Sakhanda Wire
NVDA $229.28 -0.52% MSFT $535.07 +2.38% GOOGL $351.66 +0.97% META $718.67 -0.31% AMZN $262.43 +3.29%

MarkTechPost

246 новин · усі джерела

MarkTechPost

NVIDIA AI випустила Nemotron 3.5 Lightning: відкриту MoE-модель на 30 млрд параметрів із 3 млрд активних параметрів і NeMo Switchyard Model Router

Відкрита 30-мільярдна MoE-модель NVIDIA орієнтована на рівень виконання завдань агентами, а Switchyard спрямовує кожен крок до найдешевшої придатної моделі.

MarkTechPost

MiLM Plus від Xiaomi представляє PROVE: узгоджені зі сприйняттям метрики видалення об’єктів RC-S і RC-T із реалістичним відеобенчмарком

Моделі видалення об’єктів удосконалювалися швидше, ніж метрики, які використовують для їх оцінювання. Дифузійні інструменти видалення тепер переконливо відновлюють тіні, відбиття та закриту структуру, однак PSNR, SSIM, LPIPS, ReMOVE і CFD часто неправильно ранжують їхні результати. Корінь проблеми…

MarkTechPost

Стек для відеопродакшену тепер уміщується на одному столі: LTX-2.5 запускається як прискорена NVIDIA світова модель із відкритими вагами

LTX-2.5 переносить передову генерацію відео на локальне обладнання NVIDIA: 6,8-секундні кліпи, нативний multishot, ComfyUI із першого дня, відкриті ваги.

MarkTechPost

Побудова та валідація кількісної торгової стратегії з OctoBot, walk-forward-бектестуванням, оптимізацією параметрів та інтерактивним аналізом

У цьому посібнику ми створюємо повний робочий процес кількісного бектестування з OctoBot і OctoBot-Script, зберігаючи середовище ізольованим від попередньо встановлених залежностей Colab. Ми налаштовуємо торгову стратегію на основі правил, яка поєднує сигнали перепроданості RSI, підтвердження тренду за допомогою EMA та адаптивний підхід на основі ATR…

MarkTechPost

webAI представила TwIL-LM: сімейство моделей формальної логіки на 1,7 і 3 млрд параметрів для автоформалізації на локальному обладнанні

webAI випустила TwIL-LM — сімейство моделей формальної логіки на 1,7 і 3 млрд параметрів, які перекладають англійську мову в логіку першого порядку та перевіряють, чи випливають висновки з передумов. Модель 3B працює на CPU або за наявності 4 ГБ VRAM; 1.7B завантажується за…

MarkTechPost

Реалізація мультимодального конвеєра генерації відео й аудіо MiniMax-H3 за допомогою API ComfyUI

У цьому вичерпному посібнику ми показуємо, як реалізувати повний програмований мультимодальний конвеєр генерації MiniMax-H3. Використовуючи ComfyUI як бекенд без графічного інтерфейсу, ми розглядаємо налаштування автоматизованого середовища для інференсу, яке забезпечує профілювання апаратного забезпечення, завантаження ваг моделі, динамічне…

MarkTechPost

ByteDance Seed представила SeedRealtime: нативну аудіовізуальну повнодуплексну LLM, яка дивиться, слухає й говорить в одній моделі

Команда Seed компанії ByteDance представила SeedRealtime — нативну аудіовізуальну повнодуплексну LLM. Модель поєднує аудіо, відео й текст в одній уніфікованій архітектурі. Вона взаємодіє в реальному часі через безперервні мультимодальні потоки, а не по одному ходу за раз. Seed…

MarkTechPost

NVIDIA випустила NemotronLabs VoiceChat 11B: відкриту повнодуплексну модель перетворення мовлення в мовлення зі зміною реплік за ~450 мс і викликом інструментів у реальному часі

NVIDIA випустила NemotronLabs VoiceChat 11B — відкриту повнодуплексну модель перетворення мовлення в мовлення із затримкою 448 мс і викликом інструментів у реальному часі.

MarkTechPost

Провідні платформи для спостережуваності й оцінювання LLM у 2026 році: порівняння Langfuse, LangSmith, Braintrust, Arize та інших

Перевірене порівняння платформ для спостережуваності LLM у 2026 році, що охоплює глибину трасування, можливості оцінювання, моніторинг у продакшені та ціноутворення.

MarkTechPost

Аналіз тональності IMDb за допомогою DistilBERT + LoRA, базові моделі TF-IDF, калібрування, інтерпретованість, тестування стійкості та напівкероване навчання

Цей посібник містить вичерпні рекомендації зі створення стійкого робочого процесу аналізу тональності. Поєднуючи класичні базові моделі на основі TF-IDF із сучасним донавчанням з ефективним використанням параметрів (DistilBERT + LoRA), ми розглядаємо глибоку інтерпретованість моделей, калібрування та напівкеровані методи для масштабованого визначення тональності.

MarkTechPost

Знайомтеся: Shepherd — Python-субстрат із відкритим кодом, що дає змогу метаагентам розгалужувати, відтворювати й скасовувати будь-який запуск агента

Тривалі запуски агентів накопичують стан, якого не фіксує жоден транскрипт, — відредаговані файли, запущений dev-сервер, установлені пакети, прогрітий кеш промпту. Коли агент неправильно трактує traceback на кроці 10 і перезаписує правильний файл, виправлення проблеми далі спалює токени…