Sakhanda Wire
NVDA — MSFT — GOOGL — META — AMZN —

MarkTechPost

246 новостей · все источники

MarkTechPost

NVIDIA AI выпустила Nemotron 3.5 Lightning: открытую MoE-модель на 30 млрд параметров с 3 млрд активных параметров и NeMo Switchyard Model Router

Открытая 30-миллиардная MoE-модель NVIDIA ориентирована на уровень выполнения задач агентами, а Switchyard направляет каждый шаг к самой дешёвой подходящей модели.

MarkTechPost

MiLM Plus от Xiaomi представляет PROVE: метрики удаления объектов RC-S и RC-T, согласованные с восприятием, и реалистичный видеобенчмарк

Модели удаления объектов развивались быстрее, чем метрики, используемые для их оценки. Диффузионные инструменты удаления теперь убедительно восстанавливают тени, отражения и закрытую структуру, однако PSNR, SSIM, LPIPS, ReMOVE и CFD часто неправильно ранжируют их результаты. Корень проблемы…

MarkTechPost

Стек видеопроизводства теперь помещается на одном столе: LTX-2.5 запускается как ускоренная NVIDIA мировая модель с открытыми весами

LTX-2.5 переносит передовую генерацию видео на локальное оборудование NVIDIA: ролики длительностью 6,8 секунды, нативный multishot, ComfyUI с первого дня, открытые веса.

MarkTechPost

Создание и валидация количественной торговой стратегии с OctoBot, walk-forward-бэктестированием, оптимизацией параметров и интерактивным анализом

В этом руководстве мы создаём полный рабочий процесс количественного бэктестирования с OctoBot и OctoBot-Script, сохраняя среду изолированной от предустановленных зависимостей Colab. Мы настраиваем торговую стратегию на основе правил, которая сочетает сигналы перепроданности RSI, подтверждение тренда с помощью EMA и адаптивный подход на основе ATR…

MarkTechPost

webAI выпустила TwIL-LM: семейство моделей формальной логики на 1,7 и 3 млрд параметров для автоформализации на локальном оборудовании

webAI выпустила TwIL-LM — семейство моделей формальной логики на 1,7 и 3 млрд параметров, которые переводят английский язык в логику первого порядка и проверяют, следуют ли выводы из посылок. Модель 3B работает на CPU или при наличии 4 ГБ VRAM; 1.7B скачивается при…

MarkTechPost

Реализация мультимодального конвейера генерации видео и аудио MiniMax-H3 с API ComfyUI

В этом подробном руководстве мы показываем, как реализовать полноценный программируемый мультимодальный конвейер генерации MiniMax-H3. Используя ComfyUI в качестве бэкенда без графического интерфейса, мы пошагово настраиваем автоматизированную среду для инференса, которая выполняет профилирование оборудования, загрузку весов модели, динамическую…

MarkTechPost

Meta AI выпустила Muse Glimmer: агентную модель с открытыми весами 30B, работающую на одной пользовательской видеокарте

Muse Glimmer от Meta — агентная модель с открытыми весами 30B под лицензией Apache 2.0. Она помещается в 24 ГБ VRAM и декодирует в 3,1 раза быстрее благодаря спекуляции DFlash.

MarkTechPost

ByteDance Seed представила SeedRealtime: нативную аудиовизуальную полнодуплексную LLM, которая смотрит, слушает и говорит в одной модели

Команда Seed компании ByteDance представила SeedRealtime — нативную аудиовизуальную полнодуплексную LLM. Модель объединяет аудио, видео и текст в единой унифицированной архитектуре. Она взаимодействует в реальном времени через непрерывные мультимодальные потоки, а не по одному ходу за раз. Seed…

MarkTechPost

NVIDIA выпустила NemotronLabs VoiceChat 11B: открытую полнодуплексную модель преобразования речи в речь со сменой реплик за ~450 мс и вызовом инструментов в реальном времени

NVIDIA выпустила NemotronLabs VoiceChat 11B — открытую полнодуплексную модель преобразования речи в речь с задержкой 448 мс и вызовом инструментов в реальном времени.

MarkTechPost

Ведущие платформы для наблюдаемости и оценки LLM в 2026 году: сравнение Langfuse, LangSmith, Braintrust, Arize и других

Проверенное сравнение платформ для наблюдаемости LLM в 2026 году, охватывающее глубину трассировки, возможности оценки, мониторинг в продакшене и ценообразование.

MarkTechPost

Анализ тональности IMDb с DistilBERT + LoRA, базовые модели TF-IDF, калибровка, интерпретируемость, тестирование устойчивости и полуобучение

В этом руководстве представлен комплексный подход к созданию устойчивого рабочего процесса анализа тональности. Сочетая классические базовые модели на основе TF-IDF с современным дообучением с эффективным использованием параметров (DistilBERT + LoRA), мы рассматриваем глубокую интерпретируемость моделей, калибровку и методы полуобучения для масштабируемого определения тональности.

MarkTechPost

Знакомьтесь: Shepherd — Python-субстрат с открытым исходным кодом, позволяющий метаагентам разветвлять, воспроизводить и отменять любой запуск агента

Длительные запуски агентов накапливают состояние, которое не фиксирует ни один транскрипт, — отредактированные файлы, работающий dev-сервер, установленные пакеты, прогретый кэш промпта. Когда агент неверно интерпретирует traceback на шаге 10 и переписывает правильный файл, исправление по ходу сжигает токены…