Sakhanda Wire
NVDA $230.69 +0.09% MSFT $529.83 +1.38% GOOGL $352.15 +1.11% META $719.19 -0.24% AMZN $258.57 +1.78%

MarkTechPost

242 новостей · все источники

MarkTechPost

Mistral AI выпустила Mistral Large 4 (Le Chonk): мультимодальная MoE-модель с 1,05 трлн параметров

Mistral AI выпустила Mistral Large 4, получившую прозвище Le Chonk, в качестве публичной предварительной версии. Это модель Mixture of Experts с 1,05 трлн параметров и 49 млрд активных параметров, с нативным вводом изображений и контекстным окном на 1 млн токенов, обученная…

MarkTechPost

Reka выпустила Rho-1: омни-модель рассуждения на 19B параметров, которая понимает и генерирует видео и выдает действия для роботов в одной системе

Reka выпустила Rho-1 — омни-модель рассуждения на 19B параметров, обученную с нуля. Одна сеть читает и генерирует текст, изображения, видео и действия для роботов через общий KV-кэш. Дистиллированная версия возвращает 5,3-секундный ролик примерно за секунду. Она…

MarkTechPost

За пределами предметно-специализированных мировых моделей: JEPA-Anything использует 1 рецепт для 7 областей

JEPA-Anything разделяет единственную латентную цель JEPA на 4 ортогональных фактора, у каждого из которых есть собственный предиктор. Испытанная в 7 областях, система превзошла сопоставимые базовые модели JEPA во всех 10 задачах динамики и снизила ошибку интервенции в Interventional Pong на 34,8%.

MarkTechPost

Представляем Together Link: бесплатный CLI для запуска открытых моделей вроде Kimi K3 и GLM 5.3 внутри Claude Code, Codex и OpenCode

Together AI выпустила Together Link — бесплатный CLI с лицензией MIT, который подключает Claude Code, Codex, OpenCode, Pi и настольные приложения Claude и ChatGPT к открытым моделям вроде Kimi K3 и GLM 5.3. Для настройки достаточно одной команды установки, а…

MarkTechPost

Построение потокового конвейера обучения робототехники с использованием NVIDIA Cosmos3-DROID

Узнайте, как построить сквозной потоковый конвейер обучения робототехники на основе набора данных NVIDIA Cosmos3-DROID без локальной загрузки, используя чтение Parquet по диапазонам байтов, клонирование поведения и временное ансамблирование.

MarkTechPost

Reflection AI представила Beam: MoE-модель с открытыми весами на 501 млрд параметров, из которых 23 млрд активны, для программирования и агентных задач

Reflection AI представила Beam — свою первую модель с открытыми весами. Это разреженная Mixture-of-Experts-модель на 501 млрд параметров, из которых 23 млрд активны, созданная для программирования и работы с ИИ-агентами. По словам Reflection, по способности к рассуждению она соответствует GLM-5.2, используя в 3–4 раза меньше вычислительных ресурсов для инференса…

MarkTechPost

Yandex представляет Sona: единая генеративная модель рекомендаций, заменяющая всю каскаду рекомендаций

Один трансформер выполнял генерацию кандидатов и ранжирование в A/B-тесте Yandex Music без вручную спроектированных признаков, увеличив число отметок «Нравится» на 11,42%.

MarkTechPost

История Qwen: ИИ-модели Alibaba от 7B до 2,4T

Qwen от Alibaba прошёл путь от чат-бота с доступом только по приглашениям в апреле 2023 года до модели с открытыми весами и 2,4 трлн параметров в августе 2026 года. Это полная история, выпуск за выпуском: каждая основная модель, её ключевая особенность и изменения в её лицензии. К каждому утверждению приведена ссылка…

MarkTechPost

Может ли открытая модель заниматься исследованиями в области безопасности? apex-flash-1 от Cantina решает 40 из 60 отложенных задач по поиску уязвимостей

Cantina Security совместно с Yeta Labs выпустила apex-flash-1 — модель с открытыми весами, специально обученную для исследования уязвимостей. Это дообученная с помощью обучения с подкреплением версия GLM-5.3-Flash от Z.ai, опубликованная на Hugging Face под лицензией MIT. Можно ли ее развернуть? Да, веса MIT…

MarkTechPost

Google Research переносит федеративное обучение в TEE: Gboard теперь обучается с внешне проверяемой дифференциальной приватностью

Google Research представила систему федеративного обучения, которая переносит вычисление градиентов с телефонов в аттестируемые серверные TEE. Политики доступа публикуются в журнале Rekor от Sigstore, а бинарные файлы можно воспроизводимо собирать, поэтому централизованную дифференциальную приватность можно проверять извне.