Sakhanda Wire
NVDA $230.80 +0.14% MSFT $531.33 +1.67% GOOGL $353.04 +1.36% META $719.01 -0.26% AMZN $259.15 +2.00%

MarkTechPost

242 новостей · все источники

MarkTechPost

Aleph Alpha выпустила Kolibri: англо-немецкая MoE-модель с открытыми весами на 78,1 млрд параметров и лишь 3,46 млрд активных параметров

Aleph Alpha выпустила Kolibri — англо-немецкую Mixture-of-Experts-модель на 78,1 млрд параметров, которая активирует лишь 3,46 млрд параметров на токен. Она поддерживает контекст длиной 1 млн токенов и настройку усилия рассуждения для каждого запроса, а её веса FP8 по лицензии Apache 2.0 работают на одном B200 или H200.

MarkTechPost

DeepSeek Harness v0.2 представляет официальные десктопные приложения для своего агентского инструментария с открытым исходным кодом

DeepSeek выпустила официальные приложения для macOS и Windows для DeepSeek Harness v0.2 — своего агентского инструментария под лицензией MIT. Предварительная версия добавляет менеджер плагинов, проверку файлов и изменений кода, а также запланированные задачи автоматизации. Она также поддерживает модели, отличные от DeepSeek, через совместимые с OpenAI конечные точки.

MarkTechPost

Внутри NVIDIA IsaacTeleop: от отслеживания рук и контроллеров до действий роботов с графовым механизмом ретаргетинга

Узнайте, как NVIDIA IsaacTeleop преобразует отслеживание рук в XR и ввод с контроллеров движения в команды для роботов с помощью полностью реализованного на Python механизма ретаргетинга и NumPy.

MarkTechPost

Meta, OpenAI и Uber только что научили ИИ-агентов говорить первыми. А когда им следует молчать?

Коротко: Muse от Meta, Dots от OpenAI и ассистент водителя Uber делают одну ставку: агент говорит первым. Это переносит сложный вопрос с того, что ответить, на то, когда перебить, по какому каналу и с каким предложением. Классический ML и новый…

MarkTechPost

IBM предлагает Bob для самостоятельного размещения и изолированных сред: агентная разработка ПО без перемещения вашего кода

IBM сделала общедоступным самостоятельное развертывание IBM Bob — своей платформы для агентной разработки ПО. Теперь предприятия могут запускать Bob локально, в частных или суверенных облаках и в изолированных сетях. Они используют собственную модель: NVIDIA Nemotron или…

MarkTechPost

Prime Intellect запускает Prime Inference: бессерверное и резервированное обслуживание передовых открытых моделей

Prime Intellect запустила Prime Inference — совместимую с OpenAI платформу для обслуживания передовых открытых моделей на NVIDIA Blackwell. Развертывание GLM-5.3 использует Dynamo, vLLM и сжатие KV с помощью NVFP4, обслуживая 66 сессий на группу prefill при скорости 101 токен/с на пользователя.

MarkTechPost

Microsoft AI выпустила MAI-Transcribe-2-Streaming: модель №1 для распознавания речи в реальном времени по версии Artificial Analysis

Microsoft AI выпустила MAI-Transcribe-2-Streaming — свою первую модель для распознавания речи в реальном времени. Она занимает первое место среди 38 моделей в AA-WER Streaming от Artificial Analysis. Показатель WER составляет 2,5% за 0,13 с для финальных транскрипций и 2,5% за 0,12 с для первых частичных транскрипций. Охватывает 60…

MarkTechPost

Объяснение моделей Decision AI: TypeSafe Jev против Fastino GLiDE, GLiNER2.5-Decide и конкурентов с открытым исходным кодом

Модели Decision AI отвечают на типизированные вопросы с калиброванными вероятностями вместо сгенерированного текста. Jev от TypeSafe стоит $0,042 за миллион входных токенов и возвращает ответы за 70–500 миллисекунд. Мы разбираем, как он работает, и его результаты в бенчмарках, а затем сравниваем…

MarkTechPost

NVIDIA представила DGX Spark 64GB: настольную систему Grace Blackwell с производительностью 1 петафлопс для локальных ИИ-агентов, дообучения и инференса

NVIDIA представила новую конфигурацию DGX Spark с 64 ГБ — от Acer, ASUS, Dell, Gigabyte, HP и MSI — своей настольной ИИ-системы на базе GB10. Она позволяет разработчикам начать с одной системы для локальных моделей и агентов, а затем…

MarkTechPost

Datalab представляет OmniExtractBench, чтобы устранить предвзятость и непрозрачность в бенчмарках для извлечения данных

Сопоставление строк по содержимому, шесть вердиктов для каждого значения и правило для null делают OmniExtractBench бенчмарком для извлечения данных, который может проверить любой.

MarkTechPost

AWS Strands Labs выпустила Strands Decider 2B: модель принятия решений с открытым исходным кодом, выбирающая варианты примерно за 115 мс

Команда Strands Agents компании AWS выпустила Strands Decider 2B — модель принятия решений под лицензией Apache-2.0, созданную на базе Qwen3.5-2B-Base. Она за один прямой проход возвращает варианты, вероятности «да/нет» и оценки с калиброванной уверенностью, никогда не генерируя текст. Медианная задержка работы составляет 115 мс на…

MarkTechPost

Cloudflare выпустила Clef и Clef-flash: модели принятия решений с открытыми весами, возвращающие типизированные вероятности вместо текста

Cloudflare выпустила Clef (27B) и Clef-flash (9B) — модели принятия решений с открытыми весами, которые возвращают типизированные вероятности вместо текста. Они совместимы с Jev-API, принимают изображения и работают в Workers AI со средней медианной задержкой 209,3 мс и 38,8 мс соответственно.