Sakhanda Wire
NVDA — MSFT — GOOGL — META — AMZN —

MarkTechPost

242 новостей · все источники

MarkTechPost

Google Cloud запускает Gemini Agent — универсального агента для корпоративной работы

Google Cloud представила агента Google Cloud Gemini — единого агента для корпоративной работы. Gemini Agent — размещённый в облаке агент от Google Cloud, который отвечает на вопросы, выполняет интеллектуальную работу, создаёт медиаконтент, пишет и запускает код. Он…

MarkTechPost

Руководство Google Research по RRSI: освоение самоулучшающихся ИИ-агентов

Изучите подробное руководство Google Research по программированию для RRSI (регуляризованного рекурсивного самоулучшения), в котором объясняется, как полосы шума, правила стоимости и проверки на утечки обеспечивают безопасных, эффективных и самоулучшающихся ИИ-агентов.

MarkTechPost

JetBrains выпустила Mellum2.1: открытую MoE-модель на 12 млрд параметров для агентов программирования

JetBrains выпустила Mellum2.1 — модель рассуждений с архитектурой mixture-of-experts на 12 млрд параметров и 2,5 млрд активных параметров, распространяемую по лицензии Apache 2.0. Обучение с подкреплением на реальных репозиториях повысило её результат в SWE-bench Verified с 2,0 до 47,0.

MarkTechPost

Architect запускает Liquid Inference — аукцион в реальном времени для инференса LLM

Architect Financial Technologies запустила Liquid Inference — маршрутизатор LLM, который проводит аукцион в реальном времени для каждого запроса. Liquid Inference — это маркетплейс инференса LLM от Architect, где провайдеры предлагают цены за обработку каждого промпта. Покупатель платит по самому низкому предложению…

MarkTechPost

NVIDIA PivotOPD учит многоходовых ИИ-агентов исправлять критические ошибки

Исследователи NVIDIA представили PivotOPD — метод дистилляции по текущей политике, который обучает многоходовых LLM-агентов избегать ранних критических ошибок и восстанавливаться после них, показав лучший средний результат среди 13 базовых методов на 3 бенчмарках для агентов.

MarkTechPost

Perplexity AI выпускает pplx-embed-v2-late: edge-модель с 0,6B параметра и модель на 9B параметров с результатом 92,4% на MADQA

pplx-embed-v2-late от Perplexity выпускается в 2 размерах: модель на 0,6B параметра, предназначенная для работы на edge-устройствах, и модель на 9B параметров для создания высококачественных индексов. Лучший результат составляет 92,4% на MADQA, а худший — 61,2% на ViDoRe v3 Markdown. Обе…

MarkTechPost

Что происходит, когда доверенный репозиторий моделей меняется? Unsloth Studio перепроверяет его перед запуском

Обзор безопасности Unsloth от 6 октября объясняет, как Studio проверяет код, веса, пакеты и инструменты до того, как что-либо запустится. Пользовательский код модели сканируется, а одобрение привязывается к его отпечатку. Помеченные файлы весов блокируются при загрузке, а обнаруженные проблемы в содержимом пакетов…

MarkTechPost

Liquid AI выпускает модели с открытыми весами d1-3B и d1-omni-600M: мультимодальные модели принятия решений с нулевым числом выходных токенов

Liquid AI выпустила Open d1 — две мультимодальные модели с открытыми весами из семейства моделей принятия решений d1. d1-3B обрабатывает текст и изображения. d1-omni-600M обрабатывает текст с изображением или текст с аудио. Ни одна из моделей не генерирует текст. Каждая возвращает калиброванные типизированные ответы…

MarkTechPost

Meta AI открыла исходный код Rebalancer: решатель задач на C++, обрабатывающий около 40 миллионов задач размещения в день

Meta открыла исходный код Rebalancer — библиотеки на C++ и Python, которую компания использует более 9 лет для размещения шардов, серверов и трафика. Она обрабатывает около 40 миллионов задач распределения в день, используя локальный поиск или MIP-решатели, такие как Gurobi, FICO…

MarkTechPost

Руководство разработчика по Laya: решения zero-shot и калибровка

Изучите подробное руководство по программированию на Laya — движке с открытым исходным кодом для решений zero-shot. Узнайте, как реализовать типизированные решения, настроить пользовательские температуры и создать надежные механизмы отказа от решения на основе реальных банковских данных CLINC150.