Sakhanda Wire
NVDA — MSFT — GOOGL — META — AMZN —

MarkTechPost

242 новин · усі джерела

MarkTechPost

Google Cloud запускає Gemini Agent — універсального агента для корпоративної роботи

Google Cloud представила агента Google Cloud Gemini — єдиного агента для корпоративної роботи. Gemini Agent — це розміщений у хмарі агент від Google Cloud, який відповідає на запитання, виконує інтелектуальну роботу, створює медіаконтент, пише та запускає код. Він…

MarkTechPost

Посібник Google Research з RRSI: опанування агентів ШІ, що самовдосконалюються

Ознайомтеся з вичерпним посібником Google Research із програмування для RRSI (регуляризованого рекурсивного самовдосконалення), який пояснює, як смуги шуму, правила витрат і перевірки витоків забезпечують безпечних, ефективних і самовдосконалюваних агентів ШІ.

MarkTechPost

JetBrains представила Mellum2.1: відкриту MoE-модель на 12 млрд параметрів для агентів програмування

JetBrains представила Mellum2.1 — модель міркувань з архітектурою mixture-of-experts на 12 млрд параметрів і 2,5 млрд активних параметрів, поширювану за ліцензією Apache 2.0. Навчання з підкріпленням на реальних репозиторіях підвищило її результат у SWE-bench Verified з 2,0 до 47,0.

MarkTechPost

Architect запускає Liquid Inference — аукціон у реальному часі для інференсу LLM

Architect Financial Technologies запустила Liquid Inference — маршрутизатор LLM, який проводить аукціон у реальному часі для кожного запиту. Liquid Inference — це маркетплейс інференсу LLM від Architect, де провайдери пропонують ціни за обробку кожного промпту. Покупець платить за найнижчою пропозицією…

MarkTechPost

NVIDIA PivotOPD навчає багатоходових ШІ-агентів виправляти критичні помилки

Дослідники NVIDIA представили PivotOPD — метод дистиляції за поточною політикою, який навчає багатоходових LLM-агентів уникати ранніх критичних помилок і відновлюватися після них, продемонструвавши найкращий середній результат порівняно з 13 базовими методами на 3 бенчмарках для агентів.

MarkTechPost

Perplexity AI випускає pplx-embed-v2-late: edge-модель на 0,6B параметра та модель на 9B параметрів із результатом 92,4% на MADQA

pplx-embed-v2-late від Perplexity доступна у 2 розмірах: модель на 0,6B параметра, створена для роботи на edge-пристроях, і модель на 9B параметрів для побудови високоякісних індексів. Найкращий результат становить 92,4% на MADQA, а найслабший — 61,2% на ViDoRe v3 Markdown. Обидві…

MarkTechPost

Що відбувається, коли довірений репозиторій моделей змінюється? Unsloth Studio перевіряє його повторно перед запуском

Огляд безпеки Unsloth від 6 жовтня пояснює, як Studio перевіряє код, ваги, пакети та інструменти, перш ніж щось запустити. Користувацький код моделі сканується, а схвалення прив’язується до його відбитка. Позначені файли ваг блокуються під час завантаження, а виявлені проблеми у вмісті пакетів…

MarkTechPost

Liquid AI випускає моделі з відкритими вагами d1-3B і d1-omni-600M: мультимодальні моделі ухвалення рішень із нульовою кількістю вихідних токенів

Liquid AI випустила Open d1 — дві мультимодальні моделі з відкритими вагами із сімейства моделей ухвалення рішень d1. d1-3B обробляє текст і зображення. d1-omni-600M обробляє текст із зображенням або текст з аудіо. Жодна з моделей не генерує текст. Кожна повертає калібровані типізовані відповіді…

MarkTechPost

Meta AI відкрила вихідний код Rebalancer: C++-розв’язувача, який обробляє близько 40 мільйонів задач розміщення на день

Meta відкрила вихідний код Rebalancer — бібліотеки на C++ і Python, яку компанія використовує понад 9 років для розміщення шардів, серверів і трафіку. Вона обробляє близько 40 мільйонів задач розподілу на день, використовуючи локальний пошук або MIP-розв’язувачі на кшталт Gurobi, FICO…

MarkTechPost

Посібник розробника з Laya: рішення zero-shot і калібрування

Ознайомтеся з вичерпним посібником із програмування на Laya — рушії з відкритим кодом для рішень zero-shot. Дізнайтеся, як реалізувати типізовані рішення, налаштувати користувацькі температури та створити надійні механізми утримання від рішення на основі реальних банківських даних CLINC150.