Sakhanda Wire
NVDA $230.80 +0.14% MSFT $531.33 +1.67% GOOGL $353.04 +1.36% META $719.01 -0.26% AMZN $259.15 +2.00%

MarkTechPost

242 новин · усі джерела

MarkTechPost

Aleph Alpha випустила Kolibri: англо-німецька MoE-модель із відкритими вагами на 78,1 млрд параметрів і лише 3,46 млрд активних параметрів

Aleph Alpha випустила Kolibri — англо-німецьку Mixture-of-Experts-модель із 78,1 млрд параметрів, яка активує лише 3,46 млрд параметрів на токен. Вона має контекст у 1 млн токенів і дає змогу налаштовувати зусилля міркування для кожного запиту, а її ваги FP8 за ліцензією Apache 2.0 працюють на одному B200 або H200.

MarkTechPost

DeepSeek Harness v0.2 представляє офіційні десктопні застосунки для свого агентського інструментарію з відкритим кодом

DeepSeek випустила офіційні застосунки для macOS і Windows для DeepSeek Harness v0.2 — свого агентського інструментарію за ліцензією MIT. Попередня версія додає менеджер плагінів, перевірку файлів і змін коду, а також заплановані завдання автоматизації. Вона також підтримує моделі, відмінні від DeepSeek, через кінцеві точки, сумісні з OpenAI.

MarkTechPost

Усередині NVIDIA IsaacTeleop: від відстеження рук і контролерів до дій роботів за допомогою графового механізму ретаргетингу

Дізнайтеся, як NVIDIA IsaacTeleop перетворює відстеження рук у XR і введення з контролерів руху на команди для роботів за допомогою повністю реалізованого на Python механізму ретаргетингу та NumPy.

MarkTechPost

Meta, OpenAI та Uber щойно навчили ШІ-агентів говорити першими. А коли їм варто мовчати?

Коротко: Muse від Meta, Dots від OpenAI та асистент водія Uber роблять одну ставку: агент говорить першим. Це зміщує складне питання з того, що відповісти, на те, коли перебити, через який канал і з якою пропозицією. Класичний ML і новий…

MarkTechPost

IBM пропонує Bob для самостійного розгортання та ізольованих середовищ: агентна розробка програмного забезпечення без переміщення вашого коду

IBM зробила загальнодоступним самостійне розгортання IBM Bob — своєї платформи для агентної розробки програмного забезпечення. Тепер підприємства можуть запускати Bob локально, у приватних або суверенних хмарах та в ізольованих мережах. Вони використовують власну модель: NVIDIA Nemotron або…

MarkTechPost

Prime Intellect запускає Prime Inference: безсерверне та резервоване обслуговування передових відкритих моделей

Prime Intellect запустила Prime Inference — сумісну з OpenAI платформу для обслуговування передових відкритих моделей на NVIDIA Blackwell. Розгортання GLM-5.3 використовує Dynamo, vLLM і стиснення KV за допомогою NVFP4, обслуговуючи 66 сесій на групу prefill зі швидкістю 101 токен/с на користувача.

MarkTechPost

Microsoft AI випустила MAI-Transcribe-2-Streaming: модель №1 для розпізнавання мовлення в реальному часі за версією Artificial Analysis

Microsoft AI випустила MAI-Transcribe-2-Streaming — свою першу модель для розпізнавання мовлення в реальному часі. Вона посідає перше місце серед 38 моделей у AA-WER Streaming від Artificial Analysis. Показник WER становить 2,5% за 0,13 с для фінальних транскрипцій і 2,5% за 0,12 с для перших часткових транскрипцій. Охоплює 60…

MarkTechPost

Пояснення моделей Decision AI: TypeSafe Jev проти Fastino GLiDE, GLiNER2.5-Decide та конкурентів із відкритим кодом

Моделі Decision AI відповідають на типізовані запитання відкаліброваними ймовірностями замість згенерованого тексту. Jev від TypeSafe коштує $0,042 за мільйон вхідних токенів і повертає відповіді за 70–500 мілісекунд. Ми розбираємо, як він працює, і його результати в бенчмарках, а потім порівнюємо…

MarkTechPost

NVIDIA представила DGX Spark 64GB: настільну систему Grace Blackwell із продуктивністю 1 петафлоп для локальних ШІ-агентів, донавчання та інференсу

NVIDIA представила нову конфігурацію DGX Spark на 64 ГБ — від Acer, ASUS, Dell, Gigabyte, HP і MSI — своєї настільної ШІ-системи на базі GB10. Вона дає розробникам змогу почати з однієї системи для локальних моделей і агентів, а потім…

MarkTechPost

Datalab представляє OmniExtractBench, щоб усунути упередженість і непрозорість у бенчмарках вилучення даних

Зіставлення рядків за вмістом, шість вердиктів для кожного значення та правило для null роблять OmniExtractBench бенчмарком вилучення даних, який може перевірити кожен.

MarkTechPost

AWS Strands Labs випустила Strands Decider 2B: модель ухвалення рішень із відкритим кодом, що обирає варіанти приблизно за 115 мс

Команда Strands Agents компанії AWS випустила Strands Decider 2B — модель ухвалення рішень за ліцензією Apache-2.0, створену на базі Qwen3.5-2B-Base. Вона за один прямий прохід повертає варіанти, імовірності «так/ні» та оцінки з каліброваною впевненістю, ніколи не генеруючи текст. Медіанна затримка роботи становить 115 мс на…

MarkTechPost

Cloudflare випустила Clef і Clef-flash: моделі ухвалення рішень із відкритими вагами, що повертають типізовані ймовірності замість тексту

Cloudflare випустила Clef (27B) і Clef-flash (9B) — моделі ухвалення рішень із відкритими вагами, які повертають типізовані ймовірності замість тексту. Вони сумісні з Jev-API, приймають зображення та працюють у Workers AI із медіанною затримкою 209,3 мс і 38,8 мс відповідно.