Sakhanda Wire
NVDA $230.69 +0.09% MSFT $529.83 +1.38% GOOGL $352.15 +1.11% META $719.19 -0.24% AMZN $258.57 +1.78%

MarkTechPost

242 новин · усі джерела

MarkTechPost

Mistral AI представила Mistral Large 4 (Le Chonk): мультимодальну MoE-модель із 1,05 трлн параметрів

Mistral AI представила Mistral Large 4, яку прозвали Le Chonk, як публічну попередню версію. Це модель Mixture of Experts із 1,05 трлн параметрів і 49 млрд активних параметрів, із нативним введенням зображень і контекстним вікном на 1 млн токенів, навчена…

MarkTechPost

Reka представила Rho-1: омні-модель міркування на 19B параметрів, яка розуміє та генерує відео й видає дії для роботів в одній системі

Reka представила Rho-1 — омні-модель міркування на 19B параметрів, навчену з нуля. Одна мережа читає та генерує текст, зображення, відео й дії для роботів через спільний KV-кеш. Дистильована версія повертає 5,3-секундний ролик приблизно за секунду. Вона…

MarkTechPost

Поза межами предметно-специфічних світових моделей: JEPA-Anything використовує 1 рецепт для 7 сфер

JEPA-Anything розділяє єдину латентну ціль JEPA на 4 ортогональні фактори, кожен із власним предиктором. Протестована у 7 сферах, система перевершила зіставні базові моделі JEPA в усіх 10 завданнях із динаміки та зменшила помилку інтервенції в Interventional Pong на 34,8%.

MarkTechPost

Представляємо Together Link: безплатний CLI для запуску відкритих моделей на кшталт Kimi K3 і GLM 5.3 у Claude Code, Codex та OpenCode

Together AI випустила Together Link — безплатний CLI за ліцензією MIT, який підключає Claude Code, Codex, OpenCode, Pi і десктопні застосунки Claude та ChatGPT до відкритих моделей на кшталт Kimi K3 і GLM 5.3. Для налаштування достатньо однієї команди встановлення, а…

MarkTechPost

Побудова потокового конвеєра навчання роботів із використанням NVIDIA Cosmos3-DROID

Дізнайтеся, як побудувати наскрізний потоковий конвеєр навчання роботів на основі набору даних NVIDIA Cosmos3-DROID без локального завантаження, використовуючи зчитування Parquet за діапазонами байтів, клонування поведінки та часове ансамблювання.

MarkTechPost

Reflection AI представила Beam: MoE-модель із відкритими вагами на 501 млрд параметрів, 23 млрд з яких активні, для програмування та агентних задач

Reflection AI представила Beam — свою першу модель із відкритими вагами. Це розріджена Mixture-of-Experts-модель на 501 млрд параметрів, 23 млрд з яких активні, створена для програмування та роботи з ШІ-агентами. За словами Reflection, за здатністю до міркування вона відповідає GLM-5.2, використовуючи в 3–4 рази менше обчислювальних ресурсів для інференсу…

MarkTechPost

Історія Qwen: ШІ-моделі Alibaba від 7B до 2,4T

Qwen від Alibaba пройшов шлях від чатбота, доступного лише за запрошеннями у квітні 2023 року, до моделі з відкритими вагами та 2,4 трильйона параметрів у серпні 2026 року. Це повна історія, реліз за релізом: кожна основна модель, її ключова особливість і те, як змінювалася її ліцензія. До кожного твердження додається посилання…

MarkTechPost

Чи може відкрита модель проводити дослідження безпеки? apex-flash-1 від Cantina розв’язує 40 із 60 відкладених завдань із пошуку вразливостей

Cantina Security спільно з Yeta Labs випустила apex-flash-1 — модель із відкритими вагами, спеціально навчену для дослідження вразливостей. Це донавчена за допомогою навчання з підкріпленням версія GLM-5.3-Flash від Z.ai, опублікована на Hugging Face за ліцензією MIT. Чи можна її розгорнути? Так, ваги MIT…

MarkTechPost

Google Research переносить федеративне навчання в TEE: Gboard тепер навчається з диференційною приватністю, яку можна перевірити зовні

Google Research представила систему федеративного навчання, яка переносить обчислення градієнтів із телефонів в атестовані серверні TEE. Політики доступу публікуються в журналі Rekor компанії Sigstore, а бінарні файли можна відтворювано збирати, тож централізовану диференційну приватність можна перевіряти зовні.