Sakhanda Wire
NVDA $229.57 -0.39% MSFT $534.30 +2.24% GOOGL $351.78 +1.00% META $722.98 +0.29% AMZN $260.18 +2.41%

MarkTechPost

242 новин · усі джерела

MarkTechPost

Supersonic Labs випустила Julia 1: відкриту модель ухвалення рішень зі 144,3 млн параметрів, що працює на CPU

Supersonic Labs випустила Julia 1 — модель ухвалення рішень зі 144,3 млн параметрів, побудовану на основі mmBERT-small. Вона приймає контекст, запитання та від 2 до 20 варіантів, а потім повертає один вибір із імовірностями. Модель працює на CPU і поширюється за ліцензією Apache 2.0.…

MarkTechPost

Exa запускає Agent Ultra: API для глибоких досліджень із роєм субагентів, створене для вичерпного складання списків

Exa випустила Agent Ultra — режим із найвищим рівнем зусиль у своєму Exa Agent API. Він координує субагентів у тисячах джерел для складання списків і збагачення даних про сутності. Exa повідомляє, що перевершує Opus 5.5, GPT-6 Astra та Perplexity Agent за 4…

MarkTechPost

Наскрізний бенчмарк мультимодальної аугментації даних і стійкості до змагальних атак з AugLy для зображень, тексту, аудіо та PyTorch

Дізнайтеся, як побудувати комплексний робочий процес мультимодальної аугментації та оцінювання стійкості до змагальних атак за допомогою AugLy для наборів даних із зображеннями, текстом, аудіо та PyTorch.

MarkTechPost

Liquid AI випустила LFM2.5-VL-3B-DSpark: спекулятивне декодування для візуально-мовних моделей із прискоренням до 3,13 раза

Liquid AI випустила LFM2.5-VL-3B-DSpark — чернеткову модель із 279,5 млн параметрів, яка додає спекулятивне декодування до її візуально-мовної моделі LFM2.5-VL-3B. Вона забезпечує до 3,13 раза швидше декодування на Apple M5 Max і до 2,66 раза на H100 за ідентичного результату в режимі жадібного декодування. Підтримка…

MarkTechPost

Aikido Security випускає Altar-1: модель безпеки з відкритими вагами, зменшена з GLM-5.3 до 328 ГБ

Aikido Security випустила Altar-1 — свою першу модель безпеки з відкритими вагами. Це стиснена версія GLM-5.3 від Z.AI, створена для роботи в інфраструктурі, контрольованій клієнтом. Altar-1 працює в Aikido Machine — автономному пристрої компанії для пентестингу в локальних та ізольованих мережах.…

MarkTechPost

Perplexity навчає свого комп’ютерного агента на реальних помилках за допомогою самодистиляції під керуванням підказок

Perplexity Research опублікувала нове дослідження з донавчання. У ньому модель навчають усередині Perplexity Computer на реальних користувацьких сесіях, зокрема невдалих. Метод поєднує тонке налаштування з вибіркою відхилень і самодистиляцію під керуванням підказок. У реальному A/B-тесті кількість невдалих викликів інструментів зменшилася з 2,24%…

MarkTechPost

Fastino випустила GLiNER2.5-Decide: модель ухвалення рішень із відкритими вагами та 340 млн параметрів, що працює на CPU

Fastino Labs випустила GLiNER2.5-Decide — модель ухвалення рішень із відкритими вагами та 340 млн параметрів. Вона приймає текст і схему типізованих запитань та повертає структуровані відповіді. Кожна відповідь супроводжується розподілом імовірностей, оцінкою впевненості й метаданими щодо здійсненності обмежень. Модель орієнтована на часте…

MarkTechPost

Black Forest Labs випустила FLUX 3 Action: 7B-модель дій у світі з відкритими вагами, що перевершує RoboLab-120

Black Forest Labs (BFL), лабораторія, що створила моделі зображень FLUX, випустила FLUX 3 Action. Це 7B-модель дій у світі (WAM) з відкритими вагами для керування роботами. Модель зчитує кадри з камери, стан робота й текстову інструкцію. Вона…

MarkTechPost

BottleCap AI випустила ThinkingCap-Qwen3.8-27B: на 37,2% менше токенів міркування ціною зниження точності на 0,86 в.п.

BottleCap AI випустила ThinkingCap-Qwen3.8-27B — донавчену версію Qwen3.8-27B, яка використовує на 37,2% менше токенів міркування у 12 бенчмарках. Макроточність змінилася з 86,65% до 85,79%, а AA-LCR у довгому контексті покращився на 2,25 в.п. Модель є прямою заміною у vLLM і…

MarkTechPost

Contrastive-LM випустила CLM-8B: відкриту модель System One, що оцінює дії агентів до 9 разів швидше за Jev

Contrastive-LM випустила CLM-8B — відкриту модель System One, яка оцінює дії-кандидати щодо стану, а не генерує текст. Вона додає 2 невеликі проекційні голови до замороженого енкодера Qwen3-8B і навчає їх за допомогою контрастивної цільової функції InfoNCE. У…

MarkTechPost

Посібник із програмування TypeSafe AI Jev: типізовані рішення, калібрована впевненість і спекулятивне розгалуження з моделлю System One

Цей посібник містить повний опис програмування Jev від TypeSafe AI — моделі System One, призначеної для нетекстових структурованих суджень. У ньому розглянуто встановлення офіційного Python SDK, використання примітивних типів запитань (Choice, Score, Noul), реалізацію спекулятивного розгалуження, маршрутизацію з урахуванням рівня впевненості та…

MarkTechPost

Google випустила Gemini 3.8 Flash TTS і Flash-Lite TTS зі створенням голосів за підказками

Google випустила Gemini 3.8 Flash TTS і Flash-Lite TTS — 2 нові моделі перетворення тексту на мовлення, уже доступні через Gemini API та Google AI Studio. Flash TTS створює нові голоси за підказками природною мовою більш ніж 100 мовами. Модель посідає перше місце в…