Sakhanda Wire
NVDA — MSFT — GOOGL — META — AMZN —

MarkTechPost

242 новин · усі джерела

MarkTechPost

NVIDIA випустила Nemotron 3 Diarization: модель із відкритими вагами та 100 млн параметрів, яка відстежує 8 мовців у реальному часі

NVIDIA випустила Nemotron 3 Diarization — модель діаризації мовців із відкритими вагами на Hugging Face. Вона відповідає на одне запитання про будь-яку розмову: хто й коли говорив. Модель зі 100 млн параметрів відстежує до 8 мовців, зокрема коли голоси накладаються. Одна контрольна точка обробляє обидва…

MarkTechPost

Nokia відкрила вихідний код AnyJev: шар без навчання, що перетворює будь-яку відкриту LLM на калібровану модель ухвалення рішень

Команда прикладних досліджень Nokia відкрила вихідний код AnyJev — бібліотеки Python, що перетворює відкриту LLM на модель ухвалення рішень. Навчання не потрібне. Вона призначена для поширеного виробничого завдання: вибору однієї відповіді з фіксованого набору замість написання…

MarkTechPost

Kyutai випустила Voice of Reason: мовленнєву модель, яка розв’язує усні математичні задачі за допомогою навчання з підкріпленням

Kyutai випустила Voice of Reason — 2 моделі з відкритими вагами для перетворення мовлення в мовлення, побудовані на базі GLM-4-Voice-9B. Доопрацювання з учителем і навчання з підкріпленням підвищили точність розв’язання усно сформульованих задач GSM8K із 27,3% до 77,1%. Етап транскрипції відсутній, а текстова LLM у процесі не використовується. Обидва чекпойнти…

MarkTechPost

OpenAI випускає GPT-6 Sol і Luna: ціни на API на 50% нижчі, результати бенчмарків

OpenAI випустила GPT-6 Sol і GPT-6 Luna — дві дешевші моделі, навчені за допомогою методів, подібних до GPT-6 Astra. Sol коштує $2/$10, а Luna — $0,10/$0,50 за 1 млн токенів. Обидві моделі вже доступні в API, ChatGPT Work і Codex. Вони виходять…

MarkTechPost

SpeakON розпочала постачання голосової AI-кнопки MagSafe із власним мікрофоном

Голосове введення на телефонах вирішене вже багато років. Невирішеним залишається виведення. Ви говорите в більшості інструментів для диктування — і отримуєте назад саме те, що сказали, включно зі словами-паразитами та хибними початками, у нотатці, яку потім…

MarkTechPost

SpeakON випускає кнопку голосового ШІ з MagSafe і власним мікрофоном: перетворює голос на відшліфовану комунікацію та дії в застосунках

Голосове введення на телефонах вирішене вже багато років. Але результат досі залишається невирішеною проблемою. Продиктуйте текст у більшості інструментів для диктування — і отримаєте саме те, що сказали, зокрема слова-паразити та невдалі початки, у нотатці, яку потім…

MarkTechPost

Anthropic випускає Claude Opus 5.5: продуктивність на рівні Fable 5.1 за вартості роботи на 40% нижчої, ніж у Opus 5

Anthropic випустила Claude Opus 5.5 — першу модель нового сімейства Claude 5.5. У компанії заявляють, що за більшістю завдань вона працює на рівні Claude Fable 5.1. Її експлуатація також коштує на 40% дешевше, ніж Opus 5…

MarkTechPost

NVIDIA представляє SoL-Pi: цикли автоматизованих досліджень скорочують трафік токенів кодерів до 49%

Дослідники NVIDIA випустили SoL-Pi — 4 механізми обв’язки для відкритого кодера Pi, виявлені ШІ, який проводив цикли автоматизованих досліджень у 535 середовищах. У EdgeBench SoL-Pi скорочує трафік токенів на 44,7–49,0%, а витрати на API — приблизно на 33%,…

MarkTechPost

SpaceXAI випустила Grok 4.7: більша базова модель за тією самою ціною $2/$6, що й Grok 4.6

SpaceXAI випустила Grok 4.7, свою нову флагманську модель для програмування, агентних завдань і роботи зі знаннями. Grok 4.7 побудована на більшій базовій моделі та довшому циклі навчання з підкріпленням. Вона й надалі постачається за тією самою ціною та з тією самою швидкістю…

MarkTechPost

Команда AWS Strands Agents випустила Strands Harness: відкритий фреймворк для агентів із на 28% нижчими витратами токенів за порівнянної точності

Багато розробників виявляють, що ідея агента працює в Claude Code або Codex, але починає давати збої, коли вони відтворюють її за допомогою власного циклу. Команда Strands Agents в AWS прагне усунути цю прогалину за допомогою Strands Harness — повністю зібраного універсального…

MarkTechPost

Alibaba Qwen випустила Qwen-Image-2.1: модель із відкритими вагами на 7B параметрів для генерації та редагування зображень

Команда Qwen компанії Alibaba випустила Qwen-Image-2.1 — дифузійний трансформер на 7B параметрів, що підтримує генерацію зображень із тексту, редагування з кількома референсами та нативну прозорість RGBA в одному чекпойнті. Префіксний KV-кеш пришвидшує редагування з використанням до 10 референсних зображень. Ваги опубліковано,…