Sakhanda Wire
NVDA $230.80 +0.14% MSFT $531.33 +1.67% GOOGL $353.04 +1.36% META $719.01 -0.26% AMZN $259.15 +2.00%

MarkTechPost

242 новини · всички източници

MarkTechPost

Aleph Alpha представи Kolibri: 78,1-милиарден англо-германски MoE модел с отворени тегла и само 3,46 млрд активни параметри

Aleph Alpha представи Kolibri — англо-германски Mixture-of-Experts модел със 78,1 млрд параметри, който активира само 3,46 млрд параметри на токен. Той има контекст от 1 млн токена и позволява задаване на усилието за разсъждение за всяка заявка, а теглата му във формат FP8 по лиценз Apache 2.0 работят на един B200 или H200.

MarkTechPost

DeepSeek Harness v0.2 представя официални настолни приложения за своята рамка за агенти с отворен код

DeepSeek пусна официални настолни приложения за macOS и Windows за DeepSeek Harness v0.2 — своята рамка за агенти с MIT лиценз. Предварителната версия добавя мениджър на плъгини, преглед на файлове и промени в кода, както и планирани задачи за автоматизация. Тя поддържа и модели, различни от DeepSeek, чрез крайни точки, съвместими с OpenAI.

MarkTechPost

Вътре в NVIDIA IsaacTeleop: от проследяване на ръце и контролери до действия на роботи с графовия механизъм за ретаргетиране

Научете как NVIDIA IsaacTeleop превръща проследяването на ръце в XR и входа от контролери за движение в команди за роботи с помощта на изцяло Python механизъм за ретаргетиране и NumPy.

MarkTechPost

Meta, OpenAI и Uber току-що научиха AI агентите да говорят първи. А кога да мълчат?

Накратко: Muse на Meta, Dots на OpenAI и асистентът за шофьори на Uber споделят един залог: агентът говори пръв. Това премества трудния въпрос от „какво да отговори“ към това кога да прекъсне, по кой канал и с какво предложение. Класическият ML и новият…

MarkTechPost

IBM предлага Bob за самостоятелно хоствани и изолирани среди: агентна разработка на софтуер без преместване на кода ви

IBM направи общодостъпно самостоятелното разгръщане на IBM Bob — своята платформа за агентна разработка на софтуер. Сега предприятията могат да изпълняват Bob локално, в частни или суверенни облаци и в изолирани мрежи. Те използват собствен модел: NVIDIA Nemotron или…

MarkTechPost

Prime Intellect стартира Prime Inference: безсървърно и резервирано обслужване за водещи отворени модели

Prime Intellect стартира Prime Inference — платформа, съвместима с OpenAI, за обслужване на водещи отворени модели върху NVIDIA Blackwell. Разгръщането на GLM-5.3 използва Dynamo, vLLM и NVFP4 KV компресия, за да обслужва 66 сесии на prefill група при 101 токена/с на потребител.

MarkTechPost

Microsoft AI пусна MAI-Transcribe-2-Streaming: модел №1 за разпознаване на реч в реално време според Artificial Analysis

Microsoft AI пусна MAI-Transcribe-2-Streaming — първия си модел за разпознаване на реч в реално време. Той заема №1 сред 38 модела в AA-WER Streaming на Artificial Analysis. Постига WER от 2,5% за 0,13 сек. при финалните транскрипции и 2,5% за 0,12 сек. при първите частични транскрипции. Обхваща 60…

MarkTechPost

Обяснение на Decision AI моделите: TypeSafe Jev срещу Fastino GLiDE, GLiNER2.5-Decide и конкурентите с отворен код

Decision AI моделите отговарят на типизирани въпроси с калибрирани вероятности вместо с генериран текст. Jev на TypeSafe струва $0,042 на милион входни токени и връща отговори за 70 до 500 милисекунди. Разглеждаме как работи и резултатите му от сравнителните тестове, след което сравняваме…

MarkTechPost

NVIDIA обяви DGX Spark 64GB: настолен Grace Blackwell с 1 петафлоп за локални ИИ агенти, дообучаване и инференс

NVIDIA обяви нова конфигурация на DGX Spark с 64 GB — от Acer, ASUS, Dell, Gigabyte, HP и MSI — своята настолна ИИ система, базирана на GB10. Тя дава на разработчиците възможност да започнат с една система за локални модели и агенти, а след това…

MarkTechPost

Datalab представя OmniExtractBench, за да отстрани пристрастията и непрозрачността в бенчмарковете за извличане

Съпоставянето на редове по съдържание, шестте оценки за всяка стойност и правило за null превръщат OmniExtractBench в бенчмарк за извличане, който всеки може да одитира.

MarkTechPost

AWS Strands Labs пусна Strands Decider 2B: модел с отворен код за вземане на решения, който избира опции за около 115 мс

Екипът Strands Agents на AWS пусна Strands Decider 2B — модел за вземане на решения под Apache-2.0, изграден върху Qwen3.5-2B-Base. Той връща избори, вероятности за „да/не“ и оценки с калибрирана увереност при едно преминаване напред, без да генерира текст. Работи със средна латентност от 115 мс на…

MarkTechPost

Cloudflare пусна Clef и Clef-flash: модели за вземане на решения с отворени тегла, които връщат типизирани вероятности вместо текст

Cloudflare пусна Clef (27B) и Clef-flash (9B) — модели за вземане на решения с отворени тегла, които връщат типизирани вероятности вместо текст. Те са съвместими с Jev-API, приемат изображения и работят в Workers AI с медианна латентност съответно 209,3 мс и 38,8 мс.