Sakhanda Wire
NVDA — MSFT — GOOGL — META — AMZN —
← Към новините

Decisions API на OpenAI излиза в публична бета-версия с 10 пъти по-бързи типизирани отговори

OpenAI пусна Decisions API в публична бета версия. Той превръща текстове и изображения в типизирани отговори, въз основа на които кодът ви може да взема решения. Екипът на OpenAI заявява, че OpenAI Decisions API работи около 10 пъти по-бързо от Responses API. Той е предназначен за често срещан модел: подаване на подкана към LLM, след което парсване на текста му до етикет.

Накратко

  • Размер: Броят параметри на GPT-6 Luna не е разкрит. Неговата карта на модела посочва контекстен прозорец от 1 050 000 токена.
  • Работи на: Само чрез хостван от OpenAI API, посредством POST /v1/decisions. Няма отворени тегла и възможност за самостоятелно хостване.
  • Производителност: Около 10 пъти по-бърз от Responses API, според OpenAI.
  • Най-добро: $0.10 за 1 млн. входни токена, без такси за изход, прочитане от кеша или запис в кеша.
  • Извод:
    • Най-добро: бързи, типизирани решения с вероятности.
      • Най-лошо: 1 модел, бета статус, все още няма независими оценки.

Какво представлява OpenAI Decisions API?

Decisions API е крайна точка на OpenAI, която оценява текст, изображения или и двете и връща типизирани отговори. Той не генерира проза. Заявката съдържа 3 полета: model, input и questions. Единственият поддържан модел днес е gpt-6-luna. OpenAI очаква общодостъпността да бъде през следващите седмици.

Как работи Decisions API?

Всяка заявка съдържа общи доказателства и списък с въпроси. Всеки въпрос има уникално name, тип и инструкции. Отговорът връща масив answers, индексиран по тези имена.

Кои са 3-те типа въпроси?

  • predicate: проверява условие и връща probability от 0 до 1. Пример: показва ли снимката на продукт пукнатина, разкъсване или вдлъбнатина?
  • choice: избира 1 стойност от предоставените от вас опции. Връща също така probabilities за всяка опция и поле confidence.
  • score: оценява входа спрямо подредени levels, индексирани от 0. Резултатът е среднопретеглена с вероятности стойност на индексите на нивата.

Примерът на OpenAI за степента на сериозност прави математиката конкретна. Вероятности за нивата от 0.1, 0.7 и 0.2 дават резултат 1.1. Тази стойност е между „Налично е временно решение“ и „Напълно блокирано“.

Кога вместо това трябва да използвате Structured Outputs?

OpenAI очертава ясна граница. Използвайте Decisions за вероятности, избори или оценки. Използвайте Structured Outputs, за да попълвате собствена JSON схема или да пишете обяснения. Използвайте извикване на функции, когато моделът трябва да заяви извикване на инструмент с аргументи.

Колко бърз е той и какви са доказателствата?

Документът на OpenAI твърди, че отговорите са около 10 пъти по-бързи от тези на Responses API. Материалите от DevDay посочват около 150 мс за едно решение срещу около 1,6 секунди за стандартни извиквания към Luna. OpenAI не е публикувала данни за точността или калибрирането на крайната точка. Документацията препоръчва праговете да се задават с етикетирани примери от собственото ви приложение.

Колко струва и къде можете да го внедрите?

При gpt-6-luna входът струва $0.10 за 1 млн. токена. Няма такси за изходни токени, прочитане от кеша или запис в кеша. Все още се прилагат премии за регионална обработка и множители за дълъг контекст. Картата на модела Luna посочва, че подканите над 272 хил. токена се таксуват с двойни входни ставки.

  • Крайна точка: POST /v1/decisions в OpenAI API, както и Playground.
  • Минимални версии на SDK: Python 3.26.0, JavaScript 7.30.0, Go 3.73.0, Ruby 0.101.0, Java 4.78.0.
  • Съответствие: Zero Data Retention и HIPAA за отговарящи на условията клиенти.
  • Местоположение на данните: Съединените щати и Европа (ЕИП плюс Швейцария).
  • Глас: решенията могат да задействат действия чрез делегиране от клиента с Live API.

Как се сравнява с TypeSafe Jev?

Най-близкият конкурент е TypeSafe Jev, пуснат на 15 септември 2026 г. Jev е модел System One, който връща типизирани стойности с калибрирани вероятности. TypeSafe таксува входа с $0.042 за 1 млн. токена, а изходът е безплатен. Това прави базовата тарифа на OpenAI около 2,4 пъти по-висока. TypeSafe отчита от 70 до 500 мс от край до край, измерени от западното крайбрежие на САЩ. Jev поддържа до 255 избора, но все още е в ранен достъп. Предимствата на OpenAI са въвеждането на изображения, опциите за съответствие и отвореният бета достъп.

ФункцияOpenAI Decisions APITypeSafe Jev 1.13GPT-6 Luna чрез Responses API
ПусканеБета, 6 октомври 2026 г.Ранен достъп, 15 септември 2026 г.Общодостъпен, 22 септември 2026 г.
Базов моделgpt-6-lunaJev (модел System One)gpt-6-luna
ПараметриНе са разкритиНе са разкритиНе са разкрити
ВходТекст, изображения (вграден base64)Текст и структурирано състояниеТекст, изображения
ИзходВероятност, избор или оценкаТипизирани стойности с вероятностиГенериран текст (JSON чрез Structured Outputs)
Макс. брой опции на въпросНе е разкритДо 255Неприложимо
Скорост (посочена от доставчика)Около 10 пъти по-бърз от Responses APIОт 70 до 500 мс от край до крайБазова стойност
Цена на входа за 1 млн. токена$0.10$0.042$0.10
Цена на изхода за 1 млн. токена$0$0$0.50
СъответствиеZDR, HIPAA (за отговарящи на условията); местоположение на данните в САЩ и ЕСНе е разкритоНалично е местоположение на данните в ЕС

Основни изводи

  • OpenAI Decisions API връща вероятности, избори и оценки, а не проза.
  • Входът струва $0.10 за 1 млн. токена; изходът е безплатен.
  • OpenAI твърди, че е около 10 пъти по-бърз от Responses API.
  • TypeSafe Jev е по-евтин — $0.042 за 1 млн. входни токена.

Вижте техническите подробности тук. Цялата заслуга е за изследователя на този проект. Също така можете да ни последвате в Twitter и не забравяйте да се присъедините към нашия 150k+ ML SubReddit и да се абонирате за нашия бюлетин. Чакайте! В Telegram ли сте? сега можете да се присъедините към нас и в Telegram.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от MarkTechPost на

Прочетете оригинала в MarkTechPost ↗

Текстът и изображенията са собственост на MarkTechPost и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини