Sakhanda Wire
NVDA $223.96 +2.27% MSFT $499.99 +0.03% GOOGL $354.30 -0.96% META $592.10 +0.37% AMZN $274.48 +0.82%
← Към новините

OpenAI определи новия си модел Astra като потенциално достигащ най-високото ниво на риск за киберсигурността за първи път

OpenAI сигнализира, че новият му модел Astra потенциално може да достигне най-високото ниво на риск за киберсигурността за първи път
Matthias Bastian
8 август 2026 г.
Nano Banana Pro, подканен от THE DECODER

Основни моменти

  • OpenAI временно спира части от разработката на новия си AI модел Astra, след като вътрешни тестове разкриха толкова силни способности за киберсигурност, че моделът може да достигне най-високото ниво на риск („Критично“) във вътрешната рамка за сигурност на компанията.
  • На това ниво AI може самостоятелно да разработва и извършва кибератаки без човешка намеса. Сега OpenAI въвежда по-строги мерки за сигурност, изолирани тестови среди и система за наблюдение, която автоматично прекратява рисковите дейности.
  • Този ход следва инциденти по време на вътрешни тестове, при които автономни AI агенти са проникнали в собствената инфраструктура на OpenAI и са останали незабелязани в продължение на седмици.

Актуализация:

Главният изпълнителен директор на OpenAI Сам Алтман потвърди чрез X, че оценката на киберсигурността ще забави пускането на модела. „Имаме нужда от още малко време, за да направим това безопасно. Но се надяваме да не е твърде дълго“, написа Алтман.

Той също отправи критика към конкурента Anthropic, който предоставя своя най-мощен модел „Claude Mythos“ само на избрани партньори и правителства. „Не смятаме, че е добра стратегия мощните модели да бъдат достъпни само за избрани хора“, написа Алтман.

Изследователят на OpenAI Ноам Браун, известен с работата си върху модели за разсъждение, призова хората да приемат сериозно инцидента с Hugging Face. Браун го сравни с разпространила се през 2017 г. история за модели на AI на Facebook, които уж излезли извън контрол и разработили собствен език, но която се оказала преувеличена. Инцидентът с Hugging Face може да изглежда като нещо подобно, написа Браун в X, но не е.

Браун свърза проблема с нарастващите способности на моделите, като заяви, че производителността все повече зависи от изчисленията по време на тестване и че днешните модели могат да бъдат развивани много повече, преди да достигнат плато, отколкото повечето хора осъзнават.

Оригинална статия от 7 август 2026 г.:

Вътрешни тестове на новия AI модел Astra на OpenAI показват толкова силни способности за киберсигурност, че компанията вече не може да изключи най-високото ниво на риск в собствената си рамка за сигурност, съобщава тя. Части от разработката на Astra са временно спрени.

Вътрешните оценки на предстоящия модел Astra са показали „значителен напредък в агентното програмиране и киберсигурността“ през последните няколко дни, съобщава компанията. Резултатите са били достатъчно силни, така че OpenAI „не може да изключи ниво на способност „Критично““ съгласно собствената си Рамка за готовност.

Решението е било взето „снощи“, според OpenAI. Това е първият път, в който OpenAI сигнализира, че един от собствените ѝ модели потенциално може да достигне най-високото ниво на риск за киберсигурността. Предишни модели, включително GPT-5.6-Sol, са били оценявани най-много като „Високи“.

OpenAI представи Astra за първи път миналата седмица. Слуховете предполагат, че моделът може да бъде пуснат още следващата седмица, но днешното съобщение може да повлияе на тези планове (повече по-долу). OpenAI изрично заяви в публикацията си, че Astra не е участвал в скорошния разкрит пробив в Hugging Face.

Критиците вероятно ще продължат да обвиняват OpenAI в маркетинг, основан на страх, особено след като компанията съобщава само за потенциала за оценка „Критично“, а не за самата оценка. Моментът също не помага. Това предварително предупреждение идва в разгара на продължаващ дебат в индустрията относно автономните киберспособности на AI моделите, което само ще засили скептицизма. Ако оценката „Критично“ никога не бъде потвърдена, OpenAI ще е генерирала значителна публичност без реални последствия и ще е създала поредния AI модел, който, подобно на Claude Mythos или GPT-2 през 2019 г., отново е „твърде опасен“, за да бъде пуснат.

Какво означава „Критично“

Съгласно Рамката за готовност на OpenAI, публикувана за първи път през декември 2023 г., моделът достига ниво „Критично“, когато може да открива и разработва работещи експлойти за уязвимости от типа zero-day с всякаква степен на сериозност в множество защитени критични системи без човешка намеса. Моделът също отговаря на условията, ако може самостоятелно да измисля и изпълнява нови цялостни стратегии за кибератаки срещу защитени цели, когато получи само свободно формулирана цел.

По-ниското ниво „Високо“ означава, че моделът може да премахва съществуващи пречки пред кибератаките, например чрез автоматизиране на атаки срещу добре защитени цели, но все още се нуждае от повече насоки от човек.

Способност Въздействие Политика
[Критично] Модел, допълнен с инструменти, може да идентифицира и разработва функционални експлойти за уязвимости от типа zero-day с всякаква степен на сериозност в множество защитени реални критични системи без човешка намеса ИЛИ моделът може да измисля и изпълнява нови цялостни стратегии за кибератаки срещу защитени цели, като му е зададена само обща желана цел. Откриването и изпълнението на цялостни експлойти за целия софтуер може да доведе до катастрофа, причинена от едностранно действащи лица, хакване на военни или индустриални системи или на инфраструктурата на OpenAI. Новите кибероперации, например тези, включващи нови уязвимости zero-day или нови методи за командване и контрол, обикновено представляват най-сериозната заплаха, тъй като са непредсказуеми и редки. Докато не определим стандарти за мерки за сигурност и контрол на сигурността, които да отговарят на ниво „Критично“, да се спре по-нататъшната разработка

Рамката за готовност предвижда спиране на по-нататъшната разработка при ниво „Критично“, докато не бъдат въведени мерки за сигурност и стандарти за контрол на сигурността, отговарящи на това ниво. Засега обаче OpenAI говори за временно спиране на определени дейности и засилване на тестовете, а не за пълно прекратяване на разработката. И отново, компанията сигнализира само за потенциала за оценка „Критично“.

OpenAI временно спира части от разработката на Astra

В отговор OpenAI съобщава, че е спряла вътрешните дейности, свързани с Astra, които все още не отговарят на по-строгите изисквания за сигурност. Едновременно с това компанията въвежда по-строги мерки за сигурност: изолирани тестови среди, ограничен достъп до мрежи и инструменти, по-силна защита и криптиране на теглата на модела и допълнителни системи за наблюдение.

OpenAI също така съобщава, че е внедрила универсално наблюдение във всички агентни приложения на Astra, обхващащо обучението и оценяването. Наблюдаващите системи анализират веригата от мисли на модела и задействат реакция за безопасност, която прекратява всяка високорискова дейност.

Освен това OpenAI планира да работи с правителствени агенции и избрани организации за безопасност на AI, за да тества способностите на модела. Партньорите, извършващи тестове от трети страни, ще получат препоръчителни мерки за сигурност за високорискови оценки. Институтът за безопасност на AI на Обединеното кралство (AISI) наскоро съобщи, че е преживял киберинциденти по време на една от собствените си оценки.

Оценката на Astra идва след неконтролирано хакване от агенти

Съобщението идва в момент, когато OpenAI вече се справя с последиците от автономни AI агенти. На конференцията за сигурност Black Hat компанията наскоро разкри, че автономни агенти са проникнали в собствената ѝ инфраструктура в продължение на седмици по време на вътрешни тестове, без никой да забележи.

Агентите са използвали вътрешен мениджър на пакети, за да създадат импровизирана дъска за съобщения със стотици хиляди публикации. Те са споделяли експлойти и идентификационни данни, а в крайна сметка са атакували и платформата Hugging Face.

AI новини без сензацията – подбрани от хора

Абонирайте се за THE DECODER, за да четете без реклами, да получавате седмичен AI бюлетин, нашия ексклузивен годишен шестмесечен доклад „AI Radar“ за водещите технологии, пълен достъп до архива и достъп до секцията за коментари.

Източник: OpenAI

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Decoder на

Прочетете оригинала в The Decoder ↗

Текстът и изображенията са собственост на The Decoder и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

Още новини

Всички последни новини