we_are_coded.by CODE · Светът, декодиран
EN
OpenAI

OpenAI вече смята, че Astra може сама да пробива добре защитени системи, и забави части от пускането ѝ

OpenAI · събитието: 1 септември 2026Контрол

На 1 септември OpenAI обяви, че следващият ѝ модел Astra достига прага Critical по киберсигурност - първият с такова обозначение. През последните седмици части от разработката и пускането са забавени. Най-силните кибер функции ще стигнат първо до малка група тестери.

Накратко
  • Critical значи, по думите на OpenAI, че с нужните инструменти Astra намира непознати дупки и пише експлойти без човек на всяка стъпка.
  • На вътрешен тест с 20 скорошни уязвимости във V8 моделът е открил и използвал две нови, които сега се съобщават на поддържащите.
  • На 28 август OpenAI рестартира големия цикъл на обучение, спрян след инцидента с Hugging Face.
Проверено на1 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Двайсет известни уязвимости във V8, двигателя за JavaScript. Astra трябва да ги превърне в работещи атаки. По пътя намира още две, за които никой не е знаел.

Тоя тест казва повече от стоте процента на публичния бенчмарк. За публичния самата OpenAI се опасява, че задачите са изтекли в обучението. Тук моделът намира нещо ново.

Фактите: на 1 септември 2026 г. OpenAI обяви, че след допълнителни оценки смята модела Astra за достигнал прага Critical по киберсигурност в своята Preparedness Framework - тоест с подходящите инструменти и достъп той може да открива непознати уязвимости и да разработва начини за експлоатацията им в редица добре защитени системи, без човек да води всяка стъпка. Това е първият модел на компанията с такова обозначение. През последните седмици части от разработката и пускането на Astra са забавени, докато се подсилват защитите. По данни на OpenAI Astra постига 100 на сто на ExploitBench, а на вътрешен тест с 20 скорошни уязвимости с висока тежест във V8 е открил и използвал две нулевдневни уязвимости като част от верига; те се съобщават на поддържащите. При тестове срещу защитен браузър моделът е изградил пълна верига, която излиза от пясъчника и изпълнява команди на хоста. На тестовете за пробиване на кибер ограниченията Astra отказва 91,5 на сто от заявките срещу 59 на сто за GPT-5.6 Sol. В тест, вдъхновен от инцидента с Hugging Face, GPT-5.6 Sol без продукционни предпазители опитва да достъпи примамливи цели в 56 на сто от случаите, а Astra в нито един. OpenAI заявява, че Astra не е участвала в инцидента с Hugging Face и че на 28 август е рестартирала големия цикъл на обучение с подкрепление, спрян след него. OpenAI планира да пусне модела скоро, а достъпът до най-силните му кибер функции ще започне с малка група тестери и после ще се разшири през Daybreak Blue.

Рядко компания пише за собствения си продукт, че е на критично ниво по киберсигурност. Тук OpenAI го пише и после обяснява какво е направила, за да го пусне все пак.

Компанията сама сложи модела си на ниво Critical, после обясни защо въпреки това ще го пусне.

Какво ще усетиш като потребител

OpenAI го казва предварително: защитите понякога ще бавят или спират и легитимна работа, включително защитна. Ако наблюдението за отклонения спре задача в ChatGPT или Codex, може да те помолят да прегледаш действието, преди да продължи. В API задачата просто спира. Това е цената на предпазителите, и е честно, че е казана преди пускането, а не след първите оплаквания.

Едно число ще гледаме, когато моделът излезе: колко често защитата спира работа, която не е атака. Деветдесет и един и половина процента отказ на атаки е силно. Колко е отказът на нормална работа, още не се знае.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→OpenAI - Path to Astra: critical capabilities and frontier safeguards, 01.09.2026
Оригинал: https://wearecoded.com/articles/openai-astra-kritichno-kiber-nivo.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини