На 1 септември OpenAI обяви, че следващият ѝ модел Astra достига прага Critical по киберсигурност - първият с такова обозначение. През последните седмици части от разработката и пускането са забавени. Най-силните кибер функции ще стигнат първо до малка група тестери.
- Critical значи, по думите на OpenAI, че с нужните инструменти Astra намира непознати дупки и пише експлойти без човек на всяка стъпка.
- На вътрешен тест с 20 скорошни уязвимости във V8 моделът е открил и използвал две нови, които сега се съобщават на поддържащите.
- На 28 август OpenAI рестартира големия цикъл на обучение, спрян след инцидента с Hugging Face.
Двайсет известни уязвимости във V8, двигателя за JavaScript. Astra трябва да ги превърне в работещи атаки. По пътя намира още две, за които никой не е знаел.
Тоя тест казва повече от стоте процента на публичния бенчмарк. За публичния самата OpenAI се опасява, че задачите са изтекли в обучението. Тук моделът намира нещо ново.
Рядко компания пише за собствения си продукт, че е на критично ниво по киберсигурност. Тук OpenAI го пише и после обяснява какво е направила, за да го пусне все пак.
Какво ще усетиш като потребител
OpenAI го казва предварително: защитите понякога ще бавят или спират и легитимна работа, включително защитна. Ако наблюдението за отклонения спре задача в ChatGPT или Codex, може да те помолят да прегледаш действието, преди да продължи. В API задачата просто спира. Това е цената на предпазителите, и е честно, че е казана преди пускането, а не след първите оплаквания.
Едно число ще гледаме, когато моделът излезе: колко често защитата спира работа, която не е атака. Деветдесет и един и половина процента отказ на атаки е силно. Колко е отказът на нормална работа, още не се знае.