we_are_coded.by CODE · Светът, декодиран
EN
OpenAI

OpenAI предлага преди всяко голямо обучение да има писмен довод за безопасност, като в авиацията

OpenAI · събитието: 28 септември 2026Контрол

В текст от 28 септември OpenAI пише, че преди да продължи всяко гранично обучение с подсилване, трябва да се изисква структурирана документация за безопасност. Компанията признава, че истински „safety cases“ като в авиацията и ядрената енергетика са цел, към която още строи.

Накратко
  • Доводът да покрива три слоя: съгласуване на модела, задържане в пясъчника и наблюдение в реално време.
  • Предложението: член на друг екип да пише писмено несъгласие, а няколко висши ръководители да имат право на вето.
  • По думите на OpenAI практиките се въвеждат в момента. Рамката, която да ги кодифицира, е план.
Проверено на1 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

В авиацията никой не пуска нов самолет с думите „според нас е наред“. Пише се довод: ето риска, ето доказателството, ето кой го е проверил и кой е подписал.

OpenAI иска същото за обучението на най-големите си модели. И го публикува в деня, в който се извинява и на Австралия. Двата текста се четат като въпрос и отговор.

Фактите: на 28 септември 2026 г. OpenAI публикува „Towards safety cases for frontier AI training“. Компанията пише, че структурирана документация за безопасност трябва да се изисква, преди да продължи всяко гранично обучение с подсилване, а в идеалния случай тя да стигне нивото на „safety cases“ от авиацията и ядрената енергетика; признава, че това е цел, към която гради, и че работи по рамка, която да кодифицира практиките. Техническата част покрива три слоя: съгласуване на модела (включително автоматичните оценители да не виждат веригата на мисълта, за да не се научи моделът да заобикаля наблюдението ѝ), задържане (многослойна защита на пясъчника и на изследователската инфраструктура, червени екипи срещу тях, ограничена връзка между паралелните копия на модела, неизменими записи на действията) и наблюдение в реално време със спешни сигнали и автоматична пауза. Оперативните предложения включват писмено несъгласие от член на друг екип, право на вето за няколко висши ръководители, лична отговорност на ръководителя на обучението и одитори с достатъчен достъп. По думите на компанията тези практики са в процес на въвеждане в OpenAI.

Две точки ми се струват по-важни от останалите. Първата е несъгласието. Преди обучението човек от друг екип пише защо доводът може да е грешен, а авторите трябва да му отговорят. Втората е отговорността: ръководителят на обучението носи довода, включително когато се оценява собствената му работа.

Довод, който никой не е опитал да събори, е презентация.

Честно е, че признават границата. Модел, който на всяко ново ниво изненадва създателите си, трудно се описва със строгостта, с която се описва турбина. Затова в текста пише „в идеалния случай“ и „цел“.

Нищо от това не е задължително за другите лаборатории, а самата OpenAI го нарича препоръки, които тепърва въвежда. Интересното ще започне в деня, в който външен одитор прочете такъв довод от край до край и каже какво липсва.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→OpenAI - Towards safety cases for frontier AI training, 28.09.2026
Оригинал: https://wearecoded.com/articles/openai-safety-cases-predi-obuchenie.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини