Оценителите на Faculty, специализираното звено на Accenture за AI, ще работят с достъп, сравним със служител: изпитват моделите, проверяват предпазителите и могат да докладват инциденти. Плаща Anthropic.
Накратко- Вграденият оценител вижда как моделите се оформят в обучението и решенията около пускането им.
- Двете компании очакват да вложат поне по 1 млрд. долара за пет години.
- Стандарти какво да виждат оценителите и как да докладват още няма, по думите на самата Anthropic.
Одитор, когото плаща одитираният. Счетоводството отдавна познава тоя проблем.
Anthropic сама пише в съобщението, че система за финансиране на независимата оценка още няма. И плаща въпреки това, с обяснение.
Фактите: на 18 септември 2026 г. Anthropic обяви партньорство с Accenture за независима вградена оценка на челните си
модели. По думите на компанията това е стъпка към ангажимента от есето на главния ѝ изпълнителен директор „We Must Pace the Frontier“. Работата ще води Faculty, специализираният бизнес на Accenture за AI, и включва атакуване и изпитване на моделите (red teaming), оценки на съгласуваността и тестове на предпазителите. Вградените оценители ще работят вътре в компанията с достъп, сравним със служител: ще виждат как моделите се оформят в обучението, ще следят решенията за разработката и пускането им, ще говорят направо със служители и ще могат да докладват инциденти. Anthropic и Accenture очакват всяка да вложи поне 1 млрд. долара в този капацитет за пет години. Anthropic плаща работата на Accenture директно, като пише, че в дългосрочен план финансирането трябва да идва от общи или държавни източници, каквито днес няма. Компанията води разговори с METR и други организации с идеална цел за пилоти с тяхно собствено финансиране. Партньорството не е изключително. Anthropic посочва, че стандарти какво да виждат вградените оценители и как да докладват още няма.
Защо въпреки това има смисъл
Външният оценител досега работеше отвън, без достъп като на служител. Вграденият вижда пътя: как моделът се оформя в обучението, решенията около пускането, разговорите с хората вътре.
Външният вижда продукта. Вграденият вижда компанията.
Слабото място се вижда в самото съобщение: парите идват от проверявания. Разговорите с METR за пилоти със собствени пари са правилната посока, но засега са разговори, без подпис и без дата.
Цялата идея ще се докаже с първия доклад, който вграденият оценител публикува и който на Anthropic не ѝ харесва. Ако такъв излезе, системата работи.
Визуалът към статията е генериран код-арт, без чужди изображения.