we_are_coded.by CODE · Светът, декодиран
EN
OpenAI

OpenAI ще слага воден знак в текста на ChatGPT в ЕС и сама казва колко лесно той се губи

OpenAI · събитието: 5 октомври 2026Контрол

От 5 октомври клиентите на API могат да включат знака за избрани модели; по подразбиране е изключен. В ChatGPT и Codex в ЕС, по думите на OpenAI, идва през следващите седмици. По нейните тестове при 10% думи, заменени със синоними, разпознаването пада от около 92% на 66%.

Накратко
  • 5 октомври 2026: OpenAI обяви текстов воден знак (textGrain) в отговор на EU AI Act. В API е по избор за избрани модели; в ChatGPT и Codex само в ЕС, през следващите седмици.
  • По данни на OpenAI при 1% фалшиви положителни: около 80% разпознаване на пасаж от 200 токена и около 95% от 400, за психология; значително по-ниско при математика.
  • По същите тестове замяна на 10% от думите със синоними сваля разпознаването от около 92% на 66%, на 25% - до 17%. Детекторът засега не е публичен: само одобрени изследователи и експертни организации.
Проверено на7 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Смени всяка десета дума със синоним и знакът на OpenAI се открива в около 66% от случаите вместо в около 92%. Смени всяка четвърта и остават около 17%. Числата са на самата OpenAI, за пасажи от 400 токена.

Фактите: на 5 октомври 2026 г. OpenAI публикува подхода си към текстовия воден знак в отговор на EU AI Act. От същия ден клиентите на API по света могат да включат воден знак за избрани модели; по подразбиране той остава изключен. През следващите седмици OpenAI ще добави невидим воден знак към подходящия текстов изход на ChatGPT и Codex във всички планове, само в Европейския съюз; глобален знак по подразбиране при старта няма. Технологията, textGrain, добавя невидим статистически сигнал към избора на думи, а детекторът търси този сигнал. По данни на OpenAI textGrain е съвпаднал или надминал другите тествани подходи, включително SynthID за текст. При целеви дял фалшиви положителни от 1% детекторът открива знака в около 80% от пасажите от 200 токена и в около 95% от тези от 400, за съдържание като психология; при математика, където изборът на думи е по-тесен, откриването е значително по-ниско. Замяната на 10% от думите със синоними сваля разпознаването в пасаж от 400 токена от около 92% на 66%, а на 25% - на 17%. По данни на OpenAI знакът не променя значимо резултатите на модела Astra по бенчмарковете им, например 49,57 пункта без знак и 49,76 със знак на Artificial Analysis Intelligence Index. Детекторът не е публичен: заявки могат да подават изследователи и експертни организации, а достъп получават одобрените, първоначално за всеки случай поотделно, в съответствие с Кодекса за добри практики за прозрачност на генерираното от AI съдържание. Всичко това е само за текст; инструментите за картинки и аудио, openai.com/verify и Content Provenance API, остават публични. Член 50, параграф 2 от Регламент (ЕС) 2024/1689 изисква доставчиците на AI системи, които генерират синтетично аудио, изображение, видео или текст, да гарантират, че изходът е маркиран в машинночетим формат и разпознаваем като изкуствено генериран или променен; техническите решения трябва да са ефективни, оперативно съвместими, сигурни и надеждни, доколкото това е технически осъществимо. Член 50 се прилага от 2 август 2026 г. (член 113). За системи, пуснати на пазара преди тази дата, срокът за параграф 2 е 2 декември 2026 г. (член 111, параграф 4, добавен с Регламент (ЕС) 2026/1744).

Гривната на входа се проверява за секунда и никой не я пренаписва със синоними. Текстът се пренаписва.

Липсата на знак не доказва, че текстът е писал човек.

Това изречение е на OpenAI и е най-ценното на страницата. Знакът не мери колко човек е вложил, не доказва кой е собственикът и не сочи потребителя, нито казва дали текстът е верен. Може да покаже най-много, че система на OpenAI е генерирала или обработила част от пасажа.

Законът иска решения, които са сигурни и надеждни, „доколкото това е технически осъществимо“. Колко е осъществимо, OpenAI показва със собствените си числа: около 95% за пасаж от 400 токена в психологията, значително по-малко за математика и за редактиран текст. Дали това е достатъчно за член 50, не решаваме ние.

Превключвателят в API-то е у теб и по подразбиране е изключен. Преди да обещаеш на клиент, че текстът ти е „маркиран“, прочети раздела на OpenAI за това какво знакът не казва.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→OpenAI - Our approach to EU text provenance rules, 05.10.2026→EUR-Lex - Регламент (ЕС) 2024/1689, член 50, параграф 2 и член 113→EUR-Lex - Регламент (ЕС) 2024/1689, консолидиран текст към 27.07.2026, член 111, параграф 4→Европейска комисия - Code of Practice on Transparency of AI-generated Content
Оригинал: https://wearecoded.com/articles/openai-voden-znak-tekst-eu-ai-act.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини