we_are_coded.by CODE · Светът, декодиран
EN
OpenAI

OpenAI: хора, свързани с Moonshot AI, са опитвали да източат скритите разсъждения на моделите ѝ

OpenAI · събитието: 30 септември 2026Контрол

На 30 септември OpenAI съобщи, че е прекъснала координирана кампания за враждебна дестилация, започнала на 1 юли. Ядрото на активността компанията приписва на лица, свързани с Moonshot AI, разработчика на Kimi. Криптиране не е разбито. Пряк достъп до съхранени разговори на потребители не е имало.

Накратко
  • Пиковете са на 24 и 25 юли: 16 000 заявки от над 4000 потребители. Свързан клъстер от над 15 000 потребители е прекъснат до 28 юли.
  • OpenAI уточнява, че числата са за опити, не непременно за успешни извличания.
  • Затворен е път, по който чуждо криптирано мислене можеше да се „преиграе“ и разчете.
Проверено на1 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Копираш криптираното мислене на модела от един разговор. Отваряш друг и молиш модела да ти го разшифрова и препише.

Това е един от начините, описани от OpenAI. Не е разбиване в класическия смисъл, никой не е влизал в база данни. Моделът е бил помолен да прочете на глас нещо, което е трябвало да остане скрито, и OpenAI е затворила път от този тип.

Фактите: на 30 септември 2026 г. OpenAI съобщи, че е открила и прекъснала координирана кампания за извличане на защитените разсъждения на моделите си, дейност, която определя като враждебна дестилация. Активността започва на 1 юли, отначало слаба, с пикове на 24 и 25 юли от 16 000 заявки с подходящ модел на извличане от над 4000 потребители; свързан клъстер от над 15 000 потребители е напълно прекъснат до 28 юли. Числата описват опити, не непременно успешни извличания. OpenAI не е сигурна дали всички оператори са един участник, но приписва ядрото на активността на лица, свързани с Moonshot AI, разработчика на Kimi. Операторите не са разбили криптиране, не са компрометирали база данни и не са имали пряк достъп до съхранени разговори. Мерките: блокирани или ограничени акаунти, по-строг контрол при регистрация, затворен път, по който някой с чуждо криптирано мислене може да го преиграе и разчете, проверки на изхода и споделяне на находките през Frontier Model Forum и държавни канали. Позиция на Moonshot AI в текста няма.

Защо някой ще краде разсъжденията, а не отговорите? Защото отговорът казва какво, а мисленето казва как. Ако обучаваш свой модел, „как“ е по-ценното. OpenAI добавя и по-опасната страна: така се пренася способност без предпазителите, сложени върху видимия отговор.

Отговорът казва какво. Мисленето казва как. Източват второто.

Две неща не знаем. Колко от опитите са успели, защото самата OpenAI казва, че числата са за опити. И какво казва Moonshot, защото тяхна дума в текста няма.

Ако правиш услуга, която пренася мисленето на модел между сесии или акаунти, OpenAI изрично предупреждава, че системите с преносими или повторно изпълними разсъждения може да имат сходни рискове. Това изречение е за инженерите, не за заглавията.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→OpenAI - Disrupting a coordinated model-distillation campaign, 30.09.2026
Оригинал: https://wearecoded.com/articles/openai-moonshot-iztochvane-na-razsazhdeniya.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини