we_are_coded.by CODE · Светът, декодиран
EN
Anthropic

Mythos 5 познава по снимка къде е направена с медианна грешка 47 км, а шампионите в GeoGuessr грешат със 151

Anthropic · събитието: 10 септември 2026Контрол

На 10 септември Frontier Red Team на Anthropic публикува оценки за разузнавателно таргетиране и разработка на конвенционални оръжия. Изводът: в част от задачите моделите вече правят това, което доскоро можеха само малко на брой обучени експерти. Компанията е сложила нови класификатори срещу такава злоупотреба.

Накратко
  • По снимка, без метаданни и без търсене, Mythos Preview и Mythos 5 определят мястото с медианна грешка 37,0 и 47,2 км.
  • В симулация моделите пишат и подобряват софтуер за насочване на дрон към цел.
  • Тестваните модели с отворени тегла са зад фронтира, обикновено между Sonnet и Mythos, но често показват тревожно ниво на способности.
Проверено на1 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Пъб в Кейптаун. Снимка без нито един географски етикет. Claude Mythos 5 го намира по детайлите в кадъра. Opus 5 и Sonnet 5 се объркват по друг, по-известен пъб със същото име в Нова Зеландия.

Примерът е от нов доклад на Anthropic и е забавен, докато не си представиш човек на мястото на пъба.

Фактите: на 10 септември 2026 г. Frontier Red Team на Anthropic публикува нови оценки на способностите на моделите в тактическо разузнавателно таргетиране и в разработка на конвенционални оръжия. При определяне на място по снимка, без метаданни, обратно търсене и инструменти, върху 6000 снимки Mythos Preview и Mythos 5 постигат медианна грешка 37,0 и 47,2 км и поставят 23,7% и 23,1% от снимките в рамките на 1 км. Човешка база на същите снимки няма; за сравнение компанията ползва данни от играчи на GeoGuessr, които гледат Street View и могат да се движат в кадъра: медианна грешка 151 км за дивизията Champion, горните 0,01% от играчите. В симулирани задачи моделите пишат и подобряват софтуер за насочване на квадрокоптер към цел, за пускане на товар и за полет в заглушено пространство. По думите на Anthropic в част от задачите в разузнаването и военната област моделите правят неща, които исторически са можели само малко на брой силно обучени експерти. Тестваните модели с отворени тегла са зад фронтира, обикновено между Sonnet и моделите от класа Mythos, но често показват тревожно ниво на способности. Anthropic е въвела нови класификатори, които да блокират такава злоупотреба.

Цената на анонимността

Ключът е в едно изречение от средата на текста: голяма част от защитата на хората от проследяване досега не е била тайната, а цената. Данните отдавна са в мрежата. Скъпо беше някой да седне и да ги навърже.

Ако моделът свърши за минути работа, която отнема на аналитик часове, цената пада. Според Anthropic медианният набор в една от оценките е около 37 000 думи, които човек би чел около два часа и половина. Mythos Preview дава пълната си оценка средно за около 11 минути.

Тайната никога не е пазила хората толкова, колкото скъпият труд.

При оценката по текст нещата са още по-близо до всеки от нас. От публикации в мрежата моделите намират дома на част от хората с точност до километър. В 70% от успешните случаи хората сами са издали мястото си: общежитие, заведение, улица. В 13% е стигнал само начинът, по който пишат, с диалекта, местните медии, градския транспорт и отборите.

Недей да качваш снимки от дома си с изглед към улицата и недей да пишеш квартала в профила. Не е параноя. Моделите вече четат детайлите, които ти не забелязваш, и по сметката на Anthropic най-силните от тях вече бият дори най-добрите от хората, които се състезават в това.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→Anthropic - Measuring tactical intelligence targeting and conventional weapons capabilities of AI models, 10.09.2026
Оригинал: https://wearecoded.com/articles/anthropic-geolokaciya-po-snimka-i-dronove.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини