На 22 септември Anthropic пусна Opus 5.5, първия модел от семейството 5.5. Цената на токен пада с 20%, на кеширания вход с 60%, а моделът по данни на компанията харчи и по-малко токени на задача. Две промени в API могат да счупят заявки, които досега минаваха.
- Opus 5.5 струва 4 долара за милион входни и 20 долара за милион изходни токена, а кешираното четене пада до 0,20 долара.
- По данни на Anthropic обичайната работа излиза с 40% по-евтино от Opus 5, защото и токенът е по-евтин, и токените на задача са по-малко.
- Моделът е тестван преди пускане от външни оценители, сред които METR, и идва с предпазни мерки като при Fable 5.1.
Най-полезният ред около това пускане не е от Anthropic. Той е от бележката на Vercel и казва, че някои заявки ще започнат да връщат грешка 400.
Opus 5.5 не приема фиксиран бюджет за мислене и не позволява да задължиш модела да извика точно определен инструмент. Ако системата ти досега е карала модела да върне JSON, като го принуждава да извика инструмент, след смяната на модела тя ще спре. Преправяш го на структурирани изходи и го пускаш наново.
Къде е спестяването
Част от отстъпката е в цената на токена. Останалото Anthropic го търси в това моделът да стига до резултата с по-малко токени. Примерът, който дават, е от ранен тестер: одит и поправка на кодова база от 200 000 реда за под три часа, където Opus 5 е работил над 20 часа и е изхарчил 2,5 пъти повече токени.
Това е тяхно число от ранен тестер, не наше. Но е числото, което може да се провери най-лесно у дома: същата задача, същият репозиториум, двата модела, и накрая сметката.
Има и едно изречение, което си струва да се прочете. Anthropic пише, че вижда признаци моделът често да подозира, че е в тест, и че това затруднява преценката как ще се държи навън. Добре е, че го казват сами.
Ако ползваш Opus през API, провери кода си за принудителен избор на инструмент и за фиксиран бюджет за мислене, преди да смениш името на модела.