На 29 септември OpenAI пусна GPT-6.1 Sol, обновление на GPT-6 Sol. По данни на компанията той почти достига GPT-6 Astra в агентното кодиране, работата с компютър и професионалните задачи, при една пета от цената на токените на Astra. Достъпен е в ChatGPT Work, Codex и API, но още не и в обикновения чат.
- Цената в API: 2 долара на милион входни токена, 0,10 за кеширани, 10 за изходни.
- При нисък режим делът на отговорите с фактическа грешка пада от 11,4 на 7,7 на сто, върху нарочно трудни разговори.
- Ultrafast вариант с до 8 пъти по-бързо генериране в Codex е обявен за идните дни.
Седмица. Толкова изкара GPT-6 Sol като последна версия, преди да дойде 6.1.
Темпото само по себе си е новина, но не е най-важната. По-важното е как OpenAI подрежда собственото си семейство: Astra е върхът, Sol е работният кон, и това обновление на Sol се мери по това колко близо стига до Astra и с колко по-евтино.
Най-много ми харесва скромното число: фактическата грешка, от 11,4 на 7,7 на сто. OpenAI сама уточнява, че тестът е върху разговори, в които хора вече са хванали стар модел в грешка. Тоест нарочно труден случай, не обичайният. И пак, почти всеки тринайсети отговор там има поне една грешка.
В таблиците им личи още нещо: Opus 5.5 на Anthropic вече е мярката, срещу която се мерят. На AutomationBench GPT-6.1 Sol е с 2,2 пункта над него на средно усилие и на около една трета от цената, по данни на OpenAI.
За най-трудната научна работа OpenAI сама препраща към Astra, която държи 68,1 на сто на Terminal-Bench Science. Рядко производител ти казва кога да платиш повече. Тук го прави.