Двата по-евтини модела от семейството GPT-6 излязоха на 22 септември. Sol струва 2 долара на вход и 10 на изход за милион токена, Luna - 10 и 50 цента. По данни на OpenAI на вътрешния им тест Sol прави около два пъти по-малко фактически грешки от предшественика си.
- Sol пада от 4 на 2 долара на вход и от 20 на 10 на изход; Luna от 0,20 на 0,10 и от 1,20 на 0,50 долара.
- По вътрешния тест на OpenAI за фактология Sol прави около половината от грешките на GPT-5.6 Sol.
- Моделите са в ChatGPT Work и Codex за Plus, Pro, Business, Enterprise и Edu, а безплатните потребители получават Luna в настолното приложение.
За два дни три лаборатории пуснаха нови модели и и трите говорят първо за цена.
OpenAI влиза с двата си по-малки модела и с най-простия аргумент на пазара: половин цена. Astra остава горе за най-тежката работа, а Sol и Luna са за всичко останало, което се върти по цял ден.
Грешките
Точките по бенчмарковете са на OpenAI, мерени при различни нива на усилие, а числата на чуждите модели са взети от публични отчети.
Числото, което си струва, е грешките. Тестът е построен точно върху разговори, в които хората са хванали модела в грешка, и затова е по-труден от обичайната употреба. Половината грешки там значи справка, която ще поправяш по-рядко. Не значи справка, която можеш да не проверяваш.
При Luna изходната цена пада повече от входната, от 1,20 на 0,50 долара, и в продукт с дълги отговори разликата се усеща още в първия месец.