Режимът върви на NVIDIA Blackwell и е достъпен в OpenAI API и за отговарящи на условията потребители на ChatGPT Work и Codex. OpenAI няма собствен анонс в новините си; числото стои в блога на NVIDIA, с цитати на двама души от OpenAI, и в документацията на OpenAI за API. Документацията на OpenAI добавя едно условие, което за нас е първото: обработка само в САЩ или глобално, без крайни точки за ЕС.
- 8 пъти е спрямо Astra Standard, при генериране на токени. Числото е на NVIDIA и стои и в документацията на OpenAI; никой трети не го е мерил.
- Ultrafast е най-бързият и по-скъпият сервизен клас на API: OpenAI пише да го ползваш, когато скоростта оправдава цената. За GPT-5.6 Sol е в предварителен достъп.
- Без обработка в ЕС. Държиш ли данни, които не бива да напускат Европа, режимът не е за теб.
Агентът пише код, пуска инструмент, чете резултата, решава. И пак. Стотици пъти за една задача. Всяка секунда чакане в такъв цикъл се умножава по стотици, и затова новина за скорост тежи повече от новина за още една способност.
Числото 8 е вендорско и го пишем така. Идва от NVIDIA, която продава чиповете, и стои в документацията на OpenAI, която продава токените. Двама продавачи, едно число. Не казвам, че е грешно. Казвам, че не е мерено от трети и че „до 8 пъти“ значи „понякога по-малко“. Мери го сам на своя товар, преди да го кажеш на клиент.
Дребният ред е другаде: Ultrafast поддържа само обработка в САЩ или глобална обработка, без европейски крайни точки. Държиш ли клиентски данни с изискване да не напускат региона, тоя режим не е за теб, колкото и бърз да е. Това го пише OpenAI в документацията си, не NVIDIA в блога.
Какво следва: цената. OpenAI я нарича по-висока и праща към таблица, която не цитираме, докато не я сравним със Standard на една и съща задача. Дали Ultrafast е за агенти в производство или за демо, решава цената на завършена задача, не цената на токен.