we_are_coded.by CODE · Светът, декодиран
EN
OpenAI

GPT-6 Astra вече има режим Ultrafast: до 8 пъти по-бързо генериране, по данни на NVIDIA

NVIDIAФронтир

Режимът върви на NVIDIA Blackwell и е достъпен в OpenAI API и за отговарящи на условията потребители на ChatGPT Work и Codex. OpenAI няма собствен анонс в новините си; числото стои в блога на NVIDIA, с цитати на двама души от OpenAI, и в документацията на OpenAI за API. Документацията на OpenAI добавя едно условие, което за нас е първото: обработка само в САЩ или глобално, без крайни точки за ЕС.

Накратко
  • 8 пъти е спрямо Astra Standard, при генериране на токени. Числото е на NVIDIA и стои и в документацията на OpenAI; никой трети не го е мерил.
  • Ultrafast е най-бързият и по-скъпият сервизен клас на API: OpenAI пише да го ползваш, когато скоростта оправдава цената. За GPT-5.6 Sol е в предварителен достъп.
  • Без обработка в ЕС. Държиш ли данни, които не бива да напускат Европа, режимът не е за теб.
Проверено на2 октомври 2026Отговорен редакторЦветелин ИвановКак работимМетод · Корекции

Агентът пише код, пуска инструмент, чете резултата, решава. И пак. Стотици пъти за една задача. Всяка секунда чакане в такъв цикъл се умножава по стотици, и затова новина за скорост тежи повече от новина за още една способност.

Фактите: на 1 октомври 2026 г. NVIDIA публикува в блога си, че GPT-6 Astra Ultrafast върви на NVIDIA Blackwell GPU и е наличен в OpenAI API и за отговарящи на условията потребители на ChatGPT Work и Codex. По данни на NVIDIA Ultrafast дава до 8 пъти по-бързо генериране на токени спрямо режима Astra Standard. В поста са цитирани Philippe Tillet, ръководител на inference (изпълнението на моделите) в OpenAI, и Uday Ruddarraju, главен технологичен директор по изчисленията в OpenAI, според когото OpenAI е ползвала собствените си модели, за да оптимизира това изпълнение върху графичните процесори на NVIDIA. Собствен анонс в новините на OpenAI няма. Документацията на OpenAI описва Ultrafast като най-бързия сервизен клас в API, с до 8 пъти по-висока скорост от Standard, широко достъпен за GPT-6 Astra и в предварителен достъп за GPT-5.6 Sol, с по-висока цена, с препоръка за WebSockets при много последователни извиквания на инструменти и с обработка само в САЩ или глобално, без крайни точки за ЕС и други региони извън САЩ.

Числото 8 е вендорско и го пишем така. Идва от NVIDIA, която продава чиповете, и стои в документацията на OpenAI, която продава токените. Двама продавачи, едно число. Не казвам, че е грешно. Казвам, че не е мерено от трети и че „до 8 пъти“ значи „понякога по-малко“. Мери го сам на своя товар, преди да го кажеш на клиент.

Дребният ред е другаде: Ultrafast поддържа само обработка в САЩ или глобална обработка, без европейски крайни точки. Държиш ли клиентски данни с изискване да не напускат региона, тоя режим не е за теб, колкото и бърз да е. Това го пише OpenAI в документацията си, не NVIDIA в блога.

Скоростта има адрес. Тук адресът е САЩ.

Какво следва: цената. OpenAI я нарича по-висока и праща към таблица, която не цитираме, докато не я сравним със Standard на една и съща задача. Дали Ultrafast е за агенти в производство или за демо, решава цената на завършена задача, не цената на токен.

Визуалът към статията е генериран код-арт, без чужди изображения.
Последвай ниFacebookLinkedIn
Официални първоизточници
→NVIDIA - How NVIDIA GPUs Help Accelerate OpenAI's GPT-6 Astra Ultrafast, 01.10.2026→OpenAI - Ultrafast mode, API документация, прочетена на 02.10.2026
Оригинал: https://wearecoded.com/articles/gpt-6-astra-ultrafast-blackwell-8x.html
СподелиFacebookXLinkedInTelegramWhatsApp
← Обратно към всички новини