OpenAI представи Jalapeño - собствен ускорител за inference (изчисленията, когато AI отговаря на въпрос). Щом цената на интелекта стане предимство, AI бизнесът спира да се решава само от класации.
- OpenAI и Broadcom представиха Jalapeño: първият собствен ускорител на OpenAI за LLM inference (24 юни).
- Ранните тестове: производителност на ват значително над текущото ниво на технологията.
- План: разгръщане в gigawatt мащаб с партньори, вкл. Microsoft, от 2026, като платформа за няколко поколения.
Един чип. Връчен лично на Сам Алтман и Грег Брокман от ръководството на Broadcom. Така показаха Jalapeño - първия 'Intelligence Processor' на OpenAI, направен изцяло по мярка на визията им за бъдещето на LLM inference.
Тук няма нужда от митология около силиция. Фактът е достатъчно силен сам. По думите на OpenAI чипът е проектиран от нулата спрямо дълбокото им разбиране как работят моделите: кернели (базовите изчислителни програми), движение на паметта, мрежа и схеми на обслужване. Инженерни образци вече работят в лабораторията при целева честота и мощност.
Това мести играта. OpenAI вече не прави само модели и продукти върху тях - проектира и инфраструктурата отдолу: архитектура на чипа, кернели, памет, мрежа, планиране и системи за разгръщане. Владееш ли целия стек (всички технологични слоеве заедно), всеки слой се точи спрямо останалите.
Изводът ми е другаде. Държа собствените ни сървъри вместо да ги наема, точно за тази причина - искам да знам какво стои под мен, не да вярвам на нечие обещание. Който проектира и чипа под модела си, спира да наема бъдещето си от чужд доставчик. Останалите - и ние сме между тях - строим върху чужда сметка за ток и чужд график на доставка. Това е зависимост, която не се вижда в класация, но решава кой ще е още тук след две поколения хардуер.