Инфра, стр. 2
Инфра
42 материала · страница 2 от 5Cloudflare преподреди един запис в паметта и си върна 100 терабайта, а кешът стана по-бърз
Платформата зад 1.1.1.1 държи над 250 милиарда записа в кеша по всяко време. Пет последователни промени в подредбата им свиват всеки запис с над половината. Освободената памет е колкото цялата RAM на 130 от сървърите им.
Чети →NVIDIA изнесе контролера на паметта от чипа и го сложи вътре в самата памет
На 26 август NVIDIA добави NVHBM към NVLink Fusion - памет, в чийто основен кристал вече седи техният контролер. Обещанието е до 30 на сто повече лента, 15 на сто по-малко ток и до една четвърт освободена площ върху изчислителния чип. Първи по нея тръгва Annapurna Labs на Amazon.
Чети →Meta показа MTIA 300, първия си чип за обучение на модели
MTIA 300 е първият ускорител на Meta, построен да обучава модели, а не само да отговаря с готови. Мерникът са системите за препоръки и класиране, а мрежата е вградена в самия силиций. По данни на Meta общото време за комуникация пада 3,9 пъти спрямо равностоен клъстер с графични чипове.
Чети →Meta написа свой мрежов протокол за AI и го отвори през Open Compute Project
MetaRoCE е транспортен протокол, писан от нулата за разговорите между хиляди AI ускорители върху обикновен Ethernet. По данни на компанията пази около 86 процента от скоростта дори при един процент загубени пакети. Спецификацията, референтният код и тестът за съвместимост излизат публично.
Чети →NVIDIA отчита 30 пъти повече агентна работа на мегават, но числото още чака независим преглед
NVIDIA публикува собствени измервания за Vera Rubin NVL72: 30 пъти повече агентна пропускливост на мегават и 35 пъти по-ниска цена на токен спрямо предишното поколение. Числата са техни, върху натоварване, което те са пуснали, и по собствените им думи чакат преглед от SemiAnalysis.
Чети →Groq 3 LPX влезе в производство, сглобен заедно с платформата на NVIDIA
Ускорител за извод на ниво шкаф, проектиран съвместно с Vera Rubin NVL72. Комбинира графични чипове и специализирани модули за бърз отговор и поема генерирането на токени в агентните системи. Вече се внедрява при Nebius, CoreWeave и SpaceXAI.
Чети →AWS Glue 6.0 сваля цената с 30 на сто и добавя пълна поддръжка на Iceberg v3
AWS пусна версия 6.0 на Glue, услугата за обработка на данни, с 30 процента по-ниска цена спрямо предишните версии. Отдолу е нов двигател, а отгоре пълна поддръжка на формата за таблици Iceberg v3.
Чети →GitHub обясни аварията от 17 август: капацитетът не е догонил собствения му растеж
На 20 август GitHub публикува разбор на срива от 17 август, който е държал платформата седем часа и 47 минути и е повалил github.com, автентикацията, Actions, програмните интерфейси и Copilot. По данни на компанията причината не е промяна в код или конфигурация, а недостигнал капацитет.
Чети →Cerebras пусна CS-4 и обеща до трийсет пъти по-бързо от системи с графични карти
Четвъртото поколение на системата им стъпва на три процесора с размер на цяла силициева пластина. Компанията твърди до 30 пъти по-бърза работа при отговаряне. Числото е тяхно, независима проверка още няма.
Чети →