Nvidia е започнала да доставя първи образци (samples) от платформата Vera Rubin за следващо поколение AI центрове за данни до избрани клиенти. Компанията очаква партньорите ѝ да квалифицират и валидират системата, след което да започнат подготовка за внедряване, планирано за втората половина на 2026 г. или началото на 2027 г.
По време на разговор с анализатори и инвеститори финансовият директор на Nvidia Colette Kress посочи, че първите образци вече са изпратени, а компанията остава по план за старт на производствени доставки през втората половина на годината.
Какво включва платформата Vera Rubin
Vera Rubin е следващото поколение архитектура на Nvidia за AI центрове за данни и комбинира изчислителни, мрежови и инфраструктурни компоненти. Платформата включва:
- 88-ядрен Vera CPU
- Rubin GPU с 288 GB HBM4 памет
- Rubin CPX GPU със 128 GB GDDR7
- NVLink 6.0 switch ASIC за scale-up свързаност на rack ниво
- BlueField-4 DPU с интегриран SSD за съхранение на key-value cache
- Spectrum-6 Photonics Ethernet и Quantum-CX9 1.6 Tb/s Photonics InfiniBand NICs
- Spectrum-X Photonics Ethernet и Quantum-CX9 Photonics InfiniBand switching silicon за scale-out свързаност
Проби при клиенти и значение за спецификациите
Започването на изпращане на образци към клиенти обикновено означава, че ключови параметри като производителност и енергопотребление са финализирани или поне стабилизирани. Остава да се види дали Nvidia е направила допълнителни промени за повишаване на производителността на GPU моделите, с цел да затвърди лидерската си позиция.
Vera Rubin се позиционира като модулна платформа, която комбинира CPU, GPU, мрежова свързаност и DPU слой, насочени към големи AI клъстери в центрове за данни.Роля на партньорите и възможни предварително сглобени модули
За да бъдат готови за внедряване, партньорите на Nvidia трябва да адаптират своите софтуерни и хардуерни стекове. Различни компании ще получат различни компоненти от платформата, а част от тях може да получат и реални NVL72 VR200 rack конфигурации, които събират всички описани елементи в една система.
Образци от реалния силиций ще бъдат предоставяни и на хардуерни партньори като Foxconn, Quanta, Supermicro, Wistron и други производители на AI сървъри.
Пазарни слухове сочат, че Nvidia може да доставя на партньорите си напълно сглобени Level-10 (L10) VR200 compute trays с предварително инсталирани Vera CPU и Rubin GPUs, охлаждане и интерфейси. Подобен подход би оставил по-малко пространство за самостоятелни промени по дизайна и интеграцията от страна на ODM производителите.
Colette Kress допълни, че благодарение на модулния дизайн на таблите без кабели Rubin трябва да предложи по-добра устойчивост и по-лесна поддръжка спрямо Blackwell. Според нея очакването е всеки голям cloud model builder да внедри Vera Rubin.
Какво означава това
- Доставката на първи образци е сигнал, че платформата навлиза в по-зряла фаза и екосистемата започва реални тестове и валидация.
- Комбинацията от Vera CPU, Rubin GPU и високоскоростна фотонна мрежова инфраструктура подсказва фокус върху мащабируеми AI системи на rack и клъстер ниво.
- Възможните предварително сглобени L10 compute trays биха ускорили внедряването, но и биха ограничили свободата на ODM производителите при персонализация.
- Усъвършенстването на сервизируемостта и устойчивостта спрямо Blackwell е насочено към по-нисък риск и по-кратки прекъсвания в големи AI центрове за данни.
