NVIDIA представи Rubin: шестчипова платформа за по-бързо обучение и по-ниска цена на инференс

NVIDIA представи Rubin – платформа от шест нови чипа, създадени като единна система за AI суперкомпютри. Компанията позиционира Rubin като основа за по-евтино мащабиране на обучение и инференс, включително при agentic AI и модели за разсъждение.
Платформата носи името на американския астроном Vera Florence Cooper Rubin и включва решенията NVIDIA Vera Rubin NVL72 (rack-scale) и NVIDIA HGX Rubin NVL8.
Шест чипа, проектирани като една система
Rubin залага на „екстремен ко-дизайн“ (extreme codesign) между:
- NVIDIA Vera CPU
- NVIDIA Rubin GPU
- NVIDIA NVLink 6 Switch
- NVIDIA ConnectX-9 SuperNIC
- NVIDIA BlueField-4 DPU
- NVIDIA Spectrum-6 Ethernet Switch
Според NVIDIA тази интеграция цели по-кратко време за обучение и по-ниска цена на токен при инференс. Компанията посочва до 10 пъти по-ниска цена на токен спрямо NVIDIA Blackwell за определени сценарии (agentic AI, advanced reasoning и мащабен mixture-of-experts (MoE) инференс), както и обучение на MoE модели с 4 пъти по-малко GPU спрямо предходната платформа.
Ключови технологии: NVLink 6, Vera CPU, Rubin GPU и сигурност
NVIDIA описва пет основни технологични нововъведения в Rubin:
- Шесто поколение NVIDIA NVLink – пропускателна способност 3.6TB/s на GPU и до 260TB/s за Vera Rubin NVL72 rack, плюс „in-network compute“ за ускоряване на колективни операции и функции за по-добра устойчивост и сервизируемост чрез NVLink 6 switch.
- NVIDIA Vera CPU – CPU за AI фабрики с 88 персонализирани NVIDIA Olympus ядра, пълна съвместимост с Armv9.2 и NVLink-C2C свързаност; целта е висока ефективност при agentic reasoning и центрове за данни.
- NVIDIA Rubin GPU – трето поколение Transformer Engine с хардуерно ускорена адаптивна компресия; заявени 50 petaflops NVFP4 изчисления за AI инференс.
- Трето поколение NVIDIA Confidential Computing – за първи път в rack-scale платформа (Vera Rubin NVL72) с защита на данните през CPU, GPU и NVLink домейни.
- Второ поколение RAS Engine – проверки на „здравето“ на системата в реално време, толерантност към грешки и проактивна поддръжка; модулен дизайн на rack-а без кабели, който според NVIDIA позволява до 18 пъти по-бързо сглобяване и сервизиране спрямо Blackwell.
Съхранение и софтуерно дефинирана сигурна инфраструктура
Rubin въвежда NVIDIA Inference Context Memory Storage Platform – клас AI-native сторидж инфраструктура, създадена да мащабира inference context на „gigascale“. Платформата се задвижва от NVIDIA BlueField-4 и е насочена към по-ефективно споделяне и повторна употреба на key-value cache данни, за да се повишат отзивчивостта и пропускателната способност при agentic AI.
BlueField-4 добавя и Advanced Secure Trusted Resource Architecture (ASTRA) – „trust“ архитектура на системно ниво, която цели единна контролна точка за сигурно провизиране, изолиране и експлоатация на големи AI среди без компромис с производителността.
Форми на внедряване и мрежа: NVL72, NVL8 и Spectrum-6 Ethernet
NVIDIA Vera Rubin NVL72 комбинира 72 NVIDIA Rubin GPU, 36 NVIDIA Vera CPU, NVIDIA NVLink 6, NVIDIA ConnectX-9 SuperNIC и NVIDIA BlueField-4 DPU в единна защитена система. Паралелно NVIDIA планира и NVIDIA HGX Rubin NVL8 – сървърна платка, която свързва осем Rubin GPU чрез NVLink и е насочена към x86-базирани генеративни AI платформи, както и HPC натоварвания.
Като референтна архитектура за мащабно внедряване NVIDIA посочва NVIDIA DGX SuperPOD, който интегрира DGX Vera Rubin NVL72 или DGX Rubin NVL8 с BlueField-4, ConnectX-9, NVIDIA InfiniBand, както и софтуера NVIDIA Mission Control.
В мрежовата част компанията представя NVIDIA Spectrum-6 Ethernet като следващо поколение Ethernet за AI, проектирано за по-висока ефективност и устойчивост в Rubin-базирани AI фабрики. Поддръжката включва 200G SerDes, co-packaged optics и AI-оптимизирани „fabrics“.
Системите Spectrum-X Ethernet Photonics co-packaged optical switch, базирани на Spectrum-6, според NVIDIA предлагат 10 пъти по-висока надеждност и 5 пъти по-дълъг uptime за AI приложения, както и 5 пъти по-добра енергийна ефективност спрямо традиционни подходи. Spectrum-XGS Ethernet е описана като технология, която позволява центрове за данни на стотици километри разстояние да работят като единна AI среда.
Екосистема и готовност за пазар
NVIDIA очаква широка подкрепа за Rubin от AI лаборатории, облачни доставчици, производители и стартъпи, сред които Amazon Web Services (AWS), Anthropic, Black Forest Labs, Cisco, Cohere, CoreWeave, Cursor, Dell Technologies, Google, Harvey, HPE, Lambda, Lenovo, Meta, Microsoft, Mistral AI, Nebius, Nscale, OpenAI, OpenEvidence, Oracle Cloud Infrastructure (OCI), Perplexity, Runway, Supermicro, Thinking Machines Lab и xAI.
Цитирани са и позиции от ръководители на организации, включително Jensen Huang (NVIDIA), Sam Altman (OpenAI), Dario Amodei (Anthropic), Mark Zuckerberg (Meta), Elon Musk (xAI), Satya Nadella (Microsoft), Matt Garman (AWS), Sundar Pichai (Google и Alphabet), Clay Magouyrk (Oracle), Michael Dell (Dell Technologies), Antonio Neri (HPE) и Yuanqing Yang (Lenovo), които подчертават очакванията за по-висока ефективност и по-добро мащабиране на обучение и инференс.
NVIDIA заявява, че Rubin е в пълно производство, а продукти, базирани на платформата, се очакват от партньори през втората половина на 2026 г. Сред първите облачни доставчици, планиращи Vera Rubin-базирани инстанции през 2026 г., са AWS, Google Cloud, Microsoft и OCI, както и NVIDIA Cloud Partners CoreWeave, Lambda, Nebius и Nscale.
Microsoft планира да внедри NVIDIA Vera Rubin NVL72 в следващо поколение AI центрове за данни, включително бъдещи обекти Fairwater AI superfactory, като Microsoft Azure ще предлага оптимизирана платформа за корпоративни, изследователски и потребителски приложения. CoreWeave предвижда интеграция на Rubin-базирани системи в своята AI cloud платформа през втората половина на 2026 г., с фокус върху training, inference и agentic workloads и експлоатация чрез CoreWeave Mission Control.
Партньори за инфраструктурен софтуер и сторидж, които работят по платформи за Rubin, включват AIC, Canonical, Cloudian, DDN, Dell, HPE, Hitachi Vantara, IBM, NetApp, Nutanix, Pure Storage, Supermicro, SUSE, VAST Data и WEKA. NVIDIA посочва и над 80 партньора в NVIDIA MGX екосистемата, както и разширено сътрудничество с Red Hat за пълен AI stack, оптимизиран за Rubin, включително Red Hat Enterprise Linux, Red Hat OpenShift и Red Hat AI.
Какво означава това
- По-интегриран дизайн между CPU, GPU, мрежа и сигурност може да намали реалната цена на обучение и инференс за големи AI модели, особено MoE.
- Rack-scale подходът (NVL72) цели по-бързо внедряване и по-лесна поддръжка в големи AI „фабрики“ в облака и enterprise среда.
- AI-native сторидж и механизми за повторна употреба на KV cache могат да подобрят латентността и разходите при agentic AI приложения.
- Фокусът върху Confidential Computing и ASTRA показва, че защитата на данните и изолацията на ресурси стават ключови за комерсиални и „proprietary“ модели.
- Ранното участие на AWS, Google Cloud, Microsoft и OCI подсказва, че Rubin ще бъде насочена към мащабни облачни внедрявания още при първите комерсиални доставки.



