NVIDIA представи Rubin: шестчипова платформа за по-бързо обучение и по-ниска цена на инференс

NVIDIA представи Rubin – платформа от шест нови чипа, създадени като единна система за AI суперкомпютри. Компанията позиционира Rubin като основа за по-евтино мащабиране на обучение и инференс, включително при agentic AI и модели за разсъждение.

Платформата носи името на американския астроном Vera Florence Cooper Rubin и включва решенията NVIDIA Vera Rubin NVL72 (rack-scale) и NVIDIA HGX Rubin NVL8.

Шест чипа, проектирани като една система

Rubin залага на „екстремен ко-дизайн“ (extreme codesign) между:

Според NVIDIA тази интеграция цели по-кратко време за обучение и по-ниска цена на токен при инференс. Компанията посочва до 10 пъти по-ниска цена на токен спрямо NVIDIA Blackwell за определени сценарии (agentic AI, advanced reasoning и мащабен mixture-of-experts (MoE) инференс), както и обучение на MoE модели с 4 пъти по-малко GPU спрямо предходната платформа.

Rubin е позиционирана като „rack-scale“ архитектура от трето поколение на NVIDIA, насочена към AI „фабрики“ в облака и центровете за данни, където мрежата, сигурността и обслужването са проектирани като част от една обща система.

Ключови технологии: NVLink 6, Vera CPU, Rubin GPU и сигурност

NVIDIA описва пет основни технологични нововъведения в Rubin:

Съхранение и софтуерно дефинирана сигурна инфраструктура

Rubin въвежда NVIDIA Inference Context Memory Storage Platform – клас AI-native сторидж инфраструктура, създадена да мащабира inference context на „gigascale“. Платформата се задвижва от NVIDIA BlueField-4 и е насочена към по-ефективно споделяне и повторна употреба на key-value cache данни, за да се повишат отзивчивостта и пропускателната способност при agentic AI.

BlueField-4 добавя и Advanced Secure Trusted Resource Architecture (ASTRA) – „trust“ архитектура на системно ниво, която цели единна контролна точка за сигурно провизиране, изолиране и експлоатация на големи AI среди без компромис с производителността.

Форми на внедряване и мрежа: NVL72, NVL8 и Spectrum-6 Ethernet

NVIDIA Vera Rubin NVL72 комбинира 72 NVIDIA Rubin GPU, 36 NVIDIA Vera CPU, NVIDIA NVLink 6, NVIDIA ConnectX-9 SuperNIC и NVIDIA BlueField-4 DPU в единна защитена система. Паралелно NVIDIA планира и NVIDIA HGX Rubin NVL8 – сървърна платка, която свързва осем Rubin GPU чрез NVLink и е насочена към x86-базирани генеративни AI платформи, както и HPC натоварвания.

Като референтна архитектура за мащабно внедряване NVIDIA посочва NVIDIA DGX SuperPOD, който интегрира DGX Vera Rubin NVL72 или DGX Rubin NVL8 с BlueField-4, ConnectX-9, NVIDIA InfiniBand, както и софтуера NVIDIA Mission Control.

В мрежовата част компанията представя NVIDIA Spectrum-6 Ethernet като следващо поколение Ethernet за AI, проектирано за по-висока ефективност и устойчивост в Rubin-базирани AI фабрики. Поддръжката включва 200G SerDes, co-packaged optics и AI-оптимизирани „fabrics“.

Системите Spectrum-X Ethernet Photonics co-packaged optical switch, базирани на Spectrum-6, според NVIDIA предлагат 10 пъти по-висока надеждност и 5 пъти по-дълъг uptime за AI приложения, както и 5 пъти по-добра енергийна ефективност спрямо традиционни подходи. Spectrum-XGS Ethernet е описана като технология, която позволява центрове за данни на стотици километри разстояние да работят като единна AI среда.

Екосистема и готовност за пазар

NVIDIA очаква широка подкрепа за Rubin от AI лаборатории, облачни доставчици, производители и стартъпи, сред които Amazon Web Services (AWS), Anthropic, Black Forest Labs, Cisco, Cohere, CoreWeave, Cursor, Dell Technologies, Google, Harvey, HPE, Lambda, Lenovo, Meta, Microsoft, Mistral AI, Nebius, Nscale, OpenAI, OpenEvidence, Oracle Cloud Infrastructure (OCI), Perplexity, Runway, Supermicro, Thinking Machines Lab и xAI.

Цитирани са и позиции от ръководители на организации, включително Jensen Huang (NVIDIA), Sam Altman (OpenAI), Dario Amodei (Anthropic), Mark Zuckerberg (Meta), Elon Musk (xAI), Satya Nadella (Microsoft), Matt Garman (AWS), Sundar Pichai (Google и Alphabet), Clay Magouyrk (Oracle), Michael Dell (Dell Technologies), Antonio Neri (HPE) и Yuanqing Yang (Lenovo), които подчертават очакванията за по-висока ефективност и по-добро мащабиране на обучение и инференс.

NVIDIA заявява, че Rubin е в пълно производство, а продукти, базирани на платформата, се очакват от партньори през втората половина на 2026 г. Сред първите облачни доставчици, планиращи Vera Rubin-базирани инстанции през 2026 г., са AWS, Google Cloud, Microsoft и OCI, както и NVIDIA Cloud Partners CoreWeave, Lambda, Nebius и Nscale.

Microsoft планира да внедри NVIDIA Vera Rubin NVL72 в следващо поколение AI центрове за данни, включително бъдещи обекти Fairwater AI superfactory, като Microsoft Azure ще предлага оптимизирана платформа за корпоративни, изследователски и потребителски приложения. CoreWeave предвижда интеграция на Rubin-базирани системи в своята AI cloud платформа през втората половина на 2026 г., с фокус върху training, inference и agentic workloads и експлоатация чрез CoreWeave Mission Control.

Партньори за инфраструктурен софтуер и сторидж, които работят по платформи за Rubin, включват AIC, Canonical, Cloudian, DDN, Dell, HPE, Hitachi Vantara, IBM, NetApp, Nutanix, Pure Storage, Supermicro, SUSE, VAST Data и WEKA. NVIDIA посочва и над 80 партньора в NVIDIA MGX екосистемата, както и разширено сътрудничество с Red Hat за пълен AI stack, оптимизиран за Rubin, включително Red Hat Enterprise Linux, Red Hat OpenShift и Red Hat AI.

Какво означава това

Exit mobile version