NVIDIA wprowadza na rynek platformę Vera Rubin, która wyznacza nowy standard w budowie infrastruktury obliczeniowej typu gigascale. System, oparty na architekturze NVL72, jest już wdrażany przez kluczowych partnerów technologicznych, w tym CoreWeave, Google Cloud, Microsoft Azure oraz Oracle Cloud Infrastructure. Dzięki zaangażowaniu ponad 300 globalnych partnerów i wykorzystaniu łańcucha dostaw obejmującego ponad 350 zakładów produkcyjnych w 30 krajach, platforma ta staje się najbardziej dojrzałym rozwiązaniem typu rack-scale w historii firmy.
Ekstremalny projekt systemowy
Kluczem do wydajności platformy Vera Rubin jest podejście określane jako ekstremalny codesign. Zamiast łączyć gotowe komponenty, inżynierowie zaprojektowali siedem układów scalonych i pięć typów tac rackowych jako jeden, spójny system. W sercu tej architektury znajduje się procesor NVIDIA Vera CPU, wyposażony w autorskie rdzenie Olympus. Zapewniają one dwukrotnie wyższą wydajność jednowątkową, trzykrotnie większą przepustowość między rdzeniami oraz o 40% niższą latencję pamięci w porównaniu do konkurencyjnych rozwiązań typu chiplet.
Takie podejście przekłada się na wymierne korzyści operacyjne. Dzięki wyeliminowaniu zbędnego okablowania, wentylatorów i przewodów wewnątrz tac, czas montażu pojedynczego modułu obliczeniowego skrócił się z kilku godzin do zaledwie jednej minuty. Dodatkowo, system chłodzenia cieczą przystosowany do pracy przy temperaturze wlotowej 45 stopni Celsjusza pozwala na rezygnację z energochłonnych agregatów chłodniczych, co w skali roku pozwala zaoszczędzić miliony litrów wody na każdy megawat mocy.
Przełomowa wydajność w erze AI
Pierwsze testy wydajności przeprowadzone przez CoreWeave na modelu DeepSeek-R1 potwierdzają, że Vera Rubin NVL72 oferuje dziesięciokrotnie wyższą przepustowość na megawat w porównaniu do poprzedniej generacji Grace Blackwell NVL72. Jest to kluczowy wskaźnik dla nowoczesnych fabryk AI, gdzie ograniczenia energetyczne stają się główną barierą rozwoju. W praktyce oznacza to, że koszt wygenerowania miliona tokenów jest dziesięciokrotnie niższy, co pozwala na uzyskanie znacznie większej inteligencji obliczeniowej przy tym samym budżecie energetycznym.
Wsparcie dla tak wysokiej wydajności zapewnia zaawansowana sieć. Szósta generacja technologii NVLink oferuje ponad dwukrotnie większą przepustowość i trzykrotnie niższą latencję niż standardowe rozwiązania Ethernet. Z kolei technologia Spectrum-X, wykorzystująca przełączniki Spectrum-6 oraz karty sieciowe ConnectX-9, umożliwia budowę rozległych klastrów o przepustowości 1,6 terabita na sekundę, co jest niezbędne do obsługi złożonych modeli typu mixture-of-experts.
Suwerenność danych i wsparcie dla Europy
Platforma Vera Rubin stanowi fundament nowej strategii Microsoftu i firmy Mistral, mającej na celu dostarczenie zaawansowanych narzędzi AI dla europejskich rządów i regulowanych sektorów gospodarki. Dzięki tej współpracy, organizacje mogą korzystać z otwartych modeli AI w środowiskach chmurowych, hybrydowych lub całkowicie odizolowanych, co zapewnia pełną kontrolę nad danymi i zgodność z lokalnymi wymogami prawnymi.
Następna era badań wymaga następnej ery sprzętu. Czujemy się wyróżnieni, mogąc pracować z zespołami NVIDIA i Google Cloud, które umożliwiły nam wczesny dostęp do Vera Rubin. Wsparcie obu zespołów było niezrównane; byliśmy gotowi do pracy niemal natychmiast – Lasse Espeholt, współzałożyciel Ineffable Intelligence.
W ramach tej inicjatywy, Google Cloud wprowadza instancje A5X oparte na systemach Vera Rubin, które wspierają startupy takie jak Ineffable Intelligence w rozwoju systemów typu superlearner. Te zaawansowane modele, uczące się poprzez interakcję z otoczeniem, wymagają infrastruktury o ekstremalnie niskiej latencji, którą platforma NVIDIA jest w stanie zapewnić w skali sięgającej niemal miliona procesorów graficznych w konfiguracjach wielooddziałowych.
Efektywność w liczbach
Niezależne testy przeprowadzone przez platformę DeepInfra potwierdzają, że procesor Vera CPU znacząco przewyższa alternatywne rozwiązania w zadaniach związanych z orkiestracją agentów AI:
- Obsługa do 1,6x większej liczby jednoczesnych agentów AI przy zachowaniu tej samej jakości usług.
- Ponad 2,2-krotnie szybsza orkiestracja zadań w porównaniu do innych procesorów.
- Znaczna poprawa utylizacji infrastruktury i efektywności kosztowej.
Dzięki tym rozwiązaniom, Vera Rubin nie tylko zwiększa możliwości obliczeniowe, ale również czyni zaawansowaną sztuczną inteligencję bardziej dostępną ekonomicznie, umożliwiając firmom i instytucjom wdrażanie innowacji bez konieczności rezygnacji z kontroli nad własnymi zasobami.
