NVIDIA deklasuje konkurencję. Architektura Blackwell Ultra wyznacza nowe standardy wydajności

Technologie
4322V
NVIDIA Jensen Huang
Maciej Zabłocki | 02.04, 11:45
Google Chcesz częściej widzieć nasze treści w Google? Dodaj do źródeł

NVIDIA jako jedna z pierwszych opublikowała szczegółowe wyniki testów MLPerf Inference v6.0, demonstrując ogromną przewagę nad branżową konkurencją. Z oficjalnych danych wynika, że połączenie układów Blackwell Ultra z zaawansowaną architekturą projektowania systemów pozwoliło osiągnąć najwyższą przepustowość oraz najniższy koszt przetwarzania pojedynczego tokena.

Rezultaty amerykańskiego producenta w zadaniach uczenia maszynowego przewyższają osiągnięcia najbliższych rywali nawet dziewięciokrotnie, co dobitnie podkreśla pozycję firmy na rynku zaawansowanej infrastruktury obliczeniowej. W najnowszej wersji testów organizacja MLCommons wprowadziła obsługę nowocześniejszych modeli AI, w tym DeepSeek-R1, GPT-OSS-120B oraz Mixtral 8x7B. Rozszerzony pakiet skupia się również na zaawansowanych systemach językowych, wizualnych i generatywnych systemach rekomendacji, trafniej odzwierciedlając współczesne potrzeby wielkich korporacji. Dyrektor generalny firmy, Jensen Huang, wprost określa to zestawienie jako jedno z najbardziej wymagających i obciążających na rynku.

Dalsza część tekstu pod wideo

W scenariuszu serwerowym dla wymagającego modelu DeepSeek-R1 konfiguracja GB300 NVL72 osiągnęła imponujący wynik 8064 tokenów na sekundę na jeden procesor, co stanowi skok wydajności o 177 procent w stosunku do poprzedniej iteracji oprogramowania, i to bez wprowadzania modyfikacji sprzętowych. Wzrost o ponad 50 procent odnotowano także w teście bazującym na modelu Llama 3.1 405B.

NVIDIA skook
resize icon

Przedstawiciele producenta podkreślają, że ostateczna przepustowość to wynik ścisłej optymalizacji układów scalonych, architektury węzłów serwerowych oraz potężnego zaplecza w postaci dopracowanego oprogramowania. Konsekwentne aktualizacje pozwoliły zauważalnie przyspieszyć działanie platformy i znacząco obniżyć całkowity koszt posiadania i utrzymania potężnej infrastruktury obliczeniowej.

NVIDIA jako jedyna opublikowała dokładne dane dla modelu DeepSeek-R1 w ubiegłym roku, a nowa iteracja standardu potwierdza utrzymanie prowadzenia. Transparentne podejście do prezentacji faktycznych możliwości własnego sprzętu budzi duże uznanie w społeczności inżynierów. Niezwykle wysoki próg wejścia narzucany przez środowisko MLPerf sprawia, że wielu innych twórców procesorów wciąż unika tak szerokiej weryfikacji swoich produktów, oddając tym samym przestrzeń rynkowemu liderowi.

Google Chcesz częściej widzieć nasze treści w Google? Dodaj do źródeł
Źródło: WCCFTech

Komentarze (6)

SORTUJ OD: Najnowszych / Najstarszych / Popularnych

cropper