Štreberi
  • Početna
  • Vesti
  • Testovi
  • Kupovina Licenci
No Result
View All Result
Štreberi
  • Početna
  • Vesti
  • Testovi
  • Kupovina Licenci
No Result
View All Result
Štreberi
Home Vesti

NVIDIA GB300 obara rekorde, GB200 4x efikasniji u svega 3 meseca

Dušan Račić by Dušan Račić
24/07/2026
in Vesti
Reading Time: 2 mins read
A A
0
Share on FacebookShare on TwitterShare on LinkdinShare on WhatsAppShare via Email

NVIDIA nastavlja da izvlači maksimum iz svoje Blackwell generacije GPU-ova, i to dok istovremeno uvodi platformu Vera Rubin. Najnoviji rezultati pokazuju dramatična poboljšanja i u performansama i u energetskoj efikasnosti.

A presentation slide by NVIDIA shows a graph labeled 'Token Throughput per Megawatt vs. Interactivity' detailing a 4x performance improvement of the GB200 NVL72 from October 2025 to January 2026, alongside statistics about optimization efforts.

GB200 NVL72: 4x više tokena po megavatu

U samo tri meseca, NVIDIA je povećala propusnost po megavatu (TPS/MW) za čak 4x na istoj GB200 NVL72 konfiguraciji koja pokreće DeepSeek R1 0528. Ovo je postignuto kroz 38 većih optimizacija koje su testirane u više od 250.000 simuliranih konfiguracija, što ukupno čini 1,4 miliona GPU sati testiranja. Više od 90% ovih optimizacija primenljivo je i na druge AI modele.

A bar chart titled '3x Higher Delivered Throughput' shows the GB300 NVL72 achieving 1,648 TFLOPS/GPU, significantly surpassing the GB200 NVL72's 606 TFLOPS/GPU.

GB300 „Blackwell Ultra“: svetski rekord u pre-treniranju

GB300 NVL72 postiže rekordnih 1.648 TFLOPs po GPU-u na modelu DeepSeek-V3 671B sa 256 GPU-ova kroz Megatron Core – što je 3x više u odnosu na GB200 sa 606 TFLOPs. Uz to, ista konfiguracija beleži 1,5x poboljšanje u poslednjih 6 meseci.

A bar chart titled '6x Performance Improvement - TorchTitan' shows 'DeepSeek-V3 671B Pre-Training on GB300 NVL72' with performance improving from 199 TFLOPS/GPU to 1,197 TFLOPS/GPU.

Korišćenjem TorchTitan frameworka, GB300 Ultra rack donosi 6x poboljšanje u odnosu na baznu konfiguraciju bez optimizacija. JAX framework ide još dalje – 1025 TFLOPs/GPU i do 4082 tokena/s po GPU-u, što predstavlja 10x skok u odnosu na januar 2026.

A bar chart titled 'Exceptional Scaling Efficiency across all Frameworks' shows DeepSeek-V3 671B Pre-Training on GB300 NVL72 achieving near 100% scaling efficiency across various GPU counts with frameworks Megatron Core, TorchTitan, and JAX.

Skalabilnost je takođe impresivna: na konfiguraciji od 1024 GPU-ova, Megatron Core dostiže 98,5% efikasnosti skaliranja, dok TorchTitan i JAX drže do 97%. Ključna komponenta je NVIDIA-in 800 Gb/s Scale-Out networking čip unutar svakog NVL72 racka.

SLIČNE OBJAVE

Direktna voda na RTX 2060 silicon: temperatura pala sa 70°C na 28°C

13/08/2026
Naučnici napravili AI od živih neurona

Naučnici napravili AI od živih neurona

13/08/2026

Intel Nova Lake: 16-jezgarni CPU sa 154W i iGPU od 40W

12/08/2026

Intel Diamond Rapids Xeon 7: do 256 P-jezgara, stiže 2027.

12/08/2026

Dok Blackwell i dalje napreduje, Vera Rubin platforma već se uvodi sa još većim skokovima u performansama.

Tags: ai gpuAI treniranjeBlackwell Ultradata centriDeepSeekGB200GB300grafičke kartenvidiaNVIDIA BlackwellNVL72streberistreberi vestistreberi.rsTFLOPsVera Rubinveštačka inteligencijavesti iz sveta tehnologije
Please login to join discussion
Štreberi

© 2024 Štreberi - Sva prava zadržana.

Mapa sajta

  • Microsoft Licence
  • O nama
  • Poslovni kontakt
  • Uslovi korišćenja

Društvene mreže

No Result
View All Result
  • Početna
  • Vesti
  • Testovi
  • Kupovina Licenci

© 2024 Štreberi - Sva prava zadržana.