Štreberi
  • Početna
  • Vesti
  • Testovi
  • Kupovina Licenci
No Result
View All Result
Štreberi
  • Početna
  • Vesti
  • Testovi
  • Kupovina Licenci
No Result
View All Result
Štreberi
Home Vesti

NVIDIA DiffusionGemma podrška: 150 TPS na DGX Spark

Dušan Račić by Dušan Račić
11/06/2026
in Vesti
Reading Time: 1 min read
A A
0
Share on FacebookShare on TwitterShare on LinkdinShare on WhatsAppShare via Email

NVIDIA je objavio podršku prvog dana za DiffusionGemma, novi open-source AI model kompanije Google DeepMind. Podrška obuhvata celokupan RTX i DGX ekosistem, od GeForce RTX grafičkih karti do DGX Spark sistema i profesionalnih radnih stanica.

The GeForce RTX graphics card is displayed between large letters 'RTX' and 'AI' with green light beams in the background.

https://x.com/NVIDIAAI/status/2064770996603863328

Šta je DiffusionGemma?

DiffusionGemma je model za brzo generisanje teksta koji paralelno obrađuje do 256 tokena po koraku, umesto uobičajenog generisanja token po token. Izgrađen je na arhitekturi Gemma 4 sa 26 milijardi parametara, od kojih se aktivira samo 3,8 milijardi po koraku. Model je dostupan pod Apache 2.0 licencom i može da radi lokalno, bez cloud zavisnosti.

Performanse na NVIDIA hardveru

NVIDIA-ini sistemi postižu impresivne rezultate. DGX Spark isporučuje 150 tokena u sekundi, dok H100 Tensor Core GPU na DGX Station dostiže 1.000 tokena u sekundi na jednoj grafičkoj kartici. DGX Station nudi i do 800 TPS uz 748GB koherentne memorije.

DGX Spark koristi NVIDIA GB10 Grace Blackwell Superchip sa 128GB unifikovane memorije i dolazi sa preinstaliranim AI softverom. RTX PRO 6000 radne stanice su namenjene profesionalcima koji trebaju lokalno generisanje s niskom latencijom. Podrška za GeForce RTX karticama putem llama.cpp stiže uskoro.

SLIČNE OBJAVE

Xbox otpušta više od 3.200 radnika zbog skrivenih rezova

15/07/2026

Tesla AI5 čip ide u proizvodnju na Samsung 2nm procesu

15/07/2026

ZOTAC RTX 5090 izgorela za 5 minuta: kvar nije konektor

15/07/2026

iPhone 20 napušta aluminijum: staklo nazad, manje izdržljivosti

15/07/2026

Model nudi oko 4 puta veće performanse u poređenju sa ekvivalentnim autoregresivnim modelom, bez potrebe za dodatnim podešavanjima zahvaljujući CUDA softveru i tensor core arhitekturi.

Tags: AI modelDGX SparkDGX StationDiffusionGemmaGB10 Grace Blackwellgeforce rtxGemma 4generisanje tekstaGoogle DeepMindH100lokalni AInvidiaopen source AIRTX PRO 6000streberistreberi vestistreberi.rsveštačka inteligencijavesti iz sveta tehnologije
Please login to join discussion
Štreberi

© 2024 Štreberi - Sva prava zadržana.

Mapa sajta

  • Microsoft Licence
  • O nama
  • Poslovni kontakt
  • Uslovi korišćenja

Društvene mreže

No Result
View All Result
  • Početna
  • Vesti
  • Testovi
  • Kupovina Licenci

© 2024 Štreberi - Sva prava zadržana.