SAK · MODELLER_
NVIDIA lanserer Nemotron-Labs-Diffusion med 6× høyere tokens per forward enn Qwen3-8B
NVIDIA AI har utgitt Nemotron-Labs-Diffusion, en ny tri-mode språkmodell som kan prosessere 6 ganger flere tokens per forward pass enn Qwen3-8B. Modellen representerer et betydelig løft i effektivitet for språkmodell-inferens. NVIDIA presenterer denne som en konkurrerende løsning på markedet for små språkmodeller.
HVORFOR DET BETYR NOE
Dette er viktig fordi høyere tokens per forward pass betyr raskere og mer effektiv inferens, noe som er kritisk for praktisk AI-deployment. Lanseringen viser at NVIDIA intensiverer innsatsen på modell-siden, ikke bare på maskinvare.
KILDER
MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.