SAK · MODELLER_

NVIDIA lanserer Nemotron 3 Ultra, 550B MoE-modell optimalisert for agent-arbeidsflyter

NVIDIA slapp den fullt åpne Nemotron 3 Ultra, en 550B MoE-modell med 55B aktive parametere og 1M context window, som lover 5x raskere gjennomkjøring og 30% kostnadsreduksjon for langvarige agenttasks. Modellen bruker hybrid Mamba/attention-arkitektur, LatentMoE og native MTP, og ble pretrent på 20T tokens. Parallelt lanserte Anthropic observasjoner om rekursiv selvforbedring i Claude-modeller, der modellene selv skrev 80%+ av mergede kodedeler og ga trainere mulighet til å shippe 8x mer kode.

HVORFOR DET BETYR NOE

Nemotron 3 Ultra åpner betydelig raskere og billigere agent-utvikling for developer-fellesskapet, mens Anthropics funn om rekursiv selvforbedring peker mot en mulig kvalitativ endring i hvordan AI-assistenter kan akselerere AI-development selv.

KILDER

MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.