SAK · MODELLER_
NVIDIA lanserer Nemotron 3 Ultra, 550B MoE-modell optimalisert for agent-arbeidsflyter
NVIDIA slapp den fullt åpne Nemotron 3 Ultra, en 550B MoE-modell med 55B aktive parametere og 1M context window, som lover 5x raskere gjennomkjøring og 30% kostnadsreduksjon for langvarige agenttasks. Modellen bruker hybrid Mamba/attention-arkitektur, LatentMoE og native MTP, og ble pretrent på 20T tokens. Parallelt lanserte Anthropic observasjoner om rekursiv selvforbedring i Claude-modeller, der modellene selv skrev 80%+ av mergede kodedeler og ga trainere mulighet til å shippe 8x mer kode.
HVORFOR DET BETYR NOE
Nemotron 3 Ultra åpner betydelig raskere og billigere agent-utvikling for developer-fellesskapet, mens Anthropics funn om rekursiv selvforbedring peker mot en mulig kvalitativ endring i hvordan AI-assistenter kan akselerere AI-development selv.
KILDER
MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.