SAK · MODELLER_

ZAYA1-8B matcher DeepSeek-R1 i matematikk med under 1 milliard aktive parametere

En ny åpen modell ved navn ZAYA1-8B presterer på nivå med DeepSeek-R1 i matematikk og kodingsoppgaver, men bruker mindre enn 1 milliard aktive parametere gjennom effektiv sparse activation. Dette gjør den betydelig mer ressursøkonomisk å kjøre enn større konkurrenter.

HVORFOR DET BETYR NOE

Viser at du ikke trenger enorme modeller for høy ytelse på spesialiserte oppgaver – sparse aktivering blir stadig viktigere for praktisk AI-bruk. Reduserer barrieren for å kjøre kraftig reasoning lokalt eller på små enheter.

KILDER

MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.