SAK · FORSKNING_
LLM-er trener andre LLM-er; 72B-modell trent distribuert
Import AI rapporterer om at store språkmodeller nå brukes til å trene andre språkmodeller, samt en distribuert treningskjøring på 72 milliarder parametere. Samtidig viser forskning at computer vision fortsatt er betydelig vanskeligere å løse enn generativ tekst.
HVORFOR DET BETYR NOE
Når LLM-er kan trene andre modeller effektivt, akselererer det iterasjonszyklusen for AI-utvikling og senker barrierer for å skape nye modeller. At visjonsoppgaver er hårdere enn tekstgenerering påvirker prioriteringer i AI-forskningen fremover.
KILDER
MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.