SAK · MODELLER_

GLM-5.2: Styrker kunnskapsbasert læring framfor reinforcement learning

Zhipu AI presenterte GLM-5.2 og argumenterer for at kunnskapsbasert læring (KL) er mer effektivt enn reinforcement learning (RL) for modellforbedring. Dette strider mot DeepSeeks tidligere tilnærming som prioriterte RL-basert optimalisering.

HVORFOR DET BETYR NOE

Kampen om best metode for å forbedre store språkmodeller påvirker hvordan kommende modeller blir trent. Hvis GLM-5.2 demonstrerer overlegne resultater med KL-fokus, kan det påvirke bransjens investerings- og designvalg.

KILDER

MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.