SAK · FORSKNING_
OpenAI viser at resonnering-modeller har dårlig kontroll over tankerekker – og mener det er positivt
OpenAI presenterer et nytt verktøy kalt CoT-Control og dokumenterer at avanserte resonnering-modeller sliter med å kontrollere sine interne tankerekker. Forskerne konkluderer at denne manglende kontrollen faktisk gjør modellene lettere å overvåke og forstå.
HVORFOR DET BETYR NOE
Evnen til å kontrollere og inspisere resonnering-prosesser er kritisk for AI-sikkerhet. Hvis selv modellene selv ikke kan fullstendig styre sine tankerekker, blir det enklere å oppdage manipulativ eller skjult oppførsel.
KILDER
MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.