SAK · FORSKNING_

OpenAI viser at resonnering-modeller har dårlig kontroll over tankerekker – og mener det er positivt

OpenAI presenterer et nytt verktøy kalt CoT-Control og dokumenterer at avanserte resonnering-modeller sliter med å kontrollere sine interne tankerekker. Forskerne konkluderer at denne manglende kontrollen faktisk gjør modellene lettere å overvåke og forstå.

HVORFOR DET BETYR NOE

Evnen til å kontrollere og inspisere resonnering-prosesser er kritisk for AI-sikkerhet. Hvis selv modellene selv ikke kan fullstendig styre sine tankerekker, blir det enklere å oppdage manipulativ eller skjult oppførsel.

KILDER

MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.