SAK · FORSKNING_

OpenAI og Paradigm lanserer EVMbench for sikkerhetstesting av AI-agenter

OpenAI og Paradigm har introdusert EVMbench, et benchmark som måler hvor godt AI-agenter kan oppdage, reparere og utnytte alvorlige sikkerhetshull i smarte kontrakter. Benchmarken er designet for å evaluere evnen til autonome systemer å håndtere blockchain-sikkerhet.

HVORFOR DET BETYR NOE

Dette markerer en eskalering av AI-agenter fra tekstoppgaver til å operere på kritisk infrastruktur. Det setter fokus på både muligheten for AI til å forbedre smart contract-sikkerhet og risikoen for misbruk dersom agenter blir mer dyktige.

KILDER

MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.