SAK · MODELLER_
Qwen3-Max Thinking slår Gemini 3 Pro og GPT-5.2 på Humanity's Last Exam
Alibabas Qwen3-Max Thinking-modell oppnådde høyeste poengsum på benchmark-testen Humanity's Last Exam sammenlignet med Googles Gemini 3 Pro og OpenAIs GPT-5.2. Modellen ble testet med søkefunksjoner aktivert.
HVORFOR DET BETYR NOE
Det viser at Qwen nå konkurrerer med de ledende laboratoriene på avanserte reasoning-oppgaver, og indikerer at det åpnes opp konkurranse på frontlinjen av modellutvikling utenfor USA.
KILDER
MASKINGENERERT SAMMENDRAG Sammendraget er skrevet maskinelt fra kildene under. Vi sorterer og forklarer — men vi er en inngang til feltet, ikke en fasit. Sjekk kilden når noe betyr noe for deg.