AI-nyheder · Gennembrud og forskning · 14. september 2026 · Ekspert
AI-tests viser fortsat hurtig fremgang - flere målinger peger samme vej
Flere uafhængige AI-benchmarks viser fortsat hurtig og jævn fremgang, uden tegn på afmatning. De bedste AI-modeller matcher eller slår nu erfarne mennesker på en række komplekse opgaver.
Flere forskellige tests af AI's evner peger i samme retning: fremgangen er hurtig og ser ikke ud til at bremse op.
Et af målene, METR Long Tasks, viser hvor meget menneskeligt arbejde en AI kan klare helt på egen hånd - og den kurve bliver stejlere for hver måling.
På det svære spørgsmål-benchmark GPQA (spørgsmål uden for eget fagområde) scorer de bedste AI-modeller nu 94%, mens kandidatstuderende typisk lander på 34% uden for deres speciale.
I GDPval, hvor branchefolk sammenligner AI med erfarne mennesker på komplekse arbejdsopgaver, matcher eller slår de nyeste AI-modeller topfolk i 82% af tilfældene.
Også på Humanity's Last Exam (svære opgaver skrevet af universitetsprofessorer) og på gåde-løsning ses samme mønster: hurtig og vedvarende fremgang.
Hvad betyder det for dig? Ikke noget du skal handle på i morgen - men et solidt tegn på, at AI-værktøjer fortsat bliver mere kompetente på kompleks arbejde, både privat og i virksomheden. Hold øje, hvis du bruger AI til opgaver hvor 'god nok' i dag snart kan blive til 'bedre end en ekspert'.
Kilde
- One Useful Thing (Ethan Mollick)
Mere om emnet
Få ugens AI-nyheder i indbakken
Vælg selv niveau, emner og længde. Én mail om ugen, afmeld når som helst.
Tilmeld dig Promptly Nyhedsbrev