AI-nyheder · Gennembrud og forskning · 14. september 2026 · Ekspert

AI-tests viser fortsat hurtig fremgang - flere målinger peger samme vej

Flere uafhængige AI-benchmarks viser fortsat hurtig og jævn fremgang, uden tegn på afmatning. De bedste AI-modeller matcher eller slår nu erfarne mennesker på en række komplekse opgaver.

Flere forskellige tests af AI's evner peger i samme retning: fremgangen er hurtig og ser ikke ud til at bremse op.

Et af målene, METR Long Tasks, viser hvor meget menneskeligt arbejde en AI kan klare helt på egen hånd - og den kurve bliver stejlere for hver måling.

På det svære spørgsmål-benchmark GPQA (spørgsmål uden for eget fagområde) scorer de bedste AI-modeller nu 94%, mens kandidatstuderende typisk lander på 34% uden for deres speciale.

I GDPval, hvor branchefolk sammenligner AI med erfarne mennesker på komplekse arbejdsopgaver, matcher eller slår de nyeste AI-modeller topfolk i 82% af tilfældene.

Også på Humanity's Last Exam (svære opgaver skrevet af universitetsprofessorer) og på gåde-løsning ses samme mønster: hurtig og vedvarende fremgang.

Hvad betyder det for dig? Ikke noget du skal handle på i morgen - men et solidt tegn på, at AI-værktøjer fortsat bliver mere kompetente på kompleks arbejde, både privat og i virksomheden. Hold øje, hvis du bruger AI til opgaver hvor 'god nok' i dag snart kan blive til 'bedre end en ekspert'.

Kilde

  • One Useful Thing (Ethan Mollick)

Mere om emnet

Få ugens AI-nyheder i indbakken

Vælg selv niveau, emner og længde. Én mail om ugen, afmeld når som helst.

Tilmeld dig Promptly Nyhedsbrev