Gennembrud og forskning·7. oktober kl. 17:36
OpenAI lod ny model prøve kræfter på 4.000 uløste matematikproblemer
AI-genereret og kontrolleret ud fra de angivne kilder herunder.
OpenAI har offentliggjort 722 matematiske manuskripter fra en intern, endnu uudgivet model, der gik løs på omkring 4.000 åbne problemer, men resultaterne er ikke fagfællebedømt.

Hvad er nyt
OpenAI har sluppet en samling matematiske resultater fra en intern model, som endnu ikke er udgivet. Modellen fik cirka 4.000 åbne matematikproblemer, altså opgaver som forskere ikke har kunnet løse. Resultatet ligger offentligt på GitHub: 722 manuskripter fordelt på 372 forskningsfamilier. De dækker ren matematik, teoretisk datalogi og matematisk fysik.
Det kommer efter, at OpenAI i september fremlagde et resultat om de såkaldte Navier-Stokes-ligninger, som beskriver bevægelse i væsker. Virksomheden har også sagt, at modellen har løst mere end 100 langvarige åbne problemer. Modellens navn og en udgivelsesdato er ikke oplyst i de kilder, jeg har fundet.
Hvad er smart
Meget af arbejdet er tjekket af en computer. Mange beviser er oversat til Lean, et programmeringssprog hvor en computer kan kontrollere, at hvert trin i et matematisk bevis holder. Det gør det lettere at stole på resultaterne end ved et almindeligt tekstbevis.
Tempoet er også bemærkelsesværdigt. Hvert godkendt resultat kostede i gennemsnit omkring tre timers regnekraft svarende til ChatGPT Pro. Eksempler er arbejde med, hvor tæt tallet pi kan tilnærmes med brøker, og beviser for at visse problemer i kompleksitetsteori er ekstremt svære at løse.
OpenAI har desuden talt med en rådgivergruppe om matematik og kunstig intelligens på Institute for Advanced Study, og der oprettes en uafhængig og ulønnet gruppe, som skal vurdere resultaternes betydning.
Billigere eller bedre?
Det er ikke et produkt, man kan købe, så der er ingen pris. Prisen er ikke oplyst, og der er ingen direkte sammenligning med Google eller Anthropic i de kilder, jeg har set.
Bedre er det svært at sige endnu. Mange manuskripter mangler stadig en Lean-version, og OpenAI siger selv, at nogle uformaliserede resultater kan have fejl. Selv computerkontrol beviser ikke automatisk, at hele forskningspåstanden er rigtig. Resultaterne er heller ikke fagfællebedømt, altså gennemgået af uafhængige forskere. Matematikere har også advaret mod at bruge åbne problemer som en slags pointtavle for AI.
Det er den god til
Først og fremmest viser det, at AI nu kan bruges som forskningsassistent i matematik og teoretisk datalogi. Det er et område, hvor man tidligere mest testede AI på færdige skoleopgaver og konkurrenceopgaver.
For almindelige brugere og virksomheder ændrer det ikke noget lige nu, for modellen er intern. Men den slags evne til lange, præcise ræsonnementer kan på sigt komme andre områder til gode, fx kodning, kryptografi og videnskabelig forskning. Det afhænger af, om resultaterne holder, når forskere har gennemgået dem.
Kilder
Mere om emnet
Få ugens AI-nyheder i indbakken
Vælg selv niveau, emner og længde. Én mail om ugen, afmeld når som helst.
Tilmeld dig Promptly Nyhedsbrev



