Erhverv og økonomi·3. oktober kl. 14:54
Opus 5.5 forringet? Brugere mistænker kvalitetsfald efter lancering
AI-genereret og kontrolleret ud fra de angivne kilder herunder.
Nogle brugere mener, at Claude Opus 5.5 er blevet dårligere siden lanceringen 22. september. Et nyt offentligt benchmark skal undersøge, om det passer, men der er endnu ingen dokumentation.

Kort tid efter at Anthropic lancerede AI-modellen Claude Opus 5.5 den 22. september 2026, er der dukket påstande op om, at den bliver dårligere med tiden. Det er endnu kun brugerindtryk, og der er ikke fundet noget bevis.
Må man tro de første anmeldelser, var modellen ellers et skridt frem. Anthropic siger, at svarene er 40 procent mindre ordrige end i forgængeren Opus 5, og at modellen skriver mere end 30 procent hurtigere. Nyhedsbrevet Every har skrevet, at den producerer »den mest læsværdige prosa« fra en model fra Anthropic eller OpenAI. Standardindstillingen er desuden flyttet fra »høj« til »medium« indsats, hvilket betyder, at abonnementet rækker længere.
Et benchmark holder øje
For at afprøve rygtet er der startet et projekt, der hedder Livenerf. Det er en test over 30 dage, hvor man på forhånd har lagt metoden fast. Hver dag stiller man de samme 78 spørgsmål til modellen via et Claude Max-abonnement. Man måler, hvor korrekte svarene er, og hvor mange ord modellen bruger. Ændringer i svarlængden kan nemlig være et tidligt tegn på, at noget har ændret sig, før korrektheden falder.
Opbyggeren har i en indledende test fundet, at lavere indsatsniveau skærer markant i svarlængden. Han fandt også, at det næsten ikke kunne ses forskel på Opus 5.5 og Opus 5 i hans test.
Skepsis i debatten
I diskussionen på Hacker News siger nogle, at de har mærket et fald efter lanceringen. Andre mener, at det skyldes en »honeymoon-effekt«: Man er imponeret i starten og bliver mere kritisk, når nyhedens interesse har lagt sig, eller når man bruger modellen til sværere opgaver.
Heeler er det ikke helt ude af luften, at sådanne klager kan have noget på sig. Et andet benchmark, Nerf Bench, opdagede tidligere et fald i Opus 4.6, som Anthropic anerkendte. Anthropic har selv sagt, at firmaet ikke sænker kvaliteten på grund af travlhed eller belastning, men i en gennemgang fra september 2025 indrømmede de, at tre tekniske fejl i en periode forringede Claudes svar.
Hvad betyder det for dig?
Hvis du bruger Claude i arbejdet, er der ingen grund til panik. Der er endnu ingen dokumenteret forringelse af Opus 5.5. Har du en vigtig opgave, så gem eksempler på gode svar nu, så du kan sammenligne senere. Resultaterne fra Livenerf vil give et mere nøgternt billede om en måneds tid.
Kilder
Mere om emnet
Få ugens AI-nyheder i indbakken
Vælg selv niveau, emner og længde. Én mail om ugen, afmeld når som helst.
Tilmeld dig Promptly Nyhedsbrev



