Kort svar
GPT-6 Astra vinder ikke entydigt over Anthropics Claude Fable 5.1 — den er hurtigere og bedre til computerbrug, men taber på det samlede intelligensindeks. De virale X-demoer af 3D-genskabte spilkonsoller er underholdende, men den historie, der reelt betyder noget for danske virksomheder, er hvilken model der er bedst til hvilken opgave — og hvorfor ingen af dem vinder på alt.
- Astra scorer 72,6 procent på OSWorld 2.0 og løser opgaver cirka 47 procent hurtigere end forgængeren GPT-5.6 Sol, ifølge DataCamp.
- Claude Fable 5.1 fører på Artificial Analysis’ samlede intelligensindeks med 66 point mod Astras 61.
- Astra vinder klart på FrontierMath Tier 4 (97,6 % mod 87,8 %) og på computerbrug — Fable 5.1 vinder på Humanity’s Last Exam og videnskabelig ræsonnering.
- Astras egne demoer på X (3D-genskabelser af spilkonsoller ud fra tekst) er reelt et sidespor: de viser modellens billedforståelse, ikke de evner, der afgør et virksomhedsvalg.
Hvem vinder egentlig: Astra eller Fable 5.1?
Der er intet entydigt svar, og det er selve pointen. Ifølge en sammenligning fra Emergent er billedet blandet: hver model topper forskellige benchmarks, så det rigtige valg afhænger af opgaven — Claude Fable 5.1 fører på det uafhængige Artificial Analysis Intelligence Index med en score på 66 mod Astras 61, og vinder desuden på Humanity’s Last Exam og agentiske videnskabsopgaver.
Astra vinder til gengæld klart på andre målinger. Ifølge NextBigFuture’s gennemgang af lækkede benchmarks scorer Astra 97,6 procent på FrontierMath Tier 4, mod 87,8 procent for både Fable 5.1 og Fable 5 — samme mønster ses på GPQA Diamond. MindStudio opsummerer forskellen præcist: Astra vinder ikke konsekvent, men slår Fable 5.1 særligt på opgaver med computerbrug, terminalarbejde og lange kontekster.
Demoerne på X understøtter billedet af, at Astra er blevet reelt bedre til computerbrug. Ifølge en gennemgang fra DataCamp sætter Astra en ny standard for computer- og browserbrug: modellen scorer 72,6 procent på OSWorld 2.0 og løser samtidig opgaverne omkring 47 procent hurtigere end forgængeren GPT-5.6 Sol. OpenAI-forsker Mark Chen fremhævede selv dette i et opslag om lanceringen: han opfordrede brugere, der tidligere har oplevet funktionen som for langsom eller upræcis, til at prøve igen, fordi den ifølge ham “just works” nu, sammenlignet med det tidligere Operator-værktøj. Prisen på computerbrug er stadig et åbent spørgsmål: hverken OpenAI eller Anthropic har offentliggjort fuldt sammenlignelige tal for opgaver af denne type endnu.
Det er ikke længere kun ét imponerende benchmark-tal — det er kombinationen af høj nøjagtighed og markant lavere tidsforbrug, der gør Astras computerbrug interessant.
Hvad koster forskellen — og er den værd at betale for?
Prismæssigt tegner der sig et mønster: tidlige omkostningsestimater placerer Astra over GPT-5.6, men ifølge samme kilder formentlig stadig over Claude Fable 5.1 for sammenlignelige arbejdsopgaver. Det betyder, at Astras fordel på computerbrug og hastighed reelt koster mere pr. opgave — og det ændrer regnestykket for virksomheder, der overvejer et skift.
Ingen af de to selskaber har endnu offentliggjort fuldt sammenlignelige, officielle prislister for identiske opgavetyper, så det konkrete regnestykke må laves pr. use case, ikke ud fra overskrifter.
Hvilken model skal en dansk virksomhed vælge?
Svaret afhænger af opgaven, ikke af hvilken model der “vandt” lanceringsugen. Skal en dansk virksomhed løse en konkret opgave som browserautomatisering, terminalarbejde eller lange dokumentanalyser, peger tallene på Astra. Kræver opgaven bredere ræsonnering, videnskabelig dybde eller de sværeste tænkeopgaver, ligger Fable 5.1 foran ifølge de uafhængige målinger fra Artificial Analysis.
Det er værd at huske, næste gang en spektakulær demo cirkulerer på X: en model, der kan genskabe en spillekonsol som 3D-model på 32 minutter, siger noget om billedforståelse — ikke nødvendigvis om hvilken model der løser din virksomheds faktiske opgaver bedst.
Hvad er OSWorld 2.0?
OSWorld 2.0 er en uafhængig benchmark, der tester, hvor godt en AI-model kan udføre virkelige computeropgaver — som at navigere i browsere, redigere filer og bruge software — sammenlignet med, hvordan en menneskelig bruger ville løse samme opgave.
Er Claude Fable 5.1 hurtigere eller billigere end GPT-6 Astra?
Ifølge tidlige omkostningsestimater fra MindStudio ligger prisen pr. opgave for Claude Fable 5.1 formentlig under Astras for sammenlignelige arbejdsbelastninger, men begge selskaber har endnu ikke offentliggjort fuldt sammenlignelige, officielle prislister for identiske opgavetyper.
Kilder: X (@markchen90), DataCamp, MindStudio, NextBigFuture, Emergent, Artificial Analysis — alle med data fra 3.-5. september 2026.
Senest revideret 6. september 2026. Artiklen gennemgås løbende, når AI-søgelandskabet flytter sig.






