Uforpligtende snakFå afklaret jeres idé, udfordring eller næste skridtTal med os
Præcisionsværktøjer, diagramark og målevægte på et lyst nordisk arbejdsbord
AI Benchmarks · Et bedre beslutningsgrundlag
Kildekontrolleret 7. september 2026

AI-benchmarks.
Se, hvad tallene bygger på.

Sammenlign modeller, regn på tokenpriser, og læs offentliggjorte resultater med deres metode. Her kan I se forskel på et regnestykke, en leverandørs benchmark og en test, der endnu skal køres.

12Dokumenterede modeller
3Modeludbydere
8Sammenligninger og metoder
Beregnet fra listepriser

Pris og tokenforbrug

Sammenlign 12 dokumenterede modeller med samme tokenbudget. Se USD-priser, regneeksempler og tidsbegrænsede vilkår kontrolleret 7. september 2026.

Læs sammenligning og metode →
Offentlige kilder

Offentlige benchmarkresultater

Udvalgte offentliggjorte resultater for Astra, Sol, Fable, Opus og Gemini. Tre afsendere, tydelige benchmarkversioner og ingen opfundet samlet score.

Læs sammenligning og metode →
Offentlige kilder

Aktuelle modeller

Et dateret overblik over OpenAI, Anthropic og Google: præcise API-ID’er, tokenpriser, kontekstgrænser, outputgrænser og preview-status.

Læs sammenligning og metode →
Testmetode · ingen egne resultater

Svartid og latency

En reproducerbar metode til TTFT, total svartid, p50 og p95. De tidligere millisekundtal er trukket tilbage, fordi rå målinger ikke kunne dokumenteres.

Læs sammenligning og metode →
Testmetode · ingen egne resultater

Dansk sprogkvalitet

EuroEval som ekstern reference og en dansk evalueringsrubrik. Tidligere kvalitetsestimater er trukket tilbage; nye modelrangeringer kræver dokumentation.

Læs sammenligning og metode →
Testmetode · ingen egne resultater

JSON og Structured Outputs

Opdateret dokumentation for OpenAI, Anthropic og Gemini. Skeln mellem gyldig JSON, schemaoverholdelse og fagligt korrekte værdier.

Læs sammenligning og metode →
Offentlige kilder

Kontekst og dokumenter

Dokumenterede input- og outputgrænser samt en testmetode til kildebrug, genfinding og svar fra lange dokumenter.

Læs sammenligning og metode →
Arkiv · tidligere tal trukket tilbage

Metode og rettelser

Forskellen på beregnede priser, eksterne resultater og egne forsøg. Her dokumenterer vi også tilbagetrækningen af de tidligere april-tal.

Læs sammenligning og metode →

Vælg model efter jeres opgave

En høj offentlig score er et udgangspunkt for en pilot. Lad jeres egne dokumenter, svar og acceptkriterier afgøre, om kvalitet, svartid og pris passer til driften.

Læs guiden til modelvalg eller planlæg en afgrænset AI-pilot.

FRA VIDEN TIL JERES NÆSTE SKRIDT

Skal modellerne vurderes på jeres opgave?

Beskriv arbejdsgangen og jeres vigtigste kvalitetskrav. Vi kan afklare rammerne for en afgrænset test og et konkret tilbud. Samtalen er uforpligtende.

  • Gennemgang af opgave og datagrundlag
  • Afklaring af kvalitet, pris og svartid
  • Forslag til et overskueligt testforløb
M
Et svar fra mennesker, der bygger.Mosel Studio · Svendborg · Hele Danmark
kontakt@moselstudio.dk
Hvordan vil du helst starte?

Uforpligtende henvendelse · Vi aftaler næste skridt med jer