Gratis værktøjFå en AI-drevet diagnose af dit website på få minutterPrøv AI Site Doctor
Lad os tale
Præcisionsværktøjer, diagramark og målevægte på et lyst nordisk arbejdsbord
Kontekst og dokumenter
← Alle benchmarks
Offentlige kilderGennemgået

AI og lange dokumenter: kontekstvindue er kun én grænse

Dokumenterede input- og outputgrænser samt en testmetode til kildebrug, genfinding og svar fra lange dokumenter.

Datagrundlag og metode

Kontekst- og outputgrænser er aflæst i modeldokumentationen. Tallene er tekniske maksimummer, ikke resultater for dokumentforståelse. Vi holder samlet kontekstvindue og maksimal inputlængde adskilt og viser præcist API-ID ved hver model.

Dokumenterede grænser pr. model

Kildekontrolleret 7. september 2026. USD pr. million tokens; standard API-behandling. Links i hver række dokumenterer oplysningerne.

12 modeller fra tre udbydere · specifikationer, ikke målte kvalitetsresultater
Model / API-IDKontekst / inputMaks. outputVilkår og kilder
GPT-6 AstraOpenAIgpt-6-astra1.050.000Samlet kontekstvindue128.000 tokensAPI-model; udrulning og adgang afhænger af konto.ModeldokumentationPrisvilkår
GPT-5.6 SolOpenAIgpt-5.6-sol1.050.000Samlet kontekstvindue128.000 tokensDokumenteret API-model; gpt-5.6 er et alias til Sol.ModeldokumentationPrisvilkår
GPT-5.6 TerraOpenAIgpt-5.6-terra1.050.000Samlet kontekstvindue128.000 tokensDokumenteret API-model.ModeldokumentationPrisvilkår
GPT-5.6 LunaOpenAIgpt-5.6-luna1.050.000Samlet kontekstvindue128.000 tokensDokumenteret API-model.ModeldokumentationPrisvilkår
Claude Fable 5.1Anthropicclaude-fable-5-11.000.000Samlet kontekstvindue128.000 tokensDokumenteret API-model med produktionens sikkerhedsforanstaltninger.ModeldokumentationPrisvilkår
Claude Opus 5Anthropicclaude-opus-51.000.000Samlet kontekstvindue128.000 tokensDokumenteret API-model.ModeldokumentationPrisvilkår
Claude Sonnet 5Anthropicclaude-sonnet-51.000.000Samlet kontekstvindue128.000 tokensDokumenteret API-model.ModeldokumentationPrisvilkår
Claude Haiku 4.5Anthropicclaude-haiku-4-5-20251001200.000Samlet kontekstvindue64.000 tokensDokumenteret API-snapshot.ModeldokumentationPrisvilkår
Gemini 3.8 FlashGooglegemini-3.8-flash1.048.576Maksimalt input65.536 tokensDokumenteret Gemini API-model.ModeldokumentationPrisvilkår
Gemini 3.7 FlashGooglegemini-3.7-flash1.048.576Maksimalt input65.536 tokensDokumenteret Gemini API-model.ModeldokumentationPrisvilkår
Gemini 3.5 Flash-LiteGooglegemini-3.5-flash-lite1.048.576Maksimalt input65.536 tokensDokumenteret Gemini API-model.ModeldokumentationPrisvilkår
Gemini 3.1 Pro PreviewGooglegemini-3.1-pro-preview1.048.576Maksimalt input65.536 tokensPreview. Kontrollér versionsændringer og adgang før produktion.ModeldokumentationPrisvilkår

Input, output og arbejdsplads

En samlet kontekstgrænse skal rumme de dele, udbyderen tæller i vinduet. Et separat inputmaksimum er en anden specifikation. Historik, værktøjsdefinitioner, dokumenter og reserveret output påvirker, hvad en request kan rumme. Brug dokumentationen for det valgte endpoint frem for at læse 1M som én million tegn.

Test genfinding og kildebrug

Lav spørgsmål, hvor facit findes i dokumenterne. Fordel relevante passager i begyndelsen, midten og slutningen. Medtag modstridende versioner, manglende svar og tabeller. Bedøm svar, kildehenvisning og evnen til at sige, at materialet ikke giver grundlag for en konklusion.

Sammenlign fuldt dokumentinput med retrieval på de samme spørgsmål. Registrér, om fejlen kommer fra genfinding eller modellens behandling af den fundne tekst. Det gør det muligt at forbedre det rigtige led.

Adgang er en del af forsøget

Et korrekt svar kan stadig være en fejl, hvis brugeren ikke måtte se kilden. Medtag roller, dokumentversioner og fjernede dokumenter i testsættet. Gør kildeadgang til et eksplicit acceptkriterium.

Det kan du ikke udlede af siden

  • Maksimale grænser er ingen garanti for korrekt eller fuldstændig dokumentforståelse.
  • Lang kontekst kan ændre pris og svartid; prisberegneren bruger kun korte tekstscenarier.
  • Der er ikke kørt nye egne RAG- eller langkonteksttests til siden.

Sådan bruger I det i en beslutning

Vælg model og retrieval-metode efter korrekte svar med de rette kilder og rettigheder. Et stort vindue erstatter ikke evaluering.

Guide: RAG-chatbot med egen vidensbase

Kilder og kontroltidspunkt

FRA VIDEN TIL JERES NÆSTE SKRIDT

Skal modellerne vurderes på jeres opgave?

Beskriv arbejdsgangen og jeres vigtigste kvalitetskrav. Vi kan afklare rammerne for en afgrænset test og et konkret tilbud.

  • Gennemgang af opgave og datagrundlag
  • Afklaring af kvalitet, pris og svartid
  • Forslag til et overskueligt testforløb
M
Et svar fra mennesker, der bygger.Mosel Studio · Svendborg · Hele Danmark
kontakt@moselstudio.dk
Hvordan vil du helst starte?

Uforpligtende henvendelse · Ingen automatisk tilmelding