Naar inhoud
AI Board

Onderzoek · september 2026

AI-modellen voor bestuurders 2026

Elk actueel model, de vier dingen die sinds 2023 veranderden en het eerlijke antwoord over Europese hosting. Geschreven voor wie moet beslissen of een AI de bestuursmap mag lezen, niet voor wie het moet uitrollen.

  • Gepubliceerd
  • 22 min leestijd
  • Onderdeel van het AI Board onderzoeksprogramma

Gepubliceerde contextvensters, 2022 tot 2026

Lopend maximum van het door de leverancier opgegeven contextvenster, logaritmische schaal. Bronnen: leveranciersdocumentatie en lanceringsposts, geraadpleegd op 8 september 2026.

Het laatste punt is een eigen claim van Meta voor Llama 4 Scout, onderbouwd met één zoektest en niet met een onafhankelijke meting.

Elke stap in het grootste gepubliceerde contextvenster tussen november 2022 en september 2026.
DatumModelGepubliceerd contextvenster
30 nov 2022ChatGPT (GPT-3.5)4,1K
14 mrt 2023GPT-48,19K
11 mei 2023Claude (100K)100K
6 nov 2023GPT-4 Turbo128K
21 nov 2023Claude 2.1200K
27 jun 2024Gemini 1.5 Pro (2M)2M
5 apr 2025Llama 4 Scout10M
8labs met een actueel vlaggenschip
39actuele modellen in dit rapport
28met een route naar EU-dataresidentie

Bij het EU-cijfer horen kanttekeningen over residentie. Sectie 06 loopt ze model voor model na.

01Inleiding

Waarom dit rapport bestaat

Elke week wordt er weer een model aangekondigd, en elke aankondiging komt met een benchmarktabel die een bestuurder weinig zegt. Dit rapport doet iets anders. Het brengt het modellandschap in kaart zoals dat er op 8 september 2026 bij stond, in de taal van iemand die moet beslissen of een AI de bestuursmap mag lezen.

Drie begrippen dragen het hele rapport, dus die staan hier eenmalig uitgelegd. Een token is de eenheid waarin een model tekst leest, ongeveer driekwart van een Engels woord. Een contextvenster is hoeveel tekst een model tegelijk in beeld kan houden, geteld in tokens; in dit rapport telt één bestuursstuk van twintig pagina's als ongeveer 12.000 tokens, een aanname die we noemen zodat je er tegenin kunt gaan. Een vlaggenschip is het sterkste model dat een lab op dat moment verkoopt, in tegenstelling tot de goedkopere tiers eronder die de meeste organisaties in het dagelijks werk gebruiken.

Het beantwoordt vier vragen.

  1. Welke modellen bestaan er, welke zijn actueel en welke worden onder je vandaan uitgefaseerd?
  2. Wat veranderde er tussen 2023 en 2026 dat echt telt voor bestuurlijk werk?
  3. Welke modellen kun je met dataresidentie binnen de EU draaien, en tegen welke prijs?
  4. Welk model hoort bij welke situatie, voor een bestuurder, een financieel directeur en een technisch verantwoordelijke?

De gescoorde tegenhanger van deze kaart is de AI Board Model Index, eerste editie november 2026. Wil je alleen het praktische antwoord voor één rol, begin dan bij welk AI-model voor welke rol.

De samenvatting in één alinea

In september 2026 leveren 8 labs uit dit rapport een actueel vlaggenschip: OpenAI, Anthropic, Google, xAI, Meta, DeepSeek, Mistral en Alibaba. Vier andere, Cohere, Moonshot AI, NVIDIA en Z.ai, staan in de modellijst zonder een volledig labprofiel. Samen volgt dit rapport 39 actuele modellen. Drie dingen veranderden sinds 2023 die een bestuur moet weten, en één ding veranderde niet.

Eén: geheugen. GPT-4 kwam in maart 2023 met een contextvenster van 8.192 tokens, minder dan één bestuursstuk. Vandaag documenteert OpenAI GPT-6 Astra op 1.050.000 tokens, documenteert Anthropic Claude Fable 5.1 op 1.000.000 en documenteert Google Gemini 3.8 Flash op 1.048.576. Met de aanname van dit rapport is dat ruwweg 87 bestuursstukken tegelijk in beeld. Twee kanttekeningen horen naast dat getal. Het plafond beweegt niet meer sinds 27 juni 2024, toen Google een venster van twee miljoen tokens op Gemini 1.5 Pro voor alle ontwikkelaars openstelde. En gepubliceerd onderzoek is helder over het gat tussen geadverteerd en bruikbaar: de RULER-studie (Hsieh en collega's, 2024) vond dat slechts de helft van de modellen die 32.000 tokens of meer claimen bij 32.000 nog aanvaardbaar presteerde.

Twee: redeneren. Sinds september 2024 levert elk lab modellen die eerst een probleem doorwerken voordat ze antwoorden, en in 2026 zit dat gedrag in de vlaggenschepen ingebouwd in plaats van dat het als apart product wordt verkocht. Leveranciers melden forse dalingen in zelfverzekerde feitelijke fouten tussen hun eigen generaties. Dat zijn cijfers van leveranciers op eigen vragensets, dus lees ze als richting en niet als meting. Sectie 03 zet precies uiteen wat elk lab publiceerde, en wat niet.

Drie: soevereiniteit. Voor het eerst kunnen modellen die sterk genoeg zijn voor bestuurswerk draaien met dataresidentie binnen de Europese Unie: 28 van de actuele modellen in dit rapport hebben een route die de leverancier documenteert, zelf hosten en Europese aanbieders meegeteld. Het detail dat telt is welke topmodellen dat niet hebben. GPT-6 Astra heeft geen EU-route, Claude Fable 5.1 en Gemini 3.8 Flash hebben er elk één, en de tier er net onder is waar de meeste Europese organisaties uitkomen. Sectie 06 werkt de routes uit, en de data uit de EU AI-verordening, die in 2026 zijn verschoven.

Wat niet veranderde: elk model beweert nog steeds af en toe iets dat niet in jouw documenten staat, met overtuiging en in jouw huisstijl. Geen enkele release heeft dat in vier jaar weggenomen. Daarom eindigt dit rapport in een test die je zelf kunt draaien in plaats van in een merk dat wij aanraden, en daarom hoort meten, niet marketing, de vraag te beslissen.

02Het landschap in één oogopslag

Elk actueel vlaggenschip, september 2026

13 vlaggenschepen van 12 organisaties, zoals hun eigen documentatie ze op 8 september 2026 beschreef. Daarvan hebben er 8 een gedocumenteerde route om binnen de Europese Unie te draaien, publiceren er 5 hun gewichten, en redeneren ze allemaal voordat ze antwoorden.

Opgegeven geheugen per vlaggenschip
  • GPT-6 Astra1,05M tokens, ongeveer 87 bestuursstukken
  • Gemini 3.8 Flash1,05M tokens, ongeveer 87 bestuursstukken
  • Kimi K31,05M tokens, ongeveer 87 bestuursstukken
  • Claude Fable 5.11M tokens, ongeveer 83 bestuursstukken
  • Claude Mythos 5.11M tokens, ongeveer 83 bestuursstukken
  • Muse Spark 1.31M tokens, ongeveer 83 bestuursstukken
  • DeepSeek-V4-Pro1M tokens, ongeveer 83 bestuursstukken
  • Qwen3.8-Max1M tokens, ongeveer 83 bestuursstukken
  • GLM-5.31M tokens, ongeveer 83 bestuursstukken
  • Nemotron 3 Ultra1M tokens, ongeveer 83 bestuursstukken
  • Grok 4.6500K tokens, ongeveer 41 bestuursstukken
  • Mistral Medium 3.5256K tokens, ongeveer 21 bestuursstukken
  • Command A+128K tokens, ongeveer 10 bestuursstukken
Door de leverancier opgegeven contextvensters van de actuele vlaggenschepen. Het grootste is GPT-6 Astra met 1.050.000 tokens, ongeveer 87 bestuursstukken. Het kleinste is Command A+ met 128.000 tokens.
LabelValue
GPT-6 Astra1,05M tokens, ongeveer 87 bestuursstukken
Gemini 3.8 Flash1,05M tokens, ongeveer 87 bestuursstukken
Kimi K31,05M tokens, ongeveer 87 bestuursstukken
Claude Fable 5.11M tokens, ongeveer 83 bestuursstukken
Claude Mythos 5.11M tokens, ongeveer 83 bestuursstukken
Muse Spark 1.31M tokens, ongeveer 83 bestuursstukken
DeepSeek-V4-Pro1M tokens, ongeveer 83 bestuursstukken
Qwen3.8-Max1M tokens, ongeveer 83 bestuursstukken
GLM-5.31M tokens, ongeveer 83 bestuursstukken
Nemotron 3 Ultra1M tokens, ongeveer 83 bestuursstukken
Grok 4.6500K tokens, ongeveer 41 bestuursstukken
Mistral Medium 3.5256K tokens, ongeveer 21 bestuursstukken
Command A+128K tokens, ongeveer 10 bestuursstukken
Het door de leverancier opgegeven contextvenster per actueel vlaggenschip, in tokens. Bron: de eigen modeldocumentatie van elk lab, geraadpleegd op 8 september 2026. Dit is een capaciteit, geen meting van hoe goed het model die gebruikt.
Lijstprijs per miljoen invoertokens
  • Gemini 3.8 Flash$0,75 invoer, $3,75 uitvoer
  • Muse Spark 1.3$1,25 invoer, $4,25 uitvoer
  • DeepSeek-V4-Pro$1,32 invoer, $3,96 uitvoer
  • GLM-5.3$1,40 invoer, $4,40 uitvoer
  • Mistral Medium 3.5$1,50 invoer, $7,50 uitvoer
  • Grok 4.6$2 invoer, $6 uitvoer
  • Qwen3.8-Max$2 invoer, $6 uitvoer
  • Kimi K3$3 invoer, $15 uitvoer
  • GPT-6 Astra$10 invoer, $50 uitvoer
  • Claude Fable 5.1$10 invoer, $50 uitvoer
  • Claude Mythos 5.1$10 invoer, $50 uitvoer
De lijstprijzen voor een miljoen invoertokens lopen van $0,75 voor Gemini 3.8 Flash tot $10 voor de duurste vlaggenschepen, een verschil van ongeveer 13 keer.
LabelValue
Gemini 3.8 Flash$0,75 invoer, $3,75 uitvoer
Muse Spark 1.3$1,25 invoer, $4,25 uitvoer
DeepSeek-V4-Pro$1,32 invoer, $3,96 uitvoer
GLM-5.3$1,40 invoer, $4,40 uitvoer
Mistral Medium 3.5$1,50 invoer, $7,50 uitvoer
Grok 4.6$2 invoer, $6 uitvoer
Qwen3.8-Max$2 invoer, $6 uitvoer
Kimi K3$3 invoer, $15 uitvoer
GPT-6 Astra$10 invoer, $50 uitvoer
Claude Fable 5.1$10 invoer, $50 uitvoer
Claude Mythos 5.1$10 invoer, $50 uitvoer
Gepubliceerde API-lijstprijs voor één miljoen invoertokens, in Amerikaanse dollars, gesorteerd van goedkoop naar duur. Command A+, Nemotron 3 Ultra: geen lijstprijs per token gepubliceerd. Introductietarieven, daltarieven en toeslagen voor lange context staan in de noten per model in sectie 04. Bron: de eigen prijspagina van elk lab, geraadpleegd op 8 september 2026.

De tabel

Actuele vlaggenschepen per lab, stand 8 september 2026. Elk veld komt uit de eigen documentatie van het lab. Niets in deze tabel is een score.
LabVlaggenschipUitgebrachtOpgegeven geheugenRedenerenEU-residentieOpen gewichtenLijstprijs
OpenAIGPT-6 Astra3 sep 20261.050.000 tokensongeveer 87 bestuursstukkenJaNeeLagere tiers met een gedocumenteerde EU-route: GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna.Nee$10 invoer$50 uitvoerper miljoen tokens
AnthropicClaude Fable 5.11 sep 20261.000.000 tokensongeveer 83 bestuursstukkenJaJaGedocumenteerde routes: Google Cloud Agent Platform (Vertex AI), EU-multiregio-eindpuntNee$10 invoer$50 uitvoerper miljoen tokens
AnthropicClaude Mythos 5.11 sep 20261.000.000 tokensongeveer 83 bestuursstukkenJaNeeLagere tiers met een gedocumenteerde EU-route: Claude Fable 5.1, Claude Opus 5, Claude Sonnet 5.Nee$10 invoer$50 uitvoerper miljoen tokens
Google (DeepMind)Gemini 3.8 Flash2 sep 20261.048.576 tokensongeveer 87 bestuursstukkenJaJaGedocumenteerde routes: Google Cloud Vertex AI, alleen eu-multiregio (geen regionaal EU-endpoint)Nee$0,75 invoer$3,75 uitvoerper miljoen tokens
xAIGrok 4.612 aug 2026500.000 tokensongeveer 41 bestuursstukkenJaNeeGeen enkel actueel model van dit lab heeft een gedocumenteerde EU-route.Nee$2 invoer$6 uitvoerper miljoen tokens
MetaMuse Spark 1.32 sep 20261.000.000 tokensongeveer 83 bestuursstukkenJaNeeLagere tiers met een gedocumenteerde EU-route: Muse Glimmer 30B.Nee$1,25 invoer$4,25 uitvoerper miljoen tokens
DeepSeekDeepSeek-V4-Pro13 aug 20261.000.000 tokensongeveer 83 bestuursstukkenJaJaGedocumenteerde routes: Zelf gehost op een eigen of gehuurd GPU-cluster (de gewichten zijn openbaar onder MIT); Europese GPU-huur met een verwerkersovereenkomst, bijvoorbeeld een EU-regio van een soevereine cloudJaMIT$1,32 invoer$3,96 uitvoerper miljoen tokens
Mistral AIMistral Medium 3.5apr 2026256.000 tokensongeveer 21 bestuursstukkenJaJaGedocumenteerde routes: Mistral La Plateforme met Mistral Regional Endpoints ingesteld op Europa; Scaleway Generative APIs (Frankrijk), aangeboden als mistral-medium-3.5-128b; Zelf gehost met vLLM, TensorRT-LLM of TGI op eigen hardware; Microsoft Azure AI, AWS Bedrock, Google Cloud Vertex AI, IBM watsonx.ai en OutscaleDeelsModified MIT License: de gewichten zijn te downloaden, maar commercieel gebruik kent uitzonderingen voor bedrijven boven een omzetdrempel, dus het is geen gewone opensourcelicentie$1,50 invoer$7,50 uitvoerper miljoen tokens
Alibaba (Qwen)Qwen3.8-Max3 aug 20261.000.000 tokensongeveer 83 bestuursstukkenJaJaGedocumenteerde routes: Alibaba Cloud Model Studio, regio Duitsland (Frankfurt) eu-central-1Nee$2 invoer$6 uitvoerper miljoen tokens
Z.aiGLM-5.318 aug 20261.000.000 tokensongeveer 83 bestuursstukkenJaNeeLagere tiers met een gedocumenteerde EU-route: GLM-5.2.Nee$1,40 invoer$4,40 uitvoerper miljoen tokens
Moonshot AIKimi K3jul 20261.048.576 tokensongeveer 87 bestuursstukkenJaJaGedocumenteerde routes: Zelf gehost op een eigen of gehuurd GPU-cluster, onder de Kimi K3 LicenseJaKimi K3 License (eigen licentie; commerciële inference boven ongeveer 20 miljoen dollar jaaromzet brengt afdrachtverplichtingen mee)$3 invoer$15 uitvoerper miljoen tokens
CohereCommand A+20 mei 2026128.000 tokensongeveer 10 bestuursstukkenJaJaGedocumenteerde routes: Private Cohere-implementatie binnen je eigen virtual private cloud; On-premises implementatie op 1 x B200 of 2 x H100 met vierbits gewichten en activaties; Zelf gehost vanaf de Apache-2.0-gewichten op Hugging FaceJaApache-2.0Geen lijstprijs per token gepubliceerd
NVIDIANemotron 3 Ultra4 jun 20261.000.000 tokensongeveer 83 bestuursstukkenJaJaGedocumenteerde routes: Zelf gehost op een eigen of gehuurd GPU-cluster (OpenMDW-1.1); Elke Europese GPU-aanbieder die bereid is open gewichten voor je te draaienJaOpenMDW-1.1 (Open Model, Weights and Data License, versie 1.1)Geen lijstprijs per token gepubliceerd

Hoe je de tabel leest

Elke rij is het model dat een lab op dit moment bovenaan zijn eigen reeks zet, overgenomen uit de documentatie van dat lab op 8 september 2026. Er wordt hier niets gescoord. Een specificatietabel vertelt je wat een model mag doen, niet hoe goed het dat doet, en juist die afstand is de reden dat de AI Board Model Index bestaat.

Waarom opgegeven geheugen geen werkgeheugen is

Geheugen is het meest geciteerde getal in deze markt en de minst betrouwbare voorspeller van wat een model met je bestuursmap doet. Het is een capaciteit, geen kunde: de leverancier vertelt je hoeveel tekst het model accepteert, niet hoeveel daarvan het op pagina zevenhonderd nog correct gebruikt.

Het bewijs voor dat gat komt uit gepubliceerd onderzoek, niet uit marketing. Volgens RULER (Hsieh e.a., COLM 2024) presteerde van zeventien modellen die allemaal een venster van minstens tweeëndertigduizend tokens claimden, nog maar de helft acceptabel op precies die lengte. NoLiMa (Modarressi e.a., ICML 2025) is directer: van dertien modellen die minstens honderdachtentwintigduizend tokens adverteren, zakten er elf onder de helft van hun eigen score bij korte tekst zodra de invoer tweeëndertigduizend tokens bereikte, en GPT-4o, een van de sterkste in die studie, viel toch terug van 99,3 procent naar 69,7 procent. Liu e.a. (Transactions of the ACL, 2024) verklaren waarom die fouten willekeurig aanvoelen: de nauwkeurigheid is het hoogst als de relevante passage helemaal vooraan of achteraan staat, en zakt in het midden.

De EU-kolom wordt het vaakst verkeerd gelezen

Achter de woorden EU-hosting zitten drie vragen. Waar de berekening fysiek gebeurt. Wie de contractpartij is, want een EU-regio van een Amerikaanse cloud voldoet aan residentie en laat de Amerikaanse moedermaatschappij gewoon in de keten. En beschikbaarheid per model, en alleen die volgt deze kolom.

Wat er in negentig dagen veranderde

Het grootste deel van deze tabel bestond negentig dagen geleden nog niet. Anthropic bracht op 30 juni 2026 Sonnet 5 uit met het venster van een miljoen tokens van het vlaggenschip voor een vijfde van de prijs, Opus 5 op 24 juli, en Fable 5.1 op 1 september. OpenAI verving op 9 juli versienummers door benoemde tiers en presenteerde op 3 september GPT-6 Astra. DeepSeek leverde op 13 augustus V4-Pro met publieke gewichten onder een MIT-licentie, en Google maakte op 2 september Gemini 3.8 Flash algemeen beschikbaar terwijl de Pro-plek in preview bleef.

03De vier verschuivingen

Wat er veranderde, 2023 tot 2026: de vier verschuivingen die ertoe doen

Vier getallen bewogen tussen maart 2023 en september 2026, en elk daarvan verandert een ander besluit: geheugen, redeneren, soevereiniteit en prijs. Elke grafiek hieronder draagt de regel waarmee de data is geselecteerd en het gepubliceerde bewijs dat ertegenin gaat.

Token en contextvenster zijn één keer gedefinieerd, in de inleiding. Waar deze sectie tokens omrekent naar pagina's gebruikt ze een vaste aanname: een bestuursstuk van twintig pagina's van ongeveer 9.000 woorden is 12.000 tokens. Lees de vier verschuivingen op volgorde. Het zijn geen vier versies van hetzelfde goede nieuws.

01

Geheugen: van een half bestuursstuk naar een heel jaar aan stukken

In een zinHet contextvenster van het topmodel ging van 8.192 tokens in maart 2023 naar 1.050.000 in september 2026, maar het bruikbare deel is kleiner dan het geadverteerde deel.

In maart 2023 kwam GPT-4 met een contextvenster van 8.192 tokens, een cijfer dat OpenAI nog steeds op zijn modeldocumentatie publiceert. Neem een bestuursstuk van twintig pagina's als ongeveer 9.000 woorden, dat is ongeveer 12.000 tokens. Dat is de aanname die dit rapport overal hanteert, en die betekent dat GPT-4 niet eens een heel bestuursstuk tegelijk in beeld kon houden. Ongeveer twee derde ervan.

Wat dit betekent voor het bestuur

  • Passen is niet langer de beperking. Een jaar aan notulen, het jaarverslag en de begroting passen in een gesprek met elk huidig topmodel, dus stop met het afbakenen van AI-werk op documentgrootte.
  • Vraag naar het bruikbare getal, niet naar het geadverteerde. Gepubliceerd onderzoek laat zien dat de nauwkeurigheid ruim voor de opgegeven limiet daalt, dus behandel het venster als een plafond en eis bewijs bij de lengte die je echt gebruikt.

Contextvenster van het topmodel van OpenAI, maart 2023 tot september 2026

Logaritmische lijngrafiek. Het contextvenster van het topmodel van OpenAI steeg van 8.192 tokens in maart 2023 naar 1.050.000 tokens in september 2026, met een terugval naar 400.000 tokens voor GPT-5 in augustus 2025.
Pointseries
2023 H18,19K
2023 H2128K
2024 H1128K
2024 H2128K
2025 H11,05M
2025 H2400K
2026 H11,05M
2026 H21,05M
Logaritmische schaal. Punten, op volgorde: GPT-4, GPT-4 Turbo, GPT-4o, GPT-4o, GPT-4.1, GPT-5, GPT-5.6 Sol, GPT-6 Astra. Bron: modeldocumentatie van OpenAI, geraadpleegd op 8 september 2026.

Bestuursstukken: 1 = 12.000 tokens.

Hoe dit is geteld

Er is een lijn getekend, het topmodel van OpenAI, omdat dat de lijn is die de meeste besturen daadwerkelijk hebben gebruikt en elk punt op de eigen modelpagina's van OpenAI staat. Concurrerende topmodellen volgden dicht en worden in de tekst genoemd. De reeks bestuursstukken deelt het venster door 12.000 tokens, oftewel een stuk van twintig pagina's van ongeveer 9.000 woorden bij ruwweg 1,33 token per woord. Tokenaantallen verschillen per tokenizer, dus lees de aantallen stukken als orde van grootte, niet als meting.

Bewijs dat de andere kant op wijst

  • Van de modellen die een contextvenster van 32.000 tokens of meer claimen, hield slechts de helft bij 32.000 tokens een aanvaardbare prestatie vast.

    RULER: What's the Real Context Size of Your Long-Context Language Models? (arXiv:2404.06654)

  • Op de NoLiMa-evaluatie, die letterlijke woordoverlap tussen vraag en antwoord weghaalt, zakte GPT-4o van 99,3 procent bij korte context naar 69,7 procent bij 32.000 tokens, en elf van de dertien geteste modellen zakten onder de helft van hun eigen kortecontextscore.

    NoLiMa: Long-Context Evaluation Beyond Literal Matching (arXiv:2502.05167)

  • Het grootste breed beschikbare contextvenster is niet meer verschoven sinds 27 juni 2024, toen Google twee miljoen tokens op Gemini 1.5 Pro voor alle ontwikkelaars openstelde. Elk geverifieerd topmodel staat in september 2026 op een miljoen tot 1,05 miljoen.

    Google, new features for the Gemini API and Google AI Studio. OpenAI model documentation. Anthropic model overview. Gemini API: Gemini 3.8 Flash

02

Redeneren: minder zelfverzekerde fouten, niet nul fouten

In een zinOp de eigen productie-evaluatie van OpenAI daalde het aandeel antwoorden met een grote feitelijke fout van 20,6 procent voor GPT-4o naar 4,8 procent voor GPT-5 in redeneermodus, terwijl sommige redeneermodellen juist de andere kant op bewogen.

Eerst een begrip. Een redeneermodel produceert eerst een interne gedachtegang en geeft daarna pas antwoord, in plaats van in een keer te antwoorden. OpenAI bracht het eerste breed beschikbare exemplaar uit, o1, in december 2024. In 2026 zit dat gedrag in elk topmodel en kun je het per vraag hoger of lager zetten.

Wat dit betekent voor het bestuur

  • Zet de redeneermodus aan voor alles wat in een bestuursstuk terechtkomt. Binnen dezelfde modelfamilie scheelt het een factor vier in het aandeel grote fouten tussen de snelle modus en de redeneermodus.
  • Test het model op je eigen documenten voordat je het daarop vertrouwt. Redeneren dat helpt bij open vragen kan schaden bij samenvatten met bronbinding, en alleen je eigen materiaal laat zien in welk geval je zit.

Antwoorden met minstens een grote feitelijke fout

  • GPT-4o (May 2024)20,6%
  • o3 (Apr 2025)22,0%
  • GPT-5 main (Aug 2025)11,6%
  • GPT-5 thinking (Aug 2025)4,8%
Staafdiagram. Op productie-representatieve prompts van OpenAI met browsen aan bevatte 20,6 procent van de antwoorden van GPT-4o minstens een grote feitelijke fout, tegen 22,0 procent voor o3, 11,6 procent voor GPT-5 en 4,8 procent voor GPT-5 in redeneermodus.
LabelValue
GPT-4o (May 2024)20,6%
o3 (Apr 2025)22,0%
GPT-5 main (Aug 2025)11,6%
GPT-5 thinking (Aug 2025)4,8%
Lager is beter. Een evaluatie, een document, dus de vier staven zijn onderling vergelijkbaar. Bron: OpenAI, GPT-5 System Card, 13 augustus 2025, paragraaf 3.7.

Het tegenvoorbeeld: PersonQA-hallucinatiegraad over de redeneermodellen van OpenAI

  • o1 (Dec 2024)16%
  • o3 (Apr 2025)33%
  • o4-mini (Apr 2025)48%
Staafdiagram. Op PersonQA steeg de hallucinatiegraad van 16 procent voor o1 naar 33 procent voor o3 en 48 procent voor o4-mini, dus een nieuwer redeneermodel hallucineerde meer.
LabelValue
o1 (Dec 2024)16%
o3 (Apr 2025)33%
o4-mini (Apr 2025)48%
Lager is beter. Een andere evaluatie dan de grafiek hierboven, dus de twee zijn niet vergelijkbaar. Bron: OpenAI, o3 en o4-mini System Card, 16 april 2025, tabel 4, en de o1 System Card van 5 december 2024.

Hoe dit is geteld

De hoofdreeks komt uit een evaluatie in een document, de GPT-5 systeemkaart, dus de vier staven zijn onderling vergelijkbaar. Cijfers van verschillende leveranciers of verschillende evaluaties zijn niet vergelijkbaar en staan in aparte reeksen. De Vectara-ranglijst meet alleen samenvatten met bronbinding, en de eigen methodiek is tussen 2023 en 2026 gewijzigd, dus het staat er als momentopname van een datum en niet als trendlijn.

Bewijs dat de andere kant op wijst

  • Op PersonQA hallucineerde o3 van OpenAI met 0,33 en o4-mini met 0,48, tegen 0,16 voor het oudere o1. o3 was tegelijk het nauwkeurigere en het meer hallucinerende model.

    OpenAI, o3 and o4-mini System Card (16 April 2025). OpenAI, o1 System Card (5 December 2024)

  • Anthropic meldt dat Claude Opus 5 11 procent nauwkeuriger is dan Claude Opus 4.8 en dat de hallucinatiegraad 6 procent hoger ligt.

    Anthropic, Claude Opus 5 System Card (24 July 2026)

  • Een redeneermodel langer laten redeneren kan de prestatie verslechteren, een omgekeerde schaalrelatie die over vijf verschillende faalpatronen is gerapporteerd.

    Inverse Scaling in Test-Time Compute

  • Op de FACTS-benchmarksuite van Google DeepMind scoorde elk geëvalueerd model in totaal onder de 70 procent, ook het beste model van de eigen generatie.

    Google DeepMind, FACTS benchmark suite

03

Soevereiniteit: van een EU-optie naar acht, met het nieuwste model nog buiten beeld

In een zinIn 2023 kon een frontiermodel met EU-dataresidentie draaien. In september 2026 zijn dat er acht, maar het nieuwste topmodel van OpenAI, GPT-6 Astra, hoort daar niet bij.

In september 2026 staat de teller op acht: vijf gehost met een residentiegarantie, namelijk Claude Fable 5.1, Claude Opus 5, Claude Sonnet 5, GPT-5.6 Sol en Mistral Medium 3.5, en drie zelf te hosten, namelijk Mistral Large 3, DeepSeek-V4-Pro en de open Qwen3.8-release. Dan de bevinding die een besluit verandert. GPT-6 Astra, uitgebracht op 3 september 2026 en het meest capabele model van OpenAI, staat in de Amerikaanse en globale tabellen van Microsoft en in geen enkele Europese tabel. GPT-5.6 Sol staat in negen Europese regio's. Als jouw beleid EU-residentie is, is je OpenAI-plafond per september 2026 de vorige generatie. Grok 4.6 en Muse Spark 1.3 van Meta hebben helemaal geen geverifieerde EU-route.

Wat dit betekent voor het bestuur

  • EU-residentie is nu een echte keuze en geen compromis dat je moet uitleggen. Acht frontiermodellen kunnen binnen de EU draaien, vier daarvan uit de bovenkant van het aanbod van een groot lab.
  • Controleer het specifieke model, niet de leverancier. Het nieuwste topmodel van OpenAI is per september 2026 niet met EU-residentie beschikbaar terwijl de vorige generatie in negen Europese regio's staat, en hetzelfde gat trad eerder op bij Claude 3 Opus.

Frontiermodellen die binnen de EU kunnen draaien, per jaar

  • 20231
  • 20244
  • 20256
  • 20268
Staafdiagram. Het aantal frontiermodellen dat binnen de EU kan draaien steeg van een in 2023 naar vier in 2024, zes in 2025 en acht in september 2026.
LabelValue
20231
20244
20256
20268
Geteld volgens de definitie hieronder. Elk model achter elk getal staat met naam in de lijst, zodat het aantal te controleren is. Google Gemini telt in geen enkel jaar mee: geen enkele bron van Google noemt de EU-regio's met de daar beschikbare modellen.

Route een: gehost met een garantie op EU-dataresidentie

  • 20231
  • 20243
  • 20254
  • 20265
Staafdiagram. Modellen die gehost worden met een garantie op EU-dataresidentie stegen van een in 2023 naar drie in 2024, vier in 2025 en vijf in september 2026.
LabelValue
20231
20243
20254
20265
De leverancier of een cloudaanbieder legt zich vast op verwerking binnen EU-regio's.

Route twee: open gewichten, zelf te hosten op EU-hardware

  • 20230
  • 20241
  • 20253
  • 20263
Staafdiagram. Modellen met open gewichten die een bedrijf op eigen EU-hardware kan draaien stegen van geen in 2023 naar een in 2024 en drie in zowel 2025 als september 2026.
LabelValue
20230
20241
20253
20263
De twee routes tellen niet op tot het totaal: een model dat via beide routes beschikbaar is, zoals Mistral Large 3 in 2025 en 2026, telt een keer mee in het totaal.

Hoe dit is geteld

De twee definities staan naast de grafiek, en elk meegeteld model staat hier met naam zodat de telling te controleren is. 2023, gehost: GPT-4 (Azure OpenAI, EU-regio's). 2024, gehost: GPT-4o (Azure OpenAI, EU Data Zone), Claude 3.5 Sonnet (AWS Bedrock, regio Frankfurt), Mistral Large 2 (infrastructuur van Mistral in Europa); zelf te hosten: Llama 3.1 405B (open gewichten). 2025, gehost: GPT-5 (Azure OpenAI, EU Data Zone), Claude 3.7 Sonnet (AWS Bedrock, EU cross-region inference profile), Claude Sonnet 4.5 (AWS Bedrock, regionale eindpunten), Mistral Large 3 (infrastructuur van Mistral in Europa); zelf te hosten: Mistral Large 3 (Apache 2.0), DeepSeek-R1 (MIT-licentie), Qwen 3 (Apache 2.0). 2026, gehost: Claude Fable 5.1 (alleen de eu-multiregio van Google Cloud), Claude Opus 5 (AWS Bedrock, Frankfurt en Ierland), Claude Sonnet 5 (AWS Bedrock, Frankfurt en Ierland), GPT-5.6 Sol (Azure OpenAI, EU Data Zone), Mistral Medium 3.5 (Regional Endpoints van Mistral); zelf te hosten: Mistral Large 3 (Apache 2.0), DeepSeek-V4-Pro (gepubliceerde gewichten), Qwen3.8-2.4T-A95B (open uitgave onder de Qwen-licentie). Een model dat in beide routes valt, zoals Mistral Large 3, telt een keer mee in het totaal. Claude 2 op Amazon Bedrock in Frankfurt vanaf oktober 2023 valt af omdat de AWS-aankondiging de leverancier noemt en niet de modelversie. Google Gemini valt in elk jaar af omdat de residentiedocumentatie van Google wel de modellen met EU-verwerking noemt, maar niet de datum waarop elk model die kreeg, zodat geen enkel Gemini-model in een jaar te plaatsen is

Bewijs dat de andere kant op wijst

  • GPT-6 Astra, het meest capabele model van OpenAI in september 2026, staat in geen enkele Europese datazonetabel van de Microsoft-documentatie over modelbeschikbaarheid per regio, terwijl GPT-5.6 Sol in negen Europese regio's staat.

    Microsoft Foundry: models sold directly by Azure. OpenAI model documentation

  • Het topmodel van een lab is niet automatisch het beste model dat een EU-klant kan bereiken. Claude 3 Opus, het topmodel van Anthropic in 2024, bereikte Amazon Bedrock in Frankfurt nooit; alleen Claude 3 Sonnet en Haiku wel.

    AWS, Claude 3.5 Sonnet and Haiku available in more regions. Anthropic, Claude in Amazon Bedrock

  • Dataresidentie beschrijft waar data wordt verwerkt, niet wie gedwongen kan worden die af te geven. De EU-regio's van Microsoft, Amazon en Google worden geëxploiteerd door Amerikaanse bedrijven.

    Microsoft, announcing Azure OpenAI Data Zones. Anthropic, Claude in Amazon Bedrock

  • De verplichtingen voor hoog risico uit de AI-verordening zijn uitgesteld door Verordening (EU) 2026/1744, in werking sinds 27 juli 2026, naar 2 december 2027 voor systemen uit bijlage III en 2 augustus 2028 voor systemen uit bijlage I. De datum van algemene toepassing van 2 augustus 2026 is niet verschoven.

    Regulation (EU) 2026/1744, the Digital Omnibus on AI. Regulation (EU) 2024/1689, the AI Act. European Commission, the Commission starts enforcing AI Act rules

04

Prijs: een vaste capaciteit werd 300 keer goedkoper, de voorhoede werd weer duurder

In een zinGPT-4-kwaliteit kostte in maart 2023 $30 per miljoen invoertokens en in februari 2025 $0,10, terwijl het nieuwste topmodel van september 2026 weer $10 kost.

Er zijn twee prijsverhalen en ze lopen tegengesteld, dus een enkele lijn zou een onjuiste bewering zijn. Het eerste verhaal is de kosten van een vaste capaciteit. GPT-4 kwam in maart 2023 uit op $30 per miljoen invoertokens, een cijfer dat nog steeds op de eigen modelpagina van OpenAI staat en op de gearchiveerde prijspagina van 1 april 2023. In november 2023 leverde GPT-4 Turbo vergelijkbare kwaliteit voor $10. Epoch AI, dat het goedkoopste model per capaciteitsmijlpaal volgt, plaatst Gemini 1.5 Pro op dat niveau nadat Google het herprijsde naar $1,25, en Gemini 2.0 Flash op $0,10 in februari 2025. Dat is een daling van ongeveer 300 keer in minder dan twee jaar voor hetzelfde werk, ruwweg vijf tot zes keer per jaar.

Wat dit betekent voor het bestuur

  • Begroot de taak, niet het model. De prijs om een bekende taak te doen daalde tussen maart 2023 en februari 2025 ongeveer 300 keer, dus een werkstroom die twee jaar geleden onrendabel was, is dat nu waarschijnlijk niet meer.
  • Zet niet altijd het nieuwste model in beleid vast. Het nieuwste topmodel kostte in september 2026 acht keer meer per miljoen invoertokens dan het topmodel van een jaar eerder.

Wat GPT-4-kwaliteit kostte, per miljoen invoertokens

Logaritmische lijngrafiek. De goedkoopste gepubliceerde prijs voor GPT-4-kwaliteit daalde van 30 Amerikaanse dollar per miljoen invoertokens in maart 2023 naar 10 dollar in november 2023, 1,25 dollar in 2024 en 0,10 dollar in februari 2025.
Pointseries
Mar 2023US$ 30,00
Nov 2023US$ 10,00
2024US$ 1,25
2025US$ 0,10
Logaritmische schaal. Punten, op volgorde: GPT-4, GPT-4 Turbo, Gemini 1.5 Pro, Gemini 2.0 Flash. Catalogusprijzen per miljoen invoertokens, standaardtarief, zonder batch- of cachekorting.

Waarom de lijn in 2025 stopt

Er staat geen punt voor 2026 op de lijn van vaste capaciteit. De goedkoopste kandidaten van 2026, GPT-5.6 Luna op $0,20 en DeepSeek V4-Flash op $0,22 per miljoen invoertokens, zijn gedocumenteerde prijzen, maar we konden niet met een primaire bron bevestigen dat een van beide de GPT-4 van maart 2023 evenaart of overtreft op de benchmark die Epoch AI gebruikte. Dat punt publiceren zou gokken zijn, dus het blijft weg.

De andere richting: het topmodel van OpenAI aan het einde van elk jaar

  • 2023 · GPT-4 TurboUS$ 10,00
  • 2024 · GPT-4oUS$ 2,50
  • 2025 · GPT-5US$ 1,25
  • 2026 · GPT-6 AstraUS$ 10,00
Staafdiagram. De invoerprijs van het topmodel van OpenAI liep van 10 Amerikaanse dollar per miljoen tokens in 2023 naar 2,50 in 2024, 1,25 in 2025 en weer 10 in september 2026.
LabelValue
2023 · GPT-4 TurboUS$ 10,00
2024 · GPT-4oUS$ 2,50
2025 · GPT-5US$ 1,25
2026 · GPT-6 AstraUS$ 10,00
De bovenkant van het Anthropic-aanbod bewoog gelijk op, van 8 dollar voor Claude 2.1 naar 15 voor Claude 3 Opus, 5 voor Claude Opus 4.5 en 10 voor Claude Fable 5.1. De Pro-laag van Google liep van 3,50 naar 1,25 en toen 2,00.

Hoe dit is geteld

Alle waarden zijn gepubliceerde catalogusprijzen per miljoen invoertokens, standaardtarief, zonder batch- of cachekorting. Uitvoerprijzen blijven buiten beeld omdat een bestuursstukkenstroom bijna helemaal invoer is. Per lab is de regel het model dat het lab aan het einde van dat jaar als bovenkant van het aanbod presenteerde: voor Anthropic de lijn Claude 2, Opus en Fable, voor Google de Pro-laag en niet de Flash-laag. De lijn van vaste capaciteit volgt de keuze van Epoch AI voor het goedkoopste model dat de benchmarkscore van GPT-4 haalt, waarbij elke prijs opnieuw is gecontroleerd tegen de leverancierspagina of het archief daarvan en is herrekend naar een invoerprijs in plaats van de gemengde invoer- en uitvoerprijs van Epoch.

Bewijs dat de andere kant op wijst

  • De invoerprijs van het topmodel van OpenAI steeg van $1,25 per miljoen tokens voor GPT-5 in augustus 2025 naar $10 voor GPT-6 Astra in september 2026, een verachtvoudiging.

    OpenAI API pricing. OpenAI model documentation, GPT-5

  • Anthropic stelt dat de tokenizer vanaf Claude Opus 4.7 ongeveer 30 procent meer tokens produceert voor dezelfde tekst, dus een gelijkgebleven prijs per token is een hogere prijs per document.

    Anthropic pricing. Anthropic model overview

  • Gepubliceerde schattingen van hoe snel een vaste capaciteit goedkoper wordt lopen uiteen van 9 tot 900 keer per jaar, afhankelijk van welke benchmark je vasthoudt, dus behandel elk enkel getal als illustratie.

    Epoch AI, LLM inference price trends. Stanford HAI, 2025 AI Index Report

Wat niet is veranderd

Vier dingen bewogen. Zes niet. Elke uitspraak hieronder gold voor de modellen van 2023 en geldt nog steeds voor de modellen van september 2026, en elk is gemeten in plaats van beweerd.

Modellen beweren nog steeds dingen die niet in jouw documenten staan. Op de eigen productie-representatieve evaluatie van OpenAI leverde de beste configuratie van GPT-5 nog altijd in 4,8 procent van de antwoorden een grote feitelijke fout op, en Anthropic schreef in de Claude Opus 4.5 systeemkaart dat het er nog lang niet in geslaagd is feitelijke hallucinaties weg te nemen zonder externe hulpmiddelen.

OpenAI, GPT-5 System Card (13 August 2025). Anthropic, Claude Opus 4.5 System Card (November 2025)

Een nieuwer model is niet automatisch waarheidsgetrouwer. OpenAI mat een PersonQA-hallucinatiegraad van 0,16 voor o1 en 0,33 voor het latere o3, en Anthropic meldt dat Claude Opus 5 11 procent nauwkeuriger is dan Claude Opus 4.8 en tegelijk 6 procent vaker hallucineert.

OpenAI, o1 System Card (5 December 2024). OpenAI, o3 and o4-mini System Card (16 April 2025). Anthropic, Claude Opus 5 System Card (24 July 2026)

Instructies verwateren in een lang gesprek. Over meer dan 200.000 gesimuleerde gesprekken met vijftien modellen maten onderzoekers van Microsoft en Salesforce een gemiddelde daling van 39 procent in meerbeurtsgesprekken vergeleken met dezelfde taken in een beurt, en zij vonden dat een model dat eenmaal verkeerd afslaat zich niet herstelt.

Laban, Hayashi, Zhou & Neville, LLMs Get Lost In Multi-Turn Conversation (arXiv:2505.06120)

Dezelfde vraag geeft niet betrouwbaar hetzelfde antwoord. In een gecontroleerde test leverden 1.000 identieke verzoeken bij temperatuur nul 80 verschillende antwoorden op, waarbij het uiteenlopen begon bij token 103. De eigen API-documentatie van OpenAI stelt dat de seed-parameter een inspanningsverplichting is en dat determinisme niet is gegarandeerd, en Anthropic heeft de knoppen temperature, top-p en top-k vanaf Claude Opus 4.7 volledig verwijderd.

Thinking Machines Lab, Defeating Nondeterminism in LLM Inference. OpenAI API reference, seed parameter. Anthropic model deprecations

Leveranciers halen het model weg waarop je hebt gestandaardiseerd. Genoemde productiemodellen liepen 12 tot 22 maanden voor uitschakeling: Claude 3.7 Sonnet 12 maanden, Claude Opus 4.1 12 maanden, Claude Sonnet 4 en Opus 4 13 maanden, Claude 3.5 Sonnet 16 maanden, GPT-5 ongeveer 16 maanden tot de uitschakeling op 11 december 2026, Gemini 2.0 Flash ongeveer 16 maanden. Anthropic zegt minstens 60 dagen aankondiging toe en OpenAI hanteert in de praktijk ongeveer zes maanden.

Anthropic model deprecations. OpenAI model deprecations. Google, Gemini API model deprecations and changelog

Een groter contextvenster is nog steeds geen groter bruikbaar geheugen. Drie onafhankelijke studies sinds 2024 vonden dat de nauwkeurigheid ruim voor de geadverteerde limiet daalt, en geen enkele leverancier publiceert een bruikbare lengte naast de geadverteerde.

RULER: What's the Real Context Size of Your Long-Context Language Models? (arXiv:2404.06654). NoLiMa: Long-Context Evaluation Beyond Literal Matching (arXiv:2502.05167). Chroma, Context Rot: How Increasing Input Tokens Impacts LLM Performance

04De leveranciers

Acht labs, lab voor lab

Acht labs leveren een model dat een managementteam redelijkerwijs op de eigen documenten kan richten. Dit is wat elk lab in september 2026 werkelijk verkoopt, wat het kost en waar het mag draaien.

Lees elk blok op dezelfde manier. Wat het lab is, hoe de modellenlijn zich heeft bewogen, en het huidige aanbod als tabel met bij elke EU-route en elke prijs de noot van de leverancier zelf. De volgorde loopt van de labs die Europese besturen al gebruiken naar de labs waarover ze het vaakst discussiëren.

OpenAI

San Francisco, California · US

Het lab achter ChatGPT en de GPT-modellen, en de reden dat de meeste besturen überhaupt een mening over AI hebben. De modellen bereiken bestuurders via ChatGPT-werkomgevingen, de OpenAI-API en Microsoft Foundry, en daar komt vrijwel elke vraag over Europese dataresidentie uiteindelijk terecht.

Generaties

GPT-4 family14 mrt 2023 tot 23 okt 2026 · 5 modelleno-series reasoning models17 dec 2024 tot 11 dec 2026 · 6 modellenGPT-5 family7 aug 2025 tot nu · 11 modellenGPT-6 family3 sep 2026 tot nu · 1 model

Modellen, oud naar nieuw

  1. GPT-413 jun 2023einde dienst 23 okt 2026Geheugen: onbekend
  2. GPT-3.5 Turbo25 jan 2024einde dienst 23 okt 2026Geheugen: onbekend
  3. o117 dec 2024einde dienst 23 okt 2026Geheugen: onbekend
  4. o316 apr 2025einde dienst 11 dec 2026Geheugen: onbekend
  5. o4-mini16 apr 2025einde dienst 23 okt 2026Geheugen: onbekend
  6. GPT-57 aug 2025einde dienst 11 dec 2026Geheugen: onbekend
  7. GPT-5.6 Sol9 jul 2026Geheugen: 1,05M tokens
  8. GPT-5.6 Terra9 jul 2026Geheugen: 1,05M tokens
  9. GPT-5.6 Luna9 jul 2026Geheugen: 1,05M tokens
  10. GPT-6 Astra3 sep 2026Geheugen: 1,05M tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van OpenAI: 4 actueel, 6 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
GPT-413 jun 2023uitgefaseerdonbekend
GPT-3.5 Turbo25 jan 2024uitgefaseerdonbekend
o117 dec 2024uitgefaseerdonbekend
o316 apr 2025uitgefaseerdonbekend
o4-mini16 apr 2025uitgefaseerdonbekend
GPT-57 aug 2025uitgefaseerdonbekend
GPT-5.6 Sol9 jul 2026actueel1,05M tokens
GPT-5.6 Terra9 jul 2026actueel1,05M tokens
GPT-5.6 Luna9 jul 2026actueel1,05M tokens
GPT-6 Astra3 sep 2026actueel1,05M tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: OpenAI, 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
GPT-6 AstraredeneertVlaggenschip3 sep 20261,05M tokensGeen EU-routeMicrosoft Foundry biedt Astra alleen aan in Global- en US Data Zone-implementaties. In de lanceringspost van Microsoft staat geen EU Data Zone, dus een organisatie die Europese verwerking eist, blijft voorlopig op een oudere tier.US$ 10 / US$ 50Het huidige vlaggenschip van OpenAI. Bij prompts boven 272K tokens geldt een langecontexttarief van $20 invoer en $75 uitvoer per miljoen.
GPT-5.6 SolredeneertMiddenklasse9 jul 20261,05M tokensEU-routeAzure OpenAI / Microsoft Foundry, EU Data Zone (9 EU regions)De beschikbaarheidstabel voor Data Zone Standard van Microsoft (versie van 3 september 2026) noemt de GPT-5.6-varianten in negen Europese regio's, zodat vragen en antwoorden binnen de Azure EU Data Boundary verwerkt kunnen worden. GPT-6 Astra staat niet in die tabel.US$ 4 / US$ 20Het vorige vlaggenschip, nog steeds beschikbaar. OpenAI noemt dit een actieprijs die ten minste tot 21 november 2026 geldt.
GPT-5.6 TerraredeneertMiddenklasse9 jul 20261,05M tokensEU-routeAzure OpenAI / Microsoft Foundry, EU Data Zone (9 EU regions)De beschikbaarheidstabel voor Data Zone Standard van Microsoft (versie van 3 september 2026) noemt de GPT-5.6-varianten in negen Europese regio's, zodat vragen en antwoorden binnen de Azure EU Data Boundary verwerkt kunnen worden. GPT-6 Astra staat niet in die tabel.US$ 2 / US$ 12De gebalanceerde tier, voor het meeste documentwerk de standaardkeuze.
GPT-5.6 LunaredeneertKlein en snel9 jul 20261,05M tokensEU-routeAzure OpenAI / Microsoft Foundry, EU Data Zone (9 EU regions)De beschikbaarheidstabel voor Data Zone Standard van Microsoft (versie van 3 september 2026) noemt de GPT-5.6-varianten in negen Europese regio's, zodat vragen en antwoorden binnen de Azure EU Data Boundary verwerkt kunnen worden. GPT-6 Astra staat niet in die tabel.US$ 0,20 / US$ 1,20De snelle, goedkope tier. Prima voor concepten en samenvattingen, niet voor cijfers die ongecontroleerd naar het bestuur gaan.

Officiële modeldocumentatie: OpenAI

Anthropic

San Francisco, California · US

Het lab achter Claude, opgericht door voormalige OpenAI-onderzoekers en bekend om opvallend gedetailleerde documentatie over modellen, prijzen en uitfasering. De modellen worden zowel rechtstreeks verkocht als via Amazon Bedrock, Google Cloud en Microsoft Foundry, waardoor je als Europese inkoper meer dan één contractroute hebt.

Generaties

Claude 2 generation11 jul 2023 tot 21 jul 2025 · 2 modellenClaude 3 generation4 mrt 2024 tot 20 apr 2026 · 6 modellenClaude 4 generation14 mei 2025 tot nu · 10 modellenClaude 5 generation9 jun 2026 tot nu · 4 modellen

Modellen, oud naar nieuw

  1. Claude Opus 329 feb 2024einde dienst 5 jan 2026Geheugen: 200K tokens
  2. Claude Haiku 37 mrt 2024einde dienst 20 apr 2026Geheugen: 200K tokens
  3. Claude Haiku 3.522 okt 2024einde dienst 19 feb 2026Geheugen: 200K tokens
  4. Claude Sonnet 3.719 feb 2025einde dienst 19 feb 2026Geheugen: 200K tokens
  5. Claude Opus 414 mei 2025einde dienst 15 jun 2026Geheugen: 200K tokens
  6. Claude Sonnet 414 mei 2025einde dienst 15 jun 2026Geheugen: 200K tokens
  7. Claude Opus 4.15 aug 2025einde dienst 5 aug 2026Geheugen: 200K tokens
  8. Claude Haiku 4.515 okt 2025Geheugen: 200K tokens
  9. Claude Opus 4.828 mei 2026Geheugen: 1M tokens
  10. Claude Fable 59 jun 2026Geheugen: 1M tokens
  11. Claude Sonnet 530 jun 2026Geheugen: 1M tokens
  12. Claude Opus 524 jul 2026Geheugen: 1M tokens
  13. Claude Fable 5.11 sep 2026Geheugen: 1M tokens
  14. Claude Mythos 5.11 sep 2026Geheugen: 1M tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van Anthropic: 7 actueel, 7 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
Claude Opus 329 feb 2024uitgefaseerd200K tokens
Claude Haiku 37 mrt 2024uitgefaseerd200K tokens
Claude Haiku 3.522 okt 2024uitgefaseerd200K tokens
Claude Sonnet 3.719 feb 2025uitgefaseerd200K tokens
Claude Opus 414 mei 2025uitgefaseerd200K tokens
Claude Sonnet 414 mei 2025uitgefaseerd200K tokens
Claude Opus 4.15 aug 2025uitgefaseerd200K tokens
Claude Haiku 4.515 okt 2025actueel200K tokens
Claude Opus 4.828 mei 2026actueel1M tokens
Claude Fable 59 jun 2026actueel1M tokens
Claude Sonnet 530 jun 2026actueel1M tokens
Claude Opus 524 jul 2026actueel1M tokens
Claude Fable 5.11 sep 2026actueel1M tokens
Claude Mythos 5.11 sep 2026actueel1M tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: Anthropic, 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
Claude Fable 5.1redeneertVlaggenschip1 sep 20261M tokensEU-routeGoogle Cloud Agent Platform (Vertex AI), EU multi-region endpointDe EU-route loopt via Google Cloud, waar een multiregio-eindpunt 'eu' de verwerking binnen de Europese Unie houdt tegen tien procent meerprijs. Amazon Bedrock biedt regionale eindpunten voor Fable 5.1 per 8 september 2026 alleen in us-east-1, Microsoft Foundry biedt Global en US Data Zone, en de eigen API van Anthropic ondersteunt alleen 'us' en 'global'. Eén route dus, geen vier.US$ 10 / US$ 50Het huidige vlaggenschip van Anthropic, venster van 1M tokens. Cache-leesacties kosten 2,5 procent van de invoerprijs, het laagste cachetarief dat een lab publiceert. Dat telt zwaar als dezelfde documentenset elke dag opnieuw wordt gelezen.
Claude Mythos 5.1redeneertVlaggenschip1 sep 20261M tokensGeen EU-routeDe toegang is beperkt tot geverifieerde programma's en bij de lancering tot organisaties in de Verenigde Staten. Geen route waar een Europees managementteam op kan plannen.US$ 10 / US$ 50
Claude Opus 5redeneertMiddenklasse24 jul 20261M tokensEU-routeGoogle Cloud Agent Platform (Vertex AI), EU multi-region endpoint; Amazon Bedrock EU inference profile (Frankfurt, Ireland, Paris, Milan, Madrid, Stockholm, Zurich, London)Bredere Europese dekking dan het vlaggenschip, omdat zowel het EU-inferentieprofiel van Bedrock als het EU-multiregio-eindpunt van Google Cloud dit model bedienen. Regionale en multiregionale routering kost op beide clouds tien procent extra.US$ 5 / US$ 25Top van de Opus-tier, venster van 1M tokens, de halve tokenprijs van Fable 5.1.
Claude Sonnet 5redeneertMiddenklasse30 jun 20261M tokensEU-routeGoogle Cloud Agent Platform (Vertex AI), EU multi-region endpoint; Amazon Bedrock EU inference profileDezelfde Europese routeringsopties als Claude Opus 5, voor een vijfde van de prijs.US$ 2 / US$ 10Middentier met hetzelfde venster van 1M tokens als de vlaggenschepen. Anthropic bevestigt in de prijsnotities dat de geplande verhoging naar $3/$15 op 1 september 2026 niet doorgaat.
Claude Fable 5redeneertMiddenklasse9 jun 20261M tokensEU-routeGoogle Cloud Agent Platform (Vertex AI), EU multi-region endpointUS$ 10 / US$ 50
Claude Opus 4.8redeneertMiddenklasse28 mei 20261M tokensEU-routeAmazon Bedrock EU inference profile; Google Cloud Agent Platform (Vertex AI), EU multi-region endpointUS$ 5 / US$ 25
Claude Haiku 4.5redeneertKlein en snel15 okt 2025200K tokensEU-routeAmazon Bedrock EU inference profile; Google Cloud Agent Platform (Vertex AI), EU multi-region endpointUS$ 1 / US$ 5Klein en snel, venster van 200K tokens.

Officiële modeldocumentatie: Anthropic

Google (DeepMind)

Mountain View, California · US

De AI-tak van Alphabet, gevormd rond de onderzoeksgroep DeepMind in Londen, levert de Gemini-modellen. Gemini heeft het grootste bereik van alle modelfamilies omdat het is ingebouwd in Search, Workspace, Android en Chrome, waardoor veel organisaties het al gebruiken voordat er een contract is getekend.

Generaties

Gemini 1.5 generation15 feb 2024 tot 29 sep 2025 · 3 modellenGemini 2 generation5 feb 2025 tot 1 jun 2026 · 4 modellenGemini 3 generation18 nov 2025 tot nu · 7 modellen

Modellen, oud naar nieuw

  1. Gemini 2.0 Flashdec 2024einde dienst 1 jun 2026Geheugen: onbekend(niet geverifieerd)
  2. Gemini 3.5 Flash-Lite2026Geheugen: onbekend(niet geverifieerd)
  3. Gemini 3.1 Pro19 feb 2026Geheugen: 1,05M tokens
  4. Gemini 3.7 Flashaug 2026Geheugen: onbekend(niet geverifieerd)
  5. Gemini 3.8 Flash2 sep 2026Geheugen: 1,05M tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van Google (DeepMind): 4 actueel, 1 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
Gemini 2.0 Flashdec 2024uitgefaseerdonbekend
Gemini 3.5 Flash-Lite2026actueelonbekend
Gemini 3.1 Pro19 feb 2026actueel1,05M tokens
Gemini 3.7 Flashaug 2026actueelonbekend
Gemini 3.8 Flash2 sep 2026actueel1,05M tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: Google (DeepMind), 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
Gemini 3.8 FlashredeneertVlaggenschip2 sep 20261,05M tokensEU-routeGoogle Cloud Vertex AI, eu multi-region only (no EU regional endpoint)De locatiedocumentatie van Google Cloud noemt Gemini 3.8 Flash op het eu-multiregio-eindpunt, dat de machine learning processing binnen EU-lidstaten houdt, en op geen enkel regionaal EU-eindpunt. Als je beleid één land noemt in plaats van de Unie, voldoet dit model daar nog niet aan.US$ 0,75 / US$ 3,75Het algemeen beschikbare vlaggenschip van Google is een Flash-model. Dit is een introductieprijs tot en met 31 december 2026; vanaf 1 januari 2027 verdubbelt die naar $1,50 invoer en $7,50 uitvoer. Begroot met het hogere bedrag.
Gemini 3.7 Flashniet geverifieerdredeneertMiddenklasseaug 2026onbekendGeen EU-routeWe konden op 8 september 2026 in de documentatie van de leverancier zelf geen EU-dataresidentie voor dit model bevestigen. Beschouw Europese routering als iets dat je schriftelijk laat bevestigen voordat er bestuursmateriaal naartoe gaat.US$ 0,75 / US$ 3,75
Gemini 3.1 ProredeneertMiddenklasse19 feb 20261,05M tokensGeen EU-routeDe locatiedocumentatie van Google Cloud noteert voor Gemini 3.1 Pro preview geen dataresidentie in rust en geen machine learning processing in de EU. Het model staat nog als preview-eindpunt gepubliceerd, wat de moeite waard is om in een wijzigingsplan te vermelden.US$ 2 / US$ 12
Gemini 3.5 Flash-Liteniet geverifieerdredeneertKlein en snel2026onbekendGeen EU-routeWe konden op 8 september 2026 in de documentatie van de leverancier zelf geen EU-dataresidentie voor dit model bevestigen. Beschouw Europese routering als iets dat je schriftelijk laat bevestigen voordat er bestuursmateriaal naartoe gaat.US$ 0,30 / US$ 2,50Goedkope tier in de huidige generatie.

Officiële modeldocumentatie: Google (DeepMind)

Meta

Menlo Park, California · US

Meta bouwde de Llama-reeks die open gewichten normaal maakte en levert nu de Muse-modellen: Muse Spark via een betaalde API en Muse Glimmer als downloadbare open gewichten onder Apache 2.0. Door die tweedeling is Meta het lastigste lab om in één zin samen te vatten voor een inkoopdossier.

Modellen, oud naar nieuw

  1. Muse Spark 1.1jul 2026Geheugen: 1M tokens(niet geverifieerd)
  2. Muse Glimmer 30Baug 2026Geheugen: 131K tokens
  3. Muse Spark 1.32 sep 2026Geheugen: 1M tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van Meta: 3 actueel, 0 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
Muse Spark 1.1jul 2026actueel1M tokens
Muse Glimmer 30Baug 2026actueel131K tokens
Muse Spark 1.32 sep 2026actueel1M tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: Meta, 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
Muse Spark 1.3redeneertVlaggenschip2 sep 20261M tokensGeen EU-routeMeta publiceert geen Europese optie voor dataresidentie bij de Meta Model API. Zolang dat zo blijft, is dit een Amerikaans API-eindpunt en hoort het in een gegevensbeschermingsbeoordeling ook zo behandeld te worden.US$ 1,25 / US$ 4,25
Muse Glimmer 30Bopen gewichtenredeneertApache-2.0Open gewichtenaug 2026131K tokensEU-routeSelf-hosted on your own or an EU provider's hardwareOpen gewichten onder Apache 2.0, klein genoeg om na kwantisatie op één krachtige consumentenvideokaart te draaien. De hosting is daarmee je eigen besluit, en dat is het schoonste antwoord dat er op een vraag over dataresidentie bestaat.niet gepubliceerd
Muse Spark 1.1niet geverifieerdredeneertMiddenklassejul 20261M tokensGeen EU-routeWe konden op 8 september 2026 in de documentatie van de leverancier zelf geen EU-dataresidentie voor dit model bevestigen. Beschouw Europese routering als iets dat je schriftelijk laat bevestigen voordat er bestuursmateriaal naartoe gaat.US$ 1,25 / US$ 4,25

Officiële modeldocumentatie: Meta

xAI

Palo Alto, California · US

xAI is in 2023 opgericht door Elon Musk, bouwt de Grok-modellen en levert die via het platform X en een eigen API. Het lab beweegt snel op prijs en snelheid, maar de gedocumenteerde serverregio's liggen in de Verenigde Staten, en dat bepaalt wat een Europees bestuur ermee kan.

Modellen, oud naar nieuw

  1. Grok 4.3apr 2026Geheugen: 1M tokens(niet geverifieerd)
  2. Grok 4.5jul 2026Geheugen: 500K tokens(niet geverifieerd)
  3. Grok 4.612 aug 2026Geheugen: 500K tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van xAI: 3 actueel, 0 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
Grok 4.3apr 2026actueel1M tokens
Grok 4.5jul 2026actueel500K tokens
Grok 4.612 aug 2026actueel500K tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: xAI, 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
Grok 4.6redeneertVlaggenschip12 aug 2026500K tokensGeen EU-routexAI documenteert dit model als beschikbaar in us-east-1 en us-west-2. Er is geen gedocumenteerde Europese serverregio, en dat is het belangrijkste feit voor een Europees bestuur dat Grok overweegt.US$ 2 / US$ 6Venster van 500K tokens. De genoemde prijzen gelden voor prompts onder 200K tokens; daarboven verdubbelt het tarief naar $4 invoer en $12 uitvoer per miljoen.
Grok 4.5niet geverifieerdredeneertMiddenklassejul 2026500K tokensGeen EU-routeWe konden op 8 september 2026 in de documentatie van de leverancier zelf geen EU-dataresidentie voor dit model bevestigen. Beschouw Europese routering als iets dat je schriftelijk laat bevestigen voordat er bestuursmateriaal naartoe gaat.US$ 2 / US$ 6
Grok 4.3niet geverifieerdredeneertMiddenklasseapr 20261M tokensGeen EU-routeWe konden op 8 september 2026 in de documentatie van de leverancier zelf geen EU-dataresidentie voor dit model bevestigen. Beschouw Europese routering als iets dat je schriftelijk laat bevestigen voordat er bestuursmateriaal naartoe gaat.US$ 1,25 / US$ 2,50Venster van 1M tokens, goedkoper dan 4.6. De genoemde prijzen gelden voor prompts onder 200K tokens.

Officiële modeldocumentatie: xAI

Mistral AI

Paris, France · FR

Het enige Europese lab in deze lijst, met een hoog releasetempo en een catalogus waarin eigen modellen en gehoste open modellen naast elkaar staan. Voor organisaties die een Europese contractpartij eisen en niet alleen een Europese regio, is Mistral de kortste route.

Modellen, oud naar nieuw

  1. Mistral Large 2.1nov 2024einde dienst 31 mei 2026Geheugen: onbekend
  2. Mistral Medium 3.1aug 2025einde dienst 31 aug 2026Geheugen: onbekend
  3. Mistral Large 3dec 2025Geheugen: 256K tokens
  4. Mistral Small 4mrt 2026Geheugen: onbekend(niet geverifieerd)
  5. Mistral Medium 3.5apr 2026Geheugen: 256K tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van Mistral AI: 3 actueel, 2 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
Mistral Large 2.1nov 2024uitgefaseerdonbekend
Mistral Medium 3.1aug 2025uitgefaseerdonbekend
Mistral Large 3dec 2025actueel256K tokens
Mistral Small 4mrt 2026actueelonbekend
Mistral Medium 3.5apr 2026actueel256K tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: Mistral AI, 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
Mistral Medium 3.5open gewichtenredeneertModified MIT License: weights are downl...Vlaggenschipapr 2026256K tokensEU-routeMistral La Plateforme with Mistral Regional Endpoints set to Europe; Scaleway Generative APIs (France), served as mistral-medium-3.5-128b; Self-hosted with vLLM, TensorRT-LLM or TGI on your own hardware; Microsoft Azure AI, AWS Bedrock, Google Cloud Vertex AI, IBM watsonx.ai and OutscaleDit is het enige model in dit bestand waarbij het lab zelf Europees is en Europese inferentie in de regio als contractueel product aanbiedt. Mistral maakte Regional Endpoints op 11 augustus 2026 algemeen beschikbaar, waarmee je inferentie op Europa of de VS vastzet.US$ 1,50 / US$ 7,50Het sterkste model van het enige Europese frontierlab. Mistral publiceert geen cachetarief, dus je kunt in een begroting geen cachekorting aannemen.
Mistral Small 4niet geverifieerdopen gewichtenredeneertApache-2.0Klein en snelmrt 2026onbekendEU-routeMistral La Plateforme with Mistral Regional Endpoints set to Europe; Self-hosted on your own hardware (Apache-2.0)US$ 0,15 / US$ 0,60Kleine tier voor routinematig opstellen en classificeren.
Mistral Large 3open gewichtenApache-2.0Open gewichtendec 2025256K tokensEU-routeMistral La Plateforme with Mistral Regional Endpoints set to Europe; Self-hosted on your own hardware (Apache-2.0)US$ 0,50 / US$ 1,50Ondanks de naam goedkoper dan Medium 3.5. Lees de modelkaart voordat je aanneemt dat Large ook sterker betekent.

Officiële modeldocumentatie: Mistral AI

DeepSeek

Hangzhou, China · CN

Een Chinees lab dat modellen op frontierniveau fors goedkoper maakte en de gewichten publiceert, waardoor het model te downloaden en op eigen hardware te draaien is. Voor een Europees bestuur is de relevante vraag daarom niet of je de Chinese API gebruikt, maar of je de gewichten zelf host.

Modellen, oud naar nieuw

  1. DeepSeek legacy endpoints (deepseek-chat, deepseek-reasoner)dec 2024einde dienst 24 jul 2026Geheugen: onbekend
  2. DeepSeek-V4-Flash31 jul 2026Geheugen: 1M tokens
  3. DeepSeek-V4-Pro13 aug 2026Geheugen: 1M tokens
  4. DeepSeek-V4-Flash-Vision-Exp21 aug 2026Geheugen: 1M tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van DeepSeek: 3 actueel, 1 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
DeepSeek legacy endpoints (deepseek-chat, deepseek-reasoner)dec 2024uitgefaseerdonbekend
DeepSeek-V4-Flash31 jul 2026actueel1M tokens
DeepSeek-V4-Pro13 aug 2026actueel1M tokens
DeepSeek-V4-Flash-Vision-Exp21 aug 2026actueel1M tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: DeepSeek, 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
DeepSeek-V4-Flash-Vision-Expopen gewichtenredeneertMiddenklasse21 aug 20261M tokensEU-routeSelf-hosted, subject to weights being published for this experimental buildDeepSeek noemt deze build experimenteel. Behandel het als pilotoptie voor gescande documenten, niet als iets om op te standaardiseren.US$ 0,44 / US$ 1,32
DeepSeek-V4-Proopen gewichtenredeneertMITVlaggenschip13 aug 20261M tokensEU-routeSelf-hosted on your own or a rented GPU cluster (weights are public under MIT); European GPU rental with a data processing agreement, for example an EU region of a sovereign cloudOp 8 september 2026 konden we geen beheerd EU-eindpunt voor V4-Pro bij een grote Europese aanbieder bevestigen. Amazon Bedrock noemt DeepSeek-V3.1 en R1, niet V4. De realistische EU-route voor dit model is de gewichten zelf draaien.US$ 1,32 / US$ 3,96Prijs tijdens piekuren. Buiten de piek, door DeepSeek gedefinieerd als alle uren buiten 01:00 tot 04:00 en 06:00 tot 10:00 UTC op werkdagen, kosten dezelfde tokens de helft: $0,66 invoer, $1,98 uitvoer, $0,022 uit cache.
DeepSeek-V4-Flashopen gewichtenredeneertMITMiddenklasse31 jul 20261M tokensEU-routeScaleway Generative APIs (France), served as deepseek-v4-flash-0731; Self-hosted on your own or a rented GPU cluster (weights are public under MIT)Scaleway levert dit model vanuit Europese datacenters met een contextvenster van 256.000 tokens, een kwart van wat DeepSeek op de eigen API biedt. Controleer het geleverde venster, niet het maximum van het model, voordat je een toepassing toezegt.US$ 0,44 / US$ 1,32Prijs tijdens piekuren; buiten de piek de helft. De goedkoopste bijna-frontier-API in deze lijst.

Officiële modeldocumentatie: DeepSeek

Alibaba (Qwen)

Hangzhou, China · CN

Alibaba Cloud levert de Qwen-familie en verkoopt via dezelfde cloud ook modellen van andere labs, waardoor de changelog een van de drukste in de sector is. Een deel van het Qwen-aanbod verschijnt als open gewichten, meestal onder een eigen licentie van Alibaba en niet onder een standaard open-sourcelicentie.

Modellen, oud naar nieuw

  1. Qwen3.8-Max3 aug 2026Geheugen: 1M tokens
  2. Qwen3.8-2.4T-A95B (open build)13 aug 2026Geheugen: 262K tokens
  3. Qwen3.8-27B19 aug 2026Geheugen: 262K tokens
  4. Qwen3.8-Flash26 aug 2026Geheugen: 1M tokens
  • actueel
  • uitgefaseerd
  • niet geverifieerd
Modellijn van Alibaba (Qwen): 4 actueel, 0 uitgefaseerd, elk met het contextvenster dat de leverancier publiceert.
ModelUitgebrachtRolGeheugen
Qwen3.8-Max3 aug 2026actueel1M tokens
Qwen3.8-2.4T-A95B (open build)13 aug 2026actueel262K tokens
Qwen3.8-27B19 aug 2026actueel262K tokens
Qwen3.8-Flash26 aug 2026actueel1M tokens
De balklengte is het gepubliceerde contextvenster, op één schaal over alle acht labs. Bron: leveranciersdocumentatie, gelezen op 8 september 2026.
Huidig aanbod: Alibaba (Qwen), 8 sep 2026.
ModelRolUitgebrachtGeheugenEU-residentiePrijs per 1M tokens (in / uit)
Qwen3.8-FlashredeneertMiddenklasse26 aug 20261M tokensEU-routeAlibaba Cloud Model Studio, Germany (Frankfurt) region eu-central-1Zelfde voorbehoud als bij het vlaggenschip: Alibaba stelt dat ondersteunde modellen per regio verschillen, dus controleer de beschikbaarheid in Frankfurt voordat je je vastlegt.US$ 0,15 / US$ 0,47Kleine tier op het internationale eindpunt.
Qwen3.8-27Bopen gewichtenredeneertApache-2.0Open gewichten19 aug 2026262K tokensEU-routeOVHcloud AI Endpoints (France); IONOS AI Model Hub (Germany); Self-hosted on a single modern data centre GPUDit is in dit bestand de meest praktische soevereine optie voor een bedrijf zonder GPU-cluster: twee Europese aanbieders leveren het, en omdat de gewichten Apache-2.0 zijn kun je tussen aanbieders wisselen of het naar binnen halen.niet gepubliceerd
Qwen3.8-2.4T-A95B (open build)open gewichtenredeneertQwen3.8-Max LicenseOpen gewichten13 aug 2026262K tokensEU-routeSelf-hosted on your own or a rented GPU clusterMet 2,4 biljoen parameters is dit een uitrol over meerdere knooppunten. Realistisch gezien is dit iets voor organisaties die al een GPU-cluster beheren, of voor een beheerd soeverein platform dat het voor je draait.niet gepubliceerd
Qwen3.8-MaxredeneertVlaggenschip3 aug 20261M tokensEU-routeAlibaba Cloud Model Studio, Germany (Frankfurt) region eu-central-1Alibaba Cloud Model Studio heeft een regio Duitsland (Frankfurt), maar Alibaba schrijft in de eigen documentatie dat regio's verschillen in ondersteunde modellen, functies en prijzen. Controleer in de Frankfurt-console of dit specifieke model daar wordt aangeboden voordat je erop bouwt.US$ 2 / US$ 6Prijs op het internationale eindpunt (Singapore) van Alibaba. Het Chinese binnenlandse eindpunt is een andere dienst met eigen prijzen en een eigen juridische positie.

Officiële modeldocumentatie: Alibaba (Qwen)

05Vier jaar op een lijn

Vier jaar op een lijn: releases, uitfaseringen, regels

Releases zijn het nieuws. Uitfaseringen zijn het werk. De Europese regels zijn de agenda. Hier staan ze alle drie op een rail, en elke datum is bevestigd door een primaire bron.

Een tijdlijn verdient een plek op zo'n pagina alleen als elke regel een datum is waarop iets waar een organisatie van afhangt verscheen of ophield te bestaan. Dat is hier het filter. De rail hieronder toont de releases die de grens echt verlegden, de uitfaseringen waardoor ergens een koppeling stukliep, en de data die de Europese Unie in wetgeving heeft vastgelegd.

Op de rail

  • release: 11
  • uitgezet: 11
  • mijlpaal: 3
  • regelgeving: 7

Horizontale tijdlijn. Hij schuift zijwaarts mee terwijl je naar beneden scrolt, en wordt een gewone verticale lijst op een telefoon of wanneer je systeem om minder beweging vraagt.

  1. 30 nov 2022OpenAI / release

    ChatGPT gaat open voor iedereen

    OpenAI zette ChatGPT online als gratis onderzoeksversie op basis van GPT-3.5, met een venster van ongeveer vierduizend tokens, zo'n zes pagina's.

  2. 14 mrt 2023OpenAI / release

    GPT-4 komt met een venster van achtduizend tokens

    GPT-4 was het eerste model dat veel bestuurders serieus namen en hield ongeveer twaalf pagina's tekst tegelijk vast.

  3. 11 jul 2023Anthropic / release

    Claude 2 maakt honderdduizend tokens normaal

    Anthropic bracht Claude 2 uit met het venster van honderdduizend tokens dat het in mei had geopend als standaard, meer dan tien keer de GPT-4 van maart.

  4. 6 nov 2023OpenAI / release

    GPT-4 Turbo verhoogt het venster naar 128.000 tokens

    Op zijn eerste ontwikkelaarsdag verhoogde OpenAI het venster zestien keer en verlaagde de prijzen.

  5. 27 jun 2024Google / release

    Twee miljoen tokens wordt algemeen beschikbaar

    Google maakte het venster van twee miljoen tokens op Gemini 1.5 Pro beschikbaar voor alle ontwikkelaars, na de aankondiging op de ontwikkelaarsconferentie in mei.

  6. 1 aug 2024Europese Unie / regelgeving

    De EU AI-verordening treedt in werking

    De AI-verordening werd van kracht in de hele Europese Unie, met verplichtingen die in de vier jaar daarna gefaseerd ingaan.

  7. 12 sep 2024OpenAI / mijlpaal

    o1-preview is het eerste model dat leert eerst te denken

    OpenAI bracht o1-preview en o1-mini uit, modellen die getraind zijn om stap voor stap te redeneren voordat ze antwoorden, in plaats van de eerste plausibele zin te produceren.

  8. 6 nov 2024Anthropic / uitgezet

    Anthropic trekt de volledige Claude 1-lijn terug

    Claude 1.0 tot en met 1.3 en de Claude Instant-modellen werden uitgezet, twee maanden na de aankondiging.

  9. 20 jan 2025DeepSeek / mijlpaal

    DeepSeek-R1 maakt redeneren goedkoop en open

    DeepSeek lanceerde R1, een redeneermodel met open licentie dat dicht bij o1 presteerde tegen een fractie van de prijs.

  10. 2 feb 2025Europese Unie / regelgeving

    Verboden AI-praktijken en AI-geletterdheid gaan gelden

    De eerste bindende verplichtingen van de AI-verordening gingen in: een lijst met verboden toepassingen zoals social scoring en het ongericht schrapen van gezichtsbeelden, plus een plicht om te zorgen dat medewerkers die AI gebruiken voldoende AI-geletterdheid hebben.

  11. 14 jul 2025OpenAI / uitgezet

    GPT-4.5 gaat uit in de API

    Vierenhalve maand na de onderzoeksversie werd GPT-4.5 met drie maanden opzegtermijn uit de API gehaald.

  12. 2 aug 2025Europese Unie / regelgeving

    Verplichtingen voor AI-modellen voor algemene doeleinden gaan gelden

    Aanbieders van AI-modellen voor algemene doeleinden kregen verplichtingen op het gebied van transparantie, documentatie en auteursrechtbeleid, en voor de grootste modellen ook systeemrisico.

  13. 7 aug 2025OpenAI / release

    GPT-5 vervangt de modelkiezer door een router

    OpenAI bracht GPT-5 uit als een systeem dat per vraag beslist of het snel antwoordt of eerst nadenkt, met een venster van vierhonderdduizend tokens.

  14. 29 sep 2025Google / uitgezet

    Gemini 1.5 gaat uit in de Gemini API

    Google zette Gemini 1.5 Pro, 1.5 Flash en 1.5 Flash-8B uit in de Gemini API.

  15. 5 jan 2026Anthropic / uitgezet

    Claude 3 Opus wordt uitgezet

    Het model dat in maart 2024 het vlaggenschip van Anthropic was, ging uit, tweeëntwintig maanden na de uitgave en zes maanden na de aankondiging.

  16. 19 feb 2026Anthropic / uitgezet

    Claude 3.7 Sonnet en Claude 3.5 Haiku worden uitgezet

    Anthropic zette Claude 3.7 Sonnet uit, het model dat uitgebreid denken introduceerde, een jaar na de uitgave.

  17. 9 mrt 2026Google / uitgezet

    Gemini 3 Pro Preview gaat uit

    Google zette Gemini 3 Pro Preview minder dan vier maanden na de uitgave uit en verwees aanroepen door naar Gemini 3.1 Pro Preview.

  18. 24 apr 2026DeepSeek / release

    DeepSeek V4 haalt een miljoen tokens onder een MIT-licentie

    DeepSeek lanceerde V4-Pro en V4-Flash met een venster van een miljoen tokens en publieke gewichten onder een MIT-licentie.

  19. 9 jun 2026Anthropic / release

    Claude Fable 5 opent de Claude 5-generatie

    Anthropic bracht Claude Fable 5 en Claude Mythos 5 uit: hetzelfde onderliggende model met twee niveaus van beveiliging, waarbij Fable algemeen beschikbaar is en Mythos beperkt blijft tot gescreende organisaties.

  20. 12 jun 2026Anthropic / mijlpaal

    Een Amerikaanse exportmaatregel schort Fable 5 wereldwijd op

    Volgens de eigen publicatie van Anthropic schortte het bedrijf Claude Fable 5 en Mythos 5 voor alle gebruikers op na een exportmaatregel van de Amerikaanse overheid en herstelde de dienst op 1 juli 2026.

  21. 15 jun 2026Anthropic / uitgezet

    Claude Opus 4 en Sonnet 4 worden uitgezet

    De oorspronkelijke Claude 4-modellen gingen dertien maanden na de uitgave uit, twee maanden na de aankondiging.

  22. 9 jul 2026OpenAI / release

    GPT-5.6 vervangt versienummers door benoemde niveaus

    OpenAI bracht GPT-5.6 uit als drie vaste niveaus, Sol, Terra en Luna, alle met een venster van 1.050.000 tokens.

  23. 27 jul 2026Europese Unie / regelgeving

    De Digital Omnibus on AI treedt in werking

    Verordening (EU) 2026/1744 van 8 juli 2026 werd op 24 juli gepubliceerd en trad op 27 juli in werking als wijziging van de AI-verordening.

  24. 2 aug 2026Europese Unie / regelgeving

    De AI-verordening wordt algemeen van toepassing

    De transparantieplichten van artikel 50 gingen gelden: mensen moeten weten wanneer zij met een AI praten, door AI gegenereerde inhoud moet worden gemarkeerd en deepfakes moeten worden vermeld.

  25. 1 sep 2026Anthropic / release

    Claude Fable 5.1 wordt het vlaggenschip van Anthropic

    Anthropic bracht Fable 5.1 en Mythos 5.1 uit met een venster van een miljoen tokens, 128.000 tokens uitvoer, altijd actief adaptief denken en cachelezingen die vijfenzeventig procent goedkoper werden.

  26. 3 sep 2026OpenAI / release

    GPT-6 Astra wordt onthuld

    OpenAI onthulde GPT-6 Astra met een venster van 1.050.000 tokens, 128.000 tokens uitvoer en een kennisgrens van 30 april 2026, voor tien dollar in en vijftig dollar uit per miljoen tokens.

  27. 28 sep 2026OpenAI / uitgezet

    De laatste modellen uit het GPT-3.5-tijdperk gaan uit

    gpt-3.5-turbo-instruct, babbage-002, davinci-002 en gpt-3.5-turbo-1106 gaan uit, een jaar na de aankondiging.

  28. 20 okt 2026Google / uitgezet

    Gemini 2.5 Pro, Flash en Flash-Lite verdwijnen

    Google heeft het einde van de volledige Gemini 2.5-lijn aangekondigd, zestien maanden nadat die algemeen beschikbaar werd.

  29. 23 okt 2026OpenAI / uitgezet

    GPT-4, GPT-4 Turbo, o1, o3-mini en o4-mini gaan uit

    OpenAI zet de volledige oude familie in een keer uit: gpt-3.5-turbo-0125, gpt-4-0613, gpt-4-turbo, gpt-4o-2024-05-13, o1, o1-pro, o3-mini en o4-mini, inclusief bijgetrainde varianten.

  30. 11 dec 2026OpenAI / uitgezet

    De oorspronkelijke GPT-5 en o3 gaan uit

    gpt-5, gpt-5-mini, gpt-5-nano, gpt-5-pro, o3 en o3-pro gaan zestien maanden na de lancering van GPT-5 uit.

  31. 2 dec 2027Europese Unie / regelgeving

    Verplichtingen voor hoog risico gelden voor bijlage III-systemen

    De verplichtingen voor zelfstandige systemen met hoog risico, op terreinen als werk, onderwijs, krediet, biometrie en kritieke infrastructuur, gaan gelden.

  32. 2 aug 2028Europese Unie / regelgeving

    Verplichtingen voor hoog risico gelden voor AI in gereguleerde producten

    AI die is ingebouwd in producten die al onder de Europese productveiligheidswetgeving vallen, zoals machines, medische hulpmiddelen en liften, valt dan onder het regime voor hoog risico.

Het uitfaseringsprobleem

Twee woorden richten hier de meeste schade aan, en ze betekenen niet hetzelfde. Een model is als verouderd aangemerkt, in het Engels deprecated, zodra de leverancier aankondigt dat het gaat verdwijnen en er een datum bij zet. Die dag breekt er niets. Het model antwoordt gewoon. Een model is uitgezet op de dag dat het eindpunt niet meer antwoordt en elke aanroep mislukt. Het gat tussen die twee momenten is de opzegtermijn, en dat is het enige venster waarin een migratie goedkoop is. Alle drie de grote Amerikaanse laboratoria publiceren beide data: Anthropic houdt een uitfaseringsregister bij, OpenAI ook, en Google publiceert levenscyclustabellen voor Vertex AI naast een gedateerd changelog voor de Gemini API.

Voor planning is het eerlijke bereik zes tot achttien maanden bruikbare levensduur per modelversie, met twee tot twaalf maanden opzegtermijn daarvoor. Zet dat getal in het plan en niet in een risicoregister dat niemand leest: een model waar je organisatie in september 2026 op standaardiseert is hoogstwaarschijnlijk binnen anderhalf jaar weg, en de opvolger gedraagt zich anders op jouw eigen documenten. Meestal niet slechter, vaak beter, maar anders. Instructies die waren afgestemd op de gewoonten van het ene model landen niet meer, uitvoerformaten schuiven, en een samenvattingsstap die nooit een kopje verzon doet dat opeens wel.

Een exitclausule voor modellen, in vijf regels

Niets hiervan is exotisch om in te kopen. Vraag het bij ondertekening, wanneer het niets kost, en niet nadat een einddatum is aangekondigd, wanneer het vrijwel niet meer te krijgen is. Je eigen jurist formuleert het beter, maar de kern is vijf punten:

  1. De gepubliceerde opzegtermijn van de leverancier, op schrift, met het adres van het register waar uitfaseringen verschijnen. Is het antwoord geen webadres, dan is er geen opzegtermijn.
  2. Een met naam genoemd opvolgend model, plus de toezegging dat je verwerkersvoorwaarden, je hostingregio en je bewaartermijnen ongewijzigd meegaan.
  3. Het recht om die opvolger te testen op je eigen documenten, met je eigen instructies en je eigen testset, voordat de omschakeling wordt afgedwongen, en een vastgelegd venster om dat te doen.
  4. Een uitweg als de opvolger die test niet doorstaat: export van je instructies, je testresultaten en je data in een bruikbaar formaat, zonder boete bij tussentijds vertrek.
  5. Voor gereguleerd werk een schriftelijke opgave van waar de opvolger wordt verwerkt. Een opvolger in een andere regio is een nieuwe leveranciersbeoordeling, geen versieverhoging.

Elke geverifieerde uitfasering

Uitgezette en aangekondigde afsluitingen uit de modeldataset, meest recent eerst. Bronnen: de uitfaseringsregisters en levenscyclustabellen van de leveranciers zelf, geraadpleegd op 8 september 2026. Alleen regels die tegen een primaire bron zijn bevestigd staan hier.
ModelUitgebrachtUitOpvolger
GPT-57 aug 202511 dec 2026aangekondigdGPT-5.6 Sol
o316 apr 202511 dec 2026aangekondigdGPT-5.6 Sol
o4-mini16 apr 202523 okt 2026aangekondigdGPT-5.6 Terra
o117 dec 202423 okt 2026aangekondigdGPT-5.6 Sol
GPT-413 jun 202323 okt 2026aangekondigdGPT-5.6 Sol
GPT-3.5 Turbo25 jan 202423 okt 2026aangekondigdGPT-5.6 Terra
Mistral Medium 3.1aug 202531 aug 2026wegMistral Medium 3.5
Claude Opus 4.15 aug 20255 aug 2026wegClaude Opus 4.8
DeepSeek legacy endpoints (deepseek-chat, deepseek-reasoner)dec 202424 jul 2026wegDeepSeek-V4-Flash
Claude Opus 414 mei 202515 jun 2026wegClaude Opus 4.8
Claude Sonnet 414 mei 202515 jun 2026wegClaude Sonnet 5
Mistral Large 2.1nov 202431 mei 2026wegMistral Medium 3.5
Claude Haiku 37 mrt 202420 apr 2026wegClaude Haiku 4.5
Claude Sonnet 3.719 feb 202519 feb 2026wegClaude Sonnet 5
Claude Haiku 3.522 okt 202419 feb 2026wegClaude Haiku 4.5
Claude Opus 329 feb 20245 jan 2026wegClaude Opus 4.8

Releases tegenover uitfaseringen, per jaar

Twee eerlijke kanttekeningen bij het lezen. De telling van releases in 2026 loopt tot 3 september 2026, dus dat jaar is niet af. De telling van uitfaseringen in 2026 ligt mede hoger omdat daar afsluitingen in zitten die zijn aangekondigd maar nog niet uitgevoerd, en juist daarom zijn ze bruikbaar: die data liggen nog voor je.

Geverifieerde releases per jaar

  • 20221 gebeurtenis
  • 202310 gebeurtenissen
  • 202410 gebeurtenissen
  • 202516 gebeurtenissen
  • 202621 gebeurtenissen
Geverifieerde modelreleases per kalenderjaar in de onderzoeksdataset, 2022 tot en met 2026.
LabelValue
20221 gebeurtenis
202310 gebeurtenissen
202410 gebeurtenissen
202516 gebeurtenissen
202621 gebeurtenissen

Geverifieerde uitfaseringen per jaar

  • 20220 gebeurtenissen
  • 20230 gebeurtenissen
  • 20241 gebeurtenis
  • 20256 gebeurtenissen
  • 202612 gebeurtenissen
Geverifieerde uitfaseringen en aangekondigde afsluitingen per kalenderjaar in de onderzoeksdataset, 2022 tot en met 2026.
LabelValue
20220 gebeurtenissen
20230 gebeurtenissen
20241 gebeurtenis
20256 gebeurtenissen
202612 gebeurtenissen

Geteld uit de geverifieerde gebeurtenissen in de onderzoekstijdlijn. Releases in 2026 lopen tot 3 september 2026; uitfaseringen in 2026 bevatten afsluitingen die al voor de rest van het jaar zijn aangekondigd.

Drie gewoonten dekken het grootste deel van het risico af, en geen ervan vraagt een project. Houd een lijst bij van elke modelnaam die je organisatie echt aanroept, met per regel een eigenaar, inclusief de namen die in automatiseringen en spreadsheets verstopt zitten. Zet die eigenaren op de uitfaseringsregisters van de leveranciers, openbare webpagina's die een paar keer per jaar wijzigen. En draai bij een opvolger dezelfde test opnieuw waarmee je het model destijds koos, op je eigen documenten, voordat het oude uitgaat.

De test zelf, per bestuursrol uitgeschreven met de vragen die wij gebruiken, staat op Welk AI-model voor welke rol. Degene die de migratieagenda meestal in handen krijgt, heeft een eigen pagina: AI CTO.

06Soevereiniteit

EU-hosting: wat er werkelijk beschikbaar is binnen de Unie

Zeven routes, één bevinding die de meeste besturen verrast, en een reeks data die is verschoven. In september 2026 is een sterk model in Europa draaien een opgelost vraagstuk voor de laag onder de top, en een smal vraagstuk voor de top zelf.

De meeste besturen beginnen dit gesprek bij een benchmarktabel. Begin liever bij de hostingeis: een model dat je organisatie niet mag gebruiken, scoort nul op elke maatstaf die telt. Kijk welke modellen de eis overleven en vergelijk pas daarna de kwaliteit binnen die shortlist.

Zeven woorden, één keer gedefinieerd

Dataresidentie
Een belofte over plaats: je documenten staan opgeslagen en je vragen worden beantwoord binnen een afgesproken regio. Het zegt niets over wie de eigenaar is van het bedrijf dat de machines draait.
Datasoevereiniteit
Een belofte over rechtsmacht en zeggenschap: onder welk landsrecht valt de data en welke mensen kunnen erbij. Residentie is een onderdeel van soevereiniteit en geen synoniem.
Inferentie (inferentie)
Het moment waarop het model je vraag leest en een antwoord schrijft. Hier reist je bestuursstuk daadwerkelijk naartoe, dus dit is de stap waarvan de locatie het zwaarst weegt.
Datazone en inferentieprofiel
Cloudinstellingen die inferentie vastzetten op een groep regio's. Microsoft noemt dit een Data Zone-implementatie, AWS een cross-region inference profile en Google machine learning processing in een regio.
Open gewichten
Het modelbestand zelf is gepubliceerd en je mag het downloaden en draaien. Open gewichten is niet hetzelfde als opensource: de trainingsdata en de code blijven meestal gesloten en de licentie kan voorwaarden bevatten.
Zero data retention
Een contractinstelling waarbij de aanbieder na afloop van het verzoek geen kopie van je vragen of antwoorden bewaart, ook niet in de korte logging voor misbruikdetectie.
Blootstelling aan de Amerikaanse CLOUD Act
De vraag of een aanbieder met hoofdkantoor in de Verenigde Staten door Amerikaans recht gedwongen kan worden om data af te geven die buiten dat land staat. Een EU-regio beantwoordt die vraag op zichzelf niet; aanbieders zetten daar een aparte EU-rechtspersoon tegenover.

Frontiermodel, in het Engels frontier-class, betekent hier een model dat het lab presenteerde als zijn meest capabele algemene model en dat bij release in de kopgroep zat op gepubliceerde algemene capaciteit. Dat is een oordeel, dus elk meegeteld model staat hieronder met naam en is controleerbaar. Binnen de EU betekent een van twee dingen, apart geteld: gehost met een garantie op dataresidentie, waarbij de leverancier of een cloudaanbieder zich vastlegt op verwerking binnen EU-regio's, of zelf te hosten, waarbij de gewichten zijn gepubliceerd onder een licentie waarmee een bedrijf het model op eigen EU-hardware kan draaien. Dataresidentie is niet hetzelfde als rechtsmacht: de EU-regio's van Microsoft, Amazon en Google worden geëxploiteerd door Amerikaanse bedrijven, dus residentie beschrijft waar de data wordt verwerkt en niet wie gedwongen kan worden die af te geven.

Welk model, op welke route, met dataresidentie in de EU

EU-regio, Amerikaanse cloudEigen EU-eindpunt van het labEuropese modelleverancierEuropese cloud, open modellenSoevereine cloudJe eigen hardwareConsumentenapps
Claude Fable 5.1
GPT-6 Astra
Gemini 3.8 Flash
Claude Opus 5
Claude Sonnet 5
Claude Haiku 4.5
GPT-5.6 Sol
GPT-5.5
Gemini 3.5 Flash
Gemini 2.5 Pro
Mistral Medium 3.5
DeepSeek-V4-Pro
Amazon Nova Pro
geen EU-residentie gedocumenteerdEU-residentie gedocumenteerd
Matrix van model tegen hostingroute. Van de drie nieuwste Amerikaanse topmodellen hebben Claude Fable 5.1 en Gemini 3.8 Flash alleen op de eu-multiregio van Google Cloud gedocumenteerde dataresidentie in de EU en GPT-6 Astra op geen enkele route, terwijl Claude Opus 5, Claude Sonnet 5, GPT-5.6 Sol, Gemini 3.5 Flash en Gemini 2.5 Pro die hebben op de EU-regio van een Amerikaanse cloud, en Mistral Medium 3.5, DeepSeek-V4-Pro en Amazon Nova Pro binnen de EU door een Europese exploitant kunnen draaien.
EU-regio, Amerikaanse cloudEigen EU-eindpunt van het labEuropese modelleverancierEuropese cloud, open modellenSoevereine cloudJe eigen hardwareConsumentenapps
Claude Fable 5.1100%0%0%0%0%0%0%
GPT-6 Astra0%0%0%0%0%0%0%
Gemini 3.8 Flash100%0%0%0%0%0%0%
Claude Opus 5100%0%0%0%0%0%0%
Claude Sonnet 5100%0%0%0%0%0%0%
Claude Haiku 4.5100%0%0%0%0%0%0%
GPT-5.6 Sol100%0%0%0%0%0%0%
GPT-5.5100%0%0%0%0%0%0%
Gemini 3.5 Flash100%0%0%0%0%0%0%
Gemini 2.5 Pro100%0%0%0%0%0%0%
Mistral Medium 3.50%0%100%50%0%100%0%
DeepSeek-V4-Pro0%0%0%50%0%100%0%
Amazon Nova Pro0%0%0%0%100%0%0%
Bronnen: documentatie van leveranciers en cloudaanbieders, geraadpleegd op 8 september 2026. In de datatabel achter dit raster betekent 100 procent gedocumenteerde dataresidentie in de EU, 50 procent beschikbaar op de route met een niet-bevestigde catalogus, en 0 procent geen gedocumenteerde EU-residentie of niet aangeboden op die route.

Leessleutel

  • Gedocumenteerde dataresidentie in de EU voor dit model op deze route.
  • Technisch beschikbaar op deze route, maar de actuele catalogus van de aanbieder is niet bevestigd. Vraag het schriftelijk.
  • Aangeboden op deze route zonder gedocumenteerde dataresidentie in de EU.
  • Niet aangeboden op deze route.

De zeven routes

Geordend van de route die de meeste bedrijven in het middenbedrijf nemen tot de route die elke vraag over rechtsmacht beantwoordt en het meest kost om te draaien. Lees per route eerst de regel over wat niet geregeld is: daar zit het inkoopwerk.

01 EU-regio, Amerikaanse cloud

EU-regio van een Amerikaanse cloud

verwerking in de EUBeheerlast: laag

Je huurt een topmodel bij Amazon, Microsoft of Google en zet de verwerking vast op Europese datacenters.

Genoemd aanbod

  • Amazon Bedrock, EU cross-region inference profile
  • Microsoft Foundry, Data Zone Standard (European Union)
  • Google Cloud, EU multi-region with data residency at rest and machine learning processing
  • OpenAI API regional processing on eu.api.openai.com

Wat deze route niet regelt

Drie dingen. De contractpartij blijft een bedrijf met hoofdkantoor in de Verenigde Staten, dus blootstelling aan de CLOUD Act is een juridische afweging van je jurist en geen instelling die je aanzet. Support- en engineeringmedewerkers buiten de EU kunnen mogelijk nog steeds bij systemen, en juist daarvoor bestaan de soevereine varianten hieronder. En de instelling dekt niet elk nieuwste topmodel: GPT-6 Astra heeft helemaal geen EU-route, en Claude Fable 5.1 en Gemini 3.8 Flash hebben alleen de eu-multiregio van Google Cloud, waardoor de residentie-eis stilzwijgend je modelkeuze versmalt.

02 Eigen EU-eindpunt van het lab

Het eigen Europese eindpunt van het lab

verwerking in de EU, met contractuele waarborgenBeheerlast: laag

Je koopt rechtstreeks bij de modelbouwer en die biedt een Europees adres waarop opslag en verwerking in Europa blijven.

Genoemd aanbod

  • OpenAI API regional processing, eu.api.openai.com
  • Anthropic Claude in Amazon Bedrock, zero operator access
  • Mistral La Plateforme and Le Chat Enterprise

Wat deze route niet regelt

De leverancier blijft Amerikaans, dus de vraag over de CLOUD Act verandert niet. Welke modellen in aanmerking komen op het Europese eindpunt staat niet in de documentatie die wij konden inzien, dus behandel de modellenlijst als iets wat je tijdens de inkoop schriftelijk laat bevestigen en niet als publiek feit.

03 Europese modelleverancier

Een Europese modelleverancier

beheerd door een EU-rechtspersoonBeheerlast: laag

Je koopt het model bij een bedrijf met hoofdkantoor in de EU, waarmee de vraag over Amerikaanse rechtsmacht helemaal uit het contract verdwijnt.

Genoemd aanbod

  • Mistral Le Chat Enterprise, Mistral cloud or your own cloud
  • Mistral La Plateforme API

Wat deze route niet regelt

Als je de beheerde Mistral-cloud afneemt in plaats van zelf te hosten, laat dan in het contract vastleggen welke subverwerkers worden gebruikt en in welke landen, want een Europese leverancier kan nog steeds rekenkracht in het buitenland inkopen. Wij konden de huidige verwerkersovereenkomst van Mistral tijdens dit onderzoek niet inzien, dus behandel de geografie van subverwerkers als een openstaande vraag voor de inkoop.

04 Europese cloud, open modellen

Een Europese cloud die open modellen draait

beheerd door een EU-rechtspersoonBeheerlast: laag

Een Europese aanbieder host gepubliceerde modelgewichten op Europese hardware en verkoopt je de inferentie als een gewone API.

Genoemd aanbod

  • IONOS AI Model Hub
  • Scaleway Generative APIs
  • OVHcloud AI Endpoints
  • STACKIT AI services
  • T-Systems sovereign AI services

Wat deze route niet regelt

De modelkeuze is beperkt tot wat gepubliceerd is, en een gepubliceerd model kan Chinees van oorsprong zijn terwijl de hardware Duits is. Als het bezwaar van het bestuur zich richt op Chinese leveranciers en niet op Amerikaanse, lees dan eerst de modelkaart en daarna pas het adres van het datacenter.

05 Soevereine cloud

De soevereine cloud van een hyperscaler

beheerd door een EU-rechtspersoonBeheerlast: gemiddeld

Dezelfde drie Amerikaanse clouds, maar verkocht via een aparte Europese juridische structuur met Europees personeel en zonder operationele zeggenschap van buiten de EU.

Genoemd aanbod

  • AWS European Sovereign Cloud, region eusc-de-east-1 (Brandenburg)
  • Microsoft EU Data Boundary for the Microsoft Cloud
  • Google Cloud Data Boundary with Assured Workloads
  • Google Cloud Dedicated with S3NS (France) and T-Systems (Germany)
  • Google Distributed Cloud air-gapped

Wat deze route niet regelt

De beschikbaarheid van modellen, en de vraag of een aparte EU-rechtspersoon van een Amerikaans concern voldoet aan jouw invulling van soevereiniteit. Die tweede vraag is een bestuursbesluit met juridisch advies en geen technisch feit, en redelijke Europese besturen beantwoorden die verschillend.

06 Je eigen hardware

Open gewichten op hardware die je zelf beheert

jouw hardware, jouw gewichtenBeheerlast: hoog

Je downloadt een gepubliceerd model en draait het op je eigen servers, of op gehuurde servers die je volledig beheert.

Genoemd aanbod

  • Your own data centre
  • Rented dedicated GPU capacity at a European provider
  • A managed private deployment of published weights

Wat deze route niet regelt

Niets over rechtsmacht. Alles over capaciteit en continuïteit: je bent nu zelf verantwoordelijk voor beveiligingsupdates, voor modelupgrades en voor het feit dat de gepubliceerde stand van de techniek elke paar maanden verschuift terwijl je cluster dat niet doet.

07 Consumentenapps

De route die niemand koos: consumentenapps

verwerking in de EUBeheerlast: laag

Medewerkers plakken bestuursmateriaal in een gratis of persoonlijk chataccount, en het databeleid van de organisatie krijgt dat nooit te zien.

Genoemd aanbod

  • Free and personal tiers of consumer chat apps
  • Browser extensions and note apps with a built-in assistant

Wat deze route niet regelt

Alles. Behandel dit als het basisrisico dat je feitelijk beperkt, en beoordeel je beleid op hoeveel van dit verkeer het weghaalt.

Van eis naar route

Begin bij de hostingeis en niet bij de benchmarktabel. Een model dat je niet mag gebruiken scoort nul. Werk deze zes takken af tot er één past bij wat je bestuur, je ondernemingsraad en het contract van je grootste klant werkelijk eisen, kies dan het beste model op die tak en test het op je eigen documenten.

Moet je data in de EU blijven?
Geen residentie-eis
Moet de exploitant een EU-rechtspersoon zijn?
EU-regio, Amerikaanse leverancier mag
Moet de modelleverancier ook Europees zijn?
EU-exploitant vereist
Moet het draaien op hardware onder jouw beheer?
Europese leverancier
Eigen hardware
Elke uitkomst komt overeen met een van de routes hierboven.

De regelgevingskalender, na de Digital Omnibus

  1. 1 aug 2024regelgeving

    De AI-verordening treedt in werking

    Verordening (EU) 2024/1689 treedt in werking. Er wordt nog niets van een bedrijf gevraagd; de klok start voor een reeks gefaseerde deadlines die tot 2028 doorloopt.

  2. 2 feb 2025regelgeving

    Verboden praktijken en AI-geletterdheid gaan gelden

    De verboden op een korte lijst met AI-toepassingen, zoals social scoring en het ongericht verzamelen van gezichtsafbeeldingen, gaan gelden. Datzelfde geldt voor artikel 4, de verplichting rond AI-geletterdheid, die iedere organisatie raakt die een AI-systeem aanbiedt of gebruikt en niet alleen de bouwers van modellen.

  3. 2 aug 2025regelgeving

    Verplichtingen voor AI-modellen voor algemene doeleinden gaan gelden

    De verplichtingen voor aanbieders van AI-modellen voor algemene doeleinden, dus de labs die de modellen zelf trainen, gaan gelden, samen met de regels over toezicht en vertrouwelijkheid. Lidstaten moeten op deze datum bevoegde autoriteiten hebben aangewezen en sancties hebben vastgelegd.

  4. 27 jul 2026regelgeving

    De Digital Omnibus on AI treedt in werking

    Verordening (EU) 2026/1744 wijzigt de AI-verordening. Zij stelt de verplichtingen voor hoog risico uit, verzacht de formulering van de plicht rond AI-geletterdheid van het waarborgen van een voldoende niveau naar het ondersteunen van de ontwikkeling van AI-geletterdheid, staat vereenvoudigde technische documentatie toe voor mkb en kleine midcaps, en voegt verboden toe op systemen die niet-consensueel intiem materiaal of materiaal van seksueel misbruik van kinderen genereren.

  5. 2 aug 2026regelgeving

    De rest van de AI-verordening gaat gelden en de handhaving begint

    De rest van de AI-verordening wordt van toepassing, inclusief de transparantieplichten uit artikel 50: vertel mensen wanneer zij met een AI-systeem praten en label synthetische content. Nationale markttoezichthouders houden vanaf deze datum toezicht en handhaven, en dat is het eerste moment waarop er zichtbaar een handhaver achter de geletterdheidsplicht staat.

  6. 2 dec 2026regelgeving

    Markering van synthetische content en de nieuwe verboden

    Synthetische audio, beelden, video en tekst van systemen die vóór 2 augustus 2026 op de markt zijn gebracht, moeten voldoen aan de markeringsverplichtingen. Ook de verboden uit de omnibus op niet-consensueel intiem materiaal en materiaal van seksueel misbruik van kinderen worden van kracht.

  7. 2 aug 2027regelgeving

    Oudere modellen voor algemene doeleinden moeten voldoen

    Aanbieders van AI-modellen voor algemene doeleinden die vóór 2 augustus 2025 op de markt zijn gebracht, moeten volledig voldoen. In de praktijk sluit dit het overgangsvenster voor de modelgeneratie die jouw organisatie mogelijk nog draait.

  8. 2 dec 2027regelgeving

    Hoogrisicosystemen onder bijlage III

    De eisen uit hoofdstuk III gaan gelden voor zelfstandige hoogrisicosystemen: biometrie, kritieke infrastructuur, onderwijs, werk, migratie, asiel en grenstoezicht. Door de Digital Omnibus uitgesteld; de oorspronkelijke datum was 2 augustus 2026. Voor de meeste besturen in het middenbedrijf is werk de relevante categorie: AI die wordt gebruikt bij werving of bij besluiten over personeel.

  9. 2 aug 2028regelgeving

    Hoogrisico-AI in gereguleerde producten

    De eisen uit hoofdstuk III gaan gelden voor AI die is ingebouwd in producten die al onder Europese productwetgeving vallen, zoals liften, speelgoed en machines. Door de Digital Omnibus uitgesteld; de oorspronkelijke datum was 2 augustus 2027.

Wat een bestuur in het middenbedrijf werkelijk moet doen

AI-geletterdheid: artikel 4

Aanbieders en gebruiksverantwoordelijken moeten maatregelen nemen die de ontwikkeling van AI-geletterdheid ondersteunen bij medewerkers en anderen die namens hen met hun AI-systemen werken. Er is geen voorgeschreven trainingsvorm en geen certificering. Wat een bestuur moet kunnen laten zien, is dat de mensen die de assistent gebruiken ruwweg weten hoe die faalt, wat er niet in mag en bij wie ze terechtkunnen. De Commissie en de lidstaten hebben nu formeel de taak om die inspanning te ondersteunen, in het bijzonder voor het mkb.

Geldt vanaf 2 feb 2025

Transparantie: artikel 50

Mensen moeten weten wanneer zij met een AI-systeem te maken hebben, en synthetische audio, beelden, video en tekst moeten als zodanig worden gemarkeerd. Bij de meeste bedrijven raakt dit de chatbot op de website en alles wat gepubliceerd wordt en door een model is geschreven. Deze plichten zijn door de Digital Omnibus niet uitgesteld.

Geldt vanaf 2 aug 2026

Controleer één keer of je onder hoog risico valt

Het hoogrisicoregime gaat op 2 december 2027 gelden voor zelfstandige systemen onder bijlage III. De categorie die gewone bedrijven raakt is werk: AI die sollicitanten filtert of besluiten over personeel voedt. Het uitstel is tijd om je voor te bereiden en geen reden om de toets over te slaan, en die toets kost de meeste besturen een uur.

Geldt vanaf 2 dec 2027

Leg vast welk model, waar, en op welke data

Geen enkel artikel verplicht een gebruiksverantwoordelijke in het middenbedrijf tot een modelregister, maar elk gesprek met een accountant, een verzekeraar of een ondernemingsraad begint met dezelfde drie vragen. Eén pagina met het model, de hostingroute, de data die het mag zien en de verantwoordelijke persoon beantwoordt ze alle drie en kost een middag.

Geldt vanaf 2 aug 2026

Training, bewaring en residentie, per leverancier

Gegevensverwerking per leverancier en dienst, uit de eigen documentatie van de aanbieders, geraadpleegd op 8 september 2026. Cloudrijen beschrijven het hostingplatform; de eigen voorwaarden van de modelleverancier bepalen het trainen op dat platform.
Leverancier en dienstTraint standaard op jouw data?Bewaring en residentiewaarborgenBron
OpenAI APINee, tenzij je uitdrukkelijk kiest om data te delen.Zero Data Retention haalt klantinhoud uit de logboeken voor misbruikdetectie, anders tot 30 dagen bewaard. Europese regionale opslag en verwerking lopen via een apart eindpunt.
Anthropic, zakelijke productenNee, standaard niet, voor Claude for Work, de Anthropic API en Claude Gov.Anthropic stelt zero operator access voor Claude in Amazon Bedrock: het eigen personeel kan niet bij de inferentie-infrastructuur.
Anthropic, Claude voor consumentenAlleen als de gebruiker daarvoor kiest, als een gesprek wordt gemarkeerd voor veiligheidsbeoordeling, of in een uitdrukkelijk programma.Incognitogesprekken blijven buiten modelverbetering, ook als de instelling aanstaat. Consumentenvoorwaarden, aanvaard door de persoon, niet door je organisatie.
Microsoft FoundryNiet vermeld in de documentatie die wij controleerden. De voorwaarden van de modelleverancier bepalen dit.Data Zone-implementaties verwerken vragen en antwoorden alleen binnen de opgegeven zone; de zone Europese Unie volgt de Azure EU Data Boundary. De GPT-5.6-lijn staat in negen Europese regio's; Claude op Azure heeft een Amerikaanse datazone en geen Europese.
Google Cloud, GeminiNiet vermeld in de documentatie die wij controleerden. De voorwaarden van de modelleverancier bepalen dit.Per model: dataresidentie in rust plus machine learning processing in de EU-multiregio voor Gemini 3.5 Flash en Gemini 2.5 Pro, alleen de eu-multiregio voor Gemini 3.8 Flash, en geen van beide voor Gemini 3.1 Pro preview.
AWS European Sovereign CloudNiet vermeld in de documentatie die wij controleerden. De voorwaarden van de modelleverancier bepalen dit.Een aparte Europese juridische structuur, uitsluitend beheerd door EU-ingezetenen, fysiek en logisch gescheiden van andere AWS-regio's. Amazon Nova Pro is het enige basismodel dat voor de regio wordt genoemd.
IONOS AI Model HubNee. IONOS stelt dat prompts en uitvoer niet worden gebruikt om enig model te trainen, te verfijnen of anderszins te verbeteren.Inferentie in Duitse datacenters en nergens anders, nooit gelogd en nooit ingezien, niet gedeeld met derden, binnen de reikwijdte van BSI C5.

Drie van deze rijen zijn cloudplatforms en geen modelleveranciers, dus de trainingsvraag hoort bij wie het model bouwde dat je erop inzet. Stel die vraag aan die leverancier en leg het antwoord bij het hostingbesluit.

Wat je hiermee doet

Schrijf op welke route je zit, welk model dat je laat, en wie ervoor tekende. Die ene pagina beantwoordt de eerste drie vragen van elke auditor, verzekeraar, ondernemingsraad en inkoopafdeling van een klant, en het is het document dat de documentatiecultuur van de AI-verordening beloont.

De CTO-blik op dit besluit / Hoe wij met beveiligingsvragen omgaan

Dit hoofdstuk beschrijft alleen aanbod van derden, gecontroleerd tegen de documentatie van de aanbieders op 8 september 2026. Het doet geen uitspraak over waar AI Board zelf draait of welke certificeringen het heeft.

07Welk model voor welke situatie

Zes situaties, en waarmee je in elke situatie begint

Positionering, geen meting. Elk model hieronder wordt genoemd om een eigenschap die de leverancier zelf publiceert, in dezelfde zin als de naam.

Een bestuur heeft geen modelprobleem. Het heeft een stuk of zes terugkerende situaties, en elk daarvan versmalt het veld voordat kwaliteit ter sprake komt. Zoals het soevereiniteitshoofdstuk het zegt: een model dat je niet mag gebruiken scoort nul.

Je bent CEO en wilt één assistent die alles leest

Begin met
Claude Fable 5.1 en GPT-6 Astra: beide publiceren een venster van ongeveer één miljoen tokens, bij de omrekening van dit rapport ruim tachtig bestuursstukken in één gesprek, en beide publiceren een redeneermodus. Onze data noteert voor Fable 5.1 een EU-route op Google Cloud en voor GPT-6 Astra geen enkele.
Test eerst
Geef het je laatste vier bestuursmappen en vraag welke drie besluiten tussen de eerste en de vierde zijn veranderd, met de pagina erbij.

AI voor de CEO

Je bent CFO en elk cijfer moet herleidbaar zijn

Begin met
De middentier, getest voordat je voor het vlaggenschip betaalt. Claude Sonnet 5 en GPT-5.6 Terra publiceren een venster van dezelfde orde als de vlaggenschepen en een redeneermodus, maar kosten in het model hieronder ongeveer een vijfde daarvan. Claude Opus 5 zit ertussen, met een gedocumenteerde EU-inferenceroute op Amazon Bedrock.
Test eerst
Twintig vragen waarvan het antwoord telkens in precies één bijlage staat. Tel apart hoeveel antwoorden een document en pagina noemen, en hoeveel de juiste noemen.

AI voor de CFO

Je bent CTO en moet tekenen voor waar de data staat

Begin met
De EU-regiotak van de beslisboom in dit rapport, waar drie clouds een route documenteren: Claude Opus 5, Sonnet 5 en Haiku 4.5 op het EU-inferentieprofiel van Amazon Bedrock, de GPT-5.6-varianten in negen Europese regio's onder Azure Data Zone Standard, en Gemini in Europese regio's op Vertex AI. Die lijst loopt een generatie achter, en GPT-6 Astra staat er niet op.
Test eerst
Laat elke leverancier de verwerkingsregio en de contractpartij schriftelijk benoemen, en draai daarna je tien lastigste vragen op het EU-eindpunt en op het globale eindpunt.

AI voor de CTO

Je wilt de laagste verdedigbare kosten per bestuurder per week

Begin met
De grafiek hieronder, die één vastgelegde set aannames op tien actuele modellen toepast. Gemini 3.8 Flash komt er het goedkoopst uit en DeepSeek-V4-Pro daarna, met Claude Sonnet 5 en GPT-5.6 Terra vlak erachter. Twee kanttekeningen: Google noemt de Gemini-prijs een introductieprijs tot en met 31 december 2026 die op 1 januari 2027 verdubbelt, en het cijfer voor DeepSeek is het piektarief.
Test eerst
Draai één week echte vragen op een goedkope tier en op een vlaggenschip, en tel hoeveel antwoorden je met de hand moest controleren. Goedkoop is alleen goedkoop als dat controleren gratis is.

Welk model voor welke bestuursrol

Het model moet draaien op hardware die je zelf beheert

Begin met
DeepSeek-V4-Pro, gepubliceerd onder de MIT-licentie met een venster van één miljoen tokens, is in onze data de sterkste echt ruime optie. Daaronder staan Mistral Large 3, Qwen3.8-27B en Muse Glimmer 30B, alle drie Apache-2.0, en GLM-5.2 onder MIT. Mistral Medium 3.5 publiceert zijn gewichten ook, maar onder een Modified MIT-licentie met uitzonderingen boven een omzetdrempel, dus dat model hoort pas op deze lijst nadat je jurist die licentie heeft gelezen.
Test eerst
Voordat iemand een GPU koopt: huur er een week een en draai je twintig lastigste vragen erop. Meet kosten per bruikbaar antwoord over drie jaar, niet de licentiekosten.

AI voor de CTO

De assistent moet degene zijn die al in je suite zit

Begin met
Wat de suiteleveranciers zelf publiceren. Microsoft documenteert GPT-modellen van OpenAI en sinds januari 2026 ook Anthropic als subverwerker, noemt Claude Fable 5.0 en 5.1 met naam, en laat de gebruiker in Researcher voor Claude kiezen. Google Workspace draait alleen op Gemini, met een Flash-niveau voor dagelijks werk en een Pro-niveau dat nog een preview-model-id draagt.
Test eerst
Stel dezelfde vijf vragen in de assistent van de suite en in een rechtstreekse aanroep van het model dat je anders zou kopen. Is het antwoord uit de suite goed genoeg, dan is het inkooptraject klaar.

Welk model voor welke bestuursrol

De gepubliceerde eigenschappen achter die startpunten

Startpunten per situatie, met de gepubliceerde eigenschappen erachter. Bron: documentatie van de leveranciers, gelezen op 8 september 2026. De kosten zijn een schatting op basis van vermelde aannames, geen offerte.
SituatieStartpuntContextvensterEU-residentierouteOpen gewichtenKosten per werkweek
Synthese van bestuursstukkenClaude Fable 5.11M tokensGedocumenteerdNiet gepubliceerdUS$ 10,62
Herleidbare financiële antwoordenClaude Sonnet 51M tokensGedocumenteerdNiet gepubliceerdUS$ 2,38
EU-residentie eerstClaude Opus 51M tokensGedocumenteerdNiet gepubliceerdUS$ 5,94
Laagste kosten per werkweekGemini 3.8 Flash1,05M tokensGedocumenteerdNiet gepubliceerdUS$ 0,89
Volledig zelf gehostDeepSeek-V4-Pro1M tokensGedocumenteerdGepubliceerdMITUS$ 1,26

De zesde situatie heeft bewust geen rij: Microsoft en Google publiceren de familie achter hun assistenten en niet de versie, dus er is geen venster, route of tokenprijs die eerlijk in deze kolommen past.

Kosten per bestuurder per werkweek

Prijs per miljoen tokens is voor een bestuur de verkeerde eenheid, want niemand koopt een miljoen tokens. De eenheid waar een bestuurder iets tegenin kan brengen is: één bestuurder, één werkweek, opgebouwd uit de aannames naast de grafiek. Waar een lab geen cacheprijs voor invoer publiceert wordt geen korting toegepast, en daarom staan Mistral en Alibaba hier hoger dan hun kopprijs doet vermoeden.

  • GPT-6 AstraUS$ 11,88
  • Claude Fable 5.1US$ 10,62
  • Claude Opus 5US$ 5,94
  • Qwen3.8-MaxUS$ 5,16
  • Mistral Medium 3.5US$ 4,05
  • Grok 4.6US$ 2,64
  • GPT-5.6 TerraUS$ 2,50
  • Claude Sonnet 5US$ 2,38
  • DeepSeek-V4-ProUS$ 1,26
  • Gemini 3.8 FlashUS$ 0,89
Geschatte kosten in Amerikaanse dollars voor één bestuurder voor één werkweek, per model. Het duurste model in de lijst kost meer dan dertien keer zoveel als het goedkoopste.
LabelValue
GPT-6 AstraUS$ 11,88
Claude Fable 5.1US$ 10,62
Claude Opus 5US$ 5,94
Qwen3.8-MaxUS$ 5,16
Mistral Medium 3.5US$ 4,05
Grok 4.6US$ 2,64
GPT-5.6 TerraUS$ 2,50
Claude Sonnet 5US$ 2,38
DeepSeek-V4-ProUS$ 1,26
Gemini 3.8 FlashUS$ 0,89
Schatting op basis van gepubliceerde API-lijstprijzen, gelezen op 8 september 2026. Exclusief btw, volumekorting, batch- en daltarieven, en het ophaalplatform.

De aannames, volledig

  • Een bestuurder stelt de assistent 40 vragen in een werkweek, oftewel acht per dag.
  • Elke vraag draagt 60.000 invoertokens context mee, ongeveer 90 pagina's bestuursstukken, notulen en bijlagen naast de vraag zelf.
  • Elk antwoord is 1.500 uitvoertokens, ongeveer twee pagina's.
  • Waar het lab een cacheprijs publiceert, komt 70 procent van die invoertokens uit cache, omdat dezelfde documentenset de hele week opnieuw wordt gelezen. Publiceert het lab geen cacheprijs, dan wordt geen korting toegepast.
  • Alle bedragen zijn openbare lijstprijzen in Amerikaanse dollars, exclusief btw, exclusief volumekorting, exclusief de batch- en daltarieven die verschillende labs aanbieden, en exclusief de kosten van het platform dat het ophalen doet.

Wat volgt

Dit rapport is een kaart van wat de leveranciers publiceren. Het bevat geen scores, want modellen fatsoenlijk scoren betekent dat je dezelfde documenten en vragen langs alle modellen haalt en beide publiceert.

In november 2026 publiceren wij de eerste editie van de AI Board Model Index: de actuele modellen uit dit rapport, door één vaste set bestuursdocumenten en vragen gehaald, beoordeeld op zaken waar een bestuurder iets tegenin kan brengen. Die index bestaat nog niet. Er staan geen resultaten op deze pagina en geen op de pagina van de Model Index, en elke scorekaart die daar staat is gemarkeerd als illustratief voorbeeld van het format, zonder modelnaam ernaast.

Wat wij elk kwartaal opnieuw controleren

  • Lijstprijzen per miljoen tokens, cachetarieven voor invoer, en wanneer introductieprijzen aflopen.
  • Gepubliceerde contextvensters, en of de leverancier er nog een publiceert.
  • EU-residentieroutes per model en cloud, inclusief modellen die buiten de eigen EU-grens van een leverancier vallen.
  • De status van modellen: wat wordt of is uitgefaseerd, en welke opvolger de leverancier noemt.
  • Licenties op gepubliceerde gewichten, die bij de volgende uitgave kunnen veranderen.
  • Welke modellen de kantoorsuites noemen, en of zij versies publiceren in plaats van families.

De eerlijke grenzen van dit rapport

Elk feit hier is op 8 september 2026 gelezen en geldt per die datum. Pagina's van leveranciers veranderen zonder aankondiging en zonder changelog, en een deel ervan is veranderd voordat je dit leest. Waar de ene pagina de andere tegensprak, zeggen wij dat in plaats van het nettere getal te kiezen.

Sommige dingen konden wij niet bevestigen: Microsoft publiceert geen prijs per gebruiker voor de enterprise-uitbreiding van Copilot, Alibaba publiceert geen internationale catalogusprijs voor Qwen3.8-Max, en verschillende Europese aanbieders serveren open modellen met een kleiner venster dan het maximum van het model. Die gaten staan als gaten in de tekst. AI Board Studio heeft geen eigen model en ontvangt geen betaling van leveranciers.

Lees over de Model Index en de methode. Welk AI-model voor welke bestuursrol.

08Methode en grenzen

Hoe dit rapport tot stand kwam, en wat er bewust niet in staat

Elk feit hierboven komt van een leverancierspagina die we op 8 september 2026 hebben geopend. Deze slotsectie beschrijft de methode, de bewuste weglatingen, de route voor correcties en de volledige bronnenlijst.

Hoe deze feiten zijn verzameld

Elk modelfeit in dit rapport komt van het bedrijf dat het model uitbrengt: de eigen documentatie, de release notes, de prijspagina of de aankondiging, geopend op 8 september 2026. Alleen primaire bronnen. Een specificatie telt wanneer de leverancier hem publiceert, niet wanneer een nieuwsartikel, een ranglijst of een wederverkoper hem herhaalt. Waar een leverancierspagina en een externe tracker elkaar tegenspraken, won de leverancierspagina. Waar twee pagina's van dezelfde leverancier elkaar tegenspraken, is het punt weggelaten in plaats van met een gok opgelost.

Wat er bewust niet in dit rapport staat

Twee categorieën zijn bewust weggelaten. De eerste zijn benchmarkpercentages van leveranciers die we niet konden herleiden naar een benoemde test, een benoemde modelversie en een benoemde vergelijking. Lanceringsposts staan er vol mee. Een bewering dat het ene model zoveel procent beter is dan het andere, zonder test en zonder vergelijkingsbasis, is een advertentie in de kleren van een meting, en die hebben we niet overgenomen.

De tweede zijn scores. Dit rapport bevat geen enkele gemeten rangschikking. Modellen beoordelen tegen één vaste documentenset en één vaste vragenlijst is het werk van de AI Board Model Index, waarvan de eerste editie in november 2026 verschijnt. Zolang die meting er niet is, zou een getal naast een modelnaam precies het gedrag zijn dat dit rapport leveranciers verwijt. Waar het rapport zegt welk model bij welke situatie past, is dat een lezing van gepubliceerde eigenschappen, gelabeld als positionering.

Hoe je een correctie doorgeeft

Liever gecorrigeerd dan verkeerd geciteerd. Klopt een cijfer hierboven niet meer, of klopte het al niet op de publicatiedatum, laat het ons weten en stuur de leverancierspagina die het aantoont. Een correctie met een primaire bron erbij wordt doorgevoerd, en de raadpleegdatum naast die bron verschuift mee. De contactroute staat op de pagina over ons, hieronder gelinkt.

De contactgegevens staan op de pagina over ons

Wat er hierna met deze pagina gebeurt

Het voornemen is om dit rapport elk kwartaal opnieuw te controleren: alle bronnen opnieuw openen, de prijzen, de regio's en de uitfaseringsdata bijwerken, en de datum bovenaan opnieuw vaststellen. Dat is een voornemen en geen garantie, en dat zeggen we liever hardop dan dat we een schema beloven dat een klein team kan missen. Brengt een lab iets uit dat het beeld eerder verandert, dan is het voornemen om eerder bij te werken.

Vragen die een directie hierover stelt

Twaalf vragen die in vrijwel elk managementteam langskomen zodra dit onderwerp op de agenda staat. De antwoorden bevatten bewust geen modelspecificaties, want die veranderen sneller dan een vragenlijst kan bijhouden.

Welk AI-model is het veiligst voor bestuursdocumenten?
Er bestaat geen enkel veilig model, en wie dat wel beweert, verkoopt iets. Veiligheid voor bestuurswerk bestaat uit vier losse dingen: blijft het model binnen je eigen documenten, geeft het aan wanneer een antwoord er niet in staat, verwijst het naar het document en de pagina die het gebruikte, en kan het draaien waar je data mag staan. De huidige vlaggenschipmodellen van de grote labs zijn op de eerste drie punten het beste startpunt, en het rapport hierboven laat zien welke daarvan onder Europese dataresidentie kunnen draaien. Het eerlijke antwoord blijft: test een shortlist op je eigen documenten voordat er iets gevoeligs bij komt.
Kan ChatGPT in de EU gehost worden?
De consumentenapp is een product, geen hostingkeuze. De modellen erachter zijn bereikbaar via cloudplatforms met Europese regio's, en zo lost het merendeel van de organisaties een eis rond dataresidentie op zonder het model te verlaten dat medewerkers al kennen. Twee kanttekeningen horen in de notulen. Dataresidentie in een EU-regio is niet hetzelfde als soevereiniteit, want een Amerikaanse aanbieder blijft onder Amerikaans recht vallen. En de beschikbare regio's en voorwaarden verschillen per model en veranderen, dus controleer ze in de documentatie van de leverancier op het moment dat je tekent. De hostingsectie hierboven zet de routes per lab op een rij.
Wat betekent een contextvenster van 1 miljoen tokens in pagina's?
Een token is een tekstfragment, gemiddeld iets minder dan een woord. Het contextvenster is de hoeveelheid tekst die een model in één gesprek kan vasthouden, jouw documenten en zijn antwoord samen. Als vuistregel geldt dat een venster van een miljoen tokens enkele honderdduizenden woorden zijn, de orde van grootte van een jaar bestuursstukken plus het jaarverslag. Twee waarschuwingen. Leveranciers noemen het maximum dat het model accepteert, niet het punt waarop de kwaliteit standhoudt, en een model dat een documentenset kan vasthouden gebruikt die niet altijd correct diep in de set. De Model Index meet die praktische grens: /nl/onderzoek/model-index.
Is een model met open gewichten goed genoeg voor finance?
Modellen met open gewichten kun je downloaden en draaien op hardware die je zelf beheert, en daarom kijken finance- en juridische teams er als eerste naar. In 2026 zijn de sterkste open modellen echt bruikbaar voor lezen, samenvatten en schrijven. Het verschil met de gesloten vlaggenschepen zie je in de moeilijke gevallen: synthese over veel documenten, en de discipline om te zeggen dat een cijfer domweg niet in de set staat. Voor financieel werk is de kwaliteit van bronvermelding doorslaggevend, niet algemene intelligentie. Draai de open kandidaat en een gesloten vlaggenschip op dezelfde twintig vragen uit je eigen jaarrekening voordat je kiest. De rollengids beschrijft die test voor de CFO: /nl/ai-cfo.
We testten in 2023 een AI-model en het verzon cijfers. Is dat veranderd?
Deels, en juist dat deel telt. De modellen van 2023 hadden een klein geheugen, geen redeneerstap en zwakke brondiscipline. De huidige generatie houdt veel meer tekst vast, werkt een vraag stap voor stap uit voordat hij antwoordt, en verwijst duidelijk beter naar het document dat hij gebruikte. Leveranciers rapporteren forse dalingen in zelfverzekerde fouten tussen generaties; dat zijn hun eigen cijfers, maar over de richting bestaat geen discussie. Wat niet veranderde: elk model kan nog steeds iets beweren dat niet in je documenten staat. Het oordeel uit 2023 is dus verouderd, de gewoonte uit 2023 om alles te controleren wat het pand verlaat niet. Het rapport hierboven laat zien welke modellen zijn uitgefaseerd.
Wat is een redeneermodel, en heeft een directie dat nodig?
Een redeneermodel werkt een vraag stap voor stap uit voordat het antwoordt, in plaats van het eerste plausibele antwoord te geven. Die extra stap kost seconden en geld, en levert nauwkeurigheid op precies het werk waar een managementteam om geeft: documenten vergelijken, een getal naast zijn bron leggen, opmerken dat twee stukken elkaar tegenspreken. In de huidige vlaggenschepen zit redeneren ingebouwd en is het per vraag hoger of lager te zetten. Voor een snelle samenvatting van één memo houd je het laag. Voor alles wat in een bestuursmap belandt zet je het hoog en neem je de wachttijd erbij. Het rapport hierboven beschrijft hoe die verschuiving verliep.
Zeggen de benchmarkcijfers van leveranciers zelf iets?
Als richting zeggen ze iets, als bewijs vrijwel niets. Een cijfer van een leverancier komt uit een test die de leverancier koos, op vragen die de leverancier schreef, tegenover de vergelijking die de leverancier uitzocht. Dat is marketing met echte meting erin. Onafhankelijke ranglijsten helpen, maar die meten vooral examenvragen, programmeren en onderzoekspuzzels, niet of een model een cijfer verzint in een bestuursmemo of bluft als een kwartaal ontbreekt. Het enige getal dat jouw keuze bepaalt, is het getal dat je op je eigen documenten produceert. Daarom draait de Model Index één vaste test over alle modellen: /nl/onderzoek/model-index.
Betekent de EU AI Act dat we geen Amerikaans model mogen gebruiken?
Nee. De verordening regelt hoe AI wordt gebruikt en welke verplichtingen uit het risico van dat gebruik volgen, niet de nationaliteit van de leverancier. Een algemeen model dat je eigen documenten leest en samenvat, valt aan de lichte kant, met verplichtingen rond transparantie, toezicht en documentatie in plaats van verboden. De eisen worden fors zwaarder zodra AI raakt aan werving, krediet, veiligheid of burgers. De praktische bestuurstaak is opschrijven welk gebruik je toestaat, wie de uitkomst controleert voordat er iets mee gebeurt, en waar de data staat, en de classificatie door een jurist laten bevestigen. De regelgevingstijdlijn hierboven noemt de data.
Is een model van een Chinees of Amerikaans lab een risico voor een Europees bedrijf?
Het risico zit niet in de nationaliteit van het lab, maar in waar je documenten heen gaan en wie toegang kan afdwingen. Bestuursmateriaal naar een omgeving sturen die je niet beheert, is een besluit dat je vastlegt. Bij modellen die als open gewichten zijn gepubliceerd verdwijnt die vraag grotendeels, want je draait de gewichten op eigen hardware of bij een Europese aanbieder en er verlaat niets je omgeving. Bij gesloten modellen beperkt een Europese regio de blootstelling, maar neemt die buitenlandse rechtsmacht niet weg. Bepaal eerst de hostingeis en kies daarna uit wat daaraan voldoet. Onze eigen aanpak van beveiliging staat hier: /nl/beveiliging.
Wat gebeurt er als het model waarop we standaardiseerden wordt uitgefaseerd?
Nieuwe versies verschijnen om de paar weken en oudere worden met enkele maanden aankondiging uitgezet, wat kort is voor een organisatie die er een proces omheen bouwde. Je beschermt je daartegen door het model vervangbaar te houden. Bewaar je documenten, prompts en huisregels in een systeem dat van jou is en niet in het product van één leverancier, en houd een uitgeschreven test bij die je in een middag op een nieuw model opnieuw draait. Dan is een uitfasering een geplande taak in plaats van een project. Het rapport hierboven laat zien welke modellen al zijn uitgefaseerd of gepland staan voor afsluiting, met de opvolger.
Wat is het verschil tussen het model, de assistent en het product dat we kopen?
Het model is de motor: een getraind systeem dat tekst omzet in tekst. De assistent is alles eromheen: je documenten, de rechten, het geheugen, de huisregels, de koppelingen met mail en bestanden. Het product is de verpakking van beide. Dat onderscheid is commercieel en niet academisch, want het model is het deel dat je kunt vervangen en in de assistent stapelt je investering zich op. AI Board is die assistentlaag en blijft modelonafhankelijk, en juist daarom kunnen we motoren meten zonder er zelf een te verdedigen. Bekijk wat er in die laag zit: /nl/ai-bedrijfsbrein.
Waar komen de feiten in dit rapport vandaan en hoe actueel zijn ze?
Elk modelfeit hier komt uit de documentatie of aankondiging van de leverancier zelf, kort voor publicatie gecontroleerd, met de bron naast de bewering. Prijzen, regio's en beschikbaarheid veranderen snel, dus lees ze als juist op de vermelde datum en controleer voordat je tekent. Waar een cijfer een eigen benchmark van een leverancier is, benoemen we dat, in plaats van het als onafhankelijke uitkomst te presenteren. We ontvangen geen betaling van modelleveranciers en gebruiken geen affiliate-links. Correcties zijn welkom en bereiken ons via de contactgegevens op /nl/over-ons.

Bronnen

  1. 01OpenAI model documentationGPT-4 at 8,192 tokens and GPT-6 Astra at 1,050,000 tokens.Geraadpleegd 8 sep 2026
  2. 02Microsoft Azure blog: GPT-6 Astra in Microsoft FoundryDeployment options for GPT-6 Astra: Global and US Data Zone geographies only.Geraadpleegd 8 sep 2026
  3. 03Anthropic model overviewClaude Fable 5.1 context window of 1,000,000 tokens.Geraadpleegd 8 sep 2026
  4. 04Anthropic: Claude on Google CloudGlobal, multi-region (us and eu) and regional endpoints for Claude.Geraadpleegd 8 sep 2026
  5. 05Gemini API: Gemini 3.8 FlashInput window of 1,048,576 tokens.Geraadpleegd 8 sep 2026
  6. 06Google, new features for the Gemini API and Google AI Studio27 June 2024: the two million token window on Gemini 1.5 Pro opened to all developers.Geraadpleegd 8 sep 2026
  7. 07Meta AI, The Llama 4 herdMeta states a ten million token window for Llama 4 Scout, evidenced by a retrieval-style evaluation.Geraadpleegd 8 sep 2026
  8. 08RULER: What's the Real Context Size of Your Long-Context Language Models? (arXiv:2404.06654)Hsieh et al., 2024. Only half of the models claiming 32K or more maintain satisfactory performance at 32K.Geraadpleegd 8 sep 2026
  9. 09OpenAI API pricingList prices per million tokens, including promotional pricing notes.Geraadpleegd 8 sep 2026
  10. 10Microsoft Foundry: models sold directly by AzurePer-model release dates, context windows and knowledge cutoffs.Geraadpleegd 8 sep 2026
  11. 11Anthropic pricingGeraadpleegd 8 sep 2026
  12. 12Anthropic API release notesAnnouncement dates per model.Geraadpleegd 8 sep 2026
  13. 13Anthropic: introducing Claude Fable 5.1 and Claude Mythos 5.1Geraadpleegd 8 sep 2026
  14. 14Anthropic, Claude in Amazon BedrockRegion table, global versus regional endpoints, EU inference profiles.Geraadpleegd 8 sep 2026
  15. 15Anthropic: Claude in Microsoft FoundryGlobal Standard and US Data Zone Standard deployment types only.Geraadpleegd 8 sep 2026
  16. 16Anthropic: data residencyinference_geo supports only 'us' and 'global'; workspace geo only 'us'.Geraadpleegd 8 sep 2026
  17. 17Gemini API model listGeraadpleegd 8 sep 2026
  18. 18Gemini API pricingIntroductory rates through 31 December 2026.Geraadpleegd 8 sep 2026
  19. 19xAI model documentation: grok-4.6500K context window, pricing tiers, serving regions us-east-1 and us-west-2.Geraadpleegd 8 sep 2026
  20. 20xAI model documentationContext windows and tiered input and output pricing.Geraadpleegd 8 sep 2026
  21. 21Meta AI Research: introducing Muse Spark 1.3Released 2 September 2026 in Muse Code and the Meta Model API.Geraadpleegd 8 sep 2026
  22. 22Meta: Muse Spark model page1M token context window, standard and contributor endpoints.Geraadpleegd 8 sep 2026
  23. 23Meta AI for developersGeraadpleegd 8 sep 2026
  24. 24DeepSeek API docs, changelogDated release notes: V4-Flash on 31 July 2026, V4-Pro general availability on 13 August 2026, vision preview on 21 August 2026, legacy endpoint shutdown on 24 July 2026.Geraadpleegd 8 sep 2026
  25. 25DeepSeek API docs, Models and PricingContext length, max output and the peak and off-peak token prices for every current DeepSeek model.Geraadpleegd 8 sep 2026
  26. 26Hugging Face, deepseek-ai/DeepSeek-V4-Pro model card1.6T parameters with 49B activated, one million token context, MIT License, FP8 weights.Geraadpleegd 8 sep 2026
  27. 27Scaleway, Generative APIs supported modelsEuropean serverless inference catalogue: DeepSeek-V4-Flash-0731, Mistral Medium 3.5, GLM-5.2 and Qwen models with their served context windows.Geraadpleegd 8 sep 2026
  28. 28AWS, DeepSeek models on Amazon BedrockBedrock lists DeepSeek-V3.1 and DeepSeek-R1. No V4 model was listed on 8 September 2026.Geraadpleegd 8 sep 2026
  29. 29Mistral AI docs, models overviewCurrent premier and open models with API names and version stamps, plus the deprecation and retirement table.Geraadpleegd 8 sep 2026
  30. 30Mistral AI, API pricingList price per million input and output tokens on La Plateforme.Geraadpleegd 8 sep 2026
  31. 31Mistral AI, In-region inference, open models, and new European infrastructure for sovereign AIAnnouncement of 11 August 2026: Mistral Regional Endpoints generally available with a choice between Europe and the US, a priority tier in preview, and European Compute Units.Geraadpleegd 8 sep 2026
  32. 32Hugging Face, mistralai/Mistral-Medium-3.5-128B model cardDense 128B parameters, 256k context, text and image input, reasoning effort none or high, Modified MIT License.Geraadpleegd 8 sep 2026
  33. 33Mistral AI docs, deployment indexSelf-deployment via vLLM, TensorRT-LLM, TGI and SkyPilot; cloud availability on AWS Bedrock, Azure AI, Google Vertex AI, IBM watsonx.ai, Snowflake Cortex and Outscale.Geraadpleegd 8 sep 2026
  34. 34Qwen Cloud docs, model changelogDated 2026 model entries for the Qwen3.8, Qwen3.7 and Qwen3.6 series.Geraadpleegd 8 sep 2026
  35. 35Alibaba Cloud press room, Alibaba Unveils Qwen3.8-Max3 August 2026 launch, 2.4 trillion parameters with 95 billion activated, up to one million tokens of context, sparse MoE with hybrid attention, multimodal.Geraadpleegd 8 sep 2026
  36. 36Alibaba Cloud, What is Model StudioSix Model Studio regions including Germany (Frankfurt, eu-central-1). Alibaba states that regions differ in endpoints, API keys, supported models, platform features and pricing.Geraadpleegd 8 sep 2026
  37. 37South China Morning Post, Alibaba's Qwen3.8-Max made widely accessible ahead of open-weights releaseSecondary source, cited only for the reported list price of 2.00 USD per million input tokens and 6.00 USD per million output tokens.Geraadpleegd 8 sep 2026
  38. 38Z.ai docs, release notesDated releases: GLM-5 on 12 February 2026, GLM-5.2 on 16 June 2026, GLM-5.3 on 18 August 2026, GLM-5.3-Flash on 26 August 2026.Geraadpleegd 8 sep 2026
  39. 39Z.ai docs, pricingList price per million tokens in USD for every GLM model.Geraadpleegd 8 sep 2026
  40. 40Z.ai docs, GLM-5.3 model guide1M token context, 128K max output, reasoning always enabled with low, high and max effort, text-only input, same base model as GLM-5.2 with post-training improvements.Geraadpleegd 8 sep 2026
  41. 41Hugging Face, moonshotai/Kimi-K3 model cardJuly 2026, 2.8T total with 104B activated, 1,048,576 token context, text, image and video, reasoning always enabled with low, high and max effort, Kimi K3 License.Geraadpleegd 8 sep 2026
  42. 42Kimi platform docs, chat pricing for Kimi K31,048,576 token context, USD 3.00 per million input tokens on cache miss, USD 15.00 per million output tokens.Geraadpleegd 8 sep 2026
  43. 43Cohere docs, modelsCurrent Cohere model ids with context window and maximum output tokens.Geraadpleegd 8 sep 2026
  44. 44Cohere docs, Command A+Released 20 May 2026, sparse mixture of experts, 218B total with 25B active, text and image input, 48 languages, Apache 2.0 weights on Hugging Face, runs on 1 x B200 or 2 x H100 at W4A4.Geraadpleegd 8 sep 2026
  45. 45Cohere, pricingNo per-token list price is published for Command A+ on 8 September 2026; only legacy Command models are priced publicly, with newer models quoted as custom enterprise pricing.Geraadpleegd 8 sep 2026
  46. 46Hugging Face, nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 model cardReleased 4 June 2026, 550B total with 55B active, context up to 1M tokens, OpenMDW-1.1 licence, text in and out, reasoning toggled with enable_thinking.Geraadpleegd 8 sep 2026
  47. 47NVIDIA Technical Blog, Nemotron 3 Ultra powers faster, more efficient reasoning for long-running agentsNVIDIA's own positioning of the model for long-running agents and one-million-token context.Geraadpleegd 8 sep 2026
  48. 48NoLiMa: Long-Context Evaluation Beyond Literal Matching (arXiv:2502.05167)Abstract: 'At 32K, for instance, 11 models drop below 50% of their strong short-length baselines.'Geraadpleegd 8 sep 2026
  49. 49ICML 2025 proceedings entryGeraadpleegd 8 sep 2026
  50. 50Lost in the Middle: How Language Models Use Long Contexts (TACL 2024)Abstract: performance is often highest at the beginning or end of the input context and significantly degrades in the middle.Geraadpleegd 8 sep 2026
  51. 51Chroma, Context Rot: How Increasing Input Tokens Impacts LLM Performance18 models across four labs; performance degrades consistently with input length.Geraadpleegd 8 sep 2026
  52. 52Google, Gemini API long context guideLong context limitations: with multiple needles 'the model does not perform with the same accuracy'.Geraadpleegd 8 sep 2026
  53. 53Vectara, Introducing the next generation of Vectara's Hallucination LeaderboardOver 7,700 articles, up to 32K tokens; 'hallucination rates are generally higher under the new benchmark'.Geraadpleegd 8 sep 2026
  54. 54OpenAI API docs, your dataNo training on API data by default, 30-day abuse-monitoring retention, Zero Data Retention, eu.api.openai.com regional processing.Geraadpleegd 8 sep 2026
  55. 55Anthropic, Redeploying Fable 5Geraadpleegd 8 sep 2026
  56. 56Anthropic, Introducing Claude Sonnet 5Geraadpleegd 8 sep 2026
  57. 57OpenAI model deprecationsOpenAI's own list of announced deprecations and shutdown dates.Geraadpleegd 8 sep 2026
  58. 58Meta AI, Introducing Muse Spark and the Meta Model APIGeraadpleegd 8 sep 2026
  59. 59Anthropic, Introducing Claude Opus 5Geraadpleegd 8 sep 2026
  60. 60Regulation (EU) 2026/1744 (Digital Omnibus on AI), Official JournalGeraadpleegd 8 sep 2026
  61. 61European Commission, regulatory framework for AIGeraadpleegd 8 sep 2026
  62. 62European Commission, transparency obligations under Article 50Geraadpleegd 8 sep 2026
  63. 63Gemini API changelogGoogle's dated release and shutdown log for the Gemini API.Geraadpleegd 8 sep 2026
  64. 64Vertex AI model versions and lifecycleGoogle Cloud's release and retirement dates per model version.Geraadpleegd 8 sep 2026
  65. 65Anthropic, What is new in Claude Fable 5.1Geraadpleegd 8 sep 2026
  66. 66OpenAI, GPT-6 AstraGeraadpleegd 8 sep 2026
  67. 67OpenAI model documentation, GPT-48,192 context window; $30 per million input tokens, $60 per million output tokens.Geraadpleegd 8 sep 2026
  68. 68OpenAI model documentation, GPT-4 Turbo128,000 context window; $10 per million input tokens.Geraadpleegd 8 sep 2026
  69. 69OpenAI model documentation, GPT-4o128,000 context window; $2.50 per million input tokens.Geraadpleegd 8 sep 2026
  70. 70OpenAI model documentation, GPT-4.11,047,576 context window; $2 per million input tokens.Geraadpleegd 8 sep 2026
  71. 71OpenAI model documentation, GPT-5400,000 context window, 272,000 maximum input tokens; $1.25 per million input tokens.Geraadpleegd 8 sep 2026
  72. 72OpenAI model documentation, GPT-5.6 Sol1,050,000 context window; $4 per million input tokens.Geraadpleegd 8 sep 2026
  73. 73Anthropic, Introducing 100K context windows11 May 2023: context window expanded from 9K to 100K tokens.Geraadpleegd 8 sep 2026
  74. 74Anthropic, Introducing Claude 2.121 November 2023: 200K token context window, described as roughly 150,000 words.Geraadpleegd 8 sep 2026
  75. 75OpenAI, GPT-5 System Card (13 August 2025)Section 3.7. Production-representative prompts, browsing enabled: share of responses containing at least one major factual error.Geraadpleegd 8 sep 2026
  76. 76OpenAI, o1 System Card (5 December 2024)PersonQA hallucination rate 0.30 for GPT-4o and 0.20 for o1.Geraadpleegd 8 sep 2026
  77. 77OpenAI, o3 and o4-mini System Card (16 April 2025)Table 4. PersonQA hallucination rate: o1 0.16, o3 0.33, o4-mini 0.48.Geraadpleegd 8 sep 2026
  78. 78Anthropic, Claude Opus 4.5 System Card (November 2025)Section 4.1: we are still far from removing factual hallucinations in the absence of external tools.Geraadpleegd 8 sep 2026
  79. 79Anthropic, Claude Opus 5 System Card (24 July 2026)Section 6.5.1: accuracy 11 percent higher than Opus 4.8, hallucination rate 6 percent higher.Geraadpleegd 8 sep 2026
  80. 80Google DeepMind, FACTS benchmark suite9 December 2025. Error rate cut 55 percent on FACTS Search and 35 percent on FACTS Parametric from Gemini 2.5 Pro to Gemini 3 Pro; every model tested scored below 70 percent overall.Geraadpleegd 8 sep 2026
  81. 81Vectara hallucination leaderboard (HHEM-2.3)Updated 11 May 2026. Share of summaries that introduce facts not in the source document.Geraadpleegd 8 sep 2026
  82. 82Inverse Scaling in Test-Time ComputeGema et al., Transactions on Machine Learning Research, December 2025. Longer reasoning can lower accuracy.Geraadpleegd 8 sep 2026
  83. 83Microsoft, announcing Azure OpenAI Data Zones6 November 2024. EU Data Zone processes data within any EU member nation.Geraadpleegd 8 sep 2026
  84. 84AWS, Amazon Bedrock is now available in the Europe (Frankfurt) region19 October 2023. Names participating vendors but no Claude version.Geraadpleegd 8 sep 2026
  85. 85AWS, Claude 3.5 Sonnet and Haiku available in more regions7 August 2024. Claude 3.5 Sonnet in Europe (Frankfurt).Geraadpleegd 8 sep 2026
  86. 86AWS, Claude 3.7 Sonnet now available in EuropeApril 2025. Cross-region inference across Ireland, Paris, Frankfurt and Stockholm.Geraadpleegd 8 sep 2026
  87. 87Mistral AI, Au Large26 February 2024. Mistral Large safely hosted on Mistral infrastructure in Europe.Geraadpleegd 8 sep 2026
  88. 88Regulation (EU) 2024/1689, the AI ActPublished in the Official Journal 12 July 2024, in force 1 August 2024. Article 113 sets the staged application dates.Geraadpleegd 8 sep 2026
  89. 89Regulation (EU) 2026/1744, the Digital Omnibus on AIIn force 27 July 2026. Defers the high-risk obligations to 2 December 2027 for Annex III systems and 2 August 2028 for Annex I systems.Geraadpleegd 8 sep 2026
  90. 90European Commission, the Commission starts enforcing AI Act rules31 July 2026. From 2 August 2026 the AI Office and national authorities begin enforcement.Geraadpleegd 8 sep 2026
  91. 91OpenAI pricing page, archived 1 April 2023GPT-4 8K at $0.03 per 1K prompt tokens and $0.06 per 1K completion tokens, that is $30 and $60 per million.Geraadpleegd 8 sep 2026
  92. 92OpenAI pricing page, archived 21 November 2023GPT-4 Turbo at $0.01 per 1K input tokens, that is $10 per million.Geraadpleegd 8 sep 2026
  93. 93OpenAI API pricing page, archived 2 October 2024GPT-4o at $2.50 per million input tokens after the August 2024 update; GPT-4o mini at $0.15.Geraadpleegd 8 sep 2026
  94. 94Anthropic pricing page, archived 20 June 2024Claude 2 and 2.1 at $8 per million input tokens; Claude 3 Opus at $15; Claude 3.5 Sonnet at $3.Geraadpleegd 8 sep 2026
  95. 95Google Gemini API pricing page, archived 3 June 2024Gemini 1.5 Pro at $3.50 per million input tokens for prompts up to 128K tokens.Geraadpleegd 8 sep 2026
  96. 96Google Gemini API pricing page, archived 16 February 2025Gemini 1.5 Pro repriced to $1.25 per million input tokens; Gemini 2.0 Flash at $0.10.Geraadpleegd 8 sep 2026
  97. 97Epoch AI, LLM inference price trendsThe price of GPT-4 level performance on PhD level science questions fell about 40 times per year; across six benchmarks the range is 9 to 900 times per year.Geraadpleegd 8 sep 2026
  98. 98Stanford HAI, 2025 AI Index ReportInference cost for a system performing at the level of GPT-3.5 fell more than 280 times between November 2022 and October 2024.Geraadpleegd 8 sep 2026
  99. 99Anthropic, Reasoning models don't always say what they thinkAverage across hint types: Claude 3.7 Sonnet 25%, DeepSeek R1 39%.Geraadpleegd 8 sep 2026
  100. 100Shojaee et al., The Illusion of Thinking (arXiv:2506.06941)Three regimes: standard models better at low complexity, reasoning models better at medium, both collapse at high complexity.Geraadpleegd 8 sep 2026
  101. 101Laban, Hayashi, Zhou & Neville, LLMs Get Lost In Multi-Turn Conversation (arXiv:2505.06120)Laban, Hayashi, Zhou and Neville, 2025. Average 39 percent drop across six task types, 200,000 simulated conversations, 15 models.Geraadpleegd 8 sep 2026
  102. 102Thinking Machines Lab, Defeating Nondeterminism in LLM Inference10 September 2025. 1,000 identical requests at temperature 0 produced 80 different completions.Geraadpleegd 8 sep 2026
  103. 103OpenAI API reference, seed parameterBest effort sampling only. Determinism is not guaranteed.Geraadpleegd 8 sep 2026
  104. 104Anthropic model deprecationsRetirement dates per Claude model and the 60 day notice commitment.Geraadpleegd 8 sep 2026
  105. 105Google, Gemini API model deprecations and changelogGemini 1.0 Pro removed 18 February 2025; Gemini 1.5 shut down 29 September 2025; Gemini 2.0 Flash shut down 1 June 2026.Geraadpleegd 8 sep 2026
  106. 106DeepSeek, model documentationOfficial model documentation for the lab.Geraadpleegd 8 sep 2026
  107. 107Mistral AI, model documentationOfficial model documentation for the lab.Geraadpleegd 8 sep 2026
  108. 108Google DeepMind model card: Gemini 3.1 ProRelease date 19 February 2026, 1M input tokens, 64K output tokens.Geraadpleegd 8 sep 2026
  109. 109Muse Glimmer 30B model card (Hugging Face)Released August 2026, Apache 2.0, 131,072+ token context, text and image input.Geraadpleegd 8 sep 2026
  110. 110Meta: Muse Glimmer model page30B parameters, Apache 2.0, built for local agents.Geraadpleegd 8 sep 2026
  111. 111Hugging Face, deepseek-ai/DeepSeek-V4-Flash model card284B parameters with 13B activated, one million token context, MIT License, three reasoning effort modes.Geraadpleegd 8 sep 2026
  112. 112Hugging Face, mistralai/Mistral-Large-3-675B-Instruct-2512 model card675B total with 41B active, 2.5B vision encoder, 256,000 token context, Apache 2.0.Geraadpleegd 8 sep 2026
  113. 113Hugging Face, Qwen/Qwen3.8-2.4T-A95B model card262,144 tokens natively, extensible to 1,010,000; text only; thinking cannot be disabled; final response up to 131,072 tokens; licence qwen3.8-max.Geraadpleegd 8 sep 2026
  114. 114Hugging Face, Qwen3.8-2.4T-A95B LICENSE fileCommercial use permitted; naming obligation above 100 million monthly active users or USD 20 million monthly revenue; separate licence required for model-as-a-service businesses above USD 50 million of revenue over twelve consecutive months.Geraadpleegd 8 sep 2026
  115. 115Hugging Face, Qwen/Qwen3.8-27B model card27B dense, native vision-language, 262,144 token context extensible to about 1,000,000, 131,072 recommended output, Apache 2.0, thinking on by default with effort levels.Geraadpleegd 8 sep 2026
  116. 116OVHcloud, AI Endpoints model catalogueQwen3.8-27B listed in the catalogue alongside other open-weight models.Geraadpleegd 8 sep 2026
  117. 117IONOS Cloud docs, AI Model Hub modelsQwen 3.8-27B listed with a 262k context window; IONOS documents the hosting country per model on each model page.Geraadpleegd 8 sep 2026
  118. 118Mistral, Medium 3.5 model cardGeraadpleegd 8 sep 2026
  119. 119Mistral platform changelogGeraadpleegd 8 sep 2026
  120. 120xAI, Grok 4.6Geraadpleegd 8 sep 2026
  121. 121OpenAI, Introducing ChatGPTGeraadpleegd 8 sep 2026
  122. 122OpenAI, GPT-4Geraadpleegd 8 sep 2026
  123. 123Anthropic, Claude 2Geraadpleegd 8 sep 2026
  124. 124OpenAI DevDay 2023 announcementsGeraadpleegd 8 sep 2026
  125. 125Regulation (EU) 2024/1689 (AI Act), Official JournalGeraadpleegd 8 sep 2026
  126. 126OpenAI, Introducing OpenAI o1-previewGeraadpleegd 8 sep 2026
  127. 127OpenAI, Introducing GPT-5Geraadpleegd 8 sep 2026
  128. 128Anthropic, Introducing Claude Fable 5 and Claude Mythos 5Geraadpleegd 8 sep 2026
  129. 129AWS press release, AWS European Sovereign Cloud launchLaunch of the first region in Brandenburg, EU parent company and subsidiaries, more than 90 services.Geraadpleegd 8 sep 2026
  130. 130AWS European Sovereign Cloud User Guide, Amazon BedrockGeraadpleegd 8 sep 2026
  131. 131AWS European Sovereign Cloud, model support by Regioneusc-de-east-1 lists Amazon Nova Pro, in-region inference only.Geraadpleegd 8 sep 2026
  132. 132Anthropic Privacy Center, model training on commercial productsGeraadpleegd 8 sep 2026
  133. 133Anthropic Privacy Center, model training on consumer productsGeraadpleegd 8 sep 2026
  134. 134Microsoft Learn, Claude models in Microsoft FoundryPage dated 2026-09-01. Data Zone Standard (US) only; no EU data zone listed for Claude.Geraadpleegd 8 sep 2026
  135. 135Microsoft Learn, deployment types in Microsoft Foundry ModelsPage dated 2026-08-06. Definition of Global, Data Zone and Standard processing.Geraadpleegd 8 sep 2026
  136. 136Microsoft Learn, region availability for Foundry Models sold by AzurePage dated 2026-09-03. Data Zone Standard, Europe tab: gpt-5.6 tiers listed, gpt-6-astra not listed.Geraadpleegd 8 sep 2026
  137. 137Microsoft, EU Data Boundary completionGeraadpleegd 8 sep 2026
  138. 138Microsoft Learn, learn about the EU Data BoundaryGeraadpleegd 8 sep 2026
  139. 139Google Cloud docs, data residency for Gemini EnterpriseEU multi-region: at-rest DRZ and MLP supported for Gemini 3.5 Flash and Gemini 2.5 Pro; Gemini 3.8 Flash and the Claude Fable 5 line (Claude Fable 5.1 as of September 2026) on the eu multi-region endpoint only (no EU regional endpoint); Gemini 3.1 Pro preview no EU DRZ or MLP. Re-read 8 Sep 2026.Geraadpleegd 8 sep 2026
  140. 140Google Cloud blog, Europe's path to open digital sovereigntyPublished 2026-06-18. Three sovereign tiers and named European partners.Geraadpleegd 8 sep 2026
  141. 141IONOS AI Model Hub docs, data handlingInference in German data centres only; prompts never logged; not used for training.Geraadpleegd 8 sep 2026
  142. 142Mistral AI, Le Chat Enterprise announcementPublished 2025-05-07. Self-hosted, private cloud or Mistral cloud deployment.Geraadpleegd 8 sep 2026
  143. 143Hugging Face, deepseek-ai/DeepSeek-V4-Pro-0813 model card1.6T parameters; repository and weights under the MIT License.Geraadpleegd 8 sep 2026
  144. 144Hugging Face, mistralai organisation pageGeraadpleegd 8 sep 2026
  145. 145Hugging Face, deepseek-ai organisation pageGeraadpleegd 8 sep 2026
  146. 146EU AI Act Explorer, implementation timelineGeraadpleegd 8 sep 2026
  147. 147EU AI Act Explorer, Article 4 AI literacyGeraadpleegd 8 sep 2026
  148. 148EU AI Act Explorer, Digital Omnibus on AIRegulation (EU) 2026/1744, in force 27 July 2026.Geraadpleegd 8 sep 2026
  149. 149Cheng et al., ELEPHANT: Measuring and understanding social sycophancy in LLMs (arXiv:2505.13995)11 models; face preservation 45 percentage points above humans; models affirm whichever side the user adopts in 48% of cases.Geraadpleegd 8 sep 2026
  150. 150Magesh et al., Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools, Journal of Empirical Legal Studies 22(2), 2025Abstract: Lexis+ AI and the Thomson Reuters tools 'each hallucinate between 17% and 33% of the time'; providers' claims 'are overstated'.Geraadpleegd 8 sep 2026
  151. 151Hugging Face, zai-org/GLM-5.2 model card753B parameters, one million token context, MIT licence, multiple thinking effort levels.Geraadpleegd 8 sep 2026
  152. 152xAI model documentationGrok prices per million tokens, split below and above a 200K-token prompt.Geraadpleegd 8 sep 2026
  153. 153Alibaba Cloud Model Studio billingUSD prices per million tokens on the international (Singapore) endpoint.Geraadpleegd 8 sep 2026
  154. 154Microsoft Learn, Data, privacy and security for Microsoft CopilotPrompts, responses and Microsoft Graph data are not used to train foundation models. EU traffic stays inside the EU Data Boundary, except for Anthropic models. Prompts and responses are stored as Copilot activity history and are governed by Microsoft Purview retention policies.Geraadpleegd 8 sep 2026
  155. 155Microsoft Learn, Anthropic models in Microsoft Online ServicesPage dated 2 September 2026. Anthropic is a Microsoft subprocessor; Anthropic models are excluded from the EU Data Boundary and are off by default in the EU, EFTA and the UK. Names Fable 5.0 and Fable 5.1 as Fable-class models.Geraadpleegd 8 sep 2026
  156. 156Microsoft Learn, OpenAI as a subprocessor in Microsoft Online ServicesPage dated 5 August 2026. OpenAI added to the subprocessor list on 23 June 2026, usable from 9 July 2026, enabled for all users of eligible commercial customers from 24 July 2026. OpenAI-operated models are inside the EU Data Boundary.Geraadpleegd 8 sep 2026
  157. 157Microsoft Learn, Understanding AI functionality and models in Microsoft Online ServicesDistinguishes models hosted and operated by Microsoft, AI subprocessors, and AI independent processors. For Microsoft-hosted models, data does not leave Microsoft.Geraadpleegd 8 sep 2026
  158. 158Microsoft 365 blog, Expanding model choice in Microsoft 365 Copilot24 September 2025. First announcement of Anthropic models in the Researcher agent and in Copilot Studio. Superseded on the hosting question by the September 2026 subprocessor documentation.Geraadpleegd 8 sep 2026
  159. 159Microsoft Learn, Microsoft Foundry Models overviewPage dated 28 July 2026. Catalogue of over 10,000 models from Microsoft, Azure OpenAI, Anthropic, DeepSeek, Meta, Mistral, Cohere and Hugging Face, split into models sold by Azure and models from partners and community.Geraadpleegd 8 sep 2026
  160. 160Microsoft 365 Copilot pricingCopilot Business: USD 18 per user per month with an annual commitment (promotional to 31 December 2026), list USD 21, USD 25.20 month to month, on top of a qualifying Microsoft 365 plan, up to 300 users. Verified in pricing.ts; the enterprise add-on price was not readable.Geraadpleegd 8 sep 2026
  161. 161Google Workspace, Google Workspace with GeminiWorkspace plans include the Gemini app, Gemini Notebook and Gemini in Gmail, Docs and Meet. Submissions are not used to train models and are not reviewed by humans.Geraadpleegd 8 sep 2026
  162. 162Google Workspace, Generative AI in Google Workspace Privacy HubLast updated 14 August 2026. Workspace does not use customer data to train models without the customer's prior permission or instruction; content is not human reviewed outside the domain. Gemini in Workspace prompt retention is admin controlled; Gemini Notebook content is not retained after the session ends.Geraadpleegd 8 sep 2026
  163. 163Google, Gemini Apps release updates and improvementsGemini 3.6 Flash released to the Gemini app on 21 July 2026; the app's picker offers Flash tiers for everyday work and Pro for harder reasoning.Geraadpleegd 8 sep 2026
  164. 164Google Workspace pricingEuro list prices read on 8 September 2026: Business Starter EUR 6.80, Standard EUR 13.60, Plus EUR 21.10 per user per month, Enterprise on request. Promotional prices were shown alongside. An AI Expanded Access add-on is offered without a price on the page.Geraadpleegd 8 sep 2026
  165. 165Google Cloud, Use Anthropic Claude models on Vertex AIVertex AI lists Anthropic partner models including Claude Fable 5.1, Claude Opus 5 and Claude Sonnet 5. Vertex AI is a Google Cloud developer platform, not the Workspace assistant.Geraadpleegd 8 sep 2026

Het landschap hierboven ziet er over een kwartaal anders uit, en dat is precies het punt: de organisaties die voorop komen te liggen zijn niet degenen die in september 2026 het slimste model kozen, maar degenen die een vaste manier bouwden om modellen te lezen, te testen en te vervangen. Lees het rapport, draai je eigen twintig vragen op je eigen documenten, en houd de assistentlaag rond het model in eigen hand.

AI Board Studio is modelonafhankelijk. We hebben geen eigen model, ontvangen geen betaling van modelleveranciers en gebruiken geen affiliate-links.

Word AI-native vóór je concurrentie

Surf mee op de AI-golf in plaats van erachteraan te zwemmen. Vraag toegang aan, dan plannen we je installatie in.

Je bedrijfsbrein staat op je eigen laptop. Jij kiest of een vraag naar een cloudmodel gaat of volledig lokaal blijft.