OpenAI y Anthropic haben de gebruikskosten van hun modellen centraal gesteld in hun nieuwste aankondigingen. OpenAI presenteert GPT-6 Sol en GPT-6 Luna met API-tarieven die tot 50% lager zijn dan de promotietarieven van GPT-5.6, terwijl Anthropic Claude Opus 5.5 heeft gelanceerd, dat volgens het bedrijf ongeveer 40% goedkoper is om uit te voeren dan Opus 5 bij gangbare workloads. Deze aankondigingen volgen op een publiek debat over of de ontwikkeling van geavanceerde modellen zou moeten vertragen.
De kernpunten van OpenAI en Anthropic in 20 seconden
- GPT-6 Sol verlaagt de prijs van 4 naar 2 dollar per miljoen tokens voor invoer en van 20 naar 10 dollar voor uitvoer.
- GPT-6 Luna daalt van 0,20 naar 0,10 dollar voor invoer en van 1,20 naar 0,50 dollar voor uitvoer.
- Claude Opus 5.5 vermindert de tarieven van 5 naar 4 dollar voor invoer en van 25 naar 20 dollar voor uitvoer.
- Anthropic wijt een deel van de kostenbesparing van Opus 5.5 aan verbeterde efficiëntie in het gebruik van tokens.
- De nieuwe modellen komen op terwijl laboratoria concurreren met goedkopere alternatieven en open source modellen met grotere rekenkracht.
Deze verandering markeert een andere fase in de race om kunstmatige intelligentie. De afgelopen jaren lag de focus vooral op het vergroten van de capaciteiten van de modellen. Nu wordt de kostenstructuur voor het draaien van deze capaciteiten een nieuw strijdtoneel, vooral voor bedrijven die AI willen inzetten voor duizenden of zelfs miljoenen verzoeken.
Prijsvergelijking: vroeger en nu
De API-tarieven geven een duidelijk beeld van de bewegingen van beide bedrijven. In de onderstaande tabel worden de standaardprijzen per miljoen tokens weergegeven voor de vergeleken modellen, gebaseerd op de promotietarieven van GPT-5.6 die OpenAI voor de lancering van GPT-6 gebruikte.
| Model | Voorheen invoer | Heden invoer | Voorheen uitvoer | Heden uitvoer | Verandering |
|---|---|---|---|---|---|
| OpenAI GPT-5.6 Sol → GPT-6 Sol | 4 $ | 2 $ | 20 $ | 10 $ | -50 % |
| OpenAI GPT-5.6 Luna → GPT-6 Luna | 0,20 $ | 0,10 $ | 1,20 $ | 0,50 $ | -50 % invoer / -58,3 % uitvoer |
| Anthropic Claude Opus 5 → Opus 5.5 | 5 $ | 4 $ | 25 $ | 20 $ | -20 % |
Prijzen per miljoen tokens. Bij OpenAI waren de tarieven voor GPT-5.6 Sol en Luna promotieprijzen; de nieuwe tarieven voor GPT-6 Sol en Luna worden nu gehonoreerd bij de lancering. Anthropic zegt dat de effectieve kosten van Opus 5.5 ongeveer 40% lager zijn dan die van Opus 5 bij standaard workloads, mede dankzij een vermindering in het benodigde aantal tokens.
Het verschil tussen prijs per token en kosten per taak is significant. Een model kan per miljoen tokens een lagere prijs hebben, maar toch meer tokens of calls vereisen om een taak te voltooien. De echte besparing voor een bedrijf hangt dus af van hoe het model wordt gebruikt.
Anthropic legt hier de nadruk op. Opus 5.5 verlaagt niet alleen de nominale tarieven: het bedrijf beweert dat het model efficiënter omgaat met tokens. De prijs gaat van 5 naar 4 dollar per miljoen tokens voor invoer en van 25 naar 20 dollar voor uitvoer, terwijl de cacheleestarieven dalen van 0,50 naar 0,20 dollar per miljoen, een reductie van 60%.
OpenAI past een meer directe korting toe op hun twee nieuwe modellen. GPT-6 Sol kost de helft van GPT-5.6 Sol volgens de referentietariefpromotie, terwijl GPT-6 Luna de invoerprijs halveert en de uitvoerprijs met meer dan de helft verlaagt. OpenAI bevestigde dat de twee modellen met API-tarieven nu 50% goedkoper zijn dan de promotietarieven van GPT-5.6.
GPT-6 Sol en Luna richten zich op twee soorten werk
OpenAI positioneert GPT-6 Sol en GPT-6 Luna onder GPT-6 Astra, hun krachtigste model uit de nieuwe familie.
Sol is gericht op veeleisendere taken zoals programmeren, redeneren en workflow met agents. Luna is ontworpen voor grote volumes taken waarbij kosten per verzoek cruciaal zijn, zoals informatie-extractie, classificatie of samenvatting van documenten.
Deze strategie maakt het mogelijk om de kosten van de benodigde capaciteit te scheiden. Een bedrijf kan een duurder model reserveren voor complexe taken en Luna inzetten voor miljoenen eenvoudige operaties.
Deze aanpak wordt nog relevanter bij de uitbreiding van AI-agents. Een agent die één enkele vraag uitvoert, kan een lage kost hebben. Maar als het documenten analyseert, tools raadpleegt, code schrijft, resultaten controleert en urenlang herhaalt, kunnen de tokens snel oplopen.
De daling in kosten per token beïnvloedt de economie van zulke systemen.
OpenAI heeft ook gewerkt aan cache-efficiëntie en inferentie. GPT-6 Sol kost 0,20 dollar per miljoen tokens in cache, Luna daalt naar 0,01 dollar. Hergebruik van context kan hiermee nog meer kosten besparen bij veel operaties op dezelfde data.
Anthropic reageert met een efficiëntere Opus
Claude Opus 5.5 volgt een iets andere strategie. Anthropic presenteert het als het eerste model uit de nieuwe Claude 5.5 familie en beweert dat het bij de meeste taken hetzelfde kan als Claude Fable 5.1, maar circa 40% goedkoper is dan Opus 5, mede door verbeterde token-efficiëntie.
Het model is beschikbaar voor gebruikers via Claude Pro, Max, Team en Enterprise, naast API en cloudplatforms zoals Amazon Web Services, Google Cloud en Microsoft Foundry. Anthropic stelt dat de prijs 4 dollar per miljoen tokens in invoer en 20 dollar per miljoen tokens in uitvoer bedraagt.
De besparing is vooral merkbaar bij langdurige agent-taken. Anthropic wijst er op dat cachelezen een grote kostenpost vormen, en heeft die tariefdaling doorgevoerd van 0,50 naar 0,20 dollar per miljoen tokens.
Er is ook een snellere modus voor Opus 5.5, die tot wel 2,5 keer sneller is, met tarieven van 8 dollar per miljoen tokens voor invoer en 40 dollar voor uitvoer.
Anthropic bevestigt dat Opus 5.5 extern geëvalueerd werd door instanties als Frontier Design en METR vóór de lancering. Deze beoordelingen maken deel uit van de gedeelde informatie, maar vormen geen volledig onafhankelijke vergelijking met andere modellen.
De prijsdaling tempert niet de opkomst van open source modellen
De tariefverlaging vindt plaats in een markt waar niet alleen OpenAI, Anthropic en Google concurreren. Bedrijven zoals Alibaba, Moonshot AI en DeepSeek drijven de prijzen nog verder omlaag via lagere-kostenmodellen en open source varianten met vrij beschikbare weights voor ontwikkelaars.
Voor providers met eigen modellen kan het verlagen van tarieven voorkomen dat bedrijven workloads verhuizen naar goedkopere alternatieven. Tegelijkertijd kan een lagere prijs per token het gebruik stimuleren, doordat wat eerst te duur was nu rendabel wordt.
Dit betekent dat kosten per taak belangrijker worden dan puur prijs per miljoen tokens. Een model dat voor de helft kost maar dubbel zoveel stappen vergt, biedt mogelijk geen echte besparing. Andersom kan een goedkoper model dat een taak met minder tokens afrondt, de kosten voor een applicatie significant verlagen.
Daarom winnen efficiëntie in inferentie en redeneervermogen steeds meer aan belang bij de nieuwe modellen.
Aankondigingen na het debat over het vertragen van AI-ontwikkeling
De timing voegt een extra dimensie toe. Het zijn de eerste grote lanceringen van OpenAI en Anthropic sinds het publieke debat over risico’s van versnelde ontwikkeling van geavanceerde systemen.
Dario Amodei, CEO van Anthropic, riep op tot voorzichtigheid bij het pushen van grensverleggende modellen. Het debat kwam op gang nadat voormalig onderzoeker Jacob Coxon officieel zijn vertrek aankondigde en kritiek uitte op het tempo van de ontwikkeling bij grote labs.
Sam Altman (OpenAI) en Elon Musk waren ook betrokken bij de publieke discussie over de veiligheid en commerciële ontwikkelingen, gebaseerd op informatie van CNBC die als fundament diende voor dit artikel.
Toch laten deze nieuwe lanceringen zien dat veiligheid en commerciële belangen hand in hand gaan. Anthropic brengt nieuwe Opus-modellen uit die niet alleen goedkoper zijn, maar ook voorzien van de veiligheidsvoorzieningen die voor hun meest geavanceerde modellen ontwikkeld zijn.
Ook OpenAI zet door met GPT-6: Sol en Luna breiden de familie uit naar modellen die vaker en in meer taken inzetbaar zijn.
De concurrentiestrijd verschuift van enkel de capaciteit naar welk bedrijf de beste prijs-kwaliteitsbalans kan bieden, en wie de capaciteit op grote schaal kan integreren in producten en bedrijfsprocessen.
Voor ontwikkelaars wordt het belangrijker niet alleen naar de scores op benchmarks te kijken, maar ook naar kosten per taak, tokens gebruik, snelheid, redeneervermogen en hergebruik van context. Deze factoren krijgen evenveel gewicht als de kwaliteit van de antwoorden.
OpenAI mikt op drastisch lagere prijzen met GPT-6 Sol en Luna. Anthropic reageert met een Voortbouw—model dat niet alleen goedkoper schijnt te zijn, maar ook efficiënter door een lager tokengebruik. Ondertussen blijven open source en Aziatische aanbieders de druk op de industrie opvoeren, waarbij efficiëntie een kernkenmerk wordt van de nieuwe generatie modellen.
Veelgestelde vragen
Hoe verhoudt GPT-6 Sol zich tot GPT-5.6 Sol qua kosten?
GPT-6 Sol kost 2 dollar per miljoen tokens voor invoer en 10 dollar voor uitvoer. GPT-5.6 Sol had een promotietarief van 4 dollar voor invoer en 20 dollar voor uitvoer. De prijsverbetering bedraagt dus 50%.
Hoeveel daalt de prijs van GPT-6 Luna?
GPT-6 Luna kost 0,10 dollar per miljoen tokens voor invoer en 0,50 dollar voor uitvoer. De tarieven voor GPT-5.6 Luna waren respectievelijk 0,20 en 1,20 dollar, volgens de officiële prijzen.
Wat kost Claude Opus 5.5?
Claude Opus 5.5 kost 4 dollar per miljoen tokens in invoer en 20 dollar voor uitvoer. Anthropic claimt dat de typische uitvoering kost circa 40% minder is dan die van Opus 5, mede door verbeterde token-efficiëntie.
Wat is het verschil tussen GPT-6 Sol en GPT-6 Luna?
OpenAI richt Sol op complexere taken zoals programmeren en agent-gestuurde workflows, terwijl Luna is ontworpen voor grote volumes met lagere kosten, zoals informatie-extractie en document-samenvattingen.
