Het prijsverschil is groot: Artificial Analysis berekent een blended prijs van ongeveer $0,58 per 1 miljoen tokens voor Gemini 3.8 Flash tegenover $7,70 voor GPT-6 Astra. Op deze maatstaf is Gemini dus ruim dertien keer goedkoper.
Die blended prijs combineert verschillende soorten tokens. De onderliggende cijfers maken het verschil nog duidelijker. Astra kost in deze vergelijking $10 per miljoen inputtokens en $50 per miljoen outputtokens. Bij Gemini is dat respectievelijk $0,75 en $3,75. Een cache hit kost $1 per miljoen tokens bij Astra tegenover $0,075 bij Gemini. Artificial Analysis gebruikt voor de blended prijs een verhouding van 7:2:1 voor cache hit, input en output.
Toch is “Gemini is dertien keer goedkoper” niet het hele verhaal. Artificial Analysis meet namelijk ook wat een complete Intelligence Index-taak uiteindelijk kost. Daar komt Gemini uit op $1,24 per taak tegenover $1,73 voor Astra. Het verschil is dan nog maar $0,49, oftewel ongeveer 28% gerekend vanaf de kosten van Astra.
De oorzaak zie je in het tokenverbruik. Astra gebruikt gemiddeld ongeveer 12.000 outputtokens per taak, waarvan circa 5.000 reasoningtokens. Gemini gebruikt ongeveer 71.000 outputtokens, waarvan 43.000 reasoningtokens. Gemini is per token veel goedkoper, maar gebruikt in deze test ook veel meer tokens om de klus af te ronden.
Voor bedrijven die modellen via de API op grote schaal inzetten is dit een belangrijk onderscheid. Kijk niet alleen naar de prijs per miljoen tokens, maar ook naar de kosten per succesvol uitgevoerde taak. Voor gewone gebruikers binnen ChatGPT of Gemini zeggen deze API-cijfers bovendien niets rechtstreeks over de prijs van je abonnement.
Stand van de cijfers: 22 september 2026. AI-modelprijzen veranderen regelmatig; Artificial Analysis is hier de gebruikte bron voor prijs en benchmarkmetingen.