Gratis calculator voor AI-tokenkosten
Bekijk hoeveel tokens (en dollars) je verspilt door de context in elk bericht opnieuw uit te leggen in ChatGPT of Claude - alleen of als team - en hoeveel een geladen skillbestand zou besparen.
Je maandelijkse tokenverspilling verschijnt hier.
Vul je gebruik in en klik vervolgens op Berekenen.
Wat is een calculator voor AI-tokenkosten?
Een calculator voor AI-tokenkosten schat hoeveel tokens - en hoeveel geld - je uitgeeft aan ChatGPT, Claude of elke AI-chat, op basis van hoe je die daadwerkelijk gebruikt. Deze gratis calculator voor AI-tokenkosten richt zich op één specifieke en zeer veelvoorkomende bron van verspilling: elke keer dat je hetzelfde rol-, format- of merkstem-instructies opnieuw in de chat plakt, in plaats van ze één keer te laden.
Voer in hoeveel gesprekken je per dag start, hoeveel vervolgberichten elk gesprek heeft en ongeveer hoe lang de context is die je herhaalt. De calculator schat je maandelijks verspilde tokens, wat dat kost tegen gangbare betaalde API-prijzen en hoeveel van die verspilling verdwijnt zodra diezelfde context in een persistent skillbestand of projectinstructies staat in plaats van op je klembord. Schakel over naar de teammodus om dezelfde berekening op te schalen naar het AI-gebruik van een heel team - vaak het grotere getal.
Verspilling meten is de eerste stap. Noor, de Prompt Engineer Skill op KissMySkills, verandert Claude, ChatGPT of elke AI-chat in een senior prompt engineer die herbruikbare, productieklare prompts en skillbestanden ontwerpt die deze verspilling voorgoed stoppen - zonder dat je achtergrond in prompt engineering nodig hebt.
Waarom een token geen woord is
Elke provider publiceert ongeveer dezelfde schatting voor het Engels: één token is ongeveer vier tekens, of ongeveer driekwart van een woord. Google formuleert het als 100 tokens die ongeveer overeenkomen met 60 tot 80 Engelse woorden. Anthropic geeft een iets nauwkeuriger cijfer van ongeveer 3,5 tekens per token en voegt de relevante kanttekening toe - het exacte aantal varieert per taal en per type inhoud.
Die kanttekening is groter dan ze lijkt. Tokentellingen zijn zelfs niet stabiel bij modellen van dezelfde leverancier: Anthropic merkt op dat de nieuwere tokenizer ongeveer 30% meer tokens oplevert voor dezelfde tekst dan de vorige. Identieke input, dezelfde provider, een materieel andere rekening.
Beschouw elke tokenschatting - ook deze - dus als een ordegroottebenadering. Als je het werkelijke aantal nodig hebt, tel het dan in plaats van het te schatten: elke grote provider levert een tokenizer of een gebruiksveld in het API-antwoord dat precies meldt waarvoor je hebt betaald.
Output kost meerdere keren meer dan input
Het belangrijkste om te weten over tokenprijzen is dat de twee richtingen niet hetzelfde geprijsd zijn. Input is wat je verstuurt; output is wat het model genereert; output is consequent de dure variant.
Gecontroleerd in augustus 2026: de door Anthropic gepubliceerde tarieven per miljoen tokens hanteren in het hele aanbod een nette verhouding van 5× - Opus 5 kost $5 voor input tegenover $25 voor output, Haiku 4.5 $1 tegenover $5. Het huidige vlaggenschip van OpenAI zit op $5 tegenover $30, een verhouding van 6×, met $0.20 tegenover $1.20 voor de goedkoopste laag. Het Gemini-aanbod van Google loopt uiteen van ongeveer 4× tot 8×.
De exacte bedragen zullen tegen de tijd dat je dit leest veranderd zijn - kijk op de prijspagina van de provider. De verhouding is het blijvende gegeven: bij alle drie de aanbieders ligt het outputtarief ongeveer vier tot acht keer hoger dan het inputtarief. Dat heeft een praktisch gevolg. Door een opgeblazen systeemprompt in te korten bespaar je inputtokens, en die zijn goedkoop. Door om een korter antwoord te vragen bespaar je outputtokens, en die zijn dat niet. Als er echt een kostenprobleem is, kijk dan eerst naar hoeveel het model schrijft en daarna pas naar hoeveel je verstuurt.
Waarom beurt tien meer kost dan beurt één
Chat-API's zijn stateless. OpenAI zegt het duidelijk: elk verzoek om tekstgeneratie staat op zichzelf, en je bouwt een meerturnsgesprek op door de vorige berichten opnieuw als parameters mee te sturen. Anthropic beschrijft dezelfde factureringsstructuur - de invoer voor elke beurt bevat de volledige eerdere gespreksgeschiedenis plus het huidige bericht, en alles in het verzoek telt mee, inclusief de systeemprompt en je tooldefinities.
Een gesprek kost dus niet de som van zijn berichten. Beurt tien brengt beurten één tot en met negen opnieuw in rekening als nieuwe invoer. Als elke beurt ongeveer een constante hoeveelheid tekst toevoegt, groeit de cumulatief in rekening gebrachte invoer binnen een gesprek met het kwadraat van het aantal beurten, niet lineair. Die berekening is van ons en geen bewering van een aanbieder, maar volgt rechtstreeks uit het model voor opnieuw verzenden dat beide bedrijven documenteren - en daarom wordt een lange chat op een manier duur die mensen verrast.
Twee gedocumenteerde knoppen bieden tegenwicht. Promptcaching rekent een toeslag voor het schrijven van een cache-item en een forse korting voor het lezen ervan: Anthropic rekent voor het schrijven van een cache van vijf minuten 1,25× de basisprijs voor invoer en voor het lezen uit de cache 0,1×, waardoor het zichzelf na één treffer terugverdient. OpenAI past dezelfde schrijftoeslag van 1,25× toe en geeft 90% korting op invoer uit de cache, waarvoor een prefix van minimaal 1.024 tokens nodig is. Daarnaast bieden alle drie de aanbieders 50% korting voor asynchrone batchverwerking, en Anthropic vermeldt dat de cache- en batchkortingen worden gecombineerd.
Wat deze calculator niet kan
Het schat je volledige factuur niet. Het modelleert één foutmodus - herhaalde context - niet je totale uitgaven. Je echte factuur wordt vooral bepaald door hoeveel de modellen terugschrijven, en dat ziet deze tool niet.
Het bedrag in dollars is mogelijk niet wat je daadwerkelijk uitgeeft. Dit is het belangrijkste en wordt gemakkelijk over het hoofd gezien. ChatGPT Plus en Claude Pro zijn abonnementen met een vast tarief, geen abonnementen waarbij per token wordt afgerekend. Als je binnen een chatabonnement werkt in plaats van via de API, is de hier getoonde waarde de API-equivalente waarde van de verspilling, geen bedrag op je factuur. De verspilde tokens zijn hoe dan ook echt - ze gebruiken contextvenster en kosten je snelheid en ruimte voor daadwerkelijk werk - maar alleen API-gebruikers zien ze als afzonderlijke kostenpost.
Het kent je kortingen niet. Caching, batchverwerking en onderhandelde tarieven kunnen een API-factuur een veelvoud hoger of lager maken, en geen daarvan is in dit model opgenomen.
Prijzen veranderen. Elk bedrag op deze pagina is om een reden voorzien van de datum waarop het is gecontroleerd. Aanbieders wijzigen tarieven, brengen nieuwe modelniveaus uit en veranderen soms de tokenizer eronder. Controleer dit voordat je op basis hiervan een budgetbeslissing neemt.