6 tips om hoge token kosten Claude en ChatGPT te voorkomen

| Geschreven door Bas
claude-en-chatgpt-tokens

Steeds meer zzp'ers werken dagelijks met AI-tools zoals ChatGPT en Claude. Ze helpen bij het schrijven van offertes, het opstellen van e-mails, het samenvatten van documenten of het bedenken van content. De gratis versies zijn een goede kennismaking, maar wie de tools serieus inzet, loopt al snel tegen gebruikslimieten aan of merkt dat het abonnement flink in de kosten loopt. Zeker bij de betaalde versies tikt het snel op als je niet bewust met je gebruik omgaat.

Het goede nieuws is dat je met een paar aanpassingen in je werkwijze aanzienlijk meer uit dezelfde hoeveelheid tokens kunt halen. Hieronder zetten we de meest praktische gewoonten op een rij, specifiek gericht op zzp'ers die AI willen inzetten als serieus werkinstrument.

Wat zijn tokens en waarom kosten ze geld?

AI-taalmodellen zoals ChatGPT (van OpenAI) en Claude (van Anthropic) werken niet met berichten of woorden als rekeneenheid, maar met tokens. Een token is ruwweg drie tot vier tekens tekst. Elke keer als jij iets typt en de AI reageert, worden tokens verbruikt. Maar er is een cruciaal detail dat de meeste gebruikers niet weten: bij elk nieuw bericht leest het model de volledige gespreksgeschiedenis opnieuw. Bericht één kost alleen de tokens van dat eerste bericht. Bericht vijf kost de tokens van alle vijf berichten bij elkaar. Bericht twintig kost al het voorgaande plus het nieuwe.

Die ophoping gaat snel. Bij een gesprek van dertig berichten is de twintigste of dertigste uitwisseling exponentieel duurder dan de eerste. Wie dat niet weet, tikt moeiteloos zijn limiet of budget vol zonder er iets bijzonders voor te hebben gedaan.

Tip 1: bewerk je prompt, stuur geen vervolgbericht

De meest gemaakte fout: de AI geeft niet het antwoord dat je wilde, en je stuurt een nieuw bericht met uitleg of correctie. Dat is precies wat je moet vermijden. Elk nieuw bericht voegt zich toe aan de gespreksgeschiedenis die het model opnieuw doorleest.

De betere aanpak: klik op de knop om je oorspronkelijke prompt te bewerken, pas hem aan en genereer opnieuw. De oude uitwisseling wordt dan vervangen in plaats van uitgebreid. Dit kost een fractie van de tokens van een vervolgbericht en levert doorgaans een beter resultaat op, omdat de instructie van tevoren helderder is geformuleerd.

Neem de tijd om je prompt goed te schrijven voordat je op verzenden drukt. Geef context, geef aan welke toon je wilt, geef voorbeelden als dat helpt. Een goede prompt voorkomt meerdere rondes en bespaart daarmee een veelvoud aan tokens.

Tip 2: bundel meerdere vragen in één bericht

Veel gebruikers stellen vragen stap voor stap: eerst een samenvatting, dan de hoofdpunten, dan een voorstel voor een titel. Drie berichten, drie keer de volledige contextlading. Dat is drie keer duurder dan nodig.

Stel alle deelvragen in één bericht: "Vat dit artikel samen, noem de drie belangrijkste punten en stel een pakkende onderwerpregel voor." Het model ziet het geheel meteen en geeft in één keer een volledigere reactie. Dat levert niet alleen tokenbesparing op, maar vaak ook een betere samenhang in het antwoord.

Tip 3: begin een nieuw gesprek bij lange sessies

Naarmate een gesprek langer wordt, neemt de verhouding tussen nuttige output en verbruikte tokens steeds verder af. Bij een gesprek van honderd berichten bestaat een groot deel van het tokenverbruik puur uit het herlezen van oude context die al lang niet meer relevant is.

Een praktische werkwijze: vraag de AI bij een lang gesprek om een beknopte samenvatting van alles wat tot dan toe besproken is. Kopieer die samenvatting, start een nieuw gesprek en plak hem als eerste bericht. Je begint met de relevante context zonder de ballast van tientallen eerdere uitwisselingen. Dit werkt bijzonder goed bij lopende projecten, schrijftaken of adviestrajecten waarbij je over meerdere dagen terugkomt op hetzelfde onderwerp.

Tip 4: gebruik het juiste model voor de taak

Zowel ChatGPT als Claude bieden meerdere modellen aan met verschillende capaciteiten en bijbehorende kosten. Het krachtigste en duurste model inzetten voor een simpele taak is verspilling. Grammaticacontrole, het herschrijven van een korte tekst, een eenvoudige vertaling of het beantwoorden van een feitelijke vraag: die taken vereisen geen topmodel.

Bij Claude is Haiku het lichtere en goedkopere model, geschikt voor snelle en eenvoudige taken. Sonnet zit in het midden en is de meest gebruikte keuze voor dagelijks werk. Opus is het krachtigste model, voor complexe analyses of taken waarbij nuance en diepgang echt noodzakelijk zijn. Bij ChatGPT geldt een vergelijkbare indeling met GPT-4o mini voor lichte taken en GPT-4o voor zwaardere opdrachten.

Stel jezelf bij elke taak de vraag: heb ik hier echt het krachtigste model voor nodig? In de meeste gevallen is het antwoord nee.

Tip 5: sla terugkerende context op, upload niet steeds opnieuw

Veel zzp'ers uploaden hetzelfde document steeds opnieuw naar een nieuw gesprek: een offerte-template, een stijlgids, een productomschrijving of een klantprofiel. Elk van die uploads kost tokens, elke keer opnieuw.

Zowel ChatGPT als Claude bieden een projectfunctie waarbij je documenten eenmalig kunt opslaan en vanuit elk gesprek binnen dat project kunt gebruiken zonder ze telkens opnieuw in te laden. Gebruik je deze functie, dan worden terugkerende bestanden gecached en kost het raadplegen ervan aanzienlijk minder dan een verse upload.

Gebruik je de geheugenfunctie van de tool, zet dan relevante basisinformatie vast: jouw schrijfstijl, jouw vakgebied, de toon die je hanteert in klantcommunicatie. Dat scheelt in elk gesprek drie tot vijf introductiebeurs die je anders steeds opnieuw kwijt bent aan context geven.

Tip 6: controleer altijd wat eruit komt

Dit heeft minder met tokens te maken en meer met verstandig gebruik. AI-modellen zijn goed in tekst genereren, maar ze maken fouten. Ze kunnen onjuiste feiten presenteren met dezelfde zekerheid als correcte informatie, een fenomeen dat ook wel 'hallucineren' wordt genoemd. Ze produceren soms teksten die herkenbaar naar AI ruiken: gladde formuleringen, opsommingen met drie punten, aangekondigde conclusies.

Als zzp'er die content maakt voor klanten of voor je eigen website, is het altijd de moeite waard om de output te bewerken voordat je hem publiceert of verstuurt. Gebruik de tekst als een sterke eerste versie, niet als eindproduct. Dat is ook precies het moment waarop AI zijn waarde bewijst: als tijdsbesparing in de eerste versie, niet als vervanging van je eigen oordeel.

Welk abonnement past bij een zzp'er?

Voor incidenteel gebruik volstaan de gratis versies van ChatGPT en Claude prima. Zodra je de tools dagelijks inzet voor klantcommunicatie, contentproductie of administratieve taken, is een betaald abonnement de moeite waard. ChatGPT Plus kost rond de 20 dollar per maand, Claude Pro een vergelijkbaar bedrag. Beide geven toegang tot betere modellen, hogere limieten en meer functies.

Met de gewoonten uit dit artikel kun je in veel gevallen toe met een lager abonnement dan je nu hebt, of haal je aanzienlijk meer werk uit hetzelfde budget. Dat is precies waar het als zzp'er om draait: slim schakelen, niet meer betalen dan nodig.

Meer lezen over slimmer zakelijk rijden als zzp'er? Bekijk ook wat financial lease voor jou als ondernemer kan betekenen op het gebied van mobiliteitskosten.

ZZP Nieuws