TL;DR
- Wat: Z.AI (het platform achter B.AI) lanceert GLM-5.3 met promotietarieven en biedt steeds meer modellen aan tegen dalende prijzen, midden in een bredere prijzenoorlog tussen AI-aanbieders.
- Waarom relevant: de kosten om AI via een API in te zetten dalen zo snel dat de keuze tussen kwaliteit en budget voor ondernemers minder scherp wordt.
- Wat je ermee kunt: inventariseer of AI-toepassingen die je eerder te duur vond, nu wél binnen bereik liggen — en kijk verder dan alleen OpenAI of Google.
Ik viel deze week over een tweet van @kidsreallycute die één getal uitlichtte: 90%. Niet als het interessantste cijfer, maar juist als aanleiding om te kijken naar wat erachter zit — een verschuiving in hoe AI-modellen worden geprijsd. Dat vond ik de moeite waard om in te duiken.
Wat er precies is gebeurd
Het Chinese AI-bedrijf Zhipu AI — internationaal actief als Z.AI — heeft op 14 augustus 2026 een nieuw model gelanceerd: GLM-5.3. Dit model is gericht op complexe coderingstaken, langlopende agent-werkzaamheden en cybersecurity. Het draait op dezelfde architectuur als het eerdere GLM-5.2, maar is verder getraind.
Wat opvalt: Z.AI biedt GLM-5.3 tijdelijk aan tegen 90% van de standaardprijs. Concreet betekent dat een korting van 10% op de reguliere tarieven — input gaat van $1,40 naar $1,26 per miljoen tokens, output van $4,40 naar $3,96. Dat klinkt bescheiden, maar het past in een veel groter patroon.
Het getal 90% duikt ook ergens anders op: Z.AI hanteert in hun berekeningen een gemiddelde cache-hitratio van 90,9% voor coderingswerk. Dat wil zeggen dat bij herhaaldelijk gebruik van vergelijkbare prompts, het overgrote deel van de invoer uit het geheugen wordt gehaald in plaats van opnieuw berekend. Gecachte tokens kosten bij Z.AI slechts $0,26 per miljoen — een fractie van de standaardprijs. Ik vind het eerlijk gezegd opvallend hoe groot het verschil is dat caching kan maken in je uiteindelijke rekening.
De bredere prijzenoorlog
Wat hier gaande is, gaat veel verder dan één aanbieder. Augustus 2026 is een maand van opvallende prijsdalingen in de AI-wereld:
- OpenAI verlaagde de prijs van GPT-5.6 Luna met 80% en Terra met 20%, als permanente prijsverlaging.
- Anthropic biedt Claude Sonnet 5 tijdelijk aan voor $2/$10 per miljoen tokens (normaal $3/$15) — tot eind augustus.
- Chinese aanbieders zoals DeepSeek en Zhipu AI zetten druk op de markt met modellen die een fractie kosten van westerse alternatieven. DeepSeek's topmodel kost volgens recente analyses achttien keer minder dan Claude Opus.
Sinds de lancering van GPT-4 in maart 2023 zijn AI-API-prijzen met meer dan 90% gedaald. Dat is in drie jaar tijd. Ik vind dat een cijfer waar je even bij stil moet staan als ondernemer.
Waarom dit geen tijdelijke actie is
Wat mij hier opvalt, is dat het niet meer gaat om losse acties of introductiekortingen. De hele industrie verschuift van "wie heeft het beste model?" naar "wie levert de beste prijs-kwaliteitverhouding?" Dat is een fundamenteel ander spel. En het is precies het punt dat de tweetauteur maakt: ontwikkelaars — en daarmee ook bedrijven — hoeven steeds minder te kiezen tussen kwaliteit en kosten.
Wat betekent dit voor een ondernemer?
Stel dat je als ondernemer een jaar geleden hebt gekeken naar het automatiseren van klantvragen via een AI-chatbot, of naar het laten samenvatten van documenten. De kans is groot dat je toen dacht: "Leuk, maar de kosten lopen snel op als we dit op schaal doen." Die rekensom ziet er nu anders uit.
Een paar dingen om in gedachten te houden:
De kosten zijn niet meer het grootste obstakel
Met modellen als GLM-4.7-Flash en GLM-4.5-Flash die bij Z.AI gratis beschikbaar zijn, en budgetmodellen als Qwen3.7 Flash voor $0,03 per miljoen input-tokens, is de drempel om te experimenteren bijna nul. Voor productiewerk liggen de kosten van een capable model nu rond de $1-2 per miljoen tokens — dat is een fractie van wat het twee jaar geleden kostte.
Je hoeft niet bij één aanbieder te blijven
GLM-5.2 is via meer dan twintig aanbieders beschikbaar, waaronder OpenRouter — waar de prijs zelfs lager ligt dan bij Z.AI direct ($0,63 versus $1,40 per miljoen input-tokens). Platforms als OpenRouter en andere marktplaatsen maken het makkelijker om modellen te vergelijken en te wisselen zonder je hele systeem om te bouwen.
Kun je je voorstellen wat dit betekent als je een applicatie bouwt die meerdere AI-taken combineert? Je kunt een goedkoop model gebruiken voor eenvoudige taken en een duurder, krachtiger model reserveren voor de complexe zaken.
Let op de kleine lettertjes
Ik denk dat het belangrijk is om hier ook eerlijk te zijn: niet elke korting is wat hij lijkt. Z.AI hanteert bijvoorbeeld piekmomenten (14:00-18:00 UTC+8) waarin het tokenverbruik drie keer zo hoog wordt geteld. En de Claude Sonnet 5-actie van Anthropic loopt eind augustus af, waarna de prijs met 50% stijgt. Wie op basis van actietarieven een businesscase bouwt, moet rekening houden met de reguliere prijs.
De analyse van Digital Applied vat het mooi samen: "Een model heeft geen prijs. Een model plus een gebruiksmodus heeft een prijs." Dat geldt voor batch-verwerking, caching, piek- versus daluren, en abonnementen versus pay-per-use.
De opkomst van Chinese AI-aanbieders
Wat ik ook interessant vind aan dit verhaal: een deel van de prijsdruk komt van Chinese bedrijven die modellen aanbieden die steeds beter presteren, tegen aanzienlijk lagere prijzen. Zhipu AI is daar één van, maar ook DeepSeek en Moonshot AI spelen mee.
Voor een Nederlandse ondernemer roept dat vragen op. Waar staan mijn data? Welke privacyregels gelden er? Hoe zit het met de AVG als ik een Chinese API gebruik? Dat zijn legitieme overwegingen, en ik zou zelf willen weten hoe Z.AI omgaat met Europese dataverwerking voordat ik het in een bedrijfsproces zou inzetten.
Tegelijk is de concurrentie goed nieuws: het dwingt OpenAI, Google en Anthropic om hun prijzen te verlagen. Zelfs als je besluit om bij een westers platform te blijven, profiteer je indirect van de druk die Chinese aanbieders uitoefenen.
Een veranderende rekensom
Voor mij is dit vooral een signaal dat de economische drempel voor AI-gebruik in het MKB snel aan het verdwijnen is. De technische drempel is er nog — je moet weten welk model je waarvoor inzet, hoe caching werkt, en waar de verborgen kosten zitten. Maar het prijsargument om niet met AI te beginnen? Dat wordt met elke maand dunner. En ik denk dat ondernemers die nu de tijd nemen om te begrijpen hoe deze markt beweegt, straks in een betere positie zitten dan degenen die wachten tot het "makkelijk" wordt.
80% van de AI-projecten haalt productie nooit.
Ik bouw de 20% — van prototype naar draaiend systeem, binnen weken.