TL;DR
- Wat: Cerebras en AMD lanceren samen een inference-platform dat AI-werklasten opsplitst over twee chiparchitecturen — en de hardware wordt nu in het wild gespot.
- Waarom relevant: snellere en energiezuinigere AI-inference betekent dat cloudkosten voor AI-toepassingen op termijn kunnen dalen.
- Wat je ermee kunt: houd Cerebras Cloud in de gaten als je AI-modellen via een API afneemt — de prijsdruk op inference werkt in jouw voordeel.
Op X verscheen een tweet van @iruletheworldmo met de tekst: "cerebras spotted in the wild. tomorrow be launch day." Ik viel erover omdat Cerebras de afgelopen maanden sowieso niet uit het nieuws is geweest — een beursgang van 5,5 miljard dollar, een deal van 20 miljard met OpenAI, en nu een partnerschap met AMD. Tijd om uit te zoeken wat er precies aan de hand is en wat het kan betekenen als je een bedrijf runt.
Wie is Cerebras en waarom hoor je er steeds meer over?
Cerebras is een Amerikaans chipbedrijf dat één ding anders doet dan de rest: in plaats van losse chips te maken, produceren ze een volledige wafer-scale engine (WSE). Dat is, simpel gezegd, één enorme chip ter grootte van een complete siliciumschijf — zo groot als een dinerbord. De meeste chipmakers snijden die schijf in honderden losse chips. Cerebras gebruikt de hele plaat als één processor.
Waarom dat uitmaakt? Geheugenbandbreedte. AI-modellen moeten voortdurend data heen en weer schuiven, en dat is bij traditionele GPU's een flessenhals. Cerebras claimt dat hun WSE-3 tot 7.000 keer meer geheugenbandbreedte biedt dan een Nvidia H100. Dat vertaalt zich volgens het bedrijf in inference-snelheden die 10 tot 70 keer hoger liggen dan bij GPU-oplossingen.
In mei 2026 ging Cerebras naar de beurs op de Nasdaq. De aandelen stegen op de eerste dag met meer dan 100 procent, waardoor het bedrijf een marktwaarde bereikte van bijna 100 miljard dollar. Medeoprichter en CEO Andrew Feldman en CTO Sean Lie werden in één klap miljardair. Een spectaculaire entree — maar de echte vraag is of de technologie ook buiten het lab levert.
De AMD-samenwerking: wat is er aangekondigd?
Op 23 juli 2026 presenteerden AMD en Cerebras samen een nieuw disaggregated inference-platform, onthuld op het Advancing AI 2026-evenement. Het idee: splits de twee fasen van AI-inference over twee verschillende chiparchitecturen.
Hoe werkt dat?
- AMD Helios neemt de prompt processing voor zijn rekening — het verwerken van de invoer en het opbouwen van de context. Denk aan het lezen en begrijpen van een lange vraag.
- Cerebras WSE doet de token generation — het daadwerkelijk genereren van het antwoord, woord voor woord. Daar zit de snelheidswinst.
De twee systemen draaien als één geïntegreerde workflow. Wat mij hier opvalt is dat dit een pragmatische aanpak is: in plaats van te zeggen "onze chip is beter dan alles", zegt Cerebras in feite "onze chip is het beste voor dit specifieke stuk werk, en AMD is beter voor dat andere stuk." AMD-CEO Lisa Su noemde het in het persbericht een "flexibelere aanpak" die nodig is door de groeiende diversiteit aan AI-werklasten.
Prestatieclaims
Cerebras en AMD claimen dat de gecombineerde oplossing tot vijf keer meer tokens per seconde per watt levert vergeleken met een Cerebras-only configuratie. Dat is een energieclaim, geen pure snelheidsclaim — en dat onderscheid is belangrijk. Als je minder stroom nodig hebt per eenheid werk, dalen de operationele kosten van datacenters. Die besparing kan uiteindelijk doorsijpelen naar de prijs die jij als afnemer betaalt voor AI-diensten.
Ik moet erbij zeggen: deze cijfers komen van het bedrijf zelf, op basis van modellering in juli 2026. Onafhankelijke benchmarks van derden heb ik op dit moment nog niet gevonden. Het is dus verstandig om dit als een indicatie te zien, niet als een vaststaand feit.
Wat betekent "spotted in the wild"?
De tweet die aanleiding gaf voor dit stuk spreekt over Cerebras-hardware die ergens buiten de muren van het bedrijf is gesignaleerd. Dat past bij twee recente aankondigingen:
- Europese uitbreiding. Op 9 juli 2026 kondigde Cerebras op de RAISE Summit in Parijs aan dat het Europese datacenter-capaciteit opbouwt, met locaties in Frankrijk en de Noordse landen. Het doel: 200 megawatt aan rekenkracht tegen eind 2027, deels voor OpenAI-werklasten.
- Cerebras Cloud. De gezamenlijke AMD-Cerebras oplossing wordt naar verwachting beschikbaar via Cerebras Cloud in de tweede helft van 2026.
Als er daadwerkelijk hardware in Europese datacenters wordt geïnstalleerd, is dat relevant voor Nederlandse ondernemers. Datacenters dichter bij huis betekenen lagere latency — de vertraging tussen jouw verzoek en het antwoord. Voor toepassingen zoals AI-chatbots voor klantenservice of real-time vertalingen maakt dat verschil.
Wat betekent dit voor jou als ondernemer?
Ik denk dat het voor de meeste MKB-ondernemers niet direct uitmaakt welke chip er in een datacenter draait. Wat wél uitmaakt, zijn de gevolgen:
Prijsdruk op AI-inference
Cerebras is niet de enige partij die snellere en goedkopere inference najaagt — Groq, SambaNova en Nvidia zelf zitten er ook bovenop. Maar hoe meer concurrentie, hoe beter voor jou als afnemer. De kosten om een AI-model vragen te laten beantwoorden — of dat nu via OpenAI, Anthropic of een ander platform is — worden gedrukt door dit soort ontwikkelingen.
Stel dat je als ondernemer een AI-assistent inzet voor klantcommunicatie. Elke keer dat die assistent een antwoord genereert, betaal je per token. Als de onderliggende infrastructuur efficiënter wordt, dalen die kosten op termijn.
Snelheid als onderscheidende factor
Cerebras leverde eerder al Llama 4 Maverick-inference op 2.500 tokens per seconde per gebruiker — meer dan het dubbele van Nvidia's nieuwste systeem, aldus het bedrijf. Als die snelheid beschikbaar wordt via cloud-API's, opent dat mogelijkheden voor toepassingen waar real-time reactie cruciaal is. Denk aan: automatische kwaliteitscontrole in productieprocessen, live vertaaldiensten, of AI-gestuurde beslisondersteuning.
Europese beschikbaarheid
De Europese datacenter-uitbreiding is voor Nederlandse bedrijven een punt om in de gaten te houden. Data die binnen Europa verwerkt wordt, vereenvoudigt AVG-compliance. Bovendien biedt het mogelijkheden om AI-diensten af te nemen met lagere latency dan wanneer alles via de VS loopt.
Kanttekeningen
Er zijn een paar dingen die ik graag wil meegeven als nuancering:
- Cerebras is als beursgenoteerd bedrijf gebaat bij positief nieuws. De prestatie-claims zijn nog niet onafhankelijk geverifieerd.
- De samenwerking met AMD is aangekondigd, maar de daadwerkelijke beschikbaarheid via Cerebras Cloud staat gepland voor "de tweede helft van 2026" — dat is vaag.
- De OpenAI-deal van 20 miljard dollar is enorm, maar het maakt Cerebras ook afhankelijk van één grote klant. Dat is een risico.
Tot slot
Voor mij is dit vooral een signaal dat de markt voor AI-rekenkracht in beweging blijft — en niet meer alleen gedomineerd wordt door Nvidia. Concurrentie in de chipmarkt is goed nieuws voor iedereen die AI-diensten afneemt, van de grote techbedrijven tot de MKB-ondernemer die een chatbot draait. Of Cerebras de beloftes waarmaakt, moet nog blijken. Maar dat er hardware "in het wild" opduikt, vind ik een stap concreter dan alleen een persbericht.
80% van de AI-projecten haalt productie nooit.
Ik bouw de 20% — van prototype naar draaiend systeem, binnen weken.