TL;DR
- Wat: OpenAI lanceert een preview van 'Ultrafast', een modus die GPT-5.6 Sol tot 14 keer sneller laat werken — tot 750 tokens per seconde.
- Waarom relevant: Snelheid bepaalt steeds vaker of AI in een bedrijfsproces past; dit maakt het krachtigste model bruikbaar voor taken die nu te traag verlopen.
- Wat je ermee kunt: Houd in de gaten wanneer Ultrafast breder beschikbaar wordt, en overweeg of taken als klantenservice of e-commerce-analyses hiermee haalbaar worden.
Vandaag kondigde OpenAI een nieuwe modus aan voor zijn krachtigste model: GPT-5.6 Sol draait via 'Ultrafast' tot veertien keer sneller dan de standaardversie. Ik viel hierover omdat snelheid voor mij een van de meest onderschatte factoren is bij AI-toepassingen in het bedrijfsleven — een model kan nóg zo slim zijn, als het antwoord te laat komt, gebruik je het niet.
Wat is Ultrafast precies?
Ultrafast is geen nieuw model, maar een nieuwe modus voor het bestaande GPT-5.6 Sol. Waar de standaardversie van Sol al het krachtigste model van OpenAI is, levert Ultrafast dezelfde intelligentie maar dan met een snelheid van tot 750 output-tokens per seconde. Ter vergelijking: dat is veertien keer sneller dan de standaardverwerking.
Om dat tastbaar te maken: 750 tokens per seconde is ruwweg het equivalent van een pagina tekst die in iets meer dan een seconde wordt geproduceerd. Stel dat je als ondernemer een AI-agent hebt die binnenkomende klachten analyseert en een conceptantwoord opstelt — dan heb je dat antwoord nu vrijwel direct, in plaats van na een merkbare wachttijd.
De technologie achter deze versnelling komt van chipmaker Cerebras. Hun zogeheten 'Wafer-Scale Engine' houdt het volledige model in het werkgeheugen van de chip (44 GB aan SRAM), waardoor de gebruikelijke bottleneck — het heen en weer schuiven van data tussen geheugen en processor — grotendeels verdwijnt. Wat mij hier opvalt: OpenAI bouwt dit niet zelf, maar gaat een partnerschap aan met gespecialiseerde hardware. Dat is een interessante strategische keuze.
Waarom snelheid ertoe doet voor bedrijven
Er is een patroon dat ik steeds terugzie in hoe bedrijven AI inzetten. De slimste modellen worden vaak gebruikt voor complexe taken — analyseren van contracten, samenvatten van grote documenten, ondersteunen van beslissingen. Maar diezelfde modellen zijn ook de traagste. En zodra een AI-tool merkbaar langzamer is dan een mens, haken mensen af.
OpenAI zegt het zelf in hun aankondiging: "Until now, getting real-time speed typically meant choosing a smaller or more specialized model." Je moest dus kiezen: of slim, of snel. Ultrafast probeert die keuze weg te nemen.
Voor ondernemers is dat relevant in een paar concrete scenario's:
Klantenservice en support
Als je een AI-chatbot inzet voor klantcontact, is reactietijd alles. Klanten wachten niet vijf seconden op een antwoord. Met 750 tokens per seconde komt de respons bijna onmiddellijk — vergelijkbaar met hoe snel een mens zou typen, of sneller.
E-commerce en aanbevelingen
Denk aan een webshop die op basis van klantgedrag real-time productaanbevelingen doet, of automatisch productbeschrijvingen genereert. Snelheid bepaalt daar letterlijk of de functie bruikbaar is binnen de laadtijd van een pagina.
Incidentrespons en financiële analyse
OpenAI noemt deze toepassingen expliciet. Bij financiële marktanalyse of het afhandelen van incidenten in IT-omgevingen telt elke seconde. Een model dat veertien keer sneller werkt, verschuift van 'handig hulpmiddel' naar 'onderdeel van het proces'.
Beschikbaarheid en kosten
Hier zit voor de meeste ondernemers het punt waar het spannend wordt — en waar nog veel onduidelijk is. Ultrafast is op dit moment beschikbaar als limited preview, wat betekent dat slechts een kleine groep klanten er toegang toe heeft. OpenAI zegt de beschikbaarheid uit te breiden "naarmate de capaciteit groeit".
Over de prijzen van Ultrafast zelf is nog niets bekendgemaakt. Ter referentie: de standaardversie van GPT-5.6 Sol kost op dit moment 5 dollar per miljoen input-tokens en 30 dollar per miljoen output-tokens. Ik verwacht dat Ultrafast duurder zal zijn — snellere hardware is nu eenmaal niet gratis — maar dat is mijn inschatting, niet bevestigd door OpenAI.
Voor een MKB-ondernemer in Nederland is de vraag dan ook: wordt dit betaalbaar genoeg voor jouw schaal? Als je vijftig klantvragen per dag verwerkt, is de rekensom anders dan wanneer je er vijfduizend verwerkt. Dat soort duidelijkheid ontbreekt nog.
De bredere context: een snelheidsrace
Wat ik interessant vind, is dat dit past in een bredere trend. Anthropic — het bedrijf achter Claude — biedt al een 'Fast Mode' aan voor hun modellen. Google werkt aan vergelijkbare versnellingen. De race is niet langer alleen wie het slimste model heeft, maar wie het snelst kán leveren zonder in te leveren op kwaliteit.
Dat OpenAI hiervoor samenwerkt met Cerebras in plaats van alleen op eigen hardware (zoals hun samenwerking met NVIDIA) te vertrouwen, zegt iets. Cerebras is gespecialiseerd in precies dit probleem: grote modellen razendsnel laten draaien. Het is een partnerschap dat logisch is, maar ook laat zien dat zelfs OpenAI niet alles alleen kan.
Voor het Nederlandse MKB is er nóg een relevante ontwikkeling: OpenAI lanceerde eerder deze maand een MKB-programma rondom ChatGPT Work, gericht op het opbouwen van AI-vaardigheden in kleinere bedrijven. Of Ultrafast daar op termijn ook onderdeel van wordt, is niet bekend. Maar de richting is duidelijk: OpenAI richt zich steeds nadrukkelijker op zakelijke gebruikers, niet alleen op consumenten en developers.
Waar dit heen gaat
Ik zou graag twee dingen willen weten die OpenAI nog niet heeft gedeeld. Ten eerste: wat wordt de prijs van Ultrafast wanneer het breder beschikbaar komt? En ten tweede: blijft de kwaliteit van de output écht identiek aan de standaardmodus, ook bij complexe taken? OpenAI claimt van wel, maar onafhankelijke benchmarks heb ik nog niet gezien.
Kun je je voorstellen wat het betekent als het krachtigste AI-model ter wereld net zo snel reageert als een Google-zoekresultaat? Dat is waar dit naartoe beweegt. En dan wordt de vraag niet meer óf je AI inzet in je bedrijf, maar hoe snel je het kunt integreren.
Voor mij is dit vooral een signaal dat de barrière voor AI-gebruik in bedrijven aan het verschuiven is. Het gaat niet meer alleen om wat een model kan, maar om of het snel genoeg is om het ook daadwerkelijk te doen. Die verschuiving is stiller dan een nieuw model lanceren, maar wat mij betreft minstens zo belangrijk.
80% van de AI-projecten haalt productie nooit.
Ik bouw de 20% — van prototype naar draaiend systeem, binnen weken.