TL;DR
- Wat: MiniMax heeft H3 uitgebracht, een AI-videomodel dat als eerste leesbare tekst in gegenereerde video kan tonen — iets waar alle voorgaande modellen op faalden.
- Waarom relevant: als ondernemer die video gebruikt voor marketing of productdemo's, wordt AI-gegenereerde video hiermee een stuk bruikbaarder.
- Wat je ermee kunt: bekijk of H3 via de API of het Hailuo-platform geschikt is voor korte productclips, en houd de open-weights-release in de gaten als je onder de €20 miljoen omzet zit.
Ik stuitte op een tweet van Ethan Mollick-collega @venturetwins die al anderhalf jaar elke nieuwe AI-videomodel hetzelfde vraagt: schrijf "Hi" op een schoolbord. Geen enkel model slaagde — tot MiniMax H3 van het Chinese Hailuo AI. Dat klinkt als een klein kunstje, maar het raakt aan een fundamenteel probleem waar de hele branche tegenaan loopt.
Waarom tekst in video zo lastig is voor AI
Leesbare tekst genereren in AI-video klinkt simpel, maar is technisch een hardnekkig probleem. Waar een mens moeiteloos het verschil ziet tussen een 'H' en een 'N', worstelen videomodellen met de exacte vorm van letters. De oorzaak: in de trainingsdata zitten weinig video's waarin tekst scherp in beeld is én exact wordt beschreven in het bijschrift. Het model leert dus niet goed hoe letters er frame voor frame uit horen te zien.
Het gevolg ken je misschien van eerdere AI-videotools: bordjes met onleesbare krabbels, verpakkingen met wartaal, straatnaamborden die per frame van tekst veranderen. Voor wie ooit een AI-video probeerde te maken met een productnaam of slogan erin, was dat een directe dealbreaker.
Wat mij hier opvalt: @venturetwins gebruikte dit "schrijf Hi op een schoolbord"-prompt bewust als lakmoesproef. Anderhalf jaar lang faalde elk model — Sora, Runway, Kling, noem ze maar op. Dat MiniMax H3 dit nu wél kan, zegt iets over hoe snel deze technologie beweegt.
Wat MiniMax H3 verder kan
H3 is niet alleen interessant vanwege die tekst-truc. Het model genereert video's tot 15 seconden in 2K-resolutie (2560×1440) met 24 frames per seconde, inclusief gesynchroniseerd geluid — muziek, geluidseffecten en spraak. Dat is standaard, zonder extra stappen.
Een paar concrete specs die ik relevant vind voor ondernemers:
- Omni-reference: je kunt tot 9 afbeeldingen, 3 videoclips en 3 audiofragmenten meegeven als referentie. Het model houdt dan stijl, personage of stem consistent. Stel dat je als ondernemer een serie korte productclips wilt maken in dezelfde visuele stijl — dat wordt hiermee een stuk haalbaarder.
- Video-editing: je kunt bestaande video bewerken via instructies, niet alleen genereren vanuit niets.
- Prijs: vanaf $0,13 per seconde via de API. Een clip van 15 seconden kost dus minder dan twee dollar. Vergelijk dat met wat een videograaf rekent voor één uur werk.
Ik wil hier wel bij zeggen: ik heb het model niet zelf getest. De specs komen van MiniMax zelf en van onafhankelijke reviews die ik heb doorgenomen. Hoe goed het in de praktijk werkt voor jouw specifieke toepassing, zul je zelf moeten uitproberen.
Open weights — en wat dat voor het MKB betekent
MiniMax heeft aangekondigd dat de modelgewichten "binnen dagen" publiek beschikbaar komen. Dat betekent dat je het model in principe op eigen hardware kunt draaien of kunt aanpassen aan je eigen behoeften. Dat is bijzonder voor een videomodel van dit kaliber.
De licentie — de MiniMax Community License — is voor ondernemers het interessantste deel:
- Onder de $20 miljoen jaaromzet? Je mag het model gratis commercieel gebruiken, mits je duidelijk vermeldt dat het op MiniMax-technologie draait.
- Boven de $20 miljoen? Dan moet je een apart licentiecontract afsluiten met MiniMax.
Voor de meeste MKB-bedrijven in Nederland valt dat dus binnen de gratis categorie. Ik vind dat een slimme zet van MiniMax: het maakt de drempel laag voor kleinere bedrijven, terwijl ze bij grotere partijen alsnog kunnen verdienen.
Een kanttekening over zelf hosten
Op het moment van schrijven (1 augustus 2026) zijn de weights nog niet daadwerkelijk gepubliceerd. Je kunt H3 nu alleen via de API of het Hailuo AI-platform gebruiken. Voor ondernemers die de technologie willen testen is dat prima, maar als je van plan bent om het op eigen servers te draaien — bijvoorbeeld vanwege privacygevoelige beelden — moet je nog even wachten.
De olifant in de kamer: auteursrecht
Ik kan niet over MiniMax schrijven zonder de lopende rechtszaak te noemen. Disney, Universal en Warner Bros. Discovery hebben MiniMax in september 2025 aangeklaagd wegens vermeende auteursrechtschending. De studios stellen dat MiniMax beschermd materiaal heeft gebruikt om Hailuo te trainen — denk aan herkenbare personages als Spider-Man en Darth Vader die het model kan genereren op basis van simpele prompts.
Op 23 mei 2026 heeft de Amerikaanse rechter het verzoek van MiniMax om de zaak te seponeren afgewezen. De zaak gaat door naar de discovery-fase.
Wat betekent dit voor jou als ondernemer? Ik denk dat je twee dingen in het achterhoofd moet houden:
- Gebruik geen AI-video om bestaande merken of personages na te bootsen. Dat was sowieso al riskant, maar met deze rechtszaak op de achtergrond wordt het extra relevant.
- De juridische onzekerheid rond AI-training raakt de hele branche, niet alleen MiniMax. Of je nu Runway, Kling of H3 gebruikt — de vraag hoe trainingsdata is verkregen speelt overal.
Wat betekent dit praktisch?
Kun je je voorstellen wat het betekent als je voor minder dan twee euro een professioneel ogende productclip van 15 seconden kunt genereren, mét leesbare tekst erin? Voor social media, voor een webshop, voor een interne presentatie?
Ik denk dat we op een kantelpunt zitten. Niet omdat één model alles kan, maar omdat de basiskwaliteit van AI-video nu een niveau bereikt waarop het voor steeds meer bedrijfstoepassingen bruikbaar wordt. Leesbare tekst was een van de laatste grote obstakels voor praktisch gebruik — als die hobbel genomen is, vallen er veel toepassingen open.
Tegelijkertijd: het is niet magisch. Je hebt nog steeds iemand nodig die een goede prompt kan schrijven, die de output kritisch beoordeelt, en die weet wanneer je beter een echte camera kunt pakken. Maar de lat om te beginnen met experimenteren ligt nu een stuk lager.
Voor mij is dit vooral een signaal dat AI-video het hobbyproject-stadium voorbij is. De combinatie van leesbare tekst, native audio, 2K-resolutie en een licentie die het MKB expliciet bedient — dat is voor het eerst dat al die puzzelstukjes bij één model samenkomen.
80% van de AI-projecten haalt productie nooit.
Ik bouw de 20% — van prototype naar draaiend systeem, binnen weken.