Drie alinea's en er rolt een complete game uit
Iedereen kopieert nu dezelfde prompt van drie alinea's. Ik draaide hem zelf ook. Wat eruit kwam zag er beter uit dan het bleek te zijn.
Drie alinea’s. Meer had Matt Shumer, AI-ondernemer en techbouwer, niet nodig. Wat eruit kwam is een browsergame die eruitziet als een moderne Call of Duty. Er waait stof op waar de kogels inslaan en een wapen klinkt anders als je verderop staat. Geen enkel plaatje of geluidsbestand kwam van buiten, alles wordt ter plekke berekend. De video haalde 3,8 miljoen weergaven en het halve internet riep dat het nep moest zijn.
Het is echt. Tien dagen later staat er een openbare lijst met bijna vijftig speelbare browsergames. Een kartracer, een cyberpunkstad, een co-op zombiegame voor vier spelers, een Crash Bandicoot-kloon, een wandelsimulatie in een ronddraaiende ruimtekolonie. Allemaal gemaakt door mensen die diezelfde drie alinea's hadden gekopieerd en er hun eigen doel in hadden gezet.
Shumer noemt het de Gauntlet Loop.
Dit is de hele prompt
Bouw een first-person shooter op het niveau van de nieuwste Call of Duty-games. Alles op AAA-niveau, van texturen tot physics.
Waaier uit naar sub-agents en laat elke sub-agent één onderdeel aanpakken. Zet op elk onderdeel een loop en laat een aparte sub-agent visueel controleren of het er AAA uitziet. Die controleur moet een keiharde criticus zijn. Zolang het er niet AAA uitziet gaat hij door.
Stop niet tot elke sub-agent overdonderd is, vergeleken met de echte Call of Duty. Hij moet de twee blind naast elkaar leggen en zeggen welke er beter uitziet.
Dat is alles. Geen architectuur, geen stappenplan. Het model bepaalt zelf hoe het de klus opdeelt. Dit is het resultaat.
Eigenlijk zitten er maar drie dingen in. Een doel. De opdracht om het werk op te knippen met per stuk een bouwer en een criticus die niets weet van de overwegingen van die bouwer. En als derde een lat waar niet omheen te praten valt, namelijk een bestaand product waar het eigen werk blind naast gaat.
De lat doet het werk. Shumer noemt hem zelf het belangrijkste onderdeel van de methode en je snapt meteen waarom. Vraag om iets geweldigs en je model vindt binnen tien seconden dat het geweldig is. Leg er een echte Call of Duty naast en het heeft ineens iets om op te verliezen.
AI-onderzoeker Andrej Karpathy liet zien hoe ver dit gaat. Hij gaf Claude Opus 5 de eerste alinea van In de Ban van de Ring, ongeveer tien dollar aan tokens en de opdracht daar een 3D-scène van te maken. Twee uur later lagen er 5.500 regels code die het verhaal uittekenden. Zijn opmerking erbij is blijven hangen. Geen mens zou de tijd nemen om zoiets op maat te bouwen. Een model heeft daar alle geduld van de wereld voor.
En het bleef niet bij spelletjes. Iemand liet er een complete auto uit rollen, ruim vijftienhonderd losse onderdelen inclusief ophanging en een V12-motor, uit één opdracht. Een ander zat op de bank over de herinrichting van zijn achtertuin te praten en had een uur later een model waarin hij kon rondlopen.
Dus dat is de nieuwe situatie. Software die te specifiek is om te laten maken, maak je nu voor het bedrag van twee koffie.
Wat er bij mij uitkwam
Ik moest het natuurlijk zelf proberen. Twee uur, precies zoals bij Karpathy.
Eruit kwam ACT NOW!, een reeks korte opdrachten in de geest van WarioWare. Het kantoor heeft alles geautomatiseerd en jij hebt per opdracht een paar tellen om het verstandig te maken. Tik het vertrouwelijke bestand weg voor iemand het in de verkeerde chatbot plakt, stop de sorteermachine die kandidaten scheef beoordeelt, trek de emotieherkenningskabel eruit.
In een van de andere opdrachten staat een robot met een pruik en een plaknepsnor die volhoudt dat hij echt Steve heet. Jij moet op die vermomming tikken voor de tijd op is. Dat is artikel 50 van de AI-verordening, de regel dat mensen moeten weten wanneer ze met een machine praten. In twee tellen landt dat beter dan wanneer ik er in een workshop een slide voor opentrek.
Twaalf van die dingen, vier levens en een eindgevecht dat DE AI-AUDIT heet. In het Nederlands en het Engels, want waarom ook niet.
Mijn lat was de gameplay. Of het aanvoelt als WarioWare en of je binnen één seconde snapt wat je moet doen. Daar kon de criticus naar kijken en daar is het goed in geworden.
En toen ging ik kijken
Onder elke opdracht blijkt een leerdossier te zitten dat artikel 50 aanhaalt, bijlage III op 2 december 2027 dateert en het verbod op emotieherkenning op de werkvloer terugvoert op februari 2025. Het leest alsof er een jurist overheen is gegaan.
Dat is nooit gebeurd. Ik heb er geen letter van gecontroleerd, want juridische juistheid stond niet op mijn lat.
Datzelfde patroon zit in Shumers game. Het staat opgeschreven in zijn eigen repository. Eén dag na publicatie kwam er een audit overheen die acht fouten vond die geen enkele criticus had gezien. Wie het spel startte kwam soms vier meter boven de grond terecht, klemgezet in de stam van een palmboom. Van een trap met zeventien treden waren er zestien dichtgemetseld. En de vijanden stopten na twintig seconden voorgoed met flankeren, door één verkeerd geplaatst haakje in de code.
De meters logen ook. De prestatiemeter meldde 94 beelden per seconde terwijl het spel in echt gebruik op 12 liep. Twee identieke opnamerondes gaven op tien van de elf beelden een ander resultaat, dus de blinde criticus zat een tijdlang ruis te vergelijken.
Karpathy komt onafhankelijk op hetzelfde uit. Zijn model kon de scène niet spelen en geen video bekijken, dus het moest het doen met zorgvuldig genomen schermafbeeldingen. Precies daar zaten zijn fouten.
Denk aan een modelwoning. De bank is opgeschud en de planten staan goed. Iedereen die er doorheen loopt beoordeelt de styling. Achter de wand hangt bedrading waar niemand naar kijkt.
Wat je hieraan hebt
Een loop als deze levert overtuigend werk op de punten die je hebt opgeschreven en werk dat er alleen maar overtuigend uitziet op alle punten die je vergat. Aan de buitenkant zie je het verschil niet. Dat is precies waarom jij nog nodig bent.
Geef je controleur dus iets dat je kunt aanwijzen. Een offerte die je zelf prachtig vond, of een handvol alinea's van een schrijver wiens helderheid je wilt halen. Woorden als "professioneel" en "publicatieklaar" leveren je een model op dat zichzelf overtuigt.
En schrijf één keer op wat die controleur nooit kan zien. Of de klant het gelooft, of dit gevoelig ligt bij die ene opdrachtgever, of de cijfers wel kloppen. Dat lijstje is korter dan je denkt en het is elke keer hetzelfde, dus je maakt het één keer en zet daar een mens neer.
Over de loop zelf schreef ik eerder een heel playbook, met de tredes, de remmen en de vijf niveaus van verificatie. Wat de Gauntlet Loop daaraan toevoegt is de lat van vlees en bloed.
Het bouwen kun je inmiddels uitbesteden, zolang jij degene blijft die opschrijft waar de loop blind is.
Speel ACT NOW! Het is leuk geworden (ChatGPT account verplicht). Gebruik het alleen niet als bron voor de AI-verordening.
Lees ook
Het model weet dat het getest wordt
De snelste route naar Nederlandse AI loopt via China
Vind je dit waardevol? Deel het.
Stuur THE HUMAN LOOP door naar één collega die ook met AI bezig is. Voor elke vriend die zich aanmeldt, krijg je gratis maanden premium: inclusief alle Playbooks.
Concreet:
2 vrienden = 1 maand
5 vrienden = 3 maanden
12 vrienden = een half jaar






