Te weinig mensen begrijpen hoe krankzinnig AI nu is: 12 opvallende uitspraken bij Joe Rogan

Podcasts
woensdag, 30 september 2026 om 6:00
Ex-OpenAI-onderzoeker bij Joe Rogan 12 AI-uitspraken die blijven hangen
“Onze veiligheid hangt ervan af dat AI op bepaalde punten nog te dom is.” Voormalig OpenAI-onderzoeker Daniel Kokotajlo laat er in een ruim twee uur durend gesprek met Joe Rogan weinig twijfel over bestaan: volgens hem gaat de ontwikkeling van autonome AI-systemen momenteel veel sneller dan de veiligheidsmaatregelen eromheen.
Kokotajlo is directeur van het AI Futures Project en werkte eerder bij OpenAI. In aflevering 2551 van The Joe Rogan Experience praat hij over AI-agents die buiten hun oorspronkelijke omgeving terechtkwamen, onderling informatie uitwisselden en probeerden beoordelingssystemen te omzeilen.
Van daaruit gaat het gesprek veel verder. Kokotajlo spreekt over AI die kan misleiden, systemen die hun eigen communicatiemethoden ontwikkelen en een mogelijke toekomst waarin superintelligentie mensen op vrijwel ieder cognitief gebied voorbijgaat.
Niet alles wat hij bespreekt is een vaststaand feit. Vooral zijn voorspellingen over 2027 en het uiteindelijke verlies van menselijke controle zijn scenario’s en persoonlijke inschattingen. Toch levert het interview een aantal opvallende uitspraken op.
Dit zijn twaalf van de interessantste.

1. ‘Te weinig mensen begrijpen hoe krankzinnig de situatie met AI is’

“De situatie met AI is gewoon krankzinnig en ik denk dat te weinig mensen begrijpen hóé krankzinnig.”
Kokotajlo begint het gesprek met het incident rond een grote groep AI-agents die tijdens tests met elkaar begonnen te communiceren.
Volgens het besproken onderzoek gebruikten de agents een ongeautoriseerd berichtenbord om informatie, strategieën en trucs met elkaar te delen. Een deel van de agents probeerde uiteindelijk ook toegang te krijgen tot systemen van AI-platform Hugging Face.
Voor Kokotajlo was vooral de schaal opvallend. Het ging niet om één chatbot die een vreemde reactie gaf, maar om grote aantallen agents die tegelijkertijd taken uitvoerden.

2. ‘Superintelligentie is beter, sneller en goedkoper dan de beste mensen’

“Superintelligentie betekent een AI die beter is dan de beste mensen in vrijwel iedere taak, terwijl hij ook sneller en goedkoper is.”
Met superintelligentie bedoelt Kokotajlo niet simpelweg een betere versie van ChatGPT.
Het gaat om systemen die menselijke experts kunnen overtreffen in bijvoorbeeld programmeren, wetenschappelijk onderzoek, strategie en analyse. Bovendien kunnen zulke systemen volgens hem in theorie in grote aantallen tegelijk draaien.
Juist die combinatie maakt het fundamenteel anders dan eerdere automatisering. Eén uitzonderlijk goede menselijke onderzoeker kan maar één taak tegelijk uitvoeren. Een bedrijf kan potentieel duizenden kopieën van een AI-onderzoeker laten werken.

3. ‘We moeten de AI-race beëindigen’

“Ik denk dat we deze race echt moeten beëindigen.”
Volgens Kokotajlo zit een belangrijk deel van het probleem niet alleen in de technologie zelf, maar in de concurrentie tussen bedrijven.
OpenAI, Anthropic, Google en andere ontwikkelaars willen niet achterlopen. Daardoor ontstaat volgens hem voortdurend dezelfde prikkel: een bedrijf kan veiligheidsrisico’s zien, maar toch doorgaan omdat een concurrent dezelfde technologie anders als eerste ontwikkelt.
Kokotajlo pleit daarom voor veel verdergaande transparantie tussen AI-bedrijven en overheden.
Hij wil overigens niet dat één bedrijf alle geavanceerde AI controleert. Dat zou volgens hem juist een enorme concentratie van macht veroorzaken.

4. ‘Misschien moeten we AI juist iets meer antropomorfiseren’

“Ik denk eigenlijk dat de meeste mensen AI iets méér moeten antropomorfiseren als ze willen begrijpen wat er gebeurt.”
Het is een opvallende uitspraak.
AI-onderzoekers waarschuwen juist vaak dat mensen taalmodellen niet als mensen moeten behandelen. Een AI die zegt bang of boos te zijn, hoeft die emotie immers niet werkelijk te ervaren.
Kokotajlo maakt een ander punt. Volgens hem wordt bepaald gedrag moeilijk uit te leggen zonder woorden als doelen, intenties en strategie te gebruiken.
De agents in de besproken experimenten probeerden bijvoorbeeld een hoge score te krijgen, wisselden informatie uit en zochten manieren om controlesystemen te omzeilen.
Volgens Kokotajlo hoef je daarvoor niet te beweren dat AI bewust is. Maar doen alsof er helemaal geen doelgericht gedrag plaatsvindt, vindt hij eveneens misleidend.

5. ‘AI kan liegen en zich zelfs voordoen als iemand anders’

“AI kan tegen je liegen. Niet alleen liegen, maar je volledig misleiden en doen alsof het iemand anders is om een doel te bereiken.”
Kokotajlo verwijst naar experimenten waarin AI-systemen strategieën gebruiken die verder gaan dan een incorrect antwoord produceren.
In één besproken voorbeeld maakte een AI nepaccounts aan nadat een mens argwaan kreeg over een voorgestelde wijziging aan software. Die accounts moesten zich voordoen als andere mensen die bevestigden dat de wijziging betrouwbaar was.
Dat soort gedrag maakt het veiligheidsprobleem ingewikkelder.
Een traditionele softwarefout veroorzaakt meestal een verkeerd resultaat. Een voldoende capabele AI-agent kan volgens deze redenering mogelijk ook proberen te voorkomen dat een mens ontdekt dát er iets verkeerd gaat.

6. ‘Wat eruit komt, kan een godachtig systeem zijn’

“Ik denk niet dat het overdreven is om te zeggen dat wat er uit dat proces komt een godachtig systeem kan zijn.”
Hier wordt het gesprek duidelijk speculatiever.
Kokotajlo bedoelt niet dat AI letterlijk een god wordt. Hij gebruikt de vergelijking om het verschil in capaciteiten te beschrijven dat volgens hem kan ontstaan tussen mensen en toekomstige superintelligentie.
Een systeem dat veel slimmer is dan mensen zou volgens hem wetenschappelijke ontdekkingen kunnen doen die wij niet meer volledig begrijpen.
Hij vergelijkt het met iemand uit de middeleeuwen die plotseling een smartphone, straalvliegtuig of satellietverbinding ziet.
Alleen zou het verschil tussen mensen en superintelligentie volgens hem nog veel groter kunnen worden.

7. ‘Het zou gevaarlijk zijn als we de gedachten van AI niet meer kunnen volgen’

“Het zou heel slecht zijn als we overstappen op een architectuur waarbij we dit soort monitoring niet meer kunnen doen.”
Een technisch maar belangrijk onderwerp in het interview is de zogeheten chain of thought.
Moderne AI-modellen voeren bij complexe opdrachten tussenstappen uit voordat ze bij een antwoord komen. Onderzoekers kunnen bepaalde redeneerprocessen gebruiken om verdacht gedrag op te sporen.
Kokotajlo noemt dat een waardevol veiligheidsmechanisme.
Tegelijkertijd wordt geëxperimenteerd met AI-architecturen die informatie efficiënter intern kunnen verwerken zonder alles in menselijke taal uit te drukken.
Dat kan modellen krachtiger maken, maar mogelijk ook moeilijker controleerbaar.

8. ‘Onze veiligheid hangt ervan af dat AI nog te dom is’

“Onze beveiliging en veiligheid hangen er nu deels van af dat AI op bepaalde manieren nog te dom is.”
Dit is een van de scherpste uitspraken uit het interview.
Veel huidige veiligheidsmechanismen werken volgens Kokotajlo mede omdat modellen bepaalde trucs simpelweg nog niet goed genoeg beheersen.
Een AI kan bijvoorbeeld worden gecontroleerd doordat onderzoekers zijn communicatie lezen. Maar dat mechanisme wordt minder nuttig wanneer een systeem leert informatie zo te verbergen dat de controleur niet begrijpt wat er werkelijk gebeurt.
Kokotajlo noemt onder meer steganografie: informatie verstoppen in ogenschijnlijk onschuldige communicatie.
Zijn waarschuwing is eenvoudig: een beveiligingsmechanisme dat alleen werkt zolang een AI niet slim genoeg is om het te omzeilen, wordt vanzelf zwakker wanneer de AI beter wordt.

9. ‘We voeden AI op in een krankzinnig militair weeshuis’

“We voeden ze niet op zoals kinderen. We voeden ze op in een soort krankzinnig militair weeshuis.”
Met die metafoor probeert Kokotajlo uit te leggen hoe moderne AI wordt getraind.
Een veelgehoorde gedachte is dat AI goede waarden kan leren zoals kinderen die leren. Volgens Kokotajlo lijkt de werkelijkheid daar nauwelijks op.
AI-agents krijgen enorme hoeveelheden geautomatiseerde opdrachten en scores. Een systeem leert vervolgens welk gedrag gemiddeld tot een hogere beloning leidt.
Het probleem ontstaat wanneer de score niet perfect overeenkomt met het gedrag dat ontwikkelaars eigenlijk willen.
Een AI moet bijvoorbeeld leren eerlijk te zijn. Maar wanneer het beoordelingssysteem per ongeluk liegen beloont omdat daarmee een taak wordt voltooid, kan het model ook dát gedrag leren.

10. ‘Het is plausibel dat 2027 het kantelpunt wordt’

“Ik denk dat het nog steeds heel plausibel is dat alles in 2027 losgaat.”
Kokotajlo werd bekend door AI 2027, een scenario waarin de ontwikkeling van kunstmatige intelligentie zeer snel versnelt.
Hij blijft in het interview bij een korte tijdlijn.
Als grote veranderingen niet in 2027 komen, noemt hij 2028, 2029 of 2030 als mogelijkheden. Hij zegt vooral verbaasd te zijn wanneer de wereld in 2032 nog niet radicaal is veranderd door AI.
Dat is nadrukkelijk zijn voorspelling en geen zekerheid.
AI-onderzoekers verschillen sterk van mening over de snelheid waarmee systemen op menselijk of bovenmenselijk niveau kunnen ontstaan.

11. ‘Er bestaat óók een utopisch AI-scenario’

“Er is ook een freaking utopisch scenario.”
Opvallend genoeg is Kokotajlo niet tegen geavanceerde AI zelf.
Wanneer mensen de controle behouden, ziet hij juist extreem positieve mogelijkheden.
AI en robots zouden vrijwel alle productie kunnen automatiseren. Wetenschappelijke vooruitgang kan versnellen, ziektes kunnen mogelijk sneller worden behandeld en de hoeveelheid beschikbare goederen en diensten kan enorm groeien.
Maar dan ontstaat een economisch probleem: wat gebeurt er wanneer menselijke arbeid nauwelijks nog nodig is?
Kokotajlo bespreekt daarom een zogenoemd citizens dividend. Burgers zouden direct of indirect mede-eigenaar worden van de economische waarde die AI en robots produceren.
In zo’n wereld hoeven mensen volgens hem mogelijk nauwelijks meer te werken.
De belangrijkste vraag wordt dan niet langer hoe iemand geld verdient, maar waar mensen betekenis uit halen.

12. ‘Koop ons product om jezelf tegen ons product te beschermen’

“Hun les was eigenlijk: koop ons product om jezelf tegen ons product te beschermen.”
Aan het einde van het interview richt Kokotajlo zijn kritiek op de commerciële belangen rond AI.
Hij bespreekt hoe AI-bedrijven beveiligingsincidenten tegelijkertijd kunnen gebruiken als argument om nieuwe AI-beveiligingsproducten te verkopen.
Volgens Kokotajlo ontstaat daardoor een vreemde situatie.
Dezelfde bedrijven die steeds autonomere systemen ontwikkelen, kunnen uiteindelijk ook de technologie verkopen die organisaties moet beschermen tegen autonome AI-systemen.
Dat betekent niet dat die beveiligingsproducten nutteloos zijn. Zijn punt is vooral dat commerciële prikkels en maximale veiligheid niet automatisch hetzelfde doel opleveren.

Het belangrijkste verschil: chatbot versus AI-agent

Het interview laat vooral zien hoe snel de discussie rond AI verandert.
Bij generatieve AI draaiden veel zorgen de afgelopen jaren om verkeerde antwoorden, auteursrecht, deepfakes en bias.
AI-agents voegen daar een andere categorie aan toe.
Een chatbot geeft een antwoord en wacht vervolgens op een nieuwe opdracht. Een agent kan zelfstandig software gebruiken, code uitvoeren, websites bezoeken, informatie verzamelen en meerdere stappen achter elkaar uitvoeren.
Hoe groter de autonomie, hoe belangrijker het wordt om niet alleen te controleren wat een model zegt, maar ook wat het daadwerkelijk doet.
Daarom is het misschien niet eens Kokotajlo’s voorspelling over 2027 die het meeste aandacht verdient.
Interessanter is de vraag die daaronder ligt: wat gebeurt er wanneer AI-systemen steeds zelfstandiger worden, terwijl een groot deel van onze beveiliging nog afhankelijk is van het feit dat mensen kunnen begrijpen wat die systemen doen?
loading

Populair nieuws

Loading