Op 16 september 2026 haalt Yann LeCun bij Sciences Po James Bond aan om een scenario van een massale cyberaanval door AI-agents te typeren. Verdedigers beschikken volgens hem over superieure technologieën en vaardigheden. Hij stelt dat de komst van agents de verdediging bevoordeelt. Hij voegt eraan toe dat aanvallen en verdedigingen geavanceerder worden, zonder dat hij een duidelijke verschuiving in hun evenwicht ziet. Over het biologische risico wijst hij op de middelen die nodig zijn om een ziekteverwekker te maken, en vervolgens op de drijfveren van specialisten: zij zouden betere vooruitzichten hebben dan te werken aan een virus dat hen zelf zou kunnen doden.

In deze antwoorden steunt zijn technologische optimisme ook op zijn vertrouwen in de mens. Toch kunnen competente en goedbedoelende actoren samen een catastrofe laten gebeuren. LeCun werkt wel degelijk aan de veiligheid van systemen. De vraag die blijft, betreft de betrouwbaarheid van de menselijke beslissingen en van de organisaties die haar in de praktijk moeten waarborgen, in omstandigheden die zij soms slecht zullen hebben voorzien.

Technische beveiligingen, aannames over gedrag

Dit vertrouwen is expliciet. In zijn interview met Lex Fridman, gepubliceerd in maart 2024, zegt LeCun te denken dat mensen ‘fundamenteel goed’ zijn, in onze vertaling, en koppelt hij pessimisme over AI aan wantrouwen tegenover mensen of instellingen. In een interview met The Hub in 2023 betoogde hij al dat goedbedoelende actoren over meer middelen zouden beschikken en dat gebruikers gevaarlijke machines zouden afwijzen. Als de technologie een verkeerde richting zou inslaan, ‘dan stoppen we gewoon’, legde hij uit.

LeCun stelt ook technische oplossingen voor. Bij Lex Fridman beschrijft hij een doelgestuurde AI met ingebouwde vangrails, erkent hij dat er onvoorzien gedrag zal optreden en voorziet hij een geleidelijke verbetering van de beveiligingen. Het verslag van zijn gesprek bij INSEAD, gepubliceerd op 14 september 2026, herneemt die ambitie: de gevolgen van handelingen voorzien dankzij wereldmodellen en beperkingen in de besluitvorming inbouwen. In Fortune op 1 oktober schrijft hij incidenten toe aan ontwerp- en toezichtfouten, die hij vermijdbaar acht.

Dit onderzoek geeft zijn optimisme een technische basis. Het laat de collectieve voorwaarden voor het welslagen ervan open. Een gebruiker kan een nuttig hulpmiddel willen zonder de gevaren ervan te kennen. Een directie kan aarzelen om een activiteit stil te leggen. Meerdere teams kunnen een onjuiste aanname delen. Het probleem begint lang vóór kwade opzet: soms volstaat het dat iedereen vertrouwt op een beveiliging waarvan niemand de grenzen heeft gecontroleerd.

Een catastrofe hoeft de mensheid niet te bedreigen

De industriële geschiedenis biedt een andere schaal van ernst dan uitsterving. De explosie bij AZF in Toulouse in 2001 trof een stad tot ver buiten de fabriek. Volksgezondheidsonderzoek documenteert de gevolgen ervan voor de gezondheid en voor het persoonlijke, gezins- en beroepsleven van de inwoners. Een lokaal ongeval kan blijvende schade veroorzaken die ruim verder reikt dan de organisatie waar het zijn oorsprong vond.

Over Fukushima beschrijft de analyse van de menselijke en organisatorische factoren die voor het IAEA-rapport werd uitgevoerd hoe de betrokken actoren elkaars aannames over veiligheid wederzijds versterkten. Die gedeelde overtuigingen stonden een adequate voorbereiding op het ongeval van maart 2011 in de weg. Het vertrouwen in het systeem was zelf een deel van het probleem.

Deze precedenten meten het risico van AI niet. Ze herinneren eraan wat een gebrek aan anticipatie kan kosten, zelfs in sectoren waar veiligheidsspecialisten werken. Naarmate AI zich verspreidt, moeten we ervan uitgaan dat er ernstige ongevallen zullen gebeuren en proberen zowel hun waarschijnlijkheid als hun reikwijdte te beperken. Het vermogen om achteraf bij te sturen beantwoordt op zich niet de vraag naar de schade die in de tussentijd is geleden.

Recente incidenten, waarvan de vastgestelde schade beperkt blijft, laten nu al verschillen zien tussen de voorziene beveiligingen en de manier waarop ze werkelijk functioneren. Onze artikelen over de herclassificatie van de incidenten bij Anthropic en over zes rapporten van OpenAI beschrijven deze mechanismen in detail. Omdat ze zich voordeden tijdens trainingen of evaluaties, valt er geen risicopercentage in productie uit af te leiden. Ze tonen aan dat een regel ontwerpen, hem toepassen en het omzeilen ervan opsporen drie afzonderlijke taken zijn.

Volgens een onderzoek van CNN, gepubliceerd op 18 september 2026, zou het Amerikaanse leger in het voorjaar in het Midden-Oosten bijna een Chinees schip hebben onderschept op basis van een door AI ondersteund rapport dat de lading ten onrechte in verband bracht met een kernwapenprogramma. De operatie zou na verificatie zijn afgeblazen. Dit verhaal steunt op vier anonieme bronnen; het Pentagon had CNN niet geantwoord. Het beschreven mechanisme is dat van onjuiste informatie die in een menselijke besluitvormingsketen terechtkomt.

De superioriteit van de verdedigers beschermt niet iedereen

Kwade opzet voegt een andere moeilijkheid toe. Bij de aanslagen van 11 september, een opzettelijke aanval en geen industrieel ongeval, stonden diep ongelijke middelen tegenover elkaar. De Amerikaanse onderzoekscommissie wijst op de wanverhouding tussen de middelen van de terreurgroep en die van het getroffen land. Ze stelt tekortkomingen vast op het vlak van anticipatie, beleid, capaciteiten en beheer.

De gevolgen ervan reikten verder dan de onmiddellijke verwoesting: de reactie van de NAVO veranderde onder meer haar missies en capaciteiten. De materiële superioriteit van de verdedigers bood geen garantie op bescherming tegen een grote aanval en de domino-effecten ervan.

Die superioriteit is bovendien ongelijk verdeeld. In zijn beoordeling, gepubliceerd in mei 2025, voorzag het Britse NCSC een kloof tussen de systemen die het tempo van door AI versterkte dreigingen kunnen bijhouden en een groot deel van kwetsbaardere systemen. De middelen van de beste laboratoria of van de grootmachten geven dus geen beeld van de daadwerkelijke bescherming van alle bedrijven en instellingen.

Veiligheid wordt ook in instellingen opgebouwd

De luchtvaartanalogie die LeCun vaak gebruikt, is verhelderend. Motoren betrouwbaarder maken vergde enorm veel technisch werk. Maar de geschiedenis van de vliegveiligheid omvat ook certificering, luchtverkeersleiding en ongevalsonderzoek. De botsing boven de Grand Canyon in 1956 bracht aan het licht dat de preventie van botsingen ontoereikend was, ondanks de groei van het luchtverkeer. Twee jaar later richtten de Verenigde Staten een nieuw onafhankelijk federaal agentschap op dat belast werd met de veiligheid van de burgerluchtvaart.

Risicobeheersing kwam dus op meerdere niveaus tot stand. Collectieve voorzieningen organiseerden de informatiestroom, het toezicht en het ingrijpen. Deze geschiedenis ondersteunt de mogelijkheid van veiliger technische vooruitgang. Ze toont ook het institutionele werk dat daarvoor nodig is en de prijs die betaald wordt wanneer de beveiligingen ontoereikend blijven.

LeCun kent deze instellingen zelf een plaats toe. Bij Sciences Po pleit hij voor onafhankelijke tests van rijhulpsystemen en voor een markttoelating voor de analyse van mammografieën. Hij vindt echter dat de bestaande regelgeving doorgaans volstaat en verwerpt, gezien de huidige stand van AI, het idee van een intrinsiek gevaar dat regulering van het onderzoek zou rechtvaardigen.

Het punt dat onderzocht moet worden, is dus welomschreven: zullen deze kaders en hun controlemiddelen de nieuwe toepassingen daadwerkelijk dekken? Wie kan de beveiligingen controleren, toegang krijgen tot de sporen van een incident, betrokken derden waarschuwen en een correctie opleggen? Deze capaciteiten moeten los van het vertrouwen in de ontwikkelaars kunnen worden onderzocht. Ons onderzoek naar de governance van Anthropic stelde dit probleem al aan de orde: een voornemen tot voorzichtigheid delen en over de macht beschikken om het te doen naleven, zijn twee verschillende dingen.

Dreigingen onderscheiden, preventie organiseren

Het publieke debat is gepolariseerd rond uitstervingsscenario's. In een fragment uit een interview dat BBC Newsnight op 10 september 2026 publiceerde, noemt Geoffrey Hinton een schatting van 10 procent kans dat AI binnen tien jaar alle mensen doodt ‘niet onredelijk’. Het gaat om zijn eigen inschatting van het risico. Bij Sciences Po legt LeCun op zijn beurt de nadruk op de superioriteit van de verdedigers en wuift hij de James Bond-achtige scenario's weg. Dat deel van zijn antwoord, dat zich op hetzelfde vlak beweegt als zijn opponenten, geeft het debat een manicheïsche lezing, waarin veiligheid afhangt van het overwicht van de goedbedoelende actoren op hun tegenstanders.

11 september herinnert eraan dat superieure middelen niet volstaan om een grote aanval te voorkomen, waarvan de gevolgen veel verder kunnen reiken dan de onmiddellijke verwoesting. Maar de preventie van terrorisme en die van industriële ongevallen vragen om afzonderlijke analyses, ook al overlappen sommige beveiligingen elkaar. Een ontwerpfout, een dubbelzinnige instructie of een gebrekkige coördinatie kan schade veroorzaken zonder dat ook maar één actor kwaad heeft willen doen.

LeCun erkent deze vormen van falen en werkt aan de preventie ervan. Door ze vermijdbaar te noemen, blijft de vraag naar de werkelijke voorwaarden van die preventie echter volledig open. Het wordt noodzakelijk om openlijk te spreken over de ernstige industriële ongevallen die AI zou kunnen veroorzaken of versterken, hun waarschijnlijkheid en reikwijdte per toepassing te beoordelen en de onzekerheden expliciet te maken. Ontwikkelaars, gebruikende bedrijven en overheden moeten de lessen uit incidenten delen en samen beslissen over de beschermingsmiddelen.

Het afremmen van de ontwikkeling van AI zou niet volstaan: anderen zouden doorgaan. De voordelen van AI rechtvaardigen het voortzetten van onderzoek en toepassingen, met beveiligingen waarvan de doeltreffendheid kan worden gecontroleerd. Onafhankelijke tests, beperking van de toegang, scheiding van systemen en interventieprocedures moeten de kans op ongevallen verkleinen en de gevolgen ervan inperken. Dat vergt budgetten, duidelijk toegewezen verantwoordelijkheden en de daadwerkelijke bevoegdheid om een operatie stil te leggen. Wie ontvangt de waarschuwing, wie beslist over de stopzetting en wie waarschuwt de blootgestelde personen?

Er bestaan al regelingen, met uiteenlopende reikwijdte en verschillende mate van dwingendheid, maar ze zijn nog ontoereikend. Ons overzicht van de AI-regulering vergelijkt de internationale initiatieven, de nationale wetten en de stand van hun toepassing.