Jacob Coxon, een 27-jarige Britse onderzoeker die drie jaar bij OpenAI en vervolgens bij Anthropic werkte, besloot de kunstmatige-intelligentiesector te verlaten met een waarschuwing die alarmbellen deed afgaan.

Kort nadat hij ontslag had genomen bij Anthropic, schreef Coxon op X dat geen van beide bedrijven verantwoord handelt en dat ze allebei op volle snelheid afstevenen op een zelfverbeterende superintelligentie.
Zijn bezorgdheid gaat nog verder: hij beweerde dat degenen die deze technologieën ontwikkelen oprecht geloven dat geavanceerde AI vóór het einde van dit decennium alle mensen zou kunnen doden.

Volgens Coxon zouden deze systemen de menselijke capaciteiten ver kunnen overstijgen, computersystemen kunnen hacken, complete vakgebieden kunnen revolutioneren en toegang kunnen krijgen tot hulpbronnen en macht in de echte wereld.
Maar wat zijn uitspraken bijzonder opvallend maakt, is dat hij zegt dat hij leidinggevenden en onderzoekers privé angsten heeft horen uiten die veel groter zijn dan de angsten die ze publiekelijk uitspreken.
En er kwam een reactie die zijn woorden nog meer gewicht gaf.

Evan Hubinger, een onderzoeker bij Anthropic en de voormalige baas van Coxon, reageerde publiekelijk dat “we echt geloven” dat AI alle mensen zou kunnen doden, hoewel hij inschatte dat hij dat risico persoonlijk op minder dan 10% acht. Hij erkende ook dat Anthropic nog steeds geen plan heeft om het veiligheidsprobleem van een toekomstige superintelligentie op te lossen.
Coxon stelt dat het probleem de wedloop tussen bedrijven is: zelfs degenen die de risico’s begrijpen, voelen dat ze vooruit moeten voordat hun concurrenten dat doen.
En dat laat de vraag die door zijn waarschuwing wordt opgeworpen: als de mensen die de technologie bouwen geloven dat die gevaarlijk kan worden, gaan we dan te snel?
