Jacob Coxon, un ricercatore britannico di 27 anni che ha lavorato per tre anni presso OpenAI e successivamente presso Anthropic, ha deciso di lasciare il settore dell’intelligenza artificiale con un avvertimento che ha fatto scattare campanelli d’allarme.

Poco dopo essersi dimesso da Anthropic, Coxon ha scritto su X che nessuna delle due aziende si sta comportando responsabilmente e che entrambe stanno correndo a tutta velocità verso una superintelligenza auto-migliorante.
La sua preoccupazione è ancora più estrema: ha affermato che chi sviluppa queste tecnologie crede sinceramente che un’IA avanzata potrebbe uccidere tutti gli esseri umani prima della fine di questo decennio.

Secondo Coxon, questi sistemi potrebbero superare di gran lunga le capacità umane, hackerare i sistemi informatici, rivoluzionare interi settori e ottenere accesso a risorse e potere nel mondo reale.
Ma ciò che rende particolarmente sorprendenti le sue dichiarazioni è che dice di aver sentito dirigenti e ricercatori esprimere in privato timori molto più grandi di quelli che manifestano pubblicamente.
E poi è arrivata una risposta che ha dato alle sue parole un peso ancora maggiore.

Evan Hubinger, un ricercatore di Anthropic ed ex responsabile di Coxon, ha risposto pubblicamente che «crediamo davvero» che l’IA potrebbe uccidere tutti gli esseri umani, sebbene abbia stimato personalmente che tale rischio sia inferiore al 10%. Ha anche riconosciuto che Anthropic non ha ancora alcun piano per risolvere il problema della sicurezza di una futura superintelligenza.
Coxon sostiene che il problema sia la competizione tra le aziende: persino coloro che comprendono i rischi sentono di dover andare avanti prima dei concorrenti.
E questo lascia aperta la domanda sollevata dal suo avvertimento: se proprio le persone che stanno costruendo questa tecnologia credono che potrebbe diventare pericolosa, ci stiamo muovendo troppo velocemente?
