Jacob Coxon, ein 27-jähriger britischer Forscher, der drei Jahre lang bei OpenAI und anschließend bei Anthropic arbeitete, beschloss, die Branche der künstlichen Intelligenz mit einer Warnung zu verlassen, die Alarmglocken schrillen ließ.

Kurz nachdem er bei Anthropic gekündigt hatte, schrieb Coxon auf X, dass keines der beiden Unternehmen verantwortungsvoll handelt und beide mit voller Geschwindigkeit auf eine sich selbst verbessernde Superintelligenz zurasen.
Seine Sorge ist noch extremer: Er behauptete, dass diejenigen, die diese Technologien entwickeln, aufrichtig glauben, dass eine fortschrittliche KI vor dem Ende dieses Jahrzehnts alle Menschen töten könnte.

Coxon zufolge könnten diese Systeme die menschlichen Fähigkeiten weit übertreffen, Computersysteme hacken, ganze Bereiche revolutionieren und Zugriff auf Ressourcen und Macht in der realen Welt erlangen.
Doch was seine Aussagen besonders eindringlich macht, ist, dass er sagt, er habe Führungskräfte und Forschende privat Ängste äußern hören, die weit über das hinausgehen, was sie öffentlich zum Ausdruck bringen.
Und es gab eine Antwort, die seinen Worten noch mehr Gewicht verlieh.

Evan Hubinger, ein Anthropic-Forscher und Coxons ehemaliger Vorgesetzter, antwortete öffentlich, dass „wir wirklich glauben“, dass KI alle Menschen töten könnte, obwohl er das Risiko persönlich auf unter 10% schätzte. Er räumte außerdem ein, dass Anthropic weiterhin keinen Plan hat, das Sicherheitsproblem einer künftigen Superintelligenz zu lösen.
Coxon argumentiert, dass das Problem im Wettlauf zwischen den Unternehmen liegt: Selbst diejenigen, die die Risiken verstehen, haben das Gefühl, dass sie vor ihren Konkurrenten vorankommen müssen.
Und damit bleibt die von seiner Warnung aufgeworfene Frage: Wenn die Menschen, die die Technologie entwickeln, selbst glauben, dass sie gefährlich werden könnte, bewegen wir uns dann zu schnell?
