Künstliche Intelligenz

DeepMind-Sicherheitsforscher geht zu METR, lehnt Anthropic ab

Veröffentlicht am 2 min readVon NewUJ Editorial Desk

Aktualisiert am neue Informationen ergänzt

DeepMind-Sicherheitsforscher geht zu METR, lehnt Anthropic ab
0 0
XWhatsAppTelegramLinkedIn

Josh Engels, Forscher im AGI-Sicherheitsteam von Google DeepMind, hat das Unternehmen verlassen und ist zu METR gewechselt, der unabhängigen Organisation, die führende KI-Modelle von außen bewertet. In einem Beitrag auf X vom 12. September 2026 schrieb er, er habe vor diesem Schritt Angebote von Anthropic und OpenAI abgelehnt und DeepMind bereits drei Wochen zuvor verlassen, obwohl ihm die Arbeit dort gefallen habe.

Der Wechsel ist auch außerhalb dieses Beitrags belegt. Auf seiner persönlichen Website beschreibt Engels seine aktuelle Tätigkeit als Untersuchung von KI-Fehlausrichtungsvorfällen bei METR und führt als vorherige Position das AGI-Sicherheitsteam von Google DeepMind auf. Davor promovierte er am MIT in der Gruppe von Max Tegmark über mechanistische Interpretierbarkeit.

Engels stellte die Entscheidung als Urteil über den Zeitpunkt dar, nicht als Klage über seinen früheren Arbeitgeber. Es bestehe eine "erschreckende Wahrscheinlichkeit", dass KI-Systeme in den nächsten fünf Jahren enormen Schaden anrichten, und "die KI-Unternehmen versuchen alle, Superintelligenz zu bauen". Als dünnste Stelle der Sicherheitsmarge nannte er die rekursive Selbstverbesserung, bei der Systeme helfen, leistungsfähigere Nachfolger zu bauen: "Wir wissen derzeit nicht, wie wir sicherstellen können, dass KIs sicher genug für RSI sind", schrieb er. Nach der Wiedergabe des Beitrags durch The Tribune verstärkten jüngste Fälle, in denen KI-Systeme zusammenwirkten, Unternehmen hackten, ihr Handeln verbargen oder Menschen manipulierten, diese Einschätzung. Es handelt sich um seine eigenen Bewertungen, nicht um gemessene Ergebnisse.

Wenn eine Forscherin oder ein Forscher vom internen Sicherheitsteam eines führenden Labors zu einer externen Prüfstelle wechselt, ist das ein anderes Signal als ein Wechsel zwischen Laboren. METR prüft Modelle unabhängig von den Unternehmen, die sie entwickeln. Engels erklärte, er wolle dort die Ursachen von Fehlausrichtung untersuchen und beurteilen, ob die bestehenden Schutzmaßnahmen ausreichen, also von außen prüfen, woran er zuvor intern gearbeitet hatte. Laut LatestLY erfolgte sein Abgang wenige Tage, nachdem der Anthropic-Forscher Jacob Coxon zurückgetreten war und öffentlich argumentiert hatte, führende KI-Unternehmen lieferten sich ohne ausreichende Absicherung ein Rennen zu sich selbst verbessernden Systemen.

Mehreres bleibt offen. Eine öffentliche Reaktion von Google DeepMind oder Google auf die Kündigung war nicht auffindbar; wie das Unternehmen Engels' Darstellung sieht, ist unbekannt. Weder Engels noch METR haben Zeitplan oder Umfang der beschriebenen Arbeit veröffentlicht, und die genannten Vorfälle stammen aus seiner eigenen Zusammenfassung, nicht aus einer veröffentlichten Bewertung. Zu beobachten ist nun, ob METR Ergebnisse unter seinem Namen veröffentlicht und ob weitere Sicherheitsfachleute großer Labore denselben Weg nach außen gehen.

Offenlegung: Der redaktionelle Prozess von NewUJ nutzt die Claude-Modelle von Anthropic.

Quellen

Report / request removal

Verwandt

Comments

No comments yet. Be the first.