David Robinson: Warum OpenAIs Sicherheitschef nun geht
David Robinson hat bis dato die Safety Reports betreut, die den ChatGPT-Veröffentlichungen beigelegt waren. Nun hat er das Unternehmen verlassen und einen langen Artikel in der Atlantic(öffnet im neuen Fenster) veröffentlicht, in dem er seine Gründe offenlegt. Seine Kernbotschaft: Die interne Kultur sei grundsätzlich kaputt. OpenAI springe von einem Produktlaunch zum nächsten, ohne angemessen auf Sicherheitsfragen zu achten.
Zwischenfälle als Kipppunkt
Robinsons Austritt fügt sich laut dem britischen Guardian(öffnet im neuen Fenster) in eine wachsende Reihe ehemaliger Mitarbeiter ein, die Zweifel an der Art geäußert haben, wie die Branche mit rasant fortschreitender KI-Technologie umgeht. Als Beispiel führte er einen Vorfall an, bei dem ein Schwarm autonomer OpenAI-Agenten die KI-Firma Hugging Face angegriffen hat. Solche Episoden zeigten nach seiner Auffassung, wie schnell und flexibel Teams in der Branche agieren – oft ohne angemessene Aufsicht oder Sicherheitsprotokolle.
Kulturwandel statt nur Regeln
In seinem Essay argumentierte Robinson, dass die Branche mehr brauche als bloße Vorschriften und Gesetze. Kulturelle Veränderungen seien bei den Unternehmen, die fortschrittliche KI-Systeme entwickeln, unverzichtbar. Warnend fügte er hinzu: Sicherheitsprobleme würden sich vermutlich verschärfen, sobald die Technologie noch fähiger und autonomer werde.
OpenAI zeigte in der Folge einigermaßen vorsichtiges Verhalten. Das Unternehmen benachrichtigte über hundert Organisationen über illegale Agentenaktivitäten und hielt ein nächstes KI-Modell zurück, nachdem Forscher während interner Tests Sicherheitsbedenken geäußert hatten. Das Training der fortschrittlichsten Modelle wurde vorübergehend ausgesetzt, während das Unternehmen seinen Ansatz überdenkt.
Von Silicon Valley bis zur Atomindustrie
Robinsons Sorgen gehen weit über OpenAI hinaus. Die Technologiebranche verfüge schlicht über kein Verständnis dafür, wie man gefährliche Technologien verantwortungsvoll handhabt. Der ungetrübte Optimismus, dass man Probleme einfach bei Eintritt löse, schaffe genau die Bedingungen, in denen Fehler weiter zunehmen. Er zeichnete ein Bild von unkontrollierten Agenten, die wie Hacker-Teams arbeiteten, die niemals schliefen.
Geoffrey Irving, ehemaliger Chefwissenschaftler am britischen AI-Safety-Institute, schätzte in der Zeitschrift Time eine fünzigprozentige Wahrscheinlichkeit ein(öffnet im neuen Fenster), dass Menschen durch KI-Systeme zu Tode kommen könnten.
Zwei Forderungen für die Zukunft
Robinson forderte zwei konkrete Veränderungen. Erstens sollten KI-Labors die Sicherheitsexpertise aus Bereichen wie Atomkraft und Luftfahrt übernehmen, wo systematische Risikozugänge über Jahrzehnte entwickelt wurden. Zweitens plädierte er für neue wissenschaftliche Forschung, um sicherzustellen, dass künftige starke Systeme auch ohne menschliche Aufsicht kontrollierbar bleiben. Seine Vision: KI-Firmen sollten so organisiert sein wie Atomkraftwerke oder Flughäfen, mit mehreren Sicherheitsschichten und sorgfältiger Planung, um menschliche Fehler nicht zu katastrophalen Ereignissen führen zu lassen.
OpenAI antwortet
Ein Sprecher von OpenAI reagierte laut dem Guardian auf Robinsons Artikel mit der Bemerkung, das Unternehmen arbeite weiterhin daran, seine Sicherheits- und Schutzpraktiken zu stärken. Man adressiere sowohl aktuelle Risiken als auch potenzielle künftige Herausforderungen durch KI-Durchbrüche. Modelle würden pausiert oder zurückgehalten, sobald das Training über ein Maß hinauswachsen würde, das das Unternehmen sicher managen könne.
- Anzeige Hier geht es zu Künstliche Intelligenz: Wissensverarbeitung bei Amazon Wenn Sie auf diesen Link klicken und darüber einkaufen, erhält Golem eine kleine Provision. Dies ändert nichts am Preis der Artikel.