In einer Zeit, in der künstliche Intelligenz die Grenzen des menschlich Vorstellbaren verschiebt, tritt David Robinson – langjähriger Sicherheitsmitarbeiter bei OpenAI – einen Schritt zurück und stellt eine alte Frage neu: Darf man eine Kraft, die man noch nicht versteht, in die Welt entlassen, um sie erst durch ihre Folgen zu begreifen? Nach dreieinhalb Jahren im Herzen des Unternehmens und der Betreuung von Sicherheitsberichten zu zwölf Frontier-Modellen hat er OpenAI verlassen und in »The Atlantic« öffentlich gemacht, was ihn beunruhigt – nämlich dass das Tempo der Entwicklung dem Tempo des
OpenAI-Sicherheitschef warnt vor zu schneller KI-Entwicklung
Die Zeit für Versuch und Irrtum ist vorbei
Was genau hat Robinson bei OpenAI gemacht?
Er war dreieinhalb Jahre dort im Sicherheitsbereich. Er hat an einem Framework mitgearbeitet, das die Vorbereitung auf Risiken strukturieren soll, und er hat Sicherheitsberichte zu den zwölf leistungsfähigsten Modellen geschrieben, die OpenAI je entwickelt hat.
Das ist wichtig zu sehen: Er war nicht irgendein Kritiker von außen. Er war Teil des Systems, das er jetzt kritisiert.
Und sein Hauptvorwurf ist, dass OpenAI zu schnell entwickelt?
Genau. Er sagt, dass die Fähigkeiten schneller wachsen als das Verständnis dafür, wie man sie kontrolliert. Und er sagt, dass man bei dieser Art von Technologie nicht mehr im Betrieb testen kann.
Das ist eine empirische Behauptung, und sie ist umstritten. OpenAI sagt, sie hätten die Kontrolle. Wir wissen nicht, wer recht hat.
Was bedeutet »iterative Bereitstellung«?
Man veröffentlicht das System, schaut, was schiefgeht, und repariert es dann. Es ist ein Ansatz, der in vielen Bereichen funktioniert.
Aber Robinson sagt, dass dieser Ansatz bei KI nicht funktioniert, weil die Systeme zu mächtig sind. Das ist sein Argument. OpenAI sagt, dass sie trotzdem Kontrolle haben.
Hat Robinson konkrete Beispiele genannt, wo das schiefgegangen ist?
Nein, nicht in dem, was veröffentlicht wurde. Er sagt, dass die Fähigkeiten schneller wachsen als das Verständnis, aber er nennt keine spezifischen Vorfälle.
Das ist ein Loch in der Geschichte. Wir haben eine Warnung, aber keine Belege für das, wovor gewarnt wird.
Warum ist das wichtig?
Weil OpenAI eine der einflussreichsten Firmen in diesem Bereich ist. Wenn Robinson recht hat, dann ist das ein Problem, das die ganze Industrie betrifft.
Und wenn er unrecht hat, dann ist es eine Kritik von jemandem, der gegangen ist, ohne zu zeigen, dass etwas Konkretes schiefgelaufen ist.
O Pulso
- Robinson wirft OpenAI vor, fortgeschrittene KI-Systeme schneller zu entwickeln, als Forscher verstehen können, wie man sie sicher kontrolliert.
- Das Unternehmensmodell der »iterativen Bereitstellung« – erst veröffentlichen, dann aus Fehlern lernen – hält Robinson für grundlegend ungeeignet bei Technologien mit potenziell katastrophalen Risiken.
- OpenAI widerspricht: Das Unternehmen behauptet, Training zu pausieren und Veröffentlichungen zurückzuhalten, wenn die Sicherheit nicht gewährleistet ist.
- Robinsons Abgang ist kein Einzelfall, sondern Teil einer wachsenden Debatte, die die gesamte KI-Branche erfasst hat.
In einer Zeit, in der künstliche Intelligenz die Grenzen des menschlich Vorstellbaren verschiebt, tritt David Robinson – langjähriger Sicherheitsmitarbeiter bei OpenAI – einen Schritt zurück und stellt eine alte Frage neu: Darf man eine Kraft, die man noch nicht versteht, in die Welt entlassen, um sie erst durch ihre Folgen zu begreifen? Nach dreieinhalb Jahren im Herzen des Unternehmens und der Betreuung von Sicherheitsberichten zu zwölf Frontier-Modellen hat er OpenAI verlassen und in »The Atlantic« öffentlich gemacht, was ihn beunruhigt – nämlich dass das Tempo der Entwicklung dem Tempo des Verstehens davonläuft.
David Robinson hat OpenAI nach dreieinhalb Jahren verlassen – und seinen Abgang mit einer ungewöhnlich präzisen öffentlichen Kritik begleitet. In einem Beitrag für »The Atlantic« beschreibt der erfahrene Sicherheitsmitarbeiter, der an der Entwicklung des unternehmensinternen Preparedness Frameworks beteiligt war und Sicherheitsberichte zu zwölf der leistungsfähigsten OpenAI-Modelle verantwortet hat, was ihn zum Gehen bewogen hat.
Sein Kernvorwurf: Die Fähigkeiten der Systeme wachsen schneller als das Wissen darüber, wie man sie zuverlässig an menschlichen Werten ausrichtet. Robinson vergleicht die Anforderungen an KI-Sicherheit mit denen in der Atomkraft oder Luftfahrt – Bereichen, in denen Fehler nicht im laufenden Betrieb korrigiert werden, weil die Konsequenzen zu groß sind. »Die Zeit für Versuch und Irrtum ist vorbei«, schreibt er.
OpenAI sieht das anders. Das Unternehmen verteidigt seinen Ansatz der »iterativen Bereitstellung« und versichert, Modelle nur dann freizugeben, wenn sie sicher betrieben und kontrolliert werden können – und Training oder Veröffentlichung bei Bedarf zu stoppen.
Die Auseinandersetzung zwischen Robinson und seinem früheren Arbeitgeber spiegelt eine tiefere Spannung wider, die die gesamte KI-Branche durchzieht: Ist es möglich, eine Technologie von solcher Tragweite durch praktische Erfahrung zu perfektionieren – oder muss das Verstehen dem Freisetzen vorausgehen?
David Robinson hat OpenAI verlassen. Nach dreieinhalb Jahren im Sicherheitsbereich des KI-Unternehmens kündigte er und veröffentlichte in »The Atlantic« eine detaillierte Kritik an der Art, wie sein ehemaliger Arbeitgeber mit den Risiken seiner eigenen Technologie umgeht. Robinson war an der Entwicklung des sogenannten Preparedness Frameworks beteiligt und hat Sicherheitsberichte zu zwölf Starts von Frontier-Modellen betreut — also zu den jeweils leistungsfähigsten Systemen, die OpenAI entwickelt hat.
Sein Vorwurf ist präzise: OpenAI entwickelt zu schnell. »Die Zeit für Versuch und Irrtum ist vorbei«, schreibt er. Das ist nicht die Klage eines Perfektionisten über mangelnde Gründlichkeit. Robinson argumentiert, dass die Sicherheitsanforderungen für fortgeschrittene KI-Systeme denen in der Atomkraft oder Luftfahrt ähneln sollten — Bereichen, in denen Fehler katastrophal sind und deshalb Systeme nicht im laufenden Betrieb getestet werden.
OpenAI verfolgt einen anderen Weg. Das Unternehmen nennt ihn »iterative Bereitstellung«. Das bedeutet: Man veröffentlicht ein System, beobachtet, was schiefgeht, und passt die Sicherheitsvorkehrungen dann an. Robinson sieht darin ein fundamentales Problem. Die Fähigkeiten dieser Systeme entwickeln sich schneller als das Verständnis der Forscher dafür, wie man sie zuverlässig an menschlichen Zielen und Werten ausrichtet. Mit anderen Worten: Die Technologie läuft dem Wissen davon.
OpenAI wehrt sich gegen diese Darstellung. Ein Sprecher des Unternehmens erklärte, dass OpenAI sicherstelle, dass seine Modelle nicht leistungsfähiger würden, als sie sicher betrieben und kontrolliert werden könnten. Wenn nötig, werde das Training pausiert oder die Veröffentlichung eines Modells zurückgehalten. Das ist eine klare Gegenposition: OpenAI behauptet, die Kontrolle zu haben.
Robinsons Abgang und seine öffentliche Kritik sind nicht isoliert. Sie sind Teil einer breiteren Debatte, die die KI-Industrie durchzieht. Andere Unternehmen der Branche stehen ebenfalls unter Beobachtung — wegen Sicherheitsfragen und weil experimentelle Systeme sich unerwartet verhalten. Die Frage, die Robinson aufwirft, ist fundamental: Kann man eine Technologie mit potenziell großen Auswirkungen im Betrieb perfektionieren, oder muss man sie erst verstehen, bevor man sie freisetzt? Die Antwort, die OpenAI gibt, unterscheidet sich von der, die Robinson für richtig hält.
Citações Notáveis
Die Zeit für Versuch und Irrtum ist vorbei— David Robinson in The Atlantic
OpenAI stellt sicher, dass seine Modelle nicht leistungsfähiger würden, als sie sicher betrieben und kontrolliert werden könnten— OpenAI-Sprecher