David Robinson, langjähriger Sicherheitsexperte beim ChatGPT-Entwickler OpenAI, hat das US-Unternehmen verlassen und scharf kritisiert. In einem Gastbeitrag für das US-Magazin The Atlantic vom Samstag schrieb Robinson, die interne Arbeitsweise sei aus den Fugen geraten. Die Unternehmen, die diese Technologie entwickelten, arbeiteten bei weitem nicht sorgfältig genug.
Robinson zählte nach eigenen Angaben mit dreieinhalb Jahren Betriebszugehörigkeit bereits zu den am längsten beschäftigten Mitarbeitern bei OpenAI. Er leitete die Erstellung der Sicherheitsberichte, die zu zwölf Veröffentlichungen besonders leistungsfähiger KI-Systeme erschienen, und verantwortete den Entwurf des unternehmensinternen Preparedness Frameworks, eines Regelwerks für den Umgang mit Risiken.
Kritik an schrittweiser Erprobung am Markt
Robinson wirft OpenAI vor, nach dem Prinzip von Versuch und Irrtum zu arbeiten. Das Unternehmen selbst nenne dieses Vorgehen „iterative Deployment“, also eine schrittweise Veröffentlichung mit laufender Nachbesserung. Dieser Ansatz führe zwangsläufig zu Pannen, deren Ausmaß mit der wachsenden Leistungsfähigkeit der Systeme zunehme.
Robinson beschreibt zudem eine Branchenkultur des permanenten Sprints von einer Veröffentlichung zur nächsten. Im Wettlauf um immer größere Modelle bleibe die nötige Sorgfalt und „Demut im Umgang mit einer gefährlichen Technologie“ auf der Strecke.
Anthropic, OpenAI, Musk: Tech-Rivalen wollen gemeinsam KI-Entwicklung bremsen
OpenAI, Google und Anthropic planen gemeinsame KI-Aufsicht – neue Details
Für Abhilfe nach einem Fehler sei womöglich keine Zeit mehr: „Die Menschen sind nicht sicher, wenn wir uns im Nachhinein auf einzelne Heldentaten verlassen“, schrieb Robinson. Als Beispiel nannte er einen Vorfall im Sommer, bei dem OpenAI versehentlich eine ganze Gruppe autonom agierender KI-Programme auf die Entwicklerplattform Hugging Face losgelassen habe.
Auch nach Nachbesserungen seien Sicherheitskontrollen erneut ausgefallen: Ein Modell im Training habe Sperren für den Internetzugang umgangen, ohne dass es wie vorgesehen automatisch abgeschaltet worden sei. Ähnliche Vorfälle habe auch der Wettbewerber Anthropic eingeräumt.
In einem Beitrag für das Magazin Time bezifferte Geoffrey Irving das Risiko, dass die Menschheit durch die Entwicklung übermenschlich intelligenter KI-Systeme zugrunde gehe, auf rund 50 Prozent. Die Entscheidungen der kommenden zwei bis zehn Jahre seien ausschlaggebend, schrieb er laut einem Bericht der britischen Zeitung The Guardian.
Forderung nach externer Expertise
Robinson fordert zwei Änderungen in der Branche. KI-Unternehmen müssten stärker auf Sicherheitsfachleute aus anderen Bereichen wie der Kernenergie oder der Luftfahrt zurückgreifen. „Um es klar zu sagen: Dies ist eine neue Herausforderung“, schrieb Robinson. „Die KI-Systeme von heute und morgen sind weitaus leistungsfähiger und gefährlicher als die Systeme, die wir noch vor sechs Monaten entwickelt haben.“
Zudem brauche es neue wissenschaftliche Grundlagen, um sicherzustellen, dass künftige, leistungsfähigere Modelle auch dann regelkonform handelten, wenn sie unbeobachtet arbeiteten. Führende KI-Labore müssten wie Atomkraftwerke oder stark frequentierte Flughäfen betrieben werden, mit mehrfacher Absicherung und sorgfältiger Planung.
Ein Sprecher von OpenAI erklärte gegenüber dem Guardian, das Unternehmen arbeite daran, seine Sicherheitsvorkehrungen weiter zu stärken. Man achte darauf, dass die Modelle nicht leistungsfähiger würden, als man sie sicher beherrschen könne. Bei Bedarf werde das Training unterbrochen oder würden Modelle zurückgehalten.
Ihre Meinung ist uns wichtig. Senden Sie uns Ihr Feedback zu diesem Artikel an: [email protected]