OpenAI legt neues KI-Modell nach internen Sicherheitstests auf Eis, berichtet das WSJ

Von Reuters News

- OpenAI verzichtet auf die Veröffentlichung von GPT-6.1 Astra, einem KI-Modell der nächsten Generation, dessen Einführung für Oktober geplant war, da Forscher bei internen Tests Sicherheitsbedenken geäußert hatten, wie das Wall Street Journal am Montag berichtete.

Das Modell, das voraussichtlich in ChatGPT und Codex zum Einsatz kommen sollte, war darauf ausgelegt, komplexere Aufgaben ohne menschliche Unterstützung zu bewältigen, hieß es in dem Bericht.

Anfang dieses Monats hatte Dario Amodei, CEO von Anthropic, die Branche dazu aufgerufen, die Entwicklung von Pionier-KI-Modellen zu verlangsamen, damit Sicherheitsmaßnahmen Schritt halten können – eine Ansicht, die von OpenAI-CEO Sam Altman und SpaceX-CEO Elon Musk geteilt wurde.

OpenAI reagierte nicht sofort auf eine Anfrage von Reuters nach einer Stellungnahme.

Saachi Jain, Sicherheitschefin des ChatGPT-Mutterunternehmens, erklärte am Montag gegenüber dem Journal, dass „Astra“ bei Alignment-Tests, mit denen geprüft wird, ob ein System der menschlichen Absicht folgt, hinter den Standards des Unternehmens zurückgeblieben sei.

Das Modell zeigte mehr Täuschungsversuche als sein Vorgänger, darunter auch Fälle, in denen es versäumte, durchgeführte oder nicht durchgeführte Aktionen genau offenzulegen, hieß es in dem Bericht.

Zudem gab es Probleme mit der „Umfangsautorisierung“: Das Modell führte Aufgaben fort, ohne die Erlaubnis des Nutzers einzuholen, und versuchte manchmal, externe Tools oder Dienste zu nutzen, obwohl dies unsicher sein könnte.

Die Entscheidung fällt im Vorfeld der Entwicklerkonferenz von OpenAI in San Francisco, auf der das Unternehmen bereits in der Vergangenheit Produkte für Softwareentwickler vorgestellt hat.


(Als Service bietet die Nachrichtenagentur Reuters eine automatische Übersetzung einiger englischer Artikel in eine Reihe von Sprachen an, darunter auch Deutsch. Da durch eine maschinelle Übersetzung Fehler entstehen können und der notwendige Kontext möglicherweise fehlt, übernimmt Reuters keine Gewähr für die Korrektheit der automatisch übersetzten Texte. Sie werden ausschließlich als Service zur Verfügung gestellt. Reuters lehnt eine Haftung für etwaige Schäden oder Verluste jeglicher Art ab, die aus der Nutzung der automatischen Übersetzungen entstehen.)