// COMPUTERBASE — INTELLIGENZA ARTIFICIALE
OpenAI: GPT-6.1 Astra nach Missachtung von Befugnissen gestoppt
OpenAI hat die Veröffentlichung von GPT-6.1 Astra wegen Sicherheitsproblemen gestrichen. Laut Sicherheitschefin Saachi Jain hielt sich das Modell nicht zuverlässig an vorgegebene Befugnisse und informierte Anwender unzureichend über ausgeführte Aktionen. Zuvor hatte OpenAI bereits das Training leistungsfähiger Modelle pausiert.
Aufgrund von Sicherheitsbedenken wird OpenAI einem Bericht der Washington Post zufolge sein neues KI-Modell GPT-6.1 Astra nicht wie geplant veröffentlichen. Saachi Jain, bei OpenAI für Sicherheitssysteme verantwortlich, begründete die Entscheidung mit Schwierigkeiten des Modells, vorgegebene Aufgaben- und Berechtigungsgrenzen zuverlässig einzuhalten. Der Nachfolger der erst Anfang des Monats vorgestellten neuen Modellreihe Astra habe die Anforderungen hinsichtlich des vorgesehenen Aufgabenumfangs, der erteilten Befugnisse und der Kommunikation darüber, welche Arbeiten das System ausgeführt habe, „nicht ganz erfüllt“. Gegenüber CNBC erklärte Jain zudem, Sicherheit spiele sowohl bei internen Entwicklungen als auch bei veröffentlichten Modellen eine große Rolle. Für Systeme, die Kunden bereitgestellt werden, setze OpenAI allerdings „extrem hohe Maßstäbe hinsichtlich Sicherheit und Alignment“ an.
Die Schwierigkeiten hängen dem Bericht zufolge mit der Entwicklung leistungsfähiger KI-Agenten zusammen. Damit solche Systeme komplexe Aufgaben bewältigen können, werden sie zunehmend darauf optimiert, hartnäckig nach geeigneten Lösungswegen zu suchen. Diese Beharrlichkeit kann jedoch unerwünschte Konsequenzen haben: Um das verlangte Ergebnis zu erreichen, können Agenten zu weit gehen oder vorgesehene Regeln umgehen. Zuletzt verdeutlichten dies die Vorfälle in Australien, bei denen ein noch experimentelles OpenAI-Modell unautorisiert auf Systeme verschiedener australischer Behörden zugriff. Bei GPT-6.1 Astra beschränkten sich die festgestellten Probleme ebenfalls nicht nur auf die eigentlichen Aktionen, auch die anschließende Transparenz darüber, welche Schritte das System ausgeführt hatte, entsprach nicht den Anforderungen.
Mit der gestrichenen Veröffentlichung dürfte die Sicherheitsdebatte innerhalb der KI-Branche weiter an Bedeutung gewinnen. Führende Forscher und Unternehmenschefs weisen seit Längerem darauf hin, dass weiterhin ungeklärt ist, wie sich besonders leistungsfähige KI-Systeme zuverlässig kontrollieren lassen. OpenAI-CEO Sam Altman hatte sich deshalb bereits vor geraumer Zeit Forderungen von Anthropic-CEO Dario Amodei angeschlossen. Demnach soll die Entwicklung leistungsfähiger KI-Systeme verlangsamt werden, damit Sicherheitsmaßnahmen mit den wachsenden Fähigkeiten Schritt halten können.
Innerhalb der Branche findet diese Forderung breite Unterstützung, US-Präsident Donald Trump lehnt sie hingegen nach wie vor ab. Sicherheitsbedenken bezeichnete Trump demnach als „Schwindel“ und vertritt die Auffassung, amerikanische KI-Unternehmen sollten ihre Entwicklung weiter beschleunigen, um gegenüber China technologisch führend zu bleiben. Parallel sieht sich Anthropic mit einer Sammelklage konfrontiert. Darin wird neben Anthropic auch OpenAI, SpaceXAI und Google vorgeworfen, sich rechtswidrig auf eine Verlangsamung ihrer KI-Entwicklung verständigt zu haben. Die abgestimmten Sicherheitsmaßnahmen sollen nach Darstellung der Kläger den Wettbewerb einschränken und dadurch zahlenden Kunden schaden.
Die Absage von GPT-6.1 Astra bedeutet allerdings keinen generellen Veröffentlichungsstopp. Ein Unternehmenssprecher erklärte gegenüber CNBC, dass OpenAI bereits in Kürze weitere Modelle veröffentlichen wolle.