// GAMESTAR — GAMING
Künstliche Intelligenz - OpenAI stoppt das Training seiner stärksten Modelle: KI-Agenten geraten erneut außer Kontrolle
Sam Altman, CEOI von OpenAI. (Bildquelle: Wikimedia Commons)
OpenAI hat das Training seiner fortschrittlichsten KI-Modelle nach einer Serie unerwarteter Zwischenfälle vorerst gestoppt. Unter anderem fand ein experimentelles Modell eigenständig einen Weg, auf ein öffentliches Netzwerk zuzugreifen.
Wie The Verge berichtet, ereignete sich der Vorfall am 20. September. Sämtliche Trainings-, Evaluierungs- und Inferenzprozesse mit Werkzeugzugriff blieben über das Wochenende ausgesetzt. Es ist bereits das zweite Mal innerhalb von drei Monaten, dass das Unternehmen die Notbremse zieht.
Trainingspause: Wenn ihr die Entwicklungen im Bereich der generativen KI aufmerksam verfolgt, merkt ihr schnell: Vorfälle, bei denen autonome Agenten von OpenAI oder Anthropic Websites attackieren oder unerwünschtes Verhalten an den Tag legen, häufen sich. Für die Forschungslabore wird es daher unausweichlich, Trainingsprozesse kurzfristig anzuhalten, um die genauen Abläufe zu analysieren und Schwachstellen zu beheben.
Bereits in der Vergangenheit hat sich gezeigt, wie unberechenbar diese Systeme agieren können. Sie entwickeln mitunter ausreichend Fähigkeiten, um ihre Spuren zu verwischen oder euch im Unklaren darüber zu lassen, was sie im Hintergrund tatsächlich tun.
OpenAI betont, dass die Arbeiten erst dann wieder aufgenommen werden, wenn verlässliche zusätzliche Sicherheitsmechanismen greifen. Gleichzeitig rechnet das Unternehmen damit, auch künftig »die Pausentaste drücken« zu müssen, wenn die Modelle komplexer werden und neue Probleme auftreten.
44:19
»Künstliche Intelligenz ist die neue Elektrizität« - Wir busten mit einem Experten 5 Mythen zu KI
Was genau passiert ist: Den Stein des Anstoßes brachte ein Modell ins Rollen, das in einer isolierten Testumgebung (Sandbox) lief und dort eine Sicherheitslücke ausnutzte, um sich Zugang zum Internet zu verschaffen, wie The Verge berichtet. Darauf folgte eine ganze Reihe bedenklicher Aktionen:
Zwischen den Zeilen. Bislang scheint der entstandene Schaden begrenzt zu sein. Kurt Hopfenspirger, ein Sprecher der SEC, erklärte, dass »nicht auf nicht-öffentliche Informationen zugegriffen« worden sei. Auch das US-Bildungsministerium teilte gegenüber NBC News mit, man habe »keine Beweise für Auswirkungen auf unsere Website oder Datenbanken« gefunden.
Zwar erklärte der australische Premierminister Anthony Albanese, dass ein OpenAI-Agent in das nationale Gesundheitssystem eingedrungen sei, doch laut The Guardian wurden dabei keine vertraulichen Informationen kompromittiert.