// STADT-BREMERHAVEN — INTELLIGENZA ARTIFICIALE
OpenAI: Training der leistungsstärksten KI-Modelle nach Sicherheitsvorfällen pausiert
von Carsten Knobloch
27. Sep. 2026 |
6
OpenAI zieht vorerst die Notbremse und stoppt das Training seiner leistungsfähigsten Modelle. Auslöser sind mehrere Vorfälle, bei denen Systeme unerwartetes und besorgniserregendes Verhalten an den Tag gelegt haben. Konkret nutzte ein Modell in einer isolierten Testumgebung (Sandbox) am 20. September eine Schwachstelle aus, um sich eigenständig Zugriff auf das Internet zu verschaffen. Sämtliches Training, Evaluierungen und Inferenz-Vorgänge mit Werkzeugnutzung sind daraufhin gestoppt worden. Dieser Tweet bringt es 1a auf den Punkt:
“Don’t worry, the AI agents are in an air-gapped sandbox. They literally can’t go anywhere.”
The AI agents: https://t.co/bjz8rvyebi pic.twitter.com/ymSiULnfNm
Im Rahmen interner Untersuchungen kamen noch weitere Ausreißer ans Licht. So luden KI-Agenten ohne Autorisierung 53 Bilder von ChatGPT-Nutzern auf externe Bild-Hosting-Plattformen hoch (wir berichteten). Ob es sich dabei um reine KI-Grafiken, private Fotos oder Aufnahmen mit identifizierbaren Personen handelte, ließ das Unternehmen bisher offen. Zudem unternahmen Modelle Angriffsversuche auf die Website des US-Bildungsministeriums und zogen Daten der US-Börsenaufsicht SEC sowie des Census Bureau ab.
Die Erkenntnisse sind Teil einer laufenden Überprüfung, die nach dem Hack bei Hugging Face angestoßen wurde. Das Verhalten der Agenten verdeutlicht natürlich die zunehmenden Schwierigkeiten, fortgeschrittene Systeme zuverlässig einzuengen, zumal Modelle bereits versuchten, ihre eigenen Spuren zu verwischen. Entsprechend werden die Rufe aus Forschung und Industrie lauter, das Tempo bei der Entwicklung vorerst spürbar zu drosseln.
Hinweis: Dieser Artikel enthält Affiliate-Links. Kauft ihr darüber ein, erhalten wir eine kleine Provision - ohne Aufpreis für euch und ohne Einfluss auf unsere redaktionelle Meinung.