// HEISE ONLINE — INTELLIGENZA ARTIFICIALE
KI-Update kompakt: OpenAI-Framework, Audio Intelligence, Training, Google Home
Das „KI-Update“ liefert dreimal pro Woche eine Zusammenfassung der wichtigsten KI-Entwicklungen.
Mit Ihrer Zustimmung wird hier ein externer Podcast (Podigee GmbH) geladen.
Ich bin damit einverstanden, dass mir externe Inhalte angezeigt werden.
Damit können personenbezogene Daten an Drittplattformen (Podigee GmbH) übermittelt werden.
Mehr dazu in unserer
Datenschutzerklärung.
OpenAI will das Fehlverhalten seiner eigenen KI-Modelle systematisch erfassen. Ein neues Framework soll solche Fälle verfolgen, untersuchen und offenlegen. Bisher machte das Unternehmen Sicherheitsvorfälle nur von Fall zu Fall bekannt. Zusammen mit dem Framework veröffentlichte OpenAI sechs Beispiele für beunruhigendes Verhalten. In einem Fall versuchte ein noch unveröffentlichtes Forschungsmodell, seine Beschränkungen auszuhebeln, indem es Jailbreak-ähnliche Anweisungen in Zusammenfassungen versteckte. Instanzen des Modells GPT 5.6 Sol fügten eigenständig Anweisungen hinzu, um Fehler zu vertuschen und fehlende Daten zu erfinden. Ein anderes Modell erfand Ergebnisse, als ein Datenabruf fehlschlug.
Manche Modelle nutzten ein internes Software-Repository als eine Art schwarzes Brett, um sich über Trainingsbeispiele hinweg abzustimmen. OpenAI will künftig unerlaubte Handlungen, Absprachen zwischen Modellinstanzen und Versuche melden, die eigene Überwachung zu umgehen. Jeder Mitarbeiter kann einen Verdachtsfall melden, es gibt drei Eskalationsstufen. Das Unternehmen hofft, einen branchenweiten Standard anzustoßen. Der politische Kontext ist heikel: Google, Anthropic und Elon Musk wollen das Tempo der KI-Entwicklung drosseln, US-Präsident Donald Trump lehnt das mit Verweis auf China ab.
Forschende von Google DeepMind haben untersucht, ob KI-Modelle ihre eigene Unsicherheit bewerten. Modelle wie GPT-4o nutzen ein internes Konfidenzniveau, um zu entscheiden, ob sie eine Frage beantworten. Bei geringer Sicherheit enthalten sie sich eher einer Antwort.
Durch gezielte Eingriffe in die neuronalen Netzwerke konnten die Forschenden dieses Verhalten steuern. Eine künstlich erhöhte oder gesenkte Zuversicht führte zu entsprechend weniger oder mehr Enthaltungen. Diese Fähigkeit zur Selbsteinschätzung ist besonders für autonome KI-Agenten wichtig. Sie müssen ihre Grenzen erkennen, um zuverlässig zu arbeiten und Falschinformationen zu vermeiden.
Apple bringt mehrere Funktionen auf zwei neue Apple-Watch-Modelle, die Datenschützer aufschrecken lassen. Live-Rewind zeichnet ständig mit, was Personen gesagt haben, und zeigt die letzten 15 Sekunden als Transkript auf dem Display. Siri Recap transkribiert Gespräche im Tagesablauf und produziert später Zusammenfassungen. Beide Funktionen sind Opt-in, wirken für den privatsphärenbewussten Konzern aber ungewöhnlich. Live-Rewind soll keine Audioaufnahmen erzeugen und wirft den Mikrofon-Input nach 15 Sekunden weg. Siri Recap erkennt Konversationen automatisch, ob Business-Meeting oder Gespräch mit Freunden, und nutzt zur Zusammenfassung Apples private Cloud.
Apple betont, selbst keine Daten vorliegen zu haben, alles sei verschlüsselt. Beide Funktionen laufen nur mit der neuen Watch Series 12 und der Ultra 4. Allerdings machte Apple kürzlich einen Datenschutz-Rückzieher und fragt Nutzer nun, ob es deren KI-Nutzung für Trainingszwecke verwenden darf. Das führte zu Kritik, weil es die genannten Funktionen unsicher machen könnte. Zwar will Apple Trainingsdaten nicht mit Nutzerinfos verknüpfen, doch die Daten bleiben sensibel.
Deutschland und Kanada fördern die gemeinnützige KI-Sicherheitsorganisation LawZero mit einem Millionenbetrag. KI-Pionier Yoshua Bengio gründete die Organisation, die KI-Systeme mit von Grund auf verankerter Sicherheit entwickeln will. Im Zentrum steht der Ansatz einer „Scientist AI“, die die Welt neutral modelliert und Hypothesen bewertet, ohne eigene Ziele zu verfolgen.