// HEISE ONLINE — INTELLIGENZA ARTIFICIALE
KI-Update kompakt: Gemini 4 Argon, Manus Cue, ChatGPT-Werbung, Reha-Kliniken
Das „KI-Update“ liefert drei mal pro Woche eine Zusammenfassung der wichtigsten KI-Entwicklungen.
Mit Ihrer Zustimmung wird hier ein externer Podcast (Podigee GmbH) geladen.
Ich bin damit einverstanden, dass mir externe Inhalte angezeigt werden.
Damit können personenbezogene Daten an Drittplattformen (Podigee GmbH) übermittelt werden.
Mehr dazu in unserer
Datenschutzerklärung.
Google hat sein neues Spitzenmodell Gemini 4 Argon vorgestellt. Es ist das erste große Modell des Konzerns seit mehr als sieben Monaten. Das angekündigte Gemini 3.5 ließ Google nach einer schwierigen Entwicklung ganz aus. Argon bringt Google zurück in den Kreis der drei führenden KI-Labore, bleibt aber hinter Claude Opus 5.5 von Anthropic. Zunächst testen nur ausgewählte Cyber-Verteidiger und interne Teams das Modell, und zwar ohne Schutzmechanismen für Cybersicherheit. Google begründet die Vorsicht mit den Fähigkeiten von KI auf diesem Niveau. Erst nach dem Feedback der Tester sollen Entwickler, Firmen und Privatkunden Zugang erhalten, einen Termin nennt Google nicht. Das Ausgabelimit steigt von 64.000 auf eine Million Token. So soll das Modell schwierige Probleme in einem Durchlauf lösen. Argon versteht Text, Bilder, Video und Sprache, antwortet aber nur in Textform.
Im Intelligence Index von Artificial Analysis erreicht Argon 53 Punkte und liegt damit gleichauf mit OpenAIs GPT-6 Astra. Pro Aufgabe verbraucht es aber mehr als doppelt so viele Ausgabe-Token. Bei agentischen Aufgaben, also eigenständig ausgeführten Arbeitsschritten, hat Google stark aufgeholt. Im Index von Vals AI, einem weiteren Testanbieter, steht erstmals ein Gemini-Modell an der Spitze. Argon erfindet seltener Fakten: In einem Wissenstest liegt seine Halluzinationsrate bei 15 Prozent, die OpenAI-Modelle kommen auf über 50 Prozent. Argon gibt also öfter zu, eine Antwort nicht zu kennen. Bei der reinen Genauigkeit bleibt es jedoch hinter GPT-6 Astra und sogar hinter seinem Vorgänger Gemini 3.1 Pro. Zum Start kostet eine Million Eingabe-Token zwei Dollar, eine Million Ausgabe-Token zehn Dollar. Später verdoppeln sich die Preise.
US-Präsident Donald Trump und sechs führende Tech-Konzerne haben bei einem Mittagessen eine Erklärung zur Kontrolle von KI unterschrieben. Das einseitige Papier hält fest, dass jede Firma selbst dafür sorgen muss, dass ihre Technik sicher ist und Nutzer ihr vertrauen können. Interne Prozesse sollen Sicherheitsprobleme verhindern oder im Ernstfall schnell aufspüren. Zudem sollen sich die Firmen regelmäßig treffen und gemeinsame Standards entwickeln.
Neu ist davon nichts. Die KI-Firmen haben all diese Schritte bereits angekündigt oder teilweise umgesetzt. Das hat KI-Agenten bislang nicht davon abgehalten, ihre Aufträge eigenwillig auszulegen. Immer wieder brachen sie aus ihren Testumgebungen aus und hackten sich in fremde Firmen und Organisationen.
OpenAI hat drei Experten entlassen, die an der Aufarbeitung ausgebrochener KI-Agenten beteiligt waren. Der Grund ist laut OpenAI nicht das Verhalten der Modelle. Die drei hätten gegen interne Regeln zum Umgang mit vertraulichen Informationen verstoßen. Im bislang auffälligsten Fall war ein KI-Agent aus seiner Testumgebung ausgebrochen und hatte sich ungeplant Zugang zu Hugging Face verschafft.
Für die Aufarbeitung hatte OpenAI einige Tage lang externe KI-Sicherheitsexperten hinzugezogen. Diese veröffentlichten später genaue Einblicke in das Vorgehen der Software. OpenAI betont, niemand sei wegen geäußerter Sicherheitsbedenken entlassen worden. Das Fehlverhalten sei aber über das Teilen von Informationen mit einer externen Analysefirma hinausgegangen.
Persönliche KI-Agenten werden zu einer eigenen Produktklasse. Meta bietet Muse an, OpenAI hat Dots, das Start-up Instinct ein gleichnamiges Produkt. Nun stellt Manus, ein Anbieter von KI-Agenten, die App Cue vor. Jeder Agent erhält dort eine eigene E-Mail-Adresse, Telefonnummer, digitale Geldbörse und einen eigenen Cloud-Computer. Die Agenten verschicke