// LINUX-MAGAZIN — LINUX & OPEN SOURCE
Google veröffentlicht zwei neue Flash-Modelle
(C) unter Verwendung eines Motivs von Andrei Suslov / 123RF.com
Google kündigt zwei Versionen eines neuen 3.8 Flash an: ein Standardmodell für agentenbasierte Aufgaben, Softwareentwicklung und mehrstufiges Schlussfolgern sowie Flash Cyber, das für die Erkennung und Behebung von Sicherheitslücken optimiert ist.
Google-CEO Sundar Pichai postete auf X, dass das neue Modell signifikante Leistungssprünge gegenüber der Vorgängerversion in den Bereichen Softwareentwicklung, agentische Aufgaben und mehrstufiges Schlussfolgern bietet. Im einschlägigen Benchmark DeepSWE 1.1 soll es beim autonomen Lösen komplexer Entwicklungsaufgaben sogar viel größere Modelle schlagen und das zu einem Bruchteil der Kosten.
Google Flash 3.8 Benchmarkergebnisse und Preise. (c) Google
Darüber hinaus zeichnet sich 3.8 Flash durch Zuverlässigkeit aus, die Unternehmen für das autonome Abarbeiten von Aufgaben in verschiedenen Fachgebieten benötigen. In Bereichen, die fortgeschrittene Analysen und Berichterstellungen erfordern, übertrifft 3.8 Flash 3.7 Flash und andere wegweisende Modelle in Benchmarks wie Vals Finance Agent V2 und Harveys Legal Agent Benchmark. Das Modell 3.8 Flash erreicht zudem einen Wert von 54,9 Prozent bei HLE-Verified und demonstriert damit seine Fähigkeit, mehrstufige Schlussfolgerungen in den Bereichen MINT, Geisteswissenschaften und Fachgebieten zu bewältigen.
Diese Leistungssteigerungen kommen daher, dass 3.8 Flash intensiver arbeitet. Bei komplexen Aufgaben zeigt es größere Sorgfalt – es führt zusätzliche Schlussfolgerungsschritte durch und ruft Tools iterativ auf. Dabei verwendet das Modell allerdings von Fall zu Fall mehr Tokens, um die Leistung zu maximieren, insbesondere bei höherem Aufwand. Dort, wo der besonders effiziente Einsatz von Tokens im Vordergrund steht, empfiehlt Google, bei der Version 3.7 zu bleiben.
Die Cyber-Version von 3.8 Flash übertrifft im Benchmark CyberGym auch größere Modelle wie Mythos 5 oder GPT-5.5-Cyber und GPT-5.6-Sol. Um die tatsächlichen Anforderungen an die Cybersicherheit besser zu erfassen, die sich nicht wie bei CyberGym nur auf C/C++-Codebasen beschränken, wurde Gemini 3.8 Flash Cyber außerdem anhand eines umfassenden internen Benchmarks evaluiert, bei dem das Modell eine Vielzahl von Schwachstellen in komplexen Codebasen aus 20 Programmiersprachen aufdecken muss. Hier zeigt das Modell einen beeindruckenden Sprung gegenüber den bisherigen Modellen und erreicht eine Erfolgsquote von über 70 Prozent.
Die US-Regierung ergreift in einer offiziellen Stellungnahme (Statement of Interest of the United States) im Zusammenhang mit dem Verfahren der New York Times und mehrerer Buchautoren und Verleger gegen OpenAI und Microsoft Partei für das KI-Unternehmen.
Das Incus-Team hat Version 7.4 veröffentlicht. Für virtuelle Maschinen führt Incus 7.4 Werkzeuge zur Verwaltung von UEFI-Secure-Boot-Schlüsseln ein.
OpenProject hat Version 17.8 veröffentlicht. Nach Angaben des OpenProject-Teams erweitert die neue Version vor allem den MCP-Server, über den KI-Assistenten mit OpenProject interagieren können. Die Funktion steht als Enterprise-Add-on ab dem Professional Plan zur Verfügung.