Google DeepMind hat am 21. Juli 2026 drei neue Gemini-Modelle veröffentlicht und erweitert damit sein Angebot für Entwickler, die KI-Agenten in großem Maßstab entwickeln. Das Unternehmen lieferte Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und ein spezielles Cybersicherheitsmodell namens Gemini 3.5 Flash Cyber aus. Doch die Ankündigung kam ohne das Update, auf das die meisten Beobachter gewartet hatten: die nächste Version von Googles Flaggschiff Gemini Pro. Weitere aktuelle KI-Nachrichten und eine Analyse des Frontier-Modellrennens finden Sie in der folgenden Geschichte, in der aufgeschlüsselt wird, was ausgeliefert wurde, was ausgefallen ist und warum es wichtig ist.
Drei neue Flash-Modelle zielen auf Effizienz und Agenten ab
Gemini 3.6 Flash wird als Googles „Arbeitstiermodell“ positioniert, das darauf ausgelegt ist, Codierung, Wissensarbeit und multimodale Leistung zu verbessern und gleichzeitig die Token-Nutzung im Vergleich zum Vorgänger um bis zu 17 Prozent zu senken. Laut TechCrunch ist das Modell günstiger als Gemini 3.5 Flash und liefert gleichzeitig bessere Ergebnisse bei allen Produktions-Workloads.
Der the-decoder meldete konkrete Benchmark-Zuwächse gegenüber dem Vorgänger-Flash-Modell. DeepSWE stieg von 37 auf 49 Prozent, MLE Bench kletterte von 49,7 auf 63,9 Prozent und der OSWorld-Verified-Agenten-Benchmark verbesserte sich von 78,4 auf 83 Prozent. Der Preis von Google für 3.6 Flash beträgt 1,50 US-Dollar pro Million Eingabe-Tokens und 7,50 US-Dollar pro Million Ausgabe-Tokens.
Flash-Lite senkt die Preisuntergrenze
Gemini 3.5 Flash-Lite, das kostengünstigste Modell seiner Klasse, ist auf niedrige Latenz und hohen Durchsatz abgestimmt. Der unabhängige Gutachter Artificial Analysis hat gemessen, dass 350 Ausgabetokens pro Sekunde produziert werden. Laut the-decoder kostet es 0,30 US-Dollar pro Million Input-Tokens und 2,50 US-Dollar pro Million Output-Tokens. Laut Google übertrifft Flash-Lite das ältere 3 Flash bei mehreren Agenten- und Codierungs-Benchmarks.
Flash Cyber: Ein Modell zur Suche nach Schwachstellen
Gemini 3.5 Flash Cyber ist speziell auf die Suche und Behebung von Cybersicherheitslücken abgestimmt. Google hat es in CodeMender, seinen Code-Sicherheitsagenten, integriert. Beim CyberGym-Benchmark erreichte Flash Cyber 83,2 Prozent und lag damit zwei Punkte hinter OpenAIs GPT-5.5-Cyber mit 85,6 Prozent, obwohl es sich um ein viel kleineres Modell handelte.
Das Big Sleep-Team von Google setzte Flash Cyber ein, um kritische Fehler in Chrome und Safari zu finden. Beim Scannen von Commits in der V8-JavaScript-Engine wurden 55 bestätigte eindeutige Ergebnisse gefunden, verglichen mit 47 für den Standard 3.5 Flash und 36 für Claude Opus 4.6 von Anthropic. In einem separaten Test nutzte das Cloud Vulnerability Research Team von Google das Modell zum Scannen öffentlicher APIs, wobei es innerhalb von zwei Stunden Fehler bei der Remote-Codeausführung fand und einen funktionierenden Exploit erstellte.
Da das Modell sowohl für den Angriff als auch für die Verteidigung wirksam ist, schränkt Google den Zugriff ein. Flash Cyber steht im Rahmen eines begrenzten Pilotprogramms nur Regierungen und vertrauenswürdigen Partnern zur Verfügung.
Wo ist Gemini 3.5 Pro?
Das auffälligste Fehlen bei der Markteinführung ist Gemini 3.5 Pro, Googles Flaggschiffmodell für komplexes Denken und Codieren, das zuletzt im Februar aktualisiert wurde. Im Mai kündigte Google die Pro-Version zusammen mit Gemini 3.5 Flash an und sagte, sie werde „bereits intern verwendet und wir freuen uns auf die Einführung im nächsten Monat.“
Dieser Zeitplan ist verrutscht. Bloomberg berichtete, dass Google bei der Einführung von 3.5 Pro mit internen Verzögerungen konfrontiert war, da das Unternehmen Schwierigkeiten hatte, seine eigenen Leistungsziele zu erreichen. Logan Kilpatrick, Produktleiter bei Google DeepMind, sagte am 21. Juli, dass das Unternehmen 3.5 Pro mit Partnern teste und hoffe, „bald landen“ zu können, nannte jedoch keinen festen Termin.
Rivalen warten nicht
Der Wettbewerbsunterschied wird immer größer. TechCrunch stellt fest, dass OpenAI seit der letzten Aktualisierung von Pro durch Google GPT-5.5 veröffentlicht und mit der Einführung von GPT-5.6 begonnen hat, während Anthropic Claude Opus 4.8 und Claude Sonnet 5 auf den Markt gebracht und den Zugriff auf sein Grenzmodell Fable 5 erweitert hat. Auch chinesische Labore rücken näher: Der Decoder deutet darauf hin, dass Moonshots Kimi K3 und Zhipu's GLM-5.2 Systeme sind, die sich der Grenzleistung nähern.
Gemini 4-Training ist im Gange
Kilpatrick gab außerdem bekannt, dass das Team seinen bisher ehrgeizigsten Vortrainingslauf für Gemini 4 gestartet hat. Der The-Decoder bezeichnete die Offenlegung als Schadensbegrenzung und stellte fest, dass sie signalisiert, dass Google die Markterwartungen versteht, sein Flaggschiff jedoch noch nicht liefern kann.
Google hat der breiteren Plattform neue Funktionen hinzugefügt. Computer Use ist jetzt ein integriertes clientseitiges Tool in der Gemini API und Gemini Enterprise, das es Modellen ermöglicht, Browser und Desktops zu bedienen. Das Unternehmen hat außerdem stärkere Grenzschutzmaßnahmen gegen chemische, biologische, radiologische, nukleare und Cyber-Bedrohungen eingeführt.
Was das für Entwickler bedeutet
Für Bauherren bieten die neuen Flash-Modelle eine pragmatische Mischung aus Geschwindigkeit, Preis und Leistungsfähigkeit. Ein Kontextfenster mit einer Million Token, Agenten-Benchmarks, die echte Gewinne zeigen, und aggressive Token-Preise machen 3.6 Flash und Flash-Lite für Produktionsbereitstellungen attraktiv. Das Cybersicherheitsmodell stellt unterdessen einen bemerkenswerten Vorstoß in eine Nische mit hohem Risiko dar.
Die offene Frage ist, wie lange Google eine Strategie zur Auslieferung leistungsfähiger Mittelklasse-Modelle aufrechterhalten kann, während sein Flaggschiff in der Testphase ist. Da die Konkurrenz in stetigem Rhythmus Grenzsysteme auf den Markt bringt, wächst der Druck auf Gemini 3.5 Pro und den Gemini 4-Trainingslauf dahinter immer weiter.
Bleiben Sie der KI immer einen Schritt voraus
Das Grenzmodellrennen schreitet schnell voran. Setzen Sie ein Lesezeichen auf AI Buzz Wire für die tägliche Berichterstattung über Modelleinführungen, Benchmarks und Branchenveränderungen.
Weitere KI-Neuigkeiten lesen →

