Google stellte am 21. Juli 2026 drei neue Gemini-Modelle vor und verdoppelte damit die Effizienz und Kosteneffizienz, die Entwickler benötigen, um KI-Agenten für die Produktion in großem Maßstab zu entwickeln. Das Unternehmen stellte Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und Gemini 3.5 Flash Cyber ​​vor, die jeweils auf ein anderes Segment der zunehmend wettbewerbsintensiven KI-Modelllandschaft abzielen. Für eine umfassende Berichterstattung über die neuesten Entwicklungen in aktuellen KI-Nachrichten markieren diese Veröffentlichungen Googles bisher aggressivsten Vorstoß, den kostensensiblen Entwicklermarkt zu erobern.

Die Ankündigung kommt zu einem entscheidenden Zeitpunkt für den Suchriesen. Während Konkurrenten wie OpenAI und Anthropic mit ihren Flaggschiffmodellen Aufmerksamkeit erregt haben, hat sich die Flash-Serie von Google eine Nische als Anlaufstelle für Entwickler geschaffen, die KI-Agenten wirtschaftlich und zuverlässig betreiben müssen. Die neuen Modelle stellen einen erheblichen Fortschritt sowohl in der Qualität als auch in der Effizienz aller Agenten-Workflows dar.

Gemini 3.6 Flash: Das neue Workhorse-Modell

Gemini 3.6 Flash ist als Googles Arbeitsmodell positioniert und baut direkt auf dem Feedback von Entwicklern auf, die das Vorgängermodell 3.5 Flash verwenden. Laut der Ankündigung von Google, die von Tulsee Doshi, Senior Director of Product Management, verfasst wurde, bietet das Modell verbesserte Codierung, Wissensarbeit und multimodale Leistung und reduziert gleichzeitig den Token-Verbrauch deutlich.

Im Artificial Analysis Index verbraucht Gemini 3.6 Flash 17 % weniger Ausgabetoken als sein Vorgänger. In einigen Benchmarks, wie zum Beispiel DeepSWE von Datacurve, beträgt die Reduzierung bis zu 65 %. Das Modell erfordert außerdem weniger Argumentationsschritte und Toolaufrufe, um mehrstufige Arbeitsabläufe durchzuführen.

Der Preis wurde auf 1,50 US-Dollar pro Million Input-Tokens und 7,50 US-Dollar pro Million Output-Tokens festgelegt und liegt damit unter der vorherigen Generation. Dadurch lassen sich Agenten kostengünstiger erstellen und in großem Maßstab betreiben – ein entscheidender Faktor für Unternehmen, die KI für Tausende gleichzeitiger Aufgaben einsetzen.

Benchmark-Verbesserungen

Google meldete mehrere bemerkenswerte Leistungssteigerungen im Vergleich zu 3.5 Flash:

  • DeepSWE: 49 % gegenüber 37 %, was eine höhere Präzision bei der Codebearbeitung mit weniger unerwünschten Bearbeitungen und weniger Ausführungsschleifen widerspiegelt
  • MLE Bench: 63,9 % gegenüber 49,7 %, ein deutlicher Anstieg der Forschungskapazitäten im Bereich maschinelles Lernen
  • OSWorld-Verified: 83,0 % gegenüber 78,4 %, was verbesserte Computernutzungsmöglichkeiten zeigt
  • GDPval-AA v2: 1421 gegenüber 1349, was Zuwächse bei Wissensarbeitsaufgaben widerspiegelt

Die Computernutzung ist jetzt als integriertes clientseitiges Tool über die Gemini API und Gemini Enterprise verfügbar, sodass keine Orchestrierungsebenen von Drittanbietern erforderlich sind.

Gemini 3.5 Flash-Lite: Auf Geschwindigkeit und Skalierbarkeit ausgelegt

Parallel zum Flash-Upgrade veröffentlichte Google Gemini 3.5 Flash-Lite, das für Aufgaben mit geringer Latenz und Arbeitslasten mit hohem Durchsatz wie Agentensuche und Dokumentenverarbeitung konzipiert ist. Es ist das schnellste Modell der 3.5-Serie und läuft laut künstlicher Analyse mit 350 ausgegebenen Token pro Sekunde.

Mit einem aggressiven Preis von 0,30 US-Dollar pro Million Eingabe-Tokens und 2,50 US-Dollar pro Million Ausgabe-Tokens bietet Flash-Lite ein überzeugendes Preis-Leistungs-Verhältnis für Entwickler, die Produktionsverkehr in großem Maßstab betreiben. Google stellte fest, dass das Modell bei vielen Agenten- und Coding-Bewertungen sogar das größere Gemini 3 Flash übertrifft, darunter bei SWE-Bench Pro (54,2 % gegenüber 49,6 %) und OSWorld-Verified (74,0 % gegenüber 65,1 %).

Das Modell unterstützt konfigurierbare Denkebenen, sodass Entwickler die Ausführung mit geringer Latenz für Aufgaben mit hohem Volumen priorisieren oder höhere Denkebenen für komplexe mehrstufige Subagenten-Workloads nutzen können.

Gemini 3.5 Flash Cyber: KI für Codesicherheit

Die dritte Version, Gemini 3.5 Flash Cyber, ist ein spezielles Modell, das speziell auf die Suche und Behebung von Cybersicherheitslücken abgestimmt ist. Es basiert auf 3.5 Flash und ist mit dem CodeMender-Agenten von Google gekoppelt, der mehrere Flash Cyber-Agenten verwendet, die zusammenarbeiten, um kombinierte Sicherheitsberichte zu erstellen.

Beim CyberGym-Benchmark erreicht das Modell eine konkurrenzfähige Leistung im Spitzenbereich. Angesichts des Dual-Use-Charakters der Technologie geht Google bei der Bereitstellung jedoch bewusst vorsichtig vor. Das Modell wird im Rahmen eines Pilotprogramms mit eingeschränktem Zugang exklusiv über CodeMender für Regierungen und vertrauenswürdige Partner verfügbar sein.

Dies verschafft den Verteidigern an vorderster Front einen Vorsprung bei der Suche und Behebung kritischer Schwachstellen, bevor sie ausgenutzt werden können, und verringert gleichzeitig das Risiko eines umfassenderen Missbrauchs.

Gemini 3.5 Pro befindet sich noch im Test

Google bestätigte, dass Gemini 3.5 Pro, das Flaggschiffmodell, dessen Verzögerung genau beobachtet wurde, derzeit mit Partnern getestet wird und sobald es fertig ist, allgemein verfügbar gemacht wird. Das Unternehmen hatte den Pro-Start zuvor aufgrund interner Leistungsziele und einer Welle von Abgängen von Forschern verschoben.

Am bemerkenswertesten ist vielleicht, dass Google bekannt gab, dass das Team bereits mit dem begonnen hat, was es als seinen bisher ehrgeizigsten Vortrainingslauf für Gemini 4 bezeichnete, was darauf hindeutet, dass die nächste Generation von Modellen bereits im Gange ist.

Verbesserte Sicherheitsmaßnahmen

Gemini 3.6 Flash wird mit verbesserten Frontier Safety-Schutzmaßnahmen in den Bereichen chemischer, biologischer, radiologischer und nuklearer (CBRN) Bedrohungen und Cyber-Vergehensmissbrauch ausgeliefert. Laut Google machen diese Sicherheitsvorkehrungen das Modell wesentlich resistenter gegen Jailbreaks und minimieren gleichzeitig die Ablehnung nützlicher Anwendungen.

Die Veröffentlichung erfolgt inmitten einer verschärften Prüfung der Sicherheit von KI-Modellen in Washington, wo die Trump-Regierung Unternehmen dazu gedrängt hat, unveröffentlichte Modelle vor der Veröffentlichung mit staatlichen Testern zu teilen. Google DeepMind und Microsoft haben beide im Mai 2026 Vereinbarungen mit dem staatlichen Zentrum für KI-Standards und -Innovation unterzeichnet, um ihre Grenzmodelle für nationale Sicherheitstests zu teilen.

Verfügbarkeit

Gemini 3.6 Flash und 3.5 Flash-Lite sind ab sofort für Entwickler über die Gemini API, Google AI Studio und Android Studio verfügbar. Unternehmenskunden können über die Gemini Enterprise Agent Platform darauf zugreifen. Die Gemini-App unterstützt auch beide Modelle für den Verbrauchergebrauch und 3.5 Flash-Lite wird in der Google-Suche eingeführt.

Bleiben Sie der KI immer einen Schritt voraus

Möchten Sie mehr aus der Welt der künstlichen Intelligenz erfahren? Setzen Sie ein Lesezeichen auf AI Buzz Wire, um die neueste Berichterstattung über die KI-Branche zu erhalten, der Sie vertrauen können.

Weitere KI-Neuigkeiten lesen →