KI

Zwei neue Google-Modelle sind offen – der Cyber-Pilot bleibt begrenzt

Google öffnet zwei neue Gemini-Modelle für die API. Der Cyber-Pilot bleibt dagegen einem kleinen Partnerkreis vorbehalten.

Von Wolfgang

22. Juli 20266 Min. Lesezeit

Zwei neue Google-Modelle sind offen – der Cyber-Pilot bleibt begrenzt

Google öffnet zwei neue Gemini-Modelle für die API. Der Cyber-Pilot bleibt dagegen einem kleinen Partnerkreis vorbehalten.

Google bringt zwei neue Gemini-Modelle in die API, hält den Cyber-Piloten aber bewusst unter Verschluss. Gemini 3.6 Flash und Gemini 3.5 Flash-Lite sind laut der aktuellen Dokumentation für den produktiven Einsatz verfügbar. Gemini 3.5 Flash Cyber soll dagegen zunächst nur Regierungen und vertrauenswürdigen Partnern offenstehen. Für Nutzer, Entwickler und Unternehmen ist diese Trennung wichtiger als ein weiterer Modellvergleich.

Das Wichtigste in 30 Sekunden

  • Google stellte Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und Gemini 3.5 Flash Cyber am 21. Juli 2026 vor.
  • gemini-3.6-flash und gemini-3.5-flash-lite sind laut Google allgemein verfügbare API-Modelle für Produktion.
  • Flash Cyber ist kein frei buchbares Produkt. Der Pilot läuft über CodeMender und bleibt vorerst Regierungen sowie vertrauenswürdigen Partnern vorbehalten.
  • Preise, Benchmarks und Sicherheitswerte kommen aus Google-Dokumenten; unabhängige Replikationen enthält das Dossier nicht.

Drei Modelle, drei Wege zum Zugang

Die Meldung vom 21. Juli bündelt drei Angebote, die nur auf den ersten Blick ähnlich wirken. Google stellt mit 3.6 Flash ein Flash-Modell für komplexere Aufgaben bereit, positioniert Flash-Lite für viele schnelle Vorgänge und verteilt Flash Cyber nur in einem eng geführten Pilot. Darum ist der Zugang entscheidend.

Für Entwickler beginnt die Prüfung bei der Modell-ID. Die Google-Dokumentation führt gemini-3.6-flash und gemini-3.5-flash-lite als allgemein verfügbare API-Modelle für Produktion. Beide dokumentieren ein Kontextfenster von 1 Million Tokens und maximal 64.000 Output-Tokens. Diese Werte beschreiben technische Grenzen; sie beantworten noch keine Frage zu Kosten, Vertrag oder konkreter Produktfreigabe.

Preise und Zugang auf einen Blick

Angebot Dokumentierter Zugang Preis laut Google Wichtige Grenze
Gemini 3.6 Flash Allgemein verfügbare API, für Produktion 1,50 US-Dollar Input / 7,50 US-Dollar Output je 1 Mio. Tokens Listenpreis, kein Vertrags- oder Regionsversprechen
Gemini 3.5 Flash-Lite Allgemein verfügbare API, für Produktion 0,30 US-Dollar Input / 2,50 US-Dollar Output je 1 Mio. Tokens Positionierung und Leistungswerte stammen von Google
Gemini 3.5 Flash Cyber Limited-Access-Pilot über CodeMender Nicht als allgemeiner API-Listenpreis dokumentiert Zunächst nur Regierungen und vertrauenswürdige Partner

Google rechnet Input und Output getrennt pro Million Tokens ab. Die Tabelle zeigt deshalb keine fertige Kostenrechnung für einen Betrieb. Welche Summe am Ende entsteht, hängt unter anderem von Länge und Zahl der Anfragen, dem Produktweg und den vereinbarten Konditionen ab.

Vergleichsgrafik zeigt für Gemini 3.6 Flash, Flash-Lite und Flash Cyber dokumentierten Zugang sowie die veröffentlichten API-Listenpreise.
Die Grafik trennt offene API-Modelle vom begrenzten Cyber-Pilot und nennt die dokumentierten Listenpreise – durch KI erzeugt

Was Gemini 3.6 Flash abdeckt

Google ordnet Gemini 3.6 Flash komplexeren agentischen und multimodalen Aufgaben zu. Die Model Card nennt Text, Bilder, Audio und Video sowie Kanäle wie Gemini API, AI Studio und Unternehmensangebote. Das macht sichtbar, wo Google das Modell einsetzen will. Es bedeutet jedoch nicht, dass jede Funktion in jeder App, Region oder Vertragsstufe zugleich verfügbar ist.

Die Model Card benennt auch die Grenzen: Das Modell kann halluzinieren, und im Betrieb können Langsamkeit oder Timeouts auftreten. Bei Vorschlägen für Kunden, Code oder sicherheitsrelevante Prozesse braucht es deshalb nachvollziehbare Prüfungen. Ein großes Kontextfenster spart weder automatisch Geld noch ersetzt es die fachliche Kontrolle.

Warum Flash-Lite anders kalkuliert ist

Bei Gemini 3.5 Flash-Lite liegt der Schwerpunkt auf Geschwindigkeit und vielen gleichartigen Anfragen. Google nennt Übersetzung, Klassifikation, Dokumentverarbeitung und Teilaufgaben in Agenten-Workflows. Das passt zu Abläufen, in denen Teams viele ähnliche Vorgänge bearbeiten und Antwortzeiten eine Rolle spielen.

Auch der dokumentierte Preis folgt dieser Positionierung. Google nennt 0,30 statt 1,50 US-Dollar pro Million Input-Tokens und 2,50 statt 7,50 US-Dollar beim Output. Daraus lässt sich keine allgemeine Kostengarantie ableiten. Für eine belastbare Entscheidung müssen Teams ihre eigenen Eingaben, Antworten, Wiederholungen und Kontrollen mitrechnen. Die Leistungsbeschreibung bleibt zudem eine Herstellerpositionierung, kein unabhängiger Vergleich.

Weshalb Flash Cyber begrenzt bleibt

Flash Cyber ist der auffällige Sonderfall des Releases. Google beschreibt ein auf 3.5 Flash aufgebautes Modell, das für das Finden, Validieren und Beheben von Schwachstellen feinabgestimmt wurde. Über CodeMender sollen mehrere spezialisierte Subagenten zusammenarbeiten und ihre Ergebnisse zu einem Bericht verdichten.

Der Zugang soll zunächst ausschließlich Regierungen und vertrauenswürdigen Partnern offenstehen. Google verweist dabei auf Dual-Use-Risiken: Fähigkeiten zur Analyse von Schwachstellen können Schutz verbessern, aber ebenso missbraucht werden. Aus der Ankündigung wird damit kein frei verfügbarer Hacker-Agent. Sie ist auch keine Zusage für einen autonomen Patchdienst oder garantierten Schutz.

Ablaufgrafik zeigt den begrenzten Zugang für Regierungen und vertrauenswürdige Partner über CodeMender bis zu einem Bericht.
Der Cyber-Pilot bündelt spezialisierte Subagenten in einem Bericht und bleibt im begrenzten Zugang – durch KI erzeugt

Worauf Teams in Deutschland und Europa achten sollten

Die Ankündigung enthält keine pauschale Zusage zu Deutschland- oder EU-Verfügbarkeit, Datenresidenz oder DSGVO-Konformität. Das ist für den Einsatz in Unternehmen kein Nebensatz. Vor einer produktiven Einführung sollten Teams Vertrag, Region, Datenverarbeitung, Protokollierung, Zugriffsrechte und menschliche Freigaben klären.

Praktisch hilft ein kleiner, klar abgegrenzter Test. Ein Team kann mit realistischen Eingaben beginnen, Fehlerbilder festhalten und den Einsatz danach schrittweise erweitern. So werden Annahmen zu Qualität, Kosten und Verantwortlichkeiten überprüfbar, bevor ein Modell in einen größeren Ablauf wandert.

Google-Werte sind ein Ausgangspunkt, kein Beweis

Google verweist für die neuen Modelle auf Benchmarks, Effizienz- und Durchsatzwerte. Auch Angaben zu gefundenen Schwachstellen im Cyber-Kontext stammen aus Google-Evaluationen. Solche Angaben helfen bei einer ersten Einordnung, tragen aber keinen unabhängigen Leistungsnachweis. Die Model Cards weisen zusätzlich darauf hin, dass sich Evaluationen ändern können und historische Vergleiche dadurch schwieriger werden.

Die sinnvolle Reihenfolge bleibt schlicht: Zugang und Datenweg prüfen, mit eigenen Aufgaben testen und die Ergebnisse messen. Herstellerangaben können eine Vorauswahl beschleunigen. Über einen produktiven Einsatz entscheiden sollten die eigenen Tests, Kostenannahmen und Kontrollmechanismen.

Einordnung: Die Verteilung erzählt mehr als die Modellnamen

Google veröffentlicht hier nicht einfach drei Varianten desselben Produkts. Zwei Modelle stehen nach der API-Dokumentation für Produktion bereit, während Flash Cyber absichtlich in einem kleinen Kreis bleibt. Für normale Nutzer folgt daraus noch keine Zusage für eine neue App- oder Workspace-Funktion. Für Entwickler und Unternehmen wird die Entscheidung greifbarer: Modell-ID, Preis, Vertrag und Datenweg müssen zusammenpassen.

Gerade diese Abgrenzung verhindert zwei verbreitete Fehlschlüsse. Eine API-Freigabe ist keine automatische Freischaltung in jeder Anwendung. Und ein begrenzter Cyber-Pilot wird nicht über Nacht zu einem allgemeinen Sicherheitswerkzeug.

Quellen und weiterführende Informationen

Hinweis: Für diesen Artikel wurden KI-gestützte Recherche- und Editierwerkzeuge verwendet. Der Inhalt wurde redaktionell geprüft. Stand: 2026-07-22