Google startet Gemini 3.8 Flash: Token-Kosten und Cyber-Zugang hinter dem niedrigen Preis
Kurzfassung
Google führt Gemini 3.8 Flash und eine auf vertrauenswürdige Verteidiger beschränkte Cyber-Variante ein; niedrige Stückpreise können durch längeres Reasoning relativiert werden.
Ob Gemini 3.8 Flash die Gesamtkosten eines Agenten-Workflows senkt, lässt sich am API-Preis allein nicht erkennen. Ein belastbarer Test über drei Monate müsste die Veränderung der Erfolgsquote mit der Entwicklung der durchschnittlichen Ausgabe-Token und Tool-Aufrufe vergleichen. Steigen Token-Verbrauch oder Tool-Aufrufe schneller als die Zahl erfolgreich abgeschlossener Aufgaben, ist die Niedrigkosten-Hypothese widerlegt. Google veröffentlichte Gemini 3.8 Flash und Gemini 3.8 Flash Cyber am 2026-09-02. Das allgemeine Modell ist bereits in Entwickler-, Unternehmens- und Verbraucherprodukten verfügbar; die Cyber-Version bleibt geprüften Verteidigern vorbehalten.
Google positioniert das allgemeine Modell für Softwareentwicklung, agentische Abläufe und mehrstufiges Reasoning in Fachgebieten. Der Einführungspreis beträgt $0.75 je Million Eingabe-Token und 3,75 US-Dollar je Million Ausgabe-Token. Damit entspricht er dem Preis von Gemini 3.7 Flash, das drei Wochen zuvor erschien. Google weist jedoch ausdrücklich darauf hin, dass 3.8 bei komplexen Aufgaben zusätzliche Denkschritte ausführt und Tools wiederholt aufruft. Bei höheren Effort-Einstellungen kann das Modell mehr Token verbrauchen, um die Leistung zu maximieren. Entwickler mit einem strikten Effizienz-Ziel können den Effort reduzieren oder das weiterhin unterstützte 3.7 Flash nutzen. The Verge folgert deshalb zu Recht, dass ein unveränderter Stückpreis keine unveränderte Rechnung pro erledigter Aufgabe garantiert.
Damit wird das Nutzungsvolumen ebenso wichtig wie die Benchmark-Leistung. Google meldet 54,9 Prozent bei HLE-Verified und Verbesserungen gegenüber 3.7 Flash in DeepSWE v1.1 sowie bei Finanz- und Rechtsagenten-Tests. Die Zahlen stammen überwiegend vom Anbieter. Die Ankündigung nennt weder den durchschnittlichen Token-Verbrauch noch Latenz und Gesamtkosten pro Aufgabe für die einzelnen Effort-Stufen. Ein Käufer kann die Ranglistenergebnisse daher nicht direkt in ein Produktionsbudget übersetzen. Außerdem endet der Einführungspreis am 2026-12-31. Ab 2027-01-01 sollen die Preise auf 1,50 US-Dollar je Million Eingabe-Token und 7,50 US-Dollar je Million Ausgabe-Token steigen.
Die Zugangsgrenze von Flash Cyber
Gemini 3.8 Flash Cyber nutzt dieselbe grundlegende Intelligenz, ist aber auf das Auffinden von Schwachstellen und automatisierte Patches optimiert. Laut Google erreichte das Modell in einem internen Test mit komplexen Codebasen in 20 Programmiersprachen eine Erfolgsquote von mehr als 70 Prozent. Beim externen Patching-Benchmark CWE-Bench lag pass@1 bei 47,2 Prozent und damit nahe an den 47,8 Prozent eines anderen führenden Frontier-Modells. Googles Chrome-Security-Team erhielt nach Unternehmensangaben 2,6-mal so viele korrekte Schwachstellen-Patches wie von wesentlich größeren kommerziellen Modellen. Diese Praxisbeispiele stammen von Google und genannten Partnern; eine externe Gruppe hat die vollständigen Testbedingungen bislang nicht öffentlich reproduziert.
Der Vertrieb ist bewusst begrenzt. Das Standardmodell enthält gemäß Googles Frontier Safety Framework Schutzmechanismen gegen chemischen, biologischen, radiologischen, nuklearen und offensiven Cyber-Missbrauch. Die Cyber-Variante besitzt freizügigere Mitigationsregeln für Sicherheitsarbeit und wird nur über das Fairwind Program bereitgestellt. Als Zielgruppen nennt Google Behörden, Betreiber kritischer Infrastruktur und Software-Maintainer. Die meisten Entwickler können das Standardmodell sofort testen. Ohne Zulassung können sie die Patching-Angaben von Flash Cyber und dessen Fehlalarmquote jedoch nicht unabhängig vergleichen.
Beschaffungsteams können in den kommenden drei bis sechs Monaten einen festen Aufgabensatz mit 3.7 und 3.8 ausführen und Erfolgsquote, Gesamt-Token, Tool-Aufrufe sowie Latenz erfassen. Die Kalkulation sollte zusätzlich den Listenpreis von 2027 verwenden, nicht nur den Einführungstarif. Bei Flash Cyber sind zwei Größen beobachtbar: die Zahl externer Organisationen mit Fairwind-Zugang und unabhängige Reproduktionen der Ergebnisse zu Schwachstellensuche und Patching. Googles Ankündigung beziffert bislang keine davon; Reichweite und Wiederholbarkeit des Einsatzes bleiben daher offen.
Quellen:
Verwandte Artikel
OpenAI startet GPT-6 Astra: Cyberkontrollen begrenzen ein 50-Dollar-Ausgabemodell
OpenAI führt GPT-6 Astra stufenweise ein; eine externe Auswertung zeigt, dass hohe Reasoning-Leistung erhebliche Kosten verursacht, die Unternehmen pro erledigter Aufgabe prüfen müssen.
DeepMind sperrt Modell und Test gemeinsam ein: Der erste Doppelblind-Pilot für KI-Evaluation
Google DeepMind und unabhängige Prüfer isolierten Gemini-Gewichte und vertrauliche Testfragen per Confidential Computing und adressierten damit einen Grundkonflikt der KI-Evaluation.