Google veröffentlicht Gemini 3.7 Flash: Halbpreis bis Jahresende, Agentenkosten hängen weiter von Wiederholungen ab
Kurzfassung
Google positioniert Gemini 3.7 Flash als Arbeitsmodell für Programmierung und KI-Agenten, mit höheren Anbieter-Benchmarks und vorübergehend halbiertem Preis; Architektur, Training und Wiederholungsraten im Betrieb bleiben offen.
Ob Gemini 3.7 Flash die Gesamtkosten eines KI-Agenten senkt, lässt sich mit einer Betriebskennzahl prüfen: dem Tokenverbrauch pro erfolgreich abgeschlossener Aufgabe. Googles veröffentlichter Tokenpreis und die höheren Benchmarkwerte stützen die Hypothese, dass diese Kennzahl sinken sollte. Sind bei mehrstufigen Werkzeugaufrufen weiterhin viele Wiederholungen oder manuelle Korrekturen nötig, macht eine API zum halben Preis die erledigte Aufgabe jedoch nicht automatisch billiger.
Google veröffentlichte Gemini 3.7 Flash am August 13, 2026, nur drei Wochen nach Gemini 3.6 Flash. Das Unternehmen positioniert das neue Modell als Arbeitsmodell für Programmierung und Agentenabläufe. Es ist über die Gemini API, Google AI Studio, Android Studio und Googles Plattform für Unternehmensagenten verfügbar. Auch Gemini Spark wechselt in mehr als 160 Ländern auf das Modell; Spark bleibt allerdings Abonnenten von Google AI Pro und Ultra vorbehalten und ist in einigen Märkten nicht erhältlich.
Fünf höhere Messwerte stammen vom Anbieter
Nach Angaben von Google erreichte Gemini 3.7 Flash bei FrontierCode 1.1 Main 43,6 %, während das Vorgängermodell 34,4 % erzielte. DeepSWE v1.1 stieg von 49,0 % auf 65,3 %. Der Elo-Wert in der WebDev Arena erhöhte sich von 1538 auf 1588. Beim Benchmark GDP.pdf für komplexe Dokumente wuchs der Wert von 22,0 % auf 34,0 %, bei AutomationBench von 17,0 % auf 30,4 %. Die Tests betreffen Fehlersuche, Oberflächen, Dokumentenanalyse und Geschäftsabläufe; die gemeldeten Fortschritte verteilen sich damit auf mehrere Aufgabenarten.
Die Aussagekraft bleibt begrenzt. Die Ergebnisse stammen überwiegend von Google, und die Ankündigung enthält weder eine Latenzverteilung aus dem Produktivbetrieb noch Fehlerquoten von Werkzeugaufrufen, Token pro erledigter Aufgabe oder den Anteil menschlicher Übernahmen. SiliconANGLE bestätigte Einführung und Benchmarkwerte unabhängig, wies aber darauf hin, dass die Modellkarte die Trainingsmethode nicht beschreibt. Zu der Architektur ist lediglich bekannt, dass sie dasselbe System wie Gemini 3.6 Flash nutzt. Ein Unternehmen kann die 65,3 % deshalb nicht direkt in eine Reparaturquote für seine eigenen Repositories übersetzen.
Der Einführungspreis verschiebt die Beschaffungsrechnung
Bis Ende 2026 berechnet Google $0.75/1M input tokens und 3,75 US-Dollar je Million Ausgabetokens, ungefähr die Hälfte des ursprünglichen Preises von Gemini 3.6 Flash. Das Angebot endet am December 31, 2026. Ab January 1, 2027 steigen die Preise auf 1,50 US-Dollar für Eingabe und 7,50 US-Dollar für Ausgabe je Million Tokens. Wer mit dem Aktionspreis ein ganzes Jahr kalkuliert, setzt sein Modellbudget für 2027 bereits vor einer möglichen Nutzungsänderung um die Hälfte zu niedrig an.
Das Modell verarbeitet in einer Anfrage bis zu 1 Million Tokens aus Text, Bildern und Video und kann höchstens 64.000 Tokens ausgeben. Ein längerer Kontext spart einen Teil der technischen Aufteilung großer Dokumente, erhöht aber auch die Kosten eines erfolglosen Durchlaufs. Google nennt verbesserte mehrstufige Planung und Werkzeugnutzung. Aktualisierte Schutzmechanismen sollen außerdem Missbrauch in chemischen, biologischen, radiologischen und nuklearen Bereichen sowie offensive Cyberaktivitäten begrenzen; Fehlalarmquoten veröffentlicht das Unternehmen nicht.
Wegen der fehlenden Architektur- und Trainingsangaben werden Betriebsdaten besonders wichtig. In den kommenden drei bis sechs Monaten können Käufer den gesamten Tokenverbrauch je fertiger Agentenaufgabe, die Erfolgsquote ohne menschlichen Eingriff und die Zahl der Abläufe messen, die vom Test in einen bezahlten Produktivbetrieb wechseln. Aufgabe, Werkzeugrechte und Abnahmekriterien müssen bei einem Vergleich konstant bleiben. Reicht der Anstieg der Erfolgsquote aus, um die Preisverdopplung am January 1, 2027 auszugleichen, kann Gemini 3.7 Flash seine heutigen Kosten pro Aufgabe nach Ende der Aktion halten. Andernfalls zieht der Einführungspreis vor allem Beschaffung in das Jahr 2026 vor.
Quellen:
Verwandte Artikel
Google bringt drei Gemini-Flash-Modelle: 17 % weniger Tokens, aber kein 3.5 Pro
Google veröffentlichte am 21. Juli 2026 Gemini 3.6 Flash, 3.5 Flash-Lite und das eingeschränkt verfügbare 3.5 Flash Cyber. Preise, Tempo und Benchmarks verbessern sich, 3.5 Pro fehlt weiterhin.
Google Antigravity CLI startet: Gemini CLI wird eingestellt
Google Antigravity CLI ersetzt Gemini CLI am 18. Juni und sperrt kostenlose Nutzer sofort aus. Das ehemals quelloffene Tool wird proprietär, der KI-Coding-Markt vollständig geschlossen.