Gemini 3.7 Flash: Google halbiert Preis und legt beim Coding stark zu
• 17.08.26 Nur drei Wochen nach Gemini 3.6 Flash legt Google bereits nach: Mit Gemini 3.7 Flash erscheint ein neues KI-Modell, das vor allem beim Programmieren, bei komplexen Arbeitsabläufen und beim Einsatz autonomer KI-Agenten deutlich zulegen soll. Gleichzeitig sorgt Google beim Preis für eine Überraschung.
|
|
Gemini 3.7 Flash: Google halbiert Preis und legt beim Coding stark zu
Die zweite Schlagzeile: Gemini 3.7 Flash startet nicht nur leistungsfähiger, sondern kostet pro Million Tokens zunächst nur halb so viel wie Gemini 3.6 Flash bei dessen ursprünglicher Einführung. Damit richtet sich Google klar an Entwickler und Unternehmen, die KI nicht nur gelegentlich testen, sondern in großen Mengen produktiv einsetzen wollen.
|
|
Gemini 3.7 Flash: Google halbiert Preis und legt beim Coding stark zu -Bild: © TelefonTarifrechner.de |
Google hat Gemini 3.7 Flash am 13. August 2026 offiziell vorgestellt. Die Ankündigung von Google bezeichnet das Modell als bislang intelligentestes "Workhorse"-Modell der Flash-Reihe für Coding und Agenten.
Gemini 3.7 Flash erscheint nur drei Wochen nach dem Vorgänger
Das Tempo ist ungewöhnlich. Gemini 3.6 Flash war erst am 21. Juli 2026 vorgestellt worden. Nun folgt bereits Version 3.7. Google erklärt den schnellen Schritt mit Rückmeldungen von Entwicklern und neuen algorithmischen Verbesserungen, die direkt in das Modell eingeflossen seien.
Dabei handelt es sich nicht um eine komplett neue Modellarchitektur. Gemini 3.7 Flash basiert laut Google DeepMind weiterhin auf Gemini 3.6 Flash. Verbessert wurde vor allem die zugrunde liegende Reasoning-Basis. Das Modell soll dadurch bei längeren und komplizierteren Aufgaben zuverlässiger planen, Hindernisse besser erkennen und Anweisungen genauer umsetzen.
Das ist besonders für sogenannte KI-Agenten wichtig. Solche Systeme beantworten nicht nur einzelne Fragen, sondern führen über mehrere Schritte hinweg Aufgaben aus, nutzen externe Werkzeuge, lesen Dokumente oder arbeiten mit anderen Anwendungen zusammen. Wie stark Google diesen Bereich ausbaut, zeigt auch der bereits zuvor vorgestellte Gemini-Spark-Agent.
Gemini 3.7 Flash vs. 3.6 Flash: Die wichtigsten Daten
| Merkmal | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| Modelltyp | Multimodales Reasoning-Modell | Multimodales Reasoning-Modell |
| Input-Kontext | Bis zu 1 Mio. Tokens | 1.048.576 Tokens |
| Maximaler Output | 64K Tokens | 65.536 Tokens |
| Thinking-Stufen | Steuerbar | Low, Medium, High |
| Input-Preis bis 31.12.2026 | 0,75 US-Dollar | 0,75 US-Dollar je 1 Mio. Tokens |
| Output-Preis bis 31.12.2026 | 3,75 US-Dollar | 3,75 US-Dollar je 1 Mio. Tokens |
| Modellkennung | gemini-3.6-flash | gemini-3.7-flash |
Ein wichtiger Punkt beim Preisvergleich: Google bewirbt Gemini 3.7 Flash mit einem Einführungspreis von der Hälfte des ursprünglichen Gemini-3.6-Flash-Preises. Inzwischen gilt der reduzierte Einführungspreis laut Google DeepMind auch für 3.6 Flash. Wer beide Modelle heute vergleicht, sieht deshalb zunächst denselben rabattierten Tokenpreis.
Beim Coding macht Gemini 3.7 Flash einen deutlichen Sprung
Die auffälligsten Verbesserungen zeigen sich beim Gemini 3.7 Flash Coding. Google nennt mehrere Benchmarks, in denen das neue Modell seinen Vorgänger klar übertrifft. Beim FrontierCode-1.1-Test für produktionsnahen Code steigt das Ergebnis von 34,4 auf 43,6 Prozent.
Noch deutlicher fällt der Unterschied bei DeepSWE v1.1 aus. Dieser Benchmark prüft längere Software-Engineering-Aufgaben. Hier erreicht Gemini 3.7 Flash laut DeepMind 65,3 Prozent, während Gemini 3.6 Flash bei 48,6 Prozent liegt.
| Benchmark | Gemini 3.6 Flash | Gemini 3.7 Flash | Unterschied |
|---|---|---|---|
| FrontierCode 1.1 | 34,4 % | 43,6 % | +9,2 Punkte |
| DeepSWE v1.1 | 48,6 % | 65,3 % | +16,7 Punkte |
| Code Arena / Webentwicklung | 1538 Elo | 1588 Elo | +50 Elo |
| Terminal-bench 2.1 | 78,0 % | 85,8 % | +7,8 Punkte |
| AutomationBench | 17,0 % | 30,4 % | +13,4 Punkte |
| GDP.pdf | 22,0 % | 34,0 % | +12,0 Punkte |
Gerade für Entwickler ist das relevant. Ein Modell, das bei Fehleranalyse, Codeänderungen und längeren Entwicklungsaufgaben seltener neu angesetzt werden muss, kann nicht nur Zeit sparen. Es reduziert im praktischen Einsatz auch die Zahl unnötiger Modellaufrufe.
Webentwicklung soll mit weniger Anläufen funktionieren
Google hebt außerdem die Webentwicklung hervor. Gemini 3.7 Flash soll funktionsfähige Layouts und vollständigere Anwendungen mit weniger Prompts erzeugen. Beim Code-Arena-Test erreicht das Modell 1588 Elo und liegt damit 50 Punkte über Gemini 3.6 Flash.
Interessant ist dabei der Fokus auf vorhandene Designs. Das Modell kann sich laut Google stärker an Screenshots, Bildern und kompletten Designsystemen orientieren. Für Entwickler, die aus einem Mock-up oder einer bestehenden Oberfläche direkt funktionsfähigen Frontend-Code erzeugen wollen, könnte genau das im Alltag wichtiger sein als ein abstrakter Benchmarkgewinn.
KI-Agenten werden zum eigentlichen Schwerpunkt
Der Begriff Flash stand bei Google lange vor allem für schnelle und günstigere Modelle. Bei 3.7 Flash verschiebt sich der Schwerpunkt sichtbar. Geschwindigkeit bleibt wichtig, doch agentische Workflows rücken ins Zentrum.
Das Modell soll bei Problemen besser reagieren, bei unklaren Aufgaben nach dem eigentlichen Ziel unterscheiden und mehr Rechenaufwand in mehrstufige Planung sowie Tool-Aufrufe investieren. Dadurch sollen weniger Wiederholungen und weniger manuelle Eingriffe notwendig sein.
Auch Reuters ordnet den Start entsprechend ein. Die Nachrichtenagentur beschreibt Gemini 3.7 Flash als günstigeres Modell für autonome KI-Systeme, die Aufgaben planen, Softwarewerkzeuge nutzen und mehrstufige Prozesse mit weniger menschlichem Eingreifen erledigen können.
Gemini 3.7 Flash Preis: Das Angebot gilt nur bis Jahresende
Der Gemini 3.7 Flash Preis gehört zu den stärksten Argumenten des neuen Modells. Bis einschließlich 31. Dezember 2026 verlangt Google 0,75 US-Dollar pro Million Input-Tokens und 3,75 US-Dollar pro Million Output-Tokens. Thinking-Tokens sind im Outputpreis enthalten.
Die günstigen Konditionen sind allerdings zeitlich begrenzt. Ab dem 1. Januar 2027 sollen 1,50 US-Dollar pro Million Input-Tokens und 7,50 US-Dollar pro Million Output-Tokens gelten. Wer Anwendungen langfristig kalkuliert, sollte deshalb nicht ausschließlich mit dem aktuellen Einführungspreis rechnen.
Warum der Preis für KI-Agenten besonders wichtig ist
Bei einem normalen Chat fallen oft nur wenige Modellaufrufe an. Ein autonomer Agent kann dagegen für eine einzige Aufgabe zahlreiche Schritte ausführen, Dokumente analysieren, Tools aufrufen und Ergebnisse erneut überprüfen. Jeder zusätzliche Durchlauf erzeugt Tokens. Je komplexer der Agent, desto stärker wirkt sich deshalb der Preis pro Million Tokens auf die laufenden Kosten aus.
Eine Million Tokens Kontext und 65.536 Tokens Ausgabe
Die Gemini 3.7 Flash API unterstützt Text, Bilder, Videos, Audio und PDF-Dateien als Eingabe. Das maximale Kontextfenster liegt bei 1.048.576 Tokens. Damit lassen sich auch umfangreiche Dokumentensammlungen oder größere Codebestände innerhalb eines Kontextes verarbeiten.
Die maximale Textausgabe liegt bei 65.536 Tokens. Zusätzlich unterstützt das Modell Code-Ausführung, Function Calling, File Search, Google-Search-Grounding, strukturierte Ausgaben sowie URL-Kontext. Computer Use ist ebenfalls verfügbar, befindet sich laut Google jedoch noch im Preview-Status. Die technischen Angaben sind in der offiziellen Gemini-API-Dokumentation aufgeführt.
Nicht jeder Benchmark fällt besser aus
Trotz der starken Ergebnisse ist Gemini 3.7 Flash kein Modell, das in jeder einzelnen Disziplin automatisch gewinnt. Beim CharXiv-Reasoning-Benchmark erreicht es ohne Tools beispielsweise 84,5 Prozent. Gemini 3.6 Flash kommt dort auf 85,2 Prozent.
Das ist ein wichtiger Hinweis für die Einordnung. Herstellerbenchmarks liefern Anhaltspunkte, ersetzen aber keinen Test im eigenen Arbeitsablauf. Unternehmen und Entwickler sollten deshalb prüfen, ob die Verbesserungen genau bei den Aufgaben auftreten, die für ihre Anwendung relevant sind.
Google DeepMind nennt außerdem weiterhin allgemeine Grenzen großer Sprachmodelle. Dazu gehören mögliche Halluzinationen sowie gelegentliche Verzögerungen oder Timeouts. Die detaillierten Ergebnisse und Einschränkungen dokumentiert DeepMind in seiner Model Card zu Gemini 3.7 Flash.
Für wen lohnt sich Gemini 3.7 Flash?
-
• Softwareentwickler: Besonders interessant sind die höheren Werte bei Codequalität, Debugging und längeren Engineering-Aufgaben.
• Unternehmen: Agenten können Dokumente, Tools und mehrstufige Geschäftsprozesse miteinander verbinden.
• Webentwickler: Die stärkere Orientierung an Screenshots und Designsystemen kann Frontend-Arbeit beschleunigen.
• API-Nutzer mit hohem Volumen: Der Einführungspreis macht große Tokenmengen zunächst vergleichsweise günstig.
• Gemini-Spark-Nutzer: Google setzt Gemini 3.7 Flash direkt im persönlichen Spark-Agenten für Pro- und Ultra-Abonnenten ein.
Fazit: Google greift über Preis, Coding und Agenten an
Gemini 3.7 Flash ist mehr als ein kleines Versionsupdate nach nur drei Wochen. Google verbessert genau jene Bereiche, die für den produktiven Einsatz von KI zunehmend entscheidend werden: Softwareentwicklung, lange Arbeitsabläufe, Tool-Nutzung und autonome Agenten.
Besonders auffällig ist die Kombination aus Leistung und Einführungspreis. Die deutlichen Benchmarkgewinne beim Coding treffen auf Tokenkosten, die zunächst bei der Hälfte des ursprünglichen Gemini-3.6-Flash-Preises liegen. Das dürfte den Druck im Markt für günstige, leistungsfähige Arbeitsmodelle erhöhen.
Gleichzeitig bleibt eine Einschränkung: Der aktuelle Preis gilt nur bis Ende 2026, und nicht jeder Benchmark zeigt Fortschritte. Für Entwickler zählt deshalb weniger die Versionsnummer als die Frage, ob Gemini 3.7 Flash im eigenen Workflow tatsächlich weniger Fehler, weniger Wiederholungen und bessere Ergebnisse liefert.
FAQ zu Gemini 3.7 Flash
Was ist Gemini 3.7 Flash?
Gemini 3.7 Flash ist ein multimodales Reasoning-Modell von Google, das besonders auf Coding, KI-Agenten, Webentwicklung und komplexe Unternehmensabläufe ausgerichtet ist. Es wurde am 13. August 2026 veröffentlicht.
Was kostet Gemini 3.7 Flash?
Bis zum 31. Dezember 2026 kostet die API 0,75 US-Dollar pro Million Input-Tokens und 3,75 US-Dollar pro Million Output-Tokens. Ab dem 1. Januar 2027 sollen die Preise auf 1,50 beziehungsweise 7,50 US-Dollar steigen.
Ist Gemini 3.7 Flash besser als Gemini 3.6 Flash?
In zahlreichen Coding-, Agenten- und Dokumenten-Benchmarks liegt Gemini 3.7 Flash deutlich vor dem Vorgänger. Es gibt jedoch einzelne Tests, in denen 3.6 Flash gleichauf oder leicht besser abschneidet. Entscheidend bleibt daher der konkrete Anwendungsfall.
Wie groß ist das Kontextfenster von Gemini 3.7 Flash?
Gemini 3.7 Flash unterstützt bis zu 1.048.576 Input-Tokens und maximal 65.536 Output-Tokens. Als Eingaben sind unter anderem Text, Bilder, Videos, Audio und PDF-Dateien möglich.
|
| Claude Opus 4.8: KI denkt jetzt auf Abruf tiefer nach -Bild: © Tarifrechner.de/KI |
Damit Ihnen in Zukunft keine aktuellen News oder Spar-Angebot entgeht, können Sie sich auch bei unserem kostenlosen Newsletter anmelden. Einmal in der Woche bekommen Sie dann eine Übersicht an Aktionen und wichtigen Änderungen im Telefonmarkt. Auch können Sie uns auf X (ehemals Twitter) und Facebook folgen.
| Verwandte Nachrichten: |
|
|
Auf dieser Seite gibt es Affilate Links, die den Preis nicht beeinflussen. Damit wird der hochwertige Journalismus kostenfrei angeboten |

