Wir stellen vor: Gemini 3.7 Flash

Inhaltsverzeichnis

Das Wichtigste auf einen Blick:

  • Gemini 3.7 Flash startet drei Wochen nach 3.6 Flash und kostet während der Einführungsphase nur halb so viel pro Million Token.
  • Es verzeichnet zweistellige Leistungssteigerungen bei Programmier-Benchmarks, darunter FrontierCode 1.1 Main (43,6 % gegenüber 34,4 %) und DeepSWE v1.1 (65,3 % gegenüber 49,0 %).
  • Der Einführungspreis beträgt bis zum 31. Dezember 2026 0,75 US-Dollar pro 1 Million Eingabetoken und 3,75 US-Dollar pro 1 Million Ausgabetoken.
  • Bei der Webentwicklung, der Dokumentenanalyse und der Geschäftsautomatisierung sind gegenüber 3.6 Flash deutliche Leistungssteigerungen zu verzeichnen.
  • Gemini Spark, Googles rund um die Uhr verfügbarer persönlicher KI-Agent, läuft nun auf 3.7 Flash in über 160 Ländern für AI Pro- und Ultra-Abonnenten.

Googles Flash-Reihe hat sich zum standardmäßigen „Arbeitstier“-Modell für Teams entwickelt, die Produktionsagenten bereitstellen: schnell genug für echten Nutzerverkehr, preislich niedrig genug für Millionen von täglichen Aufrufen und leistungsfähig genug für die meisten Programmieraufgaben, die Erstellung von Benutzeroberflächen und die Bearbeitung von Dokumenten. Diese Gleichung hat sich gerade erneut verschoben. Gemini 3.7 Flash erscheint kaum drei Wochen nach 3.6 Flash, und der Preis wird für den Rest des Jahres 2026 halbiert. Wenn Sie die Kosten für die Entwicklung eines Agenten auf der Grundlage der Wirtschaftlichkeit von 3.6 Flash veranschlagt haben, können Sie nun mit demselben Produktionsbudget ein leistungsstärkeres Modell nutzen. Dieser Beitrag erläutert, was sich tatsächlich geändert hat, die Unterschiede in den Benchmark-Ergebnissen, die neue Preisliste, wo Google das Modell bereits einsetzt und worauf Sie achten sollten, bevor Sie eine laufende Arbeitslast migrieren.

Was Gemini 3.7 Flash eigentlich ist

Gemini 3.7 Flash ist Googles neuestes Gemini-Modell der mittleren Leistungsklasse und wird als das leistungsfähigste „Arbeitstier“ für Programmier- und Agenten-Workflows positioniert. Laut Google ist das Modell eine direkte Reaktion auf das Entwickler-Feedback zu 3.6 Flash, kombiniert mit neuen algorithmischen Entwicklungen, die das Team in zukünftige Versionen einbringen will. Es reiht sich in dieselbe Geschwindigkeits- und Kostenstufe wie 3.6 Flash ein, anstatt die größeren Pro- oder Ultra-Stufen zu ersetzen.

Das Hauptargument ist einfach: bessere Ergebnisse, weniger Überwachung, der halbe Preis während der Einführungsphase. Google stellt es als ein Modell dar, das durch mehrstufige Pläne und Tool-Aufrufe „sorgfältiger denkt“, was in der Praxis weniger Wiederholungsversuche und weniger manuelle Korrekturen bei technischen Aufgaben bedeutet. Wenn Sie den vollständigen Hintergrund zur vorherigen Version erfahren möchten, bietet unsere Analyse zu Gemini 3.6 Flash die 3.6-Familie ausführlich.

Gemini 3.7 Flash vs. Gemini 3.6 Flash: die Unterschiede in den Benchmark-Ergebnissen

Google hat die Ergebnisse von fünf Tests im direkten Vergleich veröffentlicht, und die Unterschiede sind nicht unerheblich. Bei Programmierung, Webentwicklung, der Bearbeitung komplexer Dokumente und der Automatisierung von Geschäftsabläufen sind die Werte durchweg gestiegen.

Benchmark 3.6 Flash Gemini 3.7 Flash
FrontierCode 1.1 Hauptversion 34,4 % 43,6 %
DeepSWE v1.1 49,0 % 65,3 %
WebDev Arena (Elo) 1538 1588
GDP.pdf 22,0 % 34,0 %
AutomationBench 17,0 % 30,4 %

Der Sprung bei DeepSWE sticht besonders hervor. Ein Anstieg von 49 % auf 65 % bei Aufgaben zur Fehlerbehebung macht den Unterschied zwischen einem Modell, das man ständig anleiten muss, und einem, dem man einfach ein Bug-Ticket übergeben kann. FrontierCode misst die produktionsreife Code-Ausgabe bereits beim ersten Durchlauf, und ein Zuwachs von 9 Punkten summiert sich schnell, wenn Ihr Agent Dutzende paralleler Bearbeitungen durchführt.

Wo sich die Gewinne tatsächlich zeigen

Die beiden für Unternehmenskunden praktisch nützlichsten Sprünge sind GDP.pdf und AutomationBench. Laut Google misst GDP.pdf, wie gut ein Modell komplexe Dokumente verarbeitet – also die Art von informationsdichten Berichten, wie sie in den Bereichen Finanzen, Recht und Biowissenschaften üblich sind. Eine fast doppelte Steigerung dieses Wertes ist entscheidend, wenn Ihr Agent einen 200-seitigen Prospekt oder eine Gerichtsakte lesen soll, ohne dabei eine Fußnote zu übersehen. AutomationBench tut dasselbe für durchgängige Geschäftsabläufe, und 3.7 Flash verdoppelt auch hier fast den Wert von 3.6.

Preise und API-Verfügbarkeit von Gemini 3.7 Flash

Hier wird die Veröffentlichung richtig aggressiv. Die Einführungspreise liegen bei 0,75 US-Dollar pro 1 Million Eingabe-Token und 3,75 US-Dollar pro 1 Million Ausgabe-Token – das ist etwa die Hälfte des Einführungspreises von 3.6 Flash pro Token.

Fenster Eingabe (pro 1 Mio. Token) Ausgabe (pro 1 Mio. Token)
Einführungsangebot (bis zum 31. Dezember 2026) 0,75 $ 3,75
Standard (ab 1. Januar 2027) 1,50 $ 7,50

Ein paar Dinge sind zu beachten. Erstens liegen die Standardpreise für 2027 wieder genau auf dem Niveau der üblichen Flash-Tier-Tarife, betrachten Sie das aktuelle Angebot also als echten Rabatt und nicht als dauerhafte Preissenkung. Zweitens kosten Ausgabetoken nach wie vor das Fünffache der Eingabetoken – das entspricht dem üblichen Gemini-Verhältnis. Das ist bei Agent-Workloads von Bedeutung, bei denen das Modell seine Schlussfolgerungen erläutert oder lange Code-Dateien schreibt, da die Kosten vor allem bei der Ausgabe entstehen.

Für Teams, die bereits 3.6 Flash über die Gemini-API nutzen, bleibt der Migrationspfad dieselbe Modellfamilie und derselbe Vertrag für den Tool-Aufruf. Das bedeutet, dass die meisten Produktionsstacks die Modellzeichenfolge austauschen und ihre Testsuite noch am selben Tag erneut ausführen können.

Was Google intern mit 3.7 Flash macht

Google hat vier konkrete Builds hervorgehoben, die es auf 3.7 Flash ausgeführt hat; diese geben einen nützlichen Einblick darin, wozu das Modell wirklich dient. Es generierte aus einer einzigen Textanweisung ein vollständig spielbares 3D-Spiel und nutzte dabei Nano Banana, um Charaktere, Gegenstände und Texturen in Echtzeit zu erzeugen. Es koordinierte Unteragenten (wobei Gemini Omni die Parallax-Komponenten übernahm), um auf einen Schlag eine interaktive Landingpage zu erstellen. Es trainierte ein Robotikmodell innerhalb einer Graphschleife mit drei Agenten unter Verwendung multimodalen Verständnisses. Und es wandelte einen statischen Jahresbericht im PDF-Format in eine lebendige, interaktive Datengeschichte mit Diagrammen und aggregierten Erkenntnissen um.

Das hier erkennbare Muster ist es wert, benannt zu werden: Google präsentiert 3.7 Flash als Koordinator, nicht nur als Codegenerator. In jeder Demo ist 3.7 Flash das Modell, das andere Modelle aufruft. Unser Artikel zu Nano Banana 2 Lite behandelt diese Begleitmodelle und bietet, falls Sie sich für den Robotik-Aspekt interessieren, einen umfassenderen Überblick.

[Bild: Ein Entwickler an einem hellen, modernen Schreibtisch beobachtet, wie ein Browser neben einem Code-Editor eine interaktive Live-Landingpage rendert – Blick über die Schulter]

Gemini Spark läuft jetzt auf 3.7 Flash

Gemini Spark, Googles stets aktiver persönlicher KI-Agent, der auf der I/O vorgestellt wurde, wechselt ab heute für AI Pro- und Ultra-Abonnenten in über 160 Ländern auf 3.7 Flash. Laut Google verbessert dieser Wechsel die Nutzung der Spark-Tools in allen Google Workspace-Anwendungen, sodass das Zusammenführen von Dateien in Drive, das Verfassen von E-Mails in Gmail oder das Aktualisieren von Statusdokumenten deutlich flüssiger von der Hand gehen sollte.

Dies ist die greifbarste Art und Weise, wie die meisten Google-Nutzer das Update wahrnehmen werden. Man wählt kein Modell aus einem Dropdown-Menü aus, sondern bemerkt einfach, dass Spark anwendungsübergreifende Anfragen zuverlässiger abwickelt.

Wie sich dies auf die Wirtschaftlichkeit der Agenten auswirkt

Die Halbierung der Token-Kosten in Verbindung mit einer verbesserten Tool-Aufrufleistung bedeutet eine echte Budgetverschiebung für alle, die Agenten im Spark-Stil in großem Maßstab betreiben. Wenn Sie zuvor komplexe Workspace-Workflows an ein größeres Pro-Modell weitergeleitet haben, um die Qualität aufrechtzuerhalten, schließt 3.7 Flash diese Lücke wahrscheinlich so weit, dass der Datenverkehr wieder auf die Flash-Stufe zurückverlagert werden kann. Die Einsparungen summieren sich mit jedem zusätzlichen Wiederholungsversuch, den das Modell nicht benötigt.

Sicherheits- und Missbrauchsschutzmaßnahmen

Gemini 3.7 Flash wird mit aktualisierten Frontier-Sicherheitsmaßnahmen ausgeliefert, die sich auf den Missbrauch im Bereich chemischer, biologischer, radiologischer und nuklearer Stoffe (CBRN) sowie auf Cyberangriffe konzentrieren. Google gibt an, dass die Schutzmaßnahmen so kalibriert sind, dass legitime Nutzungen weiterhin zulässig sind, im Einklang mit den veröffentlichten Programmen zu biologischer Resilienz und Cybersicherheit. Das Unternehmen veröffentlicht seinen allgemeinen Sicherheitsansatz über Google DeepMind, und die Modellkarte zu 3.7 Flash dokumentiert die hier angewandten spezifischen Schutzmaßnahmen.

Für regulierte Branchen, die eine Due-Diligence-Prüfung durchführen, ist diese Modellkarte das Dokument, das Ihr Risikomanagementteam lesen sollte, bevor es die produktive Bereitstellung genehmigt.

Wie sich Gemini 3.7 Flash im Vergleich zum breiteren Modellmarkt schlägt

Gemini 3.7 Flash positioniert sich in einem stark umkämpften mittleren Segment. Die Sonnet-Reihe von Anthropic, die kleineren GPT-Modelle von OpenAI und die Qwen-Familie von Alibaba konkurrieren alle um denselben Platz: „gut genug für Agenten, günstig genug für den Massenmarkt“. Allein was den Preis angeht, gehören die Einführungsraten von 0,75 $ bzw. 3,75 $ zu den aggressivsten, die wir in diesem Jahr von einem Pionierlabor gesehen haben. Wenn Sie einen Überblick über die Wettbewerbslage auf der chinesischen Seite dieses Marktes erhalten möchten, finden Sie in unserem Artikel eine detaillierte Analyse der Zahlen.

Ehrlicherweise muss man jedoch anmerken, dass von Anbietern veröffentlichte Benchmarks diesen stets in einem besseren Licht erscheinen lassen. Führen Sie Ihre eigene Bewertung anhand Ihrer eigenen Workloads durch, bevor Sie kritische Daten migrieren.

Häufig gestellte Fragen

Wann wurde Gemini 3.7 Flash veröffentlicht?

Google hat Gemini 3.7 Flash im August 2026 angekündigt, etwa drei Wochen nach Gemini 3.6 Flash. Es ist ab dem Tag der Ankündigung über die Gemini-API verfügbar, und Gemini Spark hat am selben Tag für AI Pro- und Ultra-Abonnenten in über 160 Ländern darauf umgestellt.

Wie viel kostet Gemini 3.7 Flash?

Der Einführungspreis beträgt 0,75 US-Dollar pro 1 Million Eingabe-Token und 3,75 US-Dollar pro 1 Million Ausgabe-Token und gilt bis zum 31. Dezember 2026. Ab dem 1. Januar 2027 steigen die Preise auf 1,50 US-Dollar pro 1 Million Eingabe-Token und 7,50 US-Dollar pro 1 Million Ausgabe-Token. Der Einführungspreis beträgt etwa die Hälfte des Preises, zu dem 3.6 Flash eingeführt wurde.

Ist „Gemini 3.7 Flash“ zum Programmieren besser als „3.6 Flash“?

Ja, laut den von Google veröffentlichten Benchmarks. Gemini 3.7 Flash erreicht bei FrontierCode 1.1 Main 43,6 % gegenüber 34,4 % bei 3.6 Flash und bei DeepSWE v1.1 65,3 % gegenüber 49,0 %. Google berichtet zudem von einer höheren Code-Genauigkeit beim ersten Durchlauf und einer besseren Aufrufsteuerung bei mehrstufigen Tools, was vor allem für Agenten-Workloads wichtig ist, bei denen viele Aktionen miteinander verkettet werden.

Kann ich Gemini 3.7 Flash für die Dokumentenanalyse nutzen?

Ja, und dies ist einer der größten Fortschritte in dieser Version. Im „GDP.pdf“-Benchmark für die Verarbeitung komplexer Dokumente erreicht 3.7 Flash eine Punktzahl von 34,0 % gegenüber 22,0 % bei 3.6 Flash. Google nennt ausdrücklich die Bereiche Finanzen, Recht und Biowissenschaften als Zielanwendungsfälle und führt als internes Beispiel die Umwandlung statischer Jahresberichte in interaktive Datengeschichten an.

Ersetzt Gemini 3.7 Flash Gemini Pro?

Nein. 3.7 Flash ist das Arbeitstier der mittleren Leistungsstufe und auf Kosten, Geschwindigkeit und Volumen optimiert. Gemini Pro bleibt die leistungsstärkere Stufe für Aufgaben, bei denen Qualität wichtiger ist als Latenz oder Preis. Die meisten Produktionsteams nutzen beide Varianten und leiten besonders kritische Aufgaben an Pro weiter, während alles andere über Flash abgewickelt wird.

Welche Sicherheitsmaßnahmen sind in Gemini 3.7 Flash enthalten?

Google hat seine „Frontier Safety“-Sicherheitsmaßnahmen für diese Version aktualisiert, wobei der Schwerpunkt auf dem Missbrauch chemischer, biologischer, radiologischer und nuklearer Stoffe (CBRN) sowie auf Cyberangriffen liegt, während legitime Anwendungsfälle weiterhin geschützt bleiben. Die vollständigen Schutzmaßnahmen sind in der zusammen mit der Version veröffentlichten Modellkarte dokumentiert.

Was ist als Nächstes zu tun?

Wenn Sie bereits mit 3.6 Flash arbeiten, führen Sie Ihre bestehende Testsuite diese Woche mit 3.7 Flash durch. Das Preisfenster schließt am 31. Dezember 2026, und der Unterschied in der Zuverlässigkeit des Tool-Aufrufs ist eine Veränderung, die sich am deutlichsten in Ihrem eigenen Datenverkehr zeigt – nicht in Googles Benchmark-Tabelle. Wenn Sie einen Agenten von Grund auf neu entwickeln, ist dies ein wirklich guter Zeitpunkt, um damit zu beginnen: Das Modell ist leistungsfähiger, die Tokens sind günstiger und das Ökosystem rund um das Modell (Nano Banana, Gemini Omni, Spark) wächst rasant.

Table of Contents

Jetzt kostenloses Erstgespräch vereinbaren

Details

Aktie

Buchen Sie noch heute Ihre kostenlose KI-Beratung

Stellen Sie sich vor, Sie könnten Ihren Affiliate-Marketing-Umsatz verdoppeln, ohne Ihren Arbeitsaufwand zu verdoppeln. Klingt zu schön, um wahr zu sein. Dank der schnellen …

Ähnliche Beiträge

KI in der Immobilienbranche: Warum Maklerbüros gerade jetzt investieren

OpenAI für Singapur: Die strategische 300-Millionen-Dollar-Wette auf Singapurs KI-Zukunft

OpenAI Daybreak: GPT-5.5-Cyber, Trusted Access, Codex Security – Ausführliche Analyse (2026)