Zum Inhalt springen
Google

Gemini 3.7 Flash

Googles schnelles Arbeitstier-Modell für Coding, Agents und alltägliche Wissensarbeit zum Budget-Preis.

Qualität

Modalität

Multimodal

Context

1M tokens

Zugang

Geschlossen

Fabians Take

FM

"Flash sitzt an einer interessanten Stelle: bei harten Problemen klar hinter den Frontier-Modellen, aber so schnell und günstig, dass mir das für eine ganze Klasse von Aufgaben egal geworden ist. Am meisten nutze ich es zum Experimentieren an Websites, wo es schneller iteriert, als ich prüfen kann. Wenn du weisst, wo seine Grenze liegt, bekommst du sehr viel für sehr wenig."

Gemini 3.7 Flash ist Googles selbsterklärtes «intelligentestes Arbeitstier-Modell», erschienen im August 2026, nur Wochen nach 3.6 Flash. Das Versprechen ist Geschwindigkeit und Preis statt maximaler Intelligenz: Es behält die sofortigen Antwortzeiten, für die die Flash-Reihe bekannt ist, und macht gegenüber dem Vorgänger grosse Sprünge bei Coding- und Agent-Benchmarks.

Was sich geändert hat

Die Gewinne konzentrieren sich genau dort, wo Arbeitstier-Modelle ihr Geld verdienen: Software-Engineering, agentische Aufgaben und Web-Entwicklung. Es kommt mit einstellbaren Thinking-Leveln (niedrig, mittel, hoch), sodass du etwas Geschwindigkeit gegen sorgfältigere Antworten eintauschen kannst, und einer Computer-Use-Fähigkeit in der Preview. Verfügbar ist es in der Gemini-App, in Google AI Studio, über die Gemini-API und als Engine in Google Antigravity.

Wie du es nutzt

Behandle Flash als das Modell für Volumen — und kenne die Grenze. Schnelle UI-Iterationen, mehrsprachige Texte, die Analyse von Screenshots und Mockups sowie kleine Coding-Aufgaben liegen alle in seiner Komfortzone, und der Einführungspreis der API macht es zu einem der günstigsten leistungsfähigen Modelle überhaupt. Für wirklich harte Logik oder Reasoning mit hohem Einsatz wechselst du auf ein Frontier-Modell und lässt Flash alles drumherum erledigen.

Das Fazit

Am besten für: Schnelle, günstige Ausführung einfacher bis mittelschwerer Aufgaben: Coding, Agents, Texte und UI/UX-Analyse.

Pro

  • Aussergewöhnlich schnelle Antwortzeiten
  • Deutliche Benchmark-Gewinne gegenüber 3.5/3.6 Flash bei Software-Engineering und Agent-Aufgaben
  • Einstellbare Thinking-Level und Computer-Use-Unterstützung (Preview)
  • Sehr aggressiver Einführungspreis

Contra

  • Bei wirklich schwierigem Reasoning klar hinter den Frontier-Modellen
  • Ausgabe auf 64K Tokens begrenzt

Specs

  • Preis $0,75/M Eingabe, $3,75/M Ausgabe (Einführungspreis bis Ende 2026, danach $1,50/$7,50)
  • Kostenstufe Günstig
  • Geschwindigkeit Sofort
  • Lizenz Proprietär
Entwickler-Doku

Zugriff auf dieses Modell über