Skip to content
DeepSeek

DeepSeek V4 Flash

Ein unglaublich kosteneffizientes Open-Weights-Reasoning-Modell aus China, das es mit den proprietären Grossen aufnimmt.

Qualität

Modalität

Text

Context

1M tokens

Zugang

Open Weights

Fabians Take

FM

"Es ist fast verdächtig günstig. Ich nutze es über OpenRouter, wenn ich eine Aufgabe hunderte Male laufen lassen will und keine API-Credits verbrennen möchte. Die Reasoning-Fähigkeit zu diesem Preis ist komplett disruptiv."

DeepSeek V4 Flash ist ein in China entwickeltes Open-Weights-Modell, das die Preisstruktur des KI-Markts durcheinandergebracht hat. Gebaut auf einer effizienten Mixture-of-Experts-Architektur (MoE), bietet es Reasoning-Fähigkeiten, die mit erstklassigen proprietären Modellen von OpenAI und Anthropic mithalten, allerdings zu einem Bruchteil der Kosten.

Die Preis-Disruption

Die API-Preise von DeepSeek V4 Flash sind so niedrig, dass sich dadurch grundlegend ändert, was in «agentischen» Workflows möglich ist. Aufgaben, die bisher zu teuer waren, um sie in grossem Massstab zu automatisieren, wie das Durchführen tiefer logischer Prüfungen über tausende Dokumente hinweg, werden plötzlich machbar. Das Modell nutzt standardmässig einen «Thinking»-Modus, der ihm hilft, komplexe Mathematik- und Coding-Aufgaben effektiv zu bewältigen.

Das Fazit

Am besten für: Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist.

Pro

  • Extrem günstige API-Preise (bis zu 100-mal günstiger als GPT-5.5)
  • Standardmässiger «Thinking»-Modus für starkes logisches Reasoning
  • Open-Weights unter einer MIT-Lizenz

Contra

  • Trainingsdaten und vollständige Codebase sind nicht komplett offen
  • Das stark chinesisch geprägte Pretraining kann bei anderen Sprachen gelegentlich Nuancen beeinflussen

Specs

  • Preis $0,14/M Eingabe, $0,28/M Ausgabe (Cache-Misses)
  • Kostenstufe Kostenlos
  • Geschwindigkeit Schnell
  • Lizenz MIT
Entwickler-Doku