DeepSeek V4 Flash
Ein unglaublich kosteneffizientes Open-Weights-Reasoning-Modell aus China, das es mit den proprietären Grossen aufnimmt.
Qualität
Modalität
Text
Context
1M tokens
Zugang
Open Weights
Fabians Take
"Es ist fast verdächtig günstig. Ich nutze es über OpenRouter, wenn ich eine Aufgabe hunderte Male laufen lassen will und keine API-Credits verbrennen möchte. Die Reasoning-Fähigkeit zu diesem Preis ist komplett disruptiv."
DeepSeek V4 Flash ist ein in China entwickeltes Open-Weights-Modell, das die Preisstruktur des KI-Markts durcheinandergebracht hat. Gebaut auf einer effizienten Mixture-of-Experts-Architektur (MoE), bietet es Reasoning-Fähigkeiten, die mit erstklassigen proprietären Modellen von OpenAI und Anthropic mithalten, allerdings zu einem Bruchteil der Kosten.
Die Preis-Disruption
Die API-Preise von DeepSeek V4 Flash sind so niedrig, dass sich dadurch grundlegend ändert, was in «agentischen» Workflows möglich ist. Aufgaben, die bisher zu teuer waren, um sie in grossem Massstab zu automatisieren, wie das Durchführen tiefer logischer Prüfungen über tausende Dokumente hinweg, werden plötzlich machbar. Das Modell nutzt standardmässig einen «Thinking»-Modus, der ihm hilft, komplexe Mathematik- und Coding-Aufgaben effektiv zu bewältigen.
Das Fazit
Am besten für: Reasoning-Aufgaben mit hohem Volumen, bei denen Kosteneffizienz entscheidend ist.
Pro
- Extrem günstige API-Preise (bis zu 100-mal günstiger als GPT-5.5)
- Standardmässiger «Thinking»-Modus für starkes logisches Reasoning
- Open-Weights unter einer MIT-Lizenz
Contra
- Trainingsdaten und vollständige Codebase sind nicht komplett offen
- Das stark chinesisch geprägte Pretraining kann bei anderen Sprachen gelegentlich Nuancen beeinflussen
Specs
- Preis $0,14/M Eingabe, $0,28/M Ausgabe (Cache-Misses)
- Kostenstufe Kostenlos
- ⚡Geschwindigkeit Schnell
- Lizenz MIT