DeepSeek V4 Flash 0731: Das kosteneffizienteste KI-Modell
Veröffentlicht am 31. Juli 2026, erreicht DeepSeek V4 Flash 0731 eine bahnbrechende Agentenleistung durch erneutes Post-Training, ohne Änderungen an der Architektur. Es zeichnet sich im Coding und in Agenten-Workflows aus.

Wichtige Verbesserungen
Das Update 0731 steigert die Benchmark-Werte drastisch: DeepSWE von 7.3 auf 54.4 und Terminal Bench 2.1 auf 82.7, und übertrifft damit viel größere Modelle. Es unterstützt auch das OpenAI Responses API-Format und reduziert Halluzinationen.
Preisgestaltung und Effizienz
Preis von $0.14 pro 1M Eingabe-Token und $0.28 pro 1M Ausgabe-Token, mit einem Cache-Rabatt von 98%, der gecachte Eingaben auf $0.0028 pro 1M Token senkt. Das macht es bis zu 60% günstiger als GPT-5.6 Luna.
| Modell | Eingabepreis pro 1M Tokens | Ausgabepreis pro 1M Tokens | Cache-Rabatt |
|---|---|---|---|
| DeepSeek V4 Flash 0731 | $0.14 | $0.28 | 98% (im Cache $0.0028) |
| GPT-5.6 Luna | $0.35 | $0.70 | 90% (im Cache $0.035) |
Lassen Sie uns zusammenarbeiten
Benötigen Sie weitere Informationen, Hilfe bei Ihrem Projekt oder zur Entwicklung einer Idee?
Ob einfache Frage, kurzer Zweifel oder ein 5-Minuten-Chat, schreib mir einfach—es kostet nichts und ich helfe immer gerne. Ich liebe es, Probleme zu verstehen, kreative Lösungen zu finden und mich auf einfache, zuverlässige und unkomplizierte Ideen zu konzentrieren, die sich schnell umsetzen lassen.
Kontaktiere mich →