DeepSeek hat am 31. Juli die offizielle Version von DeepSeek-V4-Flash veröffentlicht, intern V4-Flash-0731. Die Gewichte liegen auf Hugging Face unter MIT-Lizenz, das Modell hat 304 Milliarden Parameter und ein Kontextfenster von einer Million Token. Die Architektur ist laut Unternehmen exakt dieselbe wie in der April-Preview. Der komplette Zugewinn kommt aus dem Nachtraining. Der ursprüngliche Termin Mitte Juli wurde gerissen, und das lange angekündigte große Schwestermodell V4-Pro fehlt weiterhin.
Die Zahl, die hängen bleibt: Terminal Bench 2.1 springt von 61,8 auf 82,7. Auf DeepSWE geht es von 7,3 auf 54,4, was weniger nach Feinschliff klingt als nach einem Modell, das vorher schlicht nicht funktioniert hat. Bemerkenswert ist die Spalte daneben. Die Preview des viel größeren V4-Pro kommt auf 72,1 und 12,8. Das kleine Modell überholt das große also auf allen neun Benchmarks, die DeepSeek selbst in die Tabelle geschrieben hat. Als Referenz stehen dort GLM-5.2 mit 81,0 und Claude Opus 4.8 mit 85,0.
Für Nutzer heißt das vor allem: offene Gewichte, MIT-Lizenz, laufende API-Preissenkung. Wer Agenten baut, bekommt hier ohne Abo und ohne Regionalsperre etwas in die Hand, das nach Herstellerangaben in Reichweite der teuren Kandidaten liegt. Neu ist ein Regler namens reasoning_effort mit den Stufen low, high und max, der steuert, wie lange das Modell vor der Antwort grübelt. Auf den oberen Stufen empfiehlt DeepSeek bis zu 384.000 Token Ausgabelänge, was eine höfliche Umschreibung dafür ist, dass die Rechnung schnell wachsen kann. Passt ins Bild der chinesischen Modelle, die den Preiskampf seit anderthalb Jahren mit Ansage führen.
Ein Vorbehalt bleibt. Die Agenten-Ergebnisse wurden mit DeepSeeks eigenem Harness gemessen, und das ist noch gar nicht veröffentlicht. Benchmarks, die der Hersteller mit selbstgebautem Werkzeug erhebt und deren Werkzeug man nicht nachbauen kann, sind erst einmal Marketing mit Nachkommastellen. Nachprüfen lässt sich das erst, wenn der Code draußen ist. Die Gewichte immerhin sind es schon.
Quellen
- Hugging Face: deepseek-ai/DeepSeek-V4-Flash-0731 (Model Card)
- DeepSeek API Docs: Change Log
- Caixin Global: DeepSeek Releases Official V4-Flash Model as China’s AI Race Intensifies
Ähnliche News
- DeepSeek schlägt mit 13 Milliarden aktiven Parametern das eigene große Modell
- Microsoft baut sich sein eigenes Cyber-Modell und lässt GPT nur noch die Drecksarbeit machen
- Mira Muratis erstes Modell ist da und will gar nicht das Beste sein
Diese Meldung wurde mit Unterstützung von Claude (Anthropic) recherchiert und verfasst. Inhaltliche Fehler sind möglich. Die verlinkten Quellen ermöglichen eine eigene Prüfung. Fachbegriffe erläutert das Glossar.