Die neueste Version von DeepSeek, das Modell V4 Flash 0731, hat mit 50 Punkten im Artificial Analysis Intelligence Index einen bemerkenswerten Fortschritt erzielt. Dies bedeutet einen Anstieg um 10 Punkte im Vergleich zum Vorgängermodell, das im April 2026 veröffentlicht wurde. Damit liegt es nun 6 Punkte vor dem DeepSeek V4 Pro.
DeepSeek V4 Flash 0731 erreicht damit einen Punktestand, der nur einen Punkt hinter dem GPT-5.6 Luna (maximal 51) liegt. Trotz einer Preissenkung von 80 % für GPT-5.6 Luna bleibt der Preis pro Aufgabe für DeepSeek V4 Flash 0731 etwa 60 % niedriger als der von GPT-5.6 Luna, einem Modell mit vergleichbarer Intelligenz. Ein wesentlicher Faktor für diesen Preisunterschied ist der Rabatt von etwa 98 % auf die Cache-Hit-Preise von DeepSeek, was deutlich aggressiver ist als der 90 % Rabatt, den die meisten Wettbewerber anbieten. Fable 5 von Anthropics übertrifft Konkurrenz in KI-Benchmarks, bleibt jedoch teuer.
Leistungssteigerungen und Vergleich mit anderen Modellen
Das neue Modell stellt einen signifikanten Fortschritt im Vergleich zur vorherigen Generation, dem DeepSeek V4 Flash (40 Punkte), dar und liegt nur einen Punkt hinter dem GLM-5.2 (maximal 51 Punkte). Es bleibt jedoch 7 Punkte hinter dem offenen Gewichtsgrenzwert, der von Kimi K3 (maximal 57 Punkte) gesetzt wurde. Im Vergleich zu anderen kürzlich veröffentlichten Modellen wie Gemini 3.6 Flash (50 Punkte) und Muse Spark 1.1 (xhigh, 51 Punkte) zeigt sich, dass DeepSeek V4 Flash 0731 gut positioniert ist. Die vollständigen Gewichte des Modells werden in den kommenden Wochen erwartet.
Technische Details und Verbesserungen
DeepSeek V4 Flash 0731 behält ein Kontextfenster von 1 Million Tokens bei, und die Gesamtgröße bleibt unverändert bei 284 Milliarden Parametern, wobei 13 Milliarden aktiv zur Inferenzzeit sind.
- Verbesserungen in der agentischen Leistung: DeepSeek V4 Flash 0731 erzielt eine Elo-Bewertung von 1559 auf GDPval-AA v2, was einen Anstieg von 1189 für das vorherige Modell darstellt. Nach der Veröffentlichung der Gewichte wird dies die zweithöchste Bewertung für offene Gewichte sein, hinter Kimi K3 (maximal 1687) und vor GLM-5.2 (maximal 1510).
- Verbesserungen in der AA-Omniscience: DeepSeek V4 Flash 0731 erreicht einen AA-Omniscience-Index von -16, was eine Verbesserung um 7 Punkte im Vergleich zum Vorgänger darstellt. Diese Verbesserung resultiert aus einer reduzierten Halluzinationsrate, während die Gesamtgenauigkeit unverändert bleibt.
- Reduzierung des Tokenverbrauchs: Der Gesamtverbrauch an Ausgabetokens ist um 12 % im Vergleich zum Vorgängermodell gesunken, wobei DeepSeek V4 Flash 0731 etwa 206 Millionen Ausgabetokens verwendet hat.
Zusammenfassung der Ergebnisse
Die Ergebnisse zeigen, dass DeepSeek V4 Flash 0731 in jeder Bewertung des Intelligence Index besser abschneidet als sein Vorgänger. Die Verbesserungen umfassen:
- CritPt: Anstieg um 9 Punkte auf 17 %
- SciCode: Anstieg um 5 Punkte auf 50 %
- Humanity’s Last Exam: Anstieg um 5 Punkte auf 37 %
- AA-LCR: Anstieg um 3 Punkte auf 66 %
- GPQA Diamond: Anstieg um 1 Punkt auf 91 %
Die Preisgestaltung bleibt unverändert bei 0,14 USD/0,28 USD pro 1 Million Eingabe/Ausgabe-Tokens, während der Cache-Hit-Preis bei 0,0028 USD pro 1 Million Tokens liegt, was einem Rabatt von 98 % entspricht.
„`
Quellen: artificialanalysis.ai
Bildquelle: KI generiert
🚀