ModelleGeschäft & Markt 🇩🇪 01.08.2026 00:08

Neues Flash-Modell DeepSeek erreicht Niveau von OpenAI GPT-5.6 Luna bei etwa 60 Prozent geringeren Kosten

DeepSeekDeepSeek OpenAIOpenAI
Das Unternehmen DeepSeek hat das kostengünstige Modell V4 Flash "0731" veröffentlicht, das im Artificial Analysis Intelligence Index 50 Punkte erreicht, zehn mehr als die bisherige Version V4 Flash. Das Modell liegt nur einen Punkt hinter dem kostengünstigen Modell OpenAI GPT-5.6 Luna, kostet aber dank eines 98-Prozent-Rabatts auf den Cache etwa 60 Prozent weniger pro Aufgabe. Die Verbesserungen sind besonders bei Agentenaufgaben spürbar: Im GDPval-Benchmark stieg der Wert von 1189 auf 1559 Elo-Punkte, und Halluzinationen sind seltener geworden.
DeepSeek hat ein neues Budget-Modell veröffentlicht, V4 Flash "0731", das im Artificial-Analysis-Intelligence-Index 50 Punkte erzielt und damit zehn Punkte mehr als die im April 2026 veröffentlichte Vorgängerversion. Das ist nur ein Punkt weniger als OpenAIs Budget-Modell GPT-5.6 Luna, während die Kosten pro Aufgabe etwa 60 Prozent niedriger liegen, selbst wenn man OpenAIs Preissenkung von 80 Prozent berücksichtigt. Der entscheidende Faktor ist DeepSeeks Cache-Rabatt von 98 Prozent, der deutlich über dem Branchendurchschnitt von 90 Prozent liegt. Das Modell verbraucht außerdem zwölf Prozent weniger Tokens als sein Vorgänger. Die Verbesserungen erstrecken sich über alle Testkategorien, insbesondere bei agentischen Aufgaben: Im GDPval-Benchmark, der komplexe reale Büroarbeit misst, stieg die Punktzahl von 1189 auf 1559 Elo-Punkte, und die Halluzinationsrate sank. Die Architektur bleibt unverändert: 284 Milliarden Parameter, von denen 13 Milliarden aktiv sind, mit einem Kontextfenster von einer Million Tokens. Die Gewichte des Modells werden unter der MIT-Lizenz auf Hugging Face verteilt.
Quelle: The Decoder (DE) — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten