ModellenBedrijf & Markt 🇩🇪 01.08.2026 00:08

Nieuw Flash-model DeepSeek evenaart OpenAI GPT-5.6 Luna met circa 60% lagere kosten

DeepSeekDeepSeek OpenAIOpenAI
DeepSeek heeft een budgetmodel V4 Flash "0731" uitgebracht dat 50 punten scoort op de Artificial Analysis Intelligence-index, tien meer dan de vorige V4 Flash-versie. Het model staat slechts één punt achter op OpenAI's budgetmodel GPT-5.6 Luna, maar kost ongeveer 60% minder per taak dankzij een korting van 98% op cache. De verbeteringen zijn vooral zichtbaar in agentische taken: in de GDPval-benchmark steeg de score van 1189 naar 1559 Elo-punten, en hallucinaties komen minder vaak voor.
DeepSeek heeft een nieuw budgetmodel uitgebracht, V4 Flash "0731", dat 50 punten scoort op de Artificial Analysis Intelligence-index, tien punten meer dan de vorige versie die in april 2026 werd uitgebracht. Dit is slechts één punt minder dan OpenAI's budgetmodel GPT-5.6 Luna, terwijl de kosten per taak ongeveer 60 procent lager liggen, zelfs rekening houdend met de prijsverlaging van 80 procent van OpenAI. De belangrijkste factor is DeepSeek's korting van 98 procent op de cache, aanzienlijk hoger dan het industriële gemiddelde van 90 procent. Het model verbruikt ook twaalf procent minder tokens dan zijn voorganger. Verbeteringen zijn zichtbaar in alle testcategorieën, vooral bij agentische taken: in de GDPval-benchmark, die complexe kantoorwerkzaamheden in de echte wereld meet, steeg de score van 1189 naar 1559 Elo-punten, en het percentage hallucinaties daalde. De architectuur blijft ongewijzigd: 284 miljard parameters, waarvan 13 miljard actief, met een contextvenster van één miljoen tokens. De gewichten van het model worden verspreid onder de MIT-licentie op Hugging Face.
Bron: The Decoder (DE) — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws