ModellenBedrijf & Markt 🇷🇺 10.08.2026 14:01

Qwen3.8 Max uitgebracht: presteert beter dan Claude Fable 5 in Agentic Index voor $6 per miljoen tokens

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
Alibaba heeft de definitieve versie van Qwen3.8 Max uitgebracht, een multimodaal model met 2,4 biljoen parameters en een context van een miljoen tokens. Onafhankelijke tests tonen aan dat het Claude Fable 5 overtreft in de Agentic Index, en de API-prijzen liggen aanzienlijk lager dan die van concurrenten. Open gewichten zijn echter nog steeds in behandeling.
Alibaba heeft officieel Qwen3.8 Max uitgebracht, een native multimodale mixture-of-experts-model met 2,4 biljoen parameters. Het model ondersteunt tekst, afbeeldingen en video als invoer, en levert tekst als uitvoer, met een contextvenster van maximaal één miljoen tokens (983.000 invoer- en 131.000 uitvoertokens in denkmodus). Het model beschikt over hybride denken dat standaard is ingeschakeld, het aanroepen van functies en ingebouwde tools, en wordt gepromoot voor programmeren en professionele agentische workflows. Onafhankelijke tests door Artificial Analysis tonen aan dat Qwen3.8 Max een score van 58,1 behaalt op de Intelligentie-Index (tegenover 62,1 voor Claude Fable 5) en 58,4 op de Agentische Index (tegenover 56,6 voor Claude Fable 5), waarbij slechts twee modi van Claude Opus 5 hoger scoren. De prijs is vastgesteld op 2 dollar per miljoen invoertokens en 6 dollar per miljoen uitvoertokens, met gecachte reads voor 0,25 dollar per miljoen tokens – ruwweg vijf keer goedkoper dan Claude Fable 5 voor invoer en 8,3 keer goedkoper voor uitvoer. Het model is echter omslachtig: het genereerde ongeveer 150 miljoen tokens bij een volledige run van de Intelligentie-Index, ongeveer 2,3 keer het mediaan (66 miljoen) van vergelijkbare modellen. De snelheid is ongeveer 82 uitvoertokens per seconde, met een latentie voor het eerste token van ongeveer 2,8 seconden. Op de ochtend van 10 augustus waren de open gewichten voor Qwen3.8 Max en Qwen3.8-27B nog niet gepubliceerd, hoewel Alibaba beloofde dat ze in de week van 3 augustus zouden verschijnen. Het grote model vereist ongeveer 4,8 TB in BF16 of 1,2 TB in 4-bit, wat lokale implementatie voor de meeste gebruikers onpraktisch maakt. Het artikel suggereert dat Qwen3.8 Max geschikt is voor agentisch coderen, analyse van lange documenten, meerstapsprocessen en als back-up voor Claude, maar raadt aan om het eerst te testen op de eigen taken voordat je overstapt.
Bron: Habr — хаб ИИ — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws