Alibaba brengt Qwen3.8-Max met 2,4 biljoen parameters uit, open-source gewichten
Alibaba/Qwen
Moonshot AI
Alibaba heeft Qwen3.8-Max onthuld, zijn krachtigste taalmodel met in totaal 2,4 biljoen parameters, ontworpen om autonoom complexe taken over meerdere dagen uit te voeren. In tests codeerde het model software, reproduceerde het onderzoeksresultaten en draaide het een gesimuleerd e-commercebedrijf. Het is nu beschikbaar, met gewichten die volgende week worden vrijgegeven.
Het Qwen-team van Alibaba heeft Qwen3.8-Max geïntroduceerd, een taalmodel met in totaal 2,4 biljoen parameters waarvan er 95 miljard actief zijn per verzoek, gebouwd op de Qwen3.5-architectuur. De focus ligt op het autonoom voltooien van complexe taken over langere perioden. Drie autonome codeerruns werden gepresenteerd als stresstests: het model bouwde de oh-my-cli-tool over een periode van 16 dagen, met 265 commits, 127 pull requests en 151 issues zonder menselijke tussenkomst; het reproduceerde en verbeterde de resultaten van een onderzoekspaper, waarbij het de methode op AIME24 met 2,7 punten overtrof; en het eindigde vóór 458 van de 526 menselijke teams in een multimodale uitdaging. Daarnaast ontwierp het model een chip, waardoor het aantal logische poorten werd teruggebracht van 8.298 naar 678 en het chipoppervlak met 81% werd verkleind, en simuleerde het een jaar aan e-commerce, waarbij het kapitaal verviervoudigde en GLM 5.2 met 38% overtrof. De multimodale mogelijkheden omvatten het verwerken van documenten van meer dan 200 pagina's en video's van meer dan 100 uur. De prestaties van het model liggen dicht bij of boven die van Claude Opus 4.8, Claude Fable 5 en GPT-5.6 Sol in interne benchmarks, hoewel onafhankelijke verificatie nog moet plaatsvinden. De gewichten worden volgende week vrijgegeven op Hugging Face en ModelScope. De concurrent Moonshot AI heeft op 27 juli Kimi K3 uitgebracht met 2,8 biljoen parameters en een context van 1 miljoen tokens.
Bron: The Decoder (DE) —
origineel
