Alibaba Cloud

Laatste AI-nieuws, modellen en releases van Alibaba Cloud. ['CMS 2.0', 'GLM-4.7-Flash', 'Qwen 122B', 'Qwen2.5-0.5B', 'Qwen2.5-14B', 'Qwen2.5-1.5B', 'Qwen2.5-32B', 'qwen2.5:3b', 'Qwen2.5-3B', 'Qwen2.5-72B', 'qwen2.5:7b', 'Qwen2.5-7B', 'Qwen2.5-Coder', 'Qwen2.5-Max', 'Qwen2.5-VL-3B', 'Qwen2-Math', 'Qwen 3', 'Qwen3', 'Qwen3 0.6B', 'Qwen3-0.6B', 'Qwen-3 14B', 'Qwen3-14B', 'Qwen3-235B-A22B-FP8', 'Qwen3-235B-A22B-Thinking-2507', 'Qwen3 235B-Instruct', 'Qwen3-30B-A3B', 'qwen3-32b', 'Qwen3-32B', 'Qwen3-4B', 'Qwen3.5', 'Qwen3.5-122B-A17B', 'Qwen3.5-27B', 'Qwen3.5-35B-A3B', 'Qwen3.5-397B-A17B', 'qwen 3.5 4B', 'Qwen3.5-4B', 'Qwen3.5-9B', 'Qwen3.5-Flash-02-23', 'Qwen3.5-Plus-02-15', 'Qwen3.6']

Onderzoek 🇺🇸

Beheer van Redeneringsniveaus in Grote Taalmodellen

Sebastian Raschka legt uit hoe redeneermodi van verschillende complexiteit (laag, gemiddeld, hoog) werken in grote taalmodellen. Hij bespreekt methoden voor versterkend leren met verifieerbare beloningen, evenals mechanismen voor het schakelen tussen modi, waaronder benaderingen die worden gebruikt in modellen zoals DeepSeek-R1, Qwen3 en GPT-5.6.

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
Modellen 🇨🇳

Qwen3-Coder: Alibaba Qwen's meest agentische model voor code

Alibaba Qwen heeft Qwen3-Coder uitgebracht, een vlaggenschip codemodel met 480 miljard totale parameters en 35 miljard actieve parameters, dat state-of-the-art resultaten behaalt onder open modellen in agentische codetaken, browsergebruik en toolgebruik. Het model ondersteunt een context van 256K tokens (tot 1M met extrapolatie), is getraind op 7,5 biljoen tokens waarvan 70% code, en maakt gebruik van grootschalige reinforcement learning, waaronder long-horizon RL voor meerstapsinteractie in omgevingen. Naast het model is de Qwen Code-tool, gebaseerd op Gemini Code, open-source gemaakt.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen27.07 · 18:03
Vers nieuws