Moonshot AI

Laatste AI-nieuws, modellen en releases van Moonshot AI. ['GLM-5.2', 'Hermes', 'K3', 'K3-mini', 'K3-MoE', 'Kimi', 'Kimi 2.6', 'Kimi-2.6', 'Kimi 3', 'Kimi 3T', 'Kimi Hosted Agent', 'Kimi k1.5', 'Kimi K1.5', 'Kimi K2', 'Kimi K2.5', 'Kimi-K2.5-1T-A32B', 'Kimi K2.6', 'Kimi K2.7', 'Kimi K2.7 Code', 'Kimi K2 Thinking', 'Kimi K3', 'Kimi K3.5', 'Kimi K5', 'Kimi Linear', 'Kivine', 'Mamba', 'Mamba-2', 'Mamba-3', 'MiniCPM-RobotManip', 'MiniCPM-RobotTrack', 'Minimax', 'Ornith‑1.0‑35B', 'Qwen3-0.6B', 'Qwen3-30B-A3B', 'Qwen3-4B-Instruct-2507', 'qwen3.5-9b', 'Strands Agents', 'модель с триллионом параметров']

Modellen 🇷🇺

Hoe Kimi K3 werkt: 2,8 biljoen parameters, lineaire aandacht en miljoenen-tokens agents

Moonshot AI heeft de gewichten van zijn Kimi K3-model vrijgegeven, een multimodaal model gebaseerd op een Mixture of Experts-architectuur met 2,8 biljoen parameters, waarvan 104 miljard per token worden geactiveerd. Op bepaalde benchmarks voor programmeren en toolgebruik presteert het model beter dan concurrenten, maar gemiddeld blijft het bij sommige achter.

Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI
Habr — хаб ИИ27.07 · 23:03
Onderzoek 🇺🇸

Beheer van Redeneringsniveaus in Grote Taalmodellen

Sebastian Raschka legt uit hoe redeneermodi van verschillende complexiteit (laag, gemiddeld, hoog) werken in grote taalmodellen. Hij bespreekt methoden voor versterkend leren met verifieerbare beloningen, evenals mechanismen voor het schakelen tussen modi, waaronder benaderingen die worden gebruikt in modellen zoals DeepSeek-R1, Qwen3 en GPT-5.6.

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
Vers nieuws