Moonshot AI

En son yapay zeka haberleri, modeller ve sürümler Moonshot AI. ['GLM-5.2', 'Hermes', 'K3', 'K3-mini', 'K3-MoE', 'Kimi', 'Kimi 2.6', 'Kimi-2.6', 'Kimi 3', 'Kimi 3T', 'Kimi Hosted Agent', 'Kimi k1.5', 'Kimi K1.5', 'Kimi K2', 'Kimi K2.5', 'Kimi-K2.5-1T-A32B', 'Kimi K2.6', 'Kimi K2.7', 'Kimi K2.7 Code', 'Kimi K2 Thinking', 'Kimi K3', 'Kimi K3.5', 'Kimi K5', 'Kimi Linear', 'Kivine', 'Mamba', 'Mamba-2', 'Mamba-3', 'MiniCPM-RobotManip', 'MiniCPM-RobotTrack', 'Minimax', 'Ornith‑1.0‑35B', 'Qwen3-0.6B', 'Qwen3-30B-A3B', 'Qwen3-4B-Instruct-2507', 'qwen3.5-9b', 'Strands Agents', 'модель с триллионом параметров']

Modeller 🇷🇺

Kimi K3 Nasıl Çalışır: 2.8 Trilyon Parametre, Doğrusal Dikkat ve Milyon Tokenlı Ajanlar

Moonshot AI, Kimi K3 modelinin ağırlıklarını yayınladı. Bu model, Uzmanların Karışımı (Mixture of Experts) mimarisine dayanan ve 2.8 trilyon parametreye sahip çok modlu bir modeldir; her token için 104 milyar parametre etkinleştirilmektedir. Belirli programlama ve araç kullanımı kıyaslamalarında model rakiplerinden daha iyi performans gösterirken, ortalama olarak bazılarının gerisinde kalmaktadır.

Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI
Habr — хаб ИИ27.07 · 23:03
Araştırma 🇺🇸

Managing Reasoning Levels in Large Language Models

Sebastian Raschka explains how reasoning modes of varying complexity (low, medium, high) work in large language models. He discusses reinforcement learning methods with verifiable rewards, as well as mechanisms for switching between modes, including approaches used in models like DeepSeek-R1, Qwen3, and GPT-5.6.

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
Güncel haberler