Moonshot AI

أحدث أخبار ونماذج وإصدارات الذكاء الاصطناعي من Moonshot AI. ['GLM-5.2', 'Hermes', 'K3', 'K3-mini', 'K3-MoE', 'Kimi', 'Kimi 2.6', 'Kimi-2.6', 'Kimi 3', 'Kimi 3T', 'Kimi Hosted Agent', 'Kimi k1.5', 'Kimi K1.5', 'Kimi K2', 'Kimi K2.5', 'Kimi-K2.5-1T-A32B', 'Kimi K2.6', 'Kimi K2.7', 'Kimi K2.7 Code', 'Kimi K2 Thinking', 'Kimi K3', 'Kimi K3.5', 'Kimi K5', 'Kimi Linear', 'Kivine', 'Mamba', 'Mamba-2', 'Mamba-3', 'MiniCPM-RobotManip', 'MiniCPM-RobotTrack', 'Minimax', 'Ornith‑1.0‑35B', 'Qwen3-0.6B', 'Qwen3-30B-A3B', 'Qwen3-4B-Instruct-2507', 'qwen3.5-9b', 'Strands Agents', 'модель с триллионом параметров']

النماذج 🇷🇺

كيف يعمل Kimi K3: 2.8 تريليون معلمة، انتباه خطي، وكلاء بمليون رمز

أطلقت شركة Moonshot AI أوزان نموذج Kimi K3، وهو نموذج متعدد الوسائط يعتمد على بنية Mixture of Experts (خبراء مختلطون) يحتوي على 2.8 تريليون معلمة، منها 104 مليار معلمة نشطة لكل رمز. في بعض معايير البرمجة واستخدام الأدوات، يتفوق النموذج على المنافسين، لكنه في المتوسط يتخلف عن بعضهم.

Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI
Habr — хаб ИИ27.07 · 23:03
الأبحاث 🇺🇸

إدارة مستويات التفكير في نماذج اللغة الكبيرة

يشرح سيباستيان راشكا كيفية عمل أوضاع التفكير ذات التعقيد المتفاوت (منخفض، متوسط، عالٍ) في نماذج اللغة الكبيرة. ويناقش أساليب التعلم التعزيزي مع المكافآت القابلة للتحقق، بالإضافة إلى آليات التبديل بين الأوضاع، بما في ذلك الأساليب المستخدمة في نماذج مثل DeepSeek-R1 وQwen3 وGPT-5.6.

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
أخبار جديدة