DeepSeek

Neueste KI-Nachrichten, Modelle und Releases von DeepSeek. ['DeepSeek', 'DeepSeek 3.1', 'DeepSeek-4-pro', 'DeepSeek API', 'deepseek-coder-v2', 'DeepSeek-GRM', 'DeepSeekMath-V2', 'DeepSeekMoE', 'DeepSeek-Prover-V1.5-Base', 'DeepSeek-Prover-V2', 'DeepSeek-Prover-V2-671B', 'DeepSeek-Prover-V2-7B', 'DeepSeek R1', 'DeepSeek-R1', 'DeepSeek R1-0528', 'DeepSeek-R1-0528', 'DeepSeek-R1-671B', 'DeepSeek-R1-Distilled-Llama-70B', 'DeepSeek-R1-Distilled-Qwen-32B', 'DeepSeek-R1-Distill-Qwen-32B', 'DeepSeek-R1-Zero', 'DeepSeek R2', 'DeepSeek-R2', 'DeepSeek Sparse Attention (DSA)', 'DeepSeek-V2', 'DeepSeek V3', 'DeepSeek-V3', 'DeepSeek V3.1', 'DeepSeek V3.1-Terminus', 'DeepSeek v3.2', 'DeepSeek V3.2', 'DeepSeek-V3.2', 'DeepSeek V3.2-Exp', 'DeepSeek-V3-Base', 'DeepSeek V3/R1', 'DeepSeek v4', 'DeepSeek V4', 'DeepSeek-V4', 'deepseek-v4-flash', 'DeepSeek-V4-Flash']

Forschung 🇺🇸

Verwaltung von Reasoning-Stufen in großen Sprachmodellen

Sebastian Raschka erklärt, wie Reasoning-Modi unterschiedlicher Komplexität (niedrig, mittel, hoch) in großen Sprachmodellen funktionieren. Er diskutiert Methoden des bestärkenden Lernens mit überprüfbaren Belohnungen sowie Mechanismen zum Wechsel zwischen den Modi, einschließlich Ansätze, die in Modellen wie DeepSeek-R1, Qwen3 und GPT-5.6 verwendet werden.

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
Aktuelle Nachrichten