MiniMax

Neueste KI-Nachrichten, Modelle und Releases von MiniMax. ['Abigail', 'Hailuo Minimax', 'M2.1', 'M2.5', 'MiniMax', 'MiniMax-M1', 'MiniMax-M2', 'MiniMax M2.1', 'MiniMax M2.5', 'MiniMax M2.7', 'MiniMax-M2.7', 'MiniMax M3', 'MiniMax-W']

Forschung 🇺🇸

Jenseits der Standard-LLMs: Lineare Aufmerksamkeitshybride, Textdiffusionsmodelle, Code-Weltmodelle und kleine rekurrente Transformer

Der Artikel untersucht Alternativen zu standardmäßigen autoregressiven Transformer-basierten LLMs: lineare Aufmerksamkeitshybride (MiniMax-M1, Qwen3-Next, DeepSeek V3.2, Kimi Linear), Textdiffusionsmodelle, Code-Weltmodelle und kleine rekurrente Transformer. Der Autor stellt eine Rückkehr zur klassischen Aufmerksamkeit in MiniMax-M2 und die Komplexität der linearen Aufmerksamkeit in der Praxis fest.

Moonshot AIMoonshot AI MiniMaxMiniMax Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Google/DeepMindGoogle/DeepMind MistralMistral MetaMeta Hugging FaceHugging Face Allen Institute for AIAllen Institute for AI xAIxAI OpenAIOpenAI IBMIBM NVIDIANVIDIA
Sebastian Raschka27.07 · 17:04
Forschung 🇺🇸

Überblick über LLM-Forschungspapiere für das erste Halbjahr 2026

Sebastian Raschka hat eine kuratierte Liste wichtiger wissenschaftlicher Arbeiten zu großen Sprachmodellen (Large Language Models, LLMs) von Januar bis Mai 2026 veröffentlicht. Die Auswahl hebt Trends hervor: hybride Architekturen (abwechselnde Aufmerksamkeits- und State-Space-Schichten), effiziente Inferenz, agentische Systeme und Diffusions-Sprachmodelle. Besondere Beachtung finden Nvidias Nemotron 3 mit Hybriddesign und Qwen3.6 mit Gated DeltaNet.

NVIDIANVIDIA Alibaba/QwenAlibaba/Qwen MistralMistral BaiduBaidu CohereCohere Technology Innovation InstituteTechnology Innovation Institute MiniMaxMiniMax
Sebastian Raschka27.07 · 12:03
Aktuelle Nachrichten