MiniMax

Últimas noticias, modelos y lanzamientos de IA de MiniMax. ['Abigail', 'Hailuo Minimax', 'M2.1', 'M2.5', 'MiniMax', 'MiniMax-M1', 'MiniMax-M2', 'MiniMax M2.1', 'MiniMax M2.5', 'MiniMax M2.7', 'MiniMax-M2.7', 'MiniMax M3', 'MiniMax-W']

Investigación 🇺🇸

Más allá de los LLM estándar: híbridos de atención lineal, modelos de difusión de texto, modelos de mundo de código y pequeños transformers recurrentes

El artículo explora alternativas a los LLM estándar basados en transformers autorregresivos: híbridos de atención lineal (MiniMax-M1, Qwen3-Next, DeepSeek V3.2, Kimi Linear), modelos de difusión de texto, modelos de mundo de código y pequeños transformers recurrentes. El autor señala un retorno a la atención clásica en MiniMax-M2 y la complejidad de la atención lineal en producción.

Moonshot AIMoonshot AI MiniMaxMiniMax Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Google/DeepMindGoogle/DeepMind MistralMistral MetaMeta Hugging FaceHugging Face Allen Institute for AIAllen Institute for AI xAIxAI OpenAIOpenAI IBMIBM NVIDIANVIDIA
Sebastian Raschka27.07 · 17:04
Investigación 🇺🇸

Encuesta de Artículos de Investigación sobre LLM para la Primera Mitad de 2026

Sebastian Raschka publicó una lista seleccionada de artículos científicos clave sobre modelos de lenguaje de gran escala (LLM, por sus siglas en inglés) de enero a mayo de 2026. La selección destaca tendencias: arquitecturas híbridas (capas de atención y espacio de estado alternadas), inferencia eficiente, sistemas agentivos y modelos de lenguaje de difusión. Se presta especial atención al Nemotron 3 de Nvidia con diseño híbrido y al Qwen3.6 con Gated DeltaNet.

NVIDIANVIDIA Alibaba/QwenAlibaba/Qwen MistralMistral BaiduBaidu CohereCohere Technology Innovation InstituteTechnology Innovation Institute MiniMaxMiniMax
Sebastian Raschka27.07 · 12:03
Noticias frescas