MiniMax

Últimas notícias, modelos e lançamentos de IA de MiniMax. ['Abigail', 'Hailuo Minimax', 'M2.1', 'M2.5', 'MiniMax', 'MiniMax-M1', 'MiniMax-M2', 'MiniMax M2.1', 'MiniMax M2.5', 'MiniMax M2.7', 'MiniMax-M2.7', 'MiniMax M3', 'MiniMax-W']

Pesquisa 🇺🇸

Além dos LLMs Padrão: Híbridos de Atenção Linear, Modelos de Difusão de Texto, Modelos de Mundo de Código e Pequenos Transformers Recorrentes

O artigo explora alternativas aos LLMs padrão baseados em transformers autorregressivos: híbridos de atenção linear (MiniMax-M1, Qwen3-Next, DeepSeek V3.2, Kimi Linear), modelos de difusão de texto, modelos de mundo de código e pequenos transformers recorrentes. O autor observa um retorno à atenção clássica no MiniMax-M2 e a complexidade da atenção linear em produção.

Moonshot AIMoonshot AI MiniMaxMiniMax Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Google/DeepMindGoogle/DeepMind MistralMistral MetaMeta Hugging FaceHugging Face Allen Institute for AIAllen Institute for AI xAIxAI OpenAIOpenAI IBMIBM NVIDIANVIDIA
Sebastian Raschka27.07 · 17:04
Pesquisa 🇺🇸

Levantamento de Artigos de Pesquisa sobre LLMs para o Primeiro Semestre de 2026

Sebastian Raschka publicou uma lista curada de artigos científicos fundamentais sobre modelos de linguagem de grande porte (LLMs) de janeiro a maio de 2026. A seleção destaca tendências: arquiteturas híbridas (camadas de atenção e espaço de estado alternadas), inferência eficiente, sistemas agentivos e modelos de linguagem de difusão. Atenção especial é dada ao Nemotron 3 da Nvidia com design híbrido e ao Qwen3.6 com Gated DeltaNet.

NVIDIANVIDIA Alibaba/QwenAlibaba/Qwen MistralMistral BaiduBaidu CohereCohere Technology Innovation InstituteTechnology Innovation Institute MiniMaxMiniMax
Sebastian Raschka27.07 · 12:03
Notícias frescas