ModelosCódigo Aberto 🇨🇳 28.07.2026 18:03

Qwen2.5: Uma Festa de Modelos Base!

Alibaba/QwenAlibaba/Qwen MetaMeta MistralMistral OpenAIOpenAI AnthropicAnthropic DeepSeekDeepSeek MicrosoftMicrosoft Google/DeepMindGoogle/DeepMind
A equipe Qwen da Alibaba anuncia o lançamento open-source dos LLMs Qwen2.5, juntamente com modelos especializados para programação (Qwen2.5-Coder) e matemática (Qwen2.5-Math). Os modelos variam de 0,5B a 72B parâmetros, pré-treinados em até 18 trilhões de tokens, com melhorias significativas em conhecimento, programação e capacidades matemáticas. O lançamento também inclui os modelos de API Qwen-Plus e Qwen-Turbo.
A equipe Qwen da Alibaba lançou o Qwen2.5, uma família de modelos de linguagem decodificador-only de código aberto, juntamente com os modelos especializados Qwen2.5-Coder e Qwen2.5-Math. Os modelos estão disponíveis em tamanhos de 0,5B a 72B parâmetros, pré-treinados em até 18 trilhões de tokens. O Qwen2.5 alcança MMLU 85+, HumanEval 85+ e MATH 80+, suporta até 128 mil tokens de contexto e 8 mil de geração, e oferece suporte multilíngue para mais de 29 idiomas. O Qwen2.5-Coder foi treinado em 5,5 trilhões de tokens de dados de código, enquanto o Qwen2.5-Math suporta raciocínio via CoT (Cadeia de Pensamento), PoT (Programa de Pensamento) e TIR (Raciocínio Textual Interno). Também são oferecidos os modelos de API principal Qwen-Plus e Qwen-Turbo. As variantes de 3B e 72B não possuem licença Apache 2.0.
Fonte: Alibaba Qwen — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas