Turbo Cloud divulga primeiros resultados dos novos modelos de IA: contexto de um milhão de tokens e 753 bilhões de parâmetros
DeepSeek
Alibaba/Qwen
O provedor de nuvem russo Turbo Cloud, parte do grupo RTK-DATA, expandiu seu Foundation Model Hub com modelos de IA de nova geração. Uma semana após o lançamento de DeepSeek-V4-Flash-0731 e GLM 5.2, a empresa reporta interesse constante de desenvolvedores e usuários empresariais. O catálogo também inclui dois modelos Qwen que cobrem uma ampla gama de necessidades corporativas.
O provedor de nuvem russo Turbo Cloud, parte do grupo RTK-DATA, expandiu seu Foundation Model Hub com novos modelos de IA de última geração. Uma semana após os modelos DeepSeek-V4-Flash-0731 e GLM 5.2 aparecerem na plataforma, a empresa observa um interesse constante por parte de desenvolvedores e usuários empresariais. O DeepSeek-V4-Flash-0731 se destaca em tarefas que exigem muitos recursos, que precisam de velocidade, precisão e capacidade de manter um contexto gigante: seu contexto de um milhão de tokens permite analisar grandes conjuntos de documentos, repositórios de código ou bases de conhecimento heterogêneas em uma única passada, enquanto a arquitetura atualizada melhora o processamento de texto e a geração de código, incluindo cenários agênticos de múltiplas etapas. O GLM 5.2 tem como alvo cargas de trabalho complexas de engenharia e análise, desde raciocínio e cálculos de múltiplas etapas até a construção de sistemas agênticos autônomos; seus pesos abertos o tornam procurado em projetos que exigem personalização profunda e auditoria. O catálogo também inclui dois modelos Qwen: o Qwen3.6-35B-A3B, com 35 bilhões de parâmetros e contexto de até 262 mil tokens, trabalhando com texto e imagens para tarefas empresariais típicas, como geração de conteúdo, busca em bases internas e automação de rotinas, e o Qwen3.5-122B-A10B, com 122 bilhões de parâmetros, para cenários corporativos mais pesados, como processamento de grandes volumes de documentos, análise e assistentes de IA avançados. Todos os modelos são fornecidos via uma API unificada compatível com OpenAI, permitindo a troca sem modificações de código. A integração não exige a implantação de infraestrutura própria de GPU, e o gerenciamento flexível de chaves e os limites de consumo configuráveis (diários, semanais, mensais) permitem que as equipes controlem o uso de recursos. O pagamento segue um modelo de pagamento conforme o uso, cobrando apenas pelos tokens efetivamente processados.
Fonte: CNews —
original
