ModelosCódigo Aberto 🇺🇸 27.07.2026 18:04

Zhipu.AI disponibiliza modelos GLM como código aberto: oito vezes mais rápidos que o DeepSeek-R1 e expansão global antes de possível IPO

A empresa chinesa de IA Zhipu.AI disponibilizou seus modelos GLM de próxima geração como código aberto, incluindo o modelo de inferência GLM-Z1, que é até oito vezes mais rápido que o DeepSeek-R1, atingindo 200 tokens por segundo em GPUs de consumo. A empresa também lançou uma plataforma internacional, Z.ai, e está se expandindo globalmente, possivelmente preparando o terreno para uma oferta pública inicial (IPO).
A Zhipu.AI anunciou a abertura completa do código-fonte de seus modelos GLM, incluindo a série GLM-4 e o modelo de inferência GLM-Z1. O GLM-Z1-32B-0414 atinge velocidades de inferência até oito vezes mais rápidas que o DeepSeek-R1, entregando 200 tokens por segundo em GPUs de nível consumidor, o que é 50 vezes mais rápido que a velocidade de leitura humana. Isso foi alcançado otimizando parâmetros GQA, quantização e amostragem especulativa. A Zhipu também apresentou o modelo GLM-Z1-Rumination-32B-0414, que pode pesquisar autonomamente na internet, usar ferramentas e autoverificar informações. O portfólio de código aberto inclui o GLM-4-32B-0414 aprimorado para capacidades de agente e versões menores com 9 bilhões de parâmetros. Todos os modelos são lançados sob a licença MIT. A Zhipu lançou a plataforma internacional Z.ai para que usuários globais acessem esses modelos, e sua plataforma MaaS oferece acesso hierárquico por API. Essa abertura de código e expansão global sinalizam a prontidão da Zhipu para um possível IPO.
Fonte: Synced — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas