智谱AI开源GLM:模型比DeepSeek-R1快8倍,全球扩张或为IPO铺路
中国人工智能公司智谱AI已开源其下一代GLM模型,包括推理模型GLM-Z1,其速度比DeepSeek-R1快8倍,在消费级GPU上可达每秒200个token。该公司还推出了国际平台Z.ai,并在全球扩张,可能为首次公开募股(IPO)奠定基础。
智谱AI宣布全面开源其GLM模型,包括GLM-4系列和GLM-Z1推理模型。GLM-Z1-32B-0414推理速度比DeepSeek-R1快八倍,在消费级GPU上每秒可处理200个token,比人类阅读速度快50倍。这一成果通过优化GQA参数、量化和推测采样实现。智谱还推出了GLM-Z1-Rumination-32B-0414模型,该模型能自主搜索互联网、使用工具和自我验证信息。开源组合包括增强智能体能力的GLM-4-32B-0414模型以及更小的9B参数版本。所有模型均基于MIT许可发布。智谱推出国际平台Z.ai供全球用户访问这些模型,其MaaS平台提供分级API访问。此次开源和全球扩张表明智谱已为潜在首次公开募股做好准备。
来源: Synced —
原文
