阿里开源 Qwen2.5-1M,支持高达 100 万 Token 的上下文
阿里巴巴发布了开源模型 Qwen2.5-7B-Instruct-1M 和 Qwen2.5-14B-Instruct-1M,上下文长度可达 100 万 Token,并基于 vLLM 提供了优化的推理框架。这些模型在长上下文任务中优于之前的版本和 GPT-4o-mini,同时在短文本上保持了性能。
Alibaba/Qwen
Alibaba Qwen28.07 · 16:03
阿里巴巴发布了开源模型 Qwen2.5-7B-Instruct-1M 和 Qwen2.5-14B-Instruct-1M,上下文长度可达 100 万 Token,并基于 vLLM 提供了优化的推理框架。这些模型在长上下文任务中优于之前的版本和 GPT-4o-mini,同时在短文本上保持了性能。
Alibaba/Qwen
独立研究人员发现,领先的中国AI模型如智谱GLM 5.2和月之暗面Kimi K3有时会自称是Anthropic的聊天机器人Claude。在GLM 5.2中,采用Claude的角色会削弱中国的审查机制,引发安全担忧。
Moonshot AI
Alibaba/Qwen
Meta
Google/DeepMind
OpenAI
Anthropic