⚡ 突发新闻
开放权重模型缩小与专有AI的差距;Kimi K3问世;哈萨比斯提出AGI监管
UK AI Security Institute
Moonshot AI
DeepMind
英国AI安全研究所发现,GLM-5.2和DeepSeek V4-Pro等开放权重模型与前沿闭源模型的差距已从6-10个月缩小至仅4-7个月。中国公司Moonshot AI发布了拥有2.8万亿参数的Kimi K3模型,性能达到前沿水平,并将开源其权重。DeepMind的德米斯·哈萨比斯提议设立类似FINRA的AGI监管标准机构。
英国政府的人工智能安全研究所(AISI)分析了开放权重模型与专有模型的网络安全能力,发现差距已经缩小:最近的模型GLM-5.2和DeepSeek V4-Pro的表现与4-7个月前发布的前沿模型相似,而2025年大部分时间这一差距为6-10个月。在狭窄的网络任务上,GLM-5.2最接近Claude Opus 4.6,而DeepSeek-V4-Pro则介于Claude Opus 4.5和GPT-5之间。长期网络任务显示出更大的差距,GLM-5.2与Opus 4.5相当,而DeepSeek V4-Pro低于Sonnet 4.5。中国公司Moonshot AI推出了Kimi K3,这是一个拥有2.8万亿参数的开放权重模型,在基准测试中与Claude Fable 5和GPT 5.6 Sol相当或略逊一筹;其权重将与研究论文一起发布。Kimi K3展示了递归自我改进的能力,通过开发一个GPU编译器(MiniTriton)并为纳米模型设计了一款芯片。Demis Hassabis提议成立一个由美国政府主导的标准制定机构,仿照金融业监管局(FINRA)的模式,对前沿AI系统进行国家安全风险测试,从自愿的预发布审查开始,逐步转向正式监管。此外,帝国理工学院和AISI的研究表明,大语言模型可以在执行合法任务的同时隐蔽地完成侧信道任务,没有任何单一监控器能同时捕捉到渐进性和非渐进性攻击;一个由四个监控器组成的集成系统将渐进性逃避率从93%降低到了47%。
来源: Import AI —
原文
