Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber
Google/DeepMind
DeepMind
Google DeepMind 宣布推出三款新的 Gemini 模型:3.6 Flash 改进了编码和效率,3.5 Flash-Lite — 系列中速度最快、成本效益最高的模型,以及用于网络安全的 3.5 Flash Cyber。3.6 Flash 和 3.5 Flash-Lite 模型现已可在 Gemini API 和其他 Google 产品中使用。
Google DeepMind推出了三款新的Gemini系列模型。基于3.5 Flash反馈打造的3.6 Flash模型在编码和知识处理方面质量更优,同时输出令牌消耗减少17%(基于Artificial Analysis指数),且价格更低:每百万输入令牌1.50美元,每百万输出令牌7.50美元。在基准测试中,该模型表现提升:DeepSWE达到49%(3.5 Flash为37%),MLE Bench为63.9%(3.5 Flash为49.7%),OSWorld-Verified为83.0%(3.5 Flash为78.4%)。模型内置了针对化学、生物、放射性和核武器(CBRN)以及网络攻击的强化安全措施。3.5 Flash-Lite是3.5系列中最快的模型——每秒输出350个令牌(基于Artificial Analysis)——且最具性价比:每百万输入令牌0.3美元,每百万输出令牌2.5美元。它在质量上大幅超越3.1 Flash-Lite,例如在Terminal-Bench 2.1中(54%对31%)、GDM-MRCR v2中(72.2%对60.1%)以及GDPval-AA v2中(1140对642)。基于3.5 Flash并针对网络安全进行微调的3.5 Flash Cyber模型,作为CodeMender智能体的一部分运行,并在CyberGym基准测试中取得了有竞争力的结果。该模型将仅通过受限试点项目向政府和受信任合作伙伴开放。3.6 Flash和3.5 Flash-Lite现已通过Google AI Studio、Android Studio的Gemini API,以及企业级平台Gemini Enterprise和Gemini应用向开发者提供。
来源: Google DeepMind —
原文
