谷歌DeepMind发布Gemini 3.7 Flash,加码编程与智能体领域
Google/DeepMind
Google DeepMind
谷歌DeepMind推出了Gemini 3.7 Flash,这是其面向编程和智能体的最强效模型,距3.6 Flash发布仅三周。该模型在软件工程、知识工作和网页开发方面实现大幅提升,入门价格仅为3.6 Flash的一半。Gemini 3.7 Flash现已通过Gemini API和Google AI Studio向开发者提供,并为Gemini Spark个人智能体提供支持。
Google DeepMind今天发布了Gemini 3.7 Flash,这是其Flash系列的最新版本,也是其迄今为止在编码和智能体领域最智能的主力模型,距离Gemini 3.6 Flash的发布仅三周时间。该模型在编码任务上相比前代有显著提升,首次通过代码准确率更高,生成的生产级代码更优质,这体现在FrontierCode 1.1 Main(43.6%对34.4%)和DeepSWE v1.1(65.3%对49.0%)的得分上。在网页开发方面,它在WebDev Arena上的Elo得分为1588,优于3.6 Flash的1538,并且在GDP.pdf基准测试中显著改善了复杂文档处理能力(34.0%对22.0%),在AutomationBench中改善了真实世界的业务工作流处理(30.4%对17.0%)。该模型的发布价格为每百万输入tokens 0.75美元,每百万输出tokens 3.75美元,有效期至年底。它还驱动了Gemini Spark,这是一款面向Google AI Pro和Ultra订阅用户的个人AI智能体,增强了Google Workspace应用的工具使用能力。安全更新包括对化学、生物、放射性和核(CBRN)领域及网络攻击的更强防护。开发者可以通过Google Antigravity、Google AI Studio和Android Studio中的Gemini API访问该模型,企业则可以在Gemini Enterprise Agent平台上使用它。
来源: Google DeepMind —
原文
