{{!completeInfo?'请完善个人信息':''}}
谷歌发布Gemini 3.7 Flash模型,在代码调试、网页开发及专业文档处理等场景性能显著提升,基准测试得分大幅优化,同时降低调用成本并强化安全防护机制。
谷歌(Google)在上一代模型上线三周后迅速推出Gemini 3.7 Flash,延续了近期高频迭代的产品节奏。本次版本更新直接吸收了开发者反馈与算法优化成果,重点拉升了模型在软件工程、网页构建及专业知识工作流中的落地表现。

在核心技术指标上,新模型针对代码调试与逻辑解决能力进行了针对性补强。基准测试显示Gemini 3.7 Flash在DeepSWE v1.1中的得分由前代的49.0%提升至65.3%,FrontierCode 1.1 Main成绩也增长至43.6%。网页端开发场景下,模型对截图、图像及系统设计稿的UI还原度与结构一致性均有优化,其在WebDev Arena的Elo评分达到1588分,相比3.6 Flash的1538分有稳定增长,支持开发者通过更简洁的提示词构建完整页面布局。

对于涉及复杂文档与业务流程的专业场景,模型在GDP.pdf基准测试中取得了34.0%的得分,显著高于前代的22.0%;在检验实际业务流处理的AutomationBench测试中,成绩也从17.0%提升至30.4%。执行机制方面,新模型强化了多步骤规划与工具调用的连贯性,能够在遇到阻碍时主动校准意图并严格遵循指令,降低工程环境下的重试损耗与人工介入成本。
安全策略层面Google同步更新了面向CBRN(化学、生物、放射性与核)及网络攻击维度的防护机制,在防范潜在滥用风险的同时保障常规技术场景的正常调用。
Gemini 3.7 Flash在2026年底前的尝鲜定价为输入每百万词元(Token)0.75美元、输出每百万Token 3.75美元,基础调用成本较上一代腰斩。目前该模型已面向订阅AI Pro或Ultra的Spark用户开放,并已同步部署至Google Antigravity、AI Studio、Android Studio及Gemini企业级平台等开发与办公套件中。
原文作者:大众软件
原文链接:点击查看 >
版权声明:本文转载自大众软件,文章版权及相关知识产权归原作者或原权利人所有。本文仅供行业交流与信息参考,文中观点仅代表原作者,不代表扬帆出海立场。如转载内容涉及版权或其他权益问题,请联系我们,我们将在核实后及时处理。转载本文请联系原作者或原权利人获得授权。
更多出海资讯,请关注扬帆出海官网:www.yfchuhai.com
{{likeNum}}
好文章,需要你的鼓励
美团海外业务大调整
已关注
关注