
이미지: X — 뉴스 앰프 화면 갈무리
摘要
- 谷歌发布了专为编程和智能体任务优化的Gemini 3.7 Flash
- 在FrontierCode 1.1基准测试中取得43.6%的成绩,超过Claude Sonnet 5(42.7%)和GPT-5.6 Terra(41.3%)
- 每百万输入token价格为0.75美元,到年底前将以3.6 Flash一半的价格提供
- 모델명
- Gemini 3.7 Flash
- 개발사
- Google Gemini
- FrontierCode 1.1 점수
- 43.6% (3.6 Flash 34.4%, Claude Sonnet 5 42.7%, GPT-5.6 Terra 41.3%)
- 입력 가격
- 100만 토큰당 0.75달러
- 가격 정책
- 연말까지 3.6 Flash 대비 50% 인하
发布了什么
谷歌推出了面向编程和智能体任务的新模型Gemini 3.7 Flash。根据谷歌DeepMind评估方法论文档随附公开的图表,该模型在衡量实际生产环境代码质量的FrontierCode 1.1基准测试中取得了43.6%的成绩。相同条件下,Anthropic的Claude Sonnet 5仅为42.7%,OpenAI的GPT-5.6 Terra为41.3%。上一代模型Gemini 3.6 Flash的成绩为34.4%,相当于一代之间提升了约9个百分点。价格方面,每百万输入token定价为0.75美元,官方说明称到年底前可以以3.6 Flash一半的价格使用。此外还提到调试准确率、智能体工作流稳定性、网页开发成果以及推理准确率均有所改善。

这是什么意思
"Flash"是谷歌Gemini产品线中比专业级模型更轻量、响应更快的实用级别定位。它以略微牺牲准确率为代价换取更快的速度和更低的成本,主要面向代码自动补全或重复性智能体任务等调用频率高的场景。这次版本发布的有趣之处在于其出现速度。就在前一天,即8月13日,有账号发现并报道称,在谷歌服务筛选搜索框中曝出了"gemini-3.7-flash"这一模型名称。再往前一天的8月12日,Gemini Enterprise界面上就已挂出"3.6 Flash"测试通知横幅。也就是说,三天之内连续观察到从3.6过渡到3.7的痕迹,随后便迎来了正式发布。这被解读为谷歌正明显缩短Flash系列的更新周期的信号。该模型在编程基准测试中以微弱优势超过竞品模型这一点也值得关注。衡量生产环境代码质量的指标,相比单纯的解题型基准测试,更多地反映了实际开发现场的复杂需求,因此对使用智能体型编程工具的开发者而言,这可能会带来实际可感知的差异。

那么会有什么变化
这次发布的实际意义在于,开发者可以用相同的价格选择更快、更便宜的编程模型。尤其是半价政策持续到年底,对于运行调用频繁的智能体流水线或自动化工具的团队来说,这意味着有机会降低成本负担。不过,输出token价格或正式API接入时间等具体细节,在此次发布中尚未明确说明。从谷歌快速更新Flash系列的趋势来看,下一次版本升级也有可能不会等待太久。


