Google于2026年8月13日推出Gemini 3.7 Flash模型,主打编码和代理工作,定价为每百万输入0.75美元、输出3.75美元,至年底结束,比原Gemini 3.6 Flash定价减半。该模型在多项基准测试中表现提升,已在160多个国家开放。
事实还原
这一发布距离Gemini 3.6 Flash仅三周。官方博客披露,Gemini 3.7 Flash是算法改进而非全新预训练模型,支持1M-token上下文窗口和最高64K输出token。入门价格直接设定为前代原价的一半,促销期至2026年12月31日。模型已上线Gemini API、AI Studio、Antigravity和Gemini Enterprise平台,并集成至Gemini App的Spark功能,用于跨Gmail、Google日历和Google文档处理多步骤任务。
机制拆解
价格减半源于生产成本降低与算法优化。官方材料显示,3.7 Flash在软件工程、知识工作和网页开发工作流上实现实质改进,包括调试、问题解决和首遍代码准确率提升。它在FrontierCode 1.1 Main达到43.6%(对比3.6 Flash的34.4%),DeepSWE v1.1达到65.3%(对比49.0%)。网页开发方面,Arena.ai WebDev Arena Elo得分1588(对比1538)。知识密集领域如金融、法律和生物科学中,GDP.pdf基准得分34.0%(对比22.0%),AutomationBench得分30.4%(对比17.0%)。这些提升直接来自开发者反馈和算法迭代。
产业影响
对开发者而言,相同任务下token成本降低,直接减少日常编码和代理任务的支出。企业用户可将节省的预算转向多步骤工作流自动化,例如将PDF转化为交互式数据故事或生成可玩3D游戏。竞争格局中,此举强化多厂商选择空间,其他模型需在性价比或特定场景响应速度上做出对应调整。上下游工具链如AI Studio和Gemini Enterprise的集成,降低了新模型的接入门槛。
对照与先例
与三周前发布的Gemini 3.6 Flash相比,3.7 Flash在相同基准上呈现一致提升,且价格直接减半。Artificial Analysis数据显示,其智能指数得分56,较前代提升4分,并登上智能与单任务耗时帕累托前沿。媒体报道如MarkTechPost和The Decoder均指出,这是对前代模型的算法改进而非全新训练,定价策略变化成为本次发布的核心差异点。
战略判断
基于现有基准数据和定价信息,Gemini 3.7 Flash最可能在年底促销期内被更多开发者设为主力模型。2027年1月1日价格恢复至1.50/7.50美元后的实际使用量变化,以及多步骤代理任务在真实Google Workspace环境中的完成率,可作为验证模型是否持续保持当前性价比优势的信号。以上判断基于已公开的基准对比和定价事实。
开发者选型时,可优先在编码调试和文档处理场景测试3.7 Flash的首遍准确率与工具调用稳定性。企业则可利用促销窗口期评估其在自动化工作流中的实际token消耗,再决定长期部署比例。所有结论均锚定官方披露的基准数值与价格条款。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接