谷歌发布Gemini 3.7 Flash,性能提升价格减半
谷歌推出Gemini 3.7 Flash,作为其Flash系列中最智能的编码和智能体模型,性能大幅提升,价格仅为3.6 Flash的一半,并已集成到Gemini Spark中。
推出 Gemini 3.7 Flash今天,我们在广泛使用的 Flash 系列基础上推出 Gemini 3.7 Flash,这是我们迄今为止在编码和智能体方面最智能的主力模型。
该版本发布于 Gemini 3.6 Flash 仅三周之后,是开发者反馈和算法创新的直接成果,我们期待将这些成果应用于未来的模型。
3.7 Flash 在软件工程、知识工作和 Web 开发工作流方面带来了显著改进,且入门价格仅为 3.6 Flash 每百万 token 成本的一半。复杂工作流的更优智能3.7 Flash 在调试和问题解决等编码任务上相比 3.6 Flash 有显著提升。
它在首次代码准确率上更高,并在生成生产级代码方面表现更佳,如 FrontierCode 1.1 Main(43.6% vs 34.4%)和 DeepSWE v1.1(65.3% vs 49.0%)所示。
在 Web 开发中,3.7 Flash 用更少的提示词生成更多功能布局和功能完整的应用。在 UI 生成方面,该模型基于参考输入(无论是截图、图像还是完整设计系统)表现出高度的设计遵循性和一致性。
它在 Arena.ai 的 WebDev Arena 上以 Elo 1588 分超越 3.6 Flash 的 1538 分。对于金融、法律和生物科学等知识密集型领域,3.7 Flash 提供了更强的推理能力和准确性。
它在 GDP.pdf 基准测试(34.0% vs 22.0%)上显著优于 3.6 Flash。
0%),该评估用于测试模型处理复杂文档的能力。它还在 AutomationBench 中超越 3.6 Flash,证明能更有效地完成真实世界的业务工作流(30.4% vs 17.0%)。
更好的开发者体验和价格Gemini 3.7 Flash 相比 3.6 Flash 提供了显著改善的开发者体验。它更好地适应障碍,在需要时澄清意图,并更忠实地遵循指令。它思考更勤奋,在多步规划和工具调用上投入更多精力。
更严格的执行意味着更少的人工监督和更少的工程工作流重试。3.7 Flash 在年底前提供入门价格,即每百万输入 token 0.75 美元,每百万输出 token 3.75 美元。这一价格加上增强的模型性能,使开发者和客户能够经济高效地扩展生产级智能体。
早期客户反馈强调 3.7 Flash 的性能和精度,以低成本实现了显著优于 3.6 Flash 的结果。
用 3.7 Flash 改进 Gemini SparkGemini Spark 面向 160 多个国家的 Google AI Pro 和 Ultra 订阅者,从今天起将使用 Gemini 3.7 Flash。
我们在 I/O 大会上推出了 Spark,作为您的个人 AI 智能体,全天候运行,在您的指导下代表您采取行动。
此次模型更新使 Spark 在知识工作方面更加高效,改进了对 Google Workspace 应用的工具使用,为复杂的多技能工作流提供了更高的准确性和输出质量。
借助 3.7 Flash,Gemini Spark 可以通过合并文件、起草电子邮件和更新状态文档,更高效地将想法转化为行动。以安全为设计理念我们持续努力提高前沿安全防护的覆盖范围和稳健性。
Gemini 3.7 Flash 配备了更新的防护措施,以防止化学、生物、放射性和核(CBRN)及网络攻击领域的滥用,同时根据我们的生物弹性方法和网络计划,支持有益的使用案例。更多信息请参阅 3.7 Flash 模型卡。
立即试用- 开发者:在 Google Antigravity 中探索智能体优先的工作流,或立即通过 Google AI Studio 和 Android Studio 在 Gemini API 中开始构建。
请参阅我们的开发者指南。- 企业:在 Gemini Enterprise Agent Platform 和 Gemini Enterprise 应用中访问 3.7 Flash。
- 个人:可通过 Spark 使用,Spark 是 Gemini 应用中的 24/7 个人智能体,适用于受支持国家/地区的 Google AI Pro 和 Ultra 订阅者。