8月13日,谷歌又发新模型了。

距离上一代 Gemini 3.6 Flash 发布,只过去了三周。没有盛大的发布会,没有铺天盖地的宣传,Gemini 3.7 Flash 就这样悄然上线了。

三周一迭代,价格直接砍半。谷歌正在用 Flash 系列打一场完全不同于以往的战争。

一、产品速览:100万上下文,64K输出,多模态全支持

Gemini 3.7 Flash 的硬件参数延续了 Flash 系列一贯的务实风格:

  • 上下文窗口:100万 Token

  • 单次输出上限:64K Token

  • 输入模态:文本、图像、音频和视频

  • 可调整思考配置:允许用户在不同任务中灵活权衡输出质量、推理成本和响应速度

谷歌官方将其定义为 “迄今为止用于编码和智能体领域最智能的 Flash 级主力模型” 。这不是旗舰,但却是谷歌想让最多开发者用上的那个模型。

二、性能炸裂:编程能力全面跃升

相比三周前的 3.6 Flash,新模型在多个关键基准上实现了两位数的百分比提升

编程与软件工程

  • FrontierCode 1.1 Main:从 34.4% 跃升至 43.6%

  • DeepSWE v1.1(长周期软件工程):从 49.0% 提升至 65.3%

  • 在 18 项评估中,有 11 项领先 Claude Sonnet 5 和 GPT-5.6 Terra

网页开发

  • WebDev Arena Elo 评分从 1538 提升至 1588

  • 能够用更少的提示词生成功能更完善的页面,对截图、设计系统的还原度更高

知识工作与自动化

  • GDP.pdf(复杂文档处理):从 22.0% 提升至 34.0%

  • AutomationBench(真实商业工作流):从 17.0% 跃升至 30.4%

在 Artificial Analysis 的独立测试中,Gemini 3.7 Flash 高推理模式下智能得分 56,比 3.6 Flash 提高 4 分。输出速度约为每秒 340 个 token,接近 GPT-5.6 Terra 的 3 倍。

但也并非全面领先——在考察图表理解能力的 CharXiv 测试中,3.7 Flash 得分略低于前代。不过这并不影响整体的升级力度。

三、价格战打到新高度:直接五折,但有时限

Gemini 3.7 Flash 最引人注目的变化,其实是价格。

2026 年 12 月 31 日前,API 入门价格直接减半:

  • 输入:每百万 Token 0.75 美元(约 5.1 元人民币)

  • 输出:每百万 Token 3.75 美元(约 25.3 元人民币)

2027 年 1 月 1 日起,价格将恢复至:

  • 输入:每百万 Token 1.5 美元

  • 输出:每百万 Token 7.5 美元

有开发者评价,每百万输入 Token 仅 0.75 美元对一个智能体模型来说“便宜得有些疯狂”。这意味着,“把整个 Next.js 代码库丢进上下文,让它自动重构也不至于把 API 预算搞破产”。

而就在同一天,DeepSeek 刚刚宣布即将涨价。一边涨价,一边五折——大模型市场的价格策略正在走向两个截然不同的方向

四、实战演示:从3D游戏到机器人训练

为了证明新模型的实际落地能力,谷歌在发布现场展示了多个覆盖不同领域的案例:

案例一:文本生成3D游戏。开发者只需输入一段简单的文本提示,Gemini 3.7 Flash 就能即时构建出可玩的 3D 游戏框架,并与 Nano Banana 模型协同,实时动态生成游戏中的角色、道具和表面纹理。

案例二:单次生成交互式落地页。Gemini 3.7 Flash 可以作为主控模型协调多个子智能体,同时调用 Gemini Omni 创建具有视差效果的动态交互组件,直接输出可运行的网页。

案例三:辅助机器人训练。在包含三个智能体的循环中,Gemini 3.7 Flash 利用多模态理解能力帮助机器人进行环境感知与决策,显著加快学习与训练速度。

这些演示揭示了一个清晰的信号:谷歌想让 Flash 成为智能体时代的工作模型,而不仅仅是一个对话工具

五、背后的信号:旗舰模型去哪了?

Gemini 3.7 Flash 的发布,也引发了另一个更受关注的问题:谷歌的旗舰模型去哪了?

今年 5 月,谷歌在 I/O 大会上预告 Gemini 3.5 Pro 已在公司内部使用,预计“下个月”推出。但三个月过去,3.5 Pro 仍未露面。Axios 报道称,谷歌甚至可能完全放弃发布 3.5 Pro,直接转向 Gemini 4 Pro。

与此同时,彭博社 7 月报道称,Gemini 3.5 Pro 因编程能力仍需改善,发布时间比原计划晚了数月。而 Flash 系列却在短短三周内完成了一次换代。

市场甚至有传言称,谷歌正在调整 AI 竞争策略——不再押注参数更大、成本更高的超大规模前沿模型,转而聚焦到性价比更高的 Flash 级别模型上。谷歌目前尚未就此回应。

而在这次发布前一周,谷歌 DeepMind 刚完成一次权力交接:创始人 Demis Hassabis 交出日常管理职责,转任董事长及 Alphabet 首席科学家。

六、一周之内,AI江湖彻底变天

Gemini 3.7 Flash 的发布,只是过去一周 AI 行业密集新闻中的一个注脚。

把时间拉回到 8 月 12 日深夜,DeepSeek 悄无声息地把 V4 Pro 从预览版更新为正式版。DeepSWE 基准测试得分从预览版的 12.8 暴涨至 62.7,在 CyberGym 和 AutomationBench 两项测试中甚至反超了 Fable 5。输出价格不足 Fable 5 的七分之一。

十几个小时后,阿里正式开放 Qwen3.8-2.4T-A95B 模型权重。这是阿里首次将 Max 级别旗舰模型开源。千问团队展示的极限测试令人震撼:连续自主编程约 16 天、独立复现并改进研究论文、在超 2000 轮交互中经营虚拟电商企业。

几乎同一时间,马斯克的 SpaceXAI 发布 Grok 4.6。Artificial Analysis 智能指数得分 61,与 GPT-5.6 Sol 持平。SpaceX 股价当日涨超 9%。

Meta 几天前发布开源模型 Muse Glimmer,承诺未来几周内开放旗舰 Muse Spark 1.2 权重。英伟达 Nemotron 3.5 Lightning 也在本周上线。OpenAI 推出 GPT-5.6 Sol Ultrafast 模式,速度是标准的 14 倍。

一周之内,DeepSeek、阿里、谷歌、xAI、Meta、英伟达、OpenAI——全球主要 AI 玩家几乎全员出动。

这不是巧合。这是一场有预谋的“集体军演”。

七、三个信号:这场军演告诉了我们什么?

信号一:开源模型正在从“追赶者”变成“围剿者”

据 Hugging Face 2026 年春季报告,中国自研开源模型下载占比达 41%,首次超过美国。市场研究公司 Counterpoint 给出判断:“如果西方科技巨头只顾构建封闭的围墙花园,开发者和企业自然会转向中国的开放权重模型。”

当开源模型在性能上逼近闭源对手,价格却只有对方的几分之一甚至几十分之一时,闭源厂商的定价权与利润率将同时承压。开发者大量转向开源方案,意味着闭源实验室不仅失去 API 收入,更失去了构建开发者生态的机会。

信号二:所有人在押注同一个方向——Agent

DeepSeek V4 Pro 的核心升级是 Agent 能力。Grok 4.6 的重点是“长时间运行的 AI 智能体”。Gemini 3.7 Flash 定位是“面向企业构建自主 AI 系统”。Meta Muse Glimmer 是“专为本地 Agent 工作流深度优化”。

大模型竞争已经翻篇了。“谁会聊天”不再重要,“谁能持续干活”才是新的胜负手。

信号三:性能差距在缩小,价格差距在拉大

Grok 4.6 得分 61,Fable 5 是 62。DeepSeek V4 Pro 与 Fable 5 的平均差距仅 2.8%。但价格差距呢?DeepSeek V4 Pro 输出价不足 Fable 5 的七分之一。Gemini 3.7 Flash 限时价只有 Gemini 3.6 Flash 的一半。

性能天花板在被无限逼近,但价格地板在被不断击穿。

八、给创业者与开发者的启示

1. “够用、快、便宜”正在成为新的竞争力

Gemini 3.7 Flash 不是能力最强的模型,但它在智能、速度和成本之间找到了一个更适合规模化部署的平衡点。对于大多数实际业务场景,“够用且便宜”比“最强但昂贵”更有吸引力。

2. 智能体是下一个主战场

从编程到网页开发到自动化工作流,每一次升级都在强化“Agent”能力。模型正在从“回答问题”走向“持续干活”。如果你的业务涉及软件开发、自动化运维或数据分析,现在正是评估 AI Agent 替代方案的时候。

3. 价格战才刚刚开始

0.75 美元 vs 1.5 美元 vs 50 美元——大模型的价格体系正在被彻底打乱。开发者在做技术选型时,需要同时关注性能成本两条曲线。

4. 警惕“降价”背后的战略意图

谷歌的“五折体验券”只持续到年底。这更像是一次降低开发者试用和迁移成本的策略——先用低价把开发者拉进来,再争取让 Flash 成为智能体时代的默认工作模型。创业者在做成本规划时,既要利用当前的低价红利,也要为未来的价格调整预留弹性。

5. 开源模型的“围剿”才刚刚开始

当开源模型在性能上逼近闭源对手,价格却只有对方的几分之一时,闭源厂商的护城河正在被填平。对开发者来说,选择前所未有的多,成本前所未有的低。下一个玩家出牌的速度,只会更快。

写在最后

Gemini 3.7 Flash 的发布,揭示了谷歌正在走一条与 OpenAI、Anthropic 截然不同的路。

当别人在拼“谁是最强模型”时,谷歌在拼 “谁是最快迭代、最便宜、最能被规模化使用的模型”

三周一迭代,价格砍半,专攻编程和智能体。这不是一次偶然的更新,而是一套清晰的战略:用高频迭代和极致性价比,抢占 AI 开发者生态的入口

而放眼整个行业,一周之内全球主要 AI 玩家几乎全员出动。DeepSeek 用 0.1 分的性能差距和 60 倍的价格差重新定义了“性价比”;阿里首次将旗舰模型开源;马斯克的 Grok 4.6 性能追平 GPT-5.6 Sol;Meta、英伟达、OpenAI 也相继出牌。

大模型竞争已经翻篇了。“谁会聊天”不再重要,“谁能持续干活”才是新的胜负手。性能天花板在被无限逼近,价格地板在被不断击穿。

旗舰模型可以慢慢打磨,但战场不能等。Flash 正在用它的节奏告诉整个行业——AI 的竞争,不只有“最强”一条路

关键词标签: #谷歌 #Gemini3.7Flash #大模型 #AI编程 #智能体 #价格战 #DeepSeek #Grok4.6 #开源模型 #AI竞赛

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐