谷歌 Gemini 3.7 Flash 深夜上线:三周一迭代,价格砍半

📅 2026/8/14 17:57:57
谷歌 Gemini 3.7 Flash 深夜上线:三周一迭代,价格砍半
8月13日谷歌又发新模型了。距离上一代 Gemini 3.6 Flash 发布只过去了三周。没有盛大的发布会没有铺天盖地的宣传Gemini 3.7 Flash 就这样悄然上线了。三周一迭代价格直接砍半。谷歌正在用 Flash 系列打一场完全不同于以往的战争。一、产品速览100万上下文64K输出多模态全支持Gemini 3.7 Flash 的硬件参数延续了 Flash 系列一贯的务实风格上下文窗口100万 Token单次输出上限64K Token输入模态文本、图像、音频和视频可调整思考配置允许用户在不同任务中灵活权衡输出质量、推理成本和响应速度谷歌官方将其定义为“迄今为止用于编码和智能体领域最智能的 Flash 级主力模型”。这不是旗舰但却是谷歌想让最多开发者用上的那个模型。二、性能炸裂编程能力全面跃升相比三周前的 3.6 Flash新模型在多个关键基准上实现了两位数的百分比提升编程与软件工程FrontierCode 1.1 Main从 34.4% 跃升至43.6%DeepSWE v1.1长周期软件工程从 49.0% 提升至65.3%在 18 项评估中有 11 项领先 Claude Sonnet 5 和 GPT-5.6 Terra网页开发WebDev ArenaElo 评分从 1538 提升至1588能够用更少的提示词生成功能更完善的页面对截图、设计系统的还原度更高知识工作与自动化GDP.pdf复杂文档处理从 22.0% 提升至34.0%AutomationBench真实商业工作流从 17.0% 跃升至30.4%在 Artificial Analysis 的独立测试中Gemini 3.7 Flash 高推理模式下智能得分56比 3.6 Flash 提高 4 分。输出速度约为每秒 340 个 token接近 GPT-5.6 Terra 的 3 倍。但也并非全面领先——在考察图表理解能力的 CharXiv 测试中3.7 Flash 得分略低于前代。不过这并不影响整体的升级力度。三、价格战打到新高度直接五折但有时限Gemini 3.7 Flash 最引人注目的变化其实是价格。2026 年 12 月 31 日前API 入门价格直接减半输入每百万 Token 0.75 美元约 5.1 元人民币输出每百万 Token 3.75 美元约 25.3 元人民币2027 年 1 月 1 日起价格将恢复至输入每百万 Token 1.5 美元输出每百万 Token 7.5 美元有开发者评价每百万输入 Token 仅 0.75 美元对一个智能体模型来说“便宜得有些疯狂”。这意味着“把整个 Next.js 代码库丢进上下文让它自动重构也不至于把 API 预算搞破产”。而就在同一天DeepSeek 刚刚宣布即将涨价。一边涨价一边五折——大模型市场的价格策略正在走向两个截然不同的方向。四、实战演示从3D游戏到机器人训练为了证明新模型的实际落地能力谷歌在发布现场展示了多个覆盖不同领域的案例案例一文本生成3D游戏。开发者只需输入一段简单的文本提示Gemini 3.7 Flash 就能即时构建出可玩的 3D 游戏框架并与 Nano Banana 模型协同实时动态生成游戏中的角色、道具和表面纹理。案例二单次生成交互式落地页。Gemini 3.7 Flash 可以作为主控模型协调多个子智能体同时调用 Gemini Omni 创建具有视差效果的动态交互组件直接输出可运行的网页。案例三辅助机器人训练。在包含三个智能体的循环中Gemini 3.7 Flash 利用多模态理解能力帮助机器人进行环境感知与决策显著加快学习与训练速度。这些演示揭示了一个清晰的信号谷歌想让 Flash 成为智能体时代的工作模型而不仅仅是一个对话工具。五、背后的信号旗舰模型去哪了Gemini 3.7 Flash 的发布也引发了另一个更受关注的问题谷歌的旗舰模型去哪了今年 5 月谷歌在 I/O 大会上预告 Gemini 3.5 Pro 已在公司内部使用预计“下个月”推出。但三个月过去3.5 Pro 仍未露面。Axios 报道称谷歌甚至可能完全放弃发布 3.5 Pro直接转向 Gemini 4 Pro。与此同时彭博社 7 月报道称Gemini 3.5 Pro 因编程能力仍需改善发布时间比原计划晚了数月。而 Flash 系列却在短短三周内完成了一次换代。市场甚至有传言称谷歌正在调整 AI 竞争策略——不再押注参数更大、成本更高的超大规模前沿模型转而聚焦到性价比更高的 Flash 级别模型上。谷歌目前尚未就此回应。而在这次发布前一周谷歌 DeepMind 刚完成一次权力交接创始人 Demis Hassabis 交出日常管理职责转任董事长及 Alphabet 首席科学家。六、一周之内AI江湖彻底变天Gemini 3.7 Flash 的发布只是过去一周 AI 行业密集新闻中的一个注脚。把时间拉回到 8 月 12 日深夜DeepSeek 悄无声息地把 V4 Pro 从预览版更新为正式版。DeepSWE 基准测试得分从预览版的 12.8 暴涨至 62.7在 CyberGym 和 AutomationBench 两项测试中甚至反超了 Fable 5。输出价格不足 Fable 5 的七分之一。十几个小时后阿里正式开放 Qwen3.8-2.4T-A95B 模型权重。这是阿里首次将 Max 级别旗舰模型开源。千问团队展示的极限测试令人震撼连续自主编程约 16 天、独立复现并改进研究论文、在超 2000 轮交互中经营虚拟电商企业。几乎同一时间马斯克的 SpaceXAI 发布 Grok 4.6。Artificial Analysis 智能指数得分 61与 GPT-5.6 Sol 持平。SpaceX 股价当日涨超 9%。Meta 几天前发布开源模型 Muse Glimmer承诺未来几周内开放旗舰 Muse Spark 1.2 权重。英伟达 Nemotron 3.5 Lightning 也在本周上线。OpenAI 推出 GPT-5.6 Sol Ultrafast 模式速度是标准的 14 倍。一周之内DeepSeek、阿里、谷歌、xAI、Meta、英伟达、OpenAI——全球主要 AI 玩家几乎全员出动。这不是巧合。这是一场有预谋的“集体军演”。七、三个信号这场军演告诉了我们什么信号一开源模型正在从“追赶者”变成“围剿者”据 Hugging Face 2026 年春季报告中国自研开源模型下载占比达 41%首次超过美国。市场研究公司 Counterpoint 给出判断“如果西方科技巨头只顾构建封闭的围墙花园开发者和企业自然会转向中国的开放权重模型。”当开源模型在性能上逼近闭源对手价格却只有对方的几分之一甚至几十分之一时闭源厂商的定价权与利润率将同时承压。开发者大量转向开源方案意味着闭源实验室不仅失去 API 收入更失去了构建开发者生态的机会。信号二所有人在押注同一个方向——AgentDeepSeek V4 Pro 的核心升级是 Agent 能力。Grok 4.6 的重点是“长时间运行的 AI 智能体”。Gemini 3.7 Flash 定位是“面向企业构建自主 AI 系统”。Meta Muse Glimmer 是“专为本地 Agent 工作流深度优化”。大模型竞争已经翻篇了。“谁会聊天”不再重要“谁能持续干活”才是新的胜负手。信号三性能差距在缩小价格差距在拉大Grok 4.6 得分 61Fable 5 是 62。DeepSeek V4 Pro 与 Fable 5 的平均差距仅 2.8%。但价格差距呢DeepSeek V4 Pro 输出价不足 Fable 5 的七分之一。Gemini 3.7 Flash 限时价只有 Gemini 3.6 Flash 的一半。性能天花板在被无限逼近但价格地板在被不断击穿。八、给创业者与开发者的启示1. “够用、快、便宜”正在成为新的竞争力Gemini 3.7 Flash 不是能力最强的模型但它在智能、速度和成本之间找到了一个更适合规模化部署的平衡点。对于大多数实际业务场景“够用且便宜”比“最强但昂贵”更有吸引力。2. 智能体是下一个主战场从编程到网页开发到自动化工作流每一次升级都在强化“Agent”能力。模型正在从“回答问题”走向“持续干活”。如果你的业务涉及软件开发、自动化运维或数据分析现在正是评估 AI Agent 替代方案的时候。3. 价格战才刚刚开始0.75 美元 vs 1.5 美元 vs 50 美元——大模型的价格体系正在被彻底打乱。开发者在做技术选型时需要同时关注性能和成本两条曲线。4. 警惕“降价”背后的战略意图谷歌的“五折体验券”只持续到年底。这更像是一次降低开发者试用和迁移成本的策略——先用低价把开发者拉进来再争取让 Flash 成为智能体时代的默认工作模型。创业者在做成本规划时既要利用当前的低价红利也要为未来的价格调整预留弹性。5. 开源模型的“围剿”才刚刚开始当开源模型在性能上逼近闭源对手价格却只有对方的几分之一时闭源厂商的护城河正在被填平。对开发者来说选择前所未有的多成本前所未有的低。下一个玩家出牌的速度只会更快。写在最后Gemini 3.7 Flash 的发布揭示了谷歌正在走一条与 OpenAI、Anthropic 截然不同的路。当别人在拼“谁是最强模型”时谷歌在拼“谁是最快迭代、最便宜、最能被规模化使用的模型”。三周一迭代价格砍半专攻编程和智能体。这不是一次偶然的更新而是一套清晰的战略用高频迭代和极致性价比抢占 AI 开发者生态的入口。而放眼整个行业一周之内全球主要 AI 玩家几乎全员出动。DeepSeek 用 0.1 分的性能差距和 60 倍的价格差重新定义了“性价比”阿里首次将旗舰模型开源马斯克的 Grok 4.6 性能追平 GPT-5.6 SolMeta、英伟达、OpenAI 也相继出牌。大模型竞争已经翻篇了。“谁会聊天”不再重要“谁能持续干活”才是新的胜负手。性能天花板在被无限逼近价格地板在被不断击穿。旗舰模型可以慢慢打磨但战场不能等。Flash 正在用它的节奏告诉整个行业——AI 的竞争不只有“最强”一条路。关键词标签#谷歌 #Gemini3.7Flash #大模型 #AI编程 #智能体 #价格战 #DeepSeek #Grok4.6 #开源模型 #AI竞赛