📉 模型 · 商业动态

谷歌连上三款"省油"模型,旗舰跳票致市值一夜蒸发 2000 亿美元

7 月,在 Grok 4.5、GPT-5.6、Kimi K3 集中发布的"被超车之夏",谷歌没有拿出对标旗舰,而是连发三款 Gemini Flash 系列模型,主攻降低 token 消耗与企业运行成本。与此同时,原定 6 月发布的 Gemini 3.5 Pro 因编程能力未达内部预期持续跳票,Alphabet 单日市值蒸发约 2000 亿美元

来源:公开报道 2026-07-22 全文约 4 分钟读完
#Google #Gemini #AI模型 #企业级AI #网络安全
$2000亿 Alphabet 单日市值蒸发 · 股价跌约 4.4%
17% Gemini 3.6 Flash 平均输出 token 消耗降幅
3 同期发布 Flash 系列模型 · 全线主打降本增效

⚡ 30 秒速览

  • 发了什么:三款 Flash 模型——3.6 Flash(主力)、3.5 Flash-Lite(极速)、3.5 Flash Cyber(安全专用),全部聚焦 agentic 工作流效率与 token 成本。
  • 省了什么:3.6 Flash 输出 token 最多降 65%,输出价降至 $7.5/百万;Lite 输出价仅 $2.50/百万,350 token/秒。谷歌 CEO 称组合用 Flash 每年可为企业省超 10 亿美元。
  • 没发什么:Gemini 3.5 Pro 持续跳票,6 月更新训练数据后编程能力仍不及预期;谷歌已启动 Gemini 4 预训练。
  • 安全牌:Flash Cyber 在 CyberGym 基准 83.2%,逼近 GPT-5.5-Cyber 的 85.6%,实测扫 V8 引擎发现 55 个独立问题,仅限政府与可信伙伴试点。
  • 关键限制:3.6 Flash 在多数关键基准落后于 Claude Sonnet 5 与 GPT-5.6,价格却与对手持平,定位承压。

01三款"省油"模型矩阵 效率优先于绝对性能

Gemini 3.6 Flash 主力款

知识截止更新至 2026 年 3 月,编程、多模态推理均有提升;部分场景输出 token 最多减少 65%。企业客户 Heavia、Harvey 反馈视觉处理与图表分析显著增强。

输入 $1.50/百万 token
输出 $7.50/百万 token(降 $1.5)

Gemini 3.5 Flash-Lite 极速性价比

面向高吞吐智能体搜索与大规模文档处理,350 token/秒。终端工作台 2.1 评分从 31% 升至 54%,SWE-Bench Pro 与 OSWorld-Verified 均超旧款 3 Flash。

输入 $0.30/百万 token
输出 $2.50/百万 token

Gemini 3.5 Flash Cyber 安全专用

基于 3.5 Flash 优化,集成进 DeepMind 代码安全智能体 CodeMender,多子智能体并行扫描并汇总报告。仅向政府机构及可信合作伙伴试点开放。

访问 试点制非公开 API
对标 Mythos对手输入 $10 / 输出 $50

注:三款模型已向 Gemini 企业用户及 Gemini 应用用户开放;3.5 Flash-Lite 将接入 Google 搜索。

02Flash Cyber 实战:小模型打安全牌的样本

在 CyberGym 基准测试中,Flash Cyber 以 83.2% 逼近 GPT-5.5-Cyber 的 85.6%,分差仅 2.4 个百分点,但模型规模与 token 成本远低于后者。

GPT-5.5-CyberOpenAI
85.6
Flash CyberGoogle
83.2

注:柱形自 80 分起缩放,非零起点;分差以标注分数为准。谷歌优势主要在 token 成本而非绝对分数。

🛡️ V8 JavaScript 引擎漏洞扫描 55 个独立问题

  • Google Big Sleep 团队用 Flash Cyber 扫描 V8 引擎代码提交,发现 55 个已确认独立问题。
  • 标准 3.5 Flash 发现 47 个,Anthropic Claude Opus 4.6 发现 36 个
  • 其中 10 个漏洞是其他所有模型完全未能识别的独有发现。

⚡ 公开 API 两小时挖出 RCE 实战验证

  • Google 云漏洞研究团队用 Flash Cyber 扫描公开 API,仅 2 小时发现远程代码执行漏洞。
  • 并生成了可绕过安全防护的有效利用代码

Anthropic 在 AI 安全领域的领先地位正受到挑战。但谷歌承认这类模型"攻防双强",已实施严格访问限制——与 Anthropic 限制 Claude Mythos、OpenAI"可信访问"计划逻辑一致。

03真正的焦点:没有发布的东西

三款 Flash 模型之外,市场真正在意的是 Gemini 3.5 Pro 的持续缺席。这款原定 6 月推出的旗舰模型至今仍在测试阶段,华尔街正以它作为衡量 Google DeepMind 能否与 Anthropic、OpenAI 保持竞争力的关键信号。

2025 年 11 月 Gemini 3 系列发布,一度显示 Google 重回 AI 竞赛前列,促使 OpenAI 内部拉响"红色警报"。
2026 年 6 月(原定) Gemini 3.5 Pro 计划发布,目标对标 Claude Sonnet 5 与 GPT-5.6,但未能如期落地。
6 月下旬 团队尝试更新训练数据改进编程能力,结果"依然令人失望"——编程恰是企业级 AI 最具商业价值的场景。
7 月 17 日 跳票消息传出,Alphabet 股价单日跌约 4.4%,市值蒸发约 2000 亿美元。10 名现任与前任员工透露内部担忧失去市场优势。
同期 谷歌宣布已启动迄今"最雄心勃勃的一次预训练",目标直指 Gemini 4——但这是意图表达,非已落地能力。
编辑视角

本篇信息主体来自企业通稿与单方披露:模型性能数据由谷歌自行提供,"省 10 亿美元"为 CEO 公开表态而非第三方审计结论;Flash Cyber 的 83.2% CyberGym 成绩虽含竞品对比,但该基准本身由业界维护、非谷歌自建。

"市值蒸发 2000 亿"与"10 名员工透露担忧"等负面信息引自外媒调查报道,非谷歌官方口径,读者宜结合多方信源判断。同期竞品模型(Grok 4.5、GPT-5.6、Kimi K3)的基准分数与能力定位,均未见独立第三方复测报告。

当"省 token"从工程优化上升为 CEO 战略叙事,意味着大模型竞争正从"参数天花板"转向"企业预算争夺"——谁能把同等能力卖得更便宜,谁就能在中端市场锁死护城河,为下一代旗舰争取时间。

现在就能用

3.6 Flash 与 3.5 Flash-Lite 已向 Gemini 企业用户及 Gemini 应用用户开放;Flash Cyber 仅限政府与可信伙伴试点。

ai.google.dev → Gemini API 文档