谷歌Pixel 11发布:Gemini跨越40+应用接管系统工作流,AI手机进入"Agent时代"
8月12日,谷歌正式发布Pixel 11系列。新机搭载Tensor G6芯片,端侧性能提升3.5倍、能耗降低3.5倍,但真正改变游戏规则的,是Gemini从"功能助手"升级为系统级Agent——它能跨越40多个应用执行多步骤任务,并主动理解邮件、日历与航班信息,在用户说出目标之前预判需求。
8月12日,谷歌正式发布Pixel 11系列。新机搭载Tensor G6芯片,端侧性能提升3.5倍、能耗降低3.5倍,但真正改变游戏规则的,是Gemini从"功能助手"升级为系统级Agent——它能跨越40多个应用执行多步骤任务,并主动理解邮件、日历与航班信息,在用户说出目标之前预判需求。
过去几年,手机里的 AI 大多藏在相机或备忘录里——帮你修一张照片、写一段文字、回答一个问题。它始终是一个"功能",而不是"系统的一部分"。
Pixel 11 改变了这件事。
谷歌让 Gemini 成为 Android 的智能层:它不再等待被调用,而是主动感知用户正在做什么,并协调不同应用完成任务。用户只需说出目标,剩下的事情——理解需求、调用工具、协调流程、确认交付——全部由 Agent 完成。
AI 是独立功能入口,藏在相机、备忘录或语音助手里。用户需主动打开、手动操作,AI 只做单点任务。
Gemini 融入系统工作流,跨 40+ 应用理解上下文,自动拆解目标、调用工具、执行多步任务,用户只需确认。
跨应用能力覆盖 Gmail、Calendar、Google Maps、Notes 等 40+ 原生及第三方应用,支持邮件内容提取、日程冲突检测、航班信息联动等复合场景。
最值得关注的是它的上下文理解能力:Gemini 可以同时读取邮件中的确认函、日历上的会议时间、航班 App 里的行程信息,然后自动判断"用户是否需要提前出发",而不是等用户问"我几点该出发"。
一个诚实的注脚:跨应用能力目前仍以 Google 自身服务为主,第三方应用的支持深度取决于 API 开放程度。这不是谷歌一家能解决的问题。
系统级 Agent 对算力的消耗是巨大的。如果每次交互都要上云,延迟、成本和隐私都无法支撑高频使用场景。Pixel 11 给出的答案是:把尽可能多的推理留在本地。
Tensor G6 搭载最新版 Gemini Nano,负责端侧推理;复杂任务仍调用云端 Gemini,但通过本地预处理大幅降低云端调用频率与数据量。
Tensor G6 并非追求"把完整大模型塞进手机",而是通过端云协同找到平衡:Gemini Nano 处理高频、低延迟的本地任务(如语音输入过滤、实时拍摄分析),更复杂的推理则交给云端。这种架构下,用户获得的体验是——AI 响应几乎无感,且不需要时刻联网。
Pixel 11 的背部设计延续了横向摄像头模组,镜头排列更简洁,机身可以平稳放在桌面上。但相比外观,真正重要的是:AI 不再是一个需要"打开"的功能,而是手机本身的工作方式。
Pixel 11 发布仅一天后,谷歌又推出了 Gemini 3.7 Flash——强化了多步骤规划与工具调用能力,限时 API 价格降至前代的一半。
这不是巧合,而是战略重心的转移。
与此同时,DeepMind 被曝正在重组,可能裁员 1/3 甚至更高;Noam Shazeer、John Jumper、Jeff Dean、Quoc Le 等多位核心 AI 人才相继离开。旗舰模型一再延期,但 Flash 模型从 3.5、3.6 到 3.7 快速迭代。
追求参数最大、能力最强,但成本高、推理慢、部署周期长。适合云端深度分析,不适合手机高频实时交互。
追求性价比与响应速度,成本低、推理快、可大规模部署。手机 AI 需要的是"够聪明且足够快",而非"最强但最慢"。
对于手机而言,Flash 路线可能比旗舰模型更有现实意义。手机里的 AI 要随时理解用户需求、调用工具、跨应用执行任务,这意味着模型不仅要足够聪明,还必须足够快、足够便宜,并且能够稳定地完成大量高频操作。
从经济角度看,Flash 模型是 AI 硬件规模化落地的数学前提。如果每次交互的推理成本降不下来,AI 手机就永远停留在"演示级"体验。
Pixel 11 展示了一条清晰的路径:让 AI 深入操作系统内部,成为系统级的智能层。但这不是唯一的答案。
另一条路,是豆包手机正在探索的方向。
豆包手机一代的思路是让 AI 像用户一样操作手机——理解屏幕界面、点击按钮、填写表单,模拟人的操作路径。而据公开信息,豆包二代开始尝试更底层的连接方式:通过 MCP(模型上下文协议)和 A2A(智能体协作)让应用主动向 AI 开放能力,而非让 AI 去模拟点击。
AI 嵌入操作系统,调用系统能力与 Google 服务,理解上下文、协调应用。优势是底层权限深,劣势是依赖自有生态。
AI 像用户一样操作 App 界面,或通过标准化协议直接调用应用能力。优势是跨平台通用,劣势是权限与商业边界受限。
两种路线背后,对应着同一个核心问题:AI 如何与互联网服务建立连接?
手机系统掌握的是设备能力,而互联网服务掌握在一个个独立 App 手中。是否开放能力、开放哪些能力,最终取决于应用自身的商业决策。这不是技术问题,而是生态问题。
无论哪种路线,最终目标一致:用户只需说出目标,AI 在手机里直接解决。但"直接解决"的背后,是互联网服务分发逻辑的深层重构。
AI 手机越智能,移动互联网的旧秩序越被动。
Pixel 11 系列已在 Google Store 上架,搭载 Android 最新系统,Gemini 系统级 Agent 随新机全面开放。现有 Pixel 用户将在后续系统更新中获得部分 Agent 能力。
Google Store 查看详情 →