💻 AI 硬件 · 观察

把 1200 亿大模型装进笔记本:联想在 IFA 算了一笔「算力经济账」

德国柏林 IFA 展前夕,联想发布多款 AI 终端新品。通过搭载高算力芯片与统一内存架构,端侧设备开始具备直接运行千亿参数大模型的能力,显示出 AI 算力正加速由云端向终端设备迁移。

综合公开信息整理 2026-09-04 全文约 4 分钟读完
#AI PC #联想IFA2026 #端侧大模型 #NVIDIA RTX Spark
1 PFLOPS FP4 精度 AI 算力(Yoga Pro 9n)
1200亿 本地运行大模型参数上限
25.1% 联想全球 AI PC 市场份额
FAST TAKE

⚡ 30 秒速览核心动态

  • 核心突破:发布 Yoga Pro 9n,首批搭载 NVIDIA RTX Spark 芯片,打破 CPU 与 GPU 显存壁垒,实现 128GB 统一内存,机身重 1.6kg。
  • 底层驱动:云端 Token 昂贵带来的成本压力,促使企业及高级用户寻求本地端侧算力替代方案。
  • 形态探索:展示 Swan(卷轴屏,14 寸可延展至 17 寸)及 Aeroblade(固态主动散热,厚度不足 10mm、重不足 900g)两款概念机。
  • 矩阵延伸:推出模块化台式机 ThinkCentre X Ultra,支持最多 4 台叠加扩展算力;智能体系统 Qira 扩展至手机及手表终端。

01需求回升背后的「算力经济账」云端 Token 成本触发本地替代

在硬件迭代的背后,AI终端的增长驱动力正在发生结构性变化。长久以来,业界对 AI PC 的真实需求始终存在追问:用户究竟是在为噱头买单,还是在寻找解决实际效率问题的生产力工具?

“云端Token的成本太高,企业用户面对巨额云账单的痛感正在触发AI PC的真实需求。”

—— Luca Rossi,联想集团执行副总裁兼智能设备业务集团(IDG)总裁

当企业与开发者频繁调用云端大模型 API 时,持续累积的 Token 消费构成了难以忽视的营业支出。这促使算力部署策略从单一依靠云端,向「云端深度推理 + 端侧即时响应」的混合架构转移。

云端 API 推理依赖

按 Token 计费,长期成本高昂;数据需上传网络,面临隐私保护与网络延迟约束。

端侧混合算力部署

一次性硬件投入,本地运行大模型;数据留在设备端,零 Token 边际成本。

财报数据显示,联想单季度营收达 1834 亿元人民币,同比增长 43%;AI 相关业务收入突破 634 亿元,其全球 AI PC 市场份额已攀升至 25.1%

02把 1200 亿大模型装进 1.6kg 笔记本统一内存拆除显存墙

以往限制笔记本电脑运行大型语言模型的主要瓶颈在于显存容量与数据搬运效率。传统架构中 CPU 内存与 GPU 显存隔离,导致高参数模型无法加载。

旗舰机型 Lenovo Yoga Pro 9n 搭载 NVIDIA RTX Spark 芯片,通过 NVLink-C2C 技术将 20 核 Grace CPU 与 Blackwell 架构 GPU 互联,提供了关键的技术转折点:

Yoga Pro 9nRTX Spark / 统一内存
1200 亿
常规 Copilot+ PC常规 NPU / 独立显存
約 100 亿

数据参考:英伟达与联想展会公开指标。本地可运行最高 1200 亿参数、100 万 Token 上下文模型。实测表现受限于实际散热策略与量化精度(待第三方复测)。

128GB 统一内存打破了 CPU 与 GPU 之间的界限。这意味着开发者与高级用户无需将项目文档、代码或素材上传至云端,即可在本地独立运行复杂的多智能体协同任务。

03形态与工程极限再拓广界卷轴屏与固态散热技术

除了算力架构的升级,展会现场公布的两款概念机型展示了笔记本工程设计的进阶方向:

📜 卷轴屏概念机(Project Swan)形态创新

  • 动态画布:常态为 14 英寸便携本,展开后屏幕可延展至 17 英寸 16:9 画布
  • 轻量化控制:整机厚度 18.9 毫米,重量控制在 1.6 千克,适用于多文档并排审阅与数据看板。
工程意义:解决了大尺寸屏幕办公需求与携行便携度之间的固有矛盾。

🗡️ 无风扇超轻薄概念机(Project Aeroblade)散热工程

  • 极致尺寸:机身厚度不足 10 毫米,重量小于 900 克
  • 固态主动散热:联合 Frore Systems 采用 AirJet 固态主动散热模块取代传统旋转风扇,降低运行噪音与进尘量。
工程意义:验证了薄型设备在放弃机械风扇的前提下保持持续性能输出的可行性。

04端侧 AI 的全场景与模块化扩展从可穿戴设备到集群台式机

端侧 AI 算力正在从单一笔记本电脑向全场景硬件形态演进。个人智能体系统 Qira(中国市场为天禧 AI)已实现跨设备上下文同步:

PC 办公终端Android 手机/平板moto watch ultra 手表

在商用算力部署方面,联想展示了集群式台式机新品类 ThinkCentre X Ultra。该设备旨在解决企业本地算力扩容成本高昂的问题:

🖥️ 模块化叠加算力台式机(ThinkCentre X Ultra)

  • 单机规格:1.6 升体积机身,搭载 AMD 锐龙 AI Max+ PRO 495 处理器,支持 128GB 统一内存(最高 96GB 可分配为显存)。
  • 集群化扩展:支持最高 4 台设备叠加互联,组合为统一算力平台,适应更大规模模型与长上下文处理需求。
部署逻辑:允许企业部门根据业务增量“按需叠加”硬件,降低首次部署门槛。
编辑观察与判断

将千亿参数模型搬上笔记本并非单纯的参数竞赛,而是端侧硬件对云端 API 依赖发起的一场结构性分流。然而,统一内存的高昂成本、高负载下的续航与发热控制,依然是端侧大模型从极客玩具走向大众普及必须面对的硬性考验。