WAIC 现场观察:当 AI 从「写代码」长到「跑流程」,一个新物种正在成型
2025 世界人工智能大会现场,代码助手与办公助手之间的边界正在被改写。多家展位上的 AI 产品不再满足于"生成一段代码""写一封邮件",而是开始接管跨工具、跨步骤的完整工作流——从需求拆解、工具调用到结果交付,一次跑完。
2025 世界人工智能大会现场,代码助手与办公助手之间的边界正在被改写。多家展位上的 AI 产品不再满足于"生成一段代码""写一封邮件",而是开始接管跨工具、跨步骤的完整工作流——从需求拆解、工具调用到结果交付,一次跑完。
过去两年,"AI 写代码"是落地最快、争议最小的场景:Copilot 类工具把单点代码补全做到了日常可用。但 WAIC 2025 现场传递的信号是——代码助手正在长出"跑流程"的能力。
给一个函数签名,补一段实现;给一段报错,回一段修复建议。人仍然是流程的执行者。
接到一个任务,自主定位问题文件、跨文件改动、运行测试、确认通过后提交 PR。人退到审核位。
位移的本质,是从"模型生成内容"升级为"模型 + 框架协同完成一件事"。这件事可能是一段代码的修复,也可能是一份财报的拆解、一次差旅的规划、一份合同的体检——形态各异,底层链路高度同构:
注:本图为现场观察抽象出的共性链路,不同厂商产品在"工具集""校验机制""交付形态"上各有差异,但骨架一致。
"新物种"不是凭空冒出来的。现场多家厂商的产品能同时跨过"跑流程"这道坎,是因为三块拼图终于凑齐:
新一代底座模型对长链路指令的遵循度显著提升,能在多步之间维持目标不漂移、不半途而废。
任务拆解、工具调用、中间结果校验、失败重试——这套工程骨架在多家厂商处同时跑通,说明方法论已可复用。
代码执行环境、文件处理器、实时 API、浏览器操作——Agent 能调用的"手脚"足够丰富,端到端交付才成为可能。
三件事缺一不可:模型再强,没有工程框架也跑不稳;框架再好,没有可调用的工具也交付不出结果。新物种的成立条件,是这三者同时越过临界点。
本篇素材来自展会现场的观察性报道,非第三方独立评测:现场展位演示的产品形态与能力,不等同于其在真实业务负载下的稳定表现。展会 demo 通常经过场景筛选与流程打磨,读者宜带着"这是厂商展示的最佳状态"的背景去读,而非"这是任意场景下的平均水平"。
文中"新物种"一词,是现场多家厂商产品形态趋同后的编辑归纳,并非任何一家厂商的官方定调;目前未见第三方机构对这些产品的端到端完成率做系统复测。它是否真正成立,最终要靠真实业务里的稳定跑通来验证,而不是靠展板上的口号。
WAIC 2025 已在上海新展中心开幕,代码与办公 Agent 集中在智能体主题展区,可现场对比体验。
worldaic.com.cn → 智能体展区