🚀 模型·产品同步发布

参数规模达 2.4 万亿,千问发布 Qwen3.8 并同步上线办公产品,开启“模型+产品”新路线

8 月 3 日,阿里正式发布总参数 2.4 万亿的 Qwen3.8-Max 预览版,同日千问办公产品上线公测。Qwen3.8 被定位为千问办公的“护航大作”,模型与产品首次以“主机+独占游戏”的组合模式推向市场。

综合公开信息整理 2026-08-05 全文约 4 分钟读完
#千问办公 #Qwen3.8 #AI Agent #Token Foundry
2.4 万亿 Qwen3.8-Max 总参数规模
8 月 3 日 Qwen3.8 发布 + 千问办公上线
198 元/月 千问办公企业标准版 · 席位价

⚡ 30 秒速览

  • 发生了什么:阿里发布 Qwen3.8(2.4 万亿参数),同日千问办公正式公测,模型承担产品品牌。
  • 路线不同:飞书/WPS 从既有系统向下接模型,千问办公从模型向上生长文件、工具和交付能力。
  • 实际表现:7 分钟生成 12 页财报 PPT,关键数据与官方一致;但电商网站任务耗时 1 小时 8 分钟,且出现乱码失败。
  • 商业模式:Token Foundry 路线落地——模型生产 Token,Agent 拉长任务,千问办公按“席位+积分”计费。
  • 一个疑问:模型上限高,但 Agent 配合不稳定。死循环和失败重跑的成本由用户承担,体验仍有波动。

01模型找身体,产品找使命

7 月 19 日,阿里披露 Qwen3.8-Max 预览版已进入 Token Plan、Qoder 和 QoderWork。8 月 3 日,Qwen3.8 正式发布,千问办公同步上线。在客户端内,Qwen3.8-Max 是唯一拥有具体名字的模型——其他模型负责能力,Qwen3.8 负责品牌。

这是一种“护航大作”策略:就像 Switch 首发《塞尔达》,千问办公需要一款独占模型让用户决定尝试。

两条路线正在分野:

路线 A:从系统接模型

飞书、钉钉、WPS 从既有办公系统向下接模型,文件、工作流和组织关系原本就在手里。

路线 B:从模型长系统

Claude Cowork、Kimi Work、千问办公从模型向上生长文件、工具和交付能力,没有存量包袱,但需要自己造生态。

注:两条路线无绝对优劣,差异在于资源禀赋。阿里选择 B 路线,意味着必须同时证明模型能力和产品完成度。

02同一台引擎,上限和下限隔得很远

模型强,只解决了任务的上限;下线要看 Agent 和模型的配合。阿里把 Qwen3.8 放进首发位,看中的是代码、多模态、推理和长上下文,但实际测试结果并不均衡。

📊 财报 PPT:12 页,7 分钟完成✅ 顺利交付

  • 任务:生成 Alphabet 二季度财报 PPT,关键数据与官方材料能对上,文件可继续编辑。
  • Agent 自主检索数据、整理结构、输出可编辑文档,耗时约 7 分钟。
结论:高确定性任务,模型+Agent 配合流畅

🛒 电商网站:1 小时 8 分钟,交付成功⚠️ 耗时较长

  • 任务:“NOVA 数码”电商网站,从零构建一个可用网页。
  • Agent 拆解步骤、编写代码、调试,最终完成交付,但耗时超过 1 小时。
  • 消耗:约 1000 积分,三项测试合计消耗约 1000 积分。
结论:能完成,但效率有提升空间

🎮 3D 火箭仿真网页:2 小时,三次报错❌ 体验波动

  • 任务:开发 3D 火箭仿真网页,Agent 经历两次报错后最终做出可用结果。
  • 耗尽 2000 积分,用户看到最终网页,但无法判断多少积分花在有效工作上。
  • 另一项“公众号文章转飞书文档”任务出现全文乱码,最终未交付。
结论:长任务稳定性不足,失败重跑成本由用户承担

社媒上同样褒贬不一:V2EX 有人夸它生成单页 HTML 的效果,也有用户发现它仅凭 CSS 类名就误判项目安装了 Tailwind。Reddit 上有用户说它 10 分钟修好复杂问题,同一个人也遇到会话三轮后陷入重复循环。

一个诚实的注脚:模型装进产品以后,没地方甩锅了。长任务需要检查点、失败续跑、关键操作确认和交付验收——这些能力,Qwen3.8 和千问办公仍在建设中。

03Token Foundry:从模型批发到任务零售

过去半年,阿里为这套生意搭建了三个层级:

Alibaba Token Hub 事业群 Token Foundry 事业部 阿里云(商业化兑现)

Token Foundry 决定造什么,阿里云负责怎么卖,Token Hub 负责把两头接起来。千问办公处在这条链路的应用端——Qwen3.8 生产 Token,Agent 把回答拉长成工作,千问办公把消耗装进积分和席位。

聊天机器人回答一次,Token 消费很快停下。Agent 接走一项任务,会持续搜索、读取文件、写代码、调用工具、检查结果——链路越长,Token 转得越快。办公这种高频、长链条任务,很适合给 Token 找活。

但烧 Token 和赚到钱之间还有三道关:用户认可结果、用户愿意付费、用户愿意续费。

198 元企业标准版/月/席位
98 元个人高级版/月
免费个人基础版
积分制统一计量 Token 消耗

注:积分把底层 Token 换成前台货币,用户不用研究每百万 Token 多少钱,但也看不见失败重跑烧掉多少调用。

阿里内部目前有四套计费模式:ES Agent 按 Token 收,联网检索 Agent 按调用收,DataBridge Agent 按规格收,千问办公按席位加积分收。但收敛方向已经明确——百炼 Token Plan 团队版已公开 Credits 统一计量,同一订阅可在多种 AI 工具中使用。

另一个信号:5 月财报电话会上,吴泳铭把“AI 模型与应用服务”报成一条合并的收入线,6 月季度 ARR 预计突破 100 亿元。会计口径上,阿里不再把模型收入和应用收入拆开——所谓“模型+Agent 整体计费”,是写进财报语言的既定方向。

04主机已摆上柜台,价签还未统一

Qwen3.8 给了用户尝试千问办公的理由,但产品仍有几个老问题需要回答。

问题一:Agent 和模型的配合是否到位?从测试看,高确定性任务(财报 PPT)流畅,但开放性任务(电商网站、3D 仿真)波动明显。死循环和失败重跑直接烧用户的钱,产品越不稳定,账单越难看。

问题二:偏暗香的付费模式能否持续吸引用户?积分制模糊了底层成本,但用户在有失败体验后,可能会对“先充钱再试错”的模式产生抵触。换成包月席位,风险回到阿里自己——市场普遍认为 Token 价格会下降,但吴泳铭在财报会上给出相反判断,理由是服务器成本上涨。

问题三:Qwen 能否持续领先?领先大模型的保质期太短。Qwen3.8 现在是最强,但半年后呢?如果竞争产品追上来,千问办公的“独占游戏”优势就不复存在。

编辑核心判断

千问办公是阿里 Token Foundry 路线在应用端的第一次完整落地,但模型强不等于产品好。Agent 稳定性、失败成本承担和定价收敛,才是决定“主机+游戏”组合能否留住用户的真正关卡。

现在就能体验

千问办公已开始公测,Qwen3.8 能力全面接入。个人版免费可用,企业版按席位订阅。

千问办公官网 → 下载客户端