灵犀专业版首批接入 DeepSeek-V4-Pro 正式版:办公智能体开始交付可编辑成果
8 月 13 日,金山办公旗下 AI 办公智能体灵犀专业版宣布,已首批接入 DeepSeek-V4-Pro 正式版。用户可直接在产品内切换模型使用,无需额外配置。
注:以上为公开参数与当前产品开放状态;token 数量描述模型处理边界,不等同于单次任务必然消耗的长度。
8 月 13 日,金山办公旗下 AI 办公智能体灵犀专业版宣布,已首批接入 DeepSeek-V4-Pro 正式版。用户可直接在产品内切换模型使用,无需额外配置。
注:以上为公开参数与当前产品开放状态;token 数量描述模型处理边界,不等同于单次任务必然消耗的长度。
这次更新的重点不是增加一个孤立的模型入口,而是把新模型放进灵犀专业版原有的办公任务链。产品定位本身已经从“回答问题”延伸到“理解工作上下文、调用工具、交付文件”。
时间线很短,产品路径很清楚。
定位为每个人的专属 AI 办公助理,强调对个人工作上下文的持续理解。
DeepSeek-V4-Pro 正式版进入灵犀专业版,用户可以在产品内切换使用。
Flash 与 Pro 两个版本均已向用户开放,不需要额外配置。
注:时间线按公开披露的产品节点排列;“目前”指报道发布时的开放状态。
关于 DeepSeek-V4-Pro 的能力描述,公开信息主要来自模型文档和公布的评测数据。它没有只强调参数规模,而是把上下文长度、输出能力以及 Agent 任务表现放在了一起。
原生支持 100 万 token 超长上下文,适合处理长文档、连续材料与复杂工作背景。
V4-Pro-0813 的相关基准测试成绩较此前 Preview 版本提升,但公开报道未列出逐项分数。
公开描述集中在终端操作、代码工程与工具调用,说明评测关注的是执行链路,而不只是问答准确率。
注:三张卡片分别对应参数层、评测层和任务层;标签表示信息类型,不代表统一量纲下的分数。
灵犀专业版的交付逻辑,是先理解用户已有的工作材料,再调用合适的工具推进任务,最后留下一个可以继续修改的成果。下面三个场景,代表的是产品公开披露的能力路径,而非虚构的 benchmark 案例。
注:案例卡展示的是“输入—工具—成果”的任务结构;其中未披露的完成率与耗时,不做额外推断。
如果只把 DeepSeek-V4-Pro 当作一个聊天模型,接入价值会被低估。真正决定办公智能体能否交付的,是模型、上下文、工具和 Office 成果之间能不能形成闭环。
一条完整链路,大致是这样。
这也是此次接入的核心:新模型提供更强的长上下文与 Agent 任务能力,灵犀则负责把这些能力接入用户的实际工作材料和专业 Office 环境。
注:链路为产品公开定位的结构化表达,不代表后台唯一技术架构;箭头表示任务推进顺序,而非单向、不可回溯的执行过程。
市面上会聊天的 Agent 很多,但能把结果直接交付出来的不多。判断灵犀专业版这次升级,不能只看“接入了哪个模型”,还要看它是否把模型能力转化成了可以继续工作的文件。
| 判断维度 | 对话型终点 | 办公交付型终点 |
|---|---|---|
| 交互结束 | 回答出现在聊天窗口 | 成果落到可编辑文件 |
| 信息来源 | 主要依赖当前轮输入 | 结合历史文档、会议材料和偏好 |
| 执行方式 | 生成文字或给出建议 | 调用文档、表格、浏览器、代码等工具 |
| 后续协作 | 用户复制、整理、再加工 | 继续修改、追溯和协作 |
这张表不是统一 benchmark,也不能替代真实用户测试。它只回答一个更实际的问题:模型输出有没有跨过“答案”与“工作成果”之间的那道门。
注:对比依据为产品公开定位与能力描述;“办公交付型终点”是分析框架,不代表所有任务都能一次完成。
灵犀专业版接入 DeepSeek-V4-Pro 的价值,不在于再增加一个模型按钮,而在于把模型的长上下文与 Agent 能力接进既有的办公交付链;但在缺少具体 benchmark 分数、真实用户完成率和稳定性数据前,它更像一次能力上限升级,而不是效率结论。办公智能体的竞争终点,不是回答更像人,而是能否持续把任务交付成可编辑、可追溯、可继续工作的文件。
进入灵犀专业版,在模型选择处切换至 DeepSeek-V4-Pro;无需额外配置。DeepSeek-V4 正式版系列目前提供 Flash 与 Pro 两个版本。