▣ 模型接入 · 办公智能体

灵犀专业版首批接入 DeepSeek-V4-Pro 正式版:办公智能体开始交付可编辑成果

8 月 13 日,金山办公旗下 AI 办公智能体灵犀专业版宣布,已首批接入 DeepSeek-V4-Pro 正式版。用户可直接在产品内切换模型使用,无需额外配置

事件时间:8 月 13 日 产品发布:7 月 15 日 全文约 3 分钟读完
#灵犀专业版 #DeepSeek-V4-Pro #AI办公 #Agent交付
100 原生支持的超长上下文 token
38.4 单次最大输出 token
2 正式版系列:Flash 与 Pro

注:以上为公开参数与当前产品开放状态;token 数量描述模型处理边界,不等同于单次任务必然消耗的长度。

⚡ 30 秒速览

  • 发生了什么:灵犀专业版首批接入 DeepSeek-V4-Pro 正式版,模型可在产品内直接切换。
  • 模型强在哪:原生支持 100 万 token 上下文,单次最大输出达 38.4 万 token,相较 Preview 版本的公开评测成绩全面提升。
  • 产品要交付什么:不止生成回答,而是结合历史文档、会议材料和个人偏好,调用多类工具产出可编辑、可溯源、可继续协作的原生 Office 成果。
  • 当前怎么用:DeepSeek-V4 正式版系列已在灵犀专业版全量上线,Flash 与 Pro 两个版本均向用户开放。
  • 一个诚实注脚:公开信息没有给出具体 benchmark 分数、排名或真实用户完成率,因此“行业第一梯队”不能直接等同于确定名次。

01接入已落地 从发布到全量开放

这次更新的重点不是增加一个孤立的模型入口,而是把新模型放进灵犀专业版原有的办公任务链。产品定位本身已经从“回答问题”延伸到“理解工作上下文、调用工具、交付文件”。

时间线很短,产品路径很清楚。

7 月 15 日

灵犀专业版发布

定位为每个人的专属 AI 办公助理,强调对个人工作上下文的持续理解。

8 月 13 日

首批接入正式版

DeepSeek-V4-Pro 正式版进入灵犀专业版,用户可以在产品内切换使用。

目前

V4 正式版系列全量上线

Flash 与 Pro 两个版本均已向用户开放,不需要额外配置。

使用门槛:产品内切换 配置要求:无需额外配置 开放状态:全量上线

注:时间线按公开披露的产品节点排列;“目前”指报道发布时的开放状态。

02为什么可信 参数、评测与任务方向三层证据

关于 DeepSeek-V4-Pro 的能力描述,公开信息主要来自模型文档和公布的评测数据。它没有只强调参数规模,而是把上下文长度、输出能力以及 Agent 任务表现放在了一起。

PARAMETER

长上下文边界明确

原生支持 100 万 token 超长上下文,适合处理长文档、连续材料与复杂工作背景。

公开参数 100万 token
EVALUATION

相较 Preview 全面提升

V4-Pro-0813 的相关基准测试成绩较此前 Preview 版本提升,但公开报道未列出逐项分数。

版本对比 未披露具体值
AGENT TASK

任务能力进入第一梯队

公开描述集中在终端操作、代码工程与工具调用,说明评测关注的是执行链路,而不只是问答准确率。

终端操作 代码工程 工具调用
如何理解“第一梯队”:这是公开信息中的能力判断,不是一个已经给出具体名次的排行榜结论。缺少分项得分时,最稳妥的读法是确认能力方向变强,而不是替它补出不存在的排名。

注:三张卡片分别对应参数层、评测层和任务层;标签表示信息类型,不代表统一量纲下的分数。

03它到底能做什么? 从工作材料到 Office 成果

灵犀专业版的交付逻辑,是先理解用户已有的工作材料,再调用合适的工具推进任务,最后留下一个可以继续修改的成果。下面三个场景,代表的是产品公开披露的能力路径,而非虚构的 benchmark 案例。

📄 历史文档与会议材料 → 工作文档 上下文理解

  • 读取用户已有的历史文档、会议材料和个人偏好,不把每次任务都当作一次全新的对话。
  • 围绕工作背景理解需求,减少用户反复粘贴资料、重复解释目标的步骤。
  • 最终交付可编辑、可溯源、可继续协作的原生 Office 成果。
交付标准:重点不只是“回答得对不对”,还包括文件是否能被打开、修改并继续推进。

📊 表格与数据处理 → 可继续使用的文件 工具调用

  • 灵犀能够调用文档、表格和数据处理等工具,将自然语言需求拆解为多个执行步骤。
  • 任务推进不止停留在文字建议,而是把处理结果写回办公成果中。
  • 当后续需要修改、复核或协作时,用户可以继续使用已经生成的 Office 文件。
交付标准:公开信息强调“原生 Office 成果”,但没有披露具体任务的完成率、耗时或错误率。

🌐 浏览器、代码与终端 → 多步执行链 Agent 能力

  • 新模型重点增强的方向包括终端操作、代码工程与工具调用,适配更复杂的执行任务。
  • 灵犀可调用浏览器、代码及数据处理工具,将需求拆解、工具执行与结果交付串联起来。
  • 新模型的加入,目标是让这条链路在复杂办公任务中更加完整、稳定。
交付标准:目前公开材料说明了能力方向,但没有给出可独立复现的具体任务样例。

注:案例卡展示的是“输入—工具—成果”的任务结构;其中未披露的完成率与耗时,不做额外推断。

04为什么能做到? 模型只是其中一层

如果只把 DeepSeek-V4-Pro 当作一个聊天模型,接入价值会被低估。真正决定办公智能体能否交付的,是模型、上下文、工具和 Office 成果之间能不能形成闭环。

一条完整链路,大致是这样。

工作上下文 历史文档、会议材料、个人偏好,为任务提供持续背景。
模型推理层 DeepSeek-V4-Pro 处理长上下文,并负责需求拆解与执行规划。
工具执行层 调用文档、表格、浏览器、代码和数据处理工具推进任务。
成果交付层 输出可编辑、可溯源、可继续协作的原生 Office 成果。

这也是此次接入的核心:新模型提供更强的长上下文与 Agent 任务能力,灵犀则负责把这些能力接入用户的实际工作材料和专业 Office 环境。

注:链路为产品公开定位的结构化表达,不代表后台唯一技术架构;箭头表示任务推进顺序,而非单向、不可回溯的执行过程。

05怎么判断这次升级? 看终点,不只看模型按钮

市面上会聊天的 Agent 很多,但能把结果直接交付出来的不多。判断灵犀专业版这次升级,不能只看“接入了哪个模型”,还要看它是否把模型能力转化成了可以继续工作的文件。

判断维度 对话型终点 办公交付型终点
交互结束 回答出现在聊天窗口 成果落到可编辑文件
信息来源 主要依赖当前轮输入 结合历史文档、会议材料和偏好
执行方式 生成文字或给出建议 调用文档、表格、浏览器、代码等工具
后续协作 用户复制、整理、再加工 继续修改、追溯和协作

这张表不是统一 benchmark,也不能替代真实用户测试。它只回答一个更实际的问题:模型输出有没有跨过“答案”与“工作成果”之间的那道门。

注:对比依据为产品公开定位与能力描述;“办公交付型终点”是分析框架,不代表所有任务都能一次完成。

编辑核心判断

灵犀专业版接入 DeepSeek-V4-Pro 的价值,不在于再增加一个模型按钮,而在于把模型的长上下文与 Agent 能力接进既有的办公交付链;但在缺少具体 benchmark 分数、真实用户完成率和稳定性数据前,它更像一次能力上限升级,而不是效率结论。办公智能体的竞争终点,不是回答更像人,而是能否持续把任务交付成可编辑、可追溯、可继续工作的文件。

现在怎么用

进入灵犀专业版,在模型选择处切换至 DeepSeek-V4-Pro;无需额外配置。DeepSeek-V4 正式版系列目前提供 Flash 与 Pro 两个版本。

打开灵犀专业版 进入模型选择 切换 DeepSeek-V4-Pro
体验入口:灵犀专业版产品内 · 具体可用模型以当前界面显示为准