阿里 Qoder 上线国内首个实时语音交互智能体,底层全双工语音模型全球登顶
7 月 28 日,阿里 Qoder 上线国内首个实时语音交互智能体 Qoder Voice。用户语音唤醒后,智能体可像真人助手一样实时双向交流并执行任务——底层全双工语音模型 Qwen-Audio-3.0-Realtime 在 Artificial Analysis 语音综合指数中拿下全球第一。
7 月 28 日,阿里 Qoder 上线国内首个实时语音交互智能体 Qoder Voice。用户语音唤醒后,智能体可像真人助手一样实时双向交流并执行任务——底层全双工语音模型 Qwen-Audio-3.0-Realtime 在 Artificial Analysis 语音综合指数中拿下全球第一。
Qoder Voice 的核心驱动来自实时全双工语音模型 Qwen-Audio-3.0-Realtime。该模型斩获多项权威榜单第一,其中在 Artificial Analysis 的语音综合指数(Speech to Speech Index)中得分 84.1%,位列全球第一。
Artificial Analysis 是专注于大模型能力的独立评测平台,其 Speech to Speech Index 综合衡量语音到语音模型的理解准确率、响应延迟、语音自然度与多轮对话连贯性等维度。这意味着 84.1% 不是一个单项分数,而是对"听懂—思考—说回"全链路能力的综合评定。
"全双工"是理解 Qoder Voice 价值的关键词:它意味着听与说可同时进行——用户可以在 Agent 说话的过程中随时打断、补充或改变方向,Agent 实时响应,无需等待一轮说完。这是与传统"对讲机"式语音交互最本质的区别。
当前 Agent 交互存在两个痛点:文本输入在长上下文场景下效率低;传统语音交互是"对讲机"式单向输入,Agent 只能被动接受指令,无法主动与用户讨论。
单向输入,说完等回复;Agent 被动接受指令,无法主动追问或讨论;任务执行时用户需停留在页面等待。
实时双向交流,可随时打断、追问、调整;Agent 可主动给出方案与建议;任务后台执行,用户可边交流边处理其他事。
用户只需在 Qoder Quest 模式主界面点击语音入口,即可在任意界面唤起常驻的语音助手悬浮窗。发起语音指令后,Qoder 自动创建任务、调用工具并在后台持续执行——语音交互与任务执行同步进行,用户无需停留在页面等待结果。
除了执行单次指令,Qoder Voice 支持讨论式交互——面对复杂任务,AI 先给出执行方案,用户通过语音补充需求或调整方向,AI 再根据反馈优化并执行。
语音悬浮窗常驻,用户无需停留在特定页面。发起任务后可继续处理其他事,Qoder 在后台完成后实时反馈结果。
对话过程中用户可随时插话调整方向,Agent 实时响应并更新执行计划,无需从头开始一轮新对话。
Qoder 已是中国最受欢迎的智能体编程平台之一。根据 IDC 2025 年中国 AI 编程市场份额报告,Qoder 以 47.6% 的市场份额位居第一,超过第二名至第五名总和。
注:以上为 Qoder 全系产品整体数据,非 Qoder Voice 单项。客户包括中国一汽、中信证券、亚信科技等。市场份额来源为 IDC 2025 年中国 AI 编程市场份额报告。
从技术链路看,Qoder Voice 的实时语音交互依赖一条完整的工程链:
全双工语音模型负责听、说、理解三层能力,Agent 框架负责任务拆解、工具调度与结果交付——两者协同,才能实现"动动嘴,让 Agent 干活"的完整闭环。
本篇报道来源为企业通稿,84.1% 的 Speech to Speech Index 得分系单方披露,未见第三方独立复测结果。读者可将该分数视为厂商自报的参考值,而非经同行验证的基准。不过,Qoder 在 AI 编程市场的份额数据来自 IDC 独立报告,可信度较高——它至少说明,推出 Voice 的不是一家空有概念的公司,而是已占据中国 AI 编程市场近半壁江山的产品团队。
Qoder Voice 已率先登陆 Qoder 国际版,个人订阅 / 体验版 / 企业订阅用户可获 3 天限时免费试用。Qoder CN 版近期上线。
qoder.com → 进入 Quest 模式点选语音