Meta 多智能体推理模型大版本更新,首度开放 API 并实测百万级上下文
Meta 超级智能实验室发布多模态推理模型 Muse Spark 1.1。新模型主打智能体任务编排,在工具调用、代码开发与计算机操作上较前代大幅提升,并首次通过全新 Meta Model API 向开发者开放公测。
Meta 超级智能实验室发布多模态推理模型 Muse Spark 1.1。新模型主打智能体任务编排,在工具调用、代码开发与计算机操作上较前代大幅提升,并首次通过全新 Meta Model API 向开发者开放公测。
Muse Spark 1.1 最大的变化不在单次推理能力,而在于它被训练成一个任务调度中心。面对复杂项目,它能够零样本泛化到新的原生工具、MCP 服务器和自定义技能。
模型能在"主控"与"执行"两种角色间无缝切换,通过多智能体系统优化端到端延迟:
作为子 Agent 时,它会严格遵守职责边界,理解可用工具,并知道何时该把问题升级回主控。这种分层架构使其处理复杂项目的速度显著快于前代 Muse Spark。
被动填充窗口,早期信息易被稀释,长链路任务后期常丢失关键步骤。
主动记忆动作、检索早期工作,并按需压缩以保留后续所需的关键步骤。
在计算机操作场景中,Muse Spark 1.1 展现出一种此前少见的"元认知":它不再逐步推理每一次点击,而是判断何时该写脚本自动化、何时该直接交互,并在每一步生成批量动作。
Muse Spark 1.1 的多模态能力强调感知与行动同时发生:能检查视觉与音频、在长工作流中保留细节,并在代用户操作电脑时调用这些细节。
部署前,Meta 依据其前沿 AI 扩展框架对模型进行了广泛安全评估:
注:上述结论为 Meta 单方面依据其内部"前沿 AI 扩展框架"评估得出,该框架定义了评测方法、威胁模型与部署阈值;目前未见独立第三方复测数据。
在对抗性测试中,模型对直接越狱、来自不可信数据的间接提示注入攻击及开发者提示攻击表现出更强抵抗力,幻觉率与谄媚倾向均有降低。
"Muse Spark 最令人印象深刻的是它把多少能力塞进了一个模型:百万 Token 上下文、完整多模态支持(图像、视频、PDF)、内置带引用的搜索、强推理、顶级编码能力(尤其是前端与设计)、结构化输出与并行工具调用——一个完整的智能体基座。"
—— Amjad Masad,Replit CEO"Meta 显然在为严肃的智能体编码而构建——强大的工具调用能力,加上一个让大规模运行真实编码工作负载在经济上可行的价格点。这种组合很罕见。"
—— Saoud Rizwan,Cline CEO"在 Box 的企业工作评测集上测试,Muse Spark 交付了与当今领先前沿模型相当的企业能力。结合其在结构化、程序化工作流上的优势,对专业服务、公共部门和工业运营等行业的组织极具吸引力。"
—— Yashodha Bhavnani,Box AI 产品副总裁本篇报道源自 Meta 官方博客,属企业通稿性质。文中所列能力提升与安全结论均为单方面披露:安全评估框架由 Meta 自身定义,评测集(如 Internal Coding Bench)细节未全量开源,目前未见独立第三方复测数据。读者宜将其视为"官方能力声明"而非中立验证结果。
外部引语来自 Replit、Cline、Box 等早期合作方,其反馈正面但存在商业合作背景,需注意利益相关性。建议结合后续独立评测与实际 API 调用数据综合判断。
模型已在 Meta AI 应用及 meta.ai 上线"Thinking"模式;开发者可通过全新 Meta Model API 公测接入。
meta.ai → 切换 Thinking 模式