🛡️ Agent 安全 · 前沿方案

腾讯安全提出「以 AI 对抗 AI」:构建越用越强的 Agent Runtime 防线

随着 Agent 自主规划、工具调用与数据访问能力进入企业核心场景,提示词注入、意图偏离、工具滥用、数据泄露等运行时风险浮出水面。腾讯安全专家段昊彤将在 AICon 深圳站抛出一套覆盖事前、事中、事后全链路的纵深防御方案——以 AI 对抗 AI,依托真实生产数据实现能力持续自迭代

来源:公开报道 2026-07 全文约 3 分钟读完
#腾讯安全 #Agent Runtime #AI 对抗 AI #纵深防御
4 层 纵深防御链路 · 事前/事中/事后
12 演讲者安全攻防与产品研发经验
2 主导产品:EdgeOne-WAF / T-Shield

⚡ 30 秒速览

  • 核心命题:传统规则安全在语义化攻击与非确定性行为面前逐渐失效——Agent 安全是新战场。
  • 方案骨架:以 AI 对抗 AI,覆盖事前检测、事中沙箱隔离、事后数据防泄露,纵深防御逐层拦截。
  • 关键取舍:误报、时延、成本、模型选型,以及攻击者视角下的平衡——不是单点堆砌,是工程辩证。
  • 护城河逻辑:依托真实生产数据持续自迭代——安全能力「越用越强」,而非一次性交付。
  • 落地坐标:8 月 21—22 日,AICon 深圳站「Agent 安全:从风险到可控」专题。

01传统安全为什么接不住 Agent 的风险

Agent 的能力边界正在扩张:自主规划任务路径、调用外部工具、访问企业数据。这同时打开了四类运行时风险——提示词注入、意图偏离、工具滥用、数据泄露。

传统规则安全

关键词匹配 + 规则拦截。面对语义化攻击与非确定性行为,规则覆盖不全、更新滞后,逐渐失效。

AI 原生安全

从第一性原理出发,用语义级理解替代关键词匹配,用行为偏离检测替代静态规则。

段昊彤的演讲将以一条真实攻击链贯穿全场——从攻击者如何逐层穿透 Agent,到每一层防御为何存在、做了哪些工程取舍。核心判断是:单点防护必然失效,纵深防御才能互补

02Agent Runtime 防护全链路一次攻击的完整拦截

方案将一次 Agent 运行拆为四个阶段,每层设独立检测与隔离机制,层间协同形成纵深:

事前 · 提示词注入检测事中 · 意图偏离检测事中 · Agent 沙箱事后 · 数据防泄露

① 事前 · 提示词注入检测语义级

  • 关键词匹配升级为语义级理解——识别伪装在正常输入中的注入指令。
  • 关键工程取舍:检测精度与请求时延之间的平衡。

② 事中 · 意图偏离检测行为级

  • 识别间接注入行为偏离——Agent 是否在执行用户原始意图之外的动作。
  • 关键工程取舍:偏离判定的阈值设定与误报控制。

③ 事中 · Agent 沙箱隔离执行

  • 工具调用在隔离环境中执行,开箱即用的轻量方案 + 配置有效性保障。
  • 关键工程取舍:隔离强度与工具可用性之间的平衡。

④ 事后 · 数据防泄露(DLP)出站防护

  • 出站内容检测 + 小模型微调——在数据离开 Agent 前完成最后一道拦截。
  • 关键工程取舍:小模型推理成本与检测覆盖率之间的平衡。

四层之间不是简单串联。层间协同是方案核心——单点防护为何失效、纵深防御如何互补,将用贯穿案例的攻击推进路径逐层演示。

03为什么「越用越强」才是真护城河

攻击手法快速演进,一次性交付的安全能力会迅速过期。段昊彤给出的答案是自迭代闭环——依托真实生产环境数据,防护能力持续更新。

一次性交付

规则与模型在部署时固化,面对新型攻击手法需要人工迭代,响应滞后。

自迭代闭环

真实生产数据回流,检测模型与拦截策略持续更新——安全能力随使用量增长而增强。

这套方案的实践痛点同样被诚实摆出:误报控制与业务体验的平衡语义级检测的算力成本与实时性矛盾攻击演进速度 vs 防护迭代速度——三个工程难题,没有银弹。

编辑视角

本文核心内容来自一场已确认的技术大会演讲预告,方案细节、攻防案例与「自迭代」效果数据均来自演讲者单方披露,尚未见第三方独立复测或同行评审。读者宜将其视为一家安全厂商的方法论展示,而非已验证的工程结论——「越用越强」是产品叙事,实际收敛效果需看落地后的真实指标。

支线信息:演讲者段昊彤现任腾讯 EdgeOne-WAF 与大模型防火墙 T-Shield 产品负责人,方案落地路径与这两款产品高度相关——方法论与产品利益存在绑定,读时需自行分离「技术判断」与「产品推介」。

Agent 从「能对话」走向「能执行」的那一刻,安全战场已从输入过滤迁移到运行时治理——谁先把语义级检测、沙箱隔离与数据防泄露做成可复制的工程标准,谁就拿到了企业级 Agent 部署的准入券。

去哪里听

8 月 21—22 日,AICon 深圳站「Agent 安全:从风险到可控」专题。早鸟票享 9 折,立减 580 元。

AICon 深圳站 → 报名入口