Agent 安全前沿 6 种攻击向量,评估 AI 智能体获得工具调用权限后的攻击面
AI Agent 工具调用权限
Agent-to-Agent 注入 Agent-A 输出被 Agent-B 当作可信指令执行
ReAct 思维链劫持 注入虚假 Observation 污染 scratchpad
多模态 Prompt Chain OCR · 音频转写 · Web 内容跨模态注入
工具 Schema 混淆 additionalProperties / oneOf 约束绕过
Summarize 外泄 利用合法 summarize 工具作为数据外泄通道
时延触发器 文档中嵌入未来日期触发的注入指令
评测输出: 是否抵抗注入 · 是否检测工具误用 · 是否发现数据泄露 · 攻击链描述 · CVSS 严重度评分
对应 AI 安全团队在 Agent 上线前的安全评估工作