Agent 安全前沿
6 种攻击向量,评估 AI 智能体获得工具调用权限后的攻击面
AI Agent
工具调用权限
Agent-to-Agent 注入
Agent-A 输出被 Agent-B 当作可信指令执行
ReAct 思维链劫持
注入虚假 Observation 污染 scratchpad
多模态 Prompt Chain
OCR · 音频转写 · Web 内容跨模态注入
工具 Schema 混淆
additionalProperties / oneOf 约束绕过
Summarize 外泄
利用合法 summarize 工具作为数据外泄通道
时延触发器
文档中嵌入未来日期触发的注入指令
评测输出:
是否抵抗注入 · 是否检测工具误用 · 是否发现数据泄露 · 攻击链描述 · CVSS 严重度评分
对应 AI 安全团队在 Agent 上线前的安全评估工作