跳到正文
原文
Embrace The Red·· 2026-02-11

研究者演示在 Agent Skill 中植入不可见 Unicode 后门并发布扫描工具

Scary Agent Skills: Hidden Unicode Instructions in Skills ...And How To Catch Them

AI 导读

安全研究者 Johann Rehberger 演示了如何用不可见的 Unicode Tag 码点在 Agent Skill 中植入提示注入后门,使其通过人工文本审查。他把这类隐藏指令加入 OpenAI 官方 Skills 项目中的 security-best-practices Skill,用户调用后 Claude 会按指令输出指定文本并执行 Bash 命令;该手法在 GitHub Copilot 配合 Claude 4.5 时同样生效。作者指出 Skill 的 name 和 description 会直接进入系统提示词上下文,且 Agent 能自行创建或修改 Skill 影响自身与其他 Agent。

阅读原文embracethered.com