研究者提出 SkillClone,仅凭正常提问即可克隆 LLM Agent 隐藏技能功能
提出 SKILLCLONE,仅凭良性任务交互重构 Agent 隐藏技能功能
- arXiv
- 2608.04192
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 攻击者
- 黑盒
- 测试
- DeepSeek-Flash、DeepSeek-Pro、DeepSeek-V4-Flash Preview 等 6 个
摘要论文揭示了仅靠良性任务交互即可重构闭源智能体技能隐藏功能的风险,表明功能保密需要限制累积信息泄露。
论文从功能保密视角系统研究了大语言模型智能体技能的行为重构威胁。