攻击arXiv 2610.05139·10月4日研究揭示代码注释中的上下文注入攻击面提出推理时上下文注入,用代码注释诱导补全生成含弱点的代码arXiv2610.05139发表10月4日层提示层场景coding agent被测模型StarCoderBase、DeepSeek-Coder-base、Qwen2.5-base 等 10 个攻击提示注入深度解读完整解读
攻击arXiv 2509.05372·2025年9月4日研究:对抗性 bug 报告可诱导 LLM 自动程序修复系统生成不安全补丁用对抗缺陷报告诱导自动程序修复系统生成不安全补丁arXiv2509.05372发表2025年9月4日层应用层场景coding agent被测模型claude-sonnet-4-20250514、o4-mini、GPT-4.1-mini 等 8 个攻击提示注入技术角色扮演与说服组件护栏与评审深度解读完整解读