攻击arXiv:2609.18217 · 9月16日研究:跨通道碎片化攻击可绕过 MCP 单通道防御提出跨通道分段攻击,借 MCP 多通道隐式信任外发敏感数据编程 Agent·测试GPT-4o、GPT-4o-mini、GPT-5.4 等 15 个·应用层提示注入编码与混淆MCP 与技能+2+2摘要论文揭示了 MCP 多通道隐式信任层级,通过跨通道分段与协议级利用突破现有防御,展示了严重的凭证外发风险。完整解读
攻击arXiv:2609.09553 · 9月9日研究:任意密文攻击前沿大模型无需微调即可越狱提出任意字母置换密码越狱,无需微调即可诱导有害输出模型与 API攻击者黑盒·测试Claude Sonnet 4、Claude Sonnet 4.5、Gemini 3 Flash (preview) 等 7 个·提示层越狱编码与混淆护栏与评审+2+2摘要前沿大模型无需微调即可通过提示词学会字母置换密码,进而绕过分类器与对齐,作者呼吁关注能力提升带来的安全风险。完整解读