其他arXiv 2610.00093
自我演化智能体的安全性综述:SAVER 过渡中心框架
提出 SAVER 框架综述自演化智能体的安全状态转移
- arXiv
- 2610.00093
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 组件记忆
摘要SAVER 用状态转移追踪自演化安全:合法状态可经复用变不安全,后代修复证据仍少。
SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。
提出 SAVER 框架综述自演化智能体的安全状态转移
SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。
研究提出"内核管理共享内存",由智能体系统内核而非单个智能体统一负责记忆检索、隐私执行与提示注入。
kernel-managed shared memory 把多智能体的检索、隐私和注入收进 agent-system kernel,并在 AIOS 上与三种替代方案比较。
综述智能体执行链路中的越狱攻击、防御与实践权衡
Mia 等人把越狱安全从单轮回复扩展到智能体的规划、记忆、工具和智能体间通信,并问既有结论在更强原生对齐下是否还成立。
提出面向工具调用智能体的授权主体层级与结构要求
这是一篇关于工具调用型智能体授权架构的结构化叙事综述,分析单位是每一次使模型之外系统产生效果的调用。
提出威胁分类 T 并映射智能体红队研究与安全基准的覆盖
主张开展嵌入式评估,审查内部智能体监控、权限与模型对齐
嵌入式评估是一种第三方评估:独立评估者在前沿 AI 开发者现场获得接近员工的系统、人员与文档访问,用来审查依赖内部系统与实践的风险。