防御arXiv 2610.12463
论文复盘 OpenAI、Anthropic 与 Google Agent 安全事件并提出 PASAC 框架
提出 PASAC 与五层边界保证栈,把智能体评测越界变成可验证的全系统保证
- arXiv
- 2610.12463
- 发表
- 层
- 应用层
- 场景
- AI Agent
- 防御权限与审批
- 风险Agent 危险操作
- 组件权限与沙箱
另有 2 篇论文还没打上分类标签,暂不在筛选结果里。
提出 PASAC 与五层边界保证栈,把智能体评测越界变成可验证的全系统保证
作者把高自主 AI scientist 的规模化协调写成经济与制度问题:假设生成变便宜之后,要分配的是稀缺验证资源,并处理信用、问责和恶意使用。
访谈并审计 EdTech 平台如何推迟隐私与 AI 披露
EdTech 里的学生隐私常被推迟,而不是设计时的部署条件。作者要解释组织内部为何如此,以及公开政策是否呈现同样结构。
Mitchell、Ghosh 与 Passi 的立场论文认为:人被留在回路中,并不会自动产生有效监督。