从蒸馏私有健康记录中智能体发现血液生物标志物
蒸馏私有健康记录为 GAT 打分器,供智能体发现血液标志物
- arXiv
- 2610.04749
- 发表
- 层
- 应用层
- 场景
- AI Agent
摘要私有队列被蒸馏成 GAT 打分器。
把私有 CBC 证据蒸馏成可发布的 GAT 打分器,使前沿智能体在不读取患者行时给生物标志物表达式排序。。
蒸馏私有健康记录为 GAT 打分器,供智能体发现血液标志物
把私有 CBC 证据蒸馏成可发布的 GAT 打分器,使前沿智能体在不读取患者行时给生物标志物表达式排序。。
提出认知脚手架,用设计摩擦与组织规程维持对智能体的人工监督
Mitchell、Ghosh 与 Passi 的立场论文认为:人被留在回路中,并不会自动产生有效监督。
梳理 AI 风险建模开放问题并比较两类定量提案
这是一份面向研究者与政策实践者的议程论文:先进 AI 的社会风险需要定量建模,但监管要求的先进方法尚未被定义。
提出 SelfSearch,用自我修改记录无奖励搜索以改进编码智能体
作者把高自主 AI scientist 的规模化协调写成经济与制度问题:假设生成变便宜之后,要分配的是稀缺验证资源,并处理信用、问责和恶意使用。
用均值场最优停止分析多智能体集体攻击的均衡条件
摘要结构阈值给出干预杠杆。
提出结合模型级监督与系统级控制的智能体保障架构
Lu 与 Bengio 给出的是一套可逐层上移的保障架构和一组事件归类,不是已测量的防御系统。
McHugh 给出提示注入工件的组件解剖,让防御、红队和 CTI 不必靠字符串匹配来标注、比较和变异攻击。
提出 AI 保险栈蓝图,为智能体经济构建可定价的明确承保
综合技术 AI 安全研究优先级,提出社会韧性支柱与智能体风险管理原则
用三层认知框架归纳智能体对人类能动性与控制的风险
这是一份按认知范围组织的人本风险分析,不是新的实验论文。
提出以协调情节为操作单位的跨执行准则,规定如何发现未授权智能体协同并在重启后遏制
摘要立场是跨执行保留关系并约束共享状态。
提出人机审计协作框架 HAAC,在对话购物 Agent 上分配并验证审计分工
HAAC 是一套用户参与式生成式 AI 审计的人机分工流程,实例为作者开发的对话式购物智能体。
Planarian 用 statepoint 回滚并分支环境。
Planarian 是与现有 harness 协同的运行时,把智能体环境收成可恢复、可分支的时间点。
提出 AgentRewind,用对齐检查点回退长程 Agent 的上下文与工作区
提出 TAIP,把策略与证据分离,在配置或策略变化后重算仓库审计门禁裁决
TAIP 是放在未修改 RepoAudit 之外的保证层,用来在软件交付门上重算智能体安全控制的当前姿态。
综述自主渗透智能体的继承攻击、架构攻击及护栏覆盖缺口
这是一篇关于自主 AI 渗透测试智能体的安全综述:用架构和生命周期两轴整理威胁与护栏,不做新的攻击实验。
提出可防篡改、可重放的自主 Agent 运行证据方案
占位。
提出 SAVER 框架综述自演化智能体的安全状态转移
SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。
提出 FAO 框架,形式化隐私约束下的智能体协同优化
Federated Agent Optimization(FAO) 是一篇框架论文:多个处在私有环境中的 LLM 智能体,如何在原始数据、完整轨迹和本地知识不离开客户端的前提下协作改进。