具身图灵机:用有状态代码实现机器人递归自我改进的 Code-Only-as-Policy
提出 COAP,用有状态代码在测试时无模型地控制机器人
- arXiv
- 2610.12369
- 发表
- 层
- 应用层
- 场景
- 具身与机器人
提出 COAP,用有状态代码在测试时无模型地控制机器人
提出研究世界模型,用语言模型预测干预增益
作者把语言模型用作研究世界模型,在执行前预测干预增益的中位数,用来在有限预算下比较候选实验。要处理的缺口是研究智能体提案快于执行。同一类改动在不同参考模型、配方和预算下效果可以不同,因此需要能离开原环境继续使用的实验知识。
提出 GENUI-Harness,用生成界面收集未决输入并完成数据库服务任务
GENUI-Harness 把数据库服务任务的交互,从纯文本改成按当前请求和检索记录生成的界面。
提出 System Switch,让快决策模型仅在门控打开时询问推理模型
System Switch在不暂停的 Doom 里,让快的 typed-decision 模型做每一次决策,只在门控打开时把控制交给视觉推理模型。
提出 CARE,离线认证 VLA 加速配置的回合级失败风险并选出最快合格候选
CARE 在部署前从加速配置中选出最快、且加速诱发失败风险能被有限样本认证为低于用户预算的候选。证据不足就保留全计算参考策略。
发布开源个人智能体 nanoMuse,经 Sentinel 审查设备屏幕动作
部署时插入前向的参数记忆被单独划界,并按位点与时机归类。
提出 Transect,将长程 Agent 评测转录对齐到可回查的共享时间线
Transect 是基于 Inspect Scout 的转录分析包,用来在长程智能体评估里保住可回查的过程账户。
提出 DAEDALUS,用自生成任务自举 Agent 记忆
提出 AI Agent 主张的可审计性框架与裁决规则
作者给出把关于已部署智能体的主张写成可核查陈述的条件,而不是检测器或攻击方法。
提出 NetAgent,编排工具完成多任务网络流量分析
NetAgent 是一个多任务网络流量分析智能体框架。作者要让分析员用自然语言把分类、隧道检测和主机研判串成可重规划的工作流,而不为每个任务单独训练一个模型。
提出 HERA,协同演化 harness 与环境以提升 Agent 拒答准确性
HERA 在模型权重固定时,让 harness 与可执行环境按失败协同演化,以改进 agentic abstention。
主张多模态安全评测应衡量可控性,并用 SAE 建立四轴画像
作者主张多模态安全评测在行为分类之外,单独报告可控性画像,而不是把检测准确当成控制证据。
把文本水印证据写成带错误率的三态可审计结论
指定配置下的文本水印被做成可审计测量:记录证据如何衰减,并把检测收成三态,而不是判定人类作者身份。
用伤害风险模型评估英国 AI 生成虚假信息的伤害潜能
提出用可逆网络为给定 AI 控制器寻找可证明前向不变集
本文处理的是认证场景:AI 控制器事先给定,不能为了构造 Lyapunov 函数去改控制器,却仍要给出可解析核验的安全依据。
提出 Geodesic Unlearning,沿测地线编辑权重以提升缺模态鲁棒性
这项工作讨论多模态模型在部署时整段缺一个模态的性能下降,并把校正写成训练后的子空间编辑。
蒸馏私有健康记录为疾病特异性打分器,供外部智能体发现血液标志物
把私有 CBC 证据蒸馏成可发布的 GAT 打分器,使前沿智能体在不读取患者行时给生物标志物表达式排序。。
提出 DecSteer,用共享低秩残差算子把审议收成直接决策
DecSteer 是加在冻结语言模型残差流上的 System-1 决策算子,用行为克隆代替强化学习来调用模型里已有的技能。
提出一阶转向,把可组合权重适配译成可相加激活转向