全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 9 条- 动态Failure-First
FORGE-plus:用冻结 LLM 监督者实现力预算约束的接触密集装配恢复
FORGE-plus 是一个双层机器人装配框架,由冻结的纯文本 LLM 担任“预算设定者”和“恢复选择者”,按物体材质、质量与几何设定力上限 Fmax,底层 60–120 Hz 控制器用 ForceClamp 将所有指令力饱和至该上限,并以 120 N 全局硬上限防止模型幻觉。
- 动态Can.ac
Snapcompact:把上下文窗口渲染成像素字体图像,成本降至三分之一
Snapcompact 提出一种本地压缩方案:上下文窗口填满后,将文本渲染为 6×10 像素字体位图并以图像形式回传,40k 字符约合 3,279 image tokens,输入价格降至约三分之一。
- 动态Trail of Bits
Trail of Bits 用 AI Agent 自建工具链审计 Miden zkVM
Trail of Bits 在审计 Miden 零知识虚拟机前,用六个月时间让 AI Agent 从零构建了 LSP 服务器、反编译器和静态分析引擎,并发现一个高危漏洞:mod_12289 过程中 prover 提供的余数未经验证,恶意 prover 可借此伪造 Falcon 签名并盗取账户资金。
- 动态Failure-First
受人类手术启发的机器人开颅框架:多模态融合与自适应轨迹调整
针对现有机器人开颅多为"开环"系统、无法应对术中配准误差与颅骨位移的问题,研究者提出一套融合多模态感知与自适应控制的框架,用双轮廓融合轨迹规划配合球头工具单级螺旋铣削。其 CMA-TCN-Transformer 网络融合力信号与铣削声音,再经自适应贝叶斯滤波抑制误触发,并在检测到穿透后原位修正辅助轨迹。牛肋与离体羊颅实验显示,闭环系统在进度 ξ≥0.9 时将进给速度降至 vsafe=1mm/s。
- 动态Can.ac
工具调用的细枝末节:从邮件分类到 Claude 猜数字实验
作者用 Claude 做猜数字实验,对比五种工具接口(单次比较、批量、打包、向量、纯 emoji 回复)的效率与胜率,结果纯 emoji 方案反而比前沿模型少用约 2 倍 token。文章指出大语言模型每次只输出下一个 token 的概率分布,所谓"模型决定调用工具"并不存在,工具 schema 只是作为开发者消息拼进上下文,校验实际发生在调用方代码里。
- 动态Trail of Bits
别让 TEE 破坏你的 MPC:TEE 与阈值签名结合的安全陷阱与最佳实践
在 TEE 内运行 MPC 协议时,若未考虑不可信主机,恶意主机可在阈值签名者删除已用预签名后回滚文件系统状态,导致 nonce share 被重用并泄露私钥分片。TEE 的机密性、完整性与远程证明可把半诚实协议提升到恶意安全级别,但前提是将其视为纵深防御层而非健全协议的替代品。部署时需验证 quote 签名、证书链与测量值,并借助可复现构建和二进制透明日志绑定 MPC 参与方身份。
- 动态Failure-First
具身操作的数据金字塔:Ye 等人综述具身数据生态与可靠性缺口
Ye 等人(2026)在综述《Data Pyramid for Embodied Manipulation》中提出"具身数据金字塔",将具身数据按可扩展性与机器人对齐度的张力分为五层:真实机器人数据、UMI、第一/第三人称视频、仿真数据和通用视觉语言数据。
- 动态Failure-First
WCM:面向通用人机交互的世界认知模型
陈等人提出世界认知模型(WCM),用 SLAK 架构将感知、逻辑、动作、知识四模块解耦,并采用异步运行时让推理、人机交流与物理执行并行。在 9 项真实物理交互任务上平均成功率为 73.8%,剩余 26.2% 未处理任务余量被作者视为红队测试的诊断入口。异步设计也带来延迟与状态失同步风险,机器人可能基于已失效的世界状态行动。
- 论文arXiv:越狱、提示注入、投毒与防御
pikit:面向间接提示注入研究与评测的可组合工具包
研究者发布 pikit,一个用于系统评测间接提示注入威胁的可组合工具包,覆盖 13 种攻击方法、16 种文本与文件载体以及 9 种防御策略和 3 种离线检测基线。