评测与基准arXiv 2610.05818·10月5日研究显示 VLA 模型文本护栏漏检隐含危害指令评测文本守卫与激活探针能否发现 VLA 隐含危害指令arXiv2610.05818发表10月5日层应用层场景具身与机器人攻击检测规避组件护栏与评审+1+1深度解读完整解读
其他arXiv 2609.22720·9月19日残障披露如何在对话式 AI 中流动:ChatGPT、Claude、Gemini 的记忆、隐私与语境完整性访谈残障成人,分析向记忆型助手披露残障时的信息流与语境完整性arXiv2609.22720发表9月19日层应用层场景模型与 API组件记忆深度解读完整解读