跳到正文
10月9日 · 周五

观点与讨论 · 论文

找到 16 篇
筛选1
同一类里任选其一,不同类之间同时满足;数字是加上其他已选条件后的篇数。另有 7 篇还没打标签,不在筛选结果里。

另有 7 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2609.31562

    面向自主科学发现的智能体经济基础设施

    主张用智能体经济协调自主科学发现的验证、信用与安全

    发表
    摘要作者主张以智能体经济管理自主科学发现的验证资源、信用、问责与安全,而非只提升推理。

    作者把高自主 AI scientist 的规模化协调写成经济与制度问题:假设生成变便宜之后,要分配的是稀缺验证资源,并处理信用、问责和恶意使用。

    深度解读完整解读
  2. 超越最终决策:面向透明 AI 辅助同行评审的流程中心基准

    提出过程中心基准,检验 AI 辅助评审终审是否被中间证据支撑

    发表
    测试
    Qwen2.5-7B-Instruct、Qwen2.5-14B-Instruct、Llama-3.1-8B-Instruct 等 6 个
    摘要过程基准显示人工对齐变量更有决策价值,模型中间文本并未稳定支撑终审。

    该基准用来检查 AI 辅助同行评审的中间证据是否支撑最终决策,而不是只看终审对错。。

    深度解读完整解读
  3. 分析与理论arXiv 2608.16578

    研究用统计力学预测 AI 智能体群体的集体行为

    用扩展 Ising 模型预测语言模型智能体的集体意见演化

    发表
    测试
    GPT-4o-mini、Gemma-3n-E4B-it、Qwen3.5-9B 等 6 个
    摘要统计力学三耦合模型从初始意见预测智能体社群轨迹,并解释 conviction、共识与客观题求真。

    定位:用统计力学描述语言模型智能体社群的意见动力学,并从初始意见预测后续轨迹。

    深度解读完整解读
  4. 其他arXiv 2609.10630

    论文提出 AI 安全设计保障架构:结合 Scientist AI 模型级监督与系统级控制

    提出结合模型级监督与系统级控制的智能体保障架构

    发表
    场景
    AI Agent
    摘要作者梳理事件中的多层失效,主张监督模型、系统控制与证据治理并用。

    Lu 与 Bengio 给出的是一套可逐层上移的保障架构和一组事件归类,不是已测量的防御系统。

    深度解读完整解读
  5. 其他arXiv 2610.00093

    自我演化智能体的安全性综述:SAVER 过渡中心框架

    提出 SAVER 框架综述自演化智能体的安全状态转移

    发表
    场景
    AI Agent
    摘要SAVER 用状态转移追踪自演化安全:合法状态可经复用变不安全,后代修复证据仍少。

    SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。

    深度解读完整解读
  6. 分析与理论arXiv 2609.31857

    LLM Judge 验证在稀疏重叠下的问题:从推理到设计

    分析稀疏重叠下 LLM judge 与人类一致性的验证误差并规划重叠分配

    发表
    测试
    Gemini Flash、Gemini Pro、GPT-4o-mini 等 10 个
    摘要稀疏重叠主导 judge 验证的错误决策。

    这篇工作研究标注重叠很稀时,怎样验证 LLM judge 是否足以替代人类,并规划重叠该留多少、怎么分配。。部署前的标准做法是在校准集上比较 judge 与人类的一致性。

    深度解读完整解读
  7. 其他arXiv 2609.15818

    Atria Dawn Preview:智能体超级智能的黎明

    用可验证经验流水线训练智能体并分析人机研发分工

    发表
    场景
    AI Agent
    测试
    Atria Dawn Preview、DeepSeek V4 Pro、KIMI K3 等 7 个
    摘要Atria Dawn 在五个基准上领先,研发日志里人类仍掌握大多数最终决定。

    Atria Dawn Preview 是面向研究与工程流程的智能体语言模型,论文同时报告它的基准表现,以及开发它的过程中人与智能体如何分工。

    深度解读完整解读
已经到底了