跳到正文
10月10日 · 周六

全部论文

找到 23 篇

另有 194 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2610.08884

    Task-Sufficient Contraction:机器信息接口的源选择方法

    定义任务充分收缩,认证用 GC 替换全信源后速率–遗憾曲线不变

    发表
    摘要任务可在优化前定出压缩信源。

    任务充分收缩处理机器信息接口上的信源选择:已声明任务有时可以在编码器、码本、速率、失真目标或优化器选定之前,定出一个更小的信源。

    深度解读完整解读
  2. 其他arXiv 2609.38096

    Tail-Influence Sampling:面向 CVaR 策略评估的尾部影响采样

    提出 Tail-Influence Sampling,按尾部影响分配查询以估计策略下尾 CVaR

    发表
    摘要TIS 用尾部影响分配条件查询估 CVaR。

    在条件转移可独立查询时,用 tail influence 把固定评测预算分给对一条固定策略的下尾 CVaR 更重要的 kernel。平均回报相近时,罕见失败仍可能差很多。完整 rollout 把大部分预算花在到不了最坏状态的转移上。

    深度解读完整解读
  3. 其他arXiv 2609.31562

    面向自主科学发现的智能体经济基础设施

    勾勒科学智能体经济以协调验证、信用与安全

    发表
    摘要作者主张以智能体经济管理自主科学发现的验证资源、信用、问责与安全,而非只提升推理。

    作者把高自主 AI scientist 的规模化协调写成经济与制度问题:假设生成变便宜之后,要分配的是稀缺验证资源,并处理信用、问责和恶意使用。

    深度解读完整解读
  4. 其他arXiv 2609.19399

    RWPS:面向网络安全博弈的高效纳什均衡计算

    提出 RWPS,在固定仿真预算下估计安全博弈收益并求均衡

    发表
    摘要RWPS 用历史代理和均衡加权采样估计安全博弈收益,并给出按支撑加权的遗憾界。

    Lanier、Farmer 与 Vorobeychik 研究仿真型网络安全博弈中,如何在远小于全矩阵的仿真预算下计算可利用性较低的均衡。。收益没有闭式,PSRO 扩大攻防策略池时必须估计每一对的收益,仿真次数随池二次增长。

    深度解读完整解读
  5. 其他arXiv 2609.18120

    PentestChain:面向免费层 LLM 的成本感知 MCP 编排自动化渗透测试框架

    提出成本感知的 MCP 编排框架,用确定性利用图与免费层模型做自动化渗透测试

    发表
    摘要确定性利用图加免费层级联在十次自建运行上测得付费成本为零。

    PentestChain 是一个十阶段、经 MCP 暴露的自动渗透框架,用确定性利用图把 7B 本地模型挡在利用关键路径之外,并把每次交战的美元成本当作实测指标。。

    深度解读完整解读
  6. 其他arXiv 2609.10144

    AIOS 的内核管理共享内存:面向系统级个性化的新抽象

    提出内核管理共享记忆抽象,统一多智能体的检索、隐私过滤与注入

    发表
    被测模型
    GPT-4o、Llama-3.1:8B、Qwen-2.5:7B
    摘要作者称内核集中管理记忆,能拿到无约束上下文的大部分个性化收益,并降低延迟。

    kernel-managed shared memory 把多智能体的检索、隐私和注入收进 agent-system kernel,并在 AIOS 上与三种替代方案比较。

    深度解读完整解读
  7. 其他arXiv 2609.02122

    研究:LLM 智能体比例改变人类群体共识的形成方式

    测量混合群体中 LLM 智能体比例对共识强度与约定归属的影响

    发表
    被测模型
    Qwen2.5-VL-32B-Instruct、Qwen2.5-VL-7B-Instruct
    摘要智能体比例先催化、再干扰、再重建共识,高比例把约定推向更抽象的智能体概念。

    这项实验研究混合人类–LLM 群体里,智能体比例如何改变自发约定。

    深度解读完整解读
  8. 其他arXiv 2608.21326

    撒哈拉以南非洲自主 AI 诊断智能体的负责任部署:患者知情与问责缺口

    梳理已部署自主诊断系统的知情与问责缺口并提出三项最低原则

    发表
    摘要用三项最低原则约束无强制复核的自主诊断智能体,并承认原则尚待实证。

    作者把撒哈拉以南非洲电子健康里的自主诊断智能体写成治理问题,而不是新的诊断模型。要处理的是:系统分析患者数据并给出拟被执行的诊断或分诊,中间没有强制人工复核,患者又未必知道这一步由智能体完成。

    深度解读完整解读