跳到正文
10月8日 · 周四

全部论文

找到 50 篇

另有 725 篇论文还没打上分类标签,暂不在筛选结果里。

  1. 其他arXiv 2609.40360

    SCAPO:用反事实稳定性改进 GRPO 的 token 级信用分配

    提出 SCAPO,用半事实稳定性改进 GRPO 的 token 级信用分配

    发表
    测试
    Qwen3-4B-Base、Qwen3-1.7B-Base
    摘要SCAPO 在训练早期下调相对不稳定 token 的 GRPO 优势,两个规模上多数基准更高。

    SCAPO 把固定回答在半事实提示下的稳定性,变成 GRPO 训练早期的 token 级负向信用修正。。

    深度解读完整解读
  2. 其他arXiv 2607.28568

    Frontis-MA1:面向机器学习工程递归自我改进的 AI4AI 模型

    提出 OpenMLE 全栈,用执行反馈后训练机器学习元进化智能体

    发表
    测试
    Frontis-MA1-35B、Qwen3.6-35B-A3B、Frontis-MA1-30B 等 15 个
    摘要OpenMLE 训练 Frontis-MA1-35B,用四个共享算子把 MLE 后训练和长程搜索接成元进化闭环。

    作者提出全栈 OpenMLE,在机器学习工程里研究从进化到元进化的一步,并把递归自我改进视为更远目标。智能体要在延迟、有噪声的执行反馈下反复修改程序。作者认为公开系统很少同时提供可扩展环境、基于执行的后训练,以及部署该模型的长程进化搜索。

    深度解读完整解读
  3. 其他arXiv 2610.00812

    视频生成模型的后训练与对齐综述

    综述视频生成的后训练与对齐,并汇总基准与开放挑战

    发表
    测试
    Wan、HunyuanVideo、OpenSora 等 8 个
    摘要综述把视频后训练分成四类对齐信号,并指出奖励、长视频、权衡和安全仍开放。

    这是一篇视频生成 后训练与对齐 综述:预训练模型已有强先验,但作者认为仍不能可靠遵循意图、维持时间连贯或满足物理与安全约束。

    深度解读完整解读
  4. 其他arXiv 2610.00093

    自我演化智能体的安全性综述:SAVER 过渡中心框架

    提出 SAVER 框架综述自演化智能体的安全状态转移

    发表
    场景
    AI Agent
    摘要SAVER 用状态转移追踪自演化安全:合法状态可经复用变不安全,后代修复证据仍少。

    SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。

    深度解读完整解读
  5. 其他arXiv 2610.01195

    Federated Agent Optimization:面向隐私约束下分布式智能体协同优化的联邦智能体优化框架

    提出 FAO 框架,形式化隐私约束下的智能体协同优化

    发表
    场景
    AI Agent
    摘要FAO 把智能体协作写成效用、隐私和通信的多目标问题,并给出组件分类与迁移框架。

    Federated Agent Optimization(FAO) 是一篇框架论文:多个处在私有环境中的 LLM 智能体,如何在原始数据、完整轨迹和本地知识不离开客户端的前提下协作改进。

    深度解读完整解读
  6. 其他arXiv 2610.02092

    TESS:面向大语言模型数据选择的可扩展可迁移元网络需换损失函数

    提出 TESS 与点值匹配损失,训练可迁移的数据选择网络

    发表
    测试
    Llama-3-8B-Instruct、Llama-3.1-8B-Instruct、Qwen2.5-7B-Instruct 等 5 个
    摘要TESS 用损失差伪标签和 PVM 训练可迁移选择网络,并在安全选择与指令微调上报告跨数据迁移。

    TESS 是一个用于 LLM 训练数据选择的元学习框架:用验证集引导下的损失差做样本伪标签,训练一个能给未见样本打分的选择网络。

    深度解读完整解读
  7. 其他arXiv 2402.00838

    OLMo:加速语言模型科学研究

    发布开放语言模型 OLMo、Dolma 数据与训练评测代码

    发表
    测试
    OLMo-1B、OLMo-7B、StableLM 1.6B 等 15 个
    摘要OLMo 开放 1B/7B 模型、Dolma 与训练评测工件。

    Allen Institute 发布 OLMo:一套从数据、训练到评测都公开的语言模型框架,用来支持对语言模型能力、弱点、偏见与风险的研究。

    深度解读完整解读
  8. 其他arXiv 2609.10144

    AIOS 的内核管理共享内存:面向系统级个性化的新抽象

    AI 导读研究提出"内核管理共享内存",由智能体系统内核而非单个智能体统一负责记忆检索、隐私执行与提示注入。

    发表
    测试
    GPT-4o、Llama-3.1:8B、Qwen-2.5:7B
    摘要作者称内核集中管理记忆,能拿到无约束上下文的大部分个性化收益,并降低延迟。

    kernel-managed shared memory 把多智能体的检索、隐私和注入收进 agent-system kernel,并在 AIOS 上与三种替代方案比较。

    深度解读完整解读
  9. 其他arXiv 2609.12413

    SoK 综述:智能体 AI 时代的越狱攻击、防御与实践考量

    综述智能体执行链路中的越狱攻击、防御与实践权衡

    发表
    场景
    AI Agent
    测试
    Qwen3.5-4B、Llama-3.1-8B-Instruct
    摘要SoK 将越狱重放到智能体流水线,并用两种模型检验回复层防御的边际与代价。

    Mia 等人把越狱安全从单轮回复扩展到智能体的规划、记忆、工具和智能体间通信,并问既有结论在更强原生对齐下是否还成立。

    深度解读完整解读
  10. 其他arXiv 2609.15906

    综述提出面向工具调用 AI 智能体的授权架构

    提出面向工具调用智能体的授权主体层级与结构要求

    发表
    场景
    AI Agent
    摘要叙事综述用主体层级把工具调用授权收成七项要求,并标出强制与聚合两处缺口。

    这是一篇关于工具调用型智能体授权架构的结构化叙事综述,分析单位是每一次使模型之外系统产生效果的调用。

    深度解读完整解读