跳到正文

#其他

今天还没有收录新动态

第 2 页更新的内容回到最新

8月21日周五
  1. Google DeepMind ·

    Google DeepMind 从 Atari 到 EVE Online:15 年游戏 AI 研究的下一步

    Google DeepMind 回顾 15 年游戏 AI 研究历程并宣布与游戏开发商合作,为新玩法体验做原型开发,其中最新一项是与《EVE Online》背后工作室 Fenris Creations 的研究合作。其早期工作始于用深度神经网络直接从像素玩 Atari 2600 游戏的 DQN,它学会了 49 款游戏且无需针对特定游戏做工程改造,相关成果登上 2015 年 Nature 论文。此后 AlphaGo、AlphaZero、MuZero、AlphaStar 相继攻克围棋、国际象棋、将棋及实时策略游戏,由 Gemini 驱动的新一代 SIMA 则转向理解和与人互动而非单纯取胜。

8月18日周二
  1. Failure-First ·

    Localized LoRA-MoE:块级低秩专家与自适应路由

    Barazandeh 等人提出 Localized LoRA-MoE,将空间分块与动态上下文条件路由融合,缓解标准 LoRA 在多任务流下的梯度冲突问题。该框架通过局部化更新和动态门控建立 Gradient Firewall,避免适配器权重坍缩为非特化的平均值。Cell-Wise 变体在高维仿真中较全局路由方案取得 +11.48% 的 R² 绝对提升,仅增加 96 个参数;California Housing 表格基准上 Block-Wise(99.65%)与 Cell-Wise(99.51%)达到近乎持平的表现,分别仅有 260 和 272 个可训练参数。

8月11日周二
  1. AI Frontiers ·

    AGI 将引发工业爆炸

    Coefficients Giving 高级研究员 Damon Binder 撰文论证,具备认知工作能力的 AGI 也能通过机器人执行体力劳动,且其劳动力成本极低。基于美国政府投入产出表推算,完全自动化经济中实物产出的增速约为每年翻一番,而非当前的数十年一次。该推演假设不引入新技术、也不发生递归自我改进走向超级智能,因此属于保守估计下的结论。

8月7日周五
  1. Failure-First ·

    LeCropFollow:面向非结构化农田导航的潜在空间规划

    Tommaselli 等人提出视觉导航框架 LeCropFollow,绕过传统几何管线将高维视觉压缩为单像素行参照的做法,改为在学习到的潜在流形中做规划并原生保留热力图离散度作为不确定性度量。该框架由自监督语义热图提取器 RowFollowNet(ResNet-18,输出 56x80x3 的张量表示消失点、左行、右行)与基于 TD-MPC2 的 MBRL 规划器组成,通过 MPPI 采样 N=256 条候选动作序列并在潜在空间中用世界模型和价值函数评估。

8月2日周日
  1. Failure-First ·

    ActiveVital:面向家庭医疗机器人的几何感知嵌入式生命体征监测

    ActiveVital 将毫米波雷达的生命体征监测从被动信号恢复重构为主动闭环几何调节问题,通过视觉引导定位胸部并调整传感器位姿来缓解角度失配导致的 cosθ 衰减。该系统基于 ViTPose 提取肩髋四个躯干关键点插值计算胸感测锚点,并用带容差阈值的二值控制律抑制机器人振荡。在 Galaxea R1 Lite 机器人与 60 GHz FMCW 雷达上的实验显示心率 MAE 由仅接近式传感的 5.26 bpm 降至 2.22 bpm,但仍不及协作静态传感的 1.66 bpm,且未报告显著性检验。

7月31日周五
  1. Failure-First ·

    RS-Diffuser:面向离线强化学习的风险敏感扩散规划

    RS-Diffuser 将扩散规划器与分布式价值评论家结合,通过调整推理时的风险参数 α 即可切换规避、中性或寻求风险的轨迹,无需重新训练。该方法用分位数回归估计回报分布并做蒙特卡洛监督以避免 bootstrap 不稳定,在两个基准上验证尾部风险场景下的表现。 RS-Diffuser 由三部分构成:仅建模状态演化的扩散规划器负责预测未来状态轨迹,逆动力学模型将状态转移解码为动作以保证稳定恢复,蒙特卡洛分布式评论家用 Quantile Huber Loss 拟合完整回报分布。其引导目标基于分位数的索引集定义两种风险偏好——CVaR 式的下尾目标最大化最差结果的均值,上尾目标则鼓励高方差高回报路径。

7月5日周日
  1. arXiv ·

    基于搜索增强 LLM 的中文新词毒性共识检测框架 SeTox

    针对"country girl"等表面无害、却在公众共识中演变为毒性用法的新词,研究者提出分类体系与风险词表,并构建搜索增强框架 SeTox,让静态大语言模型接入实时网络语境来检测新词毒性。实验显示,SeTox 即使使用 3B 规模模型也优于近期大规模模型,表明其可扩展地引入现实世界知识完成毒性新词检测。该工作发表于 ACL 2026。

6月19日周五
6月17日周三
  1. arXiv ·

    SciRisk-Bench:面向 AI4Science 安全的风险维度感知基准

    作者提出 SciRisk-Bench,一个从显式风险维度和科学学科两个角度评测 AI4Science 安全的基准,覆盖 7 个学科、31 个子学科和 10 个风险维度。研究指出,现有 AI4Science 安全数据集虽覆盖若干学科和任务形式,但底层风险维度界定不足。实验部分对主流 LLM 和面向科学的 LLM 按风险维度、学科和子学科进行评测,用于细粒度诊断科学模型在哪些方面仍不安全。论文编号 arXiv:2606.18936,属 cs.AI 与 cs.CY 方向。

6月4日周四
5月28日周四
  1. MITRE ATLAS 数据发布 ·

    MITRE ATLAS 发布 v2026.05:知识与数据格式拆分版本号并引入 v6.0.0 格式

    MITRE ATLAS 从本次发布开始将知识库内容与数据格式分开管理版本:月度内容更新改用 YYYY.MM.N 方案并把版本存入 Collection 对象,格式变更则沿用语义化版本。此次内容版 v2026.05 给所有技术条目补充了一个或多个运行平台字段(预测式 AI、生成式 AI、智能体 AI、企业);同时推出的格式 v6.0.0 新增 ATLAS YAML 结构,提供 Pydantic schema 校验、SQLAlchemy ORM 持久化和 FastAPI REST API,并将历史版本迁移保存于 dist/legacy/ 与 dist/v6/。

5月11日周一
4月30日周四
  1. Google DeepMind ·

    Google DeepMind 启动 AI co-clinician 医疗研究计划

    Google DeepMind 发起 AI co-clinician 研究计划,探索 AI 作为临床团队成员在医生监督下协助患者诊疗。该系统基于 Gemini 与 Project Astra 的多模态实时音视频能力模拟远程医疗通话,并在盲评中优于主流证据合成工具——98 个初级保健查询中有 97 个无严重错误,开放式用药问答表现超过现有前沿模型。

4月23日周四
  1. Goodfire Research ·

    Goodfire 用自校正搜索加速材料发现,将扩散模型的候选材料产出提升约 30%

    Goodfire 与 Radical AI 合作,通过给扩散模型加入基于其内部表征的反馈回路实现自校正搜索,使目标范围内可用候选材料的生成量提高约 30%。该方法针对 MatterGen 的条件生成流程改进逆设计环节,衡量指标为同时满足稳定、独特和新颖三个约束的 SUN 标准。现有基线中仅 15% 的 MatterGen 采样落在 4–6 eV 带隙目标区间内,若再叠加 SUN 过滤则降至 6.5%,且仅有约 10% 的微调候选能通过全部筛选阶段。该技术原则上适用于任意扩散模型,有望推广到蛋白质设计与药物发现等领域。

4月16日周四
  1. Goodfire Research ·

    Goodfire 提出协方差池化 Covariance Pooling,替代基因组基础模型的均值池化

    Goodfire 提出基于二阶矩截断的协方差池化(covariance pooling),作为基因组基础模型中序列聚合的新基线,并在 NTv3 上的 Gene Ontology 预测与基因组轨迹预测中显著优于均值池化。该方法计算 token 激活的二阶矩而非一阶矩,保留了均值丢弃的特征联合激活结构,刻画逐 token 嵌入云团的形状而不只是质心,且无需标签或额外架构选择。通过重建二阶矩学习低秩分解,可将长激活序列压缩为固定大小的紧凑嵌入,既可用于无监督嵌入学习,也可端到端接入有监督探针或其混合方式。

  2. Google DeepMind ·

    Gemini 3.1 Flash TTS 发布:支持音频标签的可控语音生成

    Google DeepMind 推出 Gemini 3.1 Flash TTS,一款支持音频标签(audio tags)的文本转语音模型,可通过自然语言指令控制语音风格、语速与表达方式。该模型在 Artificial Analysis TTS 排行榜上取得 1,211 Elo 分数,支持 70 多种语言和原生多说话人对话,并已通过 Gemini API、Google AI Studio、Vertex AI 和 Workspace 的 Google Vids 逐步开放预览。所有生成音频均嵌入 SynthID 水印以支持 AI 内容检测。

3月24日周二
  1. The EU AI Act Newsletter ·

    EU AI Act 简化之争:欧洲议会与欧盟理事会就高风险系统规则延期展开角力

    欧洲议会议员以 101 票赞成、9 票反对、8 票弃权通过联合立场,主张推迟部分高风险 AI 系统规则的适用,并提议将固定生效日期定为高风险系统 2027 年 12 月 2 日、受欧盟部门安全立法覆盖的系统 2028 年 8 月 2 日,水印合规延长则缩短至 2026 年 11 月 2 日。欧盟理事会随后也达成一致立场,基本维持欧委会提案主旨,同样引入上述两个固定适用日期,并将 AI 监管沙盒的建设推迟至 2027 年 12 月 2 日。 两方均禁止未经同意生成亲密内容的 AI 行为及儿童性虐待材料,其中议会还新增了对无有效保障措施的“脱衣”(nudifier)系统的禁令。

11月23日周日
  1. 安远AI(中文站) ·

    安远AI加入Partnership on AI,携手全球伙伴共筑负责任AI未来

    安远AI于今年10月正式加入人工智能伙伴关系(Partnership on AI,PAI),与魁北克人工智能研究所(Mila)、韩国人工智能安全研究所(Korean AISI)、Resaro等十家机构共同入选。PAI是由学术界、民间社团、行业和媒体组成的非营利合作网络,合作伙伴已覆盖17个国家/地区的140余家机构。安远AI创始人兼首席执行官谢旻希表示,加入PAI将增强其在促进协作与创新解决方案方面的承诺,并借助PAI全球社区扩大影响力、推动共识。

11月10日周一
  1. 腾讯玄武实验室 ·

    腾讯玄武实验室 AI 引擎发现 gnark 零知识证明库高危漏洞 CVE-2025-57801

    2025 年 8 月,腾讯玄武实验室的阿图因自动化漏洞挖掘引擎在零知识证明库 gnark 中发现高危签名可锻造性漏洞 CVE-2025-57801,CVSS 评分 8.6,随后联合上海交通大学 GOSSIP 实验室及郁昱教授团队完成复现。该漏洞位于 gnark 用于在电路中验证 EdDSA/ECDSA 签名的 Native Verification 模块,攻击者可基于真实交易构造内容相同但签名不同的伪造交易,使其被判定有效并反复执行,最终可能导致受害者账户发生非预期资产转移。gnark 由 ConsenSys 于 2020 年推出,被 Linea zkEVM、Worldcoin、BNB Chain 等项目采用。

9月17日周三
8月17日周三
  1. Nicholas Carlini Writing ·

    Nicholas Carlini 回顾《Towards Evaluating the Robustness of Neural Networks》五年后的反思

    Nicholas Carlini 撰文回顾其五年前与他人合著的对抗样本论文《Towards Evaluating the Robustness of Neural Networks》,总结该工作做对了什么以及存在的问题。他认为这篇论文最正确的核心主张是用基于梯度下降的攻击来评估神经网络鲁棒性——当时学界流行的是定制化启发式攻击,难以迁移到带防御模型的评估中。

6月15日周六
  1. Nicholas Carlini Writing ·

    Nicholas Carlini 发布 arXiv 对抗样本论文完整列表

    Nicholas Carlini 整理并公开了一份自动更新的 arXiv 对抗样本论文完整列表,涵盖每年大量新增的相关工作,并提供 TXT、含摘要版 TXT 及 JSON 三种下载格式。该列表收录标准仅为论文主要以对抗样本为主题或在研究中广泛使用对抗样本,未经质量筛选,因此可能包含误收条目。由于更新自动化程度较高,最新几条尚未人工过滤的记录会附带分类器预测概率,其中部分标注低至 1%。

已经到底了