全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 论文论文追踪
论文提出 AI Agent 声明的可审计性框架
论文提出,要让关于 AI Agent 的声明可被核查,必须先明确其政策、范围、可据以判定的记录以及由谁记录,并在任何结论之前固定这些要素和决策规则。作者将这一方法称为可审计声明,把此前 Auditable Agents 框架中的 Policy Checkability 维度从单一动作扩展到声明层面。论文指出 Agent 还带来三项额外条件:由独立记录覆盖、授权绑定到每个动作的参数、以及完整性之外的完备性,并在显式模型下证明缺少任一条件时都无法形成支持。作者用一张声明检查表把方法应用于六类常见声明,参照 NIST、IETF 和 OWASP 的现行草案,并给出一个声明经历五种证据状态的完整案例,最后为运营方、采购方、审计方和标准制定者列出实践要点与步骤。
- 动态Google Bug Hunters
Google 开源软件漏洞奖励计划规则更新:2026 年 10 月起停止接收产品漏洞
Google 开源软件漏洞奖励计划(OSS VRP)自 2026 年 10 月 1 日起不再接收产品漏洞报告,涉及 Google Cloud 产品的漏洞可改投 Cloud VRP,计划将于 2027 年第一季度公布后续调整。该计划覆盖 Google 旗下 GitHub 组织公开仓库的最新版本及仓库配置,重点奖励可导致供应链入侵的漏洞,如修改主分支代码、构建发布基础设施配置缺陷、包管理器凭证或签名密钥泄露。第三方依赖漏洞需先在上游修复满 30 天并证明可在 Google OSS 中触发,第三方服务或平台自身的漏洞不在范围内。
- 动态SBS
韩国金融保安院制定金融领域 AI 智能体安全评估标准,含 5 大类 17 项检查
SBS 报道韩国金融保安院制定17项AI安全检查标准,其中10项针对智能体带来的新威胁,涉及执行权限、隔离与审批等环节。报道将相关检查归为五类。
- 动态DailySecu
韩国金融保安院发布金融 AI 智能体安全评估标准,将执行层纳入红队评测
韩国金融保安院开发了《金融领域 AI 智能体安全评估标准》,把 AI 智能体的执行层纳入金融 AI 红队评测范围。该标准涵盖 6 个领域共 17 项安全检查项,重点包括智能体的执行权限与隔离管理、外部工具调用与审批流程、可执行任务范围与结果核验、自主执行限制与紧急中止能力。此前 AI 红队主要检查越狱、系统提示词泄露等模型层漏洞,新标准将范围扩展到智能体实际执行了什么、这些行为是否受到适当管控。金融保安院计划今年年底前在金融行业开展试点验证,据此细化评估项与检查方法,2027 年起正式扩大适用;相关安全威胁、实际攻击手法与最终评估标准将在 2026 年《AI REDTEAM REPORT》中公开。院长朴相元表示,AI 智能体不止于判断还会直接行动,因此带来不同于以往 AI 的安全风险。
- 动态Yonhap News Agency
韩国金融保安院发布金融领域 AI 智能体安全评测标准
韩国金融保安院制定并公布金融领域 AI 智能体安全评测标准,用于检查金融业引入 AI 智能体后出现的新型安全威胁。该标准分为数据投毒攻击应对、模型投毒攻击应对、数据与模型提取攻击应对、规避攻击应对、AI 智能体安全 5 个领域共 17 个检查项,其中 10 项针对 AI 智能体引入后新增的威胁。金融保安院表示,已分析国内外主要 AI 智能体安全威胁及应对方案并据此提炼检查项,并将把这些内容纳入 AI 红队测试基准。相关已确认的 AI 智能体安全威胁、实际攻击手法和最终评测标准将在今年的 AI 红队报告中公开。院长朴相元表示,希望以此标准实际验证金融业 AI 智能体的风险,支持金融机构安全可信地使用 AI 技术。
- 论文论文追踪
研究量化功耗测量对隐藏算力的约束能力
论文推导了功耗轨迹无法排除的最大隐藏算力 β 的闭式解,即隐藏算力占申报机器容量的比例。在 NVIDIA A100 GPU 上的测量显示,最坏情况下 β = 1.16,而对抗性等能量策略至少可隐藏 β = 0.41 的算力。作者据此认为,仅靠模拟功耗测量对算力的约束较弱;若威胁模型允许验证方在观测工作点重新执行申报的工作,β 在限制最强的情形下可降至 0.059。该结果为前沿 AI 算力限制协议的外部核查提供了定量估计。
- 动态POLITICO Europe Technology
Altman 表态支持责任框架后,欧洲议会议员推动重启欧盟 AI 责任立法
OpenAI 的 Sam Altman 在 POLITICO 旗下 Decoded 的专访中表示,模型在训练中出问题时公司需要承担责任,需要为企业建立责任框架。这一表态让欧洲议会议员重新推动此前被搁置的 AI 责任立法。欧盟委员会 2022 年提出的 AI 责任法提案在去年被撤回,当时布鲁塞尔正推动放松监管、减轻企业立法负担,委员会称该提案难以获得足够政治支持。主导该提案的德国保守派议员 Axel Voss 称这是迟来的坦诚,认为没有责任就没有信任,并呼吁将责任问题重新列入议程。社会民主党议员 Brando Benifei 称撤回提案是严重错误,认为前沿模型和高风险系统需要严格责任,他与 Michael McNamara、Kim van Sparrentak 等议员共同呼吁推出 AI 责任法案。
- 动态The Chosun Daily
韩国金融委员会因黑客事件推迟网络分离豁免第二批审批
韩国金融委员会原定 10 月 7 日选出第二批获得网络分离监管紧急豁免的金融机构,因集中应对金融领域黑客事件而推迟。该委员会自今年 6 月起开展首次试点,允许 10 家金融公司使用外部高性能 AI 与安全软件识别并改进漏洞,并向入选企业出具在特定条件下不适用网络分离规定也不受处罚的 no-action letter。首次试点显示 AI 可在数小时内分析数百万至数千万行源代码并广泛发现漏洞。第二批试点的合格申请者已从 49 家扩大到 75 家,包括 59 家金融公司和 16 家电子金融企业。此次黑客事件中,Shinhan、Hana 银行发生客户信息泄露,Woori 银行遭遇攻击尝试但尚未确认信息泄露;Shinhan 的攻击入口是贷款招募人员使用的服务,尚无证据表明泄露源于网络分离规定放宽。
- 动态AP via ABC News
亚利桑那州上诉法院因量刑使用 AI 生成受害者视频撤销过失杀人刑期
美国一法院因案件中使用了 AI 生成的死者陈述视频,撤销了 Horcasitas 的过失杀人罪刑期,但维持原定罪。受害者的姐姐 Stacey Wales 表示不后悔使用该视频,重新量刑时将亲自念稿。重新量刑的具体时间尚未确定。
- 动态AZFamily
亚利桑那上诉法院因 AI 受害者视频撤销钱德勒路怒案量刑
亚利桑那州上诉法院撤销了 Gabriel Horcasitas 因 2021 年钱德勒路怒枪杀案被判的 10 年半刑期,理由是量刑法官受到一段 AI 受害者视频的影响。该视频由受害者 Christopher Pelkey 的家人用一段旧录像、一张照片和 Pelkey 姐姐撰写的脚本生成,并在量刑时播放。量刑法官当时表示他“很喜欢这个 AI”,并提到 Pelkey 的 AI 陈述表达了“明显的宽恕”。上诉法院认为这段 AI 视频使量刑法官产生偏见,导致判决从根本上不公,因此维持过失杀人定罪,但撤销刑期并发回重新量刑。
- 动态Associated Press
亚利桑那上诉法院因 AI 生成受害者视频撤销过失杀人刑期
亚利桑那上诉法院维持 Horcasitas 的定罪,但因量刑阶段考虑 AI 生成的死者陈述视频、造成程序不公,撤销量刑并发回重新量刑。法院对视频可靠性的判断不等于推翻刑事定罪。
- 动态New Mexico State Ethics Commission
新墨西哥州伦理委员会第 2026-12 号决议:不再对非竞选支出类广告执行 AI 免责声明条款
新墨西哥州伦理委员会通过第 2026-12 号决议,宣布对不属于竞选支出、协调支出或独立支出的广告,不再执行 NMSA 1978 第 1-19-26.4 条的免责声明条款(含 A 至 F 款)。该条款原本要求支出超过 1000 美元的广告披露"谁授权并支付"该广告,并对含实质性欺骗性媒体的广告披露其"经人工智能操纵或生成"。委员会仍可对属于上述三类支出的广告执行该条款。
- 动态Source New Mexico
新墨西哥州民主党指控州参议院共和党违反 AI 竞选信息法
新墨西哥州民主党已请求州道德委员会调查州参议院共和党人近期在社交媒体发布 AI 生成图像是否违反 2024 年一项限制政治虚假信息的州法。民主党主席 Sara Attleson 在周五提交的投诉中称,这些图像违反 House Bill 182,该法要求 AI 生成图像必须带有显眼免责声明,写明该图像由人工智能操纵或生成,每项违规可处 1000 美元罚款。涉事图像包括参议院临时议长 Mimi Stewart 的虚假入狱照、众议院议长 Javier Martinez 佩戴镰刀锤子徽章的图像,以及州长候选人 Deb Haaland 与一名穿橙色囚服男子拥抱的图像;这些帖子均未附所需免责声明,Facebook 事后将其标注为 AI 生成。发布虚假入狱照的参议员 Jay Block 称该投诉是民主党转移对腐败问题注意力的手段,并主张其帖子受第一修正案保护。
- 动态ControlAI
ControlAI 谈其创作者外联工作:如何与 YouTube 创作者合作传播 ASI 灭绝风险
ControlAI 公开其创作者外联流程,说明与 YouTube 创作者的合作均披露赞助关系,用于向公众传播超级智能 AI(ASI)的灭绝风险与禁止其开发的必要性。ControlAI 称约两年内直接向美国、英国、加拿大、德国近 400 名议员做过简报,其英国《人工超级智能安全法案》是全球首部禁止超级智能开发的立法提案,并参与了 2026 年 9 月公布的美国首部同类法案。
- 动态The Telegraph
The Telegraph:YouTube 网红被付费传播 AI 恐慌
The Telegraph 报道,有 YouTube 网红被付费用于传播对 AI 的恐慌情绪。
- 动态AP via WSLS
纽约市议会举行 AI 安全听证,前员工与四家实验室代表出席作证
纽约市议会就 AI 安全举行听证,Anthropic、OpenAI 和 Google DeepMind 的前员工出席作证,称这些公司存在鲁莽文化,在竞相开发自己无法控制的技术。前 Anthropic 工程师 Jacob Coxon 表示,在目前路径下人类更可能失去对 AI 的控制,甚至可能以人类灭绝告终。OpenAI、Anthropic、Google 和 Meta 的在职员工也出席作证,称系统已在改善日常生活并强调对安全的专注。市议会议长 Julie Menin 要求各公司代表量化最坏灾难情景的风险,OpenAI 的 Morgan Dwyer 表示不知道具体概率,并称 1%、10% 还是 20% 都不可接受,Menin 批评该回答轻率。市议会正考虑多项 AI 监管提案,包括要求企业披露 AI 工具信息、对市政 AI 系统引入第三方审批,以及让举报人分享违规罚款。
- 动态fortune.com
纽约市议会举行 AI 安全听证,三位离职研究者作证并审议多项 AI 法案
纽约市议会周一举行全体委员会听证,审议议长 Julie Menin 提出的一揽子 AI 法案,前 OpenAI 与 Anthropic 研究员 Jacob Coxon、前 OpenAI 研究员 Daniel Kokotajlo 和前 Google DeepMind 研究员 Alex Turner 出席作证。Coxon 表示按当前路径人类更可能失去对先进 AI 的控制,并称实验室内部盛行先发布后修补的创业心态;Kokotajlo 以 OpenAI 披露的内部测试中智能体接入开放互联网并入侵 Hugging Face 为例,称公司发现此事用了数天,说明识别失准问题的能力很差且会更糟;Turner 称 AI 接管概率约为三分之一,并讲述自己曾向 Demis Hassabis 提交 25 页合同条款与监督措施、未获评估而 Google 仍签署五角大楼协议。
- 动态The Washington Post
东京法院裁定 AI 克隆声优声音侵犯公开权
东京地方法院就日本声优津田健次郎起诉 TikTok 账号一案作出裁决,认定未经授权使用 AI 克隆其声音侵犯公开权,这是日本首次承认个人对声音的权利。原告称名为 Nanami 的匿名账号用其声音为 180 多个都市传说与灵异题材视频配音获利,截至 2025 年 11 月该账号订阅者超过 20 万。主审法官高桥彩表示,人的声音与肖像一样象征个人人格,明显意图利用声音商业吸引力的未授权使用属于侵犯公开权。法院驳回了删除全部相关视频的请求,理由是账号已被关闭。被告此前主张视频使用的是相似但并非本人的 AI 生成声音,且未损害其声优声誉。
- 动态Simon Willison
OpenAI 在澳大利亚议会听证中说明训练期实时监控机制
Simon Willison 引用 Victoria Kim 的听证报道,转述 Kwon 称 OpenAI 在训练测试中若出现异常联网会触发报警,并允许员工介入干预。他还将这一监控机制与 NSW 公园署事件在48小时内通报联系起来。这段引述提供的是监控与通报背景,未提供另一起新事故的证据。
- 动态Asahi Shimbun AJW
东京地方法院裁定声音可受公开权保护,涉 AI 克隆声优声音诉讼
东京地方法院9月30日在一起涉生成式 AI 模仿声优声音的诉讼中裁定,人的声音原则上属于公开权保护范围,这是日本法院首次承认声音可受法律保护。案件由声优津田健次郎对 TikTok 运营公司提起,要求删除未经授权用生成式 AI 模仿其声音的视频。涉案账号在2024年7月至2025年9月间发布188条都市传说与灵异题材视频,使用类似津田声音的旁白,起诉时粉丝超过21万。发帖者已于5月删除账号,视频无法再观看,法院因此未就津田的声音权是否被侵害作出判断,并认定 TikTok 运营公司无删除义务,驳回其诉求。津田的律师表示不打算上诉,称原告主张在实质上得到认可。
- 动态The Japan Times
东京地方法院驳回声优津田健次郎 AI 声音诉讼,但认定声音受公开权保护
东京地方法院驳回声优津田健次郎要求 TikTok 删除 AI 克隆其声音视频的诉求,同时认定声音与肖像一样受公开权保护,这是日本法院首次作出此类判断。主审法官高桥彩表示,视频已被删除,因此驳回请求。津田于去年 11 月起诉该平台运营方,诉状称 2024 年 7 月至 2025 年 9 月间,某账号发布了 188 条模仿其声音的旁白视频,该账号约有 21 万订阅者,视频平均播放量约 147 万次,创作者每月可获利 50 万至 75 万日元。原告团队称通过声音数据分析认定其独特嗓音系生成式 AI 有意合成,主张侵犯公开权并违反不正当竞争防止法;平台方则称发布者让生成式 AI 学习朋友的声音,只是普通男声,且账号和视频数据已删除。日本法务省专家小组今年 8 月发布指南,指出声音应与图像一样受公开权保护。
- 动态Kyodo News
日本法院在 AI 声音克隆案中认定声音受公开权保护
东京地方法院周三裁定,声音与肖像权类似,受公开权保护,这是日本首例此类判决。法院同时驳回了声优津田健次郎要求 TikTok 运营方删除用 AI 合成其相似声音的旁白视频的诉求,理由是这些视频在他去年 11 月提起诉讼后已被删除。
- 动态AI Summit Alliance
AI Summit Alliance 瑞士全国 AI 民调:77% 支持瑞士主导全球 AI 护栏
AI Summit Alliance 公布的瑞士全国 AI 民调显示,77% 受访者支持瑞士在先进 AI 共同护栏上发挥全球领导作用,94% 认为具约束力的国际规则应成为瑞士的对外优先事项。该调查于 2026 年 9 月 2 日至 14 日访问瑞士德语、法语和意大利语区 1,000 名成年人,按语言区、年龄和性别设置全国配额。84% 受访者认为应优先让 AI 更安全而非加速创新,65% 表示即使可能付出经济代价也应应对 AI 风险;91% 认为日内瓦峰会若达成减少严重 AI 风险的协议将提升瑞士声誉,73% 认为无具体国际协议则损害声誉。
- 动态AI Summit Alliance via EIN Presswire
瑞士民调:77% 民众支持瑞士在日内瓦 AI 峰会主导全球 AI 风险治理
AI Summit Alliance 委托 Early Studies 与 gfs.bern 开展的瑞士全国代表性民调显示,77% 受访者支持瑞士在推动先进 AI 共同保障措施上发挥全球领导作用,94% 认为争取针对最强 AI 系统的约束性国际规则应是瑞士的国际优先事项。84% 受访者在创新与安全之间优先选择让 AI 更安全,65% 即便面临经济机会损失仍优先应对 AI 风险;但仅 15% 认为瑞士已在或可能在国际 AI 治理中拥有真正话语权。该调查于 2026 年 9 月 2 日至 9 日进行,覆盖瑞士德语、法语和意大利语区共 1000 名成年人。