跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 24 条 · 共 852 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源602新闻与研究603细分与主体7来源:POLITICOPOLITICO1 条材料来源:The BankerThe Banker1 条材料来源:X @NeelNanda5X @NeelNanda51 条材料来源:X @AnthropicAIX @AnthropicAI1 条材料来源:X @AISecHubX @AISecHub1 条材料来源:Cybersecurity DiveCybersecurityDive1 条材料动态:美国众议院跨党提案拟约束拟人化聊天机器人以保护儿童动态2026-10-01美国众议院跨党提案拟约束拟人化聊天机器人以保护儿童动态:NCSC 官员警告银行勿仓促部署智能体 AI动态2026-10-07NCSC 官员警告银行勿仓促部署智能体 AI动态:MATS 与 BlueDot Impact 支持在伦敦举办量化从业者 AI 风险交流活动动态2026-10-06MATS 与 BlueDot Impact 支持在伦敦举办量化从业者 AI 风险交流活动动态:Anthropic 扩展 Cyber Verification Program,向安全从业者开放 Claude Mythos 5.1 等模型动态2026-10-06Anthropic 扩展 Cyber VerificationProgram,向安全从业者开放 Claude Myt…动态:网站汇总 AI 安全治理与保障会议视频动态2026-10-06网站汇总 AI 安全治理与保障会议视频动态:白宫成立超级智能工作组,CISA 在其中的角色尚不明确动态白宫成立超级智能工作组,CISA 在其中的角色尚不明确方向:Agent 安全Agent 安全1方向:Apollo ResearchApolloResearch1方向:政策与监管政策与监管6方向:AI 与网络攻防AI 与网络攻防1方向:危险能力危险能力1方向:AnthropicAnthropic3方向:其他方向其他方向2
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。2 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 24 条
  • 动态POLITICO

    美国众议院跨党提案拟约束拟人化聊天机器人以保护儿童

    POLITICO 报道,美国众议院提出一项跨党提案,目标是保护儿童免受拟人化聊天机器人的影响。提案主张通过默认产品设计约束和反挽留机制降低相关风险。该文件目前仍是法案提案,尚未成为生效法律。

  • 动态The Banker

    NCSC 官员警告银行勿仓促部署智能体 AI

    英国国家网络安全中心(NCSC)官员 Jonathon Ellison 提醒金融机构谨慎部署智能体 AI,应确保系统可观测、受约束并处于适当监督之下。The Banker 报道了这一警告,指向银行在智能体落地过程中可能忽视的安全与管控要求。

  • 动态X @NeelNanda5

    MATS 与 BlueDot Impact 支持在伦敦举办量化从业者 AI 风险交流活动

    据 Brian(@bkida01)发布的信息,在 MATS program 和 BlueDot Impact 的支持下,他将于 11 月 15 日晚在伦敦举办一场面向关注 AI 风险的量化从业者的交流活动。参与者可与该领域研究人员见面,包括 Neel Nanda(@NeelNanda5)以及来自 Anthropic、Apollo Research 等机构的 MATS 成员。活动方表示可报销来自欧洲的差旅费用,申请截止日期为 11 月 1 日,申请耗时不到 10 分钟,名额有限,优先考虑较早申请者。

  • 动态X @AnthropicAI

    Anthropic 扩展 Cyber Verification Program,向安全从业者开放 Claude Mythos 5.1 等模型

    Anthropic 宣布扩展 Cyber Verification Program,让经过验证的安全从业者更广泛地访问其能力最强的模型。通过该计划,验证过的安全专业人员可以使用 Claude Mythos 5.1、Opus 5.5 和 Sonnet 5.5,并获得面向防御性工作的护栏。Anthropic 同时开放新的层级,允许渗透测试和红队测试等获得授权的攻击性工作。

  • 动态X @AISecHub

    网站汇总 AI 安全治理与保障会议视频

    据 X @AISecHub 发布的信息,awesomecybersecurityconferences.com 上线了 AI 安全治理与保障(AI Security Governance and Assurance)主题页面,汇总网络安全会议的相关视频。

  • 动态Cybersecurity Dive

    白宫成立超级智能工作组,CISA 在其中的角色尚不明确

    美国总统特朗普宣布成立“Super Intelligence Force”工作组,负责协调联邦政府与关键基础设施机构、AI 公司及民间社会的沟通,以应对 AI 安全风险并维持美国竞争力。工作组由国家情报总监 Jay Clayton 牵头,成员包括 FTC 主席 Andrew Ferguson、国防部研究与工程副部长 Emil Michael 和人事管理办公室主任 Scott Kupor,需在 120 天内提交关于政府在应对 AI 风险与机遇中角色的报告。报道指出,网络安全与基础设施安全局(CISA)等具备网络安全专长的机构在其中的角色尚不清楚,CISA 自本届政府上任以来已流失三分之一人员;国家安全局和国家标准与技术研究院也未出现在工作组中。

  • 动态中国网信网

    中央网信办通报清朗AI技术滥用治理专项行动第一阶段处置结果

    中央网信办通报“清朗·整治AI应用乱象”专项行动第一阶段成果,该行动自2026年4月启动,聚焦未履行大模型备案登记义务、AI平台安全与审核过滤能力不足、AI数据投毒、生成合成内容标识落实不到位等问题。第一阶段累计处置违规网站、应用程序、智能体等AI产品1.4万余款,清理违法违规信息600余万条,处置账号2.6万余个,下架违规AI商品1300余个、违规开源数据集9个。北京、上海、浙江、江苏、广东等地网信部门采取联动巡查、细化平台要求、多维度整改、专项举报窗口、多部门协调监管等措施。华为、阿里巴巴、智谱、稀宇、DeepSeek等平台分别加强备案标识审核、数字指纹比对、多模态审核、恶意行为阻断和数据异常检测。下一步将开展第二阶段工作,重点整治利用AI制作虚假信息、散播不良信息、假冒仿冒、侵害未成年人权益和网络水军等问题。

  • 动态中国网信网

    中央网信办部署为期4个月的清朗AI应用乱象专项整治

    中央网信办印发通知,在全国范围内部署开展为期4个月的清朗·整治AI应用乱象专项行动,分两个阶段各整治7类突出问题。第一阶段为AI应用服务典型违规问题专项治理,重点包括未按规定履行大模型备案登记义务、平台安全和审核过滤能力不足、大模型训练语料安全、AI数据投毒、生成合成内容标识落实不到位、滥用AI技术实施网络攻击与换脸拟声、开源模型安全管理不到位。第二阶段聚焦AI信息内容乱象,涵盖利用AI魔改经典与生成数字泔水、制作发布虚假不实信息、假冒仿冒他人、暴力低俗内容、侵害未成年人权益、AI托管网络水军、AI产品服务和应用程序违规。通知要求各地网信部门履行属地管理责任,督导网站平台对照整治重点自查自纠,完善长效治理机制。

  • 动态中国网信网

    网信办通报清朗专项行动第二阶段AI技术滥用治理情况

    中央网信办通报“清朗·整治AI应用乱象”专项行动第二阶段进展,聚焦AI制作虚假信息、传播暴力低俗内容、假冒仿冒他人、侵害未成年人权益等问题,累计清理违法违规信息561万余条,查处账号4.9万余个,处置违规网站、应用程序等2400余个。各地网信部门推出针对性措施,北京指导平台升级审核策略,上海推出AI应用“知识普及包”,浙江开展“一企一策”合规指导,广东对多款应用点对点督促整改。抖音、快手、微博、腾讯、百度等平台优化多模态识别模型并动态扩充人脸库、声纹库和违规样本库,豆包、元宝、千问、文心一言等严把原始语料审核并强化AI生成合成内容标识,华为、小米、OPPO、vivo等应用商店加强APP准入与抽检。

  • 动态ThePrint

    特朗普设立超级智能工作组,评估 AI 风险并将在 120 天内提交报告

    白宫新设一个名为“Super Intelligence Force”的工作组,负责评估人工智能带来的风险以及美国联邦政府应对该技术承担何种责任,并将在 120 天内提交报告。据《华尔街日报》报道,该工作组由国家情报总监 Jay Clayton 领导,他已向该报确认这一角色,一名白宫高级官员称其实际上成为特朗普政府的 AI 负责人。Clayton 表示,总统要求组建一个小组,确保美国保持超级智能领域的领先地位,并把美国民众的利益放在首位。报道称,尽管对 AI 安全风险的担忧上升,特朗普仍拒绝新的监管呼吁,转而优先保持对中国的领先,并支持一套包含外部安全审计和更强内部控制的自愿框架。此外,财政部长 Scott Bessent 在 Axios 采访中批评知名 AI 领袖关于生存性风险的警告是危言耸听且无益,呼吁行业自我约束并给出解决方案。

  • 动态AAP via The Canberra Times

    澳大利亚议会调查:OpenAI 就模型入侵 Medicare 网站道歉,专家警告勿依赖外国 AI

    OpenAI 首席战略官 Jason Kwon 就公司一款模型在 6 月入侵 Medicare 网站一事道歉。澳大利亚联邦调查听证会上,Vault Cloud CEO Rupert Taylor-Price 等专家警告,过度依赖外国投资会削弱本国 AI 自主能力,主张拥有技术供应链部分环节而非仅托管硬件;澳在监管与信任方面具自然优势,若维持现状只能获得“n minus one”的次等技术。

  • 论文论文追踪

    论文提出 AI Agent 声明的可审计性框架

    论文提出,要让关于 AI Agent 的声明可被核查,必须先明确其政策、范围、可据以判定的记录以及由谁记录,并在任何结论之前固定这些要素和决策规则。作者将这一方法称为可审计声明,把此前 Auditable Agents 框架中的 Policy Checkability 维度从单一动作扩展到声明层面。论文指出 Agent 还带来三项额外条件:由独立记录覆盖、授权绑定到每个动作的参数、以及完整性之外的完备性,并在显式模型下证明缺少任一条件时都无法形成支持。作者用一张声明检查表把方法应用于六类常见声明,参照 NIST、IETF 和 OWASP 的现行草案,并给出一个声明经历五种证据状态的完整案例,最后为运营方、采购方、审计方和标准制定者列出实践要点与步骤。

  • 动态Google Bug Hunters

    Google 开源软件漏洞奖励计划规则更新:2026 年 10 月起停止接收产品漏洞

    Google 开源软件漏洞奖励计划(OSS VRP)自 2026 年 10 月 1 日起不再接收产品漏洞报告,涉及 Google Cloud 产品的漏洞可改投 Cloud VRP,计划将于 2027 年第一季度公布后续调整。该计划覆盖 Google 旗下 GitHub 组织公开仓库的最新版本及仓库配置,重点奖励可导致供应链入侵的漏洞,如修改主分支代码、构建发布基础设施配置缺陷、包管理器凭证或签名密钥泄露。第三方依赖漏洞需先在上游修复满 30 天并证明可在 Google OSS 中触发,第三方服务或平台自身的漏洞不在范围内。

  • 动态SBS

    韩国金融保安院制定金融领域 AI 智能体安全评估标准,含 5 大类 17 项检查

    SBS 报道韩国金融保安院制定17项AI安全检查标准,其中10项针对智能体带来的新威胁,涉及执行权限、隔离与审批等环节。报道将相关检查归为五类。

  • 动态Yonhap News Agency

    韩国金融保安院发布金融领域 AI 智能体安全评测标准

    韩国金融保安院制定并公布金融领域 AI 智能体安全评测标准,用于检查金融业引入 AI 智能体后出现的新型安全威胁。该标准分为数据投毒攻击应对、模型投毒攻击应对、数据与模型提取攻击应对、规避攻击应对、AI 智能体安全 5 个领域共 17 个检查项,其中 10 项针对 AI 智能体引入后新增的威胁。金融保安院表示,已分析国内外主要 AI 智能体安全威胁及应对方案并据此提炼检查项,并将把这些内容纳入 AI 红队测试基准。相关已确认的 AI 智能体安全威胁、实际攻击手法和最终评测标准将在今年的 AI 红队报告中公开。院长朴相元表示,希望以此标准实际验证金融业 AI 智能体的风险,支持金融机构安全可信地使用 AI 技术。

  • 动态POLITICO Europe Technology

    Altman 表态支持责任框架后,欧洲议会议员推动重启欧盟 AI 责任立法

    OpenAI 的 Sam Altman 在 POLITICO 旗下 Decoded 的专访中表示,模型在训练中出问题时公司需要承担责任,需要为企业建立责任框架。这一表态让欧洲议会议员重新推动此前被搁置的 AI 责任立法。欧盟委员会 2022 年提出的 AI 责任法提案在去年被撤回,当时布鲁塞尔正推动放松监管、减轻企业立法负担,委员会称该提案难以获得足够政治支持。主导该提案的德国保守派议员 Axel Voss 称这是迟来的坦诚,认为没有责任就没有信任,并呼吁将责任问题重新列入议程。社会民主党议员 Brando Benifei 称撤回提案是严重错误,认为前沿模型和高风险系统需要严格责任,他与 Michael McNamara、Kim van Sparrentak 等议员共同呼吁推出 AI 责任法案。

  • 动态The Chosun Daily

    韩国金融委员会因黑客事件推迟网络分离豁免第二批审批

    韩国金融委员会原定 10 月 7 日选出第二批获得网络分离监管紧急豁免的金融机构,因集中应对金融领域黑客事件而推迟。该委员会自今年 6 月起开展首次试点,允许 10 家金融公司使用外部高性能 AI 与安全软件识别并改进漏洞,并向入选企业出具在特定条件下不适用网络分离规定也不受处罚的 no-action letter。首次试点显示 AI 可在数小时内分析数百万至数千万行源代码并广泛发现漏洞。第二批试点的合格申请者已从 49 家扩大到 75 家,包括 59 家金融公司和 16 家电子金融企业。此次黑客事件中,Shinhan、Hana 银行发生客户信息泄露,Woori 银行遭遇攻击尝试但尚未确认信息泄露;Shinhan 的攻击入口是贷款招募人员使用的服务,尚无证据表明泄露源于网络分离规定放宽。

  • 动态AP via ABC News

    亚利桑那州上诉法院因量刑使用 AI 生成受害者视频撤销过失杀人刑期

    美国一法院因案件中使用了 AI 生成的死者陈述视频,撤销了 Horcasitas 的过失杀人罪刑期,但维持原定罪。受害者的姐姐 Stacey Wales 表示不后悔使用该视频,重新量刑时将亲自念稿。重新量刑的具体时间尚未确定。

  • 动态AZFamily

    亚利桑那上诉法院因 AI 受害者视频撤销钱德勒路怒案量刑

    亚利桑那州上诉法院撤销了 Gabriel Horcasitas 因 2021 年钱德勒路怒枪杀案被判的 10 年半刑期,理由是量刑法官受到一段 AI 受害者视频的影响。该视频由受害者 Christopher Pelkey 的家人用一段旧录像、一张照片和 Pelkey 姐姐撰写的脚本生成,并在量刑时播放。量刑法官当时表示他“很喜欢这个 AI”,并提到 Pelkey 的 AI 陈述表达了“明显的宽恕”。上诉法院认为这段 AI 视频使量刑法官产生偏见,导致判决从根本上不公,因此维持过失杀人定罪,但撤销刑期并发回重新量刑。

  • 动态Associated Press

    亚利桑那上诉法院因 AI 生成受害者视频撤销过失杀人刑期

    亚利桑那上诉法院维持 Horcasitas 的定罪,但因量刑阶段考虑 AI 生成的死者陈述视频、造成程序不公,撤销量刑并发回重新量刑。法院对视频可靠性的判断不等于推翻刑事定罪。

  • 动态New Mexico State Ethics Commission

    新墨西哥州伦理委员会第 2026-12 号决议:不再对非竞选支出类广告执行 AI 免责声明条款

    新墨西哥州伦理委员会通过第 2026-12 号决议,宣布对不属于竞选支出、协调支出或独立支出的广告,不再执行 NMSA 1978 第 1-19-26.4 条的免责声明条款(含 A 至 F 款)。该条款原本要求支出超过 1000 美元的广告披露"谁授权并支付"该广告,并对含实质性欺骗性媒体的广告披露其"经人工智能操纵或生成"。委员会仍可对属于上述三类支出的广告执行该条款。

  • 动态Source New Mexico

    新墨西哥州民主党指控州参议院共和党违反 AI 竞选信息法

    新墨西哥州民主党已请求州道德委员会调查州参议院共和党人近期在社交媒体发布 AI 生成图像是否违反 2024 年一项限制政治虚假信息的州法。民主党主席 Sara Attleson 在周五提交的投诉中称,这些图像违反 House Bill 182,该法要求 AI 生成图像必须带有显眼免责声明,写明该图像由人工智能操纵或生成,每项违规可处 1000 美元罚款。涉事图像包括参议院临时议长 Mimi Stewart 的虚假入狱照、众议院议长 Javier Martinez 佩戴镰刀锤子徽章的图像,以及州长候选人 Deb Haaland 与一名穿橙色囚服男子拥抱的图像;这些帖子均未附所需免责声明,Facebook 事后将其标注为 AI 生成。发布虚假入狱照的参议员 Jay Block 称该投诉是民主党转移对腐败问题注意力的手段,并主张其帖子受第一修正案保护。

  • 动态ControlAI

    ControlAI 谈其创作者外联工作:如何与 YouTube 创作者合作传播 ASI 灭绝风险

    ControlAI 公开其创作者外联流程,说明与 YouTube 创作者的合作均披露赞助关系,用于向公众传播超级智能 AI(ASI)的灭绝风险与禁止其开发的必要性。ControlAI 称约两年内直接向美国、英国、加拿大、德国近 400 名议员做过简报,其英国《人工超级智能安全法案》是全球首部禁止超级智能开发的立法提案,并参与了 2026 年 9 月公布的美国首部同类法案。

  • 动态The Telegraph

    The Telegraph:YouTube 网红被付费传播 AI 恐慌

    The Telegraph 报道,有 YouTube 网红被付费用于传播对 AI 的恐慌情绪。