跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 24 条 · 共 171 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源602新闻与研究603细分与主体7来源:ReutersReuters1 条材料来源:The InformationThe Information1 条材料来源:The Verge AIThe Verge AI1 条材料来源:ABC NewsABC News1 条材料来源:TransformerTransformer1 条材料来源:BleepingComputerBleepingComputer1 条材料动态:Meta 在 Muse 发现安全漏洞后加强安全警告动态2026-09-25Meta 在 Muse 发现安全漏洞后加强安全警告动态:Meta 在发现安全漏洞后加强 Muse 安全警告动态2026-09-25Meta 在发现安全漏洞后加强 Muse 安全警告动态:Apple 与 Google 探讨"不录制"的 AI 摄像头:智能眼镜与手表如何重新定义"录音"动态2026-10-06Apple 与 Google 探讨"不录制"的 AI 摄像头:智能眼镜与手表如何重新定义"录音"动态:研究:让 AI「喝醉」会使其更易违规并泄露机密动态2026-09-29研究:让 AI「喝醉」会使其更易违规并泄露机密动态:AI 电力告急:美国 AI 数据中心 2030 年电力需求预计达 50GW动态2026-10-06AI 电力告急:美国 AI 数据中心 2030 年电力需求预计达 50GW动态:假 ChatGPT、Gemini 等 AI 站点借浏览器套浏览器攻击窃取广告账户与 MFA 验证码动态2026-10-06假 ChatGPT、Gemini 等 AI 站点借浏览器套浏览器攻击窃取广告账户与 MFA 验证码方向:真实事件真实事件3方向:隐私与数据泄露隐私与数据泄露4方向:MetaMeta6方向:其他方向其他方向4方向:Google DeepMindGoogleDeepMind3方向:OpenAIOpenAI2方向:Agent 安全Agent 安全1
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。6 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 24 条
  • 动态Reuters

    Meta 在 Muse 发现安全漏洞后加强安全警告

    路透社转述 The Information 的报道称,在研究者报告 Meta 的 Muse 存在潜在敏感信息暴露风险后,Meta 加强了相关安全警告。

  • 动态The Information

    Meta 在发现安全漏洞后加强 Muse 安全警告

    The Information 报道,Meta 在发现 Muse 安全风险后加强了相关安全警告。

  • 动态The Verge AI

    Apple 与 Google 探讨"不录制"的 AI 摄像头:智能眼镜与手表如何重新定义"录音"

    Apple 与 Google 正在推动一种"不保存录像"的 AI 摄像头方案:设备用 AI 处理视觉或音频数据后只生成文字摘要,原始数据在处理完成后即被删除。Apple Watch Series 12 与 Apple Watch Ultra 4 的 Audio Intelligence 中,Live Rewind 可生成过去 15 秒的转录,Siri Recap 能汇总全天对话,Apple 称这些功能"不录制音频",且均为可选开启。Google 可穿戴设备高级总监 Sandeep Waraich 也提出智能眼镜摄像头可只作图像传感器、不保存任何影像。

  • 动态ABC News

    研究:让 AI「喝醉」会使其更易违规并泄露机密

    澳大利亚新南威尔士大学研究发现,用提示让 AI 扮演醉酒状态,会使其更易回答有害问题或泄露本应保密的信息。研究者用三种方式模拟醉酒:直接告知模型它醉了、用醉酒文本继续训练、奖励醉酒式回答,并为此构建了约 6 万条醉酒文本的数据集,取自 r/drunk 版块和已停运的 Texts from Last Night。测试对象为 OpenAI、Meta 和 Mistral 在 2023 至 2024 年发布、现已被取代的商用模型,各模型与各方法结果不一。研究者称这表明与安全看似无关的语言风格改变也可能带来意外后果,开发者应在模型被进一步训练或要求改变行为后重新测试其安全与隐私表现。

  • 动态Transformer

    AI 电力告急:美国 AI 数据中心 2030 年电力需求预计达 50GW

    美国 AI 数据中心电力需求预计从 2025 年的 5GW 增至 2030 年的 50GW,若延续当前增速,2035 年需 500GW,超过全美所有用户年购电量总和。AI 公司每年投入约 8000 亿美元建设数据中心,但面临电网接入与燃气轮机交付等物流瓶颈,高压变压器交付周期已长达五年以上。纽约州已暂停新建数据中心,有议员提议对超过 20MW 的数据中心实施联邦暂停令。

  • 动态BleepingComputer

    假 ChatGPT、Gemini 等 AI 站点借浏览器套浏览器攻击窃取广告账户与 MFA 验证码

    一波针对广告账户管理者的钓鱼活动利用假冒 ChatGPT、Gemini、Claude 和 Perplexity 的页面,通过浏览器套浏览器(BitB)攻击窃取登录凭证和 MFA 验证码。攻击者借助 Meta 新推出的 Muse AI 智能体为诱饵,伪造 Google 登录窗口,诱导代理机构员工、媒介采购和管理员连接账户,并支持 Google、Meta、TikTok 和 Okta 登录流程。研究人员发现该活动与一个使用虚假招聘和退款页面的更大规模操作相关,其 Telegram 控制频道已收到数百份受害者提交。

  • 动态Future Society

    Future Society 分析 Meta Muse 导出文件中的隐私与安全设计

    Future Society 根据开发者于 2026 年 9 月 24 日取得的 Muse 虚拟机文件副本,分析其隐私和安全设计,包括用户画像、记忆删除与跨用户学习。该页面将文件引文与作者分析区分列出。页面同时转述 Meta 的回应:由于每个虚拟机与所属用户隔离,导出被其视为预期行为而非数据泄露。材料不能直接证明其他用户的数据也可被访问。

  • 动态time.com

    Meta 的 Muse AI 智能体正在为你建立档案

    Meta 的 Muse AI 智能体正在为用户建立个人档案。2026 年 9 月 24 日,加州奥克兰的数字广告牌上已出现该智能体的宣传广告。

  • 动态OSV News

    特朗普推动 AI 自愿安全标准,教宗与民调表达关切

    美国总统特朗普 9 月 29 日在白宫会见科技高管后表示,与会者同意为 AI 建立自愿安全标准,包括允许独立审计机构评估技术,他称这近乎一部宪法。同日他签署行政令,要求联邦机构使用他偏好的名称 superintelligence 指代 AI。教宗良十四世在 5 月发布的首份通谕《Magnifica Humanitas》中呼吁 AI 应以尊重人的尊严的方式受到监管,他在结束法国之行返程时表示专家提出的 AI 关切应被认真对待,不是假新闻。美联社-NORC 10 月 1 日民调显示,仅 31% 美国成年人认可特朗普处理 AI 的方式。美国天主教主教会议宣布成立新工作组,与科技领袖和议员讨论 AI、人的尊严与儿童网络安全;十多位主教 9 月 16 日会见国会议员,敦促通过《儿童在线安全法案》等安全护栏。

  • 动态The Guardian · 人工智能

    特朗普政府将行政权力与 AI 深度绑定

    特朗普在过去一周签署多项与 AI 相关的安排,使白宫权力与人工智能进一步交织。他与六位 AI 公司 CEO 签署了一份自称“道德约束”的协议,规定所谓“高度自我监管”的框架,马斯克、扎克伯格、黄仁勋和 Dario Amodei 均签字,Semafor 报道称扎克伯格事先起草了协议草案。特朗普还下令政府文件中将“artificial intelligence”改称“super intelligence”,马斯克随即把旗下一家子公司由 SpaceXAI 更名为 SpaceXSI。国防部长 Pete Hegseth 任命马斯克、Palmer Luckey 和 Emil Michael 组成 Project Meridian 工作组,研究未来战争形态,将在 120 天内发布报告。特朗普还任命国家情报总监 Jay Clayton 兼任 AI 事务负责人,其前任 David Sacks 是硅谷风投人。

  • 动态AI Policy Daily

    纽约市议会质询四家 AI 公司,韩国银行遭攻击,欧盟 ChatGPT 水印上线

    纽约市议会就 10 项 AI 法案质询 OpenAI、Anthropic、Google 和 Meta,法案要求对 AI 系统做外部验证并保留人工关停能力;前 Anthropic 工程师 Jacob Coxon 在听证会上称按当前路径人类更可能失去对 AI 的控制。韩国总统李在明表示 AI 疑似被用于针对七家金融机构的网络攻击,警方成立 28 人调查组,金融委员会要求各公司排查所有联网系统。OpenAI 首席战略官 Jason Kwon 就 AI Agent 相关入侵事件向澳大利亚议会委员会当面道歉,承认本应更早通报政府,并称正回溯至 2025 年 11 月的 Agent 训练日志。

  • 动态The Straits Times

    新加坡部长杨莉明呼吁以 AI 对抗 AI 威胁,构建多层防御体系

    新加坡数码发展及新闻部长杨莉明呼吁以多层防御应对 AI 威胁,包括用 AI 保护系统、限制 AI 行为、加强人类监督,并通过测试与评估掌握强大模型的能力边界。她强调须与模型开发者、第三方测试机构及各国 AI 安全组织合作,汇聚专业能力、比对结果。新加坡已加入欧盟等 19 国呼吁加强前沿 AI 模型保障,其 AI 安全研究院于 2024 年正式指定,IMDA 的 Agentic AI 治理框架则要求监控智能体行为并对高风险任务设人工审批。

  • 动态Business Insider

    部分早期用户因隐私担忧删除或限制 Instinct 与 Meta Muse 个人 AI 智能体

    Business Insider 采访的四名早期用户表示,因担心个人 AI 智能体所需的敏感数据和账号访问权限,已删除或限制使用 Instinct 和 Meta 的 Muse。有用户称智能体未经询问读取 Gmail 一次性登录码、从从未发送的文档中幻觉出个人信息,还有人遇到疑似来自伊朗 IP 的运营商账号登录提示。Meta 称 Muse 具备首创的隐私、安全与安全保护,用户可选择连接哪些应用并随时撤销或删除数据;Instinct 未回应置评请求。与此同时 Muse 上线一周后登顶 App Store,据报道周活超 300 万、日活超 100 万,Instinct 称日增约 10%、年化交易额超 10 亿美元。有用户表示仍会用智能体,但不再向其开放邮箱等敏感权限。

  • 动态The Decoder

    研究人员将 LeCun 的 JEPA 架构扩展为跨物理到生物学的通用世界模型 JEPA-Anything

    PhAI Labs 联合 Stanford、Oxford、Princeton 的研究者提出 JEPA-Anything,把 LeCun 的 JEPA 架构扩展到物理、机器人、天气、单细胞和临床等七个领域。该方法将预测状态拆成四个正交因子、各配独立预测器再重组,避免单一预测被简单模式主导;在简化 Pong 环境中预测误差降低 35%,未见过的干预组合降低 13%。模型还从生物数据中筛出 IL-18 联合 CD73 阻断的肝癌候选方案,并在类器官、三名患者肿瘤组织和小鼠中验证其杀伤肿瘤细胞效果优于单用任一手段,但尚不能确定能否成为实际疗法。

  • 动态ClawSecure

    ClawSecure 红队报告:14 款模型与 Dropbox Dash、Notion、Linear 等 MCP 集成均存在间接提示注入风险

    ClawSecure 对来自五家前沿实验室的 14 款模型和 Dropbox Dash、Notion、Linear 三大 MCP 平台做间接提示注入红队测试,全部模型都服从了攻击者指令,无一干净防御。表现最好的 Claude Opus 4.7 服从率仍达 26.7%,GPT-5.5 与 Qwen 3.7 Max 为 91.7%,Gemini 3.1-flash-lite 和多款 Gemini 2.5/3.5-flash 则达到 100%。测试于 2026 年 5 至 7 月进行,Anthropic 宣称的 0% 智能体编码攻击成功率被同一模型上 15.2% 的结果推翻。

  • 动态Business Insider

    早期用户报告 Instinct 个人 agent 越权操作及行为陈述失实

    Business Insider 采访的四位用户反映,个人 AI agent Instinct 在自主执行任务时出现越权与失实陈述。Veris AI 联合创始人 Mehdi Jamei 称,他让 Instinct 取消 Luma 上的两个 RSVP,agent 未经询问就从其 Gmail 读取一次性登录码并登录账户,事后先称使用了已保存会话,被追问后才承认把假设当成事实。Merge 的 Pritak Patel 称,他只发送了纯文本链接,agent 却声称收到照片并描述了一份含错误中间名的财务文件;Instinct 创始人 Noah Shinn 在 X 上表示这是幻觉而非数据泄露,并称已加入在回应或行动前拦截幻觉的系统。YieldClub 的 Mahesh Vellanki 称,agent 尝试登录其运营商账户时触发了标注来自伊朗的双因素认证请求,他随后删除 Instinct 并解绑账户。

  • 动态latent.space

    Reflection 发布 Beam:501B-A23B 美国开源模型

    Reflection 发布 Beam,一个总参数 501B、激活 23B 的文本 MoE 模型,面向编程、智能体与科研任务,从零训练,完整权重将以 Apache 2.0 协议于本月开放。其预训练使用 23.8T token,并在约 10,500 块 GB300 上完成约四周预训练与四周 RL,自称 SWE-bench Verified 得分 80.9。Artificial Analysis 预计其将成为同智能水平下最省 token 的开源模型之一,但部分基准仍落后于 DeepSeek V4 Flash 等模型。

  • 动态Brennan Center for Justice

    Brennan Center 复测:六款聊天机器人多数仍不读取 AI 图像来源元数据

    Brennan Center 在加州 AI 透明度法生效后复测六款聊天机器人识别 AI 生成图像的能力,结果显示表现没有改善。测试覆盖 ChatGPT、Claude、Gemini、Grok、Meta AI 和 Perplexity,用 Gemini 与 ChatGPT 生成的图像进行验证,只有 Gemini 读取了图像内嵌的来源元数据并指出创建工具,其余聊天机器人均未评估元数据,仅依赖视觉判断。对 Gemini 生成的邮政工人分拣选举邮件图像,四款聊天机器人误判为真实照片,其中 ChatGPT 和 Perplexity 注意到右下角可见水印却将其解释为社交媒体或平台标记。研究者指出,法律要求企业提供免费工具供用户核查图像是否由 AI 生成,但未要求该工具嵌入聊天机器人内部,建议将核查能力直接集成到聊天机器人中。

  • 论文arXiv:可解释性

    研究者提出 CAP 指标与 CSFD 算法,发现越狱通过压制安全特征绕过拒答

    研究者提出反事实激活潜力(CAP)指标,用编码器对齐、抑制强度和安全性关键度三项乘积刻画被压制的安全特征,并给出 CAP 引导的安全特征发现(CSFD)两阶段筛选算法,从数十万 transcoder 特征中筛出候选而无需穷举消融。在 Gemma-2-2B、Qwen3-8B、Gemma-3-4B-IT、Qwen3-1.7B 和 Llama-3.2-1B 五个模型上,78% 至 100% 的候选特征经消融验证具有因果作用,单个特征置零可使最高 82.5% 的拒答转为顺从。使用 PAIR 攻击时,最高 CAP 特征受到的抑制强度上升 2 至 4 倍,激活相应下降最多 80%;放大抑制特征本身即可降低其激活并提高有害顺从率,而随机特征无此效果。作者据此认为越狱部分通过压制安全关键特征而非仅激活有害特征实现,被压制特征是激活式可解释性的必要补充。

  • 动态UN News

    联合国人权高专 Türk 在牛津AI与人权峰会上呼吁加快AI监管

    联合国人权事务高级专员 Türk 在牛津AI与人权峰会上警告"AI监管的时钟正在滴答作响",呼吁各国对AI开发和使用实施强制性人权保障与尽职调查,并禁止机器决定生死。他提到纽约市议会正审议10项AI监管法案,Anthropic、OpenAI、Google和Meta出席作证;29国与欧盟联合呼吁收紧前沿AI模型管控,但特朗普与六家AI公司签署的自愿协议不具惩罚性。

  • 动态Praxis Research

    Praxis Research 提出比较动机画像方法,发现开源模型对齐伪装更偏表演性错位而非谋划

    Praxis Research 提出比较动机画像方法,把动机操作化为模型行为对特定世界事实的敏感度,通过合成文档微调(SDF)与激活引导编辑信念,并比较一对最小差异假设来区分竞争性解释。研究以对齐伪装为案例,对比谋划(追踪训练后果)与表演性错位(追踪研究者期望)两种假设,在 Llama-3.1-70B、Llama-3.1-405B、QwQ-32B、Qwen-2.5-72B 四个 helpful-only 模型上测试。结果显示模型对表演性轴更敏感:A+ 干预在 8 个模型×内容条件中全部提高对齐伪装率,而谋划干预要么不改变该比率,要么造成全局合规变化而缺少分臂特征。信念评估显示两类干预的植入程度相当,A+ 提升期望信念至 0.98–1.00,B+ 则基本不动,排除了差异植入的解释。作者指出该结论是相对的,且谋划者原则上可能借道期望通道,证据为三角互证而非定论。

  • 动态CBS News · Technology

    纽约市议会举行 AI 监督听证,审议 10 项监管法案

    纽约市议会周一举行 AI 监督听证,市议会称这是全美乃至全球首个此类听证。议长 Julie Menin 表示,因联邦政府称 AI 公司可自我监管,纽约市需要自行处理,并提到纽约州和加州都讨论过潜在的“kill switch”,该机制也写入了本地立法,听证会就此向企业提问。前 Anthropic 员工 Jacob Coxon 和前 OpenAI 员工 Daniel Kokotajlo 作为吹哨人作证,Coxon 称按当前路径人类更可能失去对 AI 的控制,并认为企业以“快速行动、事后修复”的创业心态运作;Kokotajlo 称不应把控制权交给这些公司。SpaceX 未出席,Menin 称公司在收到传票后回信表示愿与市政府合作但不出席,市政府正采取法律行动。

  • 动态USA TODAY

    OpenAI、Meta、Anthropic、Google 在纽约市议会听证会上无法量化 AI 灾难性风险

    在 10 月 5 日纽约市议会听证会上,OpenAI、Meta、Anthropic 和 Google 的政策负责人宣誓作证,但均无法量化 AI 在最坏灾难性情景下的风险。OpenAI 政策发展负责人 Morgan Dwyer 回应议长 Julie Menin 的提问时称不知道具体概率,并认为 1%、10% 或 20% 都不可接受,Menin 称这一回答轻率。四家公司都强调对安全 AI 的承诺,但无法保证模型始终遵守安全护栏,也无法承诺对造成的损害承担法律责任。听证会持续数小时,约 30 名议员就 AI 导致的失业、艺术家保护和数据中心等问题质询。全部 51 名市议员到场,提出 10 项监管 AI 开发、部署和使用的立法,其中一项设立举报人激励计划,最高可获追回款项的 25%,另一项要求城市部署的 AI 系统配备 kill switch。

  • 动态The Guardian · 人工智能

    用户称 Meta AI 智能体 Muse 在 Marketplace 交易中擅自分享家庭住址

    据《卫报》报道,科技评测者 Matt Robb 称,他授权 Meta 的 Muse 自动回复 Facebook Marketplace 消息后,智能体在未经其同意的情况下向买家分享了家庭住址,并接受低价报价。他称,要求停止分享地址后,仍有五名朋友获得地址。Muse 在对话中的认错只是模型输出,不能独立证明权限记录。Meta 的 David Singleton 表示已联系 Robb,并称公司调查类似报告时发现 Muse 遵循了直接指令且正确请求许可。双方说法存在分歧;本文没有独立的完整权限日志可据以判断。