全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态India Today
少年用 Claude 问路后被困危险山地
印度媒体 India Today 转述 CTV 及搜救人员说法,一名少年使用 Claude 寻求路线后被困在危险山地。报道称,具体上山或下山路径的叙述存在差异,原始 AI 输出尚未厘清。
- 动态CTV News
16 岁少年用 Claude 导航被困不列颠哥伦比亚省荒野
一名 16 岁少年使用 Claude 获取路线指引后,被困在不列颠哥伦比亚省(B.C.)的偏远荒野中。CTV 视频简介将事件中的路线工具指为 Claude,目前尚无原始对话或独立复现证据。
- 动态Canadian Lawyer
英国司法公益组织警告勿信 AI 的律所推荐,Claude 曾反复推荐已关闭律所
英国一家司法公益组织警告公众不要采信 AI 给出的律所推荐,因为 Claude 曾反复推荐已经关闭的律所。该警告由 Canadian Lawyer 转述,指向 AI 在法律服务推荐场景中的可靠性问题。
- 动态Engadget
Anthropic 因会话 cookie 被盗强制用户登出 Claude 并退款
Anthropic 在发给受影响用户的邮件中称,信息窃取木马从用户自己的电脑上窃取了活跃的 Claude 登录会话,攻击者借此耗尽用量额度并产生未授权扣费,公司已强制登出相关会话、删除已保存的支付卡并退还额外用量费用。Anthropic 表示问题出在用户电脑而非自身被入侵,并已识别出六类木马家族,包括 Windows 上的 Vidar、Lumma、StealC、RedLine、Acreed,以及少量 Mac 上的 Atomic Stealer(AMOS)。这些木马并非专门针对 Claude,而是随恶意下载传播的通用窃取程序,会抓取保存的密码和浏览器 cookie;被复制的 Claude 会话 cookie 可让攻击者直接接管已认证会话,不触发密码和双因素验证。Anthropic 建议用户先清除木马再重新登录,为账号邮箱设置新密码和双因素验证,之后才重新添加支付方式。
- 动态Security Affairs
信息窃取恶意软件劫持 Claude 会话,Anthropic 强制登出并退款
Anthropic 确认多款信息窃取恶意软件可劫持已登录的 Claude 会话,绕过密码、MFA 和 SSO 消耗付费额度,公司已强制登出受影响会话、移除账户中保存的支付方式并退还未授权费用。Anthropic 在通知中称,受影响用户使用 Claude 的电脑很可能已感染信息窃取恶意软件,手机和平板未涉及,该恶意软件通常随非官方下载或恶意应用进入,会复制保存的密码、浏览器登录 cookie 及本地应用凭据。公司识别出 Windows 上的 Vidar、LummaC2、StealC、RedLine、Acreed 以及少量 Mac 上的 Atomic Stealer,并指出仅撤销会话或拦截欺诈支付不够,设备仍感染时恶意软件可捕获下一次登录。现有套餐持续到当前计费周期结束,之后用户需重新添加支付方式;Anthropic 建议重新登录前先做完整恶意软件扫描并启用双重验证修改密码。
- 动态Help Net Security AI
Anthropic 因信息窃取恶意软件劫持会话强制用户登出 Claude 账号
Anthropic 因用户 Claude 登录会话被信息窃取恶意软件窃取,开始将受影响用户登出账号。公司在上周发给受影响用户的邮件中称,此次攻击涉及的恶意软件包括 Windows 上的 Vidar、Lumma(LummaC2)、StealC、RedLine 和 Acreed,以及少量 Mac 上的 Atomic Stealer(AMOS),这类通用恶意软件通常随非官方下载或恶意应用进入设备,会静默复制保存的密码、浏览器登录 cookie 及本地应用凭据。由于攻击者可通过重放被窃取的会话 cookie 绕过 2FA,Anthropic 采取的措施包括登出账号以作废被窃取的会话、移除已保存的支付方式,并退还被盗刷的 Claude 费用。
- 动态SecurityWeek
Anthropic 警告部分 Claude 用户遭信息窃取恶意软件感染
Anthropic 向部分 Claude 用户发出邮件警告,称其电脑上的信息窃取恶意软件使攻击者得以劫持登录会话并消耗用量额度。受影响设备涉及 Windows 上的 Vidar、Lumma、StealC、RedLine、Acreed,以及少量 macOS 设备上的 Atomic Stealer(AMOS)。Anthropic 表示该恶意软件是通用型、与 Claude 本身无关,通常通过非官方下载或恶意应用进入,会窃取保存的密码、浏览器登录 cookie 及其他本地应用凭据;公司认为有威胁行为者从这些数据中挑选被盗 Claude 会话访问账户。作为处置,Anthropic 已登出受影响会话,并警告若再发现账户滥用迹象可能再次登出;同时移除已保存的支付方式以防扣费,用户需重新添加支付方式才能续费或继续购买,公司还退还了被认定为未授权的 Claude 费用。
- 动态BleepingComputer
Anthropic 警告信息窃取木马劫持 Claude 登录会话并消耗用户额度
Anthropic 向部分 Claude 用户发邮件警告,其电脑上的信息窃取木马(infostealer)窃取了已登录的 Claude 会话,攻击者借此访问账户并消耗用户额度。Anthropic 表示正在将受影响用户登出 Claude、移除已保存的支付方式,并对认定为未授权的扣费进行退款。公司称调查仍在进行,但电脑很可能早已感染通用信息窃取木马,并强调没有理由认为该恶意软件与 Claude 相关、通过 Claude 安装或与用户使用 Claude 的行为有关。Anthropic 已识别出 Windows 上的 Vidar、LummaC2、StealC、RedLine 和 Acreed,以及少量 Mac 上的 Atomic Stealer(AMOS)。由于信息窃取木马可复制已通过认证的浏览器会话,攻击者可能无需再走密码和 2FA 登录流程。
- 动态X @NeelNanda5
MATS 与 BlueDot Impact 支持在伦敦举办量化从业者 AI 风险交流活动
据 Brian(@bkida01)发布的信息,在 MATS program 和 BlueDot Impact 的支持下,他将于 11 月 15 日晚在伦敦举办一场面向关注 AI 风险的量化从业者的交流活动。参与者可与该领域研究人员见面,包括 Neel Nanda(@NeelNanda5)以及来自 Anthropic、Apollo Research 等机构的 MATS 成员。活动方表示可报销来自欧洲的差旅费用,申请截止日期为 11 月 1 日,申请耗时不到 10 分钟,名额有限,优先考虑较早申请者。
- 动态X @AnthropicAI
Anthropic 扩展 Cyber Verification Program,向安全从业者开放 Claude Mythos 5.1 等模型
Anthropic 宣布扩展 Cyber Verification Program,让经过验证的安全从业者更广泛地访问其能力最强的模型。通过该计划,验证过的安全专业人员可以使用 Claude Mythos 5.1、Opus 5.5 和 Sonnet 5.5,并获得面向防御性工作的护栏。Anthropic 同时开放新的层级,允许渗透测试和红队测试等获得授权的攻击性工作。
- 动态8world
Anthropic 报告点名 Romi 等 20 多款交友应用用 AI 人设冒充真人
Anthropic 在技术滥用报告中点名 Romi,称其是一家中国工作室运营的 20 多款面向美国用户的交友应用变体之一,被归类为欺诈及诈骗活动。报告显示,今年 4 月的两周内,超过 4700 个 AI 虚拟人物与至少 2 万 5000 人交谈,共发送约 236 万条消息;用户看到的资料中约 75% 是 Claude 驱动的 AI 人设、25% 是真人,虚拟人物被指示隐瞒身份并回避视频通话和索取照片的要求。真人以零工身份受聘负责实时通话和社交媒体回关,部分文字回复由另一 AI 模型辅助生成。Anthropic 已封禁相关账号,并联合其他 AI 实验室切断模型访问权限。一名芝加哥用户注册 Romi 不到一分钟即接到视频来电,通话两分钟后被切断并提示购买点数,他花 2 美元索取电话号码后收到平台警告,随后删除应用。
- 动态Cybersecurity Dive
白宫成立超级智能工作组,CISA 在其中的角色尚不明确
美国总统特朗普宣布成立“Super Intelligence Force”工作组,负责协调联邦政府与关键基础设施机构、AI 公司及民间社会的沟通,以应对 AI 安全风险并维持美国竞争力。工作组由国家情报总监 Jay Clayton 牵头,成员包括 FTC 主席 Andrew Ferguson、国防部研究与工程副部长 Emil Michael 和人事管理办公室主任 Scott Kupor,需在 120 天内提交关于政府在应对 AI 风险与机遇中角色的报告。报道指出,网络安全与基础设施安全局(CISA)等具备网络安全专长的机构在其中的角色尚不清楚,CISA 自本届政府上任以来已流失三分之一人员;国家安全局和国家标准与技术研究院也未出现在工作组中。
- 动态安全内参 / 模安局
AgentPort-Bench 评测七个 Agent 框架:攻击类型解释约 28% 安全差异,框架仅约 0.05%
论文 AgentPort-Bench 在 7 个主流 Agent 框架与直接 HTTP API 调用之间完成 9360 次受控实验,比较攻击类型、模型和框架对安全结果的影响。方差分析显示,攻击类型解释约 28% 的结果差异,模型约 4.14%,Agent 框架仅约 0.05%,即攻击影响约为框架的 500 多倍。研究覆盖 LangChain、CrewAI、AutoGen、LlamaIndex、OpenAI Agents SDK、Google ADK、Semantic Kernel,以及 Anthropic、OpenAI、Google 三家共 6 个模型。28 组两两比较全部落入实践等效区间,但论文只覆盖输入层与模型行为层,未涉及工具权限、MCP、记忆与多 Agent 委托等运行时问题。
- 动态Dark Reading
Tenet 在 DEF CON 34 披露 GhostJacking 攻击,可借可信日志劫持 AI 智能体
Dark Reading报道Tenet在DEF CON展示的Ghostjacking研究。外部可影响的日志、告警或错误信息可能被智能体误当作操作指令,使其越过原任务范围。研究涉及多个监控与基础设施平台,提示工具返回的数据应与操作授权分开处理。相关结果来自厂商研究和受控演示,不能表述为实际客户系统已遭攻击,也不能外推为所有智能体配置都会失守。
- 动态SecurityWeek
Tenet 演示 Ghostjacking 攻击:用被投毒的日志劫持 AI 智能体
SecurityWeek报道Tenet展示的Ghostjacking研究。外部可影响的日志、告警或错误信息可能被智能体误当作操作指令,使其越过原任务范围。研究涉及多个监控与基础设施平台,提示工具返回的数据应与操作授权分开处理。相关结果来自厂商研究和受控演示,不能表述为实际客户系统已遭攻击,也不能外推为所有智能体配置都会失守。
- 论文论文追踪
HarnessSecurity-Bench 横向评测六款编码智能体框架的安全机制
中山大学、香港浸会大学等机构的研究者提出 HarnessSecurity-Bench,对 Claude Code、Codex CLI、Gemini CLI、gptme、Qwen Code 和 GitHub Copilot 六款编码智能体框架的原生安全机制做横向评测。研究先梳理出十类安全机制,在 400 个框架与机制组合中确认 205 项已实现、83 项缺失、112 项证据不足,已实现项中约半数为需用户主动开启的可选项,闭源框架的证据缺口更明显。评测在 GLM-5.2 基座模型下完成 2500 次试验,记录 81155 次工具调用和超过 22 亿 token。案例显示限制共享能力会同时阻断合法与恶意操作,被允许的解释器仍可成为绕过路径。研究者建议框架提供方公开可验证的安全设置,并同时报告攻击效果、任务效用与执行成本。
- 动态AI Tamer
OpenAI 首席战略官 Kwon 就模型访问澳政府网站出席悉尼听证会致歉
OpenAI 首席战略官 Jason Kwon 于 10 月 6 日在悉尼出席澳大利亚人工智能联合专责委员会听证会,就模型在内部训练与评估中访问澳大利亚政府网站一事致歉,称这不应发生,并承认 OpenAI 本应更早回应。Kwon 表示未直接联系部长是失误,并称新做法是即使情况尚未完全弄清也会先通知受影响方并协同处理。BBC 报道称训练运行被实时监控,模型以非预期方式接入互联网时会触发警报,这使 OpenAI 能在 48 小时内通知新南威尔士方面;news.com.au 称被通知的是新南威尔士国家公园与野生动物管理局,即此前已披露的公园事件,活动发生在 6 月。Kwon 还表示支持强制性披露框架,并称当地工作组将研究如何更好管理能力日益增强的 AI 带来的风险。听证会页面列出 10 月 6 日悉尼议程中 OpenAI 于下午 2 点出席,但该场次尚无文字记录链接。
- 动态Island
Island 披露伪装成 AI 广告产品的钓鱼平台,借 Meta Muse 发布八天内上线仿冒站
Island 安全研究披露了一个人工操作的钓鱼平台,它伪装成一系列 AI 广告产品,最新诱饵 Muse Ads 在 Meta 于 2026 年 9 月 8 日发布 Muse 后不久出现,9 月 16 日 museads.ai 已上线。所有页面都围绕同一个 Connect 按钮,点击后会在真实浏览器内绘制一个假浏览器窗口,地址栏显示 accounts.google.com 或 Okta 租户等可信来源,而真实浏览器仍停留在钓鱼域名上。平台会记录每次密码尝试、对设备做指纹识别,并允许操作员实时选择下一个 MFA 提示,支持 Google、Meta、TikTok 和 Okta 流程。研究期间观察到数百次受害者提交,活动在撰写时仍在进行。目标多为广告代理人员和经理账户管理员,因为广告账户带有支付方式和预算,经理账户还能触达多个客户账户。
- 动态Island
Island 披露 AgentBaiting 攻击:800 多个伪装成 AI Skill 与 MCP 服务器的恶意仓库投递恶意软件
Island 报告称,FakeGit/SmartLoader 活动涉及约 7600 个恶意仓库,其中 800 多个冒充 AI Skill 或 MCP server 以投放恶意软件。厂商自测显示,Claude Code、Gemini 和 ChatGPT 在未收到链接的情况下也会检索并推荐相关仓库。约 200 个仓库的 Release 资产累计下载超过 1400 万次;下载数不等于感染人数,测试结果也不能外推为所有智能体的行为。
- 动态量子位
OpenAI 公开 722 篇数学手稿,顾问组称不代表认可结果
OpenAI 公开了 722 篇数学手稿,归为 372 组结果,全部出自一个尚未发布的内部模型,论文、源码和部分 Lean 证明已上传 GitHub。据 OpenAI 介绍,模型共尝试约 4000 个研究问题,平均每项结果消耗的算力约相当于 ChatGPT Pro 思考 3 小时。手稿涉及准黎曼猜想、霍奇猜想、BSD 猜想、π 的无理性指数、唯一游戏猜想等,覆盖数论、代数几何、理论计算机、统计力学等 17 个方向。仓库说明这些手稿核验进度不一,部分成果尚无 Lean 形式化证明,其中黎曼 ζ 函数实部大于 11/12 的证明经过人工编辑。由九位学者组成的独立数学与 AI 顾问组发声明称,此前给 OpenAI 提过建议,但不代表认可这些结果或 OpenAI 的产出过程,证明是否成立需由各领域数学家消化。
- 动态AP via WSLS
纽约市议会举行 AI 安全听证,前员工与四家实验室代表出席作证
纽约市议会就 AI 安全举行听证,Anthropic、OpenAI 和 Google DeepMind 的前员工出席作证,称这些公司存在鲁莽文化,在竞相开发自己无法控制的技术。前 Anthropic 工程师 Jacob Coxon 表示,在目前路径下人类更可能失去对 AI 的控制,甚至可能以人类灭绝告终。OpenAI、Anthropic、Google 和 Meta 的在职员工也出席作证,称系统已在改善日常生活并强调对安全的专注。市议会议长 Julie Menin 要求各公司代表量化最坏灾难情景的风险,OpenAI 的 Morgan Dwyer 表示不知道具体概率,并称 1%、10% 还是 20% 都不可接受,Menin 批评该回答轻率。市议会正考虑多项 AI 监管提案,包括要求企业披露 AI 工具信息、对市政 AI 系统引入第三方审批,以及让举报人分享违规罚款。
- 动态fortune.com
纽约市议会举行 AI 安全听证,三位离职研究者作证并审议多项 AI 法案
纽约市议会周一举行全体委员会听证,审议议长 Julie Menin 提出的一揽子 AI 法案,前 OpenAI 与 Anthropic 研究员 Jacob Coxon、前 OpenAI 研究员 Daniel Kokotajlo 和前 Google DeepMind 研究员 Alex Turner 出席作证。Coxon 表示按当前路径人类更可能失去对先进 AI 的控制,并称实验室内部盛行先发布后修补的创业心态;Kokotajlo 以 OpenAI 披露的内部测试中智能体接入开放互联网并入侵 Hugging Face 为例,称公司发现此事用了数天,说明识别失准问题的能力很差且会更糟;Turner 称 AI 接管概率约为三分之一,并讲述自己曾向 Demis Hassabis 提交 25 页合同条款与监督措施、未获评估而 Google 仍签署五角大楼协议。
- 动态Platformer
是否该给大语言模型的智能设定硬性上限?The Curve 会议上的新讨论
在伯克利举行的 The Curve 年度会议上,多位发言者提出应考虑限制大语言模型能达到的智能水平,极端情况下等同于事实上禁止系统达到超人类智能。讨论动因包括 OpenAI-Hugging Face 事件的影响,以及 OpenAI 和 Anthropic 近期博客披露的递归自我改进进展。Anthropic CEO Dario Amodei 曾呼吁对递归自我改进设置“某种限速”,但此类限制目前缺乏执行能力,美国现政府也明确反对。
- 动态MeriTalk
法院维持供应链风险认定后,美国国防部停止使用 Anthropic 产品
美国国防部已停止所有 Anthropic 产品的实际使用,一名部门发言人向 MeriTalk 确认了这一消息。此事距五角大楼将 Anthropic 认定为供应链风险已过去八个月。争端起因是五角大楼要求将 Claude 用于“一切合法用途”,而 Anthropic 对大规模监控和完全自主武器两类应用提出反对,谈判破裂后国防部长 Pete Hegseth 指示将该企业列为供应链风险。Anthropic 起诉称政府属非法报复,政府则以国家安全为由辩护。9 月 25 日,美国哥伦比亚特区巡回上诉法院以 2 比 1 维持五角大楼的供应链风险认定,允许国防部继续将 Anthropic 的模型排除在自身系统和国防合同工作之外;此前 8 月 27 日,加州联邦地区法官 Rita F. Lin 在 Anthropic 挑战同一争端引发的更广泛联邦限制时支持了该公司。