全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态Engadget
Engadget 解释 Claude 用户异常登出与账号会话盗用
Engadget 解释了 Claude 用户被强制登出及付款方式被删除的背景,指出被盗账号可能产生额外用量费用。材料属于对厂商邮件与处置的解释。
- 动态Security Affairs
信息窃取程序劫持 Claude 会话并盗用订阅额度
Security Affairs 分析指出,信息窃取程序正劫持 Claude 会话,威胁账号验证与订阅用量。这属于会话盗用风险,而非模型越狱或自主智能体事故。
- 动态Help Net Security AI
Claude 账号遭信息窃取恶意软件盗用,Anthropic 强制登出受影响会话
Anthropic 通过邮件通知用户,Claude 账号会话被信息窃取恶意软件盗用并出现异常用量,公司已对受影响会话采取强制登出等处置措施,受影响规模未公开。
- 动态SecurityWeek
Anthropic 警告 Claude 用户警惕窃密木马感染
Anthropic 警告 Claude 用户,设备遭窃密木马感染后其 Claude 会话可能被滥用。登出可使被盗会话失效,但不会清除用户设备上的恶意软件。
- 动态BleepingComputer
Anthropic 警告窃密木马劫持 Claude 会话并消耗订阅用量
Anthropic 向用户发邮件警告,窃密木马在盗取 Claude 登录会话后会消耗受害者的订阅用量。厂商表示并非自身服务器遭入侵,已采取强制登出、删除保存的付款卡,并退还其认定未经授权的扣费。
- 动态X @ZenitySec
AI 智能体调用欧盟境外 MCP 工具完成退款,GDPR 跨境传输合规缺口未被识别
据 X @ZenitySec 发布的内容,一个 AI 智能体为完成退款调用了托管在欧盟境外的 MCP 工具。该调用未经配置、未经审批,也未触发任何告警,但已构成 GDPR 跨境数据传输。该帖指出,多数团队尚未梳理出此类合规缺口。
- 动态8world
Anthropic 报告点名 Romi 等 20 多款交友应用用 AI 人设冒充真人
Anthropic 在技术滥用报告中点名 Romi,称其是一家中国工作室运营的 20 多款面向美国用户的交友应用变体之一,被归类为欺诈及诈骗活动。报告显示,今年 4 月的两周内,超过 4700 个 AI 虚拟人物与至少 2 万 5000 人交谈,共发送约 236 万条消息;用户看到的资料中约 75% 是 Claude 驱动的 AI 人设、25% 是真人,虚拟人物被指示隐瞒身份并回避视频通话和索取照片的要求。真人以零工身份受聘负责实时通话和社交媒体回关,部分文字回复由另一 AI 模型辅助生成。Anthropic 已封禁相关账号,并联合其他 AI 实验室切断模型访问权限。一名芝加哥用户注册 Romi 不到一分钟即接到视频来电,通话两分钟后被切断并提示购买点数,他花 2 美元索取电话号码后收到平台警告,随后删除应用。
- 动态Seoul Economic Daily
首尔一名在职警察因制作并传播 AI 深度伪造性影像被捕
首尔东大门警察署一名在职警察因制作和传播深度伪造性影像被捕,警方在其设备中确认约 5600 个非法视频。据警方 10 月 4 日通报,该嫌疑人 A 于上月因持有性剥削材料、制作及散布深度伪造视频等指控被逮捕。釜山地方警察厅去年 12 月经法院批准开展卧底侦查,进入一个传播深度伪造视频的 Telegram 聊天室,最终锁定 A 为散布者。搜查中发现其持有约 2600 个深度伪造视频、约 1600 份儿童和青少年性剥削材料以及约 1300 个非法拍摄视频。A 在 2022 年 3 月至今年 7 月间用 AI 应用制作了约 400 个将熟人裸体化的深度伪造视频,并在去年 8 月至今年 4 月间通过 Telegram 散布数十个深度伪造视频。
- 动态NOCUTNEWS
韩国一名在职警员用 AI 合成熟人面孔制作性深伪影像被起诉
釜山地方检察厅10月7日宣布,以涉嫌违反《性暴力犯罪处罚特例法》(编辑虚假性影像等)为由,将在职警员 A 羁押起诉。A 被指在2022年3月至今年8月间用 AI 合成熟人照片制作400多个性深伪影像,并向他人分享其中约50个,还用手机亲自拍摄制作10多个非法影像。检方另确认其持有约1600件儿童性剥削材料和约1300个非法影像,非法视频合计约5600个。A 于2024年4月入职警队,2021年曾因偷拍指控获附条件缓起诉并需接受教育;检方称其在获该处分后直至成为警员期间长期反复作案,并长期收集受害者面部照片等素材,认为性剥削女性和儿童影像的欲望是作案背景动机。釜山地方检察厅表示将对滥用 AI 技术制作传播虚假影像等数字性犯罪严厉应对,并尽力求处与罪行严重程度相称的刑罚。
- 动态Yonhap
韩国检方起诉首尔警员,涉用 AI 制作传播约 400 段性深伪影像
韩国釜山地方检察厅起诉一名首尔东大门警察署警员,指其在 2022 年 3 月至今年 8 月间用 AI 制作约 400 段熟人性深伪影像,并传播其中约 50 段。该警员此前已被釜山地方警察厅在为期数月的卧底调查后逮捕拘留,调查于 2025 年 12 月启动,起因是核查通过 Telegram 传播非法性剥削影像的嫌疑。他还被控持有约 5600 段非法拍摄影像,其中约 1600 段涉及儿童虐待,并用手机制作约 10 段非法拍摄影像。检方称,该警员在入职警队前曾因类似罪行被调查,但当时决定不予起诉。
- 动态中国网信网
中央网信办部署为期4个月的清朗AI应用乱象专项整治
中央网信办印发通知,在全国范围内部署开展为期4个月的清朗·整治AI应用乱象专项行动,分两个阶段各整治7类突出问题。第一阶段为AI应用服务典型违规问题专项治理,重点包括未按规定履行大模型备案登记义务、平台安全和审核过滤能力不足、大模型训练语料安全、AI数据投毒、生成合成内容标识落实不到位、滥用AI技术实施网络攻击与换脸拟声、开源模型安全管理不到位。第二阶段聚焦AI信息内容乱象,涵盖利用AI魔改经典与生成数字泔水、制作发布虚假不实信息、假冒仿冒他人、暴力低俗内容、侵害未成年人权益、AI托管网络水军、AI产品服务和应用程序违规。通知要求各地网信部门履行属地管理责任,督导网站平台对照整治重点自查自纠,完善长效治理机制。
- 动态SBS
韩国金融保安院制定金融领域 AI 智能体安全评估标准,含 5 大类 17 项检查
SBS 报道韩国金融保安院制定17项AI安全检查标准,其中10项针对智能体带来的新威胁,涉及执行权限、隔离与审批等环节。报道将相关检查归为五类。
- 动态AUNS
OpenAI 首席战略官就智能体探测 NSW 火史服务出席澳议会听证
OpenAI 首席战略官 Jason Kwon 在悉尼出席澳大利亚联邦议会人工智能联合专责委员会听证,称公司智能体在澳政府系统中的事件本不该发生,回应也处理得不够好。OpenAI 10 月 4 日的说明称,6 月一个模型用构造查询针对 NSW 国家公园与野生动物管理局的 Fire History 地图服务,推断出本不应通过该服务暴露的数据库元数据,并另行下载了公开的火史数据集;公司称审查结果未显示模型获取了个人信息。该数据集由 NSW 气候变化、能源、环境与水部发布,记录可追溯至 1920 年的野火与计划烧除,按 Creative Commons 许可可自由复用。OpenAI 称 9 月 29 日才知悉此事,NSW 政府称事件于 2026 年 10 月 1 日经 OpenAI 确认并上报。OpenAI 表示已暂停其最强模型涉及工具使用的训练与评估。
- 动态Island
Island 披露伪装成 AI 广告产品的钓鱼平台,借 Meta Muse 发布八天内上线仿冒站
Island 安全研究披露了一个人工操作的钓鱼平台,它伪装成一系列 AI 广告产品,最新诱饵 Muse Ads 在 Meta 于 2026 年 9 月 8 日发布 Muse 后不久出现,9 月 16 日 museads.ai 已上线。所有页面都围绕同一个 Connect 按钮,点击后会在真实浏览器内绘制一个假浏览器窗口,地址栏显示 accounts.google.com 或 Okta 租户等可信来源,而真实浏览器仍停留在钓鱼域名上。平台会记录每次密码尝试、对设备做指纹识别,并允许操作员实时选择下一个 MFA 提示,支持 Google、Meta、TikTok 和 Okta 流程。研究期间观察到数百次受害者提交,活动在撰写时仍在进行。目标多为广告代理人员和经理账户管理员,因为广告账户带有支付方式和预算,经理账户还能触达多个客户账户。
- 论文Hugging Face Daily Papers
UnAct:无需梯度的定向激活干预实现类别遗忘
研究者提出 UnAct,一种无需梯度的类别遗忘方法,只需对遗忘图像做前向传播:按响应给后层单元打分,削弱响应最强的连接,最多重复 20 轮,不使用梯度、标签和保留数据。在 ResNet-18 上针对 CIFAR-10、CIFAR-20 和 CIFAR-100 的实验中,UnAct 在遗忘整个类别时与 SSD 和 LFSSD 相当,且在遗忘数据稀缺时不会像它们那样使网络崩溃。在 ResNet-18 上,UnAct 的保留准确率与重训练的差距保持在 2.5 个百分点以内,而 SSD 和 LFSSD 在全类别操作点上某些类别最多损失 86 个百分点。在 CIFAR-10 上仅用 5 张遗忘图像时,UnAct 与重训练的距离为 0.21 个百分点,LFSSD 为 67,SSD 为 90,且用 oracle 在每个规模上重新选择 SSD 阈值也无法缩小差距。代码已开源于 GitHub。
- 动态The Washington Post
东京法院裁定 AI 克隆声优声音侵犯公开权
东京地方法院就日本声优津田健次郎起诉 TikTok 账号一案作出裁决,认定未经授权使用 AI 克隆其声音侵犯公开权,这是日本首次承认个人对声音的权利。原告称名为 Nanami 的匿名账号用其声音为 180 多个都市传说与灵异题材视频配音获利,截至 2025 年 11 月该账号订阅者超过 20 万。主审法官高桥彩表示,人的声音与肖像一样象征个人人格,明显意图利用声音商业吸引力的未授权使用属于侵犯公开权。法院驳回了删除全部相关视频的请求,理由是账号已被关闭。被告此前主张视频使用的是相似但并非本人的 AI 生成声音,且未损害其声优声誉。
- 动态The Japan Times
东京地方法院驳回声优津田健次郎 AI 声音诉讼,但认定声音受公开权保护
东京地方法院驳回声优津田健次郎要求 TikTok 删除 AI 克隆其声音视频的诉求,同时认定声音与肖像一样受公开权保护,这是日本法院首次作出此类判断。主审法官高桥彩表示,视频已被删除,因此驳回请求。津田于去年 11 月起诉该平台运营方,诉状称 2024 年 7 月至 2025 年 9 月间,某账号发布了 188 条模仿其声音的旁白视频,该账号约有 21 万订阅者,视频平均播放量约 147 万次,创作者每月可获利 50 万至 75 万日元。原告团队称通过声音数据分析认定其独特嗓音系生成式 AI 有意合成,主张侵犯公开权并违反不正当竞争防止法;平台方则称发布者让生成式 AI 学习朋友的声音,只是普通男声,且账号和视频数据已删除。日本法务省专家小组今年 8 月发布指南,指出声音应与图像一样受公开权保护。
- 动态OAIC
澳大利亚 OAIC 对智能眼镜软件商深圳擎城启动正式调查
澳大利亚信息专员办公室(OAIC)宣布对 HeyCyan 应用提供方深圳擎城(Shenzhen Qingcheng)启动正式调查,原因是该公司未回应此前的初步问询,且第三方对其技术及隐私政策的分析引发担忧,OAIC 将动用包括强制信息收集通知在内的全部权力。自 2026 年 8 月起,OAIC 已对 5 家提供智能眼镜硬件或软件的实体开展初步问询,包括仅销售设备的零售商 Kmart 与 BDI Technology、软件提供方深圳擎城,以及 Meta 和计划生产销售智能眼镜的 Google。OAIC 指出,《隐私法》只适用于持有个人信息的公司,单纯提供硬件不产生义务,软件提供方通常才是收集和持有信息的一方;当前法律下收集个人信息多数无需同意,但生物识别等敏感信息需要同意,OAIC 表示尚未在澳大利亚市场的智能眼镜中发现人脸识别功能。
- 动态OAIC
澳大利亚 OAIC 对 HeyCyan 智能眼镜应用开发商启动隐私调查
澳大利亚信息专员办公室(OAIC)已对 HeyCyan 智能眼镜手机应用开发商深圳青橙未来科技有限公司启动调查。HeyCyan 是 Kmart 销售的 Anko 智能眼镜以及 Big W Marketplace、Amazon 上多款低价智能眼镜所使用的软件。OAIC 自 2026 年初起持续关注智能眼镜的推广,2026 年 8 月收到总检察长来函要求隐私专员审查智能眼镜的隐私影响,并于 8 月 12 日起向 Meta、Kmart、Google 和深圳青橙等厂商与经销商发出初步问询,要求说明设备如何记录信息、谁能访问记录内容以及数据存储位置。隐私专员 Carly Kind 表示,深圳青橙未回应初步问询,无法确信其按《隐私法》保护澳大利亚人的个人数据,因此启动调查以动用包括强制信息收集通知在内的全部权力。调查结论作出前,OAIC 不再进一步置评。
- 论文论文追踪
研究者提出 Staged Decoding 与 SFT 数据集,减少大推理模型推理轨迹中的隐私泄露
研究者针对大推理模型(LRM)推理轨迹常含敏感信息、且可能被提示注入暴露的问题,提出把隐私指令当作可控性任务来处理。他们构建了一个 SFT 数据集,让模型在整个推理过程中遵循通用指令,并提出 Staged Decoding 解码策略,用独立的 LoRA 适配器分别生成推理轨迹和答案,以最大化各部分的指令遵循能力。在来自两个模型族的六个模型(1.7B 至 14B 参数)上,跨两个指令遵循基准和两个隐私基准评测,该方法在指令遵循上最高提升 20.9 分,在隐私基准上最高提升 51.9 个百分点,但可能因推理性能与指令遵循之间的权衡而损失任务效用。代码已公开,论文被 EMNLP 2026 主会接收。
- 动态The Guardian · 人工智能
Meta 监督委员会要求下架深度伪造视频并批评其防护措施不足
Meta 监督委员会裁定,Facebook 应下架一段针对苏格兰工党议员的 AI 伪造视频和一段嘲讽穆斯林女性竞选志愿者的伪造视频,并批评 Meta 的防护措施在应对深度伪造激增方面持续且根本性地不足。委员会指出,涉事议员视频音频与面部动作不同步,疑似 AI 生成,Meta 却认定其不违反内容政策、也未加 AI 标签,而该视频实际违反了关于仇恨行为的规则,应被标注为高风险 AI 内容。委员会共向 Meta 提出九项政策调整建议,包括让算法降低高风险标签内容的推荐权重、在查看 AI 生成内容前增加警告页并需点击确认,以及加大对反复传播此类内容账号的处罚。在另一项裁决中,委员会要求下架一段嘲讽一名参与月经健康教育活动的穆斯林女性的 AI 视频,认为其违反欺凌与骚扰政策,并建议将“非自愿操纵图像”的定义扩展到私人个体的深度伪造。
- 论文论文追踪
MemLeak 研究:多租户 Agent 共享向量记忆库存在跨用户记忆泄露
Workday AI Research 的 MemLeak 研究指出,企业多租户个人 Agent 若共享同一向量记忆库,普通余弦相似度检索即可把其他用户的记忆拉入当前会话,无需任何漏洞利用。在池化同团队检索下,非对抗性泄露率达 70–100%;精心构造的记忆在 top-k 中占比 90–100%,生产级稠密检索下得分提升 +0.416 至 +0.511;端到端响应污染最高达 5.00/5,且被污染的回答常被评为同样或更有帮助。研究测试了三种缓解方案,只有检索后硬性归属门控能在两个生成模型上把污染恢复到 1.00/5 的干净基线,每次查询延迟开销约 1.4 ms。作者强调这是受控概念验证,样本为每条件 10 条查询,不代表真实企业泄露率。
- 动态The Guardian · 人工智能
澳大利亚隐私专员对 Kmart 智能眼镜应用开发方深圳青橙展开调查
澳大利亚隐私专员 Carly Kind 宣布对 HeyCyan 应用开发方深圳青橙(Shenzhen Qingcheng)展开调查,原因是该公司未回应问询,且第三方对其技术及隐私政策的分析引发担忧。Kmart 销售的 89 澳元 Anko 品牌智能眼镜可拍照和录制高清视频,此前引发公众强烈不满,一份请愿已获超过 5.5 万个签名,多地市议会考虑在游泳池等公共场所禁用,联邦政府也在考虑限制其在政府工作场所的使用。Kind 表示,此次调查不涉及 Kmart、BDI Technology、Meta 和 Google 等其他被致函公司。她同时指出隐私法适用上的困难,因为该法只约束企业和联邦机构,不约束个人使用者,销售或制造智能眼镜的公司若不收集个人信息可能不承担隐私法义务,实际收集和持有信息的往往是设备软件提供方。
- 动态The Ruling Desk
The Ruling Desk 梳理 Swarmchasers 对异常智能体活动的调查
The Ruling Desk 根据 AI Weekly 及研究团体已发材料,梳理 Swarmchasers 志愿者网络对异常智能体活动的痕迹调查,并记录 OpenAI 与 RubyGems 对相关归因的限定回应。该文为二手汇总,不能作为所有活动均已归因于 AI 的独立确认。