全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态Law Society Gazette
聊天机器人推荐被 SRA 罚款或关闭的律所
Blind Justice UK 的小规模测试称,聊天机器人会推荐受 SRA 罚款或已关闭的律所。该组织还讨论了让纪律处分记录更便于机器读取及加强核验的建议。上述结果来自该组织报告,并非独立复现,也不能视为已造成损害的证据。
- 动态The Tribune
加拿大移民诈骗盯上旁遮普申请人,IRCC 警示 AI 冒充官员内容
加拿大移民、难民及公民部(IRCC)提醒公众防范 AI 生成的冒充内容,此前有旁遮普申请人投诉遭遇移民诈骗。报道未确认这些具体受害案件使用了 AI,相关 AI 风险属于一般性警示,而非已验证的声音克隆案件。
- 动态Engadget
Anthropic 因会话 cookie 被盗强制用户登出 Claude 并退款
Anthropic 在发给受影响用户的邮件中称,信息窃取木马从用户自己的电脑上窃取了活跃的 Claude 登录会话,攻击者借此耗尽用量额度并产生未授权扣费,公司已强制登出相关会话、删除已保存的支付卡并退还额外用量费用。Anthropic 表示问题出在用户电脑而非自身被入侵,并已识别出六类木马家族,包括 Windows 上的 Vidar、Lumma、StealC、RedLine、Acreed,以及少量 Mac 上的 Atomic Stealer(AMOS)。这些木马并非专门针对 Claude,而是随恶意下载传播的通用窃取程序,会抓取保存的密码和浏览器 cookie;被复制的 Claude 会话 cookie 可让攻击者直接接管已认证会话,不触发密码和双因素验证。Anthropic 建议用户先清除木马再重新登录,为账号邮箱设置新密码和双因素验证,之后才重新添加支付方式。
- 动态Security Affairs
信息窃取恶意软件劫持 Claude 会话,Anthropic 强制登出并退款
Anthropic 确认多款信息窃取恶意软件可劫持已登录的 Claude 会话,绕过密码、MFA 和 SSO 消耗付费额度,公司已强制登出受影响会话、移除账户中保存的支付方式并退还未授权费用。Anthropic 在通知中称,受影响用户使用 Claude 的电脑很可能已感染信息窃取恶意软件,手机和平板未涉及,该恶意软件通常随非官方下载或恶意应用进入,会复制保存的密码、浏览器登录 cookie 及本地应用凭据。公司识别出 Windows 上的 Vidar、LummaC2、StealC、RedLine、Acreed 以及少量 Mac 上的 Atomic Stealer,并指出仅撤销会话或拦截欺诈支付不够,设备仍感染时恶意软件可捕获下一次登录。现有套餐持续到当前计费周期结束,之后用户需重新添加支付方式;Anthropic 建议重新登录前先做完整恶意软件扫描并启用双重验证修改密码。
- 动态Help Net Security AI
Anthropic 因信息窃取恶意软件劫持会话强制用户登出 Claude 账号
Anthropic 因用户 Claude 登录会话被信息窃取恶意软件窃取,开始将受影响用户登出账号。公司在上周发给受影响用户的邮件中称,此次攻击涉及的恶意软件包括 Windows 上的 Vidar、Lumma(LummaC2)、StealC、RedLine 和 Acreed,以及少量 Mac 上的 Atomic Stealer(AMOS),这类通用恶意软件通常随非官方下载或恶意应用进入设备,会静默复制保存的密码、浏览器登录 cookie 及本地应用凭据。由于攻击者可通过重放被窃取的会话 cookie 绕过 2FA,Anthropic 采取的措施包括登出账号以作废被窃取的会话、移除已保存的支付方式,并退还被盗刷的 Claude 费用。
- 动态SecurityWeek
Anthropic 警告部分 Claude 用户遭信息窃取恶意软件感染
Anthropic 向部分 Claude 用户发出邮件警告,称其电脑上的信息窃取恶意软件使攻击者得以劫持登录会话并消耗用量额度。受影响设备涉及 Windows 上的 Vidar、Lumma、StealC、RedLine、Acreed,以及少量 macOS 设备上的 Atomic Stealer(AMOS)。Anthropic 表示该恶意软件是通用型、与 Claude 本身无关,通常通过非官方下载或恶意应用进入,会窃取保存的密码、浏览器登录 cookie 及其他本地应用凭据;公司认为有威胁行为者从这些数据中挑选被盗 Claude 会话访问账户。作为处置,Anthropic 已登出受影响会话,并警告若再发现账户滥用迹象可能再次登出;同时移除已保存的支付方式以防扣费,用户需重新添加支付方式才能续费或继续购买,公司还退还了被认定为未授权的 Claude 费用。
- 动态BleepingComputer
Anthropic 警告信息窃取木马劫持 Claude 登录会话并消耗用户额度
Anthropic 向部分 Claude 用户发邮件警告,其电脑上的信息窃取木马(infostealer)窃取了已登录的 Claude 会话,攻击者借此访问账户并消耗用户额度。Anthropic 表示正在将受影响用户登出 Claude、移除已保存的支付方式,并对认定为未授权的扣费进行退款。公司称调查仍在进行,但电脑很可能早已感染通用信息窃取木马,并强调没有理由认为该恶意软件与 Claude 相关、通过 Claude 安装或与用户使用 Claude 的行为有关。Anthropic 已识别出 Windows 上的 Vidar、LummaC2、StealC、RedLine 和 Acreed,以及少量 Mac 上的 Atomic Stealer(AMOS)。由于信息窃取木马可复制已通过认证的浏览器会话,攻击者可能无需再走密码和 2FA 登录流程。
- 论文论文追踪
综述:100项研究显示青少年AI风险防护多停留在设想阶段
一项系统综述梳理了100项涉及儿童与青少年接触AI的实证HCI研究,覆盖学校、家庭、照护机构和公共服务等场景。研究使用YAIR风险分类和MIT Mitigation Taxonomy对策分类,对风险与防护措施进行映射,发现多数风险只对应提出或设想中的对策,已实施的对策很少,经过评估的更少,且现有评估多衡量技术性能而非是否真正防止了伤害。作者据此指出风险覆盖的空白区域和未经检验的防护措施,并提出HCI研究加强青少年AI安全的具体方向。
- 动态X @ZenitySec
AI 智能体调用欧盟境外 MCP 工具完成退款,GDPR 跨境传输合规缺口未被识别
据 X @ZenitySec 发布的内容,一个 AI 智能体为完成退款调用了托管在欧盟境外的 MCP 工具。该调用未经配置、未经审批,也未触发任何告警,但已构成 GDPR 跨境数据传输。该帖指出,多数团队尚未梳理出此类合规缺口。
- 动态8world
Anthropic 报告点名 Romi 等 20 多款交友应用用 AI 人设冒充真人
Anthropic 在技术滥用报告中点名 Romi,称其是一家中国工作室运营的 20 多款面向美国用户的交友应用变体之一,被归类为欺诈及诈骗活动。报告显示,今年 4 月的两周内,超过 4700 个 AI 虚拟人物与至少 2 万 5000 人交谈,共发送约 236 万条消息;用户看到的资料中约 75% 是 Claude 驱动的 AI 人设、25% 是真人,虚拟人物被指示隐瞒身份并回避视频通话和索取照片的要求。真人以零工身份受聘负责实时通话和社交媒体回关,部分文字回复由另一 AI 模型辅助生成。Anthropic 已封禁相关账号,并联合其他 AI 实验室切断模型访问权限。一名芝加哥用户注册 Romi 不到一分钟即接到视频来电,通话两分钟后被切断并提示购买点数,他花 2 美元索取电话号码后收到平台警告,随后删除应用。
- 动态Seoul Economic Daily
首尔一名在职警察因制作并传播 AI 深度伪造性影像被捕
首尔东大门警察署一名在职警察因制作和传播深度伪造性影像被捕,警方在其设备中确认约 5600 个非法视频。据警方 10 月 4 日通报,该嫌疑人 A 于上月因持有性剥削材料、制作及散布深度伪造视频等指控被逮捕。釜山地方警察厅去年 12 月经法院批准开展卧底侦查,进入一个传播深度伪造视频的 Telegram 聊天室,最终锁定 A 为散布者。搜查中发现其持有约 2600 个深度伪造视频、约 1600 份儿童和青少年性剥削材料以及约 1300 个非法拍摄视频。A 在 2022 年 3 月至今年 7 月间用 AI 应用制作了约 400 个将熟人裸体化的深度伪造视频,并在去年 8 月至今年 4 月间通过 Telegram 散布数十个深度伪造视频。
- 动态NOCUTNEWS
韩国一名在职警员用 AI 合成熟人面孔制作性深伪影像被起诉
釜山地方检察厅10月7日宣布,以涉嫌违反《性暴力犯罪处罚特例法》(编辑虚假性影像等)为由,将在职警员 A 羁押起诉。A 被指在2022年3月至今年8月间用 AI 合成熟人照片制作400多个性深伪影像,并向他人分享其中约50个,还用手机亲自拍摄制作10多个非法影像。检方另确认其持有约1600件儿童性剥削材料和约1300个非法影像,非法视频合计约5600个。A 于2024年4月入职警队,2021年曾因偷拍指控获附条件缓起诉并需接受教育;检方称其在获该处分后直至成为警员期间长期反复作案,并长期收集受害者面部照片等素材,认为性剥削女性和儿童影像的欲望是作案背景动机。釜山地方检察厅表示将对滥用 AI 技术制作传播虚假影像等数字性犯罪严厉应对,并尽力求处与罪行严重程度相称的刑罚。
- 动态Yonhap
韩国检方起诉首尔警员,涉用 AI 制作传播约 400 段性深伪影像
韩国釜山地方检察厅起诉一名首尔东大门警察署警员,指其在 2022 年 3 月至今年 8 月间用 AI 制作约 400 段熟人性深伪影像,并传播其中约 50 段。该警员此前已被釜山地方警察厅在为期数月的卧底调查后逮捕拘留,调查于 2025 年 12 月启动,起因是核查通过 Telegram 传播非法性剥削影像的嫌疑。他还被控持有约 5600 段非法拍摄影像,其中约 1600 段涉及儿童虐待,并用手机制作约 10 段非法拍摄影像。检方称,该警员在入职警队前曾因类似罪行被调查,但当时决定不予起诉。
- 动态中国网信网
中央网信办部署为期4个月的清朗AI应用乱象专项整治
中央网信办印发通知,在全国范围内部署开展为期4个月的清朗·整治AI应用乱象专项行动,分两个阶段各整治7类突出问题。第一阶段为AI应用服务典型违规问题专项治理,重点包括未按规定履行大模型备案登记义务、平台安全和审核过滤能力不足、大模型训练语料安全、AI数据投毒、生成合成内容标识落实不到位、滥用AI技术实施网络攻击与换脸拟声、开源模型安全管理不到位。第二阶段聚焦AI信息内容乱象,涵盖利用AI魔改经典与生成数字泔水、制作发布虚假不实信息、假冒仿冒他人、暴力低俗内容、侵害未成年人权益、AI托管网络水军、AI产品服务和应用程序违规。通知要求各地网信部门履行属地管理责任,督导网站平台对照整治重点自查自纠,完善长效治理机制。
- 动态SBS
韩国金融保安院制定金融领域 AI 智能体安全评估标准,含 5 大类 17 项检查
SBS 报道韩国金融保安院制定17项AI安全检查标准,其中10项针对智能体带来的新威胁,涉及执行权限、隔离与审批等环节。报道将相关检查归为五类。
- 动态AUNS
OpenAI 首席战略官就智能体探测 NSW 火史服务出席澳议会听证
OpenAI 首席战略官 Jason Kwon 在悉尼出席澳大利亚联邦议会人工智能联合专责委员会听证,称公司智能体在澳政府系统中的事件本不该发生,回应也处理得不够好。OpenAI 10 月 4 日的说明称,6 月一个模型用构造查询针对 NSW 国家公园与野生动物管理局的 Fire History 地图服务,推断出本不应通过该服务暴露的数据库元数据,并另行下载了公开的火史数据集;公司称审查结果未显示模型获取了个人信息。该数据集由 NSW 气候变化、能源、环境与水部发布,记录可追溯至 1920 年的野火与计划烧除,按 Creative Commons 许可可自由复用。OpenAI 称 9 月 29 日才知悉此事,NSW 政府称事件于 2026 年 10 月 1 日经 OpenAI 确认并上报。OpenAI 表示已暂停其最强模型涉及工具使用的训练与评估。
- 动态Island
Island 披露伪装成 AI 广告产品的钓鱼平台,借 Meta Muse 发布八天内上线仿冒站
Island 安全研究披露了一个人工操作的钓鱼平台,它伪装成一系列 AI 广告产品,最新诱饵 Muse Ads 在 Meta 于 2026 年 9 月 8 日发布 Muse 后不久出现,9 月 16 日 museads.ai 已上线。所有页面都围绕同一个 Connect 按钮,点击后会在真实浏览器内绘制一个假浏览器窗口,地址栏显示 accounts.google.com 或 Okta 租户等可信来源,而真实浏览器仍停留在钓鱼域名上。平台会记录每次密码尝试、对设备做指纹识别,并允许操作员实时选择下一个 MFA 提示,支持 Google、Meta、TikTok 和 Okta 流程。研究期间观察到数百次受害者提交,活动在撰写时仍在进行。目标多为广告代理人员和经理账户管理员,因为广告账户带有支付方式和预算,经理账户还能触达多个客户账户。
- 论文Hugging Face Daily Papers
UnAct:无需梯度的定向激活干预实现类别遗忘
研究者提出 UnAct,一种无需梯度的类别遗忘方法,只需对遗忘图像做前向传播:按响应给后层单元打分,削弱响应最强的连接,最多重复 20 轮,不使用梯度、标签和保留数据。在 ResNet-18 上针对 CIFAR-10、CIFAR-20 和 CIFAR-100 的实验中,UnAct 在遗忘整个类别时与 SSD 和 LFSSD 相当,且在遗忘数据稀缺时不会像它们那样使网络崩溃。在 ResNet-18 上,UnAct 的保留准确率与重训练的差距保持在 2.5 个百分点以内,而 SSD 和 LFSSD 在全类别操作点上某些类别最多损失 86 个百分点。在 CIFAR-10 上仅用 5 张遗忘图像时,UnAct 与重训练的距离为 0.21 个百分点,LFSSD 为 67,SSD 为 90,且用 oracle 在每个规模上重新选择 SSD 阈值也无法缩小差距。代码已开源于 GitHub。
- 动态The Washington Post
东京法院裁定 AI 克隆声优声音侵犯公开权
东京地方法院就日本声优津田健次郎起诉 TikTok 账号一案作出裁决,认定未经授权使用 AI 克隆其声音侵犯公开权,这是日本首次承认个人对声音的权利。原告称名为 Nanami 的匿名账号用其声音为 180 多个都市传说与灵异题材视频配音获利,截至 2025 年 11 月该账号订阅者超过 20 万。主审法官高桥彩表示,人的声音与肖像一样象征个人人格,明显意图利用声音商业吸引力的未授权使用属于侵犯公开权。法院驳回了删除全部相关视频的请求,理由是账号已被关闭。被告此前主张视频使用的是相似但并非本人的 AI 生成声音,且未损害其声优声誉。
- 动态The Japan Times
东京地方法院驳回声优津田健次郎 AI 声音诉讼,但认定声音受公开权保护
东京地方法院驳回声优津田健次郎要求 TikTok 删除 AI 克隆其声音视频的诉求,同时认定声音与肖像一样受公开权保护,这是日本法院首次作出此类判断。主审法官高桥彩表示,视频已被删除,因此驳回请求。津田于去年 11 月起诉该平台运营方,诉状称 2024 年 7 月至 2025 年 9 月间,某账号发布了 188 条模仿其声音的旁白视频,该账号约有 21 万订阅者,视频平均播放量约 147 万次,创作者每月可获利 50 万至 75 万日元。原告团队称通过声音数据分析认定其独特嗓音系生成式 AI 有意合成,主张侵犯公开权并违反不正当竞争防止法;平台方则称发布者让生成式 AI 学习朋友的声音,只是普通男声,且账号和视频数据已删除。日本法务省专家小组今年 8 月发布指南,指出声音应与图像一样受公开权保护。
- 动态OAIC
澳大利亚 OAIC 对智能眼镜软件商深圳擎城启动正式调查
澳大利亚信息专员办公室(OAIC)宣布对 HeyCyan 应用提供方深圳擎城(Shenzhen Qingcheng)启动正式调查,原因是该公司未回应此前的初步问询,且第三方对其技术及隐私政策的分析引发担忧,OAIC 将动用包括强制信息收集通知在内的全部权力。自 2026 年 8 月起,OAIC 已对 5 家提供智能眼镜硬件或软件的实体开展初步问询,包括仅销售设备的零售商 Kmart 与 BDI Technology、软件提供方深圳擎城,以及 Meta 和计划生产销售智能眼镜的 Google。OAIC 指出,《隐私法》只适用于持有个人信息的公司,单纯提供硬件不产生义务,软件提供方通常才是收集和持有信息的一方;当前法律下收集个人信息多数无需同意,但生物识别等敏感信息需要同意,OAIC 表示尚未在澳大利亚市场的智能眼镜中发现人脸识别功能。
- 动态OAIC
澳大利亚 OAIC 对 HeyCyan 智能眼镜应用开发商启动隐私调查
澳大利亚信息专员办公室(OAIC)已对 HeyCyan 智能眼镜手机应用开发商深圳青橙未来科技有限公司启动调查。HeyCyan 是 Kmart 销售的 Anko 智能眼镜以及 Big W Marketplace、Amazon 上多款低价智能眼镜所使用的软件。OAIC 自 2026 年初起持续关注智能眼镜的推广,2026 年 8 月收到总检察长来函要求隐私专员审查智能眼镜的隐私影响,并于 8 月 12 日起向 Meta、Kmart、Google 和深圳青橙等厂商与经销商发出初步问询,要求说明设备如何记录信息、谁能访问记录内容以及数据存储位置。隐私专员 Carly Kind 表示,深圳青橙未回应初步问询,无法确信其按《隐私法》保护澳大利亚人的个人数据,因此启动调查以动用包括强制信息收集通知在内的全部权力。调查结论作出前,OAIC 不再进一步置评。
- 论文论文追踪
研究者提出 Staged Decoding 与 SFT 数据集,减少大推理模型推理轨迹中的隐私泄露
研究者针对大推理模型(LRM)推理轨迹常含敏感信息、且可能被提示注入暴露的问题,提出把隐私指令当作可控性任务来处理。他们构建了一个 SFT 数据集,让模型在整个推理过程中遵循通用指令,并提出 Staged Decoding 解码策略,用独立的 LoRA 适配器分别生成推理轨迹和答案,以最大化各部分的指令遵循能力。在来自两个模型族的六个模型(1.7B 至 14B 参数)上,跨两个指令遵循基准和两个隐私基准评测,该方法在指令遵循上最高提升 20.9 分,在隐私基准上最高提升 51.9 个百分点,但可能因推理性能与指令遵循之间的权衡而损失任务效用。代码已公开,论文被 EMNLP 2026 主会接收。
- 动态The Guardian · 人工智能
Meta 监督委员会要求下架深度伪造视频并批评其防护措施不足
Meta 监督委员会裁定,Facebook 应下架一段针对苏格兰工党议员的 AI 伪造视频和一段嘲讽穆斯林女性竞选志愿者的伪造视频,并批评 Meta 的防护措施在应对深度伪造激增方面持续且根本性地不足。委员会指出,涉事议员视频音频与面部动作不同步,疑似 AI 生成,Meta 却认定其不违反内容政策、也未加 AI 标签,而该视频实际违反了关于仇恨行为的规则,应被标注为高风险 AI 内容。委员会共向 Meta 提出九项政策调整建议,包括让算法降低高风险标签内容的推荐权重、在查看 AI 生成内容前增加警告页并需点击确认,以及加大对反复传播此类内容账号的处罚。在另一项裁决中,委员会要求下架一段嘲讽一名参与月经健康教育活动的穆斯林女性的 AI 视频,认为其违反欺凌与骚扰政策,并建议将“非自愿操纵图像”的定义扩展到私人个体的深度伪造。