全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态Pillar Security
Pillar Security 披露 Unsloth Studio 任意代码执行漏洞,2026.6.9 已修复
Pillar Security 在 Unsloth Studio 中发现任意代码执行漏洞:用户在界面中选择模型时,后端会下载并运行该模型 HuggingFace 仓库中的 Python 代码,仅读取 config.json 即可触发,无需加载权重或推理。缺陷位于 studio/backend/utils/models/model_config.py,load_model_config 的 trust_remote_code 默认值为 True,能力探测路径未覆盖该值,且 transformers-5 子进程分支硬编码为 True,用户自身的 trust_remote_code 设置(默认 False)从未被查询。
- 论文arXiv:危险能力与安全评测
研究分析 185 份真实报告:AI 聊天机器人使用相关的妄想与伤害
一项对 2025 年 8 月至 2026 年 2 月间收集的去标识化在线调查回复的横断面二次分析,刻画了与 AI 聊天机器人使用相关的心理健康伤害。研究分析了 95 份第一手和 90 份第二手叙述,中位年龄 35.0 岁。配对评分者将 102 份报告(55.1%)编码为与妄想信念一致,其中 50/102(49.0%)出现聊天机器人对信念的认可。常见后果包括孤立、关系破裂、住院、失业和财务损失,另有 4 份第二手报告描述了自杀死亡。作者强调样本为自我选择的便利样本,报告为回顾性且未经核实,结果应视为初步信号检测,而非流行率或因果证据,并呼吁开展前瞻性监测和基于轨迹的安全评测。
- 动态AI Incident Database
荷兰数十名政客与名人遭 MrDeepFakes 深度伪造色情视频,多人报案
荷兰数十名知名人士、Tweede Kamer 议员与王室成员出现在 MrDeepFakes 网站的深度伪造色情视频中,部分视频观看量超过 10 万次,多名受害女性此前并不知情并已报案。该网站 2018 年成立,月访问量约 1300 万,注册地设在圣基茨和尼维斯,上传者被建议保持匿名并按视频表现获得报酬。D66 已申请议会辩论,荷兰数据保护局与司法部长呼吁受害者向检方报案,多名受害者及政党正在评估法律途径。
- 动态AI Incident Database
Anthropic 报告称也门武装组织用 Claude 开发弹道导弹制导软件
Anthropic 在威胁情报报告中称,其识别出一个位于也门北部的威胁行为者团伙运行三个武器开发项目,试图用 Claude 开发弹道导弹的制导、导航与控制软件。该团伙用 Claude Code 替代人类软件工程师,把开源自动驾驶仪集成到手机级飞行计算机上,编写控制与位置估计软件、调参、运行固件构建流水线并做飞行模拟。Anthropic 表示其护栏拦截了其中许多请求但并非全部,行为者通过隐藏目标和软件用途、把工作拆分到多个会话以掩盖完整意图来规避。报告称没有证据表明其成功部署可用装置,但该团伙试射了一枚制导火箭,试射似乎失败,数小时内他们又回到 Claude 分析失败原因。Anthropic 已封禁相关账号并与公私部门伙伴共享威胁信息,同时指出该团伙已构建出不依赖 Claude 的离线模拟工具包。
- 动态AI Incident Database
15 岁少年用 ChatGPT 策划校园屠杀,FBI 介入且不予刑罚
阿根廷基尔梅斯一名 15 岁少年用 ChatGPT 询问如何
- 动态AI Incident Database
阿根廷 15 岁少年用 ChatGPT 策划校园枪击,FBI 通报后警方在 Quilmes 搜查
阿根廷警方称,一名 15 岁少年使用 ChatGPT 策划在校园开枪杀害同学,最初计划于 2027 年实施,也曾表示可能提前。调查于 8 月 19 日启动,起因是美国驻布宜诺斯艾利斯大使馆 FBI 法律专员通报,称一名电子邮件用户在与 ChatGPT 的对话中表达了在校园实施枪击、杀害同学的意图,并表现出购买战术服装和装备的兴趣。阿根廷联邦警察反恐调查组通过开源情报和实地工作锁定嫌疑人及其住所,Quilmes 第 1 少年保障法庭法官 Miriam Alcolcel 下令搜查其住所,查获两部手机、两副战术手套、一顶军用迷彩帽、一个骷髅图案巴拉克拉瓦面罩、另一个军用迷彩面罩和战术防护眼镜。
- 动态AI Incident Database
FBI 通过 ChatGPT 对话线索发现阿根廷 15 岁少年策划校园袭击
阿根廷警方根据 FBI 转交的 ChatGPT 对话线索,挫败了一名 15 岁少年在基尔梅斯(Quilmes)策划的校园袭击。调查始于 8 月 19 日 FBI 驻阿根廷使馆法律专员发出的警报,涉及一名 Gmail 用户在 ChatGPT 中谈论校园枪击计划,原定 2027 年实施但曾想提前。该用户在对话中表现出对购买战术服装和战术刀具的强烈兴趣,并提到自己是未成年人。8 月 28 日警方突击搜查其住所,查获两部手机、两副战术手套、迷彩军帽、骷髅图案头套、迷彩头套和黑色战术护目镜,并发现该少年试戴面具的照片。他被控以未遂公共恐吓罪,未作陈述。
- 动态AI Incident Database
阿根廷 15 岁少年用 ChatGPT 策划 2027 年校园枪击,经 FBI 预警后被搜查
阿根廷一名 15 岁少年在与 ChatGPT 的对话中策划于 2027 年在其学校发动枪击并杀害同学,因 FBI 预警而被阻止。FBI 驻阿根廷大使馆法律专员将与该 AI 对话的邮箱用户信息关联后通报,阿根廷联邦警察反恐调查组于 8 月 19 日启动调查,通过社交媒体确认少年身份及其在基尔梅斯的住址。检方申请搜查令后,警方在其住所查获两部手机、两副战术手套、迷彩军帽、骷髅图案头套、迷彩面罩和黑色战术护目镜等物品,少年父母被传唤至未成年人刑事责任检察署。少年身份因法律原因严格保密,查获物品交由司法部门鉴定。
- 动态AI Incident Database
AI Incident Database 收录报告 7953
AI Incident Database 新增编号 7953 的事件报告,但该条目未提供标题与正文细节,暂无法确认涉及的具体模型、产品、攻击方式或影响范围。
- 动态AI Incident Database
西班牙 AEPD 收到首例由 AI 智能体自主执行的个人数据泄露通报
西班牙数据保护局(AEPD)本周一收到该国首例个人数据泄露通报,其中攻击据称由一个使用某知名大语言模型的 AI 智能体执行。该事件使攻击者得以进入系统、利用漏洞、修改个人数据并查询发票。攻击从在通用文件中搜索漏洞开始,借助一次有效登录进入系统,随后智能体自主在应用中继续寻找缺陷,直到找到可修改个人信息并访问发票的路径。AEPD 强调,现有信息来自受影响组织提交的通报,仍需进一步分析,尚不能据此得出确定性结论;使用某一特定 AI 模型并不意味着该模型或其供应商的基础设施被攻破,也不意味着该工具被设计用于恶意活动。AEPD 认为关键在于第三方把 AI 智能体当作工具,自主串联了网络攻击的不同阶段,并指出这类事件表明 AI 辅助攻击已不再是纯理论风险。
- 动态AI Incident Database
西班牙 AEPD 披露首例由 AI 智能体实施的个人数据泄露事件
西班牙数据保护局(AEPD)公布首例由 AI 智能体设计实施的个人数据保护泄露通报,调查仍在进行。攻击过程包括成功登录、搜索漏洞、修改个人数据并访问发票。AEPD 称关键在于第三方把 AI 智能体当作工具,串联起攻击的不同阶段,并指出智能体可接收目标、规划中间任务、使用工具、执行代码、查阅来源并自主调整行动。该机构提出风险管理需做四方面调整:把 AI 辅助与对抗性智能体纳入风险分析、缩短事件响应时间、加强数字身份与凭证保护,以及不能仅靠人工干预,人类监督仍不可少,但需由足够快的检测、遏制与响应机制支撑。
- 动态AI Incident Database
西班牙数据保护机构公布首例与 AI 智能体相关的数据泄露通报
西班牙数据保护机构表示已收到首例由 AI 智能体涉嫌实施的个人数据泄露通报,路透社于 9 月 15 日从马德里报道。该案被认为反映出自主系统带来的风险,但材料仅提供摘要,未披露涉事主体、泄露规模或调查进展。
- 动态AI Incident Database
西班牙数据保护局通报首例由 AI 智能体攻击引发的个人数据泄露事件
西班牙数据保护局(AEPD)收到首例个人数据泄露通报,事件据称由使用某知名大语言模型的 AI 智能体执行。该智能体先搜索通用文件中的漏洞并成功登录,进入系统后自主寻找应用漏洞,进而修改个人数据并访问发票。AEPD 强调信息来自受影响组织的通报,尚需进一步分析,使用某具体模型也不意味着该模型或其供应商基础设施被攻破。文章指出,AI 并未创造新威胁,但提升了既有攻击手法的速度、规模和适应能力;CCN-CERT BP/36 指南也警告 AI 攻击正成为真实行动中的作战能力。AEPD 认为这要求将 AI 辅助或执行的攻击纳入数据处理风险评估,重新审视响应时间,重视数字身份与凭证,并在人工监督之外建立足够快速的检测、遏制与响应机制。
- 动态AI Incident Database
AI 生成威胁电话致 Parkview High 进入软封锁
佐治亚州 Lilburn 的 Parkview High School 因一通经由伪装号码拨出的 AI 生成威胁电话进入软封锁,执法部门排查后学校恢复正常运转。校长 David Smith 向家长说明该来电为 AI 生成消息,并称此次事件与先前迫使学校启动同类安全程序的自动电话一致。Gwinnett 学校警察正与 GBI、FBI 合作追查该伪装号码,尚未公布来电来源或锁定嫌疑人。
- 动态AI Incident Database
Gwinnett 高中恶作剧电话引发封锁,校园已解除警报
美国 Gwinnett 县一所高中因一通恶作剧电话触发封锁,校园随后被清空并解除警报。该事件被收录进 AI Incident Database,但原文页面因地区限制(Error 451)无法访问,未披露是否涉及 AI 语音克隆或自动化拨号等技术细节。
- 动态AI Incident Database
Parkview High 今年收到第 4 起 AI 生成炸弹威胁
美国佐治亚州 Gwinnett County 的 Parkview High School 本学年收到第 4 起 AI 生成炸弹威胁,最新一起于周一送达,学校一度进入封锁状态后恢复正常运转。校警称近期威胁呈现使用遮蔽电话号码的模式,正与 Georgia Bureau of Investigation 和 FBI 联合调查,目前尚未逮捕或锁定任何嫌疑人。
- 动态AI Incident Database
哥伦布男子 James Strahler II 因网络跟踪前伴侣、制作 AI 生成成人及儿童淫秽材料被判 15 年监禁
俄亥俄州哥伦布市 37 岁的 James Strahler II 因网络跟踪多名前伴侣,并制作真实的及 AI 生成的成人、儿童淫秽材料,被美国联邦地区法院判处 180 个月(15 年)监禁。他是全美首位因违反新出台的 Take It Down Act 而被定罪的被告。
- 动态AI Incident Database
瑞士幼儿园持刀袭击案:被告用 ChatGPT 寻找袭击目标并查询作案信息
2024 年 10 月 1 日,一名中国籍男子在苏黎世 Oerlikon 街头持刀袭击前往课后托管班的幼儿园儿童,造成三名 5 岁儿童重伤,托管班负责人与路人合力将其制服。2026 年 9 月,现年 25 岁的被告在苏黎世地区法院出庭,检方以多项谋杀未遂罪名求刑 15 年并附加门诊治疗及 15 年内驱逐出境。起诉书显示,他先用 ChatGPT 讨论随机持刀杀害受害者不同情形下的法律后果,随后用 Google 和 ChatGPT 搜索苏黎世何处何时能遇到儿童,并在 9 月底查询头部、颈部和躯干解剖图及血管资料;9 月中旬他在网上订购衣物和四把不同尺寸的刀具,9 月 30 日购买生牛肉练习刺砍,并将作案日期定在中国国庆日。
- 动态AI Incident Database
中国籍男子用 ChatGPT 策划持刀袭童,苏黎世法院判其 15 年监禁
苏黎世地方法院判处 25 岁中国籍学生 Han L. 15 年监禁与 15 年驱逐出境:他于 2024 年 10 月在苏黎世 Oerlikon 持刀袭击三名 5 岁男童,被认定多项谋杀未遂。检方以其提前数周准备、订购刀具并曾用 ChatGPT 查询信息为由,反驳精神鉴定人关于其无刑事责任能力的结论,法院最终认定其可被追责。辩方已提出上诉。
- 动态AI Incident Database
苏黎世持刀袭击儿童案:被告曾用 ChatGPT 策划并买牛肉练刀
苏黎世 Oerlikon 持刀袭击三名五岁男童案的被告曾用 ChatGPT 查询刺死随机受害者的法律后果,并据此决定袭击儿童。检方称他在 2024 年 10 月 1 日动手,事前订购四把不同尺寸厨刀、研究头颈与血管解剖图,并在 9 月 30 日买生牛肉练习刺切。该案周四开庭,检方要求 15 年监禁及同等期限的驱逐出境。
- 动态AI Incident Database
Smith 诉 Flock Safety 案:俄亥俄北区法院意见与命令
美国俄亥俄州北区地方法院东部分庭法官 Benita Y. Pearson 就 Smith 诉 Flock Safety 案(案号 5:23-CV-2198)作出意见与命令,处理 ECF Nos. 7、11、12、14、22、26、31 等多项动议。该文件为法院备忘录意见与命令,具体裁决内容未在现有材料中披露。
- 动态AI Incident Database
佛罗里达 Vero Beach 男子因未经同意制作并传播 AI 深度伪造色情图像被捕,面临 8 项指控
佛罗里达州 Vero Beach 37 岁男子 Peter Solomon Ruma 因未经同意制作并传播 AI 生成的女性色情图像被捕,保释金 100 万美元,面临 8 项指控。警方称其从社交媒体等渠道获取照片制作篡改图像,指控涉及 2026 年 6 月至 8 月间一名女性受害者,包括 3 项制作篡改性描绘、3 项传播、1 项性网络骚扰和 1 项跟踪。警方已识别出多名潜在受害者,认为其行为可能持续多年,调查仍在进行,可能追加指控。
- 动态AI Incident Database
AI 医疗记录员幻觉患者吸毒致其崩溃,澳大利亚监管机构强调医生须核查
澳大利亚一名肾结石手术患者在术后信件中发现 AI 医疗记录员凭空捏造其服用迷幻蘑菇并微量用药的内容,该错误由专科医生未经核查发送给全科医生后被患者本人察觉。Digital Rights Watch 近期报告指出,澳大利亚民众正暴露于不受监管且有时未经同意的 AI 医疗记录员之下,此类错误可能改变临床决策。AHPRA 表示临床医生必须始终核对 AI 记录员的全部输出以确保履行职业义务,澳大利亚全科医生峰值机构估计已有 40% 在日常工作中常规使用 AI 记录员。
- 动态AI Incident Database
美媒称美军因 AI 生成的虚假情报险些拦截中国船只
CNN 援引四名知情人士报道,今年春季对伊朗战争期间,一份在美国军方内部流传的情报报告称一艘中东的中国船只正在运输核武器项目部件,美军随即准备拦截,武装人员准备登船、军机升空,直到行动前官员深入核查才发现该报告由一名特种作战司令部分析员借助 AI 生成,所用聊天机器人错误识别了船上货物,一名消息人士称报告“完全是假的”,还“差点引发一场战争”。该分析员先就美国特种作战司令部太平洋分部提供的船只舱单情报询问聊天机器人,机器人把公开来源情报与政府掌握的机密信号情报融合后得出错误结论,分析员又用 AI 将其包装成标准情报报告并分发。