全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态European Parliament
欧洲议会议长Metsola在全会披露60名议员遭性化深伪图像攻击
欧洲议会议长Metsola在10月5日至8日全会开幕时指出,60名跨党派议员遭到性化深伪图像攻击,并呼吁为相关禁令的落实执法做好准备。她提到的60人与此前AGORA审计涉及的50名MEP,以及更早期147名各国议员的口径并不相同。
- 动态Mothership
潘丹水库AI假鳄鱼图案案男子被起诉
新加坡潘丹水库出现AI生成的假鳄鱼图案,一名男子因此被起诉。Mothership报道了该案的指控与时间线,相关行为目前属于检方指控。
- 动态The Straits Times
PUB 用 AI 检测假鳄鱼图未获结论,仍采取公共安全预防措施
新加坡公用事业局(PUB)对一张水库中出现鳄鱼的假图片进行 AI 检测,但工具结果未能得出结论,机构因此采取公共安全预防措施。
- 动态CNA
男子因用 Gemini 制作潘丹水库假鳄鱼图片被起诉
一名男子被控使用 Gemini 制作并传播潘丹水库假鳄鱼图片,同时被控妨碍司法,相关指控还包括删除记录。该事件曾引发搜查并导致水上活动暂停。上述均为指控,尚未定罪。
- 动态CNA
新加坡 PUB 称 AI 检测工具对水库假鳄鱼图未能给出明确结论
新加坡 PUB 表示,多种 AI 检测工具未能就水库假鳄鱼图片给出明确结论,机构出于公共安全考虑采取了预防措施。PUB 指出,工具结果不确定并不等于检测工具全部失效,但未公开具体使用了哪些工具。
- 动态Hankook Ilbo
日本检方在走私案中引用ChatGPT对话记录支持故意指控
韩国日报转述,日本检方在一起走私案中引用ChatGPT对话记录,用以支持对被告故意的指控。检方与辩方就该记录的证据效力存在争议,目前尚无裁判结论。
- 动态Yahoo Japan / Yomiuri Shimbun
读卖解说:AI 使用记录与刑事故意的举证
读卖新闻解说稿讨论检方将 AI 使用记录用于刑事故意举证的做法,并引用检察人员认为未来可能出现更多类似案件的判断。法院是否采信这类记录及证明力仍待裁判。
- 动态Yomiuri Shimbun
日本检方在走私案中提交ChatGPT对话记录用于故意争点举证
读卖新闻报道,东京检方在一起走私案中提交了被告的ChatGPT对话记录,主张其知道包裹可能涉及违法物品,辩方对此提出异议。法院尚未判决。
- 动态Hankook Ilbo
韩国大型教会疑似发生信众数据泄露
韩国日报报道,韩国一大型教会疑似发生信众数据泄露,报道将其置于金融业遭疑似AI辅助入侵的背景中。该背景关联并不证明教会案件使用了AI。
- 动态ChosunBiz
韩国两家大型教会疑遭黑客攻击,100 万信众信息或泄露
Oasis Security 分析称,韩国两家大型教会存在被黑客入侵的迹象,可能有多达 100 万件信众敏感信息泄露。相关数字来自该安全公司的调查,教会方面仍在调查中。
- 动态The Asia Business Daily
韩国前沿AI模型计划拟公开征募投资对象
韩国拟议的前沿AI模型出资安排将公开征募投资对象,计划于12月公开征募、次年2月选定对象。该计划尚待相关预算程序。
- 动态ZDNet Korea
韩国拟另设前沿AI模型出资项目,与基础模型竞赛并行
韩国拟另设一个前沿AI模型出资项目,与现有的基础模型竞赛并行推进,并计划通过公开征募方式遴选参与方。
- 动态Strands Agents
Strands 推出基于 Qwen3.5-2B 的决策模型 Strands Decider
Strands 发布决策模型 Strands Decider,基于 Qwen3.5-2B 构建,通过对给定选项打分来做决策,并开放代码、权重和训练材料。文章给出的准确率与校准表现均为作者在指定基准上的报告结果。
- 动态Musubi Labs
Musubi Labs 发布开放权重内容审核模型 PolicyLM-1.7B
Musubi Labs 发布开放权重内容审核决策模型 PolicyLM-1.7B,按自然语言政策为内容类别打分,不生成文本。公司称修改政策无需重新训练。该模型仍存在良性内容误判和部分语言覆盖限制。
- 论文论文追踪
潜空间图像水印在几何变换下的鲁棒性上限
论文从理论与实验两方面讨论潜空间图像水印在几何变换下的鲁棒性限制,指出这类水印的鲁棒性存在上限。
- 论文论文追踪
ES-Trace:26 个代码模型伦理采购披露审计
ES-Trace 对 26 个代码模型的伦理采购披露情况进行了审计,发现报告在追踪引用材料后披露评分有所提高,但劳工和社会项目方面的披露相对较弱。
- 论文论文追踪
STCA:自动驾驶视频模型对抗鲁棒性研究
一项名为 STCA 的研究针对自动驾驶视频视觉语言模型,考察可迁移的黑盒对抗风险。该工作聚焦黑盒条件下对抗样本的跨模型迁移能力,用于评估此类视频模型在真实攻击场景下的鲁棒性。
- 论文论文追踪
医疗问答中一致答案仍可能错误:观察共识形成过程的置信信号
医疗问答中模型给出的答案即使高度一致,仍可能是错误的。作者提出通过观察共识形成过程来获取置信信号,以识别这类一致但错误的答案。所报改进仅限于该研究设置。
- 论文论文追踪
研究:无关信息污染患者病历并干扰LLM临床推理
一项研究在医患对话及模拟诊室音频中测试无关信息对AI病历生成的影响,发现闲聊和旁人病情会被写入病历或错误归属,而常规质量分数变化不大。研究结果由LLM裁判判定,未经医生复核,也未测试真实诊疗损害或医生签字前能否发现错误。
- 动态Alice Labs
Alice Labs 发布 Cyber RL Benchmark v1.0,横评前沿模型网络安全能力
Alice Labs 发布 Cyber RL Benchmark v1.0,用 12 道题横评前沿模型的网络安全能力,覆盖分析、检测、修补与渗透测试,并以诱饵观察假阳性。该基准将 API 护栏拒答记为零分,因此分数同时反映模型能力与安全策略差异。结果为厂商小样本自评。
- 论文Hugging Face Daily Papers
Harness-Aware Distillation:让小语言模型智能体学会 harness 之外的能力
针对小语言模型智能体蒸馏时 harness 保持不变、学生模型只需学习教师模型超出 harness 的能力这一特点,研究者提出 Harness-Aware Distillation(HAD),将蒸馏重点放在教师模型相对 harness 的增量上。HAD 在 on-policy 蒸馏基础上加入动作偏好对比(对比同一教师模型在有/无 harness 信息下的动作,并在学生自身推理后打分)和有效性检查(剔除与 harness 记录矛盾的偏好对)。在多个长程智能体基准和模型上,HAD 以相同固定 harness 超过 on-policy 蒸馏基线,且无需任务奖励、成功标签或未来信息;分析显示其更少陷入无效循环、更常从错误中恢复。
- 论文Hugging Face Daily Papers
AGO AI Quality Gate:面向 RAG 的"证据优先"发布决策框架
AGO AI Quality Gate(AGO)是一套面向工业级 RAG 评估的"证据优先"质量门框架,把缺失数据和评审模型出错都当作显式结果,结合确定性检查、本地护栏与结构化 LLM 评估分层打分,并用分层 beta-binomial 门控量化回归风险。在 RAGBench 的 12 个数据集、每个评审模型 N=1200 的分层测试样本上,gpt-4.1-nano 识别不合规回答的 AUROC 仅 0.603,gpt-4o 为 0.783,但其分领域表现仍在 0.62 至 0.88 之间。固定随机种子的门控研究显示,回归场景下决策级配置将不安全放行率降至 22.2%-35.1%,而朴素门控为 29.3%-41.8%。
- 动态India Today
少年用 Claude 问路后被困危险山地
印度媒体 India Today 转述 CTV 及搜救人员说法,一名少年使用 Claude 寻求路线后被困在危险山地。报道称,具体上山或下山路径的叙述存在差异,原始 AI 输出尚未厘清。
- 动态CTV News
Teenager rescued from B.C.'s Widowmaker after getting stranded using AI instructions