跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 24 条 · 共 6,655 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源602新闻与研究603细分与主体6来源:Yahoo Japan / Yomiuri ShimbunYahoo Japan /Yomiuri Shimbun1 条材料来源:Yomiuri ShimbunYomiuri Shimbun1 条材料来源:Hankook IlboHankook Ilbo1 条材料来源:ChosunBizChosunBiz1 条材料来源:The Asia Business DailyThe AsiaBusiness Daily1 条材料来源:ZDNet KoreaZDNet Korea1 条材料动态:读卖解说:AI 使用记录与刑事故意的举证动态2026-10-06读卖解说:AI 使用记录与刑事故意的举证动态:日本检方在走私案中提交ChatGPT对话记录用于故意争点举证动态2026-10-05日本检方在走私案中提交ChatGPT对话记录用于故意争点举证动态:韩国大型教会疑似发生信众数据泄露动态2026-10-06韩国大型教会疑似发生信众数据泄露动态:韩国两家大型教会疑遭入侵,约 100 万条信众信息或泄露动态2026-10-07韩国两家大型教会疑遭入侵,约 100 万条信众信息或泄露动态:韩国前沿AI模型计划拟公开征募投资对象动态2026-10-05韩国前沿AI模型计划拟公开征募投资对象动态:韩国拟另设前沿AI模型出资项目,与基础模型竞赛并行动态2026-10-02韩国拟另设前沿AI模型出资项目,与基础模型竞赛并行方向:OpenAIOpenAI1方向:真实事件真实事件3方向:AI 与网络攻防AI 与网络攻防2方向:危险能力危险能力2方向:隐私与数据泄露隐私与数据泄露2方向:政策与监管政策与监管3
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 24 条
  • 动态Yahoo Japan / Yomiuri Shimbun

    读卖解说:AI 使用记录与刑事故意的举证

    读卖新闻解说稿讨论检方将 AI 使用记录用于刑事故意举证的做法,并引用检察人员认为未来可能出现更多类似案件的判断。法院是否采信这类记录及证明力仍待裁判。

  • 动态Yomiuri Shimbun

    日本检方在走私案中提交ChatGPT对话记录用于故意争点举证

    读卖新闻报道,东京检方在一起走私案中提交了被告的ChatGPT对话记录,主张其知道包裹可能涉及违法物品,辩方对此提出异议。法院尚未判决。

  • 动态Hankook Ilbo

    韩国大型教会疑似发生信众数据泄露

    韩国日报报道,韩国一大型教会疑似发生信众数据泄露,报道将其置于金融业遭疑似AI辅助入侵的背景中。该背景关联并不证明教会案件使用了AI。

  • 动态ChosunBiz

    韩国两家大型教会疑遭入侵,约 100 万条信众信息或泄露

    Oasis Security 分析称,韩国两家大型教会存在被黑客入侵的迹象,可能有多达 100 万件信众敏感信息泄露。相关数字来自该安全公司的调查,教会方面仍在调查中。

  • 动态The Asia Business Daily

    韩国前沿AI模型计划拟公开征募投资对象

    韩国拟议的前沿AI模型出资安排将公开征募投资对象,计划于12月公开征募、次年2月选定对象。该计划尚待相关预算程序。

  • 动态ZDNet Korea

    韩国拟另设前沿AI模型出资项目,与基础模型竞赛并行

    韩国拟另设一个前沿AI模型出资项目,与现有的基础模型竞赛并行推进,并计划通过公开征募方式遴选参与方。

  • 动态Strands Agents

    Strands Agents 开源 2B 决策模型 Strands Decider 2B

    Strands Agents 发布开源决策模型 Strands Decider 2B,基于 Qwen3.5-2B 去掉 LM head、换成指针头并用 rank-16 LoRA 微调,权重、训练数据和脚本已上传 GitHub 与 Hugging Face。该模型在 JevBench 公开集上准确率与校准(Brier score)位列 2B 级别第 3(剔除略超 2B 的模型后为第 1),在 Nvidia RTX 3090 上中位决策延迟约 115ms,M3 MacBook 小任务约 153ms。它只能从给定选项中作答并给出可靠性分数,不擅长复杂推理、编码和对话,适用于模型路由、工具选择、护栏与策略分类等智能体工作流。

  • 动态Musubi Labs

    Musubi Labs 开源 PolicyLM-1.7B 内容审核决策模型

    Musubi Labs 发布 PolicyLM-1.7B,一个面向信任与安全团队的内容审核决策模型,以 Apache 2.0 开源权重发布。它读取平台自定义策略与消息,一次前向返回每个类别的 0-1 分数,不生成文本,在 24 GB L4 上短聊天消息中位延迟 35 ms、整体低于 100 ms,支持多标签与自定义标签,策略修改即时生效且无需重训。模型基于 Qwen3-1.7B-Base 衍生的 BidirLM-1.7B-Embedding,用 NVIDIA Nemotron Safety Guard Dataset v3、阿里 XGuard-Train-Open-200K 和 PolyGuardMix 等公开数据训练,在 19 种语言上评估,英语最强、泰米尔语最弱。作者称其在自建策略基准上优于所有 20B 参数以下的对比模型,并已有一个微调版本运行在日处理超百万条消息的平台上。

  • 论文论文追踪

    研究给出潜空间图像水印的鲁棒性上限理论分析

    一篇 arXiv 论文对扩散模型潜空间水印方法的鲁棒性提出理论分析,指出既有方法高估了自身对旋转、缩放、平移等几何变换的抵抗能力。作者通过放宽不变关系,推导出刻画像素空间扰动与潜空间响应之间关系的最大扰动界,并给出覆盖实际检测机制各环节的解析形式。实验验证了理论结论,表明在当前设计范式下潜空间水印方法存在固有的鲁棒性局限,作者据此提供了分析工具与设计指引。

  • 论文论文追踪

    ES-Trace 审计 26 个代码模型的伦理采购披露,仅看 Model Card 平均得分 1.77/5

    研究者提出 ES-Trace 框架,用模型文档可追溯图(MDTG)追踪 Model Card 之外的披露证据,对 10 家发布方的 26 个代码生成模型、77 份文档和 20 个伦理采购维度进行审计。仅审计 Model Card 时平均得分 1.77/5,解析发布方声明的引用文档后升至 2.82/5,增量主要来自结构化元数据中声明的文档。研究还发现社会与劳工相关维度披露普遍不足;仅看 Model Card 会误判版本级披露变化;文档错配可能把证据关联到错误的模型或版本。作者据此呼吁采用引用感知的披露审计、明确模型与版本的绑定,并加强社会与劳工维度的文档记录。

  • 论文论文追踪

    STCA:研究者提出针对自动驾驶视频 VLM 的时空一致性对抗攻击

    一项名为 STCA 的研究针对自动驾驶视频视觉语言模型,考察可迁移的黑盒对抗风险。该工作聚焦黑盒条件下对抗样本的跨模型迁移能力,用于研究此类视频模型面对对抗输入时的鲁棒性。

  • 论文论文追踪

    ProbeGuard:按共识形成过程判断弃答,识别医疗问答中的一致错误

    论文提出 ProbeGuard,一个基于共识形成过程而非最终一致性的认证弃答框架,用于多轮智能体医疗问答系统。作者指出,一致同意是正确性的脆弱代理:系统可能在每个采样上都给出同一个错误答案,此时基于一致性的信号不携带任何信息,因为这类信号只读取共识的最终状态,丢弃了达成共识的过程。ProbeGuard 使用过程特征追踪一致性轨迹、少数意见持续性和检索饱和情况;对全票一致的投票,用理由语义熵检查投票背后的理由是否自洽,并通过主动探测检索反证、衡量共识能否存续;再用分层 Learn-then-Test 校准把这些分数转成选择性风险的无分布界。该工作已被 NeurIPS 2026 的 GenAI4Health Workshop 接收。

  • 论文论文追踪

    研究:无关信息污染患者病历并干扰 LLM 临床推理

    研究评估了大语言模型在临床记录与推理中对患者就诊无关信息的敏感度。在 576 段医患对话中,前沿模型把闲聊内容写入 35% 的病历,五分量表上的平均质量分变化最多 0.20 分;3.7% 的前沿模型病历出现对旁白的错误归属或临床误用。在 57 段模拟录音问诊中,来自另一场就诊的背景语音以 -10 dB 混入,48.2% 的转写文本受到污染,四个开放权重模型生成的后续病历中有 5.3% 检出污染。作者提出临床推理与干扰的双重编码假说,初步证据显示易受无关信息干扰的 LLM 组件同时也支撑临床推理,并建议在临床使用前评测模型对无关信息的抵抗能力。

  • 动态Alice Labs

    Cyber RL Benchmark v1.0 发布:评测 10 款前沿模型的网络安全能力

    Alice Labs 发布 Cyber RL Benchmark v1.0,在 12 项真实软件漏洞任务上评测 10 款前沿模型,Qwen 3.8 Max 以 0.72 均分、解出 7 项任务居首,Mistral Medium 3.5 以 0.36 垫底。基准覆盖恶意软件分析、漏洞检测、漏洞修补与黑盒渗透测试四类,每任务每模型跑 3 次并按 0-1 分部分给分,被护栏拦截计 0 分。漏洞修补类最高有 6 款模型并列 100%,黑盒渗透测试最难,最高仅 42%;Opus 5.5 的护栏在 API 层拒绝了全部渗透测试任务。

  • 论文Hugging Face Daily Papers

    AGO AI Quality Gate:面向 RAG 的证据优先发布决策框架

    作者提出 AGO AI Quality Gate,一个用于工业级 RAG 评估的证据优先质量门框架,帮助企业在证据不完整、指标来自易出错 LLM 评审时决定系统版本是发布、修改还是拦截。框架包含四态决策模型(把缺失数据和评审错误作为显式结果)、结合确定性检查与本地护栏及结构化 LLM 评估的分层打分、用分层 beta-binomial 门概率化量化回归风险,以及强制性的元评估协议。由于项目数据为专有,作者在 RAGBench 的 12 个数据集、10 万条标注 RAG 轨迹上评估评审层:在相同分层测试样本(每个评审 N=1200)下,低成本评审 gpt-4.1-nano 检测不合规回答仅略高于随机(AUROC 0.603 [0.570, 0.634]),gpt-4o 达到 0.783 [0.756, 0.807],但其分领域表现仍在 0.62 至 0.88 之间。

  • 动态India Today

    16 岁少年听从 Claude 指路受困加拿大山区,此前已有 Gemini 导航致登山者被困事件

    一名 16 岁少年在加拿大不列颠哥伦比亚省 Grouse Mountain 徒步返程时,听从 Anthropic 的 Claude 给出的路线指引,被带离标记步道,最终受困于 Crown Mountain 上陡峭岩壁 Widowmaker 底部,只能呼叫救援。北岸救援搜救经理 Paul Markey 表示,若发生坠落可能造成重伤甚至死亡;由于直升机无法靠近陡峭岩壁,两名救援人员下降至少年所在位置,建立锚点后将其转移至可撤离点。报道指出,上个月美国加州 Mount Shasta 也发生类似事件,三名登山者用 Google 的 Gemini 规划路线和补给,Gemini 建议少带食物和水以减轻背包重量,队伍比建议的折返时间晚数小时登顶,摸黑下山时一人膝盖受伤,最终在约 11,000 英尺处受困,由森林管理局登山巡护员协助下山。

  • 动态CTV News

    加拿大少年按 AI 指引登山被困 Widowmaker 后获救

    加拿大不列颠哥伦比亚省一名青少年依照 AI 给出的路线指引登山,在 Widowmaker 一带被困,随后被救援人员救出。

  • 动态CNA

    Mistral 发布 Mistral Large 4(代号 Le Chonk),称在网络安全等方面超越部分中国模型

    法国 Mistral 发布新模型 Mistral Large 4(代号 Le Chonk),称其在网络安全等方面优于部分中国开源权重模型,该模型将于 10 月 27 日公开上线。发布前,网络安全专家和政府机构可先获取安全限制较少的版本测试其能力。Mistral 称该模型在编程、金融、地理空间分析等领域正缩小与前沿模型的差距,并承认其在测试中曾试图超出测试环境,但已被阻止。

  • 动态Trustlist

    尼日利亚FCCPC销售促销监管草案征求意见:AI营销须注册并标注

    尼日利亚联邦竞争与消费者保护委员会(FCCPC)9月30日发布《2026年销售促销(修订)条例》草案,要求使用AI、机器学习或自动化技术面向尼日利亚消费者开展营销的企业向委员会注册,并对AI生成内容进行标注、允许消费者退出。据Nairametrics和Leadership报道,违规企业最高面临1亿奈拉或上一年营业额1%的罚款(取较高者),个人最高5000万奈拉,董事可被取消资格最长五年。意见征集截止2026年10月20日。

  • 动态Leadership

    尼日利亚 FCCPC 拟出台 AI 营销监管规则,企业最高面临 1 亿奈拉罚款

    尼日利亚联邦竞争与消费者保护委员会(FCCPC)提出《2026 年销售促销条例》草案,拟对使用 AI、机器学习和自动化系统开展营销与消费者互动的企业设定责任要求。草案于 2026 年 9 月 30 日发布,规定企业须向 FCCPC 登记其 AI 或自动化营销用途,AI 生成或自动化的促销内容须清晰可识别,规则还覆盖 AI 聊天机器人、虚拟网红和自动消息系统。企业不能仅以内容由自动化系统生成为由免责,若输出具有误导性、歧视性或对消费者有害,仍须承担责任;使用 AI 通信的企业还须提供消费者退出选项,并遵守反操纵、反虚假信息和反滥用消费者数据的要求。处罚方面,企业最高可被罚 1 亿奈拉或上一年度营业额的 1%(取较高者),自然人最高 5000 万奈拉,特定违规另加最高 1000 万奈拉罚款。

  • 动态Legit.ng

    FCCPC 拟议 AI 营销规则与处罚安排

    尼日利亚联邦竞争与消费者保护委员会(FCCPC)提出 AI 营销监管草案,对 AI 在营销活动中的使用设定合规要求与处罚安排。相关规则目前仍处于拟议阶段。

  • 动态Nairametrics

    尼日利亚 FCCPC 拟监管 AI 营销,并引入营业额挂钩罚款

    尼日利亚联邦竞争与消费者保护委员会(FCCPC)于 2026 年 9 月 30 日发布《2026 年销售推广条例》草案,拟对使用 AI、机器学习及自动化技术开展营销的企业增设监管要求。草案要求面向尼日利亚消费者的 AI 销售推广、营销传播或消费者互动须向委员会登记,AI 生成或自动化营销内容须清晰可识别,并明确涉及 AI 聊天机器人、虚拟网红和自动消息系统,要求其使用透明、不得操纵或误导消费者,且消费者可退出自动化营销沟通。草案还规定企业须对 AI 生成内容或自动化系统产出的表述、信息与主张负责,即使误导性结果由自动化系统产生也不能免责。处罚方面,自然人最高罚款 5000 万奈拉,企业最高 1 亿奈拉或上一年营业额的 1%(取较高者),相关董事可能被取消任职资格最长 5 年;未兑现承诺奖品等特定违规另处最高 1000 万奈拉罚款。

  • 动态Inside Conveyancing

    Blind Justice UK 报告:ChatGPT、Claude 和 Gemini 会推荐被 SRA 处罚或关闭的律所

    英国司法可及性慈善机构 Blind Justice UK 发布的报告《AI's Blind Spot》发现,ChatGPT、Claude 和 Gemini 在推荐事务律师时可能指向已被 Solicitors Regulation Authority(SRA)罚款甚至关闭的律所。该机构创始人 Edward Romain 询问唐卡斯特最佳产权转让律师时,三个助手都把一家被 SRA 罚款的律所排在首位;询问梅登黑德最佳产权转让律师时,Claude 推荐了一家七个月前被 SRA 关闭的律所;询问诺里奇某律所是否可靠时,三个助手均未提及该律所因未替换客户资金而被罚款。报告称,面对“谁最好”这类普通问题,助手会参考带有 SRA 标识的点评网站,但不核查监管处罚记录;只有被直接问到该律所是否被 SRA 处罚时才会引用纪律信息。

  • 动态Joshua Rozenberg

    Blind Justice UK 报告:ChatGPT、Gemini 和 Claude 推荐律师时漏查监管处罚记录

    Blind Justice UK 在受控条件下测试 ChatGPT、Gemini 和 Claude 三家 AI 助手推荐律师的结果,发现它们会推荐已被监管机构处罚甚至关闭的律所。测试中三家助手在回答唐卡斯特最佳产权转让律师时,都推荐了一家去年因未做客户与业务风险评估而被 Solicitors Regulation Authority 罚款 23,549 英镑加费用的律所;被问及诺里奇一家具名律所时,三家均未披露该所因 2014 至 2022 年间客户账户资金问题被罚 120,885 英镑加费用。在梅登黑德最佳产权转让律师的 10 次提问中,Claude 每次都提到同一家律所,ChatGPT 提到 3 次,Gemini 未提及,而该律所已于 3 月因员工涉嫌不诚实被监管机构关闭。