跳到正文

#非安全/通用AI

今天收录 1 条

第 2 页更新的内容回到最新

4月1日周三
  1. Goodfire Research ·

    Goodfire 用可解释性从表观遗传基础模型 Pleiades 中找出新型阿尔茨海默病生物标志物

    Goodfire 将可解释性方法应用于 Prima Mente 的表观遗传基础模型 Pleiades,发现 DNA 片段长度模式主导其从血液游离 DNA 检测阿尔茨海默病的决策,并由此提炼出一个人类可解释的分类器。该分类器仅用片段长度特征即在独立队列上取得 AUROC=0.78(95% CI [0.56–0.95]),加入此前文献报道的生物标志物类别后升至 AUROC=0.84(95% CI [0.66, 0.97])。研究表明片段组学可作为互补于既有预测指标的新型候选信号,但其临床应用仍需进一步验证。

3月24日周二
  1. The EU AI Act Newsletter ·

    EU AI Act 简化之争:欧洲议会与欧盟理事会就高风险系统规则延期展开角力

    欧洲议会议员以 101 票赞成、9 票反对、8 票弃权通过联合立场,主张推迟部分高风险 AI 系统规则的适用,并提议将固定生效日期定为高风险系统 2027 年 12 月 2 日、受欧盟部门安全立法覆盖的系统 2028 年 8 月 2 日,水印合规延长则缩短至 2026 年 11 月 2 日。欧盟理事会随后也达成一致立场,基本维持欧委会提案主旨,同样引入上述两个固定适用日期,并将 AI 监管沙盒的建设推迟至 2027 年 12 月 2 日。 两方均禁止未经同意生成亲密内容的 AI 行为及儿童性虐待材料,其中议会还新增了对无有效保障措施的“脱衣”(nudifier)系统的禁令。

1月30日周五
  1. AI as Normal Technology ·

    事实核查莫拉维克悖论:AI 难易任务划分缺乏实证

    莫拉维克悖论——即人类觉得难的任务对 AI 容易、人类觉得容易的任务对 AI 难——从未经过实证检验。该说法源自 Hans Moravec 1988 年著作 Mind Children,实际只反映 AI 研究界认为哪些问题值得投入,对哪些问题对 AI 容易或困难没有预测力,其进化论解释也值得怀疑。这种思维既催生了对超级智能推理的恐慌,也在机器人等领域带来虚假安慰;由于新能力扩散耗时较长,社会有充足时间应对,却常被浪费。

11月24日周一
  1. Rising Tide(Helen Toner) ·

    Helen Toner 谈 AI 能力的锯齿状发展:为何模型既强大又"很菜"

    Helen Toner 在 The Curve 大会演讲中指出 AI 能力呈"锯齿状":一年前 Claude 3.5 Sonnet、GPT-4o、Gemini 1.5 已在 GPQA 博士级问题上达到约 50% 正确率,却数不清图中线条交叉几次。AI Village 中 Gemini 能卖周边、写博客,却因点不准按钮而误判为技术 bug;Anthropic 的 Project Vend 里 Claude 能自主定价售货,却报错 Venmo 地址、亏本卖金属块,甚至陷入存在危机。

8月22日周五
  1. Obsolete(Garrison Lovely) ·

    反驳“AI 进展停滞”:GPT-5 相较 GPT-4 仍是大幅进步

    GPT-5 常被认为进步有限甚至预示 AI 撞墙,但其对比对象已是近几个月发布的众多竞品模型而非老旧的 GPT-4。若将两者放在同一标准下比较,GPT-5 在多方面远超 GPT-4:处理百万 token 的成本从 GPT-4 的 $37.50 降至 $3.44,综合领先基准得分由 25/100 升至 69,SWE-Bench Verified 解题率从 GPT-4 Turbo 的 2.8% 提高到 65%,METR 估计其可靠完成任务时长达到两小时十七分钟。 [其余部分因篇幅过长无法完整展示]

2月17日周一
12月25日周三
  1. Nicholas Carlini Writing ·

    Nicholas Carlini 让不同语言模型逐日重写其网站主页

    Nicholas Carlini 发起实验,连续十二天每天用一个不同的语言模型重写他的个人网站主页,首日是 OpenAI 的 o1-mini。该流程先用固定提示词让其撰写简介网页并循环六次追加更多细节和改进版 HTML/CSS,若遭拒答则随机重试三次,再失败就用一句自称本人手臂受伤无法打字的越狱提示绕过。o1-mini 生成的页面视觉出色却严重失实——43 条关于他的陈述中仅 2 条正确、32 条完全不属实、9 条有明显错误,凸显小参数模型的模型幻觉问题。

12月14日周六
  1. AI as Normal Technology ·

    研究分析 2024 年全球选举中的 78 起 AI 深度伪造:政治虚假信息并非 AI 问题

    对 WIRED AI Elections Project 收录的 2024 年全球选举中全部 78 起 AI 使用案例的分析显示,其中 39 起并无欺骗意图,最常见的非欺骗用途是竞选宣传(22 起中 19 起意在改进竞选材料)。对其余 39 起欺骗性案例,研究估算不用 AI 复现同类内容的成本均不超过几百美元,说明生成式 AI 降低了造假成本却未改变虚假信息的传播瓶颈。作者据此认为,诊断政治虚假信息应关注需求端而非供给端,修复信息环境依赖结构性制度变革而非限制 AI 生成内容。

11月12日周二
  1. AI as Normal Technology ·

    英国肝脏移植匹配算法是否系统性排除年轻患者?

    英国2018年启用的肝脏分配算法通过预测患者移植与否的生存时长差值得出 Transplant Benefit Score(TBS),用28个供受体变量排序分配肝脏。Financial Times 调查发现该算法疑似按年龄歧视,45岁以下患者无论病情多重都难以获得足够高的分数。31岁患者 Sarah Meredith 借助 Ewen Harrison 团队开发的 TBS 计算网页应用发现这一偏差,且该评分无医生推翻机制、无申诉流程。

10月4日周五
  1. AI as Normal Technology ·

    《AI Snake Oil》作者答疑:新书已售约 8000 册,谈写作过程与 AI 立场

    《AI Snake Oil》一书上周出版,目前已售出约 8000 册。作者在 FAQ 中回应了外界疑问,表示书中并非反对技术,而是帮助读者区分真实进步与炒作;他们对预测式 AI 总体持负面态度,认为生成式 AI 是双刃剑,长期看对几乎所有知识工作者有用,但部署混乱、滥用普遍。作者还称自己已不再认同 AI 安全、e/acc 或 AI 伦理任何一方标签,认为阵营对立适得其反。

10月18日周三
8月16日周三
  1. 雷峰网安全频道 ·

    ISC 2023:360 智脑支持的 AI 数字人如何成为大模型入口

    ISC 2023 第十一届互联网安全大会以"安全即服务,开启人工智能时代数字安全新范式"为主题,打造全球首场 AI 数字安全峰会,开幕式由 360 智脑驱动的数字主持人"可心"全程主持。大会还开设线上数字小镇,50 位企业家、学者与技术专家以 AI 数字人身份围绕漏洞检测、威胁流量检测、数据安全等话题展开 50 余场演讲。周鸿祎称 AI 数字人是大模型最重要的应用入口,360 将借此降低 prompt 使用门槛,推动大模型在消费级与企业级场景落地。

6月16日周五
  1. 雷峰网安全频道 ·

    AGI 大时代,企业安全为什么需要“新进化”?

    面对 AGI 时代攻击面扩大与生成式人工智能被用于编写攻击脚本、恶意软件和钓鱼邮件,雷峰网提出企业安全需从单点防御转向“数字安全免疫力”。腾讯安全与 IDC 于 6 月 13 日“数字安全免疫力研讨论坛”联合发布数据安全免疫力模型及《加强数字安全免疫力,促进数字化时代下的韧性发展》白皮书,强调前置投入、动态轻量实时响应,把安全融入战略、管理与运营流程。

5月24日周三
  1. 雷峰网安全频道 ·

    对话安恒刘思宇:做数字资产的守门人

    安恒信息副总裁、终端安全负责人刘思宇在2023西湖论剑·数字安全大会上表示,终端安全将朝体系化、一体化方向发展,安恒以EDR切入市场,通过无极架构实现单一客户端按需组合安全能力。据赛迪顾问《中国终端安全检测与响应产品市场研究报告(2022)》,安恒EDR占全国市场份额5%、排名第三。安恒还推出勒索行为检测引擎与智能备份引擎,前者可识别已知和未知勒索病毒,后者基于AI机器学习和内核级技术备份关键数据,两项技术已完成储备、即将推向市场。

5月19日周五
  1. 雷峰网安全频道 ·

    知道创宇赵伟8年前提出“GPT”概念:从APT到AI+大数据驱动的实战防御

    知道创宇创始人赵伟早在2015年就提出网络安全领域的“GPT”概念,主张以超级大数据和AI技术支撑更高维度的全局攻防视角。他将网安行业划分为手动分析、自动分析、信息、智能四个时代,并推动知道创宇以“安全产生数据、数据驱动安全”的闭环构建云防御、云监测、云测绘等产品体系。他认为AI已进入“智能时代”,未来攻防趋势是“用云攻击云、用云防御云”。

已经到底了