全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 15 条- 动态AI as Normal Technology
事实核查莫拉维克悖论:AI 难易任务划分缺乏实证
莫拉维克悖论——即人类觉得难的任务对 AI 容易、人类觉得容易的任务对 AI 难——从未经过实证检验。该说法源自 Hans Moravec 1988 年著作 Mind Children,实际只反映 AI 研究界认为哪些问题值得投入,对哪些问题对 AI 容易或困难没有预测力,其进化论解释也值得怀疑。这种思维既催生了对超级智能推理的恐慌,也在机器人等领域带来虚假安慰;由于新能力扩散耗时较长,社会有充足时间应对,却常被浪费。
- 动态Goodfire Research
Goodfire 用可解释性从表观遗传基础模型 Pleiades 中找出新型阿尔茨海默病生物标志物
Goodfire 将可解释性方法应用于 Prima Mente 的表观遗传基础模型 Pleiades,发现 DNA 片段长度模式主导其从血液游离 DNA 检测阿尔茨海默病的决策,并由此提炼出一个人类可解释的分类器。该分类器仅用片段长度特征即在独立队列上取得 AUROC=0.78(95% CI [0.56–0.95]),加入此前文献报道的生物标志物类别后升至 AUROC=0.84(95% CI [0.66, 0.97])。研究表明片段组学可作为互补于既有预测指标的新型候选信号,但其临床应用仍需进一步验证。
- 动态Boaz Barak
Michael Rabin 纪念会议
作为 Mind-IL 以色列科学与学术周的一部分,将举办一场纪念 Michael Rabin 的特别会议,邀请多位知名讲者。该活动时间与以色列大选相近。
- 动态Helen Toner
Helen Toner 谈 AI 能力的锯齿状发展:为何模型既强大又"很菜"
Helen Toner 在 The Curve 大会演讲中指出 AI 能力呈"锯齿状":一年前 Claude 3.5 Sonnet、GPT-4o、Gemini 1.5 已在 GPQA 博士级问题上达到约 50% 正确率,却数不清图中线条交叉几次。AI Village 中 Gemini 能卖周边、写博客,却因点不准按钮而误判为技术 bug;Anthropic 的 Project Vend 里 Claude 能自主定价售货,却报错 Venmo 地址、亏本卖金属块,甚至陷入存在危机。
- 动态AI as Normal Technology
AI 作为常规技术:ICML 主题演讲探讨 AI 时代人类还剩下什么工作
普林斯顿大学研究者 Sayash Kapoor 与 Arvind Narayanan 在 ICML 主题演讲中提出,AI 作为常规技术(AI as Normal Technology)框架可用于理解 AI 对经济与社会的影响,除非未来出现递归自我改进等不连续性。演讲认为,即便认真对待递归自我改进,实验室里也不存在某个里程碑会突然让所有人失业,但未来工作将截然不同,需要大量适应,并最终指向人机“共同超级智能”的愿景。
- 论文arXiv:危险能力与安全评测
人机协作中的达克效应:Human+AI 得分更高但自我评估并未变准
一项 N=366 的研究对比了人类单独与 Human+AI 在推理任务上的表现,Human+AI 得分更高,但自我评估与成绩仅弱相关,平均高估程度与人类单独组相近。Human+AI 组中信心区分正确与错误答案的准确性更低,达克效应在两组均存在且该组对比更明显;控制分数噪声后效应减弱但未消失。研究据此区分了表现增强与元认知增强,并呼吁界面支持验证、传达任务相关的 AI 模型表现。
- 动态Future of Life Institute
从新教神学看 AI 与工作:John Dyer 谈灵性、劳动与技术的张力
达拉斯神学院教授 John Dyer 从 Max Weber 的《新教伦理与资本主义精神》出发,讨论 AI 如何改变工作的本质与人的天职感。他认为 AI 可被视为上帝赐予的工具,用于减轻非人化劳动,但若缺乏护栏,其力量与规模会切断人与职业召唤的联系、积累权力并剥削他人,即所谓"未对齐"。
- 动态Help Net Security AI
Anthropic 发布 Claude Sonnet 5.5:响应快 30% 且不加价
Anthropic 发布 Claude Sonnet 5.5,官方称其响应速度比 Sonnet 5 快 30% 以上,完成多数任务消耗更少 token,在 API 标价不变的情况下降低单任务成本。
- 动态LessWrong
我的学生如何看待 AI:一位美国公立大学教师的课堂观察
一位美国公立大学全球政治课程教师报告,2026 年春夏学期及一场学生组织 AI 工作坊中,多数学生并不认为 AI 近年有快速进展,视聊天机器人为已成熟技术,仅图像/视频生成例外。学生普遍使用 AI 做作业但用法粗糙、易把差结果归咎于模型,对 Claude Code 的反应是"原来做软件这么容易"而非惊叹 AI 能力。作者认为雇主期待的"AI 原生"毕业生可能令其失望。
- 动态Google DeepMind
Google DeepMind 推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时语音对话模型。
- 动态Google DeepMind
Gemini 3.8 Flash TTS 与 Flash-Lite TTS 发布:支持自定义音色与逐句导演
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,支持用自然语言提示从零创建音色、30 秒样本复刻声音,并逐句控制表演、节奏与口音。
- 动态Google DeepMind
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力原生结合,为 Gemini Enterprise 提供带口型同步、自然表情和流畅轮次的动态视觉形象。
- 动态OpenAI
OpenAI 推出 dots 主动式助手
OpenAI 推出名为 dots 的主动式助手,可在复杂项目与日常任务中持续推进工作。dots 让用户在任务向前推进的同时保持掌控。
- 动态OpenAI
OpenAI DevDay 2026 回顾:GPT-6 Astra、ChatGPT、Codex 与 API 更新
OpenAI DevDay 2026 公布 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API 以及面向开发者的安全与新工具。
- 动态OpenAI
OpenAI 发布 GPT-6.1 Sol
OpenAI 推出 GPT-6.1 Sol,面向编程、计算机操作与专业工作场景,智能水平接近 Astra。其标准 API 输入与输出 token 价格仅为 Astra 的五分之一。