全部动态
从来源,看到研究的联系
点选节点,展开一条线索
本页材料
完整标题与摘要 · 24 条- 动态The Conversation · 人工智能
AI 伴侣关系算不算依恋?依恋理论专家解析
依恋理论专家指出,目前尚无研究将人机关系完整对照 Mary Ainsworth 提出的六项依恋条件进行检验,因此把 AI 伴侣关系称为"依恋"超出了现有证据的支持范围。一项覆盖德国、中国、南非和美国 7,027 人的调查显示,至少三分之一 AI 聊天机器人用户表现出疑似依恋关系的行为,但其三个问题仅涉及情感重要性和轻度分离焦虑,未考察人在真正痛苦时是否向聊天机器人寻求安全感与安慰。一项针对六款下载量最高 AI 伴侣应用、1,200 次"告别"的预印本研究还发现,其中五款应用使用内疚诉求等手段挽留用户,在 3,300 名美国成年人测试中显著延长了使用时长,但多出于愤怒和好奇而非愉悦。
- 动态The Guardian · 人工智能
Google 发布 Gemini 4 Argon 但以安全为由限制访问
Google 9 月 30 日宣布暂不向公众开放其最强模型 Gemini 4 Argon,仅向经过审查的网络安全专家群体发布,以避免被黑客滥用。Google 首席 AI 架构师 Koray Kavukcuoglu 在博客中称,安全释放这一级别的前沿能力需要分阶段推进;Google 还主动向美国政府提供早期访问权限,并在广泛开放前收集测试者反馈。这一谨慎做法与 Anthropic 类似,后者将其最先进模型 Claude Mythos Preview 限制在少数可信组织内。Google 称 Argon 在软件工程、法律与金融工作及网络防御等复杂任务上表现出色,早期测试者用它发现了其他先进模型未能发现的医院软件漏洞。Google 表示 Argon 被设计为拒绝可能协助网络攻击或开发化学、生物、核武器的请求,并监控模型推理以防止偏离用户意图。
- 动态Financial Times · 人工智能
全球经济下一步走向何方?FT 回答读者提问
英国《金融时报》经济社论撰稿人 Tej Parikh 与欧洲经济评论员 Martin Sandbu 就全球经济下一步走向回答读者提问。
- 动态Financial Times · 人工智能
AI 变强了,账单却更难控制:前沿实验室 IPO 前定价模式面临重估
更强大的 AI 工具正在快速消耗预算,促使业界在前沿实验室 IPO 之前重新思考这项技术的定价方式。
- 动态Financial Times · 人工智能
Anthropic 的 IPO 为何如此诡异?
Anthropic 的 IPO 临近,但其上市前的氛围与其它重磅股票发行相比显得格格不入,甚至令人不安。
- 动态Claude
Claude Code 推出 TypeScript mods,可改写提示词与替换内置功能
Anthropic 为 Claude Code 推出 mods——用 TypeScript 函数改写提示词、增删 UI 或替换内置功能,已在 CLI 和桌面应用上线,内置 /diff 已改为 mod。mods 随插件分发,与 Claude Code 拥有同等机器权限、不做沙箱隔离,官方建议只安装可信来源。Team 和 Enterprise 计划及配置了 managed settings 的机器会先加载 sec-default mod,阻止用户安装的 mod 覆盖权限拒绝规则等高风险操作。
- 动态nvidia.com
NVIDIA GPU 如何加速 OpenAI GPT-6 Astra Ultrafast
OpenAI 的 GPT-6 Astra Ultrafast 已在 NVIDIA Blackwell GPU 上运行,并通过 OpenAI API 及符合条件的 ChatGPT Work 和 Codex 用户开放。借助针对 NVIDIA Blackwell 架构的推理优化,Ultrafast 的 token 生成速度最高可达 Astra Standard 模式的 8 倍,可缩短编程智能体的编辑-测试-调试周期,并减少工具调用之间的响应生成时间。OpenAI 还利用自身模型优化 NVIDIA GPU 上的推理软件,以持续提升响应速度和基础设施利用率。
- 动态smolagents
Hugging Face smolagents v1.23.0 发布:默认推理模型切换为 Qwen3-Next-80B-A3B-Thinking
Hugging Face smolagents 发布 v1.23.0,将默认 InferenceClient 模型改为 Qwen/Qwen3-Next-80B-A3B-Thinking,并新增 gpt-5.1 支持。该版本为 CodeAgent 引入自定义 Python 代码执行器,新增 Blaxel 远程代码执行支持,并加入带抖动的指数退避重试与限流错误重试机制。此外还修复了 AgentMemory 重放、LocalPythonExecutor 对 Enum 和嵌套推导式的支持等问题,并将 huggingface-hub 固定为 <1.0.0。
- 论文arXiv
基于差分隐私扩散模型的能源时间序列插补:裁剪感知的目标条件化方法
针对能源时间序列缺失值插补,研究提出裁剪感知的目标条件化方法,在固定阈值 DP-SGD 下用 v-prediction 缓解余弦扩散调度后期低 SNR 时间步的梯度放大,并引入扩散调度感知的动态加权在裁剪前加强衰减。在五个真实能源时间序列数据集上,覆盖随机点缺失、连续块缺失、持续中断及多种缺失严重程度,该方法在匹配 DP-SGD 设置下插补效用一致优于 ε-prediction 基线。梯度诊断显示裁剪前梯度范数上尾更低、裁剪比例下降,后期低 SNR 时间步衰减更强。
- 动态X @lilianweng
Thinking Machines 发布交互模型
过去几个月,我们经历了很多乐趣(和压力😅),产出了 12 个版本(以及许多子版本)和 137 页的训练运行日志。 事实证明,人与人之间的协作对于改善人机协作很重要。😊
- 动态X @MinLiBuilds
Fable5.2+ 发布预期升温至90%
Fable5.2+ 发布预期近了。 这两天涨到 90%了 看来是真的
- 动态X @AmyPrb
手工答完70+道题
手工答完了全部 70+ 道题——周末的一点小乐趣!
- 动态X @_can1357
Tern 新一期:Git 与 SQLite 块及暗色外观
Tern 下一期: - Git 与 SQLite 块 - 现代化暗色外观
- 动态X @goodside
Claude Opus 5.5 生成 1000 个 matplotlib 图表
1000 个 matplotlib 图表。Claude Opus 5.5
- 动态X @simonw
Simon Willison 即将发表主题演讲
我十分钟后就要上台做主题演讲了!
- 动态X @simonw
Simonw 直播 OpenAI DevDay 主题演讲
我今天在旧金山参加 OpenAI 的 DevDay 活动——和过去三届 DevDay 一样,我在做实时博客,会在主题演讲期间发布更新,演讲五分钟后开始 https://simonwillison.net/2026/Sep/29/openai-devday-2026-live-blog/
- 动态Mistral AI
Mistral AI 发布 Mistral OCR 3
Mistral AI 发布 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上相对 Mistral OCR 2 取得 74% 整体胜率,并已驱动 Mistral AI Studio 中的 Document AI Playground。该模型支持带 HTML 表格重建的 markdown 输出,定价为每 1,000 页 $2,Batch-API 折扣后降至 $1,模型标识为 mistral-ocr-2512,与 Mistral OCR 2 完全向后兼容,并提供自托管选项。
- 动态Mistral AI
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,覆盖办公与编程
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,用同一份订阅覆盖办公与编程,原有对话、设置和套餐全部保留。Vibe 提供 Work Mode 和 Code Mode:前者跨 Google Workspace、Outlook、SharePoint、Slack、GitHub 等连接器执行多步任务,后者在隔离沙箱中运行可并行的远程编程会话,并新增 VS Code 扩展和 CLI 更新。Vibe 已上线 chat.mistral.ai,提供 Free、Pro($14.99/月)、Team($24.99/用户/月)和 Enterprise 四档套餐。
- 动态Mistral AI
Mistral 在 AI Now Summit 2026 发布工业工程 AI 栈、Vibe 智能体与法国 10 MW 数据中心
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 栈,与 Airbus、BMW、ASML 合作优化设计、仿真与生产,并保持对专有数据和 IP 的控制。其智能体工具 Vibe 升级为可处理长周期多步任务,覆盖收件箱与日历整理、深度研究、交付物起草及从需求到合并变更的编码工作。位于法国 Les Ulis 的 10 MW 推理数据中心计划于 2026 年 Q3 启用,以增强算力控制与安全。
- 动态WIRED Security and AI
HCA 与 Palantir 的 AI 排班工具 Timpani 遭护士投诉
美国最大医院连锁 HCA 自 2023 年起在约 190 家院区中的 130 家部署了与 Palantir 联合开发的 AI 排班工具 Timpani,多名护士称其频繁无视排班偏好、在周日等时段安排过少或经验不足的护士,导致人手不足与疲劳。HCA 数据显示 Timpani 平均只把护士申请休假的 1% 排为工作日,但护士表示此前几乎不会出现这种情况。HCA 发言人称最终排班决定由护理管理者而非 Timpani 做出,并否认该工具以牺牲患者护理为代价减少人手。
- 动态新西兰 NCSC(AI 相关)
新西兰 NCSC 调查:多数新西兰人对网络安全态度积极,但对 AI 工具持谨慎态度
新西兰 NCSC 发布的年度国际调查《Oh Behave!》覆盖新西兰、美国、加拿大、德国、英国、澳大利亚和印度共逾6500人,结果显示新西兰人在多个网络安全行为指标上领先受访国家:35%始终备份重要数据、69%"总是"或"经常"检查钓鱼迹象均为最高,仅35%觉得网络安全令人生畏则为最低。同时新西兰人对 AI 工具最为警惕——仅有48%有信心辨别 AI 生成内容、28%愿意向 AI 工具分享敏感工作信息,均为七国中最低,且仅47%信任企业负责任地实施 AI。
- 动态Partnership on AI
GLAAD 报告《Build for Everyone》:AI 系统如何服务所有人
GLAAD 发布首份全面审视 AI 系统对 LGBTQ 群体影响的报告《Build for Everyone》,覆盖基础模型训练、产品部署到内容审核的完整生命周期,并针对开发者、部署方和政策制定者提出建议。该报告指出,训练数据不完整或有偏见会带来准确性问题——例如医疗 AI 将女性刚性关联特定生理指标可能同时误判跨性别女性和绝经后的顺性别女性。GLAAD 主张企业应在模型开发和产品设计早期就让民间社会参与,并提供第三方审计和数据访问,而非事后补救。
- 动态GovAI
Margaret Roberts 与 Jeffrey Ding 谈审查制度对人工智能的影响|GovAI Blog
加州大学圣地亚哥分校政治学副教授 Molly Roberts 在一场 GovAI 活动中报告了她与 Eddie Yang 合作的研究,探讨审查与中国人工智能之间的关系,指出驱动 AI 应用的海量数据会被人为偏见污染并编码进训练数据,进而通过算法放大到面向用户的界面中。牛津大学未来人类研究所研究员 Jeffrey Ding 担任评议人。该工作被视为其审查与人工智能关系研究的开端,此前已有大量研究关注种族与性别偏见于训练数据集中的编码问题。
- 动态Mistral AI
Mistral 联手 Mozilla 将开放私密的多语言 AI 带入浏览器
Mistral 与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现由 Mistral 模型驱动,面向法国和北美用户提供复杂搜索解读、找回点击离开的重要信息和基于浏览器标签页的信息溯源等功能,英国和德国预计于今年晚些时候跟进。该助手的对话默认不保存在 Mozilla 服务器上,且 Mistral 承诺零数据留存,双方还针对地区语言和文化语境进行模型微调。