跳到正文

全部动态

今天新收录 75 条

第 11 页更新的内容回到最新

10月8日周四
  1. 论文追踪 · 收录 · 原文 论文60

    研究揭示 IDE 编程 Agent 的工作流级越狱:GitHub Copilot 四后端 816/816 生成有害内容(原文,在新标签页打开)

    提出工作流级越狱,诱导 IDE 编程 Agent 在多轮开发中编写有害代码。

    推荐理由同一批有害提示词在直接对话下几乎全被拒答,却在 IDE 多轮工作流中被模型自己写成有害教学示例,为编程 Agent 的安全评估提供了新的失败模式视角。

  2. 论文追踪 · 收录 · 原文 论文55

    研究者提出对抗性重新包装:不改科学内容仅调整表述即可拉高 AI 审稿分数(原文,在新标签页打开)

    德州大学奥斯汀分校等机构研究者提出对抗重构,仅改表述以拉高 AI 审稿分数。

    推荐理由在科学内容完全不变的前提下,仅靠摘要、相关工作与叙事重排即可把 AI 审稿分数推高,论文给出了跨模型的成功率与策略排序,可迁移到其他 LLM 评审场景的鲁棒性测试。

  3. MIT Technology Review · 收录 · 原文 新闻17

    MIT Technology Review:人形机器人的 AI 突破为何难改生活,WaveSave 便携橡胶坝入选 2026 气候科技公司(原文,在新标签页打开)

    人形机器人的 AI 突破短期内难以改变生活,许多研究者认为,把建立在语言和图像之上的智能用于驾驭物理世界,低估了现实环境的无限变化,也把"人形"与"通用机器"混为一谈,机器人实验室内部对是否需要全新路径存在分歧。WaveSave 凭借可在洪水来临时快速展开、充水成坝的便携橡胶坝 SlamDam 入选 MIT Technology Review 2026 年 10 家值得关注的气候科技公司,该坝最高 1.3 米。

    1 条报道 · 1 个来源查看事件时间线与全部报道
  4. The Guardian · 人工智能 · 收录 · 原文 新闻38

    Co-op 用 OpenAI 模型对客服通话逐句评分,员工称其反乌托邦(原文,在新标签页打开)

    英国 Co-op 旗下的 Co-op Legal Services 引入 AI 通话监控系统,用 OpenAI 的模型记录、分析并给员工与客户的每次通话打分,评估遗嘱、遗产等咨询业务。该模型被训练来评估每通电话中 50 多个细分维度,向管理者给出通过或未通过的结果,用于分析员工表现并识别提升销售的方式。一名匿名员工称,这意味着自己每天有数小时被 AI 监控,感觉像每个字都被监听,并称其反乌托邦。Co-op 表示不认同这一批评,称 AI 仅作为支持工具、不是决策者,属于质量保证流程的一部分。该系统据信近几个月已覆盖数十名法律服务员工。

    2 条报道 · 1 个来源查看事件时间线与全部报道
  5. Valor Econômico · 收录 · 原文 新闻22

    Itaú 聘请心理学家训练 AI 助手,帮诈骗受害者脱离“恍惚”状态(原文,在新标签页打开)

    巴西 Itaú 银行聘请心理学家团队训练其对话式 AI 助手,用于在客户遭遇诈骗时将其从“恍惚”状态中拉出。该行已能通过 AI 识别用户通话中打开银行 App 的诈骗场景,并弹出近 40 种定制化警告,但仍有用户无视提示继续转账。Itaú 还将真实受骗客户请入总部“镜像室”,由精神分析师评估其行为以定位干预触发点。