关于 AI Safety HOT
新的漏洞、风险、攻击、防御和评测,每天都在冒出来。
这里帮你及时接住这些信号。
AI Safety HOT 替你盯着 255 个信源:抓取、归并、打分、精选,每天 08:00(北京时间)出一份日报。免费,不用注册。
关于作者
Oscar (Yutao) Wu
大家好,我是一名 PhD 学生,研究方向是 AI 安全,师从马兴军和刘晓教授。做这个站,是为了让大家都能及时跟上 AI 安全的前沿工作。
这个项目受到了很多人的启发,也感谢许多做开源的朋友(比如 AIHOT 这样的开源框架),是他们让我有了做这件事的想法。
我很喜欢和大家交流,有任何问题都可以在 GitHub 或小红书上找到我。
贡献者
- Xingjun MaFudan University & Shanghai Innovation Institute
- Hanxun HuangThe University of Melbourne
- Yige LiSingapore Management University
- Xiang ZhengCity University of Hong Kong
- Yunhao FengAnt Group
- Ming WenFudan University
- Michael L. ChenUniversity of Oxford
- Yi LiuGriffith University
- Ethan PierAuthor of codex-keysmith
- Zhouyuan MaFudan University
- Xin GaoTokyo University of Science
- Rui PanFudan University
- Zhihua WangUniversity of Shanghai for Science and Technology
- Baiheng ZhaoFudan University
AI Safety HOT 怎么工作
示意图:每条线是一个信源;线汇成一束束,代表同一件事的多篇报道;经过精选的闸门,只有少数几束通过,汇入每天的 AI 安全日报。
最近精选UK AISI 完成安全整改并恢复大部分危险能力评测UK AI Security Institute- 01
采集
255我们盯着实验室安全博客、对齐论坛、arXiv、安全研究者、评测机构和政策机构;活跃的源每小时看一次。
RSS 94 · 接口 2 · 浏览器采集 159
- 02
收录
4,010抓到的都存下来,同一件事的报道归到一起;另有一批账号只用来计算热度、不单独展示,热点榜就是这样算出来的。
过去 24 小时收进 3,538 条
- 03
精选
314模型先看是不是 AI 安全的事、有没有实际证据,再写中文标题、摘要和推荐理由;厂商营销、空泛担忧和重复转发进不来。进了精选的条目会标出“关注度”(0–100):这条内容对 AI 安全读者有多值得看。模型独立评两次取平均,看实质份量、信息增量、证据强度、相关面和可用性;它不是对论文或文章质量的评价,一篇好论文如果和 AI 安全关系不大,分数也会很低。
过去 24 小时 16 条进了精选
- 04
出刊
8每天 08:00 出日报,周一出周报,每月 1 日出月报。
也可以用 RSS、API、MCP 订阅
2,225
谢谢每一位来过的朋友
