Yoshua Bengio· Yoshua Bengio·2024-02-27 03:24· 2024-02-27Yoshua Bengio 提出“谨慎科学家 AI”与收敛安全边界Towards a Cautious Scientist AI with Convergent Safety BoundsAI 导读Yoshua Bengio 提出“谨慎科学家 AI”研究议程,主张在达到 AGI 前先解决 AI 控制与对齐问题,并追求可证明安全的 AGI。他指出最大似然与 RL 会隐式锁定单一解释假设、忽略其他与数据相容的假设,因此需要贝叶斯式的不确定性建模,使算力与算法效率提升能带来更强的安全保证。阅读原文yoshuabengio.org#对齐#观点/讨论#AI 控制