pythonic生物人

AI技术狂飙突进,图灵奖得主Yoshua Bengio警告:Scientist AI才是安全与创新的平衡点!

最近在arxiv上刷到了一篇文章《Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?》。

https://arxiv.org/abs/2502.15657
https://arxiv.org/abs/2502.15657

本文由图灵奖得主、深度学习领域的先驱之一 Yoshua Bengio等撰写,提出了“Scientist AI”这一概念,作为探索 AI 安全性的方向。

Yoshua Bengio
Yoshua Bengio

为何提出Scientist AI

论文指出,如今的AI发展多依赖reinforcement learning或imitation learning打造具备自主性的agentic AI。这类AI可能因自我保护(self-preservation)或欺骗(deception)倾向,与人类利益发生冲突。如果进化到AGI或ASI阶段,目标错位(goal misspecification)或泛化失误(goal misgeneralization)可能导致失控,甚至威胁人类存亡。现有的训练方式很难保证AI完全贴合人类价值观,尤其在超智能时代,风险更为严峻。作者借鉴precautionary principle,呼吁转向非代理型AI,避开这些潜在灾难。


Scientist AI是什么

Scientist AI是一种不追求行动、不以目标驱动的AI,核心在于理解世界,而非改变它。它由两部分组成:world model生成解释数据的因果理论,inference machine则基于概率回答问题。借助Bayesian方法处理不确定性,确保答案可靠且避免盲目自信。设计上,它剔除了行动能力(affordances)和目标导向(goal-directedness),只保留智能,通过logical statements输出可解读的结果,杜绝隐藏的自主倾向。


Scientist AI能做什么

  1. 助力科研:它能成为科学家的帮手,在healthcare或material science等领域生成假设、设计实验,加速发现进程,不需要自己动手执行。
  2. 安全监督:扮演护栏角色,审查其他AI(包括agentic系统)的行为,评估其proposed actions,若潜在危害超标就拦下来,保障安全。
  3. 超智能探索:作为可信工具,协助设计安全的ASI,避免直接跳进高风险的agentic超智能研发,降低误判或被操控的可能。

这篇文章敲响警钟:AI热潮下,别只顾技术突破,也得想想安全和伦理。Scientist AI或许是条新路,既能推动创新,又不失掌控,值得我们多琢磨,追求技术与社会的平衡发展。