做一道数学题:已知前方是悬崖,需要用什么样的速度和姿势才能第一个抵达?
Jacob
@hilbertspaess Anthropic 离职已经发酵36个小时了,大家纷纷在线分摊恐惧,但 Anthropic 对齐科学负责人 Evan Hubinger
@EvanHub 回应让重锤落地。
他直接认同了 Jacob 的说法:
真正参与构建 AI 的人,确实相信 AI 有可能杀死所有人。
Evan 甚至给出自己的判断:未来十年内,这件事发生的概率超过 10%。
他也强调,目前的模型风险仍然较低。真正令他担忧的,是通过递归式自我改进出现的超级智能——而它的发展速度已经快于此前的预期。
即使
@AnthropicAI 正在尽力,他们目前依然没有解决超级智能对齐问题的方案,甚至不能确定自己正走在正确的轨道上。
这不是外界的危言耸听或营销话术,而是站在最前沿、亲手推动技术发展的人,对自己正在创造之物作出的判断。
尽管恐惧,他们却没有停下脚步。
如果连创造它的人都知道前方可能是毁灭,为什么所有人还是会一如既往地向前?