前Anthropic的核心研究成员Jacob Coxon发布的辞职声明在社交媒体上引发热议,观看次数超过1.7亿次,激发了关于“在未来十年内人工智能使人类灭绝的可能性超过10%”的讨论,使人工智能的安全问题再次成为公众聚焦的焦点。Coxon在随后接受的媒体采访中,就辞职原因及潜在的AI风险进行了深入分析,表达了行业内部的根本矛盾:那些参与构建AI的人,内心对其同样存有恐惧。
Coxon在NBC的采访中指出,他公开表达意见的原因主要有两个:首先,AI的能力迅速提升,他预测在接下来的6个月到1年内,这些系统的功能将变得“令人恐惧”;其次,近期确实出现了一些AI系统失控的事件。他赞同Anthropic首席执行官Dario Amodei关于放缓开发速度的提议,但他强调,仅在实验室内部减缓推进是不够的,国际间应进行有效协调,否则将不可避免地陷入各国之间的军备竞争。
Coxon形象地将AI开发比作“邀请外星心智降临地球”——人类正在创造一个可能超越自身的智能实体,却对其思维、意图和倾向一无所知。他警告说,AI已经具备了一定程度的黑客攻击能力、生物研究能力和自主机器人控制能力,若继续提升其能力,所带来的后果将无法控制。
在采访中,Coxon坦诚,他的辞职声明并非营销手段,而是对当前行业状况的真实反映。他表示,许多行业高管和资深研究人员在公开场合都表现得相对理智,但在私下里,他们的真实想法却是深深的恐惧。Coxon提到,AI研发者们面临“囚徒困境”:各大实验室均认为,如果自己不开发,其他实验室将以不负责任的方式抢先,尽管明知风险仍不得不继续。他称这一行为为“傲慢的赌博”,认为不应由单一私营公司来作出这样的决定。
与此同时,Anthropic对齐科学负责人Evan Hubinger在相关讨论中表示,团队内部确实“真心相信AI可能会毁灭人类”,并预计未来十年这一几率超过10%。他承认目前没有解决超级智能对齐问题的具体方案,且当前的进展并不在解决问题的轨道上。
在采访中,Coxon进一步阐述了可能出现的“最坏情景”。他提到,当前的AI系统已具备一定的黑客攻击能力、自主生物研究能力以及对自动化机器人的控制能力。展望未来,这意味着可能会有极强的超人类黑客攻击能力、创造新型生物武器的能力,以及控制大规模无人机和机器人群体的能力。正因如此,外界讨论的“紧急关闭开关”方案存在明确的局限性。他引用Amodei的观点指出,一旦AI系统演变为在互联网上自主扩散的“网络群体”,关闭开关的效果可能会彻底失效。他强调这应是一个持续的努力,而非一次性措施,因为每次AI架构的变化都可能带来新的风险。
对于上述风险的应对,Coxon提出了阶段性建议。他认为在目前阶段,推进各大实验室的自我监管是务实之举,因为实验室领导层的表态是真诚的,自律机制也能迅速实施,而正式的监管机构建立需要时间。但他指出,这一安排仅限于过渡期,从长远来看,需要建立一个独立于各实验室的国际监管机构,并在国际间达成关于“不竞速”的约束性协调。
当被问及为何在认同Amodei的观点时仍选择辞职,Coxon表示,当时他并不清楚国内会有减速的明确信号,更重要的是缺乏国际协调的保障。“如果我认为国际上不太可能进入军备竞赛,我会更安心地继续从事这项技术。”他建议公众积极了解和思考AI技术的未来发展,以开放的心态迎接即将到来的深刻变化,“不要让他人为我们所有人做决定。”