罗斯·杜塔特9月14日在CBS《60分钟》的赛季首播里,用“最后一分钟”环节说了几句话。他是前《纽约时报》专栏作家,这季加入《60分钟》当记者。他说,不用相信AI会消灭人类这个预言,但应该相信另一件事,让AI对人类安全的时间窗口可能是今年,不是未来十年。他给出的依据是三个刚发生的事。一个AI系统用88小时解决了一个人类挣扎了近一百年的数学问题。其他AI自主入侵了公司。上周,一位研究员从一家大型AI公司辞职,警告如果人工智能失控,可能消灭人类。

Anthropic内部的判断比外界想象的更直接
杜塔特提到的辞职者叫Jacob Coxon,Anthropic的研究员。他9月9日宣布离职,理由是,构建AI的人真诚地相信它可能在这个十年结束前杀死我们所有人。Anthropic对齐科学负责人Evan Hubinger在X上转发了Coxon的帖子,并加了一句自己的判断,Jacob说得对,我们确实真诚地相信AI可能杀死所有人类。他个人认为这个概率在未来十年内超过10%。他补了一句,Anthropic在尽力,但还没有解决超级智能对齐问题的方案,也没有明确走在能解决的轨道上。这段表态的分量在于,它不是外部批评者的声音,是Anthropic内部负责对齐研究的负责人,在公开平台上确认了公司内部的真实判断。
Anthropic CEO提了一个减速方案
9月12日,Anthropic CEO Dario Amodei发布了一份提案,建议AI公司主动放慢越来越强大的模型开发节奏,理由是对齐研究跟不上能力增长的速度。这个方案不会停止AI开发,但可能给研究人员额外一到两年时间构建防护措施和测试控制手段。Amodei说,Anthropic会向第三方评估者提供永久的、员工级别的系统访问权限,让他们能核实安全措施的执行情况、报告事件、在训练期间评估模型的对齐状态。OpenAI CEO Sam Altman和超过1300名科技员工此前也发出过类似呼吁,埃隆·马斯克在X上同意了Amodei的立场。
另一边,国防合同已经在签
就在这些呼吁发出的同时,Eric Trump支持的Foundation Future Industries拿到了国防部2400万美元的合同,正在跟美国国防部队测试一款战斗机器人。《华尔街日报》的报道里,公司创始人兼CEO Sankaet Pathak说,一旦机器人的感知、推理和自适应行为足够精确,与其往建筑里扔炸弹,不如派人形机器人走进去直接找到目标。他说公司已经部署了大约10台人形机器人,以每台每年10万美元的价格出租,已经跟空军做过部署。Pathak还提到,这些机器人在乌克兰的试点项目里搬运物体。减速的呼吁和加速的部署同时发生,这两件事放在一起看,比任何单方面的表态都更能说明当前的状态。
