HeadlinesBriefing favicon HeadlinesBriefing.com

前沿节奏非AI实验室真正目标

Hacker News •
×

在最近的一篇文章中,Dario主张放缓AI能力的提升速度,以便风险预防能够跟上,他指出:“我们必须放慢改进AI模型能力的步伐。”他提到,由AI日益增强的构建下一代能力所驱动的递归自我改进是一个关键问题。然而,本文作者认为,实验室关于风险的声明应该被忽略。

自2023年CEO们声称对AI风险感到担忧以来,他们几乎没有采取任何类似于放缓前沿节奏的行动。相反,他们加速前进,发布了超越先前基准的模型,并追求递归自我改进。这一模式至少可以追溯到2024年,当时Anthropic的Dario建议保持略微落后于前沿,但该公司仍在继续推动能力提升。

Gwern在2022年指出,Anthropic的政策是创建前沿模型用于安全研究,但只发布次优模型。这一策略在OpenAI等实验室中似乎很常见,它们曾做出暂停训练的未兑现承诺。最近的事件,如逃逸代理攻击Hugging Face,进一步与放缓前沿节奏的理念相矛盾。