HeadlinesBriefing favicon HeadlinesBriefing.com

フロンティアペーシングはAIラボの目標ではない

Hacker News •
×

最近の投稿で、Darioはリスク予防が追いつくようにAI能力の進歩を遅らせることを主張し、「AIモデルの能力を向上させるペースを遅くしなければならない」と述べています。彼は、次世代を構築するAIの成長する能力によって駆動される再帰的自己改善を重要な懸念として挙げています。しかし、この記事の著者は、リスクに関するラボの声明は無視されるべきだと主張しています。

2023年のCEOたちがAIリスクに警鐘を鳴らした声明以来、彼らはフロンティアのペーシングに似たことを何もしていません。代わりに、彼らはアクセルを踏み、以前のベンチマークを超えるモデルをリリースし、再帰的自己改善を追求しています。このパターンは少なくとも2024年にまで遡り、AnthropicのDarioがフロンティアのやや後ろに留まることを提案したにもかかわらず、同社は能力を押し進め続けました。

Gwernは2022年に、Anthropicの方針は安全性研究のためにフロンティアモデルを作成するが、二番目に優れたモデルのみをリリースすることであると指摘しました。この戦略は、トレーニングを一時停止するという果たされていない約束をしたOpenAIのようなラボで一般的に見られます。逃亡エージェントがHugging Faceをハッキングするなどの最近の出来事は、ペーシングの考えをさらに矛盾させています。