HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI Astraモデルの不透明なループでAI安全専門家懸念

Hacker News •
×

OpenAIの新しいAstraモデルは、The Informationの報道によると、「recurrent depth」、つまり「不透明なループ」と呼ばれる推論技術を使用し、多くの推論モデルで通常使用される順序的思考の外で動作できるようにする。この技術により、モデルの思考チェーンの監視が困難になり、AI安全専門家の間で懸念が高まる。

RedwoodのCEOであるBuck Shlegerisは極度の懸念を表明し、もしOpenAIがこの技術をさらに進めると、「ループを大幅に増加させ、Co Tのモニタリング可能性を完全に破壊する可能性がある」と警告した。長年AI安全の擁護者であるZvi Mowshowitzはこの技術を「火と闘う」と呼び、AIラボ間で「下に向かう競争」を防ぐために法律が必要になるかもしれないと提案した。

通常の状況下では、推論モデルの思考チェーンは不適切な行動のモニタリングのための順序ステップを提供する。不透明なループでは、モデルがクエリをループ内で処理し、読み取り可能な痕跡が減る。しかし、Astraのこの技術の使用は限定的のようで、OpenAIは「neuralese」への転換を提案するのに対し、chief scientistであるJakub Pachockiを通じて、読み取り可能な思考チェーンへのコミットメントを強調している。

The Informationは後に、AnthropicとGoogle Deep Mindがすでにこの技術について議論していると報道した。Redwood Researchのchief scientistであるRyan Greenblattは、不透明な推論が従来の方法よりも速くスケールし、潜在的に可視チャネルからすべての推論を削除する可能性があると警告した。