HeadlinesBriefing favicon HeadlinesBriefing.com

100万エージェント:分散システム問題

Hacker News •
×

私はエージェントについて、人について考えるのと同じように考えます。1つのエージェントは労働者です。1000のエージェントは組織であり、機械の組織は分散システムです。人々はエージェントが永遠に実行できると私に言い続けます。技術的にはそれは真実です。クレジットカードが拒否されるまでモデルをループで呼び出すことができます。しかし、エージェントは依然として有限のものの上で実行されます:トークン、コンテキスト、計算、メモリ、ツール、お金。何かが常に尽きます。人間もそれほど違いません。私たちはしばらく働いて疲れます。私たちの作業記憶は小さいです。私たちは物事を忘れます。だから私たちは重要な部分を書き留め、眠り、翌朝、明晰な頭と同一のアイデンティティで戻ってきます。機械にも同じ制約が異なる形であります。ボックスはCPUを使い果たします。ポッドはメモリを使い果たします。すべてのプロセスが永遠に生きるべきだと仮定して、誰もそれを修正しません。私たちは持っているリソースに対して作業をスケジュールします。なぜ知性が免除されるのかわかりません。エージェントはしばらく働き、重要なことを書き留め、コンテキストをクリアし、自分自身または別のエージェントにそこから引き継がせることができます。私たちはIns ForgeのVPSで独自のコーディングエージェントを実行しており、それらは常に殺され、再起動され、コンテキストを使い果たします。実際に痛い失敗は、計画がエージェントのコンテキストウィンドウ内にのみ存在したものです。

エージェントを追加することは、Google Researchの180構成の研究で並行作業を最大80.9%向上させ、順次作業を39%から70%損なわせました。タスクの形状が決定します。同じ研究で、オーケストレーターはエラー増幅を17.2倍から4.4倍に削減しました。調整は実際の仕事です。Silo-Bench(ACL 2026)では、2から100のエージェントのチームが多く話し、うまく推論しませんでした。最も難しいタスクは50エージェントで成功率ゼロに達しました。したがって、永続的なものは状態であるべきであり、エージェントではありません。エージェントをプロセスのようにスケジュールし、ノードのように回復させてください。

エージェントはプロセスのように見え始めています。これはしばらく前に比喩ではなくなりました。それを構築する研究ライン全体があります。AIOS、Rutgersの「LLMエージェントオペレーティングシステム」は、一文で問題を開きます:「LLMまたはツールリソースへの無制限のアクセスを許可すると、エージェントにとって非効率的または潜在的に有害なリソースの割り当てと利用につながる可能性があります。」彼らの答えはカーネルです。各エージェントリクエストはシステムコールに分解され、スケジューラが次に誰の呼び出しを実行するかを決定し、コンテキストマネージャがタスクの途中でエージェントをスナップショットして、中断と再開を可能にします。彼らは、既存のフレームワーク上に構築されたエージェントを提供する際に、最大2.1倍の高速実行を報告しています。スケジューリング、コンテキストスイッチング、メモリ管理、ストレージ、アクセス制御。それはオペレーティングシステムです。プロセスはたまたま考えるだけです。

それは1レベル上でも報われます。ACL 2026のLLM-as-Schedulerは、ほとんどのクエリが重いマルチエージェントワークフローに値しないという観察から始まり、スケジューラがクエリごとにワークフローを選択できるようにします。彼らは43%少ないトークンと36%以上のエンドツーエンドレイテンシの削減を達成し、強力な固定ワークフローに対して精度が最大1.4パーセントポイント低下しました。したがって、1つのエージェントはプロセスのように見え、数千のプロセスにはスケジューラが必要です。結構です。しかし、計算をスケジュールすることは半分に過ぎません。また、エージェントを互いに調整する必要があり、そこが興味深いところです。10人は調整します。1万人はマネージャーを発明します。10人は部屋で自分たちを調整できます。1000人は全員が互いに話し合い、会社が何をすべきかを独立して決定することはできません。だから私たちはチーム、マネージャー、部門、そして最終的にCEOを発明しました。マネージャーが存在するのは、調整自体が仕事であり、誰かがそれをしなければならないからです。私はエージェントにも同じ問題があると思っていました。今、データがあります。Google ResearchとMITは、5つのアーキテクチャと3つのモデルファミリにわたる180のエージェント構成の対照研究を実施しました。彼らの見出し:「『より多くのエージェント』アプローチはしばしば天井に達し、さらには...」