HeadlinesBriefing favicon HeadlinesBriefing.com

AIビデオ共同ディレクター:自動化

Google AI Blog •
×

最近のビデオ拡散の進歩は、顕著な高忠実度生成を示していますが、クリップを一貫した長編ストーリーテリングエンジンに変換することは依然として困難です。既存のエージェントパイプラインのほとんどは、独立した手作りのプロンプトによる意味的ドリフトとカスケード障害に悩まされており、しばしば徹底的な手動介入を必要とします。既存の方法はまた、特徴ドリフトとコンテンツ崩壊に直面しています。

本日、私たちはAIビデオ共同ディレクターに関する研究を紹介します。これは、マルチショットの物語における視覚的連続性を明示的に計画する統一されたマルチエージェントフレームワークです。GeminiとVeoの上にオーケストレーションレイヤーとして構築され、このフレームワークはSynth IDウォーターマーキングなどの安全メカニズムをネイティブに継承しています。私たちは、Co-Director(COLM 2026で発表予定)、CANVAS(EMNLP 2026で発表予定)、A²RD、VQQAというフレームワークを開発しました。これらは、高レベルの人間の創造的仕様を実行に変換します。

これらのフレームワークは、視覚的連続性を維持する負担を抽象化する応答性の高い創造的パートナーとして機能します。包括的な評価を通じて、私たちのフレームワークはマルチショットの物語の一貫性とキャラクターの持続性において実質的な向上を示し、視覚的ドリフトとパイプラインエラーの伝播を軽減しながら、数分間のビデオを正常に生成します。

意味的整合性を確保するために、AIビデオ共同ディレクターを提示します。これは、ビデオストーリーテリングをグローバル最適化問題として形式化する階層的マルチエージェントフレームワークです。このトップダウンのステアリングにより、パイプライン全体が統一されたビジョンの下で動作し、構造化されたプロンプトをGeminiとVeoモデルに供給します。

主要エンティティ:企業:Google