論文の概要: Camera Artist: A Multi-Agent Framework for Cinematic Language Storytelling Video Generation
- arxiv url: http://arxiv.org/abs/2604.09195v1
- Date: Fri, 10 Apr 2026 10:27:52 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-13 17:57:53.821449
- Title: Camera Artist: A Multi-Agent Framework for Cinematic Language Storytelling Video Generation
- Title(参考訳): カメラアーティスト:シネマティック言語ストーリーテリングビデオ生成のためのマルチエージェントフレームワーク
- Authors: Haobo Hu, Qi Mao, Yuanhang Li, Libiao Jin,
- Abstract要約: 本稿では,現実の映画制作ワークフローをモデル化し,映像言語で物語ビデオを生成するマルチエージェントフレームワークであるCamera Artistを提案する。
カメラ・アーティストは、確立されたエージェント・パイプラインの上に構築され、専用のシネマトグラフィー・ショット・エージェント(Cinematography Shot Agent)を導入している。
- 参考スコア(独自算出の注目度): 4.910318162000904
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We propose Camera Artist, a multi-agent framework that models a real-world filmmaking workflow to generate narrative videos with explicit cinematic language. While recent multi-agent systems have made substantial progress in automating filmmaking workflows from scripts to videos, they often lack explicit mechanisms to structure narrative progression across adjacent shots and deliberate use of cinematic language, resulting in fragmented storytelling and limited filmic quality. To address this, Camera Artist builds upon established agentic pipelines and introduces a dedicated Cinematography Shot Agent, which integrates recursive storyboard generation to strengthen shot-to-shot narrative continuity and cinematic language injection to produce more expressive, film-oriented shot designs. Extensive quantitative and qualitative results demonstrate that our approach consistently outperforms existing baselines in narrative consistency, dynamic expressiveness, and perceived film quality.
- Abstract(参考訳): 本稿では,現実の映画制作ワークフローをモデル化し,映像言語で物語ビデオを生成するマルチエージェントフレームワークであるCamera Artistを提案する。
近年のマルチエージェントシステムは、スクリプトからビデオまで、映画制作ワークフローの自動化に大きな進歩を遂げているが、隣接するシーン間での物語の進行を構造化する明確なメカニズムが欠如しており、ストーリーテリングが断片化し、映画品質が制限される。
これを解決するために、カメラ・アーティスツは確立したエージェント・パイプラインを構築し、再帰的なストーリーボード生成を統合し、ショット・ツー・ショットの連続性と撮影言語注入を強化し、より表現力のある映画指向のショットデザインを作成する、専用のシネマトグラフィー・ショット・エージェントを導入した。
その結果,本手法は,物語の一貫性,動的表現性,知覚されたフィルム品質において,既存のベースラインを一貫して上回っていることが明らかとなった。
関連論文リスト
- The Script is All You Need: An Agentic Framework for Long-Horizon Dialogue-to-Cinematic Video Generation [95.18045807704284]
対話・シネマティック・ビデオ生成のためのエンドツーエンドのエージェント・フレームワークを提案する。
ScripterAgentは粗い対話を微粒で実行可能なシネマティックスクリプトに変換するように訓練されている。
本フレームワークは,テスト対象のすべてのビデオモデルに対して,スクリプトの忠実度と時間的忠実度を大幅に向上させる。
論文 参考訳(メタデータ) (2026-01-25T08:10:28Z) - Can video generation replace cinematographers? Research on the cinematic language of generated video [31.0131670022777]
本稿では,テキスト・ツー・ビデオ(T2V)モデルにおける撮影制御を改善するための3つのアプローチを提案する。
まず,20のサブカテゴリ,ショットフレーミング,ショットアングル,カメラの動きを網羅した,微妙な注釈付き映画言語データセットを紹介する。
第二に、カメラディフ(CameraDiff)は、ロラを精度よく安定した撮影制御に利用し、フレキシブルショット生成を確実にする。
第3に,撮影アライメントの評価とマルチショット合成のガイドを目的としたCameraCLIPを提案する。
論文 参考訳(メタデータ) (2024-12-16T09:02:24Z) - StoryAgent: Customized Storytelling Video Generation via Multi-Agent Collaboration [88.94832383850533]
CSVG(Customized Storytelling Video Generation)のためのマルチエージェントフレームワークを提案する。
StoryAgentはCSVGを特殊エージェントに割り当てられた個別のサブタスクに分解し、プロの制作プロセスを反映する。
具体的には、撮影時間内整合性を高めるために、カスタマイズされたイメージ・ツー・ビデオ(I2V)手法であるLoRA-BEを導入する。
コントリビューションには、ビデオ生成タスクのための汎用フレームワークであるStoryAgentの導入や、プロタゴニストの一貫性を維持するための新しい技術が含まれている。
論文 参考訳(メタデータ) (2024-11-07T18:00:33Z) - MovieDreamer: Hierarchical Generation for Coherent Long Visual Sequence [62.72540590546812]
MovieDreamerは、自己回帰モデルの強みと拡散ベースのレンダリングを統合する、新しい階層的なフレームワークである。
様々な映画ジャンルにまたがって実験を行い、そのアプローチが優れた視覚的・物語的品質を実現することを示す。
論文 参考訳(メタデータ) (2024-07-23T17:17:05Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。