論文の概要: DramaChain Bench: An End-to-End Benchmark for Short-Drama Generation
- arxiv url: http://arxiv.org/abs/2609.00646v1
- Date: Tue, 01 Sep 2026 03:23:45 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-02 16:31:36.267457
- Title: DramaChain Bench: An End-to-End Benchmark for Short-Drama Generation
- Title(参考訳): DramaChain Bench:ショートドラマ生成のためのエンドツーエンドベンチマーク
- Authors: Haoyuan Shi, Mingtao Chen, Shuo Jiang, Ziyan Chen, Xuyi Sheng, Yiming Liu, Ying Zhang, Miao Wang, Jianxiang Lu, Fanyang Lu, Songyuanyi Lu, Xiele Wu, Zhichao Hu, Yuhong Liu, Richeng Xuan,
- Abstract要約: DramaChain Benchは、完全なプロダクションチェーンのすべてのステージを評価する最初のショートドラマベンチマークである。
1次元システムDramaChain Dimensionsを共有する3つの社内システム上に構築されている。
- 参考スコア(独自算出の注目度): 20.53004165750949
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Commercial short-drama production follows a multi-stage chain: script, storyboard, keyframe imagery, shot-level video, and the finished short drama. Most existing benchmarks evaluate solely the video-generation stage using pre-authored inputs instead of real upstream pipeline outputs. This leaves two critical questions unanswerable: whether each stage adheres to the original script intent (rather than only its immediate input prompt), and whether disparate shots remain coherent after assembly into multi-episode releases. We present DramaChain Bench, the first short-drama benchmark that evaluates every stage of the complete production chain. It is built upon three in-house systems sharing one dimension system, DramaChain Dimensions: five evaluation axes instantiated at every stage, resolving into 63 leaf dimensions. DramaChain Agent is calibrated against commercial short-drama platforms in both workflow and finished short-drama quality, enabling stage-wise fair comparison across models. DramaChain Labeling System has each of the 5,785 items scored independently by three professional annotators, with all defects spatio-temporally localised and selected from a predefined defect list. This process produces 17,488 valid scores and 255,925 traceable attribution records. The human annotations confirm that upstream defects cascade across the pipeline, demonstrating that final episode quality is not governed by video generation alone. DramaChain Agentic Judge then scores every leaf dimension automatically, gathering evidence over multiple agentic rounds before judging against a per-item checklist; it reproduces the model ranking at a mean PLCC of 0.918, enough to admit new models at no annotation cost.
- Abstract(参考訳): 商業的なショートドラマプロダクションは、脚本、ストーリーボード、キーフレームイメージ、ショットレベルのビデオ、そして完成したショートドラマという、多段階のチェーンに従っている。
既存のベンチマークのほとんどは、実際のアップストリームパイプライン出力の代わりに、事前に認可された入力を使用して、ビデオ生成ステージのみを評価する。
これは、2つの重要な疑問を残している: 各ステージがオリジナルの脚本の意図に固執するかどうか(即時的なインプットプロンプトよりむしろ)、そして、異なるショットが複数のエピソードのリリースに組み立てられた後も一貫性が保たれているかどうかである。
DramaChain Benchは、完全な生産チェーンのすべてのステージを評価する最初のショートドラマベンチマークです。
1次元システムDramaChain Dimensions: 各段階でインスタンス化された5つの評価軸を63個の葉の次元に分解する。
DramaChain Agentは、ワークフローと完了したショートドラマ品質の両方において、商用のショートドラマプラットフォームに対して調整されており、モデル間のステージワイドな比較を可能にする。
DramaChain Labeling Systemには、3つのプロのアノテータが独立して収集した5,785項目があり、すべての欠陥は時間的局所化され、事前に定義された欠陥リストから選択される。
このプロセスは17,488の有効なスコアと255,925のトレース可能な属性記録を生成する。
人間のアノテーションは、パイプライン全体で上流の欠陥がカスケードであることを確認し、最終エピソードの品質はビデオ生成だけでは管理されないことを示した。
ドラマチェインエージェントジャッジは、すべてのリーフディメンションを自動的にスコアし、各項目ごとのチェックリストを判定する前に複数のエージェントラウンドにエビデンスを収集する。
関連論文リスト
- DramaDirector: Geometry-Guided Short Drama Generation [51.430988173490384]
本研究では,プロット・トゥ・ショート・ドラマ生成について検討し,プロット・トゥ・ショート・ドラマ生成において,グローバル・プロットとローカル・コンテクストを視覚的にグラウンド化されたマルチショット・ビデオに変換する。
そこで,本研究では,映像ギャラリーから映像幾何学を借用可能な幾何学的枠組みであるDramaDirectorを提案する。
また、35のライブアクションドラマ、2.8Kエピソード、81Kショットで作られたベンチマークであるDramaBoardを紹介します。
論文 参考訳(メタデータ) (2026-06-23T03:50:28Z) - Crayotter: Traceable Multi-Agent Workflows for Long-Form Video Editing [18.640980775340637]
Crayotterは、プロンプト駆動のビデオ編集のためのオープンソースのマルチモーダルマルチエージェントシステムである。
Crayotterは、カバレッジ対応の素材準備、アーティファクトベースの編集研究、ツールグラウンドのタイムライン実行という3つのフェーズで構成されている。
論文 参考訳(メタデータ) (2026-05-31T14:07:57Z) - One Sentence, One Drama: Personalized Short-Form Drama Generation via Multi-Agent Systems [17.754369892506542]
One Sentence, One Dramaは階層的なマルチエージェントフレームワークで、ユーザの単一文のアイデアを完全な短編ドラマに変換する。
提案手法は,(1)ショートドラマのパッシングと物語のコヒーレンスを強制するマルチエージェントの議論ベースのストーリー生成モジュール,(2)一貫したキャラクタの位置決めとシーンレイアウトのための共有空間参照を確立する3次元1フレーム生成機構,(3)包括的エラー検出とスクリプト,視覚,映像生成ステージ間のターゲットリビジョンを行うマルチステージレビュアループの3つの主要な構成要素に基づいて構築されている。
論文 参考訳(メタデータ) (2026-05-21T08:15:46Z) - Soap2Soap: Long Cinematic Video Remaking via Multi-Agent Collaboration [61.98029663481308]
Soap2SoapはDualBridgeメカニズムを通じて長期の視覚的一貫性を強制するマルチエージェントフレームワークである。
クローズドループ検証エージェントは、識別、安定性、アライメントを監査し、選択的再生を誘導する。
論文 参考訳(メタデータ) (2026-05-17T12:38:21Z) - Agentic Video Generation: From Text to Executable Event Graphs via Tool-Constrained LLM Planning [4.964902130083661]
既存のマルチエージェントビデオ生成システムは、LLMエージェントを使用してニューラルビデオジェネレータをオーケストレーションする。
本稿では,このパラダイムを逆転させ,空間と時間におけるイベントの形式的なグラフを構築するエージェントシステムを提案する。
プログラム状態バックエンドは、検証済みのツールコールを通じてすべてのシミュレータの制約を強制し、生成されたすべての仕様が実行可能であることを保証します。
論文 参考訳(メタデータ) (2026-04-11T23:51:13Z) - DramaBench: A Six-Dimensional Evaluation Framework for Drama Script Continuation [3.496854427764583]
ドラマスクリプトの継続には、キャラクターの一貫性を維持し、プロットを忠実に前進させ、劇的な構造能力を維持するモデルが必要である。
6次元にわたるドラマ脚本の連続性を評価するための,最初の大規模ベンチマークであるDramaBenchを紹介する。
論文 参考訳(メタデータ) (2025-12-22T04:03:01Z) - VideoGen-of-Thought: Step-by-step generating multi-shot video with minimal manual intervention [70.61101071902596]
現在のビデオ生成モデルは短いクリップで優れているが、解離した視覚力学と破折したストーリーラインのため、凝集性のある複数ショットの物語を生成できない。
一つの文から複数ショットのビデオ合成を自動化する,ステップバイステップのフレームワークであるVideoGen-of-Thought (VGoT)を紹介した。
VGoTは、ショット内の顔の一貫性が20.4%、スタイルの一貫性が17.4%向上するマルチショットビデオを生成する。
論文 参考訳(メタデータ) (2025-03-19T11:59:14Z) - VideoGen-of-Thought: Step-by-step generating multi-shot video with minimal manual intervention [76.3175166538482]
VideoGen-of-Thought(VGoT)は、単一の文から複数ショットのビデオ合成を自動化するステップバイステップのフレームワークである。
VGoTは、ナラティブな断片化、視覚的不整合、トランジションアーティファクトの3つの課題に対処する。
トレーニング不要のパイプラインで組み合わせられたVGoTは、ショット内面の一貫性が20.4%、スタイルの一貫性が17.4%向上した。
論文 参考訳(メタデータ) (2024-12-03T08:33:50Z) - Perception Test: A Diagnostic Benchmark for Multimodal Video Models [78.64546291816117]
本稿では,事前学習したマルチモーダルモデルの知覚と推論能力を評価するために,新しいマルチモーダルビデオベンチマークを提案する。
知覚テストは、スキル(記憶、抽象化、物理学、セマンティックス)と、ビデオ、オーディオ、テキストモダリティ間の推論(記述的、説明的、予測的、反ファクト的)のタイプに焦点を当てている。
このベンチマークは、ゼロショット/少数ショットまたは限定的な微調整方式で、転送機能の事前訓練されたモデルを探索する。
論文 参考訳(メタデータ) (2023-05-23T07:54:37Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。