論文の概要: Vertigo Vertigo: Reconstructing a Cinematic Ideal through its Predictive AI Double
- arxiv url: http://arxiv.org/abs/2607.00047v1
- Date: Mon, 29 Jun 2026 21:50:41 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-02 19:56:07.5935
- Title: Vertigo Vertigo: Reconstructing a Cinematic Ideal through its Predictive AI Double
- Title(参考訳): Vertigo Vertigo:予測AIでシネマティックなアイデアを再構築
- Abstract要約: 私たちは、オリジナル映画のフレームの2.78%しか使っていないヒッチコックの『Vertigo』(1958年)のシーン・フォー・シーンのAI再構成を作成しました。
復元はオリジナルのフィルムと影の間の不安定なオーバーレイとして表現され、視聴者の真正性に対する認識に永続的な疑念を喚起する。
この研究は、生成メディアは映画からのパラダイムシフトではなく、その欲求論理と偽の真偽の加速であると主張している。
- 参考スコア(独自算出の注目度): 0.03437656066916039
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Vertigo Vertigo is a scene-for-scene AI reconstruction of Hitchcock's Vertigo (1958), generated from only 2.78% of the original film's frames. Using this sparse set of keyframe anchors, we perform first-last frame interpolation via a large video diffusion model to predict the intervening sequences. Vertigo is itself a film about the obsessive reconstruction of an artificial ideal; Vertigo Vertigo extends this logic to the material of the film, treating the canonical text as a probe for the normative conventions of classical cinema encoded within generative systems. Evaluated through computational analysis and critical feedback from media theorists (Lev Manovich, Shane Denson, Kevin L. Ferguson), the artifact demonstrates remarkable structural fidelity: 73.1% of frames are recognizable as plausible renditions of Vertigo and only 3.6% fail catastrophically. This fidelity suggests that cinematic norms are deeply compressed within the model's latent priors. Aesthetically, the reconstruction is rendered as an unstable overlay between the original film and its predictive shadow, fueling a persistent doubt in the viewer's perception of authenticity -- a 21st-century vertigo. The work argues that generative media is not a paradigm shift from cinema but an acceleration of its logic of desire and false authenticity, extending from classical Hollywood through to the predictive media environments now reshaping contemporary perception.
- Abstract(参考訳): ヴェルティゴ・ヴェルティゴ』(Vertigo Vertigo)は、1958年に製作されたヒッチコックの『ヴェルティゴ』をAIで再現したシーンである。
この疎いキーフレームアンカーを用いて、大容量ビデオ拡散モデルを用いて第1ラストフレーム補間を行い、干渉列を予測する。
ヴェルティゴ・ヴェルティゴ(Vertigo Vertigo)は、人工的理想の包括的再構築に関する映画であり、この論理を映画の素材に拡張し、カノニカル・テキストを、ジェネレーティブ・システム内で符号化された古典映画の規範的慣習のプローブとして扱う。
計算分析とメディア理論家 (Lev Manovich, Shane Denson, Kevin L. Ferguson) からの批判的なフィードバックによって評価され、このアーティファクトは顕著な構造的忠実さを示している。
この忠実さは、映画的規範がモデルに潜む先行モデルの中で深く圧縮されていることを示唆している。
審美的にも、復元はオリジナル映画と予測的影の間に不安定なオーバーレイとして描かれており、21世紀のめまいである「真正性」に対する観客の認識に永続的な疑念を喚起している。
この研究は、生成メディアは映画からのパラダイムシフトではなく、その欲求論理と偽の真偽の加速であり、古典的ハリウッドから予測的なメディア環境まで、現代的認知を形作るものであると主張している。
関連論文リスト
- Order Matters: LVLMs as Judges for Temporal Reasoning in Image Sequences [0.9841060883971746]
審査員としてのLarge Vision-Language Modelsへの依存は、アーキテクチャ上のバイアスによって根本的に制限されている、と我々は主張する。
モデルが単独のポイントワイドスコアにおいて有能なように見える一方で、時間的順序のペアワイズを行う必要があると破滅的な崩壊を経験する。
これらのバイアスは、因果マスクや回転埋め込みに根ざしている可能性があり、現在のトランスフォーマーベースの判断は、本質的には長めの視覚的推論に不適合であることを示している。
論文 参考訳(メタデータ) (2026-08-11T13:29:03Z) - CineCap: Structured Reasoning with Spatio-Temporal Anchors for Cinematographic Video Captioning [17.457944487441697]
シネマトグラフィーキャプションは、カメラ、ショットサイズ、深度、組成、撮影角度といった映画言語の概念を用いて、ビデオがどのように撮影されるかを記述することを目的としている。
この機能は、微細なビデオ理解と制御可能な映画品質ビデオ生成において重要であるが、既存のマルチモーダルな大規模言語モデルでは未探索である。
CineCapは、構造化推論を原子時間アンカーと組み合わせたフレームワークであり、強化学習を包括性、精度、カバレッジの報酬で行う。
論文 参考訳(メタデータ) (2026-06-23T14:29:40Z) - Scratched Lenses, Shifted Depth: Passive Camera-Side Optical Attacks [10.038300820436776]
Scratch-induced Lens Adversarial Streak Hijacking SLASHは、カメラレンズや保護カバーの小さな傷によって引き起こされる物理的な世界攻撃である。
光空間における攻撃を定式化し、引き金条件の光チャネルとしてスクラッチパターンをモデル化し、様々な視界条件で1つの固定構成を最適化する。
論文 参考訳(メタデータ) (2026-06-12T14:34:53Z) - Recovering Physically Plausible Human-Object Interactions from Monocular Videos [45.8499411765499]
RePHO(RePHO)は、モノクロビデオから物理的に可塑性な人間と物体の相互作用(HOI)を再構築する手法である。
キネマティックな見積もりから始まり、強化学習(RL)による政策の訓練によってそれを洗練する。
キネマティックな推定は一般的にノイズが多いため、単純RLトレーニングは失敗する可能性があるため、二重自己更新機構を備えた適応サンプリング戦略を提案する。
論文 参考訳(メタデータ) (2026-06-03T19:02:48Z) - NarraScore: Bridging Visual Narrative and Musical Dynamics via Hierarchical Affective Control [59.6128550986024]
ナラスコア(NarraScore)は、感情が物語論理の高密度圧縮として働くという中心的な洞察に基づく階層的なフレームワークである。
NarraScoreは、グローバルな構造とローカルなダイナミズムを調和させるために、Dual-Branch Injection戦略を採用している。
NarraScoreは、無視可能な計算オーバーヘッドを伴う最先端の一貫性と物語のアライメントを実現している。
論文 参考訳(メタデータ) (2026-02-09T09:39:42Z) - CreativeVR: Diffusion-Prior-Guided Approach for Structure and Motion Restoration in Generative and Real Videos [17.81372151946937]
CreativeVRはAIGC(AIGC)と、厳格な構造と時間的アーティファクトを備えた実ビデオのための拡散優先のビデオ復元フレームワークである。
我々のDeep-Adapter-based methodは、モデルが入力にどれだけ強く従うかを制御する単一の精度ノブを公開する。
CreativeVRは、厳しいアーティファクトを持つビデオの最先端の結果を達成し、標準的なビデオ復元ベンチマークで競争的に実行します。
論文 参考訳(メタデータ) (2025-12-12T22:03:14Z) - Captain Cinema: Towards Short Movie Generation [66.22442526026215]
我々は、短編映画生成のための世代フレームワークであるキャプテン・シネマを提示する。
我々のアプローチは、物語全体を概説する一連の合成を生成する。
我々のモデルは、インターリーブされたデータペアからなる特別にキュレートされたデータセットで訓練されている。
論文 参考訳(メタデータ) (2025-07-24T17:59:56Z) - Skeletor: Skeletal Transformers for Robust Body-Pose Estimation [45.29710323525548]
ポーズとモーションの両方の分布を教師なしの方法で学習する新しいネットワークを提案します。
Skeletorは2500万フレームで学習し、スケルトン配列をスムーズかつ一貫して修正する。
Skeletorは、人間の3Dポーズ推定の性能を改善し、さらに手話翻訳のような下流タスクの利点を提供する。
論文 参考訳(メタデータ) (2021-04-23T16:56:42Z) - High-Fidelity Neural Human Motion Transfer from Monocular Video [71.75576402562247]
ビデオベースの人間のモーション転送は、ソースモーションに従って人間のビデオアニメーションを作成します。
自然なポーズ依存非剛性変形を伴う高忠実で時間的に一貫性のある人の動き伝達を行う新しい枠組みを提案する。
実験結果では,映像リアリズムの点で最先端を著しく上回っている。
論文 参考訳(メタデータ) (2020-12-20T16:54:38Z) - Human Mesh Recovery from Multiple Shots [85.18244937708356]
疑似地上真理3Dヒューマンメッシュを用いた長期シーケンスの3次元再構築とマイニングの改善のためのフレームワークを提案する。
得られたデータは,様々なメッシュ回復モデルのトレーニングに有用であることを示す。
編集メディアの大規模なライブラリーから3Dコンテンツを処理・分析するための扉を開くツールを開発した。
論文 参考訳(メタデータ) (2020-12-17T18:58:02Z) - PhysCap: Physically Plausible Monocular 3D Motion Capture in Real Time [89.68248627276955]
シングルカラーカメラからのマーカレス3Dモーションキャプチャは、大きな進歩を遂げた。
しかし、これは非常に困難な問題であり、深刻な問題である。
我々はPhysCapについて紹介する。PhysCapは物理的に可塑性でリアルタイムでマーカーのない人間の3Dモーションキャプチャのための最初のアルゴリズムである。
論文 参考訳(メタデータ) (2020-08-20T10:46:32Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。