論文の概要: Knowing When to Trust a Prior: Reliability-Gated Cue Fusion for Video Gaze Prediction
- arxiv url: http://arxiv.org/abs/2610.08663v1
- Date: Tue, 06 Oct 2026 16:46:33 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-08 02:58:30.128265
- Title: Knowing When to Trust a Prior: Reliability-Gated Cue Fusion for Video Gaze Prediction
- Title(参考訳): 事前信頼の時を知る: 映像ゲズ予測のための信頼性保証付きキューフュージョン
- Abstract要約: 我々は、メンバーが棄権する可能性のある、視線のない事前のゲートアンサンブルであるFocusGateを提案する。
フレーム単位のゲートは、デフォーカスマップの3つの形状統計を読み出し、推定器が平均よりも高いフレームを選択する。
解離核融合は映画、スポーツ、ウェブビデオで顕著に陽性であるが、無条件核融合はスポーツでは有害であり、ウェブでは無効である。
- 参考スコア(独自算出の注目度): 11.150781169320375
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Video gaze prediction is led by gaze-trained models, yet gaze-free priors carry signal those models have not absorbed, if one knows when to trust them. We propose FocusGate, a gated ensemble of gaze-free priors whose members may abstain. A per-frame gate reads three shape statistics of a defocus map and selects the frames on which the estimator is above chance on average, so rejected frames reduce to the base exactly, while midrank normalisation lets an all-zero prior abstain at zero parameters. Gated fusion is significantly positive on film, sports and web video, whereas unconditional fusion is harmful on sports and null on web. Added to four supervised predictors, the NTIRE 2026 champion among them, FocusGate improves all sixteen model-domain cells in shuffled AUC, fifteen significantly, one domain pre-registered and scored once, while adding only 1% to the champion's latency. Alone, it surpasses TASED-Net and UNISAL in shuffled AUC on film with a 16-frame causal mean.
- Abstract(参考訳): ビデオの視線予測は、視線訓練されたモデルによって導かれるが、視線なしの事前予測は、そのモデルがいつそれを信頼するかを知れば、吸収されていない信号を伝達する。
我々は、メンバーが棄権する可能性のある、視線のない事前のゲートアンサンブルであるFocusGateを提案する。
フレーム単位のゲートは、デフォーカスマップの3つの形状統計を読み出し、推定器が平均上回っているフレームを選択する。
解離核融合は映画、スポーツ、ウェブビデオで顕著に陽性であるが、無条件核融合はスポーツでは有害であり、ウェブでは無効である。
4つの教師付き予測器に加えて、NETRE 2026のチャンピオンであるFocusGateは、シャッフルされたAUC内の16のモデルドメイン細胞をすべて改善し、15つの大きなドメインが事前登録され、1つのドメインが1回獲得され、チャンピオンのレイテンシは1%に留まった。
単独で16フレームの因果平均でAUCをシャッフルした映画で、TASED-NetとUNISALを上回っている。
関連論文リスト
- Latent Clarity: Bridging World-Model Kinematics to Semantic Manifolds for Video Anomaly Anticipation [0.0]
継続的ビデオ検出は、リアクティブなMIL(Multiple Instance Learning)によって支配され、機能がスコアに分解される。
本稿では,連続的な意味的世界モデルパイプラインであるPULS(Predictive Unified Latent Space)を紹介する。
この翻訳だけで、UCF-Crime のチャンクレベル AUROC は 0.8994 であり、MIL や階層融合のない分布外異常は 0.8162 である。
論文 参考訳(メタデータ) (2026-07-03T18:47:54Z) - A Nationwide Benchmark for Wildfire Initial Attack Failure Prediction with Public Environmental Data [62.031815260604056]
我々は, 火災発見時に利用可能な環境および状況データから, 初期攻撃(IA)障害予測のための米国初の全国規模のベンチマークを提示する。
WILDFIREIAは、自然発生のFPA-FODの山火事を、FIRMS/VIIRS熱検出、グリッドMET気象および消火器変数、LANDFIRE植生、燃料、地形とともに38,128回調整した。
その結果,IA故障予測には,公共の発見時データが有用だが不完全な信号を提供することがわかった。
論文 参考訳(メタデータ) (2026-06-14T01:03:13Z) - Video-Mirai: Autoregressive Video Diffusion Models Need Foresight [28.342670562904445]
因果ビデオジェネレータは過去から予測する必要があるが、そこからのみ学習する必要はない。
しかし、標準的な訓練は、それぞれの因果関係にのみ、現在を説明するよう要求する。
我々は、因果推論を変えることなく、このギャップを埋めるトレーニング専用手法であるVideo-Miraiを紹介する。
論文 参考訳(メタデータ) (2026-06-02T17:55:13Z) - Beyond Denial-of-Service: The Puppeteer's Attack for Fine-Grained Control in Ranking-Based Federated Learning [37.22418291316679]
我々は、ランキングベースのFLフレームワークに合わせた、最初のきめ細かい制御攻撃であるエッジコントロールアタック(ECA)を紹介する。
ECAは平均誤差がわずか0.224%のきめ細かな精度制御を達成し、ベースラインを最大17倍の精度で上回っている。
以上の結果から, 先進的な毒殺攻撃に対する防御強化の必要性が示唆された。
論文 参考訳(メタデータ) (2026-01-21T06:03:11Z) - The Surprising Effectiveness of Membership Inference with Simple N-Gram Coverage [71.8564105095189]
対象モデルからのテキスト出力のみに依存する会員推論攻撃であるN-Gram Coverage Attackを導入する。
我々はまず、N-Gram Coverage Attackが他のブラックボックスメソッドより優れている、様々な既存のベンチマークを実証する。
GPT-4oのような最近のモデルでは、メンバーシップ推論に対するロバスト性が向上していることがわかった。
論文 参考訳(メタデータ) (2025-08-13T08:35:16Z) - Video Prediction Transformers without Recurrence or Convolution [65.93130697098658]
我々は、Gated Transformerを完全にベースとしたフレームワークであるPredFormerを提案する。
本稿では,映像予測の文脈における3次元注意の包括的分析を行う。
精度と効率の両面で大きな改善は、PredFormerの可能性を強調している。
論文 参考訳(メタデータ) (2024-10-07T03:52:06Z) - ReToMe-VA: Recursive Token Merging for Video Diffusion-based Unrestricted Adversarial Attack [71.2286719703198]
ビデオ拡散に基づく非制限アドリアック攻撃(ReToMe-VA)における再帰的トークンマージを提案する。
ReToMe-VAは、空間的非受容性を達成するために、Timestep-wise Adrial Latent Optimization (TALO)戦略を採用する。
ReToMe-VAには、ビデオフレーム間でトークンのマッチングとマージを行うRecursive Token Merging(ReToMe)メカニズムが導入されている。
論文 参考訳(メタデータ) (2024-08-10T08:10:30Z) - Diffence: Fencing Membership Privacy With Diffusion Models [19.682186550192856]
ディープラーニングモデルは、メンバーシップ推論攻撃(MIA)に対して脆弱である
生成モデルを活用することでMIAに対する新たな防御フレームワークを導入する。
当社の防衛はDIFFENCEと呼ばれ、事前推論を行います。
論文 参考訳(メタデータ) (2023-12-07T20:45:09Z) - G$^2$uardFL: Safeguarding Federated Learning Against Backdoor Attacks
through Attributed Client Graph Clustering [116.4277292854053]
Federated Learning (FL)は、データ共有なしで協調的なモデルトレーニングを提供する。
FLはバックドア攻撃に弱いため、有害なモデル重みがシステムの整合性を損なう。
本稿では、悪意のあるクライアントの識別を属性グラフクラスタリング問題として再解釈する保護フレームワークであるG$2$uardFLを提案する。
論文 参考訳(メタデータ) (2023-06-08T07:15:04Z) - Learning to Anticipate Egocentric Actions by Imagination [60.21323541219304]
我々は,エゴセントリックなアクション予測タスクについて検討し,エゴセントリックなビデオの再生に先立って,将来のアクション秒を予測する。
本手法は, EPIC Kitchens Action Precipation Challenge の既視テストセットと未確認テストセットの両方において, 従来手法を有意に上回った。
論文 参考訳(メタデータ) (2021-01-13T08:04:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。