論文の概要: Overcoming the Modality Gap in Context-Aided Forecasting
- arxiv url: http://arxiv.org/abs/2603.12451v1
- Date: Thu, 12 Mar 2026 21:05:33 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-03-16 17:38:11.763915
- Title: Overcoming the Modality Gap in Context-Aided Forecasting
- Title(参考訳): コンテキスト支援型予測におけるモダリティギャップの克服
- Abstract要約: 本稿では,時間的力学の記述と数値履歴に相補的な文脈を生成する半合成データ拡張手法を提案する。
このアプローチによって大規模なデータセット生成が可能になり、700万のコンテキスト拡張時系列ウィンドウのコーパスであるCAF-7Mが実現される。
- 参考スコア(独自算出の注目度): 54.976964834365056
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Context-aided forecasting (CAF) holds promise for integrating domain knowledge and forward-looking information, enabling AI systems to surpass traditional statistical methods. However, recent empirical studies reveal a puzzling gap: multimodal models often fail to outperform their unimodal counterparts. We hypothesize that this underperformance stems from poor context quality in existing datasets, as verification is challenging. To address these limitations, we introduce a semi-synthetic data augmentation method that generates contexts both descriptive of temporal dynamics and verifiably complementary to numerical histories. This approach enables massive-scale dataset creation, resulting in CAF-7M, a corpus of 7 million context-augmented time series windows, including a rigorously verified test set. We demonstrate that semi-synthetic pre-training transfers effectively to real-world evaluation, and show clear evidence of context utilization. Our results suggest that dataset quality, rather than architectural limitations, has been the primary bottleneck in context-aided forecasting.
- Abstract(参考訳): コンテキスト支援予測(CAF)は、ドメイン知識と前方視情報を統合することを約束し、AIシステムが従来の統計手法を超えることを可能にする。
しかし、近年の実証研究では、マルチモーダルモデルが不定型モデルよりも優れていることがしばしばあるという、不合理なギャップが明らかになっている。
この過小評価は、検証が難しいため、既存のデータセットのコンテキスト品質が低いことが原因である、という仮説を立てる。
これらの制約に対処するために,時間的ダイナミクスの記述と数値履歴の相補性の両方の文脈を生成する半合成データ拡張手法を提案する。
このアプローチは大規模なデータセット生成を可能にし、厳格に検証されたテストセットを含む700万のコンテキスト拡張時系列ウィンドウのコーパスであるCAF-7Mを実現する。
本研究では,半合成事前学習が実世界の評価に有効であることを示すとともに,文脈利用の明確な証拠を示す。
この結果から,アーキテクチャ上の制約よりもデータセットの品質が,コンテキスト支援予測における主要なボトルネックとなっていることが示唆された。
関連論文リスト
- FrED: External Data Influence Estimation via Domain Knowledge Graph Grounding [3.686386213696443]
ブラックボックス設定で完全に動作する新しい確率的フレームワークを提案する。
本手法は,個々のドメイン固有の知識グラフと連続的特徴類似性を融合する。
我々は,抽象芸術的画像合成と高次元物理天気予報という,2つの異なる領域にまたがる枠組みを評価する。
論文 参考訳(メタデータ) (2026-05-26T15:14:34Z) - Agentic Adversarial QA for Improving Domain-Specific LLMs [53.00642389531106]
大規模言語モデル(LLM)は、しばしば専門分野に効果的に対応するのに苦労する。
本稿では,意味論的課題の集合をコンパクトに生成する逆問題生成フレームワークを提案する。
論文 参考訳(メタデータ) (2026-02-20T10:53:09Z) - UniDiff: A Unified Diffusion Framework for Multimodal Time Series Forecasting [90.47915032778366]
マルチモーダル時系列予測のための統合拡散フレームワークUniDiffを提案する。
コアには統一的で並列な融合モジュールがあり、単一のクロスアテンション機構がタイムスタンプからの構造化情報とテキストからのセマンティックコンテキストを統合する。
8つの領域にわたる実世界のベンチマークデータセットの実験は、提案したUniDiffモデルが最先端のパフォーマンスを達成することを示す。
論文 参考訳(メタデータ) (2025-12-08T05:36:14Z) - When Does Multimodality Lead to Better Time Series Forecasting? [96.26052272121615]
このようなマルチモーダルな統合が常に利益をもたらすかどうか、どのような条件で検討する。
その結果,マルチモーダリティの利点は条件に依存していることが判明した。
我々の研究は、マルチモーダリティが予測タスクに役立つことをいつ予測できるかを理解するための厳密で定量的な基礎を提供する。
論文 参考訳(メタデータ) (2025-06-20T23:55:56Z) - Model-agnostic Mitigation Strategies of Data Imbalance for Regression [0.0]
データ不均衡は、回帰タスクにおいて広範囲にわたる課題として持続し、モデルパフォーマンスのバイアスを導入し、予測信頼性を損なう。
既存のサンプリング手法を構築・改善する高度な緩和手法を提案する。
モデルのアンサンブル(不均衡緩和で訓練されたモデルと、非バランスで訓練されたモデル)の構築は、これらの負の効果を著しく減少させることを実証する。
論文 参考訳(メタデータ) (2025-06-02T09:46:08Z) - SMOTExT: SMOTE meets Large Language Models [19.394116388173885]
本稿では,SMOTE(Synthetic Minority Over-sampling)の概念をテキストデータに適用する新しい手法SMOTExTを提案する。
提案手法は,既存の2つの例のBERTベースの埋め込みを補間することにより,新しい合成例を生成する。
初期の実験では、生成されたデータのみを対象としたトレーニングモデルは、元のデータセットでトレーニングされたモデルと同等のパフォーマンスを達成した。
論文 参考訳(メタデータ) (2025-05-19T17:57:36Z) - Context is Key: A Benchmark for Forecasting with Essential Textual Information [87.3175915185287]
コンテキスト is Key" (CiK) は、数値データを多種多様なテキストコンテキストと組み合わせた予測ベンチマークである。
我々は,統計モデル,時系列基礎モデル,LLMに基づく予測モデルなど,さまざまなアプローチを評価する。
提案手法は,提案するベンチマークにおいて,他の試験手法よりも優れる簡易かつ効果的なLCMプロンプト法である。
論文 参考訳(メタデータ) (2024-10-24T17:56:08Z) - Detecting Multimodal Situations with Insufficient Context and Abstaining from Baseless Predictions [75.45274978665684]
VLU(Vision-Language Understanding)ベンチマークには、提供されたコンテキストによってサポートされない仮定に答えが依存するサンプルが含まれている。
サンプル毎にコンテキストデータを収集し,エビデンスに基づくモデル予測を促進するためにコンテキスト選択モジュールをトレーニングする。
我々は,十分なコンテキストを欠いたサンプルを同定し,モデル精度を向上させる汎用なコンテキスト・アワレ認識検出器を開発した。
論文 参考訳(メタデータ) (2024-05-18T02:21:32Z) - Soundness of Data-Aware Processes with Arithmetic Conditions [8.914271888521652]
データペトリネット(DPN)は、単純さと表現性のバランスをとる能力によって、人気が高まっている。
データと制御フローの相互作用は、そのようなモデルの正しさ、特に音の良さ、決定的かつ困難さの確認を可能にする。
算術データ条件に富んだDPNの音質を評価するための枠組みを提供する。
論文 参考訳(メタデータ) (2022-03-28T14:46:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。