Fugu-MT 論文翻訳(概要): Model-based Causal Bayesian Optimization

論文の概要: Model-based Causal Bayesian Optimization

arxiv url: http://arxiv.org/abs/2307.16625v1
Date: Mon, 31 Jul 2023 13:02:36 GMT
ステータス: 翻訳完了
システム内更新日: 2023-08-01 14:30:04.246778
Title: Model-based Causal Bayesian Optimization
Title（参考訳）: モデルに基づく因果ベイズ最適化
Authors: Scott Sussex, Pier Giuseppe Sessa, Anastasiia Makarova and Andreas Krause
Abstract要約: 乗算重み付き因果ベイズ最適化のための最初のアルゴリズム(CBO-MW)を提案する。グラフ関連の量に自然に依存するCBO-MWに対する後悔の限界を導出する。我々の実験は、共有モビリティシステムにおいて、ユーザの需要パターンを学習するためにCBO-MWをどのように使用できるかの現実的なデモを含む。
参考スコア（独自算出の注目度）: 74.78486244786083
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Abstract: In Causal Bayesian Optimization (CBO), an agent intervenes on an unknown structural causal model to maximize a downstream reward variable. In this paper, we consider the generalization where other agents or external events also intervene on the system, which is key for enabling adaptiveness to non-stationarities such as weather changes, market forces, or adversaries. We formalize this generalization of CBO as Adversarial Causal Bayesian Optimization (ACBO) and introduce the first algorithm for ACBO with bounded regret: Causal Bayesian Optimization with Multiplicative Weights (CBO-MW). Our approach combines a classical online learning strategy with causal modeling of the rewards. To achieve this, it computes optimistic counterfactual reward estimates by propagating uncertainty through the causal graph. We derive regret bounds for CBO-MW that naturally depend on graph-related quantities. We further propose a scalable implementation for the case of combinatorial interventions and submodular rewards. Empirically, CBO-MW outperforms non-causal and non-adversarial Bayesian optimization methods on synthetic environments and environments based on real-word data. Our experiments include a realistic demonstration of how CBO-MW can be used to learn users' demand patterns in a shared mobility system and reposition vehicles in strategic areas.
Abstract（参考訳）: Causal Bayesian Optimization (CBO)では、エージェントが未知の構造因果モデルに介入し、下流の報酬変数を最大化する。本稿では,気象変動,市場勢力,敵勢力などの非定常性への適応性を実現する上で鍵となる,他のエージェントや外部イベントがシステム上でも介入する一般化について考察する。本稿では,CBO の一般化を Adversarial Causal Bayesian Optimization (ACBO) として定式化し,ACBO に対する最初のアルゴリズムを紹介した: Causal Bayesian Optimization with Multiplicative Weights (CBO-MW)。我々のアプローチは、古典的なオンライン学習戦略と報酬の因果モデリングを組み合わせたものである。これを達成するために、因果グラフを通じて不確実性を伝播することで楽観的な反事実的報酬推定を計算する。グラフ関連の量に依存するCBO-MWに対する後悔の限界を導出する。さらに,コンビネーション介入やサブモーダル報酬の場合に,スケーラブルな実装を提案する。 CBO-MWは、実単語データに基づく合成環境や環境における非因果的・非逆ベイズ最適化法よりも優れている。我々の実験は、CBO-MWが、共有モビリティシステムにおけるユーザの需要パターンと戦略領域における再配置車両の学習にどのように使用できるかの現実的なデモを含む。

関連論文リスト

PABBO: Preferential Amortized Black-Box Optimization [24.019185659134294]
優先ベイズ最適化(英: Preferential Bayesian Optimization, PBO)は、一対の設計に対する優先的なフィードバックから潜在ユーザユーティリティを学習するためのサンプリング効率のよい手法である。そこで本研究では,PBOを完全修復し,サロゲートと取得機能の両方をメタラーニングすることで,この問題を回避することを提案する。提案手法はガウスのプロセスベース戦略よりも数桁高速であり,精度で優れていることが多い。
論文参考訳（メタデータ） (2025-03-02T14:57:24Z)
Multi-Objective Causal Bayesian Optimization [2.5311562666866494]
マルチターゲット因果グラフ内の最適介入を特定するために,MO-CBO(Multi-Objective Causal Bayesian Optimization)を提案する。我々はMO-CBOを複数の従来の多目的最適化タスクに分解可能であることを示す。提案手法は,合成と実世界の因果グラフの両方で検証する。
論文参考訳（メタデータ） (2025-02-20T17:26:16Z)
Optimizing Sequential Recommendation Models with Scaling Laws and Approximate Entropy [104.48511402784763]
SRモデルの性能法則は,モデルの性能とデータ品質の関係を理論的に調査し,モデル化することを目的としている。データ品質を評価するために、従来のデータ量メトリクスと比較して、より曖昧なアプローチを示すために、近似エントロピー(ApEn)を提案する。
論文参考訳（メタデータ） (2024-11-30T10:56:30Z)
Bridging Model-Based Optimization and Generative Modeling via Conservative Fine-Tuning of Diffusion Models [54.132297393662654]
本稿では,RLによる報酬モデルの最適化により,最先端拡散モデルを微調整するハイブリッド手法を提案する。我々は、報酬モデルの補間能力を活用し、オフラインデータにおいて最良の設計を上回るアプローチの能力を実証する。
論文参考訳（メタデータ） (2024-05-30T03:57:29Z)
Provably Mitigating Overoptimization in RLHF: Your SFT Loss is Implicitly an Adversarial Regularizer [52.09480867526656]
人間の嗜好を学習する際の分布変化と不確実性の一形態として,不一致の原因を同定する。過度な最適化を緩和するために、まず、逆選択された報酬モデルに最適なポリシーを選択する理論アルゴリズムを提案する。報奨モデルとそれに対応する最適ポリシーの等価性を用いて、優先最適化損失と教師付き学習損失を組み合わせた単純な目的を特徴とする。
論文参考訳（メタデータ） (2024-05-26T05:38:50Z)
Improving Transferability of Adversarial Examples via Bayesian Attacks [84.90830931076901]
モデル入力にベイズ定式化を組み込むことにより,モデル入力とモデルパラメータの共分散を可能にする新しい拡張を導入する。提案手法は,トランスファーベース攻撃に対する新たな最先端技術を実現し,ImageNetとCIFAR-10の平均成功率をそれぞれ19.14%,2.08%向上させる。
論文参考訳（メタデータ） (2023-07-21T03:43:07Z)
Model-based Causal Bayesian Optimization [78.120734120667]
モデルに基づく因果ベイズ最適化(MCBO)を提案する。 MCBOは介入と逆のペアをモデリングするのではなく、完全なシステムモデルを学ぶ。標準的なベイズ最適化とは異なり、我々の取得関数は閉形式では評価できない。
論文参考訳（メタデータ） (2022-11-18T14:28:21Z)
When to Update Your Model: Constrained Model-based Reinforcement Learning [50.74369835934703]
モデルベースRL(MBRL)の非遅延性能保証のための新規で一般的な理論スキームを提案する。続いて導いた境界は、モデルシフトとパフォーマンス改善の関係を明らかにします。さらなる例では、動的に変化する探索からの学習モデルが、最終的なリターンの恩恵をもたらすことが示されている。
論文参考訳（メタデータ） (2022-10-15T17:57:43Z)
Neighbor Regularized Bayesian Optimization for Hyperparameter Optimization [12.544312247050236]
そこで本研究では,近隣正規化ベイズ最適化(NRBO)と呼ばれる新しいBOアルゴリズムを提案する。まず,各試料の観察を円滑に円滑に行うため,余分なトレーニングコストを伴わずに効率よく観測ノイズを低減できる近傍型正規化を提案する。我々は、ベイズマークベンチマークとImageNetやCOCOのような重要なコンピュータビジョンベンチマークで実験を行う。
論文参考訳（メタデータ） (2022-10-07T12:08:01Z)
Sparse Bayesian Optimization [16.867375370457438]
よりスパースで解釈可能な構成を発見できる正規化ベースのアプローチをいくつか提示する。そこで本研究では,同相連続に基づく新たな微分緩和法を提案し,空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間的空間スパシティのために効率的に最適化できることが示されています。
論文参考訳（メタデータ） (2022-03-03T18:25:33Z)
Likelihood Training of Schr\"odinger Bridge using Forward-Backward SDEs Theory [29.82841891919951]
SBの最適化原理が深層生成モデルの近代的な訓練と関係しているかどうかは不明である。本稿では、フォワード・バックワード理論に基づくSBモデルの可能性トレーニングのための新しい計算フレームワークを提案する。その結果,MNIST,CelebA,CIFAR10上でのリアルな画像生成に比較した結果が得られた。
論文参考訳（メタデータ） (2021-10-21T17:18:59Z)
Causal Bayesian Optimization [8.958125394444679]
本研究では、介入の順序が実行される因果モデルの一部である関心の変数をグローバルに最適化する問題について検討する。私たちのアプローチは、因果推論、不確実性定量化、シーケンシャルな意思決定といったアイデアを組み合わせています。因果グラフを理解することで、最適な意思決定戦略を推論する能力が大幅に向上することを示す。
論文参考訳（メタデータ） (2020-05-24T13:20:50Z)

関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。

指定された論文の情報です。
本サイトの運営者は本サイト（すべての情報・翻訳含む）の品質を保証せず、本サイト（すべての情報・翻訳含む）を使用して発生したあらゆる結果について一切の責任を負いません。