論文の概要: Practical Marketplace Optimization at Uber Using Causally-Informed Machine Learning
- arxiv url: http://arxiv.org/abs/2407.19078v1
- Date: Fri, 26 Jul 2024 20:51:37 GMT
- ステータス: 翻訳完了
- システム内更新日: 2024-07-30 20:02:28.865596
- Title: Practical Marketplace Optimization at Uber Using Causally-Informed Machine Learning
- Title(参考訳): Causally-Informed Machine Learning を用いたUberのマーケットプレース最適化
- Abstract要約: 都市の予算決定を自動化するため,エンド・ツー・エンドの機械学習と最適化手法を導入する。
S-Learnerと新しいテンソルB-Spline回帰モデルに基づく最先端ディープラーニング(DL)を提案する。
我々はADMMと原始双対内点凸最適化を用いて高次元最適化を行い、Uberの資源配分効率を大幅に改善した。
- 参考スコア(独自算出の注目度): 8.051164005088983
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Budget allocation of marketplace levers, such as incentives for drivers and promotions for riders, has long been a technical and business challenge at Uber; understanding lever budget changes' impact and estimating cost efficiency to achieve predefined budgets is crucial, with the goal of optimal allocations that maximize business value; we introduce an end-to-end machine learning and optimization procedure to automate budget decision-making for cities, relying on feature store, model training and serving, optimizers, and backtesting; proposing state-of-the-art deep learning (DL) estimator based on S-Learner and a novel tensor B-Spline regression model, we solve high-dimensional optimization with ADMM and primal-dual interior point convex optimization, substantially improving Uber's resource allocation efficiency.
- Abstract(参考訳): ドライバーのインセンティブやライダーのプロモーションといったマーケットプレースレバーの予算配分は、長年Uberの技術的・ビジネス上の課題であり、レバーの予算変更の影響を理解し、ビジネス価値を最大化する最適なアロケーションを目標としてコスト効率を見積もっていること、機能ストア、モデルトレーニング、サービス、オプティマイザ、バックテストに依存する都市での予算決定を自動化するためのエンドツーエンドの機械学習と最適化手順を導入すること、S-Learnerと新しいテンソルB-Spline回帰モデルに基づく最先端のディープラーニング(DL)推定器を提案すること、ADMMとプリミティブインテリア・ポイント・コンベックスによる高次元の最適化、Uberのリソース確保を大幅に改善すること、などである。
関連論文リスト
- Decision-Driven Regularization: A Blended Model for Learning and Optimization [1.4055982190455338]
学習と最適化のアプローチについて検討し、まず特徴から結果がどう影響するかを学習し、次にこれらの結果に基づいて最適な決定を選択する。
本稿では, 予測精度とコスト最小化のバランスを保ち, 決定駆動正規化(Deciciment-driven regularization)と呼ばれる二目的定式化を提案する。
論文 参考訳(メタデータ) (2026-08-15T08:49:33Z) - Autocorrelated Optimize-via-Estimate: Predict-then-Optimize versus Finite-sample Optimal [2.0228793142608588]
有限サンプル体制におけるアウト・オブ・サンプル性能を直接最適化するモデルは、従来の見積もりを最適化するアプローチに代わる有望な選択肢として現れてきた。
自動相関不確実性(特にベクトル自己回帰移動平均VARMA(p,q)プロセス)の文脈での性能を比較する。
論文 参考訳(メタデータ) (2026-02-02T09:49:51Z) - Accelerating Fleet Upgrade Decisions with Machine-Learning Enhanced Optimization [0.0]
レンタルベースのビジネスモデルとサステナビリティ要件の増大は、大規模なマシンおよび車両の更新とアップグレードを管理するための効率的な戦略の必要性を高める。
従来のフリート最適化はアップグレードオプションを考慮せず、指数関数的なランタイムスケーリングを備えた整数プログラミングに基づいている。
この貢献はまず、最適な更新とアップグレードの決定を決定する拡張整数プログラミングアプローチを提案する。
計算負荷は、タスクを混合離散連続最適化問題に変換する第2の機械学習ベースの方法によって対処される。
論文 参考訳(メタデータ) (2025-07-29T20:44:27Z) - Heterogeneous Causal Learning for Optimizing Aggregated Functions in User Growth [0.7100520098029438]
本稿では,ユーザ成長マーケティングを強化するために,新しい処理効果最適化手法を提案する。
ディープラーニングを活用することで,過去の実験から学習し,ユーザの選択と報酬配分を最適化する。
提案した制約付きおよび直接最適化アルゴリズムは,最先端の手法よりも20%以上優れた性能を示した。
論文 参考訳(メタデータ) (2025-07-07T22:08:45Z) - Optimizing Anytime Reasoning via Budget Relative Policy Optimization [38.57672572913099]
我々は,任意の推論性能を最適化する新しいフレームワークであるAnytimeReasonerを提案する。
従来の分布からサンプルトークンの予算に適合するように、完全な思考プロセスを切り離します。
次に、累積報酬を最大化するために、分割された方法で思考と要約ポリシーを最適化する。
論文 参考訳(メタデータ) (2025-05-19T17:58:44Z) - Dynamic Rewarding with Prompt Optimization Enables Tuning-free Self-Alignment of Language Models [54.381650481255235]
我々は,Prompt Optimization (O) を用いた動的リワードによる自己アライメントのための新しいチューニング不要アプローチを提案する。
提案手法は,LLMを反復的に自己改善し,最適アライメント命令を作成可能な検索ベース最適化フレームワークを活用する。
近年の8つのLCMのオープンおよびクローズドソースに関する実証評価により,DRPOはアライメント性能を著しく向上することが示された。
論文 参考訳(メタデータ) (2024-11-13T16:15:38Z) - Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models [79.84205827056907]
本稿では,高品質な嗜好データを自律的に生成するアルゴリズムであるセルフステアリング最適化(SSO$)を提案する。
$SSO$は、ポリシーモデル自体からデータジェネレータを構築するために、特別な最適化目標を採用しています。
評価の結果,$SSO$は人選好アライメントと報酬最適化のベースラインを一貫して上回っていることがわかった。
論文 参考訳(メタデータ) (2024-10-22T16:04:03Z) - Robust personalized pricing under uncertainty of purchase probabilities [2.9061423802698565]
予測された購入確率の不確実性を考慮したパーソナライズ価格のロバストな最適化モデルを提案する。
また、線形探索と組み合わせたラグランジアン分解アルゴリズムを開発し、大規模最適化問題に対する高品質な解を効率的に見つける。
論文 参考訳(メタデータ) (2024-07-22T02:36:19Z) - Cost-Sensitive Multi-Fidelity Bayesian Optimization with Transfer of Learning Curve Extrapolation [55.75188191403343]
各ユーザが事前に定義した機能であるユーティリティを導入し,BOのコストと性能のトレードオフについて述べる。
このアルゴリズムをLCデータセット上で検証した結果,従来のマルチファイルBOや転送BOベースラインよりも優れていた。
論文 参考訳(メタデータ) (2024-05-28T07:38:39Z) - End-to-End Learning for Fair Multiobjective Optimization Under
Uncertainty [55.04219793298687]
機械学習における予測-Then-Forecast(PtO)パラダイムは、下流の意思決定品質を最大化することを目的としている。
本稿では,PtO法を拡張して,OWA(Nondifferentiable Ordered Weighted Averaging)の目的を最適化する。
この結果から,不確実性の下でのOWA関数の最適化とパラメトリック予測を効果的に統合できることが示唆された。
論文 参考訳(メタデータ) (2024-02-12T16:33:35Z) - Robust Bayesian optimization with reinforcement learned acquisition
functions [4.05984965639419]
ベイズ最適化において、取得関数(AF)はシーケンシャルサンプリングを誘導し、効率的な収束のために重要な役割を果たす。
この危機に対処するため、データ駆動型AF選択の考え方が提案されている。
シーケンシャルAF選択タスクは、マルコフ決定プロセス(MDP)として形式化され、強力な強化学習(RL)技術を利用する。
論文 参考訳(メタデータ) (2022-10-02T09:59:06Z) - Learning Model Predictive Controllers for Real-Time Ride-Hailing Vehicle
Relocation and Pricing Decisions [15.80796896560034]
大規模配車システムは、個々の要求レベルでのリアルタイムルーティングと、動的価格設定と車両の移動のためのマクロなモデル予測制御(MPC)の最適化を組み合わせることが多い。
本稿では、MPC最適化を学習することで、これらの計算課題に対処する。
結果の機械学習モデルは最適化プロキシとして機能し、その最適解を予測する。
論文 参考訳(メタデータ) (2021-11-05T00:52:15Z) - Bayesian Optimization and Deep Learning forsteering wheel angle
prediction [58.720142291102135]
本研究の目的は,自動走行システムにおける操舵角度予測の精度の高いモデルを得ることである。
BOは限られた試行数で、BOST-LSTMと呼ばれるモデルを特定し、古典的なエンドツーエンド駆動モデルと比較して最も正確な結果を得た。
論文 参考訳(メタデータ) (2021-10-22T15:25:14Z) - Bayesian Optimization for Selecting Efficient Machine Learning Models [53.202224677485525]
本稿では,予測効率とトレーニング効率の両面において,モデルを協調最適化するための統一ベイズ最適化フレームワークを提案する。
レコメンデーションタスクのためのモデル選択の実験は、この方法で選択されたモデルがモデルのトレーニング効率を大幅に改善することを示している。
論文 参考訳(メタデータ) (2020-08-02T02:56:30Z) - Automatically Learning Compact Quality-aware Surrogates for Optimization
Problems [55.94450542785096]
未知パラメータで最適化問題を解くには、未知パラメータの値を予測し、これらの値を用いて問題を解くための予測モデルを学ぶ必要がある。
最近の研究によると、複雑なトレーニングモデルパイプラインのレイヤーとして最適化の問題を含めると、観測されていない意思決定の繰り返しを予測することになる。
我々は,大規模最適化問題の低次元サロゲートモデルを学習することにより,解の質を向上させることができることを示す。
論文 参考訳(メタデータ) (2020-06-18T19:11:54Z) - Heterogeneous Causal Learning for Effectiveness Optimization in User
Marketing [2.752817022620644]
本稿では,ユーザマーケティングのための処理効果最適化手法を提案する。
このアルゴリズムは過去の実験から学習し、ユーザ選択に対するコスト効率の最適化に新しい最適化手法を利用する。
提案手法は,先行技術およびベースライン法において,最良性能の手法と比較して24.6%性能が向上した。
論文 参考訳(メタデータ) (2020-04-21T01:34:34Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。