論文の概要: Stable and Budget-Feasible Coalition Formation for Clustered Federated Learning: A Hedonic Potential-Game Approach
- arxiv url: http://arxiv.org/abs/2607.26788v1
- Date: Wed, 29 Jul 2026 11:29:45 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-30 21:06:25.652779
- Title: Stable and Budget-Feasible Coalition Formation for Clustered Federated Learning: A Hedonic Potential-Game Approach
- Title(参考訳): クラスタ化フェデレーション学習のための安定・予算対応型協調形成:ヘドニックポテンシャルゲームアプローチ
- Abstract要約: クラスタ化された学習は、異質な参加者を連立特化モデルを訓練する連立組織にまとめることの恩恵を受ける。
我々は,学習効果,システムコスト,参加者コスト,金銭的移転を分離した移動可能余剰モデルを開発した。
- 参考スコア(独自算出の注目度): 0.23689955632456086
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Clustered federated learning benefits from organizing heterogeneous participants into coalitions that train coalition-specific models, but such clustering is sustainable only if participants prefer their assigned coalition and the required transfers are affordable. We develop a transferable-surplus model separating learning benefit, system cost, participant cost, and monetary transfers; an allocation rule converts coalition surplus into hedonic preferences, and weak budget feasibility guarantees nonnegative retained coordinator surplus. For symmetric pairwise allocations the induced game is an exact potential game: a Nash-stable partition exists, every strict better-response process converges, and with destination consent accepted better responses reach an individually stable partition. We characterize feasibility of bounded pair incentives and verify the exponentially many budget constraints in polynomial oracle time when retained slack is submodular. Decomposing welfare into participant potential and retained slack yields additive and multiplicative price-of-stability guarantees, the latter asymptotically tight; exact balance gives welfare-optimal stability only on the pairwise-representable class, and budget feasibility alone permits unbounded welfare loss. Global potential maximization equals weighted maximum-agreement correlation clustering, and approximation followed by stabilization satisfies an end-to-end welfare bound governed by retained slack and negative-edge mass, attained by an explicit construction. In a preregistered five-seed CIFAR-10 study the mechanism reaches the certified estimated-table welfare optimum on every primary instance, equal-surplus sharing has no Nash-stable outcome on three, and pairwise validation gain gives far more reliable pair signs than gradient alignment.
- Abstract(参考訳): しかし、そのようなクラスタリングは、参加者が割り当てられた連立を好み、必要な移行が手頃な価格である場合に限り、持続可能である。
我々は、学習利益、システムコスト、参加者コスト、金融移転を分離する移動可能余剰モデルを構築し、アロケーションルールは、連立余剰をヘドニックな選好に変換するとともに、予算の弱い実現可能性により、非負の維持的コーディネータ剰余を保証します。
Nash-stableパーティションが存在し、すべての厳密なより良い応答プロセスが収束し、目的地の同意が受け入れられ、より良い応答が個々の安定なパーティションに到達する。
我々は,有界対インセンティブの実現可能性を明らかにし,維持スラックが部分モジュラーである多項式オラクル時間における指数関数的に多くの予算制約を検証した。
福祉を参加者の潜在可能性に分解し、維持されるスラックは、追加的かつ乗算的な安定性を保証する、後者は漸近的に厳密であり、正確なバランスは、ペアワイズ表現可能なクラスのみに福祉最適安定性を与え、予算実現性だけで、無制限の福祉損失を許容する。
大域的ポテンシャル最大化は、重み付き最大加速度相関クラスタリングと同等であり、近似に続いて安定化は、明示的な構成によって達成された、維持されたスラックと負のエッジの質量によって支配されるエンドツーエンドの福祉を満足する。
CIFAR-10(英語版)の事前登録では、このメカニズムはすべての一次事例において評価された評価値の福祉最適値に達するが、均等な余剰共有は3つにナッシュ安定な結果を持たず、ペアワイズ検証ゲインは勾配整列よりもはるかに信頼性の高いペアサインを与える。
関連論文リスト
- Online Fair Division with Budget Constraints [20.176419497210585]
一般化された割当予算制約の下で離散公正分割のオンライン版について検討する。
まず、付加的な構造がなければ、決定論的オンラインアルゴリズムが固定的な近似を保証できないことを示す。
次に,有意な保証を回復する構造条件として,有界密度の拡散を同定する。
論文 参考訳(メタデータ) (2026-07-25T17:53:10Z) - TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning [52.67756371231985]
検証可能な報酬を伴う強化学習(RLVR)は、大規模言語モデルにおける推論とエージェント的行動を強化するための有望なアプローチである。
本稿では,Tree Rollout Allocation for Contrastive Exploration (TRACE)について紹介する。
技術的には、TRACEはロールアウト予算をルートと中間プレフィックスの両方に割り当てている。
論文 参考訳(メタデータ) (2026-06-09T17:16:03Z) - Phi-Actor-Critic: Steering General-Sum Games to Pareto-Efficient Correlated Equilibria [3.061219970798378]
現実世界のマルチエージェントシステムは、個々のインセンティブが集団福祉と矛盾する一般的なサムゲームとしてモデル化されることが多い。
標準深層マルチエージェント強化学習法(MARL)はこの問題に対処する。
提案する$-Actor-Critic($-AC)は,スワップリミスの最小化を利用して,高次相関均衡に向けて学習を行うフレームワークである。
論文 参考訳(メタデータ) (2026-06-09T16:40:26Z) - Multimodal Learning on Low-Quality Data with Conformal Predictive Self-Calibration [72.0672328514289]
マルチモーダル学習は、しばしば低品質データの課題に悩まされる。
コンフォーマル予測自己校正(Conformal Predictive Self-Calibration)と呼ばれる統合フレームワークを提案する。
私たちのフレームワークは、既存の最先端メソッドを一貫して上回ります。
論文 参考訳(メタデータ) (2026-05-05T14:48:52Z) - Computing Equilibrium beyond Unilateral Deviation [27.786964046329455]
我々は、連立偏差のインセンティブを最小限に抑える、代替ソリューションの概念を研究している。
具体的には、逸脱する連立の平均利得を最小化することに集中し、枠組みを重み付き平均利得と最大結束利得に拡張する。
平均ゲインと最大ゲインの目的に対して、そのような平衡計算の複雑さの低いバウンダリを証明し、このバウンダリに一致するアルゴリズムを提案する。
論文 参考訳(メタデータ) (2026-04-30T17:59:07Z) - Fairness Aware Reward Optimization [78.85867531002346]
本稿では,Fairness Aware Reward Optimization (Faro)を紹介した。Fairness Aware Reward Optimization (Faro)は,階層的平等,等化オッズ,あるいは反実的フェアネス制約の下で報酬モデルを訓練するプロセス内フレームワークである。
LLMアライメントにおける報酬レベルの公平性に関する最初の理論的解析を行った。
Faroはモデルの品質を維持したり改善したりしながら、バイアスや有害な世代を著しく削減します。
論文 参考訳(メタデータ) (2026-02-08T03:35:49Z) - Toward a Sustainable Federated Learning Ecosystem: A Practical Least Core Mechanism for Payoff Allocation [71.86087908416255]
最小コア(LC)概念に基づく配当フレームワークを提案する。
従来の方法とは異なり、LCは最大の不満を最小限に抑えてフェデレーションの凝集を優先する。
統合侵入検知におけるケーススタディは、我々のメカニズムが重要な貢献者や戦略的提携を正しく識別できることを実証している。
論文 参考訳(メタデータ) (2026-02-03T11:10:50Z) - Outcome-Grounded Advantage Reshaping for Fine-Grained Credit Assignment in Mathematical Reasoning [60.00161035836637]
グループ相対政策最適化は、推論タスクのための有望な批判のない強化学習パラダイムとして登場した。
我々は,各トークンがモデルの最終回答にどの程度影響するかに基づいて,利益を再分配する,きめ細かい信用割当機構であるOutcome-grounded Advantage Reshaping (OAR)を紹介した。
OAR-Gは計算オーバーヘッドを無視して同等のゲインを達成し、どちらも強力なGRPOベースラインをはるかに上回っている。
論文 参考訳(メタデータ) (2026-01-12T10:48:02Z) - On Sybil Proofness in Competitive Combinatorial Exchanges [0.0]
交換器の競合平衡機構であるBRACEにおけるシビル操作について検討する。
BRACEの有効性は、シビルズの人口が無制限である場合に失敗することを示します。
論文 参考訳(メタデータ) (2025-12-11T01:53:04Z) - Integrating upstream and downstream reciprocity stabilizes cooperator-defector coexistence in N-player giving games [1.1381558444077822]
認知的制約やグループ規模の課題にもかかわらず、社会的な協力を含め、ペイ・イット・フォワード・チェーンとアセスメント・システムは共同で社会を維持することができることを示す。
この枠組みは、認知的制限やグループサイズの課題に拘わらず、社会的な協力を共同で維持する方法を実証する。
論文 参考訳(メタデータ) (2025-09-05T01:49:26Z) - Monotonic Improvement Guarantees under Non-stationarity for
Decentralized PPO [66.5384483339413]
我々は,MARL(Multi-Agent Reinforcement Learning)における分散政策の最適化のための新しい単調改善保証を提案する。
本研究では,訓練中のエージェント数に基づいて,独立した比率を限定することにより,信頼領域の制約を原則的に効果的に実施可能であることを示す。
論文 参考訳(メタデータ) (2022-01-31T20:39:48Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。