論文の概要: Deft Scheduling of Dynamic Cloud Workflows with Varying Deadlines via Mixture-of-Experts
- arxiv url: http://arxiv.org/abs/2606.01162v2
- Date: Tue, 02 Jun 2026 02:34:50 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-04 10:57:21.687917
- Title: Deft Scheduling of Dynamic Cloud Workflows with Varying Deadlines via Mixture-of-Experts
- Title(参考訳): Mixture-of-Expertsによるデッドライン変更による動的クラウドワークフローのスケジューリング
- Abstract要約: DEFTは、動的クラウドワークフロースケジューリングのためのMixture-of-Expertsアーキテクチャを導入し、検証する最初の企業である。
最も適切な専門家を通じて意思決定を適応的にルーティングすることで、DEFTは幅広い期限要件を満たすことができる。
動的クラウドワークフローベンチマークの実験は、DEFTが実行コストと期限違反を大幅に削減することを示した。
- 参考スコア(独自算出の注目度): 9.38122626367273
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Workflow scheduling in cloud computing demands the intelligent allocation of dynamically arriving, graph-structured workflows with varying deadlines onto ever-changing virtual machine resources. However, existing deep reinforcement learning (DRL) schedulers remain limited by rigid, single-path inference architectures that struggle to handle diverse scheduling scenarios. We introduce $\textbf{DEFT}$ ($\textbf{D}$eadline-p$\textbf{E}$rceptive Mixture-o$\textbf{F}$-Exper$\textbf{t}$s), an innovative DRL policy architecture that leverages a specialized mixture of experts, each trained to manage different levels of deadline tightness. To our knowledge, DEFT is the first to introduce and validate a Mixture-of-Experts architecture for dynamic cloud workflow scheduling. By adaptively routing decisions through the most appropriate experts, DEFT is capable of meeting a broad spectrum of deadline requirements that no single expert can achieve. Central to DEFT is a $\textbf{graph-adaptive}$ gating mechanism that encodes workflow DAGs, task states, and VM conditions, using cross-attention to guide expert activation in a fine-grained, deadline-sensitive manner. Experiments on dynamic cloud workflow benchmarks demonstrate that DEFT significantly reduces execution cost and deadline violations, outperforming multiple state-of-the-art DRL baselines.
- Abstract(参考訳): クラウドコンピューティングにおけるワークフロースケジューリングは、動的に到着するグラフ構造化ワークフローのインテリジェントなアロケーションを要求します。
しかし、既存の深層強化学習(DRL)スケジューラは、多様なスケジューリングシナリオを扱うのに苦労する厳密な単一パス推論アーキテクチャによって制限されている。
我々は、専門家の特別な混合を利用する革新的なDRLポリシーアーキテクチャである$\textbf{DEFT}$$$\textbf{D}$eadline-p$\textbf{E}$rceptive Mixture-o$\textbf{F}$-Exper$\textbf{t}$sを紹介する。
我々の知る限り、DEFTは、動的クラウドワークフロースケジューリングのためのMixture-of-Expertsアーキテクチャを導入し、検証した最初の企業です。
最も適切な専門家を通じて意思決定を適応的にルーティングすることで、DECTは、どの専門家も達成できない幅広い期限要件を満たすことができる。
Central to DEFTはワークフローDAG、タスク状態、VM条件をエンコードする$\textbf{graph-adaptive}$ゲーティングメカニズムで、クロスアテンションを使用して専門家のアクティベーションをきめ細かな、期限に敏感な方法でガイドする。
動的クラウドワークフローベンチマークの実験では、DEFTが実行コストと期限違反を大幅に削減し、最先端のDRLベースラインを複数上回ることが示されている。
関連論文リスト
- Cloud Workflow Scheduling Based on Graph Attention-Driven Hierarchical Reinforcement Learning [10.978371228753518]
本稿では,GA-HRL(Graph Attention-Driven Reinforcement Learning)フレームワークとモデルスケジューリングプロセスを開発する。
タスク実行速度、配置に依存した通信、タスクとコンテナの決定の結合に対処しながら、納期満足度、コンテナ利用、エネルギー消費のバランスを取る。
2018年のAlibabaクラスタトレースの実験によると、GA-HRLは競争力のあるワークフローの成功率を維持しており、成功率が同等な環境では、コンテナの利用率の向上とエネルギー消費量の削減を実現している。
論文 参考訳(メタデータ) (2026-09-14T02:50:40Z) - Hybrid Workflow Composition for Extreme-Scale Data Processing: A Case Study on the HL-LHC (Extended Version) [0.5156484100374059]
本稿では,タスクセットの粒度とシステムレベルの制約の相互作用を特徴付けるための新しいシミュレーションフレームワークを提案する。
その結果、ハイブリッド合成戦略はスループットを最大3.8倍に向上し、ネットワークオーバーヘッドを14.9倍削減できることがわかった。
論文 参考訳(メタデータ) (2026-07-29T13:07:31Z) - StrLoRA: Towards Streaming Continual Visual Instruction Tuning for MLLMs [9.912407135967836]
本稿では,タスクの動的混合を含むデータチャンクのストリームからモデルを学習するStreaming CVIT(StrCVIT)を紹介する。
StrCVITでは、モデルは同時に新しい能力を取得し、繰り返し能力を強化し、忘れなければならない。
正規化された2段階のエキスパートルーティングフレームワークであるStrLoRAを提案する。
論文 参考訳(メタデータ) (2026-05-08T06:16:37Z) - On Time, Within Budget: Constraint-Driven Online Resource Allocation for Agentic Workflows [37.22092976146466]
エージェントシステムは、サブタスクを特別なモデルやツールに割り当て、依存関係に応じて調整するオーケストレーション実行ファイルを実行することで、複雑なユーザリクエストをますます解決します。
ワークフローは特定の予算内に完了し、特定の期限前に完了しなければならない。
これにより、平均的な効率最適化から、ワークフロー全体が明確な予算と期限の制約の下で正常に完了する確率の最大化へとゴールをシフトします。
論文 参考訳(メタデータ) (2026-05-07T12:24:21Z) - Complete Cyclic Subtask Graphs for Tool-Using LLM Agents: Flexibility, Cost, and Bottlenecks in Multi-Agent Workflows [0.0]
実行可能なサブタスクノードが完全に接続された完全巡回サブタスクグラフについて検討する。
タスク固有(Spec-Cyc)およびベンチマーク固有(Gen-Cyc)グラフをTextCraft, ALFWorld, Finance-Agent上で評価する。
論文 参考訳(メタデータ) (2026-04-17T15:31:20Z) - SAME: Stabilized Mixture-of-Experts for Multimodal Continual Instruction Tuning [83.66308307152808]
マルチモーダル・インストラクション・チューニング(MCIT)のためのStAbilized Mixture-of-Experts(SAME)を提案する。
プロプライエタリは、サブスペースへのルーティングダイナミクスを分解し、タスク関連方向のみを更新することで、専門家の選択を安定化する。
また、トレーニング中に選択した専門家を凍結するためにアダプティブな専門家アクティベーションを導入し、冗長でクロスタスクな干渉を減らす。
論文 参考訳(メタデータ) (2026-02-02T11:47:06Z) - OFA-MAS: One-for-All Multi-Agent System Topology Design based on Mixture-of-Experts Graph Generative Models [57.94189874119267]
マルチエージェントシステム(MAS)は複雑な問題を解決するための強力なパラダイムを提供する。
現在のグラフ学習に基づく設計手法は、しばしば「1対1」のパラダイムに準拠している。
自然言語で記述されたタスクに対して適応的な協調グラフを生成する一対一のフレームワークOFA-TADを提案する。
論文 参考訳(メタデータ) (2026-01-19T12:23:44Z) - Cloud-Fog-Edge Collaborative Computing for Sequential MIoT Workflow: A Two-Tier DDPG-Based Scheduling Framework [2.5263430338308557]
Medical Internet of Things(MIoT)は、異質なクラウドフォッグエッジインフラストラクチャ上にデプロイされたシーケンシャルなヘルスケアに対して、厳しいエンドツーエンドのレイテンシ保証を要求する。
本稿では,スケジューリング決定を階層的なプロセスに分解する2層DDPGベースのスケジューリングフレームワークを提案する。
実験の結果、我々のアプローチを検証し、複雑さが増大するにつれて、ベースラインよりもパフォーマンスが向上することを示した。
論文 参考訳(メタデータ) (2025-10-24T03:58:31Z) - Flexiffusion: Training-Free Segment-Wise Neural Architecture Search for Efficient Diffusion Models [50.260693393896716]
拡散モデル(DM)は高忠実度画像を生成できる強力な生成モデルであるが、高い計算コストで制約される。
我々は、事前訓練されたパラメータを変更することなく、生成スケジュールとモデルアーキテクチャを協調的に最適化する、トレーニング不要なNASフレームワークFlexiffusionを提案する。
我々の研究は、品質を犠牲にすることなく高速DMを検索するための資源効率の良いパラダイムを開拓した。
論文 参考訳(メタデータ) (2025-06-03T06:02:50Z) - UniSTD: Towards Unified Spatio-Temporal Learning across Diverse Disciplines [64.84631333071728]
本稿では,時間的モデリングのためのトランスフォーマーベースの統合フレームワークであるbfUnistageを紹介する。
我々の研究は、タスク固有の視覚テキストが時間学習のための一般化可能なモデルを構築することができることを示した。
また、時間的ダイナミクスを明示的に組み込むための時間的モジュールも導入する。
論文 参考訳(メタデータ) (2025-03-26T17:33:23Z) - Federated Continual Instruction Tuning [39.344583304181135]
フェデレートラーニング(FL)は、すべての分散データとトレーニングリソースを活用して、共同トレーニングのオーバーヘッドを軽減する可能性がある。
本稿では,この実世界の課題をモデル化するために,FCIT(Federated Continual Instruction Tuning)ベンチマークを導入する。
論文 参考訳(メタデータ) (2025-03-17T07:58:06Z) - DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs [86.76714527437383]
本稿では,事前学習したFFN層を計算ブロックに分割することで,分散化を実現するDSMoEを提案する。
我々は,Sigmoid アクティベーションとストレートスルー推定器を用いた適応型エキスパートルーティングを実装し,トークンがモデル知識の様々な側面に柔軟にアクセスできるようにする。
LLaMAモデルを用いた実験により、DSMoEは既存のプルーニング法やMoE法に比べて優れた性能を発揮することが示された。
論文 参考訳(メタデータ) (2025-02-18T02:37:26Z) - Flow: Modularized Agentic Workflow Automation [53.073598156915615]
大規模言語モデル(LLM)を利用したマルチエージェントフレームワークは、自動計画とタスク実行において大きな成功を収めている。
しかし, 実行中のエージェントの効果的な調整は十分に研究されていない。
本稿では,エージェントによる継続的なワークフロー改善を可能にするアクティビティ・オン・頂点(AOV)グラフを定義する。
提案するマルチエージェントフレームワークは,サブタスクの効率的な同時実行,効果的なゴール達成,エラー耐性の向上を実現している。
論文 参考訳(メタデータ) (2025-01-14T04:35:37Z) - Benchmarking Agentic Workflow Generation [80.74757493266057]
複数面シナリオと複雑なグラフワークフロー構造を備えた統合ワークフロー生成ベンチマークであるWorfBenchを紹介する。
また,サブシーケンスとサブグラフマッチングアルゴリズムを利用したシステム評価プロトコルWorfEvalを提案する。
我々は、生成されたタスクが下流のタスクを強化し、推論中により少ない時間で優れたパフォーマンスを達成することを観察する。
論文 参考訳(メタデータ) (2024-10-10T12:41:19Z) - Efficient Orchestrated AI Workflows Execution on Scale-out Spatial Architecture [17.516934379812994]
さまざまなタスクをロジック駆動型決定と統合し、動的で洗練されたAIを提供する。
我々は,オーケストレーションされた空間グラフを用いて,オーケストレーションされたAIの本質的なデュアルダイナミクスを効果的に表現できることを見出した。
我々の評価は、オーケストレーションAIの動的な要求に対処する上で、従来のアーキテクチャよりも大幅に優れていることを示している。
論文 参考訳(メタデータ) (2024-05-21T14:09:31Z) - Effective Multi-User Delay-Constrained Scheduling with Deep Recurrent
Reinforcement Learning [28.35473469490186]
マルチユーザ遅延制約スケジューリングは、無線通信、ライブストリーミング、クラウドコンピューティングを含む多くの現実世界アプリケーションにおいて重要である。
Recurrent Softmax Delayed Deep Double Deterministic Policy Gradient (mathttRSD4$) という深部強化学習アルゴリズムを提案する。
$mathttRSD4$は、それぞれLagrangianのデュアルと遅延に敏感なキューによるリソースと遅延の制約を保証する。
また、リカレントニューラルネットワーク(RNN)によって実現されたメモリ機構により、部分的可観測性にも効率よく取り組み、ユーザレベルの分解とノードレベルを導入している。
論文 参考訳(メタデータ) (2022-08-30T08:44:15Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。