論文の概要: DynaGraph: Lightweight Multi-Model Interaction Framework via Dynamic Topological Reconfiguration
- arxiv url: http://arxiv.org/abs/2605.29511v2
- Date: Fri, 29 May 2026 05:49:24 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-01 13:54:21.097096
- Title: DynaGraph: Lightweight Multi-Model Interaction Framework via Dynamic Topological Reconfiguration
- Title(参考訳): DynaGraph:動的トポロジカル再構成による軽量マルチモデルインタラクションフレームワーク
- Abstract要約: DynaGraphは、動的トポロジ的再構成によって駆動される軽量なマルチモデルフレームワークである。
タイムディビジョンのPEFTアダプタを共有ベースモデルに倍増し、完全なシステムトレーニングとデプロイメントを可能にする。
制限のない動的アーキテクチャと比較してレイテンシを最大68.1%削減し、トークン消費を68.6%削減する。
- 参考スコア(独自算出の注目度): 7.0972889296550825
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Tackling complex reasoning tasks typically relies on massive monolithic LLMs, which suffer from severe computational redundancy. While task decomposition through structured pipelines or multi-agent collaborations offers an alternative, these approaches inevitably fall into a critical dilemma: predefined static topologies are highly vulnerable to cascading errors, whereas unconstrained dynamic agents suffer from trajectory divergence and unpredictable memory bloat. To address this, we present DynaGraph, a lightweight multi-model framework driven by dynamic topological reconfiguration. At the execution level, DynaGraph multiplexes time-division PEFT adapters over a shared base model, enabling both full system training and inference deployment on a single consumer-grade GPU. At the routing level, the Evaluator continuously monitors execution confidence to trigger hierarchical self-healing: Fine-grained Patching for localized data gaps and Subgraph Reconstruction for severe logical ruptures. Experiments on StrategyQA, MATH, and FinQA demonstrate our 8B model closely approximates the reasoning capabilities of a 72B monolithic model (e.g., 87.6% on StrategyQA, 82.7% on MATH). Furthermore, it reduces latency by up to 68.1% and token consumption by 68.6% compared to unconstrained dynamic architectures.
- Abstract(参考訳): 複雑な推論タスクに取り組むには、計算の冗長性に悩まされる巨大なモノリシックLLMに依存するのが一般的である。
構造化パイプラインやマルチエージェントのコラボレーションによるタスクの分解は代替手段を提供するが、これらのアプローチは必然的に重要なジレンマに陥る。
そこで我々は,動的トポロジ的再構成によって駆動される軽量なマルチモデルフレームワークDynaGraphを提案する。
実行レベルでは、DynaGraphは、共有ベースモデル上でタイムディビジョンPEFTアダプタを多重化することにより、単一のコンシューマグレードGPU上でのシステムトレーニングと推論デプロイメントの両方を可能にする。
ルーティングレベルでは、Evaluatorは実行の信頼性を継続的に監視し、階層的な自己修復をトリガーする。
StrategyQA、MATH、FinQAの実験では、我々の8Bモデルは72Bのモノリシックモデル(StrategyQAでは87.6%、MATHでは82.7%)の推論能力をよく近似している。
さらに、制限のない動的アーキテクチャと比較してレイテンシを最大68.1%削減し、トークン消費を68.6%削減する。
関連論文リスト
- TabNSM: Neural Sparse Mixer for Tabular Regression [2.124023760378586]
我々は,従来のスパースアテンションとミキサーアーキテクチャを拡張したスケーラブルな回帰フレームワークであるTabNSMを提案する。
コアとなるAdaptive Sparse Interaction Module (ASIM)は、フォアグラウンド機能発見、スパースローカルインタラクションエンコーディング、Feature-Token Mixingを統合している。
回帰のために、TabNSMはプログレッシブ予測改善のための多段階回帰ヘッド、ターゲット構造を表現学習に組み込んだ順序対応ソフトバインド目的のGridLoss、損失量子ビンに基づく難易度サンプリング戦略のRISEの3つの補完的なコンポーネントを導入している。
論文 参考訳(メタデータ) (2026-08-18T17:22:49Z) - Defending against Model Extraction for GNNs with Model Reprogramming [57.82196268649236]
グラフニューラルネットワーク(GNN)は、ML(Machine-Learning-as-a-Service)における高スループットアプリケーションのバックボーンとして機能する。
それでも、ブラックボックスのデプロイメントは、モデル抽出(ME)攻撃に晒される。
既存の防衛は「ユークリッドバイアス」に苦しむ
セキュリティのためにモデル再プログラミングを再利用するプロアクティブディフェンスフレームワークであるGraphRPを提案する。
論文 参考訳(メタデータ) (2026-08-11T23:20:15Z) - When GNNs Fail: Quantifying and Overcoming Temporal Correlation Volatility in Time Series [14.456983509027195]
本稿では、2つの理論的基盤設計機構によって強化された新しいGNN層であるGLIDE(Graph Layer for Inference in Dynamic En-Vironments)を提案する。
合成および実世界のベンチマークの実験では、GLIDEは静的および動的設定で平均性能を最大45.6%改善している。
論文 参考訳(メタデータ) (2026-08-07T15:28:45Z) - Rewarding the Scientific Process: Process-Level Reward Modeling for Agentic Data Analysis [68.28714988482703]
プロセス・リワード・モデル(PRM)は、LLM(Large Language Models)の推論能力を増強することに成功した。
本稿では,一般ドメインのPRMがデータ分析エージェントの監督に苦慮していることを示す。
本稿では,新しい環境対応生成プロセス報酬モデルであるDataPRMを紹介する。
論文 参考訳(メタデータ) (2026-04-27T09:00:30Z) - Dynamic analysis enhances issue resolution [53.50448142467294]
DAIRA(Dynamic Analysis-enhanced Issue Resolution Agent)は、エージェントの推論サイクルに動的解析を組み込む自動修復フレームワークである。
テストトレース駆動の方法論によって駆動されるDAIRAは、軽量モニタを使用して重要なランタイムデータを抽出する。
Gemini 3 Flash Previewを使用すると、DAIRAは新たな最先端(SOTA)パフォーマンスを確立し、SWE-bench Verifiedデータセットで79.4%の解像度を達成する。
論文 参考訳(メタデータ) (2026-03-23T14:48:54Z) - TopoCurate:Modeling Interaction Topology for Tool-Use Agent Training [53.93696896939915]
訓練用ツール使用エージェントは一般的に、パスレート選択されたタスクに対して、軌道変更の成功と強化学習(RL)に依存している。
TopoCurateは,同一タスクから多段階的なロールアウトを統一的な意味的商トポロジに投影する対話型フレームワークである。
TopoCurateは最先端のベースラインに対して4.2%(SFT)と6.9%(RL)という一貫したゲインを達成している。
論文 参考訳(メタデータ) (2026-03-02T10:38:54Z) - MagicAgent: Towards Generalized Agent Planning [73.21129030631421]
汎用エージェント計画に特化して設計された基盤モデルである textbfMagicAgent について述べる。
多様な計画タスクにまたがる高品質なトラジェクトリを生成する軽量でスケーラブルな合成データフレームワークを提案する。
MagicAgent-32B と MagicAgent-30B-A3B は様々なオープンソースベンチマークにおいて優れた性能を発揮することを示す。
論文 参考訳(メタデータ) (2026-02-22T01:39:16Z) - CASTER: Breaking the Cost-Performance Barrier in Multi-Agent Orchestration via Context-Aware Strategy for Task Efficient Routing [25.48759875572515]
CASTER (Context-Aware Strategy for Task Efficient Routing) はグラフベースMASにおける動的モデル選択のための軽量ルータである。
CASTERは強力なモデルベースラインに比べて推論コストを最大72.4%削減する。
論文 参考訳(メタデータ) (2026-01-27T16:52:47Z) - Multiscale Aggregated Hierarchical Attention (MAHA): A Game Theoretic and Optimization Driven Approach to Efficient Contextual Modeling in Large Language Models [0.0]
マルチスケール集約階層的注意(MAHA)は、階層的分解と数学的に厳密な集約を通じて注意機構を再構築する新しいアーキテクチャフレームワークである。
MAHAは、入力シーケンスを学習可能なダウンサンプリング演算子を介して階層スケールに動的に分割する。
実験的なFLOP解析により,4096のシークエンス長で計算コストが81%削減されたことが確認された。
論文 参考訳(メタデータ) (2025-12-16T21:27:21Z) - DMSC: Dynamic Multi-Scale Coordination Framework for Time Series Forecasting [24.202509006348862]
時系列予測(TSF)は、さまざまなスケールにわたる複雑な時間的依存関係をモデル化する上で、永続的な課題に直面します。
マルチスケールパッチ分解ブロック(EMPD)、トライアドインタラクションブロック(TIB)、適応スケールルーティングMoEブロック(ASR-MoE)を備えた新しい動的マルチスケールコーディネーションフレームワーク(DMSC)を提案する。
EMPDは、指数関数的にスケールした粒度を持つ階層的なパッチにシーケンスを動的に分割する組み込みコンポーネントとして設計されている。
TIBは、各レイヤの分解された表現の中で、パッチ内、パッチ間、およびクロス変数の依存関係を共同でモデル化する。
論文 参考訳(メタデータ) (2025-08-03T13:11:52Z) - DSMoE: Matrix-Partitioned Experts with Dynamic Routing for Computation-Efficient Dense LLMs [86.76714527437383]
本稿では,事前学習したFFN層を計算ブロックに分割することで,分散化を実現するDSMoEを提案する。
我々は,Sigmoid アクティベーションとストレートスルー推定器を用いた適応型エキスパートルーティングを実装し,トークンがモデル知識の様々な側面に柔軟にアクセスできるようにする。
LLaMAモデルを用いた実験により、DSMoEは既存のプルーニング法やMoE法に比べて優れた性能を発揮することが示された。
論文 参考訳(メタデータ) (2025-02-18T02:37:26Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。