論文の概要: L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning
- arxiv url: http://arxiv.org/abs/2607.09099v1
- Date: Fri, 10 Jul 2026 05:08:02 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-13 14:47:12.783205
- Title: L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning
- Title(参考訳): L-MAD: 法的推論におけるマルチエージェントの議論構造の体系的評価
- Abstract要約: 本稿では,L-MAD(Lopal Multi-Agent Debate)フレームワークを導入する。
異なる専門家のペルソナを複数のエージェントに割り当てることで、L-MADは強力なシングルエージェントベースラインを最大8%改善する。
- 参考スコア(独自算出の注目度): 14.460920090407017
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: While multi-agent debate (MAD) frameworks have shown significant potential in general reasoning, their effectiveness in highly structured, knowledge-heavy legal domains remains under-explored. In this work, we introduce the Legal Multi-Agent Debate (L-MAD) framework to systematically evaluate different debate structures and aggregation methods within Legal Textual Entailment. By assigning distinct expert personas to multiple agents, L-MAD improves upon strong single-agent baselines by up to 8\%. Furthermore, analyzing how debate scales reveals a clear trade-off: increasing the agent population reduces inconsistency and improves accuracy, whereas extending discussion rounds induces a detrimental \textit{over-deliberation drift} where agents reinforce each other's mistakes. Ultimately, our findings outline the practical boundaries and safety margins of deploying collaborative multi-agent systems in high-stakes legal reasoning environments.
- Abstract(参考訳): マルチエージェント・ディベート(MAD)フレームワークは、一般的な推論において大きな可能性を秘めているが、高度に構造化され、知識に富んだ法的な領域におけるそれらの有効性は、まだ未調査のままである。
そこで本研究では,L-MAD(Lopal Multi-Agent Debate)フレームワークを導入する。
異なる専門家のペルソナを複数のエージェントに割り当てることで、L-MADは強力なシングルエージェントベースラインを最大8\%改善する。
エージェント人口の増加は矛盾を減らし、精度を向上する一方、長期にわたる議論ラウンドは、エージェント同士のミスを補強する有害な‘textit{over-deliberation drift’を誘導する。
最終的に、我々は、高度な法的推論環境における協調型マルチエージェントシステムの実践的境界と安全性の限界について概説した。
関連論文リスト
- Remember and Reweight: Enhancing Multi-Agent Debate with Experience Memory and Confidence Estimation [6.5331167606521205]
マルチエージェントディベート(MAD)は、複数のエージェントが議論を通じて応答を反復的に洗練することにより、大規模言語モデルの推論能力を改善する。
MADは共有誤解と呼ばれる致命的な脆弱性に悩まされる: エージェントの大多数が誤った答えに収束すると、議論プロセスは誤りを訂正するよりも増幅する傾向にある。
既存の方法は主にピアスキューに対処するが、エージェントの本質的に偏見のある概念は未適応のままである。
R$2$-MADは,過去の議論から蓄積した経験記憶をエージェントに提供するフレームワークである。
論文 参考訳(メタデータ) (2026-09-03T10:05:01Z) - Investigating Multi-Agent Deliberation in Law [0.0]
裁判所の手続きと法的議論に触発された2つの新しいマルチエージェントフレームワークを紹介する。
法的なベンチマークと非法的なベンチマークによる実験により,マルチエージェントフレームワークがベースラインの大規模言語モデルに匹敵する全体的なパフォーマンスを実現していることが明らかになった。
我々の研究は、法的領域におけるAIの有望な方向性としてマルチエージェントシステムを位置づけ、同時に、法律に着想を得たマルチエージェントによる検討の可能性を実証している。
論文 参考訳(メタデータ) (2026-06-29T20:56:37Z) - Debate to Align: Reliable Entity Alignment through Two-Stage Multi-Agent Debate [13.025981335381637]
我々はマルチエージェントの議論に基づく信頼できるEAフレームワークであるAgentEAを提案する。
AgentEAはエンティティ表現の優先順位最適化を通じて埋め込み品質を改善する。
次に、軽量な議論検証と深い議論アライメントからなる2段階のマルチロール討論機構を導入する。
論文 参考訳(メタデータ) (2026-04-15T06:54:27Z) - DynaDebate: Breaking Homogeneity in Multi-Agent Debate with Dynamic Path Generation [47.62978918069135]
DynaDebate (Dynamic Multi-Agent Debate) を導入し,3つのキーメカニズムによるマルチエージェント討論の有効性を高める。
大規模な実験により、DynaDebateは既存の最先端のMADメソッドを超越して、様々なベンチマークで優れたパフォーマンスを実現している。
論文 参考訳(メタデータ) (2026-01-09T12:01:33Z) - Tool-MAD: A Multi-Agent Debate Framework for Fact Verification with Diverse Tool Augmentation and Adaptive Retrieval [10.62333858188658]
マルチエージェント・ディベート(MAD)システムは,複数のLLMエージェントが対話を行えるようにすることで,解答精度を向上させることを目的としている。
既存のMADフレームワークは主に内部知識や静的文書に依存しており、幻覚に弱い。
エージェントを別個の外部ツールに割り当てることで,事実検証を強化する多エージェント討論フレームワークであるTool-MADを提案する。
論文 参考訳(メタデータ) (2026-01-08T09:07:41Z) - Towards Scalable Oversight with Collaborative Multi-Agent Debate in Error Detection [81.52796950244705]
自己診断は、信頼できる外部からのフィードバックがなければ、複雑なタスクでは信頼できない。
我々は,新たなコラボレーティブMADプロトコルであるColMADを導入し,MADを非ゼロ和ゲームとして再構成する。
ColMADは従来の競合MADよりも19%優れていた。
論文 参考訳(メタデータ) (2025-10-23T19:46:00Z) - MADIAVE: Multi-Agent Debate for Implicit Attribute Value Extraction [52.89860691282002]
インプシット属性値抽出(AVE)は、電子商取引における商品の正確な表現に不可欠である。
マルチモーダル大言語モデル(MLLM)の進歩にもかかわらず、多次元データの複雑さのため暗黙のAVEは依然として困難である。
我々は,複数のMLLMエージェントを用いて推論を反復的に洗練するマルチエージェント討論フレームワークであるtextscmodelnameを紹介する。
論文 参考訳(メタデータ) (2025-10-07T06:27:42Z) - Peacemaker or Troublemaker: How Sycophancy Shapes Multi-Agent Debate [30.66779902590191]
大規模言語モデル (LLM) はしばしば、過剰な一致性を示す傾向がある。
LLMs固有の薬理は、議論を早めの合意に崩壊させる可能性がある。
論文 参考訳(メタデータ) (2025-09-27T02:27:13Z) - Enhancing Multi-Agent Debate System Performance via Confidence Expression [55.34012400580016]
マルチエージェント・ディベート(MAD)システムは人間の議論をシミュレートし、タスク性能を向上させる。
一部の大規模言語モデル(LLM)は、特定のタスクに対して優れた知識や推論能力を持っているが、議論の間、この利点を明確に伝えるのに苦労している。
不適切な信頼表現は、MADシステムのエージェントが、不適切な信念を頑固に維持するか、あるいは最適でない答えに早急に収束させる可能性がある。
我々は,議論プロセス全体を通して信頼表現を統合するMADフレームワークConfMADを開発した。
論文 参考訳(メタデータ) (2025-09-17T14:34:27Z) - Revisiting Multi-Agent Debate as Test-Time Scaling: A Systematic Study of Conditional Effectiveness [50.29739337771454]
マルチエージェントの議論(MAD)アプローチは、モノリシックモデルに対する推論、堅牢性、多様な視点を提供する。
本稿では,MADを実験時間計算のスケーリング手法として概念化し,協調的な改良と多様な探索能力で区別する。
我々は、MADと強力なセルフエージェントテストタイムスケーリングベースラインを数学的推論と安全関連タスクに基づいて比較した総合的な実証的研究を行う。
論文 参考訳(メタデータ) (2025-05-29T01:02:55Z) - Is Multi-Agent Debate (MAD) the Silver Bullet? An Empirical Analysis of MAD in Code Summarization and Translation [10.038721196640864]
マルチエージェント・ディベート (MAD) システムは,大規模言語モデル (LLM) 間の構造化された議論を可能にする
MADは、役割特異的なエージェント、動的相互作用、構造化された意思決定を通じて、散発的な思考を促進する。
本研究では,2つのソフトウェア工学(SE)タスクにおけるMADの有効性について検討する。
論文 参考訳(メタデータ) (2025-03-15T07:30:37Z) - Large Multimodal Agents: A Survey [78.81459893884737]
大規模言語モデル(LLM)は、テキストベースのAIエージェントのパワーで優れたパフォーマンスを実現している。
LLMを利用したAIエージェントをマルチモーダルドメインに拡張することに焦点を当てた、新たな研究トレンドがある。
本総説は, この急速に発展する分野において, 今後の研究に有用な洞察とガイドラインを提供することを目的としている。
論文 参考訳(メタデータ) (2024-02-23T06:04:23Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。