論文の概要: Multi-agent Self-triage System with Medical Flowcharts
- arxiv url: http://arxiv.org/abs/2511.12439v1
- Date: Sun, 16 Nov 2025 03:48:22 GMT
- ステータス: 翻訳完了
- システム内更新日: 2025-11-18 14:36:24.096673
- Title: Multi-agent Self-triage System with Medical Flowcharts
- Title(参考訳): 医療用フローチャートを用いたマルチエージェントセルフトリアージシステム
- Abstract要約: 我々は,米国医学会から臨床検査された100個のフローチャートを用いて,LLMをガイドする概念的対話型セルフトレージシステムを紹介した。
シミュレーションされた会話の合成データセットを用いて,大規模に評価した。
- 参考スコア(独自算出の注目度): 36.31241490919295
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Online health resources and large language models (LLMs) are increasingly used as a first point of contact for medical decision-making, yet their reliability in healthcare remains limited by low accuracy, lack of transparency, and susceptibility to unverified information. We introduce a proof-of-concept conversational self-triage system that guides LLMs with 100 clinically validated flowcharts from the American Medical Association, providing a structured and auditable framework for patient decision support. The system leverages a multi-agent framework consisting of a retrieval agent, a decision agent, and a chat agent to identify the most relevant flowchart, interpret patient responses, and deliver personalized, patient-friendly recommendations, respectively. Performance was evaluated at scale using synthetic datasets of simulated conversations. The system achieved 95.29% top-3 accuracy in flowchart retrieval (N=2,000) and 99.10% accuracy in flowchart navigation across varied conversational styles and conditions (N=37,200). By combining the flexibility of free-text interaction with the rigor of standardized clinical protocols, this approach demonstrates the feasibility of transparent, accurate, and generalizable AI-assisted self-triage, with potential to support informed patient decision-making while improving healthcare resource utilization.
- Abstract(参考訳): オンライン医療資源と大規模言語モデル(LLMs)は、医療意思決定の第一点としてますます利用されているが、医療における信頼性は、低い正確性、透明性の欠如、未検証の情報に対する感受性によって制限されている。
我々は,米国医学会から臨床に検証された100個のフローチャートを用いてLCMを誘導し,患者意思決定支援のための構造化された,監査可能な枠組みを提供する,概念的対話型セルフトレージシステムを提案する。
本システムは、検索エージェント、意思決定エージェント、チャットエージェントからなるマルチエージェントフレームワークを利用して、最も関連性の高いフローチャートを特定し、患者反応を解釈し、パーソナライズされた患者フレンドリーなレコメンデーションを提供する。
シミュレーションされた会話の合成データセットを用いて,大規模に評価した。
このシステムは、フローチャート検索における95.29%の精度(N=2,000)と、様々な会話スタイルと状況(N=37,200)にわたるフローチャートナビゲーションにおける99.10%の精度を達成した。
標準化された臨床プロトコルの厳密さと自由テキストインタラクションの柔軟性を組み合わせることで、透明性、正確、一般化可能なAI支援型セルフトリアージの実現可能性を示し、医療資源利用の向上を図りながら、患者の意思決定を支援する可能性を示した。
関連論文リスト
- SMILE: Self-Explainable Multimodal Information Bottleneck for Medical Diagnosis [71.98702207668346]
説明可能性(Explainability)は、AIベースの診断、特に安全クリティカルな臨床的意思決定において、ますます重要な要件とみなされている。
本稿では,情報ボトルネック(IB)フレームワーク内で定式化することで,自己説明可能なマルチモーダル診断の問題に対処する。
本稿では,予測性能とモダリティ固有の説明可能性とを協調的に最適化する統合学習パラダイムを提案する。
論文 参考訳(メタデータ) (2026-09-04T14:13:24Z) - XMedFusion: A Knowledge-Guided Multimodal Perception and Reasoning Framework for Autonomous Medical Systems [1.3531581769895988]
XMedFusionは、自律的な医療システムのためのインテリジェントな認識と推論モジュールとして設計されたモジュール型AIフレームワークである。
視覚知覚剤は、画像的根拠を抽出し、知識グラフ構築剤は、臨床的に関連した所見を構造化し、検索誘導起草プロセスは、一貫した報告構造を確保する。
合成剤は、推論駆動検証により視覚的および構造化された証拠を反復的に統合し、信頼性及び解釈可能な診断出力を生成する。
論文 参考訳(メタデータ) (2026-06-08T20:26:32Z) - MedArena: Comparing LLMs for Medicine-in-the-Wild Clinician Preferences [50.71326426975699]
MedArenaは医療用大規模言語モデル(LLM)のためのインタラクティブな評価プラットフォームである。
MedArenaは、2つのランダムに選択されたモデルからの応答を表示し、ユーザが好みのレスポンスを選択するように要求する。
2025年11月1日までに12台のLLMで収集された1571の選好のうち、ジェミニ2.0フラッシュシンキング、ジェミニ2.5プロ、GPT-4oがブラッドリー・テリーのレーティングで上位3モデルとなった。
論文 参考訳(メタデータ) (2026-03-13T22:30:26Z) - A Federated and Parameter-Efficient Framework for Large Language Model Training in Medicine [59.78991974851707]
大規模言語モデル(LLM)は、質問応答や診断など、医療ベンチマークにおいて強力なパフォーマンスを示している。
ほとんどの医療用LDMは、異種システムの一般化性と安全性の制限に直面している単一の機関のデータに基づいて訓練されている。
本稿では, LLMを医療応用に適用するためのモデルに依存しない, パラメータ効率のよいフェデレーション学習フレームワークを提案する。
論文 参考訳(メタデータ) (2026-01-29T18:48:21Z) - Towards Reliable Medical LLMs: Benchmarking and Enhancing Confidence Estimation of Large Language Models in Medical Consultation [97.36081721024728]
本稿では,現実的な医療相談におけるマルチターンインタラクションの信頼性を評価するための最初のベンチマークを提案する。
本ベンチマークでは,3種類の医療データを統合し,診断を行う。
本稿では,エビデンスを基盤とした言語自己評価フレームワークであるMedConfを紹介する。
論文 参考訳(メタデータ) (2026-01-22T04:51:39Z) - DispatchMAS: Fusing taxonomy and artificial intelligence agents for emergency medical services [49.70819009392778]
大規模言語モデル (LLM) とマルチエージェントシステム (MAS) は、ディスパッチを増強する機会を提供する。
本研究の目的は,現実的なシナリオをシミュレートする分類基盤型マルチエージェントシステムの開発と評価である。
論文 参考訳(メタデータ) (2025-10-24T08:01:21Z) - Timely Clinical Diagnosis through Active Test Selection [49.091903570068155]
本稿では,現実の診断推論をよりうまくエミュレートするためのACTMED (Adaptive Clinical Test selection via Model-based Experimental Design)を提案する。
LLMは柔軟なシミュレータとして機能し、構造化されたタスク固有のトレーニングデータを必要とせずに、患者状態のもっともらしい分布を生成し、信念の更新をサポートする。
我々は、実世界のデータセット上でACTMEDを評価し、診断精度、解釈可能性、リソース使用量を改善するためにテスト選択を最適化できることを示す。
論文 参考訳(メタデータ) (2025-10-21T18:10:45Z) - MedKGEval: A Knowledge Graph-Based Multi-Turn Evaluation Framework for Open-Ended Patient Interactions with Clinical LLMs [19.12790150016383]
MedKGEvalは、臨床用大規模言語モデルのための新しいマルチターン評価フレームワークである。
知識グラフ駆動患者シミュレーション機構は、キュレートされた知識グラフから関連する医療事実を検索する。
ターンレベル評価フレームワークは、各モデル応答を臨床的適切性、事実的正当性、安全性について評価する。
論文 参考訳(メタデータ) (2025-10-14T07:22:26Z) - From Staff Messages to Actionable Insights: A Multi-Stage LLM Classification Framework for Healthcare Analytics [0.0]
本稿では、スタッフのメッセージトピックを特定し、メッセージの理由を多種多様な方法で分類するフレームワークを提案する。
最高の性能モデルはO3で、78.4%の重み付きF1スコアと79.2%の精度を実現した。
提案手法は,医療環境に不可欠なデータセキュリティ対策とHIPAAコンプライアンス要件を取り入れたものである。
論文 参考訳(メタデータ) (2025-09-05T20:15:52Z) - TrialMatchAI: An End-to-End AI-powered Clinical Trial Recommendation System to Streamline Patient-to-Trial Matching [0.0]
本稿では,患者間マッチングを自動化するAIを利用したレコメンデーションシステムTrialMatchAIを提案する。
微調整されたオープンソースの大規模言語モデルに基づいて構築されたTrialMatchAIは、透明性を確保し、軽量なデプロイメントフットプリントを維持する。
現実のバリデーションでは、腫瘍学患者の92%が、少なくとも1つの関連するトライアルを、トップ20のレコメンデーションで回収した。
論文 参考訳(メタデータ) (2025-05-13T12:39:06Z) - Enhancing Clinical Decision-Making: Integrating Multi-Agent Systems with Ethical AI Governance [1.0195618602298682]
実験結果, バイタルサイン, 臨床状況を分析するために, モジュラーエージェントを用いた新規エージェントシステムの設計を比較した。
我々は,eICUデータベースを用いて,実験室分析,バイタルのみのインタプリタ,文脈推論エージェントなどのエージェントシステムを実装した。
論文 参考訳(メタデータ) (2025-03-25T05:32:43Z) - Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering [51.26412822853409]
本稿では,医学的視覚的質問応答(VQA)モデルのための,パーソナライズド・フェデレーションド・ラーニング(pFL)手法を提案する。
提案手法では,学習可能なプロンプトをTransformerアーキテクチャに導入し,膨大な計算コストを伴わずに,多様な医療データセット上で効率的にトレーニングする。
論文 参考訳(メタデータ) (2024-10-23T00:31:17Z) - Simulated patient systems are intelligent when powered by large language model-based AI agents [32.73072809937573]
我々は,大規模言語モデルに基づくAIエージェントを用いた,インテリジェントシミュレートされた患者システムAIatientを開発した。
このシステムにはRetrieval Augmented Generationフレームワークが組み込まれており、複雑な推論のために6つのタスク固有のLLMベースのAIエージェントが使用されている。
シミュレーションの現実のために、このシステムはAIPatient KG (Knowledge Graph) も利用している。
論文 参考訳(メタデータ) (2024-09-27T17:17:15Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。