論文の概要: What Molecular Structure Cannot Tell Us: A Taxonomy of Explainability Gaps in GNN-Based Drug Toxicity Prediction
- arxiv url: http://arxiv.org/abs/2605.26183v2
- Date: Fri, 29 May 2026 15:31:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-01 13:54:20.898903
- Title: What Molecular Structure Cannot Tell Us: A Taxonomy of Explainability Gaps in GNN-Based Drug Toxicity Prediction
- Title(参考訳): GNNによる薬物毒性予測における説明可能性ギャップの分類
- Authors: Juergen Dietrich,
- Abstract要約: 本研究では,構造に基づく毒性予測を防止するために,構造情報限界の運用分類を導入する。
アセチルサリチル酸(ASA, Aspirin)を用いたシステマティックケーススタディはモデル化合物として機能する。
結果は、分子構造が既知のASAの副作用の約45%(5/11)を説明できることを示している。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Not all clinically relevant adverse effects are structurally inferable from molecular graphs - regardless of model quality or architectural complexity. This study introduces an operational taxonomy of the structural information limits that prevent structure-based toxicity prediction, independent of the learning algorithm employed. Graph Neural Networks (GNNs) have emerged as a natural approach for molecular toxicity prediction, operating directly on atomic connectivity without the information loss inherent to fixed-length fingerprints. However, the fraction of a drug's known pharmacological profile that is actually inferable from molecular structure remains systematically underexplored. A systematic case study using acetylsalicylic acid (ASA, Aspirin) - one of the most comprehensively characterized drugs in pharmacology - serves as model compound. A Message Passing Neural Network (MPNN) is trained on the Tox21 benchmark and GNNExplainer is applied to characterize atom-level attribution. Results indicate that molecular structure explains approximately 45% (5/11) of known ASA adverse effects. A four-category Gap Taxonomy (GAP-1 through GAP-4) is introduced distinguishing between principally non-encodable effects, data gaps arising from Missing Not At Random (MNAR) mechanisms, assay panel mismatches, and representation errors. The MNAR gap is empirically quantified via a systematic ChEMBL query (42 documented assays, 0 retrievable bioactivity entries). An attention pooling experiment localizes the representation error to the MPNN message passing layers rather than the aggregation step. The Gap Taxonomy has direct implications for drug safety signal detection and regulatory frameworks including Good Pharmacovigilance Practice (GVP) guidelines and New Approach Methodologies (NAMs). Structural limits identified are confirmed in a companion DDI ablation study.
- Abstract(参考訳): すべての臨床的に関連する副作用は、モデルの品質やアーキテクチャの複雑さに関わらず、分子グラフから構造的に推測可能であるわけではない。
本研究では,学習アルゴリズムとは独立に,構造に基づく毒性予測を防止するため,構造情報限界の運用分類を導入する。
グラフニューラルネットワーク(GNN)は、分子毒性予測の自然なアプローチとして登場し、固定長の指紋に固有の情報損失を伴わずに、原子接続を直接運用している。
しかし、分子構造から実際に推測できる薬物の薬理学的プロファイルのごく一部は体系的に過小評価されている。
アセチルサリチル酸(ASA, Aspirin)を用いた系統的なケーススタディは、薬理学において最も包括的に特徴付けられる薬物の1つであり、モデル化合物として機能する。
メッセージパッシングニューラルネットワーク(MPNN)はTox21ベンチマークでトレーニングされ、GNNExplainerは原子レベルの属性を特徴付ける。
結果は、分子構造が既知のASAの副作用の約45%(5/11)を説明できることを示している。
4カテゴリのギャップ分類法 (GAP-1 - GAP-4) を導入し、主に非エンコジブル効果、ミス・ノー・アット・ランダム(MNAR)機構から生じるデータギャップ、パネルミスマッチ、表現エラーを区別した。
MNARギャップは、系統的なChEMBLクエリ(42のアッセイ、0の検索可能な生物活性エントリ)によって実証的に定量化される。
注目プーリング実験は、アグリゲーションステップではなく、MPNNメッセージパッシングレイヤに表現エラーをローカライズする。
ギャップ分類学は、医薬品の安全信号の検出と、GVPガイドラインや新しいアプローチ方法論(NAM)など規制の枠組みに直接的な意味を持っている。
同定された構造的限界は、共役DDIアブレーション研究で確認される。
関連論文リスト
- Empowering Chemical Structures with Biological Insights for Scalable Phenotypic Virtual Screening [13.925550352212412]
本研究は,本質的な生物学的意味論による化学表現の強化によりギャップを橋渡しするフレームワークであるDECODEを提案する。
以上の結果からDECODEは, 作用機構予測において, 化学的ベースラインよりも20%以上の相対的な改善を施し, ゼロショット設定で機能的に類似した薬物を回収できることが示唆された。
論文 参考訳(メタデータ) (2026-03-16T09:13:08Z) - Regressor-free Molecule Generation to Support Drug Response Prediction [83.25894107956735]
目標IC50スコアに基づく条件生成により、より効率的なサンプリングスペースを得ることができる。
回帰自由誘導は、拡散モデルのスコア推定と、数値ラベルに基づく回帰制御モデルの勾配を結合する。
論文 参考訳(メタデータ) (2024-05-23T13:22:17Z) - Unveiling Molecular Moieties through Hierarchical Grad-CAM Graph Explainability [0.0]
生物学的活性に対する分子サブストラクチャーの特定の寄与を解明するための説明可能な方法の統合は重要な課題である。
我々は,小分子のデータセットを用いて20個のGNNモデルを訓練し,キナーゼファミリーから20個のタンパク質標的上での活性を予測することを目標とした。
我々は階層型Grad-CAMグラフExplainerフレームワークを実装し,タンパク質-リガンド結合安定化を駆動する分子構造を詳細に解析する。
論文 参考訳(メタデータ) (2024-01-29T17:23:25Z) - Learning to Denoise Biomedical Knowledge Graph for Robust Molecular Interaction Prediction [50.7901190642594]
分子間相互作用予測のためのバイオKDN (Biomedical Knowledge Graph Denoising Network) を提案する。
BioKDNは、ノイズの多いリンクを学習可能な方法で識別することで、局所的な部分グラフの信頼性の高い構造を洗練する。
ターゲットの相互作用に関する関係を円滑にすることで、一貫性とロバストなセマンティクスを維持する。
論文 参考訳(メタデータ) (2023-12-09T07:08:00Z) - Bi-level Contrastive Learning for Knowledge-Enhanced Molecule Representations [68.32093648671496]
分子に固有の二重レベル構造を考慮に入れたGODEを導入する。
分子は固有のグラフ構造を持ち、より広い分子知識グラフ内のノードとして機能する。
異なるグラフ構造上の2つのGNNを事前学習することにより、GODEは対応する知識グラフサブ構造と分子構造を効果的に融合させる。
論文 参考訳(メタデータ) (2023-06-02T15:49:45Z) - Graph neural networks for the prediction of molecular structure-property
relationships [59.11160990637615]
グラフニューラルネットワーク(GNN)は、分子グラフ上で直接動作する新しい機械学習手法である。
GNNは、エンドツーエンドでプロパティを学習できるため、情報記述子の必要性を回避することができる。
本稿では、分子特性予測のための2つの例を通して、GNNの基礎を説明し、GNNの応用を実証する。
論文 参考訳(メタデータ) (2022-07-25T11:30:44Z) - Chemical-Reaction-Aware Molecule Representation Learning [88.79052749877334]
本稿では,化学反応を用いて分子表現の学習を支援することを提案する。
本手法は,1) 埋め込み空間を適切に整理し, 2) 分子埋め込みの一般化能力を向上させるために有効であることが証明された。
実験結果から,本手法は様々なダウンストリームタスクにおける最先端性能を実現することが示された。
論文 参考訳(メタデータ) (2021-09-21T00:08:43Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。