論文の概要: Chemical Chain-of-Thought Functions as a Hallucination-Prone Molecular Scratchpad
- arxiv url: http://arxiv.org/abs/2607.20935v1
- Date: Thu, 23 Jul 2026 05:30:45 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-24 18:26:25.295562
- Title: Chemical Chain-of-Thought Functions as a Hallucination-Prone Molecular Scratchpad
- Title(参考訳): ハロゲン化反応による分子スクラッチパッドのケミカルチェイン・オブ・サート機能
- Abstract要約: 化学推論言語モデルは忠実連鎖(CoT)を介して分子応答を導出することが期待される
4つの推論モデルファミリーと12の化学タスクにまたがって、幻覚は広く、解答の正しさから大きく切り離されている。
この発見は、CoTを忠実な推論の直接的な証拠として扱うことに対する警告であり、回答のみの評価以上のプロセスレベルの監督を動機付けている。
- 参考スコア(独自算出の注目度): 32.236136102261945
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Chemical reasoning language models are expected to derive molecular answers through faithful chain-of-thought (CoT). However, across four reasoning model families and twelve chemistry tasks, hallucination is widespread and largely decoupled from answer correctness: correct answers often coexist with fabricated structural claims absent from the relevant molecules. Yet this does not make the reasoning trace computationally irrelevant. Attribution analyses suggest a shared scratchpad function expressed in model-specific forms: Chem-R and ether-0 rely on fragmented SMILES drafts, whereas ChemDFM-R emphasizes scaffold, positional, and naming cues. Notably, perturbing Chem-R's SMILES sketches degrades generation, showing that structural drafts can be causally load-bearing even when verbal structural claims are largely inert. Together, these results show that chemical CoT is neither a faithful explanation nor merely a post-hoc rationalization, but a hallucination-prone molecular scratchpad. This finding cautions against treating CoT as direct evidence of faithful reasoning and motivates process-level supervision beyond answer-only evaluation.
- Abstract(参考訳): 化学推論言語モデルは、忠実連鎖(CoT)を通して分子応答を導出することが期待されている。
しかし、4つの推論モデルファミリーと12の化学タスクにおいて、幻覚は広く、解答の正しさから大きく切り離され、正しい答えはしばしば関連する分子から欠落した構造的クレームと共存する。
しかし、これは推論を計算的に無関係にしているわけではない。
Chem-Rとether-0は断片化されたSMILESドラフトに依存しているのに対し、ChemDFM-Rは足場、位置、命名方法を強調している。
特に、Chem-R の SMILES スケッチの摂動は生成を劣化させ、言語構造的クレームがほとんど不活性である場合でも、構造的ドラフトは因果的にロードバリング可能であることを示す。
これらの結果は、CoTは忠実な説明ではなく、単にホック後の合理化であり、幻覚を引き起こす分子スクラッチパッドであることを示している。
この発見は、CoTを忠実な推論の直接的な証拠として扱うことに対する警告であり、回答のみの評価以上のプロセスレベルの監督を動機付けている。
関連論文リスト
- Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning [103.788281428856]
SciReasonerは、タンパク質、小さな分子、無機結晶をまたいだ自然構造推論のための科学基盤モデルである。
SciReasonerは座標、トポロジ、周期接続性を統一された構造対応語彙に識別する。
86のベンチマークで、SciReasonerは67のタスクで最先端のパフォーマンスを達成する。
論文 参考訳(メタデータ) (2026-07-08T17:59:59Z) - Chem4DLLM: 4D Multimodal LLMs for Chemical Dynamics Understanding [52.499532583297885]
ChemDUは4D分子軌道を解釈可能な自然言語の説明に変換する。
ChemDUは、ガス相と触媒反応を含む基本的な動的シナリオに焦点を当てている。
Chem4DBenchは4D分子軌道と専門家による説明を組み合わせた最初のデータセットである。
論文 参考訳(メタデータ) (2026-03-12T13:36:58Z) - LatentChem: From Textual CoT to Latent Thinking in Chemical Reasoning [107.60117957760794]
テキスト生成から化学的導出を分離する潜在推論インタフェースであるLatntChemを紹介する。
我々は,LatentChemがChemCoTBench上のCoTベースラインの強いベースラインに対して59.88%の非ティー勝利率を達成したことを示す。
その結果, 化学推論は連続潜伏力学としてより自然かつ効果的に実現されているという実証的証拠が得られた。
論文 参考訳(メタデータ) (2026-02-06T01:28:27Z) - How well can off-the-shelf LLMs elucidate molecular structures from mass spectra using chain-of-thought reasoning? [51.286853421822705]
大規模言語モデル (LLM) は推論集約的な科学的タスクを約束するが、化学的解釈の能力はまだ不明である。
我々は、分子構造を予測するために、LLMが質量スペクトルデータに対してどのように理由を持つかを評価する、Chain-of-Thought(CoT)プロンプトフレームワークとベンチマークを導入する。
SMILESの妥当性, 式整合性, 構造的類似性の指標による評価の結果, LLMは合成学的に有効で, 部分的に可視な構造を生成できるが, 分子予測の正確性やリンク推論を達成できないことがわかった。
論文 参考訳(メタデータ) (2026-01-09T20:08:42Z) - Peeling Context from Cause for Multimodal Molecular Property Prediction [12.900046337617546]
CLaP(Causal Layerwise Peeling)は、因果信号をコンテキストから階層的に分離するフレームワークである。
CLaPは、競争ベースラインよりもMAE、MSE、R2$を一貫して改善する。
原子レベルの因果正性マップを生成し、予測に責任を負う部分構造をハイライトする。
論文 参考訳(メタデータ) (2025-11-10T04:29:33Z) - Explainable Molecular Property Prediction: Aligning Chemical Concepts with Predictions via Language Models [26.838674632817877]
言語モデルに基づく分子特性予測のためのフレームワークを開発し,これをLamoleと呼ぶ。
文字列ベースの分子表現 -- Group SELFIES -- を入力トークンとして、事前にトレーニングし、Lamoleを微調整します。
我々はLamoleが同等の分類精度を達成でき、説明精度を最大14.3%向上させることができることを示した。
論文 参考訳(メタデータ) (2024-05-25T03:27:04Z) - Empirical Evidence for the Fragment level Understanding on Drug
Molecular Structure of LLMs [16.508471997999496]
言語モデルが1次元配列から化学空間構造をどう理解するかについて検討する。
その結果,分子断片の観点から,言語モデルで化学構造が理解できることが示唆された。
論文 参考訳(メタデータ) (2024-01-15T12:53:58Z) - Atom-Motif Contrastive Transformer for Molecular Property Prediction [68.85399466928976]
グラフトランス (GT) モデルは分子特性予測 (MPP) のタスクで広く利用されている。
本稿では,原子レベルの相互作用を探索し,モチーフレベルの相互作用を考慮した新しいAtom-Motif Contrastive Transformer(AMCT)を提案する。
提案したAMCTは,7つの一般的なベンチマークデータセットに対して広範囲に評価され,定量的および定性的な結果の両方が有効であることを示す。
論文 参考訳(メタデータ) (2023-10-11T10:03:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。