論文の概要: Hypothesis Generation and Inductive Inference in Children and Language Models
- arxiv url: http://arxiv.org/abs/2605.24528v2
- Date: Sat, 30 May 2026 22:18:51 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-02 18:24:16.327146
- Title: Hypothesis Generation and Inductive Inference in Children and Language Models
- Title(参考訳): 子どもの仮説生成と帰納的推論と言語モデル
- Abstract要約: 子どもの情報探索行動は,その基盤となるコストと帰納的バイアスを明瞭に表している。
子どもたちは環境構造に似通っているが、情報探索行動は、その基盤となるコストと帰納バイアスをはっきりと示している。
- 参考スコア(独自算出の注目度): 12.788661643800099
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Real world decision-making requires constructing mental models under uncertainty over evidence, over the underlying causal rules, and over the state of the world itself. Which computational principles underpin human inference under such conditions, and do LLM-based agents exhibit similar behavior given matching constraints? We address these questions using an inductive inference Box Task in which participants, human children and LLM-based agents, infer a latent cause through sequential interaction with an uncertain environment. We formalize this task as program induction with Bayesian particle-based inference, admitting two complementary interpretations: (1) as a constraint satisfaction process over hypotheses, and (2) as a program synthesis problem in which hypotheses are executable programs evaluated against evidence. Using the constraint-based formulation, we show that children's behavior is best explained by a combination of subjective evidence reliability and online hypothesis generation, accounting for both their evidence-seeking patterns and their dissociation between task completion and rule generalization. Using the program synthesis formulation, we treat LLM-based agents as model organisms: controllable systems that allow systematic manipulation of task conditions. Across backends, LLM-based agents replicate children's responses to changes in evidence reliability and observability, including discounting unreliable evidence, seeking to resolve partial information, and dissociating between task completion and causal generalization. At the same time, LLM-based agents tend to over-observe and over-comply with instructions relative to children. These results suggest that while children and LLM-based agents adapt similarly to environmental structure, their information-seeking behavior exhibits distinct underlying costs and inductive biases.
- Abstract(参考訳): 現実世界の意思決定には、証拠、根底にある因果関係の規則、そして世界の状態そのものに対する不確実性の下でメンタルモデルを構築する必要がある。
そのような条件下では、どの計算原理が人間の推論の基盤となり、LLMベースのエージェントは、一致する制約が与えられた場合と同様の振る舞いを示すのか?
本研究では,不確実な環境との逐次的な相互作用を通じて,参加者,ヒトの子供,LSMベースのエージェントが潜伏原因を推測する帰納的推論ボックスタスクを用いて,これらの疑問に対処する。
本研究では,(1)仮説に対する制約満足度プロセスとして,(2)仮説がエビデンスに対して実行可能なプログラムとして評価されるプログラム合成問題として,ベイズ粒子に基づく推論によるプログラム誘導として,このタスクを形式化する。
制約に基づく定式化を用いて、子どもの行動は、主観的エビデンス信頼性とオンライン仮説生成の組み合わせによって最もよく説明され、エビデンス探索パターンとタスク完了とルール一般化の解離を考慮に入れている。
プログラム合成の定式化を用いて, LLM をモデル生物として扱う。
バックエンド全体で、LCMベースのエージェントは、信頼できない証拠の割引、部分的な情報の解決、タスク完了と因果的一般化の解離など、証拠の信頼性と可観測性の変化に対する子供の反応を再現する。
同時に、LSMをベースとしたエージェントは、子供に対する指示を過剰に保護し、過度に補完する傾向にある。
以上の結果から,子どもやLSMをベースとしたエージェントは環境構造に類似して適応するが,その情報探索行動は,その基盤となるコストと帰納バイアスを顕著に示すことが示唆された。
関連論文リスト
- From Actions to Understanding: Conformal Interpretability of Temporal Concepts in LLM Agents [45.1959078540948]
大規模言語モデル(LLM)は、対話的な環境で推論、計画、行動が可能な自律エージェントとして、ますます多くデプロイされている。
本稿では,LLMエージェントにおける概念の時間的進化をステップワイドな共形レンズで解釈する枠組みを提案する。
論文 参考訳(メタデータ) (2026-03-27T22:29:01Z) - On the Paradoxical Interference between Instruction-Following and Task Solving [50.75960598434753]
次の命令は、大規模言語モデル(LLM)を、タスクの実行方法に関する明示的な制約を指定することで、人間の意図と整合させることを目的としている。
我々は,LLMのタスク解決能力にパラドックス的に干渉する命令に従うという,直感に反する現象を明らかにした。
本稿では,タスク解決に追従する命令の干渉を定量化する指標として,SUSTAINSCOREを提案する。
論文 参考訳(メタデータ) (2026-01-29T17:48:56Z) - Towards Comprehensive Stage-wise Benchmarking of Large Language Models in Fact-Checking [64.97768177044355]
大規模言語モデル(LLM)は、現実のファクトチェックシステムにますます多くデプロイされている。
FactArenaは、完全に自動化されたアリーナスタイルの評価フレームワークである。
本研究では,静的クレーム検証精度とエンドツーエンドのファクトチェック能力の相違点を明らかにした。
論文 参考訳(メタデータ) (2026-01-06T02:51:56Z) - A comprehensive taxonomy of hallucinations in Large Language Models [0.0]
大型言語モデル (LLM) は自然言語処理に革命をもたらしたが、幻覚の確率は依然として重要な課題である。
本報告では, LLM幻覚の包括的分類を, 形式的定義と理論的枠組みから開始する。
根本原因を分析し、それらをデータ関連問題、モデル関連要因、およびプロンプト関連の影響に分類する。
論文 参考訳(メタデータ) (2025-08-03T14:37:16Z) - Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models [76.6028674686018]
エージェントの精神状態を追跡するための推論時間推論アルゴリズムである思考トレースを導入する。
提案アルゴリズムは,ベイズ理論をモデルとした。
本研究は,様々なベンチマークにおける思考トレーシングを評価し,大幅な性能向上を実証した。
論文 参考訳(メタデータ) (2025-02-17T15:08:50Z) - Failure Modes of LLMs for Causal Reasoning on Narratives [51.19592551510628]
世界の知識と論理的推論の相互作用について検討する。
最先端の大規模言語モデル(LLM)は、しばしば表面的な一般化に依存している。
タスクの単純な再構成により、より堅牢な推論行動が引き起こされることを示す。
論文 参考訳(メタデータ) (2024-10-31T12:48:58Z) - Language Agents Meet Causality -- Bridging LLMs and Causal World Models [50.79984529172807]
因果表現学習を大規模言語モデルと統合する枠組みを提案する。
このフレームワークは、自然言語表現に関連付けられた因果変数を持つ因果世界モデルを学ぶ。
本研究では,時間的スケールと環境の複雑さを考慮した因果推論と計画課題の枠組みを評価する。
論文 参考訳(メタデータ) (2024-10-25T18:36:37Z) - IDEA: Enhancing the Rule Learning Ability of Large Language Model Agent through Induction, Deduction, and Abduction [3.961279440272764]
対話型環境下での大規模言語モデルのルール学習能力を評価するためにRULEARNを導入する。
誘導, 誘引, アブダクションのプロセスを統合する新しい推論フレームワークであるIDEAを提案する。
5つの代表的なLCMを含むIDEAフレームワークの評価は,ベースラインよりも大幅に改善されている。
論文 参考訳(メタデータ) (2024-08-19T23:37:07Z) - Latent Causal Probing: A Formal Perspective on Probing with Causal Models of Data [3.376269351435396]
構造因果モデル(SCM)を用いた探索の形式的視点を開発する。
我々は,合成グリッドワールドナビゲーションタスクの文脈において,最近のLMの研究を拡張した。
我々の手法は、LMがテキストの根底にある潜在概念を誘発する能力を示す、堅牢な実証的な証拠を提供する。
論文 参考訳(メタデータ) (2024-07-18T17:59:27Z) - Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement [92.61557711360652]
言語モデル(LM)は、しばしば帰納的推論に不足する。
我々は,反復的仮説修正を通じて,LMの帰納的推論能力を体系的に研究する。
本研究は, LMの誘導的推論過程と人間とのいくつかの相違点を明らかにし, 誘導的推論タスクにおけるLMの使用の可能性と限界に光を当てる。
論文 参考訳(メタデータ) (2023-10-12T17:51:10Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。