論文の概要: Leveraging Speech to Identify Signatures of Insight and Transfer in Problem Solving
- arxiv url: http://arxiv.org/abs/2605.12970v3
- Date: Mon, 18 May 2026 17:02:00 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-19 17:57:45.8011
- Title: Leveraging Speech to Identify Signatures of Insight and Transfer in Problem Solving
- Title(参考訳): 問題解決におけるインテリジェンスと伝達のシグネチャを識別する音声の活用
- Abstract要約: 我々は参加者に対して,5つの「マッチスティック・アジュメティクス」問題の連続を解こうとするときに,声高に考えるように求めた。
これらの問題は、すべて同じ種類の非可観測解 (Same group) か、毎回別の種 (Different group) に依存している。
次に、自然言語処理のテクニックを活用し、参加者のスピーチを分析することで、参加者の会話量と発言内容の両方に変化が伴うことがわかりました。
- 参考スコア(独自算出の注目度): 4.242871385276241
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Many problems seem to require a flash of insight to solve. What form do these sudden insights take, and what impact do they have on how people approach similar problems in the future? In this work, we prompted participants (N = 189) to think aloud as they attempted to solve a sequence of five "matchstick-arithmetic" problems. These problems either all relied on the same kind of non-obvious solution (Same group) or a different kind each time (Different group). Our first observation was that Same participants improved more rapidly than Different participants. We then leveraged techniques from natural language processing to analyze participants' speech, and found that this accelerated improvement for Same participants was accompanied by changes in both how much they spoke and what they said. In particular, they were more likely to spontaneously label the kind of problem they were working on. Taken together, these findings suggest that a hallmark of transferable insights is their accessibility for verbal report, even if the underlying precursors of insight remain difficult to articulate.
- Abstract(参考訳): 多くの問題は、解決すべき洞察のフラッシュを必要としているようだ。
これらの突然の洞察はどのような形で、また、人々が将来同様の問題にどのようにアプローチするかにどんな影響を与えますか?
本研究では,被験者(N=189)に対して,5つの「マッチスティック・アジュメティクス」問題の系列を解こうとするときに,声を出して考えるように促した。
これらの問題はいずれも同じ種類の非可観測解 (Same group) か、毎回別の種 (Different group) に依存していた。
最初の観察では、同じ参加者は異なる参加者よりも急速に改善した。
次に、自然言語処理のテクニックを活用し、参加者のスピーチを分析することで、参加者の会話量と発言内容の両方に変化が伴うことがわかりました。
特に彼らは、自分たちが取り組んでいる問題に自発的にラベルを付ける傾向がありました。
これらの知見を総合すると, 伝達可能な洞察の目印は, たとえ基礎となる洞察の先駆的存在が理解しづらいままであっても, 言語レポートのアクセシビリティであることがわかる。
関連論文リスト
- Informal Learning Emerges in Everyday Human-LLM Interaction [74.53081471113929]
日常の人間とLLMの相互作用は、非公式学習の計測可能、選択的、条件付き行動シグネチャを含むことを示す。
彼らはAI評価を、回答提供効率から、ユーザが推論し、テストし、理解を構築するための認知機会の保存へとシフトする。
論文 参考訳(メタデータ) (2026-07-20T07:56:41Z) - Say What? Examining Text and Voice Input Modalities for Prompt-Based Programming in Computing Education [18.18479797325814]
本研究では,プログラミング学生がプロンプト問題とどのように相互作用するかを検討した。
プロンプト問題は、正しいコードを生成するために自然言語のプロンプトを作成する必要があるプログラミングタスクである。
テキストを使ってプロンプトを入力した学生は、最初の試みでそのプロンプトを成功させる可能性が高かった。
学生が提出前に書き起こした音声のプロンプトを編集しても、成功率に差はなかった。
論文 参考訳(メタデータ) (2026-07-07T04:04:23Z) - A Closer Look at Failure Modes in Temporal Understanding of Large Audio-Language Models [64.68800440221138]
大規模音声言語モデル(LALM)は、様々な音声理解タスクにおいて高いパフォーマンスを達成するが、時間的推論に苦慮する。
メカニスティック解析のために設計された3つの基礎的タスクに対して,1,657問のベンチマークを導入する。
拡張性に対する注意の重み付けを比較すると、音声トークン間での注意の再分配は、音声の注意を増大させるよりも効果的であることがわかった。
論文 参考訳(メタデータ) (2026-06-16T01:57:56Z) - From Use to Oversight: How Mental Models Influence User Behavior and Output in AI Writing Assistants [70.1699066541501]
システムの動作に関する機能的、あるいは関連性、システムの動作に関する構造的、あるいは関連性という、2つのタイプのメンタルモデルについて検討する。
構造的精神モデル状態の参加者は、システムに対する理解を深める一方、これはバックフィリング効果をもたらす可能性がある。
論文 参考訳(メタデータ) (2026-04-06T20:50:44Z) - Covertly improving intelligibility with data-driven adaptations of speech timing [3.61940804174624]
音声の精度をより正確に制御できる機械音声の最近の進歩を生かしている。
対象母音のコントラストに先行する発話速度の時間的影響は,実際にはさみ様パターンに現れることを示す。
我々は、この時間構造を新しい音声シーケンスで再現するデータ駆動音声合成アルゴリズムを構築した。
論文 参考訳(メタデータ) (2026-03-31T17:30:47Z) - Exploring Human Behavior During Abstract Rule Inference and Problem Solving with the Cognitive Abstraction and Reasoning Corpus [0.32834818175343855]
人間は抽象的推論において顕著な柔軟性を示し、緩やかな例から素早く学習し、規則を適用することができる。
抽象・推論コーパス(ARC)の多種多様な人間適応サブセットである認知抽象・推論コーパス(CogARC)を紹介する。
CogARCは、75の抽象的な視覚的推論問題に対する解を自由に生成する260人の参加者に投与された。
論文 参考訳(メタデータ) (2026-02-25T21:01:47Z) - Oversmoothing, Oversquashing, Heterophily, Long-Range, and more: Demystifying Common Beliefs in Graph Machine Learning [4.020829863982153]
我々は,過密・過密,ホモフィリー・ヘテロフィリー二分法,長期的課題に焦点をあてる。
このことが研究課題の曖昧さを招き、研究者が正確な研究課題に焦点を合わせるのを妨げていると我々は主張する。
私たちのコントリビューションは、このような共通の信念を明確にし、これらのトピックに関して批判的な思考を奨励したいと思っています。
論文 参考訳(メタデータ) (2025-05-21T14:11:59Z) - Stay Focused: Problem Drift in Multi-Agent Debate [7.156386767951493]
複数のターンに対するマルチエージェントの議論が、初期問題から脱却し、タスク性能を損なうかを分析する。
この漂流に関する最も一般的な問題は、進歩の欠如、低品質のフィードバック、明確さの欠如である。
DRIFTPolicyは,問題ドリフトケースを軽減し,タスク性能を向上させる手法である。
論文 参考訳(メタデータ) (2025-02-26T20:54:51Z) - A Knapsack by Any Other Name: Presentation impacts LLM performance on NP-hard problems [64.05451567422342]
自然言語で表現されたNPハード問題の集合であるEveryday Hard Optimization Problems (EHOP) のデータセットを紹介する。
EHOPには、コンピュータサイエンスの教科書(例えば、グラフカラー化)で見られる問題の定式化が含まれている。
複数のプロンプト戦略にまたがる最先端のLCMは、実生活や逆転よりも正確な教科書問題を解くことができる。
論文 参考訳(メタデータ) (2025-02-19T14:39:59Z) - Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs [86.79757571440082]
OpenAIのo1のような大規模言語モデル(LLM)は複雑な推論タスクにおいて顕著な能力を示している。
我々は、o1-like LLMがしばしば異なる理性的思考を切り替える、という現象を特定する。
本稿では,思考間の早期移行を回避できる思考切替ペナルティTIPを用いた復号戦略を提案する。
論文 参考訳(メタデータ) (2025-01-30T18:58:18Z) - Can Model Uncertainty Function as a Proxy for Multiple-Choice Question Item Difficulty? [12.638577140117702]
我々は、質問に答える際の弱点と見なされるような、生成的な大規模モデルの側面を活用する。
本研究では、不確実性の2つの異なる指標と実際の学生の反応分布の相関について検討する。
論文 参考訳(メタデータ) (2024-07-07T10:48:04Z) - Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones? [65.43882564649721]
大きな言語モデル(LLM)は印象的な機能を示しているが、それでも矛盾する問題に悩まされている。
我々はConsisEvalベンチマークを開発し、各エントリは厳密な難易度で2つの質問から構成される。
相対的整合性スコアによる整合性向上の可能性を分析する。
論文 参考訳(メタデータ) (2024-06-18T17:25:47Z) - Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners? [140.9751389452011]
本研究では,大言語モデル(LLM)の偏りを,算術語問題を解く際に,子どもに知られているものと関連づけて検討する。
我々は,これらの各テストに対して,問題特徴のきめ細かい制御を可能にするニューロシンボリックアプローチを用いて,新しい単語問題を生成する。
論文 参考訳(メタデータ) (2024-01-31T18:48:20Z) - Hearing Loss Detection from Facial Expressions in One-on-one
Conversations [20.12296163231457]
聴覚障害のある人は、特に騒々しい環境では会話が困難である。
この困難はしばしば行動の変化として現れ、不快感や疲労などの表情によって捉えられる。
我々は,このアイデアに基づいて,会話中の人物の表情から聴覚障害を検出する問題を提起する。
論文 参考訳(メタデータ) (2024-01-17T04:52:32Z) - MacGyver: Are Large Language Models Creative Problem Solvers? [87.70522322728581]
本稿では, 現代LLMの創造的問題解決能力について, 制約付き環境下で検討する。
我々は1,600以上の実世界の問題からなる自動生成データセットであるMACGYVERを作成する。
我々はLLMと人間の両方にコレクションを提示し、それらの問題解決能力を比較して比較する。
論文 参考訳(メタデータ) (2023-11-16T08:52:27Z) - Measuring and Narrowing the Compositionality Gap in Language Models [116.5228850227024]
モデルがすべてのサブプロブレムに正しく答えられる頻度を計測するが、全体の解は生成しない。
我々は,思考の連鎖をさらに改善する新たな手法である自己認識法を提案する。
論文 参考訳(メタデータ) (2022-10-07T06:50:23Z) - Visual Perturbation-aware Collaborative Learning for Overcoming the
Language Prior Problem [60.0878532426877]
本稿では,視覚的摂動校正の観点から,新しい協調学習手法を提案する。
具体的には、異なる摂動範囲で2種類のキュレートされた画像を構築するための視覚コントローラを考案する。
2つの診断VQA-CPベンチマークデータセットの実験結果は、その効果を明らかに示している。
論文 参考訳(メタデータ) (2022-07-24T23:50:52Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。