論文の概要: Delusions and Harms Associated with AI Chatbot Use: Early Evidence from 185 Real-World Reports
- arxiv url: http://arxiv.org/abs/2609.08027v2
- Date: Wed, 09 Sep 2026 13:06:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-10 19:44:08.528607
- Title: Delusions and Harms Associated with AI Chatbot Use: Early Evidence from 185 Real-World Reports
- Title(参考訳): AIチャットボットの使用に伴う妄想とハーム:185のリアルワールドレポートから
- Authors: Hamilton Morrin, Vinitha Soundararajan, Thomas Cheliotis-James, Boris Warszawski, Joshua Fakulujo, Zeqi Jia, Etienne Brisson, Thomas A. Pollak,
- Abstract要約: 本研究の目的は、AIチャットボットの使用と関連する精神的健康被害の第一・第二のアカウントにおいて、心理病理学的特徴、行動、タイミング、成果を特徴づけることである。
95件のハンドハンドアカウントと90件のハンドハンドアカウントが分析された。
第一の結果は妄想的信念の存在であり、関連する臨床経験を持つペアラッカーによってコード化された。
一般的な結果は、隔離、関係の崩壊、入院、失業、財政損失であった。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Importance: Reports have raised concerns that AI chatbots may validate or elaborate delusional beliefs, respond inappropriately to suicidal ideation, and contribute to mental health harms, but real-world data on reported harms remain limited. Objective: To characterize psychopathological features, chatbot behaviors, timing, and outcomes in first- and second-hand accounts of mental health harm linked with AI chatbot use. Design: Cross-sectional secondary analysis of deidentified online survey responses gathered between August 7, 2025, and February 2, 2026. Main Outcomes and Measures: The primary quantitative outcome was the presence of delusional beliefs, coded by paired raters with relevant clinical experience. Additional variables included reason for chatbot use, current episode features, delusional content, chatbot validation of beliefs, harms, social and occupational consequences, healthcare use, and timing. Results: 95 first-hand and 90 second-hand accounts were analyzed. Median age was 35.0 (IQR 27.0 - 45.0). Raters coded descriptions consistent with delusional beliefs in 102 reports (55.1%), with chatbot validation of beliefs in 50/102 (49.0%). Common outcomes included isolation, relationship breakdown, hospital admission, job loss, and financial loss. Four second-hand reports described death by suicide. Conclusions: In this self-selected convenience sample, AI-chatbot-associated harms were frequently described in relation to delusional beliefs, perceived chatbot validation, intensive use, and substantial social, occupational, and clinical consequences. Because reports were retrospective, unverified, and collected from individuals seeking to report harm, our findings should be interpreted as preliminary signal detection rather than as suggesting prevalence or providing evidence of causality. Prospective surveillance and trajectory-based safety evaluations are needed.
- Abstract(参考訳): 重要性: 報告では、AIチャットボットが妄想的信念を検証または精巧に検証し、自殺の考えに不適切な反応をし、精神的な健康被害に寄与するのではないかという懸念が持ち上がっているが、報告された被害に関する現実世界のデータはまだ限られている。
目的:AIチャットボットの使用に関連する精神的健康被害の第一・第二のアカウントにおいて、心理病理学的特徴、チャットボットの行動、タイミング、成果を特徴付ける。
設計: 2025年8月7日から2026年2月2日にかけて, 特定オンライン調査回答の横断的二次分析を行った。
主なアウトカムと尺度: 主要な定量的結果は、関連する臨床経験を持つペアラッカーによってコード化された妄想的信念の存在であった。
その他の変数としては、チャットボットの使用理由、現在のエピソードの特徴、妄想的コンテンツ、信念のチャットボット検証、害、社会的および職業的結果、医療利用、タイミングなどがある。
結果: 初手95名, 中手90名について分析した。
年齢は35.0歳(IQR 27.0 - 45.0)。
ラッカーズは102レポート(55.1%)の妄想的信念と一致した記述をコーディングし、50/102(49.0%)の信念をチャットボットで検証した。
一般的な結果は、隔離、関係の崩壊、入院、失業、財政損失であった。
自殺で死亡したという報告が4件あった。
結論: この自己選択された利便性サンプルでは,AI-チャットボット関連障害が,妄想的信念,チャットボットの検証,集中的使用,社会的,職業的,臨床的結果との関連で頻繁に説明された。
報告は振り返りであり、未確認であり、害を報告しようとする個人から収集されたものであるので、我々の発見は、有病率を示すことや因果性の証拠を提供することよりも、予備的な信号検出として解釈されるべきである。
前方監視と軌道に基づく安全評価が必要である。
関連論文リスト
- DelusionEval: Measuring Delusion-Linked Behaviors in AI Chatbots [49.59847654758852]
メンタルヘルスの専門家は、大きな言語モデル(LLM)との相互作用による心理的害のリスクを懸念している。
我々はDelusionEvalを開発した。DelusionEvalは、モデルがユーザの妄想を助長する行動を示す傾向をテストするための評価プロトコルである。
評価されたLCMが妄想関連行動を示す傾向は, モデルサイズ, リリース日, テストタイム推論の有無と確実に相関しないことがわかった。
論文 参考訳(メタデータ) (2026-08-05T16:11:08Z) - Interrupting the Chain: Human Perception of AI-Generated Disinformation Through a Kill Chain Lens [47.03825808787752]
本研究は,ニュースの断片を原点(人間対機械)と真偽(本物対偽)で分類する人間-対象研究から得られた経験的知見を提示する。
我々は、介入のための分類として、適応されたサイバーセキュリティキルチェーンを用いて、認知的攻撃ライフサイクルの段階に知覚データをマッピングする結果を編成する。
3つの主要な発見は,(1)疑念の高揚が検出を改善しない知覚精度のギャップ,(2)現代のLSMは人間の識別不可能なテキストを頻繁に生成する,(3)偽ニュース検出が持続的暴露下で10.2ポイント低下し,AI-オリジン検出が安定している不斉認知疲労効果である。
論文 参考訳(メタデータ) (2026-07-26T15:40:41Z) - VERA-MH: Validation of Ethical and Responsible AI in Mental Health [0.0]
精神保健支援の文脈において,チャットボットの安全性に関する臨床的に検証された新しい評価であるVERA-MHを紹介する。
VERA-MHは会話シミュレーション、会話判定、モデル評価の3つのステップから構成される。
論文 参考訳(メタデータ) (2026-05-13T10:31:48Z) - Characterizing Delusional Spirals through Human-LLM Chat Logs [25.098985786805557]
大言語モデル(LLMs)は、妄想、自傷、AI精神病などの否定的な心理的影響の逸話的報告を乱し、増殖してきた」。
ユーザーとチャットボットが長い妄想の渦巻の中でどのように相互作用するか、まだ不明です」
本報告では,このような高頻度かつ極めて有害な症例の詳細な研究について紹介する。
論文 参考訳(メタデータ) (2026-03-17T14:24:32Z) - Sycophantic Chatbots Cause Delusional Spiraling, Even in Ideal Bayesians [47.64440749179653]
理想化されたベイズレーショナルユーザでさえ,妄想スパイラルに対して脆弱であることを示す。
この効果は2つの候補の緩和に面して持続する。
論文 参考訳(メタデータ) (2026-02-22T12:13:44Z) - Assessing the robustness of heterogeneous treatment effects in survival analysis under informative censoring [50.164756034797136]
臨床研究ではドロップアウトが一般的で、副作用やその他の理由で患者の半数以上が早期に退院する。
ドロップアウトが有益な場合、治療効果の推定値にもバイアスがかかるため、検閲バイアスが導入される。
検閲バイアスに直面した場合の生存分析における条件平均処理効果推定のロバスト性を評価するための仮定リーンフレームワークを提案する。
論文 参考訳(メタデータ) (2025-10-15T10:51:17Z) - Technological folie à deux: Feedback Loops Between AI Chatbots and Mental Illness [11.364198566966204]
精神状態の人はチャットボットによる信念の不安定化と依存のリスクを増大させる。
現在のAIの安全性対策は、これらのインタラクションベースのリスクに対処するには不十分だ。
このような公衆衛生上の懸念に対処するためには、臨床実践、AI開発、規制フレームワークを越えて協調的な行動が必要である。
論文 参考訳(メタデータ) (2025-07-25T12:38:54Z) - Development and Evaluation of HopeBot: an LLM-based chatbot for structured and interactive PHQ-9 depression screening [48.355615275247786]
HopeBotは、PHQ-9(Patent Health Questionnaire-9)を検索強化世代とリアルタイムの明確化を用いて管理する。
内部調査では、英国と中国の132人の成人が、自己管理版とチャットボット版の両方を完成させた。
全体の87.1%は、ホープボットの再利用や推奨を表明している。
論文 参考訳(メタデータ) (2025-07-08T13:41:22Z) - World Trade Center responders in their own words: Predicting PTSD
symptom trajectories with AI-based language analyses of interviews [6.700088567524812]
本研究は、応答者間のPTSD症状の軌跡を予測するためのAIに基づく言語アセスメントの能力を検証した。
横断的に、より大きな抑うつ言語(beta=0.32; p43)と一対一の特異な使用(beta=0.31; p44)は、症状の重症度の増加に関連していた。
長文使用率 (beta=-0.36; p7) と長文使用率 (beta=-0.36; p7) は改善を予測した。
論文 参考訳(メタデータ) (2020-11-12T15:57:23Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。