論文の概要: Developing and Validating the Spanish Version of the Large Language Models Dependency Scale (LLM-D12-SP)
- arxiv url: http://arxiv.org/abs/2607.22041v1
- Date: Fri, 24 Jul 2026 07:09:56 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-27 20:58:57.072265
- Title: Developing and Validating the Spanish Version of the Large Language Models Dependency Scale (LLM-D12-SP)
- Title(参考訳): 大規模言語モデル依存尺度(LLM-D12-SP)のスペイン語版の開発と検証
- Abstract要約: 大規模言語モデル(LLM)に対する心理的依存を評価するため、信頼性と文化的に検証された機器の必要性が高まっている。
本研究は,Large Language Model Dependency Scale (LLM-D12-SP) のスペイン語版の最初の検証を報告する。
- 参考スコア(独自算出の注目度): 1.6375706215572936
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: There is a growing need for reliable and culturally validated instruments to assess psychological dependency on large language models (LLMs), particularly as LLMs are increasingly used for task execution, decision-making, and communication in organizational and work-related settings. This need is especially relevant for Spanish-speaking populations, where LLM adoption is rapidly expanding, yet validated psychometric tools remain scarce. The present study reports the first validation of the Spanish version of the Large Language Model Dependency Scale (LLM-D12-SP), extending prior validations conducted in English- and Arabic-speaking samples. The LLM-D12 is a two-dimensional instrument assessing Instrumental Dependency (reliance on LLMs for performing tasks and supporting decisions) and Relationship Dependency (psychological reliance on LLMs for companionship and social interaction). A total of 386 Spanish-speaking participants (M = 28.0 years, SD = 6.1; 55% male) completed the LLM-D12-SP. Confirmatory factor analysis supported the original two-factor structure. The scale demonstrated good internal consistency (Cronbach's alpha = 0.89 total; 0.86 Instrumental; 0.85 Relationship). Discriminant validity analyses indicated that the two subscales represent related but distinct constructs. External validation showed that both dependency dimensions were positively associated with internet addiction and perceived trustworthiness of LLMs, while showing weak or no association with need for cognition. Together with prior English and Arabic validations, these findings establish cross-linguistic support for the scale's structure and provide a psychometrically sound tool for investigating psychological aspects of LLM use in organizational contexts.
- Abstract(参考訳): 大規模言語モデル(LLM)に対する心理的依存を評価するための信頼性と文化的に検証された機器の必要性が高まっている。
このニーズは、LSMの採用が急速に拡大しているが、検証された心理測定ツールが不足しているスペイン語話者に特に関係している。
本研究は,Large Language Model Dependency Scale (LLM-D12-SP) のスペイン語版の最初の検証を報告する。
LLM-D12(英: LLM-D12)は、機器依存度(LLMのタスクの実行と意思決定支援への信頼)と関係依存度(LLMの協力と社会的相互作用への心理的依存)を評価する2次元の機器である。
386人のスペイン語話者(M = 28.0年、SD = 6.1; 55% 男性)がLSM-D12-SPを完成させた。
確認因子分析は元の2因子構造を支持した。
このスケールは良好な内部整合性を示した(クロンバッハのα = 0.89 計0.86 Instrumental, 0.85 関係性)。
識別妥当性分析の結果,2つのサブスケールは関連性はあるものの,異なる構造を示すことが明らかとなった。
外的検証では、両方の依存次元がインターネット依存症とLLMの信頼感に肯定的に関連し、認知の必要性に弱くも無関係であることが示された。
これらの知見は、以前の英語とアラビア語の検証とともに、スケールの構造に対する言語横断的な支持を確立し、組織的文脈におけるLLMの使用の心理的側面を調査するための心理的に健全なツールを提供する。
関連論文リスト
- Do Assessment Instruments Measure the Same Thing for Humans and LLMs? A Latent Structure Analysis [0.0]
本研究では,大規模言語モデル(LLM)に対する評価に対する応答の潜在構造における類似性について検討する。
ヒトとLDMの因子構造には系統的な違いが見られ、解析されたアセスメントがヒトとLSMの同じ構造を測ることができないことを示す。
これらの知見は、AI能力に関する主張を行うために教育評価を使用する評価実践の有効性を疑問視している。
論文 参考訳(メタデータ) (2026-08-16T08:52:58Z) - The Emergence of Abstract Thought in Large Language Models Beyond Any Language [95.50197866832772]
大規模言語モデル(LLM)は様々な言語で効果的に機能する。
予備的研究では、LLMの隠れた活性化は、英語以外のプロンプトに反応してもしばしば英語に類似している。
近年の結果は多言語のパフォーマンスが強く、他の言語での特定のタスクにおける英語のパフォーマンスを超えている。
論文 参考訳(メタデータ) (2025-06-11T16:00:54Z) - LLM-D12: A Dual-Dimensional Scale of Instrumental and Relational Dependencies on Large Language Models [0.24629531282150877]
人々が大規模言語モデル(LLM)とどのように相互作用するかを理解することへの関心が高まっている。
LLM-D12(LLM-D12)とよばれるLCM依存度を測定する新しい12項目アンケートを開発し,その妥当性を検証した。
このスケールは、著者の以前の理論的研究に基づいており、それに応じてアイテムが開発され、イギリスで526人の参加者から回答が集められた。
論文 参考訳(メタデータ) (2025-06-07T17:42:21Z) - When Less Language is More: Language-Reasoning Disentanglement Makes LLMs Better Multilingual Reasoners [111.50503126693444]
言語固有のアブレーションは多言語推論性能を継続的に向上させることを示す。
トレーニング後のアブレーションと比較して、トレーニング不要のアブレーションは、計算オーバーヘッドを最小限に抑えながら、同等または優れた結果が得られる。
論文 参考訳(メタデータ) (2025-05-21T08:35:05Z) - Understanding LLMs' Cross-Lingual Context Retrieval: How Good It Is And Where It Comes From [73.76577052090695]
12言語にわたる40以上の大言語モデル(LLM)の言語間コンテキスト検索を評価する。
訓練後のオープン LLM は、クローズドソース LLM に匹敵する、強い言語間コンテキスト検索能力を示す。
以上の結果から, 大規模プレトレーニングではxMRCの性能が向上できないことが示唆された。
論文 参考訳(メタデータ) (2025-04-15T06:35:27Z) - Disparities in LLM Reasoning Accuracy and Explanations: A Case Study on African American English [66.97110551643722]
本研究では,Large Language Models (LLMs) 推論タスクにおける方言の相違について検討する。
LLMは、AAE入力に対するより正確な応答とより単純な推論チェーンと説明を生成する。
これらの知見は、LLMの処理方法と異なる言語品種の理由の体系的差異を浮き彫りにした。
論文 参考訳(メタデータ) (2025-03-06T05:15:34Z) - ExpliCa: Evaluating Explicit Causal Reasoning in Large Language Models [75.05436691700572]
明示的な因果推論において,LLM(Large Language Models)を評価するための新しいデータセットであるExpliCaを紹介する。
ExpliCa上で7つの商用およびオープンソース LLM をテストしました。
驚くべきことに、モデルは因果関係と時間的関係を関連付ける傾向にあり、そのパフォーマンスはイベントの言語的順序にも強く影響される。
論文 参考訳(メタデータ) (2025-02-21T14:23:14Z) - Large Language Models as Neurolinguistic Subjects: Discrepancy between Performance and Competence [49.60849499134362]
本研究では,大言語モデル(LLM)の記号化(形式)および記号化(意味)に関する言語的理解について検討する。
ミニマルペアと診断プローブを組み合わせてモデル層間のアクティベーションパターンを解析する新しい手法を用いて,ニューロ言語学的アプローチを提案する。
その結果,(1)心理言語学的・神経言語学的手法では,言語能力と能力が異なっていること,(2)直接確率測定では言語能力が正確に評価されないこと,(3)指導のチューニングでは能力が大きく変化しないが,性能は向上しないことがわかった。
論文 参考訳(メタデータ) (2024-11-12T04:16:44Z) - LMLPA: Language Model Linguistic Personality Assessment [11.599282127259736]
大規模言語モデル(LLM)は、日常の生活や研究にますます利用されている。
与えられたLLMの性格を測定することは、現在課題である。
言語モデル言語パーソナリティアセスメント(LMLPA)は,LLMの言語的パーソナリティを評価するシステムである。
論文 参考訳(メタデータ) (2024-10-23T07:48:51Z) - MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models [23.384966485398184]
本稿では,多言語信頼度推定(MlingConf)の大規模言語モデル(LLM)に関する包括的調査を紹介する。
このベンチマークは、LAタスクのための4つの厳密にチェックされ、人間によって評価された高品質な多言語データセットと、言語の特定の社会的、文化的、地理的コンテキストに合わせて調整されたLSタスクからなる。
LAのタスクでは、英語が他の言語よりも言語的優位性を示す一方で、LSタスクでは、質問関連言語を用いてLSMを誘導し、多言語的信頼度推定において言語的優位性を改善することが示されている。
論文 参考訳(メタデータ) (2024-10-16T11:46:55Z) - The Power of Question Translation Training in Multilingual Reasoning: Broadened Scope and Deepened Insights [108.40766216456413]
大規模言語モデルの英語と非英語のパフォーマンスのギャップを埋めるための質問アライメントフレームワークを提案する。
実験結果から、さまざまな推論シナリオ、モデルファミリー、サイズにわたって、多言語のパフォーマンスを向上できることが示された。
我々は、表現空間、生成された応答とデータスケールを分析し、質問翻訳訓練がLLM内の言語アライメントをどのように強化するかを明らかにする。
論文 参考訳(メタデータ) (2024-05-02T14:49:50Z) - MlingConf: A Comprehensive Study of Multilingual Confidence Estimation on Large Language Models [36.33453112932689]
本稿では,多言語信頼度推定(MlingConf)の大規模言語モデル(LLM)に関する包括的調査を紹介する。
このベンチマークは、LAタスクのための4つの厳密にチェックされ、人間によって評価された高品質な多言語データセットと、言語の特定の社会的、文化的、地理的コンテキストに合わせて調整されたLSタスクからなる。
LAのタスクでは、英語が他の言語よりも言語的優位性を示す一方で、LSタスクでは、質問関連言語を用いてLSMを誘導し、多言語的信頼度推定において言語的優位性を改善することが示されている。
論文 参考訳(メタデータ) (2024-02-21T08:20:06Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。