論文の概要: What Language Does and What the Evidence Supports: A Functional Role Taxonomy and Evidence Audit of Language Grounding in Embodied Agents
- arxiv url: http://arxiv.org/abs/2608.03099v1
- Date: Tue, 04 Aug 2026 04:17:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-05 15:30:23.028322
- Title: What Language Does and What the Evidence Supports: A Functional Role Taxonomy and Evidence Audit of Language Grounding in Embodied Agents
- Title(参考訳): 言語がするものとエビデンス: 身体的エージェントにおける言語基盤の機能的役割分類とエビデンス監査
- Abstract要約: ファウンデーション・モデルは、実施されたエージェント全体に言語を配置するが、その存在は、それが貢献するものや、その貢献がどの程度根底にあるかを示すものではない。
言語における非排他的機能的役割として,仕様,身体表現,行動オーケストレーション,接地規則,実行結合の5つを定義した。
このフレームワークをレビュー文献に適用すると、機能的使用と明らかなサポートの間には、繰り返し発生するギャップが明らかになる。
- 参考スコア(独自算出の注目度): 20.59698603062795
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Foundation models place language throughout embodied agents, but its presence does not show what it contributes or how well that contribution is grounded. This survey separates these two questions. We define five non-exclusive functional roles for language: Specification, Embodied Representation, Action Orchestration, Grounding Regulation, and Execution Coupling. For each role, we trace the path from linguistic content to its embodied consumer and identify the observations or interventions that can test the claimed responsibility. Applying this framework to the reviewed literature reveals a recurring gap between functional use and evidential support. Interpretable or revised linguistic intermediates may be incorrect, go unused, or fail to affect later behavior. Even when actions are directly conditioned on language, system-level success does not by itself isolate language's contribution. We therefore evaluate grounding claim by claim, asking whether the reported evidence supports the specific responsibility assigned to language. Using role claims rather than architectures as the unit of comparison allows us to compare modular and end-to-end embodied agents without extending conclusions beyond the reported evidence.
- Abstract(参考訳): ファウンデーション・モデルは、実施されたエージェント全体に言語を配置するが、その存在は、それが貢献するものや、その貢献がどの程度根底にあるかを示すものではない。
この調査はこれらの2つの質問を分離する。
言語における非排他的機能的役割として,仕様,身体表現,行動オーケストレーション,接地規則,実行結合の5つを定義した。
それぞれの役割について,言語コンテンツから具体的消費者への道筋を辿り,要求された責任を検証できる観察や介入を特定する。
このフレームワークをレビュー文献に適用すると、機能的使用と明らかなサポートの間には、繰り返し発生するギャップが明らかになる。
解釈可能な言語中間体または修正された言語中間体は、誤用、未使用、または後の行動に影響を与えない可能性がある。
アクションが言語に直接条件付けされている場合でも、システムレベルの成功はそれ自体が言語の貢献を隔離するものではない。
したがって、我々は、報告された証拠が言語に割り当てられた特定の責任を支持するかどうかを問う、クレームによる根拠的主張を評価する。
比較単位としてアーキテクチャではなくロールクレームを使用することで、報告された証拠を超えて結論を延ばすことなく、モジュラーエージェントとエンドツーエンドエージェントを比較することができる。
関連論文リスト
- Probing in the Wild: A Case Study of Self-Supervised Speech Representations on Mandarin Sub-dialects with Unsupervised Articulatory Analysis [1.6274707775531156]
本稿では,全くラベルのない探索パイプラインを用いたマンダリン自己教師音声モデルにおける調音特徴表現のケーススタディを提案する。
以上の結果から,マンダリンサブディレクトにまたがる調音的特徴デオードビリティのパターンが明らかとなった。
以上の結果から,言語に依存しない調音探索が実際の方言コーパスに応用できることが示唆された。
論文 参考訳(メタデータ) (2026-06-24T06:39:28Z) - Shaping Schema via Language Representation as the Next Frontier for LLM Intelligence Expanding [88.11781604392606]
本稿では,言語表現を実世界の地図化とモデル化に使用される言語的・象徴的構造として定義する。
我々は、高度な言語表現によるスキーマ形成が、大規模言語モデルの拡張の次のフロンティアであると主張している。
論文 参考訳(メタデータ) (2026-05-10T02:42:29Z) - Quantifying Cross-Lingual Transfer in Paralinguistic Speech Tasks [4.911970211082446]
言語間の言語間相互作用を定量化するための体系的手法であるCLTM(Cross-Lingual Transfer Matrix)を提案する。
我々は,多言語HuBERTエンコーダを用いて,ジェンダー識別と話者検証という2つのパラ言語課題にCLTMを適用した。
この結果から,タスクや言語間の異なる伝達パターンが明らかとなり,言語に依存した系統的な影響が反映された。
論文 参考訳(メタデータ) (2026-03-09T11:02:57Z) - Causality is Key for Interpretability Claims to Generalise [35.833847356014154]
大規模言語モデル(LLM)の解釈可能性の研究は、モデル行動に関する重要な洞察をもたらした。
繰り返し発生する落とし穴: 一般化しない発見と、証拠を突破する因果解釈。
パールの因果的階層は、解釈可能性の研究が正当化できることを明確にする。
論文 参考訳(メタデータ) (2026-02-18T18:45:04Z) - Do What? Teaching Vision-Language-Action Models to Reject the Impossible [53.40183895299108]
VLA(Vision-Language-Action)モデルは、さまざまなロボットタスクにおいて強力なパフォーマンスを示している。
Instruct-Verify-and-Act(IVA)を提案する。
実験の結果,IVAはベースラインよりも97.56%の精度で虚偽の前提検出精度を向上させることがわかった。
論文 参考訳(メタデータ) (2025-08-22T10:54:33Z) - Quantifying the Dialect Gap and its Correlates Across Languages [69.18461982439031]
この研究は、明らかな相違を明らかにし、マインドフルなデータ収集を通じてそれらに対処する可能性のある経路を特定することによって、方言NLPの分野を強化する基盤となる。
論文 参考訳(メタデータ) (2023-10-23T17:42:01Z) - On the Language-specificity of Multilingual BERT and the Impact of
Fine-tuning [7.493779672689531]
multilingual BERT (mBERT) が獲得した知識は、言語固有のものと言語ニュートラルな2つのコンポーネントを持っている。
本稿では,2つのタスクの微調整の文脈において,それらの関係を解析する。
論文 参考訳(メタデータ) (2021-09-14T19:28:31Z) - Provable Limitations of Acquiring Meaning from Ungrounded Form: What
will Future Language Models Understand? [87.20342701232869]
未知のシステムが意味を習得する能力について検討する。
アサーションによってシステムが等価性のような意味関係を保存する表現をエミュレートできるかどうか検討する。
言語内のすべての表現が参照的に透明であれば,アサーションによってセマンティックエミュレーションが可能になる。
しかし、言語が変数バインディングのような非透過的なパターンを使用する場合、エミュレーションは計算不能な問題になる可能性がある。
論文 参考訳(メタデータ) (2021-04-22T01:00:17Z) - The Rediscovery Hypothesis: Language Models Need to Meet Linguistics [8.293055016429863]
現代言語モデルの性能向上に言語知識が必須条件であるかどうかを検討する。
その結果, 言語構造を探索した場合, かなり圧縮されるが, 事前学習目的によく適合する言語モデルは, 良好なスコアを保っていることがわかった。
この結果は再発見仮説を支持し,本論文の第2の貢献である言語モデル目標と言語情報との関連性に関する情報論的枠組みを導出する。
論文 参考訳(メタデータ) (2021-03-02T15:57:39Z) - Infusing Finetuning with Semantic Dependencies [62.37697048781823]
シンタックスとは異なり、セマンティクスは今日の事前訓練モデルによって表面化されないことを示す。
次に、畳み込みグラフエンコーダを使用して、タスク固有の微調整にセマンティック解析を明示的に組み込む。
論文 参考訳(メタデータ) (2020-12-10T01:27:24Z) - A Matter of Framing: The Impact of Linguistic Formalism on Probing
Results [69.36678873492373]
BERT (Delvin et al.) のような事前訓練されたコンテキスト化エンコーダは、下流タスクで顕著なパフォーマンスを示す。
調査における最近の研究は、事前学習中にこれらのモデルによって暗黙的に学習された言語知識について調査している。
形式主義の選択は調査結果に影響を及ぼすか?
BERTによる意味的役割情報とプロトロール情報のエンコーディングにおける言語学的意義の相違は,形式主義に依存している。
論文 参考訳(メタデータ) (2020-04-30T17:45:16Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。