論文の概要: From Propositional to Perceptual Asymmetry: Extending Frictive Policy Optimization to Asymmetric Partial Information Dialogue
- arxiv url: http://arxiv.org/abs/2606.30973v1
- Date: Mon, 29 Jun 2026 23:16:19 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-01 18:27:19.029456
- Title: From Propositional to Perceptual Asymmetry: Extending Frictive Policy Optimization to Asymmetric Partial Information Dialogue
- Title(参考訳): 命題から知覚的非対称性へ:非対称部分情報対話への摩擦政策最適化の拡張
- Abstract要約: 摩擦政策最適化(Frictive Policy Optimization)は、共同対話における摩擦を共通グラウンド構築に不可欠な信号として扱う。
我々はFPOを知覚的非対称性に拡張し、参加者は非対称な部分情報を保持する。
FPOの摩擦関数は,各参加者の情報水平線内から評価した場合にのみ経験的に有効であることがわかった。
- 参考スコア(独自算出の注目度): 10.142691415785281
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Frictive Policy Optimization (FPO; Pustejovsky et al., 2025) treats friction in collaborative dialogue -- misalignment, misunderstanding, repair -- as an epistemic signal essential to common-ground construction, rather than noise to be minimized. However, FPO and its implementations assume shared perceptual contexts, where friction arises from differently interpreted propositions over the same scene, which we define as propositional asymmetry. We extend FPO to perceptual asymmetry, where participants hold asymmetric partial information and the same referring expression yields different denotations depending on whose information state grounds the reference. We evaluate this through cross-corpora analysis and LLM probing on referentially asymmetric dialogue tasks, primarily the HCRC MapTask (Anderson et al., 1991). We find that FPO's friction functional is empirically valid only when evaluated from within each participant's information horizon: different landmark configurations produce qualitatively distinct grounding failure modes, with a small class of ambiguous configurations driving a disproportionate share of misunderstandings through trajectories that appear successful but silently diverge. The LLM probe confirms that having the "right perspective" matters more than having all perspectives: the informed single viewpoint outperforms omniscient access to both participants' contexts. We propose two annotation refinements: subtype decomposition of pending grounding states and accommodation-aware alignment classification.
- Abstract(参考訳): 摩擦政策最適化 (FPO; Pustejovsky et al , 2025) は、ノイズを最小限に抑えるのではなく、共同対話における摩擦(ミスアライメント、誤解、修復)を共通の地下構造に必須のてんかん信号として扱う。
しかし、FPOとその実装は、同じ場面上で異なる解釈された命題から摩擦が生じ、命題非対称性として定義する、共有知覚コンテキストを仮定する。
我々はFPOを知覚的非対称性に拡張し、参加者は非対称な部分的情報を保持し、同じ参照表現は、どの情報状態が参照を根拠とするかによって異なる意味を与える。
本研究では, HCRC MapTask (Anderson et al , 1991) の参照非対称な対話課題に基づくクロスコーパス解析とLLMによる探索によりこれを評価した。
FPOの摩擦関数は、各参加者の情報水平線内から評価した場合にのみ経験的に有効であることが判明した: 異なるランドマーク構成は、定性的に異なる基底的障害モードを生成し、少数の曖昧な構成は、不均等な誤解の共有を、成功しているが無音に分散しているように見えるトラジェクトリを通じて駆動する。
LLMプローブは、"正しい視点"を持つことが、すべての視点を持つことよりも重要であることを確認している。
本稿では, 固定状態のサブタイプ分解と, 宿泊意識のアライメント分類という2つのアノテーション改良手法を提案する。
関連論文リスト
- Mind the Gap: Theory-of-Mind-Grounded Friction for Epistemic Alignment [10.142691415785281]
我々は,Frictive Policy Optimization における制御信号として,理論・オブ・ミンド(ToM)推論を運用する。
表現レベルでは、2階のチャンネルを非難することで、誤解のリコールが65%$から26%$に削減される。
政策レベルでは、報酬形成(FAR)と信頼領域(FTR)の変種は介入F1とDPOに対する保証コンテキスト校正を改善している。
論文 参考訳(メタデータ) (2026-08-31T12:57:29Z) - Measuring Semantic Progress in Multi-turn Dialogue via Information Gain [7.146946575593476]
我々は,情報探索対話における重要な側面であるセマンティック・プログレスに焦点を当てた。
埋め込み空間に近似する情報理論計量を導入する。
実験の結果,提案指標は人間の判断と競合する一致を示した。
論文 参考訳(メタデータ) (2026-06-10T17:04:59Z) - When Contextual Inference Fails: Cancelability in Interactive Instruction Following [51.2195840589474]
私たちは、コンテキスト意味構築のためのインタラクティブなベンチマークであるBuild What I Meanを紹介します。
BWIMでは、モデルは文脈推論を行うか、小さな通信コストで明確化を要求することによって曖昧さを解決しなければならない。
我々は,不確実性の下でのパートナーブラインド過度明確化や質問逆推定などの準最適戦略を観察する。
論文 参考訳(メタデータ) (2026-03-20T14:46:59Z) - Targeting Misalignment: A Conflict-Aware Framework for Reward-Model-based LLM Alignment [5.900494456937422]
逆モデルに基づく微調整は、大規模言語モデルと人間の嗜好の整合における中心的なパラダイムである。
本稿では,その微調整過程を知識統合の一形態として扱うことにより,このような不整合を識別・緩和する新たな枠組みについて検討する。
論文 参考訳(メタデータ) (2025-12-10T00:52:21Z) - Grounded Misunderstandings in Asymmetric Dialogue: A Perspectivist Annotation Scheme for MapTask [8.925029287648345]
協調的対話は参加者が共通基盤を段階的に確立することに依存しているが、非対称な環境では、異なる実体を参照しながら同意すると信じているかもしれない。
本稿では,HCRC MapTaskコーパスに対するパースペクティビストアノテーション方式を提案する。
13kの注釈付き参照式を信頼度推定で取得し,その結果の理解状態を解析する。
論文 参考訳(メタデータ) (2025-11-05T18:52:28Z) - DEPTH: Hallucination-Free Relation Extraction via Dependency-Aware Sentence Simplification and Two-tiered Hierarchical Refinement [22.164114662885652]
DEPTHは、関係抽出パイプラインに依存性を意識したsEntence simPlificationと2階層階層改良を統合するフレームワークである。
以上の結果から,DEPTHは平均幻覚率を7.0%まで下げる一方で,最先端のベースラインよりも平均F1スコアを17.2%向上させることを示した。
論文 参考訳(メタデータ) (2025-08-20T03:35:24Z) - Estimating Commonsense Plausibility through Semantic Shifts [66.06254418551737]
セマンティックシフトを測定することでコモンセンスの妥当性を定量化する新しい識別フレームワークであるComPaSSを提案する。
2種類の細粒度コモンセンス可視性評価タスクの評価は,ComPaSSが一貫してベースラインを上回っていることを示している。
論文 参考訳(メタデータ) (2025-02-19T06:31:06Z) - ADEPT: A DEbiasing PrompT Framework [64.54665501064659]
ファインタニングは文脈化された単語の埋め込みを曖昧にするための応用手法である。
意味的な意味を持つ個別のプロンプトは、タスクを乱すのに有効であることが示されている。
本稿では, PLM をデバイアス化する方法であるADEPT を提案し, バイアス除去と表現能力の確保の微妙なバランスを維持しながら, 即時チューニングによる PLM のデバイアス化手法を提案する。
論文 参考訳(メタデータ) (2022-11-10T08:41:40Z) - Asymmetric Modality Translation For Face Presentation Attack Detection [55.09300842243827]
顔提示攻撃検出(PAD)は、悪意のあるユーザによって顔認識システムが偽造されるのを防ぐための重要な手段である。
両モードシナリオにおける非対称なモダリティ変換に基づく新しいフレームワークを提案する。
本手法は,異なる評価プロトコル下での最先端性能を実現する。
論文 参考訳(メタデータ) (2021-10-18T08:59:09Z) - Dive into Ambiguity: Latent Distribution Mining and Pairwise Uncertainty
Estimation for Facial Expression Recognition [59.52434325897716]
DMUE(DMUE)という,アノテーションのあいまいさを2つの視点から解決するソリューションを提案する。
前者に対しては,ラベル空間における潜伏分布をよりよく記述するために,補助的マルチブランチ学習フレームワークを導入する。
後者の場合、インスタンス間の意味的特徴のペアワイズ関係を完全に活用して、インスタンス空間のあいまいさの程度を推定する。
論文 参考訳(メタデータ) (2021-04-01T03:21:57Z) - Weakly-Supervised Aspect-Based Sentiment Analysis via Joint
Aspect-Sentiment Topic Embedding [71.2260967797055]
アスペクトベース感情分析のための弱教師付きアプローチを提案する。
We learn sentiment, aspects> joint topic embeddeds in the word embedding space。
次に、ニューラルネットワークを用いて単語レベルの識別情報を一般化する。
論文 参考訳(メタデータ) (2020-10-13T21:33:24Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。