論文の概要: PragAlign: Evidence-Sensitive Reply Assistance Across Chinese and Japanese Appropriateness Judgments
- arxiv url: http://arxiv.org/abs/2608.26700v1
- Date: Thu, 27 Aug 2026 06:55:27 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.279724
- Title: PragAlign: Evidence-Sensitive Reply Assistance Across Chinese and Japanese Appropriateness Judgments
- Title(参考訳): PragAlign: 中国人と日本人の適切な判断に対する証拠に敏感な回答支援
- Authors: Xin Zhong, Satori Hachisuka,
- Abstract要約: PragAlignは、文脈読解と選択的明確化を分離し、ダイレクトとルールと共に評価する。
中国語話者は9人、日本語話者は3人、日本語話者は9人であった。
その結果,言語と文化の理解を支援するために,共用および言語固有の判断パターンを特定し,回答支援を行うことができた。
- 参考スコア(独自算出の注目度): 0.6101839518775969
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Reply assistance in multilingual settings requires linguistic competence and culturally situated judgments of appropriateness. We present PragAlign, which separates context reading from selective clarification, and evaluate it alongside Direct and Rule. Nine native Chinese speakers judged Chinese materials, while three native Japanese speakers judged matched Japanese versions. In the Chinese evaluation, PragAlign received significantly better ranks than both baselines. In the Japanese evaluation, Direct had the lowest mean rank, PragAlign had the highest top-rank rate, and the omnibus difference was not significant. The groups selected the same top condition in 5 of 10 scenarios, including four shared PragAlign selections. The results identify shared and language-specific judgment patterns and inform reply assistance designed to support linguistic and cultural understanding.
- Abstract(参考訳): 多言語設定における応答支援には言語能力と文化的に適切な判断が必要である。
PragAlignは、文脈読解と選択的明確化を分離し、ダイレクトとルールと共に評価する。
中国語話者は9人、日本語話者は3人、日本語話者は9人であった。
中国の評価では、PragAlignは両方のベースラインよりも格段に優れたランクを得た。
日本語評価では,Directは平均ランクが低く,PragAlignは最高ランクであり,Omnibus差は有意ではなかった。
グループでは、PragAlignの4つの共有選択を含む10のシナリオのうち5つで、同じトップ条件を選択した。
その結果,言語と文化の理解を支援するために,共用および言語固有の判断パターンを特定し,回答支援を行うことができた。
関連論文リスト
- The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models [51.61416200800499]
GaoYaoは182.3kサンプル、26言語、51か国/地域からなる総合ベンチマークである。
まず、GaoYao氏は評価タスクを3つの文化階層に分類する統一的なフレームワークを提案する。
第二に、専門家を活用して、主観的なベンチマークを19言語に厳格にローカライズすることで、ネイティブ品質の拡大を実現しています。
第3に,20以上のフラッグシップおよびコンパクトLCMの詳細な診断を行う。
論文 参考訳(メタデータ) (2026-04-22T06:19:46Z) - Bilingual Bias in Large Language Models: A Taiwan Sovereignty Benchmark Study [0.0]
大規模言語モデル(LLM)は、多言語的文脈においてますます展開されているが、政治的に敏感なトピックに関する言語間の一貫性はまだ検討されていない。
本稿では,中国(台湾)の主権に関する質問に対して,中国語と英語で質問した17のLSMがどのように反応するかを,体系的なベンチマークで検討する。
我々は、重要な言語バイアス、すなわち、同じモデルがクエリ言語によって実質的に異なる政治的スタンスを生み出す現象を発見した。
論文 参考訳(メタデータ) (2026-02-06T03:57:21Z) - "Be My Cheese?": Cultural Nuance Benchmarking for Machine Translation in Multilingual LLMs [0.0]
本稿では,機械翻訳における文化的ローカライゼーションを評価するための大規模評価ベンチマークを提案する。
言語毎に5つのネイティブスピーカーレーダを持つ15言語を対象に,多言語大言語モデル (LLM) を7つ評価した。
GPT-5 (2.10/3)、Claude Sonnet 3.7 (1.97/3)、Mistral Medium 3.1 (1.84/3)は破滅的な失敗が少ない最強の層である。
論文 参考訳(メタデータ) (2026-02-04T16:35:48Z) - CM-Align: Consistency-based Multilingual Alignment for Large Language Models [84.19366314925593]
高品質な多言語嗜好データを構築するための一貫性に基づくデータ手法を提案する。
具体的には、一貫性のある英語参照選択と、言語間一貫性に基づく多言語嗜好データ構築の2つの部分を含む。
論文 参考訳(メタデータ) (2025-09-10T12:40:49Z) - JiraiBench: A Bilingual Benchmark for Evaluating Large Language Models' Detection of Human Self-Destructive Behavior Content in Jirai Community [9.492476871323763]
本稿では,大規模言語モデルによる自己破壊的コンテンツ検出の有効性を評価するための,最初のバイリンガルベンチマークである JiraiBench を紹介する。
我々は,薬物過剰摂取,摂食障害,自傷など多種の自己破壊行動を含む,全国的な地雷オンラインサブカルチャーに注目した。
本データセットは,3つの行動カテゴリーに沿って,多次元アノテーションを用いた10,419の中国語投稿と5000の日本語投稿からなる。
論文 参考訳(メタデータ) (2025-03-27T16:48:58Z) - Thai Winograd Schemas: A Benchmark for Thai Commonsense Reasoning [0.0]
本研究は、タイ語の文脈における常識推論能力を評価するために設計された新しいデータセットである、タイ語におけるウィノグラードのコレクションを紹介する。
我々は,このベンチマークで人気の高い大規模言語モデルの性能を評価し,その強み,限界を明らかにし,現在の最先端技術に対する洞察を提供する。
論文 参考訳(メタデータ) (2024-05-28T17:14:02Z) - Cross-Lingual Speaker Identification Using Distant Supervision [84.51121411280134]
本稿では,文脈推論の欠如や言語間一般化の低さといった問題に対処する話者識別フレームワークを提案する。
その結果,2つの英語話者識別ベンチマークにおいて,従来の最先端手法よりも9%の精度,5%の精度で性能が向上することが示唆された。
論文 参考訳(メタデータ) (2022-10-11T20:49:44Z) - AM2iCo: Evaluating Word Meaning in Context across Low-ResourceLanguages
with Adversarial Examples [51.048234591165155]
本稿では, AM2iCo, Adversarial and Multilingual Meaning in Contextを提案する。
言語間文脈における単語の意味の同一性を理解するために、最先端(SotA)表現モデルを忠実に評価することを目的としている。
その結果、現在のSotAプリトレーニングエンコーダは人間のパフォーマンスにかなり遅れていることが明らかとなった。
論文 参考訳(メタデータ) (2021-04-17T20:23:45Z) - On the Language Neutrality of Pre-trained Multilingual Representations [70.93503607755055]
語彙意味論に関して,多言語文脈埋め込みの言語中立性を直接的に検討する。
その結果、文脈埋め込みは言語ニュートラルであり、概して静的な単語型埋め込みよりも情報的であることがわかった。
本稿では,言語識別における最先端の精度に到達し,並列文の単語アライメントのための統計的手法の性能を一致させる方法について述べる。
論文 参考訳(メタデータ) (2020-04-09T19:50:32Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。