論文の概要: TEIDAN: A Multilingual Multiparty Dialogue Corpus
- arxiv url: http://arxiv.org/abs/2609.00802v1
- Date: Tue, 01 Sep 2026 06:59:09 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-02 16:31:36.423998
- Title: TEIDAN: A Multilingual Multiparty Dialogue Corpus
- Title(参考訳): TEIDAN:多言語多言語対話コーパス
- Authors: Taiga Mori, Koji Inoue, Mikey Elmers, Divesh Lala, Tatsuya Kawahara,
- Abstract要約: 本稿では,多言語多モーダルコーパスであるTEIDANについて述べる。
TEIDANは、個々のピンマイク、マイクアレイ、参加者向けカメラでオープンエンドトピックについて議論する3人の参加者のグループを記録している。
本報告では,人間とエージェントのインタラクションにおいて,TEIDANがターンテイキング,アドレナリ認識,マルチモーダルグラウンドの研究を支援するための予備的分析を,収集設計,参加者,記録設定,転写フォーマット,コーパス統計について述べる。
- 参考スコア(独自算出の注目度): 22.140704092442196
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Multi-party interaction is a central setting for human communication and a necessary target for human-agent interaction systems that must participate in group conversation. Yet available corpora often focus on meetings, task-oriented interaction, text-based interaction, or acted scenarios, and fewer resources support cross-linguistic comparison of spontaneous face-to-face triadic discussion. This paper presents TEIDAN, a multilingual multimodal corpus that currently consists of Japanese and English three-party conversations. TEIDAN records groups of three participants discussing open-ended topics with individual pin microphones, a microphone array, and participant-facing cameras, and provides IPU-based transcripts for both language portions. Earlier studies used subsets of the Japanese portion for task-specific benchmarks in multi-party dialogue modeling; in contrast, this paper presents TEIDAN as a corpus resource spanning both Japanese and English, with planned expansion to additional languages. We describe the collection design, participants, recording setup, transcription format, and corpus statistics, and provide preliminary analyses to illustrate how TEIDAN can support research on turn-taking, addressee recognition, and multimodal grounding in human-human and human-agent interaction.
- Abstract(参考訳): マルチパーティインタラクションは、ヒューマンコミュニケーションの中心的な設定であり、グループ会話に参加する必要がある人間とエージェントのインタラクションシステムに必要なターゲットである。
しかし、利用可能なコーパスは、しばしばミーティング、タスク指向の対話、テキストベースの対話、行動シナリオに焦点を合わせ、自発的な対面三進的議論の言語間比較を支援するリソースが少ない。
本稿では,多言語多モーダルコーパスであるTEIDANについて述べる。
TEIDANは、個々のピンマイク、マイクアレイ、参加者向けカメラとオープンエンドトピックについて議論する3人の参加者のグループを記録し、両方の言語部分にIPUベースの文字起こしを提供する。
一方,本研究ではTEIDANを日本語と英語にまたがるコーパスリソースとして提案し,追加言語への拡張を予定している。
本報告では,人間とエージェントのインタラクションにおいて,TEIDANがターンテイキング,アドレナリ認識,マルチモーダルグラウンドの研究を支援するための予備的分析を,収集設計,参加者,記録設定,転写フォーマット,コーパス統計について述べる。
関連論文リスト
- MOSS-TTSD: Text to Spoken Dialogue Generation [62.04179716555789]
複数の言語にまたがる多人数会話音声のための音声対話合成モデルであるMOSS-TTSDを提案する。
長文モデリングの強化により、MOSS-TTSDは明示的な話者タグを持つ対話スクリプトから長文音声対話を生成する。
このモデルは、英語や中国語を含む様々な主流言語をサポートし、いくつかの長文のシナリオに適応している。
論文 参考訳(メタデータ) (2026-03-20T08:23:31Z) - RealTalk-CN: A Realistic Chinese Speech-Text Dialogue Benchmark With Cross-Modal Interaction Analysis [15.473595594666751]
本稿では,中国初のマルチターン・マルチドメイン音声文二重モーダルTODデータセットであるRealTalk-CNを紹介する。
RealTalk-CNは、注釈付き自然発話不一致を伴う多様な対話シナリオをキャプチャする。
本稿では,実世界のユーザインタラクションを忠実にシミュレートする,新しいクロスモーダルチャットタスクを提案する。
論文 参考訳(メタデータ) (2025-08-06T13:12:57Z) - LINC: Supporting Language Independent Communication and Comprehension to Enhance Contribution in Multilingual Collaborative Meetings [4.14360329494344]
会議中の多言語コミュニケーションのためのリアルタイムモジュールと,ディスカッション分析のためのポストミーティングダッシュボードを開発した。
LINCを用いて、参加者は好みの言語でコミュニケーションすることの恩恵を受け、行動可能な洞察をリコールし、レビューし、今後の会議を効果的に準備することを発見した。
論文 参考訳(メタデータ) (2025-04-26T18:17:31Z) - Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models [38.608158064184366]
我々は、MNSC(Multitask National Speech Corpus)を導入し、最大のSinglishコーパスを標準化し、注釈する。
これらのデータセットは、自動音声認識(ASR)、音声質問回答(SQA)、音声対話要約(SDS)、パラ言語質問回答(PQA)など様々なタスクをサポートする。
本稿ではマルチタスクマルチモーダルモデルであるSingAudioLLMを提案する。
論文 参考訳(メタデータ) (2025-01-02T03:28:52Z) - Multi-turn Dialogue Comprehension from a Topic-aware Perspective [70.37126956655985]
本稿では,話題認識の観点から,マルチターン対話をモデル化することを提案する。
対話文のセグメント化アルゴリズムを用いて、対話文を教師なしの方法でトピック集中フラグメントに分割する。
また,トピックセグメントを処理要素として扱う新しいモデルとして,トピック認識デュアルアテンションマッチング(TADAM)ネットワークを提案する。
論文 参考訳(メタデータ) (2023-09-18T11:03:55Z) - Multi2WOZ: A Robust Multilingual Dataset and Conversational Pretraining
for Task-Oriented Dialog [67.20796950016735]
Multi2WOZデータセットは、中国語、ドイツ語、アラビア語、ロシア語の4つの言語にまたがる。
本稿では,任意の下流TODタスクに対する言語間移動を容易にすることを目的とした,事前学習言語モデル(PrLM)の多言語会話特化のための新しいフレームワークを提案する。
実験の結果,目標言語における(I)会話の特殊化と,(II)具体的なTODタスクのための少数ショット転送の組み合わせが,ほとんどの場合,最高の性能を示すことがわかった。
論文 参考訳(メタデータ) (2022-05-20T18:35:38Z) - Crossing the Conversational Chasm: A Primer on Multilingual
Task-Oriented Dialogue Systems [51.328224222640614]
大規模な学習済みニューラルネットワークモデルに基づく最新のTODモデルは、データ空腹です。
ToDのユースケースのデータ取得は高価で面倒だ。
論文 参考訳(メタデータ) (2021-04-17T15:19:56Z) - Topic-Aware Multi-turn Dialogue Modeling [91.52820664879432]
本稿では,トピック認識発話を教師なしでセグメント化して抽出する,多元対話モデリングのための新しいソリューションを提案する。
トピック・アウェア・モデリングは、新たに提案されたトピック・アウェア・セグメンテーション・アルゴリズムとトピック・アウェア・デュアル・アテンション・マッチング(TADAM)ネットワークによって実現されている。
論文 参考訳(メタデータ) (2020-09-26T08:43:06Z) - XPersona: Evaluating Multilingual Personalized Chatbot [76.00426517401894]
我々はペルソナ・チャットの多言語拡張(XPersona)を提案する。
我々のデータセットには、多言語パーソナライズされたエージェントの構築と評価のための英語以外の6言語でのペルソナ会話が含まれています。
論文 参考訳(メタデータ) (2020-03-17T07:52:08Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。