論文の概要: IRWOZ 2.0: A Large Language Model-driven Dialogue Dataset for Industrial Robot Conversations
- arxiv url: http://arxiv.org/abs/2609.04030v1
- Date: Thu, 03 Sep 2026 16:08:57 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-04 18:28:39.150717
- Title: IRWOZ 2.0: A Large Language Model-driven Dialogue Dataset for Industrial Robot Conversations
- Title(参考訳): IRWOZ 2.0:産業ロボット対話のための大規模言語モデル駆動対話データセット
- Abstract要約: IRWOZは、ドメイン固有のアノテーションを通じて、産業用ロボットインタラクション(HRI)ダイアログシステムを改善した。
最初のバージョンでは、対話状態や発話にかなりのノイズが含まれており、状態追跡精度が制限されている。
本稿では,大規模言語モデル(LLM)拡張生成(Mistral/Claude-3.5)と品質改善により,これらの制約に対処するIRWOZ 2.0を紹介する。
- 参考スコア(独自算出の注目度): 6.939197084966171
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: IRWOZ has improved industrial human-robot interaction (HRI) dialogue systems through domain-specific annotations. However, its initial version contains substantial noise in dialogue states and utterances, limiting state-tracking accuracy. We introduce IRWOZ 2.0, which addresses these limitations through large language model (LLM) enhanced generation (Mistral/Claude-3.5) and quality refinements. Our improved dataset expands to 390 dialogues across 4 industrial domains (Assembly, Delivery, Position, Relocation), featuring manual corrections and automated typo removal. Benchmark experiments on dialogue state tracking demonstrate significant improvements, with GPT-2's BLEU-4 score increasing from 0.1651 to 0.5604 compared to original IRWOZ. To support industrial HRI research, we publicly released IRWOZ 2.0 dataset at https://ieee-dataport.org/documents/irwoz-20-large-language-model-driven-dialogue-dataset-industrial -robot-conversations
- Abstract(参考訳): IRWOZは、ドメイン固有のアノテーションを通じて、産業用ロボットインタラクション(HRI)ダイアログシステムを改善した。
しかしながら、最初のバージョンでは対話状態や発話にかなりのノイズが含まれており、状態追跡精度が制限されている。
本稿では,大規模言語モデル(LLM)拡張生成(Mistral/Claude-3.5)と品質改善により,これらの制約に対処するIRWOZ 2.0を紹介する。
改善されたデータセットは、4つの産業ドメイン(アセンブリ、デリバリ、位置、リロケーション)で390の対話に拡張されます。
GPT-2のBLEU-4スコアはオリジナルのIRWOZに比べて0.1651から0.5604に増加した。
産業用HRI研究を支援するため、IRWOZ 2.0データセットをhttps://ieee-dataport.org/documents/irwoz-20-large-lang-driven-dialogue-dataset-industrial-robot-con versationsで公開しました。
関連論文リスト
- Qwen-Audio-3.0-ASR Technical Report [52.28849889799101]
本稿では,Mixture-of-Experts (MoE) LLM-based ASRシステムであるQwen-Audio-3.0-ASRを提案する。
Qwen-Audio-3.0-ASRは8つの主要方言領域にまたがる30の言語と16の中国語方言の転写をサポートしている。
レイテンシに敏感なアプリケーションのための専用ストリーミング変種Qwen-Audio-3.0-ASR-Streamingを開発した。
論文 参考訳(メタデータ) (2026-09-07T14:30:56Z) - Dial HEALTHDIAL for Advice: A Multilingual and Multi-Parallel Spoken Dialogue Dataset for Knowledge-Grounded Information Seeking [72.66384771245389]
本研究では,RAGに基づく音声対話システムの開発と評価を目的とした大規模・多言語・マルチ並列データセットであるHEALTHDIALを紹介する。
このデータセットは、WHO(World Health Organization)の信頼できるコンテンツに基づく6000の情報検索対話(言語毎1500語)と、多様な方言の母語話者から記録された163時間のユーザスピーチで構成されている。
論文 参考訳(メタデータ) (2026-05-28T15:47:09Z) - CoPrUS: Consistency Preserving Utterance Synthesis towards more realistic benchmark dialogues [0.27309692684728604]
自動パイプラインにおける合成通信エラーの生成について検討する。
実世界の対話では起こりうるが、ベンチマークデータセットでは表現できない3種類のコミュニケーションに焦点をあてる。
我々の2段階のアプローチは、最先端のLarge Language Model (LLM) を使用して、まずエラーを生成し、次に補修発話を作成します。
論文 参考訳(メタデータ) (2024-12-10T13:51:55Z) - Are LLMs Robust for Spoken Dialogues? [10.855403629160921]
大規模な事前学習型言語モデルでは、さまざまな下流タスクで最先端のパフォーマンスが実証されている。
タスク指向対話に関する公開データセットとベンチマークのほとんどは、書かれた会話に重点を置いている。
DSTC11テストセットにおける音声タスク指向対話におけるLLMの性能評価を行った。
論文 参考訳(メタデータ) (2024-01-04T14:36:38Z) - SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents [70.08842857515141]
SpokenWOZは音声TODのための大規模音声テキストデータセットである。
SpokenWOZでは、クロスターンスロットと推論スロット検出が新たな課題である。
論文 参考訳(メタデータ) (2023-05-22T13:47:51Z) - DialogVED: A Pre-trained Latent Variable Encoder-Decoder Model for
Dialog Response Generation [80.45816053153722]
DialogVEDは、拡張エンコーダデコーダ事前トレーニングフレームワークに連続潜伏変数を導入し、応答の関連性と多様性を高める。
我々は,PersonaChat,DailyDialog,DSTC7-AVSDベンチマークを用いて応答生成実験を行った。
論文 参考訳(メタデータ) (2022-04-27T16:18:15Z) - Cross-Lingual Dialogue Dataset Creation via Outline-Based Generation [70.81596088969378]
言語間アウトラインに基づく対話データセット(COD)は、自然言語の理解を可能にする。
CODは、4つの異なる言語で対話状態の追跡とエンドツーエンドの対話モデリングと評価を可能にする。
論文 参考訳(メタデータ) (2022-01-31T18:11:21Z) - NeuralWOZ: Learning to Collect Task-Oriented Dialogue via Model-Based
Simulation [13.943378554273377]
本稿では,モデルに基づく対話シミュレーションを用いた対話収集フレームワークNeuralWOZを提案する。
収集者は(1)ユーザの目標指示(自然言語におけるユーザコンテキストとタスク制約)と(2)システムのAPI呼び出し結果から対話を生成する。
ラベルラは、アノテーションを複数選択問題として定式化し、目標指示とAPI呼び出し結果から候補ラベルを抽出することにより、生成された対話に注釈を付ける。
論文 参考訳(メタデータ) (2021-05-30T07:54:54Z) - Dialogue Distillation: Open-Domain Dialogue Augmentation Using Unpaired
Data [61.71319905364992]
未ペアデータを利用したオープンドメイン対話モデルのトレーニングのための新しいデータ拡張手法を提案する。
データレベルの蒸留プロセスが最初に提案され、未確認データからポストとレスポンスの両方を検索する拡張ダイアログを構築する。
低品質の対話をフィルタリングするためにランキングモジュールが使用される。
モデルレベルの蒸留プロセスを用いて、高品質なペアデータに基づいて訓練された教師モデルを、強化された対話ペアに蒸留する。
論文 参考訳(メタデータ) (2020-09-20T13:06:38Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。