論文の概要: Inter-Stance: A Dyadic Multimodal Corpus for Conversational Stance Analysis
- arxiv url: http://arxiv.org/abs/2604.22739v1
- Date: Fri, 24 Apr 2026 17:37:42 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-27 15:36:26.546101
- Title: Inter-Stance: A Dyadic Multimodal Corpus for Conversational Stance Analysis
- Title(参考訳): Inter-Stance: 会話スタンス分析のための動的マルチモーダルコーパス
- Authors: Xiang Zhang, Xiaotian Li, Taoyue Wang, Nan Bi, Xin Zhou, Cody Zhou, Zoie Wang, Andrew Yang, Yuming Su, Jeff Cohn, Qiang Ji, Lijun Yin,
- Abstract要約: マルチモーダルなダイアド相互作用(45ダイアド、90人)の新たなデータコーパスを提案する。
歴史を共有する人と見知らぬ人との2種類のダイアドが含まれている。
強力な感情誘導によって、これらのマルチモーダルデータは、対人行動の新しいモデリングを可能にする。
- 参考スコア(独自算出の注目度): 26.58842064389471
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Social interactions dominate our perceptions of the world and shape our daily behavior by attaching social meaning to acts as simple and spontaneous as gestures, facial expressions, voice, and speech. People mimic and otherwise respond to each other's postures, facial expressions, mannerisms, and other verbal and nonverbal behavior, and form appraisals or evaluations in the process. Yet, no publicly-available dataset includes multimodal recordings and self-report measures of multiple persons in social interaction. Dyadic recordings and annotation are lacking. We present a new data corpus of multimodal dyadic interaction (45 dyads, 90 persons) that includes synchronized multi-modality behavior (2D face video, 3D face geometry, thermal spectrum dynamics, voice and speech behavior, physiology (PPG, EDA, heart-rate, blood pressure, and respiration), and self-reported affect of all participants in a communicative interaction scenario. Two types of dyads are included: persons with shared past history and strangers. Annotations include social signals, agreement, disagreement, and neutral stance. With a potent emotion induction, these multimodal data will enable novel modeling of multimodal interpersonal behavior. We present extensive experiments to evaluate multimodal dyadic communication of dyads with and without interpersonal history, and their affect. This new database will make multimodal modeling of social interaction never possible before. The dataset includes 20TB of multimodal data to share with the research community.
- Abstract(参考訳): 社会的相互作用は、世界に対する認識を支配し、ジェスチャー、表情、音声、スピーチのように単純で自発的な行動に社会的意味を付加することで、日々の行動を形成する。
人々はお互いの姿勢、表情、礼儀、その他の言語的・非言語的な振る舞いを模倣し、反応し、その過程で評価や評価を形成する。
しかし、公開データセットにはマルチモーダルな記録や、ソーシャルインタラクションにおける複数の人の自己申告手段が含まれていない。
ダイアド記録と注釈が欠落している。
2次元顔画像, 3次元顔形状, 熱スペクトルダイナミクス, 音声と音声の挙動, 生理学(PPG, EDA, 心拍数, 血圧, 呼吸) と, コミュニケーションのシナリオにおけるすべての参加者の自己報告された影響を含む, マルチモーダル・ダイアディック相互作用(45ダイアド, 90人)の新たなデータコーパスを提案する。
歴史を共有する人と見知らぬ人との2種類のダイアドが含まれている。
注釈には、社会的信号、合意、意見の不一致、中立的なスタンスが含まれる。
強力な感情誘導によって、これらのマルチモーダルデータは、マルチモーダル対人行動の新しいモデリングを可能にする。
ダイアドの多モーダル・ダイアドコミュニケーションと対人的歴史と無関係のコミュニケーションとその影響を評価するための広範囲な実験を行った。
この新しいデータベースは、ソーシャルインタラクションのマルチモーダルなモデリングを可能にする。
データセットには、研究コミュニティと共有する20TBのマルチモーダルデータが含まれている。
関連論文リスト
- InterAct: A Large-Scale Dataset of Dynamic, Expressive and Interactive Activities between Two People in Daily Scenarios [40.42003202491803]
2人の活動を同時にモデル化し、客観的、動的、意味論的に一貫した相互作用を目標にすることを提案する。
我々は、241のモーションシーケンスからなるInterActと呼ばれる新しいマルチモーダルデータセットをキャプチャする。
InterActには、個人の多様で複雑な動きと、これまでほとんど見られなかった興味深い、比較的長期にわたる相互作用パターンが含まれている。
論文 参考訳(メタデータ) (2025-09-06T15:36:47Z) - Seamless Interaction: Dyadic Audiovisual Motion Modeling and Large-Scale Dataset [113.25650486482762]
4000時間以上の対面インタラクション映像の大規模な収集であるSeamless Interactionデータセットを紹介した。
このデータセットは、ダイドの具体的ダイナミクスを理解するAIテクノロジの開発を可能にする。
そこで我々は,このデータセットを用いて,人間の発話に適応した動作ジェスチャーと表情を生成するモデル群を開発した。
論文 参考訳(メタデータ) (2025-06-27T18:09:49Z) - SocialGen: Modeling Multi-Human Social Interaction with Language Models [30.068879125411726]
多様な個人間での対話行動のモデル化が可能な,最初の統合運動言語モデルであるSocialGenを紹介する。
対人インタラクションに限られる従来の方法とは異なり、任意の数の個人の動きのトークン化を支援する新しい社会運動表現を提案する。
このアライメントにより、モデルは豊かで訓練済みの言語知識を活用して、人間の社会的行動をよりよく理解し、推論することができる。
論文 参考訳(メタデータ) (2025-03-28T22:57:25Z) - InterAct: Capture and Modelling of Realistic, Expressive and Interactive Activities between Two Persons in Daily Scenarios [12.300105542672163]
我々は、2人の人物がシーケンス全体にわたって現実的なシナリオを実行する241のモーションシーケンスをキャプチャする。
両方の人の音声、身体の動き、表情はすべて、私たちのデータセットでキャプチャされます。
また,音声のみから2人の対話的動きを直接推定する拡散モデルに基づく最初のアプローチを示す。
論文 参考訳(メタデータ) (2024-05-19T22:35:02Z) - in2IN: Leveraging individual Information to Generate Human INteractions [29.495166514135295]
In2IN(in2IN)は、人間と人間の動作生成を個別に記述した新しい拡散モデルである。
In2INで生成された動きと、HumanML3Dで事前訓練された1人の動きによって生成された動きとを組み合わせたモデル合成手法であるDualMDMを提案する。
論文 参考訳(メタデータ) (2024-04-15T17:59:04Z) - ReMoS: 3D Motion-Conditioned Reaction Synthesis for Two-Person Interactions [66.87211993793807]
本稿では,2人のインタラクションシナリオにおいて,人の全身運動を合成する拡散モデルReMoSを提案する。
ペアダンス,忍術,キックボクシング,アクロバティックといった2人のシナリオでReMoSを実証する。
また,全身動作と指の動きを含む2人のインタラクションに対してReMoCapデータセットを寄贈した。
論文 参考訳(メタデータ) (2023-11-28T18:59:52Z) - On the Linguistic and Computational Requirements for Creating
Face-to-Face Multimodal Human-Machine Interaction [0.0]
ビデオ記録では、34人の人間とアバターのインタラクションを録画し、ビデオの抜粋で完全な言語的マイクロアナリシスを行い、マルチモーダル行動やイベントの発生を全て記録した。
このデータは、対面会話中に二重ループフィードバックが確立されていることを示す。
本稿では,会話分析(CA)や認知科学,心の理論(ToM)などの知識を,人間と機械のマルチモーダル相互作用を記述するための知識に組み込むことを提案する。
論文 参考訳(メタデータ) (2022-11-24T21:17:36Z) - Co-Located Human-Human Interaction Analysis using Nonverbal Cues: A
Survey [71.43956423427397]
本研究の目的は,非言語的キューと計算手法を同定し,効果的な性能を実現することである。
この調査は、最も広い範囲の社会現象と相互作用設定を巻き込むことによって、相手と異なる。
もっともよく使われる非言語キュー、計算方法、相互作用環境、センシングアプローチは、それぞれマイクとカメラを備えた3,4人で構成される会話活動、ベクターマシンのサポート、ミーティングである。
論文 参考訳(メタデータ) (2022-07-20T13:37:57Z) - Vyaktitv: A Multimodal Peer-to-Peer Hindi Conversations based Dataset
for Personality Assessment [50.15466026089435]
本稿では,ピアツーピアのHindi会話データセットであるVyaktitvを提案する。
参加者の高品質な音声とビデオの録音と、会話ごとにヒングリッシュのテキストによる書き起こしで構成されている。
データセットには、収入、文化的指向など、すべての参加者のための豊富な社会デコグラフィー的特徴が含まれています。
論文 参考訳(メタデータ) (2020-08-31T17:44:28Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。