論文の概要: Articulated Humanoid Head for a Robot Receptionist Capable of Natural Human Interaction
- arxiv url: http://arxiv.org/abs/2607.17042v1
- Date: Sun, 19 Jul 2026 03:18:37 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-21 18:48:37.342891
- Title: Articulated Humanoid Head for a Robot Receptionist Capable of Natural Human Interaction
- Title(参考訳): 自然人との対話が可能なロボット受容用人工ヒューマノイドヘッド
- Abstract要約: 21自由度を持つ機械構造(DoF)を統合したヒューマノイドロボットヘッドを提案する。
SCRFD、ArcFace、ByTetrackは顔認識に、LlamaとWhisperは自然言語処理に、ハードウェアサポートはリアルタイム操作と人間の再識別を可能にする。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Humanoid robots have become increasingly popular in applications such as social interaction, education, and service roles, which drives the need for more natural and efficient human-robot interactions. However, currently available humanoid heads often face limitations, including high costs, mechanical complexity, and limited adaptability across diverse environments. To address these challenges, we present an articulated humanoid robot head designed for a receptionist role, integrating a mechanical structure with 21 degrees of freedom (DoF), including mechanisms for the mouth, eyes, eyebrows, and neck, and covered with realistic silicone skin to achieve a human-like appearance and expression. The system integrates a model-based architecture that combines SCRFD, ArcFace, and ByTetrack for face recognition and Llama and Whisper for natural language processing, with hardware support enabling real-time operations and human re-identification. The conversational ability and re-identification capabilities of the humanoid robot head were quantitatively measured, while its emotional expressiveness and human likeness were evaluated through a user study, achieving an average human likeness score of 4.13 out of 5.
- Abstract(参考訳): ヒューマノイドロボットは、社会的相互作用、教育、サービスの役割など、より自然で効率的な人間とロボットの相互作用の必要性を喚起するアプリケーションにおいて、ますます人気が高まっている。
しかし、現在利用可能なヒューマノイドヘッドは、高コスト、機械的複雑さ、様々な環境にまたがる適応性の制限など、しばしば制限に直面している。
これらの課題に対処するため, 触覚, 目, 額, 首の機構を含む機械構造を21自由度(DoF)に統合し, 人間の外観や表情を達成するために, 現実的なシリコーン皮膚で覆われた, ロボットヘッドを試作した。
このシステムは、顔認識にSCRFD、ArcFace、ByTetrack、自然言語処理にLlamaとWhisperを組み合わせたモデルベースアーキテクチャと、リアルタイム操作と人間の再識別を可能にするハードウェアサポートを統合している。
ヒューマノイドロボット頭部の会話能力と再同定能力を定量的に測定し, その感情表現性と人間類似度をユーザスタディにより評価し, 平均人間類似度スコアは5。
関連論文リスト
- HumanX: Toward Agile and Generalizable Humanoid Interaction Skills from Human Videos [74.43500240121476]
我々はHumanXについて紹介する。HumanXは人間の動画を、ヒューマノイドのための汎用的で現実的なインタラクションスキルにコンパイルするフルスタックのフレームワークである。
HumanXは、従来の方法より8倍高い一般化成功を達成する。
論文 参考訳(メタデータ) (2026-02-02T18:53:01Z) - Towards Immersive Human-X Interaction: A Real-Time Framework for Physically Plausible Motion Synthesis [51.95817740348585]
Human-Xは、様々な実体をまたいだ没入的で物理的に妥当なヒューマンインタラクションを可能にするために設計された、新しいフレームワークである。
本手法は, 自己回帰型反応拡散プランナを用いて, リアルタイムに反応と反応を同時予測する。
我々のフレームワークは、人間とロボットのインタラクションのための仮想現実インターフェースを含む、現実世界のアプリケーションで検証されている。
論文 参考訳(メタデータ) (2025-08-04T06:35:48Z) - Real-Time Imitation of Human Head Motions, Blinks and Emotions by Nao Robot: A Closed-Loop Approach [2.473948454680334]
本稿では,ロボットによる人間の頭部の動きをリアルタイムに再現するための新しいアプローチを提案する。
MediaPipeをコンピュータビジョンライブラリとして、DeepFaceを感情認識ライブラリとして使用することにより、この研究は人間の頭の動きの微妙さを捉えようとしている。
提案手法は,自閉症児のコミュニケーション改善を約束し,より効果的なインタラクションのための貴重なツールを提供する。
論文 参考訳(メタデータ) (2025-04-28T17:01:54Z) - RHINO: Learning Real-Time Humanoid-Human-Object Interaction from Human Demonstrations [38.1742893736782]
RHINOは一般のヒューマノイド-ヒト-オブジェクト相互作用フレームワークである。
リアクティブモーション、命令ベースの操作、安全性に関する統一的なビューを提供する。
1)リアルタイムな人間の行動から人間の意図を推定するハイレベルプランナー,2)予測された意図に基づく反応行動とオブジェクト操作のスキルを達成する低レベルコントローラである。
論文 参考訳(メタデータ) (2025-02-18T18:56:41Z) - Multi-face emotion detection for effective Human-Robot Interaction [0.0]
本研究では,移動型ヒューマノイドロボットに組み込まれた顔の感情検出インタフェースを提案する。
表情認識のためのディープニューラルネットワークモデルを開発し評価した。
論文 参考訳(メタデータ) (2025-01-13T11:12:47Z) - HumanoidBench: Simulated Humanoid Benchmark for Whole-Body Locomotion and Manipulation [50.616995671367704]
そこで本研究では,人型ロボットが器用な手を備えた,高次元シミュレーション型ロボット学習ベンチマークHumanoidBenchを提案する。
その結果,現在最先端の強化学習アルゴリズムがほとんどのタスクに支障をきたすのに対して,階層的学習アプローチはロバストな低レベルポリシーに支えられた場合,優れた性能を達成できることがわかった。
論文 参考訳(メタデータ) (2024-03-15T17:45:44Z) - Real-time Addressee Estimation: Deployment of a Deep-Learning Model on
the iCub Robot [52.277579221741746]
住所推定は、社会ロボットが人間とスムーズに対話するために必要なスキルである。
人間の知覚スキルにインスパイアされたディープラーニングモデルは、iCubロボットに設計、訓練、デプロイされる。
本研究では,人間-ロボットのリアルタイムインタラクションにおいて,そのような実装の手順とモデルの性能について述べる。
論文 参考訳(メタデータ) (2023-11-09T13:01:21Z) - Habitat 3.0: A Co-Habitat for Humans, Avatars and Robots [119.55240471433302]
Habitat 3.0は、家庭環境における協調ロボットタスクを研究するためのシミュレーションプラットフォームである。
複雑な変形可能な体と外観と運動の多様性をモデル化する際の課題に対処する。
Human-in-the-loopインフラストラクチャは、マウス/キーボードまたはVRインターフェースを介してシミュレーションされたロボットとの実際のヒューマンインタラクションを可能にする。
論文 参考訳(メタデータ) (2023-10-19T17:29:17Z) - Data-driven emotional body language generation for social robotics [58.88028813371423]
社会ロボティクスでは、人間型ロボットに感情の身体的表現を生成する能力を与えることで、人間とロボットの相互作用とコラボレーションを改善することができる。
我々は、手作業で設計されたいくつかの身体表現から学習する深層学習データ駆動フレームワークを実装した。
評価実験の結果, 生成した表現の人間同型とアニマシーは手作りの表現と異なる認識が得られなかった。
論文 参考訳(メタデータ) (2022-05-02T09:21:39Z) - Spatial Computing and Intuitive Interaction: Bringing Mixed Reality and
Robotics Together [68.44697646919515]
本稿では,空間コンピューティングを応用し,新しいロボットのユースケースを実現するためのロボットシステムについて述べる。
空間コンピューティングとエゴセントリックな感覚を複合現実感デバイスに組み合わせることで、人間の行動をキャプチャして理解し、それらを空間的な意味を持つ行動に変換することができる。
論文 参考訳(メタデータ) (2022-02-03T10:04:26Z) - Smile Like You Mean It: Driving Animatronic Robotic Face with Learned
Models [11.925808365657936]
人間のような社会ロボットを構築するには、知的で一般化可能な表情を生成する能力が不可欠である。
顔模倣のための視覚に基づく自己教師型学習フレームワークを開発した。
本手法は, 多様な被験者に対して, 正確かつ多様な顔の模倣を可能にする。
論文 参考訳(メタデータ) (2021-05-26T17:57:19Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。