論文の概要: Validating the Single Item Kawaii Measure
- arxiv url: http://arxiv.org/abs/2607.19352v1
- Date: Wed, 13 May 2026 09:42:04 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-27 00:46:13.125981
- Title: Validating the Single Item Kawaii Measure
- Title(参考訳): 川井一項目測定の検証
- Abstract要約: 川井(かわい)は、日本の可愛さのインスタンス。
1項目の自己申告尺度が広く使用されているが、検証されていない。
以上の結果から,音声と視覚の川井知覚に対する1イテム尺度の有効性が示唆された。
- 参考スコア(独自算出の注目度): 37.34619430537658
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Kawaii is the Japanese instantiation of cuteness. As a multimodal percept theoretically derived from the notion of baby schema, kawaii can be a property of voice and sound, visual appearance and form factor, and movement and expression. However, measuring user perceptions of kawaii remains an open question. In the absence of a validated instrument, a one-item self-report measure has been used extensively, but has not been validated. Here, we report on three types of validity -- convergent, known groups, and cross-context -- and reliability for the single item measure across nine data sets featuring responses to video game character voices and visual appearances and computer-generated voice assistant voices from N=967 unique participants. Our results demonstrate initial evidence of the validity of the one-item measure for voice and visual kawaii perceptions. Further rigour can be pursued with novel stimuli, test-retest validation, and concurrent validity against the upcoming multi-item measure of kawaii.
- Abstract(参考訳): 川井(かわい)は、日本の可愛さのインスタンス。
ベビースキーマの概念から理論的に派生したマルチモーダル・パーセプションとして、カワイは声と音、視覚的外観とフォームファクター、動きと表現の特質である。
しかし、河合の利用者意識を測ることは未解決の問題である。
検証対象の楽器が存在しない場合には、1項目の自己申告手段が広く使用されているが、検証されていない。
本報告では,N=967の参加者から,ゲームキャラクターの声や視覚的外観,コンピュータ生成音声アシスタント音声に対する応答を特徴とする9つのデータセットを対象とした,収束性,既知のグループ,クロスコンテクストの3種類の妥当性と信頼性について報告する。
以上の結果から,音声と視覚の川井知覚に対する1イテム尺度の有効性が示唆された。
さらに、新たな刺激、テスト-テスト検証、および今後の川井のマルチイテム対策に対する同時有効性によって、さらなる厳密性を追求することができる。
関連論文リスト
- Omni-Streaming Thinking [57.37011317711198]
オームニモーダルモデルのストリーミングは、これまで観察されたビデオチャンクと同期オーディオから何といつ答えるかを決定する必要がある。
我々は,これまでに観察された証拠,今後の証拠の予測,及びこの証拠に基づく主張を含む構造化された出力を生成するOmni-Streaming Thinking (OST)を提案する。
論文 参考訳(メタデータ) (2026-09-14T07:05:04Z) - A Survey of Multimodal Hallucination Evaluation and Detection [52.03164192840023]
MLLM(Multi-modal Large Language Models)は、視覚情報とテキスト情報を統合するための強力なパラダイムとして登場した。
これらのモデルはしばしば幻覚に悩まされ、もっともらしいように見えるコンテンツを生成するが、入力内容や確立された世界的知識と矛盾する。
本調査では,イメージ・トゥ・テキスト(I2T)およびテキスト・トゥ・イメージ(T2I)生成タスクを対象とした幻覚評価ベンチマークと検出方法の詳細なレビューを行う。
論文 参考訳(メタデータ) (2025-07-25T07:22:42Z) - Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps [48.58310785625051]
大型言語モデル(LLM)は詳細を幻覚し、根拠のない回答で応答することができる。
本稿では,このような文脈的幻覚を検出するための簡単なアプローチについて述べる。
論文 参考訳(メタデータ) (2024-07-09T17:44:34Z) - Kawaii Computing: Scoping Out the Japanese Notion of Cute in User Experiences with Interactive Systems [28.689320648900118]
川井コンピューティングは、人間-コンピュータインタラクション(HCI)研究および実践における「カット」という日本の概念に関する着実に成長している研究分野の新たな用語である。
文化的に日本人が経験した特定の情緒的・文化的側面、すなわち、日本の社会文化的文脈によって引き起こされた河合のユーザ体験(UX)と精神モデルを指す。
論文 参考訳(メタデータ) (2024-05-14T00:16:09Z) - Quantity Matters: Towards Assessing and Mitigating Number Hallucination in Large Vision-Language Models [57.42800112251644]
本研究では,画像中の特定の物体の数を誤って識別するモデルを参照しながら,特定の種類の幻覚数幻覚に焦点を当てた。
そこで,本研究では,数幻覚を減らすための一貫性向上を目的としたトレーニング手法を考案し,直接微調整法よりも8%の性能向上を図った。
論文 参考訳(メタデータ) (2024-03-03T02:31:11Z) - The Hidden Dance of Phonemes and Visage: Unveiling the Enigmatic Link
between Phonemes and Facial Features [27.89284938655708]
この研究は、音素と顔の特徴の巧妙なリンクを明らかにする。
生理学的観点から見ると、音声の各部分(音素)は、顔の様々な種類の気流と動きに対応している。
その結果, 子音, 特に発声音と比較して, AMは母音からより予測可能であることが示唆された。
論文 参考訳(メタデータ) (2023-07-26T04:08:12Z) - Can Voice Assistants Sound Cute? Towards a Model of Kawaii Vocalics [10.036312061637764]
かわいさ・弱さ・魅力を表す「川井」は世界的な文化輸出である。
音声アシスタント音声の音声品質を探索することで、音声が川井になるかどうかを考察する。
論文 参考訳(メタデータ) (2023-04-22T01:47:19Z) - Plausible May Not Be Faithful: Probing Object Hallucination in
Vision-Language Pre-training [66.0036211069513]
大規模視覚言語事前学習モデルは、テキストを生成する際に、存在しない視覚オブジェクトを幻覚させる傾向がある。
標準メトリクスでより良いスコアを得るモデルは、オブジェクトをより頻繁に幻覚させる可能性があることを示す。
驚いたことに、パッチベースの機能が最も良く、より小さなパッチ解決は、オブジェクト幻覚の非自明な減少をもたらす。
論文 参考訳(メタデータ) (2022-10-14T10:27:22Z) - Multilingual and Multimodal Abuse Detection [3.4352862428120123]
本稿では,多言語ソーシャルメディア設定における多モーダル視点からの会話音声における乱用検出を試みる。
提案手法であるMADAは、音声自体以外の2つのモードに明示的にフォーカスする。
提案手法を10の異なる言語で検証し,複数のモダリティを活用することで,0.6%~5.2%の範囲で一貫した利得を観測する。
論文 参考訳(メタデータ) (2022-04-03T13:28:58Z) - Few Shot Text-Independent speaker verification using 3D-CNN [0.0]
我々は,ごく少数の学習データを用いて話者の身元を検証するための新しい手法を提案してきた。
VoxCeleb1データセットで行った実験によると、非常に少ないデータでトレーニングしても、提案されたモデルの精度は、テキストに依存しない話者検証において、アートモデルの状態に近い。
論文 参考訳(メタデータ) (2020-08-25T15:03:29Z) - "Notic My Speech" -- Blending Speech Patterns With Multimedia [65.91370924641862]
音声認識と理解における視点依存と視覚的重要性の両方をモデル化するための視点時間的注意機構を提案する。
提案手法は, ビセム誤差率において, 既存の作業よりも4.99%優れていた。
モデルでは,多視点音声に対する理解と人間の知覚との間に強い相関関係があることが示されている。
論文 参考訳(メタデータ) (2020-06-12T06:51:55Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。