論文の概要: Modeling Complex Behaviors: Multi-Personality Composition and Dynamic Switching in Vision-Language Models
- arxiv url: http://arxiv.org/abs/2606.11074v2
- Date: Wed, 10 Jun 2026 03:48:53 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-11 14:23:44.406157
- Title: Modeling Complex Behaviors: Multi-Personality Composition and Dynamic Switching in Vision-Language Models
- Title(参考訳): 複合行動のモデリング:視覚言語モデルにおける多人数構成と動的切り替え
- Abstract要約: 本稿では,マルチモーダル大言語モデル(MLLM)における明示的なパーソナリティ条件付けを提案する。
単一人格誘導、多人格誘導、個性転換を含む体系的な評価枠組みを確立する。
実験により、人格誘導はイメージキャプション性能を向上するが、正確な推論を必要とするタスクではパフォーマンスを損なう可能性があることが示された。
- 参考スコア(独自算出の注目度): 24.456367163695962
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: With the widespread deployment of Multimodal Large Language Models (MLLMs) in social interaction, understanding and controlling their behavior under complex personality conditions is essential. This paper introduces explicit personality conditioning and establishes a systematic evaluation framework encompassing single-personality induction, multi-personality induction, and personality switching. Experiments show that personality induction improves image captioning performance but can impair performance on tasks requiring precise reasoning, such as visual question answering (VQA). Balancing and residual effects are observed during multi-trait composition and dynamic switching, indicating that model behavior is co-modulated by both previous and current personality constraints. Existing prompt-based personality induction methods show limited transferability to multimodal settings. Our work reveals the dynamic and complex nature of personality modeling in MLLMs and underscores the need for robust, tailored methods for personality induction and evaluation. The code will be released when the paper is accepted.
- Abstract(参考訳): マルチモーダル大規模言語モデル(MLLM)の社会的相互作用への普及に伴い、複雑な人格条件下での行動の理解と制御が不可欠である。
本稿では、明示的なパーソナリティ条件付けを導入し、シングルパーソナリティ誘導、マルチパーソナリティ誘導、パーソナリティ切り替えを含む体系的な評価枠組みを確立する。
視覚的質問応答(VQA)のような正確な推論を必要とするタスクにおいて、人格誘導はイメージキャプションのパフォーマンスを向上するが、パフォーマンスを損なう可能性があることを示す実験である。
マルチトレート構成と動的切替の間にバランスと残留効果が観察され、モデル行動が前と現在のパーソナリティの制約によって共変調されることが示されている。
既存のプロンプトベースのパーソナリティ誘導手法は、マルチモーダル設定への限定的な転送性を示す。
本研究は、MLLMにおける人格モデリングの動的かつ複雑な性質を明らかにし、人格誘導と評価のための堅牢で調整された方法の必要性を浮き彫りにしている。
コードは、論文が受理されたときに公開される。
関連論文リスト
- Traits Run Deeper: Trait-Specific Asymmetric Fusion for Personality Assessment [53.50824432699408]
Traits Run Deeperは、新しいパーソナリティアセスメントフレームワークである。
MFR(Multimodal Foundation Representation)、TSMF(Trit-Specific Modality Fusion)、DCPR(Distributed-Calibrated Personality Regression)の3つのコンポーネントで構成されている。
論文 参考訳(メタデータ) (2026-06-09T06:38:36Z) - Towards Customized Multimodal Role-Play [50.72454102691162]
マルチモーダル理解と生成モデルは、よりリッチなヒューマン-AIインタラクションを可能にする。
しかし、文字のペルソナ、対話スタイル、視覚的アイデンティティを共同でカスタマイズする一方で、モダリティ間の出力一貫性を維持することは、ほとんど探索されていない。
本研究では,20文字からなるRoleScape-20データセットを構築した。
UniCharacterは、Unified Supervised Finetuning(Unified-SFT)とCharacter-GRPO(Character-GRPO)を含む2段階のトレーニングフレームワークである。
論文 参考訳(メタデータ) (2026-05-01T03:22:04Z) - LLMs Reading the Rhythms of Daily Life: Aligned Understanding for Behavior Prediction and Generation [53.62804271492357]
大きな言語モデル(LLM)は、その意味的豊かさ、強い解釈可能性、生成能力により、有望な方向性を提供する。
本稿では,LLMを構造化カリキュラム学習プロセスを通じて人間行動モデリングに統合する,行動理解アライメント(BUA)を提案する。
BUAは、事前訓練された行動モデルからのシーケンス埋め込みをアライメントアンカーとして採用し、3段階のカリキュラムを通じてLLMをガイドし、マルチラウンドの対話設定では予測と生成機能を導入している。
論文 参考訳(メタデータ) (2026-04-26T07:34:37Z) - Beyond Static Personas: Situational Personality Steering for Large Language Models [52.33369223308941]
IRIS(Identify-Retrieve-Steer framework for Advanced situational personality steering)を提案する。
本手法は, 状況認識型ニューロン識別, 状況認識型ニューロン検索, 類似性重み付けによるステアリングを含む。
我々は、パーソナリティベンチの枠組みと、包括的状況パーソナリティベンチマークであるSPBenchを実証的に検証した。
論文 参考訳(メタデータ) (2026-04-15T13:17:36Z) - Experiences Build Characters: The Linguistic Origins and Functional Impact of LLM Personality [10.56924140369377]
本研究は、教師なしの方法でモデルをドメイン固有のテキストに公開するために、継続事前学習を採用する。
モデル変異の性格特性を定量化し,それらの言語的スタイルと推論行動との関係を解析する。
この結果は、モデル能力がバイモーダルであり、"Expressive Generalists" と "Suppressed Specialists" がピークであることを示している。
論文 参考訳(メタデータ) (2026-03-06T09:42:41Z) - Dynamic Personality Adaptation in Large Language Models via State Machines [1.6986898305640261]
本稿では,動的パーソナリティシミュレーションのためのモデルに依存しないフレームワークを提案する。
私たちのアーキテクチャの一部は,潜伏軸に沿った対話を評価する,連続的な性格評価のためのモジュールパイプラインです。
その結果、システムはユーザの入力にパーソナリティの状態を適応させるだけでなく、ユーザの行動にも影響を及ぼすことが示された。
論文 参考訳(メタデータ) (2026-02-25T18:05:11Z) - Structured Personality Control and Adaptation for LLM Agents [11.050618253938126]
大規模言語モデル(LLM)は、ますますヒトとコンピュータの相互作用(HCI)を形作っている
ユング心理学的タイプを用いたLLMパーソナリティをモデル化する枠組みを提案する。
この設計により、エージェントは対話要求に応じて動的に調整しながらニュアンス付き特性を維持することができる。
論文 参考訳(メタデータ) (2026-01-15T03:15:24Z) - The Personality Illusion: Revealing Dissociation Between Self-Reports & Behavior in LLMs [60.15472325639723]
人格特性は、人間の行動の予測因子として長い間研究されてきた。
近年のLarge Language Models (LLM) は, 人工システムに類似したパターンが出現する可能性を示唆している。
論文 参考訳(メタデータ) (2025-09-03T21:27:10Z) - Exploring a Gamified Personality Assessment Method through Interaction with LLM Agents Embodying Different Personalities [45.56431615835303]
本研究では,個性表現の多元性に着目し,個性評価のための対話的アプローチについて検討する。
マルチパーソナリティ表現(Multi-PR GPA)を用いたゲーミフィケーション・パーソナリティ・アセスメントの枠組みを提案する。
論文 参考訳(メタデータ) (2025-07-05T11:17:20Z) - Personality Editing for Language Models through Adjusting Self-Referential Queries [17.051166122108857]
PALETTE(Personality Adjustment by LLM SElf-TargeTed queries)は,Large Language Models(LLMs)における人格編集の新しい手法である。
本手法では,心理的構成に根ざした自己参照文を事実知識と類似して扱う調整クエリを導入し,人格関連応答の直接編集を可能にする。
PALETTEは微調整とは異なり、パーソナリティ次元を横断するパーソナリティアライメントの大幅な改善を達成するために、12の編集サンプルしか必要としない。
論文 参考訳(メタデータ) (2025-02-17T13:28:14Z) - PersLLM: A Personified Training Approach for Large Language Models [66.16513246245401]
データ構築とモデルチューニングを改善するためのフレームワークPersLLMを提案する。
データ利用が不十分な場合には、Chain-of-Thoughtプロンプトやアンチインダクションといった戦略を取り入れます。
厳密な振舞いパターンを設計し,モデルの性格の特異性とダイナミズムを高めるために自動DPOを導入する。
論文 参考訳(メタデータ) (2024-07-17T08:13:22Z) - Editing Personality for Large Language Models [73.59001811199823]
本稿では,Large Language Models (LLMs) の性格特性の編集に焦点をあてた革新的なタスクを紹介する。
このタスクに対処する新しいベンチマークデータセットであるPersonalityEditを構築します。
論文 参考訳(メタデータ) (2023-10-03T16:02:36Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。