論文の概要: PPU-Bench:Real World Benchmark for Personalized Partial Unlearning in Vision Language Models
- arxiv url: http://arxiv.org/abs/2605.08800v1
- Date: Sat, 09 May 2026 08:46:00 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-12 23:28:49.892835
- Title: PPU-Bench:Real World Benchmark for Personalized Partial Unlearning in Vision Language Models
- Title(参考訳): PPU-Bench:視覚言語モデルにおけるパーソナライズされた部分学習のための実世界ベンチマーク
- Abstract要約: MLLMにおけるパーソナライズされた部分的アンラーニングのための実世界および微調整不要なベンチマークであるPPU-Benchを紹介する。
PPU-Benchは、500人の公開人物の事前知識から得られた24Kのマルチモーダルとユニモーダルのサンプルを含んでいる。
- 参考スコア(独自算出の注目度): 21.018275195083305
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Multimodal Large Language Models (MLLMs) may memorize sensitive cross-modal information during pretraining. However, existing MLLM unlearning benchmarks rely on synthetic knowledge injection or complete subject-level deletion, which fail to capture realistic, personalized deletion requests that require fine-grained factual control. In this paper, we introduce PPU-Bench, a real-world and fine-tuning-free benchmark for personalized partial unlearning in MLLMs. PPU-Bench contains 24K multimodal and unimodal samples derived from pre-existing knowledge of 500 public figures under three progressively challenging settings: Complete, Selective, and Personalized unlearning. The benchmark evaluates whether methods can remove target knowledge while preserving non-target facts, model utility, and cross-modal consistency. Extensive experiments show that Complete Unlearning often suppresses visual identity rather than factual knowledge, while Selective and Personalized Unlearning expose significant forget--retain trade-offs and challenges in intra-subject factual boundaries. Robustness analysis under cross-image and prompt-based attacks reveals distinct vulnerabilities across different unlearning settings. Motivated by these findings, we propose Boundary-Aware Optimization (BAO), which explicitly models intra-subject forget-retain boundaries. Experimental results on two representative methods demonstrate that BAO can effectively enforce intra-subject factual boundaries.
- Abstract(参考訳): MLLM(Multimodal Large Language Models)は、事前訓練中に機密なクロスモーダル情報を記憶することができる。
しかし、既存のMLLMアンラーニングベンチマークは、合成知識注入や完全な主観レベルの削除に依存しており、細かい事実管理を必要とする現実的でパーソナライズされた削除要求をキャプチャできない。
本稿では,MLLMにおけるパーソナライズされた部分的アンラーニングのための実世界および微調整不要なベンチマークであるPPU-Benchを紹介する。
PPU-Benchには、500人の公開人の事前知識から得られた24Kのマルチモーダルとアンモダルのサンプルが含まれている。
このベンチマークは、ターゲットでない事実、モデルユーティリティ、モダル間の一貫性を維持しながら、対象とする知識を除去できるかどうかを評価する。
包括的な実験では、完全学習は事実知識よりも視覚的アイデンティティを抑圧することが多いが、選択的かつパーソナライズド・アンラーニングは、オブジェクト内事実境界における重要なトレードオフと課題を明らかにしている。
クロスイメージとプロンプトベースの攻撃下でのロバストネス分析は、異なる未学習設定で異なる脆弱性を明らかにする。
これらの知見に触発され,対象物内残留境界を明示的にモデル化した境界認識最適化(BAO)を提案する。
2つの代表的な手法による実験結果から,BAOは物体内事実境界を効果的に適用できることが示された。
関連論文リスト
- PRMU: A Corpus-Free Benchmark for Person-Centric Knowledge Unlearning in Multimodal Large Language Models [31.957271923746713]
我々は,現実的な人中心の削除要求の下で,コーパスのないマルチモーダル・アンラーニングを評価するためのベンチマークであるPRMUを紹介する。
PRMUは自然に獲得した人的知識に着目し、モデルが関連する知識を保持しながら対象の知識を除去できるかどうかを評価する。
さらに、知識変位、保護されたパラメータ空間編集、局所性を考慮したマルチモーダル制御を備えた軽量なコーパスなし未学習ベースラインであるSGPE(Simisity-Gated Projection Editing)を紹介する。
論文 参考訳(メタデータ) (2026-08-11T17:09:28Z) - POPS: Recovering Unlearned Multi-Modality Knowledge in MLLMs with Prompt-Optimized Parameter Shaking [56.151482557515955]
MMU (Multi-modality Machine Unlearning) は、MLLMが個人情報を忘れることを効果的に強制する緩和策として提案された。
本稿では,MLLMから未学習のマルチモーダルな知識を回収することを目的とした新しい戦略であるPrompt-d adversarial-POPSを提案する。
提案手法は, 被害者のMLLMに対して, プロンプトサフィックス最適化による潜在的プライベートサンプルの生成を誘導し, 合成した出力を利用してモデルを微調整し, 真のプライベート情報を開示する。
論文 参考訳(メタデータ) (2026-07-07T16:28:54Z) - LIMSSR: LLM-Driven Sequence-to-Score Reasoning under Training-Time Incomplete Multimodal Observations [53.20772659095155]
本稿では、トレーニング時不完全観察において、より困難なIMLの設定に取り組む。
本稿では,この課題を条件付きシーケンス推論タスクとして再構成したLIMSSR(LLM-Driven Incomplete Multimodal Sequence-to-Score Reasoning)を提案する。
論文 参考訳(メタデータ) (2026-05-01T06:11:42Z) - Harmonizing Multi-Objective LLM Unlearning via Unified Domain Representation and Bidirectional Logit Distillation [11.723777730116831]
大規模言語モデル(LLM)のアンラーニングは、モデルから有害またはプライバシをリードする情報を除去するために不可欠である。
既存の未学習の手法は主にこれらの目標の限られたサブセットに焦点を当てている。
複数の未学習目標を調和させる新しい多目的学習フレームワークを提案する。
論文 参考訳(メタデータ) (2026-04-16T19:09:17Z) - AUVIC: Adversarial Unlearning of Visual Concepts for Multi-modal Large Language Models [63.05306474002547]
を強制する規制フレームワークは、機械学習の必要性を喚起します。
AUVICはMLLMのための新しい視覚概念アンラーニングフレームワークである。
AUVICは,非ターゲット概念の性能劣化を最小限に抑えつつ,最先端の目標忘れ率を実現していることを示す。
論文 参考訳(メタデータ) (2025-11-14T13:35:32Z) - LTD-Bench: Evaluating Large Language Models by Letting Them Draw [57.237152905238084]
LTD-Benchは、大規模言語モデル(LLM)のブレークスルーベンチマークである。
LLMの評価を抽象的なスコアから直接観察可能な視覚出力に変換する。
LTD-Benchの視覚出力は強力な診断分析を可能にし、モデル類似性を調べるための潜在的アプローチを提供する。
論文 参考訳(メタデータ) (2025-11-04T08:11:23Z) - LLM Unlearning Under the Microscope: A Full-Stack View on Methods and Metrics [10.638045151201084]
本稿では,近年のステートフル・アンラーニング法12の原則的分類について述べる。
未学習効果(UE)、実用性維持(UT)、堅牢性(Rob)の評価を再考する。
分析の結果,Multiple-choice question (MCQ) の精度に支配される現在の評価は,狭い視点しか示さないことがわかった。
論文 参考訳(メタデータ) (2025-10-08T23:47:05Z) - UniErase: Towards Balanced and Precise Unlearning in Language Models [69.04923022755547]
大規模言語モデル(LLM)は、古い情報問題に対処するために反復的な更新を必要とする。
UniEraseは、知識の未学習と能力保持の間の精度とバランスの取れたパフォーマンスを示す、新しいアンラーニングフレームワークである。
論文 参考訳(メタデータ) (2025-05-21T15:53:28Z) - Unlearning Sensitive Information in Multimodal LLMs: Benchmark and Attack-Defense Evaluation [88.78166077081912]
我々は、MLLMから特定のマルチモーダル知識を削除する方法を評価するために、マルチモーダル・アンラーニング・ベンチマークUnLOK-VQAとアタック・アンド・ディフェンス・フレームワークを導入する。
その結果,マルチモーダル攻撃はテキストや画像のみの攻撃よりも優れており,最も効果的な防御は内部モデル状態から解答情報を除去することを示した。
論文 参考訳(メタデータ) (2025-05-01T01:54:00Z) - PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models [27.338242898495448]
マルチモーダル大規模言語モデル (MLLM) は視覚言語タスクにおいて顕著な成功を収めた。
膨大なインターネットソースデータへの依存は、プライバシーとセキュリティの重大な懸念を引き起こす。
マシン・アンラーニング(MU)はこれらの問題に対処するための重要な手法として登場した。
PEBenchはMLLMにおけるMUの徹底的な評価を容易にするために設計された新しいベンチマークである。
論文 参考訳(メタデータ) (2025-03-16T15:26:20Z) - A Closer Look at Machine Unlearning for Large Language Models [46.245404272612795]
大型言語モデル(LLM)は機密または著作権のあるコンテンツを記憶し、プライバシーと法的懸念を高める。
LLMの機械学習におけるいくつかの問題について議論し、可能なアプローチについての洞察を提供する。
論文 参考訳(メタデータ) (2024-10-10T16:56:05Z) - Towards Effective Evaluations and Comparisons for LLM Unlearning Methods [97.2995389188179]
本稿では,大規模言語モデルにおける機械学習評価の精度向上を図る。
評価指標の堅牢性と、競合する目標間のトレードオフという、2つの重要な課題に対処します。
論文 参考訳(メタデータ) (2024-06-13T14:41:00Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。