論文の概要: Do Latent Channels Actually Communicate? A Causal Audit of Latent Multi-Agent LLM
- arxiv url: http://arxiv.org/abs/2607.26773v1
- Date: Wed, 29 Jul 2026 11:14:27 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-30 21:06:25.649459
- Title: Do Latent Channels Actually Communicate? A Causal Audit of Latent Multi-Agent LLM
- Title(参考訳): 潜伏チャネルは実際に通信するのか? 潜伏マルチエージェントLDMの因果監査
- Abstract要約: 本稿では、送信者生成表現が受信機に入る境界において、制御されたメッセージ置換を適用する因果監査を導入する。
4つのメッセージ設定は、送信者のエンコードされた情報の5つの測定をサポートする。
その結果、集約精度は、遅延メッセージが受信機に与える影響を識別しないことがわかった。
- 参考スコア(独自算出の注目度): 0.42970700836450487
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Latent communication in large language model (LLM)-based multi-agent systems (MAS) transmits continuous internal representations instead of text, but greater representational capacity does not establish that the receiver uses task-relevant information. End-task performance alone also cannot reveal whether an observed effect depends on message presence, content generated for the evaluated example, or information supplied by a separate agent. We introduce a causal audit that applies controlled message replacements at the boundary where the sender-produced representation enters the receiver. Four message settings support five measurements of encoded sender information, receiver sensitivity to message presence and identity, the task value of example-specific content, and the additional value supplied by a separate agent. We apply the audit to latent relay with Qwen3-4B and Qwen3-8B on GSM8K, ARC-C, and MATH-500. On GSM8K, the Qwen3-4B overall performance effect of -1.00 percentage point decomposes into a -6.17-point effect retained by an other-example message and a +5.17-point effect attributable to example-specific content; both component directions reverse at 8B. On MATH-500, the Qwen3-4B gain of 15.00 points comprises 8.33 points retained by an other-example message and 6.67 points attributable to example-specific content, while the 8B gain is dominated by the former component. Self-substitution comparisons further show that example-specific content and other-agent value are distinct. These results show that aggregate accuracy does not identify how a latent message affects the receiver and motivate controlled message comparisons as a standard evaluation for latent communication.
- Abstract(参考訳): 大規模言語モデル (LLM) ベースのマルチエージェントシステム (MAS) における遅延通信は、テキストの代わりに連続的な内部表現を伝達するが、より大きな表現能力は、受信側がタスク関連情報を使用することを保証しない。
エンドタスクのパフォーマンスだけでは、観察された効果がメッセージの存在、評価された例のために生成されたコンテンツ、または別のエージェントから提供される情報に依存するかどうかを明らかにすることができない。
本稿では、送信者生成表現が受信機に入る境界において、制御されたメッセージ置換を適用する因果監査を導入する。
4つのメッセージ設定は、エンコードされた送信者情報の5つの測定、メッセージの存在とアイデンティティに対する受信感度、サンプル固有のコンテンツのタスク値、別エージェントから供給される付加値をサポートする。
GSM8K,ARC-C,MATH-500において,Qwen3-4BおよびQwen3-8Bを用いた潜時中継に監査を適用した。
GSM8Kでは、Qwen3-4Bの全体的な性能効果-1.00ポイントは、他のサンプルメッセージが保持する-6.17ポイント効果と、サンプル固有の内容に起因する+5.17ポイント効果に分解される。
MATH-500では、15.00ポイントのQwen3-4Bゲインが、他のサンプルメッセージによって保持される8.33ポイントと、サンプル固有のコンテンツに起因する6.67ポイントと、前者のコンポーネントによって支配される8Bゲインを含む。
自己置換比較は、サンプル固有の内容と他のエージェントの値が区別されていることを示す。
これらの結果から,潜時メッセージが受信者に与える影響を集計精度で判断できないこと,潜時通信の標準評価として制御されたメッセージ比較を動機付けていることが示唆された。
関連論文リスト
- Waggle Dance Inspired Motion Communication for Multiple UAVs in MuJoCo [0.0]
本稿では,MoComのポイント・ツー・ポイント・モーション・コミュニケーション・セッティングを1人のパフォーマーと複数のオブザーバに拡張する MuJoCo システムを提案する。
パフォーマーは、4つのフライトプリミティブと明示的なヌル信号を使用して6ビットのナビゲーションペイロードをブロードキャストする。
1人から5人のオブザーバーが独自のRGBイメージを処理し、光フロー軌跡を抽出し、シンボルを認識し、メッセージを解析し、独自の完全なフレームを確認した後のみナビゲーションを開始する。
論文 参考訳(メタデータ) (2026-09-15T10:34:08Z) - XBridge: Entity-Grounded Latent Bridge for Heterogeneous LLM Communication [41.12003897083975]
不均質なマルチエージェントLPMシステムは、冗長な推論パターンを減らして均質な構成を上回り得る。
既存の通信プロトコルはテキストを介して動作し、送信者の内部表現を破棄するか、潜在レベルの転送のためにアーキテクチャ上の均質性を必要とする。
異種LLMファミリー間で連続表現を転送するクロスアテンションブリッジは,稀な圧縮崩壊に悩まされる。
XBRIDGEはデコード不要な通信プロトコルで、2つのメカニズムで処理する。
論文 参考訳(メタデータ) (2026-08-12T05:32:33Z) - Post-Hoc Sparse Coding of Latent Communication Between Vision-Language Model Agents [4.556640962276085]
Vision Wormhole は、視覚的特徴を他のモデルで使用可能な普遍的な潜在表現に変換することで、このアプローチを実現している。
すべてのメッセージは、その内容に関係なく、同じ大きさの密度のテンソルとして転送される。
この観察は、通信チャネルが実質的に圧縮可能であることを示唆している。
論文 参考訳(メタデータ) (2026-08-10T20:16:38Z) - HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning [27.564924459355424]
我々は,送信者の階層的な観察にメッセージを置くプラグイン通信モジュールであるtextscHiCommを提案する。
textscHiCommはレシーバ駆動であり、階層は3段階の復号プロセスによって解決される。
実験によると、textscHiCommは、各エピソードの受信者あたりの通信容量を最大2,3倍に減らしながら、学習したコミュニケーションのベースラインにマッチし、より優れています。
論文 参考訳(メタデータ) (2026-06-28T00:29:12Z) - Good Agentic Friends Do Not Just Give Verbal Advice: They Can Update Your Weights [58.27172968382275]
マルチエージェントLLMシステムは、通常自然言語メッセージを交換することで協調する。
送信者のメッセージを受信者のコンテキストに付加する代わりに、送信者の隠された状態を過渡的で受信者固有の重み摂動にコンパイルする。
論文 参考訳(メタデータ) (2026-05-13T17:58:32Z) - LLM-Based Intelligent Notification Composition: From Static Personalization to Context-Aware Persuasive Messaging [0.18275108630751835]
プッシュ通知は、デジタルプラットフォームがユーザをエンゲージする最も直接的なチャネルのひとつだ。
本稿は,メッセージの品質は独立で,低投資のレバーであり,LLMは,この層で最も差別化された値を生成することを主張する。
論文 参考訳(メタデータ) (2026-03-22T01:31:16Z) - CIMemories: A Compositional Benchmark for Contextual Integrity of Persistent Memory in LLMs [62.116710797795314]
大規模言語モデル(LLM)は、パーソナライゼーションとタスクパフォーマンスを向上させるために、過去のインタラクションから永続的なメモリを使用することが多い。
タスクコンテキストに基づいて,LLMがメモリからの情報フローを適切に制御するかどうかを評価するベンチマークであるCIMemoriesを提案する。
論文 参考訳(メタデータ) (2025-11-18T21:51:23Z) - MIRAGE: Agentic Framework for Multimodal Misinformation Detection with Web-Grounded Reasoning [0.6475163438744868]
我々は、マルチモーダル検証を4つのシーケンシャルモジュールに分解する推論時モデルプラガブルエージェントフレームワークであるMIRAGEを提案する。
視覚的妥当性評価は、AI生成した画像を検出し、クロスモーダルな一貫性分析は、Webエビデンスにおけるアウト・オブ・コンテクストの再利用、検索強化された事実チェックの根拠を特定する。
MIRAGEは、ターゲットとするWeb検索、構造化された出力、引用リンクされた有理数を用いた視覚言語モデル推論をオーケストレーションする。
論文 参考訳(メタデータ) (2025-10-20T14:40:26Z) - Multi-Task Semantic Communication With Graph Attention-Based Feature Correlation Extraction [69.24689059980035]
本稿では,マルチタスク・セマンティック・コミュニケーション・システムのエンコーダ/トランスミッタに新たなグラフアテンション・インターブロック(GAI)モジュールを提案する。
エンコーダの中間特徴抽出ブロックの出力をグラフのノードとして解釈し,その中間特徴の相関関係を捉える。
実験により、提案されたモデルは、CityScapes 2Taskデータセットにおいて、最も競争力があり、公開可能なモデルよりも11.4%多いことが示されている。
論文 参考訳(メタデータ) (2025-01-02T04:38:01Z) - Teaching Human Behavior Improves Content Understanding Abilities Of LLMs [56.574610730939646]
受信者の振る舞いに関するLLMのトレーニングは、コンテンツ理解能力の向上に役立つ。
この性能は、26のベンチマークデータセット上で46以上のビデオおよび画像理解タスクで向上する。
我々は、複数のプラットフォームから収集された750kの画像やビデオのレシーバ動作のクリーン化コメントやお気に入りを、インストラクションチューニングデータとともにリリースする。
論文 参考訳(メタデータ) (2024-05-02T02:04:01Z) - Large Content And Behavior Models To Understand, Simulate, And Optimize Content And Behavior [66.4024040742149]
LLMのトレーニングコーパスでは、受信者の「行動トークン」、例えば、シェア、お気に入り、クリック、購入、リツイートを紹介し、受信者のコンテンツを最適化し、その振る舞いを予測する。
コンテンツ理解タスクにおけるLLMと同じような性能を示す以外に、トレーニングされたモデルでは、行動次元における一般化能力を示す。
これらのモデルをLCBM(Large Content and Behavior Models)と呼ぶ。
論文 参考訳(メタデータ) (2023-09-01T09:34:49Z) - Robust Semantic Communications with Masked VQ-VAE Enabled Codebook [56.63571713657059]
本稿では,ロバストなエンドツーエンドのセマンティック通信システムにおいて,セマンティックノイズに対処するためのフレームワークを提案する。
セマンティックノイズに対処するため、重み付き対向トレーニングを開発し、トレーニングデータセットにセマンティックノイズを組み込む。
ノイズやタスク非関連の特徴を抑える機能重要モジュール (FIM) を開発した。
論文 参考訳(メタデータ) (2022-06-08T16:58:47Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。