論文の概要: DuCCAE: A Hybrid Engine for Immersive Conversation via Collaboration, Augmentation, and Evolution
- arxiv url: http://arxiv.org/abs/2603.19248v1
- Date: Wed, 25 Feb 2026 04:46:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-06 02:36:12.772349
- Title: DuCCAE: A Hybrid Engine for Immersive Conversation via Collaboration, Augmentation, and Evolution
- Title(参考訳): DuCCAE:コラボレーション、拡張、進化による没入型会話のためのハイブリッドエンジン
- Abstract要約: 本研究では,Baidu 検索に没入型会話のためのハイブリッドエンジンである DuCCAE (Conversation while Collaboration with Augmentation and Evolution) を提案する。
DuCCAEは非同期エージェント実行からリアルタイム応答生成を分離し、共有状態を介して同期する。
我々は,DuCCAEがエージェント実行の信頼性と対話品質において,厳格なリアルタイム予算に適合するレイテンシを低減しつつ,高いベースラインを達成していることを示す。
- 参考スコア(独自算出の注目度): 17.82263996593586
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Immersive conversational systems in production face a persistent trade-off between responsiveness and long-horizon task capability. Real-time interaction is achievable for lightweight turns, but requests involving planning and tool invocation (e.g., search and media generation) produce heavy-tail execution latency that degrades turn-taking, persona consistency, and user trust. To address this challenge, we propose DuCCAE (Conversation while Collaboration with Augmentation and Evolution), a hybrid engine for immersive conversation deployed within Baidu Search, serving millions of users. DuCCAE decouples real-time response generation from asynchronous agentic execution and synchronizes them via a shared state that maintains session context and execution traces, enabling asynchronous results to be integrated back into the ongoing dialogue. The system orchestrates five subsystems-Info, Conversation, Collaboration, Augmentation, and Evolution-to support multi-agent collaboration and continuous improvement. We evaluate DuCCAE through a comprehensive framework that combines offline benchmarking on the Du-Interact dataset and large-scale production evaluation within Baidu Search. Experimental results demonstrate that DuCCAE outperforms strong baselines in agentic execution reliability and dialogue quality while reducing latency to fit strict real-time budgets. Crucially, deployment metrics since June 2025 confirm substantial real-world effectiveness, evidenced by a tripling of Day-7 user retention to 34.2% and a surge in the complex task completion rate to 65.2%. Our hybrid architecture successfully preserves conversational continuity while enabling reliable agentic execution, offering practical guidelines for deploying scalable agentic systems in industrial settings.
- Abstract(参考訳): 実運用における没頭型会話システムは、応答性と長期タスク能力の相反するトレードオフに直面します。
リアルタイムのインタラクションは、ライトウェイトなターンで実現可能ですが、計画とツール呼び出し(例えば、検索とメディア生成)を含む要求は、ターンテイク、ペルソナ一貫性、ユーザ信頼を低下させるヘビーテールの実行遅延を生成します。
この課題に対処するために、Baidu Search内にデプロイされた没入型会話のためのハイブリッドエンジンであるDuCCAE(Conversation while Collaboration with Augmentation and Evolution)を提案する。
DuCCAEは非同期エージェント実行からリアルタイム応答生成を分離し、セッションコンテキストと実行トレースを保持する共有状態を介して同期することで、非同期結果が進行中の対話に統合されるようにする。
このシステムは、情報、会話、コラボレーション、拡張、進化の5つのサブシステムを編成し、マルチエージェントコラボレーションと継続的改善をサポートする。
我々は、Du-InteractデータセットのオフラインベンチマークとBaidu Searchにおける大規模生産評価を組み合わせた総合的なフレームワークを通じて、DuCCAEを評価する。
実験の結果,DuCCAEはエージェント実行の信頼性と対話品質において高いベースラインを達成し,遅延を低減し,厳格なリアルタイム予算に適合することがわかった。
重要なことに、2025年6月以降の展開メトリクスは現実の実質的な有効性を確認しており、デイ-7のユーザ保持率が34.2%に、複雑なタスク完了率が65.2%に増加したことが証明されている。
当社のハイブリッドアーキテクチャは,信頼性の高いエージェント実行を実現し,産業環境でスケーラブルなエージェントシステムをデプロイするための実践的ガイドラインを提供するとともに,会話の連続性を保っている。
関連論文リスト
- openJiuwen: Beyond Static Harnesses for Long-Horizon Coding Agents [25.815001544093217]
本稿では,開発者のコンポーザビリティと適応タスク実行のためのオープンソースのハーネスであるopenJiuwenを紹介する。
openJiuwenは、単一のエージェント、委譲サブエージェント、Swarm Flowにまたがる共有実行基板とRailベースの機能構成を提供する。
SWE-bench Verified と Terminal-Bench 2.1 で openJiuwen を体系的に評価し,82.6% と87.19% を得た。
論文 参考訳(メタデータ) (2026-08-28T06:31:38Z) - DuMateBench: Evaluating Autonomous Agents in Complex Real-World Workflows [69.12339622053588]
我々はDuMateBenchを紹介した。DuMateBenchは匿名化およびプライバシスクリーニングによるユーザセッションから再構築されたリアルセッションベンチマークである。
結果として得られたベンチマークは、8つの広いシナリオにまたがる200のタスクと、17のきめ細かい機能カテゴリで構成されている。
これらのタスクは、Isufficient、Unstable、Noisyの3種類の環境複雑性を注入した、分離されたDockerコンテナで実行します。
論文 参考訳(メタデータ) (2026-08-27T02:36:23Z) - DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation [51.978605314711835]
ロングホライゾン協調視覚言語ナビゲーション(Long-Horizon collaborative vision- language navigation, VLN)は、マルチロボットシステムにおいて、単一のエージェントの能力を超える複雑なタスクを達成するために重要である。
ダイアログを改良したLong-Horizon Collaborative Vision-Language Navigation (DeCoNav)を提案する。
DeCoNavは、イベントトリガーされた対話と動的タスク割り当てとリアルタイム適応調整のための再計画を結合する分散フレームワークである。
論文 参考訳(メタデータ) (2026-04-14T09:11:55Z) - Effective Strategies for Asynchronous Software Engineering Agents [52.76455094324273]
本稿では,集中型タスクデリゲート,非同期実行,独立したワークスペースという,3つのSWEプリミティブに根ざした構造化マルチエージェント協調パラダイムを導入する。
CAIDは,紙再生タスク(PaperBench)では26.7%,Pythonライブラリ開発タスクでは14.3%,単一エージェントベースラインでは26.7%の精度向上を実現している。
論文 参考訳(メタデータ) (2026-03-23T02:26:35Z) - Towards Efficient Agents: A Co-Design of Inference Architecture and System [66.59916327634639]
本稿では,エージェントアクセラレーションのための統合フレームワークであるAgentInferを提案する。
問題をAgentCollab、AgentSched、AgentSAM、AgentCompressの4つの相乗的コンポーネントに分解する。
BrowseComp-zhとDeepDiverベンチマークの実験では、これらの手法の相乗的コラボレーションを通じて、AgentInferは非効率なトークン消費を50%以上削減することを示した。
論文 参考訳(メタデータ) (2025-12-20T12:06:13Z) - AsyncVoice Agent: Real-Time Explanation for LLM Planning and Reasoning [27.522862635055077]
非同期アーキテクチャが会話音声からストリーミングバックエンドを分離するシステムであるAsyncVoice Agentを提案する。
この設計により、ナレーションと推論が並列に実行され、ユーザーはモデルの推論プロセスを中断し、クエリし、管理することができる。
客観的ベンチマークでは、このアプローチはモノリシックなベースラインに比べて600倍以上のレイテンシを削減している。
論文 参考訳(メタデータ) (2025-10-17T19:00:08Z) - Hybrid AI for Responsive Multi-Turn Online Conversations with Novel Dynamic Routing and Feedback Adaptation [2.4830284216463]
本稿では,RAGとインテントベースの缶詰応答を統合した新しいハイブリッドフレームワークを提案する。
本フレームワークでは,対話コンテキストマネージャを用いて,マルチターンインタラクションにおけるコヒーレンスを保証し,インテントを洗練するためのフィードバックループを組み込む。
実験結果から,提案手法は高い精度 (95%) と低レイテンシ (180ms) のバランスが得られた。
論文 参考訳(メタデータ) (2025-06-02T17:59:27Z) - SyncMind: Measuring Agent Out-of-Sync Recovery in Collaborative Software Engineering [74.04271300772155]
SyncMindは、ソフトウェア工学において、大きな言語モデル(LLM)エージェントが直面している非同期の問題を体系的に定義するフレームワークである。
SyncMindをベースとしたSyncBenchは,実世界のCSEで24,332のエージェントアウトオブシンクシナリオを特徴とするベンチマークです。
論文 参考訳(メタデータ) (2025-02-10T19:38:36Z) - DialogAgent: An Auto-engagement Agent for Code Question Answering Data Production [5.030384831047144]
本稿では、実際の開発者インタラクションを忠実に模倣する合成トレーニングデータを生成する自動化ツールであるDialogAgentを紹介する。
このツールは手動データ生成への依存を著しく低減し、従来の方法に比べて効率を4.8倍に向上させる。
論文 参考訳(メタデータ) (2024-12-11T03:31:36Z) - The BrowserGym Ecosystem for Web Agent Research [151.90034093362343]
BrowserGymエコシステムは、Webエージェントの効率的な評価とベンチマークの必要性の高まりに対処する。
本稿では,Webエージェント研究のためのBrowserGymベースの拡張エコシステムを提案する。
大規模なマルチベンチマークWebエージェント実験を初めて実施し、6つのWebエージェントベンチマークで6つの最先端LCMの性能を比較した。
論文 参考訳(メタデータ) (2024-12-06T23:43:59Z) - Evaluating Very Long-Term Conversational Memory of LLM Agents [95.84027826745609]
我々は,高品質で長期的な対話を生成するための,マシン・ヒューマン・パイプラインを導入する。
我々は、各エージェントに画像の共有と反応の能力を持たせる。
生成した会話は、長距離一貫性のために人間のアノテーションによって検証され、編集される。
論文 参考訳(メタデータ) (2024-02-27T18:42:31Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。