論文の概要: The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses
- arxiv url: http://arxiv.org/abs/2608.23953v1
- Date: Tue, 25 Aug 2026 01:26:41 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-26 14:09:34.726005
- Title: The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses
- Title(参考訳): エンパイア、長い分割:三つのLLMエージェント・ハーネスにおけるアーキテクチャ・コンバージェンス
- Authors: Dai Jiahong,
- Abstract要約: 本稿では、意図的に反対する哲学から構築された3つのオープンコーディングエージェントハーネスについて、ソースレベルのマルチケーススタディを提案する。
2つの成熟したハーネスは反対方向に移動したが、5つの繰り返し要素の1つのアーキテクチャの中間形態に向かって収束していることがわかった。
第3のハーネスはその後、ホールドアウトチェックとして読み上げられ、全5つを示し、1つのシームは別の実装をそのまま再利用する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: An agent harness is what turns a language model into an autonomous agent: the surrounding code that builds the model's context, mediates its tools, runs the loop, and persists state across a long-horizon run. This layer, not the model it wraps, is increasingly the binding constraint on agent behaviour. We present a source-level, multi-case study of three open coding-agent harnesses built from deliberately opposing philosophies: LangChain's deepagents (batteries-included), Earendil's pi (radical minimalism), and DeepSeek's dsh (everything-is-a-plugin). Reading each at a pinned commit and following its commit history, we find that the two mature harnesses have travelled in opposite directions (deepagents subtracting authored scaffolding, pi accreting durable infrastructure), yet converged toward one architectural middle form of five recurring elements: a commoditised loop, an append-only replayable session record, model quirks kept as data, progressive disclosure of context, and explicit extension seams. A third harness, read afterward as a held-out check, exhibits all five, and in one seam reuses another's implementation outright. We therefore do not claim independent invention, and decompose the convergence into parallel discovery, diffusion, and literal reuse. Finally, one load-bearing dimension shows no convergence, and indeed no presence: external verifiability, a tamper-evident record an outside party can check without trusting the runtime. We read this absence not as an oversight but as a predictive gap, the next axis on which harnesses for provenance-sensitive domains will differ.
- Abstract(参考訳): エージェントハーネスは、言語モデルを自律的なエージェントに変えるものです。モデルのコンテキストを構築し、そのツールを仲介し、ループを実行し、長期にわたって状態を永続化する、周囲のコードです。
このレイヤは、ラップするモデルではなく、エージェントの振る舞いに対するバインディングの制約が増している。
本稿では、LangChainのDeepageants(電池を含む)、Earendilのpi(ラジカル最小主義)、DeepSeekのdsh(すべてのもの)の3つのオープンコーディングエージェントハーネスについて、ソースレベル、マルチケースで検討する。
それぞれがピン留めされたコミットとコミット履歴を読んで、成熟した2つのハーネスが反対方向に移動しているのがわかりました(deepagents subtracting authored scaffolding, pi accreting durable Infrastructure)。
第3のハーネスはその後、ホールドアウトチェックとして読み上げられ、全5つを示し、1つのシームは別の実装をそのまま再利用する。
したがって、我々は独立発明を主張しておらず、コンバージェンスを並列発見、拡散、リテラル再利用に分解する。
最後に、ある負荷を持つ次元は収束せず、実際に存在しない:外部の検証可能性、外部のパーティがランタイムを信頼せずにチェックできる暗黙のレコード。
我々は、この欠如を監視対象ではなく、予測的ギャップとして、証明に敏感なドメインを活用できる次の軸が異なると見ている。
関連論文リスト
- Agentic Cloud Decoys: A Deception-Driven Framework for Autonomous Intrusion Investigation [0.0]
我々は,高忠実度クラウドデコイと自律言語モデルエージェントを組み合わせたフレームワークであるCloud Decoy AI Agentを紹介する。
調査単位はイベントではなくセッションであり、セッションキーは、ID階層化された認証情報の導入によって隠蔽される。
10のコントロールされたAWS S3シナリオで、9つの完全に再構築され、観測されたアーティファクトに追跡不可能なアサーションを含むレポートはなく、レイテンシは4分から5分でした。
論文 参考訳(メタデータ) (2026-07-27T05:05:57Z) - MIRAGE: Mobile Agents with Implicit Reasoning and Generative World Models [53.09772037247959]
可視テキスト推論トレースから連続潜時推論表現を学習するフレームワークであるMIRAGEを紹介する。
AndroidWorldでは、MIRAGEは4Bアブレーションで監督された微調整を3~5倍の低い復号化予算と一致している。
AndroidControlでは、75%以上のトークンを生成しながらアクショングラウンドを改善する。
論文 参考訳(メタデータ) (2026-06-03T09:01:24Z) - Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report Generation [74.0621258662676]
レポート生成のためのマルチエージェントハーネスであるPtahを提案する。
Ptahは計画、研究、執筆段階を通じて、ユーザクエリからレンダリングされたWebレポートまでのライフサイクルを編成する。
検証エージェントがハーネスの受け入れ機能として機能し、ワークフロー全体を通して事実的接地、引用の忠実性、相互の整合性を強制する。
論文 参考訳(メタデータ) (2026-05-28T12:40:34Z) - Code as Agent Harness [107.31925305395957]
新興のエージェントシステムでは、コードはもはや単なる目標出力ではない。
コードはエージェントの推論、行動、環境モデリング、実行ベースの検証のための運用上の基盤としてますます役立っている。
この調査は、実行可能、検証可能、ステートフルなAIエージェントシステムに向けた統一されたロードマップを提供する。
論文 参考訳(メタデータ) (2026-05-18T17:59:03Z) - Agent-BRACE: Decoupling Beliefs from Actions in Long-Horizon Tasks via Verbalized State Uncertainty [70.43119366710778]
本稿では,Agens-BRACE: Agent Belief state Representation by Abstraction and Confidence Estimationを紹介する。
LLMエージェントを信頼状態モデルと政策モデルに分離し、強化学習を通じて協調的に最適化する手法である。
長期にわたる部分的に観察可能な言語環境において、平均して+14.5%の絶対的な改善を実現している。
論文 参考訳(メタデータ) (2026-05-12T02:37:04Z) - The Bystander Effect in Multi-Agent Reasoning: Quantifying Cognitive Loafing in Collaborative Interactions [6.357772907811544]
我々は3つのデータセットコンテキストにまたがる22,500の決定論的軌跡を,3つの最先端(SOTA)モデルで評価した。
我々はtextitSovereignty Gap を形式化する:モデルはしばしば正しい導出を内部で計算するが、アライメント幻覚に苦しむ」。
我々は,マルチエージェントの社会的負荷が厳密に非可換であることを証明し,リード・アンカーの監査役の「ブランド」アイデンティティは群集の整合性を不当に判断する。
論文 参考訳(メタデータ) (2026-05-11T15:13:01Z) - The Last Human-Written Paper: Agent-Native Research Artifacts [106.47848184955576]
本稿では,物語紙を機械処理可能な研究パッケージに置き換えるプロトコルであるAgent-Native Research Artifact(ARA)を紹介する。
通常の開発において決定と終了をキャプチャするLive Research Manager、レガシPDFとリポジトリをARAに変換するARAコンパイラ、人間レビュアーが重要性、ノベルティ、味にフォーカスできるように客観的チェックを自動化するARAネイティブレビューシステムである。
論文 参考訳(メタデータ) (2026-04-27T16:23:09Z) - Theory of Code Space: Do Code Agents Understand Software Architecture? [0.0]
コードエージェントは、分離されたタスクで優れているが、アーキテクチャの理解を必要とするマルチファイルソフトウェアエンジニアリングと苦労する。
エージェントがAI探索中に一貫性のあるアーキテクチャの信念を構築し、維持し、更新できるかどうかを評価するベンチマークである、コード空間の理論(ToCS)を紹介する。
論文 参考訳(メタデータ) (2026-02-28T11:40:17Z) - InfiAgent: An Infinite-Horizon Framework for General-Purpose Autonomous Agents [36.740230738304525]
InfiAgentは、タスクの持続時間に関係なく、エージェントの推論コンテキストを厳密に拘束する。
20Bのオープンソースモデルを持つInfiAgentは、より大きなプロプライエタリなシステムと競合する。
論文 参考訳(メタデータ) (2026-01-06T17:35:57Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。