論文の概要: Towards the Harness of Embodied Agents
- arxiv url: http://arxiv.org/abs/2608.11246v1
- Date: Mon, 03 Aug 2026 09:19:38 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-13 19:07:54.303394
- Title: Towards the Harness of Embodied Agents
- Title(参考訳): 炭水化物の有害性にむけて
- Abstract要約: 本稿では,エージェントループがロボット機能を調整するハーネスであるTheaを紹介する。
我々は、同じパラダイムが、物理的世界のエンボディエージェントに拡張されるかどうかを問う。
- 参考スコア(独自算出の注目度): 14.617716781947488
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: The success of coding agents has established the harness as a paradigm: what an agent achieves depends not on the model alone, but on the infrastructure around it. We ask whether the same paradigm extends to embodied agents in the physical world. We present Thea, a harness in which an agentic loop orchestrates robot capabilities, each wrapped as a callable tool. It inherits the core components of coding agents, modified as the physical world requires. The world, however, withholds two abilities that software grants for free: reading the state of the world, and judging the outcome of an action. To bridge these gaps, Thea introduces Scene Graph as Context, a persistent, symbolic representation of the world, and Evaluation as Exit Codes, which detects when an action should terminate, judges whether it succeeded, and on failure diagnoses the cause. Together they close the loop between the agent and the physical world. Rich behaviors then emerge from the composition of tools, and the closed loop carries long-horizon tasks to completion in real environments.
- Abstract(参考訳): コーディングエージェントの成功は、ハーネスをパラダイムとして確立した: エージェントが達成するものは、モデルだけでなく、その周りのインフラストラクチャにも依存する。
我々は、同じパラダイムが、物理的世界のエンボディエージェントに拡張されるかどうかを問う。
本稿では,エージェントループがロボット機能を調整するハーネスであるTheaを,それぞれが呼び出し可能なツールとしてラップする。
物理世界が必要とするように修正されたコーディングエージェントのコアコンポーネントを継承する。
しかし、世界は、ソフトウェアが無償で許す2つの能力、すなわち世界の状態を読み、行動の結果を判断する能力を無視している。
これらのギャップを埋めるために、Thea氏はScene GraphをContextとして導入した。これは世界の永続的で象徴的な表現であり、Exit Codesとしての評価は、アクションがいつ終了するかを検出し、成功したかどうかを判断し、原因を診断する。
エージェントと物理世界の間のループを閉じる。
リッチな振る舞いはツールの構成から生まれ、クローズドループは実際の環境での長い水平なタスクを完了させる。
関連論文リスト
- The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses [0.0]
本稿では、意図的に反対する哲学から構築された3つのオープンコーディングエージェントハーネスについて、ソースレベルのマルチケーススタディを提案する。
2つの成熟したハーネスは反対方向に移動したが、5つの繰り返し要素の1つのアーキテクチャの中間形態に向かって収束していることがわかった。
第3のハーネスはその後、ホールドアウトチェックとして読み上げられ、全5つを示し、1つのシームは別の実装をそのまま再利用する。
論文 参考訳(メタデータ) (2026-08-25T01:26:41Z) - DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations [106.74348504930124]
本稿では,階層的な分類を基盤とした決定論的に検証可能な評価フレームワークであるDocOpsを紹介する。
DocOpsに基づいて,各種エージェントハーネスのクローズドおよびオープンソースモデルを体系的に評価する。
我々の研究は、グローバルな文書整合性を維持するためのエージェントの能力境界を明らかにし、堅牢で非破壊的なエージェントの将来の設計に光を当てている。
論文 参考訳(メタデータ) (2026-07-22T07:52:59Z) - LOGOS: A Living Logic for AI Agent Teams That Evolve With Humans [7.013794773659423]
ロゴは自己進化とガバナンスのためのプラグイン可能なレイヤです。
エージェント、ツール、知識、テスト、パーミッション、ポリシーを含むバージョン管理されたエージェントパックに、マルチモーダル入力をコンパイルする。
操作中は、エージェントアクティビティをポータブルで監査可能なイベントトレースに変換する。
論文 参考訳(メタデータ) (2026-07-12T18:46:42Z) - Critique of Agent Model [6.669064478699597]
我々は、本質的な機関がこれらの構造をシステム自体に組み込む必要があると論じている。
汎用エージェントモデルのためのゴール・アイデンティティ・コンフィグレータ(GIC)アーキテクチャを提案する。
論文 参考訳(メタデータ) (2026-06-22T22:50:02Z) - What makes a harness a harness: necessary and sufficient conditions for an agent harness [0.0]
エージェントハーネスという用語は、生成人工知能を用いたソフトウェア工学において広く流通している。
本稿では,エージェントハーネスとなるシステムに必要な,十分な条件を記述した定義を提案する。
この貢献はエージェントハーネスの運用定義であり、共通語彙を持ち、エンジニアリングの実践を導くことができる。
論文 参考訳(メタデータ) (2026-06-08T19:35:37Z) - Code as Agent Harness [107.31925305395957]
新興のエージェントシステムでは、コードはもはや単なる目標出力ではない。
コードはエージェントの推論、行動、環境モデリング、実行ベースの検証のための運用上の基盤としてますます役立っている。
この調査は、実行可能、検証可能、ステートフルなAIエージェントシステムに向けた統一されたロードマップを提供する。
論文 参考訳(メタデータ) (2026-05-18T17:59:03Z) - Some[Body] Must Receive That Pain for Agent Accountability [1.5755923640031846]
AIエージェントは、現実の世界において、次々と行動する。
継続するエージェントは、将来の振る舞いを変える方法で結果を受け取りません。
このようなアーキテクチャが存在するまで、高度なAIデプロイメントは、説明可能な人間のプリンシパルと結びついなければならない。
論文 参考訳(メタデータ) (2026-05-16T08:24:06Z) - How to Interpret Agent Behavior [56.59836196946289]
本稿では,エージェントの動作を実行時に記述・解析するための分類法であるACT*ONOMYを紹介する。
共用語彙を提供することで、ACT*ONOMYは研究者、エージェントデザイナー、エンドユーザーがエージェントの振る舞いをより一貫して解釈するのに役立つ。
論文 参考訳(メタデータ) (2026-05-13T14:52:40Z) - WorldLens: Full-Spectrum Evaluations of Driving World Models in Real World [100.68103378427567]
エージェントは現実的な4D駆動環境を合成し、説得力があるように見えるが、物理的または行動的に失敗することが多い。
モデルがどのように構築され、理解され、その生成された世界の中でどのように振る舞うかを評価するフルスペクトルベンチマークであるWorldLensを紹介します。
さらに、数値的なスコアとテキストの合理性を備えた人間の注釈付きビデオの大規模データセット WorldLens-26K を構築し、WorldLens-Agent を開発した。
論文 参考訳(メタデータ) (2025-12-11T18:59:58Z) - Gödel Agent: A Self-Referential Agent Framework for Recursive Self-Improvement [112.04307762405669]
G"odel AgentはG"odelマシンにインスパイアされた自己進化型フレームワークである。
G"odel Agentは、パフォーマンス、効率、一般化性において手作業によるエージェントを上回る、継続的な自己改善を実現することができる。
論文 参考訳(メタデータ) (2024-10-06T10:49:40Z) - On the Use and Misuse of Absorbing States in Multi-agent Reinforcement
Learning [55.95253619768565]
現在のMARLアルゴリズムは、実験を通してグループ内のエージェントの数が固定されていると仮定している。
多くの実践的な問題において、エージェントはチームメイトの前に終了する可能性がある。
本稿では,吸収状態を持つ完全連結層ではなく,注意を用いた既存の最先端MARLアルゴリズムのアーキテクチャを提案する。
論文 参考訳(メタデータ) (2021-11-10T23:45:08Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。