論文の概要: ATLAS-RTC: Closing the Loop on LLM Agent Output with Token-Level Runtime Control
- arxiv url: http://arxiv.org/abs/2603.27905v2
- Date: Mon, 06 Apr 2026 02:52:33 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-07 15:49:18.432008
- Title: ATLAS-RTC: Closing the Loop on LLM Agent Output with Token-Level Runtime Control
- Title(参考訳): ATLAS-RTC:Token-Levelランタイム制御によるLLMエージェント出力のループのクローズ
- Abstract要約: ATLAS-RTCは自動回帰言語モデルのためのランタイム制御システムで、デコード時に構造化出力を強制する。
各ステップで生成を監視し、軽量信号を使用して出力コントラクトからのドリフトを検出し、バイアス、マスキング、ロールバックといったターゲットの介入を適用する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We present ATLAS-RTC, a runtime control system for autoregressive language models that enforces structured output during decoding. ATLAS-RTC monitors generation at each step, detects drift from output contracts using lightweight signals, and applies targeted interventions such as biasing, masking, and rollback. Unlike post-hoc validation or static constrained decoding, it operates in a closed loop, enabling correction before errors materialize. Across structured generation and tool-calling tasks, ATLAS-RTC improves first-attempt success rates by 20 to 37.8 percentage points, with up to 88% latency reduction in failure-dominated settings. Results show that many failures arise from decoding artifacts rather than task misunderstanding, motivating runtime control as a distinct layer in LLM systems.
- Abstract(参考訳): 本稿では,自己回帰型言語モデルのためのランタイム制御システムATLAS-RTCについて述べる。
ATLAS-RTCは各ステップで生成を監視し、軽量信号を使用して出力コントラクトからのドリフトを検出し、バイアス、マスキング、ロールバックなどのターゲットの介入を適用する。
ポストホック検証や静的制約付きデコーディングとは異なり、クローズドループで動作し、エラーが発生する前に修正を可能にする。
構造化された生成タスクとツールコールタスク全体で、ATLAS-RTCは初回成功率を20から37.8ポイント改善し、失敗に支配された設定では最大88%のレイテンシ低減を実現している。
結果から,LLMシステムにおいて,実行時制御を異なる層として動機づける作業ミスではなく,成果物の復号化による失敗が多かったことが示唆された。
関連論文リスト
- LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior [53.63441578662801]
インタクタは、検出された属性自身だけでなく、LLM使用率や出力品質などの下流メトリクスを操縦する介入として動作する。
我々は,LLMの使用量を戦略的に選択し,コンテンツ後処理によって検出された属性を減らし,その特性を定量的に把握するスタイリングモデルを開発した。
検出された属性を低減しても出力品質は向上するが,LDM検出器を導入することで,ユーザは低品質の出力が得られる。
論文 参考訳(メタデータ) (2026-07-21T17:11:02Z) - From Open Loop to Closed Loop: A Test-Time Iterative Optimization Framework for Reference-Consistent Image Generation [108.02425846269234]
制御可能な画像生成は、視覚的参照条件を組み込むことで、大きな進歩を遂げた。
既存の方法は、主にオープンループシステムとして動作する。
本稿では,閉ループ動的トラッキング問題として参照一貫性生成を再構成する新しいテスト時間反復最適化フレームワークを提案する。
論文 参考訳(メタデータ) (2026-07-06T05:36:30Z) - StepFinder: A Temporal Semantic Framework for Failure Attribution in Multi-Agent Systems [11.500948775496218]
失敗帰属(Failure Attribution)は、障害の原因となる根本原因のステップを自動的に特定することを目的としたタスクである。
既存のフェール帰属法は主に、元の実行軌跡を推論するためにLLMに依存している。
我々は、軽量な障害属性フレームワークであるStepFinderを提案する。
論文 参考訳(メタデータ) (2026-06-02T10:45:49Z) - COBALT-TLA: A Neuro-Symbolic Verification Loop for Cross-Chain Bridge Vulnerability Discovery [0.0]
COBALT-TLAは、TLC(TLA+モデルチェッカー)とLCMをペアリングする神経象徴的検証ループである。
我々は,Nomad $190Mエクスプロイトの忠実なモデルを含む,3つのクロスチェーンブリッジターゲットに対してシステムを評価する。
論文 参考訳(メタデータ) (2026-04-14T00:56:58Z) - Prism: Efficient Test-Time Scaling via Hierarchical Search and Self-Verification for Discrete Diffusion Language Models [96.0074341403456]
LLM推論を改善するための実用的な方法として、推論時計算が再導入されている。
テスト時間スケーリング(TTS)アルゴリズムの多くは、自動回帰デコーディングに依存している。
そこで我々は,dLLM のための効率的な TTS フレームワーク Prism を提案する。
論文 参考訳(メタデータ) (2026-02-02T09:14:51Z) - Early Fault Detection on CMAPSS with Unsupervised LSTM Autoencoders [0.0]
本稿では, ラン・トゥ・フェイルラベルを必要としないターボファンエンジンの非監視型ヘルスモニタリングフレームワークを提案する。
第一に、NASA CMAPSSセンサーストリームの動作条件効果は回帰ベースの正規化によって除去される。
LSTM(Long Short-Term Memory)オートエンコーダは、各トラジェクトリの健全な部分にのみ訓練される。
論文 参考訳(メタデータ) (2026-01-15T10:38:14Z) - CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding [60.06899554269808]
サイクロンVLA(CycleVLA)は、VLA(Vision-Language-Action Model)を積極的に自己補正するシステムである。
CycleVLAは、重要なサブタスク遷移ポイントにフラグを付けるプログレス対応のVLAを統合することで、これを実現する。
大規模な実験により、CycleVLAは、よく訓練されたVLAと訓練されていないVLAの両方のパフォーマンスを改善することが示された。
論文 参考訳(メタデータ) (2026-01-05T17:31:01Z) - Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding [51.711605076319216]
拡散に基づく大規模言語モデル (Diffusion LLM) は、並列復号機能を持つ非自己回帰テキスト生成を約束している。
本稿では,双方向拡散モデルに適したブロック単位で近似したKVキャッシュ機構を提案する。
本稿では,信頼しきい値を超えるトークンを選択的に復号し,依存関係違反を軽減し,生成品質を維持できる信頼度対応並列復号方式を提案する。
論文 参考訳(メタデータ) (2025-05-28T17:39:15Z) - Code-as-Monitor: Constraint-aware Visual Programming for Reactive and Proactive Robotic Failure Detection [56.66677293607114]
オープンセットのリアクティブかつアクティブな障害検出のためのCode-as-Monitor(CaM)を提案する。
モニタリングの精度と効率を高めるために,制約関連エンティティを抽象化する制約要素を導入する。
実験により、CaMは28.7%高い成功率を達成し、厳しい乱れの下で実行時間を31.8%短縮することが示された。
論文 参考訳(メタデータ) (2024-12-05T18:58:27Z) - ROCODE: Integrating Backtracking Mechanism and Program Analysis in Large Language Models for Code Generation [31.363781211927947]
大規模言語モデル(LLM)は、コード生成において素晴らしいパフォーマンスを達成した。
LLMはコード生成時にエラーの蓄積に影響を受けやすい。
コード生成のためのLLMにバックトラック機構とプログラム解析を統合したROCODEを提案する。
論文 参考訳(メタデータ) (2024-11-11T16:39:13Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。