論文の概要: CRAFT: An Agentic Spreadsheet Form Filling System with Template Awareness
- arxiv url: http://arxiv.org/abs/2610.04437v1
- Date: Sat, 03 Oct 2026 10:56:50 GMT
- ステータス: 情報取得中
- システム内更新日: 2026-10-06 21:06:04.68086
- Title: CRAFT: An Agentic Spreadsheet Form Filling System with Template Awareness
- Title(参考訳): CRAFT:テンプレート認識型エージェントスプレッドシートフォームフィリングシステム
- Abstract要約: CRAFTは、リフレクティブバリデーションと制約のある局所的な修復を接続するテンプレート対応エージェントフレームワークである。
Instruction-OnlyとMulti-Fileのトラックに327のフォームがあるFormFillBenchを紹介します。
- 参考スコア(独自算出の注目度): 14.349693945055675
- License:
- Abstract: Spreadsheet form filling requires agents to consolidate external evidence, ground values to precise cells, and preserve irregular template structure. Errors in early edits can overwrite labels or misalign fields, undermining later decisions. We propose CRAFT, a template-aware agent framework that connects reflective validation to constrained local repair. Instead of treating reflection as a free-form request to regenerate the workbook, CRAFT grounds detected errors to spreadsheet regions, restores corrupted template state when necessary, and re-grounds plausible writable slots before subsequent edits. A Rectangle-Aware Slot Grounder (RASG) proposes writable cells, while label-slot hints and protected regions constrain subsequent edits. We introduce FormFillBench, with 327 forms across Instruction-Only and Multi-File tracks. Compared with the strongest baselines, CRAFT improves pair accuracy by 8.51 and 23.38 percentage points on these tracks, respectively. Component-removal experiments support structural adjudication and slot re-grounding within the pipeline, and the framework retains its relative advantage among the methods evaluated with a second backbone. The code and benchmark FormFillBench are available at https://github.com/Glllllly/CRAFT.
- Abstract(参考訳): スプレッドシートのフォームフィリングには、外部のエビデンス、正確な細胞への基底値、不規則なテンプレート構造を保存するためのエージェントが必要である。
早期編集のエラーはラベルや誤ったフィールドを上書きし、後の決定を損なう。
CRAFTは,反射的検証と局所的修復の制約を結合するテンプレート対応のエージェントフレームワークである。
リフレクションをワークブックを再生するためのフリーフォーム要求として扱う代わりに、CRAFTは検出したエラーをスプレッドシート領域に接地し、必要に応じてテンプレート状態を復元し、その後編集する前に可読性のあるスロットを再配置する。
Rectangle-Aware Slot Grounder (RASG)は、ラベルスロットのヒントと保護された領域がその後の編集を制限している間に、不安定な細胞を提案する。
Instruction-OnlyとMulti-Fileのトラックに327のフォームがあるFormFillBenchを紹介します。
最強のベースラインと比較すると、CRAFTはそれぞれのトラックのペア精度を8.51ポイント、23.38ポイント改善している。
コンポーネント除去実験は、パイプライン内の構造的適応とスロット再接地をサポートし、第2のバックボーンで評価された手法間の相対的な優位性を維持している。
FormFillBenchのコードとベンチマークはhttps://github.com/Glllllly/CRAFTで公開されている。
関連論文リスト
- Live Architecture Models for Cloud-Native Architecture-as-Code: Early Results from Kubernetes Conformance Checking [0.0]
インフラストラクチャドリフトは、実行中のランタイムシステムを、ドキュメント化されたアーキテクチャ意図から分離することができる。
本稿では,選択された事実に関連付けられた編集可能な表現を,明示的な対応と反復的な適合性チェックを通じて,ライブアーキテクチャモデルについて検討する。
このアプローチは、KDL(Deployment Language)のArcher固有のサブセットと、テキストビューを備えたVS CodeプロトタイプであるArcherを通じてインスタンス化される。
論文 参考訳(メタデータ) (2026-09-28T19:21:42Z) - Q&A on Any Spreadsheet Requires Interpreting Its Grid Structure [0.0]
本稿では,任意のスプレッドシートをセルロールアノテーションを用いて解釈可能なチャンクに分割する新しいフレームワークを提案する。
我々は,スプレッドシートからLLMへのボトルネックに対処するには,個別の細胞分類を超えて移動する必要があることを示す。
論文 参考訳(メタデータ) (2026-09-17T17:22:43Z) - Independent Patch Verification for Coding Agents with a Bidirectional Reconstruct-and-Verify Framework [49.16055123488827]
大規模言語モデルを利用したコーディングエージェントは、バグレポートから直接コードパッチを生成することができる。
報告された問題を真に解決するかどうかを独立に検証するメカニズムは存在しない。
本稿では,RETRACE をトレーニング不要なポストジェネレーション検証フレームワークとして提案する。
論文 参考訳(メタデータ) (2026-08-09T22:59:13Z) - Right Reset: Chunking by Prefix Removal [0.0]
右隠れ状態軌跡の保存を計測する右リセットを導入する。
平らなテキストでは、RRはオリジナルのレコードの47.7%をクリーン単位として回収し、BGE埋め込み境界は25.9%である。
6つの言語モデル全体で、RR選択されたカットは、未選択の候補エッジよりも局所的な出力破壊が一貫して少ない。
論文 参考訳(メタデータ) (2026-08-05T01:17:12Z) - ChartLens: A Dual-Branch Framework for Chart Data Correction and Factual Summary Refinement [55.77198392899527]
データMFMチャレンジトラック2:チャート理解のためのチャンピオンソリューションを提示する。
このトラックは、構造化されたチャートデータを復元し、チャート画像から忠実な自然言語要約を生成するモデルを必要とする。
グラフデータの修正と要約を行うための二分岐フレームワークであるChartLensを提案する。
論文 参考訳(メタデータ) (2026-06-09T09:45:01Z) - Reading the Finetuning Prior: Verbatim Content Recovery via Contrastive Decoding Diffing [1.9599274203282298]
Contrastive Decoding Diffing (CDD) は、出力レベルのロジット分布のみを演算し、ウェイトアクセスがなく、層選択がなく、モデルごとのチューニングもできないモデル拡散法である。
単一のデフォルト設定は、4つのアーキテクチャにまたがって組み込まれた事実を冗長に復元する。
我々は、実際のドメインの微調整設定を検証し、単一データセット以外のすべてのCoT変種に対してほぼ完全な回復を実現し、混合データセット設定で4つのデータセット全てを正しく識別する。
論文 参考訳(メタデータ) (2026-05-25T14:29:36Z) - From Hallucination to Structure Snowballing: The Alignment Tax of Constrained Decoding in LLM Reflection [0.0]
「大型言語モデル(LLM)における固有の自己補正は、幻覚雪球によるオープンエンド推論タスクでしばしば失敗する」
本研究は,制約付き復号法により構造的反射を純粋に強制することが,追加の訓練を伴わずに誤りの伝播を阻害するかどうかを考察する。
論文 参考訳(メタデータ) (2026-04-07T16:47:37Z) - TRivia: Self-supervised Fine-tuning of Vision-Language Models for Table Recognition [54.85932472676512]
テーブル認識(TR)は、テーブルイメージをHTMLやマークダウンなどの半構造化表現に変換することを目的としている。
我々は、事前学習された視覚言語モデルで、ラベルのないテーブルイメージから直接TRを学習できる自己教師型微調整手法であるTRiviaを紹介する。
我々は,既存のシステムを超越した,オープンソースでコンパクトで最先端のTRモデルであるTRivia-3Bを提案する。
論文 参考訳(メタデータ) (2025-12-01T03:49:00Z) - MonkeyOCR v1.5 Technical Report: Unlocking Robust Document Parsing for Complex Patterns [80.05126590825121]
MonkeyOCR v1.5は、レイアウト理解とコンテンツ認識の両方を強化する統合ビジョン言語フレームワークである。
複雑なテーブル構造に対処するために,視覚的整合性に基づく強化学習手法を提案する。
2つの特別なモジュール、Image-Decoupled Table ParsingとType-Guided Table Mergingを導入し、テーブルの信頼性の高いパースを可能にする。
論文 参考訳(メタデータ) (2025-11-13T15:12:17Z) - RDU: A Region-based Approach to Form-style Document Understanding [69.29541701576858]
キー情報抽出(KIE)は,フォーム形式の文書から構造化された情報を抽出することを目的としている。
我々は、Rerea-based Understanding Document (RDU) と呼ばれる新しいKIEモデルを開発する。
RDUは文書のテキスト内容と対応する座標を入力として、バウンディングボックスのような領域をローカライズして結果を予測しようとする。
論文 参考訳(メタデータ) (2022-06-14T14:47:48Z) - Does Recommend-Revise Produce Reliable Annotations? An Analysis on
Missing Instances in DocRED [60.39125850987604]
テキスト修正方式は, 偽陰性サンプルと, 人気エンティティや関係性に対する明らかな偏見をもたらすことを示す。
より信頼性の高いドキュメントREモデルのテストセットとして機能するように、relabeledデータセットがリリースされている。
論文 参考訳(メタデータ) (2022-04-17T11:29:01Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。