論文の概要: VERA-8B: Evidence-Grounded Audit Risk Reasoning from SEC Filings
- arxiv url: http://arxiv.org/abs/2608.28402v1
- Date: Fri, 28 Aug 2026 14:55:49 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-31 17:16:04.371472
- Title: VERA-8B: Evidence-Grounded Audit Risk Reasoning from SEC Filings
- Title(参考訳): VERA-8B:SECファイリングスによる監査リスクの証拠
- Authors: Menghan Liu, Elynn Chen,
- Abstract要約: 我々は,新しいエンド・ツー・エンド監査推論システムであるVERA-8Bを開発した。
VERA-8Bは、実施行動が起こる前に監査リスクを特定する。
SFTとGRPOをエビデンス・グラウンド・オーディエンス・アソシエーションで統合した最初の企業です。
- 参考スコア(独自算出の注目度): 0.6445605125467574
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Across audit applications, judgments must be supported by reasonable evidence. However, standard financial language models prioritize fluency over evidence. They are built for general financial reasoning and may produce plausible but ambiguous answers, creating a grounding gap that makes them unsuitable for audit work. We address this gap with VERA-8B, a new end-to-end audit reasoning system that identifies audit risks before enforcement actions occur. Constructing such a model raises several challenges, as no prior machine learning work targets pre-enforcement audit prediction. To our knowledge, we are the first to unify SFT and GRPO for evidence-grounded audit reasoning under one evidence standard, achieving performance that surpasses all evaluated baselines. Because auditing cannot tolerate unsupported claims, we introduce abstention and uncertainty qualification to defer uncertain or evidence-incomplete cases. Finally, we design an AuditBridge to ground model reasoning for practical audit work. It transforms raw filings into verified records and then into reviewer-ready reports, bridging finance and computation with broad generality. Together, these components produce auditable, review-ready outputs suitable for practical audit work.
- Abstract(参考訳): 監査申請全体を通じて、判断は合理的な証拠によって支持されなければならない。
しかし、標準的な金融モデルでは証拠よりも流布が優先される。
それらは一般的な金銭的推論のために構築され、妥当だがあいまいな答えを生み出す可能性があるため、監査作業には適さない基礎的なギャップを形成します。
我々はこのギャップを,執行行動が起こる前に監査リスクを識別する新しいエンドツーエンド監査推論システムVERA-8Bで解決する。
このようなモデルの構築にはいくつかの課題が伴う。
我々は,SFTとGRPOを1つのエビデンス基準の下で統一し,評価基準を超越した性能を達成するために,まずSFTとGRPOを統一した。
監査は不当な主張を容認できないため、不確実または証拠不完全な事例を延期するために、棄権と不確実な資格を導入する。
最後に,実践的な監査作業のための地上モデル推論のためのAuditBridgeを設計する。
生の書類を検証済みのレコードに変換し、その後レビュアー対応のレポートに変換し、財務をブリッジし、幅広い一般性で計算する。
これらのコンポーネントは、実用的な監査作業に適した、監査可能な、レビュー可能なアウトプットを生成する。
関連論文リスト
- IntelliAudit: Using Large Language Models to Evaluate Audit Controls [0.1759008116536278]
本稿では,IT監査エビデンス評価のための検索型マルチエージェントシステムIntelliAuditを提案する。
コントロールとエビデンスコーパスが与えられ、IntelliAuditは関連するアーティファクトを取得し、エビデンスに基づく評価を生成する。
専門家レビューと監査対応ユーザフィードバックを用いて,複数のシミュレーション組織を対象に評価を行った。
論文 参考訳(メタデータ) (2026-08-07T18:21:06Z) - From Trajectories to Evidence: Auditable Experimental Records for Industrial Research Agents [47.678562263387214]
研究エージェントは、産業レコメンデーション設定において、多段階の機械学習実験をますます実施している。
生成されたアーティファクトは、サポートされないか、不完全かもしれないし、実行されたラウンドは無効かもしれないし、あるいは廃止されるかもしれないし、後の修正は、以前の発見を曖昧にするかもしれない。
本稿では,連続的アーティファクトのバウンダリ検証と実行後のクレーム資格を結合するエビデンス・グラウンド・フレームワークを提案する。
論文 参考訳(メタデータ) (2026-08-05T13:37:38Z) - Fairness Auditing: Lower Bounds on Company Manipulation [4.867679624126028]
フェアネス監査は、雇用、貸与、自動意思決定といった高度なアプリケーションでますます義務付けられている。
最近の研究はブラックボックスフェアネス監査の基本的な不可能な結果を確立している。
有限監査資源の下では避けられない事後操作の程度を定量化する。
論文 参考訳(メタデータ) (2026-08-01T10:11:20Z) - Auditing the Audit: Five Failure Modes in Benchmark-Validity Audits [0.30586855806896046]
パイプライン障害を5つのクラスに分類し、安全ベンチマークとオープンウェイトなインストラクションチューニングモデルによる自己監査を行った。
我々は、ゲートを保証グレードの証拠の保持および開示のプロトコルとして位置づけ、古典的な構成正当性証拠を補足する(置き換えるものではない)。
論文 参考訳(メタデータ) (2026-07-01T05:30:07Z) - Preventing the Collapse of Peer Review Requires Verification-First AI [49.995126139461085]
我々は、真理結合、すなわち、過度に科学的真理をトラックする場所のスコアの厳密さを提案する。
プロキシ・ソブリン評価に向けた相転移を駆動する2つの力の形式化を行う。
論文 参考訳(メタデータ) (2026-01-23T17:17:32Z) - Robust ML Auditing using Prior Knowledge [3.513282443657269]
監査操作は、プラットフォームが故意に回答を変更して、他のユーザーに答えを変更することなく監査をパスした場合に発生する。
本稿では,プラットフォームが解決した課題に対する監査者の事前知識を考慮し,操作保護監査に対する新たなアプローチを提案する。
論文 参考訳(メタデータ) (2025-05-07T20:46:48Z) - From Transparency to Accountability and Back: A Discussion of Access and Evidence in AI Auditing [1.196505602609637]
監査は、デプロイ前のリスクアセスメント、進行中の監視、コンプライアンステストなど、さまざまな形式で実施することができる。
AI監査には、その実装を複雑にする多くの運用上の課題がある。
我々は、監査は自然な仮説テストとして、並列仮説テストと法的手続きを引き出すことができると論じ、このフレーミングは、監査実施に関する明確かつ解釈可能なガイダンスを提供すると論じる。
論文 参考訳(メタデータ) (2024-10-07T06:15:46Z) - The Decisive Power of Indecision: Low-Variance Risk-Limiting Audits and Election Contestation via Marginal Mark Recording [51.82772358241505]
リスクリミット監査(リスクリミット監査、RLA)は、大規模な選挙の結果を検証する技術である。
我々は、効率を改善し、統計力の進歩を提供する監査の新たなファミリーを定めている。
新しい監査は、複数の可能なマーク解釈を宣言できるように、キャストボイトレコードの標準概念を再考することで実現される。
論文 参考訳(メタデータ) (2024-02-09T16:23:54Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。