論文の概要: ES-Trace: Auditing Ethical-Sourcing Disclosure of Code Generation Models Beyond Model Cards
- arxiv url: http://arxiv.org/abs/2610.07762v1
- Date: Tue, 06 Oct 2026 04:58:59 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-08 02:58:29.817906
- Title: ES-Trace: Auditing Ethical-Sourcing Disclosure of Code Generation Models Beyond Model Cards
- Title(参考訳): ES-Trace: モデルカードを越えたコード生成モデルの倫理的調査
- Abstract要約: 倫理的開示監査のためのフレームワークであるES-Traceを紹介する。
77のドキュメントと20のES-CodeGen側面にわたる10のパブリッシャから26のモデルにES-Traceを適用します。
- 参考スコア(独自算出の注目度): 6.664505682266256
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Code generation models have been increasingly used in software development, but their development raises ethical-sourcing concerns involving intellectual property, privacy, fairness, labour practices, and environmental impact. Although prior work has defined ethical-sourcing criteria for code generation, it remains unclear how much evidence existing models disclose and where that evidence can be found. We introduce ES-Trace, a framework for ethical-sourcing disclosure audits that traces disclosed evidence beyond model cards using the Model Documentation Traceability Graph (MDTG), which represents relationships among models, versions, and documentation artifacts. We apply ES-Trace to 26 models from 10 publishers across 77 documents and 20 ES-CodeGen aspects. Model-card-only auditing yields a mean score of 1.77/5, while resolving the declared references increases it to 2.82/5, with most of the increase arising from documents that the publisher declares in structured metadata. The key findings of our study include: (1) social and labour-related aspects remain poorly documented, even when expanding the audit to the full documentation scope, (2) resolving documentation references substantially increases observed disclosure, raising the mean score from 1.77/5 to 2.82/5, (3) model-card-only audits can mischaracterize release-level disclosure changes, and (4) documentation mismatches can associate evidence with the wrong model or version, highlighting the need for explicit model--version binding and consistency across documentation artifacts. Our study calls for reference-aware ethical-sourcing disclosure audits, explicit model--version binding and consistency across documentation artifacts, and stronger documentation of currently underreported social and labour-related aspects.
- Abstract(参考訳): コード生成モデルはソフトウェア開発でますます使われているが、その開発は知的財産権、プライバシー、公正性、労働慣行、環境への影響に関する倫理的な懸念を提起している。
以前の作業では、コード生成の倫理的ソーシング基準を定義していたが、既存のモデルがどの程度の証拠を開示し、どこでその証拠が見つかるかは定かではない。
モデルドキュメンテーショントレーサビリティグラフ(MDTG)を用いて,モデルカード以外の証拠をトレースする倫理的開示監査のためのフレームワークであるES-Traceを紹介した。
77のドキュメントと20のES-CodeGen側面にわたる10のパブリッシャから26のモデルにES-Traceを適用します。
モデルカードのみの監査では平均スコアが1.77/5となり、宣言された参照の解決は2.82/5に増加する。
本研究の主な成果は,(1) 監査を全文書範囲に拡大しても,社会的・労働的側面が不十分なままであり,(2) 資料参照の解決は,観察された開示を著しく増加させ,平均スコアを1.77/5から2.82/5に引き上げること,(3) モデルカードのみの監査がリリースレベルの開示変更を誤認すること,(4) 資料ミスマッチは,証拠を間違ったモデルやバージョンに関連付けること,ドキュメントアーティファクト間の明示的なモデル変換バインディングや一貫性の必要性を強調すること,などである。
本研究は、参照型倫理的情報開示監査、明示的なモデル-バージョンバインディング、ドキュメントアーティファクト間の整合性、そして、現在報告されていない社会的・労働的側面の文書化を訴える。
関連論文リスト
- A Large-Scale Measurement of AI Bill of Materials Completeness in Hugging Face Models [0.2230291569252836]
事前トレーニングされた機械学習(ML)モデルは、開発者がスクラッチからモデルをトレーニングせずにML集約型のソフトウェアシステムを構築するのに役立つ。
モデルリポジトリは、モデル証明、ライセンス、データセット、制限、外部参照に関する不完全なマシン可読なドキュメントを提供することが多い。
本稿では,AIBOMの完全性について実験的に検討し,レポジトリがAIBOM関連情報を機械可読型AIサプライチェーンドキュメンテーションに提供する範囲として定義する。
論文 参考訳(メタデータ) (2026-07-19T13:20:09Z) - Reverse Engineering Compliance: A Dual-Graph Verification Framework for Auditing Legacy IT Security Concepts [0.0]
本稿では,自動セキュリティ概念構造抽出と逆トポロジチェック(ASSERT)フレームワークを提案する。
これは、オントロジーに基づくレガシー文書の形式文書グラフへの抽出、検証済み参照グラフに対する5クラスグラフの差、スキーマ値OSCAL出力へのエクスポートによるギャップに対処する。
評価の結果,ASSERTは文書内構造の不整合を計測できるが,文書化されていないエンティティの発見とスキーマの強制との間にはトレードオフがあることがわかった。
論文 参考訳(メタデータ) (2026-07-09T09:35:58Z) - Making AI-Assisted Grant Evaluation Auditable without Exposing the Model [0.0]
本稿では,遠隔検定による要求の整合を支援するTEEアーキテクチャを提案する。
このアーキテクチャにより、外部検証者はどのモデル、ルーブリック、プロンプトテンプレート、入力表現が使われたかをチェックすることができる。
我々は、秘密のAI推論、証明可能なAI監査、ゼロ知識機械学習、アルゴリズムのアカウンタビリティ、AI支援ピアレビューに対する設計を位置付ける。
論文 参考訳(メタデータ) (2026-04-28T04:10:04Z) - SpecEval: Evaluating Model Adherence to Behavior Specifications [63.13000010340958]
提供者仕様に対してモデルを監査する自動化フレームワークを導入します。
私たちの中心となる焦点は、プロバイダ仕様とモデルアウトプット、および審査員としての自身のモデルの間の3つの方法の整合性にあります。
当社のフレームワークは、100以上の行動ステートメントにわたる6人の開発者から16のモデルに適用し、プロバイダ間で最大20%のコンプライアンスギャップを含む、体系的な不整合を見つけました。
論文 参考訳(メタデータ) (2025-09-02T16:18:40Z) - Structured Legal Document Generation in India: A Model-Agnostic Wrapper Approach with VidhikDastaavej [5.790242888372048]
以下に、VidhikDastaavejを紹介します。
NyayaShilpは、インドの法律文書に特化された微調整の法的文書生成モデルである。
論文 参考訳(メタデータ) (2025-04-04T14:41:50Z) - GEGA: Graph Convolutional Networks and Evidence Retrieval Guided Attention for Enhanced Document-level Relation Extraction [15.246183329778656]
ドキュメントレベルの関係抽出(DocRE)は、構造化されていない文書テキストからエンティティ間の関係を抽出することを目的としている。
これらの課題を克服するために,DocREの新しいモデルであるGEGAを提案する。
我々は、広く使用されている3つのベンチマークデータセット、DocRED、Re-DocRED、Revisit-DocREDでGEGAモデルを評価する。
論文 参考訳(メタデータ) (2024-07-31T07:15:33Z) - Efficient Document Ranking with Learnable Late Interactions [73.41976017860006]
クロスエンコーダ(CE)とデュアルエンコーダ(DE)モデルは,情報検索におけるクエリドキュメント関連性の2つの基本的なアプローチである。
関連性を予測するため、CEモデルは共同クエリドキュメントの埋め込みを使用し、DEモデルは分解クエリとドキュメントの埋め込みを維持している。
近年、DEM構造と軽量スコアラを用いて、より好ましいレイテンシ品質のトレードオフを実現するために、遅延相互作用モデルが提案されている。
論文 参考訳(メタデータ) (2024-06-25T22:50:48Z) - Continual Learning for Generative Retrieval over Dynamic Corpora [115.79012933205756]
生成検索(GR)はパラメトリックモデルに基づいて関連文書の識別子(ドシデクス)を直接予測する。
クエリに応答する能力を保ちながら、新しいドキュメントをインクリメンタルにインデックスする能力は、GRモデルを適用する上で不可欠である。
我々は,CLEVERモデルのための新しい連続学習モデルを提案し,GRのための連続学習に2つの大きな貢献をした。
論文 参考訳(メタデータ) (2023-08-29T01:46:06Z) - Document-Level Relation Extraction with Sentences Importance Estimation
and Focusing [52.069206266557266]
文書レベルの関係抽出(DocRE)は、複数の文の文書から2つのエンティティ間の関係を決定することを目的としている。
我々はDocREのための文重要度スコアと文集中損失を設計するSIEF(Sentence Estimation and Focusing)フレームワークを提案する。
2つのドメインの実験結果から、SIEFは全体的なパフォーマンスを改善するだけでなく、DocREモデルをより堅牢にします。
論文 参考訳(メタデータ) (2022-04-27T03:20:07Z) - Does Recommend-Revise Produce Reliable Annotations? An Analysis on
Missing Instances in DocRED [60.39125850987604]
テキスト修正方式は, 偽陰性サンプルと, 人気エンティティや関係性に対する明らかな偏見をもたらすことを示す。
より信頼性の高いドキュメントREモデルのテストセットとして機能するように、relabeledデータセットがリリースされている。
論文 参考訳(メタデータ) (2022-04-17T11:29:01Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。