論文の概要: TRACTOR Benchmark for Evaluating C to Rust Translators
- arxiv url: http://arxiv.org/abs/2609.25121v1
- Date: Sun, 20 Sep 2026 14:28:05 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-23 18:04:04.040083
- Title: TRACTOR Benchmark for Evaluating C to Rust Translators
- Title(参考訳): CからRustへのトランスレータ評価のためのTRACTORベンチマーク
- Abstract要約: MITリンカーン研究所はプログラムの独立した試験と評価機関として機能している。
TRACTORプログラムは,大規模なCを安全でパフォーマンスが高く,メンテナンス可能なRustに変換する,スケーラブルなテクニックの開発を目指している。
- 参考スコア(独自算出の注目度): 4.640081926458296
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Memory-safety vulnerabilities remain a persistent source of security risk in critical software, much of which is implemented in memory-unsafe languages such as C and C++. Recent advances in programming languages, program analysis, and artificial intelligence have created new opportunities to modernize these legacy systems through automated translation to memory-safe languages such as Rust. The DARPA Translating All C to Rust (TRACTOR) program seeks to develop scalable techniques for translating large C codebases into safe, performant, and maintainable Rust. MIT Lincoln Laboratory serves as the program's independent test and evaluation organization and has developed a standardized benchmark for systematically assessing C-to-Rust translation tools. This report describes the TRACTOR benchmark, including progressively challenging test batteries and larger milestone projects, as well as the supporting evaluation infrastructure and metrics for assessing correctness, safety, idiomaticity, and performance. The benchmark and associated evaluation infrastructure are publicly available to support the broader development and evaluation of C-to-Rust translation technologies.
- Abstract(参考訳): メモリセーフティの脆弱性は、クリティカルソフトウェアにおけるセキュリティリスクの永続的な源であり、その多くはCやC++のようなメモリセーフでない言語で実装されている。
プログラミング言語、プログラム分析、人工知能の最近の進歩は、Rustのようなメモリセーフな言語への自動翻訳を通じて、レガシーシステムを近代化する新たな機会を生み出している。
DARPA Translating All C to Rust (TRACTOR)プログラムは、大規模なCコードベースを安全でパフォーマンスが高く、メンテナンス可能なRustに変換するスケーラブルなテクニックの開発を目指している。
MITリンカーン研究所は、プログラムの独立したテストおよび評価組織として機能し、C-to-Rust翻訳ツールを体系的に評価するための標準ベンチマークを開発した。
TRACTORベンチマークには、段階的に挑戦的なテストバッテリとより大きなマイルストーンプロジェクト、そして、正確性、安全性、慣用性、パフォーマンスを評価するためのサポートされた評価インフラストラクチャとメトリクスが含まれる。
ベンチマークと関連する評価インフラは、C-to-Rust翻訳技術のより広範な開発と評価をサポートするために公開されている。
関連論文リスト
- Code Quality Analysis of Translations from C to Rust [10.42011095909225]
C/C++は一般的なプログラミング言語である。しかしながら、メモリとスレッドセーフティの問題に悩まされている。
最近の研究で、Rustのようなより安全な言語へのC/C++の自動翻訳が検討されている。
本研究では、C2Rust(トランスパイラ)、C2SaferRust(LSM誘導トランスパイラ)、TranslationGymの3つのC-to-Rustトランスパイラの強度と弱点について検討する。
論文 参考訳(メタデータ) (2026-01-31T18:12:03Z) - A.S.E: A Repository-Level Benchmark for Evaluating Security in AI-Generated Code [49.009041488527544]
A.S.Eは、AI生成コードのセキュリティを評価するためのリポジトリレベルの評価ベンチマークである。
現在の大規模言語モデル(LLM)は、セキュアなコーディングに苦戦している。
大きな推論予算は、必ずしもより良いコード生成につながるとは限らない。
論文 参考訳(メタデータ) (2025-08-25T15:11:11Z) - CRUST-Bench: A Comprehensive Benchmark for C-to-safe-Rust Transpilation [51.18863297461463]
CRUST-Benchは100のCリポジトリのデータセットで、それぞれが安全なRustとテストケースで手書きのインターフェースとペアリングされている。
我々は、このタスクで最先端の大規模言語モデル(LLM)を評価し、安全で慣用的なRust生成が依然として難しい問題であることを確認した。
最高のパフォーマンスモデルであるOpenAI o1は、ワンショット設定で15タスクしか解決できない。
論文 参考訳(メタデータ) (2025-04-21T17:33:33Z) - Syzygy: Dual Code-Test C to (safe) Rust Translation using LLMs and Dynamic Analysis [8.361424157571468]
Syzygyは、C言語を安全なRustに変換する自動化アプローチである。
これは、Rustのコード翻訳を安全にする上で、これまでで最大の自動化およびテスト検証済みのCである。
論文 参考訳(メタデータ) (2024-12-18T18:55:46Z) - Translating C To Rust: Lessons from a User Study [12.49361031696427]
Rustは、未使用のCプログラムが楽しむことのない保証として、プログラムの完全なメモリ安全性を提供することを目指している。
我々は,現実世界のCプログラムをRustに変換するよう人間に求めるユーザスタディについて報告する。
私たちの参加者は安全なRust翻訳を作成できますが、最先端の自動ツールではそうできません。
論文 参考訳(メタデータ) (2024-11-21T14:37:05Z) - RustRepoTrans: Repository-level Code Translation Benchmark Targeting Rust [50.65321080814249]
RustRepoTransは、インクリメンタル翻訳をターゲットにした、最初のリポジトリレベルのコンテキストコード変換ベンチマークである。
複雑な翻訳シナリオの制約を評価するために, 7つの代表的なLLMを評価し, それらの誤差を分析した。
論文 参考訳(メタデータ) (2024-11-21T10:00:52Z) - Towards a Transpiler for C/C++ to Safer Rust [0.10993800728351737]
RustはMozillaが開発したプログラミング言語で、パフォーマンスと安全性に重点を置いている。
既存のC++コードベースをRustに変換する方法も注目されている。
論文 参考訳(メタデータ) (2024-01-16T10:35:59Z) - CodeLMSec Benchmark: Systematically Evaluating and Finding Security
Vulnerabilities in Black-Box Code Language Models [58.27254444280376]
自動コード生成のための大規模言語モデル(LLM)は、いくつかのプログラミングタスクにおいてブレークスルーを達成した。
これらのモデルのトレーニングデータは、通常、インターネット(例えばオープンソースのリポジトリから)から収集され、障害やセキュリティ上の脆弱性を含む可能性がある。
この不衛生なトレーニングデータは、言語モデルにこれらの脆弱性を学習させ、コード生成手順中にそれを伝播させる可能性がある。
論文 参考訳(メタデータ) (2023-02-08T11:54:07Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。