論文の概要: GitLake: Git-for-data for the agentic lakehouse
- arxiv url: http://arxiv.org/abs/2607.08319v1
- Date: Thu, 09 Jul 2026 10:03:36 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-10 14:45:27.497651
- Title: GitLake: Git-for-data for the agentic lakehouse
- Title(参考訳): GitLake: エージェントレイクハウス用のGit-for-data
- Abstract要約: エージェントファーストのレイクハウス用のGit-for-dataデザインであるGitLakeを紹介します。
このシステムは、シングルテーブルのIcebergスナップショットをレイクハウス全体のコミット、ブランチ、マージに持ち上げ、エージェントが独立したブランチで作業し、人間が変更をレビューし公開する。
- 参考スコア(独自算出の注目度): 1.9161188920101901
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: We present GitLake, a Git-for-data design for an agent-first lakehouse. The system lifts single-table Iceberg snapshots into lakehouse-wide commits, branches, and merges, letting agents work on isolated branches while humans review and publish changes. Pipelines run on temporary branches and publish through a final merge, so all outputs become visible atomically or none do. Finally, we report production lessons as well as correctness insights from a preliminary Alloy model of our core abstractions.
- Abstract(参考訳): エージェントファーストのレイクハウス用のGit-for-dataデザインであるGitLakeを紹介します。
このシステムは、シングルテーブルのIcebergスナップショットをレイクハウス全体のコミット、ブランチ、マージに持ち上げ、エージェントが独立したブランチで作業し、人間が変更をレビューし公開する。
パイプラインは一時的なブランチ上で実行され、最終的なマージを通じてパブリッシュされる。
最後に、我々は、コア抽象化の予備合金モデルから、生産レッスンおよび正当性に関する洞察を報告した。
関連論文リスト
- SkillGLoW: Procedural-Family Skill Consolidation for Self-Improving Agents on Long-Horizon Task Streams [55.90739575113059]
再利用の欠如は、関連するタスクのクラスタによって共有される解決手順であり、その周りでSkillGLoWを構築している、と我々は主張する。
4つのベンチマーク(数学的推論、端末の自動化、ソフトウェア修復、実施制御)と3つのモデルで、前者は平均17.2ポイント(ハード)を獲得している。
論文 参考訳(メタデータ) (2026-09-02T07:31:18Z) - Tencent WorkBuddy Bench: A Multi-Domain Coding-Agent Benchmark with Contamination-Resistant Task Construction [57.138342889101345]
Tencent WorkBuddy Benchは、コーディングエージェントのためのマルチドメイン評価スイートである。
本報告では, 設計手法, スコアリングプロトコル, クロスモデルリーダーボードについて述べる。
論文 参考訳(メタデータ) (2026-07-23T04:34:06Z) - GitFarm: Git as a Service for Large-Scale Monorepos [0.0]
gRPC APIを通じて、Gitをステートフル、アイデンティティスコープ、リポジトリ中心の実行サービスとして提供するプラットフォームであるGitFarmを紹介します。
GitFarmは、事前警告されたリポジトリによってバックアップされた、セキュアで一時的なサンドボックス内でGit操作をリモートで実行することで、クライアントからリポジトリ管理を分離する。
結果として、サービスとしてのGitは、ネイティブなGitセマンティクスの柔軟性を維持しながら、大幅なパフォーマンスとコスト面でのメリットを提供することが示された。
論文 参考訳(メタデータ) (2026-04-13T19:09:04Z) - Learning to Commit: Generating Organic Pull Requests via Online Repository Memory [11.042326503752756]
大きな言語モデル(LLM)ベースのコーディングエージェントは、制御されたベンチマークで印象的な結果を得るが、実際のメンテナが拒否するプルリクエストを定期的に生成する。
オンラインリポジトリメモリを通じてこのギャップを埋めるフレームワークであるLearning to Commitを紹介します。
論文 参考訳(メタデータ) (2026-03-27T17:58:56Z) - Pull Requests as a Training Signal for Repo-Level Code Editing [49.82435173554125]
Clean Pull Request(Clean-PR)は、現実のGitHubプルリクエストをリポジトリレベルの編集のトレーニングシグナルとして活用する、トレーニング中のパラダイムである。
ノイズの多いプルリクエストの差分を,再構築と検証を通じて検索/リプレース編集ブロックに変換する,スケーラブルなパイプラインを導入する。
SWE-benchでは,SWE-bench Liteが13.6%,SWE-bench Verifiedが12.3%,命令調整ベースラインが大幅に向上した。
論文 参考訳(メタデータ) (2026-02-07T09:22:25Z) - ANCHOR: Branch-Point Data Generation for GUI Agents [52.22377425487]
デスクトップ環境向けのエンドツーエンドGUIエージェントは、大量の高品質なインタラクションデータを必要とする。
本稿では,拡張フレームワークであるAnchorについて紹介する。このフレームワークは,小規模で検証済みのシードデモから,スケーラブルなデスクトップ監視をブートストラップする。
OSWorldとWindowsAgentArenaの標準デスクトップベンチマークの実験では、拡張されたコーパスに微調整されたモデルが一貫した改善を実現している。
論文 参考訳(メタデータ) (2026-02-06T19:55:26Z) - Building a Correct-by-Design Lakehouse. Data Contracts, Versioning, and Transactional Pipelines for Humans and Agents [1.9161188920101901]
Bauplanはコードファーストのレイクハウスで、よく知られた抽象化を使って(ほとんど)違法な状態を表現不能にすることを目的としています。
Bauplanは、パイプラインバウンダリをチェック可能にする型付きテーブルコントラクト、レビューとランタイムのためのGitライクなデータバージョニング、パイプラインレベルのアトミック性を保証するトランザクション実行の3つの軸に沿って機能する。
論文 参考訳(メタデータ) (2026-02-02T16:58:38Z) - AgentPack: A Dataset of Code Changes, Co-Authored by Agents and Humans [46.56091965723774]
コード編集のための微調整された大きな言語モデルは、一般的にコミットのマイニングやプルリクエストに依存しています。
我々は、Claude Code、OpenAI Codex、Cursor Agentが共著した1.3Mコード編集コーパスであるAgentPackを紹介する。
AgentPackで微調整されたモデルは、以前の人間のみのコミットコーパスで訓練されたモデルより優れていることを示す。
論文 参考訳(メタデータ) (2025-09-26T05:28:22Z) - Choosing the Right Git Workflow: A Comparative Analysis of Trunk-based vs. Branch-based Approaches [23.436103480497525]
Gitを使ったコラボレーティブ開発のさまざまなフォーマットが登場し、ソフトウェアエンジニアの間で人気を博している。
これをブランチベースとトランクベースという2つの主要なタイプに分類することができます。
私たちの結果は、トランクベースの開発は経験豊富なチームや小規模のチームによる速いペースのプロジェクトを好む一方で、ブランチベースの開発は経験の少ないチームやより大きなチームに適していることを示しています。
論文 参考訳(メタデータ) (2025-07-11T18:06:00Z) - MAGIS: LLM-Based Multi-Agent Framework for GitHub Issue Resolution [47.850418420195304]
大規模言語モデル(LLM)はコード生成において有望であるが、GitHubの問題を解決する上で困難に直面している。
ソフトウェア進化のためにカスタマイズされた4つのエージェントからなる、GitHub Issue Resolution, MAGISのための新しいMulti-Agentフレームワークを提案する。
論文 参考訳(メタデータ) (2024-03-26T17:57:57Z) - AMOR: A Recipe for Building Adaptable Modular Knowledge Agents Through Process Feedback [91.76169903959376]
オープンソースの大規模言語モデル(LLM)に基づくエージェントフレームワークAMORを提案する。
AMORは有限状態マシン(FSM)上に推論ロジックを構築し、自律的な実行と非絡み合ったモジュールの遷移によって問題を解決する。
この推論とフィードバックの枠組みに基づき、2段階の微調整(ウォームアップと適応)によりAMORを開発する。
論文 参考訳(メタデータ) (2024-02-02T14:56:48Z) - Enhancing Open-Domain Task-Solving Capability of LLMs via Autonomous Tool Integration from GitHub [79.31134731122462]
オープンドメインのタスク解決能力を評価するためにOpenActベンチマークを導入します。
我々は,オープンドメインの進化するクエリに,GitHubから専門ツールを自律的に統合することで対処できる,新しいLLMベースのエージェントシステムであるOpenAgentを紹介する。
論文 参考訳(メタデータ) (2023-12-28T15:47:30Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。