論文の概要: Adoption and Impact of Command-Line AI Coding Agents: A Study of Microsoft's Early 2026 Rollout of Claude Code and GitHub Copilot CLI
- arxiv url: http://arxiv.org/abs/2607.01418v1
- Date: Wed, 01 Jul 2026 19:24:27 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-03 19:45:08.577352
- Title: Adoption and Impact of Command-Line AI Coding Agents: A Study of Microsoft's Early 2026 Rollout of Claude Code and GitHub Copilot CLI
- Title(参考訳): コマンドラインAIコーディングエージェントの採用と影響 - Microsoftが2026年初頭に実施したClaude CodeとGitHub Copilot CLIのロールアウトについて
- Authors: Emerson Murphy-Hill, Jenna Butler, Alexandra Savelieva,
- Abstract要約: AnthropicのClaude CodeやGitHubのCopilot CLIのようなエージェントコマンドラインツールをロールアウトする組織は、誰が試すか、誰が使い続けるか、ツールがコストを正当化するのに十分なアウトプットを生成するかどうかを知る必要がある。
組織規模では、トークンの支出は年間数百万ドルに膨らむ可能性があるため、採用や維持、影響の誤読は、エンジニアリングのベロシティを変えることなく、ロールアウトコストを高くする可能性がある。
最初の使用はソーシャルネットワークを通じて広まり、保持は人口統計学よりもエンジニアのコーディング活動と関連付けられ、採用者はそれ以外の場合よりもおよそ24%のプルリクエストをマージした。
- 参考スコア(独自算出の注目度): 42.251213138623456
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Organizations rolling out agentic command line tools like Anthropic's Claude Code and GitHub's Copilot CLI need to know who will try them, who will keep using them, and whether the tools produce enough output to justify their cost. At organizational scale, token spend can run into millions of dollars annually, so misreading adoption, retention, or impact can make a rollout expensive without changing engineering velocity. Studying tens of thousands of engineers at Microsoft over its early-2026 rollout, we find that first use spread primarily through social networks, retention was associated more with engineers' coding activity than with demographics, and adopters merged roughly 24% more pull requests than they would have otherwise. We use merged pull requests as our proxy for output -- acknowledging that a merged PR is not the same as the value it delivers -- and the lift persists across our four-month window. These results suggest that CLI coding agents are neither uniformly adopted nor mere novelty effects and that organizations should treat visible peer use as central to rollout strategy.
- Abstract(参考訳): AnthropicのClaude CodeやGitHubのCopilot CLIのようなエージェントコマンドラインツールをロールアウトする組織は、誰が試すか、誰が使い続けるか、ツールがコストを正当化するのに十分なアウトプットを生成するかどうかを知る必要がある。
組織規模では、トークンの支出は年間数百万ドルに膨らむ可能性があるため、採用や維持、影響の誤読は、エンジニアリングのベロシティを変えることなく、ロールアウトコストを高くする可能性がある。
2026年初めのロールアウトでMicrosoftで数万人ものエンジニアを調査したところ、まずはソーシャルネットワークを通じて利用され、保持は人口統計よりもエンジニアのコーディング活動と関連付けられ、採用者は従来よりも24%多いプルリクエストをマージした。
マージされたプルリクエストを出力のプロキシとして使用します -- マージされたPRは、それが提供する価値と同じではないことを認めて、リフトは4ヶ月のウィンドウにわたって継続します。
これらの結果から,CLIコーディングエージェントは一様に採用されず,単に新規性効果も示さず,組織は可視的ピア使用をロールアウト戦略の中心として扱うべきであることが示唆された。
関連論文リスト
- AI Writes Faster Than Humans Can Review: A Longitudinal Study of an Enterprise 2x Mandate [27.728366704459265]
中規模のAIフォワード企業は、2025年半ばからエンジニア1人当たりのプルリクエストの倍増を約束している。
802の開発者と196,212のプルリクエストからなるパネルでは、ユーザ当たりのスループットが最終的に倍増し、2026年4月のプレマネージドベースラインの2.09倍に達した。
採用と利用の強度はランダムに割り当てられていないので、私たちはこの証拠が採用と利用のチャンネルに強く関係していると読みました。
論文 参考訳(メタデータ) (2026-07-02T09:03:32Z) - Agentic AI in the Software Development Lifecycle: Architecture, Empirical Evidence, and the Reshaping of Software Engineering [0.0]
現代のエージェントシステムは、リポジトリ、機能、アルゴリズムの粒度で機能する。
本稿ではエージェントソフトウェア工学システムのための6層参照アーキテクチャを提案する。
調査の中心的な対象は、コード生成から人事監督下での委任執行へと移行したと論じる。
論文 参考訳(メタデータ) (2026-04-29T04:06:47Z) - Agentic Much? Adoption of Coding Agents on GitHub [6.395990525268647]
GitHub上でのコーディングエージェントの採用に関する大規模な研究を初めて紹介する。
採用率は15.85%--22.60%と見積もられているが、これは数ヶ月前の技術では極めて高い。
コミットレベルでは、コーディングエージェントによって支援されるコミットは、人間の開発者によって書かれたコミットよりも大きいことが分かります。
論文 参考訳(メタデータ) (2026-01-26T10:28:10Z) - Code with Me or for Me? How Increasing AI Automation Transforms Developer Workflows [60.04362496037186]
本研究は,コーディングエージェントと開発者インタラクションを制御した最初の研究である。
我々は,2つの主要な協調型およびエージェント型符号化アシスタントの評価を行った。
結果から,エージェントはコピロトを超える方法で開発者を支援することができることがわかった。
論文 参考訳(メタデータ) (2025-07-10T20:12:54Z) - SwingArena: Competitive Programming Arena for Long-context GitHub Issue Solving [90.32201622392137]
We present SwingArena, a competitive evaluation framework for Large Language Models (LLMs)。
従来の静的ベンチマークとは異なり、SwingArenaはLLMをイテレーションとして組み合わせて、テストケースを作成し、継続的インテグレーション(CI)パイプラインを通じてパッチを検証するパッチとレビュアーを生成することで、ソフトウェアのコラボレーションプロセスをモデル化する。
論文 参考訳(メタデータ) (2025-05-29T18:28:02Z) - SWE-Fixer: Training Open-Source LLMs for Effective and Efficient GitHub Issue Resolution [56.9361004704428]
大規模言語モデル(LLM)は、様々な複雑なタスクにまたがる顕著な習熟度を示している。
SWE-Fixerは、GitHubの問題を効果的かつ効率的に解決するために設計された、新しいオープンソースフレームワークである。
我々は,SWE-Bench LiteとVerifiedベンチマークに対するアプローチを評価し,オープンソースモデル間の競合性能を実現する。
論文 参考訳(メタデータ) (2025-01-09T07:54:24Z) - AutoCodeRover: Autonomous Program Improvement [8.66280420062806]
プログラムの改善を自律的に達成するために、GitHubの問題を解決する自動化アプローチを提案する。
AutoCodeRoverと呼ばれるアプローチでは、LLMは洗練されたコード検索機能と組み合わせられ、最終的にプログラムの変更やパッチにつながります。
SWE-bench-lite(300の現実のGitHubイシュー)の実験では、GitHubの問題を解決する効果が向上している(SWE-bench-liteでは19%)。
論文 参考訳(メタデータ) (2024-04-08T11:55:09Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。