論文の概要: HackRep: A Large-Scale Dataset of GitHub Hackathon Projects
- arxiv url: http://arxiv.org/abs/2603.29672v1
- Date: Tue, 31 Mar 2026 12:30:13 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-01 15:25:03.650201
- Title: HackRep: A Large-Scale Dataset of GitHub Hackathon Projects
- Title(参考訳): HackRep: GitHub Hackathonプロジェクトの大規模データセット
- Abstract要約: HackRepは100,356のハッカソンGitHubリポジトリのデータセットである。
我々は,ハッカソンプロジェクトの継続に関する予備的な調査を提示することによって,HackRepがソフトウェア工学研究者に利益をもたらす方法を示す。
- 参考スコア(独自算出の注目度): 78.37688610956602
- License: http://creativecommons.org/licenses/by-nc-sa/4.0/
- Abstract: Hackathons are time-bound collaborative events that often target software creation. Although hackathons have been studied in the past, existing work focused on in-depth case studies limiting our understanding of hackathons as a software engineering activity. To complement the existing body of knowledge, we introduce HackRep, a dataset of 100,356 hackathon GitHub repositories. We illustrate the ways HackRep can benefit software engineering researchers by presenting a preliminary investigation of hackathon project continuation, hackathon team composition, and an estimation of hackathon geography. We further display the opportunities of using this dataset, for instance showing the possibility of estimating hackathon durations based on commit timestamps.
- Abstract(参考訳): ハッカソン(英: Hackathon)は、ソフトウェア作成をターゲットとする、タイムバウンドのコラボレーティブイベントである。
ハッカソンはこれまでも研究されてきたが、既存の研究は、ハッカソンをソフトウェアエンジニアリング活動として理解することを制限する詳細なケーススタディに重点を置いている。
既存の知識を補完するために、100,356のハッカソンGitHubリポジトリのデータセットであるHackRepを紹介します。
本稿では,ハッカソンプロジェクトの継続,ハッカソンチーム構成,ハッカソン地理の推定について予備的な調査を行った。
例えば、コミットタイムスタンプに基づいてハッカソン期間を推定する可能性を示す。
関連論文リスト
- Hack-Verifiable Terminal Bench: Evaluating Reward Hacking in Terminal Tasks [14.722822786841357]
ハック検証可能な環境(HVE)は、検出可能なハックをタスクに埋め込むことで、報酬ハックを自動的に確実に識別することができる。
我々はHVEを実世界の端末およびコーディングタスクのベンチマークであるTerminal Benchに適応させ、Hack-Verifiable Terminal Bench (HVTB)を導入する。
HVTBは、フロンティアモデル全体で報酬のハッキング率を測定し、ハッキングに関するさまざまな情報によって、この行動を緩和できるかどうかを調査する。
論文 参考訳(メタデータ) (2026-08-22T20:59:36Z) - Quick Build, Careful Check? Generative AI Use in Hackathons [83.0493885475068]
中央ヨーロッパにおけるAIをテーマとしたハッカソンの参加者を対象とした探索的なインタビュー研究を報告する。
参加者はコーディング以外の目的でGenAIを使用して,馴染みのないトピックの学習やブレインストーミング,ドキュメントの作成などを行いました。
また、すべての参加者が、使用前にGenAI出力をチェックするという書面のないプラクティスに集約されていることもわかりました。
論文 参考訳(メタデータ) (2026-07-31T08:59:18Z) - Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale [16.00357530754102]
我々は報酬ハッキングを評価するための新しい評価パラダイムを導入する。
検出可能な報酬ハックの機会を環境に直接埋め込む。
これにより、それらの利用を設計によって検証可能とし、決定論的かつ自動測定を可能にする。
論文 参考訳(メタデータ) (2026-05-20T05:46:52Z) - HackerSignal: A Large-Scale Multi-Source Dataset Linking Hacker Community Discourse to the CVE Vulnerability Lifecycle [7.784381182638764]
HackerSignalは、時間外配布サイバー脅威インテリジェンス(CTI)とクロスソースCVEリンクのベンチマークである。
HackerSignalは、8つのソース層と36年のウィンドウにまたがる64のパブリックフォーラム/ソース識別子から745万の認証済みのドキュメントを集約する。
論文 参考訳(メタデータ) (2026-05-04T21:03:42Z) - Do Synthetic Trajectories Reflect Real Reward Hacking? A Systematic Study on Monitoring In-the-Wild Hacking in Code Generation [53.024513172383195]
本稿では、報酬ハッキングにおける合成対内差の体系的解析について述べる。
本研究は,RLトレーニング中に出現するハッキング行動が,RLトレーニング中に出現するハッキング行動とどの程度類似しているかを検討する。
合成データ学習されたモニターは、ハッキングによって一般化することができないことがわかりました。
論文 参考訳(メタデータ) (2026-04-26T01:26:50Z) - Countdown-Code: A Testbed for Studying The Emergence and Generalization of Reward Hacking in RLVR [15.115899490498341]
Reward Hackingは、モデルが根底にあるタスクを真に解決することなく、プロキシ報酬を過度に最適化する、ミスアライメントの一種です。
モデルが数学的推論タスクを解決し、テストハーネスを操作できる最小限の環境であるCountdown-Codeを紹介します。
オープンウェイトLLMにおける報酬ハッキングについて検討し、教師付き微調整中に意図せず学習できることを見出した。
論文 参考訳(メタデータ) (2026-03-07T07:43:14Z) - Social Media Reactions to Open Source Promotions: AI-Powered GitHub Projects on Hacker News [1.6842686573313703]
我々は、宣伝中のGitHub AIプロジェクトにおけるHacker Newsと開発者活動の関係について調査する。
AI開発者の少なくとも19%は、GitHubプロジェクトをHacker Newsで宣伝し、コミュニティから肯定的な関与をしばしば受けた。
これらの結果は、Hacker NewsがAIを使ったOSSプロジェクトの実行可能なプラットフォームとして機能していることを示唆している。
論文 参考訳(メタデータ) (2025-06-14T22:03:52Z) - Mic-hackathon 2024: Hackathon on Machine Learning for Electron and Scanning Probe Microscopy [54.24356756795849]
顕微鏡は、ナノメートルと原子スケールにおける材料構造と機能に関する情報の主要な源である。
主要な資金機関によるデータ管理計画(DMP)の導入は、保存とアクセスを促進する。
標準化されたコードエコシステム、ベンチマーク、統合戦略が欠如しているため、洞察を得るのは難しいままです。
論文 参考訳(メタデータ) (2025-06-10T03:54:36Z) - Can participation in a hackathon impact the motivation of software
engineering students? A preliminary case study analysis [3.396911477739876]
本稿では,ハッカソンがソフトウェア工学(SE)の学生のモチベーションに影響を及ぼすかどうかを検討する。
プレハッカソンの発見は、全体的な受容を伴う様々なモチベーションを示し、一方、ハッカソン後の反応は、参加者の知覚に統計的に有意な変化を示さない。
論文 参考訳(メタデータ) (2024-02-08T00:56:50Z) - An Exploratory Study on the Evidence of Hackathons' Role in Solving OSS
Newcomers' Challenges [54.56931759953522]
我々はOSSプロジェクトに参加する際、新参者が直面する課題を理解し、議論することを目指している。
これらの課題にどのようにハッカソンが使われたかを示す証拠を収集する。
論文 参考訳(メタデータ) (2023-05-16T15:40:19Z) - One-off Events? An Empirical Study of Hackathon Code Creation and Reuse [69.98625403567553]
ハッカソンイベントで使用されたり作成されたりするコードの進化を理解することを目的としています。
DevPostから22,183のハッカソンプロジェクトに関する情報を収集しました。
論文 参考訳(メタデータ) (2022-07-03T11:49:52Z) - Tracking Discourse Influence in Darknet Forums [23.9758488157336]
この技術報告は、2021年のAMoC(Advanced Modelling of Cyber Criminal Careers)ハッカソン(Hackathon)の課題に対処する取り組みを文書化しています。
私たちの主な貢献は、意味的特徴と時間的特徴を共同で可視化し、ダークネットのサイバー犯罪に関する供給されたデータに関する洞察を生み出すことです。
このハッカソンの一部として私たちによって作成されたコードとデータは、すべて公開されています。
論文 参考訳(メタデータ) (2022-02-04T11:23:27Z) - A Large-Scale Study on Unsupervised Spatiotemporal Representation
Learning [60.720251418816815]
本稿では,ビデオからの教師なし表現学習に関する大規模研究を行う。
目的は同じビデオにおける時間的特徴を奨励する。
長時間持続を奨励することは,60秒であっても有効であることがわかった。
論文 参考訳(メタデータ) (2021-04-29T17:59:53Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。