論文の概要: K-Dense BYOK: An Open-Source AI Research Assistant That Runs Locally and Keeps a Hash-Chained Lab Notebook
- arxiv url: http://arxiv.org/abs/2610.00074v1
- Date: Fri, 04 Sep 2026 23:26:54 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-10-05 14:48:16.352382
- Title: K-Dense BYOK: An Open-Source AI Research Assistant That Runs Locally and Keeps a Hash-Chained Lab Notebook
- Title(参考訳): K-Dense BYOK: ローカルで動くオープンソースのAI研究アシスタント
- Abstract要約: K-Dense BYOKは、研究者自身のコンピュータ上で動作するあらゆる分野の科学者のための、無償でオープンソースのAI研究アシスタントである。
それは、書かれた科学手続きのライブラリ、ガイド付きワークフローテンプレート、研究データを見つけるためのカタログ、そしてエージェントが手渡すことができるレビュアーとライターの役割のライブラリを出荷する。
エージェントの言葉をログに書き込むのではなく、エージェントが何をするかを見ることで何が起きたかを記録する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: K-Dense BYOK (bring your own keys) is a free, open-source AI research assistant for scientists in any field that runs on the researcher's own computer. The researcher supplies access to a model of their choice, hosted or running locally, and the application supplies everything else: a place for the work to run, a layer of scientific scaffolding, and a complete record. Each project is an ordinary folder, so the data, the code, the results, and the record stay on a machine the researcher administers and can be read years later without the application. Three things separate it from a chat assistant or a general-purpose coding agent. It ships a library of written scientific procedures, guided workflow templates, catalogs of where research data can be found, and reviewer and writer roles the agent can hand work to. It keeps a Living Lab Notebook whose entries link into an argument and are added to but never erased. And it records what happened by watching what the agent does rather than by taking the agent's word for it, in a log the agent has no tool that can write to. That choice targets the most common failure, model overclaiming, in our earlier benchmark of nine frontier models, by making claims checkable rather than preventing them. On twenty interdisciplinary research prompts, scored under a rubric fixed in advance, K-Dense BYOK led two managed platforms on both scientific quality and research execution. Its deliverables were the only ones that recorded the software they ran in, and the only ones that usually arrived with a command that regenerates the results. One of the managed platforms ran the same frontier model and supplied neither. Those environment records were files the agent wrote, not part of the observed log, which does not yet capture the software environment itself. The code is available under the MIT license at https://github.com/K-Dense-AI/k-dense-byok.
- Abstract(参考訳): K-Dense BYOK(K-Dense BYOK)は、研究者自身のコンピュータ上で動作するあらゆる分野の科学者のための、無償でオープンソースのAI研究アシスタントである。
研究者は、ローカルにホストされたり、実行されたりして、選択したモデルへのアクセスを提供し、アプリケーションは、実行すべき場所、科学的な足場の層、そして完全な記録など、他のすべてのものを提供する。
各プロジェクトは通常のフォルダなので、データ、コード、結果、レコードは研究者が管理するマシンに留まり、数年後にはアプリケーションなしで読むことができる。
チャットアシスタントや汎用コーディングエージェントとは3つに分かれている。
それは、書かれた科学手続きのライブラリ、ガイド付きワークフローテンプレート、研究データを見つけるためのカタログ、そしてエージェントが手渡すことができるレビュアーとライターの役割のライブラリを出荷する。
エントリが引数にリンクされ、追加されるが、決して消去されないLiving Lab Notebookを保持する。
そして、エージェントの言葉をログに書き込むのではなく、エージェントが何をするかを見ることで何が起きたかを記録する。
この選択は、9つのフロンティアモデルの以前のベンチマークで、最も一般的な失敗、モデルの過剰評価を目標としています。
K-Dense BYOKは20の学際的な研究プロンプトにおいて、科学的な品質と研究実行の両面で2つの管理プラットフォームを率いた。
その成果物は、彼らが実行したソフトウェアを録音した唯一のもので、通常、結果を再生するコマンドを持って到着した唯一のものだった。
管理されたプラットフォームの1つは、同じフロンティアモデルを実行し、どちらも供給しなかった。
これらの環境記録は、エージェントが書いたファイルであり、観測されたログの一部ではない。
コードはMITライセンスでhttps://github.com/K-Dense-AI/k-dense-byokで入手できる。
関連論文リスト
- Dr. Claw: An AI Scientist Workspace for Vibe Research [64.18459471289147]
Claw博士はオープンソースのワークスペースで、既存のコーディングエージェントエグゼキュータを制御可能なヒューマン・イン・ザ・ループワークフローでラップする。
永続状態オブジェクト、再利用可能なスキルライブラリ、マルチエグゼクティブコーディネーションは、人間の決定とAIの実行を結びつける。
Claw博士は、監査可能な、回復可能なプロセストレイルを維持しながら、研究の完全性により高いスコアを付けます。
論文 参考訳(メタデータ) (2026-08-31T20:58:47Z) - Scientific Agent Skills: A Library of Procedural Knowledge for Research Agents [0.0]
科学エージェントスキル(Scientific Agent Skills)は、16の領域で163の手順のオープンライブラリである。
各スキルは、バージョン管理されたヒューマン可読な命令ファイルを中心に構築されたディレクトリである。
ドキュメントコーパスの2つの特性を測る。163スキルの常駐記述は、20万のウィンドウの7.1%、ドキュメントワークフローの中央値は23.9%である。
論文 参考訳(メタデータ) (2026-08-30T15:40:35Z) - SciForge: An AI-Native, Multimodal Workbench for Scientific Discovery [48.99744520105086]
SciForgeはマルチモーダルな研究ネイティブAIワークベンチである。
検索、解析、モデルルーティング、ワークフローの実行、プロット、書き込み、プレゼンテーション生成がモジュラーエージェントアクセス可能なサービスとして実行される間、人間の判断のためにグラフィカルインターフェースを予約する。
論文 参考訳(メタデータ) (2026-07-17T15:13:03Z) - XScientist: A Git-Like Research Protocol for Long-Running Autonomous Scientific Discovery [1.1923076571060318]
XScientistは、自律的な研究システムのためのgitライクな研究プロトコルとオペレーティングシステムである。
アイデア生成、実験実行、原稿のドラフト、自己レビュー、修復、品質保証、デーモンスケジューリング、アーティファクトを、継続的に監視可能なパイプラインとしてオーケストレーションする。
Agent-Native Research Artifactプロトコルをエクスポートし、探索DAG、ノード毎のコードと出力、クレーム・ツー・エビデンス・アンカー、コンテンツハッシュ、証明、再実行フックを記録する。
論文 参考訳(メタデータ) (2026-07-14T03:20:11Z) - ToFu: A White-Box, Token-Efficient Agent Harness for Researchers [73.72929185946842]
ToFuは、ファイルを読み、ファイルを編集し、コマンドを実行し、開発ツールと統合する研究者のためのエージェントハーネスだ。
研究助手として、より優れたトークン効率、低コスト、多言語能力で実践的な研究を支援する。
研究対象として、ToFuはホワイトボックスのエージェントハーネスを提供しており、研究者はオーケストレーションロジック、ツール使用の振る舞い、デザインを検査、修正、評価することができる。
論文 参考訳(メタデータ) (2026-07-13T11:26:06Z) - Claw AI Lab: An Autonomous Multi-Agent Research Team [73.07229229907435]
今回紹介するClaw AI Labは,ラボネイティブな自律型研究プラットフォームである。
1つのエージェントや固定されたシリアルワークフローを中心にシステムを集中するのではなく、ユーザーは1つのプロンプトから完全な研究チームをインスタンス化できる。
Claw-Code Harnessはローカル、データセット、チェックポイントを接続して実行可能な実験を行い、実行成果物を研究ループにフィードバックする。
論文 参考訳(メタデータ) (2026-05-21T16:02:53Z) - The Last Human-Written Paper: Agent-Native Research Artifacts [106.47848184955576]
本稿では,物語紙を機械処理可能な研究パッケージに置き換えるプロトコルであるAgent-Native Research Artifact(ARA)を紹介する。
通常の開発において決定と終了をキャプチャするLive Research Manager、レガシPDFとリポジトリをARAに変換するARAコンパイラ、人間レビュアーが重要性、ノベルティ、味にフォーカスできるように客観的チェックを自動化するARAネイティブレビューシステムである。
論文 参考訳(メタデータ) (2026-04-27T16:23:09Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。