論文の概要: Restructure This: Using AI to Restructure Onboarding Documents to Reduce Cognitive Overload
- arxiv url: http://arxiv.org/abs/2605.19174v1
- Date: Mon, 18 May 2026 22:56:11 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-20 15:03:09.020205
- Title: Restructure This: Using AI to Restructure Onboarding Documents to Reduce Cognitive Overload
- Title(参考訳): 再構築:AIを使ってドキュメントのオンボードを再構築して認知的過負荷を減らす
- Abstract要約: オンボードドキュメンテーションは、オープンソースソフトウェア(OSS)で新参者を惹きつけ、維持するために重要である
本稿では,マルチメディア学習の認知理論(CTML)がOSS文書の再構築にどのように役立つかを検討する。
私たちはGenAIベースのパイプラインを使用して、プロトタイプのVisDocを通じてこれらの戦略を運用しています。
- 参考スコア(独自算出の注目度): 12.721592720289543
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Onboarding documentation is critical for attracting and retaining newcomers in open source software (OSS). However, it is often presented as dense, inconsistently structured, and fragmented presentations that are difficult to understand, which creates cognitive overload leading to frustration, errors, and abandonment. Here, we investigate how Cognitive Theory of Multimedia Learning (CTML) strategies can be used to restructure OSS documentation. We use a GenAI-based pipeline to operationalize these strategies to restructure OSS documentation through our prototype VisDoc. VisDoc segments documentation into task-based units, infers workflows, removes redundancy, and generates multimodal explanations. An expert evaluation (N=4) affirmed VisDoc's completeness, accuracy, and adoptability; A between-subjects evaluation (N=14) with newcomers found that VisDoc participants achieved higher task success, had significantly lower cognitive load, and perceived higher usability. The contributions of this work include a CTML-grounded analysis of onboarding challenges, a GenAI-based documentation restructuring pipeline, and empirical evidence that cognitively informed documentation restructuring reduces cognitive load and improves usability and task performance in OSS.
- Abstract(参考訳): オンボードドキュメンテーションは、オープンソースソフトウェア(OSS)で新参者を惹きつけ、維持するために重要である。
しかし、しばしば、密度が高く、矛盾なく構造化され、理解が難しい断片化されたプレゼンテーションとして提示され、フラストレーション、エラー、放棄につながる認知的過負荷を生み出す。
本稿では,マルチメディア学習の認知理論(CTML)がOSS文書の再構築にどのように役立つかを検討する。
これらの戦略を運用するために、GenAIベースのパイプラインを使用して、プロトタイプのVisDocを通じてOSSドキュメントを再構築しています。
VisDocはドキュメントをタスクベースのユニットに分割し、ワークフローを推論し、冗長性を排除し、マルチモーダルな説明を生成する。
The expert evaluation (N=4) affirmed VisDoc's completeness, accuracy and adoptedability; A between-jects evaluation (N=14) with newcomers found that VisDoc participants achieved higher task success, had significantly lower Cognitive load, and perceived higher usability。
この研究の貢献には、搭載課題のCTMLによる解析、GenAIベースのドキュメント再構築パイプライン、認知的に通知されたドキュメント再構築が認知負荷を低減し、OSSのユーザビリティとタスクパフォーマンスを改善するという実証的な証拠が含まれる。
関連論文リスト
- DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations [106.74348504930124]
本稿では,階層的な分類を基盤とした決定論的に検証可能な評価フレームワークであるDocOpsを紹介する。
DocOpsに基づいて,各種エージェントハーネスのクローズドおよびオープンソースモデルを体系的に評価する。
我々の研究は、グローバルな文書整合性を維持するためのエージェントの能力境界を明らかにし、堅牢で非破壊的なエージェントの将来の設計に光を当てている。
論文 参考訳(メタデータ) (2026-07-22T07:52:59Z) - DocSeeker: Structured Visual Reasoning with Evidence Grounding for Long Document Understanding [63.257540233507626]
本稿では、構造化解析、局所化、推論のワークフローを実行するためにモデルを必要とするパラダイムを提案する。
ショートページトレーニングから超長文書への堅牢な一般化を示し、視覚的検索・拡張生成システムと自然に相乗効果を示す。
論文 参考訳(メタデータ) (2026-04-14T14:39:26Z) - Revise: A Framework for Revising OCRed text in Practical Information Systems with Data Contamination Strategy [19.295619229517936]
Reviseは、OCRが導入したエラーを文字、単語、構造レベルで体系的に修正するフレームワークである。
実験結果から,OCR出力を効果的に補正し,文書内容のより構造化された表現と体系的な管理を可能にした。
論文 参考訳(メタデータ) (2026-04-09T11:35:19Z) - From Reflection to Repair: A Scoping Review of Dataset Documentation Tools [10.124271544484634]
59のデータセット文書出版物の混合メソッド分析によって支援された体系的レビューを提案する。
我々の分析では、データセットのドキュメント概念化において、採用と標準化を阻害する可能性のある4つの永続的なパターンが示されています。
これらの知見に基づいて,個別のソリューションではなく,機関的なAIツール設計へのシフトを提案する。
論文 参考訳(メタデータ) (2026-02-17T19:37:16Z) - ExStrucTiny: A Benchmark for Schema-Variable Structured Information Extraction from Document Images [19.490609860018804]
文書画像から構造化情報抽出(IE)のための新しいベンチマークデータセットであるExStrucTinyを紹介する。
ExStrucTinyは、手動と合成された人間のバリデーションサンプルを組み合わせた、新しいパイプラインで構築されている。
このベンチマークでオープンでクローズドなビジョン言語モデルを分析し、適応、クエリアンダーセグメンテーション、スキーマ適応といった課題を強調します。
論文 参考訳(メタデータ) (2026-02-12T17:38:57Z) - Resolving Evidence Sparsity: Agentic Context Engineering for Long-Document Understanding [49.26132236798123]
視覚言語モデル(VLM)は、文書理解における主要なアプローチになりつつある。
本稿では,粗いプロセスにおいて,検索者と4つの協調エージェントを編成するマルチエージェントフレームワークSLEUTHを提案する。
このフレームワークは、検索したページ内の重要なテキストおよび視覚的手がかりを特定し、テーブルやチャートなどの健全な視覚的エビデンスをフィルタし、クエリを分析して推論戦略を考案する。
論文 参考訳(メタデータ) (2025-11-28T03:09:40Z) - Equipping Retrieval-Augmented Large Language Models with Document Structure Awareness [15.810758425275322]
本稿では,RAGプロセス全体を通して構造情報を明示的に組み込む新しいフレームワークであるRetrieve-DocumentRoute-Read (RDR2)を提案する。
RDR2 は LLM ベースのルータを用いて文書構造木を動的にナビゲートする。
我々の重要な革新は、文書のルーティングをトレーニング可能なタスクとして定式化することであり、自動的なアクションキュレーションと、人間の読書戦略にインスパイアされた構造対応の通路選択である。
論文 参考訳(メタデータ) (2025-10-05T17:04:24Z) - DREAM: Document Reconstruction via End-to-end Autoregressive Model [53.51754520966657]
本稿では、文書再構成に特化した革新的な自己回帰モデルについて述べる。
文書再構成タスクの標準化定義を確立し,文書類似度基準(DSM)とDocRec1Kデータセットを導入し,タスクの性能を評価する。
論文 参考訳(メタデータ) (2025-07-08T09:24:07Z) - Structured Attention Matters to Multimodal LLMs in Document Understanding [52.37530640460363]
入力形式が文書理解性能に与える影響について検討する。
生のOCRテキストはMLLMの性能を向上するのではなく、しばしば機能不全であることがわかった。
本稿では,LaTexパラダイムを用いて文書要素を符号化する構造保存手法を提案する。
論文 参考訳(メタデータ) (2025-06-19T07:16:18Z) - Unified Pretraining Framework for Document Understanding [52.224359498792836]
文書理解のための統合事前学習フレームワークであるUDocを紹介する。
UDocは、ほとんどのドキュメント理解タスクをサポートするように設計されており、Transformerを拡張してマルチモーダル埋め込みを入力とする。
UDocの重要な特徴は、3つの自己管理的損失を利用して汎用的な表現を学ぶことである。
論文 参考訳(メタデータ) (2022-04-22T21:47:04Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。