論文の概要: Automatic Method Illustration Generation for AI Scientific Papers via Drawing Middleware Creation, Evolution, and Orchestration
- arxiv url: http://arxiv.org/abs/2603.29590v2
- Date: Wed, 01 Apr 2026 14:57:16 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-04-06 02:36:13.145061
- Title: Automatic Method Illustration Generation for AI Scientific Papers via Drawing Middleware Creation, Evolution, and Orchestration
- Title(参考訳): ドローイングミドルウェア作成, 進化, オーケストレーションによるAI科学論文の自動イラストレーション生成
- Abstract要約: 我々は、人間作家の描画の実践からインスピレーションを得て、高品質なMI生成のための新しいマルチエージェントフレームワークである textbfFigAgent を提案する。
われわれのFigAgentはMI間の類似部品の描画体験をカプセル化し、再利用可能な描画図面にカプセル化する。
複雑な構造を持つMIを徐々に構築する上で,人間のような試行錯誤の手法を模倣する新たな探索・選択図法が導入された。
- 参考スコア(独自算出の注目度): 47.012967621189404
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Method illustrations (MIs) play a crucial role in conveying the core ideas of scientific papers, yet their generation remains a labor-intensive process. Here, we take inspiration from human authors' drawing practices and correspondingly propose \textbf{FigAgent}, a novel multi-agent framework for high-quality automatic MI generation. Our FigAgent distills drawing experiences from similar components across MIs and encapsulates them into reusable drawing middlewares that can be orchestrated for MI generation, while evolving these middlewares to adapt to dynamically evolving drawing requirements. Besides, a novel Explore-and-Select drawing strategy is introduced to mimic the human-like trial-and-error manner for gradually constructing MIs with complex structures. Extensive experiments show the efficacy of our method.
- Abstract(参考訳): 方法図面(MI)は、科学論文の中核的な概念を伝える上で重要な役割を担っているが、その生成は労働集約的なプロセスのままである。
本稿では,人間作家の描画の実践からインスピレーションを得て,高品質なMI生成のための新しいマルチエージェントフレームワークである「textbf{FigAgent}」を提案する。
当社のFigAgentは、MIをまたいだ類似コンポーネントの描画経験を蒸留し、MI世代用に編成できる再利用可能な描画ミドルウェアにカプセル化するとともに、これらのミドルウェアを動的に進化する描画要求に適応するように進化させています。
また,複雑な構造を持つMIを段階的に構築する上で,人間のような試行錯誤の手法を模倣する新たな探索・選択図法が導入された。
大規模な実験により,本手法の有効性が示された。
関連論文リスト
- Data-Efficient Brushstroke Generation with Diffusion Models for Oil Painting [60.15416769662556]
そこで本研究では,手書きサンプルの小さなセットから人型ブラシストローク生成を学習する問題について検討する。
Smooth Regularization (SmR) を用いた拡散型フレームワーク StrokeDiff を提案する。
学習したプリミティブをBézierベースの条件付けモジュールで制御可能であることを示す。
論文 参考訳(メタデータ) (2026-03-01T13:42:35Z) - PaperBanana: Automating Academic Illustration for AI Scientists [58.120067704652314]
PaperBananaは、出版可能な学術イラストの自動生成のためのエージェントフレームワークである。
最先端のVLMと画像生成モデルによって駆動されるPaperBananaは、参照を検索し、コンテンツとスタイルを計画し、画像をレンダリングし、自己批判を通じて反復的に洗練する特別エージェントを編成する。
論文 参考訳(メタデータ) (2026-01-30T18:33:37Z) - Loomis Painter: Reconstructing the Painting Process [56.713812157283805]
ステップバイステップの絵画チュートリアルは芸術的技法を学ぶのに不可欠であるが、既存のビデオリソースには対話性とパーソナライゼーションが欠如している。
セマンティクス駆動型スタイル制御機構を用いたマルチメディア描画プロセス生成のための統一的なフレームワークを提案する。
また、実際の絵画プロセスの大規模データセットを構築し、メディア間の整合性、時間的コヒーレンス、最終的なイメージの忠実性を評価する。
論文 参考訳(メタデータ) (2025-11-21T16:06:32Z) - Large Language Model Agent: A Survey on Methodology, Applications and Challenges [88.3032929492409]
大きな言語モデル(LLM)エージェントは、目標駆動の振る舞いと動的適応能力を持ち、人工知能への重要な経路を示す可能性がある。
本調査は, LLMエージェントシステムを方法論中心の分類法により体系的に分解する。
私たちの作業は、エージェントの構築方法、コラボレーション方法、時間の経過とともにどのように進化するか、という、統一されたアーキテクチャの視点を提供します。
論文 参考訳(メタデータ) (2025-03-27T12:50:17Z) - PCGRLLM: Large Language Model-Driven Reward Design for Procedural Content Generation Reinforcement Learning [4.173530949970536]
この研究はPCGRLLM(PCGRLLM)を導入し、フィードバック機構といくつかの推論に基づくプロンプトエンジニアリング技術を採用している。
2つの最先端LCMを用いた2次元環境におけるストーリー・ツー・リワード生成タスクにおける提案手法の評価を行った。
論文 参考訳(メタデータ) (2025-02-15T21:00:40Z) - Enhancing AI Research Paper Analysis: Methodology Component Extraction
using Factored Transformer-based Sequence Modeling Approach [10.060305577353633]
本稿では,方法論領域の幅広いカテゴリ情報を活用するシーケンスモデリングへの因子的アプローチを提案する。
シミュレーションされた時系列設定(トレーニングプロセス中に見えない新しい方法論)に従って実験を行う。
本実験により, 提案手法は, 数発設定の方法論抽出タスクにおいて, 9.257%のマージンで最先端のベースラインを上回り, 性能が向上することを示した。
論文 参考訳(メタデータ) (2023-11-05T16:33:35Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。