論文の概要: Chart2SVG: Editable SVG Generation from Raster Chart Images
- arxiv url: http://arxiv.org/abs/2608.26544v1
- Date: Thu, 27 Aug 2026 02:35:30 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.217051
- Title: Chart2SVG: Editable SVG Generation from Raster Chart Images
- Title(参考訳): Chart2SVG:ラスターチャート画像から編集可能なSVG生成
- Abstract要約: 静的チャートを構造的に整理し,意味的にリッチなSVGに変換する,大規模言語モデルであるChart2SVGを提案する。
チャート固有のセマンティックトークンを視覚言語モデルに組み込むことで、Chart2SVGは幾何学的プリミティブと機能的役割の両方をキャプチャする。
提案手法は,視覚的に正確かつ構造的に整合したSVGを生成するため,特殊訓練目標とレンダリング認識後学習フェーズを併用する。
- 参考スコア(独自算出の注目度): 36.287509601619924
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: We present Chart2SVG, a multimodal large language model that converts static raster charts into structurally organized, semantically enriched SVGs that support programmatic editing. By incorporating chart-specific semantic tokens into a vision-language model, Chart2SVG captures both geometric primitives and their functional roles. To support robust structural recovery, we introduce Beagle+, a dataset of 33K canonicalized and structurally distilled chart samples. Our approach combines specialized training objectives with a rendering-aware post-training phase, producing SVGs that are both visually accurate and structurally consistent. To facilitate higher-level manipulations, we construct a Chart Structure Graph (CSG) that exposes visual dependencies, enabling tasks such as interactive exploration, chart repurposing, and layout reuse. Experiments show that Chart2SVG substantially outperforms baselines in reconstruction fidelity and downstream editing utility, advancing the development of intelligent and interactive visualization tools.
- Abstract(参考訳): 本稿では,静的ラスタチャートをプログラム編集をサポートする構造的,意味的にリッチなSVGに変換するマルチモーダルな大規模言語モデルであるChart2SVGを提案する。
チャート固有のセマンティックトークンを視覚言語モデルに組み込むことで、Chart2SVGは幾何学的プリミティブと機能的役割の両方をキャプチャする。
頑健な構造回復を支援するために,33Kの正準化および構造蒸留されたチャートサンプルのデータセットであるBeagle+を紹介した。
提案手法は,視覚的に正確かつ構造的に整合したSVGを生成するため,特殊訓練目標とレンダリング認識後学習フェーズを併用する。
高レベルな操作を容易にするため、視覚的依存関係を公開し、インタラクティブな探索、チャート再資源化、レイアウト再利用といったタスクを可能にするチャート構造グラフ(CSG)を構築した。
実験により、Chart2SVGは、リコンストラクションの忠実度と下流編集ユーティリティのベースラインを大幅に上回っており、インテリジェントでインタラクティブな可視化ツールの開発が進められている。
関連論文リスト
- SVG-Score: Human-Aligned Evaluation of Text-to-SVG Generation [62.7676301168359]
テキスト間SVG生成のためのヒューマンアライメント評価フレームワークである textbfours を紹介する。
CLIPベースのスコアは、SVGジェネレータが実際に行うエラー、例えば色、数、空間関係にほとんど反応しないことを示す。
次に、テキストセマンティックアライメントのための人間注釈付きデータセットを導入し、生成したSVGがそのキャプションをいかに忠実に反映するかを測定する。
論文 参考訳(メタデータ) (2026-09-03T13:12:37Z) - DuetSVG: Unified Multimodal SVG Generation with Internal Visual Guidance [48.98604326855894]
本稿では,画像トークンと対応するSVGトークンをエンドツーエンドで共同生成する統合マルチモーダルモデルであるDuetSVGを紹介する。
提案手法は,SVGデコードの品質向上のためのガイダンスとして,モデルのネイティブな視覚的予測を活用する新しいテストタイムスケーリング戦略を適用する。
論文 参考訳(メタデータ) (2025-12-11T18:23:03Z) - InternSVG: Towards Unified SVG Tasks with Multimodal Large Language Models [65.49118879021016]
統合データベンチマークモデルスイートであるInternSVGファミリを提示する。
SAgogeはSVGタスクのための最大かつ最も包括的なマルチモーダルデータセットである。
本稿では,SVG 固有の特殊トークンを用いた SVG 理解,編集,生成のための統合型 MLLM である InternSVG を提案する。
論文 参考訳(メタデータ) (2025-10-13T12:38:04Z) - SVGThinker: Instruction-Aligned and Reasoning-Driven Text-to-SVG Generation [47.390332111383294]
本稿では,SVGコードの生成を可視化プロセスと整合させる推論駆動型フレームワークであるSVGThinkerを紹介する。
パイプラインはまず各プリミティブをシーケンスでレンダリングし、マルチモーダルモデルを使用して画像とコードを注釈付けします。
最先端のベースラインに対する実験では、SVGThinkerはより安定し、編集可能で、高品質なSVGを生成する。
論文 参考訳(メタデータ) (2025-09-29T05:25:00Z) - See it. Say it. Sorted: Agentic System for Compositional Diagram Generation [0.5079602839359522]
スケッチ・トゥ・ダイアグラムの生成について研究し、粗い手書きスケッチを正確な構成図に変換する。
視覚言語モデル(VLM)とLarge Language Models(LLM)を結合した学習自由エージェントシステムSorted.を紹介する。
このシステムは、批判的VLMが小さな定性的な編集セットを提案する反復ループを実行し、複数の候補LPMが様々な戦略で更新を合成する。
この設計は、不安定な数値推定よりも定性的推論を優先し、大域的制約(例えば、アライメント、接続性)を保存し、自然に人間のループをサポートする。
論文 参考訳(メタデータ) (2025-08-21T04:20:36Z) - SVGen: Interpretable Vector Graphics Generation with Large Language Models [61.62816031675714]
本稿では,自然言語記述と組み合わせた高品質なSVGの大規模データセットであるSVG-1Mを紹介する。
我々は、セマンティックガイダンスを強化するために、Chain of Thoughtアノテーション付きのサブセットを含む、SVGトレーニングペアに整合したテキストを作成する。
このデータセットに基づいて,自然言語入力からSVGコードを生成するエンド・ツー・エンド・モデルであるSVGenを提案する。
論文 参考訳(メタデータ) (2025-08-06T15:00:24Z) - Socratic Chart: Cooperating Multiple Agents for Robust SVG Chart Understanding [14.75820681491341]
既存のベンチマークでは、真の視覚的推論ではなく、テキストベースのショートカットと確率的パターンマッチングに依存している。
グラフ画像をスケーラブルベクトルグラフ表現に変換する新しいフレームワークであるSocratic Chartを提案する。
我々のフレームワークは、グラフプリミティブを正確にキャプチャし、推論性能を向上させるために最先端モデルを上回る。
論文 参考訳(メタデータ) (2025-04-14T00:07:39Z) - OmniSVG: A Unified Scalable Vector Graphics Generation Model [69.59073636922287]
我々は、エンドツーエンドのマルチモーダルSVG生成に事前訓練されたビジョンランゲージモデルを活用する統一フレームワークであるOmniSVGを提案する。
SVGコマンドと座標を離散トークンにパラメタ化することにより、OmniSVGは複雑なSVG構造の合成を維持しながら、低レベルの幾何学から構造論理を分離し、効率的なトレーニングを行う。
本稿では,200万の注釈付きSVGアセットを持つマルチモーダルデータセットMMSVG-2Mと,条件付きSVG生成タスクの標準化された評価プロトコルを紹介する。
論文 参考訳(メタデータ) (2025-04-08T17:59:49Z) - NeuralSVG: An Implicit Representation for Text-to-Vector Generation [54.4153300455889]
本稿では,テキストプロンプトからベクトルグラフィックスを生成する暗黙的なニューラル表現であるNeuralSVGを提案する。
生成したSVGの層構造を促進するために,ドロップアウトに基づく正規化手法を導入する。
ニューラルSVGは、構造化された柔軟なSVGを生成する際に、既存の手法よりも優れていることを示す。
論文 参考訳(メタデータ) (2025-01-07T18:50:06Z) - ChartFormer: A Large Vision Language Model for Converting Chart Images into Tactile Accessible SVGs [20.690529354141116]
チャート解析の分野での進歩を活用して,触覚チャートをエンドツーエンドに生成する。
筆者らの3つの重要な貢献は,(1)チャート画像を触覚アクセス可能なSVGに変換するために訓練されたChartFormerモデル,(2)Chart2Tactileデータセット上でこのモデルをトレーニングし,(3)リフレッシュ可能な2次元触覚ディスプレイを用いたパイロットユーザによるSVGの有効性を評価することである。
論文 参考訳(メタデータ) (2024-05-29T14:24:42Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。