論文の概要: CAS2UML: A Handwritten Sketch-to-PlantUML Dataset for Class and Activity Diagrams
- arxiv url: http://arxiv.org/abs/2608.07036v1
- Date: Fri, 07 Aug 2026 09:46:38 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-10 16:21:25.454427
- Title: CAS2UML: A Handwritten Sketch-to-PlantUML Dataset for Class and Activity Diagrams
- Title(参考訳): CAS2UML: クラスとアクティビティダイアグラムのための手書きのSketch-to-PlantUMLデータセット
- Abstract要約: 本稿では,271のクラス図と286のアクティビティ図を含む557のハンド描画図を公開データセットとして提示する。
生成したアーティファクトの構文的正しさとレンダリング性をチェックするための、PlanUMLベースの検証ツールと再利用可能なスクリプトを提供する。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Automated UML generation from sketches and images is gaining renewed attention with the rise of large language models and multimodal AI. However, reproducible evaluation remains difficult due to the lack of public datasets with executable groundtruth models. We present CAS2UML, a public dataset of 557 handdrawn UML diagrams, including 271 class diagrams and 286 activity diagrams, each paired with manually validated PlantUML code. We also provide a PlantUML-based validation tool and reusable scripts for checking the syntactic correctness and renderability of generated UML artifacts, enabling reproducible benchmarking of sketch-to-UML approaches. The dataset, validation tool, processing scripts, documentation, and demonstration video are publicly available at: Dataset: https://huggingface.co/datasets/Seym0n /cas2uml_hand-drawn_to_plantuml_dataset; Tool and Scripts: https://github.com/Seym0n/handwritten-uml-dataset; Video: https://www.youtube.com/watch?v=KQrYeGgT3hs.
- Abstract(参考訳): スケッチや画像からUMLの自動生成は、大規模言語モデルとマルチモーダルAIの台頭により、新たな注目を集めている。
しかし、実行可能な基底モデルを持つ公開データセットが欠如しているため、再現可能な評価は依然として困難である。
CAS2UMLは、557個の手書きUML図からなる公開データセットであり、271個のクラス図と286個のアクティビティ図を含み、それぞれが手動で検証されたPlandUMLコードとペアリングされている。
また、生成したUMLアーティファクトの構文的正しさとレンダリング性をチェックするためのPandUMLベースの検証ツールと再利用可能なスクリプトを提供し、スケッチからUMLへのアプローチの再現可能なベンチマークを可能にします。
Dataset: https://huggingface.co/datasets/Seym0n /cas2uml_hand-drawn_to_plantuml_dataset; Tool and Scripts: https://github.com/Seym0n/hand written-uml-dataset; Video: https://www.youtube.com/watch?
v=KQrYeGgT3hs。
関連論文リスト
- Diagram-MMU: A Multi-Modal Benchmark for Scientific Diagrams [53.28039059333946]
科学図解析と理解のためのMLLMの能力を評価するためのベンチマークを構築した。
ダイアグラム-MMUは6つの領域にわたる3.7kのキュレートダイアグラムと18.3kの人間による質問を特徴としている。
ワークスペースを書くのに共通する3つのタスク(ダイアグラムからコードへのパース、ダイアグラムからコードへの編集、ダイアグラムへの質問応答)でMLLMを評価する。
論文 参考訳(メタデータ) (2026-08-12T17:04:13Z) - Query2Diagram: Answering Developer Queries with UML Diagrams [7.42369031190836]
クエリ駆動型ダイアグラム生成を導入する。
コードファイルのキュレートされたデータセット上でQwen2.5-Coder-14Bを微調整する。
その結果,手動で修正したデータの微調整により,大幅な改善が得られた。
論文 参考訳(メタデータ) (2026-04-26T17:34:43Z) - ToolGrad: Efficient Tool-use Dataset Generation with Textual "Gradients" [53.7887350405379]
以前の作業では、まずユーザクエリを生成し、続いてDFSのような複雑なツール使用アノテーションを使用して、ツール使用のLLMデータセットを合成する。
ToolGradはこのパラダイムを逆転させるエージェントフレームワークであるToolGradを紹介します。
このアプローチは、より複雑なツールの使用、低コスト、100%パスレートで生成されたデータセットであるToolGrad-5kにつながった。
論文 参考訳(メタデータ) (2025-08-06T05:04:00Z) - Automated Visualization Makeovers with LLMs [0.716879432974126]
ビジュアライゼーションのフェイルオーバーは、コミュニティがフィードバックを交換してチャートやデータの視覚化を改善する活動である。
マルチモーダル大言語モデル(LLM)はこのタスクをエミュレートできるだろうか?
当社のシステムは,ユーザガイドラインとデータ視覚化プラクティスの潜伏した知識を併用した,事前学習モデルの迅速なエンジニアリングを中心に構築されている。
論文 参考訳(メタデータ) (2025-07-21T11:51:20Z) - Behavioral Augmentation of UML Class Diagrams: An Empirical Study of Large Language Models for Method Generation [0.0]
本研究では, 大規模言語モデル(LLM)を用いて, 21 の構造化廃棄物処理事例を用いて, メソドレスダイアグラム(21 クラス, 17 の関係性)を増強する。
合計90の図(3,373の方法)が6回にわたって評価された。
論文 参考訳(メタデータ) (2025-06-01T02:33:40Z) - Self-Training Large Language Models for Tool-Use Without Demonstrations [15.17750971071501]
大規模言語モデル (LLMs) は、実際の不正確さや計算ミスに悩まされがちである。
最近の研究は、これらの欠点を緩和するツールを備えたLCMを強化しているが、しばしば金の工具使用デモを必要とする。
本稿では,LLMが実演なしでツールの活用を学べるかどうかを検討する。
論文 参考訳(メタデータ) (2025-02-09T12:06:10Z) - Distill Visual Chart Reasoning Ability from LLMs to MLLMs [64.32993770646165]
マルチモーダル大言語モデル(MLLM)における複雑なチャートQ&Aタスクの解決には高度な視覚的推論能力が必要である
我々は,LLMからMLLMへの視覚的推論能力を蒸留するための費用効率,効率,スケーラブルなデータ合成手法であるCode-as-Intermediary Translation (CIT)を提案する。
ReachQAは、MLLMの認識と推論能力を高めるために、3kの推論集約チャートと20kのQ&Aペアを含むデータセットである。
論文 参考訳(メタデータ) (2024-10-24T14:50:42Z) - List Items One by One: A New Data Source and Learning Paradigm for Multimodal LLMs [160.6296629396925]
『各項目を1つずつリストアップ』では、タグの数字順に従って画像上に表示される全ての視覚タグを列挙して記述するようモデルに求めている。
比較的小さな(タグ付き10k-30k画像)でも、この新しいデータセットは視覚的推論能力を大幅に向上させ、MLLMの幻覚を低減させる。
論文 参考訳(メタデータ) (2024-04-25T07:29:17Z) - mPLUG-PaperOwl: Scientific Diagram Analysis with the Multimodal Large
Language Model [73.38800189095173]
本研究はマルチモーダルLLMのマルチモーダルダイアグラム解析機能を強化することに焦点を当てる。
高品質な論文のLatexソースファイルを解析することにより、マルチモーダルなダイアグラム理解データセットM-Paperを慎重に構築する。
M-Paperは、画像やラテックス符号のフォーマットの数字や表を含む、複数の科学的図の合同理解をサポートする最初のデータセットである。
論文 参考訳(メタデータ) (2023-11-30T04:43:26Z) - Towards Automatic Parsing of Structured Visual Content through the Use
of Synthetic Data [65.68384124394699]
本研究では,構造化ビジュアルコンテンツ(Structured Visual Content, SVC)を画像と地上の真実の形で含む合成データセットを提案する。
本稿では、SVC画像からグラフ表現を自動的に抽出するアプリケーションによる、このデータセットの使用例を示す。
我々のデータセットは、時間を要する高密度データアノテーションをスキップしながら、SVCの解釈のための強力なモデルの開発を可能にする。
論文 参考訳(メタデータ) (2022-04-29T14:44:52Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。