論文の概要: Designing Within the Lines: Practitioners' Perspectives and Visualisation Tool Evaluation in the Arabic Context
- arxiv url: http://arxiv.org/abs/2607.24571v1
- Date: Mon, 27 Jul 2026 15:36:44 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-28 22:34:15.482867
- Title: Designing Within the Lines: Practitioners' Perspectives and Visualisation Tool Evaluation in the Arabic Context
- Title(参考訳): ライン内デザイン:アラビア語文脈における実践者の視点と可視化ツールの評価
- Abstract要約: アラビア語話者の視覚的実践者が右から左(RTL)スクリプトをどのように設計するかを検討する。
この結果から,可視化実践者はアラビアの読書慣行と普遍的な視覚規範との緊張関係を常に交渉していることが明らかとなった。
可視化ツールとデフォルトは,RTLコンテキストにおける言語的・地政学的パワーを運用する,と我々は主張する。
- 参考スコア(独自算出の注目度): 8.648572909485678
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Design guidelines and best practices serve as references that support designers throughout the visualisation design process. While considerable effort has identified the elements that contribute to effective data visualisations, little attention has been paid to how language (scripts and reading direction), tool support, and cultural context also shape design decisions. As a result, assumptions of homogeneity persist, with visualisation practices predominantly benefiting users of English and left-to-right (LTR) scripts while overlooking the needs of over two billion Arabic script users. We investigate how Arabic-speaking visualisation practitioners design for right-to-left (RTL) scripts. We report on an analytical evaluation of seven popular GUI-based visualisation authoring tools using an Arabic dataset complemented by interviews with 11 Arabic-speaking practitioners across journalism, design, and data analysis. Our findings reveal that visualisation practitioners constantly negotiate tensions between Arabic reading conventions, "universal" LTR visual norms, and limited tool support for Arabic text, Eastern numerals, and maps. They engage in substantial labour, such as manually mirroring charts, fixing alignment issues, and stitching together multi-tool workflows, while making strategic compromises in language choice, interactivity, and chart type. Our tool analysis further reveals fragmented, inconsistent support for RTL mirroring, poor numeral rendering, and map defaults that encode geopolitical assumptions. In light of these findings, we discuss how RTL visualisation work is carried out under many constraints that affect agency and creativity. We argue that visualisation tools and defaults operationalise linguistic and geopolitical power in RTL contexts, and offer research directions and design implications that more robustly support RTL practitioners.
- Abstract(参考訳): デザインガイドラインとベストプラクティスは、ヴィジュアライゼーション設計プロセス全体を通してデザイナを支援するリファレンスとして機能する。
効果的なデータ視覚化に寄与する要素を、かなりの努力で特定してきたが、言語(スクリプトと読み方)、ツールサポート、文化的なコンテキストが設計決定を形作る方法にはほとんど関心が払われていない。
その結果、均質性の仮定は継続し、視覚化の実践は、主に、20億以上のアラビア文字ユーザーのニーズを乗り越えながら、英語および左から右へのスクリプト(LTR)のユーザに利益をもたらす。
本研究では、アラビア語話者の視覚的実践者が、右から左へ(RTL)スクリプトをどう設計するかを検討する。
本稿では,ジャーナリズム,デザイン,データ分析を通じて,11人のアラビア語を話す実践者とのインタビューを補完するアラビアデータセットを用いた7つの人気のあるGUIベースのビジュアル化オーサリングツールの分析評価について報告する。
この結果から,アラビア語の読解規約,LTRの「普遍的」視覚規範,アラビア語のテキスト,東洋の数字,地図に対するツールサポートの制限など,視覚的な実践者が常に緊張関係を保っていることが明らかとなった。
それらは、手動でチャートのミラーリング、アライメントの問題の修正、複数ツールワークフローの縫い合わせ、言語選択、対話性、チャートタイプにおける戦略的妥協など、かなりの作業に従事している。
ツール解析により, RTLミラーリング, 数値レンダリングの貧弱さ, 地政学的な仮定を符号化するマップデフォルトの断片化, 一貫性のないサポートが明らかになった。
これらの知見を踏まえ、エージェントや創造性に影響を与える多くの制約の下で、RTLの可視化作業がどのように実行されるかについて議論する。
可視化ツールとデフォルトは、RTLコンテキストにおける言語的・地政学的パワーを運用し、RTL実践者を支援するための研究の方向性と設計上の意味を提供する。
関連論文リスト
- Shaping Schema via Language Representation as the Next Frontier for LLM Intelligence Expanding [88.11781604392606]
本稿では,言語表現を実世界の地図化とモデル化に使用される言語的・象徴的構造として定義する。
我々は、高度な言語表現によるスキーマ形成が、大規模言語モデルの拡張の次のフロンティアであると主張している。
論文 参考訳(メタデータ) (2026-05-10T02:42:29Z) - MMTIT-Bench: A Multilingual and Multi-Scenario Benchmark with Cognition-Perception-Reasoning Guided Text-Image Machine Translation [29.093072408848467]
MMTIT-Benchは、14の非英語と非中国語にまたがる1,400の画像を持つ、人間による検証された多言語・マルチシナリオのベンチマークである。
ベンチマーク以外にも、推論指向のデータ設計が翻訳をどのように改善するかについて研究する。
本稿では,シーン認識,テキスト認識,翻訳推論を統一的推論プロセスに統合したデータパラダイムであるCPR-Transを提案する。
論文 参考訳(メタデータ) (2026-03-25T03:37:12Z) - TowerVision: Understanding and Improving Multilinguality in Vision-Language Models [56.775118098058506]
TowerVisionは、画像テキストとビデオテキストの両方のためのオープンな多言語視覚言語モデルである。
微調整中に視覚的、文化的コンテキストを取り入れることで、私たちのモデルは既存のアプローチを超えます。
さらなる研究を支援するため、すべてのモデル、データ、トレーニングレシピを公開しています。
論文 参考訳(メタデータ) (2025-10-22T17:02:48Z) - Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving [61.992824291296444]
現在の大型視覚言語モデル(LVLM)は、通常、大型言語モデル(LLM)のテキスト埋め込みと視覚的特徴をリンクするためのコネクタモジュールを使用する。
本稿では,エンド・ツー・エンドの視覚言語推論モデルをトレーニングする代わりに,分離された推論フレームワークの開発を提唱する。
論文 参考訳(メタデータ) (2025-05-23T08:18:00Z) - Evaluating Menu OCR and Translation: A Benchmark for Aligning Human and Automated Evaluations in Large Vision-Language Models [44.159383734605456]
異文化間コミュニケーションにおけるメニュー翻訳の重要な役割を強調する特化評価フレームワークを提案する。
MOTBenchは、それぞれの料理を正確に認識し翻訳するLVLMと、その価格とメニュー上のユニットアイテム、そして正確な人間のアノテーションを必要とする。
我々のベンチマークは中国語と英語のメニューのコレクションで構成されており、複雑なレイアウト、さまざまなフォント、さまざまな言語にまたがる文化的に特定の要素、そして正確な人間のアノテーションが特徴である。
論文 参考訳(メタデータ) (2025-04-16T03:08:57Z) - A Review on Large Language Models for Visual Analytics [0.2209921757303168]
本稿では,視覚解析の理論的基盤と大規模言語モデル(LLM)の変容の可能性について概説する。
さらに、LLMと視覚分析の相乗効果が、データの解釈、可視化技術、対話的な探索機能をどのように強化するかを考察する。
本稿は,データ探索,可視化向上,自動レポート,洞察抽出支援における機能,強み,限界について論じる。
論文 参考訳(メタデータ) (2025-03-19T13:02:01Z) - AlignVLM: Bridging Vision and Language Latent Spaces for Multimodal Document Understanding [79.43306110124875]
AlignVLMは視覚的特徴をテキスト埋め込みの重み付き平均値にマッピングする視覚テキストアライメント手法である。
実験の結果,AlignVLMは先行アライメント法と比較して最先端の性能を実現していることがわかった。
論文 参考訳(メタデータ) (2025-02-03T13:34:51Z) - Towards Interpreting Visual Information Processing in Vision-Language Models [24.51408101801313]
VLM(Vision-Language Models)は、テキストや画像の処理と理解のための強力なツールである。
著名なVLMであるLLaVAの言語モデルコンポーネントにおける視覚トークンの処理について検討する。
論文 参考訳(メタデータ) (2024-10-09T17:55:02Z) - CLEAR: Improving Vision-Language Navigation with Cross-Lingual,
Environment-Agnostic Representations [98.30038910061894]
VLN(Vision-and-Language Navigation)タスクでは、エージェントが言語命令に基づいて環境をナビゲートする必要がある。
CLEAR: 言語横断表現と環境非依存表現を提案する。
我々の言語と視覚表現は、Room-to-Room and Cooperative Vision-and-Dialogue Navigationタスクにうまく転送できる。
論文 参考訳(メタデータ) (2022-07-05T17:38:59Z) - SOCIOFILLMORE: A Tool for Discovering Perspectives [10.189255026322996]
SOCIOFILLMOREは、テキストがイベントを描写する際に表現する視点をフォアに導くのに役立つツールである。
我々のツールは、人間の判断を大量に集めることで、理論的にはフレームのセマンティクスと認知言語学に基礎を置いています。
論文 参考訳(メタデータ) (2022-03-07T14:42:22Z) - Language and Visual Entity Relationship Graph for Agent Navigation [54.059606864535304]
VLN(Vision-and-Language Navigation)は、エージェントが自然言語の指示に従って現実世界の環境をナビゲートする必要がある。
テキストと視覚間のモーダル関係をモデル化するための新しい言語とビジュアルエンティティ関係グラフを提案する。
実験によって、私たちは最先端技術よりも改善できる関係を利用しています。
論文 参考訳(メタデータ) (2020-10-19T08:25:55Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。