論文の概要: Thinking Outside the [Chat]Box: Bridging Computer Science and Industrial Design for Cognitive-Inclusive Generative AI
- arxiv url: http://arxiv.org/abs/2606.14306v1
- Date: Fri, 12 Jun 2026 09:41:30 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-15 16:00:42.856992
- Title: Thinking Outside the [Chat]Box: Bridging Computer Science and Industrial Design for Cognitive-Inclusive Generative AI
- Title(参考訳): コンピュータ科学と産業デザインを融合させた認知包摂型生成AI
- Abstract要約: 現在のGenerative AI(GenAI)インターフェースは、チャットボックスのインタラクションに大きく制約されている。
認知的アクセシビリティのための代替相互作用モデルを検討するために,我々は学際的共同設計挑戦を行った。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by-nc-nd/4.0/
- Abstract: Current Generative AI (GenAI) interfaces remain largely constrained to chatbox interaction, which can impose high cognitive demands on users and create substantial barriers for people with intellectual disabilities (ID), including prompt formulation difficulties, response overload, and limited mechanisms to assess information reliability. To explore alternative interaction models for cognitive accessibility, we conducted a cross-disciplinary co-design challenge in which two student cohorts (Computer Science and Industrial Design) developed interface concepts from the same set of functional requirements (e.g., prompt scaffolding, structured output, GUI-based refinement, transparency, and personalization). Comparing the resulting proposals reveals both convergence on foundational requirements (notably initial calibration, proactive prompting, and direct manipulation of response fragments) and complementary contributions that outline a multi-layered support system. Computer Science teams primarily produced structural scaffolding, emphasizing predictability, navigability, and trust through mechanisms such as reliability indicators, explicit sources, and context management for long conversations. Industrial Design teams emphasized experiential scaffolding, focusing on pacing, attention guidance, multimodality, and proactive agency, including step-by-step response flows, focus modes, and assistant-like integrations. We synthesize these findings into a dual-layer scaffolding framework that expands the design space for cognitively accessible GenAI interaction beyond chat-centric models and motivates future work on expert refinement, technical feasibility, and empirical validation with users with ID.
- Abstract(参考訳): 現在のジェネレーティブAI(GenAI)インターフェースは、ユーザに対して高い認知的要求を課し、迅速な定式化の困難、応答過負荷、情報の信頼性を評価するための制限されたメカニズムを含む、知的障害(ID)に対する実質的な障壁を生み出すことができる、チャットボックスインタラクションに大きく制約されている。
2人の学生コホート(コンピュータサイエンスと産業デザイン)が,同じ機能要件(即時足場,構造化アウトプット,GUIに基づく洗練,透明性,パーソナライゼーション)のセットからインターフェース概念を考案した。
提案結果を比較すると、基本的な要件(特に初期校正、プロアクティブプロンプト、応答フラグメントの直接操作)への収束と、多層サポートシステムの概要を示す補完的なコントリビューションの両方が明らかになる。
コンピュータサイエンスチームは、信頼性インジケータ、明示的なソース、長期会話のためのコンテキスト管理といったメカニズムを通じて、予測可能性、ナビゲート可能性、信頼を強調する構造的な足場を主に作り出した。
インダストリアルデザインチームは、経験的な足場、ペーシング、注意誘導、マルチモーダリティ、積極的エージェンシー、ステップバイステップのレスポンスフロー、フォーカスモード、アシスタントのような統合を強調した。
我々はこれらの知見を、チャット中心のモデルを超えて認知的にアクセス可能なGenAIインタラクションの設計空間を拡大する二層足場フレームワークに合成し、専門的洗練、技術的実現可能性、および経験的検証をユーザに提供する。
関連論文リスト
- Unleashing Multimodal Large Language Models for Training-free HOI Detection in the Wild [49.77540427384148]
本稿では,基礎モデルの汎用的マルチモーダル推論能力を野生でのHOI検出に伝達する,訓練不要なエージェント型フレームワークであるAgenHoIを提案する。
不完全な相互作用発見と複雑な場面におけるあいまいな局所化の課題に対処するために,2つの重要なメカニズムを導入する。
AgentHOIは、リアルタイム設定において、最先端の教師付きおよび弱教師付きメソッドよりも優れたパフォーマンスを実現する。
論文 参考訳(メタデータ) (2026-07-15T14:30:20Z) - Agentic Reasoning for Large Language Models [122.81018455095999]
推論は推論、問題解決、意思決定の基礎となる基本的な認知プロセスである。
大規模言語モデル(LLM)は、クローズドワールド設定では強力な推論能力を示すが、オープンエンドおよび動的環境では苦労する。
エージェント推論は、連続的な相互作用を計画し、行動し、学習する自律的なエージェントとしてLLMを解釈することでパラダイムシフトを示す。
論文 参考訳(メタデータ) (2026-01-18T18:58:23Z) - The Path Ahead for Agentic AI: Challenges and Opportunities [4.52683540940001]
この章では、複雑な環境で自律的に動作するエージェントAIシステムの出現について考察する。
我々は、統計モデルからトランスフォーマーベースのシステムへのアーキテクチャの進歩を辿り、エージェントの振る舞いを可能にする能力を識別する。
既存の調査とは異なり、私たちは、言語理解から自律的な行動へのアーキテクチャの移行に注目し、デプロイ前に解決しなければならない技術的ギャップを強調します。
論文 参考訳(メタデータ) (2026-01-06T06:31:42Z) - Evaluating Node-tree Interfaces for AI Explainability [0.5437050212139087]
本研究では,ノードツリーインタフェースとチャットボットという,2つの異なるAIインターフェースを用いたユーザエクスペリエンスを評価する。
我々のノードツリーインタフェースは、AI生成した応答を階層的に整理された対話的なノードに視覚的に構造化する。
この結果から,構造化された可視化と会話形式を切り替えることのできるAIインターフェースが,AIシステムにおける透明性とユーザ信頼性を著しく向上させる可能性が示唆された。
論文 参考訳(メタデータ) (2025-10-07T20:48:08Z) - A Survey on Cloud-Edge-Terminal Collaborative Intelligence in AIoT Networks [49.90474228895655]
クラウドエッジ端末協調インテリジェンス(CETCI)は、モノの人工知能(AIoT)コミュニティにおける基本的なパラダイムである。
CETCIは、分離されたレイヤ最適化からデプロイ可能なコラボレーティブインテリジェンスシステムに移行する、新興のAIoTアプリケーションで大きな進歩を遂げた。
本調査では、基礎アーキテクチャ、CETCIパラダイムのテクノロジの実現、シナリオについて解説し、CISAIOT初心者向けのチュートリアルスタイルのレビューを提供する。
論文 参考訳(メタデータ) (2025-08-26T08:38:01Z) - Co-CoT: A Prompt-Based Framework for Collaborative Chain-of-Thought Reasoning [0.0]
我々は,人間中心の説明可能性の向上とAI利用の責任を負うInteractive Chain-of-Thought(CoT)フレームワークを提案する。
このフレームワークは推論を、ユーザが検査、修正、再実行できる明確に定義されたブロックに分解する。
倫理的透明性は、明確なメタデータ開示、組み込みバイアスチェックポイント機能、プライバシ保護による保護を通じて保証される。
論文 参考訳(メタデータ) (2025-04-23T20:48:09Z) - A Survey on (M)LLM-Based GUI Agents [62.57899977018417]
グラフィカルユーザインタフェース (GUI) エージェントは、人間とコンピュータのインタラクションにおいて、トランスフォーメーションパラダイムとして登場した。
大規模言語モデルとマルチモーダル学習の最近の進歩は、デスクトップ、モバイル、Webプラットフォーム全体でGUI自動化に革命をもたらした。
本調査では, 正確な要素位置決定, 効果的な知識検索, 長期計画, 安全に配慮した実行制御など, 重要な技術的課題を明らかにする。
論文 参考訳(メタデータ) (2025-03-27T17:58:31Z) - Conversation Routines: A Prompt Engineering Framework for Task-Oriented Dialog Systems [0.21756081703275998]
本研究では,Large Language Models (LLMs) を用いたタスク指向対話システムの開発のための,構造化されたプロンプトエンジニアリングフレームワークである Conversation Routines (CR) を紹介する。
提案したCRフレームワークは,自然言語仕様による会話エージェントシステム(CAS)の開発を可能にする。
このフレームワークの有効性を,Train Booking SystemとInteractive Ticket Copilotという2つの概念実証実装を通じて実証する。
論文 参考訳(メタデータ) (2025-01-20T17:19:02Z) - Modular Conversational Agents for Surveys and Interviews [6.019313905775819]
本稿では,AIエージェントを設計するためのモジュラーアプローチとそのパラメータ化プロセスを紹介する。
3つの実証的な研究を通して、モジュラーアプローチの適応性、一般化性、有効性を示す。
その結果,AIエージェントは完成率と応答品質を高めることが示唆された。
論文 参考訳(メタデータ) (2024-12-22T15:00:16Z) - GUI Agents: A Survey [159.7656453000263]
グラフィカルユーザインタフェース(GUI)エージェントは、人間とコンピュータのインタラクションを自動化するためのトランスフォーメーションアプローチとして登場した。
GUIエージェントの関心の高まりと基本的な重要性により、ベンチマーク、評価指標、アーキテクチャ、トレーニングメソッドを分類する総合的な調査を提供する。
論文 参考訳(メタデータ) (2024-12-18T04:48:28Z) - Interactive Natural Language Processing [67.87925315773924]
対話型自然言語処理(iNLP)は,NLP分野における新しいパラダイムとして登場した。
本稿では,iNLPの概念の統一的定義と枠組みを提案することから,iNLPに関する包括的調査を行う。
論文 参考訳(メタデータ) (2023-05-22T17:18:29Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。