論文の概要: U-Define: Designing User Workflows for Hard and Soft Constraints in LLM-Based Planning
- arxiv url: http://arxiv.org/abs/2605.02765v1
- Date: Mon, 04 May 2026 16:05:40 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-05-05 20:33:50.39668
- Title: U-Define: Designing User Workflows for Hard and Soft Constraints in LLM-Based Planning
- Title(参考訳): U-Define: LLM計画におけるハードおよびソフト制約のためのユーザワークフロー設計
- Abstract要約: 自然言語で制約を定義するシステムであるU-Defineを提案する。
ユーザ定義の制約型は、有用性、パフォーマンス、満足感の知覚を改善する。
- 参考スコア(独自算出の注目度): 25.669401461551058
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: LLMs are increasingly used for end-user task planning, yet their black-box nature limits users' ability to ensure reliability and control. While recent systems incorporate verification techniques, it remains unclear how users can effectively apply such rigid constraints to represent intent or adapt to real-world variability. For example, prior work finds that hard-only constraints are too rigid, and numeric flexibility weights confuse users. We investigate how interaction workflows can better support users in applying constraints to guide LLM-generated plans, examining whether abstracting strictness into high-level types (i.e., hard and soft) paired with distinct verification mechanisms helps users more reliably express and align intent. We present U-Define, a system that lets users define constraints in natural language and categorize them as either hard rules that must not be violated or soft preferences that allow flexibility. U-Define verifies these types through complementary methods: formal model checking for hard constraints and LLM-as-judge evaluation for soft ones. Through a technical evaluation and user studies with general and expert participants, we find that user-defined constraint types improve perceived usefulness, performance, and satisfaction while maintaining usability. These findings provide insights for designing flexible yet reliable constraint-based workflows.
- Abstract(参考訳): LLMはエンドユーザのタスクプランニングにますます使われていますが、ブラックボックスの性質によって信頼性とコントロールの確保が制限されます。
近年のシステムでは検証手法が採用されているが,そのような厳密な制約を適用して意図を表現したり,現実の変動に適応する方法については定かではない。
例えば、事前の作業では、ハードリミテッドな制約が厳しすぎることや、数値的な柔軟性の重みがユーザを混乱させます。
インタラクションワークフローは,LSM生成計画の指針として制約を適用し,厳密性を高レベルなタイプ(ハードとソフト)に抽象化するかどうかを検証することによって,ユーザがより確実に表現し,意図を整合させるのに役立つかを検討する。
U-Defineは、ユーザーが自然言語で制約を定義し、それを違反してはいけない厳しいルールまたは柔軟性を許容するソフトな嗜好に分類するシステムである。
U-Define はこれらの型を補足的手法により検証する: 厳密な制約に対する形式的モデル検査とソフトな制約に対する LLM-as-judge 評価である。
ユーザ定義制約型は, ユーザビリティを維持しつつ, 有用性, 性能, 満足度の向上を図っている。
これらの知見は、柔軟で信頼性の高い制約ベースのワークフローを設計するための洞察を提供する。
関連論文リスト
- From Profiling to Synthesis: Benchmarking Implicit Behavioral Alignment in Personalized LLM Agents [56.187590188698955]
大規模言語モデルは、ますます有能な自律エージェントを可能にしてきたが、そのようなエージェントを実用的に有効にするためには、パーソナライズが不可欠である。
最近のベンチマークではエージェントのパーソナライゼーションの評価が始まっているが、それらは主に静的な選好スナップショット、固定されたインタラクションログ、あるいは事前に定義されたユーザプロファイルに対する質問応答に依存している。
縦断的相互作用履歴から構築した暗黙的行動アライメントのベンチマークであるIBA-Benchを紹介する。
IBA-Agentは、広範囲な検索と軌道レベルのアライメントを通じて競合する優先順位を調整するエージェントフレームワークである。
論文 参考訳(メタデータ) (2026-08-03T12:52:04Z) - AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints [65.27107190916512]
AdaPlanBenchは,Large Language Model (LLM)エージェントが適応的に計画し,段階的に明らかにされた制約の下で再計画できるかどうかを評価するための,インタラクティブなベンチマークである。
AdaPlanBenchは307の家庭用タスクに基づいて構築されている。
二重制約下での適応計画は依然として困難であり、最良のモデルは67.75%の精度にしか達していない。
論文 参考訳(メタデータ) (2026-06-04T02:47:29Z) - Learning Transferable Latent User Preferences for Human-Aligned Decision Making [4.1789291746171715]
ヒューマンアラインな意思決定には、明示された目標と潜伏したユーザの好みの両方を考慮しなければならない。
本稿では,CLIPR(Conversational Learning for Inferring Preferences and Reasoning)を紹介する。
3つのデータセットの評価とユーザスタディによると、CLIPRはアライメントの改善と推論コストの削減において、既存の手法を一貫して上回っている。
論文 参考訳(メタデータ) (2026-05-12T19:32:10Z) - Learning and Enforcing Context-Sensitive Control for LLMs [48.58004364546273]
本稿では,大規模言語モデルの相互作用から文脈依存制約を自動的に学習するフレームワークを提案する。
実験により,本手法は,LLM (1Bパラメータ) の学習と生成を完全制約付きで行うことができることを示した。
論文 参考訳(メタデータ) (2026-04-12T14:50:03Z) - Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning [52.03884701766989]
オフライン強化学習(RL)アルゴリズムは、通常、アクション選択に制約を課す。
本稿では,Bellmanターゲットにおける行動選択を,データセットアクションの近傍の結合に制限する新しい地区制約を提案する。
我々は,この制約を満たす目標動作を用いてQ学習を行うための,単純で効果的なアルゴリズムであるAdaptive Neighborhood-Constrained Q Learning(ANQ)を開発した。
論文 参考訳(メタデータ) (2025-11-04T13:42:05Z) - DiCoFlex: Model-agnostic diverse counterfactuals with flexible control [0.0]
モデルに依存しない条件付き生成フレームワークであるDiCoFlexを提案する。
DiCoFlexは、妥当性、多様性、近接性、制約の順守という点で、既存の手法よりも優れていることを示す。
論文 参考訳(メタデータ) (2025-05-29T17:37:47Z) - Semantic Integrity Constraints: Declarative Guardrails for AI-Augmented Data Processing Systems [39.23499993745249]
セマンティッククエリにおけるLLM出力に対する正当性条件を指定・強制するためのセマンティック整合性制約(SIC)を導入する。
SICは、従来のデータベース整合性制約をセマンティックセッティングに一般化し、グラウンド、サウンドネス、排他といった一般的なタイプの制約をサポートする。
本稿では,SICをクエリ計画と実行環境に統合するシステム設計について述べる。
論文 参考訳(メタデータ) (2025-03-01T19:59:25Z) - Flexible Counterfactual Explanations with Generative Models [1.3499500088995464]
本稿では, 対物テンプレートを組み込んだフレームワークであるFlexible Counterfactual Explanationsを紹介する。
FCEGANは、モデルの再トレーニングや追加の最適化を必要とせずに、ユーザー定義の制約と説明を一致させる。
経済的および医療的データセットにわたる実験により、FCEGANは対実的説明の有効性を著しく改善することが示された。
論文 参考訳(メタデータ) (2025-02-24T20:01:04Z) - Optimizing Large Language Models for Dynamic Constraints through Human-in-the-Loop Discriminators [0.0]
大規模言語モデル(LLM)は、最近、様々な現実世界のアプリケーションにまたがる印象的な機能を実証した。
本稿では,LLMがシステムインターフェースと相互作用し,制約概念を要約し,性能指標を継続的に最適化するフレキシブルなフレームワークを提案する。
我々のフレームワークは、人間の識別器で7.78%のパスレート、LSMベースの識別器で6.11%のパスレートを達成した。
論文 参考訳(メタデータ) (2024-10-19T17:27:38Z) - From Instructions to Constraints: Language Model Alignment with
Automatic Constraint Verification [70.08146540745877]
NLPタスクの共通制約を調査し、それらの引数の型に基づいて、それらを3つのクラスに分類する。
本稿では,ACT(ConsTraintsのアラインメント)という統合フレームワークを提案し,制約に適応したユーザアライメントのための監視信号を自動的に生成する。
論文 参考訳(メタデータ) (2024-03-10T22:14:54Z) - Flexible and Robust Counterfactual Explanations with Minimal Satisfiable
Perturbations [56.941276017696076]
我々は、最小満足度摂動(CEMSP)を用いた対実的説明法という概念的に単純だが効果的な解を提案する。
CEMSPは、意味論的に意味のある正常範囲の助けを借りて、異常な特徴の値を変更することを制限している。
既存の手法と比較して、我々は合成データセットと実世界のデータセットの両方で包括的な実験を行い、柔軟性を維持しつつ、より堅牢な説明を提供することを示した。
論文 参考訳(メタデータ) (2023-09-09T04:05:56Z) - Resilient Constrained Learning [94.27081585149836]
本稿では,学習課題を同時に解決しながら,要求に適応する制約付き学習手法を提案する。
我々はこの手法を、その操作を変更することで破壊に適応する生態システムを記述する用語に因んで、レジリエントな制約付き学習と呼ぶ。
論文 参考訳(メタデータ) (2023-06-04T18:14:18Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。