論文の概要: LLM-Evolved Pattern Generators for Optimal Classical Planning
- arxiv url: http://arxiv.org/abs/2606.02438v1
- Date: Mon, 01 Jun 2026 16:10:20 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-06-02 21:34:32.489668
- Title: LLM-Evolved Pattern Generators for Optimal Classical Planning
- Title(参考訳): 最適古典計画のためのLLM型パターン生成装置
- Abstract要約: 本稿では,A*探索の最適性を保証するために,設計によって許容されるドメイン依存ミスを学習するための最初の手法を提案する。
進化的プログラム合成フレームワークを用いて、各ドメインに対して、そのドメイン内の任意のタスクに対してパターンコレクションを生成するプログラムを取得し、その結果のパターンを飽和コストによって許容的に組み合わせる。
- 参考スコア(独自算出の注目度): 2.432409923443071
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Learned heuristics have recently become a competitive alternative to traditional domain-independent heuristics for satisficing planning. Existing approaches, however, focus on improving search guidance rather than guaranteeing admissibility, which makes them unsuitable for optimal classical planning. We present the first method for learning domain-dependent heuristics that are admissible by design and thus preserve the optimality guarantees of A* search. Instead of learning a direct mapping from states to heuristic values, we learn to construct abstractions that induce admissible heuristics. We use an LLM-driven evolutionary program-synthesis framework to obtain, for each domain, a program that produces a pattern collection for any task in that domain, and we combine the resulting patterns admissibly via saturated cost partitioning. Empirically, the learned programs encode interpretable domain-specific insights, run with negligible overhead at test time and yield heuristics that match the coverage of state-of-the-art domain-independent baselines on several domains while evaluating each state substantially faster.
- Abstract(参考訳): 学習されたヒューリスティックスは、最近、満足な計画のために伝統的なドメインに依存しないヒューリスティックの代替となる。
しかし、既存のアプローチでは、許容性を保証するのではなく、検索指導の改善に重点を置いているため、最適な古典的計画には適さない。
本稿では,設計によって許容されるドメイン依存ヒューリスティックを学習し,A*探索の最適性を保証するための最初の手法を提案する。
状態からヒューリスティックな値への直接マッピングを学ぶ代わりに、許容可能なヒューリスティックを誘導する抽象化を構築することを学ぶ。
我々はLLM駆動の進化的プログラム合成フレームワークを用いて、各ドメインに対して、そのドメイン内の任意のタスクに対してパターンコレクションを生成するプログラムを取得し、その結果のパターンを飽和コスト分割によって許容的に組み合わせる。
経験的に、学習プログラムは解釈可能なドメイン固有の洞察を符号化し、テスト時に無視可能なオーバーヘッドで実行し、複数のドメインにおける最先端のドメインに依存しないベースラインのカバレッジに匹敵するヒューリスティックをもたらす。
関連論文リスト
- LLM-Evolved Domain-Independent Heuristics for Symbolic AI Planning [2.9864637081333085]
ヒューリスティック検索は、象徴的なAI計画において支配的なパラダイムである。
ヒューリスティック検索は、象徴的なAI計画において支配的なパラダイムである。
ヒューリスティック検索は、象徴的なAI計画において支配的なパラダイムである。
論文 参考訳(メタデータ) (2026-05-28T09:14:39Z) - Generating Robust Portfolios of Optimization Models using Large Language Models [27.600634702684733]
我々は最適化モデルの生成と評価を行う新しい方法を開発した。
ポートフォリオが人間の好みによく適合していることを示す理論的保証を提供する。
範囲最適化モデリングタスクにおける高い性能を示す。
論文 参考訳(メタデータ) (2026-05-26T13:30:43Z) - Hierarchical Task Network Planning with LLM-Generated Heuristics [45.222898125439286]
大規模言語モデル(LLM)がHTN計画に有効な探索アルゴリズムを生成できるかどうかを検討する。
LLMは最高のHTNプランナのカバレッジとほぼ一致し、共有問題の83%で検索の労力を大幅に削減した。
論文 参考訳(メタデータ) (2026-05-08T13:14:31Z) - Interaction-Grounded Learning for Contextual Markov Decision Processes with Personalized Feedback [59.287761696290865]
本稿では,個人化されたフィードバックを伴って,文脈的マルコフ決定プロセス(MDP)のサブ線形後悔保証を実現する計算効率の高いアルゴリズムを提案する。
提案手法の有効性を,合成エピソードMDPと実世界のユーザ予約データセットの両方を用いた実験を通じて,マルチターンインタラクションからパーソナライズされた目的を学習する際の有効性を示す。
論文 参考訳(メタデータ) (2026-02-09T06:29:54Z) - Classical Planning with LLM-Generated Heuristics: Challenging the State of the Art with Python Code [6.88204255655161]
大規模言語モデル(LLM)は、計画タスクの詳細な定義を伴っても、確実に計画に失敗する。
サイズが大きくなるような配布外タスクであっても、LCMを使って正確な計画を生成する方法を示す。
論文 参考訳(メタデータ) (2025-03-24T15:50:20Z) - LLM-Generated Heuristics for AI Planning: Do We Even Need Domain-Independence Anymore? [87.71321254733384]
大規模言語モデル(LLM)は、特定の計画問題に適した計画手法を生成することができる。
LLMは、いくつかの標準IPCドメインで最先端のパフォーマンスを達成することができる。
これらの結果がパラダイムシフトを意味するのか、既存の計画手法をどのように補完するかについて議論する。
論文 参考訳(メタデータ) (2025-01-30T22:21:12Z) - Realistic Unsupervised CLIP Fine-tuning with Universal Entropy Optimization [101.08992036691673]
本稿では,未知のクラスにおける配布外サンプルの存在を考慮し,教師なしの微調整シナリオについて考察する。
特に,分布外検出と既知のクラスに関連するインスタンスの認識を同時に強化することに注力する。
我々はUniversal Entropy Optimization(UEO)と呼ばれるシンプルで効率的で効果的なアプローチを提案する。
論文 参考訳(メタデータ) (2023-08-24T16:47:17Z) - Efficient Model-Free Exploration in Low-Rank MDPs [76.87340323826945]
低ランクマルコフ決定プロセスは、関数近似を持つRLに対して単純だが表現力のあるフレームワークを提供する。
既存のアルゴリズムは、(1)計算的に抽出可能であるか、または(2)制限的な統計的仮定に依存している。
提案手法は,低ランクMPPの探索のための最初の実証可能なサンプル効率アルゴリズムである。
論文 参考訳(メタデータ) (2023-07-08T15:41:48Z) - Randomized Adversarial Style Perturbations for Domain Generalization [49.888364462991234]
本稿では,RASP(Randomized Adversarial Style Perturbation)と呼ばれる新しい領域一般化手法を提案する。
提案アルゴリズムは, ランダムに選択されたクラスに対して, 対角方向の特徴のスタイルを乱し, 予期せぬ対象領域で観測される予期せぬスタイルに誤解されないよう, モデルを学習させる。
提案アルゴリズムは,様々なベンチマークによる広範な実験により評価され,特に大規模ベンチマークにおいて,領域一般化性能が向上することを示す。
論文 参考訳(メタデータ) (2023-04-04T17:07:06Z) - Cluster, Split, Fuse, and Update: Meta-Learning for Open Compound Domain
Adaptive Semantic Segmentation [102.42638795864178]
セマンティックセグメンテーションのための原則的メタラーニングに基づくOCDAアプローチを提案する。
対象ドメインを複数のサブターゲットドメインに,教師なしの方法で抽出した画像スタイルでクラスタリングする。
その後、メタラーニングがデプロイされ、スタイルコードに条件付きでサブターゲットドメイン固有の予測を融合するように学習される。
モデルに依存しないメタラーニング(MAML)アルゴリズムにより,モデルをオンライン更新することを学び,一般化をさらに改善する。
論文 参考訳(メタデータ) (2020-12-15T13:21:54Z) - Meta-Learning for Domain Generalization in Semantic Parsing [124.32975734073949]
セマンティック解析のためにゼロショットドメインをターゲットにしたメタラーニングフレームワークを使用する。
ゼロショット解析の仮想トレインと非結合領域からのテストセットをシミュレートするモデル非依存のトレーニングアルゴリズムを適用した。
論文 参考訳(メタデータ) (2020-10-22T19:00:36Z) - Universal Source-Free Domain Adaptation [57.37520645827318]
ドメイン適応のための新しい2段階学習プロセスを提案する。
Procurementの段階では、今後のカテゴリギャップやドメインシフトに関する事前知識を前提とせず、将来的なソースフリーデプロイメントのためのモデルの提供を目標としています。
Deploymentの段階では、幅広いカテゴリギャップをまたいで動作可能な統一適応アルゴリズムを設計することを目的としている。
論文 参考訳(メタデータ) (2020-04-09T07:26:20Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。