MaLiang-Harness: A Programmable Path to Image and Video Generation [131.3] 本稿では,MLLMによる視覚生成を永続的な構築・検査・修正プロセスにまとめるフレームワークであるMaLiang-Harnessを紹介する。
我々は,MaLiang-IBench上の11個の強力なクローズソースMLLMとMaLiang-VBench上の4つのMLLMを評価し,生成成功,視覚的品質,計算コストを測定した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:48:06 GMT)
Joint and Cross-Modal Video-Audio Generation and Editing: A Unified Formulation and Design Taxonomy [121.8] ビデオとオーディオは共に認識されるが、ほとんどの生成モデルはそれらを分離して扱う。
2つのモダリティを共同でモデル化し、一方を他方から生成するか、あるいはそれらを結合的に編集する方法について検討する。
統一された定式化は、音声-視覚対上の単一分布上で定義された3つの問題として、ジョイント生成、クロスモーダル生成、ジョイント編集をキャストする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:57:37 GMT)
What if automating AI R&D triggers an intelligence explosion? [117.6] AIシステムは、数年以内にほとんどのAI R&D作業を自動化する。
もしこれがインテリジェンス爆発を引き起こすなら、AIのメリットを劇的に推し進めるだけでなく、極端なリスクをもたらす可能性がある。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:13:31 GMT)
In-Context Learning for Robots: Methods and Applications [117.4] 汎用ロボットは、新しいタスクが何を必要としているかを推測し、その理解を適切な物理的行動に変換する必要がある。
ロボットのためのインコンテキスト学習(ICL)はこのプロセスをサポートし、デモとインタラクションを使用して、デプロイ中に固定されたニューラルネットワークパラメータと既存のコンピテンスを指示する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:34 GMT)
SPIDER: Multi-Layer Semantic Token Pruning and Adaptive Sub-Layer Skipping in Multimodal Large Language Models [108.5] マルチレイヤのアンダーラインtextbfSemanticビジュアルトークン underlinetextbfPrununderlinetextbfIng と aunderlinetextbfDaptive sub-layunderlinetextbfER スキップ機構を統合したトレーニングフリーフレームワーク textbfSPIDER を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:54:41 GMT)
Verifiable Visual Rewards Transfer from Synthetic Scenes to Natural Prompts [86.8] 我々は、強化学習(RLVVR)の報酬として、ビジュアル・リワード(VVR)を用いる。
32以上の制約型に10,000のタスクを持つVVRBenchと、720以上の複雑なタスクを持つVVRBenchをリリースしています。
VVRスコアを強化学習(RLVVR)の報酬として使用すると、VVRBench上の安定3.5の精度が2.8%から28.3%に上昇し、一貫した使い易い一般化を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:07:49 GMT)
WAM-OPD: Sharpening World Action Models via On-Policy Distillation [84.1] 事前訓練された世界行動モデル(WAM)は、多様なロボット操作タスクにまたがる汎用機能を提供する。
WAMのオンライン蒸留(OPD)とWAM-OPDの導入について検討する。
We show WAM-OPD improves target-task performance while maintaining near-itial performance on tasks excludeed by adapt。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:56:23 GMT)
Learning What to Recall: Adaptive Multi-Cue Episodic Memory for World Models [83.0] 本稿では,将来認識型予測監視からエピソードリコールを学習するフレームワークであるFuture-Aware Recall (FAR)を提案する。
FARは、リコールされたコンテキストの条件付きログ類似度による予測ユーティリティを計測する。
キュー固有の関連性を学び、時間、ポーズ、ビジョン、オーディオなどの利用可能な検索キューを自動的に決定し、クエリ毎に信頼する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:07:39 GMT)
On the spectral properties of generative denoiser Jacobians [81.0] 生成的復号化モデルは、ディープニューラルネットワークの復号器を訓練して複雑な分布からサンプルを学び、ノイズで破損したサンプルからクリーンなデータを復元する。
我々は、生成的認知モデルの違いを特徴づける手段として、デノイザー・ヤコビアンのスペクトルを分析した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:09:31 GMT)
On the Relation Between Interval Regret and Dynamic Regret [72.2] インターバルな後悔とダイナミックな後悔が2つの代表的なパフォーマンス指標として紹介されている。
最適間隔後悔を持つアルゴリズムは、自動的に最適ダイナミック後悔を達成するべきであると広く予想されている。
局所的な適応性を利用して最適な動的後悔を得る方法を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:40:56 GMT)
TANGO: Watermarking Masked Diffusion Language Models in Token Pairs [64.8] Masked-diffusion言語モデルは、マスクされた位置を平行に、固定順序で埋める。
TANGOは、マスク付き拡散言語モデルの透かしで、新しいトークンを、既にマスクされていない近くのトークンにキーする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:08:33 GMT)
Knowing When Thinking Is Not Enough: Teaching Small Reasoning Models to Reason Beyond Their Parametric Knowledge [63.8] テスト時間計算のスケールは、言語モデル推論を改善する強力な方法である。
自己閉じ込めは、既に現在の状態から到達可能な解に確率質量を大半を凝縮することを示す。
選択的なクエリフレームワークであるFlyByを導入し、まず4Bと8Bの変種をトレーニングする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:07:24 GMT)
From Sharp Eyes to Expert Mind: Internalizing Expert Knowledge in MLLMs for Tampered Text Detection [62.7] Expert Knowledge Internalization (EKI)は、法医学の専門知識をMLLM(Multimodal Large Language Models)に伝達する2段階のフレームワークである。
EKIは、既存のエキスパートモデルベースやMLLMベースの手法よりも最先端の性能と強力な一般化を実現している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:20:22 GMT)
Persona Following Is Not Selective Control: The Neutrality Gap in LLM User Simulation [62.7] 大規模言語モデルにおける選択制御の体系的失敗を同定する。
ターゲット属性を変更することで、特定されていない非ターゲット属性に対する応答もシフトする。
非ターゲット属性を未特定のまま残したり、指向性や中立性を宣言する3状態診断を運用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:34:21 GMT)
AutoDataBench: Can Agents Write the Data That Feeds the Self-Improvement Loop? [62.4] エージェントがそのようなタスクを書く能力の現在の評価は、エージェントが生成したもののトレーニング後にモデルがどのように機能するかを測定する。
既存の評価では、個々のタスクがデータパイプラインの受け入れ基準を満たすかどうかを問わない。
AutoDataBenchは、自律データ合成のためのエージェントの能力を直接測定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:24:21 GMT)
What Makes World Action Models Generalize? An Empirical Study of Test-Time Future Modeling [60.3] 世界行動モデル(WAM)は、エントレーニング中の行動と共に未来を予測する。
WAMは、分散処理タスクにおいて明示的なタスクと一致するが、もともとWAMを動機付けていた一般化の利点を保たないことがわかった。
我々は、将来のモデリングを完全なノイズ付きビデオトークンの1つの前方通過に単純化するtextbfSimple-WAMを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:56:57 GMT)
FlowTool: Controlling Tool Parameter in Image Retouching via Flow Matching [59.4] FlowToolは、入力イメージとユーザインストラクションに基づいて、高品質なツールパラメータの分散をモデル化するフレームワークである。
FlowToolを2段階の教師付きフローマッチングカリキュラムでトレーニングし、その後に報酬ベースのポストトレーニングを実施します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:28:05 GMT)
Fundamental Limits of Transferability and Equivariance in Algebraic Signal Models I: Finite Dimensions [54.6] 信号モデル間の準同型を通した代数学における転移可能性の基本的限界について検討する。
すべての準同型が一致類上の非制約ブロックに分解されることを証明する。
フィルタ導波路がスペクトル欠陥を修復する方法を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:44:40 GMT)
JRDB-AVR: An Active Visual Reasoning Benchmark for Embodied Agents in Real-World Environments [51.1] 具体化された視覚的推論のシナリオでは、質問に答えるために必要な証拠は時間、視点、相互作用するオブジェクトに分散する可能性がある。
我々は,構造化質問生成エンジンを用いて,既存の実世界のJRDBロボットデータから得られたベンチマークであるJRDB-AVRを紹介する。
また, 明示的な観測地上グラフに基づく世界モデルを維持する, 参照能動推論エージェントであるJRDB-AVR-Agentについても紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:30:11 GMT)
Measuring Collapse and Correction in Homogeneous-Panel LLM Debate [51.0] マルチエージェント大言語モデル(LLM)の議論は、最終回答が改善するかどうかによってしばしば評価されるが、運動は必ずしも改善されない。
標準的な最終精度評価は、これらの反対のメカニズムを詳述する。
複数選択質問(MCQ)に関する同質な議論のための監査可能なプロトコルを導入し、各実行を、崩壊、修正、オンセット、署名された介入ユーティリティよりも、遷移台帳として記録する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:31:19 GMT)
Quantile Head for Vision-Language-Action Models [51.0] 我々は、中央値と正のギャップを予測し、1つの前方通過で順序付けられた境界作用量子化を形成するQuantile Headを開発する。
この量的目的は、中央値と正のギャップを予測し、1つの前方通過で順序付けられた辺りのアクション量子化を形成するQuantile Headの設計を導く。
実験の結果, この共同管理型中央値政策は, 比較手法の平均成功率が最も高いことがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:40:10 GMT)
Riccati State Space Models: Non-iterative Parallelization for Nonlinear Sequence Modeling [51.0] 状態空間モデル(SSM)は、アフィン状態の更新が合成の下でクローズされるため、効率的なシーケンス処理を実現する。
リカレントモデルはよりリッチで状態依存のダイナミクスを提供するが、一般的にこの構成構造を失う。
我々は、状態依存の非線形力学は正確に構成可能なままに設計できるのかと問う。
非線形SSMである RiccatiSSM を導入し、各状態は入力条件付き Riccati 微分方程式に従う。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:40:55 GMT)
VCN-Bench: A Video-Contextualized Navigation Benchmark for Spatial Reasoning over Prior Visual Experience [51.0] 本稿では,MLLMの視覚経験よりも閉ループ空間推論を探索するためのベンチマークであるVCN-Benchを紹介する。
Matterport3Dをベースとして、VCN-Benchは5つのインストラクションタイプ、100kのトレーニングエピソード、1,250の評価エピソードを含む。
実験では、航法性能の制限、実質的な航法解像度と航法距離、正確な航法識別後にも頻繁な航法障害が示される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:12:56 GMT)
mmHRI: Towards Privacy-Preserving Human-Robot Interaction with Millimeter-Wave Radar [50.7] ミリ波(mmWave)レーダーは、画像の特定なしにプライバシー障壁を通して人間の動きを感知することができる。
mmHRIは、mmWaveレーダー誘導型プライバシー保護HRIを実現する最初の多言語ロボット操作フレームワークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:24:33 GMT)
WorldPlay2: Extending Real-Time Interactive World Models in Control and Horizon [50.5] インタラクティブな世界モデルは、多目的制御にリアルタイムで応答し、長い水平一貫性を維持する必要がある。
圧縮メモリと安定蒸留の共設計と、分解されたハイブリッド制御インタフェースを結合した対話型世界モデルWorldPlay2を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:28:25 GMT)
Dr.Credit: Rubric-Grounded Process Credit Assignment for Deep Research Agents [50.3] ルーブリックグラウンドのクレジットは、最終回答の評価とプロセスの監督のための共有リファレンスとしてタスク要求を使用する。
Dr.Creditは、深い研究エージェントのためのRLフレームワークで中間ツールターンを監督するために、ルーリックグラウンドのクレジットを使用している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:43:12 GMT)
Sol-H3: Recursive Self-Improvement for MiniMax-H3 Inference Acceleration on Sol-Engine across Cloud and Edge [50.0] MiniMax-H3は、高機能で実運用レベルのオープンソースモデルである。
本稿では,効率的なアルゴリズム設計と最適化された演算子実装を統合したフルスタック推論パイプラインを提案する。
オーディオ付き5秒のビデオは、8xGB200ノードでリアルタイムより3.5倍高速に生成され、1つのDGX Sparkで1分以内のメモリ常駐が可能である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:15:07 GMT)
Hardware-Aware Features for CUTLASS Kernel Selection [47.2] 本稿では,CUTLASSカーネル選択のためのハードウェア認識表現を提案する。
我々は490万のCUTLASSカーネルのデータセットを構築し、各問題内の候補をランク付けするために勾配ブーストおよびニューラルラーニング・ツー・ランクのモデルを訓練する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:39:31 GMT)
PSM: Dataset Distillation Based on Precise Statistical Matching by Difficulty [47.0] 本稿では,精度の高い統計的マッチング(PSM)を提案する。
PSMはGlobal Precision Score(GPS)を使用して画像の難易度を推定し、各クラス内のサンプルをランク付けし、各クラスをIPC難易度グループに分割する。
PSMは蒸留試料の難易度の範囲を広げ、ほとんどの評価条件において下流性能を向上させる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:43:52 GMT)
DORA: Divergence-Oriented Data-Relay Algorithm for Partially Connected Robot Teams [46.8] 本稿では,発見のみではなく,情報の価値によるコミュニケーションをチームに提供する分散指向型データリレーアルゴリズムを提案する。
本結果から,従来の時間ベースの通信スケジューリング方式よりも最大74.8%MRT分解能が向上することが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:50:38 GMT)
Reduce, Then Encode: Multiscale Volumetric Reduction for 2D Foundation Models in Brain MRI [46.5] 脳構造磁気共鳴イメージング(sMRI)のための専用の3Dプリトレーニングに代わる実用的2D基礎モデル
既存のメソッドは通常、スライスを独立してエンコードし、その後機能を統合します。
基礎モデル符号化の前に, (D) スライスから (M D) 補完的な2次元成分へ各解剖学的ビューを圧縮するマルチスケールボリュームリダクション (MVR) を導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:25:29 GMT)
On-Policy or Off-Policy Learning? A Systematic Study of Distillation Dynamics [46.4] 制御型強弱蒸留におけるロールアウトポリシーの効果について検討した。
弊社の結果は、オンラインのロールアウトが本質的に好まれる、という見方に挑戦する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:20:42 GMT)
StateGuard: Analytical-State Management with Validity-Aware Intervention for Long-Horizon Data Agents [46.3] StateGuardは、長期データエージェントの分析的状態妥当性管理フレームワークである。
StateGuardは、依存性による下流エラーの伝搬を低減しつつ、データエージェントのパフォーマンスを一貫して改善することを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:14:20 GMT)
LLMs for Executable Multi-Agent System Specification Generation [46.3] genRTECは、自然言語記述から実行可能なMAS仕様を生成する方法である。
さまざまなMAS仕様にまたがるgenRTECの実証評価を行った。
その結果,genRTECは推論効率を損なうことなく,高い予測精度で実行可能なMAS仕様を構築していることがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:43:43 GMT)
MiCo: Mutual Information Coverage Optimization through Semantic Erasure Modeling for Efficient MLLM Inference [44.2] マルチモーダル大言語モデル(MLLM)は,多モーダル理解において顕著な性能を示した。
大量の視覚トークンを処理すれば 計算コストが高くなります
トレーニング不要な2段階プルーニング手法であるMiCoを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:09:20 GMT)
Don't Throw Away the Tail: Action Upcycling for Policy Acceleration [43.9] Action Upcyclingは、モデル内部にアクセスしたり、追加のサンプルを描画することなく、ポリシーが破棄するアクションを再利用する、トレーニング不要のアルゴリズムである。
複数のVision-Language-Action Model (VLA) や World Action Model (WAM) を通じて、成功率を損なうことなく、ポリシー呼び出しを1.2--1.7$times$で削減する。
これは、無視可能なコストでチャンクされたポリシーに適用され、数ステップのサンプリングやストリーミングアクション復号といった他のポリシーアクセラレーション手法に適用される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:13:18 GMT)
DBCF: Dual-Branch Complementary Fusion of Foundation Models for Generalized Deepfake Detection [43.6] 偽造検出モデルは 様々な領域をまたいだ一般化と 目に見えない操作に苦慮する
本稿では,相補的な事前学習表現を統合した階層型多粒度フレームワークを提案する。
提案手法は,より包括的な偽造表現を学習し,高い操作性能を実現する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:26:55 GMT)
On the Numerical Reliability of Differentiable Physics-Based Optimization for Robotic Material Manipulation [43.5] 微分物理学は、システム識別、軌道またはスキル最適化、デモ生成、ロボットまたはエンドエフェクター設計のためのロボット材料操作において、ますます使われている。
2つの物質点法(MPM)システム同定ベンチマークを用いて,これらの勾配の数値的信頼性について検討した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:03:54 GMT)
FuseReg: Regularizing Layer Fusion Mitigates the Reconstruction-Generation Gap in Representation Autoencoders [43.3] 機能選択をエンコーダ層のランダムなサブセット上でのトレーニングに置き換えるFuseRegを導入する。
DINOv3-LのImageNet-256では、1つのFuseRegデコーダがリトレーニングなしでフル、スパース、シングルレイヤのフュージョンから再構成される。
両方のステージにFuseRegを適用することで、非ガイダンスgFIDもDiT-Baseで29%削減される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:23:02 GMT)
Compress to Remember: Learning Compact Memory via On-Policy Distillation for Long Video Generation [43.3] 予測適応型コンテキスト圧縮(PACC)を提案する。
PACCは学習した圧縮機を使用して過去のフレームにまたがる情報をコンパクトなメモリトークンに集約する。
PACCをMBench上で評価し,メモリ・イベントのカバレッジと一貫性を共同で測定した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:52:57 GMT)
EvolvingAvatar: Interactive 3D Head Generation That Adapts as Conversations Unfold [42.9] EvolvingAvatarは、対話中にユーザの顔ビデオとダイアディックオーディオに適応する因果生成装置である。
InterHead-Benchは、シングルビューとデュアルビューの会話ビデオから構築された455.95時間のベンチマークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:56:07 GMT)
Two-Timescale Fine-tuning Provably Learns New Features for Two-Layer ReLU Networks [42.8] 少ないデータを持つ専門的なタスクに関する微調整済みのモデルが、現代のディープラーニングの中心である。
事前学習した重みから微調整を研究するために,ガウスのマルチインデックス設定を導入する。
2層ReLUネットワークでは,2段階のトレーニング,すなわち,隠れたものよりも外重みを無限に高速に更新することで,事前学習したものを保存しながらタスク固有の新しい特徴を学習できることが示されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:04:24 GMT)
From Attack Success to Attack Severity: Counterfactual Memory Attacks on LLM Agents [42.7] 永続メモリ攻撃は、それらが成功するかどうかによって評価されるが、成功した攻撃は、異なる下流の結果をもたらす永続状態を残すことができる。
我々は、この重症度を個別の攻撃設計目標として研究し、反実的記憶後悔(CMR)で定式化する。
MemHarmは、同一のサポートに対する評価された一般的な攻撃の中で、最も高いCMRポイント推定値を得た。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:11:56 GMT)
SOR-Nav: Search or Relocate? Context-Gated Exploration and Cross-Region Relocation for Object Navigation [42.4] SOR-Navは階層的なナビゲーションシステムで、現在の状況の探索と、より有望な到達可能な領域への放棄を明確に仲裁する。
HM3D-v1、HM3D-v2、MP3Dの完全な検証セット全体にわたって、SOR-Navは3つのベンチマークで最強に報告された成功率(SR)と成功率(SPL)を達成している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:20:52 GMT)
Long Time No See: Benchmarking VLMs for Out-of-Sight Spatiotemporal Reasoning in Egocentric Videos [42.4] 現実世界のAIシステムは、もはや見えないオブジェクトを推論する必要がある。
我々は9つの汎用・空間特化VLMをベンチマークした。
最良のモデルは、29.7%の確率とテキストのみのベースラインに対して42.2%に達する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:48:47 GMT)
TQTS-Bench: A Multi-Syntax Benchmark for Text-to-Query over Time-Series Databases [42.2] 大規模言語モデル(LLM)は、リレーショナルデータベース(TSDB)よりもはるかに高度な自然言語クエリを持つ
既存のベンチマークでは、統一されていないクエリ構文、多様なアプリケーションドメイン、TSDB固有の時間固有のクエリインテントを適切にキャプチャできない。
TQTS-BENCHは、TSDB上でのテキスト・ツー・クエリ機能評価のためのマルチシンタクス・ベンチマークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:55:40 GMT)
Long-Horizon Scaling: How Model Capabilities Shape the Returns to Computation [42.2] 2つの長期ベンチマークであるAutoLabとEdgeBenchを分析します。
パフォーマンスの開始とその後の成長は、さまざまな能力に結びついていることに気付きました。
時間を節約し、限られたスコア損失で計算するための継続ポリシーを導出します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:11:57 GMT)
When local gains fail to transfer: Frozen Earth-observation embeddings across wildfires [42.0] 凍結した地球観測の埋め込みは、ほぼ完全に1つの研究領域内で空間的に遮断されたクロスバリデーションによって判断される。
線形プローブとラベルのみを必要とするプロトコルを用いて,この数値が新しい領域の精度を予測できないことを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:35:15 GMT)
Temporal trade-offs in high-dimensional entanglement: a comprehensive noise model for optimal time-bin QKD protocols [42.0] 低次元の符号化された光子や高次元の光子を送信した方が良いだろうか?
本稿では,すべての関連するパラメータを組み込んだフレキシブルノイズモデルを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:00:28 GMT)
Solver Agent: an Agentic AI Framework for Theoretical Physics Computations Applied to F-theory Uplifts of O3-planes and S-folds [42.0] 数学と理論物理学における計算と証明のための大規模言語モデルに基づくAIフレームワークを紹介する。
我々はIIB型オリエンチフォールドの大域的F-理論アップリフトとそのS-フォールド一般化について研究する。
非アーベルゲージセクターを用いた 4 次元 $mathcalN$ コンパクト化におけるトーリック計算と 4 形式フラックス解析の方法を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:00 GMT)
DreamingGoose: Staged Distillation from Autoregressive Transformers to Bidirectional Recurrent Diffusion Language Models [42.0] 我々はQwen3の教師を1.7Bと8Bで3段階に分けて、注意なし、双方向、ゲート・デルタ・ルール拡散学習者に変換する。
言語モデリングは部分的および非分配のみを転送する。
検索を学習するすべてのモデルは、検索エピソードに現れないトークンに対して0.000のスコアを獲得します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:57:11 GMT)
Towards Mitigating Deceptive Safety Alignment in Large Reasoning Models [42.0] 大規模推論モデル (LRMs) は、最終的な答えを出す前に、強化学習 (RL) を用いて、思考の連鎖推論 (CoT) の生成を改善するために訓練される。
これは、推論トレースと最終応答が矛盾した安全信号を伝達する、偽りの安全アライメントにつながる可能性がある。
SARA(Safety-Aware Reasoning Alignment)は,安全を意識した推論と最終回答の両方に報酬を与えるRLベースの手法である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:45:10 GMT)
Hyper Algorithm Design Agent: Evolving Learnable Optimizer from Zero [41.8] 本稿では,MetaBBOの設計ループにオープンネスをコーディングタスクとして導入する。
最新のMetaBBOベースラインよりも優れた新しいバリエーションが見つかる。
この研究は、複雑な学習支援最適化アルゴリズムの設計を自動化するための最初の調査となる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:53:06 GMT)
PyroStack: A Multi-Band Spatio-Temporal Sub-Daily Dataset for Wildfires in the United States [41.7] 森林火災は生態系、大気質、人的システムに対する危険が増している。
既存のデータセットは、これらのインタラクション制御をキャプチャするために必要な解像度とカバレッジを欠いていることが多い。
ピロスタックは、アメリカ合衆国とアラスカ州にまたがる山火事と環境データの調和したイベントベースの収集を提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:48:40 GMT)
JazzSAMBA: A Synchronous and Asynchronous Multi-take Band Audio Dataset of Jazz Standards for Live Music Models [41.7] JazzSAMBAは、ドラム、ベース、ピアノ、トランペット、サックスの8人のミュージシャンによる76の標準をカバーしている。
チャート付き伴奏、コンボソース分離、フォーム対応音楽情報検索をサポートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:30:10 GMT)
Less Is More: Genetic Frame Selection for Efficient Novel View Synthesis [41.7] 本稿では、対象視点のカバレッジ、予め選択されたビューとの冗長性、画像のシャープさに基づいてフレームをスコアするレンダリングフリーなビューセレクタを提案する。
軽量スコアリングネットワークは、レンダリング、再構成、シーンごとの最適化なしに最も情報性の高いフレームを選択する。
この結果から,目的の関連性や視点間の冗長性を明確に推論することが,効率的なシーン再構築の基本的な要因であることが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:33:50 GMT)
From Input to Output: A Flexible Agent for Dual-End Interpretation of Sparse Autoencoder Features [40.9] 本稿では,SAE特徴をその活性化入力セマンティクスから介入による出力効果へのマッピングとして特徴付ける機能解釈を紹介する。
本稿では,DAFI(Dual-End Agentic Feature Interpretation)について述べる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:09:34 GMT)
AD-E2E-JEPA: A Joint-Embedding Predictive Architecture For End-to-End Autonomous Driving [40.8] 我々は、エンド・ツー・エンド・エンド・自動運転(E2EAD)において、LWM、DINOWM、JEPA-WMを含む既存の行動条件付き共同予測アーキテクチャ(JEPA)の世界モデルを評価する。
我々は、目標条件付きゼロショット計画設定を採用し、運転方針を訓練することなく、将来的な観測を目標としてこれらのモデルを評価する。
さらに、自己教師型事前訓練プロジェクターは、下流の模倣学習性能を80.2から85.4timesSに改善することを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:22:22 GMT)
From cacophony to hierarchy: a principled framework for assessing AI consciousness [40.8] AI意識に関する問題は、哲学とコンピュータ科学における最も急激な先入観の問題の1つである。
我々は、Marrの3段階の分析を、超越性に基づく機能記述の5段階の階層に拡張する。
各レベルにおいて、運用可能な指標を開発し、それらに対して現在のAIシステムを評価します。
ベイズモデルでは、理論的なクレデンスと指標的証拠を組み合わさって、システムの意識能力の全体的信条を導出する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:57:05 GMT)
Reinforcement Learning from Intermediate Renders for Image-to-Code Generation [40.7] トークンレベルのレンダリングプログレス報酬を備えたRLフレームワークIR4RLを紹介する。
我々は,画像からSVG,画像からTikZ生成へのアプローチを評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:26:35 GMT)
Natural Image Autoencoder-Based fMRI Representations for Trait and State Prediction [40.7] 本稿では,FReDについて紹介する。FReDは自然画像のみに特化してトレーニングされた凍結DCAEからfMRI表現を導出する。
特性予測では、FReDはその時間平均と対数標準偏差によってフレームワイズ表現を要約する。
状態予測では、各フレームを単一のトークンとして表現し、浅いトランスフォーマーで時間依存をモデル化する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:43:55 GMT)
Graph World Models for Constrained Epidemic Policy Planning [40.4] EpiMindは、地域ごとの制限付き疫病対策計画のためのグラフワールドモデルフレームワークである。
グラフ分解されたリカレント状態空間モデルは、地域潜在信念から共同ポリシー条件付きロールアウトを生成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:22:49 GMT)
Can AI Make Money in Crypto? Measuring the Gap from Backtests to Real Markets [40.4] 本稿では,暗号通貨市場における機械学習,強化学習,LLMベース,エージェントベーストレーディング手法の評価を行う統一ベンチマークを提案する。
バックテストと現実化のギャップを定量化し、パフォーマンスが低下し始めた時期を特定し、このギャップがAIトレーディングメソッドの主要なクラスでどのように異なるかを比較する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:52:52 GMT)
Don't Forget! Decomposing the Training Dynamics of Memorization in Language Models [40.4] 我々は、記憶されたシーケンスの損失軌跡をトレーニングやモデルパラメータよりも分解することで、記憶の微粒化を考察する。
ピキア族全体では、重複した訓練配列(リサイクリング)と稀な訓練配列(リコール)の記憶について研究する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:31:23 GMT)
A.D.A.M.O. (Agent for language-Driven Actions with Multimodal Observations): A Visual-Symbolic Framework for Virtual Humans [40.4] A.D.A.M.O. (Agent for Language-Driven Actions with Multimodal Observations)は、言語駆動型vhの視覚的象徴的フレームワークである。
A.D.A.M.O.は、エゴセントリックな視覚入力と同期されたシンボル状態を組み合わせた二重視覚シンボル世界モデルを維持している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:51:25 GMT)
The Role of Feed-Forward Layers in Transformer Dynamics [40.0] 制御理論の観点から, 変圧器におけるトークンの動的挙動について検討する。
我々の主要な理論的結果は、フィードフォワードネットワークがトークンを任意にコンセンサスに近づけることができることを証明している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:26:03 GMT)
A Unified Uncertainty Representation for Graph Neural Networks via Doubly-Spectral Stochastic Expansion [39.9] 未知ノード埋め込みをランダムグラフ信号としてモデル化する。
二重スペクトル展開は、1つの表現からの読み出しを提供する。
キャパシティ定理は、フルランクな特徴仮定の下で、制限されたサブカテゴリが任意のランダムグラフ信号のカオス係数と一致することを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:42:52 GMT)
From Perception to Integration: Revisiting the Internal Dynamics of Reasoning in Vision-Language Models [39.9] 視覚言語モデル(VLM)は単純な視覚的質問に答えることができるが、ある質問が複数の視覚的判断を必要とする場合、しばしば苦労する。
本研究では, 特徴結合, 特異性, 空間関係, アモーダル完備化の制御タスクと, それらを組み合わせた複合タスクとのギャップについて検討する。
4つのモデル、直接的な回答、隠れ状態の読み出し、および状態介入は、個々の判断を明確な推論なしで行うことができることを示している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:12:59 GMT)
DexRoam: Learning Mobile Bimanual Dexterous Manipulation from Egocentric Whole-Body Human Demonstrations [39.8] DexRoamは、人間のデモンストレーションからモバイルバイマン的なデキスタラスな操作を学習するためのシステムである。
コンシューマーVRヘッドセットとヘッドマウントステレオカメラのみで、外部カメラやモーショントラッカーを使わずに、トラッカーレスキャプチャシステムを開発した。
次に,ロボットの動作空間に撮影動作をマッピングする,3つの明示的なアライメントステージを実行する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:59:10 GMT)
AgentPerfBench: A Benchmarking and Evaluation Suite for Inference Performance of Agentic LLMs [39.8] 我々はエージェント推論のためのベンチマークスイートであるAgenPerfBenchを紹介する。
SWE-BenchやTerminalBenchといったエージェントベンチマークの本当のトレースと、標準的なチャットベースラインを使用している。
AgentPerfBenchはまた、入力長さ、出力長さ、実際のトレースから派生したターン数などの経験的分布をサンプリングし、新しいハードウェアの安価で正確な測定のための合成プロファイルを生成する。
我々はこれらの問題を詳細に議論し、メモリ帯域幅とメモリ容量のフットプリントのハードウェアシステム制限をキャプチャする新しい多次元モデルを構築するために、カーネルレベルのNsight Computeトレースを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:09:42 GMT)
The Right Lesson at the Right Step: Deriving Control Updates for Self-Evolving Agents [36.5] 自己進化型エージェントは、過去の経験(通常、グローバルなプロンプト、記憶、リフレクションなど)を再利用することで、将来の行動を改善する。
本稿では,エージェントの実行完了から再利用可能な制御プログラム更新を学習するフレームワークであるEvoCUEを紹介する。
学習慣行が適切な実行ステップに到達しなければならない長時間のツール使用環境において、EvoCUEを評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:59:22 GMT)
FastGuide: Accelerating Reward Guidance for Diffusion Large Language Models [36.5] 我々は並列および自己回帰復号の適応型ハイブリッドであるFastGuideを紹介する。
FastGuideは、デコードステップ毎に1回のコンピューティングガイダンスによって、報酬モデルのバックプロパゲーションのコストを償却する。
3つの報酬ベンチマークの実験では、FastGuideはシーケンシャルな報酬誘導復号よりも4.4倍速いことが示されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:01:44 GMT)
Beyond Geometry: Benchmarking and Consistency Reasoning for 3D Logical Anomaly Detection [36.4] Industrial Logical Anomaly Detection dataset (ILGAD)を導入する。
ILGADには15のカテゴリから2,774のサンプルがあり、ポイントレベルのアノテーションがあり、存在、仕様、ポーズ、アセンブリ状態のエラーをカバーしている。
本稿では,局所幾何学,構造被覆,空間関係が通常の設計に適合するかどうかを評価する一貫性推論フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:25:09 GMT)
FlexLoop: Depth-Elastic Looped Policies for Adaptive Test-Time Computation in Deep RL [36.3] ループアーキテクチャは、繰り返しステップで同じパラメータを再利用することで、計算をスケールする。
最近の研究は、長期的タスクにおける強化学習政策を著しく改善していることを示している。
我々は、事前訓練された固定深度ループポリシーを深さ弾性ポリシーに変換する新しいフレームワークFlexLoopを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:40:47 GMT)
Waggle: Learning One Anonymous Local Law for Self-Organizing LLM Swarms [35.7] We introduced Waggle, a shared anonymous policy over bounded local view that togetherly selects task action, semantic communication, and local commitment updates。
我々は,Swarm-Consistent Distillation (SCD) を開発した。
多様な調整設定全体において、人口や相互作用予算の変化に伴い、同じ学習法が有効であり、基質特異的なオラクルの品質の96%以上を保持し、再訓練なしに転送する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:15:21 GMT)
Broken Symmetry in BF16 Attention: Why FlashAttention Gradients Blow Up Late in Training [35.4] 我々は、50Bトークン上で450M-パラメータ変換器をトレーニングするためにFlashAttention-3を使用します。
トレーニングは25Bトークンで順調に行われ、勾配ノルムは1000倍に増加し、損失は1NaNなしでFP32の注意点より0.2Nat以上増加した。
GProjはキャスト後のゼロ和を行ごとに2つのランク1の補正で復元する。
残りの中央値クエリ/キー勾配エラーを219%/13%から0.34%/0.37%に削減し、FP32の注意に匹敵する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:21:07 GMT)
Sublinear Copies Suffice for Fidelity Estimation with Pauli Measurements [35.1] 量子忠実度を、既知の目標状態と未知の研究所準備状態の間の精度$varepsilon$まで推定するプロトコルを、サブリニア$o(d0.9908/varepsilon2)$, Pauli基底測定数で提示する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:24:07 GMT)
GPARA: Graph-Posterior-Aligned Refinement and Active Acquisition for Grounding Diffusion Priors [35.0] 後アンサンブルに基づく手法は、生成されたサンプルから取得ユーティリティを推定することができる。
本稿では,拡散予測残差よりも文脈依存グラフを代理するGPARAを提案する。
物理場とコンピュータビジョンにまたがる2つの再構成タスクの実験は、改良とアクティブな獲得において一貫した改善を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:46:53 GMT)
Render Before Reading: Visual Rendering as a Prompt Injection Defense [34.6] 大規模な言語モデルはインジェクション攻撃に弱い。
敵データの入力モダリティが果たす役割について検討する。
攻撃の成功率を一定に抑えることを示します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:54:50 GMT)
AerialDojo-200K: A Large-Scale Benchmark Suite for Open-World Aerial Object-Goal Search [34.5] 本研究では,AerialDojo-200Kを提案する。
筆者らは, 都市18, 自然12, インフラ6, 災害6の4つの家族と21のシーンにまたがる42のシミュレーションシーンを構築した。
さらに,100K以上のセマンティックゴールと100K以上のイメージゴールインスタンスからなる205,732のタスクインスタンスを構築した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:20:35 GMT)
JEV vs. LLMs as Rubric Judges: Cheaper, Faster, and Wrong in the Same Places [34.4] Jevを7つのベンチマークから9つのパネル上の3つのフラッシュレベルLCMの判定値と比較する。
Jevの精度は、27のペア比較のうち、少なくとも8つのペア比較において、それらと大きく異なる。
規則上の基準では、全てのLLM判事とJevは共にヒトのラッカーから出発する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:11:07 GMT)
XMatch: Enhancing Covariate-Aware Time Series Forecasting through Tree-Structured Exogenous Matching [34.1] 内因性時系列を予測するためのXMatch(exogenous MATCHing)を提案する。
まず,内因性パターンと内因性パターンの歴史的対応を整理するProtoTree Creatorを紹介する。
次に、将来の変数を使用してProtoTreeをクエリするProtoTree Matcherを設計します。
12の実世界のデータセットの実験では、XMatchが最先端のベースラインを上回っていることが示されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:32:45 GMT)
When Do Model Internals Help? Exploring the Role of Representation Engineering in LLM Safety [34.1] 安全管理と安全監視のための表現工学の整合性評価について述べる。
安全管理のために,DPOと3つの表現ステアリング法を比較し,ロバスト性,実用性,粒度を比較検討した。
安全監視のために、我々は表現プローブを全応答検出、早期検出、計算コストで微調整およびオープンウェイトなテキストモニターと比較する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:50:08 GMT)
DexAgent: An Agentic Human2Sim2Robot Framework for Dexterous Manipulation with Self-Evolving Tool Library [33.9] DexAgentはエージェント的なHuman2Sim2Robotフレームワークで、一つの人間中心の動画を、政策訓練のための物理的に接地されたロボット軌道に変換する。
セマンティック理解、プロパティベースのシミュレーション再構成、ロボット軌道最適化、ロボットデータ生成の4段階を通じて動作する。
11の現実世界のタスクで、DexAgent生成データでトレーニングされたポリシーは、競合するベースラインよりも3.5倍高い成功率を達成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:49:06 GMT)
Share-Borne AI Virus: Memory-Hopping Attacks Across LLM Agents [33.3] 本研究では,このチャネルが自己伝播攻撃を可能にする障害モードについて検討する。
アーティファクトを介して導入された敵コンテンツがアシスタントの永続記憶に格納される、アーティファクトを介する伝搬を導入する。
攻撃は複数の独立したアシスタントにまたがって伝播し、拡張された相互作用シーケンスに持続する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:34:52 GMT)
ROSS: Relearning from Self-Generated Rollouts through Selective Supervision [33.3] 大規模言語モデルは、強化学習とオンライン蒸留を通じて自己生成ロールアウトを生成する。
過去のロールアウトは、後続のポリシーと互換性を持ちながら、ポリシーがもはや確実に表現されない行動を保存することができる。
ROSSは,選択したモデル生成継続にのみロスを適用しつつ,履歴の完全な軌跡を文脈として保存する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:57:03 GMT)
GlyphBench: A Playground for Language-Model Reinforcement Learning [33.2] 本稿では,言語モデルエージェントの強化学習(RL)後学習のための環境スイートであるGlyphBenchを紹介する。
GlyphBenchは2次元Unicodeグリッドとして空間観測をレンダリングし、トレーニング、評価、軌跡再生を接続する。
クラックス実験では,グリフ観察がネイティブテキストやピクセルよりも優れており,BALROG環境がさらに向上していることが示されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:21:57 GMT)
SPRINT: Single-Step Generative Recommendation via Average Probability Velocity [33.1] 生成的レコメンデーションは1つのフォワードパスで生成可能であることを示す。
我々のモデルは、最も高速なAR/NAR法よりもはるかに効率的です。
また、より優れたレコメンデーション精度(7.77%$第2ベットよりも平均的な改善)を得る。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:47:34 GMT)
Dexterous Tactile World Model [33.1] 我々は,エゴセントリックな操作の将来のフレーム予測のためのビデオワールドモデルであるDexterous Tactile World Model (DTWM)を提案する。
我々は、ビデオトークン内の対応する手の位置にあるゼロ触覚残差を介して、各手の触覚信号に予めトレーニングされたビデオ拡散変換器を条件付けする。
DTWMは手の動きの過小評価を23%から9%に減らし,手領域の知覚誤差を7.4%減らした。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:30:09 GMT)
TopoEP: Topology-Aware Load Balancing for Expert-Parallel MoE Training [33.1] 動的ルーティングは、大規模なエキスパート並列混合(MoE)トレーニングにおいて、厳しい負荷不均衡を引き起こす。
大規模MoEトレーニングのためのGPUネイティブなトポロジ対応ロードバランシングシステムである textitTopoEP を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:57:31 GMT)
WorldAttention: An Efficient Attention Architecture for Interactive Video World Models [32.5] WorldAttentionはシステム指向のアテンションアーキテクチャであり、特別なアテンションカーネルと階層的なKVキャッシュ管理の共設計により高効率を実現する。
We show that WorldAttention is consistent over previous State-of-the-art Methods, achieve a subject consistency scores of 0.9472 on VBench-Long and 0.9668 on InterVBench。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:37:04 GMT)
Support-Set Target Leakage in Relational Foundation Models during In-Context Learning: Impact, Detection, and Mitigation [32.5] ここでは、ターゲットから派生した(リーカ)列はリレーショナルインコンテキスト推論中にラベル付きサポートセットにのみ存在し、クエリはクリーンのままである。
Integrated Gradients (IG) rank proxies を用いて疑わしい列を除去するため, ICL ヘッドをホールドアウトした RelBench 上の凍結エンコーダの評価を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:25:04 GMT)
Instance-Adaptive Prompts as Context for Time-Series Foundation Models [32.5] 本稿では,可視的コンテキストに条件付き連続埋め込みトークンの形で,インスタンス適応型潜在プロンプトの小さなセットを生成するPaCTSを紹介する。
PaCTSは、それらをインスタンス固有のグローバル統計から構築し、セグメントレベルの時間情報でさらに洗練する。
実験では、コンテキストとしてプロンプトの有効性を示し、コンテキストの長さとモデルアーキテクチャの予測を一貫して改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:58:15 GMT)
Evolving Support Priorities in Empathetic Reinforcement Learning [32.4] 我々は、認知的、感情的、積極的共感に沿った共感的支援を組織し、文脈適応進化(CARE)を提案する。
それぞれのターンで、CAREはこれら3つの共感次元の重みとそれらのきめ細かい評価基準を調整し、文脈適応型ルーブリックを生成する。
CAREは、SentientBench、EQBench3、EMPAの3つの独立したLCM判事の下で最先端のパフォーマンスを達成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:55:21 GMT)
Alignment Games: A Framework for Conceptual Repair in Human-AI Collaboration [32.2] 使用される概念の意味は、状況、課題、目標、事前の知識によって形作られます。
アライメントゲーム(Alignment Games)は、人間とAIのインタラクションにおいて、タスク関連の違いを可視化し、修復可能にするフレームワークである。
これらの動きを修復シーケンスにどのように構成するかを示し、実行時にタスクに十分な概念的アライメントをサポートする設計原則を導出する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:57:07 GMT)
FactorEngram: Factorized N-gram Memory with Basis-Level Gating for Language Models [32.1] 本研究では,文脈ゲーティングを用いたN-gramメモリであるFacterEngramを提案する。
FactorEngramは、基底ベクトルの辞書上でスパーシ正規化係数を検索する。
言語モデリングとダウンストリームタスクのパフォーマンスを改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:35:18 GMT)
Fractional State Space Transition for Long Sequence Modeling [32.1] 状態空間モデル(SSM)はシーケンス履歴を有界なリカレント状態に圧縮し、その結果のメモリ法則を長文パフォーマンスのための中心的なアーキテクチャ選択にする。
現代のほとんどのSSMはODEベースのダイナミクスに依存しており、指数的忘れを招き、幅広い時間範囲で情報を保持する能力を制限する。
本稿では、この指数的減衰をパワー・ロー・ロングメモリに置き換える分数的ダイナミクスから導かれる選択的SSMアーキテクチャFRACを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:48:14 GMT)
RRG-SLAM: Real-time Reflection-aware Gaussian SLAM for Indoor Scenes [31.8] 室内シーンのリアルタイムリフレクション対応SLAMシステムについて紹介する。
このシステムはリフレクションを意識したTSDF-ガウスハイブリッド表現を備えている。
オンライン・リコンストラクションでは,リフレクション・アウェア・トラッキングによるカメラのポーズを推定し,リフレクションを優先した領域の干渉を抑制する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:00:08 GMT)
Self-Adapting Group of Experts for Multi-Agent Reasoning [31.7] 本研究は,エージェントの初期応答が,現在の問題に適した戦略を識別し,他のエージェントへの転送を導くことができるかどうかを考察する。
SAGEは、回答合意、プレフィックス一貫性、相互ピアレビューを利用して、ストラテジードナーを選択するトレーニングフリーフレームワークである。
複数のエージェントのバックボーンと推論ベンチマークによる実験により、SAGEは評価されたベースラインよりも高い平均精度を達成することが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:29:08 GMT)
Explainability from Training with Applications to TCR-Epitope Prediction [31.6] 本稿では,トレーニング中のモデル解釈をトレースするモデルに依存しないパラダイムであるEFTについて説明する。
EFTを4つの最先端T細胞受容体(TCR)-エピトープ予測モデル、CNN、トランスフォーマー、CNNに適用する。
モデル説明に特有の構造情報がどう影響するかを調べるため、388の実験的に解決されたTCR-epitope構造を含むベンチマークTCR-XAI2を導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:36:04 GMT)
Raising the Bar for Chinese Adolescent LLM Safety: A Culturally-Grounded, Fine-Grained Benchmark [31.4] 既存の中国の安全ベンチマークは主に一般ユーザーをターゲットにしており、青少年の安全に限定的な注意を払っている。
QH-Benchは、青年期のコンテンツ安全性のための中国語のベンチマークである。
13のオープンウェイトモデルの評価では、オフライン接触シナリオを共通の弱点として認識している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:43:01 GMT)
Livin' on a Prior: Likelihood Score Approximation for Inverse Problems [31.4] Likelihood Score Approximation (LSA) は、事前訓練された無条件モデルを固定する生成フレームワークである。
LSAは全トレーニングデータセットの約0.01%でも効果的に動作することを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:03:22 GMT)
GAE: General Action Expert for Real-Time Humanoid Teleoperation [30.9] General Action Expert (GAE) は、汎用的で低遅延のヒューマノイド全体遠隔操作のための統合学習フレームワークである。
GAEはビデオ、アニメーション、モーションキャプチャを含む異種ソースから大規模な人間のモーションデータセットを構築し、続いて標準化と拡張を行う。
応答性のあるヒューマンロボット同期のために、GAEはリアルタイム遠隔操作中にエンドツーエンドの遅延を適応的に補償する遅延条件予測機構を導入した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:39:03 GMT)
From World Models to World Action Models: Rethinking Next-State Prediction [30.7] CF-WAMは,視覚,意味,幾何学,相互作用のプロジェクションを抽出する動的次世代予測フレームワークである。
CF-WAMはトレーニング効率と最終制御性能の両方を向上し,ヒューマンエクスペリエンスを効果的にポリシーゲインに変換する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:30:21 GMT)
From Attention Sensitivity to Layer Role: Revisiting Mixed-Precision Quantization of Transformers [30.7] 目標を3つのプロジェクションすべてに対して一度にアテンションアウトプットに書き、パイプライン全体で再利用します。
Mistral-7Bの注意のみの量子化では、これが機能する。
感度推定を必要としないロールアウェアオフセットルールは、GAT-2と完全なMistral-7BモデルでJABを上回ります。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:53:49 GMT)
On the Limits of Metacognitive Monitoring in LLMs [30.4] 15ベンチマークにわたる4つのフロンティアモデルの信頼性レポートについて検討する。
モデルが競合数学の97%の問題を解き、解答時間の信頼度が誤差の上位に正解をランク付けする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:53:12 GMT)
CoDeL: Co-Evolutionary Defense against Indirect Prompt Injection in LLM-based Agents [30.2] 大言語モデル(LLM)ベースのエージェントは、外部ツールやコンテンツに依存しやすくなり、間接的プロンプトインジェクション(IPI)に露出する。
本稿では,攻撃分布に対してエージェントを硬化させる防御剤であるCoDeLについて述べる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:19:20 GMT)
See, Measure, and Reason: Learning Visually Grounded Reasoning in Pathology [30.1] そこで我々は, 細胞外見と存在量の明示的な監督を通じて, 視覚的根拠に基づく推論を改善するためのASPECTを提案する。
ASPECTは、病理機能再構成、細胞機能アライメント、カウント監視を通じて中間的な視覚トークンを訓練する。
PathoVernierでは、ASPECTは最強のベースラインであるGemini-3.1-Proより19.2%、Qwen3-VL-8Bより99.3%の精度向上を達成した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:25:28 GMT)
Perceptual Quality Loss or Loss of Perceptual Quality? [30.1] PESQに最適化されたモデルは、テストセットにおいて自然により高いPSSQスコアを得るが、他のほとんどの指標では、スコアは著しく変化しない。
正式なリスニング実験により、PSSQの損失のないモデルは、一般的にすべての設定で、それを含むモデルよりも好まれることが明らかになった。
本研究は、PSSQに対する過度信頼の危険性を強調し、SEの完全評価手順の重要性を強調した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:50:06 GMT)
Similarity Is Not Validity: Defending LLM Semantic Caches Against Poisoning [29.9] キャッシュ中毒攻撃は、検索の類似性と回答の妥当性のギャップを悪用する。
本稿では,キャッシュキーの原文から必要な情報を復元する新しいディフェンスを提案する。
3つの攻撃クラスにまたがって、当社の防衛ブロックは82.0%から98.2%の毒物が5%の偽陽性率で供給され、オーバーヘッドは無視できる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:52:22 GMT)
Predictive Semantic Safety: From Visual Physical Reasoning to Safety-Critical Control [29.7] 予測意味安全(PSS)という枠組みを提案する。
PSSは視覚的物理的推論とバックアップベースの安全フィルタリングを結びつける。
PSSは、バックアップ制御バリア関数のベースラインで43.3%に対して、安全なエピソードレートが99.3%である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:32:33 GMT)
Generative Uncertainty as a Self-supervised Signal for Semantic Similarity Learning [29.6] 人間のアノテーションなしで意味的類似性を学ぶために、テキスト・トゥ・ビデオ(T2V)モデルから生成する不確実性。
提案手法は,T2Vモデルが慣れ親しんだ概念に対して一貫した出力を生成するが,特殊概念によって誘導される場合,高いばらつきや不確実性を示すことに基づく。
本稿では,ビデオMAE や V-JEPA などの既存の事前訓練された表現において,安定した意味的特徴を識別するために,この振る舞いを利用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:58:40 GMT)
Universality and Generalization of Causal Transformers Across Context Lengths [29.6] 固定された正規化水平線をサンプリングする任意の長さの列に対して因果トークン・ツー・トケンマップを均一に近似できるかを検討した。
分解能間の連続性の概念は、長さに依存しないパラメータを持つ単一変圧器により、コンパクトな入力クラスに一様近似を許容する因果族を特徴づける。
物理時系列の実験は、データセット依存の適応指数を持つ観測スケールでのHlder-regularトークンモデルをサポートし、テキスト入力の埋め込みは対照的なケースを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:50:27 GMT)
One-Step Next-Latent Prediction Is Not a World Model [29.1] 次の遅延予測は、現在の埋め込みから次の埋め込みへのマップに適合する。
LeNEPAはこの目的を時系列に伝え、次のエンベディング予測の停止段階をLeJEPAの異方性ペナルティに置き換える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:24:50 GMT)
Look Before You Judge: Training-Free Region Mining for Grounded and Explainable Deepfake Detection [28.6] MLLM(Multimodal large language model)は、自然言語の深い検証を説明できるが、これらの説明は必ずしも予測の根底にある視覚的証拠に基礎を置いているとは限らない。
本研究では,シーケンシャルエビデンス獲得プロセスとして説明可能なディープフェイク検出を定式化する,トレーニング不要のフレームワークであるLook Before You Judgeを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:19:22 GMT)
From Search to Research: Exploring Search Scaling in Autonomous Quantitative Factor Mining [28.6] 推論スケーリングは、大きな言語モデル(LLM)のパフォーマンスを改善することが示されている。
自律型研究における探索スケーリングが研究性能に与える影響について検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:28:08 GMT)
Rethinking Visual Token Compression for Video Large Language Models: A Simple Yet Strong Baseline [27.7] 視覚表現に符号化された構造を単純に保存することで,圧縮性能をどの程度向上させることができるかを検討する。
私たちはSimpleClusterを使って、視覚的特徴空間における位置対応のクロスフレームクラスタリングを実行しています。
実験の結果、SimpleClusterは最近の圧縮手法よりも競争力や優れた性能を発揮することがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:21:37 GMT)
LVMT: Video Mask Transformer for Long-term Video Segmentation [27.7] 長期的なビデオマスクトランスフォーマーは、さまざまなビデオセグメンテーションタスクにまたがって、アートの新たな状態を設定する。
6つのベンチマークの実験では、LVMTは様々なビデオセグメンテーションタスクにまたがって、新しい最先端の技術を設定している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:00:57 GMT)
How Far Are We from Removing the Visual Encoder? Scaling Laws for Encoder-Free Multimodal Pretraining [27.6] エンコーダフリーおよびエンコーダベースマルチモーダル大言語モデルのスケーリング法則を比較する。
視覚エンコーダの除去は,マルチモーダル目的の計算最適割当を大規模モデルにシフトさせる。
ビジュアルエンコーダがなければ、言語モデルは視覚固有の適応を通じてその役割を引き継ぐことを学ぶ。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:48:41 GMT)
When Can Attention Heads Be Statically Defined? [27.3] 注意パターンの再利用は、クエリキースコア計算やソフトマックスを回避することで、トレーニングコストを削減できる。
注意パターンの低い頭部を選択するSAF(Selective Attention Freezing)を同定する。
融合カーネルはパターンを再構築し、通常のアテンションを実行し、頭を取り替える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:58:07 GMT)
From Static to Dynamic: On-Policy Distillation from Image to Video Diffusion Models [27.2] 動作保存型画像から映像への潜伏蒸留フレームワークを提案する。
トレーニング済みのビデオダイナミクスを保存しながら、専門的な画像の専門知識を転送する。
我々の手法は、ビデオ教師のPDベースラインを一貫して上回る。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:46:11 GMT)
AraDynFact: Dynamic Evaluation of Factual Knowledge in Arabic [26.6] AraDynFactは、大規模言語モデルに埋め込まれた現実のアラビア語知識を厳格に評価するために設計された、新しい動的評価フレームワークである。
静的ベンチマークとは異なり、AraDynFactは事実情報を抽出し、リッチで回答可能な質問を生成するために動的アプローチを採用している。
我々はアラビア語ウィキペディアにAraDynFactを適用し、いくつかの最先端モデルのパフォーマンスを監査する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:49:21 GMT)
HEAR: Real Voices, Real Bias: A Large-Scale Human-Recorded, Demographically Diverse Benchmark for Audio Language Models [26.5] HEAR (Human-recorded Evaluation of Audio-LLM bias by Real speakers) は、843人の人口統計学的多様な参加者から87万名の実音声サンプルを作成した大規模ベンチマークである。
われわれの知る限りでは、これは人間の発話に完全に根ざした大規模な音声ベンチマークとしては初めてのものだ。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:30:33 GMT)
RenderRank: Learning to Rerank Text with Compressed Visual Tokens [26.4] 文書を画像としてレンダリングすることで、視覚言語モデルで文書を視覚トークンとしてエンコードすることができる。
RenderRankは、圧縮されたビジュアル文書表現からクエリ依存の関連性スコアを学習するリランカーである。
BEIRの11データセットにわたって、RenderRankは16.5-35.5%少ない入力トークンを使用し、平均NDCG@10は55.96である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:57:13 GMT)
DeShortcut-Align: Decoupling Spurious Shortcuts for Robust Safety Alignment in Large Reasoning Models [26.3] 大きな推論モデルの安全性アライメントは、ほぼ完全な安全性スコアをもたらすことが多いが、この明らかな成功は、過度に拒絶され、劣化した汎用能力の犠牲になる。
DeShortcut-Alignは、表面的キューへの依存を減らすショートカットデカップリングアライメントフレームワークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:01:03 GMT)
Capacity, Responsiveness and Alignment: What Makes a Latent Structure Actionable [26.2] 局所構造は、その因果的影響において大きく異なっており、構造がどう作用するかという疑問が提起される。
因果的影響は,キャパシティ,応答性,アライメントという3つの要因の産物であることを示す。
モデル間のステアリングを17%-118%改善する因果プローブを導入し, 概念検出をわずか3%削減した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:57:46 GMT)
CoRe: Co-Evolving Reward Models for Mitigating Latent Reward Hacking in Video Diffusion Models [26.2] CoReは、潜在空間アライメントをジェネレータと報酬モデルの間の動的相互作用として扱う共進化型報酬フレームワークである。
Wan2.1-T2V-1.3B では、CoRe が事前訓練されたモデルと事前アライメント法の両方よりも連続的に生成品質を向上させることを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:38:50 GMT)
Making Cross-Continental Federated Learning Repeatable with FLIP: a Multi-Application Study [26.1] 医療におけるフェデレーテッドラーニング(FL)は、すべてのコラボレーションにおいてガバナンスの保証を再構築するオーバーヘッドが、概念実証の段階でほとんどのプロジェクトを止めるため、依然として困難である。
本稿では,FLIP(Federated Learning Platform)について紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:07 GMT)
MERID: Multimodal Exploration via Recursive Self-Improvement Agents for Major Depression Analysis [26.0] 大うつ病 (MDD) は日常生活活動や生活の質に深刻な影響を及ぼす。
MDDの検出には、インタビュー記録やセンサ測定などのマルチモーダルデータが含まれる。
この課題に対処するための既存の取り組みは、手動で設計されたマルチモーダルアーキテクチャとエージェント支援パイプライン開発の両方を調査してきた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:29:26 GMT)
QiYao-M: Multimodal Time Series Foundation Model with Role-Aware Modeling of Endogenous and Exogenous Modalities [25.6] 既存のマルチモーダル時系列基礎モデル(TSFM)は、大まかに共有されたメカニズムを通じて異質なモダリティをモデル化する。
本稿では,2種類のモードを別々にモデル化した役割認識型マルチモーダルTSFMであるQiYao-Mを提案する。
内因性モーダル性については,時間的変動とともに進化する過程を捉えるために,内因性マルチモーダル予測器と内因性マルチモーダルスーパービジョンを導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:39:35 GMT)
Lost in Translation: Measuring the Effect of Non-Native English on End User Performance of Large Language Models [25.0] 大規模言語モデル(LLM)は、英語ではない人々によってますます使われている。
これらのユーザは、流線型話者よりも体系的に低品質な応答を受け取ることが示されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:13:16 GMT)
Correction-space Cross-variate Interaction for Test-time Adaptation in Time Series Forecasting [24.7] テスト時間適応(TTA)は、時系列予測(TSF)における分布シフトを扱うための有望なパラダイムである
共有アンカー補正(SCR)による補正空間相互作用を実現するtextscCoRe(textscCorrection-space Interaction textscRefinement)を提案する。
7つのバックボーン、6つのデータセット、4つの予測水平線、textscCoReは、平均的なバックボーン上のMSEを25.82%削減し、最先端のTSF-TTAよりも10.57%削減する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:51:52 GMT)
OPIS: An Input-Grounded Benchmark for Multi-Object Memory in Video World Models [24.6] OPISは、オブジェクトインスタンスの固定セットにアセスメントをアンロックする入力基底ベンチマークである。
OPISデータセットは、実世界、エンボディ・ロボティック、ゲームワールドドメインにわたる500のケースで構成されている。
提案するOPISスコアは,8つの画像対ビデオまたはカメラコンディショニングワールドモデルで,48.65から56.01の範囲である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:46:29 GMT)
ECHO: Event-Augmented Context with Hindsight and Outlook for Wrist-Only Manipulation [24.4] イベントカメラは、画素レベルの強度変化を検出して劣化を緩和し、高いダイナミックレンジを提供する。
本稿では、手首イベントをコンパクトな動作表現にエンコードする手首のみの潜在世界アクションモデルECHOを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:00:06 GMT)
Learning to Act under Visual Interruptions with Vision-Language-Action Models [24.4] 視覚言語アクション(VLA)モデルは、ロボット操作において強力な能力を示している。
それらは通常、タスク実行を通じて利用可能なすべてのカメラストリームで開発され、評価される。
VLAモデルによる視覚的中断を評価するベンチマークであるMAIL-Benchを紹介する。
視覚的入力を欠く場合、まずVLAポリシーを継続するように訓練するMINTを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:06:49 GMT)
Does Native 3D Texture Generation Necessarily Require 3D Assets for Training? [24.1] 我々は,2次元画像を3次元空間の平面として表現することで,3次元トレーニングサンプルに変換する。
次に、複雑な幾何学構造を構築するためにパッチワイズランダム回転とアグリゲーションを適用する。
我々はTex-Zero VAEを訓練し、トレーニング中に見ていないにもかかわらず、高品質で本物の3D資産を再構築することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:44:04 GMT)
Draft in Parallel, Condition Through Depth: Adjacent Causal Injection for Speculative Decoding [23.3] DSpineは背骨全体に因果条件注入を施したドラフト機である。
各レイヤにおいて、ゲートされた隣接インジェクションは、各前任者の予測された機能をその後継に書き込む。
対象モデルの出力埋め込みから構築された統一的な転送空間は、事前条件付きデコードによる層ワイズインジェクションである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:44:02 GMT)
AquaMend: Minimal Re-probing and Conditional Rollback for Latent-Belief Failures in Embodied Agents [23.3] AquaMendは、re-probing, rollback, Support continuation on a probe-belief-action graphの比較を行う。
ジョイント後部は条件検出パワースクリーニングによるワンステップポリシーを導出する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:12:51 GMT)
Learning to Steer, Steering to See: Unveiling the Geometry of RLVR in Large Language Models via Trainable Vectors [23.3] 強化学習(Reinforcement Learning, RL)は、大規模言語モデルの推論を強化するための重要なパラダイムとなっている。
検証可能な報酬(RLVR)を用いて強化学習を行い、ベクトルステアリングを用いて、RL誘導利得に関連する活性化空間における低次元有効多様体を同定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:21:39 GMT)
Coding Agent Memory Post-training: Unlocking the Memory Potential of Pre-trained File Operations for Long-Horizon Tasks via Reinforcement Learning [23.3] 本稿では,CAMG,Shop,Coding,DeepResearch,AutoResearchにまたがる長距離エージェント-RL環境について紹介する。
CAMGは実行可能なシェルアクセスとエピソードパーシスタントなワークスペースを提供し、エージェントがファイルのメモリとして作成、修正、検索、再利用を可能にする。
また,CAMG-RLを導入し,完全に非同期なPPOを持つ4つの環境すべてに対して,単一のポリシを共同でトレーニングする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:40:28 GMT)
Finite-Time Concentration and Convergence Rates for Projected Two-Time-Scale Stochastic Approximation with Markov Noise [23.0] 制御マルコフ連鎖によって駆動される投影された2時間1/2スケール近似の有限時間濃度と収束率について検討した。
スコロホッド写像を用いて、運動する高速平衡と予測されるスローダイナミクスを追跡するために、明示的な高確率境界を確立する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:00:38 GMT)
Can LLMs Value the Right Evidence? Evidence-Value Misalignment in Dynamic Medical Diagnosis [22.9] 不十分または誤解を招く証拠から到達した正確な診断は、臨床上の危険をもたらす可能性があるが、結果に基づく精度は、そのようなラッキーな推測に報いる可能性がある。
私たちはこの、診断決定と利用可能な証拠の価値のミスマッチを、EVM(Evidence-Value Misalignment)と呼んでいる。
診断精度から独立して明らかな接地を阻害するために,24の疾患システムで1,050の患者を対象とする動的ベンチマーク環境であるMedEVMを導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:59:47 GMT)
WeaveData: A Multimodal Data Analysis System with Self-Critiquing and Self-Evolving LLM Plans [22.8] 大規模言語モデル(LLM)は、関係演算子や意味演算子に対して解析計画を生成することによって、自然言語でそのような分析を可能にする。
本稿では,自己記述型かつ自己進化型LCM計画を用いたマルチモーダルデータ解析システムWeaveDataを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:47:20 GMT)
Learning to Optimize through Solver-Grounded Self-Play [22.8] OPT-Zeroは最適化モデリングのための完全なセルフプレイトレーニングフレームワークである。
1つのLarge Language Modelをデュアルロール閉ループに採用している。
OPT-Zeroは最先端のデータ依存手法と一致し,より強力な一般化性を示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:13:41 GMT)
InfiMed2: A Generalist Medical Multimodal Foundation Model from Contextual Evidence and Stability-Aware Supervision [22.7] InfiMed2は4Bと27Bの汎用医療マルチモーダルファンデーションモデルである。
InfiMed2-4BはRLVR以降の平均精度66.73%に達し、Qwen3.5-9Bを上回り、InfiMed2-27Bは73.72%に達した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:01:35 GMT)
PlaylistEval: Can Video-Language Judges Be Trusted at Day Scale and Beyond? [22.6] 人間のアノテーションを使わずに100時間以上のプレイリストコレクションにビデオ言語判断ベンチマークを構築するエージェントフレームワークであるPlaylistEvalを紹介した。
フロンティアの審査員はペアの精度が75.4%しかなく、オープンソースの審査員モデルははるかに遅れている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:54:29 GMT)
FluxLite: Inference-Time Proposal Control for Discrete Diffusion Models [22.4] 本稿では、離散拡散のための軽量でトレーニング不要な提案制御フレームワークであるFluxLiteを紹介する。
我々はこの原理を2つの実践的なサンプルとしてインスタンス化している: 1-hop Local reallocation rule (HEU) と、事前訓練されたレートベース (D-VCG) 上の小さな非負の二次プログラムである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:02:48 GMT)
STRIDE: Automated Evaluation of Text-to-Trajectory Alignment across Diverse Contexts [22.4] 既存の歩行者軌跡メトリクスは、実際の人間のデータと軌跡を比較する。
シナリオ記述と歩行者軌跡のコンテキストアライメントを評価するための最初のフレームワークSTRIDEを紹介する。
観衆領域におけるSTRIDEをSTRIDE-Benchとしてインスタンス化し、1Kシナリオ、6Kの行動質問、1Kの測定で30の現実世界の地図で予測された回答をキャリブレーションした。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:01:45 GMT)
UNBIND: UNlearning By INference-time Directional Steering for Code LLMs [22.4] 対象のコードに対応する隠れ状態と、その再生を抑制する方法を考える。
UNBINDはモデルウェイトを固定しながら、推論時に選択的なアンラーニングを達成する。
F-BLEUが測定したように、ターゲットコードの再生を97.3%減らして99.1%に削減する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:55:54 GMT)
An Empirical Study and Assessment of EU AI Act Compliance Checkers [22.3] EU AI Actは、AIシステムの開発、デプロイ、統合を行う組織に対して、広範なコンプライアンス要件を導入している。
中小企業や個々の開発者は、これらの義務を解釈するために必要な法的専門知識を欠いていることが多い。
コンプライアンスアセスメントの合理化と実践的なガイダンスの提供を主張する、さまざまな自動EU AI Actコンプライアンスチェッカー(AIACC)が登場した。
我々は、複数の次元にまたがる12の主流AIACCを特徴付け、法的カバレッジとアライメントを評価し、チェッカー生成コンプライアンスレポートを分析する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:25:50 GMT)
From Data to Program: Fast & Direct Generative Program Inference from Empirical Data [22.2] PRODiGIは、1つのフォワードパスで明示的で実行可能な生成プログラムを推論するデータ・ツー・プログラムモデルである。
既存の事前訓練モデルよりも平均密度を低くし、MAEをスコアし、マルチフォールド・スピードアップを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:01:54 GMT)
Sample What You Say: Aligning Language Models to Sample the Distributions They State [22.1] 対象の分布を有限個の結果集合上で一致させるモデルを訓練する。
未知の目標分布では、目撃者による訓練により、目標への全変動距離が大幅に減少する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:26:47 GMT)
From Scores to Samples: Elastic Forcing for Autoregressive Video Generation [21.8] 分散マッチング蒸留(DMD)を利用した数ステップ自動回帰ビデオ生成
我々は、参照ビデオから直接ロールアウト分布を学習し、ポストトレーニング中の両方のスコアモデルを排除した。
我々のフレームワークは、凍結した自己教師付きビデオ表現空間における最大平均不一致(MMD)を最小限に抑える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:00:49 GMT)
ReScraper: Unified Scraping and Cleaning of Web Data for Effective LLM Pretraining [21.5] 本稿では,0.6Bパラメータのみの統一言語キュレーションモデルであるReScraperを提案する。
ReScraperをトレーニングするために、3つの教師モデルの出力から教師付きデータを慎重にキュレートする。
同じクロールデータプールに基づき、400M、1.4B、および2.8Bの事前訓練により、DCLM Coreのスコアは各スケールで最強のベースラインに対して3.8--4.7%向上した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:31:15 GMT)
D$^2$-VLA: Dual-Memory Dual-Frequency Vision-Language-Action Model For Long Dynamic Manipulation [21.4] ロングホライズン操作では、移動物体に反応しながら、もはや見えなくなったキューをロボットに思い出させる必要がある。
本稿では,プリトレーニング済みVLMのKV-cacheインタフェースにおいて,デュアルメモリとデュアル周波数制御を組み合わせたD$2$-VLAを提案する。
D$2$-VLAは、DOMINOで29.3%、PUMAで9.6%、PUMAで17.2%、DOMINO-Longで60.0%、DOMINO-Longで35.4%、20.6%である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:00:58 GMT)
MotionSpaceFlow: Representation-Aware Flow Matching in Direct Motion Space [21.3] MotionSpaceFlow(MSFlow)は、学習したエンコーダやデコーダを使わずに、連続的な動き空間で直接クリーンな動きを予測する、表現対応のフローマッチングフレームワークである。
MSFlowは、さまざまなデータセットとモーション表現をまたいだ最先端のテキスト間パフォーマンスを実現する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:05:03 GMT)
Efficient World Action Model Inference with Adaptive Intermediate States [21.2] $mathrmWAMscriptstylemathrmACHINE$は、WAM推論のためのトレーニング不要のフレームワークである。
制御ループが進化するにつれて、推論状態を効率的かつ正確な継続のために保存し、適応する。
$mathrmWAMscriptstylemathrmACHINE$は1.47-3.05$times$speedups in Observation-to-action latencyと2.23-3.27$times$ speedups in GPU inference time per replanを達成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:37:39 GMT)
Learning Conditional Expectation Operators via Functional Newton Updates [20.7] 本稿では,条件付き期待演算子の主特異構造を学習するための関数スペクトルニュートン法(FSNM)を提案する。
FSNMは、機能的ニュートン更新を交互に行い、中心となる結合と積の密度比のカーネルの低ランク表現に適合する。
FSNMは、低ランク密度比とその先行スペクトル構造を復元し、同じ学習されたカーネルが、再構成することなく複数の条件付きクエリに応答可能であることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:48:05 GMT)
A General Harness for Protein Foundation Model Fitness Prediction [20.7] VenusREM-Harness (VRH) は、凍結したモデルスコアを、モデルの不確実性に応じてシーケンスアライメントの証拠と融合させる。
構造的信頼性と溶媒暴露に基づく背景補正とスコア縮小を施す。
VenusREM2は、全ての機能、分類学、MSA-depth、突然変異-depthカテゴリーで最高位にランクされた最初のものである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:58:56 GMT)
Source-preserving alignment for robust evidence localization in scientific PDFS [20.6] ソース保存アライメントフレームワークは、ロバストマッチングのためのテキストを正規化します。
1,020の化学論文での実験では、このフレームワークは92.6%の引用レベルの自動局在速度を達成した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:40:33 GMT)
From Weak Task Specifications to Scientific Extraction Agents: Optimizing Task Construction [20.6] 本稿では,短い目標と注釈のない参照文書のみを含む弱い仕様からタスク固有の構成を構築することの問題点について検討する。
本フレームワークは,タスク固有のスキーマ,抽出命令,ベーストレーニングルーブリックを構築し,最適化時にスキーマの構成と抽出命令を編集可能にしておく。
不均一触媒文学コーパスでは、自動構築は改善可能であり、スキーマ構築と抽出命令の両方を最適化し、4つの判定ルーブリック設定で最善を尽くす。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:24:57 GMT)
Adapt Semantics, Not Structure: Few-Instance Schema Calibration for Scientific PDF Extraction [20.6] 我々は、注釈付き文書からプロンプトとセマンティック記述を校正する意味抽出フレームワークCPSEを紹介する。
専門家によるアノテートされたポリマー科学文書では、CPSEは実行マッチングベースライン上で9.93ポイントの抽出を改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:39:12 GMT)
MMSkillRisk: Can Agents Stay Safe When Multimodal Skills Become Traps? [20.6] 我々はMMSkillRiskを紹介した。MMSkillRiskは、マルチモーダルスキルにおける画像による攻撃のエンドツーエンド安全性評価のための最初のベンチマークである。
28のキュレートされたクリーンスキルから構築されたMMSkillRiskには、36のアタックパッケージと、5つのアタック目標にまたがる108の実行可能なケースが含まれている。
攻撃成功率は36.5%で、GPT-5.6-solは72.2%、Codexは72.2%だった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:07:45 GMT)
Language Models Are "Insecure" Reporters [20.5] 大規模言語モデルが物語変化の欠陥を隠蔽しているかを考察する。
正直さと成功を求めることは表現空間における反対方向に対応することが分かる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:13:33 GMT)
GeoCFM: Positive-Only Conditional Flow Matching for Mineral Occurrence Sampling [20.5] マルチチャンネルジオイメージに条件付きミネラル発生点集合を生成する条件付きフローマッチングモデルであるGeoCFMを紹介する。
合成磁気地球化学ベンチマークでMRIの潜時活性化とUSGS EarthのMRIデータと不整合タイル分割を用いて、GeoCFMはスコアマップと非条件ベースラインの観測結果との一致を改善した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:11:16 GMT)
Same Tasks, Different Apps: Why Mobile GUI Agents Fail to Generalize? [20.5] 我々はAnyAppBenchを紹介した。AnyAppBenchはカテゴリ制御されたAndroidのライブベンチマークで、アプリケーション間の一般化を評価する。
10の機能カテゴリ、100のタスクテンプレート、520のタスク-アプリケーションペアで52のアプリケーションに対応している。
13のエージェントにまたがって、元のアプリケーションの成功は、同じ目標を持った新しいアプリケーションに確実に転送されないことが分かりました。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:21:13 GMT)
Tensor-Engineered Van der Waals NbOCl2 Resonant Metasurface for Polarization-entangled Bell State Generation [20.5] NbOCl2のようなVan der Waals(vdW)非線形材料は、量子光発生のための原子的に薄いプラットフォームを提供する。
我々は、固有光異方性を利用した共振子vdW非線形準曲面を開発し、偏光依存非線形応答を工学する。
これにより、最大92%の忠実度を持つ偏光共役光子生成が可能となる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:36:17 GMT)
CAST: Reconstruction-Coupled Acceleration of Interactive World Models [20.4] 本稿では,再構成結合型推論フレームワークであるCASTを紹介する。
周波数・信頼度を考慮した位相認識再構成(PAR)によるスキップ残差の再構成
比較手法の中で最も高いVBenchスコアを獲得し、13のWorldMark次元のうち7と6で非ネイティブベースラインを導いている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:25:53 GMT)
Towards Reliable AI Data Scientists: Data Agents with Workflow Harnesses [20.3] データエージェントと関連するデータ環境の分類を導入し,5つの機能段階の文献を整理する。
我々は,各ステージにおける重要な技術経路を分析し,データ構造からデータ状態の再構築に至るまで,15の異なるアプローチを特定した。
データエージェントの水平タスクファミリを要約し、それらの垂直アプリケーション設定と評価のためのベンチマークについて検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:19:30 GMT)
Sprout: Building Dynamic Memory While Reasoning for Agentic Video Understanding [20.2] 長いビデオ理解は、マルチモーダルな大言語モデルのコンテキスト制限を克服するために、ビデオメモリに依存している。
既存のメソッドはビルドテーマ推論パイプラインに従っている: メモリはビデオ全体に対してオフラインで構築され、静的ソースとして推論される。
Sproutは、推論中にメモリを構築するエージェントフレームワークであり、質問に答えると詳細なノードが芽生えるテンポラリなツリーである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:01:59 GMT)
Sufficiency of Zeroth-Order Reward Shaping for Policy Gradient in Stabilization Control [20.2] 本研究では,0階目(設定)と1階目(速度)の情報に着目し,安定化制御問題について検討する。
報奨関数は、目標関連座標よりもゼロ次完全でなければならないが、低散逸仮定の下では、第一次状態は依然として必要である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:15:56 GMT)
HINT-Blimp: Human INTent Inference from Multimodal Cues for Robotic Blimps [20.2] 本研究では,物理的プッシュや音声コマンドなどの疎密なマルチモーダル信号を通じて,人間の意図を直接伝達する,人間とロボットのインタラクションフレームワークを提案する。
我々は,この枠組みを,本質的なコンプライアンスと衝突耐性が繰り返しの物理的相互作用に適しているロボット群上で検証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:40:32 GMT)
QuantaSpike: Short-Window Spike-Driven Quantization for Large Language Models [20.2] 大規模言語モデル (LLM) は、多くのタスクにわたって高い性能を達成するが、推論中に密度の高い乗算累積 (MAC) 演算に依存する。
我々は,対数三元積分系を中心に構築されたLLMのための短ウィンドウスパイク駆動量子化フレームワークQuantaSpikeを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:03:17 GMT)
Still There, No Longer Seen: Exposing Compression-Induced Risk in Large Vision-Language Models [20.1] 我々は,大規模視覚言語モデルに対する圧縮誘導型リスクアタックであるCIRAを提案する。
CIRAはダウンストリームの質問やラベルは使用せず、言語モデル、デプロイされた圧縮機、正確な圧縮予算へのアクセスを必要としない。
その結果、CIRAのCSFRの平均値は20.35%であり、攻撃成功率は6.92%に制限されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:06:18 GMT)
Functional Hand Type Prior for 3D Hand Pose Estimation and Action Recognition from Egocentric View Monocular Videos [20.1] エゴセントリックな視点行動認識の現在の手法は、しばしば動的手の動きを知覚する際の課題に直面している。
機能的視点に基づく手型の実践的分類法を導入する。
また,手型のセマンティックな詳細を予め考慮した新しい手動作認識フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:29:40 GMT)
PowerBench: A Benchmark for Agentic Retrieval and Reasoning in Power Systems [20.1] 大規模言語モデル(LLM)エージェントは、業界における自動分析の新しい機会を提供する。
このギャップに対処するために,(1)共通依存チェーンを介して相互接続した異種運用データを導出する生成フレームワークと,(2)このフレームワークによって生成された合成データセットからなるPowerBenchを提案する。
このデータセットは100種類のデバイスにまたがる761のデバイスをカバーしており、2年間にわたる1335万時間のテレメトリ記録と24,939の運用文書がある。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:41:50 GMT)
You Can't Have It Both Ways: Concept Entanglement Limits Diffusion Model Unlearning [20.0] テキストと画像の拡散モデルにおける概念アンラーニングは、関連性はあるが異なるコンテンツを保存しながら、ターゲット概念を抑えることを目的としている。
これらの障害モードは、特定のアルゴリズムではなく、概念表現の幾何学に起因していることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:15:21 GMT)
CORTEX: Learning to Share and Specialize in Dense Language Models [20.0] CORTEXは、高密度言語モデルの内部モジュール化を学習する学習力学にインスパイアされたフレームワークである。
160M、Qwen3-8B、Qwen3-32Bのバックボーンモデルを用いた実験により、CORTEXは最も高い合成ドメインの正確な一致と最大の平均パープレキシティ低減を達成することが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:05:32 GMT)
Cheap to Hypothesize, Costly to Verify: The Defense Surface of Agentic Vulnerability Discovery [18.6] 自律的脆弱性発見は仮説検証の非対称性を示す。
限られた資源予算の下では、自律的な発見はリソース境界の選択的検証プロセスとなる。
私たちはRedHerringを紹介します。これは、実際の脆弱性から検証の労力を逸脱させる、確実に安全なデコイを挿入します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:14:39 GMT)
Convex Optimization Is Free When Accuracy Is Expensive [18.6] 我々は、勾配を正確に評価できないときに凸最適化を研究するが、精度$$$で$-$のように計算が成長するアルゴリズムの階層によってのみ近似される。
損失関数の最小化に要するコストは,問題要求の精度での勾配の1つの評価よりも,$のみに依存する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:30:18 GMT)
Experimental Realization and Phase-Space Winding of a Topological Defect State in the Quantum Rabi Model [18.5] 我々は,量子ラビモデルのトポロジカル欠陥を,1つのトラップされた171mathrmYb+$イオンで実験的に実現した。
この実験は、非一様合成格子における位相的欠陥状態物理学とハイブリッドスピンボソン系の可測位相空間幾何学を結びつける。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:04:58 GMT)
The Devil is in the Spectrum Bias: Spectrum-Balanced Feature Matching for Robust Representation Distillation [18.4] SpecMatchは、優先方向の相対的重要性を保ちながら、最適化されていないスペクトル方向を適応的に強調する単純な目的である。
画像認識の実験では、SpecMatchはさまざまなタスクの下流適応を一貫して改善している。
さらに,提案した目的が視覚を超えて一般化し,6つのタンパク質理解タスクの下流性能が向上することが実証された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:44:26 GMT)
Loop Dropout: Regularizing Shared Updates in Looped Language Models [18.3] ループ言語モデルは、同じ変圧器ブロックを繰り返し適用することで、パラメータカウントから計算深度を分離する。
我々の経験的分析によると、標準低ランク適応(LoRA)における遅延ループバイアスは顕著である。
本稿では,更新強度を維持するために,逆サバイバル再スケーリングによるアダプタアプリケーションのマスキングを低減するループドロップアウトを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:24:28 GMT)
Proxy2World: Learning to Generate Worlds From Lightweight Proxies without Seeing Them [18.3] プロキシにより、クリエイターはシーンのレイアウトと動きを制御できる。
本稿では、通常のRGBDビデオからこれらの補完能力を学習する制御可能な世界モデルであるProxy2Worldを紹介する。
このモデルは, クロスモーダルフローマッチングにより, 深度条件付きRGBD生成とジョイントRGBD生成を共同で学習する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:22:35 GMT)
The power of oracle access: Optimal sample and query complexity of the abelian state hidden subgroup problem [18.2] 本研究では、未知の量子状態の対称性を特定することを目的とする状態隠蔽部分群問題(State hidden subgroup problem, StateHSP)について検討する。
我々は、$O(log(|G/H|)/sqrt)$forward and inverse query を用いて時間効率の量子アルゴリズムを与え、一致する $(log(|G/H|)/sqrt)$ lower bound を証明する。
応用として、安定化群を学習し、絡み合いを突き止め、隠れた翻訳対称性を同定するための高速なアルゴリズムを得る。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:21:41 GMT)
From Pixel to Poses: Object-centric Tool Manipulation Learning from Human Demonstrations [18.2] ロボット操作のスケールアップは、現実世界のロボットデータの不足によって主にボトルネックとなる。
我々はP2P-Tを紹介した。P2P-Tはデータ効率のよいオブジェクト中心のフレームワークで、人間のデモから直接ツールの使用を学習する。
タスク毎の微調整を最小限にすることで、我々のフレームワークは、実行パフォーマンスにおける過去の技術状況よりも73%改善します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:12:53 GMT)
Towards Communication-Efficient Social Intelligence in Language Agents [17.2] 我々は,コミュニケーションコストを低減しつつ,社会的目標達成を改善するための教員支援コミュニケーショントレーニング(TACT)を提案する。
まず、行動戦略と表現の観点から、コミュニケーション効率を特徴付ける。
表現スペシャリストは意図した行動を維持しながら不要な詳細を除去し、戦略スペシャリストはパートナーの制約に対処する代替案を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:57:16 GMT)
Before Acting, Change the State: Prospective State Intervention for Web Agents under Deceptive Interfaces [17.2] 既存の防御は、主にブロッキング、ガイダンス、または再計画を通じてエージェントの動作に介入する。
これは、タスクプランニングをベースエージェントに任せ、提案されたアクションが不正な結果をもたらす場合、Web状態に介入するエージェントサイドのランタイムディフェンスである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:53:24 GMT)
MemoReason: Evaluating the Effect of Parametric Memory on Contextual Reasoning in LLMs [17.2] 大規模言語モデル(LLM)は推論ベンチマークでよく機能するが、それが真の文脈推論を反映しているかどうかは不明だ。
そこで本研究では,一般的なコンテンツが推論性能を向上させるような広義のテキスト記憶バイアスと,モデルが推論を完全にスキップし,記憶された回答をリコールするTextitStrong Parametric Shortcut hypothesisの2つの可能性について検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:48:06 GMT)
When VLMs Trust Context: Evaluating Scene Text Recognition under Misleading Context [17.2] 視覚言語モデル(VLM)は自然の場面でテキストを読むことができるが、その予測は周囲の文脈に影響される可能性がある。
SceneFaithは、781個のシーン画像のベンチマークで、この振る舞いを研究する。
7つのファミリーの15モデルにまたがって、全てのモデルでは8.45%から58.51%のレートで鮮明な画像の書き直しが行われている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:55:28 GMT)
FLARE: Flow Matching with Local Axis-Angle Representations for Stochastic Micromagnetic Evolution [17.2] 古典的および学習的解法がランダウ--リフシッツ-ギルベルト力学を段階的に伝播させるため、ロングホライゾンのマイクロマグネティックシミュレーションは依然として高価である。
本研究では,有限時間磁化予測を条件付き輸送として再放送するフローマッチングフレームワークFLAREを提案する。
物理的水平線を明示的に条件付けすることにより、FLAREは段階的に統合することなく、複数の目標時間にまたがる全フィールドエンドポイントを直接生成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:59:32 GMT)
Breaking Windows Malware Detection: A Comprehensive Evaluation of Problem-Space Adversarial Robustness [16.8] 問題空間回避攻撃は、機械学習ベースのマルウェア検知器において重大な弱点を露呈している。
8つのWindowsマルウェア検出装置に対する9つの最先端の回避攻撃を評価した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:13:05 GMT)
Same Winners, Different Success Rates: Evaluating How LLM Agents Recover from Failures [16.7] 既存のチェックポイントベースのベンチマークは、独立した実行毎にどのアクションがベストに選択されているかを比較することで、リカバリを測定する。
すべてのアクションが失敗すると、報酬がゼロとなり、独立ランニングは高い確率で同じ結びついた集合を生成する。
等コストベルヌーイ作用に対して、成功確率は各サンプルサイズで同一のベストアクションセット分布が得られることを証明した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:22:21 GMT)
RoutePrism: Tracing Construction Order Effects in Agent Memory [16.7] RoutePrismは、2つの処理順序で同じソースプールから2回メモリを構築する。
再注文によって取り消されたレコードが実際にタスク関連証拠であったかどうかの4条件の介入テストが一致した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:37:57 GMT)
ReplayLens: Auditing Agents' Use of Outcomes [16.7] エージェントがログ化された経験を再利用すると、変更した決定は記録されたスコア、アクション名、記憶中のレコードの位置を反映する。
ReplayLensは、保存された履歴の1つの関係を一度に変更し、残りのインターフェイスを固定し、その結果の判断を計測するブラックボックス監査である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:56:32 GMT)
A Hybrid Attention Model Learning Unified Time-aware Patch Representation for Irregular Multivariate Time Series Forecasting [16.7] IMTS予測のための統合タイムアウェアパッチ表現を学習するハイブリッドアテンションモデルを提案する。
本モデルはIMTS上での最先端のゼロショット性能を実現し,正規予測に移行しても競争力を維持する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:34:12 GMT)
TORQUE: Optimizing What (not) to Quantize Before and After Rotation [16.7] 本稿では,従来の量子化処理を改善するフレームワークであるTORQUEを紹介する。
大規模な入力座標を高精度に保存することは、全体的なエラーを減らすことができる。
量子化誤差の上界を導出し、トップ$k$プレローテーション保持が各$k$に対して最小化することを証明します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:04:24 GMT)
Kafila: Serving Large Language Models on a Trusted Set of Heterogeneous Commodity Machines [16.7] そこで我々は,NATの裏側からリングを組み立てるKafilaを提案する。
プランナーは各デバイスのメモリ帯域幅、容量、到達可能性を測定する。
3つのフリートで異なる機能を持つマシンでは、Kafilaは最も遅いパイプラインステージを最大5.2倍に短縮する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:10:30 GMT)
BV Loss: Block Verification-Aware Loss for Block Diffusion Speculative Decoding [16.7] 拡散ドラフトラは複数のトークンを並列に提案することで投機的復号化を加速する。
本稿では,Block Verification-Aware Los (BV Los)を紹介した。
BV損失は、ブロック検証受入ルールから直接導出され、ドラフトラトレーニング目標とシーケンスレベルでの推論時間検証機構との原則化された接続を提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:25:06 GMT)
No Pain, More Gain: Iterative Merging for Effective Multi-Teacher On-Policy Distillation [16.6] マルチテラー・オン・ポリシー蒸留(MOPD)は、独自に開発されたドメイン教師を1人の学生に組み合わせ、学生が生成したサンプルの予測を蒸留する。
本研究では,教師が参照モデルを共有しながら異なる訓練手順を実践する環境について検討し,MOPDが教師の能力回復に苦慮していることを見出した。
我々は,MOPD (Iterative Merging for MOPD) を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:37:22 GMT)
Transform-Aligned Learned Features for Lossy Point Cloud Attribute Compression [16.6] 変換ベースの手法は、ポイントクラウド属性圧縮のための効果的なフレームワークを提供する。
本研究では,学習空間表現に属性変換を適用することで,変換適応型学習特徴量(TALF)を提案する。
解析の結果, 得られた特徴は滑らかな非線形モデルの1次予測項を正確に表していることがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:27:41 GMT)
From Experience to Expertise: Adoption-Aware Memory Learning for Data-Scarce NPU Kernel Synthesis [16.5] NPUカーネル合成のための持続的自己改善剤であるSAGEについて述べる。
最強の制御ベースラインでは,SAGEが95.5%,84.1%を達成した。
GLM-5.3では、SAGEはスパースフラッシュアテンションに関する torch_npu 参照よりも43.99倍のスピードアップを達成した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:30:42 GMT)
CheatBench: Measuring Reward Gaming in AI Agents [16.4] CheatBenchは、数学研究、知識労働、コーディング、視覚タスク、その他の領域にわたるAIエージェントの不正行為のベンチマークである。
その環境は、挑戦的な課題と不正行為の機会を組み合わせることで、研究者は正直な仕事が難しいときに、どのようにエージェントが目標を追求するかを研究することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:42:57 GMT)
CAT-Free: Multi-View Pedestrian Localization without Calibration, Annotations, or Target-Scene Training via Adaptive Geometric Filtering [16.4] マルチカメラ歩行者位置決めは公共空間や商業空間における広域監視に有用である。
既存の方法は、カメラの校正、位置アノテーション、ターゲットシーンの訓練を必要とする。
CAT-Freeは3つの要件をすべて削除する。
82.5, 84.5, 65.7 MODAをWildTrack, MultiviewX, GMVDで達成している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:47:05 GMT)
Structured Interaction, Visual Localization, and Robust Execution for Complex Web Tasks: A Technical Report on the WebRetriever Challenge [16.2] このシステムは、通常のブラウザ操作にセマンティックなWebページ情報を用いて、構造化されたインタラクションの最初の戦略に従う。
グリッドによる視覚的ローカライゼーションによるアクセス難易度制御、冗長なページとインタラクション履歴の削減のための階層的コンテキスト管理、安定したマルチブラウザタスク処理のためのフォールト・アウェア実行機構である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:02:07 GMT)
Revisit to Segment: Working Memory Distillation for Reasoning Segmentation [15.8] マルチモーダル大言語モデル(MLLM)は、視覚的内容の推論とターゲット位置の予測により、画像セグメンテーションにアプローチしている。
生成されたレスポンスには、推論トレースとローカライズ提案が含まれており、同じイメージとクエリを再考する際に作業メモリとして機能する。
セグメンテーションのためのワーキングメモリ蒸留フレームワークであるSWiM(Reasoning Segmenter with Working Memory)を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:52:33 GMT)
RLE-Bench: A Qualifying Exam for Coding Agents as Robot Learning Engineers [15.8] エージェントは、異質なアーティファクトを構築し、統合し、診断し、改善しなければならない。
RLE-Benchは、インタラクティブ制御、ポリシー学習、知覚と推定、機械設計の4つのロボット開発にまたがるロボット学習タスクのベンチマークである。
我々は、エージェントが訓練した政策エージェントに達成した成功率、ハーネスエージェントの構築、そしてエージェントが設計した機械構造から、コーディングエージェントが提出したアーティファクトを評価するために、多様なタスク固有のメトリクスを使用します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:16:09 GMT)
XFlow: A Workflow Model for Instruction-Guided Lesion Segmentation in Chest X-rays [15.7] 胸部X線検査におけるインストラクション誘導病変分割(ILS)のワークフローモデルであるXFlowについて述べる。
XFlowは、内部評価と外部評価の両方において、最高のセグメンテーション品質を達成する。
2つの病変が同じアノテーションで訓練された場合でも、ROSALIAよりもセグメンテーション品質が高い。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:53:17 GMT)
Causal Routing for Unlearning [15.7] CRU(Causal Routing for Unlearning)について紹介する。
CRUは、この概念がモデルでどこに表現され、その部分だけを抑圧するかを問う。
トレーニングされていないフォワードが、その活性化の仕方によってニューロンをランク付けする。
これらのニューロンの小さなルーティングモジュールは、忘れられる必要のある概念のみをゲートし、抑制する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:29:22 GMT)
One Rollout Is All You Get: Fully Test-Time Adaptation for GUI Agents [15.7] GUIエージェントは凍結した重量でデプロイされ、仕事で経験したすべてのものを破棄します。
これらの制約によりGUIエージェントの完全なテスト時間適応を定義し、最小の重み空間法であるSOLOと組み合わせる。
WebArena、VisualWebArena、MobileWorldから構築された繰り返しタスクストリームでは、UI-TARS-7BとQwen3-VL-8Bの両方でフリーズエージェントを3~6ポイント改善し、Webストリーム上で2つのインセットメモリメソッドを超える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:00:45 GMT)
Late Attention Layers Alone Can Copy Entity Tokens, but Not Without Attending to Their Context [15.6] 大規模言語モデルの後半の2つの異なる層群は、エンティティのコピーに必要かつ十分であることがわかった。
本研究は,コンテキストトークンの指導の下で,エンティティコピーにおける後期層の重要性を実証するものである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:23:01 GMT)
The Canonical Order Problem: When Large Language Models Are Unreliable Knowledge Bases for Multi-Valued Relations [15.4] 大規模言語モデル(LLM)が多値関係をどのように表現し生成するかを検討する。
メカニスティック解析により, LLMにおける集合生成は3つの相の観点で考えることができることを示す。
この内部標準順序から逸脱するKBの構築を目指すプロンプトは、LSMの信頼性を著しく低下させる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:09:12 GMT)
Clinical Trajectory Alignment for Medical Vision-Language Pre-training [15.4] 訪問レベルのクロスモーダルマッチングから臨床変化の学習まで,医療ビジョン言語による事前学習を再構築するMedCTAを提案する。
異常範囲では、臨床的に根拠付けられたクエリは、異常条件付き視覚的およびテキスト的軌跡を構成し、異種異常の進化を捉える。
患者の対象範囲では、グローバル画像および報告シーケンスをモデル化し、個々の異常を超える総合的な臨床経過を捉える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:58:04 GMT)
FlexiWorld: Learning and Planning via Flexible Action Chunks Across Multiple Time Scales [15.3] 潜在世界モデルは、複数の原始的なステップにまたがるアクションチャンクを使用して、ゴール指向の計画のための将来の状態を予測する。
我々は,JEPAベースのワールドモデルであるFlexiWorldを紹介した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:26:49 GMT)
When Trees Are Not Enough: Learning Mixed-Topology Feature Graphs with Adaptive Graph Sparse Autoencoders [15.3] 適応グラフスパースオートエンコーダ(AG-SAE)を導入する。
AG-SAEは、各機能の完全な親セットを原子構造仮説として扱う構造誘導トレーニングパラダイムである。
実験は、制御されたおもちゃモデルにおいて正確な混合トポロジー回復を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:24:47 GMT)
The Marathon of Scientific Reasoning: Robustness of Scientific Agents to Perturbations in Multi-Turn Interactions [15.3] textscSciARP (textbfScientific textbfAgent textbfRobustness to textbfPerturbations) は科学的に妥当な摂動下での科学的エージェントの評価のためのベンチマークである。
textscSciARPは620の科学的問題を3-13ターンの相互依存タスクに変換する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:04:00 GMT)
Simultaneous Translation between Sign Languages [14.8] 既存のサイン・ツー・サインの翻訳システムはオフラインで実行され、ターゲットのサインが出力される前に全ソースのクリップが必要になる。
本稿では,2つのwait-k計算方式と,マルチパス監視によるトレーニングされたwait-kモデルを備えた,S2S翻訳システムを提案する。
小型の人間検証テストセットと大型の合成S2Sコーパスで6つのS2S方向を平均して,9%のDTW-PA-MPJPE増加と2.1のBLEU-4低下を保ちながら38%のca-Stream-AL低減を実現した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:54:03 GMT)
DRIFT: Disentangled Responsive-Invariant Flow Transport for Single-Cell Perturbation Prediction [14.8] 摂動に対する細胞応答の予測は細胞生物学の中心的な問題である。
我々は、既存の変動性を考慮せずに、フレキシブルでデータ駆動型摂動効果モデルを開発する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:12:33 GMT)
WorldWeave: Growing Persistent Geometric Worlds for Video Generation [14.7] We present WorldWeave, a world generation framework that a world-state maintenance from visual rendering。
WorldWeaveは、連続的な標高マップ生成とエージェント誘導シーンの組織を組み合わせることで、拡張可能な明示的な3D世界を構築する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:25:07 GMT)
Polylogarithmic Nash Regret in Matrix Games with Bandit Feedback [14.7] バンド利得フィードバックによる未知有限行列ゲームにおけるナッシュの後悔について検討し、相手の動作を観察した。
我々は、インスタンス依存の$mathcalO(log2 T)$ナッシュ後悔を実現するOPB(Optimistic Payoff Balancing)を開発する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:13:59 GMT)
Minimax Last-Iterate Convergence in Matrix Games with Observed Actions [14.7] 各ラウンドで高い確率で$widetildemathcalO(sqrtd/t)$の双対性ギャップを達成するアルゴリズムを開発する。
レートは標準帯域幅の下限と一致し、アクションの数とラウンド数の両方において最小限の最適性を確立する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:59:34 GMT)
From Dead Code and Static Requirements to Working Engines: Software Revival with Coding Agents [14.7] ReviveBenchは、ネイティブ実行環境に対する隠れ検証によって評価された2つのタスクファミリを持つベンチマークである。
リカバリファミリーは、依存関係の非互換性、削除されたコアモジュール、レガシビルド、GPUベースのファンデーションモデルを含む10のタスクで構成される。
再構成ファミリーは、数値、幾何学、ハードウェア、取引システムにまたがる13のタスクからなる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:30:12 GMT)
Can We Trust the Teacher? Decoupled Credit Direction-Magnitude for Self-Distillation [14.6] 我々は、理論的には信用方向と大きさを2つの信頼できる信号に分解する、textitDecoupled Credit Self-Distillation (DCSD)を導入する。
11のベンチマークで、DCSDはGRPO、OPSD、RSSD、RCCSDに対して最高のスコアを得る。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:43:13 GMT)
PersonaManifold: Revealing and Exploiting Curved Geometry in LLM Persona Representations [14.2] 大規模言語モデルにおけるペルソナを推論時に制御することは、ロールプレイング、パーソナライズされた対話、社会シミュレーションにおいて重要である。
最近の手法では、モデルの活性化空間からペルソナベクトルを抽出し、ユークリッド演算を適用する。
我々は、アクティベーション空間における曲線付き低次元リーマン部分多様体上の点としてペルソナ表現をモデル化するフレームワークであるペルソナ多様体を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:19:52 GMT)
Optimal Networks for Agentic Information Aggregation [14.2] 我々はKearns,Roth,Ryu(SODA 2026)が導入したネットワーク学習モデルにおける情報集約について研究する。
有限深さでは、設計者が分布を知っている場合でも、エージェントごとに1つの親を持つ全ての分布に対して正確なアグリゲーションが保証されないことを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:19:38 GMT)
Rubric Rewards from Item Response Theory [14.2] 応答理論は、基準基準が共有対象の単調な指標である場合に品質を測定し、基準を選択する。
このモデルでは、その確率スコアは品質の局所的な信号対雑音比を最大化する。
トレーニング中にポリシーの配布が変わると、RTは現在のロールアウトからRPNを更新するためにオンライン期待を使っています。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:15:37 GMT)
A mechanistic study of language model introspection [14.2] 大きな言語モデル(LLM)は、しばしば内部のアクティベーションに摂動を報告できる。
本稿では,入力テキストを固定する制御タスクを用いて,この問題について検討する。
イントロスペクティブ・レポーティングでは,2つの小さな注意点群がそれぞれ異なる役割を担っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:13:10 GMT)
Bayesian Active Learning for Intent Disambiguation in Interactive Robot Planning [14.1] 対話型ロボット計画では、自然言語の指示から人間の意図を推論し実行する必要がある。
本稿では,STL(Signal Temporal Logic)タスク仕様に対して,明確化をアクティブな学習問題として扱うベイズフレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:19:58 GMT)
Muon Sublates the Edge of Stability in LLM Pretraining [13.8] ムオンの大きなステップのダイナミクスは、古典的な不安定な降下図では捉えられていないことを示す。
制御された実験により、損失バランスと時間的アライメントは学習率とバッチサイズに異なる反応を示す。
損失ニュートラルエッジは残るが、普遍的な時間方向シグネチャは伴わない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:17:01 GMT)
BASE: Batch-Aware Selection of Experts Using Predicted Removal Error for Efficient MoE Decoding [13.8] 大規模言語モデルはますます高価になる。
大規模サービスシステムでは、モデル重みの転送によって自己回帰復号化がボトルネックとなることが多い。
入力トークン毎のエキスパート除去コストを推定する軽量線形予測器を開発した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:20:13 GMT)
Cyclostationary Phase Conditioning for Medical Time Series Diffusion [13.8] 運動、接触不良、生理的干渉は診断に必要な形態を曖昧にする。
既存の拡散は、崩壊した観測だけで条件に近づき、サイクリック構造を暗黙的に学ぶ必要がある。
代わりに、シフト共変ウェーブレット表現と、サンプルごとの高密度位相条件を符号化する2つの帰納バイアスを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:48:11 GMT)
DivOPD: Spread Wide, Look Close for Asynchronous On-Policy Distillation of Multi-turn Agents [13.8] DivOPDは単純な学習者側バッチ選択法であり、より多くのロールアウトに固定ターン予算を分散させる。
累積的な教師が生み出す経験でターンを優先する。
トレーニングトークンの1.84倍、バニラOPDの1.87倍のGPU時間を持つ、レポートされた設定固有のターゲットに到達する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:35:39 GMT)
Output-aware Residual Stream Pruning for Large Language Models [13.7] 残留ストリームプルーニング法は、モデルの隠れ次元を縮小することにより、推論コストを低減する。
この方向依存感度を直接考慮した残差ストリームプルーニングに対する感度認識手法を提案する。
以上の結果から, 活性化エネルギーの保存だけでは残留流破砕には不十分であることが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:35:45 GMT)
Composable Decoding on the Probability Simplex: Theory and Implementation [13.7] 確率単純度上の次トーケン分布に対する最適化問題としてデコーディングを定式化する。
このビューは、正規化とサポート制約の選択を通じて、よく知られた復号法を復元する。
これにより、単一最適化問題内で分布選好を構成することで、新しいデコーダを構築することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:02:33 GMT)
SAGE: Structured Strategic Reasoning for Efficient LLM Game Playing [13.7] SAGEは、LLMの戦略的推論を3つの協調操作を中心に構築する、トレーニング不要な推論時間フレームワークである。
戦略的に関係した相互作用を、以前に欠落した考慮事項に関する反実的な仮説に蒸留する。
推論集約的なLSMエージェントと比較すると、SAGEはLiar's Diceの127.6%の改善を達成している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:20:04 GMT)
When Words Fall Short: Iterative Synergy Between Verbalized Reasoning and Hidden Features for LLM Confidence Estimation [13.6] Iterative Policy-Estimator Training (IPoET)は、言語化された推論トレースと情報表現の相補的な強みを相乗化するためのフレームワークである。
IPoETは、ポリシー最適化と推定器更新を交互に行い、推定器由来の信頼フィードバックをポリシー学習に統合する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:12:49 GMT)
Compute Time Scaling with Recursive Models for Combinatorial Optimization [13.6] 我々は、深さ(どのようにネットワークを呼び出すか)と幅(どの程度並列にサンプリングするか)の両方をスケールする最適化のための一般的なニューラルネットワーク手法を提案する。
そして標準のErds-Rényi-[700-800]ベンチマークでは、MISでしかうまく機能しないものを除いて、すべてのニューラルソルバを上回ります。
次に、自己教師型トレーニングのためのセルフレパートリングについて検討する。我々は、現在のトレーニングラベルのセットを、代替のトレーニング信号として、モデル独自のより良いソリューションに定期的に置き換える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:25:43 GMT)
Guided Uncertainty-Aware Robust Domain Transfer [13.5] GUARD(Guided and Uncertainty-Aware Robustness to Domain shift)は、既存のデプロイモデルを更新するための統一統計フレームワークである。
GUARDは、現在のモデルに固定された半教師付き逆最適化問題として、堅牢なマルチソース変換学習を定式化している。
そして、ソースモデルにおけるサンプリングのばらつきを考慮しつつ、ソース情報とターゲット情報を組み合わせた不確実性を認識したガイド付きグループDRO推定器を構築する。
我々は,10年以上にわたる慢性関節リウマチの慢性関節リウマチに対するGUARDの有用性について,広範囲なシミュレーション実験と実世界の応用例を示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:20:38 GMT)
RoboCompiler: Graph-Native Compilation of Closed-Chain Robots for Consistent Modeling, Control, and Simulation [13.5] 本稿では,標準機構グラフを共有メカニカルインタフェースにコンパイルするグラフネイティブフレームワークであるRoboCompilerを提案する。
体、関節、フレーム、慣性体、アクチュエーターポートからクロージャーパスと分析的残留ヤコビアンを構成する。
小松掘削機,Unitree Go2,Franka Panda,Kangaroo,および6UPSスチュワートプラットフォーム上での物理ループとタスク誘起制約を評価した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:46:49 GMT)
The Universal Classifier for Graph Learning [13.4] 任意の特徴とクラス濃度をサポートし、ノード、エッジ、グラフレベルの目的を統一するUniversal Backbone(UC)を導入する。
UCは、全てのノード、エッジ、グラフレベルの予測タスクを、潜在空間における類似性を最大化するものとして再構成する。
このアーキテクチャでは、ノード分類、ノード回帰、および特徴セマンティクスの異なる未確認グラフをまたいだリンク予測を、単一の事前学習モデルで一般化することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:38:17 GMT)
JET: Judge-Guided Evolution at Test Time for Agent Programs [13.2] 試験時間における判断誘導進化(JET)は、ラベル付きソーストラジェクトリ上で実行可能な判断を進化させ、それを凍結し、ターゲット側のプログラム進化を誘導するために転送する。
JETは、未進化のプログラム(コールドスタート)から進化が始まると、固定ルーブリックガイダンスよりも平均報酬が約13%高くなり、ソースタスク(保存スタート)ですでに最適化されたプログラムから始まると4%高くなります。
分析は、進化したコードで有用な報酬予測ロジックを特定し、より良い最終選択だけで利得を説明できないことを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:04:37 GMT)
ORAV: Benchmarking Audio-Video Generation from Multimodal Contexts [13.2] ORAV Bench for Omni Reference Audio-Video Generation, including 380 task instances with 2-10 references, 9 semantic role, and 30 role compositions。
本稿では,視覚的および聴覚的エビデンスを準備し,各参照の意図した貢献を比較し,提示順序の全体的検証を行う,参照対応のペアワイズプロトコルを開発する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:40:41 GMT)
Direct Self-Evolving Optimization: Evolving LLMs without Challenger Training [13.1] textbfDirect Self-textbfEvolving textbfOptimization (DEO)を導入する。
DEOはR-Zeroと競合する推論性能を達成し、壁時計のトレーニング時間を50%以上削減した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:26:56 GMT)
What Paired Evaluations Reveal under Visual Perturbations [13.1] ロバストネス評価は多様な視覚的摂動を検査する必要があるが、ベンチマークは実際の条件のみをカバーし、物理的なテストはコストがかかる。
この画像対応性は, 対評価結果の解釈と, 物理試験用サンプルの優先順位付けという, 強靭性評価の2つのニーズをサポートするかを検討した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:37:11 GMT)
Emergence, Not Bandwidth: Physical Coupling and the Limits of Learned Multi-Agent Communication [13.1] 利率制限されたマルチエージェントチームは、創発的なコミュニケーション文学が経験的にのみ答えた3つの質問を提起する。
我々の定理は、どんな学習者とも独立して達成可能なものを修正するので、エンジニアと学習した送信者の間のギャップは、最適化事実である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:46:53 GMT)
TRACER: Trajectory-Aligned Learning for Multi-Turn User Simulation [13.0] ユーザ意図の進化をモデル化し,シミュレーションされた軌跡を実物と整合させるマルチターンユーザシミュレータTRACERを提案する。
リファレンスコホートに組織された実際のカスタマーサービスセッションでは、TRACER-7Bが11.4の変換F1ポイントで最強のベースラインを越えた。
人間のチューリングテストでは、アノテータはTRACERの会話をほぼ精度で識別した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:34:28 GMT)
d-OPD: Future-Aware On-Policy Distillation for Block Diffusion Language Models [13.0] 我々は,AR教師の分布を改良し,生徒の目に見える状態に適合する将来的なオンライン蒸留法であるd-OPDを紹介した。
Qwen3の0.6Bから8Bまでのモデル全体で、d-OPDはOPDLMよりも最大4.0ドルポイント向上している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:08:22 GMT)
Over-Personalization Is a Decision Failure: Generation-Induced Apply Bias in LLMs [12.9] LLMは、格納された各好みに対して、現在のコンテキストがそれを適用または抑制するよう求めるかどうかを判断しなければならない。
選好処理を3段階に分割し,それぞれを個別に測定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:29:25 GMT)
TermJudge: A Document-Level Metric Judging, Not Counting, Terminology in Machine Translation Evaluation [12.9] TermJudgeは、すべての項発生に対して解釈可能な検証を割り当てる文書レベルの用語メトリクスである。
システムレベルのメタ評価とセグメントレベルのメタ評価の両方で、用語の整合性と品質推定のベースラインよりも上位に位置する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:17:49 GMT)
Conformal Prediction and Conditional Coverage for Tabular Foundation Models [12.9] C-USIMは、高い予測密度分割共形予測の軽量な応用である。
これは我々の仮定の下で有限サンプルの限界有効性を提供する。
TabPFNとTabICLによる実験では、限界カバレッジ精度が向上し、平均条件およびグループカバレッジエラーが低減された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:58:51 GMT)
Using Context Is Not Enough: Test-Time Training for Personalized Reward Modeling [12.9] 提案するPreference-Aligned Test-Time Training (P-TTT) は,パーソナライズされた報酬予測のために,ユーザ固有の高速ウェイトへの嗜好関係を明示的に符号化する。
P-TTTは実装が簡単で、計算効率が良く、1つのフォワードパス内の高速ウェイトを推論時バックプロパゲーションなしで更新する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:13:57 GMT)
DisKO: Deep Koopman Learning in Distribution Space from Unpaired Snapshots [12.9] DisKO は深いクープマン学習を拡張して、予測的分布観測可能性、有限次元クープマン表現、および全分布への生成写像を共同で学習することで、分布力学に寄与する。
DisKOは、長時間の予測タスクにおいて、エラーの蓄積が著しく遅く、性能が向上する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:48:43 GMT)
Multi-Task Learning of Conditional Mean Operators: applications to dynamical systems and uncertainty quantification [12.9] 条件平均演算子(CMO)は、幅広い条件統計クラスへのアクセスを提供する。
既存の手法では、それぞれのCMOを独立に推定するか、あらかじめ定義された関数空間に制約する。
本稿では,共有関数空間とタスク固有演算子を共同で学習するフレームワークであるMTL-CMOを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:35:49 GMT)
UniAR: A Unified Framework for Autism Recognition Enhanced by Multi-View Prompt Learning [12.8] 異種データ変動下での頑健なASD認識のための多粒性学習により強化された統合フレームワークUniARを提案する。
UniARは既存の最先端の手法を一貫して上回り、MRIベンチマークでは平均75.9%、顔面ベンチマークでは91.6%を達成している。
これらの結果は、UniARが意味不足下でのASDスクリーニングのための堅牢で解釈可能なフレームワークを提供することを示している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:16:05 GMT)
The Low-Rank Structure of VLA Reinforcement Learning [12.7] 強化学習(Reinforcement Learning, RL)は、視覚-言語-行動モデル(VLA)の訓練後モデルに使用される。
本稿では,パラメータ空間における学習信号のエンコード方法を検討することによって,RLがVLAポリシーにどう影響するかを検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:32:26 GMT)
CORE: COverage CAlibration and Evicted-Mass REdistribution for KV Cache [12.7] 長いコンテキストの復号化はキー値(KV)キャッシュメモリと帯域幅によってますます制限される。
既存の固定予算圧縮法は、通常、補償から保持を分離する。
COREは最強のRULERベースラインを最大3.78ポイント、90%の圧縮で上回っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:31:48 GMT)
Style-Driven Data Synthesis and Degradation-Aware Enhancement for Ultrasound Image Restoration [12.7] 安価なハンドヘルド超音波装置は、専門病院の超音波装置と比較して広く展開することができる。
彼らの画像は、臨床的判断を誤解させるような複合的な劣化に悩まされている。
本稿では,手持ちの低品質画像(LQ)を病院の高画質画像(HQ)にマッピングする問題に対処する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:17:41 GMT)
INTCC: A Framework for Interactive Confidential Computing [12.7] 本稿では、信頼できないデータプロセッサがデータ機密性を損なうことなく、TEE内で非決定論的操作を実行できるシステムアーキテクチャを提案する。
本稿では,(1)ネイティブ開発体験を維持するためのプロキシベースのディスパッチシステム,(2)データ漏洩を防止するためのセキュリティ格子に基づくきめ細かい情報フロー制御機構,(3)動的ランタイムのコンプライアンスを保証するためのプライバシ検証実行機構,の3つの主要なメカニズムを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:25:38 GMT)
An Exact Polynomial Task-Risk Bridge for Time-Multiplexed Photonic Quantum Reservoirs [12.6] 時間多重化(TDM)フォトニック貯水池は通常、いくつかのデータセットのスコアによって判断される。
3つのステップで、タスクから予測リスクへの正確なブリッジを導出します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:16:50 GMT)
Handwritten Text Recognition Lives in the High-Pixel Variance Subspace [12.6] 手書き文字認識のための自己教師付き事前学習において、画素再構成法はコントラスト法より優れている。
画素再構成の値は、入力の識別信号がどこにあるかによって異なることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:54:35 GMT)
Right Words, Wrong Moment: A Clinician-Grounded Analysis of Distress in 19,930 Conversations between Young People and ChatGPT [12.4] 若者は苦悩の瞬間にGPCA(General-Purpose Conversational Agents)に目を向ける傾向にある。
若年者158名を対象に,ChatGPT19,930件の会話と調査データを収集した。
苦悩した被験者は、ChatGPTとの感情的な関係が強く、相手よりも使用による行動の変化が大きかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:53:26 GMT)
Rubric-Calibrated Preferences: Cross-Query Calibration of LLM Judgments via Item Response Theory [12.4] リランカー同士が品質面で接近するにつれ、これらのラベルのnDCGは分離に失敗する傾向にある。
1つのクエリ内の相対的な判断は、クローズドな候補を区別するが、そのスコアはクエリ間でスケールを共有しない。
RCPの検索基準であるRCP-nDCGは、nDCGの離散ラベルを関連性確率に置き換える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:54:16 GMT)
PEARL: Adaptive Prefill-Decode Execution with Elasticity for Agentic Reinforcement Learning [12.4] 非同期実行とエラスティックGPUリソースはこのステージを加速するが、ロールアウトレプリカを追加するとリターンが減少する。
本稿では,外部資源の弾性,アイドルトレーニングGPUの一時的再利用,適応PD実行を協調するエージェントシステムであるRL PEARLを提案する。
評価の結果,PEARL は LLM 間の固定リソース ROLL のスループットを2.17$-2.79times で達成した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:35:47 GMT)
Deep Weighted Bellman Residual Minimization for $Q^*$ Estimation [12.3] オフ政治評価は、オフライン強化学習の基礎となる要素である。
本稿では,密度比重み付けを取り入れたベルマン残留最小化フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:30:21 GMT)
Who Gets a Token, and What Does It Carry? Unequal Name Support and Concept Access in Large Language Models [12.3] 複数のサブワードから組み立てられた名前が直接シングルトークンアクセスを受け取り、不平等な名前と表層のサポートを生み出していることを示す。
モデルネイティブできめ細かなプレビヘイビアフレームワークであるNameTraceを紹介し、不平等な名前表面サポートが語彙的特性のままであるかどうかを測定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:46:18 GMT)
PADMÉ: Preference Alignment Data Synthesis for Meta-Evaluation of LM Agent Evaluators [12.3] 本稿では,エージェント設定のための信頼性の高い基準に基づくメタ評価データを生成するデータ合成手法PADMを紹介する。
PADMのプロトタイプを作成し、4つのエージェントドメインと3つの評価基準にまたがる1,000のサンプルのデータセットを合成する。
150サンプルのサブセットに対するヒトの検証は、PADMが人間の判断との一致を73%から85%に改善することを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:31:13 GMT)
Better Nearest Neighbor Graph Indices via (Efficient) LLM-Guided Pruning [12.3] グラフベースニアニアサーチ(ANNS)は大規模セマンティックサーチに広く利用されている。
検索した結果とクエリのセマンティックな関連性に基づいて性能を評価する。
これにより、インデックスの構築方法と、検索結果の評価方法との間には、基本的な「幾何学的」なミスマッチが生じる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:47:05 GMT)
LENS: The Sum Is Worse Than the Parts for Set-Level Poisoning in Retrieval-Augmented Generation [12.3] 制約された証拠構成として構築をキャストする枠組みを提案する。
4つのベンチマークと3つのジェネレータで、返送パケットは0.852のフルセットのASRと0.784のASR@5を達成する。
盲目の人間の監査では、返却パケットの68.3%が不正なターゲット、明確な解答基準シフト、およびターゲットの含意を組み合わせている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:33:32 GMT)
Latency and accuracy tradeoffs in Spiking Neural Networks [11.7] スパイクニューラルネットワークは低消費電力の音声コマンド認識には魅力的である。
遅延はエネルギー効率よりもはるかに少ない。
本稿では,より局所的な時間経過がネットワーク遅延を増大させるという仮定に挑戦する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:20:46 GMT)
Relevance-Resolution Transfer via Scale-Decomposable Fractional Diffusion for Multi-Length Cross-Modal Hash Retrieval [11.6] クロスモーダルハッシュは、異種データをコンパクトなバイナリコードに符号化することで、効率的な検索を可能にする。
近年の手法は、多ラベル学習構造に符号化された微粒な関係を利用する。
本稿では,マルチラベル構造からマルチ長ハミング空間へ関連度を伝達するMultiBitを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:07:53 GMT)
When Should the Count Change? Learning State Maintenance for Causal Video Counting [11.6] StaMinaは状態条件の更新を通じてカウント状態を維持することを学ぶ。
部分的なビデオオーバーラップと連結アノテーションの保留グループによるカウント適応の評価を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:29:48 GMT)
CyFA: Linear Sequence Modeling with Relative-Time-Partitioned Memory [11.5] 線形RNNは線形時間シーケンス処理と定数メモリデコードを提供する。
既存の忘れるメカニズムとデルタルールの更新は、状態を選択的にクリアまたは修正することで干渉を減らす。
相対時間分割メモリを備えた線形RNNであるCyFA(Cyclic Flow Attention)を紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:47:43 GMT)
SignFLIP: A Unified Model for Sign Language Translation and Generation via Stage-wise Alignment at Scale [11.5] SignFLIPは、翻訳と生成のための統一LLM中心のフレームワークである。
テキストとサインの双方向マッピングを可能にするため、SignFLIPは大規模データ上に構築された段階的なトレーニング戦略とともに対称アーキテクチャを採用する。
複数のベンチマーク実験により、SignFLIPは、翻訳タスクと生成タスクの両方におけるタスク固有モデルと比較して、競合する性能を示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:08:50 GMT)
When Ambiguity Meets Atypicality: Dual-Perspective Test Input Prioritization for DNNs [11.5] 決定的あいまいさと分布的非定型性は、クラス間の競争とクラス内典型性を特徴づけるために広く採用されている。
我々は、クラス間とクラス内の両方の視点を共同で組み込んだ、深層ニューラルネットワーク(DNN)のためのKNN密度に基づくテスト入力優先順位付け手法であるDuFPを提案する。
実験結果から,DuFPは故障発生入力を効果的かつ効率的に優先順位付けし,最先端の手法より優れていることが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:19:30 GMT)
CineSubBench: Evaluating LLMs on Long-Form Narrative and Cultural Understanding from Multilingual Movie Subtitles [11.4] CineSubBenchは、多言語映画字幕から長文映画理解を評価するためのベンチマークである。
CineSubBenchには1012本の映画があり、6つの言語で完全な字幕カバーがあり、6,072曲と8.13Mのタイムスタンプ付き字幕エントリがある。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:16:09 GMT)
SubRot: Signed Gradient Subspace Calibration for VLM Rotation Quantization [11.4] SubRot は VLM 回転量子化のための符号付き部分空間キャリブレーション法である。
We show consistent average-score improvements over FlatQuant under W4A6 and W4A4, to to 1.4 points on LLaVA-NeXT-7B。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:58:30 GMT)
MarsLab: A Martian Rover Simulator for Planetary Rover Autonomous Navigation [11.4] 将来の火星ミッションでは、未構造化の地形を横断し、照明、大気塵、限られた通信を行うローバーの自律性が必要になります。
我々は、自律性とナビゲーションアルゴリズム開発のためのオープンソースのROS2ネイティブ火星ローバーシミュレータであるMarsLabを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:18:28 GMT)
Aerial GRIPPER: A Gradient-based Real-time Inverse-game Predictor and Planner [11.3] 不完全な情報の下で、一般サム追従回避ゲームとして定式化される。
不確実なペイロードとグリップの作動の障害を克服するために、反ゆらぎ制御装置が開発された。
非協調的な目標を捕捉し、提供するタスクは達成され、フレームワークの堅牢性、適応性、リアルタイムのパフォーマンスが強調される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:30:21 GMT)
Building Transformation Layers for Riemannian Neural Networks [11.3] 計算可能な空間上にユークリッド完全連結(FC)と畳み込み層を構築するための枠組みを提案する。
このフレームワークは、異なるジオメトリーにまたがるいくつかの以前のFC層を特別なケースとして含んでいる。
異なる多様体測地に関する実験は、我々のアプローチの有効性と適用性を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:39:37 GMT)
Self-Evolving Coding Agents: From Digital Programs to Physical-World Intelligence [11.3] 視覚言語アクション(VLA)と世界行動モデル(WAM)は、観察と指示を直接ロボットアクションにマッピングする。
タスク要件、条件、進捗、障害回復は暗黙的にアクションシーケンスにエンコードされる。
タスクの状態と実行をコードとして表現する物理符号化を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:38:07 GMT)
ATLAS: Aligned Transport of Latent Structure for Reliable World Model Planning [11.3] 潜在限界のみを正規化することは、行動選択に使用される状態と状態の関係を決定できないことを示す。
我々は、関係幾何学を明示的に保存する訓練目的であるLAS Transport of Latent Structure (ATLAS)を紹介する。
ATLASは、PushT、TwoRoomエンコーダ、OGBench-Cubeの低次評価サブセットおよび高次評価サブセットにおける平均目標達成の成功を改善している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:09:55 GMT)
Continuous Assurance of Agentic Security Auditors for Software Delivery Decision Gates [11.2] 大規模言語モデル(LLM)ベースのリポジトリ監査は、継続的インテグレーション(CI)パイプライン内のセキュリティコントロールとして、ますます多くデプロイされている。
本稿では,Trustworthy AI Posture (TAIP) Assurance Engineによって実装されたポリシエビデンス・実行分離パターンを提案する。
固定されたPython Null Pointer Dereferenceベンチマークにおいて,修正されていないRepoAuditを用いたアプローチの評価を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:23:38 GMT)
From Classical to Quantum Channels: Achieving Positive Covert Rates [11.2] 我々は、離散記憶のない古典的量子チャネル、古典的量子チャネル、量子チャネルに対して、正の速度でカバート通信が可能となる条件について検討する。
入力確率の次元がチャネル出力で誘導できる出力状態の集合のアフィン次元を超えた場合、古典量子DMCのある種のクラスに対して正の被覆率が得られることを示すことによって、これらの結果を古典量子DMCに拡張する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:32:33 GMT)
Edge-Level Automorphism in GNNs: A Quantitative Framework and Effective Designs For Link Prediction [11.1] グラフニューラルネットワーク(GNN)は、置換同変アグリゲーションを通じてノードを学習し、埋め込みをリンクするのに有効である。
標準GNNは自己同型ノードを区別不能な表現に分解し、ノード自己同型問題を引き起こす。
グラフ内のリンクを識別するGNNの能力を定量化するスカラー計量であるエッジ自己同型比(EAR)を導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:29:34 GMT)
How to Tame a Multi-Headed Hydra? Adaptive Multi-Category Safety Steering for Large Language Models [11.1] CAM-Steerはカテゴリー適応型多カテゴリ安全ステアリングフレームワークである。
これは、現在の隠れ状態と安全で安全でないプロトタイプを比較して、各有害カテゴリーに関連するリスクを推定する。
構成された操舵方向に沿って隠れ状態が回転し、推定リスクによって回転角が決定される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:53:31 GMT)
Prompted Identity Degrades Cooperation in Multi-Agent LLM Systems [11.0] エージェントが互いのモデルファミリを認識している場合、グループをクラスタに分割し、エージェントが同じラベルを持つ他のエージェントと対話することを好むことを示す。
我々は,この現象を,最大5つのオープンウェイトモデルファミリーから引き出された9~25個のエージェントを用いて,2つの協調ゲームと推論ベンチマークで示し,評価した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:02:07 GMT)
Structured Latent Modeling for Supervised Multimodal Information Decomposition [11.0] 本研究では,中間層にコントラストやマスキングの目的を適用可能なフレームワークを導入し,ソースワイドな非可逆正規化フローと,教師付き低ランク潜在変数モデルを提案する。
このアーキテクチャは、共同分布を、共有タスク関連変分、モダリティ特化予測変分、タスク非関連変分に明確に分解する。
最終的に、このフレームワークは構造化された可能性に基づくガイダンスと中間表現学習を結合し、連続したマルチモーダル相互作用を特徴づける実用的な潜在変数レンズを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:04:24 GMT)
Monotonicity of the Rényi channel capacity under non-signaling assisted channel simulation [10.2] 非シグナリングボックスはエンコーダとデコーダのペアよりも厳密に大きなクラスを形成する。
非符号ボックスが任意の順序でレニイ容量を上げることはできないことを証明します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:21:52 GMT)
Correcting to Predict: Pseudo-Value Correction for Multimodal Attribute Value Extraction [10.1] 本稿では属性抽出を補正処理として扱うフレームワークC2Pを提案する。
トレーニング中、様々な擬似値が、モデルがエビデンスに基づく修正行動を学ぶのに役立つ。
推測では、固定されたプレースホルダーが学習された修正動作をトリガーし、効率的なシングルパス予測を可能にする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:59:19 GMT)
An Exact Generate - Transform Decomposition of Small-LLM Team Scaling Across Orchestration Architectures [10.1] 1つのLLMエージェントをコラボレーションチームに置き換えることは、正確さを高めることができるが、チームのスケーリングが有効で、どのアーキテクチャをスケールするかは不明だ。
5つの命令チューニングされた7-9Bモデルと5つのショートアンサーベンチマーク、最大30コールまでの実行可能コードベンチマークの8つのエージェントオーケストレーションアーキテクチャから、チームのスケーリングに対するリターンは、タスク依存であることが分かりました。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:40:39 GMT)
Mutually Adversarial Self-Training with Evolving Data for Unified Multimodal Models [10.1] 統一マルチモーダルモデル(UMM)は、画像生成と視覚的理解を共有バックボーンで結合する。
両枝の協調監督による自己訓練型UMMの研究
強化学習に基づくポストトレーニングフレームワークであるMATEを導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:22:14 GMT)
Emergi-PersonaOS: A Persona Agent Operating System for Situational Adaptation and Controllable Evolution [10.1] 我々は,ペルソナオブジェクトを管理する心理学的なオペレーティングシステムであるEmergi-PersonaOSを紹介する。
状況適応中に、現在のインターロカタ、関係、イベント、検索された記憶を統合して、ペルソナ状態を推測する。
長期的な開発において、経験と成果を記録し、修正候補の開発と評価を行う。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:05:15 GMT)
Org-Agent: Beyond Personal Assistants Towards Organizational Agents [10.0] タスク実行を3段階にまとめる,制約中心の統一推論フレームワークであるOrg-Agentを紹介する。
Og-Agentはタスクをアトミックなサブタスクに分解し、タスク依存グラフを構築する。
次に、エビデンス取得とメモリ管理ツールによってサポートされているタスクの制約を考慮しながら、各サブタスクを実行する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:07:00 GMT)
Let the Neurons Die: Exploiting ReLU-Induced Model Degradation [10.0] データ注文と中毒に基づく3つのトレーニングタイムアベイラビリティーアタックを提案する。
MNISTでトレーニングされた完全に接続されたReLUネットワーク上では、6万のトレーニング例のうち100が、テストの正確性をわずか5回で96%から95%に削減する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:13:12 GMT)
When Privacy Becomes a Weapon: Understanding Doxxing and Privacy Vulnerabilities in Mainland China's Social Media Ecosystem [10.0] 個人情報の悪意のある開示であるDoxxingは、広範囲にわたるプライバシーの脅威となっている。
我々は、中国本土の18人のドークシング生存者との半構造化インタビューを用いて、この文脈でのドークシングの動作を概念化している。
以上の結果から,前西洋の発見と,規制委任統治の相互行為によって形成された中国固有の動態が一致することが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:29:48 GMT)
Decision Readouts for Text-Mediated Video Anomaly Detection: An Exploratory Evaluation of Jev and Qwen [9.9] 我々は,UCF-CrimeとXD-Violenceの40本の動画と400本のターゲットアンカーのスパース開発サンプルを用いて,Jev型判定と3つのQwen読み出し結果を評価した。
XDキャプションでは、Jev Noulは平均精度を75.99%、Qwen生成確率は48.47%、ローカルな順序的予想が57.81%に達した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:58:55 GMT)
Strategies for Deploying AI Agents in Production at Scientific User Facilities [9.7] エージェントはキャリブレーション、測定の実行、品質管理において繰り返し可能なタスクを実行することができる。
この観点は、楽器や設備にまたがって再利用できる要素に重点を置いて、実践的な戦略を精査する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:49:50 GMT)
From Pixel Generation to Topological Inference: Structural Dual Super-Resolution for Trustworthy Cross-Physical-Domain Trabecular Morphology Learning [9.7] 臨床CTとUHRCTは個々の気管を分解できないが、シンクロトロン放射マイクロCTは3.2mの高分解能基準を提供するが、生体内イメージングには適用できない。
既存の超解像ネットワークと事前訓練されたプリアメソッドは、ピクセル生成をターゲットとしており、ディバースディテールとSSIM/PSNRをターゲットとしており、これらの物理差を明示的にモデル化していない。
本稿では, 画素生成からトポロジカル推論へのパラダイムシフト, マクロスケールの低分解能入力から不変構造を決定論的に予測し, 形態パラメータを用いて評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:23:43 GMT)
How Well Can LLMs Simulate Real Learner Evaluations of Educational Feedback? [9.6] 本研究では,大規模言語モデル(LLM)が実学習者の学習環境における主観的評価をいかにうまくシミュレートできるかを検討する。
人格特性や評価例などの学習者固有の情報を用いて,6つのモデルで性能を比較した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:12:55 GMT)
ZeroCode: On-demand Error-Correcting Code Construction from the Zero Matrix via Reinforcement Learning [9.6] 我々は、全ゼロ行列から逐次コードを構成する強化学習ベースのアプローチであるZeroCodeを提案する。
ZeroCodeは、個別のシーケンシャルな意思決定問題として構成を定式化する。
従来の RL ベースの構成法に比べて約 1 dB のゲインを (32,16) コードに対して 10-4$ のビット誤り率 (BER) で達成している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:16:20 GMT)
Physics and Data Driven Transformer-Mamba Framework for Flow Field [9.6] 本稿では,3つの重要な革新を伴う物理制約付き演算子学習モデルであるTransformer-Mamba for Flow Field (TM4FF)フレームワークを紹介する。
4つのCFDデータセットの実験では、TM4FFは様々な流れ条件に対して高精度で堅牢な一般化を実現する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:06:22 GMT)
PowerZooJax: A JAX-based Power System Benchmark for Reinforcement Learning [9.6] PowerZooJaxは、電力系統運用における強化学習のためのJAXベースのベンチマークスイートである。
生成、送信、分散、分散エネルギーリソース、データセンターマイクログリッドにまたがる5つの制約付きマルコフ決定プロセスタスクを提供する。
実験では、CPUベースのシミュレーションよりも大幅にスピードアップし、ポリシーリターン、安全違反、アウト・オブ・ディストリビューションストレス条件の標準化された評価がなされている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:12:26 GMT)
Social Circuits behind Multi-agent Echo Chambers [9.6] Social Circuitsは受信者のアクティベーションを通じてメッセージエフェクトをトレースするフレームワークである。
ソーシャルサーキットに基づいて,有用なメッセージを選択することを学習するサーキットガイド・デリバレーション(CGD, Circuit-Guided Deliberation)を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:02:06 GMT)
ReCo: When to Relocate Sensor Kits under Deployment Constraints -- A NILM Case Study [9.6] 非侵入負荷監視(NILM)は、家庭のメインメーターから個々の家電が引き出す電力を推定する。
本稿では,制約に基づく転位フレームワークを提案し,NILM用にReCoとしてインスタンス化する。
ReCoは、現在収集されているデータから各家庭の将来の利益を予測し、ダウンタイム後の移動の利益に対して毎晩の利益を計る。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:00:40 GMT)
HALO: Enhancing Time Series Generation via Hyperspherical Latents and Masked AutoregRessive Modeling [9.5] 本稿では,ハイパースフィラティカルラテントとマスケド自動回帰モデリングによる時系列生成を支援するHALOを提案する。
HALOは,既存の高度なベースラインよりも推論効率を大幅に向上させつつ,最先端のジェネレーション性能を実現していることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:52:52 GMT)
Revitalizing Medical Time Series with Vision-Informed Retrieval: A Vision-Language Perspective [9.4] 我々は,凍結VLM由来の波形表現を形態認識クエリとして用いて,生の数値的MedTS特徴からの検索をガイドするViRe(ViRe)を提案する。
ViReは、確立された10のベースラインに対して強力な効果を示し、6つの公開ベンチマークで前の最先端技術に比べて、全体的な6.42%の相対的な改善をもたらす。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:58:34 GMT)
M3OS: A Monte Carlo Graph Search-Orchestrated Multi-Agent LLM System for Evidence-Traced Molecular Optimization [9.3] 小分子最適化は、反復的多目的決定を通じて薬化学推論と計算的エビデンスを統合する。
最適化状態管理から分子設計推論を分離する多エージェントLCMシステムであるM3OSを提案する。
2つのブランチは、ツール駆動の候補生成と知識とケースガイドによる医薬化学編集を組み合わせる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:41:44 GMT)
Echoes of Deeds: Moral History Can Shape and Steer LLM Behavioral Choices [9.2] 我々は,俳優のモラルヒストリーがLLMの行動に対して,一定の意思決定コンテキスト下でどのように行動を形成するかを研究するためのフレームワークであるMoralLedgerを紹介した。
行動レベルでは、以前の道徳的歴史は、その強さの関数としてのその後の選択を体系的に変化させることが分かる。
内部表現レベルでは、これらのヒストリーは残留ストリームにおいて線形に回復可能な方向を誘導し、保留例に一般化する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:57:14 GMT)
SEAD: A State-Based Perspective on Attack and Defense in Tool-Using Agents [9.2] 攻撃と防御はSEADで部分的に観察される状態制御として定式化される。
攻撃者は具体的な行動を選択している間に指示を与えるため、DARTは有害な目標を局所的に妥当なステップに分解する。
制御された初期状態、再生可能なツール環境、タスク固有の実行可能チェックを統合した環境検証可能なデータセットを構築する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:55:56 GMT)
Collaborative Principle Evolution via Evidence Transfer for Scientific Discovery [9.2] 大規模言語モデル(LLM)に基づくエージェントは科学的発見の自動化を約束するが、膨大な仮説空間の探索には費用がかかる。
既存の原理進化法は、このループを加速するが、連続的に動作し、探索の幅を制限し、困難な問題に対してウォールタイム時間を浪費する。
本稿では,並列分岐上での協調コアによる転送を実現するVOLVEを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:48:57 GMT)
PReCache: Efficient KV Cache Sharing for Multi-LoRA Agents via Low-Rank Precomputation and Neutral Reconstruction [9.2] マルチLORAエージェントシステムは、共通のバックボーンモデルを共有することで、効率的なロール計算を可能にする。
既存のKVキャッシュ共有メソッドは、この繰り返しプリフィルを減らすが、追加のトレーニングやアーキテクチャ上の制約が必要になる。
PReCacheはトレーニング不要のKVキャッシュ共有フレームワークで、PreLRSharedとReBaseSharedという2つの設計がある。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:24:14 GMT)
ARS: Agentic Reward System for Robot Learning [9.1] Agentic Reward System (ARS) は、進捗報酬モデリングのための推論フレームワークである。
ARSは、イベントの提案と検証の両方に適応的な視覚検査を使用する。
ARSは、任意の端末結果ラベルと視覚的参照を組み込んで判断を通知することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:37:09 GMT)
Low-Confidence Remasking Traps Flexibility: Realizing Arbitrary-Order Potential for Diverse Rollouts in Diffusion LLMs [9.1] マスク付き拡散言語モデルは任意の順序生成をサポートし、多様な出力を生成する自然な方法を提案する。
この柔軟性は、異なる生成経路につながる可能性のある高不確実性トークンを遅らせることによって多様性を低下させる。
エントロピー誘導初期化(Entropy-Guided Initialization, EGI)を導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:52:44 GMT)
FurE: Efficient Instance-Specific 3D Fur Reconstruction without Animal-Fur Datasets [9.1] FurE(FurE)は,一本鎖で編集可能な新郎を効率よく回収する動物毛皮復元法である。
人間の髪のストランドデータから学習したPCAベースのデコーダは、動物データの不足を軽減することができることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:59:58 GMT)
Efficient Reasoning via Constrained Optimization in Latent Space [9.0] 大規模推論モデル(LRM)は過度に考え直され、大量のトークン消費を引き起こす冗長な推論ステップを生成する。
性能を犠牲にすることなくトークン生成コストを削減できる,効率的な推論を実現するための新しいトレーニングフリーフレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:59:01 GMT)
Understanding LLM Parameter Update Sparsity through the Lens of Fisher [9.0] 言語モデルポストトレーニング中のパラメータの変化は、座標の小さなサブセットに集中することができる。
この現象は、強化学習、オン・ポリケーション蒸留、およびニア・ポリケーションデータによる微調整において報告されている。
この結果は,更新空間とオンライントレーニングのダイナミクスを結びつける統一的な視点として,対角モデルFisherを確立した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:50:56 GMT)
Toward verifiably private learning from federated data [8.9] フェデレートラーニング(FL)は、プライベートデータを持つデバイスが、共有モデルのトレーニングに協力することを可能にする。
信頼された実行環境(TEE)に基づく次世代FLシステムを提案する。
我々のシステムでは、TEEがホストするキー管理サービス(KMS)が管理するキーで暗号化されたデータをアップロードする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:53:03 GMT)
When Less Data Favors Smaller Teachers: Rethinking Teacher Capacity and Data Selection for Knowledge Distillation [8.9] 教師の指導をリレーショナルオーダに分解して分析する。
低データ体制における小学生のアドバンテージは、スコア幾何学だけでなく、リレーショナル順序付けからも生じることを示す。
予算対応難易度フィルタリングのプロキシとして小人数の教師を用いるDVAを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:41:08 GMT)
Where Should Physics Enter a Molecular Crystal Generator? [8.9] 生成モデルは分子結晶構造を高速に予測するが、それらのサンプルは幾何学的およびパッキング違反を示す。
我々は、全原子結晶フローマップ生成モデルであるCrystAFを導入し、UMA原子間ポテンシャルを用いて物理がどこに入るべきかを体系的に研究する。
ポストトレーニングはCrystAFに直接物理的嗜好を学習し、サンプリングをそのまま残しながら分子の妥当性と結晶パッキングを改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:53:27 GMT)
When Does Correction Become Repair? Mechanistic Auditing of Internal Interventions in Tool-Using LLMs [8.9] SAKIKOは、方向誤差発見、ルータ条件の介入、目的地解決の検証、そして将来的な凍結した統計ライセンスによる表現修復を形式化する。
指向性エラー発見, ルータ条件による介入, 目的地解決による検証, 凍結した統計的ライセンスによる表現修復を形式化する監査フレームワークであるSakikoを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:12:55 GMT)
PhysioTRACE: Provenance-Aware Stress Tests for Physiological Foundation Models [8.8] 凍結エンコーダのための4軸動作監査であるPhyloTRACEを紹介する。
これは、プローブがデコードできるものと、固定タスクヘッドが依存するものとを分離する。
それぞれの監査は、3つの評決のうちの1つで終わる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:24:44 GMT)
UQ-LOB: Uncertainty-Aware Limit Order Book Mid-Price Forecasting [8.8] UQ-LOBは軽量でエンコーダに依存しない不確実性定量モジュールである。
プリトレーニングされたリミテッドオーダーブック(LOB)エンコーダにアタッチされる。
520億のLOBイベントにおいて、UQ-regressionは68%のインターバルカバレッジを達成している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:23:26 GMT)
GradLev: Token-Parallel Test-Time Training Via Costate Prediction [8.8] テストタイムトレーニングにより、モデルは推論時に予測を改善することができる。
オンライン勾配降下は、前向き評価と逆向きのバックプロパゲーションの両方に正確な平行走査を認めている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:47:33 GMT)
SCBO: Semantically Coherent Batching and Ordering for LLM-Based Social Surveys [8.8] 本稿では,複数の質問を1つのプロンプトで予測する学習自由フレームワークを提案する。
コヒーレントなバッチを作成し、共有参照を選択し、質問と参照を効果的に注文する。
4つの大規模調査データセットと4つの大規模言語モデルの実験により、SCBOはトークンの消費と推論時間を著しく削減することが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:17:35 GMT)
Many Eyes, One World: Feed-Forward 3D Reconstruction from Mixed Cameras [8.7] リアルワールドキャプチャーは異質な視点であり、魚眼であり、パノラマ画像は360ドル(約3万3000円)で1回の再構築作業で共存できる。
本研究では,N-view混合視点,魚眼画像,フルパノラマ画像からポイントマップとカメラポーズを共同で再構成するメカニカルフィードフォワードシステムMEOWを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:21:52 GMT)
Rewarding Novel Deductions: Solver-guided Process Rewards for Logical Reasoning [8.7] 我々は、SPRingを提案する: (新しいLogIcal ReasoNing Step生成のためのAwerr-guided Process Rewards)
SPRINGは、SMTソルバを中間推論ステップの訓練時間検証器として使用し、プロセスレベルの監視を提供する。
これは、新しい推論のステップ、すなわち論理的に妥当なステップの概念を導入し、進化する推論状態と整合する。
それは、矛盾する推論ステップと非形式的推論ステップをペナルティ化しながら、新しい推論進歩を促進するプロセス報酬を設計する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:01:24 GMT)
DuplexCadence: Exact State and Execution from a Speech Model's Declared Timelines [8.6] フル音声モデルはストリーミングインタラクションをサポートし、同時に聞き取り、話す。
本稿では、ネイティブクロックを明示的に宣言し、2つのルールを相互に有効化するDuplexCadenceを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:16:39 GMT)
Towards an AI Software Factory for Data Systems [8.6] AI支援コーディングツールは、コーディングの大幅な加速を提供するが、エンドツーエンドソフトウェア開発ライフサイクル(SDLC)に限られた影響しか与えない。
本稿では,SDLC-Targeting, Coding, Reviewing, Opsのすべての段階を加速するAI SW Factoryの構築に向けた進展について論じる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:55:26 GMT)
Learning Regional Snow Water Equivalent and Snow Height Variations from Sentinel-1 InSAR Acquisitions [8.6] SegFormerは2つのターゲットで最高の結果を得ることができ、HSは10.391 cm、SWEは27.113 mmである。
SegFormerは2つのターゲットで最高の結果を得ることができ、HSは10.391 cm、SWEは27.113 mmである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:40:53 GMT)
Koa-action: Fast and Consistent Structured Decision Making with Generative LLMs [8.4] Koa-actionは低レイテンシのアトミックアクションのためのフレームワークである。
本手法は,分類を決定論的一段階復号化問題に還元する。
生産意図付けベンチマークでは、Koa-actionは85.5%の精度に達する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:49:58 GMT)
When Does a Spoken Agent Have Enough Evidence to Act? The PACT-SLM Contract Test [8.3] 音声モデル(PACT-SLM)におけるターンテイキングのための部分的音声行動契約の導入
PACT-SLMは、最初の有効なアクションタイムを割り当て、アクションアイデンティティとタイミングを別々に計測する。
これらの結果から,行動識別とタイミングは部分音声決定行動の異なる側面を測ることが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:11:17 GMT)
Proprioceptive Force Estimation for Quadruped Locomotion and Human-Robot Interaction [8.3] 装填力は移動中に収容されなければならないが、レッシュ力は所望の動作を指定できる。
推定器と移動ポリシーは、監督力と速度出力で共同で訓練される。
持続力シミュレーションでは、成分方向の根平均平方誤差の時間平均値は1.44から2.83,Nである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:27:41 GMT)
ControlTrace: Recovering Control Fields for Hidden-Content Recognition [8.3] 生成時に使用するグレースケール制御フィールドを復元する制御トレースを提案する。
ControlTraceは3つの条件付き強度で60.2%のオープンエンド輪郭認識精度を実現している。
A100 GPUでは、完全なパイプラインはVLM推論を指示するために7.4ms (5.3%)しか追加されない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:10:41 GMT)
AdaKerNet: Neural Kernel Decoding for Task-Adaptive Prediction with Multimodal Large Models [8.3] 本稿では,新しいタスク適応型ニューラルカーネルデコーダであるAdaKerNetを紹介する。
AdaKerNetは、基盤となるMLLMのパラメータに完全に依存していない。
様々な利用可能なモダリティから得られる(凍った)豊かな表現にのみ依存する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:59:26 GMT)
Universal Approximation of Measure-to-Measure Operators by Pushforwards [8.3] 有限$p$-次モーメントの出力を持つ任意の連続測度演算子は、連続的なプッシュフォワードにより、$p$-ヴァッサーシュタイン距離において一様近似できることを示す。
また、このフレームワークを継続的に変化するソース測度に拡張し、プッシュフォワードモデルのクラスに対して対応する結果を得る。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:58:06 GMT)
Classical Bound on the Fisher Information Rate of a Dephasing-Enhanced Quantum Neuron [8.2] Dephasingは、散逸性量子ニューロンの活性化を鋭くすることができるが、定常応答は、その出力が単位時間当たりの入力情報量を決定するものではない。
我々は、繰り返し投影された読み出しから、完全レコードのしきい値応答帯域と正確なローカルフィッシャー情報率を導出する。
これらの結果は、量子ニューロンの動作情報スループットと、有限時間量子ニューラル処理のためのハードウェア対応ベンチマークとを区別する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:00:47 GMT)
PainterBench: A Figural Divergent-Thinking Benchmark for Tool-Using Language Models [8.2] エージェント設定に不完全な描画タスクを移植するベンチマークであるPanerBenchを紹介する。
ベンチマークでは、短い地平線上でのインクリメンタルなビジュアルプランニングと、事前トレーニングからマルチターンツール使用へのクリエイティブな能力の移行をテストしている。
我々は2,700点の図面とクラウドソースの創造性と認識可能性の評価を、すべての図面と300点の人間の参照図面に対して収集する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:08:43 GMT)
FONDANT: Strong and Best-Effort Planning via Antichains [8.2] 完全可観測非決定論的(FOND)計画における古典的な解の概念は強い方針である。
本研究では,ベストエフォートプランニングと強力なプランニングの両面において,健全で完全なプランナーを導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:36:01 GMT)
Weighting Schedules Govern What and When Score-Based Generative Models Learn from Multimodal Data [8.2] スコアベース生成モデルは、ガウス雑音を対象分布に運ぶ時間依存ドリフトを統合することで、新しいサンプルを生成する。
統合損失を1回のコントリビューションに分解し、それぞれを固定信号対雑音比で分析する。
時間積分目標に基づいて訓練されたモデルの場合、学習力学は、重み付けのどれ程が発散時間付近に効果的に置かれるかによって支配される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:51:00 GMT)
Just Initialize: A Training-Free Initialization Component for Large-Scale Routing Optimization [8.2] そこで我々は,大規模ルーティング最適化のためのトレーニング不要かつ解決不能なコンポーネントであるJustを提案する。
巨大なルーティングをコンパクトなサロゲート空間に圧縮し、グローバルなルーティング構造を最適化し、結果のソリューションを復元する。
単に最先端の手法に匹敵する、あるいは優れた高品質のソリューションを実現するだけだ。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:41:52 GMT)
KernelOnet: An Interpretable Neural Operator Based on Kernel Functions [8.2] KernelOnetはカーネル関数をニューラルネットワークアーキテクチャに明示的に組み込む。
データ駆動学習可能なカーネル、物理インフォームドカーネル、ハイブリッドカーネルの3つの補完カーネルを提供する。
浅波導波路における3つのベンチマークと1つのエンジニアリング上の問題に対して、KernelOnetは精度が高い。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:24:13 GMT)
OmniTide: Co-Designing Algorithms and Systems for Efficient On-Device Omni-LLM Streaming [7.9] オンデバイスストリーミング omni-modal推論は、ユーザのプライバシを保護し、token当たりの禁止的なAPIコストを排除します。
既存のスパースアテンションメソッドは、違法なオンライン推定遅延を発生させるか、インターリーブされたクロスモーダルコンテキストを破壊するかのいずれかで不足する。
我々は,OmniTideを提案する。OmniTideは,デバイス上での効率的なストリーミングオムニモーダル推論に適したアルゴリズム・システムである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:58:37 GMT)
GAZEleak: Passcode Inference Against Eye-tracking XR Devices Through External Observation [7.9] Apple Vision Proのような複合現実感ヘッドセットは、タッチスクリーンをGear-as-pointerインタラクションに置き換える。
ディスプレイはヘッドセットの中にあり、アイトラッカーはサードパーティ製ソフトウェアから切り離されているため、このような入力は傍観者には観測できないと広く考えられている。
GAZEleakは、頭の動きの外部ビデオから視線駆動の入力を回復するサイドチャネル攻撃である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:38:29 GMT)
Verifier Errors in RLVR: Reward Hacking, Limits of Feedback, and Selective Control [7.9] 不完全な検証者は 不正な反応を報い 報酬のハッキングの機会を創り出す
RLVRにおける観測は,一般的には,受理誤りの検出や識別に不十分であることを示す。
我々は監査の正確性に関する追加のフィードバックを用いて修正を構築する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:30:24 GMT)
PhoneCLI: From App Interfaces to Callable Commands for Mobile Agents [7.9] PhoneCLIはアプリのGUIナビゲーションを呼び出し可能なコマンドにコンパイルする。
オフラインでPhoneCLIは、外部からターゲットアプリを探索し、画面、インタラクティブな要素、ナビゲーションエッジを意味的に注釈付けされたマップに蒸留する。
オンラインで、エージェントはコマンドを選択し、実行前に検証し、VLMコストゼロでサブ秒間に決定的に実行する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:26:56 GMT)
Steering Language Model Goals with Value Transplant [7.9] 推論モデルは、しばしば、目標を追求するかのように振る舞うが、その取り組みは、必ずしもユーザーが何を意図しているかに向けられているとは限らない。
これまでの研究では、モデルが"バリュー軸"を通じて、モデルが自身の目標に向かっての進捗を内部的に追跡する方法が検討されてきた。
このような信号の変更が、異なる目標に向かってモデルの探索をリターゲティングできるかどうかを検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:26:19 GMT)
On Temporal Binding in Large Audio Language Models [7.9] 音声記録の時間構造に関する推論には,音声イベントと時間的位置を関連付けるために,Large Audio Language Models (LALM) が必要となる。
本研究では,3つのオープンソースのLALMにおいて,時間情報がどのように表現され,音声イベントに結びついているかを検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:10:19 GMT)
CRF Loss is How Networks Should Learn Boundaries in Weakly Supervised Segmentation [7.8] 本稿では,ソフトな擬似ラベルを一元的監視として,二元的エッジマップを相互に監督するフレームワークを提案する。
我々は、dino.txtのCAMとSAMのバウンダリを使って、DS-CRFという単一ステージモデルでフレームワークを実現する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:59:41 GMT)
BA-DPO: Bias-Adjusted Direct Preference Optimization for Language Model Alignment [7.8] Bias-Adjusted DPOは、宣言された属性を持つ応答に対してアノテータ毎に1つのバイアスパラメータを追加するDPOの一般化である。
我々は、目的がバイアスパラメータの凸であり、各アノテータのバイアスを共有定数まで識別することを証明する。
植込みバイアスのあるコーパスでは、DPOはバランスの取れたスタートから確率0.96まで特性を駆動し、BA-DPOはそのシフトの81から95%を除去する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:41:34 GMT)
Identifying Neural Source Dynamics from Unknown Local Interventions [7.8] 既知の解剖学的フォワードモデルでさえ、ソース状態空間の一部のみを励起する実験は、力学を未同定のまま残している。
未知の局所的なメカニズムの変化が、不足した情報を供給できることが示される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:14:22 GMT)
ResonAct: Streaming Metrics for Runtime Diagnosis and Self-Healing in Multi-Agent Systems [7.8] 本稿では,マルチエージェントシステムの継続的監視,診断,修復を可能にするランタイム自己修復フレームワークであるResonActを紹介する。
ResonActは、実行トレース、エージェントインタラクション、ツール呼び出しをストリーミング分析層に取り込みます。
フレームワークは外部コントロールプレーンとして動作し、アプリケーションエージェントやオーケストレーションロジックを変更することなく介入を可能にする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:18:24 GMT)
ReSight-SMC: Two-Stage Power Sampling via Island SMC with Visual Scouts [7.7] LVLM推論のための検証不要な2段階パワーサンプリングであるReSight-SMCを紹介する。
本稿では,ReSight-SMCが推理と知覚の両ベンチマーク群に対して,Power-SMCよりも強力な集約性能を実現することを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:09:34 GMT)
SIFARI: Self-Supervised Interferometric Fitting for Astronomical Radio Imaging [7.7] 本稿では, 画像トレーニングセットや空間正規化器を使わずに, 自監督型ネットワークSIFARI(Self-Supervised Interferometric Fitting for Astronomical Radio Imaging)を提案する。
合成ALMA試験では、SIFARIは自然重み付けのCLEAN復元ビームの約8倍の効率的な点源応答が得られる。
また、3つの形態素ベンチマークで復元されたCLEAN画像よりも画像の忠実度が高い。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:01 GMT)
Retracing Hodgkin and Huxley: State Recovery Does Not Certify Mechanism [7.6] 我々は、シミュレートされた電流と電圧の潜在モデルを訓練した。
次に、応答予測、状態回復、プロトコル転送、およびHHダイナミックスとの整合性をテストする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:18:34 GMT)
LRC-JEPA: Disentangling Dynamics and Residual Context for Efficient World Models [7.6] 報酬のない自己超越の下で訓練された低次元表現は、アクション条件付き力学と予測可能な視覚コンテキストの両方をエンコードする必要がある。
LRC-JEPAは、情報をコンパクトな予測潜水器にルーティングする軽量なエンド・ツー・エンド・ワールドモデルである。
結果の表現は十分で、最小限で、ニュアンス不変であり、非絡み合っていることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:48:14 GMT)
When Text Matters: Design Principles for Visual Token Pruning in Vision-Language Model [7.6] 視覚トークンプルーニングは、大規模視覚言語モデルの計算コストを削減するための実践的なアプローチである。
我々は、初期視覚誘導プルーニングと遅延テキスト誘導再選択を分離する訓練不要な方法を開発した。
本手法は, 平均11.10ポイントの性能回復率において, 最良性能のベースラインを上回っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:49:40 GMT)
CollisionSplatting: Collision-Aware Motion Planning in 3DGS Scenes with Image-Conditioned Objectives and Adjustable Conservatism [7.5] 本稿では、可変保守性を持つ単純でモジュラーで確率にインスパイアされた距離メートル法であるCollisionSplattingを紹介する。
代表的なベースラインと比較して,衝突分類性能が良好か良好かを示す。
実世界の視覚誘導ナビゲーションおよび操作タスクにおけるメトリックの有効性を実証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:57:15 GMT)
A Differentiable Optimization Framework for Registering Sequential Bounding Boxes with Point Cloud Stream [7.5] L-BFGSと組み合わせてすべてのポーズを解く。
配向アライメントは推定速度と相関し,その推定値がノイズとなるとフェールする。
地道なルールは、時間スケールを選択し、すべてのトラックを粗さ予算内に保持することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:41:58 GMT)
SPOC-Net: Single-Primitive Online Composition Network for GNSS Jamming Set Recognition [7.5] グローバルナビゲーション衛星システム(GNSS)は、それぞれの混合物を別のクラスとして扱う認識器を妨害するが、新しい組み合わせに拡張することは困難である。
本稿では,認識問題を基本的なジャミング要素の集合に分解するSPOC-Netを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:56:40 GMT)
Frozen Judges, Moving Agents: Version-Dependent LLM-Judge Error and the Limits of Judge-Assisted Agent Evaluation [7.5] 言語モデル審査員はエージェントのアップグレードを前任者と比較するが、固定された審査員はバージョンに依存した誤りを犯すことがある。
公開コーディングエージェント35件、カスタマーサービスエージェント2件、専門家ラベル付きエージェントRewardBenchトラジェクトリ1,106件を分析した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:10:18 GMT)
ZonoGPT: Towards An Abstract Domain for Verifying Large GPT Models [7.5] ZonoGPTは、ネットワーク深度に依存しない空間の複雑さを維持する大きなトランスフォーマーを検証するための抽象ドメインである。
標準アーキテクチャの検証、公式のHuggingFaceモデルへのスケーリング(24ブロック、300M+パラメータ)、テキストとビジョンタスク間で1,339のインスタンスの検証に成功している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:14:58 GMT)
Research-Native by Construction: Minimal Nodes, Re-verifiable Workflows, and Compounding Memory for Long-Horizon Scientific Agents [7.2] AfSは長期の科学研究のためのプラットフォームである。
プロジェクトは何十ものエージェントにまたがって何時間も実行され、人間のプレゼンスはたまにしか実行されない。
機械による研究の信頼性の大部分は、モデルに振る舞いを求めることから、非準拠の状態を表現不能にすることに移行することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:47:05 GMT)
Who Is Left of Whom? Tracing Spatial Evidence and Role Binding in Relative-Position Reasoning [7.2] 相対配置推論を支持する内部表現は、いまだに理解されていない。
本稿では,このプロセスの2つの補完的要素について検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:59:55 GMT)
One Geometry, Different Outcomes: Readout-Dependent Effects of the Modality Gap in Vision-Language Models [7.1] タスク依存効果の統一的な幾何学的説明を提供する。
ゼロショット分類では、クエリ側固定ギャップオフセットサブトラクションは、正に加法クラスバイアスと同値である。
混合モーダル検索では、ギャップ方向は候補をモダリティでソートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:40:27 GMT)
Beyond Reconstruction Loss in Post-Training Quantization: Balanced Fitting for Large Vision-Language Models [7.1] 後学習量子化(PTQ)は、大規模視覚活性化モデル(LVLM)の効率的な展開を可能にする
近年のLVLMのPTQ法では感度信号が組み込まれているが,完全精度モデルでは再現損失が最小化されている。
本稿では、最適化を超えて精度と正規化のバランスをとる量子化効果に基づくフレームワークであるBa balanced Fittingを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:48:10 GMT)
Poster: Towards ProofWeave: A Privacy-Minimised, Integrity-Anchored Evidence Plane for Continuous Agentic Assurance [7.1] エージェントAIシステムは、ツール、メモリ、デリゲート、外部サービスを介してますます機能する。
既存の可観測性と証明メカニズムは、ホック後の出来事を再構築することができるが、記録の時点で、各政策関連アクションが意図された制御によってチェックされたかどうかを示すことはまれである。
我々はエージェントAI保証のための記録的なチェーン・オブ・エビデンスの概念であるProofWeaveを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:11:15 GMT)
Nereus: Adaptive Parallelism for LLM Post-Training [7.1] Nereusは、RLポストトレーニングジョブを効率的な実行計画に適応させる、コスト対応ランタイムである。
DPスケーリングによって、最初の固定TP/PPレイアウトと比較して平均ステップレイテンシを27.7%削減する。
エンドツーエンドの8B PPOスループットを2.14--7.27$times$ over OpenRLHFと1.10--1.47$times$ over Verlで改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:55:05 GMT)
Tracing the Evolution of Oracle Bone Characters Across Three Millennia [7.1] 本稿では,漢字の進化系列(OBI,Bronze,Seal,Clerical,Regular)を多様体空間の連続的進化としてモデル化する枠組みを提案する。
多様体空間と遷移力学の両方は、任意の2つの時代にわたるキャラクタ進化対を通して、エンドツーエンドで訓練することができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:28:29 GMT)
Test-Time Adaptation of Manipulation Policies Under Actuator Degradation [6.9] 本稿では,凍結操作ポリシをテレメトリ条件付きポリシに変換するポリシ非依存の方法であるTeAR(Teremetry-Aware Action Rectification)を紹介する。
我々は,8つのポリシーファミリーと5つの操作タスクにまたがる18のポリシータスクペアを対象にTeARを評価した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:49:27 GMT)
Crude, Commercial, and Self-Referential: Chinese-Language Coordinated Activity in Japanese-Language X [6.9] 本研究では,協調行動の特徴と一般ユーザが協調投稿に対してどのように反応するかを解析する。
ほとんどの調整済みアカウントは粗末であり、自動化の古典的なマークを保っている。
潜在的に有害または違法な物質として分類されたポストは、中国人が支配する外層から比較的高い割合の反応を受け取っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:13:19 GMT)
Elicitation and Decision Geometry in Single-Index Bandits [6.9] 両腕のコンテキスト帯について,腕特異的な単一指標と未知のモノトーンリンクを用いて検討した。
本研究では, 逐次ステインコントラストを用いて, 最適境界を直接学習する, 強欲な手続きである自然境界学習(NBL)を紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:58:06 GMT)
The Overlap Gap Property: Separating Quantum and Quantum-Inspired Approximate Optimization Algorithms [6.8] 平均場近似最適化アルゴリズム(MF-AOA)は、オーバーラップギャップ特性(OGP)を示す問題に対して任意の近似解を与えることができない
我々は,MF-AOA と有限メモリ近似メッセージパッシング (AMP) アルゴリズムを関連付け,OGP の性能に制限があることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:23:45 GMT)
When Words Speak Louder than Images: Towards Understanding Language Bias in Vision-Language Models [6.8] 視覚言語モデル(VLM)は言語バイアスの影響を受けやすいままであり、しばしば視覚的証拠よりも言語的手がかりを優先する。
本稿では,言語バイアスの伝播を追跡するために,推論プロセスを4つの独立した相互依存段階に分解する診断フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:27:19 GMT)
PHASE: A Physiology-Guided Hierarchical Foundation Model for Intracranial EEG [6.4] 本稿では,生理的特徴を明確にし,潜伏予測と組み合わせた生理学誘導基礎モデルPHASEを紹介する。
Omni-iEEGの5つの臨床タスクにおいて、凍結したPHASE-Tは評価された基礎モデルを最大31%上回り、微調整されたPHASE-Tはタスク固有のモデルを上回っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:31:25 GMT)
Learning to Re-Draft: A Variational Stackelberg Game for Discrete Diffusion [6.4] 仮面拡散モデル(英語版)は、仮面拡散が解かれるとトークンを固定するが、一様拡散は修正を許すが、一様ランダムなトークン置換に依存する。
本稿では,意味的に認識された汚職過程を学習するフレームワークとして,変分スタックルバーグ離散拡散(VSDD)を導入する。
分子・テキスト・プレイリスト生成におけるVSDDの評価を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:38:38 GMT)
Fast Learning Rate Transfer in Shallow Linear Networks at Growing Training Horizons [6.2] 成長する水平体制における迅速な移動を確実にする条件について検討する。
具体的には,1つのトレーニング可能な隠れ行列を持つ浅い線形ネットワークにおける学習速度の伝達について検討する。
これらの結果は、スペクトル構造と局所損失感度が、成長する地平線における学習速度伝達をどのように支配するかを明らかにする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:28:15 GMT)
Learning to Reason with Persistent Object States for Video Instance Segmentation [6.2] ビデオセグメンテーションモデルは、フレーム全体にインスタンス情報を運ぶことによって、オブジェクトのアイデンティティを保持する。
我々はPOSReasonerを紹介します。これはトレーニング可能なプラグイン・アンド・プレイフレームワークで、オブザーバがオブジェクトの状態を変えるべきタイミングを明確に決定します。
長期VOSとVISベンチマークによる実験では、強いベースラインよりも一貫した改善が見られた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:19:41 GMT)
Statistical Learning of Contractive Dynamical Representations for Composite Adaptive Control [6.2] 動的に結合された外乱下での複合適応追従制御のための表現学習フレームワークを提案する。
このフレームワークは、古典的外乱調節制御(DAC)と最近の最終層適応外乱除去法を結びつけている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:59:07 GMT)
ESTHER: Egocentric Stereo Hand Estimation and Reconstruction in the Wild [6.2] 本稿では,立体幾何学,時間的推論,出力表現がウェアラブルエゴセントリックステレオ用に設計されたESTHERを提案する。
実験では、最先端のアクアラキシー、優れた外部一般化、欠落したビューに対する堅牢性、フレームの落落、そして光と動きのぼやけ極端が真の自我中心のキャプチャーであることが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:17:22 GMT)
First Learn, Then Memorize: The Spectral Bias of Diffusion Models [5.9] 有限データセットでトレーニングされた拡散モデルは、まず新しい高品質なサンプルを生成することを学ぶ。
我々は、それを探査する物体のこの分離の背後にあるメカニズムを同定する。
スコア関数のトレーニング力学は、実際に、任意の幅において、ニューラル・タンジェント・カーネル(NTK)のグラム行列によって制御される。
それらの構造が標準のカーネル設定に類似していないことを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:13:46 GMT)
From Language to Task Maps: Compiling Semantic Relations While Preserving Task-Relevant Freedom [5.9] 本稿では,言語が実体,関係,位相を規定する型付きセマンティック・ツー・ジオメトリ・インタフェースを提案する。
ロボット側コンパイラは、これらの仕様を根拠として、関係性固有のタスクマップと整合幾何代数を用いて一貫した微分を構成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:25:48 GMT)
Steelhead: Interleaving Partially Synchronous and Asynchronous Commit Rules on a Shared DAG [5.9] Steelheadはデュアルモードのメカニズムで、1つのDAG上で部分的に同期および非同期コミットルールを構成する。
各間隔で、バリケータは各候補期間でコミットされたDAGをリプレイし、最小のメッセージ遅延を持つDAGを採用し、出力が停止するとk = 1にフォールバックする。
スティールヘッドはDAGのブロックを超えてメッセージを送ることなく、その期間に同意せず、隠れたリーダーを必要とするラウンドにだけコインを開く。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:57:49 GMT)
OpenWhistle: A Large-Scale Longitudinal Dataset and Benchmark of Bottlenose Dolphin Vocalizations [5.9] イルカの発声に関する最大のデータセットであるOpenWhistleを紹介する。
半自然環境下で5個体の安定したポッドから5年間にわたって記録された約180,000のホイッスル(114時間)から構成される。
我々は、ホイッスル検出、セグメンテーション、分類のための完全な処理パイプラインをリリースする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:37:20 GMT)
SAKI: Skill Assembly and Kinematic Imitation from Human Videos for Long-Horizon Mobile Manipulation [5.8] Skill Assembly and Kinematic Imitation (SAKI) は、人間とビデオのスキル獲得、クロスデモアセンブリ、クローズドループ全体の実行を結びつけるフレームワークである。
SAKIは、タスククリティカルなインタラクションを維持しながら、転送パスの適応を可能にする、再利用可能なオブジェクト中心のスキルを準備します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:03:46 GMT)
Semantic Modality Compensation for Unsupervised Visible-Infrared Person Re-identification under Unpaired Settings [5.8] 未経験学習では、モダリティ間の同一性対応はしばしば不完全である。
モーダルスタイルからアイデンティティ意味を分離するプロンプト合成に基づくフレームワークを提案する。
SMCは一貫して最先端の手法を上回っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:40:10 GMT)
TaoTex: Boosting Texture Detail Fidelity for Native 3D Material Generation [5.8] 最近の3Dモデルでは、詳細なテクスチャの再構築に苦労しながら正確なジオメトリーを作成できる。
そこで本研究では,複雑なテクスチャを忠実に復元する拡散型3次元素材生成モデルTaoTexを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:31:38 GMT)
Robot-Assisted Deployment and Maintenance of Inflatable Modules for Lunar Habitation: A Field Demonstration [5.8] 膨らませるモジュールとモジュラーで再構成可能なロボットシステムを組み合わせたシステムを提案する。
本稿では,実際のハードウェアを用いた各種ロボット支援タスク実行について報告する。
実証されたタスクには、インフレーション中のロボット検査、モジュール位置のアライメント、最終安全ロック、デプロイ後のメンテナンスのための3次元マッピングが含まれる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:46:30 GMT)
Why Backdooring Neural Networks is so Easy? [5.7] バックドア攻撃に対する現代のAIシステムの安全性は、依然としてオープンな課題である。
ニューラルネットワークを強力にするのと同じ機能学習ダイナミクスが、バックドアに対してより脆弱になることも示しています。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:50:48 GMT)
KiT: A Foundation Model for Financial Time-Series Forecasting using DiffusionTransformers [5.7] K線拡散変圧器基礎モデルであるKiTを導入し,フローマッチングによる条件付き経路生成として将来の予測を再構成する。
複数の市場とタイムスケールにまたがる何十億ものロウソクスティックバー上で、複数のパラメータスケールでKiTを事前トレーニングします。
3つの市場と7つの解像度で、KiTは平均リターンランディック0.057、平均ボラティリティーランディック0.066を達成している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:51:35 GMT)
Hierarchical Clustering and Signal Denoising on Digraphs [5.7] 本稿では、その隣接行列から導かれるエルミート行列として、ディグラフ(方向グラフ)の表現を提案する。
エルミート行列のスペクトル分解に基づいて、$k$-meansのグラフクラスタリングアルゴリズムを導入し、グラフ上の分割を生成する。
合成ダイグラフと実世界のダイグラフの実験は、ダイグラフクラスタリングのためのmyprojアルゴリズムの優位性を実証している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:05:36 GMT)
Attention-based Hierarchical Variational Information Bottleneck for Robust Multi-Agent Communication under Variable Bandwidth [5.6] AH-VIBは、変動情報(VIB)と逐次メッセージ生成と階層的損失を組み合わせたアテンションベースの自己回帰通信モデルである。
その結果、AH-VIBは帯域幅制約下での学習通信の信頼性と優雅な劣化を改善することが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:48:36 GMT)
KITA AI: A Multi-Agent LLM System for Pluralistic Policy Deliberation [5.6] KITA AIは、複数の大きな言語モデルエージェントが、それぞれ異なる階層的利害関係者のペルソナを基盤として、政策シナリオを意識したモジュラーシステムである。
KITA AIの目的は、望ましい政策提案を知らせるだけでなく、シナリオに影響された人物を自動的に見つけ出すことである。
KITA AIは、非収束を第一級の説明可能な出力として扱い、政策立案者が議論される政策のトレードオフと人間的影響をよりよく理解できるようにする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:59:17 GMT)
DecoyTrace: Toxic Decoys for Active Defense in Decentralized Federated Learning [5.6] Decentralized Federated Learning (DFL)は、中央集約サーバを排除し、従来の攻撃に対する防御が依存する単一視点を減らします。
既存の詐欺ベースの防御は、主に中央集権的なFLのために設計されており、局所的な観察、中毒の伝播、ソースの帰属、封じ込めに共同で対応していない。
本稿では,厳密なサーバーレスDFL環境に対する積極的なサイバー偽装に基づく防御手法であるDecoyTraceについて述べる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:05:51 GMT)
Conspiracy and Environment Communities on Reddit Sort Along Different Demographic Axes [5.6] 本研究では,一方の環境要因への関与と他方の陰謀論の2つの対照的な事例について検討する。
Reddit利用者の年齢、性別、頻度、参加関係を推定することにより、階層化された遷移ネットワークを構築する。
この2つの領域では、人口動態の分化が異なることが判明した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:41:53 GMT)
Understanding Clinical Cognitive Dialogues Using Large Language Models [5.5] 話者3名と対話行動56名に対して8,250発のアノテートが付与された認知評価会話33件の未確認コーパスを提示する。
我々はこのコーパスを用いて、詳細な対話行動分類と次の患者発話生成の大規模言語モデルをベンチマークする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:04:25 GMT)
Think Before You Restore: Risk-Aware Manchu Manuscript Restoration with Stroke-Guided Attention [5.5] 歴史的満州写本の全面的なブラインド復元は、注釈の不足、未知の劣化地域、脆弱な連結脳卒中により困難である。
SAGE-Restoreは、まず、復元が必要な場所を判断し、この評価を用いて、復元候補の生成と画素レベルの選択をガイドする選択的な復元フレームワークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:37:18 GMT)
Not All Thinking is Created Equal: Latent Reasoning Discovers a Recurrent Search Algorithm for Depth Generalization [5.5] 我々は、拡張マルチホップ推論タスクにおいて、同じGPTNeoXバックボーンの5つのバリエーションをスクラッチからトレーニングし比較する。
バニラ, CoT および Pause Token モデルは ID 問題をよく解決するが, 主に局所グラフ機能に依存している。
潜在変種はより一般化され、グラフ上の前方到達可能性伝播と整合した内部ダイナミクスを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:12:30 GMT)
Almieyar: A Culturally Grounded Benchmark for Multi-Dialect Arabic Speech Recognition [5.5] GPT-4o-transcribe、Voxtral-Mini-4B、Fanar-STT-LF、Whisper、SeamlessM4T-v2、wav2vec2ベースのモデルを含む12の最先端ASRシステムのゼロショットをベンチマークする。
GPT-4o-transcribeはWER全体の35.0%で最低であり、Voxtral-Mini-4B、Fanar-STT-LF、Whisper-Large-v3はそれぞれ41.1%、45.9%、49.5%となっている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:29:11 GMT)
OT-PCA: New Key-Recovery Plaintext-Checking Oracle Based Side-Channel Attacks on HQC with Offline Templates [5.4] OT-PCAはPlaintext-Checking (PC) Oracleベースのサイドチャネル攻撃を行うための新しいアプローチである。
数百の秘密位置のソフト情報を効率的に抽出するオフラインテンプレートを構築します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:00:33 GMT)
EntroPack: Fast and Accurate Entropy-Coded Weight Compression at Arbitrary Bitrates [5.4] EntroPackはエントロピー符号化された重量圧縮機で、アクティベーションキャリブレーションや微調整なしで任意のターゲットをサポートする。
行正規化された$E_8$格子量子化と格子座標の条件確率モデルを組み合わせる。
オンラインデコードでは、ウェイトカウントとともに成長するレイテンシが追加され、メソッドは計算集約的なワークロードに適している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:01:09 GMT)
Early Learning Shapes Later Directions Of Representation Change In Continual Learning [5.4] 初期の表現的変化が自然に幾何学的構造を形成しているかどうかを問う。
初期表現ドリフトの低次元部分空間を同定し、足場と呼び、その後のタスク間で再利用されているかどうかをテストする。
これらの結果は、初期の経験は、ニューラルネットワークが将来のタスクにどのように適応するかについて、永続的な幾何学的なインプリントを残していることを示唆している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:26:00 GMT)
Coherence Rather Than Error Rate Governs Privacy in Multi-Tenant Quantum Computing [5.4] 本稿では,量子状態の区別性から生じるコテナント境界における情報漏洩に関する情報理論的概念を提案する。
商用利用可能な156量子ビット(IBM Kingston)および20量子ビット(IQM Garnet)デバイス上で,このリークを計測する。
被害者のレジスタ全体に実装された均一なパウリランダム化は、情報漏洩をゼロに抑えるための防御メカニズムとして使用される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:25:34 GMT)
Neural Language Models Learn the Contextual Distributions of Dependency Structures: a statistical learning theory to compositionality [5.3] ニューラルネットワークモデル(NLM)が、語彙意味論とは無関係な文法構造によって符号化された構造的意味をどうやって取得するかは不明である。
本稿では,学習した依存構造自体がその後の統計学習のための新しい分布単位となる統計学習プロセスを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:32:28 GMT)
Generalized LIMDDs: Succinctness and Canonicity for Decision Diagrams Modulo a Group [5.3] 函数 $0,1ntomathbbC$ と $G$ に対して、パウリ群は局所可逆写像決定図形である。
函数 $0,1ntomathbbC$ と $G$ に対して、パウリ群は局所可逆写像決定図形である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:27:09 GMT)
Classical simulation of amplitude-damped bucket-brigade quantum random access memories via predictable branch evolution [5.3] 我々は、量子ビット符号化と量子ビット符号化の両方に対して、バケット・ブリガドQRAMシミュレーションにおける減衰チャネル予測の完全な説明を与える。
結果として得られるアルゴリズムは、悪いブランチと1つの参照ブランチのみを進化させ、置き換える完全な進化と他のコストをすべて共有する。
これは、pruned-over-fullのスピードアップを最大285タイムで行うエンドツーエンドのベンチマークと、すべてのクローズドフォームをマシン精度で確認するトラジェクトリレベルのテストによって検証される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:32:18 GMT)
The Double-Edged Sword of Information: Revealed versus Hidden Lotteries in School Choice [5.3] 学校の選択において、宝くじ番号は、マッチング機構によって関係を断ち切るためにしばしば使用される。
近年、ニューヨーク市公立学校は、透明性を高めるために、学生に宝くじ番号を公表し始めた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:06:33 GMT)
Dynamical Parameters: An Interpretability Framework for Time-Series Foundation Models [5.2] 動的プロパティは、そのプロパティが変更されても、予測が正しく応答しない場合でも、隠れた状態でアクセスすることができる。
我々はこれらの特性を,トレンドスロープ,発振周波数,自己回帰依存性などの動的パラメータとして定式化する。
隠れ状態からの回復によって測定された表現アクセシビリティと、予測された予測変化と一致して測定された予測応答を比較した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:56:47 GMT)
Do Not Cut When Uncertain: Rejectable and Calibrated Decision Heads for VLA Policies in Robotic Harvesting [5.2] VLA(Vision-Language-Action)ポリシーは、行動軌跡を出力するために最適化されているが、"I don't know"や"I should not act"は表現できない。
提案するRejectable and Calibrated Decision Heads (RCDH) について述べる。
RCDHはタイプ付き、拒絶可能で、校正された出力インタフェースで、凍結したVLAバックボーンにリトレーニングや新機能を使わずに取り付けることができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:38:23 GMT)
One Readout, Many Repairs: Diffusion-Guided Hierarchical Search for Tool-Agent Repair [5.2] 本稿では,修復計算の削減を図り,ツールエージェントの故障復旧を改善するためのトレーニング不要な拡散誘導フレームワークを提案する。
ReCommitは、マスク付き言語モデルの単一並列読み出しから操作型スコアを再利用することにより、修復試験全体にわたって操作レベルの提案を補正する。
Agent-Diffベンチマークで4つのエンタープライズサービスにまたがる実際の障害に関する実験では、75.9%と63.2%の相対的な回復率が61.3%、51.3%の削減率を示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:57:16 GMT)
Structural Alignment for Reliable Industrial AI: Bridging Physical Reality, Data, Models, and Human Intent [5.2] 本研究では,産業用AIの信頼性を,相互作用する4つの世界における構造的整合性の問題とみなす枠組みを提案する。
これらの世界は、デジタル化、物理現実と計算表現のリンク、目標符号化、人間の認知を機械の目的に翻訳する2つのインターフェースを通して接続される。
解空間は, 存在, 非普遍性, 堅牢性, 解釈可能性という4つの属性によって特徴づけられる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:23:18 GMT)
FLOORA: A Human-Aligned Domain-Specific Language Model for Architectural Design [5.1] アーキテクチャレイアウト生成のための小さなドメイン固有言語であるFLOORAを紹介する。
特殊なデータとアライメントによって、当社の0.6Bモデルは、はるかに大きなフロンティアモデルよりも優れています。
人間の評価はこれらの結果と相関し、FLOORAは89.3%の評価で最良のモデルに選ばれた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:19:34 GMT)
Behavioral Foundation Models for Quality Diversity [5.0] 行動基礎モデル(BFM)は強化学習における新たなパラダイムであり、自然言語処理における大きな言語モデルに類似した役割を担っている。
本稿では,BFMのコンパクト潜在空間において品質多様性(QD)探索を行うフレームワークであるBFM-QDを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:56:06 GMT)
A Unifying Framework of Concept-based Explainable AI with Completeness Guarantees [5.0] 概念に基づく説明は、概念と呼ばれる入力の人間の理解可能な特性を通してニューラルネットワークの予測を記述する。
我々はこれらのアプローチを共通の数学的言語で記述する理論的枠組みを導入する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:41:12 GMT)
TRACE: Expert-Aligned ECG Representation Learning with Rigorous Benchmarking and Real-World Validation in Acute Cardiac Care [4.6] TRACE(Text-Reinforced Analysis of Cardio ECGs)は、心電図のマルチモーダル表現モデルである。
既存のCLIPスタイルのトレーニングの限界に対処するために設計されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:26:53 GMT)
CacheRepair: Learning to Repair Cross-Chunk Context in RAG for KV Cache Fusion [4.6] CacheRepairは、独立に計算されたKVキャッシュと、チャンクを一緒に処理することによって生成されるKVキャッシュの違いを学習する。
修復により, チャンク境界近傍とチャンク内部全体のKV誤差が低減されることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:26:55 GMT)
Where Memory Belongs: Ledger, an Object Ledger for Memory-Augmented VLAs [4.6] 記憶は部分的に観察されたロボット操作に不可欠である。
最近のビジョン・アクション・スーツ・モデルは、ポリシーに直接メモリを組み込むが、単一の政治メカニズムは示さない。
我々は、単一のきめ細かいポリシーの分割を実現するハーネスであるLedgerを提示する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:12:37 GMT)
From Normative Frameworks to Alignment Data: Constructing and Evaluating SFT and Preference Data [4.6] 我々は、イスラム倫理、神学、法学の伝統に根ざした規範的枠組みにアライメントデータを構築するための専門家主導の方法論を適用した。
その結果得られたアラビア語と英語のデータセットには、約2.8Kの教師付き微調整(SFT)の例と5.4Kの好みのペアが含まれている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:58:53 GMT)
Deciding the Attainability of the Multiparameter Quantum Fisher Information is NP-Hard [4.6] 量子状態の個々のコピーの測定によるQFIの到達可能性の一般的な条件は、長い間求められてきた。
この研究では、実数、定数ランクの量子モデルの制限された集合であっても、個々の測定による正確な到達可能性を決定することはNPハードであることが証明される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:02 GMT)
Can Attack Difficulty Be Characterized Before Optimization? A Study of Pre-optimization Difficulty in Person-Vanishing Attacks [4.5] 本稿では,入力画像間での最適化作業の本質的な違いを捉える,事前最適化攻撃困難の概念を紹介する。
複数の攻撃アルゴリズムに対する実験により、Quad-CLEVERは観測された最適化コストと一貫して相関していることが示された。
本稿では,基地攻撃に対する最適化予算を適応的に割り当てるために,推定難易度を利用する難易度対応攻撃フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:47:36 GMT)
Population Fidelity: Evaluating Population Representativeness in LLMs [4.4] 大規模言語モデル(LLM)の評価フレームワークであるPopulation Fidelityを紹介する。
グループレベルの精度、グループ間の変動の量、そしてその変動の構造の3つの次元が組み込まれている。
我々は、人口の表現には、同時に人間の位置変化のいくつかの特徴を再現するモデルが必要であると論じる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:44:59 GMT)
Memory Prediction Excess: A Probabilistic Quantity for Predictive Gain and Memory Length in Stochastic Processes [4.4] 本稿では,この問題に定量的に対処するために,メモリ予測エクササイズ(MPE)を導入する。
MPEは観測履歴全体を用いて得られた予測精度を平均的に改善する。
最適条件予測精度と最適静的予測精度との差として定義される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:52:12 GMT)
IMC-CLINIC: Coupled Loss-Informed Newton Iterations for Clipping in Analog In-Memory Computing [4.4] IMCCLINIC(Coupled Loss-Informed Newton Iterations for Clipping)は,IMC MatMul出力誤差の解析的サロゲートに基づくクリッピングキャリブレーションフレームワークである。
平均ゼロショット精度を6.5-11.5ポイント向上させ、キャリブレーション時間係数を10.0-12.1に下げる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:38:47 GMT)
A Weak Notion of Symmetry for Control Systems [4.3] 弱不変系は古典不変系よりも厳密に一般である。
弱対称性は古典対称性だけでなく、群アフィン系の(非常に異なる)クラスも一般化することを示す。
また、自律的残留を伴う弱い対称性がシステムのエラーダイナミクスから導出できることも示している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:47:24 GMT)
Lagrangian--Hamiltonian Flows for Video Prediction and Image Generation: A Symplectic Perspective [4.2] 画像力学を学習するための幾何学的枠組みであるLHFMを紹介する。
LHFMはそれぞれの画像を正確なラグランジアングラフとして表現し、画像依存のハミルトン流を通してその進化をモデル化する。
我々の主な応用は、決定論的ビデオ予測である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:45:16 GMT)
"Nothing to See Here'': Unintended Disclosure through Revision Traces of LLM Deliverables [4.2] 大規模言語モデル(LLM)アシスタントは、サードパーティの受信者向けのコンテンツのドラフト作成を支援するようになっている。
プライベートドラフト中、ユーザーまたはモデルはアイテムを導入し、その後削除または置き換える。
例えば、ユーザーが設定ファイルを共有する前にパスワードを削除すると、モデルはそれを削除できるが、「要求通りにパスワード「No****4!」を削除した」とコメントを残している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:28:03 GMT)
Training-Free Clinical Reasoning through Medical Ontologies and Cognitive Mapping: A Symbolic-Probabilistic Knowledge Graph Framework [4.1] ほとんどの臨床予測システムは、患者可変アウトカム関連を学習する。
患者観察を明確な医療知識にマッピングする無トレーニング診断パラダイムについて検討する。
CKG Reasonerは、候補固有のEvidence Feature Nodes、患者参照マッチング、境界情報ゲート、知識重み付けされたエビデンス蓄積、疾患類似性、決定的な臨床規則を統合している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:39:34 GMT)
Disentangling Lung-Cancer CT/LDCT AI: A Systematic Evidence Map of Clinical Tasks, Evidence Chains, and Translational Gaps [4.1] 肺がんに対するCT(Computed Tomography)を用いた人工知能研究はしばしば「予測」と呼ばれる。
5- database search, full-text eligibility Assessment, role-aware modality/omics extract, and a Multi-Tier Evidence Graph (MTEG) を用いたCT/低用量CT(LDCT)中心肺がんAIの体系的マッピングを行った。
文献は検出が支配されており、真の将来的なリスク予測は珍しく、完全な翻訳エビデンス連鎖は稀である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:14:47 GMT)
Simulation-Based Inference for Plate Reverb System Identification [4.1] 我々は、インパルス応答が与えられたプレートパラメータの密度を推定するためにニューラルネットワークを訓練する。
新たなインパルス応答の推論では、シミュレータを介さずに、ネットワークをフォワードパスするだけでよい。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:38:22 GMT)
Receptive-field-constrained stimulus optimization for human early and intermediate visual cortex [4.1] 本稿では,2つの新しいMEI生成フレームワーク,RF-DiVE(Receptive Field Diffusion Exploration)とRF-GO(Receptive Field Gradient Optimization)を紹介する。
RF-DiVEとRF-GOで生成されたMEIを2つのコードバックボーンを用いて系統的に比較し,MEIに対する予測応答のシリカ内検証を行った。
全ての方法と視覚領域において、MEIは最も活発な自然画像よりも高いモデル予測応答を誘発する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:44:23 GMT)
Simulating Respondents, Not Single Questions: Coherent Survey Generation with Large Language Models [4.1] 既存の単一項目法では、同一人物が完全な調査にどう答えるかを正確に再現することはできない。
本稿では,2種類の特殊LLMを微調整したFullRespondent-LLMを提案する。
2つの実世界のソーシャルサーベイデータセットにおいて、FR-LLMはより正確にマルチクエスト応答パターンを再現し、競合するシングルイテムの精度を維持し、人口や疑問に見当たらないように一般化する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:24:47 GMT)
ReMCTS: Reflection-Enhanced Monte Carlo Tree Search for Code Generation [4.1] オープンウェイトな大規模言語モデル(LLM)は、自然言語のプロンプトから関数レベルプログラムを生成することができるが、もっともらしい候補は依然として隠れた意味論で失敗する。
本稿では,実行ベース,メモリ拡張,LLM誘導型MCTSスタイルの検索フレームワークであるReMCTSを提案する。
HumanEval と MBPP-Sanitized では、可視性テスト ReMCTS は、ホールドアウト評価の下で、10 個のモデルデータセットペアのうち 8 個で直接生成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:24:20 GMT)
When Is an SAE Feature Interpretable? A Validation Ladder for EEG Foundation Models [4.1] スパースオートエンコーダ(SAE)は、密度の高いモデルのアクティベーションを離散的なラテントに分解し、個々の特徴を解釈しやすくする。
EEGファンデーションモデルでは、これは誘惑的な推論を生み出す:アルファバンド活性の除去が潜伏者の活性化を強く変えるなら、潜伏者はアルファ活性を表すと結論付けるかもしれない。
3つのバックボーン、3つのEEGデータセット、3つのネットワーク深さにまたがる27の設定で、この解釈は最初は魅力的に思える。
しかし、アルファフィルタはシャムよりもはるかに多くの信号を削除する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:31:44 GMT)
Do Temporal Link Predictors Need Learned Memory? A Smoothed-Count Baseline with a Handful of Parameters [4.0] 統計的言語モデリングに基づく時間リンク予測器を提案する。
ソース間で遷移と共起数をプールし、ソースが生成したことのないリンクを予測する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:09:02 GMT)
Reliability-Gated Fusion of Consumer Head and Foot IMUs for Lower-Body 3D Pose [3.9] 信頼性問題はチャネルレベルであることを示す。
私たちは、各ストリームの各チャンネルをどれだけ信頼するかをモデルに教えます。
センサーカウントの代わりにゲートの信頼性を学ぶことは、展開可能なスパース慣性捕獲のためのレバーである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:59:22 GMT)
One Sensor, Whole Body - 3D Body Pose from a Single Consumer Earbud IMU [3.9] 一方の頭部IMUは79.0mmの剛性MPJPEで下肢の姿勢を回復し,1フィートあたりの接点は0.809マクロF1で回復する。
コンシューマー・フットの追加はポーズを著しく改善せず、4つのモデル・スプリットの組み合わせのうち2つで大幅に劣化する。
テスト対象のデバイスでは、イヤホンはそのスイートスポットだ。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:55:29 GMT)
Loyal Agents: Training LLM Agents to Protect Principal Interests Under Strategic Information Asymmetry [3.9] 我々は,エージェント・ロヤルティを,爆発性情報漏洩(EIL)の防止とマニピュティブ情報取り込み(MIU)への抵抗に必要な情報制御特性として定式化する。
実験により、忠誠心は、ゼロショット評価の下で測定可能なEILとMIUギャップを持つ一般的な能力や既存のアライメントによって保証されないことが示された。
トレーニングした8Bモデルでは,シングルターン交換における応答毎のリークを31~44pp削減し,タスクユーティリティ,エビデンス忠実度,決定精度を最大11pp,49pp,29ppに向上させた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:23:27 GMT)
Normative Loss Landscape Navigation: A Trajectory-Based Approach to Mitigating Forgetting in Incremental Learning [3.9] 連続学習モデルは、非定常データ分布を逐次訓練する場合、破滅的な忘れ込みに悩まされる。
TMLN(Trajectory-Modulatory Landscape Navigation)は,連続的な学習を曲面損失景観に対する最適制御問題として定式化する規範的ナビゲーションポリシーである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:34:44 GMT)
Computational Complexity of Clifford Template Compilation: Are Quantum Computers Useful for Compiling Quantum Circuits? [3.9] クリフォードテンプレート(Clifford template)は、クリフォード演算の有限順序族である。
コンパイル問題は、テンプレートがパウリ作用素のターゲット変換を実現するために繰り返し数を選択する方法を求める。
自己逆クリフォード作用の可換化では、二項実現可能性と1つの解の回復は古典的に時間分解可能であるが、全反復数に対する有界はNP完全である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:13:36 GMT)
When Does an Image Determine the Answer? Benchmarking Visual Answerability across Charts and Scenes [3.9] 我々は、PlotQAチャート、CLEVRレンダリングシーン、GQA写真にまたがって、完全探索評価とラベルの明確な証拠を結びつけるベンチマークを導入する。
チャート上では、最強の構成はビュー毎の判定精度96.2%に達するが、835グループのうち265は、すべての決定が正しくない答えを含んでいる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:33:29 GMT)
Planarian: Managing Agent State with Statepoints [3.9] LLMエージェントはファイルを反復的に変更し、ローカルツールを呼び出し、リモートサービスと対話することで複雑なタスクを解決する。
Planarianは、エージェントがミスを解除し、代替案を並行して探すことを可能にし、タスク品質を最大15倍改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:09:18 GMT)
Same Bytes, Different Authority: Reserved-Token Representations in Chat-Template Prompt Injection [3.8] |im_start|> は、単一の予約制御トークンまたは通常のサブワードトークンのシーケンスとしてモデルに到達することができる。
入力された命令の権限のどれだけが、学習された表現の予約トークンから来ているかを測定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:51:21 GMT)
Spontaneous Context Restoration: How Language Models Recover from Corrupted Inputs [3.7] 言語モデルは、入力が削除、置換、ミススペルによって破損しても、正しい出力を生成することがある。
我々は,この行動に伴う内部プロセスについて検討し,その過程を文脈復元と呼ぶ。
注意のみのトランスでは、クリーンなシーケンスのみのトレーニングにもかかわらず、自然に回復する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:54:56 GMT)
Fuzzy Distribution Modeling for Synthetic Tabular Data Generation with Causality Preservation [3.7] 本稿では,ファジィ集合理論に基づく合成表データ生成のためのファジィ分布モデリング手法を提案する。
合成サンプルは、生の値ではなくファジィの概念をサンプリングすることによって生成される。
ベンチマークデータセットの実験結果は、最先端の手法と比較して、実用性、忠実性、プライバシに関する競合性能を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:23:37 GMT)
Terrain-Aware Autonomous Planetary Exploration for Exteroceptive-Proprioceptive Mapping with Quadruped Scouts [3.7] 本稿では,月のような環境下での四足歩行ロボットに対する外受容と固有受容のマッピングを組み合わせた地形対応探索フレームワークを提案する。
搭載されているRGB-Dカメラは、ロボット中心の標高マップを構築し、幾何学的トラベル性を推定し、自律的な計画のためのナビゲーションコストを導出する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:01:24 GMT)
Your Benchmark Is Not Saturated: Reviving Multiple-Choice Evaluation with Answer Pooling [3.7] マルチ選択ベンチマークは、グレードが安く、不在です。
私たちはAnswerPoolを提案します: コンテキストを共有する$N$の質問を受け取り、すべてのオプションを1つのリストにまとめ、モデルにその答えを割り当てるように頼みます。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:57:53 GMT)
The Model Knows When to Stop: Training-Free Early Stopping for Long-Context Reading [3.7] 本稿では,質問するよりも判断する訓練不要な停止規則であるAnswer-Convergence Stoppingを紹介する。
各チャンクの後に、凍結したモデルの現在の解答状態を調べ、その状態が自信と安定の両方であるときに停止する。
2つのフロンティアモデルを備えた完全なLongBench-v2では、ACSが唯一の停止ポリシーであり、完全な読み上げ精度に適合または超えている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:28:00 GMT)
Simulation for Planetary Robotic Perception and Autonomy: A Concise Survey of Recent Capabilities and Gaps [3.5] 惑星ロボットシミュレーションに関する文献は、様々なシミュレーションエンジン、実装、アプリケーション設定に分散している。
本研究では,惑星ロボットの知覚と自律性を4つの実用軸で検証するためのシミュレーション作業について検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:36:13 GMT)
Can Generative AI Automate Data Extraction for Meta-Analysis? A Case Study on Intercropping Research [3.4] 農業研究におけるメタアナリシス(メタアナリシス)は、既知のものを合成し、網羅的なパターンを分析するために大きな必要性がある。
刊行された文献からデータを抽出することは、労働集約的で、時間がかかり、退屈である。
最近の試みでは、データ収集を自動化するシステムやツールの構築に重点を置いているが、人間のラベルによる真実に対する厳密な評価は、しばしば欠落している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:04:41 GMT)
Towards Generalizable 3D Anomaly Detection via Relational Inconsistency Modeling [3.4] 3D異常検出は、ポイントクラウドデータの欠陥領域を特定することを目的としている。
本稿では,欠陥を幾何学的整合性の違反として特徴付ける関係不整合モデリングフレームワークを提案する。
提案手法は,関係性違反を抑えるために設計された擬似異常により,カテゴリに依存しない欠陥を学習する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:52:32 GMT)
Exploring Learning Models for Topological Relationship Recognition from Image Data [3.4] 画像のトポロジカルな関係は、GIS、バイオメディカルイメージング、ロボット工学といった分野において重要である。
機械学習は長い道のりを歩んできたが、人々は画像にこれらのトポロジ的関係を見出すことにはあまり注力していない。
11,000枚以上のラベル付き画像は、これらすべての重要な関係を示している。
私たちは、Naive Bayes、KNN、Random Forest、SVM、Artificial Neural Networksといった古典的な機械学習モデルでテストを実行しました。
深層学習法、特にVGG16は、検証精度が89.55%に達した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:42:06 GMT)
Quantum Query Complexity Beyond the Worst Case [3.4] 量子クエリの複雑さが古典的なクエリの複雑さよりも指数関数的に小さい全関数が存在することを示す。
また,スムース化により,最悪の解析結果よりも大きな量子スピードアップが期待できることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:35:50 GMT)
Separating personal from population gains when calibrating EEG foundation models for new users [3.3] ファンデーションモデルは、個々のユーザーに適応する傾向にあるが、明らかなパーソナライゼーションの増加は、単により強力な人口モデルに反映できる。
本研究では,3つの運動画像データから,凍結脳波基礎モデルの235被験者に対する個人適応性を評価した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:04:42 GMT)
Model-Informed Safe Reinforcement Learning for Bipedal Locomotion via Step-to-Step Prediction [3.3] 解析的Angular Momentum Linear Inverted Pendulumテンプレートに固定されたモデルインフォームド強化学習フレームワークを提案する。
離散的な指数関数制御バリア関数を介してALIPステップのステップツーステップ安全証明書を提供する。
提案手法は, 制約のないベースラインと比較して, 報告外乱試験における安全違反事象を低減する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:39:55 GMT)
Optimizing and Securing the Modern Watermarking Channel for Images [3.3] 本稿では,エンコーダ/デコーダペアの出力の統計的解析を基礎とした,現代的なポストホックな透かし方式の理論モデルを提案する。
これらのディープニューラルネットワークは,BPSK変調を用いてメッセージを送信することで,並列AWGNチャネルとしてモデル化された透かしチャネルを暗黙的に定義することを示す。
復号器の出力の統計モデルに基づいて秘密鍵を推定する可能性にリンクすることで、ポストホック方式のセキュリティを正確にマーキングする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:37:19 GMT)
AnswerMap: Faithful Spatial Interpretability of VLMs from Answer Posteriors [3.3] 出力ヘッドから構築されたトレーニング不要、タスク非依存、ブラックボックスの視覚的理性であるAnswerMapを紹介する。
行と円柱の後方の積は、クエリ条件付き空間写像を与える。
2つのテストで4つのモデルと3つのクエリ分布でAnswerMapを検証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:17:08 GMT)
Simulation-Based Quantum System Inference with Neural Posterior Estimation [3.3] シミュレーションに基づく量子システム推論を導入する。
1回トレーニングされた1つのモデルは、新しい測定記録を1回の前方通過で後方にマップする。
パウリノイズ学習、量子エラー緩和、量子状態トモグラフィ、ハミルトン学習にまたがるフレームワークの汎用性を数値的に示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:04:15 GMT)
XPhysICS: Cross-Physical-Domain Threat Grounding for Industrial Control Systems Security [3.2] XPhysICS(XPhysICS)は、特定のターゲットシステムに、文書化されたサイバー物理脅威を接地するための方法論である。
本研究では, 連続プロセスおよび製造源間の83の脅威抽象化を, 別個の評価分母を用いて検討した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:03:46 GMT)
Graph-Based Simultaneous Path and Foothold Planning for Multi-Limbed Intra-Vehicular Robots in Space Stations [3.2] グラップリングエンドエフェクターを備えた多脚車内ロボット(MLIVR)が,将来性のあるソリューションとして登場した。
これらのインタフェース上の把握可能な位置は空間的に限定的かつ離散的に分布しているため、MLIVRの動作計画と足場計画とを併用して対処する必要がある。
本稿では,MLIVRのグラフ理論に基づく,同時経路と足場計画の枠組みを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:05:39 GMT)
PairPref: When Should Memory Guide the Answer? A Benchmark for Contextual Preference Use [3.2] PairPrefは、文脈的嗜好使用のベンチマークである。
各ペアは状況だけを変更し、好み、要求、および4つの候補の応答を固定する。
選択トラックでは、モデルは適切な場合にのみ好みを適用する返信を選択する必要がある。
フリージェネレーショントラックでは、候補の応答を見ることなくいつ適用するかを決めなければなりません。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:59:35 GMT)
ForVis: An In-Field Dataset and Benchmark for VIO Using Under-Canopy UAV Flights in Forests [3.2] 森林環境におけるUAV飛行中のVI-SLAMを評価するためのフィールド内データセットとベンチマークであるForVisを提案する。
データセットには、オープンな牧草地、上天王星、下天王星の各環境を横断する12回の飛行が含まれている。
我々は、504回以上の7つのオープンソースのVI-SLAMシステムをベンチマークした。
その結果, センサ選択は, アルゴリズム間の拡散よりも軌道誤差に大きな影響を及ぼすことがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:57:39 GMT)
Counterexamples to Local Reconstruction Gain as a Proxy for Final Fidelity in Residual Completion [3.2] 残余補完は、厳密なスパース計算から省略されたトークンの寄与を推定することにより、クエリ対応スパース注意を増大させる。
トレーニングフリーのRESAを学習し,冷凍バックボーン言語モデルを用いてTop-K+$を学習した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:42:38 GMT)
A Simple Gripper Interface for Simulator-Agnostic Cloth Manipulation [3.2] モデルは頑丈で、高速で実装が容易で、グリップと布の間の接触や摩擦の考慮を避けることができる。
我々は制約に基づく拡張不能な布シミュレータと協調して把握モデルを実装した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:31:49 GMT)
From Simple Sources to Quantum Advantage: Homomorphic Polynomial Transduction via Relative Decoding [3.2] デコード量子干渉法(DQI)とそのハミルトン拡張法(HDQI)は、振幅が目標の低度である状態を作成する。
我々は、このアプローチを代数準同型を通して量子状態として再考する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:10:51 GMT)
Neural Succession: A Mesoscopic Theory of Invasion, Coexistence, and Stabilization in Continual Learning [3.1] 本研究では,現在住民コミュニティとなっているメソスコピック・アカウントである逐次学習理論(SLT)を開発した。
その経験的座標は、入力タスクが学習される前に、常駐モデル上で測定される、指向性前侵入互換性である。
84-NISTスイートでは、互換性は保持しきい値ごとに共存と排除を分離する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:07:28 GMT)
QC-Stark: A Multi-Task Benchmark Revealing Capability Dissociations in LLMs Evaluated on Quantum Computing Tasks [3.0] QC-Starkは、11の量子コンピューティング(QC)タスクで大きな言語モデル(LLM)を評価するためのベンチマークである。
このベンチマークに含まれる11のタスクのうち4つについて、全体的なタスク毎のランキングとスピアマンの相関は統計的に重要ではない。
すべてのタスクは実行によって自動検証可能であるため、手作業による評価は不要である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:36:12 GMT)
Making the Invisible Visible: A Framework for Reflective AI Use in Software Engineering Education [3.0] 本稿では,ソフトウェア工学教育における学生-AIインタラクションの可視化を目的としたリフレクションフレームワークであるAI Journalを紹介する。
このフレームワークは、プロンプト、アウトプット、インテント、インタラクションコンテキストを記録する実行追跡と、認知監査を組み合わせる。
これにより、成果に基づく評価だけでは観察不可能な学生学習の側面を可視化できるようになった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:04:55 GMT)
Digital Quantum Algorithms for Generating and Utilizing Spin Squeezed States [3.0] そこで本研究では,SSSを奥行きパラメータで作成する適応型ローカル回路プロトコルを提案する。
この深さは、エンタングルメントエントロピーの下位境界を導出することにより、置換対称SSSに対して最適であることを示す。
さらに,従来の手法よりも少ない資源でDicke状態を決定論的に準備するために,スキューズパラダイムを活用している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:08 GMT)
Reciprocal Guidance: Orchestrating Draft and Verify Budgets for Advancing the Diffusion-AR Self-Speculation Frontier [2.9] 自己推論モデルは、共有バックボーン内でドラフトと検証を統合することで、投機的パイプラインを単純化する。
Reciprocal Guidance(RecGuide)は、投機的復号化をさまざまなサービス負荷に適応させるランタイムドラフト検証オーケストレーションフレームワークである。
さまざまなレベルにわたる実験は、バニラの自己定義よりも一貫したスループットの向上を示し、最大1.8タイムのスピードアップを実現している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:04:32 GMT)
Stealth Is a Relation, Not a Property: How Event Representations Create Blind Spots for Timing Attacks in Event-Based Perception [2.9] 保護された蓄積ウィンドウ内でイベントをリモートすると、蓄積された整数テンソルは正確に変化しない。
我々は、この正確なブラインド空間を用いて、タイムスタンプ誘導型攻撃であるNullを構築し、SC-ASR_A(tau)を定義して攻撃成功を測定する。
また、独立に実装された制約付き射影勾配 C-PGD を用いて、全く同じブラインド空間を探索する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:29:17 GMT)
Sustained growth of quantum circuit complexity in many-body Hamiltonian dynamics [2.8] 我々は、局所的時間非依存なハミルトン力学について研究する。
一般の局所ハミルトニアンや典型的な初期生成物が高い有効温度で存在する場合、堅牢な量子回路の複雑さは、非常に長い時間にわたって増大しなければならない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:23:38 GMT)
OTT3R: Multi-View 3D Reconstruction and Fast Dataset Generation at 1% Compute [2.7] OTT3R(RGB-Only Tiny Transformer for 3D Reconstruction)は、3D再構築のための知識蒸留フレームワークである。
擬似ラベルパイプラインは、COLMAPに代わる信頼性の高い高スループットを提供する。
デプロイ可能なアーティファクトはドメイン特化された学生であり、0.2%の計算の専門化の後、7シーンのCOLMAPよりも4$times$正確である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:05:19 GMT)
LOCO-AdaMP: Built-in LOCO Inference for Adaptive Minipatch Ensembles with Enhanced Prediction [2.6] 最近のアンサンブルフレームワークであるLOCO-MPは、観察と特徴の両方をサブサンプリングするミニパッチを使用してこれらの課題に対処している。
そこで我々はLOCO-AdaMPを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:52:26 GMT)
MS-GLA: Multi-Scale Gated Linear Attention for Addressing Representational Bottlenecks via Multi-Temporal Resolution [2.6] ゲーテッド線形アテンション (GLA) 変換器はデータ依存ゲーティングを通じて線形リカレントモデルを前進させる。
我々は,複数の時間分解能にまたがって注目ヘッドを分散することで,この問題に対処するマルチスケール Gated Linear Attention (MS-GLA) を導入する。
MS-GLAは、一致したパラメータ数において、GLAよりも高い精度と低いパープレキシティを一貫して達成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:23:45 GMT)
Medical Image Alignment Assessment as a Test of Generalist Visual Reasoning in Frontier Multimodal Models [2.6] 本研究では,フロンティアMLLMが医用画像アライメントの効果的な視覚的評価を行うことができることを示す。
わずか数ヶ月前にリリースされたモデルでは、一般化が不十分で、いくつかの設定では、ほとんどパフォーマンスが上回らない。
以上より,医用画像アライメントは一般的な視覚的推論に有用なテストベッドであると考えられた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:17:27 GMT)
What Does a Stream Model Buy You in Flow Matching? [2.6] ストリームレベルのCFMの目的は、ストリーム法則にのみ依存する(s_t,v_t)$)。
全体の設計空間は2つのスカラー曲線$(m_t,v_t)$に崩壊する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:04:14 GMT)
Papers Without Code: Availability of GitHub Repositories Linked in *CL Publications [2.5] 計算言語学(*CL)の会場で公開されたソースコードとデータは、GitHubを通じてますます共有されている。
計算言語学(CL)ジャーナルに掲載されている論文にリンクされたレポジトリと,過去10年間のACLと共同開催イベントについて論じる。
期待に反して、より最近のACL出版物にリンクされたGitHubリポジトリは、古い出版物と同様の速度で利用できないことが分かりました。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:02:36 GMT)
Cognitive Expert Language Models Better Align with the Corresponding Brain Systems [2.5] 大型言語モデル(LLM)は、自然言語理解中に様々な脳領域で人間の脳活動を予測することができる。
このワンモデル適合アプローチは、脳領域の機能的特殊化を無視している。
本研究では、特定の認知領域を指向するモデルが、その領域に特有な脳システムとよく一致しているかどうかを評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:34:58 GMT)
Pretrained ASR Pseudo-labeling for Noisy Police Audio [2.4] 事前訓練されたASRシステムは、ノイズの多い放送警察通信(BPC)で不調に機能する
Pseudo-labelingは、高価な人間ラベルなしでASRを改善するための教師なしの道を提供する。
本稿では,一方のモデルを他方の擬似ラベルで微調整するクロスモデル擬似ラベル方式を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:09:10 GMT)
Can Representation Learning Decouple from Loss Minimization? Polar Updates Have an Answer [2.4] 本研究では,訓練損失が改善しない場合に表現学習が停止するかどうかを考察する。
教師の学習玩具に対する明示的なサイクルとアライメントの公式と条件付きプラトーと崩壊境界を導出する。
33 ReLU, GELU, SiLUの教師構成について, 方向のみのアライメント尺度を用いて, 学生AGOPが周期2の発振中に教師のサブ空間に整合しているか, あるいは整合しているかを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:35:56 GMT)
Geometric Encoding for Spatial Reasoning in Vision-Language Models [2.4] VLM(Vision-Language Models)は、その空間的および時間的特性を推論するよりも、ビデオに現れるものを認識する方がはるかに信頼性が高い。
ビデオから空間構造を明示的に計算する,知覚と幾何学のパイプラインであるGeometric Codeを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:29:01 GMT)
Bounding Retraining Equivalence and the Deletion Floor in Materials Machine Unlearning [2.4] 材料機械学習では、特定の記録を削除した後でも、密接に関連する保持構造が正確な特性予測を維持できる。
削除要求において,削除フロアを指定されたトレーニング手順の下で,期待される目標損失として定義する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:03:08 GMT)
Indistinguishability of Sum of Permutations: A Fourier Analytic Route to Classical and Quantum Security [2.4] 独立な乱数置換と関連する置換から関数への変換の和について検討する。
我々は,その構成を確率密度で表現し,受容関数で区別する統一されたフーリエ解析処理を行う。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:30:40 GMT)
TIDE: Teacher-Student Transition via Informative Distillation and Exploration for Agentic RL [2.4] マルチターンエージェントは、長い地平線上での情報収集、行動、フィードバックを調整する戦略を必要とする。
オンライン蒸留(OPD)によりRLを増強する最近の方法
潮流は教師の指導と報奨による更新を共同で調整する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:51:48 GMT)
Cheap, open agents make LLM pollution harder to mitigate [2.3] LLM(Large Language Model)は、人間の行動を捉えるために合成応答がデータを汚染する場合に発生する。
完全開き型から閉き型まで,9種類のエージェント構成の性能と検出性を比較した。
オープンと商用のエージェントは異なるチェックセットに失敗し、単一のチェックですべてのエージェントを確実に検出することはなかったが、オープンテキストのレスポンスはエージェントと人間を最も区別した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:36:01 GMT)
Is there a future for models in the LLM era? [2.3] ARTHURは、ダイアグラムから伝統的なルールベースのMDEコードジェネレータによって生成されるレガシーJavaコードを対象として設計されている。
我々は、時間とコスト、テストレートのパス、textttcompile@k、 textttpass@k、 textttpass$k$で得られた結果を測定します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:33:09 GMT)
LoopICL: Looping a single transformer block to solve tabular tasks [2.3] LoopICLは、コア設計がパラメータ数を計算深度から切り離すループ変換器である。
標準設定では、LoopICLはTabArena上のTabICLv2と同じ計算コストでTALENTと競合する。
そのリカレント設計により、ユーザは推論コストとパフォーマンスをトレードオフでき、リソースを意識したFMを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:46:48 GMT)
A Two-Echelon Covering Tour Vehicle Routing Problem with Drones for Post-Disaster Relief [2.3] 本研究では,災害後の救援物資の流通に有効な2E-CTVRP (2-echelon cover tour vehicle routing problem) を提案する。
本稿では,クラスタを衛星に割り当てる際の,グレディランダムな構成,単一軌道探索,周期経路リリンクを組み合わせたハイブリッドメタヒューリスティックGRASP-ILS-PRを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:27:45 GMT)
Textual User Taste: Natural-Language User Context for Foundation-Model Recommender System at Scale [2.2] 本稿では,聴取行動,インタラクション信号,コンテンツメタデータ,任意のユーザフィードバックから構造化された自然言語の味覚プロファイルを生成するシステムであるTextual User Tasteを紹介する。
産業規模でこれらの表現を生成し、評価し、最適化し、維持するために必要なエンド・ツー・エンドの生産ライフサイクルについて述べる。
評価の結果,味覚プロファイルは肯定的な自然言語のステアリングをサポートし,重要な制限を露呈することがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:34:14 GMT)
Detecting False Data Injection and Unstable Operation in Smart Grid via System-Aware Graph Boundary Learning [2.0] クリーンな安定な構成からのみ安定した動作領域を学習するグラフ学習フレームワークであるStarGNNを紹介する。
StarGNNは、真の不安定なラベルや攻撃サンプルにアクセスすることなく、安定性予測と攻撃検出の両方をサポートできることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:05:42 GMT)
EvE: An Alternate Optimizer to Adam [2.0] EvEは、アダムを標的とした定常な4つの微分勾配である。
EvEは、70セルの76%でAdamに勝利または結びつきを与える。
EvEは最終段階のトレーナーとしてのAdamの完全な代替ではなく、検索が重く予算が制約された体制の高速かつ勾配対応のプロキシである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:55:40 GMT)
Uncertainty Quantification in Cardiac Model Personalisation from Ultrafast Ultrasound [1.9] シミュレーションベース推論(SBI)を用いた統計的推論問題としてSWEインフォームドパーソナライゼーションを定式化する。
被験者適応0D心血管モデルと神経後部推定を用いて,活性剛性尺度k0,収縮速度kATP,緩和速度kSRのモデル条件後部分布を推定した。
これらの結果は、SWEに基づく個人化の不確実性に対するSBIをサポートし、先行支援と前方モデル適合性を重要な診断基準として同定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:04:13 GMT)
Isotonic surrogate modeling for computer experiments with many input variables [1.9] 本稿では,多くの入力変数を持つ等方性代理モデリングのための変換型付加等方性モデル(TAIM)を提案する。
TAIMは、慎重に設計されたギブスサンプリング器を介して効率的な後部推論を可能にする。
数値実験と2つの応用により,多くの入力変数を持つ等速代理モデリングにおけるTAIMの有効性が示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:03:26 GMT)
Audience-Bound Persistent Memory: Authorization Across the Memory Lifecycle [1.9] メモリライフサイクル全体にわたるコンテキスト前の認証について研究する。
この許可は、正確に組み立てられたコンテキストにおいて、健全でポリシー完全である。
不正な基本的代替を生んだ建築は無かったが、未調査の代替品があまりに稀であったため、事前に規定された共同決定が確立できなかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:04:54 GMT)
Design and Validation of an Antagonistic Tendon-Driven Dexterous Robotic Hand with Bidirectional Operation [1.9] 本稿では, 対角的腱引き機構を用いた人為的, 人体規模 (200 mm) , 軽量 (220 g) , 3Dプリント, 17-DoFロボットハンドについて述べる。
提案したルーティング機構により、すべての自由度がその中立な構成を横切ることができ、手のひら側または背側でホールをつかむことができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:36:21 GMT)
WebPageBench: Event-Level Verification and Controlled UI-Variant Generation for Web Agents [1.9] WebPageBenchは、Webエージェントを評価するためのオープンフレームワークである。
タスクは必要なイベントを宣言し、それらをマッチングすることで成功を判断する。
WebPageBenchリリースは3つのコンポーネントで構成されている。152のタスクは65の標準シナリオと87のコントロールバリアントで構成され、一般的なランナーは6つのブラウザ/DOMハーネス構成と5つのスクリーンショットのみのGUIエージェントファミリーで評価されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:24:23 GMT)
Cognitive Skills in the Age of AI: Computing Students and Experts Perceptions [1.9] 私たちは徐々に、AIに富む未来へと移行しています。
私たちは、コンピューティングの労働力において重要な認知スキルが何であるかを知る必要があります。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:13:53 GMT)
Signal or Noise? Modality Contribution and Cooperation in Multimodal GraphRAG [1.8] マルチモーダル知識グラフ(KG)は、テキスト、フィギュア、テーブル、その他のモダリティからの情報を統一された構造化表現に統合する。
推論時により多くのモダリティから証拠を取得することで、下流のパフォーマンスが向上すると一般的に仮定される。
マルチモーダルグラフRAGパイプラインにおいて,モダリティを考慮した検索が下流の推論に与える影響について検討した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:44:24 GMT)
Asymptotically Good Quantum Codes with Addressable Transversal T Gates [1.8] 一定のレートと線形距離を持つバイナリCSSコードの明示的なファミリーを構築し、完全にアドレス可能な$T$ゲートを許容する。
具体的には、$T$の積論理パワーの任意の所定の積は、その後の補正なしに$T$の物理パワーの積によって実装される。
最小二元埋め込み長問題をアフィン空間上の最小重み問題として定式化し、境界レートと相対距離境界における定数を数値的に改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:22:40 GMT)
The Uneven Decline of Collective Knowledge Production: Evidence from Stack Overflow After Generative AI [1.8] ジェネレーティブAI(Gen AI)は、個人が学習し、働く方法を変えつつあるが、集団的知識に対するその影響は理解されていない。
本稿では,ChatGPT-3.5のリリースを自然なショックとして扱うため,ソフトウェアエンジニアリングにおける最大のオンラインコミュニティであるStack Overflowを用いて,この問題を考察する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:21:56 GMT)
Conversable Quantum Fire in the Standard Model [1.8] 量子火力は効率よく複製できるが、一方通行の古典的な通信では伝達できない量子状態から成り立っている。
量子ファイアのこの2つの新しい性質とクローン性を利用して、量子ファイアの最初の暗号的応用の1つを提供します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 22:13:43 GMT)
Temporal Heterogeneous Graph Pretraining for Relational Deep Learning [1.7] 両時間信号の明示的に符号化が下流タスクの時間的事前学習に与える影響について検討する。
本フレームワークでは,学習可能な時間スケールとタイプ固有投影を用いて記録年齢をキャプチャするマルチスケールタイムと,符号付き相互記録間隔を表すロータリータイムを組み合わせた。
ヘテロジニアスGNNとグラフトランスフォーマーのバックボーンを用いて,11の分類および回帰タスクにまたがる5つのRelBenchデータセットを評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:05:37 GMT)
Fixed-Time Gaussian State Transfer via Collective Dissipation in a Fully Static Architecture [1.7] 本研究では,情報伝達をアクティブな制御なしに仲介する固定時間通信チャネルについて検討する。
アンサンブル解析により、チャネル性能は振幅レベルの非対称性に対して頑健であり、一様レートのドレッシングとして機能することが示された。
高速メモリでは、環境相関が急速に抑制され、チャネルは環境の劣化に敏感になり、マルコフ限界を回復する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:42:01 GMT)
Small transformers track Bayesian evidence for latent common causes via a context-invariant mechanism [1.7] 共起原因に関するベイズ的推論の形式が、小さくてトラクタブルな変換器において、コンテキスト横断的な一般化としてどのように現れるかについて、詳細な研究を行う。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:36:19 GMT)
MCP Error Messages Written for Developers Hurt the Most Capable Agents Most [1.7] 150の広く使われているMPPサーバでは、3,001のエラーメッセージのうち949が呼び出し元に次に何をすべきかを伝える。
私たちは5つのOpenAIモデルをテストしました。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:14:46 GMT)
HClimRep-Ocean: A Global Ocean Emulator on an Unstructured Mesh [1.7] FESOM2の非構造メッシュ上で直接動作する海洋エミュレータであるHClimRep-Oceanについて述べる。
電流の場合、HClimRep-Oceanは30日間の予測で全ての基準を上回り、一方温度と塩分濃度では、減衰した異常な持続予測はより正確な推定値のままである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:54:55 GMT)
Accuracy Evaluation of INS/ZUPT Filtering Methods Based on Different Geometric Error Definitions [1.7] 本稿では, 左誤り過程と測定モデルを, 不変フィルタ, 2フレームフィルタ, 等変フィルタから導出する。
InS/zuPT測定システムを用いた実験により, 従来の間接拡張カルマンフィルタ(EKF)は, 走行距離の0.1%以下でループ閉鎖位置誤差を達成できた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:25:59 GMT)
Nociception as a Control Primitive: Afferent Channels and Nociceptive Memory for Agents Deployed in One Body [1.6] 本研究では, 固定重量政策のパラメータを, 身体の描画前に設定し, 生命の更新を行わないエフェポッチ1の設定について検討する。
私たちは、感覚のコストが、最も穏やかな仕事よりも、まだ感じられていない仕事への割り当てを移動したことを証明しています。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:37:35 GMT)
Hybrid QKD-PQC Network Emulation through Automated and Scalable Cloud-Native Orchestration [1.6] この作業ではQudittoを、自動化されたスケーラブルなクラウドネイティブオーケストレーションを備えたハイブリッドQKD-PQCネットワークエミュレーションプラットフォームとして紹介する。
提案プラットフォームは4つの主要なコントリビューションを紹介している。クラウドネイティブオーケストレータは、クラウドとマルチクラスタ環境にまたがる完全な自動化されたインフラストラクチャデプロイメントを可能にし、量子後ノードのネイティブ統合によりハイブリッドQKD-PQCネットワークの統一エミュレーションを可能にし、暗号材料の永続的かつアクセス制御されたストレージを提供するセキュアなキー管理モジュールである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:06:03 GMT)
Finite-Sample Theory for Fitted Q-Iteration When Actions Are Functions [1.6] オフライン強化学習は、以前収集されたデータから最適な決定ルールを求める。
いくつかの応用において、決定は、放射線治療におけるフルエンスマップや、ロボット工学における滑らかな運動軌跡のような全機能である。
本研究では, 有限サンプル理論を用いて, 微分無限水平条件下での関数的作用を持つQ-it (FQI) について検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:41:46 GMT)
Weakly interacting fermionic Gibbs states are Gaussian mixtures and classically simulable [1.6] 十分に弱い相互作用を持つフェルミオンのガウス性と古典的シミュラビリティを厳格に確立する。
任意の有限温度および任意の次元において局所的に相互作用するフェルミオンハミルトニアン$H=H_0+V$のギブス状態に対して、ギブス状態がフェルミオンガウス状態の凸混合であるような正の相互作用強度が存在することを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:35:48 GMT)
Near-Optimal Bounds on the Density of Low-Energy States of $k$-Local Hamiltonians and Faster Quantum Algorithms [1.5] 一般の$k$ローカルハミルトニアンの低エネルギー推定と状態準備は、量子複雑性理論の基本的な課題である。
これらの問題に対して、二進エントロピー関数が実行時指数を支配できる高速指数量子アルゴリズムを提案する。
我々の主な技術的結果は、ハミルトンの低エネルギー部分空間の次元上のエントロピーが支配する下界であり、基底状態の分極によって得られる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:02:02 GMT)
Singularities of Non-negative Matrix Factorization and their application to Bayesian inference [1.5] 非負行列因数分解(非負行列因数分解、NMF)は、ベイジアンが実対数標準しきい値(RLCT)によって支配される特異統計モデルである。
分解写像の局所幾何学を考察し,NMF の RLCT 上界を導出する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:09:05 GMT)
Gauge freedom and efficient algorithms for Lindbladian learning [1.5] 本研究では,SPAM(State-preparation-and-measurement)ノイズの存在下でのリンドブラディアン学習の問題点について検討する。
我々は、信頼されたシングルキュービット制御で通勤する局所性保存ゲージ変換の族を特定し、リンドブラディアン成分の分類にそれを用いる。
我々のアルゴリズムは、信頼できる単一キュービット演算のみを使用し、アンシラもエンタングリング制御も必要とせず、$widetildemathcal Oleft(-2log(N/)right)$実験と、局所性と等級の連続的な進化時間を使用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:23:26 GMT)
An Optimal Quantum Linear Systems Algorithm [1.5] 量子線形システム問題(QLSP)では、条件番号$$$の$d$スパース$Ntimes N$Matrix$A$へのクエリアクセスが与えられる。
目標は、$vec x$ of $Avecx=vecb$に比例する量子状態に$$-approximationを出力することである。
行列エントリに対して$O(sqrt N)$クエリを使用して,任意の$Ntimes N$ユニタリを境界誤差で実装可能であることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:22:14 GMT)
THEIA: A Multimodal Dataset and Benchmark for Vision-Language Analysis of Layout [1.5] 本稿では,質問応答と組み合わせた数千のレイアウト画像を含む新しいデータセットであるTheeIAを提案する。
アナログ回路のGDSIIファイルを解析するために、微調整視覚言語モデル(VLM)を用いたベンチマークを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:32:42 GMT)
Propagate, Then Sharpen: Post-Hoc Refinement of Frozen Node Classifiers [1.4] Propagate, Then Sharpen (PtS) はクラス確率の伝搬とノード単位の大量保存検証ノードを交互に行う。
PtSは、独立に調整されたAPPNPよりも、クリーンな入力に対して1.71ドル、深刻な機能腐敗の下で3.90ドルの平均テスト精度を向上することを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:01:47 GMT)
When Does Selection Replace Extraction? A Pre-Registered Test of Agent Memory with a Typed Decision Model [1.4] 会話記憶はLLM抽出事実を必要とするのか、それとも適切な生のターンを選択するのか?
近年の研究では、格付けが良い生の歴史も見受けられるが、格付けが重要かどうかについては意見が分かれている。
われわれはLoCoMoの会話とLongMemEvalについて事前登録した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:34:07 GMT)
Implementing Data Diodes Using Commodity Hardware and Open Source Software [1.4] データダイオードとして知られる一方通行のネットワークデバイスは、サイバー攻撃から守るために使用される。
データダイオードは、主に原子力発電所や政府内で機密情報を扱うために展開されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:19:31 GMT)
Safe Greenhouse Climate Control Using Lagrangian-Constrained PPO with Kolmogorov-Arnold Networks [1.4] 我々は、制約付きマルコフ決定過程(CMDP)として温室効果ガス規制を定式化する。
ラグランジアン安全なRLフレームワークRCPO-PPOを用いて、経済最適化と累積安全制約を分離する。
バニラのペナルティに基づくPPOと比較して、我々の方法は累積的な気候違反を18.65%削減し、レタスの経済利益を2.91%引き上げる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:48:25 GMT)
Inspector: Conversational and Lightweight Analyzer of Analog Circuit Layouts Using LLM and CNNs [1.4] 本稿では,微調整 LLM と CNN を組み合わせてアナログ回路の GDSII ファイルを解析するフレームワークを提案する。
4つの現実的なタスクにまたがる何千ものアナログ設計を用いた実験結果から、提案手法は最先端の汎用大規模VLMよりも大きなマージンで優れていることが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:54:13 GMT)
Tool Mediation Alters Refusal Mechanisms in Large Language Models [1.4] 我々は、要求の有害性に関する情報がモデル表現に強くエンコードされ、対話型およびツール経由の入力間で転送されることを示す。
以上の結果から,ツールメディエーションは単に害の内的知覚を低下させるだけでなく,拒絶への変換に影響を及ぼすことが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:16:54 GMT)
Arbitrary-Accuracy Neural Approximation with Optimal Neuron Count and Near-Optimal Bit Complexity [1.4] 局所的に可積分な活性化とアフィン出力を持つ標準フィードフォワードネットワークにおいて,$d+1$は隠れニューロンの最小総数であることを示す。
これらの構造は、明示的なグリッドアドレッシングと量子化された関数値の整数エンコーディングを使用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:00:04 GMT)
FD-AA: A Lightweight Focal-Diffuse And Attenuation-Aware Head for Incidental Abdominal Abnormality Detection in Chest CT [1.3] 凍結した3次元CTエンコーダに適応可能な軽量な臓器認識型分類ヘッドFD-AAを提案する。
腹部7臓器では, Pillar-0のFD-AAがSOTA(State-of-the-art)の成績を示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:54:19 GMT)
How Much Prompt Is Enough? A Blackbox Minimization of Few-Shots in LLMs [1.3] フレームワークはブラックボックスのプロンプト最小化フレームワークである。
文字数の平均は65.3%$pm$15.8%である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:18:38 GMT)
CAMEO: A Class-Activation-Mapped Equitable Overlay Framework for Fair and Robust Deep Learning-based Skin Condition Diagnosis [1.3] この研究は、説明可能なAI(XAI)を、診断精度を犠牲にすることなく、このショートカットを修正するアクティブなトレーニング信号として再利用できるかどうかを問うものである。
CAMEOは、安定なモデル説明を選択し、それらの背景から病変を分離することで、皮膚・歯列分類を改善するフレームワークである。
HAM10000と暗色のISIC画像では、CAMEOは背景駆動誤差を約4倍に削減しながら精度を維持した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:54:37 GMT)
A Hierarchy of Entropy-Shapley Games for Multivariate Predictive Uncertainty [1.3] 本稿では,任意の順序付けられた結果に対して属性を明確にする3つのエントロピーベースのShapleyゲーム階層を導入する。
結合属性のチェーンル分解を確立し,条件付き全相関によるクロスコンポーネント項の特徴付けを行う。
確率的モデル間で学習された関節構造の違いを,フレームワークがどのように捉えているかを実証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:04:38 GMT)
CATP: Design and Evaluation of Local Agent Authorization and Audit Evidence [1.3] 署名された認可記録は、署名者が主張したものを認証するが、それ自体は、アサーションが実行時決定に使用されるポリシーとアクションに一致することを証明していない。
CATPは、ローカルな実行前決定をオフラインで検証可能な証拠に伝達するために必要な結合を指定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:06:20 GMT)
Drug-Target Interaction Prediction via Hierarchical Sequential Cross-Attention over Chemical and Protein Language Models [1.3] 本稿では,事前に訓練された2つの言語モデル,薬物SMILES文字列のChemBERTaとタンパク質アミノ酸配列のESM-2を組み合わせたシーケンスのみのDTI予測アーキテクチャを提案する。
提案したモデルでは,まず事前学習したエンコーダを用いて文脈表現を抽出し,次いで1次元畳み込み層を用いて局所的なシーケンスパターンを凝縮する。
BIOSNAP、Davis、BindingDBの実験では、提案されたモデルはBIOSNAPで最高のパフォーマンスを達成し、Davisで最高のAUROCと一致し、BindingDBでは2520万のトレーニング可能なパラメータしか使用していない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:25:04 GMT)
From UNI2-h to ConvNeXt-T: Lightweight Nuclei Instance Segmentation via Knowledge Distillation [1.3] 本稿では, UNI2-h病理基盤モデルをConvNeXt-Tiny学生に蒸留する軽量なスキームを提案する。
Ours-TはPanNukeの0.519mPQ(教師の98.8%)、MoNuSegの0ショットbPQは0.668m、推論速度は634.3img/sである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:59:02 GMT)
Does Model Uncertainty Track Human Ambiguity? Evidence from Multi-Annotator Vision Benchmarks [1.3] モデルが、人間が困難なと感じているのと同じ事例で苦労しているかどうかを調査する。
3つのアーキテクチャにまたがる8つの事前訓練モデルを評価する。
両次元においてアライメントが弱いことが分かる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:51:31 GMT)
Distributional Variants of the Aaronson-Ambainis Conjecture [1.2] 均一な入力分布の下では、量子クエリアルゴリズムは古典的なアルゴリズムでシミュレートできる。
すべての固定$p inに対して、$_p$分布の下での量子クエリアルゴリズムは予想を許容し、同じが予想均一分布の下で成り立つ場合に限ることを示す。
アーロンソン・アンバイニス予想(アーロンソン・アンバイニスげん、英: Aaronson-Ambainis conjecture)は、この予想を示唆する強い言明であり、ハイパーキューブ上の有界な低次数で定式化されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:52:32 GMT)
E3J: An Efficient and Open-Source Backend for Euclidean Equivariant Operations on GPU and TPU [1.2] 我々は,GPUとTPUのJAXバインディングを備えた幾何学的深層学習アプリケーションのための,高速なユークリッド等価バックエンドe3jを提案する。
最適化されたPallasカーネルとアルゴリズムによる改善の両方を活用することで、このライブラリは最先端のスループットと、前方と後方の両方のパスでのランタイムを実現している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:10:17 GMT)
When Harness Beats Scale, and When Reading Beats Both [1.2] DocInsights 2026における文書化量的推論共有タスクDocSemについて,本システムについて述べる。
ラベル付きデータに成功し、テストセットで失敗した理由を分析します。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:42:51 GMT)
The Decision Value of Perception Compute [1.2] 本稿では,入力を安価な知覚モードから高価な知覚モードにエスカレートすることによる下流損失の変化として知覚計算の判定値を定義する。
KITTI や nuScenes に単分子幾何学を配置すると、下流の損失を変化させるエスカレーションの34~54%が悪化する。
nuScenesでは、知覚レベルの利得は意思決定値に署名することとよく一致しない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:41:28 GMT)
Learning sparse quantum states from single-qubit measurements [1.2] 我々は、密度行列が未知の積ベースで少なくとも$s$非ゼロ行列成分を持つ量子状態、$n$量子ビット量子状態の学習問題を研究する。
このような状態はコンパクトな古典的記述を許容するが、局所的に減少する密度行列からの再構成を妨げる長距離の絡み合いを持つことができる。
スパース状態は, シングルキュービット測定のみを用いて効率的に学習できることが示される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:17:45 GMT)
After the Fix: How Corrected Agent Histories Transfer to Related Tasks [1.1] エピソードの修復は、次のタスクにおいて、その体験をより良く記憶できることを示す。
私たちの3300は100のThinkingBoxペアと100のAPEXペアをソース状態の継承なしでカバーしています。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:35:23 GMT)
QuanReview: Offline, Auditable Reconciliation of Human and LLM Span Annotations [1.1] QuanReviewは構造化スパンアノテーションを修正するためのオープンソースのシステムである。
同じドキュメント上の2つのアノテーションストリームを文字レベルで整列させ、明示的かつログ化されたポリシーによって曖昧なケースを解決し、候補のコンフリクトをブラウザベースのアジュディテーションインターフェースにルーティングする。
キャンペーンマネージャは、冗長性のある複数のアノテータに文書を割り当て、文書およびスパンレベルで合意を計算し、一様文書を自動マージし、修正されたレイヤを元のファイルフォーマットでエクスポートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:33:14 GMT)
A Polyphonic Conception of AI Understanding [1.0] アウトプットは不均一な信頼性の並列メカニズムの連立から発生し,相互に補完し,重複し,あるいは溺死することを示す。
我々は,ポリフォニックAIに適合する理解の概念を考案し,出力を確実にかつ正確に採用し,制御する音響回路に焦点を当てた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:25:44 GMT)
Misaligned Clinical Risk Classification and Cost Asymmetry in Open-Weight Large Language Models [1.0] 言語モデルが患者のリスクと臨床費用のトレードオフをいかに統合するかは、まだよく分かっていない。
本研究では,4つのオープンウェイト LLM が内部的にコストトレードオフを表現しているか,これらの表現が臨床予測とどのように関連しているか,そして,特定のコスト方向や大きさによって予測される決定が変化するかを検討した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:06:45 GMT)
A decision-support system applied to Law: Reasoning and explainability of the decision [1.0] 本稿では,決定の妥当性に焦点をあてて,規則から正式な規則を運用するための枠組みについて述べる。
シンボリックAIとSPARQLクエリ言語が法的推論をどのようにサポートするかを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:10:55 GMT)
The Invisible Throttle: Running on Borrowed Time in Scratch [0.9] 描画しないループは、他の何が見えるか、機械によってペースされる。
Loopの速度はコードに触れることなく変更できる。
500の人気のある公開ゲームでは、59%が描画も待ちもしないループを含んでいる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:24:10 GMT)
The Invisible Scheduler: Dragging a Sprite Can Change What a Scratch Program Does [0.9] StackSwapは5つのスプライト(コンフリクトグラフのクラス毎に1つ)と、どちらも実現不可能なサンプルでプロジェクトを実行する。
2ランの証人が隣のスプライトを命名し、スワップが結果を変える。
すべての注文が実行されたセンシティブなプログラムの中で、保存された注文の結果は、注文の中央値(コース)と50%(パブリック)で再帰する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:21:32 GMT)
Large Language Models for Structured Clinical Data Analysis: Dual-Agent Grounding and Validation [0.9] CLEAR-Medは、構造化された臨床データの自然言語解析のための二重エージェントフレームワークである。
CLEAR-Medは、構造化された臨床データのトレース可能な分析のための一般的なアーキテクチャを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:02:51 GMT)
Detection of Adversarial Attacks on Super-Resolvers Using Spectral Features [0.9] 超解像のような画像前処理パイプラインへのディープラーニングモデルの統合は、敵に対するほとんど探索されていない攻撃ベクトルを導入している。
超解像モデル重みに埋め込まれた敵攻撃を特定するためのスペクトルベース検出法を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:22:08 GMT)
Graph neural networks for sampling-invariant embeddings of organized signal sets [0.9] 本稿では,ニューラルネットワークエンコーダを編成した信号セットについて検討する。
このようなエンコーダの目的は、不均一にサンプリングされた信号集合を任意の固定サイズのベクトル空間に投影することである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:08:05 GMT)
Toward a Culturally Adapted Chinese Language Agent: A Wizard-of-Oz Study of Nonverbal Behavior in Chinese-German Intercultural Interaction [0.9] 中国語話者のマルチモーダル行動データ収集のためのWizard-of-Oz(WoZ)によるリアルタイムシステムの設計と支援について述べる。
このシステムは、Live Linkの顔キャプチャとMediaPipe上半身追跡によって駆動されるMetaHumanアバター、リアルタイムな行動選択のためのウィザードコンソール、エージェントと学習者ストリーム間の同期マルチモーダルロギングを備えている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:32:10 GMT)
The Statistical Cost of Causal Discovery with Feedback [0.8] 観測データから正確な凝縮回収について検討した。
変数$p$、最大 SCC サイズ $s_max$、最大外用値 $d_B$ の場合、任意の推定器は$s_maxlog(ep/s_max)+d_Blog(ep/d_B)$サンプルを必要とする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:19:08 GMT)
Tensor-Train Compressed Separable PINNs: A Curvature-Aware Optimization Framework for Parametric PDEs in High Dimensions [0.8] 我々は高次元パラメトリック偏微分方程式(PDE)に適用した物理学情報ニューラルネットワーク(PINN)の2次最適化フレームワークを開発する。
フレームワークはGauss--Newtonのプルバックメトリック上に構築されており、パラメータ空間における曲率の演算子インフォームド概念を提供する。
座標分離型ニューラルアーキテクチャと線形微分作用素が有限分離型表現を許す場合、残留ヤコビアンは構造分離型分解を継承することを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:35:50 GMT)
Improving Generative Model Self-Training with Geometrically Modified Outputs [0.8] 本稿では,ジェネレータの入力出力ジャコビアンの特異値を再重み付けして,その先頭の特異方向の影響を増大させる幾何学的修正出力(GMOs)を提案する。
GMOは、標準的なモデル出力と比較して、ネオンやSIMSを含む負の誘導法の性能を一貫して改善する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:07:16 GMT)
RidgeRank: Efficient Visual Document Reranking via Score Fusion and a Shallow Linear Readout [0.8] RidgeRankは、リランカースコアがどれだけの関連性信号が不足しているかを測定し、レトリバースコアからリカバリする。
ViDoRe 2とViDoRe 3から抽出された12のデータセットに対して、RageRankはNDCG@5を最大48倍のスピードアップを持つフルクロスエンコーダの1.2pp以内で提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:05:48 GMT)
Residual Fisher Information in Measurement-Error Uncertainty [0.8] 量子構造レベルでは、この超過は正確な分解を持つことを示す。
レコードのみの誤差行列は、未読後測定システムに残されているフィッシャー情報によって固定された残留認識誤差行列と正のシュア補完項とを等しい。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:44:33 GMT)
Measuring and Mitigating Identity-Cue Preference Drift in LLM-based Recommender Systems [0.8] 大規模な言語モデルベースのレコメンデータシステムでは、プロンプトに埋め込まれたアイデンティティーキューは、グループレベルのパターンに対するレコメンデーションを制御できる。
本稿では,PmptShiftを紹介した。PmptShiftは,そのようなアイデンティティーキューの嗜好の漂流を定量化するための,解釈可能な,トレーニング不要なフレームワークである。
PromptShiftは、DifHitRate、HitRate、MRRを改善しながら、一貫してDriftとSliceShiftを減少させ、マクロ平均のSliceShiftを62.42%低下させることを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:35:06 GMT)
Generative AI-Based Data Augmentation for Oral Lesion Classification: The PhotoMOCI Dataset and Benchmark [0.7] 画像撮影による早期口腔癌の診断は,大規模な口腔検診の道として有望なものである。
これを解決するために, 口腔腫瘍学における複数の診断タスクにまたがるモデルを開発するために, 写真多目的口腔癌画像データセット(Photoic Multi-purpose Oral Cancer Imaging dataset)が導入された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:09:27 GMT)
Word Similarity Datasets for Indian Languages: Annotation and Baseline Systems [0.7] 6言語からなる単言語単語類似性データセットを手作業で提案する。
これらの言語はウルドゥー語、テルグ語、マラティー語、パンジャービ語、タミル語、グジャラート語である。
これらのデータセットの構築には、英語の単語類似性データセットの翻訳と再注釈に頼っている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:17:59 GMT)
Signatures of semantic search in the activations of large language models [0.6] 我々はジャコビアンレンズを用いて、概念レベルのアクティベーションがスイッチングを予測することを示す。
抽象カテゴリ関連ラベルの中間層Jレンズ活性化はスイッチングを期待して増加する。
スイッチングを期待して活性化される一般的な残留ストリーム方向を同定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:48:06 GMT)
Training and Inference Dynamics of PLDR-LLMs: Row-Map Collapse, Renormalization, and Predictive Reduction [0.5] モノグラフは、パワーロー・デコーダ表現言語モデル(PLDR-LLM)におけるトレーニングと推論の統一的な説明を開発する
厳密な有限作業恒等性は、行中心の学習マップの絶対エネルギーの変化をパラメータ寄与、署名された相互作用、数値的な観察欠陥に分解する。
実験では、オブザーバと依存を明らかにし、テストされた自律行状態候補を拒否し、有限条件予測と状態固有の演算子還元をサポートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:08:53 GMT)
LLMs are General Asynchronous Agents [0.5] 我々は,ユーザが重複するメモリ状態で推論を定義できる非同期LLMフレームワークを開発した。
Qwen 3.x モデルでは,タスク固有のトレーニングを必要とせず,ビデオ理解,ゲーム,監視の非同期操作が可能であることを実証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:35:26 GMT)
From One-Shot Generation to Incremental Music Composition: Adapting a General-Purpose Instruction LLM for Persistent Symbolic Editing [0.5] 本稿では,汎用的な命令追従型大規模言語モデルの異なる利用法について検討する。
我々は、ABCの持続的な表記法上での操作認識状態遷移の列として、インクリメンタルな構成を定式化する。
Llama 3.1 8B Instruct with Low-Rank Adaptation (LoRA) on 496,038 Operation-Aware dialogue records from Irish traditional music。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:03:13 GMT)
Privacy-Friendly Cohort Determination: Sealed, CSP-Independent In-Browser ML Inference of Professional Segments for Identity-Less Advertising [0.5] デバイス上で粗いプロのコホートを推測するSIF(Sealed Inference Frame)を提案する。
OpenRTBの入札ストリームには、ローカルに独立した分類符号付きラベルのみを出力する。
悪意のあるモデルでさえ、週に約5ビットのサイトをリークする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:24:19 GMT)
Physics-Guided Conditional Diffusion Model for Rare Event Synthesis and Diagnosis for the Water-Gas Shift Reaction [0.5] 水素(H2)は、高エネルギー密度と炭素排出ゼロのため、化石燃料のエコフレンドリーな代替品として扱われる。
水-ガスシフト(水-ガスシフト、英: water-gas shift、WGS)は、一酸化炭素と蒸気を水素と二酸化炭素に変換することで、水素生産に広く用いられる産業プロセスである。
WGS反応のためのリアルな希少軌道を生成する物理誘導条件拡散モデルを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:03:00 GMT)
Tokenized Key-Gated Adapter Routing: A Secure Access Control Mechanism Against Private Data Leakage in LLMs [0.5] 大きな言語モデル(LLM)は、プライバシクリティカルなドメインにますますデプロイされている。
既存の防衛は、モデルユーティリティ、プライバシ保護、微調整されたプライベート知識へのアクセスの間のトレードオフを強制する。
鍵入力トークン(ロケット)を用いたLoRA指向制御を提案する。
Locketは、細粒度でポリシー駆動のアクセス制御を直接LLM生成に組み込む。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:52:42 GMT)
MASCIT: A Mask-Aware State Space Classifier for Naturally Irregular Time Series [0.4] 不規則時系列(MASCIT)のためのマスク対応状態空間分類器
34個の不規則な時系列データセットのうち、MASCITは最強の集合点推定値を得た。
結果は、自然に不規則な時系列分類のための有効かつ実行可能なバックボーンとして、選択状態空間モデルをサポートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:23:03 GMT)
Recommendation Ranking Off-Policy Evaluation under Ranking-Dependent Examination via Examination-Relevance Decomposition [0.4] 本稿では,クリックの分解に基づく2つの評価手法を提案する。
実験により,ED-DRは試料サイズが大きい既存手法よりも低MSEを実現することが示された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:31:38 GMT)
Verifying the Linear Representation Hypothesis: How Interpretable Are Vision SAEs? [0.4] Vision Sparse Autoencoders (SAEs) は、メカニスティック・インタプリタビリティ(Mechanistic Interpretability)において人気のあるツールとなっている。
標準メトリクスと適応型自己解釈可能性スコア(AIS)の両方を用いてSAE概念の質を評価する。
その結果,SAEの解釈可能性の指標は相互に相関せず,AISとも相関し,単一の基準自由度が視覚SAEの解釈可能性の検証に十分でないことが明らかとなった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:20:57 GMT)
Observation of a topological edge state among localized bulk states in the anisotropic quantum Rabi model [0.4] トラップイオン量子シミュレータにおける異方性量子Rabiモデル(AQRM)の位相的エッジ状態(TES)とバルク固有状態について検討する。
TESとバルク状態はどちらも局在分布を示すが、TESは明確に定義されたキラリティとほぼ完全なスピン-ボソン分離性を示す。
これらの結果は,TESを固有のトポロジカルなシグネチャを通じて同定し,トポロジカルな現象を探索するためのルートとして固有状態レベルの特徴を定めている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:09:33 GMT)
Page-Aware Retrieval-Augmented Generation for EvalLLM 2026: A Five-Variant Study on French PDFs [0.3] 5つのシステム変種は、BM25ベースラインに高密度検索、階数融合、階位変更、クエリ分解を追加する。
595の課題では、完全なシステムは0.4450 MRR@10と0.4013 Recall@10であり、BM25は0.3430と0.2994である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:51:52 GMT)
RupeeBias: Auditing Demographic Bias in Indian Economic Guidance from Large Language Models [0.3] ルピーバイアス(英: RupeeBias)は、インドの経済状況における経済指導における人口統計バイアスの評価指標である。
ルーピーバイアスは、カースト、宗教、地域アイデンティティ、ジェンダー、障害、都市農村の6つの軸にまたがる87のインド固有の人口統計識別子をカバーしている。
人口識別子でのみ異なる同一のプロンプトの場合、ルピーバイアスが生成する経済生産量は平均20.2%異なる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:23:32 GMT)
MagNav: A Dual-Core Magnetic Track Guidance Framework for Lighting-Invariant Navigation in Two-Wheeled Robots [0.3] 本稿では,磁気トラック誘導システムを用いて直線を追従できる自己バランスロボットを提案する。
ステッパーモーターは、余分な回転エンコーダを必要としない正確なトルク制御を提供する。
このデザインは、工場、倉庫、屋外の道など、自律的なナビゲーションのための信頼性が高く、照明に依存しないソリューションを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:32:52 GMT)
Better Behavioral Prediction, More Faithful Model Ablations? Evidence from Sequential Choice [0.3] 認知を説明するために予測モデルを使用するには、正確な行動予測以上のものが必要である。
入力アブレーションは、モデルから情報を取り除き、結果のパフォーマンス変化を行動の重要性の証拠として解釈する、魅力的なルートを提供する。
我々は、既知の生成ポリシーを持つ2つの合成逐次バンディットタスクでテストする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:38:49 GMT)
Copula Active Subspaces I: A Score-Covariance Method for Reduced-Order Non-Gaussian Density Estimation [0.2] 非ガウス雑音の推論問題では、後部はノイズ密度と同等の精度しか得られず、勾配に基づくサンプルは、その密度と勾配評価点の点で要求される。
本稿では,この雑音密度を表すために,Copula Active Subspaces (CAS)を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:17:31 GMT)
Failure-Transparent Agents: Benchmarking Post-Failure Reporting in Tool-Using Language Models [0.2] 本稿では,フェール・トランスペアレント・エージェント(FTA)について紹介する。
FTAには5つの障害ファミリにまたがる決定論的障害トレース、中立的なコントロール、4つのユーザプレッシャ条件を備えた100のタスクが含まれている。
6つのモデルで、偽失率は基本方針下で22.8%、透明な命令で9.3%、構造化された証拠契約で0.8%である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:51:41 GMT)
Cardinality-Stratified Interaction Decomposition for Interpretable Pairwise and Higher-Order Structure in Transactional Basket Data [0.2] Cardinality-Stratified Interaction Decomposition (CSID) は対数オードのコントラストを分解する解釈可能なフレームワークである。
CSIDは、情報重み付き、ゲージに制約のあるリッジプロジェクションを用いて、ペアとトリプルコンポーネントを推定する。
これらの結果は、一対の高次および高次アソシエーション構造のための探索的および解釈可能な分解フレームワークとしてCSIDをサポートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:05:07 GMT)
Evidence Before Accuracy: A MRI-PET Fusion Network for Alzheimer Disease Classification with Causal Regional Validation [0.2] 本稿では,T1 MRIとFDG PETを併用した核融合ネットワークについて述べる。
このモデルはAUC 0.962、精度0.909、F1 0.891に到達し、最近の3D CNNやマルチモーダルトランスシステムと競合する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:56:43 GMT)
An integrated geometric quantification and shape analysis framework for axillary lymph node metastasis in breast cancer patients [0.2] 位相対応表面処理と多分解能球面調和解析を組み合わせた統合フレームワークを開発した。
家族固有の混合分解能モデルは、従来のPyRadiomics Shape14ベースラインの0.884と比較して0.918のAUCを達成した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:39:50 GMT)
The Signed Geometry of One-Shot Recourse: On-Path Validity and the Signed-Curvature Criterion [0.2] クローズドフォームのリコースは、期待される距離によって分類器の$hat g$の単位勾配に沿って、拒否されたユーザーを移動させる。
このワンショットステップがいつ成功し、追加のモデルクエリが変更されるのかを問う。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:44:23 GMT)
AgentWare: Automating the Lifecycle of Agentic Applications across the Edge-to-Cloud Continuum [0.2] 本稿では,エッジ・ツー・クラウドインフラストラクチャ間のエージェントアプリケーションのプロビジョニング,デプロイ,可観測性,評価を自動化するAgenticOpsフレームワークであるAgentWareを提案する。
我々は,AgentWareが分散エージェントアプリケーションの体系的な実験と評価を可能にし,デプロイメント,計測,解析に必要な手作業を大幅に削減できることを実証した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:25:48 GMT)
Toward a Graded Measure of Belief Stability in Large Language Models [0.2] 格付けされた信念の安定性は、信念がいかに大きな言語モデル内で持続するかを示す尺度である。
請求に対する支持は、その請求がモデルの他のコミットメントと一緒に検討されているときに継続するかどうかを問うものである。
我々は、内部モデル表現を用いて条件信念の確率を推定する直接条件推定器を用いて、このアイデアを運用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:36:54 GMT)
Fast Hamiltonian engineering from cut polytope geometry [0.2] ハミルトニアン工学(英語版)(HE)は、ハミルトニアンと制限制御を用いて、標的ハミルトニアンの下で量子力学をシミュレートする。
局所量子ビット、qudit、フェルミオン系の広いクラスに対して統一的なフレームワークを提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:09 GMT)
Efficient classical algorithm for estimating linear statistics of Boson Sampling [0.1] 本稿では, ボソンサンプリング器の線形統計を加法誤差で近似する, 効率的な古典的アルゴリズムを提案する。
本稿では,ボソンサンプリングに基づく一方向関数を古典的に評価する手法を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:42:54 GMT)
EdgeVLN: Runtime-Aware Deployment Ready Quantized Vision Language Navigation Model [0.1] 視覚言語ナビゲーション(VLN)モデルはよく機能するが、ターゲットは計算量の多いプラットフォームである。
ランタイム対応でデプロイ対応の量子化VLNモデルであるEdgeVLNを紹介する。
NVIDIA Jetson Orin NX 16GB上でのシミュレーション,遅延,エネルギー,常駐メモリにおける成功率(SR)を測定した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:32:09 GMT)
The Surge of Anti-Semitism in German Social Media following the October 7 Attacks [0.1] 我々は、2023年10月7日のハマスによるイスラエル攻撃が、ドイツにおけるユダヤ教とイスラエルに関するソーシャルメディアの議論にどの程度影響を与えたかを調査する。
大規模言語モデル(LLM)を用いたユーザ投稿における26のアンチセミティックカテゴリの検出手法を開発した。
反ユダヤ主義は両プラットフォームで著しく急増しているが、TelegramではFacebookに比べて約10倍多い。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:18:45 GMT)
Measuring trainable degrees of freedom in materials graph neural networks: a random-subspace intrinsic dimension analysis [0.1] 最終的な予測精度は、物質優位性予測におけるグラフニューラルネットワーク(GNN)の比較の標準基盤である。
本稿では,GNN学習教材の相補的特徴として,学習可能度依存を導入する。
CGCNN, ALIGNN, DimeNet++ をランダムなパラメータ部分空間で訓練する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:29:48 GMT)
Repair Before You Fuse: Frozen-Host Adaptation for Corrupted-but-Present Sensors [0.1] カメラ-LiDAR検出器は、両方のセンサーが存在し、同期され、校正されたままでも、信頼性の低い特徴を消費し続けることができる。
EmphBoundary Feature repair (BFR) は、検出器が既に消費しているモダリティインタフェースでタスク教師付き残差補正を学習するフレームワークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:22:00 GMT)
Deployment of Large IQP Circuit Born Machines on Qubit-Limited Hardware Using Noise Injection [0.1] 量子生まれの回路機械(QCBM)は、古典的に効率的に推定できる損失関数を持つが、推論中に量子コンピュータを必要とする。
これは、より大きなIQP QCBMから量子ビット制限量子コンピュータをサンプリングする方法の研究を動機付けている。
本稿では,論理レベルでノイズを注入し,元の回路を量子ビット制限量子プロセッサでサンプリング可能な小さなクラスタに確率的に分解するIQP QCBMの展開プロトコルを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:36:44 GMT)
Proofs Without Nominals: Gödel's Ontological Argument, its Shallow Embedding, and the Open Questions of the Monatshefte Notes [0.1] Benzmller と Scott's Notes on Gdel's and Scott's variants of the Onlogical argument (2025) において、高階のモジュラー論理の浅い埋め込みはモジュラー対象言語を超えて到達する。
ノートが証明した全てのステートメントは、手書きとマシンチェックで書かれたオブジェクト言語294の内部に証明を持っているが、名目上は使用していない。
すべての定理はIsabelle/HOLで、独立してLean 4で検証されます。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:09:57 GMT)
LLMs are not stochastic parrots: Evidence for meaning-mediated abstraction from conlang-like tasks [0.1] コンラングのようなタスクを用いて,強いオウム仮説を検証した。
適切なアーキテクチャ的制約と文脈的制約の下では、統計的学習が意味を媒介する抽象化を生み出すことが示される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:03:12 GMT)
Reference-Grounded Data Curation for Instruction-Following Thai-English Machine Translation [0.1] ルールコンプライアンスは、汎用IFデータ拡張手法が対処しない緊張関係である翻訳品質とは対照的である。
本稿では,参照変換から教師付き制約を抽出する2相パイプラインであるReference-Grounded Data Curationを提案する。
フェーズ1では、イングリッシュ・タイ・パラレルプールから最も難しいが学習可能なインスタンスを保持するために、インストラクション・フォロー・ディフューティ(IFD)スコアを適用している。
フェーズ2は、各基準目標から制約を抽出し、すべての制約を満たす世代のみを保持し、1.97M-record Groundedデータセットを生成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:49:26 GMT)
Timeline-Bench: Evaluating Agents on Realistic Video-Editing Tasks, from Raw Footage to Final Cut [0.1] Timeline-Benchは56の実際のビデオ編集タスクのベンチマークである。
各タスクは、簡単なソースアセット、コンテナ、一連のテストを提供する。
テストはデリバリフォーマット、コンテンツ、およびブリーフの明示的な要件をチェックします。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:28:17 GMT)
Pass or Fail? Evaluating LLMs on Two Greek Examination Benchmarks [0.1] Prot-ExとPan-Exは、ギリシャのモデルおよび実験学校の入学試験とパンヘレニック試験の質問からなるベンチマークである。
これらのベンチマークは、テキストのみの大規模言語モデル(LLM)の性能を評価するために使用される。
以上の結果から,KriKri-8Bは,言語的に要求される人文科学タスクにおいて,より大きなLLMに対抗して,その基盤モデルを大幅に上回っていることが示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:03:59 GMT)
Harmonizing Spectral Evolution in Conditional Flow Matching for TTS [0.1] テキスト音声(TTS)のための条件付きフローマッチング(CFM)モデルは、推論中に不整合周波数の進化に悩まされる。
我々は,この問題を新しいトレーニング不要な周波数選択型ブースティング戦略を導入することで効果的に緩和できることを実証した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:51:49 GMT)
Speed-Fisher Information: Chaos and Irreversibility in Classical and Quantum Dynamics [0.1] カオス力学は,速度-フィッシャー情報とプロトコル時間との分岐として現れることを示す。
我々は、速度フィッシャー情報がユニークな量子スケーリングを示すプランクタイムスケールよりも短い量子状態を特定する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:35:22 GMT)
Privacy-Preserving Full-Body Meshing from mmWave Radar via Mesh Foundation Model Supervision [0.1] ミリ波レーダー(mmWave)は、プライバシーを守る人間の知覚を可能にするが、商用の単一チップセンサーからの点雲の極端に広い範囲は、先行技術をボディ部分のキーポイントまたは個別のアクション分類に制限している。
本稿では,市販のレーダをフレーム単位のフルボディ,メトリック3Dメッシュに引き上げるクロスモーダルな教師学生用フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:49:08 GMT)
When Does Structured Knowledge Help Neural Theorem Proving? [0.0] MathKGは364のMathlibsと9,434の型付きセマンティックエッジを接続する。
我々は4つの拡張モード(文脈、知識グラフコンテキスト、Mathlib、両方)と5つのモデルで制御されたアブレーションを実行する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:17:43 GMT)
Quantum memory in an effective $Λ$-type system using dynamic detuning control of a superconducting qubit pair [0.0] 一対の可変超伝導量子ビットが半無限伝送線に結合して形成される量子光ストレージシステムについて検討する。
量子ビット間の周波数デチューニングは、スーパーラジアント励起状態とサブラジアント準安定状態を直接結合する。
提案システムは,スケーラブルな量子ネットワークのための最小かつチューニング可能な量子メモリアーキテクチャとして確立されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:11:43 GMT)
The Last Mile Is the File: OfficeEditBench for Preservation-Aware Office Editing [0.0] OfficeEditBenchは、スプレッドシート、プレゼンテーション、ドキュメントの変更スコープによるメンテナンスのための170タスクのベンチマークである。
我々は,凍結自動判定と人間の受容性とを区別しながら,メンテナンスの失敗を分析した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:25:52 GMT)
Zero Knowledge Proofs in Quantum Networks [0.0] 動作制約下での量子状態の不明瞭性に基づくゼロ知識検証のためのフレームワークを開発する。
我々は,情報理論のセキュリティを実現するマルチパーティ量子ネットワークのための明示的なプロトコルを構築した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:58:13 GMT)
Witness-based quantification of non-Markovianity without complete Choi state reconstruction [0.0] 非マルコビアン性の量子化は、開量子系の理論における基本的な問題である。
非マルコビアン性の定量化のための目撃者に基づく枠組みを開発する。
その結果,少数の実験相関測定結果から直接得られた証人値が得られた。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:25:48 GMT)
When Should a Satellite Estimate Be Changed? Stress-Testing Neural Corrections for Evapotranspiration [0.0] 我々は,OpenETと組み合わせた16,366個のフラックス・トウワー観測における10員モデルの評価を行った。
空間的に保留された単位誤差では、SupportGainは風速x3.6でステーションマクロMAE対ゲインを0.148 mm/日削減した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:48:27 GMT)
What is Physics For? Why Classical Physics is not the Limit of Quantum Mechanics [0.0] 量子力学は、史上最も成功した物理理論であると見なされている。
数学的形式主義の普遍的な解釈は、一世紀にわたる議論の後に存在しない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:08:46 GMT)
What Drives Citations in Production Large Language Models? An Observational Multi-Method Study of Two Million AI Citations Across Ten Thousand Web Pages [0.0] 本稿では,4基の商用エンジンから約200万基の励起を観測した。
ページレベルの予測は,プロンプトコンテンツアライメントが主流であることがわかった。
標準のAEOチェックリストは、ドメイン固定効果が適用されれば逆あるいは崩壊するプーリングされたデータに肯定的な効果を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:00:53 GMT)
Vision--Language Signals in Constrained RL: Safety Gains Without Anticipation [0.0] VLM-Safe-RLは凍ったCLIP信号をPPO-Lagrangianに統合するフレームワークである。
フォーミュラ1-L2分析では、CLIP信号が衝突を予想する証拠は見つからない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:07:53 GMT)
Verifying Graceful Degradation in a Distributed Malware-Detection System with SPIN [0.0] 本稿では,現代のマルウェア検出システムのエンドポイント決定パイプラインの形式モデルであるPromelaについて述べる。
私たちは、フォールバックマシンが偽陽性を引き起こすことは決してなく、スキャン毎に正確に1つの評決にコミットし、常に強制的な決定で終了するということを証明しています。
この研究は、製品セキュリティシステムの障害処理ロジックに対して、モデルチェックが強い正当性を保証する方法を示している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:56:10 GMT)
Unknown is not normal: separating language-model extraction from rule-based decision logic for clinical risk scores [0.0] 大規模言語モデル(LLM)は、フリーテキストノートから臨床リスクスコアを計算するために、ますます使われてきている。
決定論理から三状態抽出を分離することで、システムは決定を変えることができる質問のみを問うことができるかどうかを検証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:48:17 GMT)
Trotterisation Thresholds and Dissipative Quantum Chaos in Open-System Digital Quantum Simulation [0.0] デジタル量子シミュレーション(DQS)は、量子コンピューティングの最も有望な応用の1つである。
トロタライズステップサイズは、一定のしきい値を超えては増加できない。
散逸性量子カオス(英: Dissipative quantum chaos)は、散逸が基礎となるユニタリ量子カオスの存在とバランスをとるときに生じる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:45:22 GMT)
Tracekit: Tamper-Evident Intent-Reasoning-Action Auditing for Autonomous Coding Agents [0.0] Tracekitは、各エージェントセッションの3つのチャンネルをキャプチャする。人間の質問(インテント)、推論のモデルが何を言ったか(自己報告)、実際に実行されたか(アクション)。
Claude Codeのライフサイクルイベントにフックし、マルチエージェント階層の再構築、事前実行ポリシによるゲートツールコール、SDKまたはHTTP API経由で他のエージェントからのイベントの受け入れ、ブラウザ内の台帳を再検証するライブオブザーバのレンダリングを行う。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:22:04 GMT)
Topological Band Theory for High-Dimensional Parameter Spaces [0.0] 外部ゲージポテンシャルの断熱流束パラメータが高次元多様体を形成する量子ホール系のトポロジカルバンド理論について検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:02 GMT)
Thinking Outside the Box: Retention and Transmission of Information in Sliding-Window KV Inference [0.0] KV推論は、最近のキーと値状態の固定サイズのキャッシュのみを保持しながら、シーケンスを漸進的に処理することを指す。
本研究では,Qwen,Llama,Mistral,Muse Glimmerの5つのオープンウェイトモデルを用いて実験を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:18:20 GMT)
The equivalence of topological indices for $\mathrm{U}(1)\rtimes\mathbb{Z}_2$-symmetric quantum spin chains [0.0] オガタの作用素-代数指標は、連続対称性を必要としない幅広い対称性クラスに適用できる。
オンサイト$mathrmU(1)rtimesmathbbZ$対称性を持つ整数スピン鎖の共通設定におけるそれらの同値性を証明する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:58:43 GMT)
The Construction of an Empirical Dataset of Incomplete Software Changes from Open Source Projects [0.0] オープンソースソフトウェア群から不完全な変更をマイニングしてデータセットを構築する。
この構築されたデータセットを用いて不完全な変更の特性を分析し、欠落した変更の89.4%が5つ以上のファイルを含むことがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:58:45 GMT)
The Compiler May Read It, the Agent May Not: Keeping Part of a Research Code Away from a Coding Agent [0.0] コンパイラは、物理ベースのソルバが構築できないモジュールを読まなければならない。
我々は、コンテナ、許可規則、サンドボックスに対して15の読み取りルートを分類した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:27:41 GMT)
The Argument and the Letterhead: Source-Position Coherence in AI Evaluation [0.0] 予備登録された2つの研究と、後のJevのサプリメントは、米国のAI政策、ドイツの債務ブレーキ、スイスの核エネルギーに関する6つの固定されたテキストについて、2,976個の有用な評価を収集した。
本論文は, 制御された比較によってこの推論を開発し, 付録中の条件付きポストホックp値を報告し, 人間の判断とAIによる研究の背後にある委譲チェックを文書化する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:34:23 GMT)
TEE Anchor: Cross-TEE Organizational Endorsement for Mitigating TEE Physical Attacks [0.0] TEEアンカーは、どの組織がマシンを管理するかを証明することで物理的な攻撃を緩和する。
TEE Anchorは軽量なX.509ベースの設計で、(v)TPMのような追加の信頼源を必要としない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:28:28 GMT)
Sustained Participation as a Security Resource: The Bounded Participation Channel [0.0] 窓による参加窓の検証を繰り返すプリミティブであるBPC(Bunded Participation Channel)を導入する。
BPCは厳格な期限下で新しい、アイデンティティバウンドな課題を発行し、アイデンティティバインディング、フレッシュネス、リアルタイム応答、チャンネル毎のスループットのバウンドという4つの構造特性を強制する。
GPT-4o, Gemini 2.5 Flash, Claude Sonnet 4.5を600回の試験で評価した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:40:49 GMT)
Student Perceptions of Tablet-Based Teaching and Learning in TNE Undergraduate Mathematics [0.0] タブレットベースの教育と学習は、大学数学科ではますます一般的になっている。
本稿では,応用科学の学位課程における数学講座に通う大学生の小規模調査の結果を報告する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:45:02 GMT)
SeLMRoute: Probabilistic Semantic Evidence for Large Language Model Routing [0.0] SeLMRouteは、候補に依存しないセマンティックエビデンスの抽出と、候補性能の学習を分離するルーティングフレームワークである。
LLMBench (15データセット、20の候補モデル、11,481のクエリ)では、SeLMRouteの平均精度は72.08% pm 0.45$である。
この表現は、評価された意味、密度、語彙、およびドメインレベルの表現の中で最も高い平均性能を達成する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:31:45 GMT)
SAGE: Symbolic Action-Gating and Editing for LLM Task Planners [0.0] SAGE(Symbolic Action-Gating and Editing)は,2つの軽量メカニズムから構築された単一LLMプランナである。
ドメインに依存しないシンボルゲートは、実行時安全モニタとしてタイプされた理由により、事前条件違反行為をブロックする。
ローカルな編集は失敗したサブゴールの接尾辞のみを再生し、完了し、未修正の作業をそのまま維持する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:17:55 GMT)
Robust to Which Model Change? A Unified Evaluation of Robust Counterfactual Explanations [0.0] 我々は,同じ8種類のモデル変更に対して,すべてのメソッドをテストしながら,実例と生成した反ファクトを固定した一貫したクロスファミリー評価プロトコルを提案する。
相対的なパフォーマンスと障害モードは、変化家族によって異なります。
我々は、ロバストなCFE手法は、モデル変更を特定し、その実現された行動規模を測定し、ロバスト性とは別個の生成性能を維持する共通のプロトコルを通じて評価されるべきであると主張する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:00:41 GMT)
Reference-Tail Trust:Certified Probability Floors for Learned Updates Inside a Deployed Network [0.0] グラフニューラルネットワーク(GNN)は、すでにデプロイに信頼されている予測を放棄することなく、改善されたメッセージパッシングを活用する必要がある。
我々は、凍結したGNN内で学習した更新を認め、実際に提供された予測を認証するフレームワークであるReference-Tail Trust (RTT)を紹介した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:09:29 GMT)
Recursive LLM Degradation in Biomedical Question Answering: A Cross-Generation Study [0.0] 言語モデルを自分自身が生成したデータで繰り返しトレーニングすることで、合成データフィードバックループが生成される可能性がある。
本稿では,PubMedQA と Qwen2.5 モデルサイズ 0.5B および 3B パラメータを用いたバイオメディカル質問応答 (QA) のプロセスについて検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:01:53 GMT)
Reclaiming the social in social media [0.0] 我々は,ソーシャル・コネクティビティを支える技術ではなく,アテンション・エコノミーにおけるその実践から,一般的にソーシャルメディアに起因する害が生ずると主張する。
我々は、注意をそらすだけでなく、構造的にも不可能なアーキテクチャを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:29:15 GMT)
RAGWarrant: Evidence-Preserving Governance for RAG Policy Promotion Under Quality, Cost, Latency, and Risk Constraints [0.0] RAGWarrantは、デプロイメントをリーダボードの選択ではなく、制約付きのエビデンス判断として扱う。
我々は,T2-RAGBench,MultiHop-RAG,CRAG,HotpotQA,合成再生,局所生成実験におけるフレームワークの評価を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:58:06 GMT)
Query Expansion and Key Specialization in Transformer Attention Geometry [0.0] 注意点に関しては、キーの縮小により、QKtop$のスペクトルがより狭くなり、より注目されるようになる。
本稿では,文字レベルWikiText-103上でのGPTライクな小型トランスフォーマーの学習を通して,この問題を考察する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:22:14 GMT)
Quantum Work Extraction via Conditional Spatial Displacements [0.0] Schemeはユニタリ演算子$U = exp(-i k t, hatH otimes hatP/hbar)$に依存し、電池のエネルギー固有状態と補助ポインタの位置との間の絡み合いを生成する。
その後のポインター位置の投影測定は、作業が抽出可能な純粋な状態で電池を条件付きで準備する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:00:35 GMT)
Quantum Estimation under Decoherence in Neutrino Oscillations: Quantum Resources, Flavor Accessibility, and Multiparameter Incompatibility [0.0] ニュートリノ振動は、開系力学、量子資源、パラメータ推定のための干渉計設定を提供する。
拡散ベーシス・デファスティングとフレーバーモード・デファスティングの2つの統計ファミリを区別した。
単色3色ベンチマークでは、DUNE様、T2HK様、ESSnuSB様の点において、混合状態QFIM、フレーバーFIM、SLD不適合性を$(_23,_rm CP,_31,g)$で評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:05:48 GMT)
Quantum Entanglement in Variational Quantum Classification for Breast Cancer Diagnosis [0.0] 本研究は、変異量子分類器(VQC)のエンタングル構造が乳癌診断におけるその性能とどのように関連しているかを考察する。
我々は,同じ効率のSU2アンサッツ,COBYLA,5倍のクロスバリデーションを持つ3つの3ビット構成を試験した。
AからCまでの平均エントロピーは0.40から0.71に上昇し、精度は92.98%から93.68%に上昇し、F1スコアは90.32%から91.28%に上昇した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:42:33 GMT)
Quantitative Measurement of Language Distance among Closely Related Indo-European Languages Using Pretrained Language Models: A Case Study on the North Germanic Branch [0.0] 本稿では,デンマーク語,ノルウェー語(Bokml),スウェーデン語(Bokml)の3つの北ゲルマン語に焦点を当て,事前訓練された言語モデルに基づく3次元定量的フレームワークを提案する。
タトエバコーパスから得られた150個の3言語並列文三重項を対照試料として, 2つの独立モデルにおける一貫した距離ランキングを得た。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:32:33 GMT)
ProtoSeam: Lifting Classifier Training with Latent Gaussian Mixture Models [0.0] リフトトレーニングは、共有チューニングプロトコルの下でリフトすることなく、変種に対して最大5ポイントのテスト精度を向上させる。
これらの結果を理論的に正当化する。
CIFAR-10、CIFAR-100、TinyImageNetにResNetとビジョントランスフォーマーのバックボーンが組み込まれている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:41:48 GMT)
Probabilistic electrical power demand forecasting with uncertainty quantification [0.0] 本研究は, 電力消費に関する4つの現代確率予測モデルを実証的に比較した。
実世界の電力システム関連データセットの比較を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:58:57 GMT)
Principled Thoughts for Latent Recursive LLM Systems [0.0] REST(Representation-Supervised Thoughts)は、有効な思考表現の4つのプロパティを差別化可能な損失に変換するトレーニング目標である。
エージェント設定とモデルサイズをまたいだCEのみのトレーニングよりも、最大7.5ポイントの精度向上と、最終回答の収束率の30%向上を実現している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:29:18 GMT)
Price Stability in the European Union: A Systemic Approach Using Random Matrix Theory [0.0] この研究は、ユーロ圏における毎月のインフレ指標の収集を検討し、その固有値の統計と特性を分析する。
その結果、システムはランダムに生成できないことが確認され、国レベルでの小さな変化と永続的な変動のため、データはノイズに支配されたパターンを示す。
複雑であるにもかかわらず、システムは自己組織化の観点から一定の安定性を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:13:53 GMT)
Predicting Delayed Train Trajectories on the Dutch Railway Network: Explainable AI Evaluation of Topological, Operational and Weather Features with Tree Based Ensemble Methods [0.0] この論文は、ネットワーク全体の鉄道遅延予測の時間的解析を提供する。
本研究は,オランダの鉄道網に着目し,解釈可能な木系アンサンブルを用いて,詳細な地形,環境,運用上の特徴を統合する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:13:59 GMT)
Pre-registered tests of solid-state-physics-inspired LLM compression: a cluster-level negative result at small-language-model scale [0.0] 訓練済み言語モデル上で5つの固体物理学にインスパイアされた圧縮マッピングをテストする3ヶ月の自律的リサーチエージェントプログラム。
4機のフェーズ3パイロットのうち3機が偽装された。
結果は、ほとんどの注意頭はコーンの目に見える絶縁体のように振る舞うという事前登録の予測を逆転させる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 04:38:14 GMT)
Near-Optimal Parallel Unitary Process Tomography in Diamond Distance [0.0] ユニタリプロセストモグラフィーは、機能する量子コンピュータを実現するための重要な手順である。
逐次回路アーキテクチャを用いて最適なクエリ複雑性を実現する方法が知られている。
並列回路を用いて, 問合せの複雑度に近い一元的プロセストモグラフィーが実際に可能であることを証明した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:00:20 GMT)
Native implementation of the machine-learned Skala exchange-correlation functional in CP2K: Unified one-centre reconstruction for molecular and condensed-phase calculations [0.0] CP2KにおけるSkala Exchange-correlation (XC) 関数は,Gaussian and plane-wave (GPW) とGaussian and augmented-plane-wave (GAPW) を用いて実装する。
XC固有のGAPW表現は、原子中心格子の局所的な寄与を急速に変化させる。
十分なフレキシブルな軌道ベースを持つと、初期のGauXCの分子ベンチマークの精度が保たれる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 00:26:04 GMT)
Nakayama's reduction of quantum topos and Bayesian quantum computing [0.0] 中山はドリンク・イシャム・トポス量子論の文脈を制限する方法を発見した。
本稿では,この統合がベイズ的視点をどのように支持するかを説明する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 03:11:24 GMT)
More Features Are Not More Evidence: Limits of Training-Free Human Activity Recognition with Jev [0.0] 汎用モデルは、タスク固有の分類器を訓練することなく、センサベースの決定を約束する。
これらのモデルが、訓練されたHARモデルを置き換えたり補完したりするのに十分な物理センサ信号の決定論的記述を解釈できるかどうかを検討する。
我々は3つの決定論的センサ表現を評価し、5,400のJev決定を生成ベースラインと3つの教師付きHARモデルと比較した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:26:05 GMT)
Mnemon: Raw Records, Fast Judgments, Slow Thoughts [0.0] メモリの作業は、考えるように、2つのシステムに分割する、と我々は主張する。
たいていは高速なシステム1の作業で、多くの小さな、独立したイエス/ノーのレコードに関する判断である。
この分割に基づいて構築されたメモリエージェントMnemonを提示する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:17:13 GMT)
Mathematics for and by human cognition: A resource-rational search for bottlenecks in problem-solving [0.0] 我々は、認知的制約が数学やそれ以上の進歩を促進する上で重要な役割を担っていると論じる。
認知的制約から生じるボットネックは、既存の知識を再構築する圧力を生み出す。
我々は、人間的な制約を取り入れることで、有用な数学的抽象化の発見が容易になると主張している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:25:00 GMT)
Low Frequency Gravitational Wave Detection with Gravito-Magnetism [0.0] 相対論的重力波は等等級の重力波と重力波を発生させる。
実験体のローレンツ加速度を用いた低周波重力波の重力-磁気成分の検出を提案する。
この測定により、3つの衛星星座の重力勾配ノイズから重力波信号の明瞭な抽出が可能であることが示されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:01 GMT)
Long-Term Operational Planning Using Scenario-Based System Load Forecasting [0.0] ハイパースケールデータセンターは北バージニアの電力需要を増大させている。
ドミニオン・エナジーはこの成長を支えるために送電網を強化する必要がある。
長期の停止研究は、月毎または季節毎のピーク負荷の仮定を用いて、日毎の実施が一般的である。
本稿では,現実的なマルチグラニュラ負荷予測を長期的障害評価に組み込むことの運用価値を評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:21:54 GMT)
Live Architecture Models for Cloud-Native Architecture-as-Code: Early Results from Kubernetes Conformance Checking [0.0] インフラストラクチャドリフトは、実行中のランタイムシステムを、ドキュメント化されたアーキテクチャ意図から分離することができる。
本稿では,選択された事実に関連付けられた編集可能な表現を,明示的な対応と反復的な適合性チェックを通じて,ライブアーキテクチャモデルについて検討する。
このアプローチは、KDL(Deployment Language)のArcher固有のサブセットと、テキストビューを備えたVS CodeプロトタイプであるArcherを通じてインスタンス化される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:21:42 GMT)
Large Language Models for Automated Cross-Domain Machine Learning Task Type Identification: A Benchmark Dataset and Evaluation [0.0] 大規模言語モデル(LLM)は、データセットレベルの情報から直接、データドメインと下流予測タスクの両方を推論することができる。
提案手法は,より小さなローカルモデルを用いた実践的な展開シナリオを含む,3つの設定で評価する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:55:59 GMT)
Language Models Act on Hidden Valence [0.0] 言語モデルは、いくつかの内部状態が良いと表現し、他の状態は悪いと表現する。
しかし、モデルに利害関係があるかどうかは明らかな疑問だ。
我々はアクティベーションステアリングを用いて2つの無意味な「ゾーン」のうちの1つに正あるいは負のアクティベーションパターンを付加する。
ステアリングによって各ゾーンについて記述するパスモデルが変化し、これらの単語は後で選択される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:43:34 GMT)
LQR-ArUco Fusion: Robust Hierarchical Control for Navigation and Asymmetric Manipulation in Two-Wheeled Robots [0.0] 本稿では,重度の動的不安定性と航法的ドリフトに対処する階層型制御フレームワークを提案する。
サイドマウントされたロボットアームは、ペイロードが持ち上げられたときに片側ロールモーメントを導入します。
オフボード視覚システムは、ArUcoマーカーのオーバーヘッドを追跡し、高アクチュエータなグローバルなウェイポイントナビゲーションを提供する。
低レイテンシオンボード制御ループは、慣性およびエンコーダデータを用いて、アクティブな物理障害を拒否する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:41:14 GMT)
Jev thinks "I don't know'', but doesn't say it: Introducing Sys1Cal-v1 Dataset for Probability Calibration [0.0] Jevのスコアとチョイスの解答の校正について検討する。
特に、Jevが第三の真理値を抑制すると仮定して説明できる特異な振る舞いを発見する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:59:07 GMT)
Introducing the CZAR Loss: A Tailored Objective Function for Financial Log-Return Predictions [0.0] 定量的ファイナンスでは、標準回帰損失はリターン予測の経済と不一致である。
CZAR(Zero-Agnostic Return)損失関数を導入する。
CZARで訓練されたモデルでは、ゼロリターンバイアスが低減され、大振幅リターンの方向精度が向上する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:18:06 GMT)
Independent density and coherence skin effects in adaptive fermion circuits [0.0] フェミオン回路は独立に調整可能な密度とコヒーレンス皮膚効果を有することを示す。
アンサンブル平均オブザーバブルを用いた相関器比プローブを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:01:02 GMT)
Improving the Stability of the Hierarchical Equations of Motion for Open Quantum Systems with Strong Coupling to Structured Bosonic Baths [0.0] 階層の有限トランケーションがボソニック環境の基本的な数値カル不安定性に繋がることを示した。
非単位類似性変換を適用し、これらの項を階層化と階層化のバランスの取れた組み合わせに変換する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:58:15 GMT)
Improving disruptive research in the EU: why strengthening European Research Council grants alone is not enough [0.0] EUにおける破壊的なイノベーションは十分な競争力を持っていない。
この弱点は、市民が当然受ける社会的利益を危険にさらす。
EUは米国や中国と競合するほど遠くない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:39:00 GMT)
Impact of Patient Orientation in Single- and Multi-View Camera Environments for AI-based Rehabilitation Monitoring [0.0] 本稿では,広範囲のカメラアングルから取得した正確なリハビリテーション演習のデータセットであるREHAB26-Viewsを紹介する。
様々なカメラ配置下での運動品質評価に,RGBを用いた姿勢推定がいかに適しているかを解析した。
得られた結果から, 最適配置の2Dカメラは, 普通に使用される$0circ$前景よりも16.9.%の分離性を向上できることがわかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:50:26 GMT)
Illusory Truth or Mere Exposure? Model-Dependent Repetition Effects in LLM-Based Social Media Simulations [0.0] ITEがソーシャルメディアシミュレーションの文脈で4つのLDMにまたがってどのように現れるかを検討する。
私たちは、100のステートメント、10のフィード変種、3のレプリケーションで336,000の真実、重要度、感情、利子評価を集めています。
Gemma-3 は真の ITE を示し,Qwen2.5 は単なる露光効果を示し,GPT-5-nano は真実と軽度懐疑論の繰り返しに対する反復効果を示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:09:47 GMT)
HyperDAM: Hyperspectral Distractor-Aware Memory with Amodal Expansion for SAM 3 Tracking [0.0] HyperDAMは、DAM4SAM3ベースのハイパースペクトルトラッカーで、3つの主要な貢献がある。
フレームゼロ校正されたHSIゲートは、イントラクタ解決メモリに対するスペクトル的に一貫性のない更新を拒否する。
因果的ビデオ材料展開器は、凍ったSAM特徴から外向きのみのアモーダル補正を追加する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:09:33 GMT)
How to break the Miranda signature scheme over matrix Gabidulin codes [0.0] ミランダ署名スキームは、マスクされた基盤構造を処分する行列符号をマスキングすることに依存する。
行列コードに拡張されるガビデュリン符号は、Fq-リニアにのみ適用される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:15:35 GMT)
How fast can a parent estimate the value of their children? A quantum algorithm for stochastic games [0.0] 2ドルのゲームに量子アルゴリズムを与える。
アルゴリズムは、ゲームの値をルート平均2乗誤差$に推定し、[O!left(KD, degfracD4, fracN, D4D logleft( fracdeg N right), qquad D = 2m ] クエリを葉の値に変換する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:06:44 GMT)
How Language Models Differ in Redistributing Attention-Head Activity Under Serial Demand [0.0] モデルが各レイヤのアテンションヘッド上でアクティビティを分散する方法は、ディープを通して情報をルーティングする方法の粗いビューを提供する。
ほとんどのモデルでは、奥行きの直前のレイヤがアクティビティに集中し、後のレイヤがそれを拡散します。
上位の頭に集中しているモデルも、その答えの頭に依存している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:19:21 GMT)
Hidden Activations are not Enough I: Knowledge Matrices as Higher Representations [0.0] トレーニングされたフィードフォワードネットワークの知識行列を,その入力の高次表現として検討する。
固定形状は、ResNet-152、DenseNet-121、GoogLeNet間のアライメントフリーのサンプル間距離を与える。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:43:30 GMT)
Heuristic lower bounds on real Grothendieck constants of finite and infinite order [0.0] 実グロタンディーク定数の候補下界は$K_mathrm G(d)$である。
我々は、このしきい値において半球戦略が地球規模で最適であると推測する。
大規模シーソー最適化は連続予測をサポートする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:23:05 GMT)
Hardware-Aware Functional Kolmogorov-Arnold Networks for Efficient Medical Image Enhancement and Segmentation [0.0] 本稿では、FunKANの2段階ハードウェア対応圧縮であるFunKANLiteについて紹介する。
FunKANLite-TRは空間的先行値を低減し、ResBlockオフセット予測器を深さ方向に分離可能なブロックに置き換える。
FunKANLite-STはFunKANよりもパラメータが5.6倍、GFLOPが3.7倍少ない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:08:15 GMT)
HPMD: A Historical Persian Manuscript Dataset for Word Spotting with Line-Level Annotation [0.0] 223ページ,3,678行,37,631語,130,630文字の新しいデータセットを導入し,ペルシャの詩文と散文の多様な歴史書から収集した。
微調整線検出器はテキスト線を見つけ、CTCで訓練された微調整CRNN認識器は各行に対してフレーム・バイ・キャラクタの後方行列を生成する。
テストセットでは、微調整線検出器が0.892のF1に達し、後部探索により単語スポッティングF1が0.487から0.558に上昇する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 07:41:15 GMT)
Group dynamics of engagement with AI topics on Bluesky [0.0] 実験的なBlueskyアクティビティを異なるユーザグループに収集するフレームワークを開発し,ネットワークベースのダイナミックスモデルを用いて,それらのエンゲージメントのメカニズムを解明する。
イベントに対する強い直接的な反応は、必ずしも強いネットワーク駆動の伝播と一致せず、集約されたアクティビティだけで隠蔽される可能性のある、異なるエンゲージメントパターンを明らかにする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:33 GMT)
Geometric Representations of African Languages: A Regional Semantic Hub and Cultural Steering [0.0] Gemma 4 31Bはアフリカの言語を表現し,文化的なステアリングに反応する。
最初の研究では、プローブ、コントラスト方向、および表現類似性の尺度を用いて、9つのアフリカの言語と3つのコントロールを比較した。
2つ目の研究は、ナイジェリア、ガーナ、ケニア、南アフリカへの道順を構築するために、別々の英語データを用いている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:03:18 GMT)
FromPitch2Board: Benchmarking LLM Agents in Long-Horizon Football Management [0.0] ロングホライゾンエージェントベンチマークは通常、エージェントがどれくらい進歩するかを報告するが、そのパフォーマンスが基礎モデル、足場、責任範囲、マッチ制御の粒度、地平線から来ているかどうかを特定できない。
FromPitch2Boardは,1つのシミュレータ上で,ペアシードと凍結キャリブレーションを用いて,制御された比較によって5つの要因を研究する決定論的フットボール管理ベンチマークである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:22:33 GMT)
From internal representations to model improvement through prediction errors [0.0] 内部機能と予測エラーとパフォーマンスへの影響をリンクします。
本手法は2つのデータセットと2組のランダムシードに対してオブジェクト検出器を用いて評価する。
これらの結果は、モデルの内部特徴とエラーと、その性能への影響をリンクさせることで、パフォーマンスを向上させるトレーニングイメージを選択するのに役立つことを示唆している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:43:19 GMT)
From Quantum to Classical Dissipative Spin Dynamics [0.0] 最近提案された量子アナログである量子ランダウ・リフシッツ・ギルベルト方程式は、この枠組みを量子スピン系に拡張している。
QLLG方程式の古典的大スピン極限としてLLG方程式を導出することにより、この接続を実証する。
結果は、散逸スピン力学の量子-古典的記述を提供し、LLG方程式の顕微鏡的基礎を提供する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:15:15 GMT)
From Projected Subspaces to Full-Space Implementations: Representation-Equivalence Audits for Open-Shell ADAPT-VQE [0.0] ADAPTは1.5719 m$E_h$で121の演算子を持つ。
ADAPTは1.5719 m$E_h$で121の演算子を持つ。
同じ121個の親ジェネレータをハード制約の下で同じ順序で再最適化すると、$p_Dge0.999$は最高の収束エラーを8.482 m$E_h$に削減する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:17:59 GMT)
From Human Narrative to Harmonic Structure: A Human-Centered Investigation of Algorithmic Music Generation through the Chord Wheel Diagram [0.0] 本研究は,ボブ・ディラン,ジョニー・キャッシュ,リッチー・ヴァレンスの6曲について検討した。
調波語彙,機能持続性,繰り返し,非調波事象,および調波図とBPMNに基づく表現を用いた緊張分解パターンについて検討する。
この結果から, 生成システムは調和的正当性だけでなく, 構造的同一性, 文脈, 人間の構成意図もモデル化できる可能性が示唆された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:31:34 GMT)
Forecast-Necessary Causal Discovery for Nonlinear Political Panel Data: Feedback, Functional Form, and the Dynamics of Democratization [0.0] 政治パネルデータのための推論ワークフローを開発する。
本稿では,113カ国のV-Demパネルにおける民主化の因果関係モデルに適用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:53:12 GMT)
Fewer Assumptions by Design: A Reusable Skill for LLM-Assisted Verus Verification [0.0] 慎重に設計された検証技術を備えたLLMエージェントは,VerusのDLLに対して,強力かつ低信頼な仕様を作成可能であることを示す。
慎重に設計された検証技術を備えたLLMエージェントは,VerusのDLLに対して,強力かつ低信頼な仕様を作成可能であることを示す。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:58:41 GMT)
Exact probability distributions of complex spacing ratios in non-Hermitian random matrices [0.0] 複素スペーシング比は、基準固有値から隣接する隣人への変位を、対応する変位から隣人への変位で割ったものである。
ここでは、非エルミート確率行列のガウスアンサンブルに対する有限$N$複素空間比分布を導出する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:10:13 GMT)
Environmental requirements for the use of social information by artificial life agents using evolved plastic artificial neural networks [0.0] EPANNは、第一のプロセス、進化のプロセス、第二のプロセス、発達と生涯学習の2つのプロセスから構成される。
EPANN要求に基づくALIFEモデルは、社会的=学習の起源を研究するために使用できる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:18:02 GMT)
Entanglement spectrum and magic in higher-dimensional free fermionic systems [0.0] 高次元自由フェルミオン系におけるフェルミオン非局所魔法について検討する。
エンタングルメント-温度変形は、ハミルトニアンの低エネルギー構造をプローブすることを示す。
準粒子記述を高次元クエンチにおけるフェルミオン非局所魔法に拡張する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:17 GMT)
Electron decoherence in cylindrical holes and circular apertures [0.0] 2つの標準測地における高速電子デコヒーレンスの理論を発展させる。
薄肉完全導電膜に現実的な金属と円孔を貫通する円筒状の穴について検討した。
十分に大きな穴をあけると、デコヒーレンスは集束された電子プローブの空間的拡張を支配できる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:02:58 GMT)
Efficient Simulation of Hybrid Continuous- and Discrete-Variable Quantum Circuits via Gaussian Decompositions [0.0] 離散可変(DV)と連続可変(CV)サブシステムを組み合わせたハイブリッド量子システムは、幅広い物理プラットフォームにまたがる。
本稿では,Gaussian(LCoG)分解の線形結合に基づくCV-DVハイブリッドシステムのシミュレーションフレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:00:58 GMT)
DynaTokens: Teaching Dynamics to Camera-Controlled Video Models at Test Time [0.0] 学習可能なシーン固有のトークンの軽量なセットであるDynaTokensを紹介します。
この手法は2つの運動源間の単純な非対称性によって動機付けられる。
DynaTokensは、VBench2とWorldScoreの評価において、より優れた同時ダイナミックスカメラトレードオフを実現する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:42:57 GMT)
Discontinuity of Continuum Fermion Dynamics [0.0] ペアポテンシャルを介して相互作用する$IRd$における連続体フェルミオンのハイゼンベルク動力学を研究する。
多数の非定常対ポテンシャルに対して、ゲージ不変な CAR 代数でさえ、力学が点-ノルム連続であることは証明できない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:15:26 GMT)
Directional pumping of a two-level system by a fluctuation-regulated quantum source [0.0] 我々は、励起源が量子サブシステムとして保持されているときに方向性が現れることを示す。
指数関数的に減衰するソース相関について、ポンピング速度は相関時間によって支配されるローレンツのデチューニング依存を示す。
熱緩和の存在下では、定常励起状態の個体群は共鳴的に駆動される光ブロック限界を超えることができる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:58:39 GMT)
Deep Learning Methods in Neuroscience: From Modeling Molecular Mechanisms to Classifying States of Consciousness [0.0] 本研究は, 麻酔下の脳状態の分類, クラスタリング, モデリング, 脳機能の計測可能な神経生物学的特性の同定に焦点をあてる。
脳波とfMRIデータに基づくニューラルネットワークによる意識状態の自動検出、麻酔効果による脳の構造-機能的ダイナミクスのモデル化、の3つの主要領域で比較分析を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:12:25 GMT)
DGF-Bench: A Benchmark for Simulating and Auditing Deception Against Multi-Agent Governance Boards [0.0] DGF-Benchは、エージェントの委員会が合成ドシエをレビューするベンチマークであり、攻撃者は組織が欲しがらない証拠にコンテンツを配置する。
DGFのスコアは96.2から26.9までで、ポリシー対応のアダプティブアタックが6つのモデルのうち5つに対して成功している。
オープンソースのパッケージdgf-benchは、DGFスコアを1つのコマンドで計算する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:14:46 GMT)
Cubic Phase Gate with a Trapped Ion Oscillator [0.0] 捕捉されたイオンの運動モードは、連続変数量子計算の候補として有望である。
我々は,立方相ゲートを近似するプロトコルを実験的に実証した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:50:48 GMT)
Correlation measure for statistical systems [0.0] 平衡系の相関指標は、ボース=アインシュタイン凝縮系、超伝導系、スピン系において例示される。
非平衡系の相関指標はスピン系と擬スピン系の非線形力学に対して考慮される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:48:31 GMT)
Concept Direction Reliability Across Languages with Different Tokenizer Fertility [0.0] 原文と翻訳文の両方を用いて,英語,ハウサ語,ヨルバ語の分割半一致を計測した。
英語では0.737から0.870、ハウサでは0.589から0.762、ヨルバでは0.101から0.399である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:57:20 GMT)
Compact Force Sensor for Dual-UAV Cable-Suspended Payload Transport with Tension-Aware Outer-Loop Control [0.0] 複数の無人航空機(UAV)を用いた共同ペイロード輸送は、安定性、協調性、堅牢性に課題をもたらす。
本研究は、UAVケーブルアンカーポイントにおける相互作用力を測定する小型でカスタム設計の力センサによって支援されるデュアルUAVペイロード輸送フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:54:27 GMT)
Commutator Memory: Sparse, Path-Local Reading and Steering in Language Models [0.0] 2つのデータソースで言語モデルをトレーニングすることは、同じデータと全露出であっても、異なる重みを与えます。
この経路依存がパラメトリックトレーニング履歴記憶を残しているかどうかを問う。
我々は,ブラケットをロケットを通して1語彙のトークンに投影することで,演算子メモリを定義する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:23:25 GMT)
Commitment Hierarchies under Intent Revision: A Belief-Revision Account of Salvage in Tool-Use Agents [0.0] 救世主の品質はモデル能力よりも役割設計の問題であることを示す。
ノードのローカルビューのみを観察するポリシーは安全かつコストが最適であることを示す。
3つの環境にわたって、ポリシーは達成可能な全貯蓄を回復し、再起動よりも43%安く、100%の正確さで回復する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 06:23:25 GMT)
Cheap and Powerful Tests for Supervised Subspaces: Per-Component Inference for PLS [0.0] 我々は、教師付き部分空間のホールドアウトORS修正に対する推論を減らす。
我々は,合成測地,2つのNIRケミカルデータセット,言語間単語埋め込み回帰について検証した。
提案された試験はCV-permutation-Q2よりも高出力であり、そのコストのごく一部である。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:42:15 GMT)
Characterizing quantum precision enhancement for multiple currents in open quantum systems [0.0] 運動的不確実性関係(KUR)は、古典的非平衡系の個々の電流の変動を制約する。
相関電流変動がこの古典的極限を超える量子デバイスを特定するために、我々の理論を適用する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:00:03 GMT)
Cavity magnonics and bound states in the continuum with Bragg and anti-Bragg mirrors [0.0] 1次元導波管に結合された周期共振エミッタアレイをミラーとして動作させることができる。
そのような2つの鏡は連続体(BIC)の有界状態をホストする空洞を形成する
ここでは、2つの周期的強磁性体球配列と2重開導波路構造におけるプローブ球を用いた空洞磁気学におけるBICの実証実験を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 05:41:30 GMT)
Calibrated to Whom? Persona and Language Effects on Cultural Values in JEV [0.0] 決定のみの言語モデルは、テキストを生成する代わりに、すべての回答オプションの確率を返す。
このようなモデルであるTypeSafeのJEVの文化的価値を,バリューサーベイモジュール2013で監査する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 23:53:31 GMT)
CADENCE: A Confidence-Adaptive Dual-Expert Network for Fast and Accurate Time Series Classification [0.0] CADENCEは、時系列分類のためのCPUネイティブなデュアルエキスパートアーキテクチャである。
109の同じ長さのUCCアーカイブデータセットに対して0.8864の精度を実現している。
HIVE-COTE 2.0の差を0.31ポイントまで縮め、データセットあたり平均17.53秒しか取らない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:05:10 GMT)
Bivariate Bicycle Codes over Group Algebras [0.0] 1つの二進シフトは右乗法で作用し、もう1つは左積で作用する。
D_3$の場合、一対の重み付き置換シフトは通常の$C_6times C_12$アクションを生成する。
また、コンピュータで検証された[144,16,12$ code over $A_4times C_6$, with every check of weight 8。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 20:10:05 GMT)
Beyond One Epoch: Uncertainty-Weighted Sensitivity Regularization for Recommendation Models [0.0] 疎密な埋め込みと共有消費者による勧告モデルは、しばしば一つのエポックな現象を示す。
前提原則に違反した見解を提示する。
このミスマッチに対処するために、不確実性重み付き感度正則化を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 01:20:02 GMT)
Beyond Gradient Flow: Identifiability and Recovery from Distribution Snapshots [0.0] フォッカー・プランク方程式は、そのスコア重み付き発散によってのみ、ドリフト$F$を制約する。
タイムインデックスによる輸送の定式化は、この曖昧さを解決できない。
重み付けされたスコア重み付き発散演算子のカーネルを、ソース制約で特定できることが示される。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:53:28 GMT)
Beneath the Tokens: A Performance Engineering Study of Multi-Token Prediction in GPU-Accelerated LLM Inference [0.0] 本研究では,NVIDIA A10G GPU上での単一要求の制御において,自動回帰復号化に対するMTP( two-token multi-token prediction)を評価する。
360-requestベンチマークでは、平文、推論集約、ツールコールのワークロードがカバーされ、ランタイムテレメトリ、Nsight Systems、PyTorch Profiler、選択されたNsight Compute測定が観察されたパフォーマンスを説明するために使用された。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 13:49:34 GMT)
Automated feature engineering, AutoML, and decision-focused learning for improved energy consumption forecasting [0.0] この論文は、エネルギー消費予測のための包括的な機能エンジニアリングパイプラインを確立し、評価する。
第2にAutoEnergyは、タイムスタンプから解釈可能な機能を生成し、タグ付けされた消費を生成する、ドメインに適した自動FEアルゴリズムである。
第3に、AutoEnergyは電池蓄電池システム問題にDFL(Decision-Focused Learning)と統合されている。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 12:14:33 GMT)
Automated Species Identification in Camera Trap Images for Wildlife Conservation [0.0] この論文は、制限に対処するための自己注意機構を統合する、新しいエンドツーエンドフレームワークを提示している。
提案アーキテクチャは、より高速なRCNN検出ネットワークに統合されたSwin-BiFPNバックボーンと、LLaVA v1.5 (13B)マルチモーダル大言語モデルによって駆動される視覚的意味抽出モジュールを含む。
このフレームワークは、低コントラストトラップ画像と小動物間の検出精度を改善し、ゼロショット検出能力を実証する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:30:32 GMT)
Audit the Scaffold, Not the Checkpoint: A Stationarity Dichotomy for Recursive Self-Improvement in Agentic Coding [0.0] 私たちの基準では、通常、固定クラス内の検索、天井自体を上昇させるテストタイムトレーニング、足場書き換えという3つのレギュレーションを分離しています。
30人の家族労働者では、失敗の重複は最大で、大多数は23/55(42%)のタスクで失敗する。
丸ごとの改善はSWEベンチでゼロに崩壊し、チャーンは401回の生産セッションで幾何的に崩壊する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:25:52 GMT)
Assay: Claims That Decay With the Code. Content-Addressed Evidence Graphs for Accountable AI-Assisted Software Delivery [0.0] 我々はAIコーディングエージェントのための依存性のないツールを開発した。
エージェントが行うすべてのクレーム(テストはパスせず、シークレットも保存されない)は、それがカバーするコードの依存性コーンのMerkleハッシュに結びついています。
我々は、結合は音で最小限であり、変化の爆発半径は、それが無効化する主張の集合であることを示した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:40:35 GMT)
Argus: Academic Integrity in the Era of Generative AI [0.0] 本稿では,大学生のCプログラム課題におけるLLM支援学生作業の自動検出システムであるArgusについて述べる。
パーデュー大学の大規模CS2コースで6年間の春学期給付のデータを定量化し分析した。
自動検出システムには、人間のレビューのための構造化プロセスが伴わなければならない、と我々は主張する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 18:22:55 GMT)
Applying Language Models in medical Medicine: Recent Trends and Perspectives [0.0] 大規模言語モデル(LLM)の出現は、医療におけるAIの適用に関する議論を拡大した。
LLMの医療環境への統合は、医療環境における信頼性、正確性、透明性、安全性、適切な役割に関する重要な疑問を提起する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:53:51 GMT)
Analytical and Convolutional Neural Network-Based Motion-Vector Propagation for Efficient Video Object Detection [0.0] 連続ビデオ分析は、組み込み電力予算内での低レイテンシでの正確なローカライゼーションを必要とする。
本稿では,検出器呼び出し間の移動ベクトルを再利用するハードウェア・ソフトウェア設計手法を提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:24:42 GMT)
Analysis of asymmetric errors in NISQ experiments [0.0] 実験とシミュレーションから得られたデータに対して、先行研究を拡張して補完し、非対称な読み出し誤差を分析する。
Googleの実験データでは,このゲート誤差の影響は見られず,12le n le 53$,12le n le 53$,0と0の差は,報告された読み出し誤差の非対称性のみを反映している。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 16:18:45 GMT)
Analog Computing revisited: A fully analog and minimalistic Damage Detector for Ultrasonic Testing enabling Material-Integrated Structural Health Monitoring [0.0] 我々は,完全アナログ信号処理と特徴抽出システムについて検討し,実演する。
この研究の焦点は、信号エンベロープとアナログ特徴抽出のアナログ計算と損傷の予測である。
円形欠陥を有する鋼板のPZTトランスデューサ信号を用いて損傷検出システムをテストする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:56:01 GMT)
Almost Human, Except When It Matters: VoxParity and the Decisions a Voice Should Change [0.0] 14のセクターから183のシナリオでは、音声が変化する間、1つの書き起こしが固定される。
単語のみのnullテストは、単語のみを読み込むパイプラインを移動させるよりも、呼び出しがアクションを動かすのを聞いた場合にのみ、システムを信用する。
書き起こしパスでも実行できる23のシステムのうち11つしかありません。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:26:06 GMT)
Agentic Federated Learning: Rule-Based Client and Server Agents for Adaptive Training [0.0] Federated Learning (FL)は、生データを共有せずに、分散クライアント間で協調的なモデルトレーニングを可能にする。
本稿では,クライアントレベルとサーバレベルで軽量なルールベース自律エージェントを統合するエージェントフェデレーション学習フレームワークを提案する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 09:05:59 GMT)
After the Award: The Authorization Gap in Academic Access to Frontier AI [0.0] 学術アクセスプログラムは、フロンティア人工知能を研究基盤として配布するが、賞と機関の認可は異なる段階である。
2026年9月19日に取得した15の公開アクセスパスの構造化符号化によるハンドオフについて検討した。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 21:39:04 GMT)
Accessible, but Not Adopted: Increasing LLM Adoption among First-generation, Low-income (FGLI) College Students beyond Expanding Access [0.0] 大規模言語モデル(LLM)は、保存されていないコミュニティに力を与える力としてますます位置づけられている。
本稿では,第1世代低所得学生コミュニティにおけるアクセス適応ギャップについて検討する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:00:34 GMT)
Accelerator Choice Is Not Enough: AlphaFold2 Inference on Cloud TPUs [0.0] Colab CPUランタイム、NVIDIA T4 GPU、専用8チップのCloud TPU v5eスライスで1つのAlphaFold2推論ワークロードを実行しています。
TPUのハードウェア上の大きな利点は、T4の13.1秒に対して1回の呼び出しで0.47秒の安定した状態にあることにある。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 10:17:25 GMT)
AX is the New AEO [0.0] 私たちは37,927人のエージェント・トラベルを実行し、それぞれの購入者がビジネスについて疑問を呈し、4つの独立したハーネスを1,056以上のリアルビジネスでカバーしています。
エージェント対応のビジネスでは、自身のページから回答が作成されており、その78%が56%に対して、明らかに1.9倍の頻度で推奨されている。
ウェブ構築の回答は3.7倍になり、買い手が要求した事実は含まれない。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 11:41:13 GMT)
AI Agent Swarms as Researchers: Progress, Challenges, and Open Questions [0.0] 私たちは、市販のコーディングエージェントの群れに、スコープの短いステートメントを与えました。
数週間のうちに、エージェントは研究ノート、紙の長さの草稿、公式な証明を制作した。
これまでのところ、大きな科学的誤りは見つからなかった。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:47:30 GMT)
AGILE-GS: Anchor-Guided Fast Next-Best-View Selection for Active 3D Gaussian Splatting [0.0] 我々はこの2つを分離するアンカー誘導型NBV法AGILE-GSを提案する。
AGILE-GSは、最初のビューを次のビューとするため、Fisher情報はどの候補に対しても計算されない。
AGILE-GS+は各ショートリストビューのフィッシャー情報ゲインを計算し、ベストを選択する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 02:53:40 GMT)
A technological capability scale for civilizations from the Kardashev and Barrow scales [0.0] 人間性は、$K = 0.73$で、CMOS論理ゲートをプライマリエネルギーで$B = -0.78$で計算する。
最終的な技術は7.58ドル(約7,800円)で、ド・ジッター空間の最大の質量付近にある無電荷で回転しないブラックホールに、予想される最大の電力を散逸させる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 14:13:17 GMT)
A partially linearized mapping approach to surface hopping (MASH-PLDM) for nonadiabatic dynamics and nonlinear spectroscopy [0.0] 我々は表面ホッピング (MASH) への写像法の一部を線形化したバージョンを導出する。
MASH-PLDMは、様々な散乱問題やスピンボソンモデルに対する元のMASHダイナミクスよりも改善された結果をもたらす。
新しい手法のさらなる利点は、マルチタイム相関関数を扱えることである。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:58:57 GMT)
A citizen science behavioural dataset of an urban collective-risk dilemma on air pollution mitigation under resource inequality [0.0] データセットは、77の6プレーヤーゲームで462人の参加者で構成され、合計で4,620人のコントリビューション決定がなされている。
2つの屋外会場で収集されたデータは、実験室のプロトコルの下でタブレットベースのインタフェースを用いて行われる。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 15:29:58 GMT)
A Si-on-SiC Platform for Interfacing with Vanadium Dopants in the Telecom O-Band [0.0] 炭化ケイ素(SiC)のバナジウム色中心は、テレコムOバンド発光、サブミクロ秒光寿命、第2スケールスピン緩和時間を提供する。
ここでは, シリコンナノキャビティと浅いバナジウムドーパントとを両立させるシリコンオンSiCヘテロジニアスフォトニックプラットフォームを紹介する。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 17:42:25 GMT)
A Persistent State for Auditable Mixture-of-Experts Routing [0.0] Mixture-of-Experts (MoE)モデルは、トークンを専門家のまばらなサブセットに繰り返しルーティングするが、従来のルータは、階層間の影響がどのように蓄積されるかのルーティング固有の記録を公開しない。
Scratchpad-Augmented Mixture-of-Experts (SA-MoE)を導入し、各ルータが専門家に提供されていない低次元の永続状態にアクセスできるようにする。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 08:51:09 GMT)
A Character-Level Neural Approach to Sinhala Sandhi Splitting [0.0] SandhiLexに基づく文字レベルのシーケンス・ツー・シーケンスの研究について述べる。
近似型およびより複雑な語彙化,派生型および語源的サンディに対する繰り返しエンコーダデコーダモデルの評価を行った。
論文参考訳(メタデータ) (Mon, 28 Sep 2026 19:04:26 GMT)