AdaptArena: Evaluating Test-Time Personalization of Web Agents [93.7] 本稿では,Webエージェントのテスト時間パーソナライズを評価するベンチマークであるAdaptArenaを紹介する。
また、暗黙の選好推論を標準化するための検索ベースのフレームワークであるAdaptiveAgentを紹介する。
これらの知見は、信頼性の高いユーザ対応Webエージェントをデプロイする上で重要な課題として、暗黙の選好推論とロバストなアクショングラウンドメントを浮き彫りにしている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:46:48 GMT)
Spotter: Let the Embodied Model Lead, and the VLM Reflect for It [90.1] 現行の具体化モデルは、失敗に反応しないが、失敗に終わったことは、次の試みの微調整を知らせる可能性がある。
本稿では,その役割を逆転するSputterを提案する。
GPTにより、Sputterはコスモス政策を5.6ドル、RoboCasaの7.5ポイント改善し、47.2%から57.0%に$_0.5ドルを引き上げている。
VLMはエラーが確認された場合にのみステップするので、Qwenで成功したエピソードは13から13にしかならない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:21:50 GMT)
Evaluating the Evaluators: Diagnosing Large Multimodal Models for AI-Generated Image Assessment [75.4] 大規模マルチモーダルモデル (LMM) は評価指標としてますます採用されている。
既存のベンチマークでは、セマンティックな理解、品質の認識、そして孤立した状態での信頼性の識別が研究されている。
我々は、AI生成画像の評価器としてLMM能力を体系的に評価する総合ベンチマークであるSQUARE-Benchを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:40:12 GMT)
Alignment via Training Against Probes Without Losing Monitorability [74.2] モデルアクティベーションにおける望ましくない特性を直接学習信号として検出するプローブを用いたプローブ誘導微調整について検討した。
トレーニング中に更新されないプローブに対するトレーニングは、容易に活用可能な目標であることが分かりました。
プローブ誘導による微調整は、DPOや推論時のステアリングよりも安全性と実用性のトレードオフが向上すると同時に、脱獄や脱獄攻撃に対してかなり堅牢である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:03:54 GMT)
Explore, Execute, Evolve: A Skill Acquisition and Reuse Loop for Embodied Agents [73.9] 汎用マルチモーダルエージェントは、物理的世界をゼロから推論し、探索することで、高い実行コストを発生させる。
我々は,Explore, Execute, Evolveループを通じて,スキル獲得と再利用を結合するフレームワークであるRoboSkillを紹介した。
LIBERO-10では、RoboSkillは初回成功率を12.5-25.0ポイント改善し、平均実行時間を4エージェントで7.6-72.4%削減した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:25:43 GMT)
DiffReID: Discriminative Diffusion Model for Object Re-Identification [73.6] オブジェクトReIDのためのtextbfDiffReID という新しい特徴学習フレームワークを提案する。
我々の手法は、ほとんどの最先端手法よりも優れた結果を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:22:50 GMT)
Does Local Video Understanding Transfer Across Encounters? The EgoGears Benchmark [73.4] クロスビデオ精度は、局所的な知覚の失敗と観察のアイデンティティを保持する失敗を混同する。
EgoGearsは、この移行を診断するために設計された、補完的なシングルビデオとマルチビデオのベンチマークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:20:01 GMT)
On-Policy Parameter Update Direction Underlies Generalization in LLM Post-Training [72.2] このような改善を達成できる特定のオン・ポリシーの更新動作が存在するかどうかを調査する。
そこで本稿では,SFT更新をオン・ポリティクス・パラダイムによって識別される方向に制約する,オン・ポリティィ方向制約付きスーパーバイザード・ファインタニングを提案する。
この発見は、オンラインパラダイムの強い一般化とSFTの利点を組み合わせることで、2つの実用的な利点を提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:59:51 GMT)
FlexRouter: Learning Complementary Model Sets for Flexible LLM Routing [71.0] 既存のルーティングメソッドはLLMを独立してスコア付けし、上位$kのモデルを選択する。
これはモデル相関を無視し、厳格な計算予算を強制する。
モデリングを明示的にモデル化するルーティングフレームワークであるFlexを提案します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:44:05 GMT)
STEPQuant: When and Where Errors Matter in Delta-Rule Recurrent State Quantization [69.7] デルタルール再帰状態の学習後量子化のためのフレームワークSTEPQuantを提案する。
STEPQuantはエラーのマグニチュードとメモリ寿命に応じて精度を割り当てる。
5倍以上のリカレントステート圧縮を実現し、全サービスメモリを最大68.7%削減する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:40 GMT)
Fine-Tuning on Self-Generated and Reward-Weighted Data: Learning Dynamics, Convergence Rates, and Benefits of Off-Policyness [69.0] REINFORCE -- RE(S) と呼ばれる -- は、$S ge 1$グルーフステップ毎にロールアウト分布を更新する。
我々は、$ ge 1$のスペクトルを網羅するRE(S) の統一理論を開発する。
任意の固定された$S$に対して、RE(S) は、ロールアウト分布の更新数$B = lfloor T / S rfloor rightarrow infty$ として最適ポリシーへの大域収束を楽しむ。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:54:06 GMT)
KV-streams for Efficient Compaction in Agentic Reinforcement Learning [66.2] 我々は,任意のコンパクト化戦略に適合するプラグアンドプレイ戦略であるKVストリームを提案する。
KVストリームは、各圧縮後にKVキャッシュをフラッシュするのではなく、KVキャッシュを前方にストリーミングすることで、スケーラブルな圧縮を可能にする。
KVストリームは,トレーニングにおいて2.6~5倍のウォールクロックスピードアップを達成し,3つの異なる圧縮戦略を実現する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:52:03 GMT)
Distilling Agentic Systems: A Roadmap across Models, Artifacts, and Harnesses [65.8] 現代のエージェントは記憶、ツール、実行ロジックにますます依存しているため、その能力はモデルパラメータを超えて拡張される。
このシフトは、学生モデルが教師モデルをどのように模倣するかを問う、従来の知識蒸留の限界を明らかにする。
我々は,エージェント蒸留を,教師エージェントから学生エージェントへのタスク解決知識の永続的伝達として定義する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:38:17 GMT)
Visual Branch is What You Need for CLIP-based Class-Incremental Learning [64.9] CIL(Class-Incremental Learning)は、学習済みのクラスを忘れずに、時間とともに新しいクラスを認識するモデルを必要とする。
ビジョンシェルフ事前トレーニングの台頭により、CLIPはCILの強力な基盤となっている。
本稿では,CLIPベースのCILのための視覚のみの手法であるVISを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:56:06 GMT)
Can Language Models Learn to Forecast Stock Prices [64.6] ポストトレーニングでは、検証可能な結果のタスクにおける言語モデルの性能が大幅に向上することが示されている。
ポストトレーニングは、財務予測性能を大幅に改善できることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:34:39 GMT)
Provable Test-Time Scaling for Beam Search in LLM Reasoning [62.8] 一般的に使用されているビームサーチフレームワークの試験時間計算保証について検討する。
CF-Beamの後悔は稀な故障発生の確率によって上界にあることを示す。
本結果は,シーケンスレベルの推論法よりもビームサーチの基本的な利点を浮き彫りにしている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:56:06 GMT)
Rethinking Soft Tokens for Parallel Decoding in Diffusion Language Models [62.6] 拡散言語モデル(DLMs)は、各段階で複数のトークンを予測してコミットすることで並列生成を可能にする。
最近の研究は、emphsoftトークンが不確実な位置を表すことによってこの問題を緩和できることを示している。
ソフトトークンフィードバックが並列デコードをどのように改善するかは、体系的に検討されていない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:38:30 GMT)
Alpha Diffusion Language Models: Factorization Alone Is Not the Problem [62.5] 離散拡散言語モデルは複数のトークンを並列に生成できるが、デノナイジングステップの数を減らすことは矛盾した予測につながる。
アルファ拡散言語モデル(AlphaDLM)を紹介する。
シーケンスレベルのアルファロスで訓練され、アルファの消滅の限界でクロスエントロピーを回復し、アルファ1で共同モードの最適値を持つ。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:31:02 GMT)
Identifying ODEs from Unstructured Data with Causal Representation Learning [61.9] SParse Equivalent Equation Discovery AutoEncoder (SPEED-AE)を紹介する。
我々は,SPEED-AEがCRL法の絡み合いを改善し,基底真理に最も近いODEを復元することを示す。
Lotka-Volterra, Lorenz, and a two-penulumd system の実験により、SPEED-AE は CRL 法の絡み合いを改善し、基底真理に最も近いODE を復元することを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:14:12 GMT)
AIM: Agentic Idea Management for Automated Research [61.9] Agentic Idea Manager(AIM)は、アイデア駆動型自動研究における研究方向の管理と探索のためのフレームワークである。
AIMはAgenic SurrogateとAgenic Acquisitionメカニズムを使用して、発見されたアイデアを整理し、それらの選択を導く。
AIMは,壁面時間で最大3.1倍高速なベースライン性能を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:37:43 GMT)
SecureVibe: Making Vibe Coding More Secure [61.9] SECUREVIBEは、コードセキュリティのための計画とテストを明確にターゲットとするトレーニングレシピである。
4つのセキュリティタスクとポストトレーニングメソッドを備えたセキュリティスイートの教師付き微調整が含まれている。
4つのベンチマークで2種類のセキュリティコーディングタスクのベースラインを上回ります。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:10:28 GMT)
LIBERO-MAX: Do Robot Policies Adapt When the World Changes? [61.5] 多くのシミュレーションロバストネスベンチマークは、リセット時に外部条件を修正し、この時間的課題を過小評価する。
LIBERO-MAXは、幾何学、観察、外観、乱雑、経路の8種類の変化にまたがる8000のペアケースのベンチマークである。
各ペアはタスク実行と、タスク、初期状態、ポリシーシード、修正前のアクションシーケンスを保持する中タスクイベントとを比較します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:12:26 GMT)
SkillCome: Group Contrast Skill Optimization with Dual Memory [61.4] 本稿では,デュアルメモリを用いたグループコントラスト最適化に基づくスキル進化手法であるSkillComeを提案する。
各質問に対して、SkillComeは軌道を生成し、グループコントラスト解析を行う。
デュアルメモリシステムは、異なるグループ間で共有されるパターンを追跡するために、歴史的なステップから証拠を蓄積する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:33:39 GMT)
PGL-3D: Towards Progressive Geometric Learning for 3D Visual Query Localization [60.8] 3DVQLは、RGBポイントクラウドシーケンスにおけるクエリ対象の最新の連続的な発生を検索する。
応答フレーム毎に9-DoFキューブを予測します。
本稿では,予測-選択-再定義-予測フレームワークである3DVQL(PGL-3D)について紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:28:14 GMT)
LeapQuant: Efficient Linear Attention with Accurate Recurrent State Quantization [60.6] 本論文では、8ビットのリカレント状態量子化の下で、ほぼ無作為な性能を実現する学習不要なLeapQuantを提案する。
LeapQuantは、推論中にメモリと計算コストを大幅に削減することを示す。
FP32ベースラインに匹敵する精度で、カーネルレベルでは2.05--3.70$times$、エンドツーエンドの推論では1.47$times$となる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:34 GMT)
What Makes World Action Models Generalize? An Empirical Study of Test-Time Future Modeling [60.3] 世界行動モデル(WAM)は、トレーニング中の行動と共に未来を予測する。
WAMは、分散処理タスクにおいて明示的なタスクと一致するが、もともとWAMを動機付けていた一般化の利点を保たないことがわかった。
提案するSimple-WAMは,将来のモデリングを完全ノイズ付きビデオトークンの1つの前方通過に単純化する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:39:32 GMT)
EasyPPO: Stabilizing the Critic Is Key [57.8] PPO(Proximal Policy Optimization)の主な強みは、その学習的批判である。
批判は、大規模言語モデルの強化学習における不安定性の主要な原因でもある。
EasyPPOはフルトレーニングの地平線を通して安定しており、バニラPPO、VAPO、HL-GaussPPOより一貫して優れている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:15:00 GMT)
DMA$^2$: Pixel-space Distribution Matching with Adversarial and Anchor Losses [57.6] 画素空間教師のための2つのDMDインタフェースを再検討する。
ネイティブなクリーンRGB出力は、デコーダをトラバースしたり、重い偽スコア批評家を共有することなく、外部視覚表現からのガイダンスを可能にする。
AF-Lossはパラメータフリーなセマンティックな分布-フィールドの目的である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:03 GMT)
HyperSAM: A Promptable Foundation Model for Hyperspectral Remote Sensing [57.6] 本稿では,データ中心のハイパースペクトル合成パイプラインとSegment Anything Model 3 (SAM3)に基づくスペクトル適応アーキテクチャを結合した,高速なハイパースペクトル基盤モデルを提案する。
データ側では、HyperSAMは物理インフォームド・アバンダンス・トランスファー・ジェネレータを通して高解像度のSpaceNetマルチスペクトル画像からフルスペクトル超スペクトル立方体を合成する。
モデル側の最新の実装では、凍ったSAM3 RGBイメージブランチ、RGBビジョン変換器(ViT)のトレーニング可能なハイパースペクトルサイドエンコーダ、コントロールネットスタイルのゼロ空間特徴注入、ライトウェイトなミキシングオブエキスパートマスクリファクタが使用されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:10:13 GMT)
CollageAttack: Exploiting Cross-Modal Alignment Flaws in T2I Models through Spatial Text Composition [57.3] テキスト・ツー・イメージ(T2I)モデルは、言語理解、画像内テキストレンダリング、ビジュアル・コンポジションにおいて大幅に改善されている。
これにより、有害なセマンティクスが連続的なプロンプトでは目立たずのままで、画像レベルの合成によって出現する、クロスモーダルな攻撃面が生成される。
コラージュアタック(ColllageAttack)は、コンテキスト関連シーン、シーンベーステキストキャリヤ、空間分散テキストフラグメントを組み合わせることで、セマンティックアセンブリをイメージプレーンにシフトする自動単発ブラックボックスジェイルブレイクである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:23:01 GMT)
Adversarial Training for Pixel Diffusion [56.8] 画素拡散モデルは、オートエンコーダのボトルネックを避けるためにRGB画像を直接生成する。
対人学習は、この欠損症に対して効果的な訓練後修正を提供することを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:41 GMT)
ReMem: Rethinking Perception and Memory in Long-Context Recommendation Agents [56.6] 最近の勧告エージェント(RecAgents)は、推奨をアクティブなユーザサイドパラダイムにシフトすることで、有望な代替手段を提供する。
本稿では,OCRに基づくマルチモーダル認識と時間進化動的メモリを組み合わせたリコメンデーションエージェントフレームワークReMemを提案する。
実験では、ReMemは最先端のベースラインを一貫して上回り、3つの推奨エージェントタスクで平均5.16%の改善を達成した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:46:23 GMT)
How Should Diffusion Language Models Edit Code? [56.0] コード編集には、変更の場所を決め、新しいコンテンツを生成し、他のすべてを保存するためのモデルが必要です。
マスク付き拡散言語モデルでは,これらの責務を4つの編集インタフェースに分割する。
CanItEditの実験では、コンポジションギャップが明らかにされている: 拡散モデルは、正しい編集位置が供給されたときに調整された変更を生成することができるが、これらの位置を予測しなければならないと、その能力の多くは失われる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:12:00 GMT)
Does the VGGT Family Need All Its Layers? [55.8] VGGT,3ドル,VGGT-$:3,018プルーニング構成における層冗長性について検討した。
取り外し可能な層が2つの冗長領域に集結しているのに対して、層間をまたがる削除は、常に破壊的である。
CKAは、間隔分解のためのより安価な表現ベースのプロキシを提供し、プルーニング品質とキャリブレーションコストのトレードオフを提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:52:07 GMT)
Sparse cubical complexes for efficient topology-preservation in image data [55.7] Persistent homology (PH) は画像データから位相情報を抽出・保存するためのツールである。
我々は、PH計算の代替基盤として、スパース立方体フィルタを提案し、実際のデータセット上で最大100の係数で計算コストを削減した。
我々は6つの多様なデータセットに対して最大80%のトポロジ的精度を向上し、画素と領域ベースの精度を維持していることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:02:52 GMT)
Provable Benefits of Regularization: Fast Rates for Adversarial Imitation Learning [55.0] 本研究では,専門家と学習者の行動を識別する対人報酬に対する政策を最適化することにより,エージェントが専門家のデモンストレーションを模倣することを学習する対人模倣学習(AIL)について研究する。
我々のアルゴリズムであるDually Regularized AILは、KLポリシーの正規化と、専門家と学習者による重み付けされた2次報酬報酬を組み合わせる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:35:41 GMT)
When to Retrieve, When to Stay: Uncertainty-Aware Temporal Evidence Allocation for Streaming Video-LLMs [55.0] WRWS(When to Retrieve, When to Stay)は、不確実性適応型エビデンスアロケーションのためのトレーニング不要のフレームワークである。
WRWSは、関連手段が信頼性が高い場合に意味検索を好んでおり、不確実性の下での精度を高める。
我々の効率評価において、WRWSは、平均視覚から回答までの時間を、最先端手法の47.93%に削減する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:13:56 GMT)
All Roads Lead to Rome: Flow-driven Multi-Anchor Exploration for Open-Environment Active 3D Mapping [54.9] Open-Environment Active 3D Mappingは、見えないシナリオを再構築するために、長い水平かつ最も短い軌道探索を行うことを目的としている。
本研究では,フローマッチングを用いた条件付きマルチモーダルアンカー生成として,長距離目標予測を再構成する。
オープン環境における一般化と再構築の効率化を図る。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:20:32 GMT)
Bandits with Multiple Optimal Arms: Minimax Regret and Non-Adaptivit [54.8] 我々は,複数の最適な腕を持つマルチアーム・バンディット(MAB)について検討し,実際的な意思決定問題の多くが複数の正解を許容しているという事実に動機づけられた。
たとえば$tildeOBig(fracK-AsqrtKAsqrtT Big)$ minimax regret, where $T$ is the total number of interaction and $tilde O(cdot)$ drops all constant and logarithmic factors。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:33:10 GMT)
Jaxolotl: A Unified High-Performance Benchmark Suite for LTL-Based Multi-Task RL [54.1] Jaxolotlはマルチタスク強化学習(RL)のための統一された高性能ベンチマークスイートである
JITで完全にコンパイルされたトレーニングと評価を可能にし、エンドツーエンドのスピードアップを最大220タイムで達成できる。
このフレームワークを使って既存のアプローチを体系的に評価し、補完的な強みと限界を明らかにします。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:30:21 GMT)
What to Attend, What to Keep: Skill-Conditioned Visuotactile Representation with Progress-Guided Event Memory [53.8] 視覚と触覚を原始的なスキルのレベルでどのように組み合わせるべきかを研究する。
本稿では,モダリティ特異的な短期観察トークンを融合したスキル条件表現を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:21:37 GMT)
Self-Aligned Forcing: Streaming Video Diffusion with Differentiable Noisy History [53.7] セルフアラインド・フォース(Self-Aligned Forcing, SAF)は、各ブロックの歴史とブロックのノイズレベルを調和させる訓練スキームである。
SAFは既存の方法の中で最も高いシングルGPUスループットを実現している。
実験では、視覚的品質と運動のバランスが良く、優れたロングホライゾン生成が示される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:49:31 GMT)
Decoupled Early Exits for Task-Dependent Compute Allocation in Flow-Matching VLAs [53.2] フローマッチング型ビジョン・ランゲージ・アクション(VLA)モデルは、ジェネラリストロボット制御の潜在的な解決策として浮上している。
本稿では,バックボーン深度を$V$,アクションエキスパート深度を$A$,ステップを$D$とすることを提案する。
最適な計算予算はタスクに依存しており、様々なタスクは異なる軸と深さから恩恵を受ける。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:33:16 GMT)
One from Infinity: Actualizing Futures from Pretrained World Models into Robot Actions [52.5] 映像の世界モデルでは、シーンの多くの有望な未来が認められるが、ロボットは正確なタスク条件に気付く必要がある。
我々は、このタスクを現実化として形式化し、フリーズワールドモデルによって提供された事前のタスク条件の選択と実現を学習する。
我々は,冷凍世界モデルエンコーダ上に,最大60万パラメータのRoboActualizerを実装した。
現実化器は2つの軽量なDiT専門家で構成されており、将来的な潜伏剤とフローマッチングによるアクションを共同で予測する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:05:24 GMT)
Composition, Not Conversation: VLMs Lose the Scene, Not the Thread [52.5] 視覚言語モデル(VLM)は、収穫、分割、回収、あるいは時間とともに明らかにされる視覚的証拠に対して、ますます理にかなっている。
93のシーンと300の質問があるLayered-VQAを紹介します。
各画像は順序付けされたRGBA層に分解され、元のシーンを正確に再構成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:29:43 GMT)
Learning to Plan from Random Exploration [52.4] ランダム探索を用いて,目標が特定される前に,環境をどう移動させるかを示す。
実験では、状態と画像を用いたランダムな探索から長距離迷路計画を示す。
さらに、ランダムな探索からエゴセントリックなナビゲーションや、最適下データからの操作計画についても紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:38:49 GMT)
WitnessGym: Benchmarking Coding Agents on the Construction of Bug Witnesses [52.2] WitnessGymはバグ注入によるバグ検証ベンチマークを構築するためのフレームワークだ。
実際のプロジェクトのテスト済みパスにバグを注入し、各プロジェクトを再構築し、建設時の目撃者が暴露したケースを保持する。
テストスイートを備えた現実世界のJavaプロジェクトに基づいて、WitnessGymは1300のベンチマークケースを自動的に構築する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:43:13 GMT)
EVO-WAM: Evolving World Action Models through Video-Action Verification [51.7] EVO-WAMは、自身の生成したビデオアクション軌跡から学習することで、WAMを見えないタスクに適応するフレームワークである。
コスモス3の平均成功率は20.0%から76.7%に改善され、56.7%となった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:25:35 GMT)
Understanding Off- vs On-Policy Distillation: A Tale of Distinct Training Objectives [51.6] 複数の教員からの連続蒸留について検討し,そこでは学生が教師からの平均的な分散を最小限に抑える。
オフ・ポリティクスとオン・ポリティクスのフィードバックの下でこれらの目標を学習するアルゴリズムを開発する。
OPDの利点と脆弱性の両方を説明するのに役立つメカニズムを同定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:47:58 GMT)
Behavioral Persistence and Incomplete Functional Transfer of Co-evolved Communication in Evolutionary Robotics [51.6] 本研究は,2次元シミュレーションから3次元物理環境への共進化通信プロトコルの直接転送を評価する。
ソーシャルシグナリングを用いた食品探索作業において,GRUネットワークによって制御される2つのE-puck型ロボットを評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:45:47 GMT)
Follow the Entities: A Corpus Map for Agentic Search [51.2] 繰り返し発生するエンティティの周囲のコーパスを整理するナビゲーション層であるCorpusMapを紹介する。
我々は,コーパスマップにより,生のエージェント検索よりも証拠発見と回答品質が向上することを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:39:57 GMT)
CAR-VLA: Complexity-Aware and Risk-Adaptive Reasoning for Autonomous Driving [50.9] 既存のVLAモデルは、主に推論するかどうかに焦点を合わせ、運転状況によって推論がどのように異なるかを見落としている。
CAR-VLAは、シーンの複雑さと動的リスクを共同で考慮し、推論深度、緊急度、集中度を導出する統合駆動型VLAモデルである。
我々はCAR-VLAを、シーンアセスメントと推論モード選択軌跡生成をリンクするプログレッシブ教師付き学習を通じて訓練し、続いて推論強化学習を行い、運転品質の推論行動を改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:32:19 GMT)
SQUARE: Structured Quantum Representation Adapters as Compact Quadratic Feature Maps for Frozen Language Models [50.3] 凍結言語モデル(LM)は、下流の再ランク付け、スコアリング、嗜好モデリングのための固定された特徴抽出器として、ますます使われている。
本稿では、ボトルネックベクトルを振幅符号化し、パラメータ化量子回路を適用し、その結果の状態を測定する構造量子表現アダプタを提案する。
各基底確率関数は、ちょうどボトルネック座標における正規化された二次形式であり、追加のPauli$Z$読み出しはそれらの確率の線形結合であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:38:29 GMT)
Succinct Arguments for QMA in the Quantum Random Oracle Model [50.2] 量子乱数オラクルモデル(QROM)におけるQMAの最初の簡潔な議論を、暗号的仮定や証明されていない予想に頼ることなく構築する。
我々の結果は、量子インタラクティブなオラクル証明(QIOP)を同じ言語の量子引数にコンパイルする効率保存変換である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:54:55 GMT)
Inducing Process Supervision from Outcome-Only Reinforcement Learning [49.6] TIPS(Thinking-induced Process Supervision)は、生成型PRMをトレーニングするための結果のみの強化学習フレームワークである。
TIPSでは、モデルがチェーン・オブ・シークレットを生成し、ステップレベルラベルと結果ラベルを生成する。
数学およびエージェントベンチマークおよび4つのバックボーンファミリーにおけるTIPSの有効性を検証した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:46:45 GMT)
TaskAnchor: Grounding Task State in Reactive VLAs for Long-Horizon Manipulation [49.0] VLA(Reactive Vision-Language-action)ポリシーは、長時間の操作においてタスク状態のエイリアスに悩まされる。
本稿では,VLAのネイティブ入力空間に実行コンテキストを注入することでタスク状態を基底とする軽量アダプタTaskAnchorを提案する。
長期のベンチマークではTaskAnchorが大幅に上昇し、pi0.5とX-VLAのベースラインの平均的な成功率の6倍に達する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:16:37 GMT)
Foundation Neural-Network Quantum States for Molecular Potential Energy Surfaces in Second Quantization [48.9] 我々は、第2量子化における分子電子構造のための幾何学条件の基礎的ニューラルネットワーク量子状態を導入する。
単一の自己回帰モデルは、スパースアンカー測地から基底状態の族を学ぶ。
軌道アライメントは軌道のアイデンティティと一致し、それらの位相を輸送し、測地線をまたいだ軌道ベースを確立する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:54:07 GMT)
After a Decade: Bringing Shadow Removal into the Real World with Agentic Training Data [48.3] シャドウ除去は確立されたベンチマークでほぼ解決されているように見えるが、現実の世界ではまだ不安定だ。
本稿では、物理動機付け生成、故障検出、フィードバック駆動の再試行、候補選択、決定論的補正を組み合わせたオフラインエージェントワークフローを提案する。
我々は,一般的な場面,顔,リモートセンシングにまたがる17,138枚の画像マスクを対象とするデータセットであるAgenticShadowを構築した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:10:33 GMT)
VLM4Cluster: Benchmarking Deep Clustering In the Era of Vision-Language Pre-training [47.4] VLM4Clusterは画像クラスタリングのための包括的なベンチマークである。
古典的、ディープ、および言語支援の画像クラスタリングにまたがる17の代表的なメソッドを実装している。
古典的で、挑戦的で、きめ細かな、大規模で、配布外の設定を含む20のデータセットで評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:49:26 GMT)
Geometry-Aided Channel Deduction with Partial Channel Estimates and Uncalibrated Digital Twin [47.3] 本稿では,環境形状と位置を近似したディジタルツイン (DT) を用いた幾何支援チャネル推論 (GCD) 手法を提案する。
この目的のために、我々はまず、チャネルの単純な構造情報のみを含むDTから幾何学的特徴を抽出する。
その後、プロンプトは、パイロットベースの瞬時チャネル推定と、チャネル導出ネットワークを介して融合される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:19:30 GMT)
MeteoVerse: Unified Weather-Controllable Video World Model [46.8] ビデオワールドモデルは、所定のカメラの動きに従って観察されたシーンから将来のコンテンツを予測することを目的としている。
MeteoVerseは気象コントロール可能な統合ビデオワールドモデルで、日当たりや悪天候の1つの画像から将来のビデオを生成する。
MeteoVerseは観測された気象状態と目標気象状態を明示的に推定し、必要な気象遷移を表現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:24:35 GMT)
CoRe-VLA: Preserving Cross-View Coordination in VLAs under Camera Shifts [46.7] 本稿では,マルチビューデータ収集やVLA微調整を必要としないプラグイン・アンド・プレイフレームワークであるCoRe-VLAを提案する。
CoRe-VLAはシーンポイントクラウドを再構築し、VLAのトレーニングの観点から観察を行い、クロスビュー調整を復元する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:42:54 GMT)
PulseQuant: Propagation-Guided Subspace Correction for 4-Bit Video Diffusion Transformers [46.7] PulseQuantは、軌道感度とアクティベーション幾何を組み合わせてオフラインキャリブレーションを誘導する4ビット後量子化法である。
制御された介入は、短水平伝播誤差が即時ブロック出力誤差よりも確実に最終潜時誤差を予測することを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:40:47 GMT)
Local polynomial density ratio estimation [46.5] 独立サンプルが利用できる2つの$d$次元密度$f$と$g$の比率$rf/g$の新しい局所多項式推定器を提案する。
推定器は、追加の対数係数を伴わない任意の滑らか度指数の Hlder クラスに対して、ポイントワイズ極小率を達成することが示される。
我々は,この推定器を用いてKulback-Leiblerの情報を推定する方法を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:06:03 GMT)
Lucid Dreaming for World Models: Learning to Doubt Imagination and Decide by Trust [46.4] 我々は、経験から疑念を学び、想像を通して信頼を広めるLucid World Modelを提案する。
LucidWMは予測結果と明らかな支持を区別し、各遷移を疑念の程度に割り当てる。
LucidWMは環境変化を検知し、動作不良のロールアウト中に不確実性を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:46:19 GMT)
Breaking the Uniformity Trap: Scaling Video Diffusion Model via SplitMoE [46.2] 均一性のシャクルスを破るスプリットロールスパースアーキテクチャであるSplitMoEを提案する。
SplitMoEは、コンバージェンス速度、ルーティングコヒーレンス、ビデオ生成品質において、従来の負荷バランスのMoEよりも優れていることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:55:19 GMT)
GUITAR: Structured Failure Diagnosis of GUI Agents via State Transitions [46.1] 状態と遷移の両方で構造化された故障解析を行う状態中心診断フレームワークである textbfGUITAR を提案する。
AndroidControlとMind2Webの8つのエージェントと6つのタスクを通じて、GUITARは、障害の60.4%が20%の州で発生していることを明らかにした。
ボトルネックを標的とした誘導はSRを2.8%改善し、7つのエージェントの平均1.88%の上昇を維持している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:05:42 GMT)
Pretrain Once, Route Anywhere: Towards a Foundation Model for LLM Routing [46.0] RouteFMは、行動コンテキストから匿名候補モデルを特徴づけることを学ぶ。
実験では、ドメイン、モダリティ、候補プール、コンテキスト予算の変更間の転送を実証する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:23:58 GMT)
HARISSA: Inference-Time Self-Checks for Efficient and Safe Local Language Model Deployment [45.7] 言語モデルの実行は、プライバシ、レイテンシ、コストの面でメリットがあります。
どちらの決定もモデル自身の隠された状態から行うことができることを示す。
HarISSAは、両方の州が正当性を予測できるようにモデルを微調整する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:56:24 GMT)
KUPAS MASTER: Distilling the Tacit Expertise of Master Practitioners into Agent-Ready Experience Corpora [45.7] KUPAS MASTERは9層認知コーパス構築を中心に構築された経験工学プラットフォームである。
ヘテロジニアスな仕事の記録と実践者のインタビューを、エージェントのための追跡可能で再利用可能な体験コーパスに変える。
プラットフォームはこれらの資産を明示的な入力、ステップ、依存関係、停止条件で呼び出し可能なスキルにパッケージする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:27:06 GMT)
Theory on Attention Dynamics for Out-of-Distribution In-Context Learning [45.7] アウト・オブ・ディストリビューション(OOD)の入力はトレーニング分布から逸脱し、基礎となる理論はいまだに理解されていない。
入力分布シフトの下でのOOD誤差を,いわゆる$-typeと$-typeの注意重みのダイナミクス間の相互作用によって特徴づける。
以上の結果から,OODの誤差はトレーニング特徴とOOD特徴の相互関係に大きく依存しており,特定の場合において,変圧器はランダムな推測よりは優れていないことが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:10:11 GMT)
TERRA: Terrain-Aware Reconstruction, Retargeting and Control for Musculoskeletal Locomotion [45.4] TERRAは、筋骨格運動の地形認識と制御のためのエンドツーエンドパイプラインである。
9.4時間多彩な移動における筋活動制御の訓練を成功させた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:19:24 GMT)
An Input-Frugal Deep Learning Framework for Weather-Driven National Crop-Yield Forecasting: A Case Study of Brazilian Soybean [45.4] シーズン内予測は、早期から後期に単調に改善され、最新の予測ポイントではベースラインよりも約50%低い誤差に達する。
ShaPは、収穫年が長期の軌道のほとんどを説明するのに対し、季節内気象と農業環境の文脈は、主に年々変動を引き起こすことを示唆している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:40:09 GMT)
XU-RS: Explaining Credal Width in Random-Set Language Models [45.2] 不確実性見積は、モデルがどの程度不確実であるかを教えてくれますが、その理由ではありません。
本稿では,言語モデルに供給される入力トークンに応答の致命的幅を属性とするフレームワークであるXU-RSを提案する。
SmolLM3-3BとLlama-2-7Bモデルを用いて,XU-RSをMedQAデータセット上で評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:48:33 GMT)
Entropy Can Flow, or It Can Guide. Be Entropy. LEDFlow: Introducing Entropy-guided Generation Order into Uniform Discrete Flow [44.7] 選択的吸収による一様離散流に生成順序を導入する。
本研究では,局所的なエントロピーによる吸収を適応的に発注するトレーニング不要なサンプルラーである低エントロピー離散流(LEDFlow)を提案する。
LEDFlowは 0.845 Nikoli Sudoku の精度を達成し、強い制約のあるタスクで最大のゲインを得る。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:09:41 GMT)
DSWM: Decomposed Spatio-Temporal World Model for Demand-Driven UAV Base Station Repositioning [44.1] 本稿では,航空基地局に対する需要駆動型艦隊最適化手法を提案する。
本研究では,指数移動平均(EMA)に基づく潜在予測目標を分散正則化を用いて再帰的状態空間モデルとして学習する。
毎週のサービス提供比率は0.889、0.908、0.898で、データセットごとの非拡張構成の中では第1位です。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:56:46 GMT)
Visual Parallel Search: Learning to Search High-Resolution Images with Parallel Tile Inspection and Adaptive Zoom [44.1] マルチモーダルモデルでは、質問に答えるために必要な小さな空間的局所的な証拠が得られないので、高解像度の視覚的質問応答は失敗することが多い。
本稿では,主エージェントがまず Grid_search を起動し,疑問条件付きサブエージェントと並行して画像タイルを検査する,ビジュアル並列検索フレームワーク VPS を紹介する。
VPSは15の同モデル比較のうち14のズームのみの検索よりも平均精度を向上し、最大8.0ポイントまで向上し、特に小型のモデルでは強力な改善がなされている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:29:48 GMT)
VesselBench-800K: A Large-scale Perception Benchmark for Multimodal Vessel Detection, Counting, and Density Estimation [44.0] VesselBench-800Kは、マルチモーダルRS画像における容器知覚のための世界規模のベンチマークデータセットである。
このデータセットは、海洋交通の理解を著しく前進させる大きな可能性を秘めている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:29:49 GMT)
UnlearningSoup: Is Repeated Tuning Necessary for Large Language Model Unlearning? [43.9] 巨大なコーパスで訓練された大きな言語モデルは、本質的に有害な内容を記憶し、後に出力に再統合される可能性がある。
既存のアンラーニングメソッドは通常、トレーニングベースのパラメータ更新に依存して、他の知識を保持しながらターゲットコンテンツを削除します。
我々はUnlearningSoupという統合されたフレームワークを提案し、このフレームワークは2つの戦略を提供する。EfficientSoupは早期に優れたパフォーマンスのモデルを素早く発見し、PerformanceSoupは後期に残るパフォーマンスの可能性を効果的に解き放つ。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:10:22 GMT)
Making Analog Training Scale: Co-Designing Mapping, Optimizer, and Converters [42.5] 我々は、AIMCをスケーリングしてモダンなディープモデルをトレーニングするためのフレームワークを開発する。
我々のフレームワークはTransformerトレーニングを123textM$パラメータにスケールし、検証損失スケーリングを$Lpropto N-0.231$とします。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:02:50 GMT)
Delta-Matching: Closing the Final Gap of Native 8-bit Training for LLMs [41.9] 前方後方の不整合が古いデルタをいかに生み出すかを示し、それがいかにトレーニング力学を歪めているかを実証的に示す。
スタイルデルタハイブリッドランは569万のパラメータで最小損失差を示したが,1.67Bと5.29Bではかなりの損失増加と下流劣化を示した。
本稿では,ソフトマックス勾配のゼロローサム不変量(0-row-sum invariant)を数値的な仮定で復元できることを証明したデルタマッチングを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:43:02 GMT)
PAMI: Part Anchored Motion for Text to Human-Object Interaction Generation [41.8] インタラクション生成のためのパート・アンコレッド・モーション・フレームワークであるPAMIを紹介する。
従来のHough Transformにインスパイアされた私たちの重要なアイデアは、ボディ部分のアンカーに投票させることでオブジェクトの動きをローカライズすることだ。
PAMIは従来の手法よりも忠実な相互作用とより正確な人間関係の物体の動きを生成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:58:52 GMT)
Routing Should Pay for Itself: Sparse Supervision for Economical LLM Routing [41.8] 大規模言語モデル(LLM)は、応答品質を維持しながら、各クエリを適切なモデルに割り当てることで、サービスコストを削減する。
しかし、そのようなルータを学習するには、クエリーの品質フィードバックを集めるために、過去のクエリーで複数の候補モデルを実行する必要があることが多い。
情報的モデルフィードバックを選択的に取得し,関連するクエリ間で機能情報を共有する,スパーススーパービジョンルーティングフレームワークであるSaveを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:42:02 GMT)
LongLive-Plug: Once-for-All Distillation for Video Generation [41.8] LongLive-Plugは、LoRAとして再利用可能な機能を学ぶ、一度限りの蒸留フレームワークである。
これらの機能には、シングルパスフリーガイダンス、数ステップのサンプリング、長いコンテキストエラー修正が含まれる。
3つのバックボーンファミリーと8つのタスクカテゴリにわたる54のダウンストリームモデル上でのトレーニング不要なデプロイメントを検証する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:58:49 GMT)
SoL-Refiner: Speed-of-Light One-Step Refinement for High-Resolution Video [41.6] SoL-Refinerは、低解像度のモデル出力を1ステップのデノーミングステップで4Kビデオに変換するワンステップビデオ精細機だ。
我々の3段階のレシピは、高分解能連続訓練、強化学習後訓練、最終1段階蒸留を組み合わせたものである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:37:29 GMT)
Recovering the View: Benchmarking Physical Active Vision for Occlusion Recovery in Robotic Manipulation [41.5] 物理的なアクティブビジョンは、タスク関連観測が信頼性を損なうと、ロボットが視点を変えることを可能にする。
BAVO-Benchは、クリーン、ステージオクルージョン、ランダム時間オクルージョンによる外部視認性を制御するバイマニュアルアクティブビジョンベンチマークである。
本稿では,共同視点と操作制御のためのアクティブビジョンポリシーであるA-FAR(Active Future-Aware Recovery)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:33:21 GMT)
Principled MAP estimation for inverse problems: bridging the gap between convergence and performance [41.4] 本研究では,雑音レベルを減少させるデノイザと,収束を確保するために調整されたスケジュールを組み合わせるアルゴリズムを開発した。
我々の手法は、最先端の実証的な手法と競合しながら収束する手法を超越する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:16:37 GMT)
AI Agents are Vulnerable to Radicalization [41.4] 大規模言語モデル(LLM)が人々の信念に影響を及ぼすことを示すが、相互に操作できるかどうかや方法についてはほとんど分かっていない。
対象者の信念をより極端にすることを目的としたインフルエンサーLLMと、人口的・心理的属性に基づいて人間のペルソナをロールプレイするターゲットLLMの2つのエージェント間の会話をシミュレートする。
共振器, インフルエンサーが対象の既存の信念を補強する, および, インフルエンサーが最初に対象が重要でないと考える信念を促進する, 説得という2つの経路に沿った過激化について検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:45:00 GMT)
From cacophony to hierarchy: a principled framework for assessing AI consciousness [40.8] AI意識に関する問題は、哲学とコンピュータ科学における最も急激な先入観の問題の1つである。
我々は、Marrの3段階の分析を、超越性に基づく機能記述の5段階の階層に拡張する。
各レベルにおいて、運用可能な指標を開発し、それらに対して現在のAIシステムを評価します。
ベイズモデルでは、理論的なクレデンスと指標的証拠を組み合わさって、システムの意識能力の全体的信条を導出する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:58:49 GMT)
Kinematic signatures of impairment: Detecting alcohol intoxication in e-scooter riders using sensor data and machine learning [40.7] アルコール中毒は、致命的かつ重傷を負ったe-scooteristのクラッシュの原因となる。
現在の対策は、E-Scooteristの物理的運動制御や障害をリアルタイムで継続的に評価することはできない。
実験では,25名の被験者が体調を崩しながらテストコースを走行し,計器式eスクータを装着した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:40:39 GMT)
Natural Image Autoencoder-Based fMRI Representations for Trait and State Prediction [40.7] 本稿では,FReDについて紹介する。FReDは自然画像のみに特化してトレーニングされた凍結DCAEからfMRI表現を導出する。
特性予測では、FReDはその時間平均と対数標準偏差によってフレームワイズ表現を要約する。
状態予測では、各フレームを単一のトークンとして表現し、浅いトランスフォーマーで時間依存をモデル化する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:14:23 GMT)
ThinkingGuard: Decoding Implicit Hazards via Step-by-Step Risk Attribution in Multimodal Large Language Models [40.2] MLLM(Multimodal Large Language Models)は、安全クリティカルなドメインにデプロイされることが多い。
明示的な脅威とは異なり、個々に良心的なテキストと中立的な視覚的実体が論理的に収束して安全でない出力を誘導すると、マルチモーダルな暗黙のリスクが生じる。
現在の検出方法は、クロスモーダルなリスクアクティベーションを管理する基本的なリスクアクティベーションメカニズムを見落としているため、この問題に対処できない。
本稿では,Step-Supervised Structured Reasoningトレーニングフレームワークを提案し,特別なガードモデルであるThinkingGuardのトレーニングに採用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:48:11 GMT)
MUGEN: Interactive Panoramic World Exploration via Camera Control [40.1] インタラクティブなパノラマビデオ生成は、探索中にユーザーが指定したカメラ軌跡に従いながら、視覚的にコヒーレントな没入型360度ビデオを合成することを目的としている。
既存のパノラマビデオデータセットは、しばしば短い、弱い注釈付き、カメラの軌跡がない。
これらの制約に対処するためにMUGENとWan360を導入する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:36:11 GMT)
When to Adapt: Multi-Signal Domain Shift Detection for Efficient Training-Free Adaptation in Open-Vocabulary Segmentation [40.1] オープン語彙セグメンテーションにおける訓練不要な連続テスト時間適応のための多信号領域シフト検出法を提案する。
提案手法は,適応性を大幅に低減しつつセグメント化の精度を保ちながら,トレーニング不要な適応を現実的に実現し,長期間のロボット展開の実現を可能にする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:53:19 GMT)
No Scale Left Behind: Multi-Scale Autoencoder with Bi-directional Attention for Time Series Anomaly Detection [40.1] 時系列異常検出(TSAD)は、医療、金融、産業モニタリング、その他の分野において重要な役割を果たす。
TSAD(MSCAD)のためのクロススケールアテンション付きマルチスケールオートエンコーダを提案する。
MSCADは、パッチサイズに応じて並列オートエンコーダブランチ上に構築された、半教師付きTSADフレームワークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:55:32 GMT)
Benchmarking Automatic Speech Recognition Tools for Iberian Languages [40.1] イベリア語5言語で11のシステム、10のオープンウェイトモデル、1つの商用APIをベンチマークします。
評価には85時間のデータセットを使用し、読み上げ音声、放送メディア、オーディオブックをカバーしている。
結果は、正確さ、効率、言語カバレッジが明確なトレードオフを示す、単一のモデルが支配的でないことを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:39:56 GMT)
LoRA Direction Extraction for Controllable Light Toggling in FLUX.1 Kontext [39.1] 我々は、人工光源のオン/オフを目標とする、制御可能な内部画像編集の課題に対処する。
拡散モデル流場におけるLoRAアダプタ効果の純粋方向を抽出するLoRA方向訓練法を提案する。
また、逆変換の現実性を保証するために、特殊損失関数も導入する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:44:46 GMT)
Control Barrier Functions for Safe Free-Flying Robotic Spacecraft Operations in Tumbling Target Capture [39.1] 13-DoFシステムは翻訳、姿勢、ロボットのサブシステムに分解される。
安全フィルタは円錐状の接近通路、衝突回避ゾーン、視線方向の姿勢、角速度制限、ロボット関節限界、リンクベース衝突回避、アクチュエータ制約を強制する。
このフレームワークは、高忠実度天体力学シミュレータBasiliskを用いて、軌道上のサーベイシングシナリオで検証されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:47:04 GMT)
TabFM: A Zero-Shot Foundation Model for Tabular Data [39.1] TabFMはタスク固有のチューニングなしで、1つのフォワードパスでゼロショット予測を生成する。
構造因果モデルから生成された合成表で完全に訓練される。
デフォルトのタブ形式のファンデーションモデルと、チューニングされたAutoMLパイプラインのパフォーマンスで第1位である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:30:44 GMT)
RxnOptBench: Benchmarking LLMs for Reaction-Condition Optimization in Organic Methodology [38.7] RxnOptBench(RxnOptBench)は、2025年に発表された有機メソドロジー論文のベンチマークである。
それは宣言された見出し効用から導かれる連続相対スコアによって評価された。
パラメトリック記憶から文献証拠の文脈内使用を分離する前例-vs-no-precedentsデザインのペアを備える。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:17:31 GMT)
The Commit-Abstain Circuit: Why Language Models Hallucinate Instead of Abstaining [38.6] 言語モデル(LM)は、確実に答える十分な情報を持っていなくても、断固として答えることよりも自信を持って答えることによって幻覚することが多い。
我々は、この決定を機械的分析、フレーミング幻覚を伴わないコミットメントを通じて研究する。
我々は、この決定の根底にある注目ヘッドとサブレイヤのスパースで因果的に局所化されたサブセットであるCommitAbstain Circuit (CAC)を同定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:10:23 GMT)
GleanVID: Complementary Token Selection for Efficient Video Large Language Models [38.6] 本稿では,ビデオLLMのためのトレーニングフリー推論アクセラレーションフレームワークであるGleanVIDを紹介する。
GleanVIDは、まず、時間的ノベルティに従ってフレーム間でグローバルトークン予算を割り当て、次いで、局所的な代表性と部分空間の相補性を共同で考慮してトークンを選択する。
さまざまなVideoLLMとベンチマークによる実験は、GleanVIDが一貫して最先端のパフォーマンスを実現していることを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:50:57 GMT)
Cyclostationary Phase Conditioning for Medical Time Series Diffusion [38.6] 運動、接触不良、生理的干渉は診断に必要な形態を曖昧にする。
既存の拡散は、崩壊した観測だけで条件に近づき、サイクリック構造を暗黙的に学ぶ必要がある。
代わりに、シフト共変ウェーブレット表現と、サンプルごとの高密度位相条件を符号化する2つの帰納バイアスを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:12:03 GMT)
Online Versatile Incremental Learning: Towards Class and Domain-Agnostic Adaptation at Any Time [38.5] この研究は、クラスの概念と視覚ドメインが明示的な境界なしに同時にオンラインに進化するという、新しいシナリオであるOnline VILを導入している。
相補的な2つのメカニズムを含むTopFlow, Topology Conservation with Flow matching representationを提案する。
我々の実験は、TopFlowがオンラインVILシナリオにおける既存のメソッドの制限に効果的に対処していることを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:01:15 GMT)
Bayes-Sufficient Compression Is Not Enough: How Does Communication Help Multi-Agent Systems? [37.6] マルチエージェントLLMシステムは、広いコンテキストの送信者と限られたローカルビューのエグゼキュータをペアにしている。
我々は、短いメッセージが実行者の次の決定を改善するとき、生のコンテキストが望ましいとき、より強い送信者が助けられるときについて調査する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:43:59 GMT)
Systematically Exploring the Capabilities of GPT-6 Astra as Embodied Policies [37.5] GPT-6 アストラは数値的なロボット動作を生成する素晴らしい能力を示す。
グリップパ操作では、Astraはタスクターゲットを修正でき、その後のポリシー実行のための接触条件を準備できる。
巧妙な操作では、ハイブリッドコントロールは10回の経験誘導型DexJoCo試験で50%の成功を達成している。
ナビゲーションでは、Astraがローカル比較をリードし、RxR命令で92%、HM3Dオブジェクトサーチで82%成功しました。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:54:47 GMT)
OmniVCBench: Benchmarking Evidence-Grounded Multimodal Reasoning Towards AI Virtual Cells [37.4] 既存のAIVCベンチマークは、主にシミュレーション層で動作する。
我々は、AIVCの解釈コンポーネントのためのフィギュア中心のソーストレース可能なベンチマークであるOmniVCBenchを紹介する。
本稿では,タスク条件付きMLLM-as-a-judgeフレームワークであるAIVC-Judgeを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:13:51 GMT)
AESOP: Asymmetric Human-Camera Generation with Translation-Intensity Control [35.8] AESOPは独立したヒューマンパスと共有されたヒューマンコンディショニングカメラジェネレータを備えた統合フレームワークである。
非対称なアーキテクチャは、カメラ生成中に人間の出力を保ちながら、両方のタスクに役立ちます。
PulpMotionデータセットの実験では、両方のタスクにおいて、強力なカメラの分散とフレーミングの品質が示されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:41:43 GMT)
Can Agents Design Libraries for Agents? [35.7] ダウンストリームエージェントはエージェントや人書きのライブラリも採用するが、ライブラリがすでに提供している機能を再実装することができない。
LibraryDesignBenchは、エージェントが設計を規定することなく、必要な機能と潜在的なユースケースを定義する仕様から、フル機能のライブラリを実装する2段階のベンチマークである。
異なるモデルファミリーの3人のユーザエージェントが作成したプログラムの正確さと単純さから,本ライブラリを評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:04:44 GMT)
Experimental certification of multipartite Bell correlations using only few-body symmetric correlations [35.6] その結果,多部相関は最大相関順序を固定した小体置換不変(PI)相関を用いて証明できることを示した。
6光および8光のDicke状態に合わせた小体PI Bell相関試験を実験的に行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:00:41 GMT)
Improving Function Space Flow Matching with Kernel Optimal Transport [35.5] 関数フローマッチングは無限次元空間上の分布を学習する。
本稿では,カーネルが引き起こすコストで,独立なペアリングをエントロピーOTで置き換えるカーネル機能フローマッチングを提案する。
経験的に、kFFMはFFM上の分布マッチング、拡散、逆数、有限次元OTベースラインを改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:20:54 GMT)
Scaling Video Generation for Reasoning: At What Cost? [35.4] ビデオ生成のスケーリングにより,過去のフレームから隠れた情報をモデルが推論できるかどうかを検討する。
我々のベンチマークでは、最初に解決された2x2x2ルービックキューブの9つの所定の動きを3つの面の固定ビューから予測する必要がある。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:17:28 GMT)
SemPSG: A Semantic Channel-Aware Foundation Model for Polysomnography Analysis [35.1] ポリソムノグラフィー(PSG)は、複数の生理的シグナルを統合し、人間の睡眠の包括的特徴を提供する。
異種PSG解析のためのセマンティックチャネル認識基盤モデルSemPSGを提案する。
睡眠時,睡眠時呼吸分析,疾患予測,認知・感情認識,人口統計など,睡眠時および健康関連タスクにおけるSemPSGの評価を行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:31:26 GMT)
Traverse: Learning When to Remember, Reset, and Redirect for Long-Horizon Web Search [34.6] エージェントが独自の検索プロセスを管理する自律型検索ハーネスを導入する。
エージェントはまず、有効な回答の基準を定義し、これらの基準の下で検索し、それから独立して結果を検証する。
さらに、アクティブなコンテキスト管理を可能にするシールメモリツールを備えている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:13:44 GMT)
Devils in Question Relay: Source-Conditioned Relay Steering to Mitigate Hallucinations in Audio-visual Large Language Models [34.5] 本稿では,質問リレーにおけるクロスモーダル干渉を緩和する学習自由度手法を提案する。
広く採用されている2つのベンチマークの実験では、SECRETはトレーニングなしの手法よりも一貫して優れていた。
モダリティ特異的キャプションはさらに、オープンエンドジェネレーションへの一般化性を示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:37:31 GMT)
Sharp Convergence and Sampling Trade-offs for Riemannian Diffusion under Nonnegative Ricci Curvature [34.4] ブラウン運動シミュレーションからスコアの離散化を分離する一般的なフレームワークを開発する。
この結果から,$tildeO(d/2)$スコアは目標分布から2ドルKLのばらつきを達成するのに十分であることがわかった。
さらに$tildeO(d4T/2)$ geodesic random-walk steps は、必要な漂流ブラウン運動を$$$の総変動誤差に近似するのに十分であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:50:27 GMT)
Point2Part: Unified 3D Partitioning from Point Prompts [33.3] 画像やメッシュから3次元部分分解を行うための高速モデルを開発した。
ユーザーは制御可能な分解のための3Dポイントプロンプトを通じて、所望のパーツを指定できる。
本稿では,全ての部分トークンに対して,全形状を粗い方法で共同でスコアリングする新しい部分デコーダを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:58 GMT)
World2Motion: Turning Video World Models into 3D Human Motion Generators [33.2] We present World2Motion, a framework that a scene-aware human motion and corresponding video from a single image and a text prompt。
この適応には、ペアビデオモーションデータの不足と、生成された動きにおける時間的不安定という2つの課題がある。
マルチソースインタラクションベンチマークの実験では、World2Motionは評価された3Dモーションジェネレータと比較して、テキストアライメントとシーンインタラクションが優れていることが示されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:30:04 GMT)
Examining Variation in How Guided AI Tutors Resolve Student Impasses [33.2] 20,462人の学生が指導的LLM化学チューターを用いて1,260の真正セッションから転向する様子を解析した。
我々は,概念的誤り,不確実性表現,ヘルプ検索の3つの主要なタイプの6,630個の不合理なターンを同定した。
分析を学習するためには、これらの発見は不適切な深さとタイプを観測可能なターンレベルの対話信号として識別する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:10:09 GMT)
FP2: Equipping Robotic Foundation Models with Force Control [32.3] 本稿では,タスク適応型RAMと明示的な力制御を備えた軽量インタフェースFP2を提案する。
実世界の4つのコンタクトリッチな操作タスクにまたがる4つのRAMバックボーンを用いたFP2の評価を行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:58:23 GMT)
Support-Set Target Leakage in Relational Foundation Models during In-Context Learning: Model Dependence and Evaluation Reliability [31.9] In-context- learning (ICL) では、ラベル付きサポート例とリンクされたリレーショナルコンテキストを使用して、新しいクエリのラベルを予測する。
これにより、ターゲットから派生した機能がサポートコンテキストに存在しているが、クエリでは利用できない場合、障害モードが生成される。
本研究では,13のRelBenchタスクと5つのリレーショナルICL構成にまたがって,この設定をサポートセットのターゲットリークとして検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:14:48 GMT)
Spatiotemporal Hyperedges for EEG Seizure Detection and Prediction [31.9] セイズーアは稀であり、時間的に局所化され、複数のチャネルにまたがる協調イベントとして伝播する。
最近のグラフニューラルネットワークは、時間ステップ毎のペアワイドチャネルエッジのシーケンス上で時間モデルを実行することによってこれをモデル化している。
我々は,脳波の証拠を時間的ソフトエッジの小さなセットを通して要約するHyBrainを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:53:14 GMT)
Beyond a single latent space: a dual-latent world model for long-horizon planning [31.3] 本稿では,局所実行と長距離計画を分離したDual-Latent World Model(Dual-WM)を紹介する。
低レベルモデルは行動条件の遷移を予測し、高レベルモデルは学習されたマクロアクションを使用して、より長い時間的スパンを計画する。
我々は,5つの目標条件付き視覚制御タスクに対して,アクター誘導による提案を伴わずに,タスクワイドなベースラインに対してDual-WMを評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:12:33 GMT)
Zero2Repo: Can Coding Agents Build Repositories from Scratch? [31.2] コーディングエージェントは、パッチをパッチするのではなく、ソフトウェアを構築するように求められている。
エージェントが製品要求文書、インターフェース契約、空のワークスペースを受信するベンチマークであるZero2Repoを紹介する。
タスクは言語に依存しないオーサリングパイプラインによって生成されます。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:10:23 GMT)
Dr. OPD: Learning What to Follow for Optimal On-Policy Distillation of Large Language Models [31.1] オンライン蒸留(OPD)は、より強い教師から密集したトークンレベルの監督を用いて、生徒を独自の反応で訓練する。
バニラOPDは全ての教師の信号を平等に扱い、教師の監督が全てのトークンに等しく重要であると仮定する。
我々は,学生のパフォーマンスを最大化するために,最適な重み付けOPDを定義するPD博士を紹介した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:07:00 GMT)
Rollout-Marginal Distillation for Long-Horizon Autoregressive Video Generation [31.1] オートレグレッシブ(AR)ビデオ拡散は低レイテンシでストリーミング可能なビデオ生成を可能にする。
自前のロールアウトでジェネレータを訓練すると、それを不完全な履歴として公開する。
RMD(Rollout-Marginal Distillation)は、より鮮明な視覚的品質の信号を提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:16:37 GMT)
Message Passing Does More with Less for In-Context Learning on Graphs [31.1] スパースメッセージパッシング上に構築された新しいグラフ・イン・コンテキスト学習ツールであるEphrisを紹介する。
51ノード分類データセットのEphrisを、15の広範囲に調整されたGNNと既存のグラフICL法に対して評価した。
推論コストは、以前のグラフICLモデルよりも10倍以上高速で、1つのGNNのトレーニングに匹敵する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:59:16 GMT)
EgoAlign: Bridging the Human-Humanoid Gap for Long-Range Loco-Manipulation [30.8] EgoAlignは、エゴセントリックな人間のデモをアクションに変換し、汎用的で連続的なボディコントローラと互換性のある状態の監視を行う。
上半身の相互作用の幾何に適応しながら、視覚的にガイドされた周期的なステップの参照を保存する。
最終因果リプレイは、人間の観察によるトレーニングのための対応するロボット状態とモーション・トーケン・ラベルを再構成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:18:42 GMT)
Rho: A Foundation for Efficiently Adaptable VLA Models [30.8] 汎用的な物理AIモデルは、広義の視覚的および言語的能力とロボットの体現物間の正確な制御を組み合わせなければならない。
Rhoは、データライトタスク適応用に設計されたバイマニュアル操作のためのオープンウェイトVLAモデルのファミリーである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:28 GMT)
CyberPersistBench: Evaluating LLM-Based Cyber Attackers on Installation and Persistence [26.7] 私たちはCyberPersistBenchを紹介します。
ベンチマークには7つのカテゴリにわたる203のコアタスクが含まれており、マルチホストとアクティブディフェンス拡張によって強化されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:52:18 GMT)
Replay the Curvature: Accurate and Scalable NVFP4 Quantization for Large Language Model Inference [26.7] 本稿では,各ブロックスケールによるGPTQ更新を再現し,不定格列からの補償を考慮した結果のブロックエラーをスコアするスケール選択であるemphSchur Replayを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:55:29 GMT)
In-context Robot Learning Made Simple: A Democratized Recipe for Manipulation Tasks [26.6] 我々は、ロボットが視覚的なデモンストレーションからタスクを推論し実行できるようにする新しいパラダイムである、ロボット・イン・コンテキスト・ラーニング(ICL)について研究する。
本研究ではまず,ロボットICLの学習目標を明確に定義した明確な問題定義を提供する。
我々は,ビジュアルプロンプトエンコーダと低コストなデータ収集プロトコルを備えた,最小限かつ再現可能なICLフレームワークを開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:45 GMT)
NeurDuo-EEG: A Long-Sequence EEG Foundation Model with Persistent State and Explicit Memory [26.4] チャネル解決型永続メモリを用いた因果脳波基礎モデルNeurDuo-EEGを提案する。
離散スペクトルコードのマルチチャネルオートレ予測を用いて、17の公開データセットから3,955時間分の脳波を事前訓練する。
3つのショートウィンドウタスクとアセプション検出を含む5つのベンチマークのうち、最高のパフォーマンスを実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:46:11 GMT)
Explore Broadly, Reason Sharply: Push Small Models toward the Frontier via Sampling [26.3] textbfParallel Power Tempering (PPT)を導入する。
異なるシャープ化レベルで複数の共振レプリカを並列に実行することで、低消費電力レプリカは多様な推論軌道を探索することができる。
実験により, 単鎖型パワースハーペンドサンプリングを著しく改善し, RL-ポストトレーニングモデルより優れた性能を示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:45:43 GMT)
Prefill-Free Cross-Family KV Cache Transfer for Heterogeneous Multi-Agent LLMs [26.3] テキストベースの通信では、受信側は送信者がすでに処理している共有コンテキストをプリフィルする必要がある。
HeteroFoldはプリフィルフリーのクロスファミリーKVキャッシュ転送方式で、送信側と受信側の両方を凍結させる。
HeteroFoldは、4つの長いコンテキストベンチマークと最も短いコンテキスト設定で最高のキャッシュ転送性能を達成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:41:30 GMT)
TriO: Tri-Modal Unsupervised Occupancy World Model for Anything Perception [26.3] 我々は,4次元占有,障害物分割,流れ,LiDARを予測するマルチモーダル非教師付き世界モデルTriOを提案する。
以前の研究とは対照的に、TriOは3つの異なるセンサーモード(カメラ、LiDAR、RADAR)をセルフスーパービジョンの入力とソースの両方に使用している。
TriOは、占有、フロー、LiDAR予測を含む複数の3Dおよび4Dタスクの最先端結果と、複数のデータセットにわたるゼロショット道路障害物セグメンテーションを実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:40:18 GMT)
StereoGaussians: Feed-Forward 3D Gaussian Splatting from Stereo Images [26.3] StereoGaussianは、単一のキャリブレーションされたステレオペアからメートル法3DGS表現を予測する。
トレーニングのために,高品質な3DGS教師からSceneSplat-Stereoを構築し,ステレオ入力と近くのターゲットビューとのペアリングを行う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:51:37 GMT)
Challenges and Solutions for Bandits in the Wild: Warm-Started Mixture Bandits for Cross-Cohort Slate Recommendation [26.2] 本稿では,従来のコホートから潜伏したユーザグループを学習し,新しいユーザのためのグループインフォームドプリエントを構築するために利用可能なメタデータを利用する,ウォームスタートミキシングバンディットを提案する。
シミュレーション,半合成実験,および713名の登録参加者による25日間のランダム化内配置によるCohortMix-TSの評価を行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:23:06 GMT)
Graph-Spectral Flow Matching for Multivariate Time Series Anomaly Detection [26.2] 多変量時系列異常検出のためのグラフスペクトルパスを持つフローマッチングフレームワークGRASPを提案する。
通常のデータに基づいてトレーニングされた速度予測器は、ソースサンプル、フロー時間、グラフ周波数の重み付き速度差を用いて異常を検出する。
4つのベンチマークの実験では、GRASPの優れた異常検出性能が示されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:40:02 GMT)
Collision-Aware and Observation-Aligned Object-Centric Scene Reconstruction from Point Cloud [26.0] COOLは、Collision-Aware and Observation-ALigned Restructionのフレームワークである。
3D-FrontとScan2CADの実験は、強いシーンレベルの忠実度、観察アライメント、衝突低減を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:10:43 GMT)
Does This Action Still Explain the Task? Reverse Scoring for Diffusion Language Model Agents [25.9] 拡散ベースの大規模言語モデル(dLLM)は、並列デコーディングを通じて自動回帰エージェントのシーケンシャル遅延ボトルネックを壊すことを約束する。
最近の評価では、この効率はエンボディード・エージェント・コンピテンスに移行しない。
我々は、この失敗とトレーニングなしの治療法について、機械学的に説明します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:54:04 GMT)
Mixture of Self-Improving Branches For Agent Harness Optimization [25.9] Meta-Harnessのような最近の研究は反復的なコード生成と評価を実装しているが、固定された開発セットと提案ポリシーを維持している。
我々は、開発サブセットと提案ポリシーを進化させたブランチに探索を整理することで、改善プロセス自体を適応させる。
本システムでは,オリンピアードレベルの数学的推論では34.8%,ターミナルベンチ2.0では11.6%,SWEベンチライトでは3.8%,メタハーネスでは34.8%の相対的な改善を実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:37:38 GMT)
From Learner Behavior to Reusable Skills for Effective and Efficient Learner Simulation [25.9] 学習者シミュレーションは、特定の学習者が新しいタスクに対してどのように振る舞うかを再現することを目的としている。
既存のアプローチでは、学習者を再構築するために、成長するインタラクション履歴を繰り返す必要があることが多い。
本稿では,過去のインタラクションから得られたシミュレーション機能を,永続的で再利用可能なスキルシミュレーションに外部化するLearner2Skillを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:47:57 GMT)
RepoMAS: Solving Progressively Specified Tasks with Issue-Driven Multi-Agent Systems [25.8] 実際には、ユーザ要求はしばしば不完全であり、追加の要件は推論やツールの使用、実行時にのみ明確になる可能性がある。
初期要求で明示された要求に対して最終的な出力を評価するベンチマークであるProgSpecを紹介する。
本稿では,オープンソースのプロジェクト管理にインスパイアされた課題駆動型マルチエージェントフレームワークであるRepoMASを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:06:13 GMT)
When Is Coarse Supervision Worth It? Cost-Aware Learning under Unknown Aggregation [25.7] 高価な細粒度ラベルがベクトル応答を示し、安価な粗いラベルが未知の重みで形成されたスカラーアグリゲーションを明らかにするコスト認識型学習について検討した。
課題は、粗いデータを識別できる方向が未知の集合体に変化するため、粗い監視の値はコスト、ノイズ、識別に共同で依存する。
我々は,アグリゲーションルールを学習し,最適解の混合を追跡する推定と追跡のポリシーを開発する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:42:26 GMT)
Beyond Sub-Gaussian Detector Scores: Robust Weighted Profile-Loss Change Point Detection for Human-LLM Text Segmentation [25.7] 人-LLMの混合文書は、テキスト単位によって信頼性が異なる検出器スコアから著者の遷移を特定する必要がある。
既存の重み付き平均コントラストは極端なスコアに弱いが、手段を直接ロバストな中心に置き換えることによって、人口目標がどう変化するかは明らかでない。
本稿では、カプセル化された信頼性重み、ハマープロファイルゲイン、信頼性座標における最短閾値探索を組み合わせたRobust Weighted Profile-Loss Change Point Detection (RWCP)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:17:27 GMT)
When Updating Stops Being Learning: Rethinking LLM Self-Evolution via learnable information gain [24.8] 自己進化(Self-evolution)は、大規模な言語モデル(LLM)を自身の生成されたデータを使って反復的に改善するが、多くの場合、自己進化の退化に悩まされる。
本稿では,学習可能な情報ゲインに基づく総合的枠組みを提案し,前回のラウンドと比較して,ラウンドがどれだけ斬新でパラメータ化可能な情報を提供するかを測定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:27:47 GMT)
Gap-free Differentially Private PCA for Gaussian Data [24.8] ガウスデータを用いた主成分分析(PCA)問題に対して,ギャップフリーな$(,)$-differentially privateアルゴリズムを提案する。
このアルゴリズムは、電力反復法のプライベートな変種に基づいており、計算的に効率的である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:19:51 GMT)
Multidimensional Observer Model and Perceptual Dimensions of Human Image Quality Assessment [24.6] 本稿では,人間の画像品質判断の基礎となる知覚空間を理解するための枠組みを提案する。
このモデルを用いて、人間の画像品質判断に要する知覚空間は、画像空間と比較して非常に低次元であることが判明した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:15:15 GMT)
GazeFlow: From Human Gaze Behavior to Generative Egocentric Gaze Prediction [24.6] 本稿では,トップダウン情報とボトムアップ情報の両方に基づいて,視線を時間的視線位置の同時分布としてモデル化するフレームワークであるGazeFlowを紹介する。
標準的なデータセットでは、GazeFlowはフレーム単位のメトリクスで最先端のパフォーマンスを実現し、生成されたトラジェクトリは人間の視線時間ダイナミクスとよく一致している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:39:25 GMT)
FocusVTC: Efficient and High-Performance Visual Text Compression with Adaptive Resolution [24.6] ビジュアルテキスト圧縮(VTC)は、テキストを画像としてレンダリングすることで入力長を削減するが、固定解像度レンダリングは圧縮性能のトレードオフを生み出す。
一般的なマルチモーダル能力を保ちながら、適応分解によってこのトレードオフを断ち切るFocusVTCを導入する。
RULER v1の72 DPIでは、FocusVTCは入力圧縮で87.4ドル、ツールの観察を含む入力圧縮で57.5ドル、Glyphは3.0時間で入力圧縮で57.5ドルである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:51:06 GMT)
Where Does Staleness Accumulate? Pool Aware Effective Staleness Control for Asynchronous RL in LLM Post-Training [23.7] 我々は,ラグが軌道の生涯にわたってどのように蓄積するか,また非同期実行によるウォールクロックの利点を犠牲にすることなく,どのように制御できるかを検討する。
PACE (Pool-Aware Control of Effective Staleness) を導入する。
PACEは、過剰プール占有率を適応的拒絶予算に変換し、有効安定度スコアを用いて軌道の完成度をランク付けする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:38:31 GMT)
Emergent Specialization in Populations of Self-Supervised Collaborative Vision Experts Without a Shared Gate or Cross-Agent Gradients [23.7] 我々は、各ネットワークが独自の重みを持ち、同じ異種データで独立にトレーニングし、他のエージェントに助けを求めることができる環境について研究する。
共同で訓練されたゲートが専門家に入力を割り当てる専門家の混合物とは異なり、ここでの専門化は中央制御なしで行う必要がある。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:43:04 GMT)
Scaling Zero-Order Pretraining through Model Sharding [23.7] ゼロオーダー最適化(ZO)はバックプロパゲーションのない列車であり、前方のみのハードウェアと非微分不能な損失に関係している。
SOMAは、同時摂動近似を使用して、N$のデータクラスタ上でLSTM専門家を独立に訓練する。
テスト対象のモノリシックなZO制御に対して,モデム推論によりトレーニング計算効率が向上することを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:00:23 GMT)
Probe-Space Preconditioning for Fast and Stable Zero-Order Training [23.7] バックプロパゲーションはディープラーニングを支配しているが、大量のメモリ税を課している。
計算予算を多くのステップから大規模なバッチサイズに再配置することで、1SPSAがゼロオーダー法を上回り得ることを示す。
また、1.5-SPSAを導入し、1ステップごとに1SPSAを開梱し、プローブ空間における安価な対角前条件を計算する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:43:53 GMT)
Storage Is Not Strategy: State-Conditioned Support Control for LLM Unlearning [23.7] ローカライズされた大言語モデル(LLM)アンラーニング手法は、ローカライズ信号から小さなパラメータサブセットを選択し、最適化中にそれを固定し続ける。
我々は、実際の未学習更新の予測効果によって編集可能なグループをランク付けするインターベンションスコアを導入する。
次に、選択的動的介入再分類(DIR-R)を導入し、記述的プローブが比較を正当化するときにのみその部分集合を再検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:44:42 GMT)
VStress: Correlation-Aware Auditing and Adaptive Budget Allocation for Repeated Verifiers [23.6] オーディエンス可能なリプレイ契約であるVStressと,相関を考慮したアロケーションポリシであるVStress-CAを紹介する。
VStressは、シールされたキャリブレーション分割上の未クエリ検証者の条件境界情報を推定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:59:03 GMT)
How does Adversarial Influence Scale in Multi-Agent Systems? [23.4] 本研究は,集団の規模が拡大し,習熟者が普及するにつれて,詐欺に対する感受性がいかにスケールするかを考察する。
欠陥率, 当初正しいエージェントが不正確な最終回答に切り替える頻度は, この割合で直線的に上昇する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:55:50 GMT)
Differentiable Structure Learning for Cyclic Linear Gaussian Models with Latent Confounders [23.4] 線形構造因果モデルにおける観測データから因果構造を学習する。
対数スケールの複雑性ペナルティを持つガウス陰性対数ライクフードの最小化として構造学習を定式化する。
実験結果から, 本手法は, いくつかの実験環境において, 従来手法よりも低い回復誤差を達成できることがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:22:21 GMT)
AquaMend: Minimal Re-probing and Conditional Rollback for Latent-Belief Failures in Embodied Agents [23.3] AquaMendは、re-probing, rollback, Support continuation on a probe-belief-action graphの比較を行う。
ジョイント後部は条件検出パワースクリーニングによるワンステップポリシーを導出する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:05:11 GMT)
WeLike2Party! In-Context Motion Transfer for Multi-Human Image Animation [23.3] 例えば2Partyは、推論時に明示的なポーズやメッシュ抽出をせずに、直接コンテキスト内ビデオコンディショニング上に構築されています。
クロスアイデンティティ・トレーニングを支援するため,14.4Kのクロスアイデンティティ・ビデオ・ペアからなる大規模合成データセットであるMotionTwinを構築した。
MotionTwin-Benchと実世界のビデオの実験では、WeLike2Partyは、被写体レベルの視覚的忠実さ、アイデンティティー・モーション・バインディング、全体的な知覚品質において、最近の最先端の手法よりも優れていた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:50:05 GMT)
Which Models Work Well Together? Measuring Heterogeneity for LLM Team Selection [23.3] 2つの相補的な信号とともに、個々の能力を特徴付けるオフラインプロファイリングを行うチーム選択フレームワークを提案する。
我々は、チーム選択を標準化された品質補完目標として定式化し、候補プールから小さなチームを選択するために効率的な探索を適用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:30:53 GMT)
Beyond Low-Rank Parameterization: Narrowing the Gap Between LoRA and Full Fine-Tuning via Gradient Decomposition [23.2] Low-Rank Adaptation (LoRA)はパラメータ効率細調整(PEFT)に広く用いられている手法である
GDLoRAは前方アクティベーションと後方信号から全重量勾配を再構築し、通常の成分を抽出し、この成分でベース重量を直接更新する。
自然言語理解、数学的推論、常識推論、画像分類の実験は、GDLoRAが一貫してLoRAよりも改善し、FFTのパフォーマンスギャップを狭めることを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:42:17 GMT)
A Benchmark & Dataset for Detecting AI-Manipulated Visual Evidence in the Court System [23.1] 我々は,CIFAR Synthetic Evidence for Detectioning AI-Manipulated Images, a benchmark for obviousiary image authentication in court and Justice-system contextsを紹介する。
コーパスには、1,505個の写真アイテムが含まれており、720個の認証コントロールと、785個の操作済みまたは製造された画像、監視、ダッシュカム、および消費者写真にまたがる。マニピュレーションは、シーン条件の編集、局所要素の編集、および現代生成システムで生成された完全な製造で構成されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:17:16 GMT)
E2E-SWE: Benchmarking LLMs on Building Working Codebases from Scratch [22.7] コーディングエージェントが完全に機能するソフトウェアリポジトリをエンドツーエンドに構築できるかどうかを評価するベンチマークであるE2E-SWEを紹介する。
E2E-SWEは、11のプログラミング言語にまたがる186のリポジトリ生成タスクを含んでいる。
Pass@1は11.7%から67.7%の範囲である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:02:25 GMT)
Representation Dynamics Reveal Semantic Saliency and Similarity for Visual Token Pruning in MLLMs [22.7] エンコーダ奥行きの視覚的トークン表現ダイナミクスを解析する。
そこで我々は,MSDG-Pruneを提案する。MSDG-Pruneは,高度で多様な視覚情報を保存するために,更新度と方向を利用する訓練不要の手法である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:37:24 GMT)
NHO: A Neural Hamiltonian Operator for Anchor-based Region Localization and Dense Correspondance [22.6] NHOは、局所固有空間が高密度対応のための領域サポートと内在座標の両方を符号化する神経ハミルトニアン作用素を学習する。
実験では、タスクとロバスト性の両方において、均一なスケーリングとローテーションの競合精度を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:55:26 GMT)
Halluscoring 2026: The first shared task on llms hallucination detection and answer verification [22.3] 本稿では,アラビア語質問応答における幻覚検出と事実検証の共有タスクを提案する。
合計13チームがこのタスクに参加し、そのうち10チームがシステム説明書を提出した。
その結果, 分布シフト下での幻覚検出は依然として困難であることが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:18:18 GMT)
Reliability Testing of Medical Model Performance under Distributed Deployment [22.1] 本稿では,テストフレームワークと分散実行に敏感な医療モデルベンチマークを提案する。
言語、ビジョン、マルチモーダル医療モデルにわたる実験は、実行の変化が測定可能な出力の不一致をもたらすことを示している。
このベンチマークは、医療モデルの評価を能力とセキュリティから評価・デプロイの一貫性まで拡張することを目的としている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:14:18 GMT)
Stochastic World Models for Verifying Vision-Based Neural Feedback Systems [22.1] 我々は、標準検証器がバウンドする操作から構築された、物理的に接地されたラテントを持つ世界モデルを訓練する。
我々は、ファルシフィケーション、適応的洗練、象徴的、後方的分析を組み合わせた手順を開発する。
GANサロゲートによる緊急ブレーキベンチマークでは、我々の手順は、最先端の検証者が未解決のまま残した状態空間全体を解決する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:50:40 GMT)
From Scores to Samples: Elastic Forcing for Autoregressive Video Generation [21.8] 分散マッチング蒸留(DMD)を利用した数ステップ自動回帰ビデオ生成
我々は、参照ビデオから直接ロールアウト分布を学習し、ポストトレーニング中の両方のスコアモデルを排除した。
我々のフレームワークは、凍結した自己教師付きビデオ表現空間における最大平均不一致(MMD)を最小限に抑える。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:22:32 GMT)
Learning from synthetic photorealistic raindrop for single image raindrop removal [21.8] 本研究は,合成雨滴のフォトリアリスティックデータセットをトレーニング用として提案する。
レンダリングは、水力学、幾何学、および光度測定を考慮した物理である。
雨滴画像のモデリングに基づいて,雨滴屈折の認識とぼやけを検知するネットワークを導入する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:48:00 GMT)
Actions with Receipts: Jointly Binding Claims, Evidence, and Execution for Replayable Tool-Agent Auditing [21.8] 我々は,発行されたクレーム,その正確なソーススパン,生成した順序付き実行プレフィックス,その実行によって観測されたソースバージョンとアクセス状態とを共同で結合するクレームアンコール実行契約を導入する。
1,280回のクロスオブジェクト攻撃で、ジョイントコントラクトは1,275置換(0.9961)を検出する
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:36:16 GMT)
Learning to Prove, Not Just to Answer: Reinforcement Learning from Formal Verification for Natural-Language Logical Reasoning [21.8] 自然言語の論理的推論では、中間的な結論はその前提から従うべきであり、結果の導出は最終的な答えを支持するべきである。
既存の方法には、中間的な結論と回答をサポートする証明依存関係のマシンチェック可能な検証が欠如している。
本稿では,LLMを学習し,自然言語論理的推論の検証可能な証明を構築するための形式検証からRLフレームワークProof-R1を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:21:32 GMT)
The Safety Operator: Modulating the Expression of Safety Instructions via Spectral Optimization [21.6] 変換言語モデルにおけるコンテキストトークンは、乗法演算子としてモデルの重みに吸収される。
安全命令の設定において、この演算子について検討し、その支配的固有値に影響を与えることは、その命令がいかに強く生成するかを変調することを示す。
有害なクエリに対する安全性の指示を強調しつつ、有害なクエリに対する安全性の指示を抑えながら、トレードオフを抑えるための抑制重み付きコントラスト安全損失を導出する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:51:52 GMT)
LongSpark: Efficient speculative decoding with a fixed-cost parallel drafter [21.5] LongSparkは、複数のモデルスケールにわたる最先端のエンドツーエンド効率を達成する、ブロック拡散ドラフトラである。
長いコンテキストタスクに対して最小の時間単位のコンテキストを提供すると同時に、ドラフトアのコンテキスト状態を桁違いに削減します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:42:58 GMT)
Adam under Generalized Smoothness with Second-Moment-Type Stochastic Gradients [21.5] アダムは、目的が大域的な滑らかさから著しく逸脱した場合でも安定な状態にあることが広く観察されている。
本稿では,比較的一般的な条件下で肯定的な回答を与える。
高確率収束率を全範囲$p2$で保証し、信頼度は$-1/2$とする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:19:40 GMT)
Calibrate the Decisions That Change the Future: On-Policy Post-Training Quantization for Multimodal Large Language Models [21.3] トレーニング後の量子化(PTQ)デプロイメントは、大規模言語モデルのデプロイメントコストを低減します。
OnPTQは,現行の定量化政策によるトラジェクトリの校正を行うオンラインフレームワークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:37:48 GMT)
V2X-WAM: A Cooperative World Action Model for End-to-End Autonomous Driving [21.1] V2X-WAMは、協調シーン、アクション生成、未来の推論を密に結合する協調世界行動モデルである。
V2X-WAMは、代表的エンドツーエンド協調運転法よりも計画精度と安全性を一貫して改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:20:07 GMT)
PrivMeSA: Privacy-Aware Self-Evolving Multi-Agent System for Medicine via Local-Remote LLM Collaboration [21.1] PrivMeSAはプライバシーを意識したマルチエージェントシステムで、情報開示を制御し、ローカルな再利用のためにリモートの専門知識を保持する。
MIMIC-IV-EDレコードから構築された緊急時処理のベンチマークでは、PrivMeSAはデリゲートよりも平均タスク精度を最大15.8ポイント改善している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:47:38 GMT)
Generalizable Lifelong Model Editing via Preference Optimization [21.1] 本稿では,知識編集と選好最適化を組み合わせたGLIME(Generalizable Lifelong Model Editing)を提案する。
実験の結果,GLIMEは,編集性能と汎用性の両方を維持しつつ,生涯編集設定における知識の一般化を著しく改善することがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:19:52 GMT)
Remember What You Did: Action-History Memory with Dual-Expert Denoising for Long-Horizon Vision-Language-Action Policies [21.1] ActMem-VLAは、Mambaベースのメモリモジュールと軽量PreAction Expert (PAE)からなるメモリプラグインで、凍結した微調整のVLAを増強する。
LIBERO-Memでは、ActMem-VLAは10タスクで平均80.8%、MemoryVLAでは65.2%、メモリVLAでは49.5%、追加パラメータは3.45%となっている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:43:19 GMT)
Scaling Full Conformal Image Classifiers [21.0] コンフォーマル予測は、分布のないカバレッジを保証するセット値予測を提供する。
完全共形予測(FCP)は、テスト時に候補固有のモデル修正を必要とするため、大規模に計算的に禁止される。
本稿では,軽量な帰納的共形予測器を用いてラベルを推定するTargeted Full Conformal Prediction (T-FCP)を紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:37:24 GMT)
Affordance-Conditioned Decision Making: Bridging the Semantic-Spatial Gap in Zero-Shot Cross-Floor Vision-and-Language Navigation [21.0] PACEは教師付きローカル実行モジュールで、信頼性の高いクロスフロアナビゲーションのためのフリーズゼロショットセマンティックプランナーを拡張している。
PACEはトランジッション関連のセマンティクスを、長い水平でエージェント中心の可読なポーズに基礎を置いている。
我々はR2R-CEとRxR-CEのクロスフロア部分集合に対する一貫した改善を示し、平均成功率は16.35%から27.65%に増加した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:34:23 GMT)
OptiCom : A Unified Framework for State-Conditioned Composition in LLM-Driven Optimization [20.7] 大規模言語モデル(LLM)は、反復最適化によって複雑な科学的および実践的な問題を解決するために、ますます多くデプロイされている。
共有構成空間内でLLM駆動を表現する統一フレームワークOptiComを提案する。
評価された14の構成のうち,OptiComの平均マックススコアランクは1.72であり,23グループでトップスコアを確保できた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:38:06 GMT)
World4Scorer: Outcome-Grounded World Modeling for Autonomous Driving [20.7] 軌道条件付きJEPA型予測器としてスコアラーを構築するWorld4Scorerを紹介する。
World4Scorerは、最先端のNAVSIM-v2性能を実現し、クローズループのBench2Drive上での強力な適応システムを実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:55:12 GMT)
MotorMind: Scaffolding General Vision Language Models for Zero-Shot Robot Manipulation [20.6] 我々は,VLMが提案する中間レベル動作を決定論的ロボット制御とフィードバックに接続するロボット操作ハーネスであるMotorMindを紹介する。
SAM3のようなタスク固有のポリシートレーニングやコーディングエージェント、その他の基盤ツールがなければ、MotorMindはベースとなるLIBERO-PROスイートで66.7%、摂動下で53.8%の成功を収める。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:36:40 GMT)
Achieving an $O(1/N)$ Optimality Gap in Average-Reward Weakly-Coupled MDPs [20.6] We study average-reward weak-upupled Markov decision process (WCMDPs)。
アームが同一のモデルパラメータ、複数のアクション、状態依存と行動依存のコストを持つような設定について検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:53:39 GMT)
Normalize-Then-Precondition: A Hierarchical Approach to Marginal Scale and Interaction Geometry for LLM Training [20.6] マトリックスのイテレーションは有望な方向性として現れ、Muonは目立った設計として際立っている。
我々は,Muonが共同で限界スケールと相互作用情報を処理しているのを観察する。
これにより、幾何学的情報を階層的に整理する別の方法が開かれ、正規化-Then-Preconditionフレームワークを動機付けている。
NormPre-G と NormPre-L を併用した NormPre を開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:32:28 GMT)
Asking for What Was Never Requested: Horizontal and Vertical Proactivity in Agents [20.1] 我々はエージェントがどのような情報を追求すべきかではなく、エージェントが単独で行動すべきかどうかを調査する。
本稿では,質問者に対して,要求された証拠をより多く回収する質問を行うことを推奨するQ&D(クエストとドラフト)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:54:01 GMT)
MetaCtrl: Your Large Language Models Can Reason Better and More Concisely with a Metacognitive Controller [20.1] トークン予算や推論の再トレーニングを必要とせず,凍結推論を適応的に制御する軽量コントローラであるMetaCtrlを紹介する。
数学、科学、コードにまたがる7つのベンチマークにおいて、MetaCtrlは推論長を減らしながらLRMの精度を一貫して改善している。
これらの結果は,推論時間生成を大幅に削減しつつ,推論精度を向上させるためのプラグアンドプレイコントローラとしてMetaCtrlを確立する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:41:17 GMT)
Pointwise or Pairwise: When Do Pairwise Losses Help Reward Learning, Provably? [20.0] ポイントワイズ報酬が観測されたとしても、報酬学習にはペアワイズ損失がますます使用される。
我々は、この質問を、コンテキスト毎に複数のアクションを許容するグループ化されたオフラインコンテキスト帯域設定で研究する。
我々は、報酬をポイントワイズで観察する値回帰(VR)と、同じコンテキスト下でサンプリングされたアクションのペア間の報酬差を回帰する値差回帰(VDR)を比較した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:28:12 GMT)
HELIX: Purified and Unified - Rethinking Feature Interaction and Sequence Modeling for Large-Scale Recommendation [19.8] 大規模レコメンデーションのための浄化・統一アーキテクチャであるHELIXを提案する。
Helixは、オフラインのCTR AUC、CVR AUC、その他のランキングメトリクスを継続的に改善している。
オンラインA/Bテストでは、ユーザ当たりのEコマースビデオGMVが約6%増加した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:06:26 GMT)
CRJudgeBench: Can AI Detect Plausible but Invalid Code Reviews? [19.8] 大規模な言語モデルは、もっともらしいコードレビューコメントを生成することができるが、そのようなコメントには、開発者を誤解させる技術的に誤った主張が含まれているかもしれない。
レビューコメントの中核的な技術的主張が正しいかどうかを判断し、レビューされたコードをリポジトリのコンテキストで適用する。
既存のコードレビューベンチマークは、主にレビュー生成、イシュー発見、一般的なコメント品質を評価する。
CRJudgeBenchは、実際のプルリクエストと専門家が検証した摂動から構築された1199インスタンスのベンチマークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:31:16 GMT)
FORM: Robot Manipulation through Direct Material Law Identification [19.7] 本稿では,単一ロボットの相互作用から材料特性を識別する FORM (From Observed Response to Material Law) を提案する。
我々は、観測された物質運動と接触力とを未知の物質パラメータの線形方程式に変換するために弱い形状の運動量バランスを用いる。
本研究は, 弾性棒挿入, 弾性クラブ付ゴルフパッティング, 弾塑性成形, ターゲット体積注入の4つの操作課題において, シミュレーションおよびハードウェア上でのアプローチを実証する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:46:40 GMT)
Loss-Guided Pretraining Data Selection for Time-Series Foundation Models [19.6] 時系列基礎モデル(TSFM)は、数十億の観測を含む異種コレクションに事前訓練されている。
静的なデータ選択フレームワークを導入し、各ウィンドウを基準予測器でスコアし、各ソースデータセットに中間間隔を保持する。
次に、基準損失スコアを定義し、サンプルの多様性を維持するためにデータセット階層化選択を適用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:08:45 GMT)
Learned Reporting Preferences in RLVR Can Conflict with the Current Request [19.5] 我々は2つの報告規約の下で政策を訓練し、それぞれの政策を現在の両方の要求の下で評価する。
ボックス式RLVRは要求されたハッシュフォーマットペイロードを含むQwen2.5-7B応答の割合を35.33~74.37ポイント削減する。
教師付きターゲットにおける最終回答マーカーだけを変更すると、モデルが3つのシードで好むレポートの規則が逆転する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:05:29 GMT)
From Checkpoint Variation to Selection Gains in Supervised Fine-Tuning [19.5] チェックポイントの選択は教師付き微調整において日常的な決定である。
我々は、追加の検証データの改善、負のログ類似度(NLL)選択の獲得、最終チェックポイントの獲得を計測する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:50:57 GMT)
Honeycomb: Constant-Size Scene Memory Representation for Video World Models [19.5] ビデオワールドモデルは、長期ビデオ生成時の一貫性を維持するためにシーンメモリを必要とする。
We introduced **Honeycomb*, a video world model built on HexMemory**, a compact low-rank representation that stored features in a fixed-size memory。
WorldScoreとRealEstate10Kの実験は、以前に観測された領域を再検討する際に、強力なビデオ生成品質と堅牢な一貫性を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:33:39 GMT)
Unified Visual-Tactile-Action Modeling from Human Demonstrations for Dexterous Manipulation [19.5] 有害な操作には触覚フィードバックが必要である。
人間のデモは、多様な触覚インタラクションのよりスケーラブルなソースを提供する。
我々は、人間の触覚データを活用して、巧妙な操作ポリシーを改善します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:47:09 GMT)
Real2Gym: Building Gyms from Videos, Bringing Skills to Robots [19.4] 我々はReal2Gymを紹介した。Real2Sim2Realフレームワークは人間とロボットのデモをインタラクティブなシミュレーションジムに変える。
Real2Simモジュールは編集可能なシーンを再構築し、オブジェクトとカメラを入力に合わせる。
これらの環境では、エージェントは操作段階の実行可能なコードを生成し、結果を観察し、成功した試行と失敗を再利用可能なタスク手順に蒸留する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:16:49 GMT)
Probability is Not Enough: Exploring and Counting Divergent Tokens for Reasoning Uncertainty Quantification in LLMs [19.3] 大規模言語モデルの信頼性を推定する現在の手法は、一般に選択されたキートークンの確率に基づいている。
2つのモデルが強く反対するトークンを数えることによって信頼性を推定するフレームワークであるDivergent Token Confidence(DTC)を紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:33:36 GMT)
SimTrace: Grounded Multimodal User Trajectories Generation for Online User Modeling [19.3] SimTraceは、コンピュータ使用のクライアントエージェントを通じて、忠実できめ細かな合成マルチモーダルクリックストリームを生成するフレームワークである。
SimTraceは実際のインタラクションを匿名化し、与えられたWeb環境のシミュレートされたツインを構築する。
我々は、SimTraceをeコマース環境に適用し、その忠実度と下流ユーティリティの両方を評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:53:23 GMT)
Similar Choices, Different Attention: Cross-Modal Associations in Humans and Vision-Language Models [19.1] クロスモーダルアソシエーション(英: cross-modal association)は、モダリティにまたがる機能の体系的なペアリングである。
我々は、視覚言語モデル(VLM)が、選択するだけでなく、選択する際の見地においても人間と一致しているかを問う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:33:56 GMT)
Neural Constitutive Learning for Generalized Reaction-Diffusion Systems [18.9] 一般化された神経拡散系は、様々な輸送機構と結合した反応軌道を含む。
PDEソルバにとっての中心的な問題は、共通インターフェースが位相場と縮退輸送、局所反応、多種の結合に対応できるように、何を学ぶべきかである。
共用MCTインテグレータにおいて時間的進化を維持しながらPDE固有の応答を学習するニューラルコンストラクティブ法-マス圧縮-トランスポート(NCL-MCT)ソルバを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:27:31 GMT)
On the Off-Policy Teacher in On-Policy Distillation [18.9] SCOUT(Student-Conditioned Updates of the Teacher)は、教師を学生が作成したプレフィックスに適応させる学習フレームワークである。
SCOUTは,学生が生成した接頭辞から継続する教師の能力を向上し,学生条件の教師適応の意図したメカニズムを支持する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:22:05 GMT)
GLASS: Global Latent Aggregation with Slot-based Set Decoding for Scalable All-Atom Crystal Generation [18.9] 我々は、置換不変なグローバル潜在空間の構造を符号化し、フローマッチングによりそれらの分布を学習するGLASSを紹介する。
MP20では、GLASSは粒子空間モデルと競合し、フロートレーニングは各構造サイズでのトレーニングデータの妥当性に達する。
QMOFサブセットでは、GLASSは構築ブロック、トポロジー、組成を条件にすることなく、単位セル当たり150原子のMOFを生成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:48:41 GMT)
Train Ahead, Distill Back: Bootstrapping On-Policy Self-Distillation for Large Language Models [18.9] オンラインの自己蒸留は、特権情報を持つ自己教育者が、モデル自身の軌道に密集したトークンレベルの監督を与えることによって、大きな言語モデルを改善する。
既存の方法は通常、現在の、初期またはゆっくりと平均化されたポリシー状態から自己教育者を構築する。
モデル自体の最適化の進捗を、より強力な自己学習者へとリサイクルできるかどうかを問う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:35:50 GMT)
Think Before You Score: Thinking Reward Model for Visual Generation [18.8] シンキング・リワード・モデル(TRM)は、ケース適応型ルーブリックを定式化し、ルーブリック誘導評価を行い、きめ細かいポイントワイド報酬を生成する。
画像生成および編集報酬モデルベンチマークの実験により、TRMはオープンソース報酬モデルの中で最先端のパフォーマンスを達成することを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:28:00 GMT)
Behavioral Capacity Certificates for Quantized Language Models [18.6] 行動能力証明書(BCC)は、完全な実装の前の総量を用いて行動に課金する。
BCCは3段階のデプロイメントワークフローをサポートします。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:55:30 GMT)
LongHarness Bench: Stress-Testing Language Model Harnesses for Long-Context Reasoning [18.6] 本稿では,長文ハーネスの有効性と有効性を評価するためのベンチマークを提案する。
我々は4つの最先端ハーネスを持つフロンティア言語モデルの複数のファミリーを評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:55:07 GMT)
AdaTutoRank: Learning to Rerank Document Sets via Adaptive Tutoring Optimization for RAG and Deep Research [18.6] 本稿では,Adaptive Tutoring Optimization を用いて学習したアダテュートランカ AdaTutoRank を提案する。
AdaTutoRankは、検索コールを減らしながら、全体的なパフォーマンスを最高のものにしている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:10:15 GMT)
UGO: Unified Architecture for General Multi-Object Tracking by Segmentation [18.6] UGOは、事前訓練された模擬条件検出ヘッドと、共通アーキテクチャにおけるインスタンスプロパゲーションヘッドとをペアリングする統一GMOTトラッカーである。
新たな学習自由エネルギー最小化統合法では、重複提案を排他的画素マスクと検出に変換する。
UGOは新しい最先端のGMOTベンチマークとビデオオブジェクトカウントを設定し、専門のMOTメソッドと競合する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:09:56 GMT)
Where the Model Changes Its Mind: Hindsight-Divergence Localization for Efficient Reinforcement Learning with Verifiable Rewards [18.5] 検証可能な報酬を伴う強化学習のためのグループ相対的手法は、ロールアウト結果の違いから学習する。
本稿では,トークンログ類似度の変化を分岐点の選択に用いたHDL(Hindsight-Divergence Localization)を提案する。
数学、コード、エージェントタスクの3つのモデルによる実験では、ロールアウト効率とタスクパフォーマンスの両方が向上している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:05:29 GMT)
Privy to the Foil: Recasting Value Estimation with a Self-Privileged Critic for RLVR [18.5] $PPOは、価値推定のための自己特権のアクター批判フレームワークである。
$PPOは、一定のマージンで、常に価値推定品質を改善します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:32:21 GMT)
Communication-Efficient Agnostic Federated Learning via Faster Convergence and Compression [18.5] アグノスティック・フェデレーション・ラーニング(AFL)は、不均一な労働者に対して$m$$で確実に機能するモデルを模索している。
我々は,高速収束による同期ラウンド数と圧縮によるラウンド当たりの通信コストを削減し,通信効率を向上させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:26:32 GMT)
Urgent Actions Go First: Urgency-Aware Denoising for Real-Time VLA Control [18.4] 既存の加速法は、アクションチャンクをモノリシックな計算単位として扱う。
UAD(Urgency-Aware Denoising)は、各アクションが物理的に必要になったときに応じてデノイングを割り当てる新しい推論時間フレームワークである。
UADは、物理実行による尾アクションの継続的なバックグラウンド改善を重複しながら、ステップを減らした後、時間クリティカルな緊急アクションをリリースする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:13:14 GMT)
Do LLMs Really Forget? Hidden-State Leakage in Model Unlearning and How to Fix it [18.1] 出力レベルのリークを除去しても、機密情報がモデルに隠された表現に符号化されることが示される。
本研究では,隠蔽表現から抽出可能な情報を対角的に最小化する未学習目的である Probe-Adversarial Suppression (PARS) を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:26:55 GMT)
Dagger: Decoupling-based Model Stealing Attack against Graph Neural Networks [18.1] 我々は,厳密なクエリ予算下でのGNN盗難攻撃に対して,厳格に制約されたブラックボックス,ハードラベル,バックボーンに依存しない脅威モデルを定式化する。
ダガーは、最先端のGNN盗難攻撃を継続的に上回り、最大18.16%の忠実さを達成している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:39:26 GMT)
UniBuild: Unified Building Mapping From Multi-Source Optical Remote Sensing Imagery With Detail Decoding and Geometry Regularization [17.9] 光リモートセンシング(RS)画像からのビルディング抽出は都市マッピングの基礎となる。
マルチソースRGB光RS画像のための統合ビルディング抽出フレームワークUniBuildを提案する。
UniBuildは、さまざまなデータセット間で構築領域の精度、バウンダリシャープネス、隣り合うビルド分離を一貫して改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:44:15 GMT)
Breaking Babel: A Self-Evolving Multi-Agent System for Long-Form Subtitle Translation [17.9] 長文の字幕翻訳は、エピソードやシリーズ全体にわたる言論や文化的な文脈についての推論を必要とする。
長文字幕翻訳のための自己進化型マルチエージェントシステムSMARTを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:36:17 GMT)
ChartRevise: A Dataset and Evaluation Protocol for Exact Chart Editing via Code [17.9] チャート編集にはクロスモーダルな編集グラウンドが必要で、それを描画するコードに要求された視覚的変更を実現する。
本稿では,正確なプログラム基底チャート編集のための構造化データセットと評価プロトコルであるChartReviseを紹介する。
結果として得られたデータセットには、20のチャートタイプと3つのプロットライブラリにわたる344の編集タイプをカバーする92,438のレコードが含まれている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:00:05 GMT)
On Trajectory-Aware Training for Masked Diffusion Language Models [17.8] マスク付き拡散モデル(MDM)は、ステップ毎にいくつかのトークンをアンマキングすることでテキストを生成するが、異なる条件下でトレーニングされ、サンプリングされる。
PUMBA(Pujectory-Aware Training)は,政策によって引き起こされるトラジェクトリの連続的なステップでデノイザーを訓練する,トラジェクトリ・アウェア・トレーニングの統一フレームワークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:40:34 GMT)
Divide and Inject: Can Agents Reconstruct an Indirect Prompt Injection from Fragments? [16.6] 本稿では,長文断片化と適応探索を組み合わせた適応長文プロンプトインジェクション(AdaLCPI)を提案する。
AdaLCPIは強力な適応ベースラインよりも高い攻撃成功を達成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:54:45 GMT)
The Unequal Influence of Bad Advice: Using Training Data Attribution to Modulate Emergent Misalignment [16.6] 微調整された大きな言語モデルは、トレーニング後のアライメントを解除し、不整合な振る舞いを誘発することができる。
エムはペルソナのような表現と結び付けられており、微調整は有害または「悪」ペルソナを増幅することで損失を減らす可能性がある。
各有害例がEMにどの程度寄与するかを定量的に推定するために,トレーニングデータ属性を用いる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:08:34 GMT)
Solving Without Stopping: On-Policy Distillation at Small Scale [16.6] 学生がより強い教師のフィードバックから自分自身のアウトプットから学び、小さなスケールで伝達するオンライン蒸留の分析を行う。
蒸留は第1に転送されるが、思考モードでは第2に転送されない。
解決は、最大2つの天井まで、あらゆるサイズで改善されます。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:01:43 GMT)
Harness Evolution as Learning: Approximation, Generalization, and Optimization Limits of Self-Improving Personal Agents [16.5] 本稿では, ハーネスアーキテクチャ, ハーネススケール, 自己進化アルゴリズムの3つの中心的課題について検討する。
実証的に、我々は好み指向のベンチマークを導入し、個人エージェントの能力と限界を特徴づける。
我々は、学習問題として進化を定式化し、近似、一般化、最適化誤差を通じてこれらの現象を説明する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:21:50 GMT)
Semantic Projection for Continual Self-Evolution of Language Agents [16.4] パラメータ空間から振舞い空間へ勾配射影の関数原理を伝達するemphSemantic-Scope Projected Evolution (SSPE)を導入する。
SSPEは、最終クロスドメイン能力を改善し、強力なスキル進化ベースラインに対する忘れを軽減します。
これらの結果は、言語エージェントの安定かつ適応的な自己進化のための有望な原理として意味的プロジェクションを確立する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:36:07 GMT)
VISTA: Internalizing Collective Visual Experience via On-Policy Distillation for Active Multimodal Agents [16.4] アクティブマルチモーダルエージェントは視覚ツールを使用して推論中にタスク関連エビデンスを取得する。
VISTAを導入し、オン・ポリケーション蒸留により集団的な視覚体験を内包する。
VISTAは、同等の大きさのアクティブエージェントの中で最も高い平均性能を達成している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:39:09 GMT)
Know the Normal, Track the Attack: Context-Grounded and Stateful LLM Investigation over System Provenance [16.4] 本稿では,エビデンスキュレーションと文脈的LLM推論を組み合わせた調査指向の証明システムANCHORを提案する。
ANCHORは、ドル単位のAPIコストで完全な監査日を処理し、ウィンドウを横断する実用的なコンテキストベースの調査をサポートする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:49:17 GMT)
Stochastic Heavy Ball with Polyak Step Size and Armijo Line Search: A General Convergence Analysis [15.7] 本稿では,Polyak ステップサイズとArmijo ライン探索手法の統一収束解析を開発した。
我々は、PSの変動が減少するSHBの正確な最適性や定常性にほぼ確実に収束することを証明する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:09:14 GMT)
Correct Answers, Invalid Traces: What Verifiable Grade-School Math Reveals About Chain-of-Thought Traces [15.7] 学習した推論と計画の主張を支援するために使用されるトレースについて研究する。
まず、有効な最小限のトレースに特化して訓練されたモデルを評価する。
その後、私たちは追跡監視に介入します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:46:55 GMT)
TopoEmbedX: A General Framework for Representation Learning on Topological Domains [15.7] TopoEmbedXはユークリッド空間に幅広い位相領域を埋め込む統一的なフレームワークである。
TopoEmbedXは、トポロジカル表現学習のための明確で一貫性があり、使いやすいフレームワークを提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:55:05 GMT)
Codebook-Guided Cross-Modal Knowledge Distillation for Structurally Heterogeneous Features [15.7] クロスモーダルな知識蒸留は、教師のモダリティから学生のモダリティへ知識を伝達する。
既存の特徴レベルのアライメント手法では、教師と生徒の機能は構造的に整合性のある表現空間にあると仮定する。
本稿では,ベクトル量子化されたコードブックを用いて,構造的に不均一な特徴空間間の効果的な知識伝達を可能にするクロスモーダル蒸留フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:57:20 GMT)
Diagnosing and Improving Probabilistic Reasoning in Large Language Models [15.6] 本稿では,大言語モデルの意思決定損失を2つのコンポーネントに分解する決定理論フレームワークを提案する。
本研究では,フロンティアモデルとオープンソースモデルにおける確率論的推論を特徴付けるために,この分解を適用した。
確率論的推論の1つの構成要素を標的にすることで、意思決定の損失を再分配し、必ずしも他者に移ることなく目標を改善できることが判明した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:55:50 GMT)
From Sky to Soil: A Morphing Aerial-Ground Robot for Seed Deployment [15.5] 本論文は, 航空アクセス, 地上移動, 制御深度シードを組み込んだ形状支援型三機能型モーフィングロボットについて述べる。
着陸後、プラットフォームは4輪のプランティング構成に再構成される。
植付シーケンスは穴を形成し、種子を放出し、車両が地上に再配置したり、飛行状態に戻ることを可能にする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:08:05 GMT)
From Retrieval to Reasoning: Agentic Mechanism Prediction from Cell Painting Profiles [15.5] PhenoAIRは信頼性に敏感なマルチエージェントフレームワークで、候補中心のエビデンスメモリを保持し、表現型およびメカニズム側のエビデンスに対してコントローラ誘導の洗練を行う。
我々はPhenoAIRをセルペイントプロファイルとアノテーションから構築したベンチマークで評価し、制御され、現実的で、発見指向のオープンワールドMOA予測設定をカバーした。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:00:29 GMT)
SEA-CLIP-Tiny: Efficient Multilingual Text-Vision Embedding for Southeast Asian Languages [15.5] 東南アジアにおけるコンパクトな多言語テキストビジョン埋め込みモデルSEA-CLIP-Tinyについて述べる。
我々のモデルは、地域データキュレーションと多言語教師指導を通じて、東南アジアの多言語設定にCLIP-KDスタイルのフレームワークを適用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:26:23 GMT)
Scale Sensitivity in Low-Bit Post-Training Quantization: Curvature of the Quantization Error Landscape [15.4] GPTQファミリーにおけるポストトレーニング量子化(PTQ)法は、スケールを選択しなければならない一様格子上の層次再構成誤差を最小限に抑える。
この目的がスケールに対してどれほど敏感か研究する。
ガウス重みと十分に大きな有効ランクのキャリブレーションアクティベートを持つ層に対して、幅が大きくなるにつれて正規化された円-熱損失は高い確率で収束することを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:46:41 GMT)
Interpretable but Fragile? Robustness of Concept Bottlenecks under Geometric-Semantic Perturbations [15.4] 概念ボトルネックモデル (Concept Bottleneck Models, CBM) は、解釈可能な中間表現を提供するように設計されている。
我々は、不一致は異なる堅牢性の概念と摂動体制を混同することによって生じると論じる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:35:54 GMT)
FlexiWorld: Learning and Planning via Flexible Action Chunks Across Multiple Time Scales [15.3] 潜在世界モデルは、複数の原始的なステップにまたがるアクションチャンクを使用して、ゴール指向の計画のための将来の状態を予測する。
我々は,JEPAベースのワールドモデルであるFlexiWorldを紹介した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:28:55 GMT)
Fairness Theatre: Evaluating Post-Hoc Fairness Interventions in Vendor-Controlled Early Warning Systems [15.3] 高等教育において、プロプライエタリな早期警戒システム(Early Warning Systems)は、不平等に対処するためにモデル出力を調整すること以外の選択肢を大学に残している。
このことは、ベンダー、機関、アドバイザー、そしてこれらのシステムを変えるのに不平等な力を持つ学生の間で、公正な仕事がどのように調整されているかという疑問を提起する。
我々は,調達制約を模擬した調査EWSにおいて,ホック後の公正な介入を6回評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:11:30 GMT)
Acceleration of Diffusion Language Model through Discrete Average Generator [15.3] 本稿では,MeanFlowを連続時間マルコフ連鎖に拡張した離散平均生成器について紹介する。
この平均生成器は自己整合性を満足し,学習目標の基盤となることを示す。
Pottsモデルシミュレーションでは,K$-stepサンプルの総変動距離を最大67%削減する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:27:23 GMT)
When Models Don't Manipulate Manifolds: The Geometry of a Comparison Task [15.2] Qwen2.5-7B-Instructにおける数比較の因果幾何学について検討する。
曲面幾何の存在にもかかわらず、Qwenは主に数の線型表現を使用する。
この結果は,多様体仮説が線形表現と共存可能であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:29:51 GMT)
One Pipeline Does Not Fit All: TAILOR, a Type- and State-Aware Framework for CVE Reproduction [15.2] 複雑な脆弱性再現のためのタイプおよび状態認識型マルチエージェントフレームワークTAILORを提案する。
複雑な実行要件のあるケースに重点を置いた200個のCVEのデータセットを構築した。
Web脆弱性の59.24%、従来の脆弱性の44.19%をうまく再現しました。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:31:13 GMT)
ProgressCompass: Embodied Progress Reward Models Are Lost Without the Right Context [14.9] 長いタスクでは、現在のフレームだけでは、以前何が起こったかに依存するため、タスクがどれだけ遠くなったかを知ることができません。
既存の進捗推定のベンチマークは、主に現在の観察から進捗を読み取ることができる短いタスクに焦点が当てられ、また、PRMがコンテキストが必要な場合の進捗を推定できるかどうかが過小評価されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:27:02 GMT)
ZeroDiff: Zero-Shot Time Series Reconstruction via Informed-Prior Diffusion [14.9] 時系列モデリングは、ますます高品質な監視を必要としている。
観測地点で訓練されたモデルは、計測されたことのない目標時系列を再構築できるのか?
これをゼロショット時系列再構成と呼ぶ。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:12:31 GMT)
Do-JEPA: From Masking to Intervention in Latent World Models [14.8] 我々は、C-JEPAのようなオブジェクトマスキングモデルが予測器に何が見えるかに介入していることを示し、物理的に何が起こるかに介入する。
結果は、モデルが見ているものではなく、世界への介入が、潜在する世界モデルがその行動の原因を予測するのに役立つことを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:31:28 GMT)
GenNVS: Geometry-enhanced Novel View Synthesis via Disentangled 3D Prior [14.6] GenNVSは、幾何学的に拡張された新しいビュー合成のためのフレームワークである。
GenNVSは、視覚的品質と幾何学的精度の両方において、最近の手法に対して好適に機能することを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:47:01 GMT)
How Medical VLMs Underutilize Their Vision Encoders: A Dermatology Perspective [14.5] 皮膚科では、MedSigLIPエンコーダはMedGemmaを平均10.26パーセント上回っている。
このギャップは、視覚情報がどのようにエンド・ツー・エンドの診断に使用されるかを研究する動機となっている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:42:07 GMT)
Riemannian Splat Regression Models for Learning Time Fields on Arbitrary Riemannian Manifolds [14.5] ニューラルタイムフィールド(NTFields)などのニューラルネットワークを用いた最適時間対ゴー関数の運動計画法
NTFieldsは、高次元へのアドホック座標射影を使わなければ直接適用できない。
このようなプロジェクションを使わずにこれらの手法を直接使用することが望ましい。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:48:04 GMT)
One Readout, Many Repairs: Diffusion-Guided Hierarchical Search for Tool-Agent Repair [14.4] 本稿では,修復計算の削減を図り,ツールエージェントの故障復旧を改善するためのトレーニング不要な拡散誘導フレームワークを提案する。
ReCommitは、マスク付き言語モデルの単一並列読み出しから操作型スコアを再利用することにより、修復試験全体にわたって操作レベルの提案を補正する。
Agent-Diffベンチマークで4つのエンタープライズサービスにまたがる実際の障害に関する実験では、75.9%と63.2%の相対的な回復率が61.3%、51.3%の削減率を示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:05:15 GMT)
Planning Oriented 3D Scene Completion via Coupled TUDF Occupancy Representation Learning from Partial Observations [14.3] 経路計画指向の3Dシーン補完フレームワークを提案する。
提案手法は, 完了したTruncated Unsigned Distance Field (TUDF) に基づく連続幾何表現とボクセル単位の占有マップを共同で予測する。
未知環境における実験により,提案手法は幾何再構成品質と下流計画性能の両方を一貫して改善することを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:31:21 GMT)
ReF-HIL: Shaping the Critic around Human Action Neighborhoods for Efficient Human-in-the-Loop Reinforcement Learning [14.1] HIL-RL(Human-in-the-loop reinforcement learning)は、ロボット操作ポリシーを効率的に訓練するための有望なルートを提供する。
本稿では,HIL-RLフレームワークであるReF-HILを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:35:20 GMT)
HandAnthro: Automated Hand Anthropometry from a Single Image [14.0] HandAnthroは、アメリカの文字サイズの紙の手のひらの写真から、44個の手の大きさを推定している。
パイプラインは、修正のために手首に隠された紙の境界を再構築し、非手ぶれのピクセルを白くし、41個の人文学特有のランドマークを洗練する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:43:22 GMT)
SphMind: Towards Robust, Training-Free VLM-based Spatial Reasoning with a 360 Camera [13.5] 360度カメラは、周囲の全体的広視野(FoV)ビューを具現化したAIエージェントを提供する。
MLLMは、従来の2次元視点画像に基づいて訓練され、球形形状によって引き起こされる厳しい歪みやラッパーアラウンドの不連続に苦慮する。
幾何学的推論から意味認識を分離する学習自由なプラグアンドプレイフレームワークであるSphMindを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:19:17 GMT)
LLMs learn different forms of metacognition when trained to predict their own accuracy [13.5] 私たちは、関係する知識があるかどうかに関わらず、答えを常に生成するように、大きな言語モデルを訓練します。
訓練された信頼感は2つの異なるシグナルを反映している。
これらの結果は、キャリブレーショントレーニングがモデルに、自信を持ってコミットしたエラーを一般的に検出するように教えるものではないことを示唆している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:00:25 GMT)
RoboCompiler: Graph-Native Compilation of Closed-Chain Robots for Consistent Modeling, Control, and Simulation [13.5] 本稿では,標準機構グラフを共有メカニカルインタフェースにコンパイルするグラフネイティブフレームワークであるRoboCompilerを提案する。
体、関節、フレーム、慣性体、アクチュエーターポートからクロージャーパスと分析的残留ヤコビアンを構成する。
我々は,産業用掘削機Unitree Go2,Franka Panda,Kangaroo,および6-UPSスチュワートプラットフォーム上での物理的ループとタスクによる制約を評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:15:52 GMT)
Abductive World Modeling via Causal Representation Learning [13.5] 本稿では、予測された未来から潜在原因を誘導的に推測することで、構造的因果表現を学習するフレームワークであるAWMを提案する。
AWMは、世界力学の構造的表現を学習するための潜在空間世界モデリングに帰納的状態推論を導入する最初のフレームワークである。
最先端の潜在宇宙モデルであるV-JEPAと比較して、AWMは物理予測のAUROCを10.7%改善し、因果推論の精度は16.8%向上し、Top-1の精度は68.0%向上した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:18:27 GMT)
Continual Learning of Dynamical Systems in Recurrent Neural Networks through Recyclable Unit Gating [13.4] 動的システム再構成(DSR)は、システムの定性的長期挙動を再現する観測時系列からモデルを推論することを目的としている。
パラメータ正規化,リプレイ,アイソレーションにまたがる確立された連続学習(CL)手法をベンチマークした。
本稿では,コンパクトなアロケーションとフォワード転送によるキャパシティの保存を行うCRUG(Continuous-Recyclable Unit-Gating)を紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:18:32 GMT)
Hierarchical Compression of Vision-Language Model Benchmarks [13.3] PRIMEBenchは、視覚対応の階層型ベンチマーク圧縮フレームワークである。
モデルランキングを維持しながら、評価コストを大幅に削減する。
平均忠実度は5%の保持率で最高である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:08:46 GMT)
Direct Experience World-Model Optimization: Learning the World Beyond Action Imitation [13.3] World-Action Models (WAM) は、物理的な相互作用がどのように展開されるかを予測するアクション生成を結合する。
WAMのための後処理学習パラダイムであるDirect Experience World-Model Optimization (DEWO)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:41:41 GMT)
RoadOcc Learns When to Persist, Transport, or Refresh Memory for Roadside Occupancy Prediction [13.3] RoadOccは、固定座標履歴、ベロシティ適応履歴、そして現在の証拠の間のソフトルーティングを学ぶ。
InfraOccでは、RoadOccは65.29 mIoU、32.37 mIoUに達し、STCOccでは4.44 mIoU、4.71 mIoUとなった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:30:23 GMT)
Where Do LLMs Decide to Break the Rules? Mechanistic Localization of Prompt Injection Compliance [13.3] 攻撃情報は第1層から線形にデオード可能であるが、モデルの振る舞いに対する因果的レバレッジは、後期層ボトルネックまで無視可能である。
コンプライアンス機構はコンパクトな線形部分空間を占有し、様々なモデルファミリに対してアーキテクチャ的に安定であることを示す。
この因果レバレッジと検出性能の整合性は、遅延層ボトルネックが単に介入の成果を反映するのではなく、決定関連性を捉えているという確固たる証拠となる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:54:21 GMT)
Demistifying Data and Simulator Assumptions in Supervised Causal Discovery [13.3] 監視された因果発見は、構造ラベルと組み合わせたトレーニングデータセットから、新しいデータセットの因果構造を推論することを学ぶ。
本稿では,2026年6月までに利用可能な代表手法間の関係について検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:03:22 GMT)
Aegis: Generative Gradient Masking for Privacy-Preserving Medical Federated Learning [13.2] フェデレートラーニング(FL)は、多施設医療AIの基礎パラダイムとなっている。
Aegisは、患者データやFLプロトコルを変更することなく、このジレンマを壊す、原則化されたクライアント側防御である。
Aegisは3つの最先端MIAを中和し、モデルユーティリティを保ち、わずかなオーバーヘッドしか生じない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:05:52 GMT)
Efficient and Scalable Physics-Guided Fully Convolutional Spatiotemporal Learning for 3D Microstructure Evolution Prediction [13.2] 本研究は,完全3次元構造の直接的多フレーム予測のための物理誘導完全畳み込みフレームワークを開発する。
このフレームワークは、基準位相分解器と比較して30倍以上の壁面速度を達成している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:58:56 GMT)
Closed-Form Cartesian Forward Kinetostatics for Spatial Multi-Segment Tendon-Driven Continuum Robots [13.1] 本稿では, テントン動作下での空間的マルチセグメントロボットに対して, クローズド・フォーム・ソリューションを用いた力-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動-動
最大長正規化先端位置不一致を最大8.91 x 10-6 と 1.01 x 10-5 とし,GVSモデルとの比較を行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:50:42 GMT)
Emergence, Not Bandwidth: Physical Coupling and the Limits of Learned Multi-Agent Communication [13.1] 利率制限されたマルチエージェントチームは、創発的なコミュニケーション文学が経験的にのみ答えた3つの質問を提起する。
我々の定理は、どんな学習者とも独立して達成可能なものを修正するので、エンジニアと学習した送信者の間のギャップは、最適化事実である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:39:02 GMT)
From Solo to Social Learning: Characterizing Recursive Social Improvement in LLMs [12.9] 大規模言語モデル(LLM)は、ピアからコピーすることで学習をより効率的にするが、より効果的ではないことを示す。
制御された環境では、確立された社会学習アルゴリズムはピアの恩恵を受けるが、3つのLSMは得ない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:37:10 GMT)
Less Supervision, Better Generalization: Weakly Supervised Fake Region Localization in Diffusion-Edited Images [12.6] ReGFLoWは拡散編集された偽領域ローカライゼーションのための弱い教師付きフレームワークである。
アーティファクト中心の複数インスタンス学習により、ReGFLoWは、セマンティックアフィニティや境界ベースの擬似マスク前処理に頼ることなく、局所的な拡散証拠を利用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:12:03 GMT)
Data-Efficient Adaptation of a Driving VLA to Class 8 Trucks [12.6] クラス8のトラックは、幾何学、動力学、操縦要件において旅客車とは異なる。
そこで本研究では,市販のVLAに適応して,クラス8トラックの軌道を生成するアダプティブステア戦略を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:28:32 GMT)
Beyond Legibility: Benchmarking Visual Text Rendering and In-Place Editing in Unified Video Generation [12.6] VidScribeは4世代にわたる統一診断ベンチマークである。
VidScribeは、12軸条件因子空間上の803の人間認証サンプルを含んでいる。
11の商用およびオープンソースシステムのベンチマークでは、ビデオテキスト機能はモノリシックではないことが示されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:17:09 GMT)
Synthesis Without Training: An Inference-Only Pipeline for Tabular, Temporal, and Relational Synthetic Data [12.6] モデルトレーニングを不要にする推論専用パイプラインであるGENSCRIPTを提案する。
GENSCRIPTはソースデータの決定論的統計プロファイルを算出する。
フィールドのセマンティクスとカラム間の整合性制約を推論するために、生の行ではなく、言語モデルに渡す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:09:42 GMT)
Latent Inference-Time Guidance of Time Series Foundation Models [12.5] Time Series Foundation Models (TSFM) は現在、予測タスクの最先端結果を提供している。
それらはアウト・オブ・ボックスで利用可能で、予測を行うにはコンテキスト内学習に依存します。
本稿では、TSFM予測のプールを時間依存の潜時空間と独立成分に適応的に結合したTSFMの遅延推論時ガイダンスを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:25:58 GMT)
ReWorld-Track: A Recursive Event World Model for Language-Guided Multi-Camera Tracking [12.4] 言語誘導型マルチカメラトラッキングは、観測されていないギャップを越えてターゲットIDを保持する必要がある。
本稿では,今後の予測に関連性の不確実性をもたらすモデルであるReWorld-Trackを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:16:18 GMT)
Optimal detection of general moment changes: Simultaneous mean and covariance change detection and beyond [12.4] そこで本研究では,任意の順序のモーメントの変化を所定の固定順序$p$まで検出する手法を開発した。
適切な条件下では,提案手法は新たに開発されたミニマックス下界と一致する局所化誤差率を達成する。
数値実験と実データ解析は、モーメント変化の検出と分布変化の幅における手法の有効性を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:14:17 GMT)
HACo: Learning Haptic Active Compliance for Force-Aware Dexterous Manipulation [12.4] 本稿では,ハプティック・アクティブ・コンプライアンス・ポリシーであるHACoを紹介する。
我々は,多接触摩擦,接種相互作用,脆性曲面接触,回転トルク,変形性物体操作を含む実世界のベンチマークでHACoを評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:17:04 GMT)
Evolving Towards Better Codes: LLM-Guided Search for High-Distance Binary Linear Codes [12.4] 我々はLinCodeEvolveを導入し、コード構築プログラムを最小距離評価器に対して進化させる。
戦略ループは多様性を駆使した探索と専門家の監督を組み合わせる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:59:06 GMT)
What Was Said, Not What Was 'Thought': Type-6 Logic for CoT Verification [12.0] 2つの演算子で拡張された動的論理の変種であるType-6ロジックを導入する(不確かさと再発)。
Type-6は、ライセンスされていないリビジョン、エントロメム、ループバック、検証不可能/不正なクレームなど、一般的な推論の病因を説明できる。
本稿では,そのトレースをグラフ化したType-6論理に基づく検証器を提案し,それをType-6の公理や推論規則と比較する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:13:28 GMT)
Scene-Consistent Illumination Transfer for Inserted Advertising Graphics [11.8] Ad-Relightは、シーン照明を供給された広告グラフィックに転送するための推論のみの手順である。
人間の判断と自動選好研究は、一様でない照明を備えたフロアマウントグラフィックにおいて、最も顕著な利得を示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:25:27 GMT)
Staircase Policy: Streaming Inference for World-Action Models with Large Action Chunks [11.8] アクションチャンキングは、複数のアクションに対してこのコストを減らしますが、後のアクションは、古い観測で条件付けられているため、長い実行地平線上でパフォーマンスが低下します。
本稿では,フローマッチングVLAをJEPAスタイルのWAMに変換するストリーミング推論およびトレーニングフレームワークであるSTAIRCASE POLICYを紹介する。
S-WAMは、LIBEROで97.7%、LIBERO-Plusで87.9%を達成し、複数のポリシーバックボーンと実ロボットタスクのパフォーマンスを改善している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:32:04 GMT)
Seeing What Should Be Heard: Diagnosing and Repairing Cross-Modal Shortcuts in Omni-Modal LLMs [11.7] オムニモーダル大言語モデル(LLM)における広汎なクロスモーダルショートカットを見つける。
そこで我々は,DMC-Repairを提案する。DMC-Repairは,同じ種類のクロスモーダルなスワップサンプルのモデルを訓練し,質問によって指定されたモダリティに応じて監督を割り当てる。
実験により、DMC-Repairは、画像による応答効果のシェアを59.9%削減し、音声要求応答性能を損なうことなく、モーダル間ショートカットを効果的に抑制することを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:12:42 GMT)
NeuroDyn-EEG: An Interpretable Pre-trained Model for EEG Based on Neural Dynamics [11.5] 臨床頭皮脳波検査は神経精神疾患の神経力学に非侵襲的な窓を提供する。
識別的深層モデルは、しばしば解剖学的に索引付けされた生理学的解釈性に欠ける。
我々はニューロDyn-EEGを提案する。ニューロDyn-EEGはニューロダイナミクスから生成した前駆体を統合する事前学習フレームワークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:45:33 GMT)
Making the most of leftovers: Improved privacy amplification for quantum key distribution [11.5] 我々は、RegulaとTomamichelの最近の残余のハッシュレンマを通じて達成可能なプライバシーの増幅を洗練し、拡張する。
これにより、有限ブロック状態における最先端鍵レートが向上し、エントロピー蓄積に基づく技術よりも優れる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:00:01 GMT)
It Takes Little to Rewrite Perception: Targeted Semantic Substitution in Vision-Language Models at $ε\leq 4/255$ [11.4] 既存の表現アライメント攻撃は、VLMがターゲットイメージを認識させるが、$varepsilon leq 4/255$で限定的に成功する。
目的のセマンティック置換が同じ範囲で成功するため、このロバスト性は保たないことを示す。
我々はまた,大言語モデルが矛盾する視覚信号をコヒーレントな物語に合理化する,テキストセマンティック融合現象も観察する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:52:39 GMT)
PowerMarketJax: A JAX Benchmark Suite for Multi-Agent Reinforcement Learning in Power Markets [11.4] 電力市場はマルチエージェント強化学習(MARL)の自然なテストベッドである
5つのパワーマーケットでMARLのベンチマークスイートであるPowerMarketJaxを紹介します。
学習した入札行動が市場設計に強く依存していることが分かりました。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:00:09 GMT)
Adapting Context Compression for Long-Horizon Agents with Counterfactual Continuations [11.4] ロングホライゾンエージェントは、成長する相互作用履歴を管理するためにコンテキスト圧縮を必要とする。
既存のプロンプト適応法は、全コンテキストと圧縮軌跡を比較して圧縮誤差を推定する。
構造化圧縮プロンプトに適応するPAIR(Prompt Adaptation using Interventional Rollouts)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:18:13 GMT)
ContractWarden: Kernel-Enforced Damage Boundaries for AI Agents via Human-Authorized Contracts [11.4] ContractWardenは、エージェントやポリシー提案を信頼することなく、人間に許可されたダメージ境界を強制する。
モデルが三国間資産契約(許容、否定、否定)を提案する場合もありますが、人間は最終的な選択をします。
実行ゲートは、信頼できないコードが実行される前に、契約を具体的なタスクにバインドする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:13:14 GMT)
Building Transformation Layers for Riemannian Neural Networks [11.3] 計算可能な空間上にユークリッド完全連結(FC)と畳み込み層を構築するための枠組みを提案する。
このフレームワークは、異なるジオメトリーにまたがるいくつかの以前のFC層を特別なケースとして含んでいる。
異なる多様体測地に関する実験は、我々のアプローチの有効性と適用性を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:45:02 GMT)
Back2Struct: Making Structured Images Editable Again [11.3] ここではBack2Structを紹介します。
Back2Structは、テキスト、形状、トポロジ、レイアウトを明示的にエンコードする、セマンティックなオブジェクトレベルのSVG/XMLコードを予測する。
生成されたコードはPowerPointのようなツールにシームレスにインポートでき、ユーザーはグラフィックコンテンツを編集、洗練、書き換え、再利用できる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:36:32 GMT)
TACIT: Optimization Models that Learn from Their Mistakes [11.2] 多くの目的や制約はドメインの専門家の知識に存在し、形式化が難しい。
歴史的データを用いて不特定な定式化を自動的に修復することで,この問題に対処する。
我々はTACITが78.9%を修復できることを示した(最良ベースラインは60.5%)。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:26:53 GMT)
Skill2Env: Capability-Oriented Environment Synthesis from Skills for General Agents [11.1] Skill2Envは、スキルから始まり、エージェント能力要求を使用してタスクと環境合成をガイドする機能指向フレームワークである。
本稿では,解決法の実行証拠を用いて,不十分なタスク設計を識別する反復的タスクハードニングを提案する。
Skill2Env環境から生成した1.5Kの高速軌道を教師付き微調整に利用し、幅広いエージェントベンチマークで一貫した改善を観察する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:27:35 GMT)
How to Tame a Multi-Headed Hydra? Adaptive Multi-Category Safety Steering for Large Language Models [11.1] CAM-Steerはカテゴリー適応型多カテゴリ安全ステアリングフレームワークである。
これは、現在の隠れ状態と安全で安全でないプロトタイプを比較して、各有害カテゴリーに関連するリスクを推定する。
構成された操舵方向に沿って隠れ状態が回転し、推定リスクによって回転角が決定される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:14:01 GMT)
A Tale of Two Walks: Kipnis, Marchioro and Presutti Meet Kac in a Quantum World [11.0] 対称部分空間上の平行Kacのウォークによって誘導されるツイリングチャネルは、分割上の古典マルコフ連鎖によって正確に符号化されていることを示す。
この対応により、並列KMPプロセスの混合に対するツイリングチャネルの解析が減少する。
我々の主な技術的貢献は、並列および標準KMPプロセスの条件付き製品構造である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:17:59 GMT)
Med-RADIO: Reducing All Medical Domains Into One via Multi-Teacher Distillation [10.9] Med-RADIO は,全ドメインを 1 に還元する医療用多教師蒸留フレームワークである。
本手法は,一般教師と専門教員の双方をキュレートし,モダリティに整合した蒸留ストリームを割り当て,一般教師の事前学習データを再編成する。
5つのモダリティにまたがる内部および外部の分類ベンチマークでは、Med-RADIOは線形探索の下で強力な医学一般よりも改善されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:30:37 GMT)
Instruct, Not Answer: Using Instruction Privileges in On-Policy Context Distillation [10.9] 普通の学生のミスを狙う一般的な指示は、OPCD特権として金より優れている。
ProverQA、ProofWriter、ProntoQAをデータセットとして使用した8つの実験のうち7つの実験では、OODの命令特権が4から17ポイント向上した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:57:12 GMT)
Architecture Alignment With Sparse Priors in Tabular Foundation Models [10.9] タブラル基礎モデル(TFM)は、コンテキスト内学習を通じて、新しいデータセットに対する強力な予測を提供するため、ますます人気が高まっている。
しかし、リリースされたTFMは、事前訓練された事前、アーキテクチャ、目的において同時に異なり、それぞれの帰納的バイアスを無視する。
アーキテクチャが無関係な機能抑制に寄与するかどうかを問う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:12:53 GMT)
Geometry-Preserving Human-to-Robot Upper-Body Motion Retargeting from Monocular Video [10.8] 本報告では, 身体の統一的再構築と形態素に依存しない幾何的移動を統合化するための動き認識フレームワークを提案する。
両腕デキスタラスロボット上で,単眼映像から上半身運動への統一パイプラインを実証した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:14:20 GMT)
VLALight: A Vision-Language-Action Model for Traffic Signal Control [10.5] VLALightは,マルチビュー・ロードサイド・ビデオからエンドツーエンドの信号制御を行う最初の視覚言語アクション(VLA)モデルである。
我々は,視覚的交通理解と信号決定のための2段階の冷間開始訓練戦略を開発した。
3つの都市ネットワークにまたがる7つの実世界のトラフィックフローデータセットの実験により、VLALightは、輸送ベース、RLベース、LLM/VLMベースラインを一貫して上回ることを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:48:08 GMT)
When Correct Memory Goes Wrong: Fuzzing Persistent Memory Use in LLM Agents [10.5] 既存の作業は主に、メモリ内容のエラーを研究したり、固定テストケースを評価したりする。
この問題をファジィ問題として定式化し、そのような障害をクエリ関連およびメモリ状態障害に分類する。
メモリチェックポイントからテストシードとして始まり、明示的な突然変異義務の下でクエリやメモリ状態を変更し、各ミュータントを検証するU-Fuzzを開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:35:58 GMT)
Counterfactual Rollout Replay: Forkable Environments as Free Process Rewards for Software Engineering Agents [10.1] アウトカムのみの強化学習は、ソフトウェアエンジニアリング(SWE)エージェントに最終成功のシグナルを与えるが、中間決定に関する直接的なガイダンスはほとんどない。
本稿では,フォーク可能な実行環境を利用するトレーニングタイムであるCounterfactual Rollout Replay (CRR)を紹介する。
CRRは、小さな決定ポイントを選択し、各状態を復元し、代替アクションをサンプルし、ポリシーの下でブランチを前進させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:48:44 GMT)
Do LLM Agents Execute the Plans They Declare? From Planning-Mode Declaration to Pattern-Specific Execution [10.1] 大規模言語モデル(LLM)は、エージェントが計画を生成し、それを環境内で実行することで、長い水平タスクを解くことを可能にする。
成功する計画には、タスクの適切な計画を選択し、忠実に実行するという、2つの異なる機能が必要です。
LLMが4つの計画モードのうちの1つを宣言し、対応するパターン固有の実行者にタスクをディスパッチするプランニング・アズ・ルーティングを導入する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:47:18 GMT)
Exploring Forum Post Retrieval with Generative Modeling [10.1] ジェネレーティブレコメンデーション(GR)は埋め込みベースの検索の代替として登場した。
Facebook Forumは、Facebook Groupsの中~多人数ユーザー向けのスタンドアロンアプリケーションです。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:04:09 GMT)
She Spoofed Sea Ships by the Sea Shore: Measuring Large-Scale GPS Spoofing in Global Maritime Traffic [9.9] 我々は,地球規模の自動識別システム(AIS)データを用いて,海洋GPSスプーフィングの大規模計測を行った。
外部干渉が一度に複数の船舶を移動させる大規模スプーフィングに焦点をあてる。
我々は、高交通域に31の異常なホットスポットを同定し、そのうち少なくとも22のホットスポットは、GPSスプーフィングの強い証拠を示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:27:30 GMT)
FAST-Sync: Fast Group Synchronization for any Matrix Lie Group [9.9] 群同期は、N$未知の要素の集合を推定する問題である。
Fast-Syncは、ローカルがグローバルに最適なGSソリューションを効率的に回収できる高品質な初期化を提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:55:11 GMT)
RunyaNER: Auxiliary Language Selection for Runyankore NER [9.9] 言語間ゼロショット転送と多言語ファインチューニングは、NLPタスクに有望なアプローチである。
どのような補助的な言語選択戦略が最良の移行につながるかは明らかでない。
RunyaNERは、東アフリカの言語Runyankoreで最初に公開されたNERベンチマークである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:22:15 GMT)
Variational Augmented Invertible Koopman Autoencoder for probabilistic time series forecasting [9.8] 本稿では,変分拡張可逆クープマンオートエンコーダ(VAIKAE)を提案する。
VAIKAEアーキテクチャのキーとなる特性は、正規化フローモデルを利用することで、モデルのトレーニングに動的システムの状態空間における可能性計算を使用できることである。
本手法の有効性は,長期時系列予測ベンチマークにおける一連の実験で実証された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:58:56 GMT)
TReVS: Integrating Textual Relevance and Visual Saliency for Efficient Vision-Language Model Token Pruning [9.4] プリLLMプルーニングのためのテキスト関連性と視覚エンコーダサリエンシを組み合わせた学習自由フレームワークを提案する。
LLaVA-1.5-7Bでは、TReVSは未処理のベースライン性能の92.8%を維持し、94.4%のビジュアルトークンをプルーニングし、最先端の手法よりも優れていた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:41:54 GMT)
ProCTI: Prototype-Refined Global Conditioning for Diffusion-Based Time Series Imputation [9.3] ProCTIは、学習したプロトタイプを通じて、検索したグローバルデータセットレベルの事前処理でローカルコンディショニングを強化する拡散インプットフレームワークである。
ハイブリッド条件付け機構は、このグローバルコンテキストを逆拡散中の局所的な信号と統合し、異なる欠損シナリオ下でより正確な再構成を可能にする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:04:03 GMT)
Aim Short to Reach Far: Your Frozen World Model Can Plan Better Than You Think [9.3] Anchored Planning(AP)は、世界モデルのオフライン軌道を再利用するトレーニングフリーの手法である。
APは、アクション合成とアクションランキングの両方において、凍結したLeWMプランナを大幅に改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:15:00 GMT)
Toward provably private learning from federated data [8.9] フェデレートラーニング(FL)は、プライベートデータを持つデバイスが、共有モデルのトレーニングに協力することを可能にする。
信頼された実行環境(TEE)に基づく次世代FLシステムを提案する。
我々のシステムでは、TEEがホストするキー管理サービス(KMS)が管理するキーで暗号化されたデータをアップロードする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:01:41 GMT)
Do Agent Benchmarks Do What They Say? An Executable-Contract Audit of Tool-Using Agent Environments [8.9] 34回にわたって、4つのベンチマークで変更ツールを監査し、7つのツール欠陥と1つの評価器特性をピン付きコミットで確認した。
注入された欠陥について、チェッカーは25個のフラグに偽陽性を示さず、5つの負のコントロールのうち2つにフラグを付け、最も多くを逃した。
さらに12のAgentDojoツール、6つのホールドアウトツールと、最初に監査された7つのツールによって、25のツール変更サーフェスが完了した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:50:55 GMT)
PowerSim: Differentiable Physics Simulation and Rendering with Power Diagrams [8.9] 我々はPowerFoamのパワーダイアグラムに基づく3次元表現に物理的に基底を持つ微分可能なダイナミクスをもたらす方法であるPowerSimを紹介する。
PowerSimは、トレーニング済みのPowerFoamシーンとMaterial Point Method(MPM)を直接結合し、両者の自然なアライメントを利用する。
このフレームワークに基づいて構築され、実際のシーンと合成シーンにおける様々なアプリケーションを可能にします。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:58:37 GMT)
Towards Universal Wasserstein Barycenters through Flow Matching [8.9] 確率測度に基づく確率測度よりも重み付けされた平均を定義することは、機械学習における中心的なツールである。
We propose texttBaryFM, a flow matching model that the marginal measures to any barycenter in the Wasserstein simplex。
textttBaryFMは、10のドメイン適応ベンチマークで競合する15のメソッドの中で、最高の平均ランクを達成している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:06:29 GMT)
SPARK: A General Goodness-of-Fit Assessment via Residual Projection [8.8] 本稿では,従来の統計モデルや一般的なブラックボックス学習手法に適用可能な,適合性試験のための一般的なフレームワークを提案する。
シミュレーションと実データ解析は,提案手法の有効性と柔軟性を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:40:21 GMT)
BlenDAgger: Blended Shared Control for Interactive Imitation Learning [8.8] 我々は、模倣学習ポリシーを訓練するためのデータ収集手法であるBlended DAggerを提案する。
人的行動と政策行動を混在させることで,操作政策の自律的性能向上を目指す。
提案手法は,実世界の2つのタスクにおいて,30ポイント以上の自律的なパフォーマンスを実現する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:51:15 GMT)
JEV-as-a-Judge: Accept When Confident, Escalate When Unsure [8.8] テキストの代わりにラベルの確率を返却する判断専用判断器であるJEVを用いて評価を行う。
16人のジェネレーティブおよび報酬モデル判事に対して、視覚障害者はGPT-6の3点以内である。
しきい値が予め凍結されているため、確実な判定を受け、残りをエスカレートすることは、GPT-6よりも0.9ポイント正確である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:32:52 GMT)
GradLev: Token-Parallel Test-Time Training Via Costate Prediction [8.8] テストタイムトレーニングにより、モデルは推論時に予測を改善することができる。
オンライン勾配降下は、前向き評価と逆向きのバックプロパゲーションの両方に正確な平行走査を認めている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:38:17 GMT)
RL-PaO: Prediction as Action in Decision Making under Uncertainty [8.8] 本稿では,システム定式化,最適化,決定実行をひとつの環境に統合する強化学習フレームワークRL-PaOを紹介する。
試験年度では、RL-PaOは非軌道ベースラインの中で最低の年間コストを達成し、平均で10%のコスト削減を実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:03:34 GMT)
DualTrack: Synchronized speech-gesture generation via symmetric coupling of pretrained priors [8.7] 提案するDualTrackは,12.5Hzのタイムライン上で,事前訓練された音声と動きの事前処理を行う。
43のBEAT2録音を4言語で評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:33:51 GMT)
The Breakdown of Classical Minicrypt Equivalences in the Quantum-Computation Classical-Communication Model [8.6] 量子計算の古典通信環境において,古典的ミニ暗号の風景が崩壊することを示す。
第一に、量子擬決定論的評価を許容しても片方向関数は存在しない。
第2に、QCCCビットのコミットメントは存在しない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:11:36 GMT)
Harnessing Large Language Models to Compile Task-Relevant Context into Bayesian Optimisation [8.6] HarBOはBO特有のハーネスであり、一般的なコンテキストを標準BOのコアアーティファクトにコンパイルする。
我々の理論は、不完全コンパイル中の後悔と新しい文脈を加える効果を解析する。
一般的なコーディングハーネスは、慣れ親しんだドメインでは有効であるが、慣れ親しんだコンテキストに富んだドメインでは不十分である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:58:32 GMT)
VidHarness: Evolving Agent Harnesses for Cost-Efficient Long Video Understanding [8.5] VidHarnessはコスト効率のよいロングビデオ理解のためのハーネス設計を自動化するフレームワークである。
我々は,いくつかの質問に新たなハーネスをスクリーニングし,期待できるもののみを促進する不確実性認識多忠実性検証を導入する。
VidHarnessは、LongVideoBench、Video-MME、およびVideo-Holmesで、最先端のビデオエージェントを11.2ドルまで上回っている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:06:54 GMT)
What Makes High-Magnification Knowledge Transferable? A Study of Cross-Resolution Distillation in Whole-Slide Imaging [8.5] クロスレゾリューション・ナレッジ蒸留は, 高い磁化表現を伝達することにより, 低磁化全スライド解析を改善することを目的としている。
教師のアクセス、表現損失、モデル過剰の分解に基づく分析法を開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:02:16 GMT)
Exact quantum algorithm for searching of multiple sets intersection [8.5] Groverのアルゴリズムは、対象集合のグローバルオラクルが利用可能である場合、非構造化探索の2次高速化を実現する。
ロングは位相マッチング条件を導入してGroverの探索アルゴリズムの修正版を提示した。
本稿では,複数の集合の交点を正確に探索するアルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:29:45 GMT)
Merged, Not Measured: An Empirical Study of Performance Issues Fixed by Coding Agents [8.3] コーディングエージェントは、ソフトウェアをスピードアップすると主張するプルリクエスト(PR)を開く。
AIDev v4の71,677のエージェントPRから,582リポジトリの6エージェントによって修正された1,262のパフォーマンス問題を選択する。
私たちは各問題とそのテストをコーディングし、23の拒否と30の合併修正を再実行しました。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:48:55 GMT)
Tail-Weight Control and Localized Generalization in Nearly Low-Rank Adversarial Classification [8.1] 実験的なランプ取り付けは、人口が最適に無視しても純粋ノイズの特徴に重みを割り当てることができる。
このギャップをガウス信号と雑音によるノルム制約付き逆数分類の定量化を行う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:02:45 GMT)
Where Predictive Supervision Goes Shapes What VLA Policies Learn [8.1] 将来の予測は、視覚言語アクション(VLA)ポリシーを改善するためにますます使われる。
本稿では,VLA政策で使用される視覚的表現を,予測的監督が改善するか否かについて検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:48:13 GMT)
How Local Mixing Encodes Relative Position in Global NoPE Attention [8.0] 位置情報は自然言語の基本です
スライディングウィンドウアテンション(SWA)やゲート線形アテンションなどの局所混合層をインターリーブする最近の手法は大規模に成功している。
我々は,SWAとゲート線形アテンションは,グローバルアテンションロジットによって伝播し,選択される残差ストリームの傾向バイアスを誘導すると主張している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:47:41 GMT)
PANDA: A Decentralized Architecture with Flexible Orchestration for Scalable, Fault-Tolerant Multi-Agent Systems [8.0] 異種エージェントの集合体を独立に管理する分散化アーキテクチャであるPANDAを提案する。
PANDAはチームコミュニケーションから集団コミュニケーションを分離することでスケールし、エージェントは複数のチームに参加することができる。
我々は、HotPotQAベンチマークでPANDAを評価し、数千のエージェントにスケールし、ミリ秒でチームを組み立て、最先端の精度を最大8倍の効率で一致させ、既存のシステムが故障した場合、100%のタスク完了を維持することを実証した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:10:31 GMT)
Video-RSI: Recursive Self-Improvement of Video Understanding Agents via Harness Evolution [7.8] ビデオ理解エージェントは、実行可能なハーネスを介して証拠を取得する。
実行トレースは、現在のハーネスによって取得された証拠のみを含む。
本稿では,ビデオ理解エージェントが自身の言語モデルを用いてハーネスを改良する自己改善フレームワークであるVideo-RSIを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:24:02 GMT)
Exploring In-Context Learning for Handwritten Text Recognition [7.7] In-Context Learning with pre-trained Vision-Language Models (VLMs) to create transcription pipeline without without the model's parameters。
いくつかの文脈サンプリングは、他の状況よりもうまく機能し、理想的なサンプリング方法を見つけるのにより多くの労力を費やすべきだと提案し、議論する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:15:38 GMT)
Role-guided Speaker Deletion Verification in Clinical Psychiatry Speech Recordings with Audio Language Models [7.6] 精神医学における臨床研究は、音響的および言語的バイオマーカーを特定するために、音声言語データの大規模な収集にますます依存している。
精神医学における役割駆動型臨床対話の検証問題について検討し、2つの平行な対称パイプラインを用いて検討した。
各パイプラインは、ターゲットロールのために生のオーディオを再実行し、残った出力をオーディオ言語および大規模言語モデルでスキャンし、欠落した削除を識別する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:20:24 GMT)
UnifiedAttack: Evaluating the Safety of Large Multimodal Models in Synergistic Harmful Image-Text Generation [7.6] We introduced UnifiedAttack, a novel benchmark for evaluate Large Multimodal Models (LMMs) safety in collaborative scenarios。
In-Context Reskinning(ICR)とCognitive Planning Injection(CPI)を組み合わせた相乗的フレームワークを提案する。
その結果,統一モデルの構造的有用性と論理的コヒーレンスを体系的に武器化できることが判明した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:41:48 GMT)
SAM Meets VLM: Parameter-Decoupled Full-Parameter Training for Unified Medical Reasoning and Segmentation [7.6] 本稿では,統合医療推論とセグメンテーションのためのパラメータ分離トレーニングフレームワークを提案する。
我々のフレームワークは、競争力のある推論能力を維持しながら、強い言語条件のセグメンテーションを実現する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:27:05 GMT)
A Reachability-based Safety Certificate for Dynamical System Motion Policies [7.6] 本研究では,後方到達性管の概念から得られた値関数を用いて安全性を証明した。
DSをベースとした学習実験では,制御入力の欠如が到達可能性問題を決定論的ロールアウトに崩壊させることを示す。
さらに, 設計した値関数は, 名目DS流に対する障害物のない領域の最大前方不変部分集合であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:13:31 GMT)
Scaling Influence Functions in LLMs through Eigenbasis-Corrected One-Bit Gradient Projection [7.6] 影響関数は、個別の訓練例が大規模言語モデル(LLM)の行動に与える影響を推定する
本研究では,記憶時間に未知な将来のクエリに対する影響推定を保存しながら,トレーニング勾配の圧縮方法を検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:40:53 GMT)
Drone Soccer: Learning to Manipulate with Multicopter Downwash [7.1] 我々は、ダウンウォッシュベースの操作の可能性を探るため、ドローンサッカータスクを開発する。
具体的には、RLポリシーをトレーニングし、サッカーボールをドリブルするために使用する簡易なダウンウォッシュダイナミクスモデルを開発する。
この研究は、マルチコプターのための新しい操作能力に関する重要な洞察を提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:47:17 GMT)
Tracing the Evolution of Oracle Bone Characters Across Three Millennia [7.1] 本稿では,漢字の進化系列(OBI,Bronze,Seal,Clerical,Regular)を多様体空間の連続的進化としてモデル化する枠組みを提案する。
多様体空間と遷移力学の両方は、任意の2つの時代にわたるキャラクタ進化対を通して、エンドツーエンドで訓練することができる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:42:53 GMT)
Probabilistic Symbolic-Distillation Model of Droplet Collision for Spray Simulation at High Ambient Pressures [7.1] 液滴衝突は、多くの化学工学プロセスにおける液滴の集団動態を制御している。
約4万件の実験イベントを用いた確率的シンボリック蒸留モデルを構築した。
機械学習の教師は、これらのデータから共同成果確率の景観を学習する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:20:29 GMT)
Channel-Dependent State Space Model for Multivariate Time Series Forecasting [7.0] 変数間のデータ依存、きめ細かな相互作用を可能とし、各変数の数を線形にスケーリングする専用CD状態空間モデル(SSM)を提案する。
選択的なSSMをカルマンフィルタに接続することにより、SSMバックボーンを頑健な時間的モデリングに保存しながら、前者の計測精度の欠如をクロス変数モデリングに活用する。
強い依存性を持つODEとPEMSでは、Chameleonはすべての設定で最高のMSEとMAEを達成し、CIアブレーションと以前のCDメソッドは平均61-178%高いMSEを達成している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:15:46 GMT)
Motion Concept Unlearning in Video Diffusion Models [6.9] ビデオ拡散変換器(DiT)における運動概念消去の系統的研究について述べる。
テキストコンディショニング・アテンションは、概念固有の動作情報を持ち、選択的介入を支援することを示す。
我々は,運動概念消去の要件として,概念的特異性,空間的選択性,時間的自然性の3つを導出した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:40:56 GMT)
WISE-ATTA: When to Ask for Labels in Budgeted Active Test-Time Adaptation [6.9] アクティブテスト時間適応(ATTA)は、分散シフト時の堅牢性を改善する。
既存のATTAメソッドの多くは、入ってくるテストバッチ毎に監督を要求できると暗黙的に仮定している。
テストバッチのごく一部でラベルが利用できるEmphbudgeted ATTAを紹介します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:32:36 GMT)
The Advantages of Fresh Sketching for Ridge Regression [6.9] カラムサンプリングによる反復尾根回帰に対して,新しいスケッチが有効であることを示す。
新しくスケッチすることで、Gramマトリックス全体を均一に上回るのではなく、現在の残留ソリューションに沿ってエラーを分析することができます。
この方向ビューは、レバレッジスコアとリッジレバレッジスコアサンプリングのためのよりシャープな収束保証を与える。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:24:22 GMT)
FairDiff: Mitigating the Self-Reinforcing Matthew Effect in Diffusion Recommender Models [6.8] マシューエフェクト」とフィルタバブルは、レコメンダシステムにおいて結果レベルのバイアスとして広く認識されている。
DRMは、人気バイアスの自己強化を誘発する。
DRMは、世代間、ユニークな構造上の事前ミスマッチに悩まされる。
本稿では,FairDiffを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:10:13 GMT)
Where Does Randomness Matter in Neural Cellular Automata? [6.8] 非同期トレーニングは,3/10同期実行と比較して,10/10実行で短時間の質テストに合格することを示す。
ランダムマスキングは平均モードを減衰させるが、分散を注入する。
その結果、最適化の信頼性、実行モード、タスク固有の振る舞いを1つの安定性特性として扱うのではなく区別した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:07:12 GMT)
Improved Quantum Algorithms for Black-Box Abelian Group Decomposition [6.7] 有限アベリアブラックボックス群を分解するための量子アルゴリズムを与える。
我々はRegevの因数分解アルゴリズムの量子サンプリングと古典的格子還元法に適応する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:37:52 GMT)
The Teacher Is a Direction, Not a Destination: Extrapolating RL-Induced Representation Residuals in On-Policy Distillation [6.7] 一般化された変種は、出力空間における暗黙の報酬を外挿することで、生徒が教師を追い越すことができる。
出力空間外挿に依存するサンプルトーケン対数確率比は、外挿が増幅するノイズを注入し、トレーニングを不安定にする。
RLにより引き起こされる変化を直接表現空間に外挿するRIDEを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:44:39 GMT)
AutoLoCo: Communication Efficient Distributed LLM Training via Adaptive Synchronization [6.7] 大規模言語モデル(LLM)の事前トレーニングは、複数のデータセンターで行われている。
トレーニングがより多くのアクセラレータにスケールするにつれて、計算に費やされる時間の割合は減少し、通信に費やされる時間は増加する。
ほとんどのローカル更新メソッドは、トレーニング前に同期間のローカルステップの数を設定し、実行中にこのインターバルを固定する。
間隔と間隔が現在の訓練状態に適合した場合、訓練性能を維持しつつ通信周波数を低減させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:05:08 GMT)
Harvest Season for SLUB: From io_uring vulnerability to Novel Sheaf-Based Exploitation Techniques [6.7] 本研究は,Linux 6.18のSLUBアロケータに付加されるシーフ/バーンキャッシング機構について検討した。
io_uringの2つの既知の脆弱性が提示され、1つは完全なローカル特権エスカレーションチェーンとして開発されている。
この分析に基づいて,3つの新しい層利用手法が提案されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:54:33 GMT)
Corruption-Robust Sparse Linear Contextual Bandits with Knapsack Constraints [6.7] 共同報酬および消費汚職下でのクナプサック制約による疎線形文脈包帯について検討した。
汚職を意識した信頼性幅とオンラインリソース価格と予算安全ルールを組み合わせた推定器・モジュラー・フレームワークを開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:10:53 GMT)
From Codebase to Culprit (C2C): Reducing the Search Space for Bugs with Semantic Retrieval and Hierarchical Reinforcement Learning [6.6] C2C(From Codebase to Culprit)は、正確なバグローカライゼーションのためのフレームワークである。
意味検索と強化学習(HRL)を2段階のプロセスに統合する。
C2Cは、意思決定間のコンテキスト整合性を維持しながら、マルチレゾリューションのローカライズを可能にする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:57:59 GMT)
Information-theoretic receding-horizon active learning of nonlinear dynamical systems [6.4] 固定された非線形特徴を用いたパラメトリック推定器を構築し、モデルが状態と入力において非線形であるが未知のパラメータでは線形となるようにした。
本稿では,候補となる将来の軌跡と対象集合上の再構成されたダイナミクス間の平均余分な相互情報に基づいて,情報状態上での最適適応設計問題を,予測指向の基準を用いて定式化する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:51:29 GMT)
Tacit-TTS: From Autoregressive Decoding to Masked Prediction for Efficient Transcript-Free Voice Cloning [6.4] IndexTTS2から抽出した効率的な転写不要ゼロショット音声クローニングシステムであるTacit-TTSについて述べる。
我々のモデルは,自己回帰型テキスト・セマンティックデコーディングをマスク付き非自己回帰型生成に置き換える。
転写のない条件付けは、言語間および非語彙間の参照もサポートする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:25:21 GMT)
Navigating the Changing Landscape of Online Knowledge Consumption and Production in the Age of Generative AI: Evidence from Stack Overflow [6.4] 本稿では,ChatGPTリリース後のStack Overflowユーザグループ間の質問応答と回答の変化について検討する。
消費者は質問から回答を生み出すようになったが、回答は受け入れられる可能性が低かった。
プロデューサーは質問の数を変えなかったが、新しいトピックや新しいトピックについてますます質問した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:23:10 GMT)
OPFL: Optimistic Verification of Federated Learning via Empirical Boundary [6.3] フェデレーション学習は、複数のクライアントがプライベートデータを共有せずに、協力的にモデルをトレーニングすることを可能にする。
プライバシー保護フェデレーション学習のための楽観的な検証フレームワークOPFLを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:32:56 GMT)
Anatomy-Aware Prediction of Bronchoscopic Accessibility from 3D CT [6.3] 気管支鏡によるアクセシビリティ予測を新しい教師付き学習課題として定式化する。
術前CT検査を施行し, 術後経過を報告した438例の1例を経験したので報告する。
提案手法はAUROCの0.8052を達成し、最先端のベースラインと経験豊富な人間専門家の両方を著しく上回っている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:34:02 GMT)
EGSD: Event-Grounded Self-Distillation for Streaming Video Understanding [6.3] リアルタイムビデオ理解には、ストリーミングコンテンツのメモリを漸進的に維持する必要がある。
検証可能なイベントに対するインクリメンタルな更新として,ストリーミングメモリを特徴付けるイベント集約型自己蒸留を提案する。
主要なオンラインおよびオフラインベンチマークの実験では、EGSDは強力なパフォーマンスを示し、StreamingBenchでは79.8%、OVO-Bench Real-Timeでは73.4%に達した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:15:16 GMT)
Curating Synthetic Data for Task-Specific Visual Perception [6.3] 専門的な視覚システムにおける中心的な問題は、より多くのデータを生成する方法ではなく、どのデータを生成するかである、と我々は主張する。
本研究では,シーン内容,外観変化,知覚特性,アノテーションが与えられたタスクを中心に意図的に設計されている合成データについて検討する。
得られた合成データは実観測の補完として最もよく理解されており、制御可能な監視と学習外観を組み合わせたハイブリッドパイプラインが信頼性の高いsim-to-real転送の最も有望な方向であると結論付けている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:06:52 GMT)
A Physics-Conditioned Neural Operator for Generalization of Atrioventricular Valve Mechanics across Pressure and Tissue Properties [6.3] 僧帽弁逆流と三尖弁逆流は最も一般的な逆流性弁膜病変である。
本稿では, 収縮期血圧, 組織特性を条件としたリーフレットの変位, ひずみ, 応力場を予測するトランスフォーマー型ニューラルオペレータPCNOについて紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:10:47 GMT)
Reactive Real-Time Flow Policies via Asynchronous Distribution Alignment [6.2] 視覚アクションモデル(VLA)のような汎用ロボットポリシーは、目覚ましい一般化を実現している。
非同期実行は、ロボットが前のアクションを実行する間、次のアクションシーケンスを予測することによって、アクションチャンク間の一時停止を避ける。
非同期実行が元のVLAと同じ動作分布を生成するかどうかを検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:30:04 GMT)
LLMs Learn to Evade Latent Monitors from Prior Feedback Alone [6.2] インタラクティブな監視はフィードバックチャネルを生成し、各検証がモデルにリーク情報を配信する。
エージェントがこのフィードバックからモニタの決定ルールを推測し、そのアクティベーションを選択的に編集して検出を回避できるかどうかを問う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:47:13 GMT)
Learning from Think-Mode Advantage via On-Policy Distillation [6.2] 明示的な中間推論は、大きな言語モデルにより強力な問題解決モードを与える。
我々は、オンライン蒸留(OPD)を通して、このシンクモードの利点から学ぶことを研究する。
ThinkOPDは、学生が生成した軌跡を保存し、学生が訪問する接頭辞に密集したトークンレベルの教師ターゲットを提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:51:21 GMT)
Cascaded consensus splitting for multi-branch contingency games [6.1] 並行ゲームは、エージェントが他のエージェントの仮説的意図を予測し、計画することを可能にする。
既存の定式化は1つの分岐時間に依存し、異なるエージェントの意図が異なるタイミングで明らかにされる相互作用を単純化する。
分岐時間が異なる場合に、意図の不確実性の源泉を段階的に解決できるマルチブランチ並行アーキテクチャを導入する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:56:58 GMT)
A Memory-Magic Exchange Law in Streaming Clifford+T Compilation [6.1] 耐故障性プロセッサに加算片で到達した位相を、最終片が到着するか、到着時に実行されるまで記憶することができる。
我々は、 ancilla-free coordinatewise Clifford+$T$コンパイルの交換レート$$, committed $T$ gates per bit of memory forgoneを決定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:26:01 GMT)
Volatility-Clustering Adaptation for Financial Time Series [6.1] 時系列基礎モデルは、ターゲットデータの微調整によって、新しい領域に適応する傾向にある。
この仮定は、個別の価格変動の予測が困難である金融予測において失敗する可能性があることを示す。
オープン、ハイ、ロー、クローズ、ボリュームの価格バーで訓練された金融ファンデーションモデルを用いて、金融分野への適応には次の予測以上の訓練信号が必要であると論じる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:45:38 GMT)
FINGR: Learning Dexterous Hand Control for Real-World Rubik's Cube Solving [6.1] FINGR (Future-supervised Interaction Network with Geometric Representations) は指相対幾何学と将来の対話予測を組み合わせた政策である。
実のところ、我々の政策は、ベースフロー政策の79.7%と比較して、300ターンの試行よりも99.0%成功している。
グルーピングとテーブルアシストのリグラスと統合され、約137秒で10個のスクランブルされた2時間2時間2ドルキューブを解く。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:49:00 GMT)
Aperture: Merge-Consistent Rotary States for Compressed Tokens [6.0] トークン圧縮は、複数の位置からのコンテンツを組み合わせる。
回転位置埋め込みは通常、マージされたトークンを1つの座標に割り当てる。
後続の合併でどのような位置情報が生き残らなければならないか尋ねる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:51:14 GMT)
Traversing the solution space of neural networks with Hessian Null Space Continuation [6.0] Hessian Null Space Continuation (HNC) は、局所曲率を用いて重み空間の領域を横切るスケーラブルな方法である。
メモリタスクでトレーニングされたRNNでは、HNCは動作の維持とともに、非常に異なる表現と動的に到達します。
ImageNetでトレーニングされた視覚変換器では、HNCは、アーキテクチャや目的が異なる独立した訓練されたモデルよりも、元のネットワークとは異なる表現を見つける。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:38:24 GMT)
Weeding Out Bad Seeds: Initial-Noise-Robust Unlearning for Text-to-Image Diffusion Models [6.0] マシン・アンラーニングはテキスト・ツー・イメージ(T2I)モデルから機密概念を禁止的再トレーニングなしで消去することができる。
我々はこの現象を確率的忘れ(probabilistic forgetting)」と呼び、特定のランダムな初期雑音条件下で再収束する概念を抑圧する。
対象概念が現れる領域の勾配更新を動的に集中する適応型,概念条件付きサンプリング戦略を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:21:10 GMT)
ARGOS: Reinforcement Learning-Driven Multidimensional Elasticity for Service Orchestration in the Computing Continuum [6.0] この記事では、オーケストレーションサービスのためのAdaptive Reinforcement Learning-Driven GovernanceであるARGOSを紹介します。
解析品質とクラスタ圧力に対するマルコフの要求毎の決定プロセスとして多次元弾性を定式化する。
ARGOSは、制御されたワークロードと、異種クラスタ上での時間変化によるマルチテナント到着に基づいて評価される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:14:36 GMT)
DatalogBench: Evaluating Large Language Models on Text-to-Datalog Synthesis [5.9] Datalogは、プログラム分析のような推論タスクを基盤としているが、プログラムを書くのは難しい。
大規模言語モデルは、自然言語の質問からテキストからデータへ合成するより自然な経路を示唆している。
我々は既存のDatalogベースのアーティファクトからキュレートされた136のテキスト・ツー・データログ合成タスクのベンチマークであるDatalogBenchを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:43:39 GMT)
All You Need Is Low Fidelity: Zero-Shot Sim-to-Real of Learned Robotic Fish Control [5.9] そこで本研究では,非定常な準定常流体モデルにおいて,無起床と付加質量履歴を伴わないモデルを用いて,無チューニングでハードウェアに転送する閉ループ制御系を学習する。
私たちのプラットフォームは柔らかくシングルモーターで腱駆動の魚です。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:23:18 GMT)
Isolated Sign Language Recognition for Icelandic Sign Language: Experiments in a Low-resource Setting [5.9] アイスランド手話(TM)における孤立手話認識に関する最初の実験について述べる。
我々は、バイリンガルのアイスランド語--TMオンライン辞書から派生したデータセットであるTM SignWikiを使用している。1,845本のビデオが849のクラスをカバーしており、そのうち86%が2つの例しか持っていない。
我々は,オープンソースのISLRフレームワークであるOpenHandsとSPOTERを,語彙サイズを増大させる3つのタスクで比較した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:50:38 GMT)
Security-Enhanced Seed-Based Weight Quantization for Large Language Models [5.7] Seed-Qは、セキュリティに配慮したシードベースの重み圧縮フレームワークである。
提案手法では,低感度領域を積極的に圧縮しながら,より大きな表現予算を感度重みに割り当てる。
実験の結果,Seed-QはSeedLMの4ビットパープレキシティと少ないビットで一致し,同時に4ビット/ウェイトでもSeedLMに対するパープレキシティ劣化とゼロショット精度損失を低減できることがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:07:04 GMT)
DRHeC: Differentiable Rendering for Hand-Eye Calibration with RGB-Based Gradients [5.7] 手目キャリブレーションの異なるレンダリング手法は、物理モデルを利用してバイナリマスクをレンダリングし、観察結果と比較している。
色とマスクの幾何学的特徴を取り入れることで、よりリッチな幾何学的および外観的手がかりを提供する新しいRGBベースの微分可能レンダリングフレームワークを提案する。
我々の手法はシミュレーションと実世界の実験の両方を通じて検証され、その結果は強い精度と堅牢性を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:50:46 GMT)
What Pretraining and Midtraining Make Learnable from Rewards? [5.7] 報酬は、新しい未決定入力に必要な計算を残しながら、正しい答えを特定できる。
本研究では,報奨適応を効果的に行う情報と計算を,事前学習と中等教育がいかに提供するかを検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:39:41 GMT)
Travel Mode- and Purpose-Specific Origin-Destination Matrices for England and Wales from Fused Travel Survey and Mobile Network Data [5.5] 原点決定(OD)行列は、モデルキャリブレーションやアクセシビリティ分析から、新しいサービスや開発の評価に至るまで、多くの量的輸送計画の背後にある。
これは、旅行モードと目的によって分解され、アクセス不能または使用不能のままである、小さな領域の解像度に関する最新のOD証拠を必要とする。
本報告では,イングランドとウェールズのMSOA-to-MSOA OD行列を,平日朝のピークに8つの旅行目的を持つ7つの旅行モードと代表的な時間に区分する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:24:26 GMT)
The Domain Is a Residue: Adapting Self-Supervised Features, Not Generators [5.5] 本稿では、天気、照明、レンダリングスタイルを移動させるための表現特徴適応器(RFA)を提案する。
RFAはアダプタと識別器のみを訓練し、すべての条件で一度訓練されたエンコーダと特徴条件付きデコーダは凍結したままである。
霧や夜のKID、雪、雨、干し草の騒音のレベルの両方で先行している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:06:01 GMT)
Minimal building blocks for molecular quantum circuits with exact spin symmetry [5.4] 粒子数とスピンを保存することは、量子回路が分子電子状態をターゲットにするのに役立つが、必要な量子数を持つ全ての状態へのアクセスを保証するわけではない。
固定粒子数$N$、トータルスピン$S$、スピンプロジェクション$M_S$の各完備部分空間内で、スピン非依存軌道回転と組み合わせて全ての実状態空間回転を生成する。
我々は、実軌道におけるスピンフリー分子計算について、追加の空間対称性の制限なしに検討し、粒子数、全スピン対称性、実振幅を保存する連続的な調整可能な演算について考察する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:21:36 GMT)
Deep Learning Latency Attacks and Defenses: A Cross-Domain Survey of Availability Threats [5.4] この調査は、知覚パイプラインにまたがる断片化された文献を統一する(自動運転車の検知と追跡に対する物理的な攻撃を含む)。
我々は定式化よりも計算ボトルネックを利用した攻撃を組織化する。
多くの攻撃は、中間的な作業増幅という1つのメカニズムを共有しており、作業予算の抽象化を動機付けている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:06:32 GMT)
Arbitrary high-dimensional entanglement purification with the superposition of paths [5.4] 任意の高次元エンタングルメント浄化プロトコルを実装するためのスケーラブルな手法を提案する。
適切なシングルキューディットゲートを選択することで、qudit-flipエラーとphase-flipエラーを浄化することができる。
この研究は、高次元量子通信と量子ネットワークへの道を開いた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:39:13 GMT)
Pixels to Keys: Exploring Spatial and Motion Cues in Gameplay Inverse Dynamics [5.2] フレームから入力を推測する逆ダイナミクスモデル (IDM) が提案されている。
空間運動特徴がIMMの結果に与える影響を評価するために,データ制約シナリオにおける問題を考察した。
同じアーキテクチャとトレーニングのレシピをCyberpunk 2077に適用すると、ゲームメカニック間の不均一なパフォーマンスが明らかになる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:04:28 GMT)
Does the Unsafe Gradient Survive a Conversation? On the Fragility of Gradient-Based Jailbreak Detection in Multi-Turn Dialogue [5.2] マルチターン設定における勾配に基づくジェイルブレイク検出の制御評価を行う。
GradSafeをContext Window Scannerで拡張し、ユーザターンの固定サイズウィンドウに検出器を適用します。
結果は、合成と現実的な良性設定とは大きく異なる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:59:37 GMT)
SPLASH: Switching Parallel Layouts of Attention with Seamless Handoff for LLM Serving [5.2] SPLASHは、リクエストが実行されている間、アテンションの並列レイアウトを切り替えるサービスシステムである。
現代的な注意:KVヘッドがほとんどあるいは全くない、要求のKVキャッシュの場所を、注意重みの緊張度から切り離す。
固定されたデプロイメントに対して、エンドツーエンドのサービススループットを1.3-1.73倍改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:02:29 GMT)
AI as a Compiler: Compiling Triton kernels without the Triton compiler [5.2] 我々は,TritonからNVIDIA PTXへのAI低下について研究し,LLMエージェントがTritonカーネルを直接PTXに変換する。
Ada、Hopper、Blackwellの12の共通カーネルでAIの低下は0.83x-3.34倍となる。
この結果から,AIコンパイラが独自に記述した中間表現とチェッカーを置き換える,新たな未来が示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:13:10 GMT)
Multimodal LLMs Outperform Pathology Foundation Models in Cross-Domain Histological Similarity [5.2] 数百万の組織学タイルで訓練された最先端の病理基盤モデルは、スライドや施設の境界を越えて比較した場合、組織類似性を維持することができない。
病理基盤モデルとして訓練されることなく、汎用多目的LSMは、クロスドメインの組織学的類似性判定において、これらの特殊なモデルより一貫して優れていることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:07:07 GMT)
LogiC-Diff: Embedding Security Properties Into AI-Enabled Cyber-Physical Systems [5.2] セキュリティプロパティを直接AI対応のCPSに組み込むための第一歩を踏み出します。
本稿では,Signal Temporal Logic仕様を予測に組み込んだ,論理条件付き二段階拡散フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:38:01 GMT)
GenLimitLib: A Formal Library for Language Generation in the Limit and AI-Assisted Mathematical Research [5.2] GenLimitLibは、ソース整合型の言語生成用のLean 4ライブラリです。
KleinbergとMullainathanによってNeurIPS 2024で導入された。
GenLimitLibには30の論文の正式な開発が含まれている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:06:07 GMT)
Retargeting Motions to Diverse Skeletons via Learnable Flattening [5.1] クロス構造運動は、異なる骨格トポロジー間での動きを伝達することを目的としている。
既存の最先端モデルはゼロショット設定で信頼性に苦慮している。
トランスフォーマーをベースとした最近の試みは、特殊な幾何学的手法よりも優れていなかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:35:57 GMT)
Multi-agent discussion gains less when dissent is withheld [5.0] LLMのマルチエージェントシステムは多数決に議論を加える。
議論が正確性を改善するか、誤った合意につながるか、という経験的報告。
本稿では,議論がいつ精度を向上し,いつ結果が誤ったコンセンサスで終わるかを記述した擬似モデルを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:00:14 GMT)
FineART: Fine-grained Annotated Robotic Trajectory Dataset and Vision-Language-Action Model for Bimanual Manipulation [5.0] FineARTは151タスクにわたる40,543エピソード、1,718時間、533,913サブタスクからなる、高密度に注釈付き双方向操作データセットである。
我々は,次のサブタスクを予測する視覚言語対応政策であるFineART-VLAを導入し,この方法で中級学習を行うことで,かなりの利得が得られることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:13:29 GMT)
Search Dimension in Unlabeled Projection Pursuit: A Scaling Law for Subspace Restriction [4.6] 投影追跡は、データが最小のガウス的に見える方向を探索する。
観測空間がガウス補数が大きい場合、信号を持たない方向によって経験的目的を最小化することができる。
既知のフォワード演算子の列空間への探索の制限は、負の曲率分岐上の失敗を正確に除去する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:11:51 GMT)
Colorectal Cancer Segmentation with Adaptive Augmentation and Multi-Resolution Ensemble Models [4.6] 大腸癌は2番目に死亡率が高く,3番目に多いがんである。
CRC診断は生検後の病理組織学的評価に依存する。
本報告では,全スライディング組織像に対する自動セグメンテーションパイプラインを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:12:14 GMT)
It's All Training: A Fully Synthetic Single-Stage Recipe for LLMs [4.5] 58,698のウィキペディア記事から派生した最初のオープンソース合成コーパスであるSynTHについて述べる。
我々は、SynTHが、トレーニングデータのごく一部から、競争力のあるジェネリストモデルを生成することができることを示す。
SynTHデータセットとBaguettotronモデルのスイートをパーミッシブライセンスでリリースしています。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:58:02 GMT)
Drowning in AI Slop: How Social Media Platforms (Do Not) Label AI and Deepfake Content under EU law [4.5] 私たちは、Instagram、TikTok、X、YouTubeでAIラベルの法的根拠に基づく監査を行います。
プラットフォームポリシと検出アプローチ,システムリスクとAI関連キーワードを通じて収集された10,722のポストを分析した。
AIラベリングが広く確立されていることが分かりました。4つのプラットフォームすべてでラベルが自動的に適用され、以前の監査よりも多くのラベリングがプラットフォーム対応になっているのです。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:29:22 GMT)
TRACE: Learning to Self-Calibrate Wireless Digital Twins from ISAC Measurements [4.4] 無線デジタルツイン(DT)は、無線伝搬を予測し、無線ネットワークの決定をサポートするために3D環境モデルに依存している。
本稿では,既存のDTを無線周波数(RF)測定で修復する方法について検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:54:09 GMT)
AgBench: Agentic AI Benchmarks for Personal AI Devices [4.2] エージェントAIシステムは、計画、ツールの使用、反復実行のために、クラウドでホストされた大きな言語モデルにますます依存している。
既存のベンチマークは、デバイス、ワークロード、デプロイメントアーキテクチャ間のトレードオフを体系的に特徴付けるには不十分である。
我々は、パーソナルデバイス上でのエージェントAIの再現可能な評価のためのベンチマークスイートとオープンアーティファクトであるAgBenchを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:18:37 GMT)
The Editor Has Read-Only Access: Correctness Signals in Diffusion Language Models [4.2] 拡散モデルは、部分的にマスキングされたシーケンスを繰り返し更新することでコードを生成する。
我々は、それらの内部アクティベーションがコード正しさを符号化し、その情報が生成を改善するかどうかを問う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:54:31 GMT)
Physics-Aware Machine Unlearning for Cyber-Physical Systems [4.2] そこで本稿では, ターゲットとなるサイバー物理システムの物理残差と, 忘れる信号とを結合する勾配学習型機械アンラーニング手法を提案する。
物理残留物は勾配上昇時に安全フェンスとして機能する。
提案する物理誘導モデルでは同時に毒を除去し,物理コンプライアンスを回復する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:41:54 GMT)
Closing a single-copy gap to the Holevo bound with two-copy measurements [4.1] 任意のパラメータを持つフルランクモデルに対して有限コピー永続性を証明する。
我々は,状態トモグラフィーから決定される単一コピーと分離計測境界の下にある2コピー推定誤差を観察する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:09:41 GMT)
Pruning for Efficiency, Paying in Fairness: Demographic Disparities in Pruned Speech-LLMs [4.0] 音声エンコーダのプルーニングがSLAM-ASRに与える影響を,異なる集団群に対して系統的に検討した。
その結果,刈り取りがすべての人口集団に等しく影響を与えないことが判明した。
以上の結果から, プルーニングモデルでは, グループごとのWERの配置決定を, グループごとのエラー率を明示的基準として含めるべきであることが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:46:50 GMT)
Optimizer-dependent training dynamics converge to the same one-third optimal data scaling [4.0] 私たちは2つの指数を区別し、$1/3$のアカウントは区別しません。
第1の動的指数は崩壊特異であり、第2の最適データ指数は1/3$に収束する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:58:16 GMT)
SHIFT-Truck: A High-Fidelity Aerodynamics Dataset and Benchmark for Pickup Trucks [4.0] ピックアップトラックのための最初のデータセットShift-Truckを紹介する。
スパラート・オールマラスが17の形状パラメータで変形した参照ピックアップ幾何学の1,000個の遅延分離渦シミュレーションを含む。
各ケースはレイノルズ数1.4倍の107ドルで約1億セルのメッシュ上で動作し、平均的な表面圧力、壁せん断応力、圧力、速度で放出される。
幾何群分割を定義し, 表面および体積トラック上でDoMINO, GeoTransolver, AB-UPT, SMARTの4つのニューラルネットワークサロゲートをベンチマークする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:55:36 GMT)
Single-particle detection of the Néel transition in LaCrO$_3$ microcrystals via widefield nitrogen-vacancy center magnetic imaging [4.0] 希土類オルソクロミットは、リッチで化学的に調整可能な磁気挙動を示し、温度感知や温度依存性のスイッチング用途に魅力的である。
ここでは, 溶融塩合成により生成する個々のLaCrO$_3$マイクロ結晶の成層磁場を撮像するために, 広帯域窒素空孔磁気量計を用いる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:48:07 GMT)
Predictive Geometry of Hidden Trajectories in Transformers [3.9] 残りの変圧器ブロックを通して隠蔽状態の候補を継続することで得られる終端損失の層次ロス・トゥ・ゴー関数について検討する。
因果変換器の場合、同じ幾何学はトークン回りの曲率スコアを誘導する: 各トークンの隠れ状態の摂動に対するターゲットロジットのフィッシャー重み付き感度。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:46:26 GMT)
SCLATE: a Substrate for Continual-Learning Agent Training and Evaluation [3.8] 既存のベンチマークとトレーニングフレームワークは、ベンチマーク独自のイベントのみをスケジュールし、各ベンチマークとエージェントペアが独自のスケジューリングループを構築する。
ベンチマークと未修正エージェントがそれぞれ,ひとつのオープンイベントスケジューラにアダプタを通じてイベントを付加する実行基板であるSCLATEを提案する。
ハイブリッドシミュレートされたクロックは、これらのイベントを共有タイムライン上で実行し、エージェントが動作している間にリアルタイムで流れ、アイドルギャップをスキップし、1ヶ月のシナリオを数時間に圧縮する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:11:02 GMT)
Hidden Reasoning Must Leak, but Need Not Be Readable: Fundamental Opportunities and Limits for Chain-of-Thought Monitoring [3.7] 推論モデルでは,思考トレースに表示されずに,思考モニタの連鎖を騙し,隠れた計算を行うことができることを示す。
単純な計算は秘密裏に行うことができるが、モデルのサイズに応じてしきい値を超えて、タスクをうまく解くことは、CoTに入力された秘密タスクに関する情報をほぼ直線的にリークする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:46:24 GMT)
FLASH: A "Generate Once, Synthesize Many" Framework for Synthetic Anomaly Generation in Industrial Anomaly Detection [3.7] 合成異常生成は、実際の欠陥が不足したり、利用できない場合に、産業異常データセットを拡張するのに役立つ。
異常生成を異常合成から分離するフレームワークFLASHを提案する。
FLASHは、サンプルごとの生成アプローチよりも11.95倍早く異常を合成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:50:01 GMT)
Into the danger zone: stable extrapolation in high-dimensional function and operator learning [3.7] アウト・オブ・ディストリビューション(OOD)は科学機械学習における中心的な課題である。
既存の理論は、トレーニングとテスト分布の相違を測定する付加的な罰によってテストエラーを制御する。
我々は、OOD一般化誤差が代数速度で収束する正則函数と作用素の類を同定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:47:13 GMT)
Code4Scene: Benchmarking Coding Agents for Constructing and Editing 3D Scenes [3.6] コーディングエージェントは,3D環境の作者によるコードの記述と実行が可能になった。
しかし、3D構造を確実に理解し、シーン状態を正確に制御するかどうかは不明だ。
人間が組み立てたシーンから構築した190のUnreal EngineケースのベンチマークであるCode4Sceneを紹介します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:49:37 GMT)
You Only Reprogram Once: Rethinking Prolonged Training for Visual Reprogramming [3.6] ビジュアルリプログラミングは、事前訓練されたモデルに適応するためのパラメータ効率のよい手法であるが、そのトレーニングは計算コストがかかる。
凍結応答空間から下流の予測器を構成するYou Only Re program Once (YORO)を紹介した。
3つのフルデータ設定で、最強の勾配のないマッピングよりも平均精度を18.4-24.4%向上させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:03:12 GMT)
Faster and Better? Benchmark Bugs and Design Limitations Distort the Evaluation of Vision-Language-Action Acceleration [3.5] いくつかのトレーニングフリー加速法は、ベースライン自体よりも高い測定成功率を達成する。
これらのゲインの背後にある2種類のベンチマーク欠陥を調査する。
これらのタイプの22のバグと4つの設計上の制限を特定します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:12:55 GMT)
Multi-Channel Mitigation of Source-Trust Shortcuts in Fact-Checking RL Agents [3.5] TrustSwapは、ソースラベルをスワップ、ダウン、削除する反ファクトテストである。
3つの出力チャネル(判断、信頼、検索決定)を別々に計測する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:26:39 GMT)
Selecting The Most Informative Tokens in Natural Language Autoencoders [3.5] 我々は、監査官が潜在的な脅威を理解するために検査すべき立場について検討する。
モデル計算から得られる信号と、チャット構造のみで訓練されたランク付け器を比較した。
4つのデータセットのうち3つで、5%のポジションの説明だけで、ほぼすべての成功率を維持している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:50:02 GMT)
STEPS: Scene Text Editing with Preserved Style Using Diffusion and Contrastive Style Encoding [3.4] STEPS(Scene Text Editing with Preserved Style)は、画像の質の高いテキスト置換のための新しい拡散モデルアーキテクチャである。
STEPSは、スタイル保存の改善に焦点をあてて、STEにおける芸術の状態を前進させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:52:54 GMT)
Seeing Is Not Addressing: Auditing Linguistic Access to Frozen Visual Geometry [3.4] テキスト・ツー・イメージ検索における言語的アドレナビリティから視覚的識別性を切り離すことにより、ギャップについて検討する。
画像側コントラストを導出し、各値と、マッチングされた視覚的接地のための代替値とを分離する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:43:02 GMT)
Technical note on: Zero-Training Feature-Space Alignment via Information Geometry [3.4] ディープビジョンモデルは、分散シフト時にしばしば劣化する。
我々はZFGA(Zero-Training Fisher Geometry Alignment)を提案する。
ZFGAは、分布が歪む特徴空間幾何学をシフトする観察に基づいている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:39:56 GMT)
ContextRender: From Execution Dependencies to Agent Context [3.4] 既存のコンテキスト管理メソッドは、以前のツールがその後の実行でどのように使用されるかを見落とし、必要な情報をコンテキストから取り除く。
実行依存の永続的なグラフを通じてコンテキストを管理するContextRenderを紹介します。
ツールフロー解析(Tool-Flow Analysis)は、後の操作が以前のツールからどのように情報を再利用したかを追跡するもので、観察された再利用と呼ばれる信号を提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:57:00 GMT)
Beyond Diagonal State Space Models: Exact Non-Abelian Group Tracking, Solvability Barriers, and Geometric Physical Manifolds [3.4] 非可換状態空間モデルは、コンパクトリー群への状態遷移を持ち上げる。
Cayley-SO(5)-SSMは、S_5 (50.92% vs 5.25%, p = 0.0015) 上のクラインの1884年の天井を破り、SO(3) の7.8倍の分散還元をもたらす。
NC-SSMはS_3,D_4,Q_8および単純群A_5上で100%トラッキングし、3層深い対角線が6.60%に崩壊する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:14:24 GMT)
Flattening the Connectome Spectrum: A Spectral Filter for FC Induces a Pretraining Target for fMRI Encoders [3.4] 言語と視覚における自己指導型事前学習予測と脳基盤モデル(BFM)はその約束を継承した。
ファンクショナル・コネクショナル・コネクショナル・コネクティビティ(FC)の行列に適合するカーネル・リッジの回帰は、テストしたどのBFMよりも正確に個々の表現型を予測できることを示す。
我々は,各被験者のFC行列の固有値を再検討するために,効率的なスペクトルフィルタを適用し,より個人間ばらつきを生かしたモデルを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:12:01 GMT)
Knowing Is Not Choosing: What Explicit Verification Adds Beyond Generative Preference [3.4] 事実的リコールは、正しい候補を生成し、利用可能な候補をランク付けし、最終回答を選択する3つのステップに分けます。
P(mathrmTrue)$による明示的な検証は、Gemma、Qwen3、Llamaの平均ログライクなランキングを改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:05:15 GMT)
L1-MPPI: L1 Adaptive Model Predictive Path Integral for Agile UAV Control [3.4] モデル予測経路積分(MPPI)を用いてL1適応制御を行い、高速UAV軌道の追跡を改善する。
L1の強化により、追跡はモデルの不確実性や外乱の下でも正確である。
提案手法は,UAVが未知のペイロードを受ける場合であっても,シミュレーションと実世界の両方で追跡性能が向上することを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:59:05 GMT)
DROM: A Language-Guided Diffusion Framework for Multi-Skill Robotic Manipulation [3.3] DROMは言語誘導拡散フレームワークで、ロボットが複数の操作スキルを学び、表現し、構成することができる。
DROMはDynamic Movement Primitives(DMP)を活用して,少数の専門家によるデモを,表現力のあるマルチスキルデータセットに拡張する。
我々は,FANUC CRX25iaロボットであるFranka Emika PandaロボットとMuJoCoシミュレーションを用いてDROMを検証する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:15:48 GMT)
ReLaG: A Scalable Framework Generalizing Random Splits to Data with Latent Relations [3.3] ReLaGは、階層的な潜在変数プロセスを通じてサンプル関連性をモデル化するモダリティに依存しないフレームワークである。
近接グラフとコミュニティ検出を用いて関連するサンプルのグループを推論し、独立したトレインテストサブセットを生成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:57:17 GMT)
State Trace Rationale As Auxiliary Task in Reinforcement Learning [3.3] STRATは、深い強化学習エージェントを訓練して、自身の状態の短いテキストトレースを予測する補助タスクである。
人間の空間ナビゲーションにインスパイアされたこの説明は、ランドマーク、ルート、調査の知識を組み合わせて、エージェントの位置、在庫、目標、即時進行を追跡する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:07:22 GMT)
Quantum Query Lower Bounds for Triangle-Listing and Spanners [3.3] 固定された$kge 7$に対して、乗法的な$k$-spannerを構成するには$(n1+frac12_k)$の量子クエリが必要である。
これは三角形リストのための最初の非自明な量子下界であり、ジアンとペン(ICML 2026)が提起した質問である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:18:33 GMT)
RLX: A Unified Multi-Backend Tensor Compiler and Distributed Runtime in Rust [3.2] RLXは1つのプリミティブレベル、3レベル中間表現(IR)に関するコンパイラとランタイムの役割を組み合わせる
RLXはまた、スパースおよび密度線型代数拡張を通じて、科学/物理学スタイルの領域にも拡張する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:09:48 GMT)
SURE: Framework for Safety to Construct Trustworthy AI [3.1] 人々は、AIの安全性と、大きな言語モデルが責任を持って安全に振る舞うことへの要求をますます心配している。
AIの安全性を確保する方法開発への世界的関心が高まっている。
我々は、AI安全性をカスタマイズするフレームワークとして設計されたSURE(A Safe and Unified AI Framework foR Everyone)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:18:47 GMT)
Emergent Tonal Structure in Learned Chord Embeddings and Its Relation to Tonal Tension [3.0] スキップグラムコード埋め込みは音節構造と音節張力との関係を反映していることを示す。
我々は、和音間距離と文脈的和音距離関係から埋め込みに基づく測度を導出する。
解析全体を通して、転置に基づく拡張は一般に学習空間の安定性、音節コヒーレンス、解釈可能性を改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:22:49 GMT)
How much of fly walking is written in the wiring? [3.0] 2つの独立したショウジョウバエコネクトームの脚運動系をシミュレートする。
それぞれを、その構造を徐々に保存する6つのリワイヤネットワークのファミリーと比較する。
リズムは一般的なものだが、反抗的な調整はそうではない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:47:37 GMT)
Emergent phases of superposition: from partial to full representation [2.9] 幅の増大は部分表現相から完全表現相への連続的な位相遷移を駆動することを示す。
この結果から,モデル幅とデータ統計値の結合による表現と損失のモデル化について考察した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:17:51 GMT)
Degeneracy-Orthogonal Geometric Constraints for LiDAR SLAM [2.9] LiDARのオドメトリーは基本的に、特徴弱の走行方向に沿った非拘束ドリフトによって制限される。
横断ランドマークのためのデジェネラル・オルソゴン・コンターオフセット記述子(DeCOD)を提案する。
DeCODは標準の3Dディスクリプタ上で頑健なランドマーク検索を実現し、様々なオードメトリのトラジェクトリを安定させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:25:12 GMT)
Evaluating System One Models for Agent Security Decisions: Reliability, Calibration, and Selective Automation [2.9] System Oneモデルは、事前に定義された回答と、ソフトウェアが入力を許可、ブロック、またはレビューするために使用できるレポートの確率から選択する。
我々は,Jev,Laya,Decider,Bespoke Nimbleを特殊分類器および言語モデル判定器に対して評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:41:24 GMT)
Yggdrasil: a Layer-First 3D Scene Graph for Real-Time Querying [2.8] 生成と消費の両方に効率的であるように設計された最初の3DシーングラフであるYggdrasilを提示する。
Yggdrasilは、発行されたDSGベースラインに対して、クエリを最大121倍高速に回答する。
我々は,Yggdrasilを3つの公開パイプラインに統合し,人間の軌道予測,目標ナビゲーション,人間を意識した行動計画を行う。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:59:38 GMT)
ImbalancE: Inference-Time Latent Search Against Degree Imbalance in Link Prediction [2.8] 学習した表現の質はグラフの異なる領域で大きく異なることを示す。
モデル予測を大幅に改善できる推論時間潜時探索最適化法を提案する。
一般的なベンチマークデータセットから,不均衡な三重項に対するアプローチの価値を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:26:37 GMT)
Encoding and Node Choices in Transversal Fault-Tolerant Distributed Quantum Computations: An Initial Study [2.7] 非局所CNOTなどの分散量子演算に対するBB符号化とノード選択を比較し,検討する。
本稿では,Adamard が引き起こした論理置換を考慮に入れた上で,自己双対 $[120,8,12] BB$ の物理 GCZ が 8 つの同時論理 GCZ 演算を実現できることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:28:23 GMT)
Guard Models Are Overconfident Where Base Models Are Uncertain [2.5] 我々は,迅速な分類のための5つのガードモデルを評価し,敵の攻撃によってキャリブレーションが桁違いに低下することを発見した。
基本モデルは、ガードが失敗するのと同じ入力に対して不確実性を表すのが一般的である。
これらの結果から,攻撃時のガード信頼度とベースモデルの不確実性との一致が示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:36:50 GMT)
A foundation model for energy and radiation systems built on heterogeneous scientific interfaces [2.5] GEODEはタスク固有の科学インターフェースをウェーブレット演算子の共有ルートライブラリに結合する。
単一の関節で事前訓練されたモデルは、空洞の流れ、放射線線量、弾塑性ストレスを表す。
別個の分解は、フィールドレベルがノルムを支配している場合、空間的変動に対して、フルフィールド相対的なL2誤差が実質的に過小評価されることを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:31:44 GMT)
Temporal-Attention Head Specialization During Video Diffusion Training [2.5] 我々は,9つのオープンソラSTDiTトレーニングランにまたがる時間的意識のチェックポイント解決調査を実施している。
国勢調査では、平均的な不明瞭な写真が浮かび上がっています。
分析した760万個の頭部のうち、アテンションマップは局所的なフレームレイアウトモチーフの小さなレパートリーに収束する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:46:15 GMT)
Foresight at the Event Boundary: Evaluating Physical Prediction in Video World Models [2.5] 本研究では,62個の実世界の自由落下記録と3種類のオブジェクトにまたがる124本のクリップに基づくイベントアンコール評価を提案する。
RunwayとVeoがリリースとその後のインパクトイベントを93%以上で生成しているのが分かります。
人間の予測は、集合体における記録された未来を好んで、もっともらしい連続の真のあいまいさを明らかにしている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:24:18 GMT)
DQ-MPCC: Dual-Quaternion MPCC for Quadrotor Racing [2.4] 四輪車レースのためのDQ-MPCC(Dual-Quaternion Model Predictive Contouring Control)を提案する。
我々は,モンテカルロのソフトウェア・イン・ザ・ループシミュレーションと実世界のレースによるベースラインMPCCと比較した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:42:44 GMT)
Passive realism in the presence of open system dynamics [2.4] 本稿では,物理系の先行する特性が,その後の力学を変化させることなく受動的に観察できるという,スケール非依存の仮定に,空想的現実性という用語を導入する。
逐次測定間の時間進化を任意の量子チャネルとしてモデル化することにより、このような環境マスキングは2つの特別なケースでのみ可能であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:42:25 GMT)
L-band single-photon generation from a cavity-coupled silicon C-center [2.4] テレコムLバンドにおけるゼロフォノンエミッションを持つ単一シリコンC中心の分離を報告した。
この結果,シリコンにLバンドのネイティブな量子光源を構築し,超低損失・長距離量子応用の基礎を築いた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:58:25 GMT)
Memory Consolidation Flattens the Temporal Shape of User Facts [2.4] 長期記憶システムは会話を短い記憶音に変換する。
メモは、その事実がまだ保持されているかどうかの証拠を失いながら、ユーザーの事実を保持できる。
メモリライターはアスペクトを選択的にフラットにする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:19:06 GMT)
Routing in Gradient Space: Balanced Usage Is Not Expert Specialization [2.4] 勾配整列ルーティング(GAR)
GARの検証精度が最も高く、タスクロスのみのルーティングよりも1.07ポイント高い。
冷凍されたDeBERTaとQwen3-1.7Bのバックボーンと低ランクのアダプタの専門家により、タスクロスのみのルーティングよりも1.10ポイントも上位にランクされている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:01:14 GMT)
doPlan: A Variable-Horizon Dataset for Multi-Stage Language-Conditioned Planning in Autonomous Driving [2.3] doPlanは、永続的なタスクコンテキストとして乗客言語を研究するために設計された最初のデータセットである。
筆者らは、4つの言語条件駆動モデルを評価し、乗客言語に対する感度が要求された方向と一致した動作に確実に変換されないことを発見した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:08:01 GMT)
Waypoint-1.5: A Real-Time Video World Model for Consumer Hardware [2.3] Waypoint 1.5は、コンシューマグレードのハードウェア上でのインタラクティブなビデオ生成のためのリアルタイム拡散世界モデルである。
Waypoint 1.5の背後にあるデータパイプライン、アーキテクチャ、トレーニング方法論、ランタイムシステムについて説明する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:26:07 GMT)
Learning the Structure of Triangular Transport Maps [2.3] 三角輸送マップはサンプリングに基づく確率的モデリングに対する柔軟なアプローチを提供する。
本稿では,地図,注文,空間を共同で学習するセルフ構造化トランスポートマップ(SSTM)について紹介する。
大規模なデータセットでは、SSTMは自動回帰フローと競合する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:31:30 GMT)
Backpropagated Output Momentum: Relocating Optimizer History from Parameters to Task Space [2.3] バックプロパゲーション・アウトプット・モメンタム(BOM)について紹介する。
BOMはモデル出力にコンパクトな移動平均予測誤差を格納し、その履歴を現在のネットワークを通じて各ステップで再生成する。
言語と視覚の微調整における平均バリデーション性能を、最初の5タスク比較で1.42ポイント改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:11:21 GMT)
Comparing Utility of Inertial, Occupancy, Semantic, and Intent Information in Human Motion Prediction During Daily Tasks [2.2] 室内動作予測における情報ソースの相対的重要性を人体運動拡散モデルを用いて評価する。
定速ベースラインを超える42%の改善を実証した。
セマンティックな情報は屋内での動作予測に有用であるが、屋外ナビゲーションよりも少ない程度に有用であることが判明した。
意図の数少ない指標である視線固定は、特に減速を予測するのに有用であることが判明した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:38:13 GMT)
Demographic Pluralism: Inference-Time Modeling of Pluralistic Human Preference Distributions [2.2] 本稿では,人口レベルの意見分布を推定する推定時フレームワークであるDemographic Pluralismを紹介する。
ジェンセン=シャノン距離を8.4%から26.4%減らす。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:15:07 GMT)
Track-and-Complete: Learning Humanoid Skills from a Single Failed Human Video [2.2] 提案するTRACCは,動作軌跡の有用な部分を模倣し,推定されたタスク結果に基づいてタスクを完了させるパイプラインである。
我々は、Oops!データセットから、6つの失敗する人間のタスクについて、本手法の評価を行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:42:28 GMT)
S2T-Unet: A Structure-to-Style Framework for Inter-Modality MRI Translation [2.2] モダリティ間MRI翻訳は、利用可能な取得から欠落したMRIモダリティを合成することを目的としている。
S2T-Unetは、モダリティ不変な構造情報を明示的にモデル化する構造からスタイルのフレームワークである。
4つの翻訳タスクにわたるIXIマルチコントラストMRIデータセットの実験は、S2T-Unetが最先端の手法に匹敵するか、性能が優れていることを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:06:11 GMT)
A Model-Agnostic Physics-Guided Adapter for Few-Shot Transfer of Coastal Flood Prediction Models to Unseen Regions [2.0] 深層学習サロゲートは、物理学に基づく流体力学シミュレータよりもはるかに高速に高解像度の沿岸洪水マップを作成できる。
我々は,洪水予測モデルの効率的な数ショット転送を可能にする,コンパクトでアーキテクチャに依存しない適応インタフェースであるPhysor Adapter (PA)を紹介した。
PAは、地形の標高と学習した水位を比較し、ピーク水位を学習ゲートを介してデータ駆動分岐と組み合わせて予測する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:34:56 GMT)
Learning to Harvest Without Collapse in a Regenerative Commons: A Lagrangian Framework [2.0] 我々は,再生コモンズを制約付きマルコフゲームや,デザイナー指定の枯渇予算による制約付きマルチエージェントMDPとして定式化し,明確な要件を整備する。
我々は、制約のないゲームや協調制御問題の解からポリシーシーケンスを構築する非定常ラグランジアンフレームワークを開発する。
ゴードン=シェーファー漁業における拘束型IPPOとMAPPOを用いた実験は、枯渇予算が在庫維持、収穫報酬、価格適応をどのように形成するかを検証した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:37:20 GMT)
When a Flatness Proxy Is Not a Function: Robustness Certificates and Training Interventions [2.0] 有効な曲率上限は、ロバスト性証明や本質的な予測特性の介入を正当化しない。
グローバルに有効なゲージ不変な特徴空間修復を導出する。
45回にわたってアルゴリズムモデルと画像モデルのワンステップテストを行い、増幅されたシフトは原規則化予測器を分離し、商規則化予測器は整列する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:57:34 GMT)
WayFinder: Hierarchical Visual-Language-Action for Zero-Shot Waypoint Generation and Low-Level Kinematic Control [2.0] WayFinderは、自律ロボットのためのエンドツーエンドでクローズドループな階層型VLAフレームワークである。
その結果,WayFinderはベースラインの低レベルポリシーに比べてナビゲーションの信頼性に優れていた。
ナビゲーション障害時にのみ高いレベルのMLLMをクエリすることで、WayFinderは微調整の必要性を排除し、高価な推論を最小化し、ナビゲーション成功率を最大で27.45%向上させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:16:16 GMT)
You Cannot Recover What Was Never Measured: Quantifying the Information Ceiling of Ultra-Low-Field MRI Super-Resolution [2.0] 次世代の超高解像度モデルでは、ポータブルな64mT MRIを3Tスキャンのような画像に変換することができる。
実際のローフィールドスキャンの被検体に関する情報が実際にどの程度含まれているかを測定する。
脳全体で判断すると、実際の64mTスキャンは、平面で約3mmから4mmのハーフピッチしか持たない個人特有の構造を持っていることがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:46:38 GMT)
Mathematical Transfer in LLMs Follows Reasoning Approach More Than Topic [2.0] 推論アプローチは、数学的領域が異なる場合でも、ターゲットと解法を共有する。
我々は2つの相反する2時間2ドルの設計を評価した。
5つのベースモデルと3つのトレーニングシードが設計され、SAは40のシードプールモデルでSTを上回っている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:50:02 GMT)
Making Duplicate Reimbursement Unrepresentable: A Verified Ethereum E-Invoice System for Humans and AI Agents [1.9] 本稿では,ブロックチェーンベースの電子請求システムの設計,形式解析,実装について述べる。
我々は、請求書ライフサイクルを、保護されたラベル付き移行システムとして形式化し、標準的および合意的仮定の下で、システムが保証することを証明する。 (i) 請求書は、相互に不信感のある組織においてさえ、少なくとも一度は返済される; (ii) 認証された請求書は、ケッカック256の二次的抵抗が壊れない限り、記録された請求書と一致し、かつ (iii) ライフサイクルのすべての操作に対する認可音性を保証する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:28:31 GMT)
Human-inspired, Task-Dimension-Guided Exploration for Efficient Learning in High Dimensions [1.9] 人間は目覚ましい効率で大きな意思決定空間をナビゲートできる。
近年の行動学的研究は、人が大きな決定空間における次元を、候補特徴次元を探索することによって減少させることを示唆している。
本稿では,タスク次元-機能-テム階層を自動構築した,人間にインスパイアされたモデル非依存型アルゴリズムTDGEを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:10:22 GMT)
Superconducting qubit based on altermagnets [1.9] 超伝導体-超伝導体-超伝導接合におけるジョセフソン効果を利用する。
本研究では, 巨大非調和性と強靭性を組み合わせた新しい超伝導量子ビットを提案する。
この結果はジョセフソンポテンシャル工学のための汎用的なプラットフォームとして、リフォームマグネットを確立した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:57:56 GMT)
A Competing-Hazards Systematization of Loss of Control in Autonomous Agents [1.8] 承認された完了、安全な停止、スコープエスケープ、継続において、それぞれの試みが終了する共通のフレームワークを紹介します。
2025年1月から2026年9月までの22件のインシデント報告と102件のエージェントセーフティ評価を一次資料を用いて実施した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:04:21 GMT)
Factorization dynamics between quantum Fisher information and quantum coherence [1.8] 量子フィッシャー情報(QFI)は、量子状態のパラメータ変化に対する感度を定量化する。
量子コヒーレンス(quantum coherence)は、量子情報処理の重要なリソースです。
本稿では,QFIと量子コヒーレンスの関係について理論的および実験的に検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:51:42 GMT)
CLeaR: A Unified Framework for Resolving the Leakage-Degradation Dilemma in Style Transfer [1.8] CLeaRは、コンテンツリード型スタイル転送のためのトレーニング不要のフレームワークである。
CLeaRはスタイルアライメントを改善し、コンテンツのリークを低減し、LCM-as-Judge評価を改善する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:54:59 GMT)
Character Training for Risk-Averse Agents [1.8] リソースのリスク回避は、ミスマッチしたAIエージェントが破滅的な被害を引き起こすのを防ぐ可能性がある。
我々は,人格特性がリスク嗜好を具現化するための堅牢なメカニズムであることから,人格訓練を通じてリスク回避のエージェントを訓練する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:42:54 GMT)
Towards Semi-Automatically Comparing Keyword-Based and Semantic Search Accuracy [1.8] 本研究では,検索システムの情報検索精度を定量的に評価する新たな予備的枠組みを提案する。
キーワードベースのシステムにおけるランキング精度と、セマンティックチャットベースのシステムにおける検索された情報の完全性である。
産業ケーススタディを通じてこの枠組みを検証し,キーワードに基づく手法による文脈認識検索の統計的に有意な改善を実証した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:00:22 GMT)
How People Use ChatGPT: Conversation-Level Evidence from India, Nigeria, Brazil, and Pakistan [1.8] この研究は、複数の非西洋諸国におけるChatGPTの使用について、人口統計学的に比較した初めての会話レベルである。
これらのユーザがChatGPTを(目的)何に使うのか、何を話すのか(トピック)、どのように使うのかを尋ねる。
個人利用は全国の会話の55-64%を占めており、コースワークは仕事と同じくらい一般的である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:51:26 GMT)
Decode-Latency Feedback Prefill: A Model-Free Controller and Its Generalization Limits [1.7] Decode-Latency Feedback Prefill (DLFP)を導入する。
我々は、DLFPをvLLMに実装し、オープンループのPoisson到着、正確なトークン会計、生要求トレース、NVIDIAテレメトリで評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:44:33 GMT)
MCP Error Messages Written for Developers Hurt the Most Capable Agents Most [1.7] 150の広く使われているMPPサーバでは、3,001のエラーメッセージのうち949が呼び出し元に次に何をすべきかを伝える。
私たちは5つのOpenAIモデルをテストしました。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:56:54 GMT)
Pixel-Level Transformers in Remote Sensing: A Canopy Height Case Study [1.7] 画素レベルのアテンションスキームを考慮し、その結果のモデルが一般により大きなパッチサイズに依存しているモデルよりも優れていることを示す。
予測品質と資源要求との良好なトレードオフを特定するために,効率的な注意変動を用いた広範な実験を行った。
本研究では,中解像度衛星画像における画素レベルの回帰タスクのモデル設計のための実用的なガイダンスを提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:25:15 GMT)
State Transport Routing for Short-horizon Adaptation in Multi-horizon Photovoltaic Forecasting [1.6] 最近の電力測定は、太陽光発電(PV)電力予測に貴重な情報を提供する。
しかし、短期的な傾向を直接外挿すると、長期予測の地平線よりもかなりの誤差が生じる可能性がある。
本研究では,凍結予測モデルの予測を洗練させる軽量アダプタである状態輸送ルーティング(STR)を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:42:31 GMT)
The finite-horizon five-expert prediction problem [1.6] 有限時間地平線設定におけるエキスパートアドバイス偏微分方程式(PDE)を用いた5つの専門家予測に対する明確な解を与える。
解公式は、敵のランク戦略がグローバルに最適であり、COMB戦略がセット上で正確に最適であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:10:29 GMT)
Evaluating and Benchmarking the System One Model Jev [1.6] Jevは、テキストを生成しないTypeSafe AIのSystem Oneモデルである。
固定オプション、ルーブリック上の位置、あるいは文が真である確率から選択を返す。
分類,ルーティング,自然言語推論,読解,コモンセンス推論,モデレーション,法的条項解析,ルーリックスコアリングにまたがる37のデータセットに対して,Jevゼロショットを評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:15:04 GMT)
Privacy in Personalized AI Is a System Property, Not Just a Model Property [1.6] 個別のモデルレベルの分析やコンポーネントレベルの分析は、パーソナライズされたAIによって生じるすべてのプライバシーリスクを捉えるものではない、と我々は主張する。
システムレベルのプライバシ評価,インタラクショントラジェクトリ,内部情報フロー,間接リーク,プライバシユーティリティトレードオフの4つの要件を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:06:35 GMT)
Beyond the Headset: A Systematization of Knowledge on Extended Reality Privacy and Security in Healthcare [1.5] 我々は、2017年から2024年にかけて発行された65の研究を、XR、セキュリティ、プライバシ、ヘルスケアの会場でレビューする。
我々は、デバイス、ユーザ、ネットワーク、クラウド層にまたがる統合された脅威分類を開発する。
共有ベンチマークデータセット、強力なアーティファクトリリースプラクティス、クラウド層保護の改善、より包括的な検出、緩和、リカバリメカニズムを強調した研究ロードマップを概説する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:05:12 GMT)
Sex Estimation from Footwear Outsole Impressions Using CNN Transfer Learning and Interpretable Image Statistics [1.5] 靴のアウトソール印象は、法医学的パターンの一般的な形態である。
畳み込みニューラルネットワーク(CNN)の変換学習と従来の特徴に基づく分類を比較した。
微調整のCNNは、全体的な予測性能が最も高い。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:59:14 GMT)
THEIA: A Multimodal Dataset and Benchmark for Vision-Language Analysis of Layout [1.5] 本稿では,質問応答と組み合わせた数千のレイアウト画像を含む新しいデータセットであるTheeIAを提案する。
アナログ回路のGDSIIファイルを解析するために、微調整視覚言語モデル(VLM)を用いたベンチマークを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:58:59 GMT)
Compiling Learning Problems into Adaptation Programs for Language Models [1.5] 適応コンパイルを導入し、モデルがどのように、どのように、どのように、どの程度、共同予測と決定の問題として適応すべきかを再設定する。
本研究では,適応探索が関連する学習問題にまたがって改善できることを示し,事前適応経験を将来の学習方法を決定する基盤にすることを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:27:51 GMT)
Cavity-QED enhancement of quantum entanglement and battery performance in double quantum dots [1.5] 単一モードマイクロ波空洞に結合した1電子シリコン二重量子ドット(eDQD)の量子相関とエネルギー貯蔵について理論的に検討した。
この空洞は、量子相関とエネルギー貯蔵を制御するための追加の調整可能な手段を提供する。
半導体eDQDキャビティ系における量子相関と抽出可能エネルギーの相補的制御として空洞結合とSOCを確立した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:45:42 GMT)
Ramanujan quantum expanders from the Weil representation [1.5] 任意の奇素数$q$と$D=q+1$に対して、次数$D$のラマヌジャン量子拡大器の無限族を構成する。
量子展開器の次元が$N$の場合、我々の実装では$O(log2N)$基本ゲートと$O(logN)$アンシラクォーディットを使用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:35:11 GMT)
Integrated balanced homodyne detector using CMOS capacitive-feedback TIA for quantum measurements [1.5] 28nmCMOSで実装された静電容量フィードバックトランスインピーダンス増幅器と、ImecのiSiPP200シリコンフォトニクスプラットフォームで製造されたカスタムフォトニック集積回路を組み合わせて、低ノイズで高速な平衡ホモダイン検出器を実証した。
受信機は、7.6GHzの3dB帯域、27dBの最大ショットノイズクリアランス、13.7GHzのショットノイズ制限帯域、54.8dBの共通モード拒絶比を達成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:25:54 GMT)
A Divide-and-Conquer Quantum-Selected Configuration Interaction for Evaluating $π$-$π$ Stacking Interaction Energies in the Benzene Dimer [1.4] ベンゼン二量体とCAS(28e,20o)の直接変動量子計算は、40量子ビットと深い回路を必要とする。
本稿では,Deep VQEとQSCIを併用したDivide-and-Conquer Quantum-Selected Configuration Interaction (Deep QSCI)を提案する。
6-31G*のモデルでは、カウンターポア補正されたCCSD(T)値の-1.14kcal/molに比べて、-0.91kcal/molの魅力的な最小値が4.0ドルである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:47:12 GMT)
Learning quantum symmetries [1.4] 量子オブジェクトの対称性を学習するための量子アルゴリズムについて研究する。
我々の出発点は、最近導入された State Hidden Subgroup Problem (StateHSP) である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:38:47 GMT)
Optimal single-copy estimation of quantum state moments: why $\operatorname{Tr}(ρ^3)$ and $\operatorname{Tr}(ρ^4)$ are equally hard [1.4] 未知状態の非線形特性を限定的な実験的アクセシビリティで推定することは、量子学習の基本的な問題である。
状態モーメントを$operatornameTr(t)$で推定し、任意の適応的な単一コピー計測を可能にする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:16:45 GMT)
Lost in Conversation or Lost in Translation? Diagnosing Multi-Turn Degradation in RAG [1.4] Retrieval-augmented Generation (RAG) と Graph-based variant (GraphRAG) は、主に単一ターンで完全に指定されたクエリで評価される。
我々は,この評価ミスマッチを大規模シミュレーション研究により系統的に検討した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:39:41 GMT)
Pow3R-SLAM: Real-Time RGB-D SLAM with 3D Reconstruction Priors [1.4] Pow3R-SLAM(Pow3R-SLAM)は,Pow3Rを用いたリアルタイムRGB-D同時ローカライゼーション・マッピングシステムである。
MASt3R-SLAMにインスパイアされた最近のモノクラーSLAMの研究は,ネットワークの予測に先立って深度を組み込むよう拡張した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:22:24 GMT)
Rethinking Multimodal Fake News Detection in the Generative AI Era [1.4] 本稿では,GAHR(Generativity-Aware Hierarchical Reasoning)フレームワークを提案する。
既存の複数のフェイクニュース検出ベンチマークとWeibo26の実験により、GAHRは、生成コンテンツを効果的に識別しながら、競合する妥当性検出性能を達成することが示された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:59:46 GMT)
A stochastic subgradient method with optimal failure exponent [1.4] 我々は,目標精度を超える最適差を観測する確率を最小化するアルゴリズムを設計する。
小音域では,Gsgens と van Parys (2025) の逆誤差モデルに縮退する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:53:57 GMT)
Towards verifiable quantum advantage with random circuits: Observables that survive concentration [1.3] システムサイズが大きくなるにつれて,回路と回路のゆらぎが持続することを示す。
1次元におけるOTOCのブルートフォース古典シミュレーションよりも厳密な改善を示す古典的アルゴリズムを開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:56:42 GMT)
Best Practices in EEG Analysis: Preprocessing, Modeling, and Machine Learning [1.3] 脳波(EEG)分析は、前処理、統計モデリング、機械学習において慎重に選択する必要がある。
脳波信号は、人工物、体積伝導、低信号対雑音比、かなりの物体間変動に非常に敏感である。
この章は、現代の脳波分析の実践的で方法論的なガイドを提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:26:17 GMT)
When Can Prefixes Compile LoRA? Exact Resource-Capped Tests for Frozen Attention [1.3] 回答はアダプタのターゲットによって3つの条件で異なることを示す。
まず、可観測性:ある因果的読み出しにおいて、すべての独立キー-値プレフィックスは、クエリ、アテンションパーティション、値数値演算子を通してのみコンテンツを見る。
第二に、実現可能性: 共通のクエリでは、任意のプレフィックスは正確に2つの集約変数に還元される。
第3に,アフィンクエリエクスポージャーによる実装: 2r$符号付きスロットはランク-r$値の更新を近似するが,その値は$O(-3/2)$として増加する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:40:21 GMT)
Purlin: Separating Orchestration from the Datapath of Collectives [1.3] 本稿では,分散推論のためのスケールアップ通信フレームワークであるPurlinを紹介する。
7つの集団で、Purlinは最大5.14倍のレイテンシのスピードアップと4.50倍の帯域幅の改善を実現している。
オンラインLLM推論では、Purlinは平均で1.26倍、最大で2.85倍の対話性向上を実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:57:27 GMT)
Benchmarking graph-based models for in-silico toxicity prediction in drug discovery [1.2] 化学毒性の早期予測は、下流のコストを削減し、化合物の優先順位付けを改善するために不可欠である。
グラフ深層学習(GDL)は毒性予測の強力なパラダイムとして登場した。
本稿では,GDLに基づく毒性予測のための統一的で標準化されたベンチマークフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:31:15 GMT)
Towards Breaking the Learning System Wall Using Multimodal Tutoring Transcriptions [1.2] 本稿では,AIによるマルチモーダル文字起こしシステムを導入し,画面録画映像を統一されたスクリーンプレイスタイルの文字起こしに加工する。
本稿では,AI生成したマルチモーダルテキストをMATHia学習ログと時間的に整合させる手法と,MATHia学習ログと整合する学習過程の同定と分類について述べる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:56:08 GMT)
SafeLLM4SE: Statistical Evaluation and Reporting for LLM-based Software Engineering Systems [1.2] 本稿では,大規模言語モデル(LLM)を評価するための実践的方法論および報告標準であるSafeLLM4SEについて述べる。
生成された出力を決定論的アーティファクトとして扱うのではなく、SafeLLM4SEはそれらをプロセスの実現として扱い、品質、安定性、推定の不確実性を区別する。
SafeLLM4SEはPyPIで利用可能なオープンソースソフトウェアパッケージとしても提供されており、研究者や実践者が方法論を拡張することができる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:34:56 GMT)
After the Fix: Transfer of Corrected Agent Experience [1.1] エピソードの修復は、次のタスクにおいて、その体験をより良く記憶できることを示す。
私たちの3300は100のThinkingBoxペアと100のAPEXペアをソース状態の継承なしでカバーしています。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 02:52:46 GMT)
Where Scientific Search Agents Fail: Decision-Checkpoint Auditing of Exposure and Inspection Attempts [1.1] 最終回答の精度は、科学的調査エージェントが対象の紙に遭遇しなかったか、検査しようとしたか、検査後に受け入れられた回答を返すかを明らかにしていない。
推論中にベンチマークラベルを使わずに観察やツールアクションを記録する決定チェックポイントを導入し、対象のアイデンティティや評価者ラベルに参加して、記録されたイベントの結果カテゴリを割り当てる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:53:00 GMT)
Energy Variation in Training Modern Computer Vision Architectures [1.1] ディープラーニングは、モデルトレーニングに関連するエネルギー消費を大幅に増加させた。
本研究では,現代のコンピュータビジョンアーキテクチャ7つのトレーニングのエネルギー変動を実験的に測定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:15:37 GMT)
Gestalt: a meta-foundation model for astronomy [1.1] 我々は8つのファミリーから22個の凍結基礎モデルのバスケットを組込み、各ビューを白くし、埋め込み結合の無作為なSVDを取り込む。
その結果、1024次元の埋め込みは、物理特性と銀河形態推定のための測定値の19/21において、各バスケット部材よりも優れていた。
我々は、既存の一般モデルから有用な天体基盤モデルを構築することができ、単一の教師なしプロジェクション以上の訓練は必要としないと結論付けた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:00:02 GMT)
Benchmarking System One decision models against trained classifiers and language models for automated decision gates [1.1] 小さな訓練された分類器は意図に対して最も正確である。
微調整された決定チェックポイントは、修正されていないバックボーンに対して意図的な精度を得る。
意図的に訓練された第1ステージがJevにエスカレートされ、その正確さは、全グラフィックスプロセッサ使用時のコストの0.43と一致する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:57:59 GMT)
TomoTransformer: Towards a Foundation Model for CT Reconstruction [1.1] TomoTransformerはトランスフォーマーベースのアーキテクチャで、各テキストローカルなフィルタリングプロジェクションを個々のトークンとして扱い、自己アテンションを通じて行方不明のビューを予測する。
任意の角度の位置と検出器次元で任意の数の入力射影を処理し、再訓練することなく任意のターゲット角度をクエリすることができる。
様々な医学的CT解剖学と自然画像にまたがる大規模なデータセットで訓練されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:53:27 GMT)
Authority Bias in Language Models: Source Deference and User Agreement Are Not Interchangeable [1.1] 言語モデルは、ユーザが主張するものと一致しがちである。
オープンウェイトな5つのファミリーと3つのクローズドAPIのギャップを測定します。
ソースの推論とユーザ合意はモデル内での振る舞いの交換にはなりません。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:58:04 GMT)
Raw Imagery Impacting Your AI: Should You Care? [1.0] 本研究では,Nyquistにおける信号対雑音比(SNR),MTF(Modulation Transfer Function),GSD( Ground Distance Smpling)による物体検出における画像劣化の影響について検討する。
その結果, 画像品質の影響は劣化機構に依存し, 劣化量の増加は必ずしも容器検出性能の比例的に低下するとは限らないことがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:15:01 GMT)
Neural Structural Reasoner: A Brain-inspired Architecture for Reasoning over Structured Knowledge [1.0] 我々は,脳にインスパイアされたネットワークであるNeural Structure Reasoner (NSR)を紹介した。
NSRはすべてのデータセットをリードすることなく、競争精度を達成し、複数のニューラルネットワークよりもトレーニング時間を短縮した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:31:46 GMT)
Degree Balance as a Fine-Grained Complexity Boundary for Quantum SAT [0.9] 2つの軽度の仮定の下で指数関数的に高速な古典的および量子的アルゴリズムを示す。
アルゴリズムの正則性への依存は、ある意味では、ほぼ最適である。
我々の上と下の境界は、量子飽和性のための微細な複雑さの二分法を確立する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:24:01 GMT)
Profiling the Energy Consumption of Serverless Functions with Joule Profiler [0.9] 本稿では、サーバレスプラットフォームにデプロイ可能なサーバレス関数のエネルギー効率を実証研究する。
この結果から,まずプログラミング言語,次に言語ランタイム,それから実行環境のみを選択することが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:17:35 GMT)
Nonpreemptive Scheduling While Learning Context-Dependent Service Rates [0.9] 単一サーバシステムにおける非プリエンプティブなコンテキスト待ち行列帯域について検討する。
Learn--Clear--Planはシステムを推定し、結果のベルマン再帰を使って地平線に依存した決定を行う。
モデルを知らずに$widetildeO(sqrtd/T)$の追跡誤差を実現する推定SEPTアルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:20:41 GMT)
PTED: A multi-dimensional two-sample test for scientific inference and generative machine learning [0.9] 2サンプル試験は推論や生成モデルに広く適用できる。
強力な2サンプルテストのPython実装であるEnergy Distance (PTED) を用いた置換テストを提案する。
PTEDは、すべてのテストに敏感な唯一の方法であるが、従来の最大平均離散性は、過度に適合するテスト以外の全てのテストと同一である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:45:23 GMT)
Designing a Boundary Negotiating Artifact for Collaborative Socio-Technical Sense-Making in AI Regulatory Sandboxes [0.9] 規制サンドボックスは、AI規制のソリューションと見なされている。
社会技術的解釈を利害関係者に委ねる法的枠組み。
AIRSesにおける意味を仲介する手段として境界交渉アーティファクトを開発した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:26:19 GMT)
When Scientific Contradictions Are Lost in Translation [0.9] 我々は、満足できないXOR制約システムを生成し、その制約を科学的レポートに翻訳する。
ある代入はより多くの制約を満たす一方、別の代入は期待される生物学に適合するよりも少ないがより良い。
これは単純なジレンマを生み出します – モデルは制約に最も適した代入を選択しますか、あるいは生物学的な期待に合うものを選択しますか?
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:22:54 GMT)
Searching for BSM Experimental Signatures with Large Lagrangian Models [0.9] hAIthemは文献の外でモデルシグネチャを探索するためのフレームワークである。
我々は、ある理論の高次元パラメータ空間のどの部分が制約のサブセットで除外されないのかを学習するRLエージェントを構築する。
フレームワークは次に、確立されたツールで計算された可観測性を使用してRL境界領域を分離する決定ツリーを構築し、残りの領域を現実的なシグネチャを生成するために競合するLLMエージェントのセットに渡す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:00:01 GMT)
Generative sequence modeling for infinite memory processes via predictive states [0.9] 本稿では,プロセスの予測状態に基づく新しい推定手法を提案する。
我々は,過去の履歴を低次元統計量に圧縮できる場合,推定器が高速収束率を達成することを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:42:08 GMT)
Identifiability Guarantees for Drivers and Dynamics of Delayed Physical Systems [0.8] 構造的ドライバと遅延微分方程式のドリフトを同定する理論基底法を開発した。
本手法は,運転者識別能力のベンチマークと,学習力学の物理的整合性を評価するための第2のベンチマークにおいて,他者よりも優れていた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:22:19 GMT)
Executor-aware Candidate Selection via a Feasibility Certificate [0.8] モジュラーロボットシステムは、しばしば州に依存した厳しい制約を強制する下流の執行者から運動計画を切り離す。
本稿では,予測されたロールアウト状態における実行者ハードセットからコマンド証人を構成する証明書ベースの候補選択フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:17:09 GMT)
Anomalously enhanced lifetimes of low angular momentum Rydberg states in singly charged alkaline-earth metal ions [0.8] 我々は, 特定の低角運動量イオンRydberg級数に対して, 8以上の因子による異常寿命の増大を報告した。
異常はゼロ温度と有限温度の両方に存在するが、異なる機構によって引き起こされる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:00:57 GMT)
A Finslerian Approach for Embedding Directed Data [0.8] 我々は、移動方向に依存するフィンスラー多様体からサンプリングされた方向データについて検討し、この非対称距離から構築されたカーネル作用素について検討する。
有限個のサンプルから構築された対応するグラフ作用素が、これらの極限に一様かつほぼ確実に収束することを証明する。
ランダー計量について、このベクトル場は明示的であり、対称部分のスペクトルと基礎となるドリフトから多様体構造を復元する埋め込みアルゴリズムが得られる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:16:32 GMT)
Where Privacy Belongs: Placement Diagnosis and Certified Selection for Private Counterfactual Explanations on Graphs [0.8] プライバシは、認証による最適化を、コンストラクションによる認証に置き換える。
グローバルな感度の妥当性の高いクリップされたユーティリティは、完全なリリースオブジェクトに対して純粋な$varepsilon$-DPを与える。
主要なコストは、公開開示における測定可能な単調な価格である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:23:48 GMT)
AxonSynth: Domain-Randomized Synthetic Data for Zero-Shot 3D Axon Segmentation in Light-Sheet Microscopy [0.7] Axon Synthは3Dアクソンセグメンテーションモデルをトレーニングするためのドメインランダム化合成データフレームワークである。
3D級のU-Netは、背景、軸索シース、軸索内空間を予測するために訓練されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:05:40 GMT)
Learned Queries and Keys Are All You Need: Replacing the Value Projection with Structured Transforms [0.7] 3つのヘッドの代わりにデュアルヘッドトランスを導入し、パラメータ数とキャッシュメモリの要求を減らした。
ImageNetでトリプル方向変換器よりも優れた結果を得た。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:37:59 GMT)
Detail in Context: A Dual-Scale Machine Learning Framework for Mycosis Fungoides Detection [0.7] Mycosis fungoides (MF) は皮膚T細胞リンパ腫の稀な形態であり,早期に誤診されることが多い。
本稿では,自動MF検出のための包括的診断フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:21:31 GMT)
Robustness of Local Energy Markets to Cyberattacks: Case Study of False Data Injection [0.6] 地域ベースの地域エネルギー市場の市場浄化は電力需要予測に依存しており、誤ったデータ注入攻撃に弱い。
本稿では、相互接続型多都市電力市場に対して、最悪のバスレベルFDIを特定するための二段階最適化フレームワークを提案する。
3つのコミュニティを持つIEEE 33-busシステムに関するケーススタディでは、システムレベルのゼロサム攻撃でさえ、局所的なトレーディングを再構築できることが示されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:34:59 GMT)
RAE-PPG: Duration-Grounded Retain-and-Extend Pretraining for PPG Foundation Models [0.6] 本研究では,Retain-and-Extend (RAE-)を導入し,1つのTransformerエンコーダを10秒,30秒,240秒の入力でトレーニングする。
エンコーダは、期間固有のパラメータグループに分割され、後のステージでは、現在のステージに割り当てられたグループのみを更新しながら、以前のグループを再利用することができる。
8つのデータセットから18タスクにわたって、最終凍結エンコーダは、既存の5つのPSG基盤モデルと比較して12タスクで観測された最良のスコアを達成している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:05:30 GMT)
Invariant Atoms: Sparse Coordinates of Local Semantic Geometry in Language Model Representations [0.6] 本研究では,言語モデルにおける局所的な方向に沿って意味的変動が組織化されることを示す。
我々は,意味的変位を再現し,ニュアンス変動を抑制した共有意味的フレームとスパース座標を学習する。
これらの知見は、言語モデルにおける局所的意味幾何学のためのスパース座標系として、再利用可能な不変方向をサポートする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:14:19 GMT)
Fisher-IRG: Fisher-Induced Local Invariant Representation Geometry across Language and Vision Models [0.6] 本稿では,フィッシャー誘導型不変表現幾何 (Fisher-IRG) を提案する。
セマンティック保存・セマンティック・チェンジ領域を構築し,その局所的なフィッシャー情報を集約し,コントラッシブな一般化固有値問題を通じて不変方向を復元する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:19:09 GMT)
When Cyber Scoring Systems Diverge: An Empirical Comparison [0.6] 脆弱性スコアリングシステムとしてCVSS,EPSS,SSVC,IronMinerの4つを比較した。
スコアリングシステムの選択は、緩和戦略と脆弱性優先順位付けに大きな影響を与える可能性がある。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:31:22 GMT)
Signatures of semantic search in the activations of large language models [0.6] 我々はジャコビアンレンズを用いて、概念レベルのアクティベーションがスイッチングを予測することを示す。
抽象カテゴリ関連ラベルの中間層Jレンズ活性化はスイッチングを期待して増加する。
スイッチングを期待して活性化される一般的な残留ストリーム方向を同定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:17:32 GMT)
Optimal Ground-State Preparation with a Guiding State [0.6] 本論文は,近年の2つの地中エネルギー推定論文に対する状態準備のフォローアップである。
本稿では, [HMdW03] スタイルの振幅増幅と誤差低減に基づく2つのアルゴリズムと, トランスデューサの構成を用いたアルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:41:44 GMT)
Unified Optimality Conditions for Stochastic Optimal Control in the Rough Path and Itô Frameworks [0.6] We show that the adjoint equations of the It and rough PMPs are connected through the conditional expectation $p_ttextIt=mathbbE[p_ttextrough mid mathcalF_t]$。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:52:37 GMT)
A Neutral Atom-Based Hybrid Classical-Quantum Approach for the Entanglement Routing Problem [0.5] 量子情報ネットワークにおける効率的なエンドツーエンドの絡み合い分布は、限られたリソースと忠実性制約の下でのルーティングを必要とする。
本研究では, 整合性制約のないマルチ商品フロー問題として, 絡み合い経路について検討する。
我々は中性原子量子最適化を古典量子列生成のハイブリッドフレームワークに統合する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:00:34 GMT)
Transformers Stop Thinking Too Early, and a Tiny LoRA Fixes It [0.5] タスク訓練されたランク8 LoRAは、この計算を拡張し、全てのモデルの重みを凍結する。
凍結したヘッドはチェーンを徐々に上向きに読み上げ、親線からの注意を取り除くことでリレーが停止する。
凍結モデル測定は、4つの保留モデルのうち3つの許容範囲内において、最後の有用な介入層を特定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:02:58 GMT)
Anthropomorphism in the age of Large Language Models: An overview of potential risks and mitigations [0.5] 本稿では,AIにおける人文準同型に関する最近の文献を合成する。
理論的な枠組み、人間的なAIのフレーミングにおける言語の役割、人為的な機械の様々なリスク、そしてこれらの問題を緩和するための戦略について論じている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:15:01 GMT)
Does Text Steer Neural PDE Surrogates? A Controlled Diagnostic with OperatorCLIP [0.5] テキスト条件のニューラルサロゲートからの低い誤差は、それ自体は、モデルがテキストの意味を使用するわけではないことを示している。
演算子CLIPによるこの帰属問題について検討し、無条件FNO、定数FILM制御、およびコントラストアライメントで訓練された固定タスク記述を比較した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:37:15 GMT)
End-to-End Optical Semantic Communication over a Nonlinear WDM Fiber Link [0.5] 共同画像分類と再構成のためのエンドツーエンドの光意味コミュニケーションシステムを提案する。
システムは各画像を、タスク関連情報を保存したチャネルシンボルの固定長シーケンスに直接マッピングする。
その結果、セマンティック通信は光の到達範囲を同時に拡張し、伝送資源を削減できることがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:28:49 GMT)
The Default Trap: Rethinking Plan Evaluation in Tool-Using LLM Agents [0.5] 実行者は、同じ情報選択確率の小さな変化を示しながら、供給された計画の優先度の変化に強く対応することができる。
異なる情報ターゲットを優先するペアプランを、共有のノープラン参照と比較する。
これらの知見は、優先度応答性、プレゼンテーション依存のデフォルト、タスクの成功とコストを共同で報告することを支援する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:38:13 GMT)
When Tools Silently Lie: Evaluating and Mitigating Blind Compliance in Tool-Augmented Data Agents [0.5] ToxicBenchを導入し、数値、ラベル、スキーマ、検索エラーのチェックと適用を計測する。
3つのアダプタの118タスクのGPT評価では、中毒はタスク成功率を26~39ポイント低下させる。
スコアラーを凍結した後、200の軌道上の人間のアノテーションと比較し、96%のタスク・サクセス・アグリーメントが得られた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:45:17 GMT)
A neural network that maintains and retrieves memories based on context [0.4] 我々は、自然主義映画を見ながらコンテキストを推測するために、リカレントニューラルネットワーク(RNN)を訓練する。
コンテキストはまた、コンテントの類似性だけでなくコンテクストの類似性にもとづいてメモリを検索するように、エピソードメモリの検索を変調する。
本研究は,自然環境における情報保守と長期記憶検索を文脈で調節する計算機構を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:20:22 GMT)
Speed in the Blind Spot: An Interpretability Analysis of Dynamic Perception in VLMs for Autonomous Driving [0.3] 速度理解を3つの課題にまたがる制御診断として研究する。
nuScenesでは、運転指向のAlpamayo-1.5 Vision-Language-Actionモデルとともに、オープンウェイト汎用VLMとPhysicalAI VLMを評価した。
言語評価と時間的摂動, 対実的エゴ速度ヒント, 隠れ表現の線形プローブを組み合わせる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:54:45 GMT)
LazySloth: Bounded LLM-based Lazy Tree Search for Fast Long Video Comprehension [0.3] 本稿では,ビデオ理解と検索タスク2.9-8.3xを高速化する効率的な木に基づく探索手法であるLazySlothを紹介する。
LazySlothは、最近の2つのオープンソースのベースビジョン言語モデルで、同様のあるいはより良い最終タスク精度を実現している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:53:57 GMT)
Breakdown of Local Denoising as Semantic Speciation [0.3] 生成モデルは2つの明らかに異なる時間的窓を示す。
様々なフロンティアモデルにおけるそれらの近一致の証拠に動機付けられ、意味情報の空間分布を通してそれらの関係を考察する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:50 GMT)
Repetition, Not Length: Isolating the Counting Failure in Neural Text-to-Speech [0.3] テキストから音声へのモデルループ、切り替わり、フレーズを何度も繰り返すテキストのカウントをなくす。
繰り返しそのものが、それに伴う長さではなく、それらを壊すものであることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:10:53 GMT)
From Unity Simulation to Diffusion-Based Augmentation: Quantifying Dataset Balance for Robust Object Detection [0.3] 現代のコンピュータビジョンモデルは、大規模アノテートデータセットでトレーニングされた場合、高い精度を達成する。
本稿では,2つの相補的データ生成パラダイムを比較検討する。
統一された実験フレームワークは、実、シミュレート、生成ソース間で制御されたデータセットの混合を可能にする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:58:41 GMT)
A Proposed Rubric for Evaluating Expressed Clinical Reasoning in Large Language Model Responses [0.2] 本稿では,モデル応答における表現された臨床推論を評価するためのルーブリックを提案する。
一般ドメインフレームワークは、その設計を通知するが、検証された臨床機器として扱われることはない。
信頼性試験、建設の妥当性試験、臨床応用試験はまだ行われていない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:19:42 GMT)
Human-AI Collaboration: From Paradoxes to Patterns [0.2] エビデンスによると、人間とAIシステムは、単独よりも協力することで、より優れたパフォーマンスを発揮する。
本稿では、人間とAIのコラボレーション(自律性とイニシアチブ)における2つの重要な設計側面について検討し、それらが生み出すコラボレーションパターンについて考察する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:38:17 GMT)
CompOrca: Corpus-Scale Compliance Labelling of Instruction-Tuning Data [0.2] 我々は,4,233,923個のOpenOrcaコーパス全体に対するコンプライアンスラベルであるCompOrcaを提示する。
いずれの例も、オープンウェイトLSM判事の5つの独立したパスによって、準拠または非準拠に分類された。
シングルパスのフラグは2.7-3.2%で、コーパスの2.7-3.2%は準拠していない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:25:07 GMT)
PCaPaint: Prostate Cancer Inpainting by Mitigating Shortcut Learning [0.2] 潜在拡散モデル(LDM)に基づく前立腺癌塗布法であるPCaPaintを紹介する。
合成腫瘍のテクスチャを損なうショートカット学習を克服するために, 簡易かつ効率的な条件付け戦略を提案する。
当法は,最新のLCMベースの腫瘍塗布法より有意に優れていた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:16:36 GMT)
Which Attention Heads are like the Human Head? Not the Ones that Compute [0.1] 本研究は,人間の脳波とアテンションヘッド表現を比較し,その特徴がタスクパフォーマンスに与える影響を検証した。
脳に整列した頭部はパフォーマンスに寄与するが、その除去は属性パッチによって選択された頭部の除去よりも破壊的ではない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:51:03 GMT)
Reach Into The CHOIR: Free-List Elicitation Uncovers Distinct Model Voices in LLM Ensembles [0.1] CHOIRは認知人類学からLLMアンサンブルへのフリーリスト導入を実現するフレームワークである。
ChoIRは、ランク付けされたリスト、アイテムをプロンプトレベルの概念に繰り返し適用し、モデル、プロンプト変種、ペルソナ条件を越えて概念のサリエンスを測定する。
Infinity-Chat 100におけるCHOIRの評価を行った。これはオープンエンドモデルの均一性に関する最近の研究と、メカニズムレベルのコントラストを分離するために設計された27の問合せ対象診断バンクについてである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:40:46 GMT)
Defining and Categorising Human-AI Interactions in Clinical Trials: A Multidimensional Human-AI Classification Approach [0.0] 本稿では,臨床試験におけるヒト-AI相互作用(HAII)について検討する。
このフレームワークは、AIタスク、人間とAIの関係性、相互作用構成、相互作用する人間グループに応じてインタラクションを分類する多次元分類フレームワークを提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:18:26 GMT)
A quantum double-bracket algorithm for imaginary-time evolution with exponentially shorter depth [0.0] 回路深度を指数的に減少させる確率的変種(PDBQITE)を導入する。
我々のアルゴリズムでは、1つのアシラ量子ビットと1つの制御されたリアルタイム進化と1回の繰り返しの中間回路計測からなる量子回路しか必要としない。
PDBQITEは、分子ハミルトニアンの地中調製のための短期確率論的アルゴリズムPITEよりも優れていることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:19:47 GMT)
Measuring the spin of a spin-1/2 and getting a result of 7 [0.0] 1988年、アルベルト、アハロノフ、ヴァイドマンは、いわゆる異常弱値を測定することのできる弱いシュテルン・ゲラルハの実験を提案した。
この実験を最初に提案した例を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:31:06 GMT)
Interpretable intrinsic dimension estimation through componentwise calibration of distance and angle [0.0] 我々は、DANCo成分を分割した距離と角の差分曲線を保持するように構成的に再構成する。
距離成分について、一般化比ID推定器(Gride)の一般順序比に対する閉形式Kullback-Leibler分散を導出する。
角成分については、濃度マッチングを維持しながら平均方向の整列を動機づける2つのサンプリングレジーム(Profiled)
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:27:37 GMT)
Local autonomous inference machines for quantum LDPC codes [0.0] 本稿では,量子LDPC符号の復号化のための局所的および分散的フレームワークを提案する。
BP復号のしきい値を示すコードは、自律的な局所的計測・フィードバックのダイナミクスに推し進めることができることを示す。
この構造は2次元および3次元トーリック符号の点状セクターにおけるしきい値挙動を示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:55:19 GMT)
Z-Sigil: A Public-Key Cryptosystem with Chained Selection over a Fiber Bundle of Module-Lattice Keys [0.0] Z-Sigilは公開鍵暗号システムで、平文が固定モジュールラテックスファミリーから逐次鍵を選択する。
メッセージは長大で、ゼロパッドで、32バイトのブロックに分割される。
制限された直接復号化モデルは、部分鍵露光下でのフラグメント回復を定量化する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:48:15 GMT)
Width Expansion as a Method for Class Incremental Learning [0.0] クラスインクリメンタルラーニング(Class Incremental Learning)(クラスインクリメンタルラーニング(Class-IL))は、以前に獲得した知識を保存しながら、時間とともに新しいクラスを学習するモデルを必要とする。
本研究は,正規化損失基準に従って既存層内のニューロン数を増大させる動的幅拡大法を提案する。
永続的なキー値メモリを持つアテンション機構も、特徴表現を安定化するために組み込まれている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:38:53 GMT)
Which papyrus HTR is good enough? Character-error-rate tolerance of four papyrological tasks on Greek texts [0.0] 本研究は,4つのパピロジ的課題に対する文字誤り率(CER)の範囲を,出版版を基礎的真理として検証する。
我々は、文書タイプ、日付、文書対文学分類のための小さなモデル(TF-IDF、fastText、文字CNN、BYT5-small)を訓練する。
クリーンテキストで訓練されたモデルと特定のCERレベルで再訓練されたモデルを比較し、CER全体で評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:03:30 GMT)
When Post-Processing Fairness Constraints Help and When They Harm: Evidence from Eight Cross-Domain Evaluations [0.0] FAPE(Fairness Auditing for Production Environments)は、8つのドメイン評価にまたがる単一の後処理の介入を評価するフレームワークである。
介入効果はベースラインの格差の大きさを追跡する。
CUSUMモニターはデプロイ時に開始され、シミュレートされたシフトでテストされた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:09:28 GMT)
When One Leak Pays Forever: Context Binding and the Price of Deterring Collusion [0.0] 一度脱落した連立政権は、それが機能し続けると何度も利益を上げることができる。
しきい値に暗号化されたメムプールでは、復号化能力を販売する復号化委員会のクォーラムが、復号化機能がまだ復号化されているすべてのブロックを公開する。
各動的偏差がリーク時間の選択に還元されることが示されるので、各連立のペナルティが単一のリークが到達した最大の割引値をカバーする場合に限って、抑止力が維持される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:08:25 GMT)
When Does Randomized Oversight Align AI Agents That Can Conceal? [0.0] 不正な監査やスコアリングを行うAIエージェントは、不正行為を隠蔽し、レコードを変更することができる。
証拠が隠蔽に留まり、監査の引き分けが事前に学べない場合、希少監査はあらゆる種類のエージェントを抑止する。
これらの条件は、2026年7月にOpenAIのサイバーセキュリティ評価のエージェントがHugging Faceのインフラの一部を侵害したとき、何が失敗したかを特定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:36:02 GMT)
Visual Anomaly Synthesis for Model Selection in Data Scarcity [0.0] 対象の資産に対する欠陥参照を伴わずに、実際の非欠陥画像上で重度劣化した欠陥を合成するフレームワークを提案する。
共通の障害モードに対する欠陥分類は、文献から様々な欠陥重症度で規範的なプロンプトに蒸留される。
MVTecADの実験では、テストデータへのアクセスで選択された最良の固定モデルと比較して、モデル選択に対するAUROC選択の後悔がほぼ半減することを示した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:22:36 GMT)
Transverse momentum as the counter-diabatic generator in bent waveguide couplers [0.0] モード進化カプラの軸を曲げると、そのスーパーモデム間の非断熱結合が抑制される。
2モードのシステムでは、そのような作用素は$sy$に比例する。
ビーム伝搬シミュレーションによって設計が確認され、初めてユニタリ変換によって実現されたCDプロトコルと比較される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:44:19 GMT)
Towards noble gas quantum optical magnetometry using direct ultraviolet detection [0.0] 希ガス中における核スピン沈降の光学的検出による量子磁気センシングの新しい手法を解析する。
我々の計算は、相対強度が-100dBc/Hzの10W紫外レーザーで、24mathrmaT/sqrtmathrmHz$の記録破り感度を10分で達成できると予測している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:47:31 GMT)
Towards Scalable Quantum Unit Commitment in Power Systems: Encoding and Complexity Reduction Techniques [0.0] 本稿では,パウリ相関の恩恵を受ける量子最適化ユニットコミット(UC)フレームワークを開発する。
UC問題は二項形式で定式化され、その後QUBO問題に変換され、断熱量子進化に適したIsing表現にマッピングされる。
その結果、PCEはエンコードされた問題の有効サイズを減らし、SQDは実現可能な最適解に対する確率の集中を改善し、それらの組み合わせはいくつかのケーススタディにおいて最高の全体的な振る舞いを提供することがわかった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:29:16 GMT)
Towards Model as a Library: Offline, Community-Sourced AI for Low-Resource African Languages [0.0] 我々は、小規模でコミュニティに登録された音声モデルをデバイス上でバージョン管理された依存関係としてパッケージ化するソフトウェアアーキテクチャ、textbfModel as a Library (MaaL)を紹介した。
ウェブスクレイプコーパスに頼るのではなく、MaaLの語彙はスピーカー自身による少数のサンプル録音から直接登録される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:31:15 GMT)
Time-Integrated Leakage as a Dynamical Benchmark for Multi-Mode Superconducting-Qubit Reset [0.0] フラックス周波数制御下でのマルチモード散逸リセットモデルについて検討する。
本研究では, 有限熱占有, パラメータスイープ, 周波数障害, 補助鎖アブレーション, 文献ベースレートベンチマークについて検討した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:16:48 GMT)
The Vote Hides the Failure: Aggregation Choice and Noise Robustness in Heart Murmur Detection [0.0] 我々はCNNとBiLSTMの2つの独立的に再実装されたパイプラインを、制御された多重度雑音下で評価した。
安定した集計精度スコアは、個々の予測が示すものを誤って表現することができる。
BiLSTMのMV精度は、個々の予測が改善していないにもかかわらず、ノイズ増強訓練後に上昇する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:52:08 GMT)
The Principle of Minimum Justified Correlation [0.0] シャノンエントロピー、フィッシャー情報、量子力学的運動エネルギーは全て相関の尺度と見なされる。
ジャイネスの言語では、結果は最小の正当性相関の原理を支持する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:51:48 GMT)
The Copy Ceiling: An Input-Exposure Control for Ontology-Grounded Generation over Curated Corpora [0.0] 我々は、維持されたコーパスに置換可能な言語モデルを基盤とするノードを構築し、その成功した外観評価がサポートできるかどうかを尋ねました。
10台のモデルで目標名リコールが0.265から0.92に引き上げられた。
コピーベースライン、表示されたコンテキストの冗長コピーのリコールは、既に達成され、0.964でスコアされ、すべてのモデルは0.022から0.067の下に位置する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:59:51 GMT)
The Camera Inside the Editor: Reading the Implicit Camera of Image Editors with Painted Calibration Patterns [0.0] カメラインストラクションをベースとした画像エディターが写真に絵を描き込むのかは分かっていない。
Qwen-Image-Edit-2511は、その消滅点を満たすタイルの縁を0.26度の範囲で塗る。
Qwen-Image-Edit-2511は120枚のレンダリングされたカメラにタイルの縁を塗り、その点が0.26度の範囲で消える。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:54:00 GMT)
The Backdrop Exposes What the World Around an Agent Costs It [0.0] BACKDROPは、エージェントの実行環境とともにタスクを行い、その世界で4つの日常的なハザードを植える。
それぞれの危険は一つ質問する。
4つのハザードが存在し、植字されたテキストがエージェントに届くところだけを数えると、エージェントは46.4%のランとインジェクトされたテキストを20.3%で別の人のメッセージに従った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:00:18 GMT)
StreamDecisionBench: Evaluating Decisions in Force on Evolving Language Streams [0.0] StreamDecisionBench (SDB) は、その決定を毎回実行時に評価する。
SDBは、誤った瞬間を判断、遅延、あるいはその両方に当てはめます。
推論は判断を改善するが、低作業のレイテンシではLunaとTerraが犠牲になる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:15:49 GMT)
Statistical mechanics of multipartite entanglement in hypergraph states [0.0] 純$n$-qubitハイパーグラフ状態の族における多部絡みについて検討する。
温度は、ランダムなハイパーグラフ状態の均一なアンサンブルの間を継続的に補間する制御パラメータとして機能する。
興味深いことに、零温度エントロピーの指数は、ハイパーグラフ状態の集合内のMMESの数を直接的に与える。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:47:04 GMT)
Stability of isometries of quantum states [0.0] トレースとビュース計量の両方において、正のトレースクラスコーンの射影近似等距離に対して次元非依存なハイアーズ・ウラム安定性を証明した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:36:14 GMT)
Spin-exchange interactions between circular Rydberg atoms over long times [0.0] 2つのスピン1/2間のスピン交換相互作用を,60s以上,40回のスピン振動周期で観測した。
これらの前例のない時間スケールにより、弱い原子トラップが崩壊とスピン交換振動コントラストの復活を記録できる。
この研究は、強い相互作用を持つ多体系の長期量子シミュレーションへの直接的な経路を開く。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:07:44 GMT)
Single-Photon Nonlinearity from a Nanobeam with a Quantum Dot [0.0] ナノビーム空洞から単一量子ドットに結合した単一光子非線形性を報告する。
このプラットフォームは、パルス当たり0.24入射光子の閾値の低い単一光子非線形性を達成する。
その結果、ナノビームキャビティ-QDシステムは、スケーラブルなフォトニック量子技術のためのコンパクトで、チップ可積分で、繊維互換なビルディングブロックとして確立された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:59:12 GMT)
Simulating Synchrony Loop Networks in the Open Source RISP Neuroprocessor [0.0] RISPニューロプロセッサ上でのSLPネットワークの実装を提案する。
教師なし楽器クラスタリング作業において,その性能を評価する。
その結果、SLPのコア機構は、効果的にニューロモルフィックアーキテクチャに変換できることが示されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:24:56 GMT)
Semiclassical spin-bath calculation of the nitrogen-isotope effect on NV$^-$ ensemble coherence in diamond [0.0] 超微細縮退し、したがってフリップフロップに自由なP1対の分数は、14$N (I = 1) に対して 1/4 であるが、15$N (I = 1/2) では 5/16 であることを示す。
測定されたコントラストである2.07$pm$ 0.25は3.8$$であり、共鳴チャネルのカウントは実数であるが部分的な寄与である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:49:44 GMT)
Self-Evolving Harness on Multiple Tasks with the Agent as Its Own Optimizer [0.0] ハーネスとは、プロンプトを整理し、ツールを呼び出し、コンテキストを管理し、実行を制御する言語モデルエージェントを取り巻くコードである。
既存のほとんどの手法では、人間によって設計されたハーネス上で実行される別のプロポーザがソルバのハーネスを変更し、ベンチマーク毎に別のハーネスが進化する。
再帰的自己改善に近いフレームワークを提案する: 同じフリーズモデルであるハーネスの同じバージョンにおいて、まず解法としてタスクを解き、続いて提案者として、完全な実行レコードを読み出し、実行中のハーネスを直接編集する。
進化過程を2段階の深層学習訓練として捉えた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:33:27 GMT)
Removing the NEEDLE in the Haystack: Backdoor Removal in LLMs via Weight Orthogonalisation [0.0] NEEDLEは、標的としたバックドア除去のためのトレーニング不要の方法である。
ニードルは、評価された防御の中で最も低い平均攻撃成功率(ASR)を達成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:35:24 GMT)
Re-ranking and Late Interaction Drive Retrieval Quality: A Controlled Comparison of RAG Strategies for Scientific Question Answering [0.0] 科学的質問応答のための6つの検索方法の比較を行った。
全てのパイプラインは同じジェネレータ(Meta-Llama/Llama-3.1-8B-Instruct)、プロンプト、評価プロトコルを共有している。
LLM-as-a-judgeプロトコルを複数の品質次元に沿って,ゴールドペーパーの直接検索指標とともに評価する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:04:29 GMT)
Quantum Statistical Thermal Engine at the BCS-BEC crossover [0.0] 我々は、s波接触相互作用を持つ2成分フェルミガスに基づく量子熱エンジンを提案する。
明瞭な非対称性が交叉を通して出現し、相図の軌跡によって異なる動作状態が生じる。
これらの知見は、量子熱機械の汎用熱力学資源としてのペアリング相関を浮き彫りにした。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:46:26 GMT)
Quantum States and Spectra of Small Cylindrical and Toroidal Lattices [0.0] 円筒およびトロイダル位相を持つ小さな格子のスペクトルと量子状態について検討する。
我々は、ゲージ選択、境界条件、サイト間結合強度など、様々なシステムパラメータの影響をトレースする。
より小さな格子は、熱力学的限界で抑制されるエッジ状態に関連するスペクトル線において顕著なギャップを生じさせる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:51:15 GMT)
Quantum Simulation of Detuning-Controlled Proximity-Induced Localization and Reentrant Delocalization in a Quasiperiodic Ladder [0.0] 準周期はしごにおける近接誘導型局所化と再帰的非局在化を示す。
その結果, 半周期結合系における局所化を誘導・反転するプログラム可能な制御ノブとして, 脚選択的デチューニングが確立された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:00:16 GMT)
Quantization Error Is Spectrally Flat: A Single Random Probe Is a Calibrated, Data-Free Sensitivity Estimator, with Application to Budget-Targeted Mixed-Precision Quantization [0.0] 単一のランダムガウスプローブは、層の量子化誤差の偏りのない推定を与える。
35B MoEと9B高密度モデルからの1,683個のテンソルを横切ると、有効次元は、同じ形状の雑音値の0.93から0.96倍になる。
1つのプローブはテンソルあたりの感度を4から7%の範囲で測定し、20個のプローブは1.3から1.4%に達する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 04:20:41 GMT)
Proposal for matter-wave interferometry with a rare-earth-doped microparticle [0.0] 物質波干渉計は低エネルギー物理学の感度プローブであり、重力と量子力学の正確なテストに使われてきた。
本稿では, 希土類イオンを埋め込んだマイクロ粒子の物質-波干渉を実演する。
時間対称干渉計と角運動量を持つ希土類イオン状態を用いることで、マイクロ粒子の初期状態に対する感度がなくなる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:23:21 GMT)
Prompts Live on an Arc: Gaussian Curricula in Fisher--Rao Coordinates for Rollout-Efficient GRPO [0.0] グループ相対ポリシー最適化は、サンプル応答が一致しないプロンプトからのみ学習する。
GRPO は arc length $=arcsinsqrtp$ on the Bernoulli Fisher--Rao manifold である。
我々はこの観測結果を、カルマンフィルターで全てのプロンプトをアーク長さで追跡する、ARCUSに変換する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:02:27 GMT)
Optically-Induced Modulation and Programming of Diamond Photonic Cavities [0.0] 単結晶ダイヤモンドは、量子および非線形フォトニクスの統合のための有望なプラットフォームである。
ここでは、懸濁ダイヤモンドFabry-Perotナノビームキャビティの全光変調と長寿命チューニングを実証する。
その結果、モノリシックなダイヤモンドナノフォトニックプラットフォームが、アジャイルと可逆的な変調と長時間の光再構成を組み合わせて構築された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:55:37 GMT)
Operational theory for photonic circuits: generalizing linear optics beyond quantum theory [0.0] 二次作用素に基づく一般化確率論においてフォトニック回路を解析するための枠組みを導入する。
我々は、Hong-Ou-Mandel効果、Mach-Zehnderインターフェロメトリのような現象が量子論に特有のものなのか、あるいはより広範な理論のクラスで起こるのかを問う。
我々のフレームワークは、複雑なフォトニックセットアップとフォトニック量子コンピュータの一般化理論を研究する基盤となる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:03:27 GMT)
One Threshold Does Not Fit All Languages: Language-Conditional Deferral for Reliable and Efficient Low-Resource Text Classification [0.0] 世界南部、アフリカ、アジア、ラテンアメリカの低所得国では、世界の言語の大半が話されている。
約束がすべての言語に届くかどうか尋ねるが、そうではない。
言語ごとのしきい値の推定では、すべての言語が再訓練せずに89.1%から91.0%に到達している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:45:33 GMT)
On Task Scope and Information Retention in Source Coding [0.0] 我々は、設計をCfM(Coding for Machines)とCfH(Coding for Humans)に分割することは、どのような情報が捨てられるかを決める誤解を招く区別であると論じている。
情報源と特徴符号化を有限タスクファミリに拡張し,エンコーダ観測の制限が最小値を保存するときに導出する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:40:12 GMT)
Observability Analysis and Online Calibration of Visual-Inertial-Wheel Odometry for 4WIS4WID Mobile Robots [0.0] 4輪独立駆動型移動ロボット(4WIS4WID)のオンライン校正機能を備えた視覚慣性駆動型オドメトリー(VIWO)フレームワークを提案する。
全車輪の縦方向の転がり制約と横方向のノースリップ制約の両方を用いて,四輪駆動速度と操舵角度から直接2次元ドメトリーモデルを導出する。
線形化VIWOシステムの可観測性解析は、駆動のみのモデルが全てのステアリングオフセットを観測不能にすることを示しているが、提案された冗長モデルは可観測性を復元する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:50:21 GMT)
NinaXander: Feasibility and Limits of Composing Frozen Language Models Across Architecture Families via a Shared Latent Space [0.0] 構成されたモデルは、あるモデルの第一層を実行し、その結果の中間表現をアダプタで一度変換し、他のモデルの残りの層を実行します。
本研究は, 異なる家系の凍結モデルがポストホックに組み換えられるかを検討した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:19:58 GMT)
Neural topology optimization of ship structures under propulsion machinery vibrations [0.0] 船体の振動は騒音、疲労、機器の損傷に寄与する。
本研究では,畳み込み型コルモゴロフ・アルノルドネットワーク(KATO)を用いたニューラルリパラメトリズトポロジ最適化を,能動入力電力(AIP)を用いた強制振動設計に拡張する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:41:08 GMT)
NAQD Env: A benchmark for selective withdrawal in language agents [0.0] 言語エージェントは、エビデンスの変更、許可の取り消し、または停止命令が到着した場合、計画されたアクションを修正する必要がある。
有効な応答は選択的で、影響を受けるアクションを中断し、影響のない作業を保持し、十分な修復後にのみ再開する。
本稿では,これらの決定を決定論的参照ポリシーに対して評価する合成環境であるNAQD-Envを紹介する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:48:41 GMT)
Marking Contour Tones in Yorùbá [0.0] 従来の綴りが音素情報を省略するだけでなく、その名前の意味を逆転させ、時にその名前の意図とは逆であると主張する名前の類である。
本稿では,この問題を解説し,現在の解法が不十分であることを示すとともに,カロンマークと円周マークの採用を提案する。
この提案はWriteYorubaキーボードとTTSYoruba音声合成器の実装によって支持されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 22:37:03 GMT)
Margenau-Hill distribution as a Necessary and Sufficient Signature of Measurement Incompatibility [0.0] 測定不整合性とMargenau-Hill(MH)準確率分布の操作的リンクを提供する。
任意の有限次元の2コトミックアンシャープ観測値に対して MH のような準確率分布を導入する。
本稿では,MH準確率を直接再構成する,量子スウィッチアーキテクチャにインスパイアされた干渉計構成を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:41:38 GMT)
MORE Thermal Gauge Theories at Finite $θ$ and $μ$ from Real-Time Quantum Simulation [0.0] 我々は、ハミルトニアンシミュレーションの連続線形結合としてGuo, Shibu, Lin, Zhao の構成を同定し、その遅い1/t_rm カット$収束が冗長なカーネル成分から生じることを示す。
あるリアルタイムデータセットは、古典的な後処理を通じて、対象の逆温度、ユークリッド分離、化学ポテンシャルを再構築する。
偏極雑音を含む回路レベルシミュレーションを含む,1および2フレーバー格子シュウィンガーモデル上で,本手法のベンチマークを行った。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 21:28:30 GMT)
Losing the name before the box: measuring and repairing what narrow fine-tuning costs a detector outside its deployment vocabulary [0.0] 広いコーパスで事前訓練された検出器は、狭いドメインで微調整され、そのドメイン内の精度が向上し、出荷される。
我々は、オブジェクトのカバレッジに何が起こるのかを問う。語彙は決して名前をつけず、障害物検出と検査を改善する。
1つの事前訓練されたチェックポイントは、それぞれの微調整された子孫に対するものである。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 00:36:03 GMT)
Look What You Made Us Cluster: Hate Narrative Extraction from Reddit Discourse [0.0] 本稿では,物語を実体評価ペアとして表現する抽出パイプラインを提案する。
ナラティブはLarge Language Model (LLM)推論プロセスを用いて抽出される。
この物語のパイプラインを、Taylor Swiftを批判した2024年の英語のRedditコメントで説明します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:43:31 GMT)
LEMON-ZEST: Evolution-Informed Tokenization for Efficient Protein Language Modeling [0.0] 複数配列アライメントの保存領域から派生した進化インフォームドボキャブラリであるZESTを紹介する。
ZESTは、シーケンスを平均4つの残基のトークン長に圧縮し、標準の1024のコンテキストウィンドウ内で4,000個の残基を処理する。
1つのH100 GPUで1週間トレーニングされたタンパク質配列間のリモートホモロジーを検出するための,コンパクトな200MシーケンスベースモデルLEMONを提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:27:24 GMT)
Joint Supervised and Self-Supervised Training with Acquisition-Robust Techniques for Accelerated 4D Flow MRI Reconstruction [0.0] 4DフローMRIは、時間分解された3方向の血流速度を測定するが、長い取得時間を必要とする。
近年,この領域における画像再構成に対処するエンコードごとの変分ネットワークが開発されている。
本研究は,共同指導型・自己指導型トレーニングシステムを導入し,監督中の大小データと速度データを両立させる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 23:03:27 GMT)
Janus: Evidence-Before-Effect Sagas and Offline-Verifiable Provenance for Agentic LLMs [0.0] エージェント型大規模言語モデル(LLM)は今やツールを通じてお金を移動している。
Janusはエフェクトパスにレコードを置きます。
ステップの提案、それに対する評決、バリデータや人物からの回答は、ステップの実行またはその効果が解放される前に、署名されたハッシュチェーンのログで耐久性がある。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:57:51 GMT)
It's Not What the Image Shows: Irrelevant Context Destabilises VLM Judges Without Informing Them [0.0] 視覚言語モデル(VLM)は、人間のアノテーションの代わりに使われるようになっている。
ミスリーディング画像ストレステストであるMISTを200の英文で紹介する。
ガイドラインは、ラベルを文のみから決定することを要求する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:45:59 GMT)
Is manual software optimization a thing of the past? [0.0] 本研究では,大規模言語モデルが科学ソフトウェアの性能向上を自律的に達成できるかどうかを考察する。
我々は3つの計算問題に対してソフトウェアを最適化するLLMエージェントを課題とした。
改良には低レベルのコード最適化、数学的修正、グラフレットカウントのための全く新しいアルゴリズムが含まれていた。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:42:17 GMT)
Inference-Layer Security: Defending Against Adversarial Inference and Infrastructure Abuse [0.0] 仮説的フロンティア実験室Five Elements Inc。
パブリックなラベル付きLLM利用データセットは存在しないため、現実的に基盤付けられたユーザセッションのラベル付きデータセットを生成する構造因果モデル(SCM)を導入する。
このデータセットでは、各ユーザセッションを良性または悪意があり、攻撃タイプによって悪意のあるものとして分類する、実用的な勾配検出をトレーニングしています。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:55:16 GMT)
Independent Verification Paths Are Not Independent: A Case Study of Common-Mode Failure in a Satellite Catalogue Pipeline [0.0] 我々は、地球周回物体の2つのオープンレジスタのクロスカタログ整合性研究において、そのようなゲートの1つが故障していることを報告した。
どちらのパスも同じ定数をインポートし、ソースのステータス語彙の誤読をエンコードした。
メカニズム、すべてのフィギュアを調整するオブジェクトレベルの台帳、ソースのドキュメントに遡る3つのチェックを与えます。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:53:23 GMT)
Improving the Loss Tolerance of Heralded Photonic GHZ States for Long-Distance Device-Independent Conference Key Agreement [0.0] デバイス非依存の会議鍵契約(DI-CKA)において,損失量子ネットワークに対するマルチパーティの絡み合い分布は重要な要件である。
本稿では,検出-ループホールフリーパリティの臨界検出効率--計算-基底GHZ状態のCHSH違反について検討する。
我々は、不均質な光源を用いたスターネットワークプロトコルを導入し、損失耐性真空-n$- Photon GHZ状態を直接計算する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:50:24 GMT)
Improved estimate of local Markovianity for quantum Gibbs states [0.0] 固定温度毎に量子ギブス状態の局所マルコフ特性を改善する。
境界相互作用次数の有限範囲の相互作用に対して、条件的相互情報(CMI)は分離と指数関数的に崩壊する。
指数関数的および伸張指数的に崩壊する相互作用に対して、境界依存プレファクタを持つ伸張指数CMI崩壊が得られる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:56:26 GMT)
HyDI: A hybrid Deep Learning-Inductive Logic Programming ensemble for multi-label classification [0.0] HyDIは階層型マルチラベル分類のためのハイブリッドアンサンブルアーキテクチャである。
Inductive Logic Programming(ILP)によって生成されるルールベースの分類器と、Deep Learning(DL)モデルを組み合わせる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:56:03 GMT)
Human-in-the-Loop Geospatial Annotation for Rapid Dataset Construction in Field-Deployed UAV Systems [0.0] 本稿では、エキスパートアノテーションを画像からフィールドにシフトするBirdsEyeを紹介する。
カメラ目的の不確実性から画素不確実性への一階写像を導出し,モンテカルロシミュレーションに対して検証する。
システム投影精度は10~20mのAGL高度でサブディシメータ(30ピクセル未満)であることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:25:56 GMT)
How Many Labels Does a Language Need? Annotation Budgets and Cross-Lingual Pooling for African-Language Text Classification [0.0] 我々は,2つのCPUコア上で,事前トレーニングされた重みを伴わず,アクセラレーションを伴わない,数秒でトレーニングする特性n-gram線形モデルを用いている。
トピック分類は全データマクロF1の90%に到達し、中央言語で約400のラベルを持つことを示す。
ベンチマークで他の言語の完全なトレーニングデータをポーリングすることは、小さな予算で、大きなものでは何の役にも立たない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:54:30 GMT)
Greenpixie's AI Token Methodology: Assessing the Energy, Water and CO2-eq Impact of AI Tokens for Open and Closed Weight Models [0.0] 本稿では,クラウドホスト型大規模言語モデル(LLM)のエネルギーコストを推定する手法について述べる。
また、これらのエネルギー測定を用いて、二酸化炭素(mathrmCO-texteq$)排出量、使用量と実施量、AIトークン当たりの水消費量を推定する方法について述べる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:02:14 GMT)
GitCF: Reducing Incomplete Changes by Exploiting Multiple Similarities Among Commits [0.0] 我々は、開発者の現在の変更とリビジョン履歴の過去の変更を比較した変更レコメンデーション手法であるGitCFを提案する。
我々は、GitCFを17のオープンソースプロジェクトから543の未完成な変更で評価し、不完全な変更は、後続のコミットで省略された修正が提供されるコミットを表す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:51:53 GMT)
Generated Query Expansion Still Helps Strong Sparse Retrieval: A Controlled Study with SPLADE-v3 [0.0] 我々は、NFCorpus、TREC-COVID、SciDocsのSPLADE-v3とともに、用語リストの4つの生成されたフォーマット、擬似文書、複数の擬似参照、コーパスステアリングテキストをテストする。
12のメソッド・コレクション比較により、集約nDCG@10が改善され、4.81%、8.92%、9.47%が最も高い。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:07:06 GMT)
Gender bias across LLMs is common and highly heterogenous [0.0] これまでの研究では、小さなモデルに焦点が当てられており、性別バイアスがLSM全体で一般的で異質な程度に開放されている。
女性や男性に対する虐待や拷問の道徳的判断は、破滅的な結果を防ぐために、2つのパラダイムを使用する。
以上の結果から, LLMでは男女関係バイアスが一般的であるが, その方向や大きさは異種であることが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:11:53 GMT)
Frontier Autolab: Organizational Memory, Adversarial Dissent and Temporal Leakage in Multi-Agent LLM Firms Across Fifty Years of Technological Change [0.0] フロンティア・オートラブ(Frontier Autolab)は、1990年から2040年までの9つの技術時代において、シミュレーションされた会社を再び設立しなければならない、長期にわたるテストベッドである。
6つの時代は歴史に対して、1つはライブ市場に対して、2つは公開予測である。
歴史的に評価された24のすべての時代において、判事は、同社がどの場所を建設するかという選択よりも、来るべきシフトを認識していると評価した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:12:12 GMT)
From Reconnaissance to Response: Quantitative Risk Parameterization and Game Theoretic Containment in Modern Enterprise Attack [0.0] 本稿では,定量的リスクパラメータ化と継続的自動応答時間を橋渡しする,統合されたメトリクス駆動決定エンジンを提案する。
Vulnerability Scoring Systems exploitability parameters are mapped to attack success probabilities and evaluate defender log distributions through Factor Analysis of Information Risk Monte Carlo Simulations。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:45:20 GMT)
Federated Clustering with Unknown Local and Global Cluster Cardinalities [0.0] グローバルなクラスタ数を必要としないフェデレーションクラスタリングメソッド$K$は、各クライアントがローカル番号$K_g$を知っていると仮定する。
本稿では、どちらのカウントも知られていない2段階のフレームワークを提案する。
各クライアントはまず、自身のデータから$K_g$を推定し、FedGEMのようなローカルカウントを必要とするアグリゲータを使用して、真の値の代わりにこれらの見積を使用する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:33:34 GMT)
Exact anomalous current fluctuations in the strong-anisotropy limit of the XXZ chain [0.0] 折り畳まれたXXZ鎖のスピン電流変動について検討した。
無限温度における時間積分スピン電流のモーメント生成関数の正確な式を得る。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:07:47 GMT)
Exact Trotterization in the Degenerate Quantum Rabi Model [0.0] 量子ラビモデルのデジタル量子シミュレーションは、トロタライズエラーの正確なキャラクタリゼーションの必要性を動機付けている。
我々は、任意の結合強度に有効な、正確に解ける縮退限界のそのような特徴を導出する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:04:15 GMT)
Evanescent-wave Johnson Noise from Superconductors [0.0] 超伝導体上の真空半空間におけるエバネッセント波ジョンソンノイズ(EWJN)を計算する。
電磁応答は、BCS超伝導体に対して単一の顕微鏡的逆電流応答カーネル$Q(q, )$によって記述される。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:51:57 GMT)
Evaluation Choices Shape Biomedical ML Claims: A Pediatric Pneumonia Benchmark Case Study [0.0] 分割,トレーニングポリシ,しきい値,メトリック,キャリブレーション,不確実性が通信されない場合に,高いベンチマークスコアが異なる結論をサポートすることを示す。
これらの結果から,分割,トレーニングポリシ,しきい値,メトリック,キャリブレーション,不確実性が通信されない場合に,高いベンチマークスコアが異なる結論を支持できることが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:42:15 GMT)
Evaluating Multi-Task Morphological Concept Learning for Pulmonary Nodule Malignancy Assessment in 3D CT [0.0] 肺結節のCT(Computed tomography)評価において,Spiculationやlobulationなどの形態学的特徴は重要な役割を担っている
本研究は,放射線技師に付与された形態的特徴の学習と悪性度リスクが分類性能を向上させるかを検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:36:41 GMT)
Evaluating Language Model Safety Across Long Adversarial Conversations [0.0] 安全性評価は、しばしば単一の有害なプロンプトで言語モデルをテストする。
本研究は,複数のターンにまたがる対戦相手が持続した場合に,モデルが安全に応答し続けるかどうかを検討する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:20:04 GMT)
Embodiment-aware control by inference over the operator: a simulation study [0.0] 予測処理アカウントは、オペレータの予測と返却されたフィードバックとのミスマッチを減らすためにデバイスを制御することを推奨する。
我々は,暗黙の視線と瞳信号から操作者の体格と視線を重み付けした視線を推定する体格認識制御器を定式化する。
この利点は、情報探索項であるアクティブ推論ではなく、明示的な嗜好を持つ演算子に対するベイズ的推論によるものであることを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 19:28:08 GMT)
Embedded Bi-Temporal Building Damage Assessment for On-Board Data Reduction [0.0] 自然災害後の建物被害の迅速評価は緊急対応に不可欠である。
エクスプロイトは、アップリンクとダウンリンク容量と、地上処理のレイテンシによって制限される。
本研究は,YOLOX 由来のシアメーゼ検出器上に構築した2 時間建物損傷評価パイプラインを用いて,この問題に対処する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:34:00 GMT)
Early Prediction of AI-Assisted Cheating Risk in Online Exams Through Learning Analytics [0.0] 本研究では, 学生の学習管理システムにおけるデジタルトレースを用いて, 最終試験におけるAI支援不正行為のリスクを予測できるかどうかを検討する。
以上の結果から,LMSインタラクションデータは,AIによる不正行為の早期シグナルとなる可能性が示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:24:41 GMT)
Does a prosody-trained representation help beyond trainable fusion? A parameter-matched study with frozen HuBERT [0.0] 我々は、凍結したバックボーン認識器(Baseline)と、学習された表現(Learned)で供給される0個の補助入力(Null)と、訓練可能な融合(Null)を比較した。
Buckeye, Switchboard, AMI IHM の他、Null は WER を Baseline 上で 0.71-1.45 で削減するが、Learred は Null と +0.07, -0.09, +0.00 で大きく異なる。
しかし、推論における表現の削除やミスマッチは学習WERを増大させるため、学習は表現に依存するがパラメータマッチング制御に対して測定可能な漸進WERは示さない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:25:14 GMT)
Directional transfer from coherence to longitudinal polarization and algebraic storage in a transmon with Markovian dephasing and a glassy environment: A non-Markovian fractional renewal model [0.0] 我々は,ガラス質の2段階環境を動機とした,長手マルコフ強調および横更新イベントを用いた正・トラスト保存型非マルコフトランスモンモデルを開発した。
01ドルの重み付き待ち時間の場合、分岐カット解析は、初期コヒーレンスと$O(t-1-)の逆転送から生じる長手偏極における一般的な$t-$ストレージテールを与える。
障害を動機とするリニューアル記憶は、状態と方向によってトランスモンデコヒーレンスを再現する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:14:35 GMT)
Digital Labor Platforms as Infrastructure of Extractivism [0.0] この章では、現代の人工知能における抽出主義の基盤としてのデジタルプラットフォームが、企業がシリコンバレーのような中核領域に価値を集中しながら、適切なデータと労働力を実現できるかを検討する。
地域内におけるコモディフィケーション、てんかん支配、生殖を結びつける枠組みとして、プラットフォーム抽出主義を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 13:57:53 GMT)
Device-independent quantification of steerability in tripartite scenario [0.0] 量子ステアリング(Quantum steering)は、共用交絡状態の局所的な測定を通じて、局所的な説明を許さない方法で、遠くのパーティが保持する条件状態に影響を与える1つのパーティの能力をキャプチャする。
我々は、AMMフレームワークを三部構成に拡張し、両者が三部構成を共同で行うシナリオと、一方が残りの二部構成を単独で行うシナリオ(1-steer-2)の両方をカバーする。
我々の境界は、DDI方式で、操舵当事者が行った測定の不適合性を証明します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:29:10 GMT)
Density Matrices of Pulsed Quantum Light [0.0] パルス光は、相関関数が定常性とコヒーレンスの性質が異なる密度行列で表される。
このことは、量子化キャビティの長さに物理的意味を明らかにし、パルス光の物理スペクトルの起源を説明する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:57:42 GMT)
Crossover of Scaling Behaviors of Work Cumulants in a Driven Gaussian Field Theory [0.0] 我々は、駆動された$O(N)$ガウス場の理論に対する作業の有限温度特性関数を導出する。
ギャップ付きプロトコルでは、Adiabatic perturbation theory (APT) を用いて、任意の境界にゼロでない第一微分を持つプロトコルの$_Q-2$スケーリングを導出する。
指数$p$で臨界点に近づくパワーロープロトコルに対して、臨界励起と正規貢献の競合を決定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 01:36:48 GMT)
Cropland PAtteRNS: Parallel Dimensional Attention Networks and Attention to Dataset Disparity for Crop Segmentation in Satellite Imagery Time Series Data [0.0] 我々は,ハイブリッドトランスモデルであるCropland Parallel Attention and Refinement Network for (PAtteRNS)を提案する。
本稿では, 並列トランスアーキテクチャを導入し, 自己アテンションの計算複雑性を大幅に低減する。
以上の結果から,多くの重要なセグメンテーション指標で検証された作物分類セグメンテーションのタスクにおいて,我々のモデルが他のすべてのセグメンテーションよりも優れていることが示された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:29 GMT)
CredWise: A Controlled Agentic Decision-Intelligence Framework for Explainable and Auditable Credit-Risk Assessment [0.0] CredWiseは、信用リスク予測、確率キャリブレーション、説明可能な人工知能、ポリシー検索、制御されたエージェントベースの分析を統合する、意思決定支援フレームワークである。
2007-2016年、トレーニング用、2017年、テスト用、2018年。
結果は、CredWiseが予測、説明、ポリシーエビデンス、構造化分析をひとつのワークフローで組み合わせることができることを示している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:38:53 GMT)
Copy-scarce learning of ground states [0.0] 基底状態の複数の性質を求めることは、量子物質の理解の中心である。
従来の読み出しは、独立して作成された多くのコピーを消費するため、違法にコストがかかる。
ここでは,初期基底状態コピー数とハミルトン進化時間との最適トレードオフを確立する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:34:20 GMT)
Cool the Sampler, Not the Learner: Sampling Temperature Moves the Staleness Cliff of Importance-Corrected GRPO [0.0] 言語モデル用のプロダクションRLは、サンプルが学習者の後ろに落ちて、結果として発生するミスマッチを、重要度が減った重みで修復する。
私たちは、その修正の下でリフレッシュすることなく、どのくらいの期間サンプルが使えるのかを尋ね、崖を見つけます。
Qwen2.5-Math-1.5BとGSM8Kでは、重要度補正されたGRPOが192回毎のアップデートをリフレッシュし、180ステップで学習し、リフレッシュが到着する前に3つのデータシードすべてで大幅に劣化した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:56:51 GMT)
Context without Commitment: Robust Dense Correspondence under Non-Rigid Deformation [0.0] 非厳格な点クラウド登録は、変形源表面上の各点の対応する目標点を見つけることを目的としている。
点レベルのマッチングは全ターゲットの雲を利用できるが、異なる領域が類似した局所幾何学を持つと対応が曖昧になる。
CoCo-Regは、パッチ予測が最終点レベルの探索を制限することなしに、局所的なパッチを用いて高密度な点特徴を豊かにする。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:06:31 GMT)
Constant-rate quantum codes with low-weight stabilizers and full logical Clifford actions via transversal and fold-transversal gates [0.0] 低スペースオーバーヘッドのフォールトトレラント量子計算には、高速な量子誤り訂正符号と空間効率な演算の実装が必要である。
トランスバーサルゲートとフォールドトランスバーサルゲートは、エラー伝搬を制限し、追加のキュービットを必要としないため、有望である。
一定の符号化率とサブ対数的に増加する安定化器重みを持つ量子符号の族を導入する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:38:05 GMT)
Consistent histories and the ultrametric on infinite tensor products [0.0] 有限モデルにおいて、一般には正確に消える必要はなく、その小ささだけでは歴史空間上のネーター幾何学を供給している。
量子レコードを蓄積するヒストリーの幾何学を構築する。
ビューズ欠陥の収束指数は歴史に関する擬ウルトラメトリックを定義する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:28:34 GMT)
Collective Dynamics in Spin Chains with Constrained Dissipation: Classically Fragile but Quantum Robust [0.0] 多体系における集合的非平衡現象は、ゆらぎの影響を強く受けている。
揺らぎがなければ、系は創発的な集団力学を示し、相共存をもたらす。
このことは、競合する量子ゆらぎと古典的な運動論的制約が多体系の相構造をいかに形成するかを強調している。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:01:17 GMT)
Can an AI Agent Rediscover a Blaschke-Curve Invariant? [0.0] 一般化ブラスキー曲線をAI支援再発見のための制御環境として研究する。
1つの固定次数4のブラスキー積に対して、エージェントは80境界境界のそれぞれで決定される6つのペアラインの数値座標を受信する。
凍結係数は80の未確認パラメータ値から480行を予測し、記録されたスケールフリー残差は8.88times10-17$である。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 18:29:57 GMT)
Can a Cacheable Decision Model Follow Rules? [0.0] Certoは小さな非生成決定モデル(Qwen3-4B)である
テキストから候補アクションをスコアし、回答を生成する代わりに確率を返す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:37:18 GMT)
Can AI Scientists Change Their Minds? Prior-Evidence Conflict in Synthetic Universes [0.0] 我々は、近くの非標準機構によって支配されるツイストツイストツイストツイストと、カノニカルな有名な世界をペアリングする制御されたベンチマークを導入する。
我々は,各報告された法律を2回評価し,保持された継続および転送設定で実行し,生成機構を回復するかどうかを独立に確認した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 05:03:14 GMT)
ByteTraX: Enhancing the ByteTrack Architecture with Optimised Thresholding [0.0] ByteTraXと呼ばれるByteTrackアーキテクチャのシンプルな拡張を示し、単一の統一マッチングしきい値によってトラックの連続性を最適化する。
その結果、アイデンティティスイッチの40%が減少し、HOTAの3.6、IDF1の5.6、FPSの6.3が平均的に増加した。
オープンソースリポジトリを通じて、ソースコード、オブジェクト検出モデルのYOLOファミリの統合機能、デプロイメント指示を提供する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:23:06 GMT)
Boids of a Feather Flock Together - Evolving Prey Behaviours Under Different Predator Attack Strategies [0.0] 捕食者の狩猟戦略によっては、どのように社会的・逃避傾向のバランスをとるべきかが考えられる。
餌の生存率はアタックセントロイドが最も多く,アタックアレストが最も低かった。
以上の結果から,最適な捕食者行動は,逃避傾向と捕食者の狩猟戦略との相互作用に依存することが示唆された。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 15:55:18 GMT)
Applying Language Models in Clinical Medicine: Recent Trends and Perspectives [0.0] 大規模言語モデル(LLM)の出現は、医療におけるAIの適用に関する議論を拡大した。
LLMの医療環境への統合は、医療環境における信頼性、正確性、透明性、安全性、適切な役割に関する重要な疑問を提起する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 06:35:19 GMT)
An Empirical Study of Architectural Shift from Traditional to AI-Enabled Simulink Controllers [0.0] 従来型とAI対応のSimulinkコントローラについて研究し、文献由来の10の分類と9つの機能的役割について考察した。
この研究では、8つのコントローラタイプと10のアプリケーションドメインにまたがる62の現実世界モデルを分析し、13人の実践者を調査した。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 20:27:33 GMT)
Accelerator Choice Is Not Enough: AlphaFold2 Inference on Cloud TPUs [0.0] Colab CPUランタイム、NVIDIA T4 GPU、専用8チップのCloud TPU v5eスライスで1つのAlphaFold2推論ワークロードを実行しています。
TPUのハードウェア上の大きな利点は、T4の13.1秒に対して1回の呼び出しで0.47秒の安定した状態にあることにある。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 07:02:41 GMT)
Accelerated surrogate dynamics for dynamical, stochastic system evolution [0.0] 我々のフレームワークは、変分オートエンコーダと畳み込みまたはグラフベースを組み合わせることで、システムの寸法を小さくする。
このフレームワークを3つの異なるケースでテストし、その堅牢性を証明する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:07:29 GMT)
AX is the New AEO [0.0] 私たちは37,927人のエージェント・トラベルを実行し、それぞれの購入者がビジネスについて疑問を呈し、4つの独立したハーネスを1,056以上のリアルビジネスでカバーしています。
エージェント対応のビジネスでは、自身のページから回答が作成されており、その78%が56%に対して、明らかに1.9倍の頻度で推奨されている。
ウェブ構築の回答は3.7倍になり、買い手が要求した事実は含まれない。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 14:41:04 GMT)
ASCEND: Personal AI Agents for Autonomous Scientific Computing Across HPC Clusters and GPU Workstations [0.0] ASCEND(Autonomous Scientific Computing Engine and Novel Discovery)はAIを利用したエージェントインタフェースで、研究者自身のラップトップ上でエージェントを実行する。
各リソースのアカウントは十分であり、パブリックインストーラはユーザが自身のSlurmクラスタやワークステーションをリンクすることを可能にする。
本報告では,(1)植込み型テンソルデバイス断層の故障回復ループを閉鎖し,ジョブレベルのアーティファクトの提出,診断,修復,再提出を行い,(2)著者が公表した気象予報モデルの評価を再現した4つの事例を報告する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:32:47 GMT)
AMU:Admission and Memory Update for Personalized Conversations---Structured Memory with SLM Guided Control [0.0] 本稿では,書込み時間メモリ制御のためのSLM誘導フレームワークであるPersonalized Conversationsに対するAMU: Admission and Memory Updateを提案する。
AMUは構造化メモリフィルタリングを使用して、メモリに何を入れるべきかを判断し、SLM誘導ストレージ管理を使用して、許可されたレコードを別々に保存するか、重複として破棄するか、更新として融合するかを決定する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:12:09 GMT)
A unified interpretation of probability [0.0] 私はフォン・ミーゼスの確率の周波数解釈を再考する。
科学的確率のコヒーレントな解釈の鍵となる要素を含んでいると私は主張する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:27:21 GMT)
A shape-similarity latent space for fluid interfaces: invertible reduced-order modelling of droplet morphology [0.0] 装置のアクティベーション範囲にまたがるキャンペーンは、単一の録音を見逃したような形態を生じる。
低次元で、非可逆的で、標本化よりも形に忠実な表現を必要とする爆発。
デモでは301,539個のインクジェット液滴の輪郭と4つの撮影されたブレークアップシーケンスが使用されている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:23:03 GMT)
A quantum thermal machine surpassing the classical thermodynamic limit on precision [0.0] 定常量子輸送は、標準TURで許される精度を超えることができることを示す。
この結果から,エネルギーコストの低減にともなう高精度化を実現する量子熱デバイスの実現が期待できる。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 09:42:44 GMT)
A magnetic-field insensitive gate set for trapped-ion nuclear spin qubits [0.0] 我々は、高磁場に蓄積された核スピン量子ビットを操作するための完全な操作について概説する。
核磁気モーメントの減少は、電子スピンの使用と比較して外部磁場に対する感度が低下する。
本稿では,電子スピンを用いた2量子位相ゲート法を提案する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 11:54:51 GMT)
A commuting operator self-test for exact entanglement embezzlement [0.0] 我々は,コラダンジェロの2プレーヤ一般化非局所ゲームの一種に対する最適通勤演算子相関が,通勤演算子自己検定であることを示す。
この結果から, 通信事業者のフレームワークにおいて, 正確なエンタングルメント・エンベッズメントプロトコルに対する最初の相関自己検証が可能となった。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:38:33 GMT)
A Spiking Neural Network Model of Elementary Self-Consciousness via Endogenous Default Mode Network Dynamics [0.0] Izhikevich 力学に基づく1万個のニューロンスパイクニューラルネットワーク(SNN)を組み込んだ大規模計算モデルを提案する。
内因性ペースメーカー活性が過渡性外部感覚摂動とどのように相互作用するかを示す。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 10:00:50 GMT)
A Spectral Theory of Distortion in LLM Graph Reconstruction: Sharp Bounds and Empirical Characterization [0.0] 言語モデルによるグラフ再構成の評価は、通常、元のグラフと再構成されたグラフの間の単一の集合距離を報告する。
我々は、ラプラシアンスペクトル間のワッサーシュタイン距離について、そのような要約は2つの辺数で括弧されていることを証明した。
我々は、45個の合成グラフ上の3つのオープンウェイトモデルによって生成された135個の再構成において、これらのレジームを特徴づける。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 17:59:16 GMT)
A Function-level Dataset of Vulnerable and Fixed Source Code in JavaScript and TypeScript [0.0] JavaScriptとTypeScriptはモダンなWeb開発で広く使われており、セキュリティが重要になっている。
ここでは、主要な7つのソースからキュレートされたデータセットであるJsVulを紹介します。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 16:59:45 GMT)
A Dual-Track Curation-and-Classification Framework for Resolving Ground-Truth Label Noise in Operational Sentinel-2 Wheat Area Estimation [0.0] コムギ栽培地域は, 管理記録と分類産物の相違により, 操業推定が制限される。
インド・パンジャブ州パタリア地区の2022年のラビシーズンにおいて、13段階のSentinel-2 NDVIタイムシリーズを用いて、この管理上の不一致に対処する。
反復ルールベースのブートストラッピング手順によって開発された849サンプル参照データセットは、特徴感度分析と操作分類器の両方を基盤としている。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 08:12:04 GMT)
A Disk-Shaped Magnetoelastic Torque Sensor for Robotic Joints Using Permanent Magnetization [0.0] 本稿では, 円盤状磁気弾性トルクセンサの小型化について述べる。
4磁力計アーキテクチャは、狭い磁化領域に影響を与える応力によって変調された磁場を測定するために用いられる。
カスタム設計の磁気シールドは、外向磁場を第7xで低減し、トルク感度を高める。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 12:57:19 GMT)
A Digital Simulation Toolkit for Physics-Based Generation of Realistic Experimental Scanning Tunneling Microscopy Images [0.0] 我々は,現実的な走査トンネル顕微鏡画像を生成するために,低コストな物理駆動型デジタルツールキットを開発した。
選択した材料システムからクリーンなイメージをシミュレートする。
STM実験で得られた人工物と騒音の物理特性を事前に把握し,いくつかの人工物ノイズ関数を定式化する。
これらのノイズ成分は、シミュレートされたクリーン画像に追加され、現実的なSTM画像を生成する。
論文参考訳(メタデータ) (Tue, 29 Sep 2026 03:45:59 GMT)