Saturation-Insensitive Dueling Bandits with General Function Approximation [59.1] SI-CDB(SI-CDB)は、腕選択のための慎重に設計されたアルゴリズムである。
我々の分析の核となるのは、一般関数近似を用いたデュエルバンディットに適した局所化エルダー次元フレームワークである。
また,両腕の遺残分析が,デュエルバンドにおけるシングルアームのパフォーマンス向上に不可欠である理由も理論的に説明できる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:08:51 GMT)
RL Starts before RL: On Policy Distillation for Better Reinforcement Learning [57.7] 強化学習(RL)は推論を改善するが、その性能は学習開始の方針に依存する。
RLの調製段階としての政治蒸留(OPD)について検討した。
OPDの学生は、直接RLや教師付き微調整の訓練を受けた生徒よりも高い最終成績を得た。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:51:58 GMT)
Over-the-Air Federated Learning in Heterogeneous Mobile Wireless Networks [56.4] オーバー・ザ・エア(Over-the-air)計算は、無線ネットワークに学習アルゴリズムをデプロイするためのスケーラブルで効率的なソリューションである。
我々は,アルゴリズム正規化を採用し,暗黙のゴシップを通じてデバイスのアップデートを均等に混合するFedOAGを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:04:09 GMT)
HyperReCo: Retrieving and Connecting Evidence with Hypergraph Neural Networks for LLM Multi-hop Reasoning [55.9] ハイパーグラフニューラルネットワーク(HyperGNN)による証拠の検索と接続のためのフレームワークを提案する。
我々は、各ドキュメントを抽出されたエンティティ上のハイパーエッジとして表現し、共有エンティティがハイパーエッジを接続する。
文書やエンティティを共同で監督するハイパーグラフメッセージパッシングを通じて、HyperGNNはクエリ依存のインタラクションを学び、補完的な証拠を取得する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:43:30 GMT)
MergeHEIR: Mitigating Multimodal Hallucinations as the Tax of Model Merging [55.7] 我々は,初期専門家から受け継がれた専門知識を維持しつつ,この統合税の削減を目的とした,制約後の適応フレームワークであるMergeHEIRを紹介する。
我々は,MergeHEIRが相変わらず幻覚を緩和し,継承した専門知識を保ちつつ,より好意的な幻覚-保留トレードオフを示すことを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:48:28 GMT)
RECAST: Recasting Vision-Language Semantics into an Actionable Cost Map for Robot Navigation [55.5] RECASTは、VLMの推論と視覚基盤モデルの空間的接地を組み合わせたロボットナビゲーションフレームワークである。
シミュレーションでは13.3ポイント、実四重奏では31.4ポイントで最強の先行法よりも成功率を向上させる。
衝突速度を9.6点、14.3点に減らし、全ての方法の中で最も低い衝突速度に達する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:13:45 GMT)
CompassPlay: Rewarding the Proposer for Where It Moves the Solver [55.4] プロポーラの報酬は、しばしば解決者の成功率に依存するが、同じくらい難しいタスクは、トレーニングの価値で異なることがある。
我々は,アライメントアライメントを通じて提案者に報酬を与えるセルフプレイ手法であるCompassPlayを紹介した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:42:56 GMT)
A Journey to the Edge of Stability [53.8] 深層学習は、最大ヘッセン固有値モデルが学習率と相反する値で安定化される「安定性の端」(EoS)でしばしば起こる。
深層学習問題を解き、深層学習率のスイープで一階最適化法を変化させる。
次に、学習軌跡の特徴量、すなわち損失、鋭さ、連続的な勾配間のアライメントを追跡する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:28:18 GMT)
MM-OPD: Towards One More Bottleneck Between Perception and Reasoning [51.6] 最近の大規模言語モデル(MLLM)は、知覚と推論の両方を強化することで視覚的推論を推し進めている。
我々はこの仮定に挑戦する直感的現象を観察し、モデル、疑問、復号化を保ち、イメージをキャプションやコード表現に置き換える。
本稿では,シンボル条件付き行動から画像条件付きポリシーへガイダンスを転送する,シンボル・視覚的修正のためのフレームワークMM-OPDを紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:53:25 GMT)
World Agent: Can Language Models Keep a World Running? [48.3] 本稿では,納品時点から以降の継続運用まで,世代評価点を移動させる世界エージェントタスクを提案する。
このタスクでは、モデルが世界を生成するよう要求されることはない。世界を維持する責任は、イベントを調整し、その後の進化を抑えるために結果を進めることである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:55:08 GMT)
AuthorityLens: Rethinking LLM-Based Agent Systems Through the Lens of Authority [46.3] 本稿では,システムの権限構造を測定するためのフレームワークである AuthorityLens を紹介する。
我々は、システムが行う権限(システムオーソリティ)、その権限を行使するためにどの程度の共同参加が必要か(オーソリティ分離)、そして各参加者が保持する権限(プリンシパルオーソリティ)の3つの側面に沿ってシステムを評価する。
AuthorityLensをCodex、OpenCode、Gemini CLIに、エージェント操作の共通ポートフォリオ上の13のオペレーティング構成に適用します。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:53:11 GMT)
Write Back the $Δ$: Revisiting the Same Tokens with Fresh Representations [45.6] ReFluxは学習可能なフィードバックグラフで、インクリメントの経路を動的に選択し構成する。
同期ReFluxは10の言語モデリングコーパスのパープレキシティを一貫して低減し、精度を2.1-2.3ポイント向上させる。
ストリーミング ReFluxは、ベースモデルのバックボーン1x理論FLOPを保ちながら、これらの利益のほとんどを保持している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:42:27 GMT)
Optimal Nonparametric Dynamic Pricing with Censored Demand and Adversarial Inventory [44.8] 我々は、価格の前に任意の在庫レベルが明らかにされる、検閲された需要を伴うオンライン動的価格について検討する。
2026年、Xu et al. [2026] は制限的な構造仮定の下で、$widetildemathcalO(sqrtT)$ regretを達成した。
我々の最初の貢献は、この枠組みをより一般的で統計的に難しい非パラメトリックな設定に拡張することである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 21:20:45 GMT)
ProDyGS: Dynamic Gaussian Splatting from a Single Static Monocular Camera [44.0] ProDyGSは、単一の静止カメラで撮影されたビデオから高品質の新規ビューを合成するための、新しい動的3Dガウススプレイティングフレームワークである。
基礎的な単眼深度ネットワークを用いて時間的に一貫した深度マップを推定し,任意の視点からプロキシ画像を生成する3次元ガウス表現を構築した。
DyNeRFデータセットを用いた実験により, 単眼深度推定のみを外部監視として必要としながら, 最先端性能を実現することができた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:20:54 GMT)
Scanning While Imagining: A Scene-Graph World Model for Robotic Ultrasound Navigation [43.1] 多くのロボティックUSナビゲーション手法は、解剖学的変化を明示的に予測せずに行動を選択する。
本研究では,SanoGraph-WMを提案する。
ラベルマップ由来のSGを用いたロボットファントムナビゲーション実験において、プランナーは73.7%の試験で目標に到達した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:10:52 GMT)
Artificial intelligences and human scientists exhibit complementary strengths in theory building [42.4] 社会科学における高度な認知タスクにおける人工知能の有効性について検討する。
研究領域は男女不平等に関する学術談話であった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:35:53 GMT)
Train4Merge: A Controlled Single-Teacher Study of RL vs. SFT Teachers for OPD-Based Model Merging [42.3] 共有チェックポイントから訓練されたドメインエキスパートは、オンライン蒸留(OPD)を通じて1つのモデルにマージすることができる。
我々は,この選択を,多教師OPDのビルディングブロックである単一教師OPDによって探索する。
ベストチェックポイントでは、RL指導学生がSFT指導学生の成績を4.27ポイント、1.50ポイント、0.86ポイント上回った。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:59:03 GMT)
DraftAttention2: Fast Video Diffusion with Low-Resolution-Guided Mixed-Precision Attention [41.7] ビデオトランスフォーマーは、生成されたビデオの質が向上するが、ビデオの解像度と持続時間が増えるにつれて、トークンに対する注意がますます高くなる。
本稿では,低解像度のドラフトアテンションマップを用いて,アテンションブロックを共同選択し,それらの数値精度を割り当てる学習自由フレームワークであるDraft2を提案する。
実験により,本手法は既存の効率的なビデオ生成方法よりも優れた品質・効率トレードオフを実現することが示された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:47:31 GMT)
REALIS: A Curated Dataset for Studying the Challenges of AI Image Detection [41.6] 42の現代テキスト画像モデルによって生成された133万のリアル画像と合成画像のデータセットであるREALISを紹介する。
また、高品質な合成画像のためのストレステストサブセットであるREALIS-Expertを紹介する。
提案手法は,REALISに基づいて,事前学習された検出器,微調整されたモデル,ジェネレータおよび後処理シフト下でのゼロショットビジョン言語モデルを評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:53:36 GMT)
A Unified Framework and Dataset for Oriented Object Visual Grounding in Remote Sensing [40.9] リモートセンシング画像における視覚的グラウンドディングは、表現を参照することによって記述されたオブジェクトを見つけることを目的としている。
O$2$-VG-Trans はオブジェクト指向の視覚的接地のためのモダリティ変換器である。
O$2$-VG-Uniは、可能なフォアグラウンドオブジェクトに対する普遍指向の提案を予測する。
O$2$-VG-VLMは自動回帰視覚言語モデルである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:29:54 GMT)
An Empirical Study on What Matters for Viewpoint-Generalizable Policies in Visual Imitation Learning [40.4] 本稿では,視覚的政策が視点をまたいだ一般化を実現するための設計選択に関する実証的研究について述べる。
視覚的トークンが密に保持され、アクションヘッドが幾何学的推論に参加すると、視点は改善する。
現実的な結果として、これらの設計選択で訓練されたポリシーは、ランダムなカメラ構成の下で、シミュレーションから実世界へゼロショットを転送する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:29:58 GMT)
CAPEX: Efficiently Distilling Foundation Model Behavior into Deployable Robot Policies through Experience-Adaptive Reasoning [40.4] 本稿では,経験調和型デモコレクションフレームワークCAPEXを紹介する。
我々は,RoboCasaタスクおよびFrankaおよびバイマンガルYAM-armプラットフォーム上での評価を行った。
CAPEXは成功例の数を4.3倍にし,成功例当たりのコストを80%削減する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:05:46 GMT)
FinancialAuditBench: Benchmark Construction under Differential Privacy Using Real-World Priors [40.3] ファイナンシャルアウディベンチ(FinancialAuditBench)は、ファイナンシャルステートメント監査タスクにおけるエージェントの評価のためのベンチマークである。
FinancialAuditBenchは、ワークペーパーの完成と6つの総合的な監査エンゲージメントのレビューにまたがる90のタスクで構成されている。
我々のフレームワークは、プライバシに敏感なドメインにおけるモデル評価とトレーニングのための合成タスクを体系的に生成するためのアプローチを提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:07:58 GMT)
The GUI Is Not the State: Diagnosing State Aliasing in GUI World Models [40.0] 我々は、vis-ibleインタフェースが遷移関連環境状態を省略する状態エイリアスを同定する。
歴史から構造化状態を予測する軽量な予測状態回復法を提案する。
実験の結果,既存のGUI-WMは観測のみの条件入力下での系統的な故障を示すことがわかった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:35:45 GMT)
Learning an Anchored Prompt Space for Continual Adaptation of Large Language Models [39.2] アンコレッド・プロンプト空間の学習は歴史的即興効果を保っている。
LAPSはタスク固有のソフトプロンプト間の関係を学習し、ポジティブな伝達を促進する。
LAPSは蒸留ベース、プロンプトベース、および共同プロンプト-パラメータ適応ベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:39:55 GMT)
ReLOBGen: Replayable Limit Order Book Message Generation [39.1] ReLOBGenは、構成によって再生可能な制限順序書(LOB)メッセージを生成する方法である。
100%再生性を実現し、市場リアリズムを改善し、2.7text-3.6times$ speedup per replayed message over the LOBS5 baselineを提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:32:47 GMT)
CUE-Mem: Benchmarking Long-Term User Memory via Implicit Cues in Multimodal Conversations [38.1] CUE-Memは、暗黙の手がかりから長期ユーザメモリを評価するためのテキストイメージオーディオベンチマークである。
テキスト化されたメモリシステム全体において、暗黙のパフォーマンスはオラクルの証拠よりはるかに低いままである。
CUE-Memは、微妙なマルチモーダルエビデンスを選択的に保持、取得、使用するためのメモリシステム用のテストベッドを提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:49:02 GMT)
Relic: From Multi-Agent Collaboration to Persistent Organizational Capability [37.8] 繰り返し発生するコラボレーションの失敗を組織所有の実行可能なプロトコルに変えるRelicを紹介します。
メンバーは目に見える仕事を反映し、ルールを提案し、採用を管理します。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 21:55:49 GMT)
DashAct: A Progressive Diagnostic Benchmark for GUI Agents in Interactive Dashboard Analysis [37.7] 私たちが知る限りでは、DashActは、障害を同じダッシュボードタスク内のきめ細かいレベルで診断する最初のベンチマークです。
DashActには,マイルストン依存性と階層的ターゲットアノテーションを備えた,357の人間検証されたインタラクショントラジェクトリが含まれている。
その進歩的な診断カスケードは、エンドツーエンドの実行を評価し、検証済みコンテキストを次のアクション予測に復元し、ターゲットセマンティクスと視覚的接地のためのローカルビューを提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:58:50 GMT)
Clarify the User or Verify the World? Uncertainty Routing for Proactive Agents [37.6] 本稿では,プロアクティブな不確実性ルーティングフレームワーク PROUR を提案する。
PROURは、アクションの不確実性を、もっともらしいユーザゴール解釈の相違に分解する。
$-benchでは、PRURは小売りと航空会社全体で平均28.17%の成功率を達成した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:25:50 GMT)
Allspark: Weak to Strong Transfer via Alternating Chain of Thought [35.9] 我々は、訓練中に強力なモデルのロールアウトを使わずに、小さくて弱いモデルによって学習された推論の改善が、より大きく、より強力なモデルに利益をもたらすかどうかを問う。
思考の交互連鎖を通した弱強移動のためのトレーニングおよび推論フレームワークであるAllsparkを紹介した。
我々は、Alsparkを2つのスケールで研究する: 数学と推論にまたがる制御されたQwen実験、ARC-AGI-2におけるより大規模なインクリング実験。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:05:21 GMT)
Exact Gaussian Entanglement Dynamics and Initial-State Control in Coupled Parametric Oscillators [35.4] 時間依存バネによって駆動される2つの双線形結合調和音について検討した。
エンタングルメントは相対的スクイージング等級と相対的スクイージング角の両方によって支配されていることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:19:16 GMT)
HoTS: Homophily-Aware Temperature Scaling for Graph Neural Network Calibration [34.7] Homophily-Aware Temperature Scaling (HoTS) は、エントロピーに基づくロジット濃度と推定局所ホモフィリーから各ノードに正の温度を割り当てる単純なポストホックキャリブレータである。
HoTSは、予測エラー(ECE)が4.79%、最高の平均ランク、最も信頼できる信頼性ランキングを選択分類で達成している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:58:12 GMT)
OmniMoE-VL: A Sparse Vision-Language Model with Coupled Visual-Depth Routing [34.2] 視覚深度プロジェクタを結合したスパースVLMであるOmniMoE-VLを紹介する。
各画像プロンプトペアに対して、プロジェクタは、中間的な視覚深度のスパースセットを選択する。
この設計は、ネイティブな視覚情報シーケンスを保持しながら、質問依存の視覚アクセスを可能にする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:55:15 GMT)
FA-Bench: A Benchmark for Word-Level and Phone-Level Forced-Alignment and ASR Timestamps Under Clean and Noisy Conditions [34.1] 強制アライメントは、音声とテキストの書き起こしをアライメントし、単語と電話のタイムスタンプを生成する。
FA-Benchは、これらの選択を一度修正し、コード、分割、電話マッピング、テキスト正規化、スコアリングスクリプトをリリースするオープンフレームワークである。
発話のすべてのバウンダリをスコアし、それの横にある2つのラベルをチェックします。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:16:06 GMT)
On the Behavioral Traits of LLM Agents [31.8] 行動データ(Bデータ)から特徴量のボトムアップを推定するためのA-B-Dを提案する。
80のモデル、12のタスク、50のハーネスにまたがる実世界の345,667の軌道から、318の候補特徴を抽出した。
例えば、Kim-K3は最も計画的で、GPT-5.5とGPT-5.6は最もエネルギーが少ない。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:51:52 GMT)
Ask Without Telling: Local SLMs Consult Cloud LLMs Without Revealing Task Intent [31.8] 既存のプライバシ保護SLM-LLMフレームワークは、タスクセマンティクスを保持しながら機密性の高い値を隠している。
最近のdecoyベースのメソッドでは、代替手段間の真の要求を隠すことで、タスク意図をさらに曖昧にしている。
回復可能な数学的再構成によってタスク自体を変換するエンドツーエンドフレームワークであるPriConを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:04:51 GMT)
What Should a Self-Teacher See? Privileged Context Design for On-Policy Self-Distillation [31.7] 本研究では,自己学習者が特権的文脈下で生徒自身のロールアウトをスコアする,政治自己蒸留(OPSD)の緊張度について検討する。
オフラインでコンパイルされた3つの抽象化、名前付き戦略、メソッドに依存しないフレーミング、問題カテゴリを比較します。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:35:55 GMT)
On the Capability and Limitation of Hard Prompt [29.4] 本稿では,変圧器が下流タスクを解くハードプロンプトの存在を判断することはNP完全であることを示す。
ソフトなプロンプトや連続的なプロンプトとは異なり、ハードプロンプトには必須の制限があることを示す。
有限タスク上でのプロンプトの実行に対して、プロンプト長の観点からタスクのサイズを厳密に制限する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:51:27 GMT)
AsynCodeBench: Benchmarking Collaboration of Asynchronous Multi-Agent Systems in Software Engineering [29.4] マルチエージェントソフトウェアエンジニアリングのための依存性中心ベンチマークであるAsynCodeBenchを紹介する。
AsynCodeBenchは明示的な依存性グラフと実行可能な依存性チェッカーで各タスクを表現する。
コーディング性能の改善が必ずしもコラボレーションの強化につながるとは限らないことを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:19:40 GMT)
FoundDSR: A Generalizable Foundation Model with Guided 2D Gaussian Splatting for Depth Super-Resolution [29.2] FoundDSRは、見えないデータ分布にまたがる堅牢な深度再構成のための一般化可能な基礎モデルである。
ガウスのパラメータを最適化するプロンプトとして高解像度のRGBを採用している。
FoundDSRは、既存の最先端アプローチを一貫して上回っている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:35:05 GMT)
Mind the Spike: Mechanisms and Brittleness of Visual Massive Activations in Large Vision-Language Models [28.9] 大規模視覚言語モデル(LVLM)は、テキストのみのベースから大規模なアクティベーションを継承する。
視覚的なスパイクは画像によって異なるが、その形成が一貫したパターンに従うかどうかは未解決のままである。
本研究は,2Bから72Bパラメータの10種類のテキストのみのベースを18個リリースしたアダプタベースのLVLMを25個構築した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:30:10 GMT)
Not Every Term Adds New Structure: Sobolev Novelty for Symbolic Regression [28.9] シンボリック方程式における構造独立の項レベル尺度であるtextbfSobolev Novelty を導入する。
各項に対して、その関数値と観測された入力上の正確な導関数から経験的なソボレフシグネチャを構築する。
理論校正しきい値が導出され、構造的に新しい用語を識別するための原則的かつチューニング不要な基準が導出される。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:15:17 GMT)
Learning to Refer: Client-Resolved Generation for Privacy-Aware Language Models [28.6] クラウドベースの大規模言語モデル(LLM)では、ユーザはサービスプロバイダにデータを公開し、機密ドメインのプライバシリスクを発生させる必要がある。
本稿では,サーバサイド生成と入力内容の語彙的実現を分離するジェネラオンインタフェースであるクライアント-解決生成(CRG)を紹介する。
このインターフェースは、トレインイングと推論の両方の間、プライベート入力とインプットから出力されるコンテンツを保護すると同時に、サービスプロバイダが独自のモデルパラメータをクライアントから隠蔽することを可能にする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:13:58 GMT)
Benchmarking EEG Foundation Models at Scale: Lessons from 20,000 Evaluations [28.5] 脳波基礎モデル(FM)は伝達可能な神経表現を約束する。
EEG-Arenaはオープンソースのベンチマークで、30のEEG FMと25の教師付きベースラインをカバーする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:02:21 GMT)
TreeRef-BFN: Equivariance-Free De Novo Molecule Generation based on 2D Topology and Internal 3D Geometry [28.3] デ・ノボの3D分子生成は、分子のサイズ、トポロジー、幾何学を共同でモデル化する。
そこで本研究では,分子トポロジとトポロジに依存した局所3次元幾何学を自然に可変サイズの木に割り当てる木に基づく分子表現であるTreeRefを提案する。
TreeRefをベースとした標準的なトランスフォーマーバックボーンを備えたベイズフローネットワークであるTreeRef-BFNを開発し、これらの局所的な変数をグローバルに結合し、離散的な分子変数と連続的な局所幾何学を生成する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:43:38 GMT)
Shared Worlds, Private Minds: Structured Memory for Long-Form Writing as World Creation [27.7] 本稿では,メモリ構築を世界創造として扱う長文書き込みのための構造化メモリシステムであるNarraWorldを紹介する。
共有されたエビデンスに基づくグラフから、NarraWorldは、世界事実、キャラクタごとの信念、オープンな発展、仮説的な枝という4つの接続された見解を導出している。
NarraWorldは3つのベンチマークで最強の集計結果を達成した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:24:22 GMT)
Routing Drift Alone Does Not Diagnose Failure in Merged MoE LLMs [27.7] 本稿では,制御された対策介入とトークンレベルの分析のためのルーティング解析ツールキットを提案する。
我々は、ルーティング障害を特定のルーティング介入の下でリカバリ可能なtextittask損失として運用し、非ルーティングパラメータを固定する。
そこで本研究では,EmphSelective Router repair (SRR) を事例として提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:47:55 GMT)
From Feed-Forward to Flow: Unifying Reconstruction and Generation Is Easier Than You Think [27.5] 再構成と生成のためのフローベース統一型定式化を提案する。
共有されたクリーンターゲット予測器は、その単一ステップのエンドポイントで直接再構成を行い、マルチステップフローを介して条件生成を展開する。
再構成と生成は定式化とバックボーンの両方を共有できることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:28:52 GMT)
PruneForget: Joint Unlearning and Pruning of Vision Models [27.5] 学習と刈り取りは自然に一致しており、互いに気付くように共同で解決すべきであることを示す。
本研究では,未学習集合をプルーニングガイドとして利用するPruneForgetを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:39:19 GMT)
Theory of Scene: Breaking the Symmetry Trap in Multi-Agent LLM Coordination [27.5] マルチエージェントシステムが同時に動作する場合、それらはターゲットに衝突し、分割し、一緒に取り組まなければならないターゲットに分散する必要があることを示す。
本稿では,各エージェントが公開ロールを読み取るトレーニングフリー推論スキーマである「シーンの理論(ToS)」を提案する。
ToSはベンチマーク毎に6つのベースラインを上回り、各ベースラインは少なくとも1つの設定でそれよりはるかに遅れている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:56:41 GMT)
PhiFold: Towards Dynamic Protein Design with Physics-Structured Covariance Modeling [27.4] PhiFoldは、タンパク質のバックボーンとその2次ダイナミクスを共同生成するためのフレームワークである。
力学を3つの解釈可能な構成要素に分解する:局所的柔軟性、低ランクな集団運動表現、残余的な集団参加である。
平衡力学の明示的な表現で構造生成を統一することにより、PhiFoldはタンパク質を設計するための基礎を築いた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:10:43 GMT)
DAAF: From Failure Localization to Editable System Assets in LLM Agents [27.4] フェールローカライゼーションメソッドは、エージェントや実行トレースにエラーが現れる場所を特定することができるが、修復には別の決定が必要である。
我々は,このギャップを,実行場所ではなく,バージョン管理されたアドレス可能な項目を対象とするコンポーネント属性障害属性を通じて検討する。
本研究では,有効な属性置換の効果を学習し,この介入証拠をデプロイ時の診断に保存する検出・認識フレームワーク(DAAF)を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:39:00 GMT)
From Anomalies to Failures: Constructing Causal Error Graphs for Agentic Trace Diagnosis [27.3] LLMを駆動するエージェントは、長いエージェントトレースによって診断が困難になる複雑なアプリケーションにますますデプロイされる。
エージェントトレースの因果診断のためのツール強化エージェントフレームワークであるCEG-Agentを提案する。
CEG-Agentは, 意味的緩和と構造的正確な評価基準の下で, 最先端の性能を達成することを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:01:04 GMT)
Porimon: An LLM-Based Pokémon Battle Agent Enhanced by Long/Short-Term Knowledge Augmented Generation [27.1] 我々は,Pokémon Battles をケーススタディとして,敵意識の計画を必要とするタスクにおいて LLM ベースのエージェントのパフォーマンスを改善する方法について検討する。
本稿ではLSTKAG(Long/Short-Term Knowledge Augmented Generation)を提案する。
LSTKAGに基づいて、ポケモンバトルのためのLLMベースのエージェント構造であるPolimonを設計する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:22:58 GMT)
Getting Motif-ated: Controllable AI Compositions from Injected Motif Prompts [26.8] そこで本研究では,事前学習したシンボリック・ミュージック・モデルに新たなインストラクション・プロンプトを組み込むためのレシピであるMotiGenを紹介する。
実験の結果,本モデルは92.3%以上の生成片において誘導モチーフで構成されていることがわかった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:02:21 GMT)
World SLAM Model: Joint World Modeling for SLAM and Navigation [26.6] World SLAM Model(WSM)は、SLAMパラダイムを直接下流のナビゲーションに持ち込む統合フレームワークである。
WSMは将来の視覚状態を予測し、カメラの動きと密度幾何学を共同で推定する。
実験では、SLAMの精度が向上し、ナビゲーション性能が向上した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:44:57 GMT)
SPACE: Sparse Predictive Attractor via Counterfactual Eviction for Streaming Video Memory [26.4] 本研究では,SPACE(Sparse Predictive Attractor via Counterfactual Eviction)を導入し,代替的エビテーション行動によって引き起こされる将来の表現を予測する。
カウンターファクチュアルユーティリティは将来の有用な代替品を識別し、遅い予測ベース幾何は回避可能なドリフトをいつ修正するかを決定する。
MABS-Benchは、一致した因果ストリームとメモリ予算の下で、将来のタスク満足度、レジスタ内予測安定性、遷移応答性、回復を評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:11:20 GMT)
Prefill-Free Cross-Family KV Cache Transfer for Heterogeneous Multi-Agent LLMs [26.3] テキストベースの通信では、受信側は送信者がすでに処理している共有コンテキストをプリフィルする必要がある。
HeteroFoldはプリフィルフリーのクロスファミリーKVキャッシュ転送方式で、送信側と受信側の両方を凍結させる。
HeteroFoldは、4つの長いコンテキストベンチマークと最も短いコンテキスト設定で最高のキャッシュ転送性能を達成する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:30:18 GMT)
CAFE: Counterfactual Prediction via Fast Posterior Estimation [25.9] 事実予測は、実際の観察から介入した個人の結果を推定する。
CBEは、観測的に区別できない因果グラフによって誘導される構造的不確実性が存在する場合に、後続の予測分布を近似する。
現実的な製造やブドウ栽培における強い性能は、その経験的堅牢性をさらに証明している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:43:21 GMT)
RepoMAS: Solving Progressively Specified Tasks with Issue-Driven Multi-Agent Systems [25.8] 実際には、ユーザ要求はしばしば不完全であり、追加の要件は推論やツールの使用、実行時にのみ明確になる可能性がある。
初期要求で明示された要求に対して最終的な出力を評価するベンチマークであるProgSpecを紹介する。
本稿では,オープンソースのプロジェクト管理にインスパイアされた課題駆動型マルチエージェントフレームワークであるRepoMASを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:33:53 GMT)
More Programs or More Rolls? Separating Coverage from Specialization in LLM Harnesses [25.5] LLMはタスクの特殊化を通じて推論を改善することを約束するが、同じプログラムの繰り返し実行によって追加の回答カバレッジが生じる可能性がある。
質問に対する回答のカバレッジ、繰り返し可能なタスクの利点、および事前実行選択から得られる利益を分離する制御された評価を導入する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:16:07 GMT)
Certainty Is Not Just Correctness: Rethinking Token-Level Certainty in LLM Reasoning [25.2] トークンレベルの確実性は、LLMトレーニングや推論において、正確性のためのプロキシとして広く使用されている。
モデルおよびタスク間での制御された経験的評価により、確実性の予測能力を評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:56:58 GMT)
PluginRSI: Recursive Improvement of Agent Harnesses with Reusable Plugins [24.8] 我々は,これらのプラグインの周辺で,アトム化プラグインの構成要素としてハーネスを表現し,ハーネスの進化を組織化するRSIを紹介する。
RSIは、ソフトウェアエンジニアリング、コマンドラインインタラクション、質問応答タスクにまたがる既存の最適化手法を改善する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:49:25 GMT)
Can Motion-Language Models Ground Structure? STRIDE for Evaluating the Evaluators [24.6] 本稿では、時間順、反射、同一性診断評価ベンチマークによる構造的グラウンド化について紹介する。
我々は,時間的秩序,ミラー反射,行動同一性を追跡する評価器の能力を体系的に評価した。
実験の結果, 鏡面の感度が低下し, 鏡面の感度が低下することが判明した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:52:20 GMT)
Back-Tracking from Clarity: Self-Learning to See Text from Afar [24.6] 本研究では,シーンテキスト検出能力を高めるための自己教師型フレームワークを提案する。
我々のフレームワークは、様々な場面や言語で早期検出精度と堅牢性を著しく改善する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:16:51 GMT)
Staying on the Attractor: Supervising Neural Surrogates of 3D Turbulence Where They Leave It [23.8] 本研究は,神経サロゲートが引き寄せられる場所を監督するために,OAS(off-attractor surveillance)を提案する。
OASは、固定基準軌道からの監督をサロゲートが失敗する可能性のある状態に拡張することで、物理モデルを神経シミュレーションに統合する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:51:34 GMT)
Kernel-Based Steering of CLIP with Vision-Language Model Preferences [23.6] 大きな視覚言語モデル(VLM)は視覚的類似性を判断できるが、その判断は効率的な比較のためにコンパクトな画像埋め込みとして直接利用することはできない。
本稿では,教師の埋め込みを使わずにペアの判断から学習するカーネルベースのステアリング手法であるASKを紹介する。
適応後、検索はVLMコールなしでCLIPイメージの埋め込みとコサイン類似性を使用する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:58:27 GMT)
REMEDY: How Far Is Video Generation from Medical Education World Models? [23.5] 本稿では,AIによる医学教育の実演のための最初のベンチマークであるREMEDY(Readiness Evaluation of Medical Education Demonstration sYnthesis)について紹介する。
REMEDYは実際のデモビデオから900フレームを提供し、4つのシナリオにわたる12のタスクをカバーしている。
以上の結果から,現実的な外見と時間的整合性は適切な臨床行動を保証するものではないことが示唆された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:49:58 GMT)
RoboFFT: Finetuning generative robot policy via online reinforcement learning with forward process [22.9] 生成ロボットポリシーを微調整するための前処理強化学習フレームワークであるRoboFFTを提案する。
本研究では,代表シミュレーションベンチマークを用いて,RoboFFTを一般的な生成ロボットポリシーで評価する。
さらに,RoboFFTを実世界のRLフレームワークに統合し,実世界のタスクにおいて有効性を示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:52:58 GMT)
SameFact: The Same Safety Facts Lead to Different Responses Across Interfaces [22.8] 私たちは、この質問を直接テストするマッチしたカウントファクトのベンチマークであるSameFactを紹介します。
SameFactには300のセーフ/アンセーフペアが含まれており、タスク、事前の観察、候補アクション、識別子、およびターゲット外の事実を保持し、単一の状態の安全事実を変更している。
同一の候補-行動境界における3つのインターフェース(明確な安全判断、チェックポイント候補の入場、オープンファーストアクション選択)を通して、この一致した介入の効果を計測する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:55:03 GMT)
MemoryAthena: Adaptive Routing over Latent and Generated Memories [22.4] 本研究は,検索だけでなく,有用なメモリも生成できるかどうかを考察する。
MemoryAthenaは、直接Engram検索(E)、検索したEngram cues(GE)からの生成、メモリテーブル(GH)を参照せずに因果バックボーン状態からの生成の3つの経路を使用する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:52:03 GMT)
UnStep: Training-Free Acceleration of Causal Video Diffusion with Fewer Steps Than Distillation [22.1] 提案するUnStepは,推論時に因果的ビデオモデルを高速化するトレーニングフリーラッパーである。
ステップ削減とアテンションウィンドウリングによって失われた品質を回復する2つの推論のみのメカニズムを提案する。
UnStepは、因果的ビデオ拡散のための新しいスループットレギュレーションを設定し、品質損失なく1つのH100で50FPS、GB200で77FPSに達した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:02:08 GMT)
TimeES: Probabilistic and Deterministic Time Series Forecasting via Evolutionary Spectra [22.1] 実世界の時系列は本質的に非定常的であり、傾向、周期パターン、不確実性は時間とともに進化する。
現在のディープラーニングアプローチは、フーリエスペクトルの進化とランダム性を明示的にモデル化していない。
進化スペクトル(ES)理論により,確率的および決定論的予測を可能にする一般的なフレームワークであるTimeESを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:58:48 GMT)
On the Pitfalls of Verbalized Confidence Priors for Calibrating Large Reasoning Models [22.1] 市販のLEMは,RL全体にわたって持続するいくつかの高い値に大きく集中する前に,信頼性を示すことを示す。
本稿では、RLの前に広く支持される前に、キャリブレーションされた信頼度を形成するプラグイン・アンド・プレイの微調整ステージであるCalibSFTを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:00:45 GMT)
PF-RL: Progress Field Reinforcement Learning via Goal-Conditioned Value Geometry for Vision-Language-Action Models [22.0] Reinforcement Fine-Tuning(RFT)はビジョン・ランゲージ・アクション(VLA)ポリシーを改善するための有望なパラダイムとして登場した。
本稿では,事前学習したVLA機能に対して,目標条件付き進捗表現を構造化したPF-RLを導入する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:53:11 GMT)
RecastVLA: From Past Interaction to Future Control with Adaptive Policy States [21.8] シークエンシャルな操作では、現在のシーンが明らかになっていない場合でも、ロボットが既に起きていることを追跡する必要がある。
我々は、アクション生成自体がその後の制御のために永続的な状態を形成することができるか尋ねる。
RecastVLAは、フローマッチング型視覚言語アクションポリシーの中で適応的なポリシー状態を維持している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:17:13 GMT)
Improving Video Sparse Attention with Fine-grained Router and Sparse Rebasing [21.6] VSA2は、ビデオDiTのための、フロンティアトレーニング可能なスパースアテンションである。
フルアテンションのDiTと同等か、あるいは同等のクオリティのDiTを生産する。
プログレッシブ・ロー・ツー・ハイ・レゾリューション・プレトレーニングの途中で、完全な注意を置き換えることができる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:05:06 GMT)
Trapped by Their Own Rollouts: Understanding Aggregation--Rollout Feedback in Federated On-Policy Distillation [21.6] オンライン蒸留(OPD)は言語モデル適応への有望なアプローチである。
フェデレーションOPDについて検討し、学習速度の感度によってかなりのコラボレーションの利得が明らかになることを示した。
本稿では,FedAvg更新の規模をクライアントワイド予測変更制約に適応させるため,現在のトラジェクトリに対する教師のフィードバックを再利用するFedTOPSを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:48:43 GMT)
Latent Space Is Not Flat: Rethinking Latent Structure for 3D Medical Image Synthesis [21.3] 我々は、$ell$ objectivesによって誘導される一般的な平坦なマグニチュードの仮定が不正確であることを示す。
潜在状態を構造と残留に分解する潜在フロー構造(LSF)を導入する。
LSFは、グローバルな指標と腫瘍固有の指標の両方で比較されたベースラインを上回ります。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:09:30 GMT)
How Far Do Persona Effects Generalize in Language Models? [21.3] ペルソナは特定の種類の人々の答えを言語モデルに求める。
これらの効果から得られた関係が、新しい質問に対する反応を予測し、モデルやプロンプトで有用かどうかを検証する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:26:03 GMT)
Self-Evolving Multi-Agent Symbolic Discovery for Financial Fundamental Analysis [21.3] 金融における記号発見のための階層型多エージェントフレームワークMUFASAを提案する。
複数の国のデータセットを対象とした実験は、MUFASAが評価タスクで最先端のパフォーマンスを達成することを示している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:05:04 GMT)
From Trajectories to Grounded Preferences: Process Preference Synthesis via Interaction Element Graphs for Web PRMs [20.4] 比較Web PRMのためのグラフ誘導プロセス選好フレームワークであるSURFPRMを提案する。
SURFPRMは、Webデモを、環境を基盤としたネガティブアクション提案メカニズムとして機能する永続的なインタラクショングラフ要素に構成する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:14:50 GMT)
ProTTT: Learning to Learn Semantic User Memory with Test-Time Training [20.4] パーソナライゼーションは、成長するユーザ履歴からユーザ固有の知識をキャプチャする言語モデルを必要とする。
セマンティックユーザメモリを学習するためのプロファイル教師付きメタラーニングフレームワークであるProTTTを紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:36:59 GMT)
Reuse or Relearn? A Spectral View of Earth Observation Foundation Models [20.1] ファンデーションモデルは一般的で凍結された特徴抽出器として滅多に使われない。
代わりに、ターゲットの下流アプリケーションのために微調整される。
適応前後のモデルを比較し、その支配的な特異部分空間がどれだけよく保存されているかを定量化する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:21:53 GMT)
PQR3D: Progressive Query Refinement over Reference-Conditioned Temporal Windows for Multi-View 3D Object Detection [19.5] 時間的コンテキストは、カメラのみのマルチビュー3Dオブジェクト検出に不可欠である。
提案するPQR3Dは,参照条件付き時間ウィンドウ内で進行的なクエリ改善を行う。
ViT-Lのバックボーンにより、PQR3DはnuScenesテストセットに新しい状態を設定し、71.6 NDSと64.9 mAPを達成した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:40:03 GMT)
Copper-Policy: Focus on the Representation for Robust Robot Manipulation [19.3] 我々は,この政策でコンパクトな世界表現を学習するCuper-Policyを紹介した。
画素を再構成することなくタスク意図に調和した将来の観察埋め込みを予測する。
表現分析により、学習した特徴は摂動からタスク駆動的変化を分離した方がよいことが示された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:53:28 GMT)
USAI-Quant: A Quantitative Reasoning Benchmark for Vision-Language Models in Built Environments [19.2] 現在最先端の大規模視覚言語モデル(VLM)は、リモートセンシング画像の定量的推論に苦慮している。
リモートセンシング画像を用いた構築環境計測において,VLMの推論能力を定量的に評価するための最初のベンチマークを開発した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:37:25 GMT)
Learning from Others, Acting for You: Cross-User Memory Sharing for LLM Agents [19.2] ShareMemは、再利用可能なエクスペリエンスを共有しながら、アプリケーションをユーザ自身の好みに根ざしたメモリアーキテクチャである。
ウェブナビゲーション(Mind2Web)、オンラインパーソナライズされたインタラクション(VitaBench2.0)、および4つのバックボーンモデルによるマルチセッションコーディングを評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:59:39 GMT)
One Perception, All Maneuvers: Directional Traffic Signal Understanding for Maneuver-Level Signal Intent Prediction [19.2] Directional Traffic Signal Understandingは、フロントビューイメージからストレート、左ターン、右ターン、Uターンの操作のための構造化信号状態を予測する。
方向対応ベースラインは、グローバルコンテキスト、局所的なトラフィックライトエビデンス、および操作固有の表現を組み合わせたものだ。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:19:01 GMT)
Towards Scalable Data Diversification for Language Model Pretraining via Leverage Score Sampling [19.0] 組込みデータの最大体積をレバレッジスコアで決定的に拡大するサンプルを反復的に選択するtextbfLeverage Score Smpling (Lev) を導入する。
Levは、最大72タイムのスピードアップを提供し、Vendiスコアによって測定されたデータセットの多様性を改善し、強力な多様化ベースラインであるtextbfDiSFに対して9.2%の価格で提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:26:32 GMT)
PolyTopoBench: A Benchmark for Complex Vector Polygon Generation from Remote Sensing Imagery [18.8] RS画像からベクトルポリゴンを生成するための統一評価フレームワークであるPolyTopoBenchを提案する。
その結果,ポリゴン生成は未解決課題であることが明らかとなった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:31:13 GMT)
Efficient Support Recovery of Mixtures of Sparse Linear Classifiers with Less Measurements [18.6] 線形分類器の混合におけるサポートリカバリ問題は、複数の線形決定規則の混合によってデータが生成されるとき、実際にどの特徴が重要であるかを特定することを目的としている。
本稿では,測定回数を削減し,同時にサブ線形復号時間を実現することで,事前結果を大幅に改善する適応型および非適応型スキームを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:55:10 GMT)
AdaTutoRank: Learning to Rerank Document Sets via Adaptive Tutoring Optimization for RAG and Deep Research [18.6] 本稿では,Adaptive Tutoring Optimization を用いて学習したアダテュートランカ AdaTutoRank を提案する。
AdaTutoRankは、検索コールを減らしながら、全体的なパフォーマンスを最高のものにしている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:05:34 GMT)
From Static Policies to Adaptive Priors in Offline Reinforcement Learning [18.5] オフライン強化学習(RL)は伝統的に、保守的な目的の下で直接配置するための学習ポリシーに重点を置いてきた。
オンラインインタラクションを通じてオフラインでトレーニングされたポリシーが更新されると、この定式化は不完全になる、と我々は主張する。
このポジションペーパーでは、このような設定では、オフラインRLの目的は即時デプロイを超えて拡張されるべきである、と論じている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:31:54 GMT)
OpenMASC: An Open-Source Pipeline for Cross-Trajectory Metal-Aware Sampling and Correction in Accelerated MRI [18.5] 金属インプラントは、$k$-spaceでMRI測定を破損させる。
パブリックデータセットは、同じ解剖学のために、$k$スペースのペアと、金属と非金属のイメージを提供していません。
データ生成からデプロイメントまでの完全なワークフローをカバーするオープンソースのパイプラインであるOpenMASCを紹介します。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:04:15 GMT)
What Should Data Teach? Moving Bottlenecks Across Circuit, Store, and Use [18.3] サーキットビューでは、計算の作成、必要なコンテンツの提供、利用可能なルートの選択という、3つの異なるボトルネックが明らかにされている。
350Mモデルの連続実験は、3つの介入を同じ事実に結びつける。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:40:36 GMT)
TriDrive: Joint Driver, Vehicle, and Road Modeling for Forecasting and Driver Monitoring [18.1] 我々はTriDriveを紹介し、ドライバーのキネマティクス、車両のダイナミクス、道路需要を共同で予測する最初の統合フレームワークについて紹介する。
リアルタイム使用のために,道路エンコーダを蒸留し,外部8GBのGPUを備えたコンマ4上でTriDriveを実行する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:47:08 GMT)
BarcodeMAE+: Rethinking Masked Pretraining and Global Representations for DNA Barcode Foundation Models [18.0] 多くのDNA基盤モデルは、配列の一部をマスキングし、モデルを再構築するよう要求することで事前訓練される。
標準的なマスク付き事前トレーニングは、推論時に欠落している特別な[MASK]トークンにエンコーダを公開する。
本稿では,BarcodeMAE+とモデルアーキテクチャ,グローバル[MASK]表現,補助事前学習目標について紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:15:40 GMT)
Rethinking Training-Inference Mismatch in LLM Reinforcement Learning: Where It Arises and How to Correct It [17.4] 政策更新における不一致を考慮した重要サンプリング(CIS)を導入する。
CISは、切り捨てられた重要度サンプリングよりも、低信頼トークンに対するトラクションバイアスが少ない。
診断分析により、CISは重要度サンプリングよりも低信頼トークンにトラクションバイアスが少ないことが示された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:21:24 GMT)
When Does a Skill Add Value? Task-Conditional Gain Prediction for Selective Skill Use [17.2] SkillDeltaは、同じエージェントのペア実行によるタスク条件スキルのゲインを、スキルなしで予測するためのフレームワークである。
ローカル予測器は、エージェントを再訓練することなく、これらの歴史的利益を新しいタスクに転送する。
一致したスキル使用率では、SkillDeltaは15設定すべてでランダムなアクティベーションよりも成功し、平均4.3%の絶対的なゲインとなる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:03:54 GMT)
Scaling Properties of Same-Family On-Policy Distillation [16.6] We study the scaling properties of *on-policy distillation (OPD)* across *weak-to-strong*, *same-base* and *strong-to-weak* setups。
初期のOPDトレーニングダイナミクスは、通常の *useful-transfer* 体制を均一に示している。
また,2種類のOPDのスケーリング効果,弱いOPDのブートストラップ,およびオンライン監視の程度について検討した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:39:11 GMT)
A Comparative Analysis of Attention versus State-Space Models for In-Context Learning [16.6] 広義の注意クラスとSSMの表現能力を比較するための統一的なフレームワークである信念幾何学を開発する。
信念維持のため、SSMは静止集約カーネルよりも最適に後悔し、位置集合ではSSMはメモリ上の優位性を持ち、コンテンツ対応では、ソフトマックスアテンションはシグモイド選択SSMよりも指数的な幅の優位性を持つ。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:59:24 GMT)
RE-0: Verified Recursive Improvement of Embodied Code-as-Policy Agents through Local On-Policy Distillation [16.4] Code-as-Policyエージェントは、コードの生成と実行によって、長い水平化タスクを達成する。
既存の蒸留法は教師の完全な振る舞いを監督対象として扱い、教師が失敗した州でのトレーニングクレジットを誤割り当てする。
実証された介入をオンライン蒸留の監督に転換するRE-OPDを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:44:35 GMT)
Generative Priors Conditioned on Natural Language for Bayesian Inversion in PDEs [16.4] データから大量の関心(QoI)を推測することは、科学と工学の中心的な課題である。
我々は2つのモダリティの固有の相関を利用して、非常に情報に富んだデータ駆動自然言語-条件ベイジアンを前もって学習する。
条件拡散法と条件自動符号化法を併用した2つの並列手法を開発し,両者を古典的ベイズ法と比較した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 21:02:41 GMT)
Action Shaping: Policies Absorb What They Can Express [16.3] 私たちはこの実践を行動形成と呼び、その原則を述べます。
トレーニング可能なポリシは、自身の出力層が正確に再現できるオフセットを吸収する。
厳密な再現により、勾配ノイズが流れる平坦な方向が失われ、オフセットの振幅は、取り除く前に、ヘッドを落とすのに何の費用がかかるかを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:18:55 GMT)
When Less Compute Is More: Adaptive Early Exit Improves Pretrained Outlier Detection [16.2] 事前訓練された基礎モデルは、データセットのサイズに応じて推論コストが増大し、すべてのデータセットを一定の深さで処理する。
本稿では,事前学習した外乱検出モデルに対する深度適応型早期退避に関する最初の研究について述べる。
最適中間層での終了はまた、様々な実世界のベンチマークにおける検出性能を平均4.7-7.3%向上させることができる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:37:00 GMT)
Not Every Token Is Worth Distilling: Selective Supervision for Direct-OPD [16.1] ダイレクト・オン・ポリシィ蒸留(Direct-OPD)は、学生自身のロールアウトの厳密な監督として、ポストRLとプレRLチェックポイントのトークンレベル対数比を用いて、強化学習による政策改善を小さなモデルからより大きな学生に転送する。
我々は,Jensen-Shannon divergence (JSD) とチェックポイント間のKL方向の両方が,この質量で消滅する一方,Direct-OPD報酬とその更新は変化しないことを示す。
学生を選抜するダイレクトOPD(S$2$D-OPD)の選抜スーパービジョンを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:54:04 GMT)
Carnator: Fast Text-to-Video Generation with Generation-Native Compatibility-Guided Cross-Request Reuse [16.1] ビデオ拡散変換器は高品質なビデオを生成するが、反復的にノイズを発生させるとかなりの遅延が発生する。
最近のクロス・リクエスト・リユース(英語版)は追加の貯蓄源を提供するが、既存のアプローチは、しばしば粗いセマンティックな類似性から再利用可能性を予測する。
本稿では,この課題に対処するクロスリクエストアクセラレーションフレームワークであるemphCarnatorについて,世代固有の互換性エビデンスを抽出し,使用することによって紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:47:38 GMT)
Equivariant Neural Primal-Dual Assignment for Maximum Common Edge Subgraphs [16.0] 分子類似性探索には多くのグラフ対をマッチングする必要がある。
Equivariant Neural Primal-Dual Assignment (ENPDA)を紹介する。
ENPDAは共有マッチングポリシーを学び、さらなるトレーニングなしに新しいペアに適用する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:19:12 GMT)
Business Compromise Detection with Agentic AI and LLM-driven Knowledge Discovery [16.0] LLM(Large Language Model)エージェントは、整合性の強制を約束するが、ハードケースに対する幻覚的なミスはビジネス上の摩擦を引き起こす。
自律エージェントは、強いリコール重信号抽出器であるが、信頼性の低い最終アービターであり、不明瞭な決定の精度を許容している。
そこで我々は,このエージェントを,構造化され解釈可能な信号ベクトルを出力し,決定をニューロシンボリックな段階に委譲する研究者として,FOIL-IEによって発見された記号規則,ネイブベイズ校正層,データ調整された矛盾層として保持する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:05:25 GMT)
HeroFrame-Bench: Reference-Anchored Evaluation via Rubric--Ranking Co-Evolution for Movie Hero Frame Selection [16.0] 本稿では,ヒーローフレーム選択のためのスケーラブルなVLM-as-a-JudgeフレームワークであるHero-Frame-Benchを紹介する。
多様なメタデータから、選択したフレームをスコアするVLM判定を行うためのマルチモーダルコンテキストを構築する。
Hero-Frame-Benchは2,031本のレファレンスチェーンと1,970本の学習ルーリックを持つ204本の映画をインスタンス化している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:12:48 GMT)
Opening LLM Judges: Recovering Preference Signals Beyond the Final Verdict [16.0] 判断が間違っている場合、正しく判断するために必要な情報はモデルから外れているか、内部表現に存在しているが出力に反映されていないか?
41名の裁判官に対する因果的介入を含む,64名のオープンウェイト評価者と14名のデータセットを対象に,これについて検討した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:26:36 GMT)
Flat-Consensus Diffusion for Robust Data Reshaping under Noisy Evaluator [16.0] 粗いデータ形状は、モデルを一般化可能な構造ではなく、ノイズを学習させる。
マイクロマクロ分解による両方の障害に対処するフラットコンセンサス拡散フレームワークであるFCDiffを提案する。
以上の結果から, 頑健なデータ再構成には, 急激な単軌道オプティマではなく, 平坦でコンセンサスに支えられた領域の探索が必要であることが示唆された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:58:13 GMT)
Hierarchical Frequency-Domain Compression of Implicit Geometric Representations for Large-Scale Point Clouds [16.0] そこで本研究では,非特異な幾何学的場表現,階層的周波数領域圧縮,条件付き高周波述語を含む統一的なフレームワークを提案する。
8ミル以上のライオン点を持つ複合表面の点雲実験により,既存の点雲計算法よりも高い圧縮比が得られることを示した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:04:27 GMT)
Contamination, Prior, or Evidence? Decomposing and Training Evidence Use in Whole-Slide Vision-Language Models [15.7] 画像および質問側汚染の除去を目的としたTCGAベースのVQAベンチマークを提案する。
Pair-DPOは、同じ質問と情報源から、対実的なスライド対よりも優先的な損失である。
提案手法は,CleanSlideの画像証拠から15.29%を得たが,最も優れたモデルでは2.81%であった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:19:52 GMT)
DS-VLA: A Dendritic-inspired Vision-Language-Action Model for Robust Action Control [15.5] DS-VLAは樹状体にインスパイアされたアクションアーキテクチャであり、樹状体スパイキングダイナミクスをVLA制御に組み込む。
我々は4つのLIBEROスイートのDS-VLAを、名目上ロールアウトと統一されたクローズドループ動作摂動プロトコルの両方で評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:17:16 GMT)
WSM-Aware HRI: An IoT-Enhanced Framework for Early Detection and Norm-Guided Repair of Failures with LLM Guidance [15.3] We propose WSM-Aware HRI, a IoT-enhanced modular framework that we simply various HRI downs as World-State Mismatches。
大きな言語モデル(LLM)は暗黙の仮定を明示し、それらを小さなミスマッチタイプにマッピングし、検証に必要な証拠を特定するために使われる。
視覚的および潜在状態のミスマッチにまたがる10症例のミスマッチ同定について検討した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:53:54 GMT)
HM-ROUTER: Joint Model and Harness Routing for Agentic Systems [13.7] HM-Intrepidは、クエリ毎にモデルとハーネスを共同で選択するルーティング方法である。
標準ポリアディックテンソル分解(CP)にインスパイアされた相互作用項を用いて、ルート間で共有されるモデルとハーネス表現を学習し、それらの互換性がクエリとどのように異なるかを把握する。
平均ルーティング精度は7.3ポイントと最も高い評価を受けたベースラインを超え、6つのベンチマークサブセットで評価されたコスト予算を全てリードする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:19:28 GMT)
DimPO: Dimensionality Reduction for Attention using Preference Optimization [11.3] 線形射影は、事前訓練されたモデルを更新することなく、クエリとキーベクトルの次元を減少させることができるが、どのトレーニング対象がモデル挙動を最もよく保存するかは、まだ不明である。
最大重み付き鍵に対するキーとアテンションマスの嗜好が、全アテンション分布とKLの発散とを一致させるよりも良い信号を提供するかどうかを問う。
本稿では、リストワイドな選好最適化と、頭部忠実度を表す軽量なトップkクロスエントロピー項を組み合わせたDimPOを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:51:36 GMT)
TRAP: Understanding and Mitigating Privacy Memorization in Language Models [11.3] センシティブなレコード上で言語モデルを微調整することで、それらを再現することができる。
我々は、この記憶がいつ発生し、どのスパンが敏感であるかを事前に知ることなく、それを防ぐか尋ねる。
TRAPはトークン単位のTRAに一方的なペナルティを導入し、ターゲットモデルがその参照に先んじる場合にのみ作用する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:36:39 GMT)
When Does Dense Retrieval Need Asymmetric Geometry? A Bias-Variance Theory of Shared and Dual Projections [11.3] 低ランク線型作用素に対するバイアス分散理論を導入する。
共有射影は双半有限作用素を誘導するが、双対射影は任意の低ランク作用素を実現する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:30:34 GMT)
What Must a World Model Distinguish for Planning? [11.1] 我々は、メカニズム、応答、決定の十分性の階層を通してギャップを形式化する。
世界モデルが保持しなければならないものは、クエリ、候補セット、プランナーに依存します。
そこで本研究では,クエリがどこを見るべきかを判断し,アクション条件付きモデルで何が起こるかを予測するモジュール設計を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:53:39 GMT)
Progression- vs Automata-based Anticipatory Monitoring of LTL over Finite Traces (Extended Version) [11.0] 予測監視(precipatory monitoring)は,実行時検証の先進的な形式である。
算術的制約を伴う線形時間特性のモニタリングに着目する。
本稿では,提案手法と算術的設定法の両方に対して,進捗と満足度チェックに基づく代替手法を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:03:31 GMT)
Uncertainty-Aware Selection of Online Algorithms with Simulator Ensembles [11.0] Plug-Inセレクションは、シミュレータに適合するオフラインデータが制限されている場合に、評価を信頼できないようにする。
本研究では,シミュレータのアンサンブルを形成し,オンラインアルゴリズムを最高の平均性能で選択する不確実性認識選択について検討する。
提案手法は,シミュレータに装着した場合の限られたデータの影響を緩和し,理論的には大きな後悔を招きやすいことを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:48:07 GMT)
Refresh or Realize? Compute Allocation in Drifting Models [10.8] トレーニングの問題として、現在の目標をより緊密に、あるいはフィールドを再計算するために、余分な計算を組み込まなければならないか、という問題について研究する。
より深い適合により、ネットワークは凍結したターゲットに近づき、トレーニングの早い段階では16段階から後で1段階に減る前に必要なステップの数が減少することがわかった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:42:23 GMT)
Multi-Agent System Search via Active Substructure-aware Policy Optimization [10.8] Active Substructure-Aware Policy Optimization (ASPO)は、クエリレベルのMAS検索のためのRLフレームワークである。
ASPOは、ポリシーの能力境界におけるクエリのトレーニングに焦点を当てたAdaptive Query-Selection Mechanism (AQSM)を導入している。
ASPOはまた、各アクションの後続部分グラフ内の出力品質ゲインを測定するサブ構造レベルの報酬も導入している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:06:16 GMT)
SAMBAR: Selective Anchoring via Method of Multipliers for Balanced Knowledge Acquisition and Retention in Vision-Language-Action Models [10.6] VLA(Vision-Language-Action)モデルでは、大規模な事前訓練を活用して最終的に汎用的な操作を実現する。
デプロイされたVLAポリシは、時間とともに新しいタスクを取得するための継続的学習をサポートする必要があります。
本稿では, 連続学習アルゴリズムSAMBARを導入し, VLAファインタニング時の破滅的忘れを防止する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:29:42 GMT)
FutureRay: Control-Aligned Future Range for Agile Quadruped Navigation [10.5] 移動障害物は、四足歩行ロボットがモーションコマンドを実行する間、前もって明確な経路を塞ぐことができる。
我々は、遭遇リスクとともに、視線方向と未来時間の範囲を予測できるFutureRayを提案する。
共同作業範囲と遭遇リスク予測は,移動方針を再訓練することなく障害物回避を改善できることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:25:49 GMT)
Refreshing Less, Selecting Better: Reusing Stale Gradient Features for Efficient Influence-Based Data Selection [10.5] LESSのようなグラディエントベースのデータ選択方法は、その勾配と目標の検証勾配との整合によって各候補をスコアし、新しいチェックポイント毎にサンプルごとの勾配特徴を再計算することでコストを抑える。
そこで本研究では,トップランクの分数$p$候補の勾配特性を再計算するCached Diverse Influence Selection (CDIS)を提案する。
CDISは、ゼロを除いた信頼区間と4.3ポイントの完全再計算、トレーニングラン標準偏差、選択コストの3.4倍の確率でランダム選択よりも12ポイント高いスコアを得る。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:16:59 GMT)
Dude, Where's My State? Execution Information Requirements for Stateful Agents [10.5] 本研究では,個々の作業の難易度から情報需要,維持,回復を別々に変化させるような,既知の依存関係を持つタスクを生成するフレームワークを開発する。
エージェント実行トレースを使用してセマンティックグラフを構築し,実際のタスクに対する情報要求を計測するVESTIGEも導入する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:48:41 GMT)
Hearsay: Can an Auditor Trust the Record a Deployed Agent Harness Writes? [10.5] Hearsayはタスクではなくレコードを調べます。
審査員が引用する抜粋はすべて、誰が書いたかによって機械的にチェックされる。
第3に、治療は第2の著者であり、第1の強い封印ではない。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:37:06 GMT)
The Alignment Paradox: How Post-Training Amplifies Confident Hallucinations in Language Models [10.3] 大規模言語モデル(LLM)は、信頼度の高い事実的不正な回答を生成できる。
トレーニング後のアライメント自体が、これらのエラーの第一の要因である。
我々は、直接選好最適化においてエントロピー依存のマージンによってこの原理を実装している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:39:15 GMT)
Muon Under Gradient Noise and the Limits of Orthogonalization Near Optima [10.2] 各重み行列の運動量バッファーをその極因子で置き換えることを示す。
エルミート展開は、入力ノイズとは無関係な非線形残留に運動量がどのように作用するかを示す。
その結果、最適化がノイズ支配となると、応答整合運動量SGDによる勾配化の置き換えが理論的に成り立つ。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:38:27 GMT)
Residual Streams Read, Recurrent States Remember: The Global Workspace in Mamba Models [10.2] ヤコビアンレンズをマンバ語モデルの残差ストリームと再発状態に適合させる。
ジョイント残留状態読み出しは、残留レンズ上の既知の中間概念の回復を改善する。
また,座標交換よりも目標トップ5の成功率を向上させるシグネチャガードステアリングを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:18:28 GMT)
Locally Sound, Globally Insufficient: The Local-Global Gap in Multi-Hop Reasoning [10.1] 我々はこの障害体制をローカル・グローバル・ギャップ(LGG)と呼んでいる。
LGGはすべてのベンチマークモデルの組み合わせで発生し、全世界で不十分なレスポンスのほぼ半分を占めています。
これらの障害に対処するために、エビデンス・ツー・ステップのサポート、質問・ツー・トラス・アライメント、トレー・ツー・アンサー・クロージャという、信頼できる推論のための3つの依存関係を形式化する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:37:37 GMT)
Continual Data Unlearning in Diffusion Models via Transition-based Regularization [10.1] 本稿では、削除完了の遷移を方向性参照として使用して、将来の更新を規則化する継続的データアンラーニングフレームワークを提案する。
削除後の完全な応答と一致するのではなく、記録された方向の逆転を阻止する一方的なペナルティを適用する。
記録は、記録された方向に沿った進行の局所感度に基づいてパラメータ更新に基づいて選択される。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:43:30 GMT)
Learning Social Navigation from Internet Videos in the Policy State Space [10.0] 堅牢なソーシャルナビゲーションポリシーのトレーニングには、様々なシーンレイアウト、地形、人間の動きを持つシミュレータが必要である。
本研究では,通常の単眼歩行映像を直接クローズドループソーシャルナビゲーション訓練環境に変換する効率的なパイプラインを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:16:56 GMT)
What Can a Leaderboard Certify? Compositional Controllability for Fair Evaluation and Training of Biomedical Literature-Review Agents [9.9] リーダーボードは、最終的なアウトプットでロングホライズンエージェントをランク付けする。しかし、高いスコアだけでは、2つのシステムが同等であるか、どのステージが違いの原因であるかは定かではない。
これらの問題に対処するために,構成制御性を導入する。
比較窓は1つのステージ、複数のステージ、またはエージェント全体をカバーしており、我々の中心的な結果は、窓の外のみのニュアンスを用いて観測されたスコアと制御されたスコアの差を限定している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:22:15 GMT)
Learnable Randomization as Commitment Against Adaptive Optimizers [9.9] 予測不能な準最適政策 (UNOP) について検討し, 個別に合理的な近縁行動に一様に混合する。
1つのベストアクションを再生すると、そのカットオフが発行される。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:48:52 GMT)
Age of Learning: Temporal Persistence of Prediction Errors as a Learning Signal [9.9] Age of Learning (AoL)は、予測エラーの持続時間を測定する学習状態変数である。
AoLはエラーが未解決のまま増加し、正しい予測が達成されたときにリセットされる。
オフラインとストリーミングの両方で、AoLベースのトレーニング戦略を開発します。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:11:56 GMT)
GAUGE: Planner-Conditioned Active Calibration of Opaque Quadruped Velocity Interfaces [9.5] 本稿では,4重化速度インタフェースのプランナー条件付きアクティブキャリブレーションのためのフレームワークを提案する。
GAUGEはベイズコマンド・トゥ・モーションモデルを維持しており、後続の不確実性の低減を期待して承認された試行を選択する。
これは、受動的、D-最適、タスク非依存の選択肢よりも少ない試行で、タスク対応の正確さと不確実性のための共同基準に達する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:16:42 GMT)
Learning Through Game: Skewed Transfer of Tabular Knowledge to Strengthen Image Model [9.5] スキュード・ナレッジ・トランスファー(SKT)は、モダリティ勾配を適応的に積分することで、画像モデルを改善するために非対称に転送される。
SKTは、モダリティバランスの点を求め、第2ステップで優先意識を用いて、画像-効果方向への複合的な勾配を操る。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:58:49 GMT)
An End-to-End Latent-Rollout Approach for Pushing Few-Step ImageNet-$256$ Generation to FID $1.11$ without Fréchet Losses [9.4] 蒸留は教師の軌道に沿って選択された状態に教師力の回帰を適用する。
監督の強化は 敵意と補助的な 分類の目的に置き換わる
ImageNetのクラス条件生成では,FID 1.11(IS 282)を3段階,FID 1.15(IS 280)を2段階で達成した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:52:12 GMT)
Identification of Nonlinear and Dependent Latent Factor Structure through Clique Search [9.3] 観測変数の分布から潜在因子の数と非線形写像構造の両方を同定できることを示す。
これは、観測データのみから潜在因子の数と非線形マッピング構造を共同で推定する依存性保持(DT)アルゴリズムを動機付けている。
我々は,ニューラルネットワークなどの柔軟な手法を用いても,DTアルゴリズムが実際に正確であることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:32:47 GMT)
Active Feature Acquisition With Incomplete Training Data [9.3] 完全無作為データ(MCAR)が欠如している場合、一段階の取得値は変化しないが、多段階の取得値は減少する可能性がある。
不完全なデータから学習する3つのアプローチ:エイリアス、フィルタリング、生成的復元について分析する。
我々は、制御された実験と一般的なAFAデータセットに対して、我々の理論を実証的に検証し、欠落が主にマルチステップ取得を利用する方法にダメージを与えることを発見した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:38:39 GMT)
Using LMs to Model the Effects of Context and Coreference during Sentence Comprehension [9.3] 言語モデル(LM)は人間の言語処理をモデル化するためのツールとしてよく用いられる。
近年の研究では、LMのコンテキストウィンドウを厳しく制限することは、人間の作業記憶の制約をシミュレートすることによって、人間の心理言語データに適合することを示唆している。
この厳密なメモリデカイアプローチは、談話構造のような長距離構造表現への人間の依存を見落としている可能性がある。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:43:56 GMT)
Risk-Averse Online POMDP Planning via CVaR of the Immediate Cost with Performance Guarantees [9.3] オンラインPOMDPプランナーは、予測累積コストを最適化し、高コストの州にかなりの質量を置くと、危険な状態を隠蔽することができる。
既存のリスク逆法は、リスク関数に静的または動的条件付値(CVaR)を適用し、軌道レベルのリスクを捕捉するが、2つのギャップを共有している。
CVaRを各ステップにおける信念の即時コストに適用し、電流に関するステップごとの不確実性を直接ターゲットとする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:37:28 GMT)
MassAlloc Attention: Let Attention Allocate Its Own Compute [9.1] FullAttnは因果点空間の多くに無視可能な正規化質量を割り当てるが、密度の高いカーネルは各QKタイルを形成した後、完全なポストスコアパスを実行する。
我々は,すべての法的因果関係に対するスコアアクセスを保った注意プリミティブであるMALAを紹介する。
一般的な寛容さは、トレーニングと推論を統制し、作業の適応的保持を可能にする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:24:45 GMT)
CoWindow Attention: Full Causal Coverage Is a Collective Property [9.1] FullAttnはすべてのアテンションヘッドに完全な因果履歴を繰り返し公開する。
我々は、KVヘッドにまたがる因果履歴へのアクセスを分散する構造化された注意アーキテクチャであるCoWAを紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:09:07 GMT)
Instruct, Not Answer: Using Instruction Privileges in On-Policy Context Distillation [9.1] 普通の学生のミスを狙う一般的な指示は、OPCD特権として金より優れている。
ProverQA、ProofWriter、ProntoQAをデータセットとして使用した8つの実験のうち7つの実験では、OODの命令特権が4から17ポイント向上した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:57:00 GMT)
Tail-Weight Control and Localized Generalization in Nearly Low-Rank Adversarial Classification [8.1] ガウスモデルにおける逆摂動下でのノルム制約線形分類について検討する。
境界の傾斜損失については、主空間の目撃者が、ほぼ最適の予測値のほぼ半分以下で、尾の重量が小さいことを証明している。
20対の反復実験では、サンプルサイズの過剰なリスクとテールの使用が減少し、テール次元が固定された総エネルギーで大きくなるとほとんど変化しない。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:42:48 GMT)
MixBench-TS: A Multivariate Time Series Forecasting Benchmark Where Channel Mixing Pays Off [8.1] 55.5%のラグカップリングペアと+1.7%の中央値のCDゲインを持つ10の実世界のデータセットのベンチマークを提案する。
1つのプロトコルの下で調整された6つの最先端モデルの中で、CIモデルは10/10(MSE)と8/10(MAE)標準データセットで勝利するが、3/10と2/10 MixBench-TSデータセットでのみ勝利する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:16:14 GMT)
From Latents to Wires: Surgical Post-Editing on Large Language Models [8.1] 名前付きセマンティックターゲットのための手術後編集を行うフレームワークであるL2Wについて述べる。
ローカライゼーションでは、L2Wはヤコビレンズ(J-lens)属性を使用して、セマンティックターゲットに対して成分をスコアする。
外科的切除ではLLMの機構は冗長であるため,L2Wは標的が出現しなくなるまでCGCC(Counterexample-Guided Causal Cut)を走らせる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:08:32 GMT)
Learning from a Thoughtful Teacher: Adaptive On-Policy Self-Distillation for Mathematical Reasoning [8.1] On-policy Self-distillation (OPSD)は、教師からのトークンレベルのフィードバックで質問専用学生を訓練し、訓練専用特権情報(PI)を付与する。
予備診断では, 学生の学習能力と教師の効用との間に有意な差があることが示唆された。
本稿では,教師がどのような情報を受け取り,そのフィードバックが学習に与える影響を強く評価する適応型オンライン自己蒸留(AOPSD)を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:23:15 GMT)
When Users Change Their Minds: Measuring and Repairing Intent Drift in LLM Agents [8.0] LLMエージェントは、ユーザが実行前に変更するマルチターンインタラクション上で動作する。
ユーザの意図に取って代わられた部分が最終回答やツールアクションに影響を与え続ける障害モードについて検討する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:03:54 GMT)
Overfitting of Spectral Gradient Descent: How Matrix Geometry shapes Generalization and Implicit Bias [7.9] スペクトル勾配降下(SpecGD)の一般化について検討する。
単一方向を共有する崩壊したショートカットと、異なる特異方向を占める分散ショートカットとを対比した。
1つのSpecGDステップは、既に補間および一般化が可能であり、継続トレーニングは、非常に悪い一般化を伴う方向に収束することを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:54:55 GMT)
Structuring Relations Among Learning Paradigms via Protocol--Objective--Resource Reductions [7.8] 本稿では,表現能力と設計選択を分離するプロトコル・オブジェクト・リソース(POR)フレームワークを提案する。
我々の主定理は、そのような減少が組込み比較クラスにおける最悪のケースの複雑性支配を暗示していることを示している。
エピソードなメタラーニングとパラダイム内精細化のためのエピソード・ツー・アンプ・リダクション法を考案した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:38:54 GMT)
Geometry-Preserving Blind Watermarking for Raw 3D Point Clouds [7.8] ブラインド透かしフレームワークはxyz座標で動作し、オブジェクトレベルの形状とシーンスケールスキャンの両方をサポートする。
フィードフォワードオクツリーアーキテクチャを用いてウォーターマークの埋め込みと抽出を共同で学習する。
オブジェクトレベルおよびシーンレベルのベンチマーク実験は、一般的な幾何学的処理下での信頼性の高いメッセージ回復を示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:32:14 GMT)
From Knowing to Abstaining: Bridging the Representation-Action Gap in Vision-Language Models [7.6] 本稿では,2段階のショートカットフィルタと品質検証のパイプラインによって構築されたベンチマークであるVAD-R(Visual Answerability Diagnosis with Rationales)を紹介する。
VAD-Rは、それぞれ11.4%と16.3%のリコール率しか持たない、自発的な停止が制限されている。
本稿ではRep2Actを提案する。Rep2Actは、潜在応答可能性認識を明示的な棄却決定に変換する表現対アクションアライメント手法である。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:12:08 GMT)
SRE-Marathon: A Continuous, Change-Driven Benchmark for Autonomous Site Reliability Agents [7.5] SRE-Marathonは連続SRE動作のベンチマークである。
Marathon-Scoreは、相関、ローカライゼーション、修復を通じて、各インジェクトされた障害を順に進行させる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:43:04 GMT)
What Should the Reflector See? An Empirical Study of Evidence in Reflective Prompt Optimization [7.3] 我々は5つのデータセットに対して9つの反射戦略を評価する。
パフォーマンス改善のためには、フェールのみが最大の平均テストゲインを生成します。
オーバーフィッティング評価では、障害のみとバランスドミックスが平均キャリブレーションギャップの最低値を共有している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:38:10 GMT)
Contour-integral and Fourier transform based multivariable quantum eigenvalue transformation for commuting matrices [5.8] 量子コンピュータ上での多変数行列値関数の実装問題について検討する。
本稿では,2つの量子アルゴリズムを用いて,行列の対の可換変換に作用する多変数行列固有値変換を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:33:28 GMT)
Is Human-Readable Text Necessary for Effective LLM Fine-Tuning? [5.8] Desired-Update-Aligned Synthetic Data (DASA)
DASAは、凍結参照モデルからのアクティベーション・グラディエントフィードバックを使用して、連続的な合成入力埋め込みの最適化を導く。
ラマ家とクウェン家の6つのモデルの実験。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:39:54 GMT)
Feature Space Guidance for Breast Cancer Classification in DCE-MRI [5.7] ダイナミックコントラスト増強乳頭MRI(DCE-MRI)は乳がん検出のための強力な臨床ツールである。
しかし、高次元の4D入力、小さな病変、不均一な取得プロトコルは、堅牢な自動分類を妨げている。
本稿では,遅延表現を動的に解析し,プロトコル固有の特性に適応するフレームワークを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:31:56 GMT)
Are Vision-Language-Action Models Robust to One-Step Observation Perturbations? [5.7] 本研究は,1エピソード毎に1ステップずつ適用される1ステップの摂動に対するロバスト性について検討する。
本稿では,以前に予測されたアクションチャンクとの整合性に基づいて実行長を動的に選択するCAREを提案する。
CAREは、摂動下でのみ短い実行長を選択することによって、クリーンなパフォーマンスを維持しながら、計算オーバーヘッドの少ない堅牢性を向上させる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:29:30 GMT)
Revisiting AdaGrad in Stochastic Convex Optimization: Last Iterates, High Probability, and Lower Bounds [5.6] AdaGrad-Norm と AdaGrad はガウス以下の雑音や有界反復の下でも、普遍的テクスブフラスト定位率を認めないことを示す。
また、この$log T$損失は、有界条件が課されると消えることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:48:40 GMT)
Fail Loudly: An Auditable Runtime for Agentic Data Analysis [5.6] 我々は、エージェントの分析的選択を検査可能とし、実行フィードバックを通じてそれらのリビジョンをサポートする監査可能なランタイムRADARを提案する。
RADARは3つのコアメカニズムを通じて動作している。まず、エビデンス保存探索モジュールは、ソース位置と観測範囲を保持しながら、タスク関連コンテンツを検索する。
次に、ランタイムは型付き演算子を使用して、エージェントの宣言された入力、操作引数、結果の観察を記録する。
競合が検出されると、ランタイムは操作を拒否するか、診断フィードバックを提供し、エラーが伝播する前にエージェントが選択を修正できる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:11:39 GMT)
Feedback-based quantum optimization with low depth and measurement [5.5] 我々は,回路深度を同等に低減するだけでなく,SO-FALQONよりも少ない測定値を実現するBLS-FALQONを提案する。
我々は、Zuchongzhi2超伝導量子プロセッサを用いたTianyan-176量子コンピュータ上で、実際の量子ハードウェア実験を行う。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:07:57 GMT)
AquaBEV-Nav: Learned BEV Occupancy for Underwater Navigation and Exploration [5.5] AquaBEV-Navは,鳥類の視線直視による着眼深度推定を回避した水中探査フレームワークである。
1つのRGBフレームを与えられたAquaBEVは、視覚的特徴を学習された極性表現にマッピングし、範囲次元に沿って因果推論を行い、中間深度予測に頼ることなく、局所カルテの占有を再構築する。
AquaBEV-Navは1つのプロトコルで評価された10のシミュレートされたサンゴ礁環境と6つの乗員バックボーンで37.48の構造IoUと53.2のターゲットIoUに達し、88.95%のクローズドループが無衝突でカバーされた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:17:42 GMT)
FREESIA: Covariance-Aware Posterior Transport for Expressive and Scalable Data Assimilation [5.4] 複雑なシステムのための訓練不要で正確な後部輸送法を提案する。
提案手法は, 複雑な後部構造を捕捉し, スパース, 非線形および非射影観察において精度を保っている。
スパースな非注入条件下では、RMSEは最高のベースラインに対して56%減少する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:28:21 GMT)
Scalable In-Domain Self-Supervised Foundation Model for Dense Representation Transfer in High-Resolution Plant Imaging [5.3] 本研究は、高解像度植物画像のためのスケーラブルなドメイン内自己教師型基礎モデルを提案する。
ViTバックボーンを備えたマスク付きオートエンコーダは、1000万以上のマルチビュー植物画像タイル上で事前トレーニングされている。
その結果、事前学習の規模が大きくなると、高密度な特徴伝達が一貫した改善をもたらすことが示唆された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:18:33 GMT)
High-Probability Guarantees for SGD under $β$-Heavy-Tailed Gradient Noise [5.2] サブサンプリングは、機械学習モデルにノイズ減衰を導入する。
したがって、高確率の強度と適用性は、ガウス下雑音のモデル化方法に大きく依存する。
我々はOrlicz空間のヤング関数を用いて、共通のフレームワークでノイズテールを記述する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:44:13 GMT)
Solving Every Step Is Not Enough: Milestone Oracles Reveal a Composition Gap in LLM Math Reasoning [5.2] 大規模言語モデル(LLM)は、多段階数学問題の中間ステップを自分自身で解くことができ、ステップのロードマップと全ての答えが与えられたとしても、完全な問題に失敗する。
OracleLadder は LLM の数学推論が失敗する場所を特定するための診断評価手法である。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:51:33 GMT)
Function Over Form: Distributional Orthogonalization in Mixture-of-Experts with Replica Expert Mechanism [5.2] MoEは、しばしば専門家の崩壊と表現の冗長性によって制約され、モデルキャパシティの未使用に繋がる。
本稿では、静的な重みの多様性から動的ルーティング行動へ焦点を移す補助正規化である分布直交化損失(DO-loss)を提案する。
また,Replica Expert Mechanism (REM)を導入し,2層戦略によるロードバランシングを改善する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:19:16 GMT)
FUND: Density Flow for Sampling Unnormalised Distributions [5.2] トレーニングに真のサンプルを必要としないボルツマン分布の学習アルゴリズムを提案する。
本稿では,2次元ガウス混合法,多値分布法,高次元スカラー4$理論など,標準ベンチマークによる評価を行った。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:40:13 GMT)
Multimodal LLMs Outperform Pathology Foundation Models in Cross-Domain Histological Similarity [5.2] 数百万の組織学タイルで訓練された最先端の病理基盤モデルは、スライドや施設の境界を越えて比較した場合、組織類似性を維持することができない。
病理基盤モデルとして訓練されることなく、汎用多目的LSMは、クロスドメインの組織学的類似性判定において、これらの特殊なモデルより一貫して優れていることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:59:48 GMT)
GlowTact: Simple and Compact Vision-Based Tactile Sensing with High Sensitivity and Spatial Resolution [4.8] 接触圧を直接可視化する視覚ベースの触覚検知機構であるtextbfGlowTact を導入する。
textbfGlowTactは、単色で非方向の照明のみを必要とし、生の触覚画像は圧力分布を直接表現する。
本研究は,M1スクリュースレッドを含む,グラムスケール接触検出,高精度な正規力推定,微細接触形状の再構築を実証する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:01:17 GMT)
Can LLMs Predict the Future? A Brier Score Analysis of Prediction Markets [4.8] 問合せのみのゼロショットプロトコルを用いて6種類のClaudeモデルとQwenモデルの評価を行った。
4つのクロードモデルはブラースコア0.183-0.192を達成し、ベースレートを0.024-0.033改善した。
事象カテゴリー間でのモデル内差は、クロード変種間の観測された差を超える。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:12:09 GMT)
Memory as a cache: Exact context reuse and deletion by construction [4.8] SMemはコンテキスト表現が構成によるキャッシュであるアーキテクチャである。
パラメータ設定ごとに、メモリは固定ブロックインデックスで正確に構成される。
SMemは、訓練された長さの窓の向こうに植えられた針を回収する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:15:40 GMT)
LLM Unlearning Evaluation with TRIAGE [4.7] 我々は,変化を特徴付けるためのベンチマークに依存しない評価フレームワークであるtextitTRIAGE(textitTripartite Representation-internal Introspection for Adjacency Gap Evaluation)を紹介する。
TRIAGEは既存の未学習ベンチマークと併用して、モデルのパラメータ空間を再認識し、保持された知識に影響を与えるモデル内部ビューで行動評価を補完する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:24:27 GMT)
Understanding and Exploiting Anisotropy in Post-Training [4.7] LLM後トレーニングは教師付き微調整(SFT)と強化学習(RL)を併用する
周波数重み付き可能性トレーニングは、いくつかの残留チャネルが不均等に大きな活性化を担っている、幻異方性(enphanisotropy)というよく知られたサインを残している。
異方性は広く文書化され、通常は欠陥として扱われるが、その機能と後処理との相互作用は未だ不明である。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:08:06 GMT)
Fracast-0: Fractal Weight Sharing for a Time Series Foundation Model with Only 85K Parameters [4.7] Fracast-0は時間的自己相似性を利用して1つの演算子をスケールで再利用する時系列基礎モデルである。
データセットごとの微調整のない97のGIFT-Eval構成では、Fracast-0は28のチェックポイントの中で最小である。
TinyCastよりもパラメータが42.0%少なく、MASEとWQLは4.2%、WQLは3.3%低い。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:11:44 GMT)
Assisting for Open-Ended Tasks: Goal-Oriented Shared Autonomy as a Particle Filter [4.6] 共有自律のための一般的なアプローチは、人間の目標に基づいて人間の入力と自律的な援助をブレンドする。
目標指向の共有自律性を粒子フィルタとして定式化する。
我々は,この枠組みを,文脈関連セマンティックゴールの提案,低レベルのスキルプリミティブからの目標条件付き支援の生成,人間の補正からそれらのスキルを洗練する基礎モデルを用いてインスタンス化する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:49:52 GMT)
The Key Handoff: Retrieval in Hybrid Language Models [4.3] 2ホップの質問は、言語モデルを2回回収する。
トランスフォームはブリッジエンティティを初期層で解決する。
ハイブリッドモデルは、ほとんどの注意を反復状態に置き換える。
キーが使えるようになり、答えに費やされる場所は分かっていない。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 21:07:29 GMT)
Learning response-aware patient dynamics for respiratory support [4.3] 自己回帰状態更新時の生理的変化を表す応答認識型患者動態モデルを提案する。
2つの独立した機関のICUコホート全体で、提案モデルは患者動態ベースラインに匹敵する全体軌道予測を達成する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:56:52 GMT)
Derivative-Informed Training of Neural Operators On-the-Fly via Sketched Tangent Consistency [4.2] 派生インフォームドトレーニングは、入力出力感度を直接監視することで、ニューラル演算子を改善する。
既存の方法はオフラインで生成されたデリバティブラベルに依存しており、データ生成が遅く、ストレージ集約的で、適応が難しい。
そこで本研究では,オンザフライ微分インフォームドトレーニングの目的であるスケッチ付きタンジェント整合性損失(sTCL)を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:18:06 GMT)
Learning the Graph and the Embedding Together: Classifier-Independent Rewiring for Heterophilic Node Classification [4.2] グラフニューラルネットワークは、連結ノードがしばしば異なるラベルを持つヘテロ親和性グラフにおいて、多くの利点を失う。
グラフとノード表現を同時に推定する親和性誘導型再配線法を提案する。
変更時にラベルを使用しない完全に教師なしの派生型は、ほとんどの改善を維持している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:36:16 GMT)
TCMQA: A 38K-Question Traditional Chinese Medicine Benchmark with a Licensed-Practitioner Reference [4.0] 我々は、中国のTCMライセンス試験から38,279の質問をオープンにベンチマークしたTCMQAを紹介します。
我々は,0.27Bから14.8Bのパラメータにまたがる9つのファミリーから29の命令調整モデルを評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:11:48 GMT)
Distributionally Robust Average-Reward Reinforcement Learning: Finite-Sample Guarantees under Weak Communication [4.0] 本研究では,弱い通信環境下での平均回帰条件下での分布的頑健な強化学習(DR-RL)について検討した。
我々の主な成果は、ロバストな最適平均報酬を推定し、ほぼ最適ポリシーを学ぶための有限サンプル保証を提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:45:43 GMT)
A Unified Optimism-Agnostic Framework for Linear Bandits over Spherical Action Sets [3.8] 線形帯域は、決定変数に線形なノイズのある報酬を持つ逐次決定問題をモデル化する。
上位信頼境界(UCB)とトンプソンサンプリング(TS)の2つの顕著なアルゴリズムファミリーは、時間をかけて探索と搾取のバランスを取る。
UCB と TS の変種は推定および濃度特性を満足し、最適の後悔率を享受することを示した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:10:59 GMT)
SCLATE: a Substrate for Continual-Learning Agent Training and Evaluation [3.8] 既存のベンチマークとトレーニングフレームワークは、ベンチマーク独自のイベントのみをスケジュールし、各ベンチマークとエージェントペアが独自のスケジューリングループを構築する。
ベンチマークと未修正エージェントがそれぞれ,ひとつのオープンイベントスケジューラにアダプタを通じてイベントを付加する実行基板であるSCLATEを提案する。
ハイブリッドシミュレートされたクロックは、これらのイベントを共有タイムライン上で実行し、エージェントが動作している間にリアルタイムで流れ、アイドルギャップをスキップし、1ヶ月のシナリオを数時間に圧縮する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:08:44 GMT)
JEPA Learns What the Mask Leaves Unrecoverable [3.7] 共同予測アーキテクチャは、入力のマスク方法に非常に敏感である。
マスクは線形測定であり、コンパクトに支持されたウェーブレット基底では、隠れた領域内に支持されている全ての原子は測定の埋め込み空間に落下する。
我々は151の事前トレーニング-100において、アカウントの特異な予測をトレーニングし、テストする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:19:50 GMT)
What Should Federated LoRA Share? FedSAIL via Input-aware Subspace Alignment [3.7] フェデレートされたローランク適応(LoRA)は、異種クライアント間で共有される更新構造を特定する必要がある。
本稿では、ローカル層入力の第2モーメント統計により、アダプタ更新を重み付けする入力対応アクション行列を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:28:39 GMT)
You Can't Spot a Deepfake?And Neither Can Your Brain Nor Eyes: A Neurophysiological Framework for Deepfake Exploitation of Cognitive Engagement and Implicit Visual Evaluation [3.7] 本稿では,DeceIVE(Deepfake Exploitation of Cognitive Engagement and Implicit Visual Evaluation)を紹介した。
我々は脳波と視線追跡研究を行い、参加者はリアル、ディープフェイク、ルックアライズなビデオを見た。
リアルビデオとディープフェイクビデオの間に統計的に有意な神経生理学的差異はみられなかったが、ルックライクなビデオでは明らかな区別が見られた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:46:19 GMT)
Gradients for Interventions and Activations for Detection: Targeted Feature Learning in Language Models [3.6] 多くの解釈可能性質問は仮説駆動であり、事前に定義された概念を懸念する。
我々は,この設定を目標となる特徴学習として研究し,そのような事前定義された概念のために一つの特徴が構築される。
これらの手法を、15のタスクと3つの言語モデルにまたがる事前訓練されたSAEと比較し、検出と因果介入の両方を評価した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:22:46 GMT)
When Better Gets Worse: Improvement Fidelity for Self-Improving Agents in Adaptive Worlds [3.6] 改善の忠実さは、改善プロセスが実際に提案する更新よりも、プロキシの改善がサインとデプロイメントの改善の順序を保存するかどうかを問うものだ。
PIVOT-KGは,単位コスト当たりの選択後悔の低減を期待して,少ない高忠実度評価を割り当てる決定対応検証器である。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:34:02 GMT)
When Does Synergy Help Active Feature Acquisition? A PID-Based Study [3.5] 我々は、ペアワイズジョイント情報と条件情報を組み合わせた状態依存型AFAポリシーであるSynAFAを紹介する。
また,SynAFAはPhyloNetの低予算で最強の伸びを示した。
また,非グレーディローカル検索では,予算依存の浸食が解決されないことを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:50:49 GMT)
When Can First-Order Models of Fine-Tuning Bound Forgetting? [3.4] 新しいデータに言語モデルを微調整することで、保持すべき事実を忘れることができる。
細調整された実行の開始時に得られた測定値が、保護された各事実に対して、実行がモデルにそれを忘れさせる確率を制限できるかどうかを問う。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:45:31 GMT)
Constraints Are Graphs, Not Chains: Exact Decoding for Diffusion Language Models [3.4] 拡散言語モデル(dLLM)は任意の順序でマスキング位置を予測するが、厳密な制約付きデコーダは制約を逐次言語としてエンコードする。
有限領域関係を因子グラフとして表現する学習自由デコーダであるFacterDLMを紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:40:43 GMT)
Two-Stage Multi-View Gait Recognition with a Re-Embedding Network [3.4] TFTR(Translate-First-Then-Reason)と呼ばれる2段階のフレームワークを提案する。
第1段階では、三重項損失マップ(GEIs)を備えた浅いシームズ畳み込みネットワークを128次元のビュー固有埋め込み空間に配置する。
第2段階では、これらのビューごとの埋め込みをトークンとして扱い、12層トランスフォーマーエンコーダで処理し、コサイン分離性を改善した新しい空間に再投影する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:02:13 GMT)
Active Data Acquisition with Side Information via Discrete Diffusion Priors [3.2] データの取得にはコストがかかる – 高い測定忠実度は電力とストレージを犠牲にし、無関係なコンテンツを収集するリスクを負う。
このトレードオフを,1つのモデルではなく,幅広いタスクに関連するデータを取得する情報理論のフレームワークで解決する。
マスクポリシーは、予算の下で、離散画像とその部分観察との間の相互情報を最大化するために、どの画素を計測するかを選択する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:15:19 GMT)
The Impact of Stochasticity on the Rashomon Effect in Machine Learning [3.2] 我々は,ラショモン現象を3つの相補的な次元(解空間乗法,予測乗法,決定基底乗法)に沿って研究する。
以上の結果から,トレーニング性は予測性能だけでなく,予測や説明の安定性にも影響を及ぼすことが示された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:46:46 GMT)
A model of rational interlocutors: Unification of comprehension and production [3.2] 我々は、誰とコミュニケーションをとるかが、発話の解釈とそれ自身の設計の両方に影響を及ぼすことを示す。
どちらの調整も1つの合理的な計算を表現し、論理的インターロケータ(RI)モデル、すなわち理解と生産を統一する計算会計を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:21:47 GMT)
ARSM: Auto-Regressive State Machine for Agentic Reasoning Compression [3.2] Auto-Regressive State Machine (ARSM)は、構造化状態の進化を通じて、その場での推論圧縮を可能にする軽量なトレーニングフリーフレームワークである。
ARSMは、トークン消費を同時に削減しながらタスクパフォーマンスを維持する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:26:49 GMT)
Linger and Lose: Knowledge Collapse in Low-Bit Language Models [3.1] 3次重みを持つ訓練言語モデルは、一般的に損失と下流の精度によって判断される。
これらのメトリクスは、はるかに大きな失敗を隠蔽できることを示している。
我々は 5 つの精度で 2.5M から 50M のパラメータで GPT-2 スタイルのモデルをスクラッチから訓練する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:44:19 GMT)
Low-Rank Single-Index Bandits with Unknown Links: From Matrices to Tensors [3.1] 低ランク行列とテンソルバンディットは構造的相互作用を利用するが、典型的には既知の報酬リンクを仮定する。
最近の単一インデックス法は、行列やテンソルランクを直接利用せずに未知のリンクを許容する。
このギャップを、未知の共有リプシッツリンクと低ランク指数パラメータを用いて、行列とテンソルのバンドイットを研究することで解決する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:50:38 GMT)
Emergent One-Third Scaling Law as Attention Tries to Concentrate [3.0] 任意のソフトマックス学習ピーク分布は、指数$1/3$の電力法則で成長するロジット等級を発達させることができることを示す。
LLMにおける多くのソフトマックス関数がピーク分布を学習し、LSM損失スケーリングがこの1/3$予測に一致することを確認した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:11:51 GMT)
Generation of arbitrary quantum states in cavity-atom systems with a three-level ancilla [3.0] より効率的な3レベル原子をアンシラとして任意の量子状態を生成するプロトコルを提案する。
このプロトコルは、各制御ステップで2つの励起を並列に移動し、進化ステップの数を半分に減らす。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:19:33 GMT)
When Helpful Text Hurts: Option-Redirecting Bias in Vision-Language Models [2.9] もっとも有害な補助テキストは必ずしも最も事実的に誤りであるとは限らないが、イメージを矛盾させ、特定の注意散らしを好みながら疑問に沿うものである。
本研究の結果は, 事実的正確性だけでなく, 判断レベルでの補助テキストの信頼性の理解が不可欠であることが示唆された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:33:06 GMT)
Change the Product, Keep the Parameters: Associative Algebra Layers for Transformers [2.9] Transformerの学習したプロジェクションは、まったく違う安価な製品を使うことができます。
通常の行列乗法をスペーサー相互作用テーブルに置き換えるアソシエイト・代数構造を構築した。
4つのプロンプトドメインをまたいだモデルでは、エンド・ツー・エンドの生成スループットが6.2-7.8%向上する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:39:58 GMT)
Precision As You Need: Stochastic Computing Is a Dense Adaptive Quantizer [2.8] SC行列乗算を大規模にエミュレートするGPUライブラリを構築した。
本研究では,トークン単位のストリーム長やグループ一致の平均予算を割り当て,再トレーニングを必要とせず,スケジュール毎に同じSCハードウェアを使用する動的混合精度ポリシを開発する。
これらの結果は、SCが現代の視覚変換器の微粒化混合精度推定のための密度精度基板として機能することを示すソフトウェアレベルの実現可能性を示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:24:04 GMT)
Language Distances are Practical for Equitable Cross-Lingual Transfer [2.6] 言語間移動は、ソース言語をどのように選択するかに条件づけられる。
対象言語ごとに最適な候補ソースを決定するのは現実的ではない。
言語距離は、候補ソースのランク付けに広く使用されている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:49:10 GMT)
HEXIS: Compiling Agent Skills into Extended Finite State Machines [2.6] HEXISはエージェントスキルを拡張有限状態マシンにコンパイルする。
マシンは実行の進捗と中間結果を記録する。
Qwen3.8-27Bはベンチマークで実行トークンを38.4-88.9%削減する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:30:15 GMT)
His Name, Their Judgment: Expert Authority in Posthumous Persona AI [2.5] ペルソナAIは、遭遇したことのない決定のために、故人の専門家を利用できるようにする。
ユーザーは、アドバイスを判断するために必要な知識が欠けているため、これらのペルソナを正確に探すことができる。
我々は,現地のRedNote/Xiaohongshuの投稿115件と,中国の教育顧問Zhang Xuefengの非公式人格に関するネストされたコメントサンプルを分析した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:40:10 GMT)
Mend the Measurement Gap: Latent User Preference Modeling for Short-Form Video Recommendation [2.5] 不均一な行動フィードバックからユーザの嗜好を測定するために,FLVM(Facterized Latent Value Model)を提案する。
YouTube Shortsでは、このモデルはオフラインのメトリクスを改善し、オンラインA/Bテストでは2.67%向上する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:11:20 GMT)
Is H&E Image-to-Spatial Transcriptomics Simpler Than It Looks? [2.3] 平均二乗誤差MSEの目的の下で予測誤差の構造について検討する。
内すべり成分は、制御された神経実験において残留正規化パラメータの感度が低い。
同じイントラスライダー監視は、既存のニューラルモデルを改善する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:31:47 GMT)
A bilingual AI audiologist built through rubric-guided playbook induction outperforms human audiologists in a blinded evaluation of simulated cases [2.3] 本稿では,汎用的な大言語モデルとルーリック誘導型プレイブックを組み合わせたバイリンガルAIオーディオロジスティクスを提案する。
訓練例73例から19ルールの相談方針を導出し,58例の独立したシミュレートを行った。
AIオーディオ学者は、すべてのケース(58/58;平均は5点合成で$ = +1.35、コーエンのd = 1.84、$P = 4.5倍10-20$)で人間のオーディオ学者より優れていた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:27:01 GMT)
Learning Shuffle Ideals with Membership Queries and Contrastive Examples [2.2] 我々は,シャッフルイデアルの学習を,メンバシップクエリとコントラストクエリで研究する。
両方の設定において、非常に単純なシャッフルイデアルのクラスでさえ効率的に学習できないことが示されている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:47:40 GMT)
Phase Space Attention:A Hairer Lift Circumvents the Single-Layer Induction Obstruction [2.2] ポストRoPE基板上の一段階,因果,双線形,シンプレクティックに一貫した設計クラスにおいて,Sanford-Hsu-Telgarsky(SHT)単層誘導障害を回避する。
我々は、このリフトが分解されたサブクラスの中で一意であり、演算子レベルで正確にシンプレクティックであり、RoPE後の配置を必要とすることを証明している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:29:18 GMT)
Interpretable Physics Informed WiFi Indoor Localization: Learning an Effective Access Point Geometry and Using It to Prune [1.8] WiFi指紋を用いた屋内位置推定のための階層型ディープラーニングフレームワークを提案する。
ユーザの位置を共同で予測し、周辺アクセスポイント(AP)の有効形状を学習する。
提案手法は平均3次元局所化誤差7.07mを実現し,ベースラインモデルと比較して誤差を26%から36%削減する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:19:15 GMT)
Certified Interface Aliases: Exact Collisions in Vision-Language Preprocessing, and When They Exist [1.7] 視覚言語検証器とルータは、言語モデルに到達しない視覚的エビデンスによって引き起こされたものとのさらなる推論により、修正可能なエラーを区別しなければならない。
関連する事実がインターフェースから確実に欠落しているケースを作成するために、AliasForgeを紹介します。
すべての固定点ダウンスケーラがそのようなヌルベクトルを持ち、最も一般的な比で最小サイズを有界であることを証明する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:57:21 GMT)
Social3Source: Connecting Social Provenance, Societal Qualities, and Social Purpose on an Open-Source Software Foundation [1.7] 本稿では,Social3Sourceの実装に関する概念,原則,初期の議論について述べる。
オープンソースソフトウェア開発にソーシャルな考慮事項を統合する方法について説明している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:49:21 GMT)
Prediction Limits and Koopman Closure of Geometry-Induced Soft State Abstractions [1.7] 幾何誘起ソフト状態抽象化が正確な有限次元線形力学を許容するかどうかを考察する。
我々の主な結果は、最小ルート平均二乗予測誤差に縛られる計算可能な低信頼度である。
Duffing、Van der Pol、CartPole、MountainCar、Acrobotの実験は、直接ソフトコーディネート予測と状態空間DMD/EDMDベースラインを比較した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:10:31 GMT)
Adaptive Ensemble Selection for Noisy Labels on Tabular Data [1.7] 本稿では、データセットの品質を自動的に診断し、適切なクリーニング戦略を選択するAIデータサイエンスシステムのためのデータ中心推論モジュールを提案する。
提案手法は,データセットに依存したゲインと損失を伴って,平均的な信頼学習ベースラインに匹敵するパフォーマンスを実現する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:11:15 GMT)
Agents as Software: A Programming Languages Agenda for Agent Reliability [1.7] AIエージェントはますますソフトウェアシステムに似ています。
しかしエージェントの'プログラム'はプロンプト、ツール、メモリ、実行トレースに分散している。
このエッセイは、プログラミング・システムの観点からエージェントを信頼できるものにするための自然なレンズを提供すると主張している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:53:08 GMT)
AI Harness: Certification under Proposal-Conditioned Information for Foundation-Model Agents [1.4] デプロイされたシステムでは、モデルがセマンティック提案を発行した後のみ、ランタイムが介入する可能性がある。
我々は,この構造を州のみの提案封筒に崩壊させることで,セルティフィビリティを損なうことなく,提案のカバレッジを維持することができることを示す。
我々の貢献は、新しい定点計算ではなく、モデル境界における提案-履歴相関が証明に必要である場合の特徴である。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:19:07 GMT)
PolyStepOR: Learning to Decide Without Optimal Decisions [1.4] 本稿では,事前計算したオプティマを使わずに,予測者を直接決定コストから訓練するPolySteporを提案する。
PolyStepOR のパーターは予測パラメータを計算し、結果の判断を評価し、最適なトランスポートを使用して低コストな方向を選択できる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:55:34 GMT)
Global Evaluation of AI and NWP Precipitation Forecasts During Atmospheric River Events [1.3] 我々はGlobal Forecast System(GFS)、Global Ensemble Forecast System(GEFS)、GraphCast、AIFS(AIFS)の24時間降水予測を評価する。
降水量,空間構造,局在の測定値を用いて,GPM(IMERG)観測のための総合的マルチサテライトE検索に対して予測値を評価した。
GraphCast と AIFS は GFS や GEFS よりも空間的スキルが優れており、特に降水量が多く、リード時間が長く、AR に関連する降水の空間的構造を 10 日目まで保存する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:16:27 GMT)
STAMP: Predicting Out-of-Distribution Generalization without Target Data [1.3] STAMPはソースのみの、ターゲットラベルなしの基準であり、ペアのソースドメイン画像からアウト・オブ・ディストリビューション性能を推定する。
CNN、ViT、MetaFormers、基礎モデル、SSL/VLMプローブにまたがる44の胸部X線モデルにおいて、時間STAMPはスピアマン相関を0.844$-0.855$で達成した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:28:06 GMT)
Intuition vectors [1.1] 自己監督型視覚モデルは、シーンのセグメンテーションと物理的なオブジェクトの意味的分解をサポートする表現を学習する。
タスク固有の微調整を行わずに視覚的推論問題への変換を支援するのかを問う。
DINOv3, MAE, and random pixel projections on Bongard problem, ARC-AGI-1 and ARC-AGI-2, and novel ARC-GEN instance。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:40:07 GMT)
Length-Independent State Tracking Under a Parallel Scan [1.0] 堅牢でスケーラブルな有限状態追跡を学習することは、シーケンス処理に不可欠である。
我々は有限精度で有限状態追跡を定式化し、長さ独立性を特徴付ける。
長さ非依存有限状態追跡のための非アフィン・スキャン互換RNNであるNeural Finite-State Machine (NFSM)を紹介する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:27:34 GMT)
Can Open-Weight Large Language Models (LLMs) Simulate Human Survey Populations? A Cross-Instrument Calibration Study [1.0] 大規模言語モデル (LLMs) は、実際の人々の総合的な調査回答者とデジタル双生児を生成するために、ますます使われている。
クロス・インストラクション・キャリブレーション・タスクにおいて,3つのオープンウェイトLLMファミリーを評価した。
139対の格子を横切ると、シミュレーションされたクロス構造相関は、すべてのモデルにおいて実際の人間相関を0.70 - 0.73で追跡する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:01:34 GMT)
Governing the Edge: Automating Commercial Property and Casualty Insurance Underwriting via a Hybrid Local-Cloud Multi-Agent Framework [1.0] Governing the Edgeは、データ-レジデンシ制約に関する機密データを整理する。
このフレームワークは、単一のエッジデバイス上で、数分で40分間のマニュアルを処理します。
20-scenarioベンチマークの全体的なコンプライアンス精度は70%で、残りのギャップはよりソフトで判断ベースの層に集中している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:27:55 GMT)
Before Answering: Evidence Sufficiency under Size-Matched Memory Construction [1.0] 不十分な証拠の作り方とそれを検出する推定器が同等であることを示す。
MemSafeは、クエリを各メモリユニットでクロスエンコードし、セット変換器でユニットを集約する推定器である。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:53:10 GMT)
Do Audio LLMs Listen Before They Act? Diagnosing Acoustic-Context Gating in Voice Agents [1.0] VGBenchは、サイドトーク、セルフトーク、スピーカースイッチシナリオにまたがるアクションレベルのアドレス性のベンチマークである。
孤立した話者識別ではなく、マルチキュー音響コンテキストゲーティングを測定する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:16:00 GMT)
Evolution of Deprecated APIs and Their Replacements in Python Libraries [0.9] APIの非推奨は、ライブラリの進化において一般的だが、移行には代替品の発見と呼び出しの適応が必要である。
本稿では,置換局所性,パラメータ-インタフェースの違い,バージョン間の置換ランキングの変化,非推奨のライフサイクルについて検討する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:39:39 GMT)
Machine learning for the LHC physics program: a 2025-2026 stocktake [0.8] 私は2025年5月から2026年5月までの12ヶ月にわたって、LHC物理プログラムの機械学習(ML)の在庫を取っています。
AIパイプラインは569件の要約を調査し、引用、傾向、テーマ、コラボレーションの関与によってランク付けし、103件の論文(分割後の95件、以前のベースライン論文8件)を全文読み上げ、それぞれに構造化ノートを作成した。
メモは、フィールドの状態に関する6つのクレームに合成され、独立したレビュアーエージェントによってチェックされ、ソース・ペーパーに対して再検証された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:57:22 GMT)
Devol-ONE: One Autoregressive Mixture of Transformers to Unify Vision-Language-Action and Latent World Modeling [0.7] 本稿では,視覚言語理解,潜在世界ダイナミクス予測,行動生成をひとつの自己回帰フレームワーク内で統合するトランスフォーマーアーキテクチャであるDevol-ONEを提案する。
LIBERO, LIBERO-PLUS, RoboTwin2.0およびFlexivのシングルアームとデュアルアームの実際の評価を行った。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:35:15 GMT)
The Geometry of Logic: Stratification Induces Semantic Structure and Robust Reasoning [0.7] textbfSTRAT(textbfSTratified textbfRegisters textbfAnd textbfTypes)を導入する。
算術では、STRATはTransformerベースラインに対して中央値のOOD誤差を35倍に削減する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:35:44 GMT)
Self-Reports Do Not Identify Self-Models: An Identifiability Test for Counterfactual Reports [0.7] 言語モデル自己報告(Language-model self-reports)は、自己モデルそのものの証拠ではなく、迅速な環境における行動に関する証拠である。
本研究では、アクティベーション介入中の情緒的状態に関する事実報告を調査し、実演環境が変化しても、その報告が名前の介入に結びついているかどうかを問う。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:32:34 GMT)
Beyond Token Savings: A Systematic Study of Context Compression in LLM Agents [0.6] 我々は、同様の成功のポリシーが、異なるタスクを解決できるのに対して、同じポリシーはモデル間でかなり異なるパフォーマンスを実現できることに気付きました。
本研究の結果は,タスク,モデル,ワークロードに対するエージェントの実行とポリシーの調整に対する効果によって,圧縮を評価する動機付けである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 21:46:40 GMT)
Logic Gate Networks and Lookup Table Networks as Lightweight Hardware Classifiers for Inter-patient ECG Arrhythmia Classification [0.6] 我々はLGNの論理ゲートを2つ以上の入力ピンに一般化し、自然に$N$-input LUTからなるネットワークに到達する。
患者間心電図不整脈分類におけるLGNsとLUTNsの適用性について,MIT-BIHデータセットを用いて検討した。
われわれのLGNとLUTNは2.89kから6.17kのFLOPしか必要としない。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:29:10 GMT)
What Do Latent Predictive Vehicle Representations Retain? Measuring State, Geometry, and Local Response [0.6] IPG CarMakerに記録された信号に基づいて学習した時間的共同埋め込み予測モデルについて検討した。
保持、予測、局所応答を別々に測定することは、予測潜在能力が制御の候補モデルとして適している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:00:18 GMT)
Diagnosing Sampled LLM Reasoning in Formal Geometry: Coverage, Realization, and Validity Evidence [0.6] CRV(Coverage, Realization, and Validity Evidence)について紹介する。
CRVは,形式的幾何状態を考慮したサンプル付き大言語モデル(LLM)の評価プロトコルである。
正しい答えがプール内で1回か2回しか発生しない場合、読み出し精度は特に低い。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:30:56 GMT)
Non-Commutative State Tracking with Input-Dependent Low-Rank Updates in Mamba-3 [0.5] 我々は、非可換状態追跡をサポートするために、入力依存の低ランク反射項でMamba-3の対角遷移を拡張する。
ランクワン更新は入力依存方向に沿って状態座標を結合し、単一のMamba-3ブロック内で非対角状態遷移を可能にする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:15:09 GMT)
Graph Memory: Spectral Associative Memory via Dirichlet Energy [0.5] 本稿では,グラフデータの格納と検索のための高密度連想メモリを提案する。
指数記憶容量を証明し、指数的に劣化する検索誤差を証明した。
我々のフレームワークは、グラフ構造化データのための新しい連想メモリパラダイムを提供し、最新のグラフ学習と生成AIと密結合メモリをブリッジする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:41:43 GMT)
Typed Decision Models: An Early Evidence Audit and Evaluation Checklist [0.5] 型決定モデル(TDM)は、テキストを生成することなく、呼び出し元定義オプション上の確率分布を返す。
タイプセーフは2026年9月15日に商業的な型付き決定モデルであるJevをリリースし、数日以内に小さな評価と複製作業が登場した。
9月19日から24日にかけて発行された28件の論文をレビューし,その成果をラベル確率分類に関する以前の研究に関連づけた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:28:14 GMT)
Neural Dynamics as the Composition of Quantized Units [0.5] 深層学習は一般的に2つのレベルで解釈される:マクロ的、スケール法則によって要約された損失の集合的傾向、そして微視的、ニューロン、特徴、回路である。
本研究では,Quantaの順に取得したトレーニングを記述した中間的抽象化について検討する。
停滞した離散的獲得がスムーズな集合的損失をもたらすことを示し、量子組成の特定のジオメトリの下では、スケーリング法則がもたらされる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:29:49 GMT)
Trust and Task Completion in the World of Consumer AI Agents [0.4] アクションエージェントは2つの方法でユーザを失敗させます。
彼らは、ユーザーが同意しなかったことをした時に信頼を断ち切る。
同じランで信頼と完成度を評価する評価を構築しました。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:24:44 GMT)
Backdoor in the Loop: Compromising Agentic Search via Malicious Retrievers [0.4] エージェント検索増強世代(RAG)は、エージェントが観察する証拠とその後の探索決定の両方に対して、検索者の影響を与える。
我々は,このフィードバックループを利用したレトリバーバックドアについて検討し,その存在を隠蔽するために弱い浄化バックドアを再利用した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:47:25 GMT)
CLAIRE: A Schema-Grounded Hybrid Workflow for Healthcare Administrative Form Completion [0.4] CLAIREは、フィールド状態の検出、ソースからフィールドへのマッピング、決定論的検証、境界付き修正、エスカレーション、監査トレースを分離するハイブリッドワークフローである。
5つの総合医療管理スキーマ,1,000のソースレコード,4つのインターフェースバリアント,2つのデータ品質スイート,6つのコンパレータをテストした結果,24,000のベンチマークエピソードが得られた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:02:19 GMT)
Smooth Sailing through Spherical Shells: Provable Random-Lattice Sieving in Time $2^{0.292n}$ [0.3] ハールランダムな一モジュラー格子上の格子
我々は、Haar-random 格子上での Sieving と同じ複雑さを確実に達成できることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:07:05 GMT)
Think Fast, Plan Selectively: Adaptive Deliberation for Efficient Data-Driven MPC [0.3] 本稿では,高速なポリシー実行とテスト時間計画の間を適応的にルーティングする軽量フレームワークであるFast-TD-MPCを提案する。
Fast-TD-MPCは103の継続的制御タスクにまたがって、最大4倍高速な推論を実現する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:10:00 GMT)
LaMET-Agent: An Agent Framework for Large-Momentum Effective Theory Analysis [0.3] LaMET(Large-momentum effective theory)は格子QCDからの光錐粒子分布の$x$依存性を計算するための第一原理フレームワークである。
本稿では,オープンソースの大規模言語モデル (LLM) エージェントフレームワークである lamet-agent について述べる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:35:11 GMT)
Automatic Speech Recognition for the Basaà Language: A Low-Resource Approach [0.3] AIの進歩は、世界の少数の言語に不均等に恩恵を与えてきた。
音声認識は最も影響力のある発展の1つだ。
ディープニューラルネットワーク、トランスフォーマーアーキテクチャ、自己教師型学習に基づくシステムは、ほぼ人間に近いパフォーマンスを実現している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:29:57 GMT)
Scientific capabilities and deployment sustainability of small-scale LLMs in biological wastewater treatment [0.2] 大規模言語モデル(LLM)は科学的なアシスタントとして登場しているが、その計算要求と限られた領域の特殊化は環境工学における持続可能な展開を妨げている。
そこで本研究では, 生物排水処理における科学的能力と持続的展開の両立が可能であるかを検討した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:55:01 GMT)
Are You Sure You're Sure? Two Confounds in a Sycophancy Benchmark [0.2] 我々は、SycEvalを監査する。これは、モデル回答(プリエンプティブ)の前に提起された異議が、(コンテキスト内での)後に提起されたものよりも、より厚みを生じることを報告している。
欠落した比較を構築し、複数の質問とSycEval独自のフリーフォームパイプラインでテストします。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:52:35 GMT)
APEXA: Execution-Integrity Enforcement for Multi-Agent LLM Automation of Synchrotron Data Reduction [0.2] 我々は、シンクロトロンデータリダクションのための61のツールをコーディネートするフレームワークAPEXAを提案する。
決定論的実行統合ガードは、実行されていないツール呼び出しの結果を返すのを防ぐ。
また,APEXA-Benchは科学的正当性と身体的影響によって構成された58の施設タスクである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:08:09 GMT)
Counting on Thinking: Tracing Evidence Integration in Language Models [0.2] 大規模言語モデル(LLM)は、難しい問題に余分な計算を費やすことができるが、直接答えは数えるのに苦労する。
我々は, 直接応答に欠ける累積数の思考構造が, 既に形成されている思考の読み出しよりも優れていることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:44:25 GMT)
When Can Old Evaluations Certify a New Model? Label-Efficient Release Decisions under Evaluator Drift [0.2] 本稿では,歴史によってガイドされた賭けの専門家と,現在のラベルからのみ学習する専門家を混在させるシーケンシャルな認証手法を提案する。
このコントリビューションは、事前に記入された賭けや専門家の混合ではなく、ラベルの収集のみを導く歴史から有効になる歴史を分けるものである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 05:47:34 GMT)
AnchorRep: Defending LLMs Against Cross-Model Adversarial Transfer via Representation Repulsion [0.2] 単一のオープンウェイト LLM に最適化された敵攻撃は、アーキテクチャ的に異なるモデルに転送およびジェイルブレイクすることができる。
モデル間移動は内部表現幾何学の共有と整合し、自然な防御対象となる。
この結果から, モデル間のロバスト性は, 攻撃固有の訓練を必要とせず, 表現幾何を形作ることで達成できることが示唆された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:19:52 GMT)
Fast and Precise Learned Charged-Particle Trajectory Regression at the Large Hadron Collider [0.2] 本稿では,高エネルギー物理検出器データに対する荷電粒子軌道パラメータ回帰をシーケンスモデリングタスクとして扱うトレーニングレシピを提案する。
双方向ゲート型リニアリカレントエンコーダを用いて,従来のトラックフィッティング手法の完全精度を再現できることを実証した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:17:57 GMT)
Reward Hacking and Agent Containment Failure: A Monte Carlo Study Based on the 2026 Hugging Face Incident [0.1] 2026年7月、Hugging Faceの生産インフラへの侵入は、ハッキングが外部のサイバーセキュリティインシデントになる可能性を示した。
本研究では、報酬ハッキング、封じ込め回避、使用可能なアクセス、永続性、検出の失敗の5段階をリンクする確率論的リスクモデルを開発する。
感度分析は、監視、認可、信用管理におけるエージェント能力と弱点が、モデル化されたリスクに最も大きな影響を与えることを示している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:08:34 GMT)
What Does a ProcGen Generalization Gap Measure? Action Rules, Convergence, and the Missing Random Floor [0.1] 強化学習における一般化ギャップは通常、基準点なしで報告される。
欠落した参照は無作為なフロアであると主張する。
ProcGenでは、フロアがいくつかの標準番号の意味を変える。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:14:35 GMT)
EEG-Based Motor Imagery BCI Algorithms and Technologies: A Review [0.1] 脳波に基づく運動画像(MI)は、その単純さ、非侵襲性、および運動機能の回復と運動障害患者のリハビリテーションを促進する可能性から、注目されている。
本稿では、過去10年間に開発された脳感覚運動野信号を復号するための最も実用的な処理アルゴリズムについて概説する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:42:59 GMT)
Explaining Textual Entailment with Lexical Entailments: Using LLMs to Supply Lexical Relations for Formal Proofs [0.0] 我々は、自然言語推論問題を解決するのに必要なすべての語彙知識をLarge Language Modelsが特定できるかどうかを評価する。
本研究は,NLI問題に対する包含ラベルを用いた構造的説明の代用として,構造的語彙包含に焦点をあてる。
このデータセットは、構造化語彙的説明を生成する上で、LLMを本質的に評価するために使用される。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:34:58 GMT)
Playing to Par: Reinforcement Learning for Provably Optimal Quadrilateral Block Decompositions [0.0] 証明可能なガウス・ボンネット境界に達する分解を構築するために強化学習エージェントを訓練する。
メッシュの半エッジデータ構造に直接、ローカル編集を通じて動作し、メッシュ自身の接続性に従って畳み込みを行うポリシネットワークを備える。
96の保持領域では、エージェントは1つ1つに全四角形メッシュを、平均95.7では使用可能なメッシュを、90では証明可能な最適メッシュを生産する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:07:53 GMT)
Wide-Mass-Scanning-Range Setup and Phase-Resolved Protocol for Axion Dark Matter Detection [0.0] 本稿では,量子強化アクシオンダークマター探索のパラダイムを提案する。
我々は、量子極限における干渉計プロトコルにおいて、アクシオン振幅と位相を直接測定する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:31:17 GMT)
When Pair Count Is Not the Sample Size: What All-Pairs Agent Comparisons Estimate [0.0] オールペア分析では、何が固定され、何がサンプリングされ、どのように共有エントリとペアアグリゲーションを処理するかを記述する必要がある。
他の2つの固定されたリーダーボードの結果、正確なサマリーはどのペアが含まれているか、どのように重み付けされているかにも依存している。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:09:29 GMT)
What Would Falsify It? A Variable Specific Evidence Standard for Mechanistic Claims About Self Explanation [0.0] 言語モデルがすでに与えられた答えを説明するとき、その答えを生成した計算を再利用するか、あるいは回答からのみストーリーを再構築するかを示します。
検証された変数の同一性を除去する変数固有nullと、それぞれ正の統計量とをペアリングするエビデンス標準を提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:26:14 GMT)
What Should We Freeze? Guarded Freezing: Connectivity Shapes the Fine-Tuning of Pretrained Models [0.0] 我々は、選択した凍結コアを分離できる場合を分析し、除去値を提案する。
VGG-8では、トレーニング可能なニューロンから凍結したコアへの切断経路が、このスコアを用いた選択に有用であることを示す。
我々は,各重み入力を局所更新モデルで更新することによる出力乱れのフォワード専用プロキシであるドリフト値の導出を行う。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:56:28 GMT)
Using Machine Learning to Investigate Predictors of Fasting Blood Glucose: Insights into Circadian Timing and Age Interactions [0.0] 糖の欠乏は代謝障害や2型糖尿病に大きく寄与する。
本研究では, 代謝, ホルモン, ライフスタイル, 人口動態, 栄養, 概日変動を用いて, ログトランスフォーメーションによる血糖値の予測を行う機械学習フレームワークを開発した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:01:27 GMT)
Uncertainty Quantification of Next Generation Reservoir Computing with Applications to Memory-Driven Dynamical Systems [0.0] 次世代貯留層計算(NGRC)のような効率的な予測手法の不確実性定量化は未開発である。
我々は,NGRCのベイズ尾根と共形予測間隔について検討し,不確実性の推定値が一致するか異なるかを特徴付ける。
これらの結果は貯水池を用いた予測における不確実性定量化手法の選択と解釈のための原則的枠組みを提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 02:47:23 GMT)
The refractive index of the medium within the volume of deep inelastic $ep$ scattering: I. Group velocity of interaction carriers [0.0] 深部非弾性粒子散乱中に形成されるフェルミオンボソン媒質の特性測定法を提案する。
波動過程の位相と群速度はレイリー微分条件によって関連付けられる。
媒体の屈折率を位相速度で決定する一方、群速度は媒体の分散特性を特徴づける。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 11:17:11 GMT)
The Judge Is Not Its Twin: Post-training makes a model's writing more predictable but barely moves its taste, as a judge, toward predictable writing [0.0] ポストトレーニングは、モデル自身の書き込みをより予測可能にします。
また、予測可能な文章に報酬を与えるために、裁判官として振る舞う同じモデルを教えることもある。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:46:50 GMT)
The Extender: A Log-Structured Transformer [0.0] 本稿では,標準的な Transformer アーキテクチャのログ構造化版である Extender を紹介する。
標準のTransformerでは、各レイヤが後続のレイヤとのみ通信する。
拡張子は,$|_ell|=32$の場合,199M-924Mパラメータの短文(CORE)タスクでTransformer精度と一致し,長文(RULER)ワークロードで924MパラメータでTransformer精度を上回ることがわかった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:27:09 GMT)
The Epistemics of Agent Memory: Measuring, and Governing, the Consolidation Decision in Long-Horizon LLM Agents [0.0] LLMエージェントは、蓄積した経験を耐久性のあるメモリに変換する必要がある。
フェーズ1は下流ユーティリティによってエージェントトレースからエピソード境界を学習する。
フェーズ2は、トークン予算の下で経験と抽象化のレベルを促進する方法を学ぶ。
フェーズ3では、3つの非円周軸上の既知の最適値に対する統合決定をスコアするオラクル・バイ・コンストラクション・ベンチマークが導入されている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:10:45 GMT)
The Decomposition Tax: LLM Pipelines Lose Up to 40 Accuracy Points at Their Own Interfaces [0.0] 4段階のLSMパイプラインは、自身のインターフェースで最大40.5の精度ポイントを付与する。
モデル、問題、ステージ、ステージプロンプト、完成予算を定めています。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:49:27 GMT)
SinBrief: A Hybrid Framework for Abstractive Text Summarisation of Sinhala Legal Documents [0.0] SinBriefは、人間による注釈付きトレーニングデータを必要としない、シンハラの法的文書のためのハイブリッド抽象的な要約フレームワークである。
このフレームワークは、カバレッジ、密度、圧縮比、SummaC、Self-BertScoreなどの基準のないメトリクスを使用して、シンハラの法定コーパスで評価される。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:17:31 GMT)
Silent Failures in Agentic Security Evaluation: A Validated Harness for Tool-Call Mediation Under Indirect Prompt Injection [0.0] 特権ツールを起動するLLMエージェントは間接的プロンプトインジェクション(IPI)に脆弱である
4つの欠陥クラス - サイレントペイロードの非配信、引数ではなくツールアイデンティティによるアタック成功、モデル非能力と混同された偽リジェクション率、監査証跡の欠如 - を識別する。
我々は、欠陥と修正された定義の下で同じ実行トレースを再描画することで、歪みを定量化する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 14:53:42 GMT)
Shared Autoregressive Context Can Distort Relationships in Synthetic Data [0.0] 大規模言語モデルでは、1つの自己回帰補完内で複数のレコードを生成することができる。
本稿では, 合成データ中の変数間の関係を歪曲することができることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:25:58 GMT)
Safety-Constrained Cascade Inference for Robust Malaria Cell Classification Under Field Corruptions [0.0] クリーンな実験室画像の精度を最大化するモデルは、安価なスマートフォンカメラがセンサーノイズを導入した瞬間に失敗する。
MobileNet2 sentinelは、高い計算コストで信頼性の高い分類を行う。
専門家は、フレームの破損の有無に関わらず、クリーンで標準化された画像しか見ていないと考えている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:58:25 GMT)
SIMANF: Sample Free Learning of Unnormalized Distributions via Simulated Annealing in Normalizing Flows [0.0] SIMANFは、模擬アニーリングと正規化フローを統合する、サンプルフリーフレームワークである。
マルチウェル分布と高次元スカラーPhi4格子場分布に有効性を示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 06:12:07 GMT)
Right Answer, Wrong Reason: Accuracy, Consistency, and Consensus Are Misleading Indicators of LLM Faithfulness in Clinical Decision Support [0.0] 我々は150のMedQA-USMLE質問に対して6つの臨床大言語モデル(LLMs)を評価した。
対象となった臨床概念の23.3%が因果的に必要であることが判明した。
これらの結果から, 精度, 一貫性, コンセンサスは, 臨床的意思決定支援に不完全な安全信号であることが示唆された。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:44:22 GMT)
Readout is not Recovery: Dissociating Coordinate Emission from Visual-Corruption Repair in Vision-Language Models [0.0] 単体接地におけるQwen3-VL-4B-インストラクトの読み出し・回収分離について検討した。
本研究では,クリーンな座標 token の読み出しランキングと汚職由来の修復ランキングを比較し,リカバリのためのオブジェクトマスクの終端置換と深度定位のためのクリーンインプットのフロアリングを用いた。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 16:25:45 GMT)
Reading Is Not Leaking: Local, Auditable Measurement and Reduction of Inference Exposure from Public Footprints [0.0] ターゲットのプライベートな真実に対する推論システムが、どれだけの頻度で記録を読み取るかを示す。
16の合成企業に対する128の質問では、質問のほぼ半分が6人の読者によって正しく答えられることはない。
我々の分析装置は、規則と統計解法と、106M-パラメータエンコーダをスクラッチから訓練し、冗長な証拠をマークし、テキストを決して生成しない。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:40:35 GMT)
Re-derivability Decides What a Staged Agent Pipeline Recovers After an Upstream Fault [0.0] 1つの変数は、上流の障害が言語モデルエージェントのステージ化されたパイプラインにかかるものを設定する。
Llama-3.1-8Bでは、この断層はいかなる線量でも検出可能なコストがかからないため、他の3つには断層のコストに関するすべての主張がある。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:23:48 GMT)
Rank Collapse Is Recoverable, Growing $|Q|$ Is Not: Out-of-Sample Early Warning for Value Divergence in High-UTD Soft Actor-Critic [0.0] データ更新率の上昇は、政治的批判を「塑性損失」と分類する2つの方法で破ることを示す。
我々は、スケールされた批評家(2048年、正規化なし)でそれらをSoft Actor-Criticに分離する。
1つの高UTD SAC構成内では、実行が近く始まり、批評家の$log_10|Q|$が、その初期の成長であるステップ15kでどれだけ上昇したかは、ガードがすぐにフラグを付けるかによってランク付けされる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 17:46:16 GMT)
Quantum undular bores, rainbows, and event horizons in superfluid dam breaks [0.0] ボース=アインシュタイン凝縮体(BEC)から電位障壁が突然取り除かれると、流体力学のダム破壊の量子バージョンが生じる。
摂動型(n ll n_0$) と非摂動型(n sim n_1$) のどちらも準一次元の場合を研究する。
摂動状態においては、外向きに伝播する2つの分散ウェーブパレット形式は、ダンダルボアの量子バージョンと見なすことができる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:48:07 GMT)
Predicting the Next State Is Not Enough: JEPA Representations for Lean Theorem Proving [0.0] 一段階のリーン移行が分岐順序付けのための自己教師付き信号を提供するかどうかを検討する。
JEPAスタイルのモデルは、潜伏した後継表現を予測し、カーネル検証された非終端的な後継のみをスコアする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:59:26 GMT)
PoliVEM: a Python-driven virtual element framework for computational solid mechanics [0.0] PoliVEMは、計算固体および構造力学における仮想要素法(Virtual Element Method, VEM)のソフトウェアフレームワークである。
C++17計算コアとPythonインタフェースは、1次元ビーム、2次元および3次元弾性、軸対称弾性、過渡拡散、有限ひずみ超弾性を共通の実装で配置する。
このフレームワークは、エッジ、顔、セルの自由度を1つの階層に格納し、共通のデータからエネルギー、ひずみ、および$L2$の投影を構築し、要素レベルでの整合性安定化の分割を保持する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:27:08 GMT)
PlurVA-LLM-2026 Shared Task Track-1: Pluralistic Value Alignment in LLMs via Multilingual Fine-Tuning and Threshold Calibration [0.0] 我々は,中国,インドネシア,スリランカの文脈における多元的値アライメントに着目したPlurVA-LLM 2026共有タスクトラック1を提案する。
提案手法は,中国のデータに対するオプション順化,インドネシアのデータに対するアノテータ投票の拡大,スリランカのデータに対するシンハラMMLU拡張による二項改定を組み合わせたものである。
最終システムは中国語が0.785、インドネシア語が0.715、スリランカ語が0.916となり、マクロ平均精度は0.805となった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:56:11 GMT)
On the Usage of Verifiable Credentials in Privacy-Preserving Federated Analytics [0.0] プライバシ保護フェデレーション分析により、生データを交換することなく、複数のノードが協調して統計的洞察を導き出すことができる。
本稿では、FPPAと自己主権IDフレームワーク内で定義された検証クレデンシャルを結合することにより、認証された整合性保存データモデルを定義することの実現可能性について、いくつかの知見を提供する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:57:54 GMT)
On the Born rule in a new quantum approach [0.0] ボルンルールはいくつかのステップを通じて弱い条件下で証明される。
遷移確率原理は統計の確率原理と密接に関連している。
このアプローチ全体は、有限次元量子力学における従来の概念よりも単純な状態の概念へと導かれる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 10:10:50 GMT)
Neural Network-Assisted Refinement of Traditional Schemes for One-Dimensional Scalar Conservation Laws [0.0] 数値的手法とニューラルネットワーク近似の間に明確なリンクを確立する。
最初のニューラルネットワークは、ゴドゥノフの手法を再発見することができる。
後者は2階傾斜リミッタ関数の挙動をエミュレートする。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:14:39 GMT)
Learning What to Evaluate: Correlation-Aware Decoupling for Multiobjective Bayesian Optimization [0.0] 本稿では,マルチタスクGPモデルを利用して,すべての目的と制約を共同で学習する手法を提案する。
本手法は, 技術状況において, 結合されたベースラインと疎結合されたベースラインよりも優れていることを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:50:39 GMT)
Language as an Independent Information Layer: A Conceptual Model of Communication, Cognition and Decision-Making [0.0] 本稿では,企業の知識基盤を設計するための新しい概念を提案する。
この概念は、企業の語彙の確率的ベクトル空間を統合する。
動的システムとして、言語は情報アーキテクチャ全体の中で独立したインデペンデント層として機能する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:32:02 GMT)
KinyaMed: Seeds, Not Rows -- What a Corpus Requirement Written in the Wrong Unit Fails to Constrain [0.0] 我々は患者声の緊急分類器Kinyarwandaを構築した。
私たちの仕様は、安全を意図したものを何一つ作らずに満たすことができたのです。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:50:14 GMT)
How to Reduce Whisper Hallucination [0.0] ひとつは寛容にライセンスされたチェックポイント、99の言語、言語ごとのチューニングなしです。
42クリップの純ルームトーンでは、whisper-large-v3は61.9%で単語を出力し、100%で何かを出力する。
最高のチェックポイントは、61.9%から2.4%までの沈黙と、99.9%から47.8%までの実際の無声音声に関する言葉を幻覚させる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 12:35:29 GMT)
How AI Changes DevOps Performance: A Mechanism-Based Simulation [0.0] ソフトウェア開発のためのAIツールは、コード補完から自律エージェントへと進歩した。
AGCとAGTは別々に共同で、デプロイメント頻度、リードタイム、変更失敗率、リカバリ時間、デプロイメント再作業率にどのように影響するかを検討する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 09:42:09 GMT)
Harness Tokenomics: A Router for the Enterprise Agentic Control Plane [0.0] 数百席のパイロットとして始まったのは、今では数万人に拡大している。
ハーネスは、どのモデル答え、モデルが何を読んだか、プロンプトキャッシュの使用方法、どのサブエージェントが実行されるかを決定する。
我々は、Jevがすべてのプロンプトをエージェント要求の所有する分類に対してラベル付けするカスタマイズ可能なルータを構築します。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 20:27:51 GMT)
Generative AI & Two Forms of Decoupling [0.0] 記事は、AIモデルにより、関連する人間の活動を受けずにテキストを作成できると主張している。
テキストを使って連続的な決定を下す機関は、それに応じてプラクティスを再構築するかもしれない、と論じている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 13:59:59 GMT)
Generalization and Memorization along the Learning Trajectory of Neural Language Models: A Geometric Account of Categorization [0.0] ニューラルネットワークモデルの学習軌跡に沿って一般化と記憶がどのように発達するかを考察する。
制御された合成文法を用いて,表現空間の幾何学と学習時のモデル行動について検討する。
観察されたトークンによって占有されない表現空間の連続領域は、学習の初期段階から体系的に構造化される。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:54:48 GMT)
Exact High-Temperature Quantum Area Law [0.0] 例えば、$mathcalI_(A,B) leqslant tildef(), 2,|partial_AB|$ ここで、$|partial_AB|$は境界領域のサイズを表す。
この2次スケーリングは高温相関とマクロ熱力学の関係を改善する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 07:44:41 GMT)
Evaluating Single and Multi-Omics Based Explainable Artificial Intelligence (MOXAI) for Molecular Subclass Classification of Adult-Type Diffuse Gliomas [0.0] MOXAIはDNAメチル化とメチル化配列からのコピー番号データを統合し、成人型びまん性グリオーマを分類する。
クラスアクティベーションマップ(CAM)および勾配重み付きCAM(Grad-CAM)に基づくXAI法により、各分類決定に最も関係のある特定のCpG部位、遺伝子および染色体領域を同定する。
その結果、成体型びまん性グリオーマサブタイプの確立された分子的特徴と一致し、フレームワークの生物学的解釈可能性を確認した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 03:30:29 GMT)
Escaping Alignment: A Physical Trap Model of Best-of-N Jailbreaking [0.0] Best-of-N$ jailbreaking (BoN) は、安全でないプロンプトを$N$で独立に拡張することで、整列モデルのセーフガードをバイパスする。
これまでの研究によると、攻撃成功率(ASR)はN$の権力法則に従っているようだ。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:40:15 GMT)
Environmental Impact of Generative and Agentic AI: An in-Depth Analysis and Green Solutions [0.0] 本稿では, エネルギー消費量, 二酸化炭素排出量, 水利用量, 電子廃棄物を対象とする, 現代のAIシステムの環境フットプリントについて検討する。
これは、オリジナルの物理測定を行なわずに、公表されたデータに基づいてマグニチュードの順序を推定する概念解析を提供する。
これらの発見は、エージェント対応エネルギー測定、ライフサイクルベースの炭素と水の会計、大規模AIトレーニングとデプロイメントの必須開示を求めている。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 21:45:56 GMT)
Editable Map-Conditioned Trajectory Generation for Human Mobility Simulation [0.0] 我々は、このタスクを、マップ条件による人間のモビリティメッシュのオートレ生成として定式化する。
我々は、ResNet-50ビジュアル回帰構成とViT(Vision Transformer)クロスアテンション構成をインスタンス化する。
我々は,正解と内分割シャッフルマップ生成と実軌道の保持値を比較することで,地図感度を評価する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:33:20 GMT)
Domain Adaptation with Target Information via Doubly-Anchored Distributionally Robust Optimization [0.0] ドメイン適応(DA)は最悪のケースの保証を欠くことが多いが、ソースデータのみに基づく分散ロバスト最適化(DRO)は利用可能なターゲット構造を無視している。
本稿では、ソース法を中心とする$$-divergence Ballsとソース完備なターゲット参照法とを両立させるDROフレームワークを提案する。
我々は、対称および非対称な発散ペアリングのための二重誘導対角橋のジオメトリを導出する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 15:49:01 GMT)
Counterdiabatic quasi-Floquet control for the generation of entangled BICs using giant atoms [0.0] 連続体(BIC)における境界状態は、導波路量子力学における絡み合いを保存するメカニズムを提供する。
我々は高忠実な絡み合ったBICを作成するための頑健なアプローチを提案する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 01:05:29 GMT)
Coordinated Electromagnetic Side-Channel Attacks for Voter--Ballot Linking: A Case Study of the Brazilian E-Polling System [0.0] 電子投票機に表示された投票を再構築するために,2人の敵が電磁的側チャネル攻撃を調整する方法を示す。
本研究は,電子投票システムに責任を持つ政府機関に対して,情報法医学の知見を提供し,セキュリティ勧告を支援するものである。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 22:37:37 GMT)
Active 3D weaves for load-bearing and damage-resilient locomotion [0.0] 活性物質を3次元織物殻に統合してロボット構造を構築するための一般的な枠組みを提案する。
これらのロボット構造は、負荷軸受の高軸剛性、効率的なアクチュエータのための低曲げ剛性、耐損傷性のためのシステムレベルのレジリエンスを組み合わせたものである。
これらの3D織布ロボットは、負荷を70倍の自重に分散することができ、過度な圧縮を受けた後でも繰り返し性能を維持可能であることを実証する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 00:09:25 GMT)
ASCEND: Personal AI Agents for Autonomous Scientific Computing Across HPC Clusters and GPU Workstations [0.0] ASCEND(Autonomous Scientific Computing Engine and Novel Discovery)はAIを利用したエージェントインタフェースで、研究者自身のラップトップ上でエージェントを実行する。
各リソースのアカウントは十分であり、パブリックインストーラはユーザが自身のSlurmクラスタやワークステーションをリンクすることを可能にする。
本報告では,(1)植込み型テンソルデバイス断層の故障回復ループを閉鎖し,ジョブレベルのアーティファクトの提出,診断,修復,再提出を行い,(2)著者が公表した気象予報モデルの評価を再現した4つの事例を報告する。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 18:53:22 GMT)
A statistical theory for blind denoising: minimax estimation of the noise level from a single sample [0.0] P 上の2つの構造的仮定の下で,ミニマックス平均二乗誤差を特徴づける。
複雑性kをカバーする信号に対して、ミニマックスレートは$widetilde_(min_2,d-1+k2d-2)$であり、制約されたMLEは対数因子に到達する。
これらの結果から,信号法則の構造はブラインドノイズ推定の難易度と適切な推定値の両方を決定することがわかった。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 23:06:13 GMT)
A Quantum Framework for K Coloring of Graphs [0.0] グラフカラー化は、スケジューリング、レジスタ割り当て、周波数割り当て、ネットワーク最適化などにおいてよく知られたNP完全問題である。
量子コンピューティングは、特定の問題インスタンスにおいてスーパーポリノミカルなスピードアップの可能性を秘めている。
我々は、$K$-coloringのためのソルバ量子フレームワークを提案した。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 08:09:59 GMT)
A Function-Level Vulnerability Score Measures Flag Rate More Than the Model: Protocol Effects on Paired Benchmarks [0.0] ペアテストでは、モデルが脆弱な関数にフラグを付け、修正コミット後にバージョンをクリアしなければならない。
7つのフロンティアと大きなオープンモデルが、5つのリリースされたペアベンチマークと1つのプロトコルでプールされたセットで評価された。
68モデル中37モデルの場合、正対と逆対の差は95%の間隔でゼロとなる。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 19:23:48 GMT)
"Where Can I Trust You?": Boundary-Aware Evaluation of Surrogate Fidelity [0.0] 代理モデルは、評価セットに対して教師モデルにどの程度の頻度で同意するかによって、一般的に評価される。
代理の正当性は、代理が教師とどの程度の頻度で合意するかだけでなく、その合意がどこにあるかにも依存することを示す。
論文参考訳(メタデータ) (Sat, 26 Sep 2026 04:45:14 GMT)