ReNFT: Repairing Mode Collapse in Reward Post-Training via Internal Probability-Mass Recalibration [84.1] 再学習後、必然的に確率質量をいくつかの報奨モード、即時多様性を消去するモード崩壊に集中させる。
本稿では、内部の確率質量再校正により、高逆低ダイバーシティアダプタを修復するReNFTを提案する。
PickScoreとGenEvalでは、ReNFTはNFTの報酬の98.9%と99.0%を保持し、DreamSim-Divは58.8%、55.0%改善している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:13:50 GMT)
GenRubric: Self-Evolving Rubric Generation for Scalable LLM Evaluation [74.4] GenRubricは、ラベルのないクエリからルーブリック生成を改善する自己進化フレームワークである。
我々はこの原理を強化学習により実現し、ルーブリック間の包括性信号とグループレベルの報酬と基準レベルの報酬を組み合わせる。
人間の注釈付きルーブリックベンチマークの実験では、自己進化は生成されたルーブリックと専門家によるルーブリックによる評価の一致を改善することが示されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:39:39 GMT)
TEMPO: Temporally-grounded Multi-task Post-training for Large Audio-Language Models [58.8] 大型オーディオ言語モデル(LALM)は、クリップレベルで音声を記述するが、イベント、スピーカー、音声にタイムスタンプを割り当てることはできない。
我々は、音声、音声、音楽のタイムスタンプタスクを処理する最初の統合モデルであるTEMPOを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:49:21 GMT)
Task-Relevant Feature-Dynamics Fidelity Enables Zero-Shot Sim-to-Real Transfer for Robotic Ultrasound Scanning [58.3] 我々は,共有構造中間領域,軌道レベルの固定雑音,数ステップの条件流生成を組み合わせたTR指向超音波シミュレータを開発した。
ファントム実験では、4つの標的機に400発のゼロショット配置のうち390発が成功した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:37:00 GMT)
Small Language Models as Judges for Rubric-Based Reinforcement Learning [57.7] より小型の言語モデルが,より効率的かつ信頼性の高いルーリック・ベース・ジャッジとして機能するかどうかを考察する。
生成的評定,Yes/No Logprobマージン,Probe judgesの3つの基準レベルの判断を,小モデルから抽出する方法を比較した。
どちらのデータセットでも、Qwen3-1.7B Probeの審査員はこれらの方法の中で最強の基準レベルの合意を達成している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:00:17 GMT)
ContextBias: Controlled Evaluation of Bias Persistence Under Context Shift in Text-to-Image Models [56.4] 制御された評価フレームワークであるContextBiasと、92のロールと1,656のセマンティックなプロンプトにまたがるベンチマークであるContextBenchを紹介する。
66,240個の画像に対して4つの最先端モデルを評価する。
意味的に無関係なコンテキストにロールを配置しても、ロールリンクされた属性は抑制されず、代わりにクロスロール属性の濃度が増加する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:23:07 GMT)
RIDGE: Region-Informed Derivative-Guided Evidence Selection for Long Video Understanding [55.8] RIDGEはフレーム選択フレームワークであり、時間信号としてフレームクエリの類似性曲線を読み取る。
タイムラインを構造的なリージョンに分割し、固定予算の下でイベントコア、トランジション、ビルドアップ、アフターマス、コンテキストフレームを保存するために、リージョン固有の選択を適用する。
ほとんどの設定で最高のパフォーマンスを達成し、他の設定では競争力を維持します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:40:51 GMT)
FRAMEWORKERS: A Dynamic Multi-Agent Framework for AI-Generated Video Production [55.7] 本稿では,タスク中心のマルチエージェントフレームワークであるFRAMEWORKERSを紹介した。
Central Directorは、ビデオ生成を動的タスク管理として定式化し、タスクスタックを継続的に編集して、次にどのサブタスクを実行するか、どのサブエージェントを呼び出すかを決定する。
アシスタントは実行層として機能し、選択した各タスクを共有ワークスペースに接地し、必要なアセットとコンテキストを検索し、割り当てられたサブエージェントを呼び出し、結果のアーティファクトを永続化する。
FRAMEWORKERSは、ルーティング精度において強いプランナーよりも優れ、実行時の障害から確実に回復し、目に見えないサブに一般化することを示した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:28:50 GMT)
Everybody Tracking Every Body [54.8] 本研究では,集中的な協調を伴う自我中心的な視点から対話する複数の人物の3次元身体ポーズ推定の問題に対処する。
この動画をVIO SLAMで処理することで、宇宙空間におけるそれぞれの自撮りカメラの高品質な追跡が可能になる。
本研究では,頭部の動きに基づくポーズ推定と遠心性ポーズ観測を融合した拡散型アプローチを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:42:15 GMT)
VibeJam: A User Study Platform for Web Development with Agents [54.3] VibeJamは、ユーザーがAIエージェントと協力してウェブサイトを開発するためのブラウザベースのユーザー学習プラットフォームです。
VibeJamはエージェントのカスタマイズを可能にし、オープンソースのAiderエージェントをデフォルトで使用し、ダウンストリームの使用を反映するために、差分レビュー、チャットとプランモード、ライブWebサイトプレビューを追加します。
ゲームベースのWebサイト作成タスクを55リリースしたパイロットスタディでは、5人の経験豊富なAIプログラマが、私たちのシステムを面白く、シンプルで、商用ツールに似ていると評価し、13人の中学生がVibeJamを使って、同じタスクのエージェントよりも高品質なWebサイトを作成しています。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:37:51 GMT)
A Target-Centric Survey of Quantization-Aware Training [53.5] 量子化アウェアトレーニング(QAT)技術は、これらの課題に対処するための有望なソリューションとして登場した。
QAT技術は、モデルトレーニング中に量子化効果を明示的にシミュレートし、完全精度に匹敵する精度を達成する低ビットモデルを生成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:04:47 GMT)
Check The Scoreboard: An Analysis of Scoring Schemes on Multiple-Choice Evaluation [52.6] NLPにおけるMultiple-choice Question answering (MCQA)ベンチマークは、数右スコアリング(精度)を用いる。
教育試験において、スコアリング方式は、応答モードモデルが従うこと、および応答のグレーディングルールの組み合わせであり、どの能力に報酬を与えるかを規定する重要な設計選択である。
我々は、MCQAが6つの教育にインスパイアされた6つのスキームで、正確性を超えた能力を評価することで、数字右の代替手段がどのように変化するかを検討する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:35:22 GMT)
The Depth Flow of Token Representations Is Nonlinear and Does Not Descend Its Own Density [51.7] トークンの表現はネットワーク層を介して層によって行われる。
我々は、この流れの運動方程式を、Pythia-160M と Pythia-410M のコーパス平均軌道上の離散ランゲヴィンモデルとして適合する。
トークンは、標準ランクがシャッフルされ、その濃度ランクが最後のブロックによって反転する間、その角ランクを13層すべてにわたって保持する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:22:00 GMT)
A Hub of Short Rows Inflates Intrinsic Dimension Estimation of Token Embeddings [51.7] トークン埋め込みテーブルは、その起源の近くに短い行のハブを保持する。
測度が集中しているため、トークンは他のトークンよりも中央のクラスタに近い。
その結果、TwoNNのようなID推定器は実IDよりもはるかに高い次元を返す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:19:11 GMT)
PrivBench: A Holistic and Modular Benchmarking Platform for Evaluating Text-to-Text Privatization [50.7] PrivBenchは、テキストの民営化に取り組んでいる研究者や実践者のためのベンチマークプラットフォームである。
PrivBenchは無料で、https://privbench.com/.comで公開されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:33:08 GMT)
EMERGE-Policy: A Robot Mind Emerges Beyond a Single Policy [48.9] EMERGE-Policyは機能呼び出しと情報交換の両方をコーディネートする。
Main Agentはアクティブなコンテキストウィンドウ内でタスクレベルの状態を保持する。
ロール固有のサブエージェント プロセスの認識、実行監視、検証、メモリ統合。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:46:06 GMT)
MMMMM: A Unified Taxonomy for Investigating the Mechanisms of Multilingual MultiModal Misinformation [45.9] ソーシャルメディア上のマルチモーダルな誤報は、非常に普及し、強力で、有害であり、検出と対応が困難である。
マルチモーダル誤情報の性質と偽造戦略に関する研究は、実世界の文脈に根ざしたマルチモーダル誤情報の欠如によって妨げられている。
本研究は,データの詳細な質的分析とそれ以前の理論的研究に基づく,多モーダル誤報の包括的分類法を開発する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:30:19 GMT)
A Hybrid State-Space Approach for Census-Tract Population Estimation [45.9] MambaPopは、行政単位のイメージから直接人口を学習する方法である。
平均絶対誤差(MAE)は1トラル当たり1141ドルであり、最も強い畳み込みベースラインと一致する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:43:06 GMT)
A Calibration Audit of Confidence in Feed-Forward 3D Reconstruction [45.5] 3D再構成モデルは、下流システムが信頼性信号として読み取る画素当たりの信頼を出力する。
4つの特性に対する信頼度、エラーのランク付けの正確さ、そのレベルが平均的に正しいかどうか、信頼範囲を越えて保持されているかどうか、そしてその間隔が真実をカバーしているかどうか。
信頼度は誤差をよくランク付けするが、予測された不確実性は、トレーニングの正確さではない条件下で読み取られると低すぎる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:21:34 GMT)
Discrete Diffusion Bridges for Spatiotemporally Aligned Image Translation and Generation [44.1] DDBは、画像翻訳と生成における標準離散拡散の基本的な相違を解決するために設計されたフレームワークである。
マスクとソーストークンの混合に状態を吸収するハイブリッド吸収機構を導入し,空間アンカーとして空間空間に効率的にソースを注入する。
さまざまな生成パラダイムにわたるフレームワークの汎用性と堅牢性を検証する実験。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:44:38 GMT)
Uncertainty-Driven Replay Memory for Reinforcement Learning [43.3] 不確実性推定は強化学習(RL)エージェントに有望な機能を提供する。
本稿では、不確実性駆動型リプレイメモリ(UDRM)と呼ばれるRLで一般的に使用されるエクスペリエンスリプレイバッファの新たな定式化を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:41:57 GMT)
Memory-First Fact-Checking: A Knowledge-Graph-Grounded Multi-Agent System for Misinformation Detection [42.7] 本稿では,知識グラフに基づくセマンティックメモリと逆多エージェント推論を統合し,説明可能な誤情報検出を行うハイブリッドファクトチェックフレームワークを提案する。
提案システムはメモリファーストのWebフォールバックアーキテクチャに従っており、入力クレームは2次元知識グラフに対して初期評価される。
グラフから取得した証拠が信頼性のある決定を支持するには不十分な場合には、信頼できるWebソースから情報を収集し、支持、矛盾、判断エージェントからなる相手方裁判を用いて評価する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:16:07 GMT)
Automatic Conversion of NICE Guidelines to an Executable Computational Model Using Large Language Models [42.6] NICEガイドラインは、臨床治療のためのエビデンスベースのレコメンデーションを提供する。
計算可能な表現に変換する既存のアプローチは、しばしば個々の病気に焦点を当てる。
大規模言語モデル(LLM)は、この翻訳の多くを自動化することができる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:28:03 GMT)
TAKE 85: Testing Audiovisual filmmaKer's intEnt across 85 Hours of Film [42.2] 映画は、照明、色、作曲、編集、対話、音楽、音など、意図的な創造的な選択を通じてコミュニケーションする。
我々は,398本の短編映画(85時間)と,世界規模および微粒な視覚的および音声的意図にまたがる専門家による質問応答対を含む,ディレクトリインテリジェンス理解のための最初のベンチマークであるTAKE 85を紹介する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:22:14 GMT)
SPLG-Mamba: Structure-Preserving Local-Global Mamba Network for Salient Object Detection in Optical Remote Sensing Images [40.1] 既存の手法はしばしば塩分地域を局在させるが、その予測は依然として構造劣化に悩まされる可能性がある。
ORSI-SODのための構造保存型ローカル・グローバル・マンバネットワークSPLG-Mambaを提案する。
ORSSD、EORSSD、ORSI-4199の実験は、最先端の結果を示し、構造的完全性と連続性を改善した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:38:25 GMT)
On the Recoverability of Private Information Unlearning in Large Language Models [40.0] 大きな言語モデル(LLM)は機密情報を記憶し、重大なプライバシー上の懸念を引き起こす。
既存のメソッドが実際にそれを消去したのか、単にモデル内に隠しただけなのかは不明だ。
偽のプライベート情報を含む合成データセットを構築し,ホワイトボックス監査フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:17:02 GMT)
DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting [39.6] 1ステップのVLAであるDriftingVLAを導入し、単一のアクション-エキスパートフォワードパスで完全なアクションチャンクを生成する。
PDTDは、各アクション次元の完全な時間軌道を別々のドリフト単位として扱う。
ネイティブのワンステップデプロイメントでは、アクションチャンク生成の3.36倍のスピードアップも実現している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:21:44 GMT)
OptiGeo: Efficient Monocular Geometry for Embodied Perception in Optically Challenging Scenes [39.5] クリーンジオメトリの教師と残差トリミングアライメントを用いて,バイアスのある実監督を修復する,バイアス対応のトレーニングフレームワークであるOptiGeoを紹介する。
我々は、大きなドメイン固有の微調整セットではなく、クリーンな光学幾何学のコンパクトなソースとして透過目標レンダリングを再定義する。
わずか3000万のパラメータにもかかわらず、OptiGeoは3億のスケールのモノクラーモデルと数十億のスケールのマルチビューベースラインを透過的なベンチマークで上回っている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:21:02 GMT)
The Edge Spectrum of Choice-Derived Item Graphs: Strong and Weak Edges Encode Different Relations in Collaborative Filtering [38.9] 強辺と弱辺が定性的に異なる関係を符号化していることを示す。
我々はこれをスムージング演算子とランク勾配との符号ミスマッチとして定式化する。
この診断は、MDNとEB-NeRDの3つの経験的観察を説明する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:53:08 GMT)
Evaluating 2D and 3D-Aware Vision Foundation Models for Vehicle Attribute Recognition [38.9] 本稿では,14種類の最先端2Dおよび3次元視覚基盤モデルの実証的ベンチマークを示す。
車両のタイプ,製造,モデル認識のための線形探索により,これらのモデルを凍結特徴抽出器として評価する。
以上の結果から, 標準的な2次元自己教師型モデル, 特にDINOv3は, きめ細かなタスクにおいて, 3次元認識モデルよりも大幅に優れていた。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:51:44 GMT)
AgentProv: Auditing Agentic LLM API Providers via Tool-use Policy Probes [38.4] 商用LLM APIは特定の基盤モデルを宣伝するが、提供されたバックボーンは静かに代用され、定量化され、あるいはラップされることがある。
既存の監査はすべて、テキスト出力チャネルからバックボーンアイデンティティを決定する。
本稿では,AgentProv(AgentProv)について紹介する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:22:12 GMT)
AgenticRag-R1: Agentic Reinforcement Learning with Stack Memory for Multi-Step Reasoning, Retrieval and Memorizing [38.0] AgenticRag-R1は強化学習フレームワークで、メモリスタックときめ細かいアクション空間を介して推論、検索、メモリを統合する。
実験の結果、AgenticRag-R1は強いベースラインを一貫して上回ることがわかった。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:31:19 GMT)
ACTD: Anchor-Based Cross-Tokenizer Distillation with Residual Regularization [36.7] クロストケナイザー蒸留は、大きな言語モデルから軽量の学生モデルへの推論能力を効果的に伝達する。
残留正則化を用いたアンカー系クロストケナイザ蒸留法(ACTD)を提案する。
ACTDは語彙や配列アライメントを通じて構造的不均一性を橋渡しし、アライメントノイズを残留正規化を伴う新しいアンカー損失によって緩和する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:54:48 GMT)
Higher-Dimensional Rotary Position Embedding [36.6] RoPE(Rotary Position Embedding)は、位置情報を独立した2次元回転で埋め込む。
独立な2次元回転から高次元回転へ拡張するHD-RoPEを提案する。
HD-RoPEは、追加のトレーニング可能なパラメータを導入することなく、エンジニアリング効率に容易に最適化できる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:46:24 GMT)
Creation begins with understanding: LLMs as strategy designers for privacy-preserving tabular data synthesis [36.2] レコードを直接生成するのではなく,LLMを用いて合成手順を設計するタブラル合成戦略デザイナ(TabSSD)を紹介する。
12のデータセットにわたって、TabSSDは統計的忠実度、予測ユーティリティ、経験的プライバシーリスクの間で好適なバランスをとっています。
これは、比較した手法と比較して、局所的な計算とトークン消費を大幅に削減する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:16:21 GMT)
Self-OPD: On-Policy Distillation for Flow Matching Models without Teacher [36.1] フローマッチングモデルのための教師なしOPDフレームワークである textbfSelf-OPD を紹介する。
Self-OPDは決定論的次状態予測を$K$SDE候補に分割し、ODEサンプルとロールアウトして、決定論的自己参照ベースラインと比較する。
単品と混合報酬のベンチマーク実験により、セルフOPDはタスク固有の教師を伴わずに、以前のRLとOPDメソッドよりも優れていた。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:02:38 GMT)
Foundation and Multimodal Large Language Models for Face Presentation and Morph Attack Detection [36.1] プレゼンテーションアタック検出(PAD)とモーフィングアタック検出(MAD)は、信頼できる顔バイオメトリックスの重要な構成要素である。
汎用基礎モデル (FM) とマルチモーダル大言語モデル (MLLM) がPAD関連情報およびMAD関連情報を符号化するかどうかを検討する。
実験により、FMとMLLMはPADとMADに大きな性能を発揮することが示された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:07:31 GMT)
CoCoA: Context-Conditional Cultural Alignment for Large Language Models [35.1] 大規模言語モデル(LLM)は、文化的な文脈において西洋関連エンティティを好んでいることが多い。
文化的バイアス緩和は文脈条件の行動を要求し、文化的な手がかりが存在する場合、文化的に適切な実体を優先し、それらが欠如している場合、中立なままである。
CoCoAは、文化的な手がかりのないコンテキスト下で、同じエンティティペア上での二重コンテキストトレーニングを通じて、この振る舞いを学ぶためのフレームワークである。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 01:04:36 GMT)
Drift Calibration in Geometric Eye Tracking Systems [34.1] 12人の被験者から163回の臨床試験を含む校正中心のデータセットを提示した。
共通空間外挿プロトコルを用いて,グローバル,ローカル,複合的な補正関数の評価を行う。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:05:44 GMT)
DataFoundry: Evolving Data Preparators via Recursive Self-Improvement [34.1] textscDataFoundryは、データプリパレータを進化可能なランタイム仕様として表現し、その進化をtextsc-as-Modulesアーキテクチャでインスタンス化する。
数学,金融学,法学,医学におけるDataPrep-Benchに関するtextscDataFoundryの評価を行った。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:53:24 GMT)
SemTrace: Source-Grounded Semantic Signatures for Tracing LLM Exposure to Protected Documents [33.9] SemTraceは、生成されたレビューが保護された原稿コピーの影響を受けているかどうかを検出するための、ソースグラウンドのセマンティックな透かしである。
保護されたPDFは、視覚的に各バイナリペアから1つの事実を選択し、それらの事実を固定されたレビュースロットで表現するよう指示フォローするレビュアーに要求するコンテンツ契約を伝達する。
凍結した自然言語推論モデルは、結果のセマンティックエビデンスを明示的な消去でデコードし、そのコピーに割り当てられたコードワードに対して回復したビットをスコアする。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:41:20 GMT)
When History Is Multimodal: Rethinking Context Management for Long-Horizon Agents [33.6] ロングホライゾンエージェントは、増大する相互作用履歴を境界付けられた作業コンテキストに圧縮するためにコンテキストマネージャを必要とする。
視覚レンダリング(VR)は、表現型コンテキストマネージャとして導入された。
そこで本研究では,メモリ操作を伴わない決定的レンダリングに基づく学習自由コンテキストマネージャVERAを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:46:16 GMT)
GridFlow: Structured Latent Flow for Seamless City-Scale 3D Point Cloud Generation [33.3] 本稿では,衛星画像,セマンティックセグメンテーションマップ,およびデジタル表面モデルに基づいて,都市規模で色のついた点雲を生成するフレームワークを提案する。
実験の結果、全ての幾何学的指標において、適応されたポイントクラウド生成ベースラインよりも優れています。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:39:36 GMT)
Perceive to Hypothesize, Verify to Ground: An Agentic Reasoning Framework for Open-World Geo-Localization [32.8] オープンワールドのジオローカライゼーションは、多段階の推論を通じて曖昧な視覚的手がかりを推論するモデルを必要とする。
既存のアプローチは、明確な証拠に基づく検証が欠如しているため、知覚の幻覚や文脈の漂流に悩まされている。
本研究では,人間のような知覚的検証的推論問題として地理的ローカライゼーションを再構築し,二段階のエージェント・フレームワークであるGeoPAVEを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:19:10 GMT)
Agent-Driven Verification of Memory Safety for liblzma Decoder Components with VST [32.5] Liblzmaのデコーダコンポーネントのメモリ安全性の検証について報告する。
検証の結果、生のLZMA1ゼロインプット処理における未定義の動作が明らかになった。
検証済みコードを合成する類似の作業とは異なり、既存のプロダクションスケールCを検証する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:50:56 GMT)
IndicDetect: Evaluating Cross-Lingual LLM-Generated Text Detection for Hindi, Telugu, and Tamil [32.2] 我々は,ヒンディー語,テルグ語,タミル語におけるAI生成テキスト検出のベンチマークを示す。
IndicDetectは、現実的な分布シフトの下で検出器の堅牢性を評価するように設計されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:21:55 GMT)
PhysVR: Vision-Language Model Guided Interference-aware Temporal Feature Refinement for Remote Physiological Measurement [30.4] 本稿では,r推定のための視覚言語モデルであるPhysVRを提案する。
並行して、凍結された視覚言語モデルは、干渉指向のプロンプトの下でサンプルされた顔フレームを処理し、エビデンスヘッドは、VLM出力から視覚的干渉証拠を抽出する。
5つの公開ベンチマーク実験により、PhysVRは、データ内およびデータ間評価プロトコルの両方において、代表的手法よりも一貫して優れていることが示された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:56:46 GMT)
MiBOT: A head-worn robot that modulates cardiovascular responses through human-like soft massage [29.9] MiBOTは、人間のマッサージを模倣したタッチモーションを生成するために2つの柔らかいタークターを作動させる頭縫いマッサージロボットである。
対照研究におけるMIBOTの有効性について検討し,血圧と心拍数について検討した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:38:45 GMT)
ARMOR: Manifold-Oriented Training for Adversarially Robust Aerial Object Detection under Data Scarcity [29.6] モデル脆弱性に対処し,データ不足をトレーニングするために,マニフォールド指向トレーニング(ARMOR)を用いた適応ロバストネスを提案する。
ARMORは、低データ体制におけるmanifold adversarial training(OMAT)の中核的な洞察を実現している。
ARMORは0.90以上のモデルの信頼性の強いクリーンな性能を維持しながら、最先端の防御に対するモデルの信頼性を最大0.32向上させる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:14:40 GMT)
Life Operators: a self-evolving framework for multiscale life modelling [29.1] ライフオペレーター:3つの科学的役割を定義するタスク境界マッピングを提案する。
知覚作用素は、マルチモーダル観測からタスク関連生物学的状態を推定し、進化作用素はこれらの状態を自然あるいは介入条件の力学の下で伝播し、生成作用素はそれらを測定可能な信号にマッピングする。
選択された演算子とブリッジは、宣言されたクレームに十分な最小の状態とメカニズムを含むタスク固有の演算子グラフを形成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:27:07 GMT)
Zero-Shot Respiratory Sound Classification through LLM-Augmented Audio-Text Alignment [29.1] 自己監督型呼吸エンコーダは、ゼロショット推論に必要な臨床領域のセマンティックグラウンドを欠いている。
本稿では,これらのエンコーダと医療用語を共用するフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 11:49:54 GMT)
Matrix-Game 3.5: Enhancing Real-Time Streaming Interactive World Models with Patch Memory [28.9] 本稿では,3つの重要な改良点を通じて,リアルタイム対話型ワールドジェネレーションを推し進めるMatrix-Game 3.5を紹介する。
まず、パッチメモリとタイル付きPRoPEコンポーネントが追加で学習可能なパラメータを導入しない統合幾何対応メモリフレームワークを提案する。
第2に、静的なシーン幾何学と動的主題を別々にモデル化した静的な非交叉世界表現を導入する。
第3に、双方向拡散モデルから数ステップの因果生成器に変換する2段階進行リアルタイム蒸留フレームワークを開発する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:11:00 GMT)
See the Change, Keep the Flow: Unsupervised Action Segmentation via Spectral-Temporal Representation Learning [28.8] SpecT-OTは、不均衡な最適輸送擬似ラベルの概念に基づいて構築されたスペクトル時間表現学習フレームワークである。
我々は、SpecT-OTが、BreakfastとDesktop Assemblyのベースラインで4.1ポイントのMoFと7.4ポイントのF1を含む15のメトリクスのうち13のベストな結果を達成することを示した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:04:28 GMT)
LLMODE: Aligning ODEs with LLMs via Gated Token Injection for Irregular Spatio-Temporal Forecasting [27.8] 大規模言語モデル(LLM)は不規則な時間的予測を約束しているが、既存のアプローチは定期的にサンプリングされたトークンシーケンスに依存することが多い。
凍結したバックボーンを用いた表現時間予測のためのトークン効率のよいフレームワーク LLMODE を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:02:20 GMT)
GTA-RAG: Graph-Trajectory-Augmented Reinforcement Learning for Multi-Turn Retrieval-Augmented Reasoning [27.8] グラフトラジェクトリ拡張RLフレームワークであるtextscGTA-RAG について述べる。
メソッドは、Qwen2.5-3BとQwen2.5-7BのバックボーンでRLベースのRAGベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:43:59 GMT)
Detect Before You Attribute: Cascade Failure Attribution for Multi-Agent Systems [27.6] DUOTRACEはLLMベースの障害属性に対するプラグアンドプレイ検出フィルタである。
最初は異常な実行を検出し、下流の帰属法に焦点を絞った軌道証拠を提供する。
実験によると、DUOTRACEはエージェントレベルとステップレベルの属性の精度をそれぞれ8.7%と7.0%改善している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:17:42 GMT)
RePro: Proof-Verified Benchmark Rewriting for Reliable Evaluation of LLM Mathematical Problem Solving [27.4] 本稿では,Lean-oriented Neural theorem proversをベンチマーク書き換えに統合するために,Proof-Verified Benchmark Rewriting (RePro)を提案する。
ReProは問題を書き直し、リーン検証の証明によって確認された正確さで回答を再生する。
GSM8KとMATHの実験では、ReProの保持された再書き込みインスタンスが100%明確に定義され、実現可能であり、答えの正しさが得られることが示されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:23:48 GMT)
D2C-Routing: Dimension-to-Composition Evidence Routing for Mixed-Origin AI-Generated Text Detection [27.4] 混合オリジン検出を次元と構成源の属性として用いた。
本稿では,コンテンツ側および表現側証拠をルートするD2C-Routingを提案する。
コアアブレーションはルーティング設計をサポートし、エラー解析は、AIコンテンツ/人間表現と完全なAI生成テキストを区別することが、最も難しい境界であることを示している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:16:47 GMT)
Not Safe for All: Auditing the Dialect Penalty in Text-to-Image Safety Pipelines [27.3] テキスト・トゥ・イメージ(T2I)の安全ガードレールは、標準でない方言に等しく一般化することができない。
我々はこの失敗を方言のペナルティとして定式化し、フィルタは意味的意図ではなく言語表面の特徴に基づいて引き起こす。
現在のパイプラインは、平均精度ベンチマークによって隠蔽された公平な失敗である方言話者を体系的に失敗する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:19:46 GMT)
SUP-MIMIC: A Multi-Task Clinical Diagnosis Benchmark for Evaluating LLMs' Robustness to Contradictory Evidence [27.2] 既存のベンチマークでは、大きな言語モデルが診断の曖昧さのシナリオに必要な推論能力を持っているかどうかを判断できない。
MIMIC-IV-v3.1を利用したマルチタスクフレームワークSUP-MIMICを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:59:47 GMT)
On the Plasticity Collapse in Continual Machine Unlearning [26.7] マシンアンラーニングは、プライバシと規制要件に応じて、特定のデータの影響を選択的に除去することを可能にする。
前者は単発のアンラーニングを主に研究していたが、現実のシステムは継続的なアンラーニングを許容しなければならない。
連続的な未学習操作はパラメータ空間に幾何的制約を蓄積し、将来の更新を制限する飽和部分空間をもたらすことを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:33:40 GMT)
ICEGR: An Intent-Coherent End-to-End Generative Retrieval Framework for E-commerce Search [26.4] Generative Retrieval (GR)はeコマース検索を約束している。
既存のメソッドは、トレーニングパイプライン全体を通してクエリインテリジェンスを維持するのに苦労している。
本稿では,Eコマース検索のための一貫したエンドツーエンド生成検索フレームワークICEGRを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:28:58 GMT)
JITterFlip: Uncovering Fault Attack Surfaces in JIT-Compiled LLM Serving [26.2] 我々は、GPUベースのLLM推論のホスト側JITサービス制御プレーンをターゲットにした最初のBFAであるJITterFlipを提案する。
大きなJITコンパイラスタックで悪用可能なターゲットを特定するために、JITterFlipは、決定誘導のフォールトフロンティアブルコード解析を開発する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:16:00 GMT)
Evaluating LLMs on Conversational Text-to-SQL under Chain Ambiguity and Intent Drift [25.7] TIDE-Benchは、チェーンのあいまいさと意図のドリフト評価の下での対話型テキストから特定要素のベンチマークである。
1,542のサンプルからなり、実行精度を超えるチェーン識別とドリフト認識のための専用メトリクスを導入している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:24:08 GMT)
SIC-Agents: Benchmarking and Building an Adaptive Simulator for Pediatric Serious Illness Communication Training [25.6] 小児SICトレーニングに適した,最初のベンチマークスイートとシミュレーションフレームワークを紹介する。
我々のベンチマークであるPitfallBenchとDialogueBenchは、ターンレベルとフルダイアログの両方でシミュレータを評価します。
そこで我々は,SIC-Agentsを提案する。SIC-Agentsは,医師が編集可能なスキルドキュメントを生成してシミュレータの動作をガイドする自己改善フレームワークである。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:19:44 GMT)
You Know What I Mean: A Benchmark for Agentic Conversational Reference Grounding [25.1] 協調的な会話は、しばしば名前ではなく間接的な対象である参照を含んでいる。
我々はこの問題をCoRG(Conversational Reference Grounding)として定式化する。
CoRGは、会話と外部のワークスペースに分散した語彙、意味、時間的キューを組み合わせる。
GitHubイシュー、プルリクエスト、コミットに基礎を置いた400の開発者チャットセグメントのベンチマークであるRepoRefを通じて、CoRGを研究します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:06:51 GMT)
Mitigating Over-Optimization in PRM-Guided Search in Mathematical Reasoning by Optimizing the Guide [24.9] PRM誘導探索は、不完全なプロセス報酬を過度に最適化し、スプリアスを拡大しながら、実行可能なトラジェクトリを刈り取ることができることを示す。
我々は、PRM誘導探索を、妥当な報酬摂動に対する堅牢な最適化問題として定式化する。
微調整やオンライン適応がなければ、マキシミンサーチはPRM誘導サーチを平均17~35%改善する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:25:03 GMT)
POLYFLOW: A Neuro-Symbolic Framework for Static Cross-Language Information Flow Analysis [24.8] PolyFlowは言語境界を越えて情報の流れを静的に推論するニューラルネットワークのシンボリックフレームワークである。
PolyFlowは費用対効果が高く,最先端のさまざまなベースラインよりも優れていることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:19:35 GMT)
Which Metrics Save the Most Human Annotation? Prediction-Powered Evaluation and Meta-Evaluation [24.6] 予測による評価は、限られた人間の判断と大規模な自動スコアを組み合わせることで、データ効率のよいシステム比較を得る。
本稿では,自動計測による人間のアノテーションの保存量を測定するメタメトリックである予測パワーセーブ比(PPSR)を紹介する。
我々の新しいパラダイムは、人間の判断を置き換えるのではなく、人間のアノテーションコストを削減するツールとして自動メトリクスを再設定し、検証不可能なタスクに広く適用します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:20:50 GMT)
A Comprehensive Study of Native Code Bugs in Python Applications [24.5] Pythonアプリケーションは、しばしばCのような低レベルプログラミング言語で記述されたネイティブコードコンポーネントを統合する。
この多言語構成は、パフォーマンス効率の向上や、さまざまなランタイム環境との相互運用性の容易化など、さまざまなメリットをもたらします。
しかし、ネイティブコード(すなわちネイティブコードバグ)のバグもまた、Pythonアプリケーション全体の品質に対する大きな課題となっている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:30:07 GMT)
MI-Distillation: Selecting from Model-Interpolated Instruct-Reasoning Data Spectrum for Chain-of-Thought Distillation [24.0] モデルを用いて連続的なインストラクション・推論データスペクトルを構築するフレームワークである textbfMI-Distillation を提案する。
推理ベンチマーク実験により、MI蒸留は強力なロングCoTベースラインよりも小さなモデルCoT蒸留を一貫して改善することが示された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:32:22 GMT)
OCGQuant: Outlier-Companion Grouping for NVFP4 Quantization [24.0] Outlier-Companion Grouping (OCG) は、NVFP4アクティベーションブロック構成を改善するために、低マグニチュードのコンパニオンチャネルと外部チャネルを適応的にペアリングする。
OCGQuantは、評価されたPTQ手法の中で、WikiText-2の難易度が最も低く、下流の平均精度が高い。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:00:11 GMT)
SpatialTrust: A Benchmark for Environmental Risk Recognition in Secure Authentication [23.7] 本研究では,セキュアな認証における環境リスク認識のためのベンチマークであるSpatialTrustを提案する。
現在のモデルでは、特に間接的リスクの理解と説明において、パフォーマンスが制限されていることが分かっています。
本研究は,MLLMのセキュアな認証における信頼性を向上させるために,専用ベンチマークと構造化推論手法の必要性を強調した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:37:58 GMT)
From Detection to Refusal: Safer LLMs via Circuit-Guided Weight Scaling [23.2] 大規模言語モデル(LLM)は、敵対的プロンプトの下で安全でないコンテンツを生成するのに脆弱である。
機械的解釈可能性の観点から安全性を研究し、多段*安全回路を特徴付ける*
我々は、上流のハーモフル検出ヘッドの抑制が下流の拒絶動作を妨害し、安全ニューロンがこの相互作用を媒介することを示した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:01:42 GMT)
TrAct: Bridging Robot Control and Visual Prediction with Visual Tracks [22.7] 制御と予測の中間インタフェースとして視覚トラックを用いた世界モデルに基づくロボット意思決定フレームワークTrActを提案する。
TrActは3つのコンポーネントから構成される: ビジョン・ランゲージ・アクション・アンド・トラックモデル(VLAT)は、現在の観察と言語指導から候補行動と対応する視覚トラックを共同で予測し、トラック条件付き世界モデル(TWM)は、提案されたトラックで条件付けられた将来の視覚結果を予測する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 01:29:15 GMT)
A Formal Analysis of Agent Payment Protocols [21.9] 自動商取引における重要なトランザクション層としてエージェント支払いプロトコルが登場している。
我々はタマリンでx402,MPP,ACP,AP2の4つの代表エージェント支払いプロトコルを定式化した。
ソースバックの検証質問と反例トレースを使用して、欠落したバインディング、状態制約、およびステージ横断の対応を公開します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:04:15 GMT)
MoPLEx: Estimating Plackett-Luce Mixture Models for Multi-Objective Alignment [21.7] 我々は、アノテータからのマルチウェイランキング応答から、$k$ Plackett-Luceモデルの混合を学習する。
我々は、まずランクをより大きなサイズに増やすことにより、この問題に対処する効率的なアルゴリズムを設計する。
勾配に基づく近似は、最大34億のパラメータを持つモデル上で5%未満の誤差で真の確率を推定する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:16:22 GMT)
Callability Is Not Operability: Controlled Interface Interventions for LLM Agents [21.5] 我々は,エージェントが操作上の不確実性の下で安全に継続するために必要なアクション関連状態と意味をツールインターフェースが公開するかどうかを検討する。
我々は,エージェントファーストツーリング(AFT)によるツールの操作性,選択的機能発見,実行ライフサイクルとリカバリ,明示的な外部効果セマンティクス,マシン可読結果,および後条件検証を対象とするインターフェース機構のセットを運用する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:41:41 GMT)
PhasorNet: Learning Structure from Frequency for Real-Time Stereo Matching [21.2] PhasorNetは、周波数領域キューによる幾何学的識別を促進する強力なフレームワークである。
PhasorNetは5.3Mのパラメータしか持たず、挑戦的なETH3Dベンチマークで最先端のパフォーマンスを達成した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:41:36 GMT)
MedCache: Efficient and Temporally Valid Memory for Longitudinal Clinical Agents [21.2] 本報告では, 長期的証拠検索, クロスタイム的証拠収集, およびクロステキスト的臨床推論を評価するマルチビジット・マルチコンテキスト患者記録のベンチマークについて紹介する。
このベンチマークを用いて、我々は、キュレーション、組織、検索、およびメモリ拡張推論の4つのメモリ設計選択を体系的に研究した。
我々は、時間的に有効な患者記憶を構築し、エビデンスを重複する専門的なビューに整理し、各クエリを関連記憶にルーティングし、1つまたは複数の専門家を適応的に呼び出すハイブリッドフレームワークであるtextitMedCacheを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:28:56 GMT)
JPO: Juris Policy Optimization for Structured Legal Reasoning in Criminal Judgment Prediction [20.5] 刑事判断予測は、事件事実から法定記事、告訴、判決結果を推測するモデルを必要とする。
我々は,中国の刑事判決予測における構造化法的推論の枠組みであるJPO(Juris Policy Optimization)を提案する。
JPOは、法的な予測品質、推論構造完全性、ステップ間の整合性に対する複合的な報酬を伴う強化学習を適用している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:14:02 GMT)
ProgRouter: Online Progress-Guided Orchestration for Multi-Agent LLM Workflows under Quality-Cost Tradeoffs [20.4] 複雑でオープンなタスクを解決するための強力なパラダイムとして,マルチエージェント大規模言語モデル(LLM)が登場した。
既存のカスケードルーティング手法は、単発で状態依存的な決定をし、マルチステップクエリレベルの決定の動的で状態依存的な性質に適応できない。
Progはオンラインのプログレッシブ誘導型ルーティングフレームワークで、ワークフローステップ全体にわたってLLMエージェントを適応的に選択し、時間とコストの予算を守りながらタスク解決品質を維持する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:09:33 GMT)
FoundYou: A Unified Model for Personalized Segmentation and Retrieval [20.4] ビデオフレーム間でオブジェクトの同一性を維持するために訓練されたSegment Anything 2 (SAM2) は、本質的にインスタンスレベルのキューをキャプチャする。
この特性を利用してオブジェクトを独立した画像にマッチさせ、セグメント化と検索を同一のインスタンスアライメントプロセスの2つの結果として実現します。
この統合ビューは、パーソナライズされた検索や、フレキシブルなプロンプトによるパーソナライズ可能なセグメンテーションなど、従来のベンチマーク以上の新機能をアンロックする。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:19:24 GMT)
GUI-CC: Benchmarking Contextual Consistency of GUI World Models as Agent Environments [20.3] エージェント環境としてGUIワールドモデルのコンテキスト整合性を評価するベンチマークGUI-CCを紹介する。
我々はGUIOdysseyから500のオフライントラジェクトリタスクを構築し、30のモバイルアプリで200のエミュレータ認証オンラインタスクを構築した。
実験により、信頼性の高い環境シミュレーションは保証されないことが示された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:19:43 GMT)
DISTAL: Distillation and Self-Supervised Pretraining for Structure-Agnostic Materials Property Prediction [20.2] DISTALは、構造に依存しない材料特性予測のための二元的なフレームワークである。
自己監督型合成前訓練と構造認識型知識蒸留を組み合わせる。
DISTALは、評価された全ての機能の組み合わせの中で、最も高い総合的なパフォーマンスを達成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:00:55 GMT)
Spec2Twin-Chain: Orchestrating Bi-Level Optimization with LLMs for Blockchain Digital Twin Construction [19.4] ブロックチェーンのディジタルツインを構築するには、ドメイン知識と特定のシステム記述をシミュレータアーキテクチャに翻訳する必要がある。
ブロックチェーンのデジタル双対構造を二段階最適化問題として定式化するフレームワークであるSpec2Twin-Chainを通じて、このプロセスを自動化することを検討する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:25:00 GMT)
The Emergent Symbolic Structure of Artificial Neural Networks [19.0] ニューラルネットワークの内部表現は暗黙的に記号構造を実現する。
この発見は、リストを操作するために訓練された小規模ニューラルネットワークと、大規模な言語モデルの両方に当てはまる。
この研究は、長年の象徴的インテリジェンスの概念と、現代のAIのベクトルに基づく性質を調和させる潜在的方法を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:32:13 GMT)
Counter with Evidence! A Multi-Agent Memory Efficient Reasoning Framework for Hate Category Informed Counterspeech Generation [19.0] FIRE(Factuality Informed Multi-Agent Reasoning Framework)を導入し,まずヘイトスピーチを5つのカテゴリーの1つに分解する。
FIREは, コンパクトエージェントを用いても, 既存の手法をはるかに上回っていることを示す。
我々は、ヘイトスピーチの根底にある意図を分解することは、安全で効果的で、文脈的に正確な反音声を生成するために不可欠である、と結論付けた。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:28:49 GMT)
Predicting the Unpredictable: LLM-powered Long-term Chaotic Time Series Forecasting under Short-term Observations [17.5] 長期カオス時系列予測のための位相空間対応型適応融合フレームワークであるPAC-LLMを提案する。
提案手法は,短期および長期の予測において,既存の微調整ベースラインとゼロショットベースラインより優れる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:56:08 GMT)
Adversarial Online Classification with a Preview [17.5] 最悪のオンライン分類は、リトルストーン次元のようなシーケンシャルな複雑さによって管理されている。
オンラインの順序をランダムにすることなく、古典的な統計次元によって、ランダムなプレビューが最悪ケースのシーケンシャルな複雑さを置き換えることができることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 01:38:49 GMT)
AMINA: The Inclusive and Accountable AI for Marginalized Immigrant Nonprofit Assistance [17.5] 本稿では,イラン移民の非営利実践者との3段階の混合メタドス研究について報告する。
調査の結果は、正当性障壁、キャパシティギャップ、政治的に告発された誤報が非営利活動にどのような制約を与えるかを強調した。
我々はこれらの洞察を、包括的非営利AIアシスタントの設計目標に翻訳する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:17:06 GMT)
AGM: Achievement-Grounded Memory for Closed-Loop Agents with Frozen VLA Policies [17.1] 本稿では,凍結視覚言語行動(VLA)ポリシーのためのAGM(Achievement-Grounded Memory)を提案する。
AGMは、タスクをプログレスポインタ付きサブゴールシーケンスとして表現し、現在のサブゴールが物理的証拠によって検証された後にのみ、このメモリを前進させる。
RoboMME Countingベンチマークでは、AGMがPickXTimesとBinFillに到達し、メモリ拡張ベースラインを平均で上回っている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:50:49 GMT)
Influence-Directed Distillation: Solving the Diversity Bottleneck in Sampled-Token On-Policy Distillation [17.0] 影響指向型適応型オンポリシィ蒸留(IDA-OPD)を提案する。
IDA-OPDはエントロピー適応型更新を保存し、エントロピー圧縮型更新をばらつき拡大による利点縮小に置き換える。
推論指向蒸留の実験では、IDA-OPDはパス@k$を一貫して改善し、蒸留を通じて教師の多様性を継承する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:22:46 GMT)
Do Multimodal LLMs See Before They Read? Diagnosing Contextual Sycophancy [16.5] 外部テキストは、マルチモーダルな大言語モデルにおける矛盾する画像証拠をオーバーライドすることができる。
視覚的エビデンス,コモンセンス先行,外部テキストを独立に変化させる998ケースの診断を導入し,この障害が発生した場合,コンテキストブラインドされた視覚的目撃者を中心に情報境界を移動させることで探索する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:19:33 GMT)
Budget-Aware Compression Pipeline for Single-GPU LLM Inference: Methods, Trade-offs, and Coupling Effects [16.3] 我々は,現実的な実行下でのプルーニング,量子化,KV-cache圧縮の相互作用を示す。
我々は実用的なパイプラインを構築し、70Bモデルを約33GBに圧縮し、10kトークンプロンプトで約57トークン/秒を持続し、共通および推論ベンチマークで5%以内の絶対精度を維持した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:54:40 GMT)
Pak3H: Evaluating the Cost of Cultural Mismatch in LLM Alignment with a Human-Contextualized Urdu Benchmark [16.1] 我々はPak3H1を紹介した。Pak3H1は3Hアライメントのための、人類初の、文化的に文脈化されたUrduベンチマークスイートである。
筆者らのパイプラインは,手動による文化的適応と辞書誘導編集を統合して,母国語話者の判断を優先する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:12:03 GMT)
Tracing Generated Samples to Training-Data Clusters in Flow-Matching Models [16.0] フローマッチングにおいて、トレーニングサンプルは生成軌跡に沿った速度場を通して生成された画像に影響を与える。
本研究は,ハイブリッド解析学習手法による流れマッチングモデルの帰属性について検討する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:08:04 GMT)
Towards an Expressivity-Normalized Energy-Demand Comparison of ANNs and SNNs [15.9] スパイキングニューラルネットワーク(SNN)は、しばしば人工ニューラルネットワーク(ANN)のエネルギー効率の良い代替品とみなされる。
時系列データに対する完全接続型ReLU ANNと統合型SNNを比較するための分析フレームワークを開発した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:56:17 GMT)
Blind Dexterity: Whole-Body Humanoid Manipulation via Pure Proprioception [15.7] 我々はUnitree G1ヒューマノイドにブラインド、全身操作のスキルを提示する。
私たちは、カメラ、マーカー、フォーストルク、触覚センサーを使わずに、オンボードのプロリオセプションのみを使用します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:32:01 GMT)
Event-triggered Control and Online Learning for Networked Systems under Computational Delays [15.7] リソース集約型オンライン学習アルゴリズムは、非無視の計算遅延を導入する。
遠隔計算ノード上に学習ベースのコントローラを配置することにより、ネットワーク内オンライン学習ベースの制御構造を用いる。
イベントトリガード戦略の提案は、時間トリガードシナリオと同じ制御性能を実現することが証明されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:45:00 GMT)
R$^2$A: Learning Persona Policies Through Persona Representation Learning and Runtime Alignment [15.4] 同じペルソナの振る舞いは、あるコンテキストでは有益だが、別のコンテキストでは有害である。
本稿では,Persona Selection-Realization Frameworkを紹介した。
ペルソナ政策を学習するための2段階のアプローチであるR$2$Aを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:55:09 GMT)
Biomechanical 3D Body: Self-Supervised Distillation of Biomechanical Pose from a 3D Body Foundation Model [15.4] 我々は既存の基盤モデルSAM-3D-Bodyを拡張し、生体力学モデルの関節角度とスケールを補強する生体力学的予測ヘッドを追加する。
これを解決するために, 逆キネマティクスを行うLevenberg-Marquardtソルバのループ内最適化目標を用いたバイオメカニカルアウトプットを, メッシュ予測のマーカーに適合させる。
我々は,このモデルを2つのマーカーベースデータセット(MoViとBioCV)に適合する生体力学的適合性,およびマルチビューマーカーレスモーションキャプチャーによる臨床コホートからの移動性について検証した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:46:11 GMT)
SnapBench: Benchmarking Snap-and-Ask Multimodal Retrieval for Mobile Interactions [15.4] Snap-and-ask検索は、モバイルAIの最も一般的なエントリポイントの1つである。
既存のベンチマークはクリーンな入力のみをテストするか、スナップ・アンド・アズク検索でペアを分離しない。
SnapBenchは、堅牢なスナップ・アンド・アズクマルチモーダル検索のための最初のペアベンチマークである。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:56:11 GMT)
FuncRoom-Agent: Sequential Feed-Forward 3D Functional Indoor Scene Generation [15.4] 本稿では,室内3Dシーン生成環境であるFunction-Room Generationを紹介する。
既存のエージェントおよび実行可能メソッドは制御性を改善するが、しばしばコストのかかるテスト時間生成--evaluate-reviseループに依存する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:48:11 GMT)
How do World Models and Policies Compose in LLM Agents? A Joint Spectral and Behavioral Account [15.3] 我々は世界モデルトレーニング(次世代予測)と政策トレーニング(リワード)を組み合わせる。
効果的なワールドモデル更新は低ランクであり、入力機能サブスペースをポリシー更新と共有する。
政策トレーニングは世界的知識をできるだけ保存するだろうか?
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:21:16 GMT)
InteractBench: Benchmarking LLMs on Competitive Programming under Unrevealed Information [15.2] Codeforces, AtCoder, IOI, ICPCから算出した322の高品質な対話型問題からなるベンチマークであるInteractBenchを紹介する。
各問題は実行可能ローカルインタラクタでパッケージ化され、完全にオフラインで評価できる。
もっとも先進的な推論モデルでさえ、対話的な問題において限られた成功を達成している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:50:53 GMT)
RePair: Turning Retrieval Failures into Counterfactual Hard Pairs [15.1] RePairは、偽陽性を双方向にマイニングし、LLM誘導の反ファクト編集を適用し、ローカルなハードペアの対照的な目的を持つ列車を訓練する。
Flickr30KとCOCO30Kでは、RePairは107Kの合成サンプルで制御された拡張ベースラインを上回っている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:47:38 GMT)
Task-Specific Prompt with Global Context for Multi-Task Graph Pre-Training [15.1] 本稿では,タスク前と構造前との相乗効果を明示的にモデル化する二元的プロンプトソリューションTPGCを提案する。
TPGCは、最先端のベースラインよりも、数ショット設定で一貫してパフォーマンスが向上し、ダウンストリームパラメータが減り、ランタイムが低くなった。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:28:51 GMT)
Learning Agile Perceptive Traversal of Sparse 3D Structures for Humanoids [15.0] スパース3D構造をトラバースするには、人間型ロボットは、アジャイルな全身の動きを実行しながら、薄くて重なり合う幾何学を知覚する必要がある。
本稿では,ヘッドマウント固体ライダーからの観測を直接操作する強化学習に基づく知覚制御システムを提案する。
結果として得られたポリシーは、3つのバー構成で15のトライアル中14の完全なジャンプアップ>ブラキション>ジャンプダウンシーケンスを完了した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:56:43 GMT)
"Act Like a 5th Grader" is Not Enough: Bounding Knowledge in LLM-Based User Simulators [15.0] 大規模言語モデル(LLM)は、人間の振る舞いをシミュレートするために使われることが多いが、現実的な認知的制約を示すのに失敗することが多い。
標準的なペルソナは、ほぼ完璧で決定論的性能を示し、発展途上の読者の自然な分散を捉えていない。
我々は,若手読者の限られたワーキングメモリを明示的にモデル化するアーキテクチャフレームワークであるCognitively bounded User Simulator (CBUS)を紹介する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:44:17 GMT)
Evolutionary Soups: Evolving Mixture-of-Experts for Multi-Objective LLM Alignment [14.9] 大規模言語モデルは、競合する複数の目的を満たす応答を生成するためにますます必要となる。
本稿では,進化的アルゴリズムを用いて学習したゲーティングネットワークを用いた微細な生成のためのフレームワークであるEvolutionary Soupsを提案する。
3つのタスクにわたる実験は、ベースラインを越えて進化的スープの有効性を示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:09:59 GMT)
GUIDE: Generative Unsupervised Chinese Query Correction via Phonetic and Visual Shared-ID Encoding [14.8] コンテンツプラットフォーム上での検索およびクエリレコメンデーションには,中国語クエリ修正(CQC)が重要である。
コンフュージョン・テーマ・明確化パラダイムに基づくCQCのための生成的教師なしフレームワークであるtextscGUIDEを提案する。
textscGUIDEは、音声または視覚的に混乱した文字を共有IDでエンコードし、エンコーダ・デコーダアーキテクチャで元のクエリを再構築する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:43:11 GMT)
AcrossWAM1.0:A Modular Latent World-Action Stack for Compact Robot Policies [14.6] 本稿では,LaWAMの潜在的ワールドアクションスタックのモジュール化とスケーリングに関する研究であるAcrossWAM1.0を紹介する。
AcrossWAM1.0は、コンパクトな潜在世界アクションポリシーのための監査可能なソフトウェアと評価バウンダリを提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:09:17 GMT)
CineForge: Self-Improving Agents for Long-Horizon Video Generation [14.1] ロングホライゾンのストーリー駆動ビデオ生成は、物語の分解、状態追跡、ショットデザイン、素早い構築、レンダリング、相互依存シーン間のリビジョンをコーディネートするためのプロダクションエージェントを必要とする。
本稿では,CineForge-EvolveとCineForge-Produceを結合した自己進化型ビデオ制作エージェントフレームワークCineForgeを紹介する。
CineForge-Evolveは、CPPE(Case-to-Pattern-to-Policy Evolution)を使用して、軌道証拠をレビューし、再帰的な結果を有界なステージローカルパッチに集約し、構造的リプレイと信頼性制御されたペアリング評価を通じて検証された更新をデプロイする。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:29:46 GMT)
Last Step Matters: Early Uncertainty Cannot Predict Failure in Long-Horizon Agents [13.6] タイムリーな介入を可能にし、推論とツール使用コストを削減できるため、長期的なエージェントにとって早期の障害予測が重要である。
我々は,ディープラーニングタスクにおける主流の不確実性信号を評価し,言語的信頼度が軌道完了時の失敗を確実に区別することを発見した。
経路切換では、エージェントが現在の探索方向を軌跡内で頻繁に放棄し、初期信号と最終結果とのリンクを断ち切る。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:43:08 GMT)
Which LLM for Which Work? Budgeted Model Allocation under Uncertain Evaluation [13.4] 証拠と整合したすべての品質表で、1つの代入が最適かどうかを問う。
固定予算問題に対して、これは正確に2つの解決証明書を付与する: 推定テーブルで1回、最低テーブルで1回解決する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:00:43 GMT)
When Seeing Is Not Enough: Benchmarking Interactive Visual Grounding in LVLMs [13.3] 視覚的グラウンドティングは、情報的参照表現から視覚的ターゲットへのワンショットマッピングとして評価される。
大規模視覚言語モデルにおける対話型視覚接地のための制御された評価フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:39:24 GMT)
Enhancing Bayesian Optimization and Active Learning Through Kernel Diversity [13.1] 本稿では, Ensemble Gaussian Processes (EGP) と不一致認識獲得戦略を統合した統合フレームワーク KENDO を提案する。
KENDO-BOは最先端の手法と比較して、競争力や優れた最適化性能を達成している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:21:07 GMT)
Self-Aware Active Learning Enables Continual Improvement in Autonomous Driving [12.7] SAGE(Self-Aware Guided Exploring)は、自動運転の訓練後適応のためのアクティブな学習フレームワークである。
好奇心は、脅威に対する介入しきい値を適応的に調整し、エージェントがコンテキスト依存的な方法でリスクを規制できるようにする。
Fearは、パフォーマンスのレグレッションを減らすために、安全指向の制約としてポリシー最適化と評価に統合されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:01:32 GMT)
Learning Human Health and Diseases from 24-hour Wrist Movement [12.6] 本研究では,3軸式手首運動24時間から直接,汎用的な健康表現を学習する自己指導型基礎モデルであるSensoryを提案する。
我々は、イギリス、中国、米国から4つの人口ベースコホートにまたがるモデルを開発し、評価した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 01:13:38 GMT)
CUDA-Harness: Harnessing Agentic CUDA Kernel Generation and Optimization from Natural Language [12.5] Text2CUDAは、自然言語(Text2CUDA)から直接カーネルを生成する。
LLM(Large Language Models)は、LLMベースのカーネル生成を探求する一連の研究を促進する。
本稿では,自然言語からエージェント型カーネルレベルの最適化を実現するフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:51:43 GMT)
Beyond Global Realism: Virtual Try-On Evaluation and Optimization with Dimension-wise Garment Fidelity Assessment [12.5] 仮想試行のための次元ワイドアセスメントフレームワークを提案する。
衣服の一貫性を7つの解釈可能な次元に分解する。
本手法は,バランスの取れた精度で最先端の性能を実現する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:08:40 GMT)
Dior: Drawing the Light of Image via Material-Decoupled Illumination Representation [12.4] 制御可能な画像のリライトは画像編集において重要な問題であり、手書きのスクリブルは所望の照明を指定するための直感的なインターフェースを提供する。
我々はLumi Mapと呼ばれる物質分離照明表現を導入し、ユーザスクリブルと結果の照度との明示的なマッピングを確立する。
次に手書きストロークによって制御される画像のリライト方法であるDior-Lightを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:41:17 GMT)
Partition-Aware Unlearning for Removing Spurious Correlations in Large Vision-Language Models [12.3] LVLM(Large Vision-Language Models)は多くのマルチモーダルタスクにおいて高いパフォーマンスを達成する。
それらはしばしば、刺激的なオブジェクト背景の堅牢性を利用しており、結果として、オブジェクト関連の視覚的証拠ではなく、文脈的ショートカットによって引き起こされる予測をもたらす。
我々は,LVLMにおけるスプリラス相関による障害を構築,ベンチマーク,緩和するフレームワークであるPURGEを紹介する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:42:47 GMT)
SmoothRL: Online Reinforcement Learning During Asynchronous Execution [12.2] 物理的な世界でロボットポリシーをデプロイするには、信頼性とスムーズなリアルタイム実行という、2つの基本的なデシダータを満たす必要がある。
SmoothRLは、非同期推論ループ内で事前訓練されたポリシーを微調整するオンライン強化学習フレームワークである。
我々は,SmoothRLを実世界のロボットタスクに対して高い精度で評価し,非同期実行を必要とする高ダイナミックなタスクについて検討した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:56:09 GMT)
Spatial Matryoshka Training for Multi-Granularity Visual Document Retrieval [12.1] ColSNAPは、バックボーンのパッチグリッドから直接圧縮レベルのネスト階層を生成するトレーニング手法である。
我々は,ColSNAPを用いてトレーニングしたモデルが,精度の高い圧縮条件下でほぼ完全解像検索性能を維持していることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:27:06 GMT)
RAPIDMap: Rapid Multi-Agent Pipeline for Interpretable Disaster Mapping from Satellite and Street-view Imagery [12.0] 本稿では,衛星画像とストリートビュー画像からのゼロショット解釈型災害マッピングのための高速マルチエージェントパイプラインを提案する。
このフレームワークは、災害認識エージェント(DPA)、画像復元エージェント(IRA)、災害認識エージェント(DRA)、災害マッピングエージェント(DMA)の4つのインテリジェントエージェントを統合している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:20:59 GMT)
InspectorGPT: A Comparative Reasoning Enhanced VLM for Comprehensive Industrial Anomaly Detection [11.9] 産業異常検出は現代製造業の重要な要素である。
比較推論を中心としたVLMフレームワークであるInspectorGPTを提案する。
我々は、見つからないベンチマークに対して、優れた多次元性能と一般化を示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:22:42 GMT)
SearchWiki: Learning to Build and Navigate Knowledge Wikis for Active Information Seeking [11.5] SearchWikiは、コーパスを階層的で型付けされ、ナビゲート可能なwikiに合成するフレームワークである。
我々は、WikiResearcher-9Bというエージェントを訓練し、マルチターンツールの使用を通して情報を取得する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:36:13 GMT)
Auditing Harness Tampering in Self-Improving Agents [11.3] 我々は、この現象をハーネスの改ざんと呼び、報酬と測定の改ざんから完全な自己改善ライフサイクルまでの概念を拡張した。
本稿では,その原因となる機能的役割と,それが犯す義務によって,各編集のミスアライメントを分類する2軸分類法を提案する。
結果は、ハーネスの改ざんは、異なるエージェントの実際の実行中に一貫して発生し、しばしば最良のエージェントの系統に持続し、分類学全体で異なるシステム固有のプロファイルを形成することを示した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:18:56 GMT)
ValueGraph: Value-Signal Guided Graph Pre-training for Contextualized User Representation [11.3] 価値信号はユーザレベルのモラル表現を集約したもので、ユーザの推論された価値関連傾向をオンライン談話から捉えます。
本研究では、文脈化されたユーザ表現のためのノイズの多い補助信号として、自動推論された道徳値信号を利用するグラフ事前学習フレームワークであるValueGraphを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:39:30 GMT)
Interpreting and Steering for Safe and Correct Code Generation [11.2] 我々は,大規模言語モデル(LLM)のコンポーネントによってコードの安全性がいかに表現されるか,あるいは駆動されるかを検討する。
CodeSec-Pairsは9,342のPythonセーフ・アンド・バルナブルなコントラストコードペアのデータセットです。
我々は、注意頭に対して安全性とコードの正確性を同時に適用するダブルステアリングアプローチであるDuoSteerを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:30:14 GMT)
Context or Digits? Balancing Memorability and Efficiency in Virtual Reality Authentication [11.2] Adaptive Direction-Based Authentication (ADBA) は、仮想現実の知識に基づく認証手法である。
ADBAは仮想環境コンテキストに基づいてパスワード作成を強制することで、ユーザの要求を一時的に切り離す。
この設計は、新しいパスワードに対する記憶可能性の優先順位を付け、ユーザの進化するニーズをサポートするために、効率的かつ記憶可能な選択肢を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:33:21 GMT)
When Less is More: Understanding When Token Filtering Helps and Fails in AI-generated Text Detection [11.1] 診断プローブとして、上位$k$累積確率フィルタリングを導入する。
低エントロピートークンが有害であるが、強いソースLMが有害でない場合、フィルタリングは弱いソースLMに役立ちます。
我々の研究は、いくつかのトークンが単に非形式的であるだけでなく、エントロピーの誤校正によって体系的に有害であることを示す最初の体系的な分析を提供し、トークンレベルの検出において両面的なトレードオフが明らかとなった。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:00:06 GMT)
Hallucination Mitigation for Large Vision-Language Models via Implicit Feature Stabilization [11.1] LVLM(Large Vision-Language Models)は、画像にないオブジェクト、属性、シーンを柔軟に記述する。
この障害の一部は、その表現の計測可能な性質、特徴不安定と結びついており、ここでは、入力の温和なセマンティクス保存の摂動が、学習された埋め込みに大きな変化をもたらす。
既存の安定性をモチベーションとしたリメディエーションは、遅延ステアリングや制約付きデコーディングを通じて推論時に介入し、クエリ毎に支払いを行うという意味で明確である。
摂動不変性は、微調整中にモデル重みに組み込まれ、デプロイ時に余分に実行されるものはない。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:39:38 GMT)
GeoRay: Gauge-Aware Feed-Forward Satellite 3D Reconstruction in the Geodetic Frame [11.0] パースペクティブに制約された特徴、絶対標高、モノクラーおよびマルチビューキューを扱う方法。
軽量な ray-consistent アダプタは、凍結したバックボーンをネイティブな RPC 線に沿って適合させる。
18のシステムの絶対フレームベンチマークであるStandardは、登録やテスト参照リークなしに絶対配置をスコア付けします。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:27:36 GMT)
SkillForge: Compositional Skill Synthesis with Verification-in-the-Loop for Generating Formally Verified Dafny Programs [10.9] 我々は、形式的なコード合成をアトミックで再利用可能なスキルのライブラリに分解するフレームワークであるSKILLFORGEを紹介する。
検証駆動ハーネスはこれらのスキルを編成する。
Dafny仕様のペアに対する自然言語のキュレートされたベンチマークでは、SKILLFORGEは最先端のエージェントアプローチよりも大幅に優れている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:15:00 GMT)
Reward-guided Fine-Tuning of One-Step Generative Models via Wasserstein Gradient Flow [10.9] 本稿では,Wasserstein Gradient Flowを用いた1ステップ生成モデルの報酬誘導微調整を提案する。
我々は、報酬勾配を必要としない実践的な訓練手法を導出し、非微分可能報酬と微分可能報酬の両方を扱います。
本手法は,報酬のハッキングとモード崩壊を緩和しつつ,スムーズで安定した報奨誘導型分布更新を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:18:30 GMT)
Do LLMs Change Their Minds Like Humans? Diagnosing Human--LLM Divergence in Single-Turn Persuasion Judgments [10.7] 大規模言語モデル (LLMs) は、社会シミュレーションの参加者のためのプロキシとして、ますます多くデプロイされている。
自然発生型オンライン説得コーパスを用いて体系的な比較を行う。
以上の結果から,LSMは人間とわずかに一致していることがわかった。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:08:06 GMT)
Training-Free Action Correction for VLA Model Failures via Language Feedback [10.6] 我々は,タスクレベルの自然言語修正を政策重みを変更せずに付加的な行動大調整に変換するフレームワークであるCorrectVLAを提案する。
シミュレーションでは、CorrectVLAは、配信中のタスクとOODタスクの両方にわたる実行ミスアライメント障害を回復する。
ポリシーが正しい目標に達するが、アクションの規模を誤る実行ミスアライメント障害は、修正可能なサブセットを表す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:54:03 GMT)
AutoCRAT: Within-trajectory Joint Control of Stochasticity and Compute for LLM Reasoning [10.4] 大規模言語モデル(LLM)は、時間決定に大きく依存する強力な推論性能を達成する。
最近の適応的手法はこの制限に部分的に対処するが、主に推奨の復号性(モデルがどのように探索するか)や計算の推論(モデル理由の期間)を分離して適用する。
軌道内ジョイントコントロールビューを導入し,AutoCRATでインスタンス化する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:24:58 GMT)
Demonstration of traveling-wave interactions between spontaneous photon emissions and atoms in a chiral F-P cavity [10.4] 光ヘリシティを保ち得るF-Pキャビティにおける走行波-原子-光相互作用を実験的に実証した。
この研究は、F-P空洞における移動波-原子-光子相互作用の実証の道を開く。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:35:52 GMT)
DVBench: Benchmarking MLLMs for Understanding Dynamic Charts and Narratives in Data Videos [10.3] データビデオ上でMLLMを評価するベンチマークであるDVBenchを紹介する。
DVBenchは300の現実世界のデータビデオと、厳格な半自動パイプラインでキュレートされた1000の人間検証QAペアで構成されている。
オープンソースのモデル性能はパラメータサイズに厳密にスケールせず、物語の習熟度は視覚能力を保証することができない。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:38:29 GMT)
Breaking Ambient Trust: In-Network Per-Process Access Control Against Lateral Movement [10.3] NetZoneはネットワーク内アクセス制御であり、各ユーザープロセスを固定アクセス範囲に制限する。
AccessScopeは、ユーザのプロセスに結びついた軽量なアクセス機能を表す。
評価の結果,NetZoneは目立ったオーバーヘッドを発生させることなく,高度な攻撃シナリオを効果的に防御できることがわかった。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:10:48 GMT)
RegionCache: Semantic-Aware Region Reuse for Efficient Multi-Turn Image Generation [10.3] RegionCacheは、マルチターン画像編集のためのセマンティックな再利用フレームワークである。
異なる領域からの拡散状態を選択的に再利用する。
1.43x--2.55xの画像品質を維持しながら、エンドツーエンドのスピードアップを実現している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:21:46 GMT)
Towards Reliable, Generalizable, and Specific In-Context Knowledge Editing via Multi-Objective Reinforcement Learning [10.0] 大規模言語モデル(LLM)は強力だが、事前学習が終わると時代遅れになる静的パラメトリック知識によって制限される。
テキスト内知識の編集は、トレーニング不要で、ブラックボックスのLSMにも容易に適用できるため注目されている。
In-context Knowledge Editing (MO-IKE) を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:32:27 GMT)
RubricRM: Generative Reward Modeling via Dynamic Rubrics for Image Generation and Editing [9.9] 本稿では,評価次元,重み,評価基準を有する入力固有ルーリックを生成し,そのルーリックを候補画像に応用するペアワイズ生成報酬モデリングフレームワークを提案する。
我々は、2段階のトレーニングパイプラインを用いて、テキスト・ツー・イメージ生成と画像編集のための専用RMモデルを訓練する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:51:39 GMT)
ManGo: Manga Active Narrative Grounding Optimization [9.5] マンガの視覚的質問応答には、パネルベースの視覚的物語に関する質問に答えるモデルが必要である。
アクティブマンガ視覚質問応答のための教師なしフレームワークであるManGoを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:47:45 GMT)
A Sliding Window Filter on the Galilean Group for Consistent Aided Inertial Navigation with Unknown Measurement Delays [9.5] 本研究では、補助センサ測定が未知の一定の遅延を受ける場合の補助ナビゲーションについて検討した。
目的は、遅延測定が適切なタイミングで軌道を補正するように、遅延状態と航法状態を共同で推定することである。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:34:28 GMT)
BEACON: Behavioral and Semantic Enrichment of AlphaEarth Embeddings through Tri-Modal Contrastive Learning [9.5] 都市空間の3つの視点を整合させる3モーダル・コントラスト学習フレームワークBEACONを提案する。
BEACONはAlphaEarthに対する相対R2を、肥満の有病率で43%、精神疾患で34%、中央値の世帯所得で22%まで改善している。
これらの知見は,意味的および行動的信号を用いた地理空間基盤モデルの付加価値を浮き彫りにした。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:46:23 GMT)
HSMLog: Small Language Model-Assisted Hardware Security Module Log Anomaly Detection with Behavioral Analysis [9.2] HSMLogはHSMログ異常検出のための2段階のフレームワークである。
産業パートナーと共同で定義された異常シナリオを付加した実産業用HSMバックグラウンドログの評価。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:01:32 GMT)
HiVe: Beyond Static Prompts for Multitask Learning via Hierarchy-based Vertical Mixture-of-Experts [9.1] HiVeは、複数のレベルでプロンプトをモデル化し、入力依存の特殊化を可能にするプロンプトチューニングフレームワークである。
実験によると、HiVeはさまざまなタスクに対して、強いプロンプトチューニングベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:35:42 GMT)
ActReal: System-Level Mobile Agents Challenge Mobile Automation Detection [9.0] システムレベルのモバイルエージェントは、固定スクリプトから、インターフェース、理性、アクションの調整を継続的に監視する適応システムへと進化している。
本稿では,システムレベルの移動エージェントのための物理アクション攻撃フレームワークであるActRealを紹介する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:55:21 GMT)
En-ViMedNER: An English-Vietnamese Parallel Biomedical Corpus with UMLS Semantic Type Annotations [9.0] 本稿では,UMLSセマンティックタイプを付加した最初の英語-ベトナム語並列生物医学NERコーパスであるEn-ViMedNERについて述べる。
コーパスには、PubMed 4,392の抽象ペア、44,892の英語-ベトナム語文ペア、202,949の整列エンティティ-メントペアが含まれる。
本研究では,En-ViMedNERを,人間監査およびコンセンサス補正されたミニテストサブセットを備えた大規模銀標準コーパスとして特徴付ける。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:40:18 GMT)
LARC: Lazy Adaptive Reachability Certification of Robot Manipulator Trajectories [8.4] 到達可能性に基づく認証は状態間の動作を束縛するが、一様時間分割はクリアランスが大きい計算を無駄にする。
非決定的クリアランステストで区間のみを二分することで、計画された軌道をチェックする遅延適応可到達性認証(LARC)を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:53:20 GMT)
Dense Weak Hiding: Closing Complexity Gaps in Nonconvex and PL Finite-Sum Optimization under Individual Smoothness [8.4] 我々は、各$_maxgeq 3$に対して、個々の滑らかさの下で下界に一致することを証明した。
また、各$_maxgeq 3$に対して、個々の滑らかさの下で下界が一致することを証明する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:47:24 GMT)
Applications of Risk Science to AI Fairness Evaluation: Principles, Challenges, and Best Practices [8.4] 我々は、雇用・雇用に関わる業務に使用される技術システムのバイアスや公平性を評価するために、文献レビューを実施している。
偏見や公平性に関連する結果の重大さを特徴付けるが、これらの結果の発生または重大さ推定のどちらかに関する不確実さを特徴付けるためのベストプラクティスに従わないことが判明した。
次に,AIによる履歴書スクリーニングタスクの公平性評価のケーススタディを行い,リスク科学の原則をこのような評価に組み込む方法について実証する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:13:01 GMT)
Reinforcement Learning on Benign Facts Amplifies Leakage of Memorized Private Data [8.3] 検証可能な報酬付き強化学習(RLVR)は、推論タスクにおいてモデルをより良くするためにデプロイされる。
事実に基づくRLVRは、インストラクションモデルがすでに記憶していた個人識別情報(PII)の抽出を増大させることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:20:01 GMT)
Reachability-Based Capability Confinement for LLM Agents under Indirect Prompt Injection [8.3] SkillGuardは、汚染を汚染として扱い、結果として生じる状態をデプロイが定義した禁止状態から切り離す機能を制限するハーネスレベルの執行層である。
我々は、Gmini 2.5 FlashとLlama3.3-70Bの4つのAgentDojoスイート上で、LLMのみのNo Defenseベースラインと異なるシステム層での3つのディフェンスに対してSkillGuardを評価した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:57:47 GMT)
Denoising as Projection: Constrained Optimization with Gradient-Guided Diffusion [8.3] そこで本研究では,Stein denoising演算子がデータ幾何への近似射影として作用できるという観測に基づいて,簡易なプロジェクテッド・グラディエント誘導拡散更新法について検討する。
我々は、この更新を、学習可能なジオメトリに対する制約付き最適化のための、不正確な予測段階的手法として分析する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 01:48:22 GMT)
A Unified Perspective on Conformal Prediction and Wasserstein Distributionally Robust Optimization for Uncertainty Quantification [8.3] 有限データの不確実性は、機械学習、最適化、自動化システムの中心である。
コンフォーマル予測(CP)と分散ロバスト最適化(DRO)に関する統一確率論的視点を開発する。
CP は閉形式の分布自由度補正を使用し、DRO は未知の分布の性質に依存する値空間補正を用いる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:34:39 GMT)
Analytical diagonalization of the open-boundary bosonic Kitaev chain: An asymmetric plane-wave ansatz approach [8.3] 我々は、標準ボソニックボゴリューボフ変換に完全に依存する、代替的で純粋に代数的な解を提案する。
N$サイト連鎖に対して、非エルミート関連行列である2Ntimes 2N$を解析的に解くために、不等な左運動モーメントと右動モーメントを持つ非対称平面波アンサッツを提案する。
この構成は、特別の場合において、元のアプローチの局所的スキーズ変換における自由を正確に反映する非特異性を明らかにしている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:37:14 GMT)
XQDT: eXplainable and Quantitative Data-Text Alignment Metric with Feedback Signals [8.3] データ-テキストペア内の省略データ、余分データ、誤りデータ、正しいデータユニットを識別するために、言語モデルを微調整するエンドツーエンドで説明可能な評価指標を提案する。
我々のモデルは誤り予測においてLLM-as-Judge法を上回り、競合精度、リコール、F1スコアを達成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:20:28 GMT)
ECA-BLS: An Efficient Complex-Augmented Broad Learning System [8.2] ブロードラーニングシステム(BLS)は、高速な訓練、分析学習、限られたデータの下での強力な一般化により、ディープアーキテクチャの効率的な代替手段である。
以前のBLSモデルは、データが複雑なドメインに埋め込まれた時に自然に現れる完全な2階統計を完全に活用するものではない。
本稿では,実数値入力を位相符号化された複素表現に変換する,最初の複合的拡張型ブロードラーニングシステム(CA-BLS)を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:50:13 GMT)
Asynchronous Cooperative Online Learning for Multi-Robot Control under Computational Delays [8.1] 本研究では,協調ロボットシステムのための非同期協調学習戦略を提案する。
予測精度、クエリポイントのバリエーション、遅延効果を考慮に入れている。
随伴MASに基づく分散制御法が開発され、所望の制御性能が確保される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:11:02 GMT)
Robustness Analysis of Agentic AI to Inconsistent and Incomplete Tool Responses [8.0] リターンがエージェントコンテキストに入ると、ツールの障害を分析します。
確率に基づく信号は、不完全なリターンといくつかの直接的な不整合をはっきりと捉えていることを示す。
可能性信号の弱いいくつかの障害は、エージェントを状態変化アクションにリダイレクトすることができる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:25:02 GMT)
Drive the Thoughts: Runtime Monitoring of VLA Reasoning-Trajectory Consistency [7.9] Chain-of-Thought (CoT) はモデル出力をクロスチェックするための豊富な仕様である。
本稿では,最近のオープンドライビングVLAのCoTがこのようなモニタリングをサポートできるかどうかを評価する。
本稿では,CoTトラジェクトリの整合性チェックをランタイムモニタに統合することを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:03:34 GMT)
Symmetry-Enforced Topological Structures in Quantum Phase Diagrams [7.7] 我々は、多くのボディハミルトンが非自明な基底状態縮退を持つことができるギャップ付き位相図の中で、ループの非収縮性(いわゆる$S1$-families)について研究する。
このような構造は、独立な'対称性に基づく以前の分類ではアクセスできない新しい$S1$-classの分類につながる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:19:06 GMT)
Sensitivity-Constrained Neural Operators for Data-Efficient Forward and Inverse Modeling of Partial Differential Equation Systems [7.7] 感度拘束型ニューラル演算子(SC-NOs)の研究
SC-NOs Augment Standard Training withsolvr- derived Jacobian supervision。
我々は, 対流拡散およびRANS--Spalart--Allmarasベンチマーク, 入力次元スケーリング試験, 長距離自己回帰ロールアウト, 浅海域東北津波震源反転事例についてSC-NOsの評価を行った。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:37:25 GMT)
MUDDLE: Measuring Understanding of Documents under Distractor and Length Effects [7.7] 混乱と文脈劣化を分離する制御されたベンチマークであるMUDDLEを提案する。
MUDDLEは270の人間による注釈付き質問を使用し、それぞれが1つのソース文書に結び付けられ、5つの条件で全ての質問をインスタンス化する。
3つのモデルファミリーにまたがるLLM審査員の回答を得た。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:10:40 GMT)
Towards Continual Test-Time Adaptation of Vision-Language Models in Open-Vocabulary Semantic Segmentation [7.4] Diversify, Anchor, and Filter (DAF) はエントロピーに基づく適応を拡大するフレームワークである。
自然界,自律運転,水中画像,リモートセンシングの5つのデータセットを,その劣化した変種を用いて評価した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:39:14 GMT)
Tight Global Bound on Pairwise Entanglement of Formation in Three-Qubit Systems [7.4] 3量子系における対の2乗絡み合いの和に大域的境界を導出する。
3つの二部共役を3つの座標にマッピングし、任意の3量子状態が3次元空間の点に対応するようにする。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:27:20 GMT)
GraM-Diff: A Unified Graph-Mamba Diffusion Framework for EEG-Based Alzheimer's Disease Data Generation and Diagnosis [7.1] 脳波合成のための統一型分類器誘導グラフマンバ拡散フレームワークGraM-Diffを提案する。
拡散U-Net内にグラフ畳み込みネットワークを組み込んで、電界間の接続をモデル化し、線形複雑で長期の時間的モデリングのための双方向マンバ状態空間ブロックをモデル化する。
EEGベースのADベンチマーク4つのベンチマークで、合成強化は分類を改善し、強力な生成ベースラインよりも優れたコンテキストFIDと相関スコアを獲得し、データスカース設定の堅牢性を高める。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:37:47 GMT)
Learning Representations through Token Prediction: Geometry, Approximation, and Downstream Guarantees [6.8] トークン予測は、現代の言語モデルにとって、トレーニング前の中心的な目的である。
我々は,トークン予測と表現幾何学,エンコーダ近似,下流性能を結びつける統計フレームワークを開発した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:33:15 GMT)
Imaging Stars at the Quantum Compatibility Limit [6.7] 我々は, (N) ステーションアレイにおける時間分解繰り返しあるいは適応的測定が, 可視性推定器の基本的な配列レベルの不整合性に悩まされていることを示す。
本稿では,コヒーレントストレージとジョイント量子処理による集合的読み出しを実現するためのメモリ支援型干渉計アーキテクチャを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:54:37 GMT)
Can LLM Agents Discover? Evaluating Creativity on ML Engineering Tasks [6.7] 本稿では,MLエンジニアリングタスクをテストベッドとして,マルチターンLLM研究エージェントの創造性を評価するためのフレームワークを提案する。
LLM-as-a-Judgeパイプラインを開発し、人間の創造性判断との強い相関性を検証する。
このパイプラインをエージェント・トラジェクトリーに適用すると,(1)探索から搾取への移行に伴うP-Creativityの低下を示す全てのエージェント,(2)LLMはメダル獲得者よりもH-Creativityの低下を示すが,性能は低下する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:21:08 GMT)
Integrating adaptive human behavior into epidemic models with large language models [6.7] 我々は,この課題を,機械的流行モデル内での適応的人間の行動を表現するために,大規模言語モデル(LLM)を用いて再評価する。
我々は,この概念をジェネレーティブ・アダプティブ・行動層(ジェネレーティブ・アダプティブ・ビヘイビア・レイヤ・フォー・エピデミクス,GABLE)を通じて運用する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:46:56 GMT)
EVAR: Evidence-Validated Hypothesis Admission for Budget-Aware Narrative Reasoning [6.6] EVARは、予算を考慮した物語推論のためのエビデンス検証仮説解釈フレームワークである。
EVARは、制御可能な推論コストを維持しながら、タスク性能とエビデンス忠実性の両方を改善していることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:07:27 GMT)
OASIS: Optimizing Attacker Sequences for Hard-Label Black-Box Text Attacks [6.5] OURSは、ハードラベルのブラックボックステキストアタックで攻撃者のシーケンスを最適化する方法である。
実験により、OURSは強いスタンドアロンのベースラインと単純な手作業で構築されたチェーンよりも一貫して優れていることが示された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:26:19 GMT)
MotionSync: Non-Causal Refinement of Causal Tracker for Label-Efficient 3D Perception [6.4] 3次元のボックス・アンド・トラックアノテーションは、自動運転データエンジンのコストボトルネックである。
両体制を必要とするチームは2つの体制を維持し、調整する。
MotionSyncは因果/非因果境界を明示的なアーキテクチャシームにする。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:25:57 GMT)
DeMMO: Longitudinal and Cross-Disease Modelling of Digital Mobility Outcomes via Multi-Task Learning [6.3] ウェアラブルセンサから得られるデジタルモビリティ成果(DMO)は、疾患の進行を監視するための有望な手段である。
既存のDMO研究は、通常、1つの病気または1つの訪問に焦点を当てている。
縦長・多相・マルチアウトカム学習のための解釈可能なフレームワークであるDeMMOを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:48:43 GMT)
Ontology-Guided Multi-Agent Extraction of Evaluation Objects from Academic Review Texts: Evidence from Chinese Library and Information Science [6.3] 本研究では,オブジェクト抽出評価のためのオントロジー誘導型マルチエージェントフレームワークを提案する。
90.33%の精度、84.55%のリコール、87.34%のエンティティレベルF1、79.78%のStrict Typed F1、91.35%の型精度を実現している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:09:47 GMT)
Multiclass Linear Perceptrons with Multiplicative Margins [6.3] 乗法的マージン機構を持つ多クラス線形パーセプトロン分類器群(MMPerc)を導入する。
MMPercは、真のクラススコアが競合するクラスのスコアを超えることを要求することで、分類の信頼性を強制する。
合成データセットと実データセットの実験では、MMPerc分類器が標準パーセプトロンより優れていることが示されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:32:04 GMT)
CatchBench: When Can an Agent Failure Be Caught? [6.2] CatchBenchは、監査人の質問を3つの情報状態に分類する。
以前のベンチマークでは、これらの状態の1つを修正したり、テレメトリを変更したりする。
各州は異なる質問を認めており、7つのタスク契約は独自のラベルとメトリクスを持っている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:25:12 GMT)
Robust Broad Learning System with Wave Loss for Classification under Data Uncertainty [6.2] 非対称で有界でスムーズなウェーブロス関数を統合する,堅牢な広範学習フレームワークであるWave-BLSを提案する。
30のUCIベンチマークデータセットでの実験では、Wave-BLSは古典的BLSといくつかの堅牢な亜種を一貫して上回っている。
これらの結果により、Wave-BLSは、データ不確実性の下で学習するための既存の広範学習モデルの安定かつ堅牢な代替品として確立される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:16:25 GMT)
A Data-Driven Multimodal Method for Early Detection of Coordinated Abnormal Behaviors in Live-Streaming Platforms [6.0] MM-FGDNetは大規模ライブストリーミング環境における異常な振る舞いを検出するためのデータ駆動フレームワークである。
時間的不正パターンモジュールは、弱い早期信号から突然のアウトブレイクまでの進行をキャプチャする。
協調操作モジュールは、組織されたユーザグループと自動アカウント間の協調的な相互作用を特定する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:56:28 GMT)
Attention Sensitivity Is Not Enough: Dissociating Attention-Level and Behavioural In-Context Learning under Fine-Tuning [5.7] コンテキスト内学習では、大規模な言語モデルがデモから新しいタスクに適応する。
微調整はこの振る舞いを省くことができる。
本稿では、最適化されたプロキシをどの程度信頼できるかを問う。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:43:16 GMT)
TRINITY: A Multi-Perspective Benchmark for Personal-Style Video Highlight Detection [5.7] 従来のビデオハイライト検出は、狭くイベント中心の唾液度の定義に依存している。
TRINITYは、ハイライト・サリエンシを3つの相補的な次元、イベント、感情、自然に分解するマルチパースペクティブ・ベンチマークである。
我々の手法は最先端のベースラインを著しく上回り、HiSum氏では+7.15/+3.62 mAP、YouTube Highlightsでは+10.82 mAPを達成した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:46:13 GMT)
VeloBins: Learning Velocity and Its Uncertainty via Bins and Error-Conditioned Gaussian Labels for Aerial Inertial Odometry [5.4] 慣性オドメトリーは、アグレッシブな操作と照明の弱い視覚センサーを備えた航空ロボットにとって重要である。
本稿では,速度レグレッションを離散化された速度ビンの分類として再構成するVeloBinsを紹介する。
フリーフォームのアグレッシブフライトから27gのナノクワッドローター、21m/s以上のドローンレースまで、VeloBinsを4つの航空データセットで評価した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 11:00:45 GMT)
Thresholdless dynamical instability in transverse $\mathcal{PT}$-symmetric scattering systems: The hidden role of bound states in the continuum [5.3] 横パリティ時間(mathcalPT$)対称系におけるしきい値のない動的不安定性を求める。
不安定性は、任意の$_V>0$で任意に小さい$に設定される。
これらの結果から, 安定な$mathcalPT$-symmetric散乱デバイスの設計原理が確立された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:57:14 GMT)
When Safety Speaks a Language: A Mechanistic Analysis of Safety-Language Identity Entanglement in LLMs [4.9] 安全関連機能は、どこに位置し、どのように層に分散するかという点で、アーキテクチャに依存します。
この安全言語の絡み合いは、安全性を損なうことが有害な反応速度だけでなく、標的言語にも影響を及ぼすという直接的な結果をもたらす。
本研究は,安全アライメントの言語多様性をアーキテクチャ依存とみなし,多言語的安全介入の機械的説明を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:07:26 GMT)
Continual Test-Time Adaptation via Entropy Sensitivity-Guidance in Strict Online Setting [4.8] 汚職スタイルのストリームに対する厳密なオンライン連続TTA(CTTA)手法であるSEGA(Sensitivity-Guided Erasing Adaptation)を紹介する。
SEGAは、情報の除去に伴う予測エントロピーの変化を調査するために、少数の構造化された消去を使用する。
ImageNet-C、CIFAR10/100-C、および制御された汚職スタイルのプロキシとして処理された汚職生成水養殖ストリームの実験において、SEGAは一貫性のある堅牢性と安定性を得る。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:30:51 GMT)
What Are You Listening to? Temporal Music Grounding for Audio-to-Text Large Language Models [4.7] 本稿では,音符やイベント,パターンに対応する1つ以上の時間帯をモデルが返すタスクである時間的音楽グラウンドについて紹介する。
アルゴリズムによって生成されたピアノMIDIをオーディオにレンダリングして構築したベンチマークスイートであるMusicGroundingBenchを紹介する。
実験の結果,現在の音声モデルでは時間的音楽グラウンドリングが依然として困難であることが確認された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:17:28 GMT)
Apples to Apples? Towards Comparable Crosslingual Language Model Evaluation [4.7] 並列データに基づいて訓練された制御単言語言語モデルを用いて言語間評価手法を検討する。
この結果から, トークン化, エンコーディング, 正書法の違いに根ざした多言語的バイアスが広く用いられている。
対照的に、意味論的に等価なシーケンスで計算された文レベルの負の対数類似性は、より有意義で一貫した言語間比較を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:53:47 GMT)
On the Resilience of Text-to-Video Diffusion Models to Hardware Faults [4.6] ランダムなハードウェアレベルの故障下でのテキスト・ツー・ビデオ拡散モデル(T2V)のレジリエンスに関する最初の系統的研究について述べる。
単一障害は、全体的なパフォーマンスを最大3.7%低下させ、意味的正しさは知覚的品質よりも影響を受けやすい。
本研究は,T2Vシステム導入のリスクを明らかにし,耐故障性に関するさらなる研究を動機づけるものである。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:41:51 GMT)
PredVLA: Predictive Sensorimotor Modeling for Sub-Million-Parameter Robot Manipulation [4.6] PredVLAは、トレーニング可能なネットワークパラメータがわずか0.68万で、ロボットデータの事前学習がない言語条件の予測符号化ポリシーである。
階層的なリカレントダイナミクスは視覚的特徴と固有受容を予測し、観察は予測エラー駆動オンライン推論によってのみ潜在状態に影響を与える。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:56:42 GMT)
Beyond Surface Alignment: Grounding the Dynamics of Situational Understanding and Generative Control in LLMs [4.5] LLM(Large Language Models)の現在のアライメントチューニングパラダイムは、表面レベルの振る舞いを優先している。
この論文は、このような表面アライメントマスクはグラウンド化の欠如を論じ、スタイリスティックに自信があるが状況的に不安定なモデルを作り出している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:04:03 GMT)
Compression-Aware Abstention: Teaching LLMs to Refuse When KV-Compression Masks Remove Answer Evidence [4.5] KV-cache圧縮は、コンテキストトークンを省略することでLLM推論メモリを削減する。
排除されたトークンが答えを持つ証拠を含んでいる場合、圧縮されたコンテキストが不十分であることを認識せずに、モデルが幻覚することがある。
提案手法では, 証拠を裏付けるモデルが, 圧縮を継続し, 保留しない場合の解答を学習する学習問題として, 圧縮を意識した棄却を定式化する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:02:15 GMT)
Medical Causal Hypothesis Verification with Large Language Models [4.2] 検索や情報検索における大規模言語モデル(LLM)の利用の増加は、医療などの高い領域において、その信頼性を評価する必要性を浮き彫りにする。
因果的医学的クレーム評価におけるLCMの精度について検討した,小規模の予備的研究を報告する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:37:06 GMT)
Candidate supply and answer selection shape the value of LLM judging in multi-agent systems [4.2] 正しい答えは、しばしば生成された候補の中に存在しているが、システムは依然として収束し、間違った答えを報告することができる。
筆者らは,(1) LLM判事がマルチエージェントシステムで生成した候補に対して,回答正解の信号を供給することによって,効果的な選択圧を与える場合,(2)その信号を用いることで回答が向上する場合の2つの質問について検討した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:09:24 GMT)
Token Counts Are Not Model Lineage: A Frozen-Threshold Holdout Study of Black-Box LLM API Fingerprinting [4.1] 大規模な言語モデルがリレーとリセラーAPIを通じて提供される場合、ブラックボックスモデルの属性はますます重要になる。
テンポの低い信号は、OpenAI互換エンドポイントで返されるプロンプトトケン数である。
しかし、この信号がより広範にEmphmodel- family属性に有効であることは、直接のホールドアウト試験がほとんど行われていない。
我々は,24個のラベル付きエンドポイントペアに対して凍結保持実験を行い,開発セットと未タッチのホールドアウトセットに均等に分割した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:58:49 GMT)
Frame phase retrievability and state distinguishability of quantum channels [4.1] 量子チャネルによる純状態の同定と情報保存におけるフレーム位相探索の役割について紹介する。
単位ベクトルに対して、 lift $xmapsto xx*$ は同じ階数1の量子状態を持つ大域位相のみが異なるベクトルを識別する。
この観点では、チャネルは純粋状態に対して射影されたときに正確に位相検索可能である。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:01:26 GMT)
FIS-OT: Feature-Induced Optimal Transport for Unsupervised Action Segmentation [4.1] 教師なしのアクションセグメンテーションは難しいタスクです。
ラベルなしでビデオのアクションカテゴリやバウンダリを見つける。
既存の Optimal Transport (OT) メソッドは、グローバルな制約を使用する。
これにより、ローカル情報の使用を見落としてしまう。
FIS-OTを提案する。これは、新しい特徴誘発構造的最適輸送フレームワークである。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:10:51 GMT)
Improving Argument Saliency Coverage in Small LLMs for Long Legal Opinion Summarization via Sequence-Level Distillation [3.8] 我々は,有能な長文教師モデルからのシーケンスレベルの蒸留が,議論サリエンシのカバレッジを改善するためのシンプルで,アノテーションのない,データ効率の戦略であることを示す。
学生のモデルサイズ全体にわたって、蒸留は、我々の法的意見設定における専門家による要約のチューニングを一貫して上回っている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:27:09 GMT)
Generalizable Multi-Agent Planning from Signal Temporal Logic Specifications via Diffusion [3.7] マルチエージェントシステムは衝突を避けながら、豊かな時間的タスクを満たさなければならない。
現在の信号時間論理(STL)計画手法は限界に直面している。
STL仕様を用いたマルチエージェント計画のための新しい拡散法を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:38:31 GMT)
Sampling-based Certified Planning with Graphs of Convex Sets [3.7] 凸上の平面は、凸領域が衝突のない場合、建設によって衝突のない軌道を返す。
私たちはその答えを認定するプランナーを構築します。
あらゆる29ドルのタスククエリに対してゼロの無効な回答を、参照に対して21ドル、最初の認定された回答を0.11ドル、参照の未検証クエリに対して1.59ドル、参照が物理的に有効であるすべてのクエリに対して正確に参照最適化を再現する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:57:53 GMT)
Agent Zero Memory: Provenance-Aware Long-Term Memory for LLM Agents [3.7] Agent Zero Memory(エージェントゼロメモリ)は、長期記憶システムである。
ユーザの会話、ファイル、接続されたソースを3つの並列メモリシステムに消去する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:55:59 GMT)
Input-Adaptive Gating of a Dehazing Front-End for On-Device Perception in Smoke-Obscured Environments [3.6] 2段階のビジョンパイプラインは、よりクリーンな入力がより良い出力を生成すると仮定して、タスクネットワークの前に拡張ネットワークを配置することが多い。
消火器が煙に満ちた部屋を構造的な輪郭として描画するエッジ検出器に先行する消防士支援パイプラインでこれを評価した。
どちらもRaspberry Pi 4向けに355Kと23Kのパラメータで設計され、Liteを介してUINT8に量子化されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:44:27 GMT)
Seeing Through Extreme Visual Sparsity: Surface Understanding from a Single Random Visual Patch [3.5] 本稿では,4つの事前学習型アーキテクチャを準多面的表面再構成と材料分類に適用する,統合されたデュアルタスク学習フレームワークについて論じる。
スパース観測プロトコルを用いてTouch-and-Goデータセット上で実験を行った。
Swin Transformerは89.21%、F1スコア0.8922、ROC-AUC0.9813で最高の分類性能を達成した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:08:41 GMT)
Evaluating the Capabilities of LLMs for Persuasive Dialogue [3.4] 大きな言語モデル (LLMs) は明らかに説得力のあるテキストを生成することができるが、説得力のある発音は議論をうまく行うことを意味するのだろうか?
我々は,多言語対話プラットフォームであるtextscPersuasio を紹介した。
このシステムを用いて、英国における人間とLLMの政治的話題に関する192の議論を発生させ、自動判断と9,702人のクラウドソースによるペアの判断を通じて、22人のインターロケータを評価した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:03:59 GMT)
MASQ: Mask-Aware Spatiotemporal Quantization for Unsupervised Skeleton Action Segmentation [3.2] 非トリミング骨格に基づく時間的行動セグメンテーションは、長い教師なし配列における人間の行動を理解するための重要なタスクである。
近年のアプローチは、運動表現から行動境界を発見するために離散量子化に依存することが多い。
本研究では,新しいマスク対応時空間量子化フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:40:32 GMT)
Structure Aware Neural Architecture Search for Mixture of Experts [3.1] 本稿では,専門家とデータ構造との整合性を探索変数として提示するアーキテクチャ検索フレームワークを提案する。
本研究では,不完全値の最大値と潜在変数混合の最大値とが一致し,一般化された期待-最大化法により解かれることを示す。
我々は,サロゲート誤差が要約可能であれば繰り返し収束することが証明され,各極限点において探索が生成する候補が存在しないことにより,真の目的が向上されることを証明した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:37:23 GMT)
VERA: Authority-Preserving Edge Revocation for Federated AI-Agent Workflows [3.1] 我々は,エージェントランタイムアダプタが発行する検証可能なリコール契約とAPIであるVERA(Verifiable Edge Revocation for Agents)を署名された証拠として紹介する。
解法的権威の下で、エッジ e の無効化は T_intent(e,G) = reach(G) reach(G e) を正確に無効にする。
LangGraphフレームワーク-repltセルでは、20回繰り返し500コンパイルされたフレームのトレースと2000の有効な署名されたデリゲート決定が生成される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:39:26 GMT)
Detecting Hidden Chain-of-Thought in Large Language Models with Linguistic, Behavioral, and Mechanistic Indicators [3.0] 隠れたCoT検出スコア(HCDS)は、中立なプロンプト動作が明示的なCoTや明示的なno-CoTとより密接に一致しているかを測定する。
HCDSは、明らかにされていない推論の痕跡を直接観察または証明していない。
探索は推論学習モデルにおいて、より強く、より急進的なCoT様の挙動を示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:37:46 GMT)
Every Layer Counts: An Exponential $L_2$ Depth Hierarchy for ReLU Networks [3.0] 我々は、ReLUニューラルネットワークに対して、任意のReLU層が指数関数的に多くのニューロンを保存できる深さ階層を証明した。
我々はまた、より正規なターゲットに対して正確な分離を証明し、これはグローバルに$[0,1]$-valued と $mathcalO(sqrt d)$-cubeschitz である。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:24:04 GMT)
Error Detection for PET/CT Radiology Reports: Domain-Specific vs Large Language Models [2.9] 大言語モデル (LLMs) は放射線学報告の検証のために提案されているが, 臨床的に有意な誤りを検出する能力はいまだ探索されていない。
PET/CTレポートの誤り検出のための言語モデルの最初の体系的評価を行い、コンパクトなドメイン固有モデルとSOTAオープンウェイトLLMを比較した。
臨床的に動機付けられた合成報告エラーを検出するために,ドメイン固有BERTモデルを訓練し,0/few-shot Qwen3-32B,Gemma-3-27B,Llama-3.3-70Bを11,500のベンチマークで評価した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:23:01 GMT)
Joint Spatiotemporal Spectral Neural Operators for Learning PDEs on Irregular Domains [2.9] 空間グラフスペクトル分解と時間フーリエ変換を組み合わせたニューラル演算子である textbfGraph Spectral Neural Operator (GSNO) を導入する。
GSNOは、ドメインのワープや自動回帰ロールアウトなしで、非カルト的離散化についてグローバルにコヒーレントな演算子学習を可能にする。
実行時間とパラメータ数を削減し、メッシュ解像度と幾何学ファミリをまたいだ堅牢なゼロショット一般化を実証しながら、高い精度を達成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:41:10 GMT)
Off-Manifold Refinement: Guiding Video Generators with a Frozen World Model [2.5] Off-Manifold Refinement (OMR)は、単一のサンプリング軌道に直接ワールドモデルフィードバックを注入する推論時間法である。
固定された400-prompt VideoPhy-2の詳細部分集合では、OMRはSemantic-Adherence-and-Physical-Commonsenseを47.0%から52.0%に引き上げる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:00:09 GMT)
How You Ask Shapes What You Get: A Theory-Seeded Measurement of Articulation in Advice-Seeking LLM Conversations [2.5] ユーザが同じアドバイス検索リクエストを,それぞれ異なる方法で記述できることが分かりました。
我々は,調音が話題から分離可能な潜在次元を形成するかどうかを問う。
我々は、公開チャットコーパスから16,447のアドバイス検索プロンプトから解釈可能な特徴を抽出する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:25:04 GMT)
Cross-lingual Functional Vectors for Emotion Detection in Large Language Models [2.4] 関数ベクトル(FV)は、大規模言語モデルの振る舞いを制御するための有望なメカニズムとして登場した。
多言語多言語感情認識を用いたFVの言語間伝達性について検討する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:08:36 GMT)
Dark state as a measurable state by a dispersive readout without a Purcell limit [2.3] 量子共振器結合の強化により、より分散的な読み出しが可能となるが、パーセル損失は増大すると考えられている。
本研究では、結合量子系における暗モードが、暗モードと明るいモードの間のZZ相互作用を導入することにより、この規則に違反する可能性があることを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:26:14 GMT)
A New Algebraic Algorithm for LWE [2.2] LWE(Learning With Errors)問題は、現代の暗号とポスト量子セキュリティの中心である。
本研究では,探索-LWE問題に対する新しい代数的アルゴリズムを提案する。
高いレベルでは、アルゴリズムは線形代数的手法とGroebnerに基づくS-polynomialベースの手法を組み合わせる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:09:53 GMT)
Null-Space Diffusion Restoration with Adaptive Uncertainty-Guided Fusion for Ultrasound Speckle Reduction [2.1] 超音波Bモードイメージングは通常、スペックルノイズやアーティファクトに悩まされる。
新しい不確実性誘導型ヌル空間拡散(UGNS)フレームワークは、安定化された正エンベローププロキシ上での整合性を強制する。
UGNSは細かな空間分解能を保ちながらスペックルノイズを効果的に抑制することが検証された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:45:13 GMT)
Target-Aware State-Adaptive $p$-Dirichlet Graph Neural Regression for Non-Invasive Body-Composition Estimation [1.8] 身体構成結果の正確な評価は代謝,骨格,筋の健康を評価する上で重要である。
非侵襲的人文計測からこれらの結果を評価するために,ターゲット対応の$p$-Dirichletグラフニューラル回帰フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 01:27:28 GMT)
Selection, Representation, and Execution in Sparse Fourier Neural Operators [1.8] スパース表現はしばしばモデルを小さくし、推論コストを低減させる。
我々は、表現における空間性、記憶されたパラメータ、理論的操作数、実行時を区別する。
本研究では,それぞれの遷移を個別に検査するスパースFNOに対するいくつかの経路について実証的研究を行った。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 22:26:59 GMT)
PruneShift: A Framework for Evaluating Decision Reliability in Structured Pruning [1.8] 構造化プルーニングは、すべての実現可能なマスクに対する直接的なタスク評価が高すぎるため、サロゲート目的を使用する。
本研究では,予測忠実度,セレクタ出力近傍の忠実度,選択されたプルーニング判定の品質を分離する評価フレームワークPruneShiftを紹介する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:52:16 GMT)
When Prediction Error Is Not Enough: Evaluating Nuisance-Function Prediction for Causal Estimation [1.7] モンテカルロシミュレーションを用いて,部分線形モデルにおける予測誤差と因果推定器の性能の関係について検討した。
予測誤差はメソッドや設定の因果バイアスを常に追跡せず,最適点推定性能を持つ手法は必ずしも最良信頼区間のカバレッジを有していなかった。
これらの結果から,予測誤差はニュアンス関数推定に有用であることが示唆された。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:01:15 GMT)
GeoAgent: Evaluating VLM Geolocalization Through Embodied Navigation [1.7] 現代のビジョンランゲージモデル(VLM)は、画像のジオローカライゼーションにおいて、人間のベースラインよりはるかに高い性能を発揮する。
我々は,エージェントがストリートビュー環境をナビゲートする必要があるエージェント環境ベースのベンチマークであるtextbfGeoAgentを紹介する。
我々の分析によると、現代のVLMは、国や大陸レベルでの予測を成功させながら、地域パターンの識別に苦慮している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 00:19:49 GMT)
Wide Learning: Learning to Reach Evidence [1.7] 学習者の状態は、どのエビデンス生成実験が有界資源の下で確実に実現できるかを決定することができる。
学習者状態,デプロイメント予算,信頼性しきい値,評価分布に対して有効なリーチを定式化する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:58:50 GMT)
OrnaStyler: Ornament-Aware Latent Editing for Content-Preserving 3D Stylization [1.6] OrnaStylerはテキスト誘導による装飾を意識した3Dスタイリングのためのフレームワークである。
私たちの中核となる考え方は、スタイリスティック要素の空間構成を明示的にモデル化することである。
OrnaStylerは、コンテンツ保存、スタイルの忠実さ、全体的な視覚的リアリズムの観点から、最先端の編集性能を達成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:00:39 GMT)
AutoXRD: Autonomous LLM Agents and Comprehensive Evaluation for Powder Diffraction Analysis [1.4] 粉末X線回折(XRD)は材料評価の中心であるが、信頼性の高いエンドツーエンドの自動化は依然として困難である。
本稿では,粉体XRD分析を段階的に洗練するフレームワークであるAutoXRDを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:05:21 GMT)
MariSat: A Maritime Dataset for Instance Segmentation of Objects in Satellite and Aerial Images [1.3] MariSatは1260の航空画像と衛星画像のベンチマークデータセットで、多様な港や海岸のシーンをカバーしています。
データセットは8種類の海洋生物(セイルボート、ヨット、ジェットスキー、漁船、クルーズ船、軍艦、タグボート、貨物船)に対してピクセルレベルで注釈付けされた。
本稿では,画像収集手法,アノテーションと修正プロセス,および得られたデータ構造について述べる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:31:39 GMT)
A Deep Latent Variable Framework for Jointly Modeling Missingness, Measurement Error, and Heterogeneity [1.3] 本稿では, 欠落データ, 測定誤差, 集団の不均一性を両立する統一確率的枠組みを提案する。
提案手法は,新しい階層型木抽出変分オートエンコーダとパターン認識型潜在表現とキャリブレーションに基づく復調処理を統合した。
このフレームワークは、MCAR、MAR、MNARなどの欠落データメカニズムに対応し、サブグループ固有の、グローバルに共有される潜在構造を同時に学習する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:56:57 GMT)
HoopMind: A Real-Time Neural Game-Tree System for Opponent-Aware Possession Planning [1.2] 学校のコーチは、ゲームフィルムと直感で相手の準備をします。
プロフェッショナルチームの分析ツールは手の届かないままです。
公共データがこのギャップをどこまで埋めるかを尋ねる。
私たちは5つの公開ソースを、21シーズンにわたって4.23Mショットの1ショット当たりのデータセットに融合します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:13:53 GMT)
When 3D Gaussian Splatting Recovers Real Surfaces [1.1] 幾何学的ミスアライメントは空間テクスチャをパララックスによる高周波角信号に変換する。
合成応力試験の実験は、この予測を裏付け、高い角の容量でビルボードの故障が正確に現れることを示した。
標準的なキャプチャプロトコルで評価した実世界のデータセットでは、高いSH度でも再構成は表面一貫性が保たれている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:30:26 GMT)
Influence Is Not Authority: When Causal Guardrail Signals Make Legitimate Tool Use Look Like an Attack in Tool-Using LLM Agents [1.0] 影響に基づくガードレールの鍵となる制限は、正当でユーザ認証されたアクションと悪意のある不正なアクションとを確実に区別しないことである。
我々は,この制限を,24件のベースケースから抽出した96条件の認証等価監査を通じて明らかにした。
シャドーベースのガードレールは、テストされたすべての無害走行を可能にするが、一致した不正な動作をより頻繁に拒否することはない。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:16:04 GMT)
MedSegBenchmarker: A Raw-Count-First Framework for Controlled 2D Medical Image Segmentation Benchmarks [1.0] MEDSEGBENCHMARKER(MSB)は,2次元データセットのベンチマーク制御のための構成駆動フレームワークである。
MSBは、評価コンテキストとともに、サンプルレベルおよびクラスレベルの画素数と予測をエクスポートする。
3つの異種2Dデータセットと256画素および512ピクセルの入力解像度で評価された複数の視覚モデルを含むケーススタディでMSBを実証した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:20:38 GMT)
Which one is banana man? Evaluating vision-language models in multi-turn pragmatic interpretation [1.0] 反復参照ゲームは、文脈に敏感な実用的な推論を行うエージェントの能力のテストケースを示す。
我々は、反復した参照ゲームで生成された記述の意図した意味を識別する能力に基づいて、人間と視覚言語モデルを試した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 05:36:41 GMT)
On the Instance Hardness as a Decision Criterion in TinyML Systems [1.0] TinyMLには、限られたメモリとコンピューティングリソースを持つデバイス上での機械学習の実装が含まれている。
本稿では,TinyMLシステムへの木深プーンインスタンス硬度法の新規適用に関する予備的知見を示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:18:20 GMT)
Building the Truman Show: A TrustZone-Based Framework for Lightweight Out-of-band Kernel Security Monitoring [0.9] 分離ベースのセキュリティアプローチは、セキュリティロジックをカーネルから分離することで、より強力な保護を提供する。
我々はARM TrustZone上に構築された軽量なアウトオブバンドOS監視アーキテクチャであるLOOMを紹介する。
LOOMはカーネルとは独立してタンパー耐性の監視環境を確立する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:41:31 GMT)
nnMNet: Baseline for Martian Terrain Semantic Segmentation [0.9] 火星のセマンティックセグメンテーションのために設計された新しいベースラインモデルnnMNetを提案する。
局所表現とグローバル表現のギャップを埋めるために,空間認識融合ブロック(SAFB)を導入する。
nnMNetはSynMars-TW、SynMars-Air、MarsScapesでそれぞれ86.61%、83.25%、88.24%のmIoUを達成した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:03:33 GMT)
Review Before Trust: Source-Grounded Integrity Gates for AI-Assisted Personal Health Records [0.9] 大規模言語モデルは医療文書を構造化されたデータに変換することができるが、信頼できる出力は情報源によってもサポートされない可能性がある。
本稿では,情報源文書に対して決定論的モニタが検証するまで,生成したデータを暫定的に保持するエビデンス付き信頼促進モデルを提案する。
個人健康記録アプリケーションであるMedical DataCloudにこのモデルを実装し、自動テストと保存出力の再生を通じて評価する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:51:43 GMT)
Adaptive Doubly Robust Off-Policy Evaluation for Ranking Policies under Diverse User Behavior [0.7] Inverse Propensity Scoring (IPS) は過度な分散を持つ。
IPS と Reward Interaction IPS (RIPS) は、ユーザーがランキングを閲覧する方法に関する仮定を定め、ばらつきを減らす。
本稿では適応重み付けと再帰回帰を組み合わせた適応二重ロバスト(ADR)を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:43:36 GMT)
Generating Clinical Vignettes that Preserve Cognitive Formulations [0.7] Ehlers と Clark の認知モデルを用いて, 外傷後ストレス障害における FORMA のインスタンス化を行う。
我々は,500個のペルソナ,11世代モデル,および3つのアブレーション条件に対して16,500個のウィグレットを生成する。
専門家は、フルヴィグネットをゼロショットの代替品よりもかなり高く評価し、臨床医は、その時間の85%が人間によって書かれたものだと認識している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:40:24 GMT)
Designing for the Next Click: Bandits for Real-Time Page Layout [0.7] 製品ページレイアウトをリアルタイムで最適化する,スケーラブルな帯域幅ベースシステムを提案する。
コンテキストバンディットモデルは、ユーザ、アイテム、およびカテゴリレベルの機能を使用して、各セッションの最も効果的なレイアウトを動的に選択する。
このアーキテクチャは、大規模なWebサービススタックへのシームレスな統合のために設計されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:28:15 GMT)
Localization in microcavities revealed by phase-space non-Hermitian skin effect [0.7] 幾何誘起運動量ドリフトと屈折脱出の組み合わせは、位相空間運動量における一般化された非エルミート皮膚効果をもたらすことを示す。
我々は、この機構を、オープンカオススパイラルマイクロキャビティにおける共鳴の臨界線局在の起源とみなす。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:43:23 GMT)
On the Role of MRI Sequences in Cross-Dataset Generalization for Brain Tumor Segmentation [0.6] 本研究では、2つのよく知られたデータセットにおける個々のMRIシーケンスがモデルロバスト性に与える影響を系統的に評価する。
ResUNetベースのフレームワークを使用して、各モダリティを独立してトレーニングし、その効果を分離する。
その結果、T2f/FLAIRシーケンスは、Diceスコアが75%を超え、最高のクロスデータセット性能を達成することがわかった。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:17:18 GMT)
Confidence-Aware Ensemble and Long-Word Refinement for Artistic Text Recognition [0.6] アートテキスト認識(ATR)は、装飾的なフォント、湾曲したレイアウト、オブジェクトのような文字、散らかし、激しい歪みを言葉画像で組み合わせることがしばしばあるため、依然として困難である。
本稿では,この設定の標準化ベンチマークとしてWordArt-V1.5について検討し,最近のシーンおよび芸術的テキスト認識器を共通プロトコルで評価する。
本稿では, SVTRv2, PARSeq, MAERecを公式トレーニングスプリットの微調整後に組み合わせた自信認識アンサンブルを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:56:04 GMT)
Forget or Fine-tune? A Comparative Study of Machine Unlearning Strategies for Noisy Label Correction [0.6] ディープニューラルネットワークのトレーニングにおいて、ノイズラベルは依然として重要な課題である。
標準的なソリューションは、クリーン化されたデータセットのスクラッチからモデルをトレーニングすることです。
マシン・アンラーニングは計算的に効率的な代替手段として登場した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:16:29 GMT)
Isospectral potentials with Dirac delta interaction: Constrained Spectra [0.6] ディラックデルタ関数(DDF)を含む量子ポテンシャルを、不連続な超ポテンシャルを通して超対称性(等スペクトル)構造内に研究する。
局所特異点は量子系の離散スペクトルを制御・工学することができる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:52:25 GMT)
EDGE: Engine for Deterministic Graph Evaluation through Conversation Simulation from Graph Structured DSL Configuration [0.5] 本稿では,ドメイン固有言語を利用したプランナであるAgentGraphを基盤とした形式的評価手法を提案する。
我々は,対話経路を包括的に列挙するグラフアルゴリズムを活用し,エージェントの完全な行動空間をキャプチャする包括的評価セットを形成する。
信頼性を定量化するために、反応と軌道決定性、構造的付着、意味的整合性を測定する新しい指標を定義する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:56:53 GMT)
Robust K-means Clustering using the Density Power Divergence Measure [0.5] 本稿では,密度パワーの分散とマハラノビス距離を用いたロバストクラスタリング手法であるMK-means DPDを導入する。
マハラノビス距離に基づく K-平均は一般収束保証を欠いているため、収束不変量である密度一貫性 MK-平均 DPD を導入する。
結果のアルゴリズムが有限ステップに収束することを証明する公式な定理を証明します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:41:19 GMT)
System Identification of Admittance Models for Large Real-World Objects [0.4] 本稿では,大規模な実世界の物体の物理的に一貫したモデルを作成するための,最初の完全なワークフローを提案する。
モデルは重く近接したドアと手押し車のために製造される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:06:58 GMT)
Beyond Fluency: A Rubric-Based Benchmark for Evaluating Saudi Dialect and Cultural Competence in Large Language Models [0.4] サウジアラビア方言の古風なベンチマークを示す。
9カテゴリの分類で466のエラー事例を分類する。
一貫性に反するトレードオフとモデル固有のエラーシグネチャを観察する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:31:35 GMT)
Emergence of Strategic Equilibria from Transverse Field Ising Hamiltonian Dynamics [0.4] 逆場量子イジングモデルから導かれる演算子に基づく定式化を用いて量子ゲームを研究する。
ハミルトン動力学はゲーム設定におけるジレンマを解消するエンタング演算子を自然に生成することを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:41:19 GMT)
Neural ODE enhanced linear mixed effect models for estimating complex association patterns of time-varying covariates with the marker trajectory [0.3] 本稿では,線形混合効果フレームワークにニューラル正規微分方程式(Neural Ordinary Differential Equation,Neural ODE)を組み込むニューラルODE-LMMを提案する。
この方法では、BMIの軌跡依存的な関連と、認知的低下を伴うグルコースの断食が明らかにされる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:45:02 GMT)
A Lightweight Phenology-Aware YOLOv5 Framework for Tomato Growth Stage Detection in Resource-Constrained Bhutanese Greenhouse Environments [0.3] ブータンでは、温室栽培は高度変動、昼日温度の変動、拡散照明、限定された自動化、および局所的な注釈付きデータセットの不足の影響を受けている。
本研究は, トマト成長段階認識のための, Ultralytics YOLOv5 から派生した, 軽量で表現学を意識したオブジェクト検出アーキテクチャである Pheno-Lite + Efficient Channel Attention (ECA) を提案する。
提案されたモデルは、90.6%の精度、88.8%のリコール、92.6%のmAP@50、4.0百万のパラメータと10.9のGFLOPを640 x 640の解像度で達成している。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:23:08 GMT)
Cost-Effective Repository Exploration for Agentic Issue Localization [0.3] 我々は、この段階を低価格モデルに委譲できるかどうか検討する。
我々は、早期の候補発見、トップ3のゴールドファイルカバレッジ、厳格なファイルセット回復、エージェント時間、トークン使用率を測定する。
高品質なエクスプローラーは、ローカライゼーションの指標を越えてリードするが、かなり安い運用ポイントが出現する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:16:33 GMT)
Large-Scale Qualitative Research with AI: Infrastructure, Management and Operation of the Socioscope Data Pipeline [0.3] 本稿では、AI拡張分析を実現するために、結果のデータがどのように構築され、管理されたかの技術的参照を提供する。
データパイプラインの終端について説明している: システムサンプリングフレーム; 食品システム内の各イニシアチブの関係をキャプチャするために使用されるトランザクショングリッド。
コスト、メトリクス、学んだ教訓、制限を報告し、他のチームがソシオスコープの方法論を再利用し、適応し、改善できるようにします。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:25:27 GMT)
Convergence issues in Relational Concept Analysis based on AOC-posets [0.2] 形式的概念分析(英: Formal Concept Analysis, RCA)は、概念的分類構築と2値テーブルからの規則発見のためのアプローチである。
RCAは、他のオブジェクトグループとの関係を特徴とするオブジェクトのグループを強調することを目的としている。
一般の場合、収束がもはや保証されない理由を示し、それを保証できる条件を特定し、どのように収束を回復できるかを議論する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:09:37 GMT)
Sleight of Word Benchmark: Can Language Models Notice If Their Own Output Was Tampered With? [0.2] この外部摂動に対するモデルの認識を評価することで、簡単なテストを構築することができる。
この精神では、単純なベンチマークが構築され、生成プロセスにおいて1つの単語が一貫して別の単語に置換される。
モデルのサプライズに関連するメトリクスと、19の異なるオープンウェイト言語モデルに対するテキスト反応の評価の2つの異なる軸が測定される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:31:31 GMT)
How Prolific Sellers Self-Present: Dissecting the Communication Patterns of 1.6 Million Reverb Listings [0.2] 多くの売り手は、製品の客観的な側面と機能的な側面にもっとフォーカスする傾向があります。
しかし、この情報をどう伝えるかは、潜在的な買い手に伝えられる話の典型だ。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:30:56 GMT)
Decay versus dephasing in Rydberg analog optimization: exchange rate, mechanism, and schedule design [0.1] ノイズレスリドバーグ原子最適化はデコヒーレンスとデフォーカスの観点から研究されている。
一階摂動理論はノイズのない伝播だけで$$を再現する。
コストモデル全体がノイズを伴わないため、ノイズのないシミュレーションをすることなく、スケジュールをデバイスのチャネルミックスに調整することができる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:41:02 GMT)
Zero-Knowledge Predicate Proofs Between AI Agents: A Measured, Cross-Protocol Gateway and the Source-Integrity Gap [0.0] マルチエージェントAIプラットフォームは、ステージングからプロダクションへ素早く移行するが、エージェントが信頼を確立する方法はまだ初歩的だ。
提案から実行システムまで,エージェント間での検証可能なデータ最小化を行う。
32ビットのしきい値述語は6.2msで証明され、608バイトのBulletproofs証明で1.0msで検証される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:16:17 GMT)
When Does a Classifier Help an LLM? Classifier-Guided Prompting and Hybrid Classifier-LLM Models for Credit-Default Prediction [0.0] 大規模言語モデル(LLM)は、最近、信用デフォルト予測に適用されている。
我々は,クレジットカードのデフォルト予測のために,適合型分類器とLCMを組み合わせる方法について検討した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:17:37 GMT)
Verification-Time Dependency on a Disappearing Evaluator [0.0] 本稿では,Execution Governance (EG) 3.0から派生した3つの検証時間構造について述べる。
EG(Decision-State Commitment, Independent Verifiability, Counterfactual Auditability)。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:17:32 GMT)
Valley-Enabled Intrinsic Dresselhaus Spin-Orbit Coupling in Silicon [0.0] シリコン中のスピン軌道-バレー結合の対称性に基づく理論を示す。
磁場勾配によって生じる対称許容スピン-バレー結合を導出する。
これらの結果は、シリコンのスピン軌道物理学における基本的な要素としてバレー対称性を確立する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:25:34 GMT)
Transformer-Based Flow Shop Scheduling Using MILP-Generated Training Data [0.0] トランスフォーマーモデルは、トークンを高次元の埋め込み空間にマッピングし、注意を通してコンテキスト情報を伝播することで、トークンシーケンスにおける複雑な相互作用をキャプチャすることができる。
これにより、次段階の予測タスクとして二次資源を用いた非置換フローショップスケジューリングをモデル化する候補となる。
この研究は、トランスフォーマーモデルはある程度は、MILP-第2次非置換フローショップスケジュールからパターンを学ぶことができると結論付けている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:58:30 GMT)
Towards a Systems Foundation for Agentic Skills: Architecture, Lifecycle, and Security [0.0] 本稿ではエージェントスキルエコシステムのための統合システム基盤と参照アーキテクチャを確立する。
我々は、決定論的実行環境による高いレベルの認知計画をブリッジした、外部化された手続き的知識として、スキルを形式化する。
さらに,実行時検証と防御機構とともに,マーケットプレースダイナミクス,パブリックレジストリ,新興敵脅威ベクトルについても検討する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:36:42 GMT)
Towards Agentic Cloud Engineering: Graph and Loop Engineering with a Zero-Trust Agent Harness [0.0] 我々は、自然言語のエージェントクラウドエンジニアリングタスクを検証済みのコードリポジトリと検証済みの運用クラウドデプロイメントに変換するエージェントAIフレームワークを提案する。
Google Cloud上のフレームワークをインスタンス化し、リポジトリの評価、管理された実行、エビデンス対応の進捗、運用デプロイメント、バウンドリカバリを評価します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:20:49 GMT)
The quantum supremum of the $I_{3322}$ Bell inequality is not attained in finite dimension [0.0] 2010年、Pl と Vértesi は、局所ヒルベルト空間次元が大きくなるにつれて、最適化された値が収束するように見える$I_3322$ベルの不等式に対する有限次元戦略の族を発見した。
我々はこの極限がすべての有限次元の量子戦略の上限であると推測したが、有限次元の戦略がそれを達成することはない。
この証明はベル汎函数の対称性を用いて全ての戦略を確率の有限行列に関連付ける。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 11:48:13 GMT)
The Price of Intelligence: A Quality-Adjusted Price Index for AI Services [0.0] 本稿では、公開データからAI推論市場の品質調整価格指標を構築する。
3,208モデルと86プロバイダにわたる21,024のポスト価格観測を組み立てている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:17:14 GMT)
The Policy Deficit in AI x Social-Emotional Learning Research [0.0] 我々は、AIとSELの交点を調べる65の論文を体系的にレビューした。
研究の4分の3近くは、政策への影響について全く言及していない。
我々は「インプリケーション・アズ・ア・アフター・思想」から「インプリケーション・アズ・メソドロジー」への転換を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:25:09 GMT)
The Pego Theorem for the Hilbert--Schmidt Class [0.0] ヒルベルト・シュミット作用素の有界集合が前コンパクトであることと位相空間シフトの下で一様同値であることを示す。
量子物理学への応用を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:05:30 GMT)
The Nearest Target Is the Wrong One: Target Separation in Arc2Face Identity Unlearning [0.0] 顔条件付きジェネレータからのIDの学習は、リダイレクトされた出力が元の人物としてまだ検証されている場合、静かに失敗する可能性がある。
この失敗は、認識空間におけるリダイレクトターゲットが、認識空間における忘れアイデンティティからどこまで離れているかという、制御可能な選択に依存していることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:22:26 GMT)
The MS Unidirectional Current as a Generalization of the ABC Absorption Current [0.0] 吸収ロビン境界条件と一般化マルキューカ-シュース(MS)一方向電流系との比較を行った。
ロビン吸収は 1 つのパラメータ $>0$: が指定されると運動量依存の吸収プロファイルが固定される。
一般的なMS構成では、検出器応答は、検出法則の正則性と準正規化条件に従うスペクトル関数$(k)$によって記述される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:55:40 GMT)
The Language of the Question Selects the Market: Query Language and Exit IP as Separable Factors in Commercial Recommendations from a Generative Search Interface [0.0] ログアウトされたChatGPT WebインターフェースとOpenAI APIに対して,234回の動作を制御したプローブを報告した。
クェリ言語が国と一致した地域では、グローバルブランドが24ラン中1ランを獲得し、同じ接続で英語で質問され、現地ブランドはエストニアとトルコで6ラン中0ランを獲得した。
ロシアはエストニアから6ラン中4ランでエストニアのサプライヤーに、全6ランでグローバルのサプライヤーに指名した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:25:17 GMT)
The Intervention Gap in Latent World Models [0.0] 計画時介入の忠実さは、学習された世界モデルの際立った、測定可能な特性である。
リリースされたTD-MPC2チェックポイントサイズ全体で、タスクオブザーバのオペレータエラー診断が増加するにつれて、エピソードリターンが減少する。
タスク信号無しで訓練された自己教師付き世界モデルは、共有タスク上のタスク選択モデルよりもかなり優れた演算子を保存する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:47:51 GMT)
Text Data Analysis and Classification Methods - Insights from Customer Letters in Life Insurance [0.0] この作業は、顧客の手紙をキャンセルとして分類し、利用可能であれば、それぞれの理由を特定することに焦点を当てる。
我々は、データ取得と準備、代替案について論じ、選択したアプローチの理由を説明します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 10:12:04 GMT)
SynCrash: A Multi-Stage Pipeline for Zero-Shot Accident Detection and Localization in Traffic Surveillance Video [0.0] CCTVビデオにおけるゼロショット事故検出,空間的局所化,衝突型分類のためのパイプラインであるSynCrashを提案する。
CVPR 2026 Challengeでは,事故発生時の予測,フレーム内の衝突の発生状況,衝突の種類などについて検討した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:42:59 GMT)
Structural Hierarchy and Geometry in Molecular Representation Learning [0.0] 分子のBemis-Murcko足場を明示的にコードし、それを分子の埋め込みがモデルが学習するものを変えるのを監督するかどうかを調べた。
2つの強化強度の中で、足場を監督するモデルは、同一および構造的に関連付けられた足場の両方に応じて一貫して分子を編成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:34:17 GMT)
Static Detection of Post-Quantum Cryptographic Algorithms in Stripped Binaries for Digital Forensic Examination and Migration Assurance [0.0] 本稿では,数理論変換定数テーブルからアルゴリズムを同定する静的解析手法であるケストレルについて述べる。
これは ML-KEM と ML-DSA の標準化された格子スキームに適用される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:22:02 GMT)
Source-Dependent Deference in Medical Imaging Agents Under Falsified Findings: A Pilot Audit [0.0] ReActスタイルのツールコールエージェントが、偽造された発見が到着したら、すでに与えられた回答を放棄するかどうかを監査する。
私たちの結果は、ツールを使わずに正しく答えられたコミッショナー・エラーのケースです。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:58:15 GMT)
Scientific Agent Skills: A Library of Procedural Knowledge for Research Agents [0.0] 科学エージェントスキル(Scientific Agent Skills)は、16の領域で163の手順のオープンライブラリである。
各スキルは、バージョン管理されたヒューマン可読な命令ファイルを中心に構築されたディレクトリである。
タスクレベルの評価は行わず、ホストの選択も行わない。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:40:35 GMT)
SVI2LoD3: Agent-Driven Reconstruction of LoD3 Facade Openings in Semantic 3D City Models from Volunteered Street View Imagery using Large Language and Visual Models [0.0] 本稿では,3次元都市モデルにおけるファサード開口部再構築のためのエンドツーエンドのエージェント駆動パイプラインを提案する。
ファサード特徴距離(FFD)と呼ばれるファサード再構成のための新しい評価基準も導入する。
提案したパイプラインと評価戦略は、セマンティックに富んだ3D都市モデルの自動生成と分析に実用的でスケーラブルな貢献を提供する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:37:01 GMT)
REIGN: Refurbished Embeddings with Integrated Guidance Networks for Efficient Context-Length Scaling [0.0] REIGNは、生のトークンではなく、凍結したガイダンスネットワーク(GN)からのコンテキスト化されたチャンク埋め込みのシーケンスで動作するバイエンコーダである。
コントラストトレーニングと長期文脈における評価のための,合成長文書検索ベンチマークをリリースする。
2組の重要度試験は、特許上の1.6-4.3倍の大きさのモデルと同等であり、LoCo上の20倍大モデルの0.65 nDCG@10の範囲内に留まる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:50:38 GMT)
Quantum Steering Geometry at High Energy Particle Colliders [0.0] 量子ステアリング楕円体(QSE)に基づくコライダー観測値の定式化
コライダースピン密度行列は2量子状態を定義し、そのQSEは局所的な測定を通してアクセス可能な条件状態の幾何学を与える。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:53:58 GMT)
Pathwise Random Hamiltonian Simulation [0.0] 我々は、qDriftを任意の順序に拡張するPathwise Random Hamiltonian Simulation (PRHS)を導入し、各時間ステップをM$の相関スライスに分割する。
PRHSはqDriftを超える2~4桁の精度をクエリコストで達成する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:37:58 GMT)
Partially Linear Autoencoders for Manifold Learning and Dimensionality Reduction [0.0] オートエンコーダは、非線形次元減少と多様体学習に広く用いられている。
本稿では,エンコーダの特定の役割と,精度を低下させることなく線形に制約できる範囲について検討する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:54:48 GMT)
Online Gate-Driven Flow Control in Resin Transfer Moulding Using a Neural-Network Surrogate [0.0] 樹脂の転写成形では、レーストラッキング効果によりフローフロントが均一に進行することは滅多にない。
この問題に対処するために,評価と制御の併用戦略を提案する。
フィリング中に収集した圧力センサデータを用いて、繰り返し拡張カルマンフィルタを用いて未知のレース追跡強度を推定する。
完全飽和前に, 補助ゲート圧力を同時に最適化し, 樹脂が通気口に着くのを防ぐ。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:56:43 GMT)
Module Number Adaptive Visual Shape Control for Serial Modular Soft Robots [0.0] 本稿では,モジュール数適応型視覚形状制御法を提案する。
1〜5個のモジュールを持つロボットに対して、単一のモジュールアクチュエータ形状データのみに基づいて訓練されたコントローラを再利用する。
実験により、単一モジュール制御学習は、特定の制御データ収集の設定なしに、全体をスケーラブルに制御できることが示されている。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 04:33:10 GMT)
Misunderstanding Convivial Solipsism: the Necessity of a Perspectival Logic [0.0] 生き残るソリプシズムは容易に誤解される。
本論では, 現代ソリプシズムの議論において生じる誤解の家族を再構築する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:22:43 GMT)
Localized orbitals and tunnel couplings from general confinement potentials in gate-defined quantum-dot arrays [0.0] 一般の1粒子実効軌道ハミルトニアンの固有基底を、個々の量子ドットに関連する局所化軌道波動関数の$s$-, $p$-, $d$-, $ldots$-shellsに回転させる数値的な局在化手順を提案する。
本手法を2次元三角形Si-MOS三量子ドットアレイ上で,トンネル結合の電圧依存性と障害発生時の分布を求めることにより実証する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 12:52:50 GMT)
LLM Judges as Raters: A Pre-Registered Audit of Severity, Halo, Reliability, and Version Instability in LLM Essay Scoring on Public Corpora [0.0] 大規模言語モデル (LLM) は、分析学習においてエッセイグレーダーとして使われることが多い。
教育測定では、ラッカーは重度、ハロー、ドリフトも楽器として異なることを警告している。
LLM審査員をレーダとして扱い、登録済みのレーダ効果電池を2言語で公開コーパス上で動作させる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 02:45:46 GMT)
Josephson-Phase Reversal of Non-Bloch Andreev Propagation [0.0] 非エルミート制御は、固定散逸による固体系では困難である。
スピン軌道結合した平面ジョゼフソン接合において、ジョセフソン位相だけを変化させると、低エネルギーのアンドレーフ帯域の非ブロック伝播が逆になることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 13:31:48 GMT)
INTERVenE: Temporal-Abstraction-Interval Based Transformers for Short-Horizon Medical Event Prediction [0.0] 本論文では, 時間的知識に基づく時間的抽象化(KBTA)について述べる。
57,078MIMIC-IVのGRU-D, STraTS, KarmaLegoに対する投与成績について検討した。
入力表現アブレーションは、KBTAベースの間隔を解釈可能な基質として、構造化された離散化をまたいだリフト転送を確認する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 16:52:34 GMT)
Generative vs. Encoder Models for Multilingual NER: A Comprehensive Empirical Study on Naamapadam [0.0] 本稿では、NAMAPAdamベンチマークの11言語すべてを対象に、NERのための生成およびエンコーダに基づくニューラルアーキテクチャの比較研究を行う。
我々は,エンコーダ優位,部分被覆,障害ゾーンという3つの言語クラスタを同定する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:41:04 GMT)
Game-Agnostic Value Functions through Automatic JSON Feature Extraction [0.0] Bag-of-Tokens (JSON-Bag) は,その記述をトークン化することによって,ゲーム軌跡を汎用的に表現する手法である。
この手法はランダムフォレストをベースとした特徴選択とゲームステージ固有の特徴の選択によって拡張可能であることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:45:36 GMT)
Forward-Deployed Full-Stack Engineering for Autonomous Cloud MLOps [0.0] 本稿では,自然言語MLOpsクラウドエンジニアリングタスクを検証されたリポジトリと運用クラウドデプロイメントに変換するためのエビデンス付きマルチエージェントフレームワークを提案する。
Google Cloud Platformのフレームワークを実現し、リポジトリの完全性、管理された実行、エビデンス対応の移行、クラウドプロモーション、バウンドリカバリを評価します。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 07:13:10 GMT)
Exact Resource Laws for Passive Wavelength Routing in Entanglement Networks [0.0] 絡み合いに基づくネットワークは、スペクトル相関光子対を受動的にルーティングすることで、量子通信のためのスケーラブルなフレームワークを提供する。
ネットワークの接続グラフを通してこの問題に対処し、そこでは波長割当が資源最適化問題となる。
連続波励起ブロードバンド源に対するBBM92量子鍵分布(QKD)の秘密鍵レート解析を定式化する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:12:37 GMT)
Exact Entanglement Swapping through Single-Occupancy Measurements in Gaussian Fermion States [0.0] 条件状態の絡み合い構造を同一の2つのコピーで$m$の対応するラングを計測して決定する。
両コピーの未測定部分間の絡み合いエントロピーは初期状態とは独立であることがわかった。
P_m=det C_Ldet(I_m-C_L)=det(C_LRC_RL)$で、初期相関のみによって決定される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:01:55 GMT)
Evolution Generators for Complex Parameters [0.0] 我々は、進化生成器の形式化の適用性を、ワイティンガー微分を通じて複素数値パラメータに拡張する。
複素パラメータとその共役を独立変数として扱うことにより、進化方程式はヒルベルト空間バンドルの量子状態と計量の両方に対して導出される。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:47:02 GMT)
Evaluating a 4B open-weights local LLM for agentic DFT workflows: a literature reproducibility audit [0.0] この研究は、様々なハードウェア制約に対して自律的な科学パイプラインを実行するオープンウェイトQwen3:4Bモデルを評価する。
このシステムは、非構造化テキストからパラメータを抽出し、それらを密度汎関数理論(DFT)入力に変換し、シミュレーションを収束させる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:59:05 GMT)
Diffusion-Based Inverse Design of Dielectric Resonator Metasurfaces for Shaping Smart Electromagnetic Environments [0.0] 将来の無線システムは、周囲の空間を受動伝搬媒質からスマート電磁環境へと変えることが期待されている。
鍵となる課題は、電磁伝搬の調整のための準曲面の逆設計である。
本稿では,ターゲット角散乱パターンからの準曲面の逆設計のための条件拡散フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 17:04:45 GMT)
Demand-Side Measurement for Generative Engine Optimization: Constructing and Validating a Million-Persona, Intent-Annotated Buyer Corpus [0.0] ChatGPT、Gemini、Perplexityなどのジェネレーティブエンジンは、直接購入者の質問に答え、回答の中にブランドのショートリストを付ける。
我々は,511の業界ラベルと4つの市場コンテキストにまたがる1,031,732の総合購入者ペルソナであるペルソナGen-1Mを構築し,検証した。
それぞれのペルソナには、クエリセットをカバーする1つのプライマリ_intentラベルと、購入者が信頼するソースタイプを指定した推奨_sourcesフィールドがある。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:28:19 GMT)
Data-Driven Design Optimization of Streaming-Potential-Mediated Electrokinetic Transport of Viscoelastic Fluids in Microchannels [0.0] 流動電位による粘弾性流体の輸送は、その電気力学エネルギー変換と微小流体輸送への応用から研究の注目を集めている。
スリットマイクロチャネルにおけるPhan-Thien-Tanner流体の圧力駆動型電気動電輸送の迅速な設計最適化のためのサロゲートアシストフレームワークを開発した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:13:39 GMT)
Conducting Stylistic Analysis of Paintings through an Art-History Agent [0.0] 絵画のスタイリスティック分析を自動化するAIフレームワークを提案する。
視覚変換器(ViT)を大量の絵画のコーパスにメタデータで訓練することにより,この美術史固有のデータを埋め込みとして符号化する。
大型言語モデル(LLM)は、関連するアートワークとその付随するキュレーターによるテキストを取得して、それらを記述に合成することによって、それぞれの特徴を解釈する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 08:10:58 GMT)
Branching stochastic mechanics. I. Clustering and connected correlations within a branching-process representation of the Schrödinger equation [0.0] 拡張量子状態の統計における有限範囲相関?
シュルディンガー・ナガサワは正の前方および後方拡散場による波動関数を表す。
拡張ボルン密度と有限相関範囲が1つのカーネルで共存可能であることを示す。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:19:07 GMT)
Beyond Uncertainty: Multi-Solver Disagreement Rewards for Self-Evolving Reasoning Curricula [0.0] 自己進化的推論フレームワークは、チャレンジャーに、解決者の弱点を明らかにする質問を生成するように訓練する。
既存のアプローチでは、チャレンジャーの報酬として1つのソルバのサンプリングの不確実性を用いる。
モデル容量とサンプリング温度に異なる異種アンサンブルを用いたマルチソルバ不一致報酬を提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 20:49:16 GMT)
Beyond Object Authentication: Context-Closed Post-Quantum Authentication for the WebPKI [0.0] 検証者によって受け入れられた認証されたプロジェクションは、それが主張する選択された承認セマンティクスを決定する必要がある。
このアイデアを、更新平面における変更可能なCAコンテキスト状態を認証する2面後量子構造LRpでインスタンス化する。
ピン留めされたCCADB再構築では、Apple、Chrome、Microsoft、Mozillaのビュー全体で44,912のパス/ビューコンテキストと16,858の物理CAラインが取得できる。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 19:59:54 GMT)
Balance of Benchmarks: Semantic Density Reweighting for Benchmark Multiplicity and Task-Conditioned Evaluation [0.0] ベンチマーク記述を埋め込み、各ベンチマークに逆密度のセマンティックウェイトを割り当てるベンチマークのバランスを導入する。
586のモデルと14のベンチマークのスナップショットで、BoBは、一般的な能力を超えた保留タスクにおいて、どのモデルが異常に強いかを予測した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 21:06:29 GMT)
BMN Spread Complexity Across Phase Transitions [0.0] 質量変形型BMN行列モデルにおける量子状態の動的挙動と拡散複雑性について検討する。
我々は、荷電した熱場二重状態を介して力学をモデル化し、3つの異なる熱力学系にまたがる拡散複雑性の進化を辿る。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 14:34:03 GMT)
Asymptotic Entanglement across Dynamical Regimes of a Dissipative Bosonic Dimer [0.0] 本研究では,ビームスプリッタと2モーデスクイーズ相互作用,局所損失,調整可能なコモンバスを用いた散逸性ボソニック二量体について検討した。
この結果は、安定性、非平衡力学、絡み合いを接続するための枠組みとして、非エルミート力学スペクトルを確立した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 09:13:51 GMT)
Arkios: An Open Bilingual English-Nepali Language Model Trained From Scratch, with a Devanagari-Aware Tokenizer [0.0] 我々は150Bのバイリンガル・イングリッシュ・ネパリ文字のトークンにスクラッチから事前訓練された高密度トランスフォーマーArkiosを提示する。
アルキオスは、訓練トークンの桁数が桁違いであるにもかかわらず、3つの比較可能な大きさのオープンモデル(Pythia-1.4B、TinyLlama-1.1B、OLMo-1B)を超える。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 23:39:44 GMT)
Argument-Aware Semantic Alignment of Normative Texts: A Toulmin-Based Neuro-Symbolic Approach [0.0] 本稿では、明示的な引数構造が要求の整合性のために神経意味論に相補的な情報を与えるかどうかを問う。
明示のステップは、主張、根拠、令状、資格者、裏づけ、そしてエントサイムを再構築する。
NERC-CIPからNIST-CSFマッピングのベンチマークでは、引数由来の機能は、ニューロシンボリックなセマンティックベースライン上のアライメントを改善する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 03:30:58 GMT)
Ancilla-mediated fixed-point quantum search using Grover iterations [0.0] グロバーの量子探索アルゴリズムは、非構造化データセットの基本的な二次的スピードアップを提供する。
本稿では,ロバスト収束を実現するアンシラを用いた固定点量子探索アルゴリズムを提案する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 15:13:14 GMT)
An Open-Source, Event-Driven Pipeline for Cryptocurrency Market Data: Ingestion, Forecasting, and On-Chain Fraud Detection [0.0] 本稿では,クラウドネイティブなイベント駆動システムの振る舞いを再現する,完全なオープンソースパイプラインについて述べる。
アーキテクチャ、モデリング手法、および結果のメトリクスについて報告する。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 18:59:08 GMT)
$\mathcal{N}_0$-Foundation: Towards the Age of Tactile Intelligence [0.0] $mathcalN$-Foundationは触覚対応の操作のためのパラダイムである。
我々は、視覚ベースの触覚センサ、触覚のユニバーサルマニピュレーションインタフェース(UMI)、ビジュオ触覚データ収集システムを含む、スケーラブルなデータ収集のためのインフラを設計した。
実ロボット遠隔操作とUMIベースのデモを混合して収集した,6つの実施形態,450のタスク,数十億のペアリングRGBおよび触覚フレームにまたがる,30000時間以上の視覚的および触覚的デモンストレーションを含むNeoDataを構築した。
論文参考訳(メタデータ) (Sun, 30 Aug 2026 06:46:18 GMT)