Rubrics as Visual-Repair Context for Self-Evolving UI-to-Code Generation [147.1] ローカルコード編集は、レイアウト、スタイル、コンポーネントの依存関係を通じて伝搬し、以前は忠実だった領域を劣化させながら、1つの視覚的ミスマッチを修正する。
本稿では,視覚フィードバックを構造化された視覚再生コンテキストとして表現するために,ルーブリックを用いたルーブリック誘導フレームワークであるRubSEを紹介する。
RubSEは最終ラウンドおよび最高ラウンド設定での自己進化を著しく上回り、より安定した改良とより高い軌道レベルの性能天井を実現する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:03:46 GMT)
PhysMLLMs: Spatial Priors for Unified Referring Segmentation and Grounded Reasoning of Images and Videos [116.6] ビデオ大言語モデルは、言語ガイド付きビデオセグメンテーションをサポートするが、時間的不整合を示すことが多い。
本稿では、物理にインスパイアされた空間連続性をビデオMLLMに注入する訓練段階のプレインジェクションアーキテクチャであるPhysMLLMを提案する。
複数のビデオベンチマークを通じて、PhysMLLMsはビデオセグメンテーションマスクの品質とクロスフレーム一貫性を改善している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:01:59 GMT)
TurboT2VA: Fast Large-Scale Text-to-Video-Audio Generation via Score-Regularized Consistency Distillation [105.1] TurboT2VAは、ジョイントテキスト・ツー・ビデオ・オーディオ生成のための蒸留および推論フレームワークである。
LTX-2では、4段階の蒸留により512$times$768の標準評価解像度でジェネレータのレイテンシを50.52sから2.51sに短縮する。
完全なスタックは、ジェネレータのレイテンシを318.74sから1つのNVIDIA H20で5.83sに短縮し、54.67$times$ジェネレータのみのスピードアップを達成した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:09:02 GMT)
Poisoning Agentic Alpha: Adversarial Vulnerabilities Across Roles and Architectures in Multi-Agent Trading Systems [103.9] LLMベースのマルチエージェントトレーディングシステムは、研究プロトタイプから実際の資産を管理するライブデプロイメントへと急速に移行している。
破損した信号は最終決定に伝播し、実現された財政損失に変換される。
本稿では,金融分野において,敵対的信号がマルチエージェント取引システムにどのように入るのかを特徴付ける最初の体系的実証的研究について述べる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:07:37 GMT)
On-Policy Self-Distillation in Diffusion Models [89.3] 強化学習は、拡散モデルと人間の好みやタスク固有の目的とを一致させることができるが、エンドポイント報酬は、中間的偏見予測をどのように変更すべきかを規定していない。
そこで我々は、DiffusionOPSDを、画像レベルの報酬誘導を明示的なターゲットに変換して、サンプルクエリにおけるクリーンな出力予測を行うオンライン自己蒸留フレームワークとして導入する。
SD 3.5-Mとステップ蒸留したZ-Image-Turboを用いて、2つのバックボーンと10個の評価器で20の報酬マッチング設定のうち19のファイナルホールトアウトスコアを達成した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:55:24 GMT)
PURA: Provably Unbiased and Robust Multi-Bit Watermarking for AI-Generated Text Attribution [83.7] PURAは、テキスト属性に対する不偏で頑健なマルチビット透かし方式である。
PURAはトークンの確率を直接摂動するのではなく、鍵付き逆変換サンプリングによって潜在サンプリング空間にペイロードを埋め込む。
PURAは、高負荷体制において、既存の非バイアスベースラインを大幅に上回ることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:57:46 GMT)
Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses [83.3] Recurisは、ロングホライゾンエージェントハーネスのためのExperiential-Working Memoryアーキテクチャである。
Work Memoryはタスクの進捗を追跡し、Experiential Memoryからスキル選択をガイドする。
4つのロングホライズンベンチマークと10のモデルでRecurisは37のモデルベンチマークペアのうち35のタスク成功を改善している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:56:35 GMT)
StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing [80.4] StepGuardは、完了したエージェントの軌跡を監査し、実行前にツールアクションをチェックするステップレベルのガードモデルである。
StepGuardは、GPT-5.4に匹敵するパフォーマンスで、オープンウェイトガードモデルの中で最高の平均精度を達成した。
AgentDojoとAgentDynのエージェントを保護するために使用される場合、StepGuardは平均攻撃成功率を77.3%削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:17:27 GMT)
TurnBench: A Multi-Domain Benchmark for Turn-Taking Dynamics in Spoken Dialogue [79.8] 自然な会話の話し手は、話と聞き取りを交互に行い、いつ床をつかむか、保持するか、または譲るかをリアルタイムで決める。
そこで本研究では,30時間の人的会話を手作業でラベル付けしたコーパスを,エンド・オブ・ターンと割り込み検出のための標準評価プロトコルと組み合わせたベンチマークTurnBenchを提案する。
一方、割り込み偽陽性は強く型依存的であり、バックチャネル・デンス相互作用スタイルに集中している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:14:36 GMT)
PeakBench: Benchmarking Resource-Aware Tool Invocation in LLM Agents [79.3] PeakBenchは、実行可能なマルチツール依存アノテーションと測定リソースプロファイルのベンチマークである。
我々は,強い論理的計画が資源制約下での安全あるいは効率的な実行に確実に変換されないことを示す。
PeakBenchは、リソース認識エージェントの振る舞いの診断に有用なテストベッドである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:56:08 GMT)
ResiSpec: Enhancing Multi-Candidate Speculative Sampling via Residual Distribution Shaping [79.2] ResiSpecは、検証中に提案の配布を戦略的に改革するフレームワークである。
候補の偏光を防止し、最先端のマルチ候補法よりも最大1.92$times$スピードアップを達成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:25:55 GMT)
Autonomous Cyber Defense: Real-Time Attack Detection and Mitigation in Software-Defined Networks Using Machine Learning [78.3] この研究は、リアルタイムでネットワークトラフィックを監視し、攻撃を診断し、自動的に対策を適用する機械学習ベースのシステムを示す。
Syn flooding denial of service attackによるケーススタディでは、人間の介入なしに21秒で攻撃が検出され、ブロックされていることが示されている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:36:49 GMT)
Who is the Agent to Blame? Localizing Faithfulness and Citation Mistakes in Agentic Deep Research [75.9] ディープリサーチ(DR)システムは、Webから情報を検索して合成する複数のエージェントを編成することで、長い形式の引用レポートを生成する。
循環はこれらの報告の忠実さを評価するための主要なメカニズムであるが、現在のDRシステムでは引用のリコールが不十分である。
そこで本稿では,エージェントが各エラーをローカルにテストすることで,各エラーをピンポイントで検出する手法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:34:18 GMT)
Investigating Knowledge Transfer Across Interactive Dialogue Games [73.4] 異なる対話ゲーム間での知識伝達について検討する。
Clembench スイートのゲーム上で LLM モデルを微調整することにより、転送可能性について検討する。
いくつかのゲームは微調整よりも転送の恩恵を受けており、ビジュオパティアル・ファミリー(例えば探索ゲーム)は転送が最善である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:47:31 GMT)
LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training [71.2] マルチモーダル学習のための大規模オープンビデオデータセットであるLAION-BVDを提案する。
CommonCrawlから収集された1.3Bプラットフォーム固有のビデオURLを含んでいる。
総視聴時間は1000万時間で、8000万のビデオをダウンロードします。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:34:19 GMT)
Belief Cascades Drive Persuasion in LLM Agent Networks [71.2] 本研究では,実世界のego-networkトポロジに根ざしたLLMエージェントのネットワーク上で,ゴール指向の説得者がどのようにスタンスをシフトするかを検討する。
直接露光は、競合走における次のラウンドの姿勢変化を確実に予測し、ピアリレーは小さいが測定可能な影響をもたらすことを示す。
これらの結果は、多エージェントの説得を軌跡レベルのプロセスと露出レベルのプロセスとして評価することを主張する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:01:19 GMT)
SkyDrive: Learning to Drive in a New City from Aerial Traffic Monitoring [69.9] emphSkyDriveは、ドローンベースのトラフィック監視を使用して、新しい環境における自律運転エージェントの効率的な監視を提供するフレームワークである。
以上の結果から,航空交通監視は,新都市における自律走行システムに適応するための,効率的かつスケーラブルなデータソースであることが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:47:09 GMT)
Joint Optimization of Tool Creation and Use for Large Language Model Agents [69.1] SMITH (-grounded Multi-task Iterative Tool Honing) は、単一のポリシー内でツールの作成とツールの使用を訓練する。
SMITHで訓練された4B Qwen3は、正確に検証された13の手続き的推論タスクで、保持されたタスクで平均79.8のマクロ平均精度に達する。
また、TabMWP-Hardでは40.4、ドメイン外のGQAでは42.6に到達している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:59:34 GMT)
WarpSAC: Towards the Pinnacle of Scalable Off-policy RL by Rethinking Exploration and Exploitation [67.8] 大規模並列シミュレーションは、非政治強化学習を訓練するデータ体制を変える。
これらの安定化器はデータ登録に依存していることを示す。
我々は、政治外RLアルゴリズムのレシシック対応ファミリーであるWarpSACを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:24:15 GMT)
CAFE: Self-Improving Search Agents Need Co-Evolving Feedback [64.5] アウトカム管理された検索エージェントは、いつ、どのように証拠を回収するかを学習するが、端末の報酬は中間エラーのローカライズも、それらのエラーが複雑になる前に継続する軌道のリダイレクトもしない。
学習した軌道内での介入として修正的フィードバックを扱うことは、エージェントがいつフィードバックを要求し使用するかを決めなければならないのに対し、批評家は、エージェントが改善するにつれて障害パターンが変化する結果構築されたロールアウトから有用な修正を推測しなければならない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:39:00 GMT)
Ockhamareto: Pareto-Gated Segment-Level Credit Assignment for Concise Unit-Test Generation with Reinforcement Learning [64.5] 我々は単発のGRPOフレームワークであるtextbfOckhamaretoを紹介した。
Ockhamaretoには2つの主要なコンポーネントがある: (i)emphPareto-gated Bonusは、(mutation, $-$#tests)スペースで非支配的なロールアウトのみを報酬する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:20:02 GMT)
ExpConCAD: Experience-Guided Text-to-CAD Generation from Shape Descriptions with Implicit Spatial Constraints [63.5] 空間的制約の欠如は、基礎となる構造に関して推測されるべきである。
本研究では,暗黙的空間制約補完のための経験型フレームワークExpConCADを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:58:33 GMT)
CIVA: Critic-Induced Value-Subspace Attacks on Visual World-Model Agents [62.3] 我々は、視覚的世界モデルエージェントに対するホワイトボックス、因果、オンライン攻撃について研究する。
批判的価値空間攻撃(textbfCIVA)を提案する。
私たちのキーとなる観察は、ロールアウトとともに、批評家が指導する摂動は、被害者自身の批判によって引き起こされる低次元の部分空間に集中しているということです。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:49:04 GMT)
Speech-to-SOAP: End-to-End Summarization of Medical Dialogues: KIT@BeTraC 2026 [62.2] 我々は、KITのこの年に提出したBeTraCチャレンジを軽量トラックで紹介する。
我々の主な貢献は、多種多様な医療対話データセットを合成音声生成と自動生成SOAP監視によって統合するスケーラブルなデータ拡張パイプラインである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:51:03 GMT)
SAGE: From Direct Answering to Evidence-Grounded Inference for Chinese Ancient Document Understanding [61.0] 中国古文書理解のためのエビデンスを基盤としたマルチエージェントフレームワークであるSAGEを提案する。
SAGEは、タスク対応計画、ツールによるエビデンス獲得、クレームレベルの検証、バウンドリプランニングのための特殊エージェントを調整する。
AncientDocベンチマークの実験によると、SAGEは直接答えベースラインと一貫して優れていた。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:01:51 GMT)
Long-Horizon Audio-Visual Generation for Persistent Stories and Interactive Worlds [60.2] 本稿では,2つの目的を持ったオーディオ視覚生成システムであるJoyAI-Echo-1.5を提案する。
この長ビデオ版では、コンポーザブルなクロスショットメモリが導入され、複数の先行ショットと、音声フィルタリングされたフルショットオーディオから派生した話者キューに視覚的エビデンスを集約する。
世界モデルの変種は、不均一なナビゲーション入力を校正されたメートル法6-DoFカメラ軌跡に変換し、幾何学的条件付け経路を介してそれらを注入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:42:59 GMT)
Aggregating Visual Information with Optimal Transport for VideoLM Token Compression [55.9] ビデオ言語モデルは、ビデオを表現の冗長性に富んだ濃密な視覚的なシーケンスとして処理する。
これらのシーケンスは、言語モデルデコーディングにおける視覚的負担を軽減するために不可欠である。
AVIOT(Aggregating Visual Information with Optimal Transport)を導入し,フレーム観測の高密度な経験的指標としてビデオトークン圧縮を論じる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:52:24 GMT)
Event-Based Motion Estimation via Oriented Distance Fields [55.2] イベントベースの動き推定は、高時間分解能と高速動作に対する堅牢性を必要とするタスクの中心である。
本稿では,この最適化を,事前計算された事象距離ベクトルの場上の1つの平均ステップに置き換える,オブジェクト指向距離場運動推定(ODF Motion Estimation)を提案する。
公開および自己収集されたデータセットでは,ODFの動作推定は,比較手法の中で最低レイテンシでサブピクセル精度に達する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:27:42 GMT)
BrowserForge: Scaling Web Episode via Parallel Browser Sandboxes [55.0] BrowserForgeは、オープンなWeb上で多くのブラウザサンドボックスを並行して駆動することで、大規模なWebインタラクションデータを生成する。
BrowserForgeには3つのコンポーネントがある: オープンなWebソーシングステージ。
ルール+モデルクリーニングパイプラインは、失敗した実行を除去し、生き残った推論を単一の統合されたチェーン・オブ・シンクスタイルに書き換える。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:35:42 GMT)
Low-Rank Ternary Adaptation for Fine-Tuning Transformers [54.3] 3次変換器は、極端なメモリと計算効率を提供する。
既存のロービットのLoRAベースの手法では、3次重みを直接微調整することはできない。
3次重みの離散的な更新を表す3次乗法適応を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:15:56 GMT)
SANE: State Anomaly Neutralization for Stable Extreme-Context Delta-Rule Models [53.9] Delta-Ruleリカレントモデルは固定サイズの状態を維持しており、$O(1)$の推論メモリが可能であるが、極端なコンテキスト外挿では不安定になる可能性がある。
我々は,チャンク内並列構造を保ちながら,チャンク境界における適応$tanh$圧縮を適用したtextbfState Anomaly Neutralization (SANE)を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:15:23 GMT)
ROMNet: a hybrid reduced order modeling and machine learning approach to waveform inversion [53.8] 波形インバージョンは、不均一で到達不能な媒体の波速を推定しようとする。
ROMNetと呼ばれる手法を導入し,数値シミュレーションで検証する。
ROMNet と直接 ROM ベースの逆変換と FWI に対する2つの代表的な深層学習手法を比較した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:13:39 GMT)
Do Robotic World Models Really Follow Actions? Diagnosing and Aligning Action-Conditioned Generation for Policy Learning [53.8] 本稿では,視覚的整合性と軌跡アライメントを用いて,より広い行動分布を探索するWorldEchoを紹介する。
本稿では,3つの軸に沿った行動(分布カバレッジ,表現的接地,介入効果のアライメント)を強化するWorldSyncを提案する。
RoboTwinベンチマークと実ロボットタスクの実験は、WorldSyncがWorldEchoメトリクスを改善し、反復的なポリシー改善のためのより信頼性の高いシミュレータとして機能していることを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:59:49 GMT)
Preference Optimization for Non-Verbal Vocalization Synthesis [52.7] 我々は,NV対応TTSの選好最適化について検討し,選好信号,選好ペア構築,DPOに基づく目的に着目した。
我々は、NVタグを別個の出力シンボルとして扱うことにより、NV対応文字誤り率(NV-CER)を定式化する。
18種類のNVタイプをカバーするEmilia-NVと拡張NV-Benchの実験は、異なる設計選択がNVの実現と語彙の忠実性にどのように影響するかを明らかにする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:27:11 GMT)
ChorusTIC: Training-Free Multivariate Time Series Classification via Chorus In-Context Learning [52.7] 異種チャネル構成にまたがるコンテキスト内分類のための分類ネイティブ基盤モデルであるChorusticを導入する。
Chorusticは、可変チャネル構成を元のチャネルカウントとは無関係に固定幅の表現にマッピングする。
コンテキスト由来の分布を使って機能軸を校正し、リーク保護されたコンテキスト内学習を通じてクエリラベルを予測する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:45:24 GMT)
Robust Slip Detection and Material Classification via Spatiotemporal Transformers on a Uniformly-Illuminated Visuo-Tactile Sensor [52.3] 本稿では,一様照明をカスタマイズした視覚触覚センサと統合認識フレームワークを提案する。
提案するハードウェア・ソフトウェア・フレームワークは、複雑なロボット操作のための高忠実度フィードバックと強力なマルチモーダル認識ベースラインを提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:25:27 GMT)
Preference Data Selection for Mitigating the Alignment Tax in Large Language Models [52.2] BALIGNは、アライメント効率を最適化しながら破滅的な忘れを緩和するバランスのとれたデータ選択戦略である。
3つの重要なデータ中心の機能を統一された複合リスクスコアに集約することにより、BALIGNは、ハイリスクな選好サンプルを体系的にフィルタリングする。
標準的な人間の嗜好データセットの実験では、BALIGNはアライメントゲインを損なうことなく基礎的能力を強く保持している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:58:42 GMT)
Flower Hub: A Reproducible Benchmarking Platform for Federated Learning in Simulation and Deployment [51.8] Flower Hubは、分散およびフェデレーションされたアプリケーションを公開、発見、実行するためのプラットフォームです。
ベンチマークを実行可能としてパッケージングすることで再現性のあるベンチマークを実現する方法、標準化されたメタデータを備えたバージョン管理されたアプリケーション、ピン付き依存関係、明示的な評価について示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:09:44 GMT)
CauSec: Unboxing the Causal Drivers of Static Vulnerability Analysis Performance [51.5] 静的アプリケーションセキュリティテスト(SAST)ツールは、業界と学術の両方で広く利用されている。
これらのツールは、高いパフォーマンスを達成するために検出を犠牲にする設計上の選択をしばしば行います。
本稿では,これらのツールによる仮定は概して因果性である,というキーとなる考察を頼りに,この問題に対処することを目的とする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:54:57 GMT)
Across the Loss Landscape with Progressive Growth [51.4] 成長を漸進的緩和と見なして、より平坦な地域に向けての訓練戦略がいかに成長・最適化されるかを示す。
制御されたおもちゃの流域や現実的なResNet/CI-100環境でこれらの予測を実証的に検証する。
プログレッシブな部分空間成長は、より平坦な解を確実に生成するが、曲率の低減は、普遍的にテスト性能の向上に変換されず、平坦性一般化接続における微妙さを強調している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:50:48 GMT)
SWIM: Step-Wise Integrated Measure for Session-supervised List Evaluation in Generative Re-ranking [50.9] ユーザ動作を有限水平プレフィックスのセッションレベルサバイバルプロセスとしてモデル化するリストレベル評価器SWIMを提案する。
SWIMは、リストワイドのタスクにおいて、ベースラインを著しく上回り、全体的なレコメンデーションエンゲージメントを大幅に改善することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:57:48 GMT)
Thinking Beyond Videos: Unifying Video Reasoning and Deep Research for Open-World Video Agents [50.9] 我々は,ビデオトリミング,マルチモーダル検索,Webページブラウジングを協調する統合ビデオディープリサーチフレームワークであるVideoRoverを紹介する。
ビデオ検索のペアが与えられたら、VideoRoverはそれぞれのツールの結果を使って次のアクションを選択する。
この機能を開発するために,26KのSFTトラジェクトリと3Kの挑戦的RLインスタンスを生成する自動データキュレーションパイプラインを構築した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:58:46 GMT)
MatReplace: A Reference-Free, Conditioning-Aligned Benchmark for Material Replacement in Interior Scenes [49.5] MatReplaceは、4つの検証可能な次元に沿って編集を評価する、参照なしのベンチマークである。
A)命令のみ、(B)命令+エリアマスク、(C)教材参照画像の3つのトラックを定義している。
以上の結果から,命名と視覚的接地材料との明確な相違が明らかとなった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:11:18 GMT)
RecurSE: Bounded Recursive Self-Evaluation for LLM Rubric Judges [48.8] RecurSEは、訓練可能な裁判官と同期されたポリシーコピーチェッカーをペアにして、裁判官のメタルーブリックに対する推論を監査し、スカラープロセスの報酬を提供する。
本稿では,RecurSEが医療,ペアワイド,要約,プロフェッショナルベンチマークにおいて一貫した一般化を実現していることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:35:04 GMT)
ADeptS-Bench: Measuring the Trustworthiness of Computer Use Agents Across Devices [48.4] 我々はADEPTS機能フレームワークを基盤とした信頼性ベンチマークであるADeptS-Benchを紹介する。
Safetyストリームは、視覚インターフェースに埋め込まれた脅威を伴うペアの良心/悪意のあるタスクを提供する。
曖昧さストリームは、意図が曖昧である場合、エージェントが明確化を求めるかどうかを評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:21:57 GMT)
Incorporating Cognitive Load and Knowledge Transfer for Multi-Domain Knowledge Tracing [47.6] マルチドメイン知識追跡(LT-MKT)のための認知負荷と知識伝達を取り入れた新しい手法を提案する。
具体的には、独立したドメインをブリッジするために、LT-MKTはまず質問とその関連する概念からテキスト情報を統合し、マルチドメイン階層グラフを構築する。
これらの要因を共同でモデル化することにより、LT-MKTは学生の今後のパフォーマンスをより正確に予測できる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:50:58 GMT)
Unsupervised Post-Training of Foundation Models: A Survey [47.0] 本研究では,unsupervised Post-Training (UPT) について検討する。
学習後モデルを改善するか、エラーを増幅するかを、内部信号とタスク構造の選択がどのように決定するかを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:54:02 GMT)
FireRedAudio: A General-Purpose Audio Language Model with Decoupled Continuous Representations for Understanding and Generation [46.9] 統一音声モデルは、音声合成と編集をサポートしながら、言語、パラ言語、環境情報を認識し、理解する必要がある。
9BパラメータLLMを共用した汎用オーディオ言語モデルFireRedAudioを紹介する。
FireRedAudioは、音声理解と多言語ASRにおける競合的ないし先進的なパフォーマンス、ゼロショットTSにおける強いコンテンツ精度と話者タイムスタンプの保存、Ming-UniAudio-Editに対する大幅な改善を実現している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:37:15 GMT)
FuzzingBrain-Bench V1: Evaluating Open-Ended Bug Discovery by LLMs [46.6] FuzzingBrain-Benchは、AIモデルがオープンソースソフトウェアでバグを発見する能力を評価するためのベンチマークである。
各チャレンジにおけるモデルのパフォーマンスは、生成するクラッシュシグネチャの数に基づいてスコアされる。
クロード・オプス4.8は、77回中60回にクラッシュし、579回中196回を記録。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:09:20 GMT)
Taming foundation model with invariance-oriented pre-training for broad-spectrum EEG analysis across signal-level, brain-state, and brain-health tasks [46.5] INCEPTは11,000時間以上の非競合型臨床脳波をトレーニングした、不変指向の脳波基礎モデルである。
買収後の脳波分析の3段階にまたがる10個のデータセットの広スペクトルベンチマークでINCEPTを評価した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:20:02 GMT)
Graph-Supervised Hierarchical Clinical Alignment for Radiology Report Generation with Large Language Models [46.2] Graph-Hierarchicald Supervised Clinical Alignmentは、階層的な臨床アライメント問題としてイメージレポートの監督を再構築する。
本手法は, このアライメントを, 管理を2つのレベルに分解した疾患条件付きプロセスとして構成する。
MIMIC-CXR,IU-Xray,COV-CTRを用いた実験により,本手法は従来と臨床の両方の指標における性能を一貫して改善することが示された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:32:26 GMT)
Partial Identification under Causal Orders by Linear Programming [46.2] 反事実探索が関連する変数に対する部分的トポロジカル順序を誘導することを示す。
これにより、任意の反ファクトクエリとネストされた反ファクトクエリのバウンダリングが可能になる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:42:38 GMT)
ORBITALIF: An Efficient Spiking Federated Learning Framework for Onboard Cloud Removal [46.1] 低軌道(LEO)衛星は、災害監視や環境監視などの用途において、高解像度で大規模な地球観測を可能にする。
従来のクラウド除去パイプラインでは、処理のためにクラウドイメージを地上局にダウンロードすることは、限られたコンタクトウィンドウ、制限された衛星-地上帯域、高いレイテンシに悩まされている。
オービタルアパシー・インテリティー・アンド・ファイア(OrbitALIF)という,星座をまたいだ雲除去のための新しい衛星統合学習フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:11:19 GMT)
Multi-Agent Self-Improving Reinforcement Learning for Video Reasoning [45.4] グラウンドドビデオ質問応答や時間的グラウンド化のようなビデオ推論タスクは、クエリをサポートする時間的エビデンスを選択する必要がある。
凍結検証器がトレーニングをガイドできるかどうかについて検討する。
我々のフレームワークは、トレーニング可能なEmphGrounderと凍結したEmphVerifierを結合する: Grounderは候補の軌跡とエビデンスセグメントをサンプリングする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:46:32 GMT)
Tunable Tool-Call Rates in LLM Agents via Representation Steering [45.3] 本研究では,モデル自身のツール使用嗜好信号からトレーニングを受けずに抽出した残ストリーム内の1つの直線方向でツールを制御できることを示す。
また、その方向は、特定のツールの選択を好まずに、各ツール自身の方向と同等の強度で、見えないツールに一般化されていることも示しています。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:35:18 GMT)
SiZeUp: Fast 3D Proxy from Aerial Images via Depth Ordinal Loss [45.3] SiZeUpは、斜めの空中画像から直接大規模な3D都市プロキシモデルを構築するための、高速でスケーラブルなアプローチである。
提案手法は,最先端のプロキシ再構築パイプラインよりも23-52$timesの高速化を実現する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:23:29 GMT)
CyberFactory: Scaling Cyber Security Capabilities with Instances from the Wild [45.1] CyberFactoryは、CVEを含む公開脆弱性アーティファクトをワイルドから実行可能で検証可能なタスクインスタンスに変換する。
再利用可能な脆弱性分析スキルを使用して、ソースインスペクション、ドメイン前の問題解決、エビデンスベースのバリデーションを通じて教師を指導する。
CyberGymでは1時間の予算で52.4%のPass@1に達し、Qwen3.5ベースモデルを+22.8ポイント改善した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:48:47 GMT)
B-MIM: Biased Masked Image Modeling for Generalizable Segmentation of Fine-Grained Anatomical Structures [42.8] 自己監督型プレトレーニングは、医療画像の転送可能な表現を可能にする。
ほとんどのCTエンコーダは、いまだに粗い意味理解に偏っている。
グローバルなセマンティックアライメントを低減するために、バイアスドマスク画像モデリングを導入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:20:05 GMT)
TrustDABench: Benchmarking Reliability and Robustness of LLMs for Structured Data Analysis [42.6] 信頼できる結果は、ユーザ質問から関連するデータエビデンスへの有効なパスによってサポートされるべきである。
この要件は2つの診断質問を生成する: LLMがそのような経路が存在しない場合、答えを拒否するか、明確化を求めることができるか、同じ証拠が異なる表形式で表現された場合、正しい分析を維持できるかである。
信頼性と堅牢性としてこれらの質問を運用するベンチマークであるTrustDABenchを紹介します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:09:01 GMT)
Causal Modelling of Support Interventions for Student Competency Assessment [42.5] 我々は、構造的因果モデリングアプローチを教育評価に適用することを提唱する。
我々は、標準的な連想モデルに到達できない推論形態の実践的関連性を分析する。
我々のプロトコルでは、専門家から構造方程式を引き出す必要があるが、必要な情報は純粋に論理的である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:46:00 GMT)
The Imperfective Paradox Is Not Necessarily in Large Language Models: A Benchmark Failure Before a Model Failure [42.3] 本稿では,ベンチマークと結論について検討し,概念的および評価的ミス・スペクテーションに大きく影響していることを示す。
厳格なNLI標準の下では、グループAのインスタンスの76%は、決定を明示的に除外していない。
イベントセマンティックなNLIを多段階推論問題として定式化し、中間的意味決定と最終的な予測の両方を評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:00:18 GMT)
Quantum simulation of circular cluster interactions in a linear spin chain [42.0] 基礎となる装置と根本的に異なる対称性を持つハミルトニアンの調製は、量子技術における中心的な課題である。
この課題は、周期的境界条件からの翻訳対称性を持つ象徴的一般化クラスタハミルトンに対するアナログプロトコルを用いて解決する。
以上の結果から,スピンの数とハミルトン相互作用の複雑性とを適度にスケールする制御期間で達成できることが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:48:48 GMT)
DRRG: A Discrete Diffusion Framework for Radiology Report Generation [41.9] 既存のほとんどのメソッドは、トークンごとにレポートトークンを生成する自動回帰(AR)フレームワークに依存しており、以前のコンテンツを修正できない。
対照的に、離散拡散大言語モデル (DLLM) は反復的 denoising を通じてテキストを生成する。
DRRGは、RRGを反復マスクトケンデノベーション(英語版)として定式化するフレームワークである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:07:02 GMT)
TAGR: Temporally Adaptive Generative Recommendation for Industrial Live-Streaming Advertising [41.8] 本稿では,リアルタイムトークン化,ユーザ意図モデリング,嗜好アライメントという3段階の時間適応型生成推薦フレームワークを提案する。
大規模なeコマースのライブストリーム広告プラットフォーム上に展開されたTAGRは、それぞれライブルームのエントリーとショッピングカートのクリック率を8.5%と7.4%改善している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:47:52 GMT)
From Seeing to Acting: Smart Glasses as First-Person Intelligence Platforms [41.6] この調査は、このような統一されたフレームワークを通じて、まずスマートグラスを体系的に研究するテキストbfである。
我々は、一人称データフローと制約付きタスクユーティリティを形式化し、8つの検証可能なハードウェア機能軸に沿ってデバイスを特徴付ける。
L0-L5フレームワークは、キャプチャ、反応性知覚、文脈支援、永続状態、支配行動、エンボディ結合にまたがる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:56:54 GMT)
Bellman Calibration for Marginalized Importance Weighting in Offline Reinforcement Learning [40.3] 一次元モデルに依存しない後処理法である等速ベルマンキャリブレーションを導入する。
提案手法は, 1次元の非減少型変換に適合した占有率評価(FORE)を適用することにより, 推定値のスケールと形状を補正する。
キャリブレーション・リファインダは, キャリブレーション誤差の小さい任意の適合比が, 最良な後処理とほぼ同等であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:44:02 GMT)
MTDiag: A Multi-Turn Diagnostic Dataset Towards Clinically Meaningful LLM Evaluation [39.8] MTDiagは3つの異種源から構築された大規模マルチターン診断対話データセットである。
我々は,このスキーマ,UserLM-8Bに基づく発話生成パイプライン,および構造化された臨床証拠を自然言語の発話に変換する医師検証データセットをリリースする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:27:10 GMT)
Coverage Planning for Robotic Tooth Preparation in Densely Constrained Environments [39.5] 歯の補綴は、歯の修復に最適な基質を作るために、歯の構造を制御して除去することを指す。
本稿では,自律歯列作成のための新しいロボットシステムを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:16:53 GMT)
Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion [38.7] Block3Dは、離散的な形状の配列を連続ブロックに分割するブロックワイド拡散フレームワークである。
TRELLIS-500Kのホールドアウトセットでは、Block3Dは平均エンドツーエンド生成時間を25.71秒から4.99秒に短縮する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:57:37 GMT)
Eating for a Sustainable Planet: Personalized Sustainable Diet Recommendation via Constraint-Aware Decision-Making Modeling [38.5] 持続可能な食事は、栄養の充実、経済的可給性、文化的受容性、環境の尊重の4つの重要な柱の中で多次元のシナジーを表している。
この研究は、個々の食事選択を惑星の健康と整合させる枠組みを確立し、将来の持続可能な食事介入と持続可能な開発のための政策決定を導く定量的な証拠を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:01:19 GMT)
Real-World Knowledge-Guided Change Data Synthesis for Remote Sensing [38.1] KnowChangeは知識に基づく変更データ合成フレームワークである。
統一されたフレームワーク内で、多様な変更タイプのフレキシブルな合成を可能にする。
合成データ拡張と合成データ転送の両方において、既存の合成データセットを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:51:05 GMT)
MobilePA-Bench: Benchmarking Mobile Planner Agents on Complex Real-World Tasks [37.7] モバイルプランニングエージェントのツールコールと計画能力を評価するための,インタラクティブでステートフルでツール中心のベンチマークである textbfMobilePA-Bench を提案する。
MobilePA-Benchは、ライブアプリケーションデータベースを保持し、構造化されたフィードバックを返す実行可能なサンドボックスで動作し、13ドルの機能ドメインと212ドルのリアルなモバイルツールにまたがる。
対話型関数呼び出しサンドボックスとエビデンスベースの検証を組み合わせることで、MobilePA-Benchは実用的な診断ベンチマークとエージェント強化学習のための対話型基盤の両方として機能する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:26:07 GMT)
NeoWorld-Pro: Programming Interactive Scenes from Monocular Images for Embodied Simulation [37.6] NeoWorld-Proは、インタラクティブな3D環境のためのプロシージャプログラミングとして、単眼のシーン再構成を再構築するフレームワークである。
次に、ループ内の物理機構は、物理エンジンでの実行を検証することによって、生成されたプログラムを反復的に洗練する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:19:39 GMT)
LION: A Clifford Neural Paradigm for Multimodal-Attributed Graph Learning [36.9] マルチモーダルドメインは、グラフMLにおけるデータ中心のパラダイムシフトを推進し、テキスト属性からマルチモーダル属性グラフへ移行した。
その約束にもかかわらず、現在のニューラルネットワークパラダイムには制限がある。
マルチモーダル分布グラフにおけるアライメント・テン・フュージョンを実装するために,LIONを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:39:59 GMT)
ExMesh++: From Multi-View Images to Relightable UV-PBR Mesh Assets via Topology-Adaptive Reconstruction and Decomposition [36.9] マルチビュー画像から可照性のあるUV-PBRメッシュアセットを再構築するフレームワークであるExMesh++を提案する。
実験では、標準DCCにおける輸出資産の競争的幾何精度、強力な照準性能、および直接使用性を示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:16:03 GMT)
GameWAM: A World Action Model for Video Games [36.4] 我々は,ネイティブなクローズドループゲームプレイとGUI制御のための WAM について,我々の知る限り,GameWAM を紹介した。
協調した世界行動学習を支援するために,ゲームプレイとGUIトラジェクトリを構築した。
実験では、比較されたエージェントよりも実行されたネイティブアクションが少なく、競争力のあるタスク成功を示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:21:15 GMT)
Molecular LLM Agents: From Architectural Design to Scientific Autonomy [36.0] 本研究は、2つの相補的な視点から分子LLMエージェントの概念的枠組みを開発する。
まず、分子表現と知覚、エージェントフレームワーク、ドメイン固有のツールボックス、学習と最適化を網羅した分子エージェント設計のアーキテクチャビューを紹介する。
第2に,工学系における段階的自律性から着想を得た科学的自律はしごを提案し,エージェントをL1または固定化,L2適応型計算機エージェント,L3フィードバック対応物理実験エージェント,L4科学的エージェントの4つのレベルに分類する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:05:03 GMT)
ZODIAC: Zero-shot Octree-based Diffusion for Anatomical Completion [35.9] 部分的な超音波観察から腰椎全体を再構築するゼロショット形状完成フレームワークを提案する。
適応オクツリー構造で表される全解剖学的形状よりも先に生成拡散を学習し、単一の前方通過における完全脊椎の効率的なモデリングを可能にする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:35:39 GMT)
A Structural FHMM for Interpretable Disease Trajectories in T2DM [35.5] T2DM患者における疾患軌跡解析のための因子隠れマルコフモデル (FHMM) の構造的変異を提案する。
このモデルは、複数の独立した同時に進化するコンポーネントの組み合わせとして、患者の潜伏状態を表す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:51:13 GMT)
IterCAD: Iterative Program Repair for CAD Code Generation from Orthographic Views [35.5] IterCADは、プログレッシブなプログラム修復プロセスとして、ホログラフィック・ビュー・トゥ・CAD生成を再構成する反復的なフレームワークである。
IterCADは、現在のCAD結果、ターゲットビューとの相違の原因、および、コードを再定義するか、改善プロセスのSTOPを明示的に決定する。
IterCADは、強力なワンショットベースラインよりも、コードの実行可能性と幾何学的忠実度を一貫して改善する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:22:10 GMT)
Absorbing Gradient Conflicts: Modeling Semantic Variance via Kent Distributions for Cross-Modal Hashing [35.4] Kent-based Distributional Proxy Hashing (KDPH)は、プロキシ表現を静的点から超球上の柔軟な異方性Kent分布にシフトする新しいフレームワークである。
私たちの知る限りでは、KDPHはKentディストリビューションをクロスモーダルハッシュに導入する最初のフレームワークです。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:00:07 GMT)
Critical bifurcation and deconfined quantum criticality in an interacting cluster Ising chain [35.2] より近い隣り合う相互作用を持つクラスタIsing鎖について検討する。
相互作用がなければ、ジョルダン・ウィグナー変換はモデルを同じマヨラナ鎖の3重項に分解する。
シミュレーションにより, 1次遷移によって到達した翻訳対称性を破る反強磁性体が明らかになった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:48:15 GMT)
FARCA: Fact-Aligned Reliability-Aware Credit Assignment for Reinforcement Learning with Factual Supervision [35.0] 本稿では,現実の監視を局所的かつ信頼性の高いトレーニング信号に変換する政策最適化フレームワークを提案する。
FARCAは、ファクト検証の粒度とポリシー更新の粒度を整合させることにより、きめ細かなクレジットローカライゼーションを実現する。
さらに、重要な証拠に対する事実判断の依存を、信頼性の信頼性を計算し信頼性の重みを計算するための実証的なプロキシとして利用する、反事実的証拠の帰属も導入している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:07:22 GMT)
Neurosymbolic Alignment for Physiologically-Safe Clinical Language Models [34.3] 本稿では,HGNNをベースとした生理的世界モデルと7B臨床LLMを併用したトレーニングタイムフレームワークであるNeurosymbolic Alignmentを提案する。
候補者の反応は、ホメオスタティックな制約、マルチホップパスの妥当性、薬物相互作用の罰則を用いて評価される。
臨床安全ベンチマーク(CSB: Clinical Safety Benchmark)は、遺伝子的臨床推論における生理的制約違反に対する2500-scenarioベンチマークである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:20:03 GMT)
Lifting connectivity bottlenecks in superconducting quantum processors via enriched native two-qubit gates [34.2] 我々はAshN制御方式を導入し、近接する各ペアのリッチな2ビット制御により論理的相互作用を可能とし、必要なキュービットルーティングを1つのネイティブ操作にマージする。
検討したベンチマークインスタンスに対して、結果として得られる合成機能は、制約付き1次元および2次元格子上での信頼性の高い実行を可能にする。
1次元と2次元のトポロジ上の7つのベンチマーク回路で、AshNベースの実装は2ビットゲート数で45.2%と43.7%の幾何学平均の削減を実現している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:31:25 GMT)
A Behavior-Guided Online Probabilistic Forecasting Method for Electric vehicle Charging Loads [33.9] 本稿では, 持続的駅特化パターンと最近の行動変化を特徴付ける行動誘導型オンライン確率予測フレームワークを提案する。
10個の異種実世界の充電ステーションの実験では、提案手法が従来の予測モデルより一貫して優れていることが示された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:57:06 GMT)
Boot-and-Feedback Framework for Generalist-Expert Model Collaboration in Breast Ultrasound Diagnosis [33.7] 近年のMLLM(Multimodal Large Language Models)はドメイン知識が限られているため、しばしば突発的な記述を生成する。
シナジスティックMLLM-エキスパートインタラクションのためのBooFモデル協調フレームワークを提案する。
BooFは診断精度と解釈可能性で最先端の手法を大幅に上回る。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:07:05 GMT)
On-policy Distillation with Verifiable Reward [32.7] オンライン蒸留(OPD)とRLVR(Reinforcement Learning with Verifiable Rewards)は、大規模言語モデルの訓練後に広く採用されている2つのパラダイムとなっている。
本稿では,OPDVR と RLVR をシームレスに組み合わせた簡易かつ効果的な方法である OPDVR (On-policy Distillation with Verifiable Reward) を提案する。
6つの推論ベンチマークの実験は、PDVRが標準PDより一貫して優れていることを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:21:17 GMT)
Matched Excess-Outranker Regularization for Candidate-Set Interference in Continual Knowledge Graph Embedding [32.6] 候補セット干渉を候補セット干渉として定式化し、Matched Excess-Outranker Regularization(MEOR)を導入する。
MEORは、スムーズな解答相対的新参者圧力とスコアブラインド、構造的に一致した古い参照を比較する。
歴史的一様平均相反ランク(MRR)は再生時0.0057で改善され、候補セット干渉は0.0055で、一方の95%下限は0.0052と0.0051である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:01:14 GMT)
See More, Detect Less? Taming Information Leakage in Multi-View Anomaly Detection [32.3] 局所的およびグローバルな相互視融合による異常検出のための最初のフレームワークであるGLAD(Global-Local Attention Driven framework)を提案する。
実効的なマルチビュー融合では,デコーダに到達した情報を明示的に制限する必要がある。
Real-IADとMANTA-Tinyの実験によると、GLADはサンプルレベル、イメージレベル、ピクセルレベルのメトリクスで最先端のメソッドよりも優れています。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:29:35 GMT)
Trajectory-Level Continuous Action Representation for Robotic Manipulation [31.9] 既存のビジュモータシステムは、しばしば制御周波数で行動表現を絡めるか、固定時間パラメータ化に依存する。
ロボット操作のための軌道レベル連続行動表現フレームワークであるCATを提案する。
Catは、固定されたリアルタイム間隔内でアクショントラジェクトリを、連続的な潜在トークンのセットにエンコードする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:19:00 GMT)
RePolicy: Reinforcement Learning for Safety-Policy Invocation in Agent Safeguards [31.4] 本稿では,強化学習を通じて安全政策の実践を学習するエージェントセーフガードであるRePolicyを提案する。
エージェントの軌跡と動的ポリシーライブラリが与えられた後、RePolicyは適用可能なポリシーを起動し、そのコンテンツを使用してポリシーに基づく合理性と安全性の判断を生成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:01:33 GMT)
Hydra: Phase-Aware Workload Characterization of LLM Inference across Edge SoC Generations, Backends, and Quantization Levels [31.4] 我々は、エッジLLM推論のための共通スキーマ、フェーズアウェアなワークロード評価フレームワークであるHydraを提案する。
3つの連続エッジシステムオンチップ世代(AGXXavier、AGX Orin、AGX Thor)を評価する。
分析の結果、集約レイテンシだけで重要なデプロイメント効果が隠されていることが分かりました。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:43:43 GMT)
MnemoDyn: Learning Resting State Dynamics from 40K FMRI sequences [30.5] 約40K rs-fMRIのデータセットに基づいて訓練した静止状態機能型磁気共鳴画像(rs-fMRI)の動的システムに基づくモデルを提案する。
我々は、MnemoDynが計算効率が高く、多様な集団や走査プロトコルで非常によく一般化されていることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:52:46 GMT)
Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints [30.4] 我々は,基本LMの計画品質を維持しつつ,符号化された制約を保証する制約付きデコードフレームワークであるtextbfMeta-Ctrl を提案する。
実際のテーブルトップロボット上で、生成したすべての計画が、その前提条件と目標を建設によって満足する様子を実演する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:39:21 GMT)
VizAnchor: Decoding Manipulation Intent from Tampering Visualizations via Dual-Anchor Reasoning [29.6] VizAnchorは可視化操作理解のためのフレームワークである。
正確なチャート情報を復元し、改ざんされた地域をローカライズする。
彼らの操作、ミスリーダー、誤解を招く意図を忠実に説明します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:20:27 GMT)
Gripper-aware Vision Language Action Models [29.5] MiGAは、複数のロボットにまたがる5つの異なるグリップタイプにまたがるマルチグリッパー対応データセットで、103,000のデモを行う。
また,新しいマルチグリッパートークンとアダプタベースのポリシールーティングを組み合わせたGVLAを提案する。
我々の新しいグリップエンコーディングは、パラメータ共有と戦略微分のバランスをとる構造的埋め込み情報を誘導する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:24:51 GMT)
Reflection with Action-Induced Visual Differences for Desktop GUI Agents [29.4] Planner-Operator-Reflector (POR)フレームワークは複雑なタスクにおける客観的アライメントを維持するためにGUIエージェントで広く使われている。
既存のリフレクタは、変化の検出と結果の検証を1ステップに分解し、証拠を暗黙的に残し、根拠の弱い決定を下す。
Evidence-First Reflection (EFR) は、2段階の反射鏡であり、行動誘発視覚差を結果検証から抽出する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:10:01 GMT)
Don't Just Listen, Try Planning: Graph-based Retrieval-Generation Agent for Long-form Audio Meeting Understanding [29.0] 我々はLongAudioQAデータセットを構築し,異種音声特徴を多次元グラフにモデル化するGRGAモデルを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:16:42 GMT)
Robust Data-Collection Policy Learning for Low-Variance Online Policy Evaluation [28.7] 本稿では,遷移不確実性に対して効率的かつ頑健な学習行動ポリシーを学習するための2ループ勾配に基づくアルゴリズムを提案する。
本手法は既存手法よりも過渡摂動に敏感でないことを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:10:06 GMT)
Retrieved But Not Reliable: A Survey on Attacks, and Defenses in Retrieval-Augmented Generation [28.6] Retrieval-Augmented Generation (RAG)は、外部知識のアウトプットを基礎として、大規模言語モデルを強化する。
RAGは、コーパス中毒、バックドア攻撃、プライバシー漏洩、公正違反など、新たな堅牢性とセキュリティリスクを導入している。
この調査では、RAGの堅牢性について、統一的でパイプライン対応の概観を示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:18:04 GMT)
Beyond Static Interpretability: Anticipating Post-SFT Mechanisms from Pre-SFT Parameters for Better Tuning [28.2] 機械的ローカライゼーションは機械的解釈可能性と後学習最適化を橋渡しする。
本研究では,SFT後の解釈可能性状態を正確に推定するフォワード・ルックティング・フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:28:55 GMT)
ATHENA: Knowledge-guided agentic neural architecture search for AutoFormer-based electronic health record modeling [28.2] AtheNAは、TransformerベースのEHRモデリングのための知識誘導型エージェントNASフレームワークである。
以前の2層クロスホスピタルアーキテクチャが組み込まれていた。
AtheNAは、検索予算30の12評価のうち、9位にランクインしている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:53:04 GMT)
ACE: A Self-Correcting Agentic Canvas Editor for Multi-Slide Presentation Automation [27.7] エージェント型キャンバスエディタである textbfACE を,プレゼンテーション専用アクション空間 (98 ツール) を備えたエスフラチエラルなシーングラフ上に提示する。
固定バックボーンでは、Emphsingleターンのシーングラフエディタは、内部で反復する同じバックボーン強調HTMLパイプラインとすでに一致している。
完全な94-taskベンチマークでは、ACEが命令で大きく上回っている(IF 4.23 vs. 3.81、ペアの$p=.010$、複製)。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:05:17 GMT)
Beyond Confidence: Test-Time Scaling for Multi-Turn Search Agents via Retrieval Grounding [27.3] 信頼度に基づく投票は、現代のマルチターン検索エージェントには不十分であることを示す。
本稿では,最終回答と得られた文書との語彙重なりで各ロールアウトをスコアするRGVを提案する。
RGVは、信頼性に基づく投票を一貫して上回り、得票率は最大で5.4%、少数で正しい質問では+35%である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:28:17 GMT)
GlanceWAM: Sparse Test-Time Imagination for World-Action Models [27.2] GlanceWAMを導入し、単一のビデオDiT内での想像力を制御から切り離す。
24タスクのRoboCasaキッチンベンチマークでは72.2%に達している。
NVIDIA A100 GPU(同期ベースラインの24倍高速)上で、1チャンク当たり48ミリ秒で実行される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:19:09 GMT)
Beyond the Stability-Exploration Dilemma: Environmental Regularization for LLM Policy Optimization [27.1] Policy-KLはレスポンスの振る舞いを制限し、アクションサイドの探索予算を消費する。
我々は、正規化を入力側に移すことでジレンマを壊す代替案を議論する。
ERPO は標準の Policy-KL 正規化器を置き換え、クエリ分散のドリフトを効果的に制御する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:31:13 GMT)
Structurally-bounded Agentic Graph Exploration for Evidence-Grounded Scholarly DeepSearch [26.0] Craseは一度、シード論文を検索エンジンに問い合わせ、1.5ホップの引用地区に沿ってそれらを拡大し、残りの論文を無作為なランダムウォークでランク付けする。
LitSearchと500KペーパーのarXivコーパスのベンチマークでは、Craseはプロプライエタリなモデルで構築されたディープリサーチエージェントを3$times$ recall@50で約3分の1で上回っている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:51:26 GMT)
PonderPounce: A Pretrained MLLM as an Episode Context Engine for Robot Control [25.9] PonderPounceはMLLMのネイティブ因果コンテキストをロボットメモリとして再利用する。
パウンスは現在の観察、指示、受容を直接受け取ります。
ベーススケールのトレーニングデータを持つRoboMMEでは、PonderPounceは同じPounceアーキテクチャとインターフェースの下で、9Bで60.83%、0.8Bで50.04%に達する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:24:36 GMT)
Robust Code RL via Faulty-Code-Driven Test case Synthesis and Dense Reward Shaping [25.9] 検証可能な報酬(RLVR)からの強化学習は、LLM(Large Language Models)のコード生成能力を向上するための重要なテクニックとして登場した。
本稿では,コード駆動型テストケース合成戦略を導入するRobustTestsフレームワークを提案する。
トレーニングのためにCodeContestsから適度に困難な問題のサブセットを活用することで、RobustTestsによるQwen3-32Bの微調整により、LiveCodeBenchベンチマークでは、絶対的な3%のパフォーマンス向上が達成できることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:00:08 GMT)
NeuralParker: A Reinforcement Learning Planner for Irregular Parking Environments [25.6] 我々は、任意の目的の駐車のための強化学習に基づくハイブリッドプランナーであるNeuralParkerを紹介する。
完全な環境障害と境界幾何学を対象相対表現にエンコードする。
学習した曲率長のアークポリシーと、様々な立方体のハーマイト接続から選択されるループ内端子アンサンブルを結合する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:33:14 GMT)
Robustness of IR Models to Collection Growth [25.5] 本研究は概念を定式化し、2つのコレクションと無視可能なトピックオーバーラップを組み合わせて経験的に評価する。
我々は、IRモデルがコレクション内の他の文書にランク付けする方法が、非関連文書の追加に対するロバスト性において重要な役割を担っていると仮定する。
以上の結果から,MDDモデルもMDAモデルも非関連文書の追加に対して完全には堅牢ではないことが明らかとなった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:45:03 GMT)
LeFlow: Generative Latent Flow Planning for World Models [25.4] 本稿では,世界モデルから潜在力学空間を直接操作する前に,再利用可能な潜在軌道を学習するLeFlowについて述べる。
4つの主要なゴール条件付きピクセル制御ベンチマークの中で、LeFlowは反復的なアクション空間最適化を償却された潜在計画に置き換えている。
我々の研究結果は、潜在世界モデルは予測だけでなく、再利用可能な計画事前をサポートするべきだと主張している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:42:30 GMT)
Can We Read the Mind of an Audio LLM? A Verbalizable, Multilingual Middle-Layer Workspace [25.3] 音声言語モデルは、特定の方法でブラックボックスである。
われわれはそれが何を言っているかを見るが、そこで何がうまくいくかは見当たらない。
モデルの中層では、話し言葉の質問に対する答えが(言葉で言えば)正当であることが分かりました。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:17:28 GMT)
Learning Spherical Occupancy Profiles for Multi-View 3D Reconstruction and Generation [25.0] 我々は、FILM条件のプロファイルヘッドに、平均視界および光線固有の画像証拠を注入する識別用1光線デコーダを訓練する。
予測されたプロファイルの形態を解析し、複数ビューの再構成と生成先行の間のコンパクトで、学習され、不確実性を意識したインターフェースを提供することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:43:31 GMT)
SceneReGen: Generative Reconstruction of 3D Scenes from a Single Image [24.8] 我々は、シーン再構築を完全なオブジェクト資産の生成と組み立てとして再解釈する生成的再構築フレームワークであるSceneReGenを紹介した。
SceneReGenは、選択的なポーズ係数化を通じて生成/再構成ギャップに対処する。
SceneReGenは評価手法の中で,最高のシーンレベルCD,シーンレベルFスコア,3DバウンディングボックスIoUを実現している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:29:37 GMT)
EgoErrorVQA: Assess Egocentric Comprehension Capabilities through Procedural Errors for Ego-Agentic AI [24.6] EgoErrorVQAタスクは、明示的な手続き的エラーモデリングを用いて、エゴセントリックな手続き的理解のために提案される。
エージェント2Agentプロトコルに基づくユーザフレンドリーな評価エージェントを開発した。
また、Adaptive Decoupled ReasoningフレームワークであるEgo-ADRを紹介します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:58:44 GMT)
Meta$^n$: Recursive Self-Improvement through Emergent Depth [23.8] メタ操作を固定し、代わりにその入力に再帰するMeta$n$を提示する。
$$は決して変更されないので、システムを不安定にすることはできない。
2つのバックボーンで、Meta$n$は8つのベンチマークファミリすべてで自己改善エージェントよりも優れています。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:44:25 GMT)
Evidence Blindness in Direct Corpus Interaction: Persistent Navigation with AtlasNav [23.5] 我々は、この進行的な無声損失をエビデンス・ブラインドネスと呼び、段階的な証拠実現を通じてそれを定量化する。
再利用可能なコーパス構造上での有限予算ナビゲーションとして大規模エージェントサーチを定式化する。
我々はAtlasNavを紹介した。AtlasNavは永続的な多視点コーパスナビゲーションフレームワークで、直接コーパスインタラクションを保持するが、一度コーパスをコーパスアトラスに編成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:03:02 GMT)
It depends: Incorporating correlations for joint aleatoric and epistemic uncertainties of high-dimensional output spaces [23.5] 不確実性定量化(UQ)は、ディープラーニングモデル予測の信頼性を高める上で重要な役割を果たす。
本稿では,高次元回帰タスクにおける連成性に着目し,不確実性の二重性について論じる。
本稿では,低ランク+対角共分散構造を用いた結合不確かさを近似する新しい手法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:08:17 GMT)
Best Practice Critic Optimization [23.2] 批判に基づくトレーニングのレシピは、しばしば不安定である。
DPPO,報酬範囲に束縛された値予測,モンテカルロ値の目標,非正規化ポリシの優位性,長さ適応型汎用的優位性推定を組み合わせたレシピを開発した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:10:31 GMT)
Task-Adaptive Rubrics for GUI Reward Modeling [23.2] 本稿では、AdaptRubricが、カテゴリレベルの粗い段階とインスタンスレベルの細かい段階を通じて、タスク適応的判断基準を構築する方法を示す。
AdaptRubricは、オフライン報酬評価とオンライン強化学習最適化を通じて、常に先行報酬エージェントを上回っている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:40:12 GMT)
TrAct: Bridging Robot Control and Visual Prediction with Visual Tracks [22.7] 制御と予測の中間インタフェースとして視覚トラックを用いた世界モデルに基づくロボット意思決定フレームワークTrActを提案する。
TrActは3つのコンポーネントから構成される: ビジョン・ランゲージ・アクション・アンド・トラックモデル(VLAT)は、現在の観察と言語指導から候補行動と対応する視覚トラックを共同で予測し、トラック条件付き世界モデル(TWM)は、提案されたトラックで条件付けられた将来の視覚結果を予測する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:00:01 GMT)
CoinVE-200K: A Large-Scale High-Quality Dataset for Compositional Instruction-Guided Video Editing [22.5] CoinVE-200Kは、合成指導誘導ビデオ編集のための大規模で高品質なデータセットである。
CoinVE-Editは、Wan2.1-T2V-14BとQwen3-VL-8B-Instructをベースに開発された22Bの合成ビデオ編集モデルである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:23:56 GMT)
Pixel-Space Diffusion via Observation Operators [22.4] 本稿では,画像構造の本質的な回復順序とフルイメージの監督と特徴改善を一致させる統一的なフレームワークを提案する。
実験により,提案手法は画像Net-256上で1.52のFIDを達成し,生成品質を継続的に向上しながら,ほぼ高速に収束することが示された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:30:46 GMT)
From Corpora to Co-Evolving Capabilities: Capability-Centric Data Design for Generalist Image Generation [22.4] 大規模な画像生成は、データスケール、品質、再バランス、再カプセル化の進歩の恩恵を受けているが、従来のパイプラインは通常、タスク固有のデータセットを分離して最適化する。
本稿では,機能に特有な監視構築と,機能に整合したカリキュラムスケジューリングを併用した,テキスト機能駆動型データ基盤を提案する。
このフレームワークは4億4000万イメージのT2Iコーパス、120万の編集ペア、2700万以上の画像エンタリティペアをキュレートする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:09:09 GMT)
Memory Is Not Always Needed: Characterizing Conditional Memory in Scientific Reasoning [22.4] 我々は、いつ、どこで、どの程度、条件記憶が科学的推論にどの程度参加すべきかを調査する。
生成前に利用可能なタスク固有の入力プロキシを用いて、メモリが活性化されているかどうかを判定する知識境界対応ルータを提案する。
我々のアプローチは、メモリ誘起回帰を抑えながら、有益なメモリコントリビューションをより一貫して維持する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:19:20 GMT)
Steering Recurrent Reasoners at Inference Time with Readout Feedback [22.3] そこで本研究では,リトレーニングを伴わずに遅延力学を操り,自己の読み出し確率を用いて再帰モデルを推論時に改善可能であることを示す。
SudokuとMazeの3つのリカレントモデル(AKOrN, ItrSA++, TRM)の中で、RoFBは6つのモデルタスクペアのうち4つで明確な利得を得る。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:00:21 GMT)
Bridging Adversarial and Collaborative Learning for AI-Generated Image Quality Assessment [22.1] 2つの次元は相互依存しており、人間の評価における競合的相互作用と協調的相互作用の両方を示す。
本稿では,認識・適応関係をモデル化する相互作用認識学習フレームワークを提案する。
我々の手法は最先端の精度を実現し、解釈可能な相互作用パターンも得る。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:31:00 GMT)
Learning Mixtures of Plackett-Luce Models for Multi-Objective Alignment [21.7] 我々は、アノテータからのマルチウェイランキング応答に対して、$k$ Plackett-Luceモデルの混合を学習する問題を考察する。
我々はこれらの2つのステップで予測最大化アルゴリズムを設計し、モプレックスと呼ばれるプラケット・リュックモデルの混合に適合させる。
我々は、MoPLExがクラスタリングとランキングの精度を平均43.7%、ベースラインよりも15.2%改善していることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:42:37 GMT)
MemUse: Moving Memory Evaluation from Direct QA to Natural Integration in Long-Term Human-AI Conversation [21.7] 4ヶ月のデプロイメントにおいて,ダイレクトQAの精度がユーザ満足度と相関するかどうかを検証した。
既存のベンチマーク・ダイレクトQAは7つの条件で19.7%から70.1%まで変化しているが、満足度は変わらない。
デプロイから引き出された実際のユーザキューメモリモーメントのセットであるMemUseを紹介します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:54:12 GMT)
Relative Time Intervals Representation for Word-level Timestamping with Masked Training [21.2] 音声大言語モデル(SpeechLLMs)は、音声理解と生成において優れており、その微細で時間的に整列した出力の能力はいまだに未熟である。
従来の絶対タイムスタンプを相対的なタイムスタンプに置き換え、よりコンパクトな語彙とより強力な一般化能力を実現する。
提案手法は,強い音声書き起こし性能を維持しつつ,タイムスタンプ予測精度を大幅に向上させる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:59:42 GMT)
NemoSplat: Feed-Forward 4D Gaussian Splatting for Media-Aware Underwater Reconstruction [21.2] NemoSplatは、メディアを意識した動的再構成に適した最初のフィードフォワード4Dガウススプラッティングフレームワークである。
NemoSplatは最先端のトラッキング精度と高忠実度レンダリングを実現する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:52:42 GMT)
AgentSpec: Speculative Decoding for Batch Inference of LLM Agents [21.1] 投機的復号アルゴリズムは大きなバッチサイズで大幅な速度劣化を示す。
LLMエージェントの既存のメソッドの制限に対処する投機的復号アルゴリズムであるAgentSpecを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:49:29 GMT)
GaussianWAM: Distilling Geometry and Semantics from 3D Gaussian Fields into World-Action Models [21.0] World-Action Models (WAM) は、ロボット操作のための表現学習信号としてビデオダイナミクスを用いて、将来の視覚予測とアクション生成を共同で学習する。
我々は3次元ガウス場を通して幾何学的・意味的管理を組織する訓練時表現強調フレームワークである textbfGaussianWAM を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:34:13 GMT)
Right Diagnoses, Decorative Reasoning:A Perturbation Audit of Medical Chain-of-Thought [20.9] 臨床医は医学的推論の証拠としてチェーン・オブ・シークレット(CoT)の理論的根拠を読むが、その役割を果たす鎖が検査されることは稀である。
チェーン・デカップリング・レート(CDR; chain don not register the edit and the answer not flip)は72.9%であり、臨床的に意味のある破壊的な編集、チェーンの破損の正確さは変化せず、CoTプロンプトを除去しても精度は低下しない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:37:39 GMT)
Implicit Q-learning-bootstrapped ant colony optimization for maritime moving-target observation scheduling with agile satellites [20.4] アジャイル地球観測衛星を用いた海上移動目標観測スケジューリングは、動的でシーケンスに依存した最適化問題である。
本稿では,マルチサテライト海洋移動目標観測スケジューリングのための暗黙的なQ-ラーニング・ブートストラップ付きアリコロニー最適化手法であるIQACOを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:17:25 GMT)
Resource-Efficient Pruning for Transformer via Low-Rank Importance Estimation [20.4] REP-LIEは、微調整の過程で資源効率の高い刈り取りを可能にする新しいアプローチである。
重要度推定における固有のランダム性に対処するため、安定性スコアを導入する。
中規模エンコーダモデルと大規模生成モデル(LLaMA-7BとMistral-7B)の両方の実験は、REP-LIEが既存のアプローチと比較して競争性能を保っていることを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:36:01 GMT)
AudioLens: Multi-Perspective Speech Clustering with Reasoning Audio-Language Models [20.3] 本稿では,音声のマルチパースペクティブクラスタリングについて紹介する。
蒸留と選好最適化を訓練したエンドツーエンドの大規模音声言語モデルであるAudioLens-R1を提案する。
実験の結果、AudioLens-R1は全てのベースラインを一貫して上回り、全ARIを12.99ポイント、V測定を11.62ポイント改善した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:47:57 GMT)
MetaRAG: Belief-Action Aligned Policy Optimization for Agentic RAG [20.3] エージェント検索拡張生成(RAG)では、言語モデルに対して、いつ検索を継続するか、いつ回答するかを判断する必要がある。
既存のRLベースの手法は外部の監督に依存しており、現在の証拠が十分であるかどうかについてのエージェントの内部の信念を見落としている。
本稿では,エージェントRAGのための信頼行動ポリシー最適化フレームワークであるMetaRAGを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:20:29 GMT)
Parason: Revealing Subtask and Trial Parallelism in LLM Reasoning [20.2] 大規模言語モデルにおける2種類の並列性を明らかにし,学習するParasonを紹介した。
パラソンは逐次的推論トレースを文脈自由文法で構造化された並列軌跡に変換する。
推論時に、Parasonはツールコールを通じて学習された並列構造を実行し、理論的な保存を現実のウォールクロックアクセラレーションに変換する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:02:54 GMT)
ReGround-Surg: Reliability-Guided Anchor Grounding for Referring Surgical Video Segmentation [19.7] 外科的ビデオセグメンテーションの参照には、自然言語の表現に従って、ビデオフレームをまたいで対象の機器または組織領域をセグメンテーションする必要がある。
最近のSegment Anything Model 2 (SAM2) ベースの2段階法 (ReSurgSAM2) は、最初に参照されたターゲットを初期または選択されたフレームに接地し、次に選択されたマスクを追跡によって伝播する。
Re-Ground-Surgは,SAM2をベースとした手術用ビデオセグメンテーションを改善するための軽量な信頼性誘導アンカーグラウンドディングフレームワークである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:08:24 GMT)
Multi-exposure HDR Imaging: A Review of Pixel-level and Feature-level Reconstruction Methods [19.5] マルチ露光は、現実世界のハイダイナミックレンジ(HDR)シーンをキャプチャする効率的な方法である。
しかし、HDR画像は、シーケンシャル露光の時間的差により、ダイナミックなシーンで激しいゴーストに悩まされる。
本稿では,Multi-Exposure fusion (MEF) とゴースト除去という,HDRイメージングに関する2つの重要なトピックについて,文献を分類する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:05:20 GMT)
TRACER: Balancing Stability-Plasticity-Cognitivity Trilemma for LLM Enhanced Continual Recommendation [19.2] 継続的なレコメンデーションは、ストリーミングデータから進化するユーザの関心を捉えることを目的としている。
提案するTrilemma-Responsive Adaptive Continual Enhancement for Recommendation (TRACER)について述べる。
TRACERは3つの特殊なモジュールを組み合わせており、それぞれが安定性、可塑性、認知性を目標としている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:33:41 GMT)
Not All Tokens Are Equal: Region-Aware Consistency Repair of Backdoors in MLLMs [19.1] 既存のモデルレベルのバックドア除去法はMLLMに対して限られた効果を示した。
バックドアは内部表現において異常な層間進化を誘導する。
RACERは、融合した表現を視覚的およびテキスト的トークン領域に分解し、それらの階層的不整合を別々に正規化し、深層ウィンドウ上のモード認識重みを使って再構成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:10:01 GMT)
Are Android GUI Agents Robust Against Runtime Anomalies? AnTrap: Evaluating Agents in Dynamic Adversarial Environments [19.0] エージェントの実行軌跡に動的摂動を注入する総合ベンチマークAnTrapを導入する。
本研究では,現実世界の異常を4つの層(状態,思考,行動,ラウンド)に分類する分類法を提案する。
また,現実的な対向条件を導入しながら,課題解決可能性を維持する構築パイプラインも開発している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:57:25 GMT)
Counter with Evidence! A Multi-Agent Memory Efficient Reasoning Framework for Hate Category Informed Counterspeech Generation [19.0] FIRE(Factuality Informed Multi-Agent Reasoning Framework)を導入し,まずヘイトスピーチを5つのカテゴリーの1つに分解する。
FIREは, コンパクトエージェントを用いても, 既存の手法をはるかに上回っていることを示す。
我々は、ヘイトスピーチの根底にある意図を分解することは、安全で効果的で、文脈的に正確な反音声を生成するために不可欠である、と結論付けた。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:25:33 GMT)
PRQ-KMeans: Projection Residual Quantization for Semantic ID Tokenization [19.0] 残留量子化トークンは、各レベルでコードワードを選択し、次に残余を渡すことによって生成シーケンスを構築する。
コーパスワイドの共有コンポーネントは、ファーストレベル容量を消費し、ハードアサインは、近くのコードワードとグレードされた類似性を無視し、フルコードワードのサブトラクションは、選択されたコードワード方向に沿って、次の残余でばらつきを残すことができる。
提案するPRQ-KMeansは,グローバル平均成分を除去し,Top-k類似度重み付き更新によりセントロイドを洗練し,全符号サブトラクションをプロジェクション残差に置き換える。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:18:57 GMT)
Low-Rank Velocity Fields as a Structural Prior for Unsupervised 4D Medical Image Interpolation [18.5] 教師なしの4D医療画像は、訓練用に利用可能な開始と終了のボリュームのみを使用して、スパースサンプリングされたシーケンスから中間ボリュームを合成する。
この弱い制約条件は、しばしば不安定な境界と非生理学的運動を持つ中間体を生じさせ、解釈可能性や下流解析を制限する。
そこで我々は, 構造的タッカー低速度場に対する制約運動として, 低ランク速度場を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:30:03 GMT)
SHIFT-LLM: Distribution Shift Correction in Depth-Pruned LLMs [18.5] 本稿では,各プルーニングサイトに線形残差アダプタを挿入するトレーニング不要なポストプルーニング修正フレームワークShift-LLMを紹介する。
各LRAは元の残基の同一性経路を保持し、軽量なアフィン残基補正を追加する。
5つのモデルファミリ,6つの層選択基準,および7つのゼロショットベンチマーク実験により,ShiFT-LLMは深絞りによって失われる精度を常に回復することを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:01:58 GMT)
LongWoF-Bench: Evaluating EvoMap Genes for Verifiable Long-Workflow Tasks [18.4] 我々は,EvoMapを通じて実行エクスペリエンスを外部化して再利用できるかどうかを検討した。
EvoMapは検証済みの実行トラジェクトリを構造化されたGeneに統合する。
Claude Opus氏にとって、Geneの再利用はSkillよりも39のタスクを完了し、解決時のトークン消費を9.9%削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:35:20 GMT)
EMRB: A Multi-Level Benchmark for Evaluating LLM Reasoning over Raw Electromagnetic Signals [18.2] 大規模言語モデル (LLM) は、科学的・工学的な分析のためのコードエージェントとしてますます使われているが、生の物理層の測定能力は検証されていない。
textbfEMRB (textbfElectrotextbfmagnetic textbfReasoning textbfBenchmark) は、LLMがコードを書き、実行することで生のI/Qデータを分析できるかどうかを評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:33:24 GMT)
VisCache: Visual KV Cache Pruning for Efficient Vision Large Language Model Inference [17.9] VisCacheは、トレーニングなしで大きめのtextbfVisual KV textbfCacheプルーニングを行うためのフレームワークである。
PruneKVは、Vision Large Language Modelsの注意力学に合わせて設計された、外科的KV圧縮アルゴリズムである。
VisCacheは、既存のベースラインを一貫して上回る。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:52:05 GMT)
MSR-IVA: Masked Structural Residual Independent Vector Analysis for State-Aware Fusion of Structural MRI and Dynamic Functional Network Connectivity [17.9] 本研究では、共有構造表現と状態固有残差適応と、不完全状態表現のためのマスクを組み合わせた状態認識フレームワークを提案する。
アルツハイマー病のニューロイメージングイニシアチブのコホートで、MSR-IVAは一致しないソース結合を6.5%改善した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:36:02 GMT)
Generalization, memorization, and overfitting for diffusion models trained in the lazy high-dimensional regime [17.7] 我々は、ニューラルネットワークの良性オーバーフィットとアルゴリズム正規化の理論に匹敵する生成法を開発した。
勾配流訓練における正確なリスクトラジェクトリを導出する。
これらの推定器が逆時間SDEに沿ってどのように結合するかを分析し、その結果の分布を特徴付ける。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:54:59 GMT)
GEAR: Generative Expansion and Real Anchoring for Two-Stage Distillation of Tabular Foundation Models [17.7] タブラル基礎モデル(TFM)は、コンテキスト内学習によって強いパフォーマンスを達成するが、コンテキストに依存した推論により、大規模なデプロイメントを妨げている。
GEAR(emphGenerative Expansion and Real AnchoringAUC)は,TFMを軽量またはツリーベースの予測器に蒸留し,コモディティCPU上に展開可能なモジュール型2段階のフレームワークである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:47:19 GMT)
SkillForge: Evolving Verifiable Skills for Reinforcement Learning Agents [17.6] 大規模言語モデル(LLM)エージェントは、複雑な意思決定タスクのために強化学習(RL)を用いて訓練される。
SkillRLのような最近のスキルベースのアプローチは、生の軌跡からスキルを抽出することでこの問題に対処しようとしている。
SkillForgeは、環境相互作用を通じてスキルの検証と洗練を可能にする継続的スキル進化のためのフレームワークである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:52:10 GMT)
Latent Action as Intention Enables Efficient Future Imagination for World Action Models [17.4] 提案するアーキテクチャ**LAWA**は,コンパクトな潜伏動作を将来の意図の操作的表現として利用するWAMアーキテクチャである。
RoboCasaでは、LAWAは数ショットと全データ設定で65.6%と80.8%という最先端の平均的な成功率を達成した。
また、一致したJoint-WAMモデルの性能レベルも保持し、42.9%の遅延時間を必要とする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:59:03 GMT)
Revenge of Monosemanticity: Specialized Neurons Improve Data Efficiency in MLPs [17.4] 多層パーセプトロン(MLP)は自然に単節性特異的ニューロンを発達させる。
単一の大域的な低次元表現を学ぶのではなく、関連人は高次元空間を集合的に扱うことのできる局所的な低次元表現の集合を学ぶ。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:54:58 GMT)
SeMoCo: A Semantic-First Motion Codec for Motion Language Modeling [16.8] 本稿では、セマンティックファーストモーションであるSeMoCoと、言語条件のモーション生成のための2軸モーションジェネレータを紹介する。
また、SOMA表現の下で統合された大規模マルチソースヒューマンモーションデータセットである$-MotionVerseを構築した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:58:20 GMT)
Adaptive Influence Graphs for Failure Attribution in Multi-Agent Systems [16.8] 本稿では,2段階のエージェントフレームワークであるAdaptive Influence Graphs(AIGs)を紹介する。
複数のモデルにまたがって、よりリッチなトレース表現がフェール属性を継続的に改善することを示す。
この仮説は、帰属は診断モデルだけでなく、どのようにトレースが表現され、探索されるかにも依存する、という我々の仮説を裏付けるものである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:18:19 GMT)
Phase-Aligned Finite-Fourier Periodic Deformation for 4D Medical Image Interpolation [16.7] 4Dの医療画像は、わずかに観察された時間ポイントから行方不明の量を回復することを目的としている。
重要な課題は、この構造がACDCの最先端表現に直接エンコードされるとは限らないことである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:34:54 GMT)
Observability and Fault Injection for LLM-Based Multi-Agent Systems in Software Engineering [16.7] 大規模言語モデルに基づくマルチエージェントシステムは、ソフトウェア工学のタスクのためにますます研究されている。
OpenTelemetryベースの分散トレースとフォールトインジェクションを組み合わせた軽量でフレームワークに依存しないツールであるllmmas-otelを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:59:08 GMT)
FraudBench: Protocol-Sensitive Benchmarking of Adversarial Robustness for Financial Risk Assessment [16.6] FraudBenchは、金融詐欺と信用リスク検出における敵の堅牢性評価のためのプロトコルに敏感なベンチマークである。
その結果,ロバストネスの結論はプロトコルに敏感であることが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:36:42 GMT)
SonarLLM: A Native Sonar--Optical Multimodal Large Language Model for Underwater Perception [16.5] 既存のMLLMは、主に光エンコーダ上に構築されており、ソナーのモデルには不向きである。
本稿では,ソナーを知覚モダリティとして扱うソナー光学MLLMのSonarLLMを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:50:52 GMT)
What Guides the Agent? Adjudicating Unauthorized Behavior via Localizing Behavior-Guiding Instructions [16.4] Attnlocateは、ツール呼び出しの決定に真に影響を及ぼすコンテキストのきめ細かいローカライズのためのランタイムフレームワークである。
Attnlocateは、このローカライゼーション問題をオブジェクト検出タスクとして、振る舞い誘導命令によって引き起こされるユニークなアクティベーショントレースを検出することを目的としている。
5つのLSMファミリーから10のエージェント構成にまたがるAttnlocateを評価し,間接的プロンプト注入とツール中毒のシナリオについて検討した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:24:53 GMT)
CodeHID: Learning an Addressable Hierarchical Code Index for Generative Code Retrieval [16.4] 本稿では,コード検索タスクをフラットな候補マッチングから粗いセマンティックアドレス生成へと再構成する生成コード検索フレームワークであるCodeHIDを提案する。
CodeHIDは2つのコアコンポーネントに依存している。まず、Pseudo-Neighbor Guided DocID Learningは、多レベル残留量子化と$k$-nearest-neighbor pseudo-supervisionを適用することで、グローバルな静的階層インデックスを構築する。
第2に、Dual-Phase DocID Generation Guidanceは、トレーニング側ランキングの強化、ハードネガティブとランク蒸留、推論側候補制約、プレフィックス対応デコードを組み合わせて、この固定インデックスを確実にナビゲートする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:35:17 GMT)
When Does Visual Generation Help Visual Understanding in Unified Multimodal Models? [16.2] 本稿では,視覚生成支援理解のためのきめ細かい評価フレームワークであるVGAU-Diagを紹介する。
生成した視覚支援がインスタンスの簡易化に役立ちながら、推論の複雑さが増大するにつれて信頼性が低下することを示す。
また、効果的な視覚生成は、より多くの推論ステップを追加するのではなく、視覚的理解のボトルネックを目標とすべきであることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:03:55 GMT)
STRIVE: Multi-Agent Structured Temporal Reasoning with Integrated Verification for Longitudinal Radiology Report Generation [16.1] STRIVEは、臨床推論を専門的な診断、属性、時間変化剤に分解する。
経時的MIMICでは, STRIVEが近年の方法の中で最も有効である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:43:15 GMT)
FLARE: Verifying MILP Reformulations with LLM-Based Theorem Proving [15.6] 私たちは、リーンとマシンチェックで形式化できるMILP改革の構成的定義を開発します。
提案手法を評価するために,20の問題と109の定式化のデータセットであるFormulationBenchを紹介した。
FLAREは既存の手法より優れており、フォーミュレーションベンチのNPハード部分集合では100%精度が高い。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:19:41 GMT)
ExPhy: A Benchmark for Explicit Physical Property Learning in Multi-Object Trajectory Forecasting [15.5] 既存のベンチマークでは、軌道予測と並行して明示的な評価対象としてオブジェクトレベルの物理的特性を公開することはめったにない。
ExPhyには24,000のシミュレートされた物理シーンがあり、質量、摩擦、再生のための明確なオブジェクトレベルラベルがある。
textscPhyODEは、観測された軌跡から物理特性を推定し、それらを差別化可能な将来のロールアウトに使用する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:52:54 GMT)
FLINT: Efficiently Leveraging High Bandwidth Flash for Capacity-Scalable LLM Inference Acceleration [15.4] LLM推論は、計算スループットよりも加速メモリ容量によってますます制限される。
HBFは、マルチテラバイト近加速器容量を提供する3DスタックのNANDフラッシュ技術である。
本稿では,作業負荷駆動型HBF基板FLINTを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:58:14 GMT)
OmniJudge or OmniBias? Diagnosing Multimodal Judges through Balanced, Decoupled Lenses [15.4] D3-Omniは、微粒なマルチモーダル理解を診断するためのバランスのとれた、分離されたベンチマークである。
次元にわたって情報を漏らすような出力を再生成するのではなく、正の正の種子を固定し、負を導出する。
結果として得られるD3設計はデュアルバランスであり、負のサンプル不足とディメンション毎のラベルの不均衡を軽減するのに役立つ。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:18:35 GMT)
Model Effect or Label Effect? Refined Annotations and a Human-Referenced Benchmark for Pulmonary Embolism Segmentation [15.4] CADPE, FUMPE, READから166症例のVoxel-annotated CT肺血管造影検査を行った。
2つの事前訓練されたnnU-Netモデルと、オリジナルのアノテーションと洗練されたアノテーションを評価することでラベル効果を測定した。
ラベル効果はCADPEおよびFUMPEのモデル効果を超え,READでは0.045であった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:34:07 GMT)
Shaping the Future of Generative AI for Black Communities: A Frame Analysis of Public Discourse and Empirical Scholarly Research [15.3] 我々は,公共の談話や実証研究を通じて,ジェネアシステムによる黒人社会への影響を探究する。
91件の実証論文の体系的文献レビュー(SLR)と28件の公開資料のメディア談話フレーム分析を行った。
我々のSLRは、学術研究が技術的バイアスの検出に重点を置いていることを明らかにし、文化慣行や構造条件、ブラックナレッジシステムに携わるよりも、ブラックネスを測定可能な変数に還元している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:05:45 GMT)
SENSESHIFT: Continuous Sentiment-Controlled Text Generation via Encoder-based Mask Infilling [15.3] 感情制御のための制御可能なテキスト生成(CTG)は主にデコーダベースの大規模言語モデルに焦点を当てている。
本稿では,細粒度CTGのためのエンコーダベースのフレームワークであるSenseShiftを紹介する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:31:21 GMT)
Source-Face Authenticity Detection for 3D Gaussian Heads Reconstructed from a Single Portrait: A Benchmark and Dedicated Detector [15.1] シングルイメージの3Dガウスの頭部再構成は、1枚の肖像画から非常にリアルで自由にレンダリングできるデジタルヘッドを実現した。
しかし、復元とレンダリングは、ソースポートレートの痕跡偽造を弱める可能性があるため、その結果の3D顔は、その基盤となる顔が本物か偽物であるかを分類することが困難になる。
我々は,2段階戦略で訓練された検出器を提案する。第1段階では,マスク付きオートエンコーディングにより視覚バックボーンが局所的な再構築に必要な微細な外観情報を保持でき,同時にマルチビューコントラスト学習は,同一の頭部の描画された視界を横断する特徴一貫性を強制する。
実験の結果,本手法が最も精度が高く,精度が高いことがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:24:16 GMT)
KLTNet: Learning Sparse Feature Tracking for Robust and Accurate Monocular Visual-Inertial Odometry [15.1] KLTNetは、VIOフロントエンドの古典的なKLTトラッカーを置き換えるために設計された、軽量な学習ベースのプラグアンドプレイスパース機能トラッカーである。
固定参照パッチは、各機能トラック全体で安定したアンカーを提供し、蓄積されたトラッキングドリフトを減らすのに役立つ。
VINS-Mono と OpenVINS による公開ベンチマークと自己コンパイル型低テクスチャデータセットによる実験により,従来の KLT よりも追跡精度とオドメトリの精度が向上した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:30:32 GMT)
MoTE: Mixture of Task Experts for Multi-Task Video Understanding [15.1] 本稿では,大規模言語モデルのフィードフォワードネットワークをタスク固有の専門家に変換し,マルチモーダルバックボーンの共有を維持するデコーダアーキテクチャを提案する。
我々はこの設計をVideoLLM-MoTEとしてインスタンス化し、明示的なタスク経路を用いて5つのCOINベンチマークで評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:00:11 GMT)
Maia 200: A Software Defined Dataflow System for Large-scale AI Acceleration [14.9] Maia 200は高性能10-10 Tflop/s FP4と5072 Tflop/s FP8を750W TDPと7TB/s帯域で提供する高度なAIアクセラレータである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:05:40 GMT)
A Judge Should Know What Changed:Construct Validity for LLM-as-a-Judge Evaluation [14.9] 評価器の構成妥当性を2次元プロファイルとして定式化する。
S と R は独立であり、スカラーの要約がすべての関連する比較を保存することはないことを示す。
これらの結果から, 評価対象構造の変化に対して, 高判定基準は弱い感度で共存できることが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:32:54 GMT)
The Handoff Tax: Continuing Non-Native Trajectories in LLM Agents [14.8] コーディングエージェントは、数十のモデルコール、ツールの使用、コード編集にまたがる長時間のタスクを実行する。
これらが展開されるにつれて、ユーザは、より安価なモデルにエスカレートする、あるいはハードな推論が完了したらダウンシフトするという、実用的なコスト品質のトレードオフに直面します。
我々は,このハンドオフが品質やコストにどのように影響するか,また,受信機によって受け継がれた軌跡情報の変化が結果に与える影響について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:14:30 GMT)
Effective Learning Rate Governs Loss Dynamics in Language Model Pretraining [14.6] 学習率(LR)とパラメータノルムは、その比率、有効学習率(ELR)を通して損失ダイナミクスを制御している
ELRはランで一致し、LRとパラメータの基準がかなり異なるにもかかわらず、トレーニング中に損失軌跡は崩壊する。
崩壊エラーは通常、代表的な構成で測定された種子から種子までの変動より下の数 x 10-3 である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:57:29 GMT)
qshap: Fast Shapley Decomposition of $R^2$ for Gradient-Boosted Trees [14.6] qshapは、勾配型決定木(GBDT)に対する$R2$値のShapley分解を提供する
qshapはxgboost、lightgbm、catboostなど、広く使われているGBDT実装をサポートしている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:06:16 GMT)
Auditing Return Conditioning as a Control Knob: An Offline Diagnostic for Decision Transformer Recommendation [14.5] オフラインのリターン・ツー・ゴー(RTG)スイープは、リターン時にコンディションされたレコメンデータが制御可能であるかどうかをテストできるが、介入が監査されることは滅多にない。
歴史的RTGトークンの書き直しは、現在のトークンだけがよりローカルであるのに対して、ますますシンセティックなコンテキストを生み出す。
介入,非RTGベースライン,報酬チェック,RTGコンテンツアブレーションの4つのチェックを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:57:40 GMT)
AHEAD: Adaptive Hindsight with Environment-Augmented Distillation for Agentic RL [14.4] 自己蒸留法は、特権情報でRLを増強することにより、よりきめ細かい監視を提供することができる。
我々は、異なる監視ソースと異なるステップタイプにマッチするステップ認識フレームワークであるAHEADを提案する。
AHEADはタスク成功率(ALFWorldで+13.3ポイント)を高め、トレーニングステップを減らし、結果のみのRLや事前の自己蒸留ベースラインよりも厳密な相互作用予算内でタスクを解決する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:23:48 GMT)
Denoising the Future: Context-Aware Spectral Diffusion for Temporal Knowledge Graph Extrapolation [14.4] FreqDiffは、TKG外挿のための周波数対応フレームワークである。
FreqDiffは、将来のオブジェクト予測をクエリスロットのデノゲーションとして定式化する。
4つの公開TKGベンチマークの実験は、FreqDiffが最先端のパフォーマンスを達成することを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:39:45 GMT)
Variance-Guided Spatial Attention Fusion for Robust End-to-End Driving under Asymmetric Sensor Degradation [14.4] 本稿では,VG-SAF(Variance-Guided Space Attention Fusion)を提案する。
まず、物理的に接地されたオーグメンタは、代表カメラとLiDARの故障をシミュレートし、連続した空間マスクを放出する。
第2に、モダリティ特有の専門家は、ログ空間におけるクロスブランチ密度の蒸留を通じて、ピクセル当たりの信頼性のスケールを予測する。
第3に、キャリブレーションされた信頼性マップは、局所的な空間ゲートを持つ信頼できない細胞を抑圧するハイブリッドアテンション機構を駆動する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:27:02 GMT)
A Drop-in KEM Replacement for Client Signatures in Post-Quantum SSH [14.4] 量子後暗号は、リモート管理のためのSecure Shell(SSH)プロトコルを再構築している。
本稿では,クライアントの公開鍵署名をセッションバウンドなチャレンジ応答証明に置き換える,KEMに基づくSSHのユーザ認証手法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:01:47 GMT)
TRACE: An Evidence-Grounded Benchmark for Safety Evaluation of Large Reasoning Models [14.2] 大規模推論モデル(LRM)は、最終応答が安全に見える場合でも、安全でないコンテンツを含む可能性のある中間的推論トレースを生成する。
TRACEはエビデンスに基づく安全性評価ベンチマークで、プロンプト、推論トレース、最終応答をカバーしています。
各プロンプトに対して、4つのLEMが推論トレースと最終応答を生成し、各コンポーネントの安全性を注釈し、証拠を抽出する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:35:47 GMT)
VIP: Variation-based Iterative-learning Planning for Robotic Navigation [14.2] 本稿では,ロボットの効率的な動作計画のための,変分に基づく反復学習計画フレームワークを提案する。
提案するフレームワークは,異なる計画目標,ロボットプラットフォーム,Swarm構成の動作計画を効率的に生成し,反復的に改善することができる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:38:20 GMT)
GeoWAM: Visual Geometry World Action Models for Autonomous Driving [14.1] 自律運転のための視覚幾何学的世界行動モデルである textbfGeoWAM を紹介する。
将来の画像を予測する代わりに、GeoWAMは将来のシーン形状を予測するために事前訓練されている。
幾何条件のアクションヘッドは、これらの学習された幾何学的ダイナミクスを利用して将来のエゴ軌道を予測する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:05:45 GMT)
Syn2RealTrack: Bridging the Gap Between Synthetic and Real-World Datasets for Online Multi-View Multi-Target Tracking [14.0] 倉庫シーンのマルチカメラ3D認識システムは、主に合成データに基づいて訓練されている。
その結果、合成と現実のギャップは、地上の局在とカメラ間のアイデンティティーアソシエーションを損なう。
代わりに、カメラキャリブレーション、以前の物体形状、対象の国勢調査が知られているという仮定の3つの分離可能な点でパイプラインに入ることを議論する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:48:50 GMT)
Rethinking Pre-Training and Augmentation for Zero-Shot Cross-City Object Detection [14.0] 本研究では,2つのコア柱を中心に構築された物体検出のための新しいトレーニングパイプラインを提案する。
我々のフレームワークは、限られたGPUメモリ(16GB)を使用しながら都市間分散ギャップを橋渡しします。
最適化されたRF-DETR-HRとRF-DETR-Grayworldは、ベースラインに対して+24.29の実質的な増加をもたらす。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:16:42 GMT)
Scalable Self-Supervised Learning for Multiphase AC-OPF in Distribution Systems with Topology Reconfiguration [14.0] 多相分布AC-OPFのための自己教師型学習フレームワークSLFSアルゴリズム
位相変化は、アクセタンス行列逆のシャーマン・モリソン・ウードベリー更新を用いて効率的に処理される。
13ノードから8500ノードまでのIEEEフィードでは、ペナルティ+SLFSは無視できる最適性ギャップとほぼゼロの制約違反を達成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:45:13 GMT)
TransPhy: Visual In-Context Learning for Physically Grounded Image Editing [13.8] 74の物理基底変換規則と5,240のソースターゲット画像対からなるPhysVICL-74を導入する。
物理基底を持つVICLを物理ルール誘導とトランジション整合レンダリングに分解するフレームワークであるTransPhyを提案する。
実験により,TransPhyは既存の視覚内テキスト編集法に対して,物理ルールの適合性,クエリ一貫性,および目に見えないルールの一般化を改善した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:28:39 GMT)
COCI: Conference Organisers and Content Identifier [13.7] COCIはAIベースのフレームワークで、生のCfPテキストからきめ細かい構造化メタデータを抽出するように設計されている。
著者を曖昧にし、トピックやカンファレンスシリーズを意味的に整合させることで、COCIは非公式な学術的普及とセマンティックウェブリソースのギャップを埋める。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:43:53 GMT)
Optimal Alternating Regret for Online Learning and Games [13.6] 我々は,オンライン線形最適化 (OLO) とオンライン凸最適化 (OCO) の両面において,ゲームにおける学習力学の交互化を動機とした,ミニマックス-最適交互後悔(minimax-optimal alternating regret)を解決した。
確率単純度 $_d$ 上の OLO に対して、任意の時間的地平線$T$ と一致する下界に対して定数である $O(log d)$ の繰り返し後悔を持つアルゴリズムを与える。
一般の$d$次元コンパクト凸集合上のOCOに対して、$O(dlog (1+T/d)$交互後悔を伴うアルゴリズムを与える。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:41:17 GMT)
Classical and quantum spectral density estimation under local graph access [13.3] 局所アクセスモデルに基づく非重み付きグラフの正規化隣接行列のスペクトル密度推定について検討した。
We give a $widetilde O(eps-3)$-query algorithm that the spectrum density with Wasserstein-1 error at least $eps$。
グラフが十分に大きいとき、$widetilde(eps-4/3)$ quantum lower boundを証明します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:46:08 GMT)
When Seeing Is Not Enough: Benchmarking Interactive Visual Grounding in LVLMs [13.3] 大規模視覚言語モデル(LVLM)における対話型視覚接地のための制御された評価フレームワークを提案する。
LVLMは、4つの視覚的コンテキストと4つのインタラクションプロトコルでタスクレベルの人間のベースラインをはるかに下回る性能を示した。
LVLMは校正も不十分で、しばしば実験精度を超える信頼性を報告している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:12:31 GMT)
EviDx: Evidence-Aware Active Diagnosis with Scaffolded LLM Agents [13.2] 我々はエビデンスを意識したアクティブ診断フレームワークであるEviDxを紹介する。
患者固有の診断環境と、臨床診断の足場と、観察者向けランタイムハーネスを組み合わせます。
EviDxは、モデルに依存した機能境界を明らかにしながら、診断性能とプロセス安定性を改善する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:54:30 GMT)
Expectations and Practices around AI Disclosure in CS Research [13.1] 我々は、トップコンピュータサイエンスの会場におけるAI公開ポリシーを調査し、その流行にもかかわらず、それらが非常に不明確であることを発見した。
我々は、研究者が研究設計に関わるタスクや、人間の関与が低いタスクに最も必要な情報開示を見つけることを学ぶ。
我々は、AI開示ポリシーとプラクティスを期待と整合させることを推奨し、必要と認識される研究課題の分類を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:40:25 GMT)
Minimax Alternating Regret for the Experts Problem and Online Convex Optimization [13.1] ミニマックスの交互後悔は地平線から独立して$(log d)$であることを示す。
さらに、この結果を$d$次元コンパクト凸集合上で一般のOCOに拡張する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:56:20 GMT)
Enhancing Bayesian Optimization and Active Learning Through Kernel Diversity [13.1] 本稿では, Ensemble Gaussian Processes (EGP) と不一致認識獲得戦略を統合した統合フレームワーク KENDO を提案する。
KENDO-BOは最先端の手法と比較して、競争力や優れた最適化性能を達成している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:35:47 GMT)
What Does Prompt Learning Change? -A Natural-Language Concept Analysis of Vision-Language Models [13.0] PromptSpLiCEは、固定された自然言語辞書から概念の疎結合として、各クラス条件のテキスト埋め込みを表現する。
代表的なプロンプト学習手法であるCoOp上でのPromptSpLiCEを11の画像分類データセットで評価した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:06:26 GMT)
Native Multimodal Representation Learning for Click-Through Rate Prediction in E-Commerce Scenarios [12.7] マルチモーダル表現は、産業用eコマースレコメンデーションシステムで広く採用されている。
CTRデータから高品質で多モードで解釈可能なトレーニングサンプルをマイニングするMine-Then-Train法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:36:17 GMT)
LifePlanner: Evaluating LLM Agents for Geo-spatial Planning with Social Media Data [12.7] 大規模なローカルソーシャルメディア投稿で地図データを充実させるベンチマークであるLifePlannerを紹介した。
LifePlannerは4つのタスクカテゴリと3つの困難レベルにまたがる評価スイートを提供する。
実験では、フロンティアLSMは単純な検索では良好に機能するが、複雑な計画では著しく低下する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:28:29 GMT)
GOD: Enhancing Generalization via Deep Grafting for Sequential Recommendation [12.7] 逐次推薦者はスパースでノイズの多い歴史に苦しむことが多く、一般化は目に見えない相互作用に制限される。
そこで我々は, グラフト指向蒸留(GOD)を提案する。
GODは3つの実世界のデータセットで、最先端のベースラインを最大13.92%上回っている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:29:07 GMT)
SA-Bench: Evaluating Semantic Alignment in LLM-Based Paper Reproduction [12.7] LLMエージェントは再生コードを生成することができるが、科学的に不誠実な実装をしばしば生成する。
我々は、この障害モードをセマンティックドリフトと定義し、生成されたコードは紙の仕様から静かに分岐する。
ICLR、ICML、NeurIPS 2025の30論文をカバーする診断ベンチマークであるSemanticAlign-Benchを紹介した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:48:48 GMT)
Discovering Adaptive Transmission Programs for Collective Innovation [12.7] エージェントと集合状態に基づいて情報をルーティングする状態認識プログラムとして送信プロトコルを形式化する。
進化したプロトコルは、文献から標準ベースラインよりも最大37%パフォーマンスを向上する。
結果は、人間の集団知性を高める協調インフラの設計への道筋を示唆している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:34:03 GMT)
SPAR-Hate: Auditor-Guided Multi-Perspective Role Reasoning for Bilingual Hate Speech Parsing [12.6] SPAR-Hateは、バイリンガルヘイトスピーチ解析のための監査者向け多視点ロール推論フレームワークである。
それぞれの文書をローカル・フォーカス・ユニットに分解し、ヴィクティム、モデレーター、文化的傍観者の視点から証拠に基づく候補者を導き出す。
STATE-ToxiCNと制御されたTBOスプリットの実験は、ローカルとAPIのバックボーン間で利得を示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:31:08 GMT)
RACE: Scalable Statistical Estimation of Functional Consistency in LLM Neurons [12.6] 本稿では,トランスフォーマーニューロンの領域全体の機能的整合性を評価する統計フレームワークであるRASを提案する。
RACEは勾配に基づく点推定よりも優れた領域特異性を達成する。
計算オーバーヘッドは勾配法よりも2桁低い。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:57:43 GMT)
Algorithmic Impact Reveals the Hidden Social Choice Structure of Alignment [12.6] AIアルゴリズムは複数の人に影響を及ぼす決定を行い、それを整列させることは社会的選択の問題となる。
本稿では,社会プランナーの福祉効果に対する制約をプロトコルに翻訳する方法を明らかにする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:09:26 GMT)
From State to Action: OODA-Tool for Reliable Multi-Turn Tool Use [12.5] 本稿では,国家行動競争を緩和するためのクローズドループ方式であるOODA-Toolを紹介する。
OODA-Toolは、コントローラがチェックした中間状態を通じて各決定をルーティングし、最終的な出力が現在のタスク状態に残されていることを保証します。
我々は,マルチターン,マルチツール,不完全情報設定にまたがるQwen3モデルを用いて,直接関数呼び出しとReActポリシーに対するOODAツールの評価を行った。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:27:25 GMT)
Multiscale Community-Based Fingerprinting of Signed Functional Networks [12.5] マルチスケールなコミュニティベース機能型コネクトームフィンガープリントフレームワークを提案する。
機能ネットワークのメソスケール構造によって個々の個人を特徴づける。
以上の結果から, コミュニティベースの指紋は, 個別化脳機能評価のための信頼性, 解釈可能な基質であることがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:10:52 GMT)
Do System Prompts Leave Behavioral Fingerprints? A Large-Scale Empirical Study of Clone Detection via Output Similarity [12.3] システムプロンプトのためのBBF(Black-Box Behavioral Fingerprinting)を提案する。
BBFはモデル出力から振る舞いのシグネチャを登録し、後に被疑者のデプロイメントがそのシグネチャと一致するかどうかをテストする。
BBFは非適応的なプロンプトパラフレーズ(AUC $geq 0.889$)に抵抗し、不完全な抽出に頑健である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:12:22 GMT)
Towards Optimal Quantum Estimators for State Frame Potential [12.3] 本稿では, 3 つのより弱いアクセスモデルの下で, 次数 $t$ の状態フレームポテンシャルを付加誤差 $varepsilon$ に推定する問題について検討する。
クエリモデルでは、$widetilde(sqrtt/varepsilon)$のほぼ最適クエリ複雑性を確立します。
一般的なサンプルモデルでは、最適なサンプル複雑性を$(t/varepsilon2)$とする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:29:24 GMT)
Evaluating Multiple LLM Generations with Validated Task Coverage [12.2] 有限候補集合の評価のための5領域ベンチマークであるVTC-Benchを紹介する。
VTCは、$k$の試行で何つの異なる有用な結果が得られるかを測定する。
複数のモデルと推論設定にまたがって、ベンチマークは従来の評価とは異なる結論をもたらす。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:32:37 GMT)
Sequential Object Placement Optimization with Convex Decomposition [12.0] 分解自由空間における微分可能な非線形最適化問題としてオブジェクト配置をフレーム化する逐次最適化フレームワークであるSOPO-CDを導入する。
従来のグリッドサーチ法に比べて100倍の高速化を実現し, 制約の厳しい空間に数ミリ秒で最適な配置を実現するカスタムソルバを実装した。
フレームワークを2D Tangram, 2D Tetris, 3D Bin Packingに一般化し, 高い計算性能とパッキング性を示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:19:31 GMT)
Uncovering the Limits of Proof Sharing for Neural Networks [11.9] テンプレートベースのアクセラレーションの有効性と限界について検討する。
我々は、ニューラルネットワーク層にまたがってテンプレートを自動的に分散する新しいテクニックであるFastCertを紹介する。
FastCertは、既存のテンプレートベースの再利用技術で平均1.13倍のスピードアップを達成した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:52:40 GMT)
Is Discrete Difficulty Sufficient? Leveraging Continuous Difficulty for Efficient Self-Consistency in LLMs [11.8] 自己整合性(Self-Consistency, SC)は、様々な推論経路を抽出し、最も一貫した答えを選択するデコード戦略である。
複数の推論経路を生成することによって生じる過剰なトークン消費は、SCの大きな制限として認識されている。
本稿では,連続的な信号として問題難易度を推定し,生成した推論経路の数を動的に調整するフレキシブル自己整合性(FSC)を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:17:30 GMT)
Inferring Action from Future Latent State for Robotic Manipulation [11.7] 我々は、ビデオ生成がワールドアクションモデリングの不要な目的であると主張している。
ロボット操作においては、世界モデルの目的は、中間の瞬間に世界がどのように見えるかを再現するのではなく、アクションの実行後に世界が到達する状態を予測することである。
本稿では,映像生成に頼らずに将来予測状態からロボット動作を推定するDELE-w0.5を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:06:14 GMT)
TrustFormer: Cross-Temporal and Cross- Dimensional Transformer for Task-Specific Multi-Dimensional Trust Evaluation [11.6] TrustFormerはタスク固有の多次元信頼評価フレームワークである。
過去の業績データから潜在的協力者の多次元信頼進化を学習する。
信頼性評価精度は40.8%向上し、より信頼性の高い協力者選択が可能となった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:57:18 GMT)
Multi-View Trust Evaluation for Collaborator Selection via Evidential Deep Learning [11.6] 本稿では,MVEに基づく信頼度評価手法を提案する。
まず、潜在的協力者と相互作用した各タスク所有者を独立した観察視点としてモデル化する。
第2に,変化条件下での信頼の動的進化に対処するために,マンバモデルにおける強力なロングシーケンスモデリング能力を利用する。
第3に、ビュー固有の信頼度評価の確実性レベルを定量化するために、MVEに明らかな深層学習機構を組み込んだ。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:52:26 GMT)
Long-Term Behavioral Evaluation for Trusted Collaborator Selection via Bidirectional Mamba [11.6] 本研究は,長期的行動評価のための双方向マンバ対応モデル(BM)を提案する。
短い時間帯ごとに、歴史的コラボレーションに基づいたデバイス間でグラフが構築される。
双方向マンバモデルはこれらの短期的表現を全ての時間間隔で統合し、安定かつ信頼性のある長期的行動評価を生成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:41:08 GMT)
IDeaL: Data-Free Multi-Teacher Distillation via Improved Dead Leaves [11.5] 我々は,教師が持つ情報を利用して,マルチティーチンガー蒸留の騒音を調整できることを実証した。
本研究では, パッチと画像レベルでのデコレーション損失により, データフリー蒸留に最適化された教師固有の改良サンプルを生成する手法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:57:52 GMT)
Behind the [MASK]: Disentangling Representation and Faithfulness in DAPF-Based Dementia Detection [11.4] 本稿では,ドメイン適応モデルの解釈可能性について,Prompt-based Fine-tuning (DAPF) フレームワークを用いて検討する。
DAPFフレームワークは認知症検出を診断関連マスキングトーケン予測として用いる。
このことは,そのマスキング・ランゲージトケンインタフェースが,忠実なトークンレベルの説明を作らずに診断情報を決定することを示唆している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:16:05 GMT)
Parameterized Complexity of $L_p$-Lipschitz Constants for Input Convex Neural Networks and $L_p$-Norm Maximization over Zonotopes [11.0] リプシッツはニューラルネットワークを入力するためのネットワークの感度に標準的手法を定めている。
この問題に対してブルートフォースが本質的に最適であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:47:37 GMT)
PARTAB: Partition-Aware Reasoning with Structured Evidence for Scalable Table Understanding [11.0] 分割型共振器(分割型共振器)
分割型共振器(分割型共振器)
分割型共振器(分割型共振器)
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:26:23 GMT)
Hierarchical Skill Retrieval for Data-Efficient Adaptation of Vision-Language-Action Models [10.9] Hierarchical Skill Retrieval (HSR)は、データ効率のよいVLA適応のための検索フレームワークである。
我々は、HSRが最強のベースラインに対して平均成功率を10.3%、21.3%改善することを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:04:49 GMT)
Simulating Cognitive Smart Freight Corridors with Agent-Based Models and Reinforcement Learning [10.8] 本稿では,物理インフラストラクチャ層,接続層(V2X),決定層(RL)を結合したエージェントベースモデリング(ABM)フレームワークを提案する。
スループット,混雑,エネルギー,排出,堅牢性の測定値を用いて,3つのシナリオ(Baseline,Assisted,Cognitive)を評価する。
予備的な結果は,コグニティブシナリオはベースラインよりも高いスループットと低い混雑を実現する一方で,補助シナリオは小隊による1キロあたりの有意義な省エネを達成していることを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:17:33 GMT)
When Does Context Routing Help? A Systematic Study of Multi-Modal Fusion in Time Series Forecasting [10.8] マルチモーダル時系列予測法は, 高度な融合機構により, 補助的文脈を時間的予測に統合する。
我々は、より狭く、チェック可能な質問を尋ねる: 補助的なコンテキストは、いつ、予測者を助けることができるのか?
1) ターゲットは最終値のショートカット(低自己相関rho_h)に支配されず、(2) コンテキストは履歴を超えてターゲットに関する情報を伝達する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:25:49 GMT)
GRAPE: Gradient Refinement and Progress-Aware Exploitation for Query-Efficient High-Dimensional Bayesian Optimization [10.8] GRAPE(Gradient Refinement and Progress-Aware Exploitation)を紹介する。
まず、閉形式取得関数を介して局所勾配後部を研削し、次に、降下時の期待減少条件を最大化して更新方向を選択する。
GraPEは、高次元タスク間で優れたクエリ効率を示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:12:12 GMT)
OPDSearch+: On-Policy Distillation with RL Refinement for Search-Augmented Reasoning [10.7] 教員のオンライン蒸留は、有望な方向性を提供するが、2つの問題に悩まされている。
タスク固有の訓練教師は、タスク固有の微調整を伴わずに、オフ・ザ・シェルフの教師とPDを直接適用しながら、相当な訓練コストを発生させる。
我々は,教師の微調整を必要としない最初の蒸留パラダイムであるPDSearch+を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:39:16 GMT)
DeepRepoQA: Code Repository Question Answering with Deep Agent Exploration [10.7] DeepRepoQAは、リポジトリレベルのコード理解のための新しいQAフレームワークである。
Monte-Carlo Tree Search (MCTS) メカニズムは、エージェントが動的にコードを探し、ナビゲートし、検査することを可能にするために使用される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:26:31 GMT)
IAPO: Influence-Aware Policy Optimization for Credit Assignment in Multi-Turn Service Agents [10.6] 大規模言語モデル(LLM)エージェントは、ユーザと外部ツールとのマルチターンインタラクションを通じて、長い水平タスクをますます解決します。
この研究は、マルチターンユーザインタラクションにおけるクレジット割り当ての理解を深め、スパースな結果フィードバックからサービスエージェントを訓練するための原則的なアプローチを提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:14:36 GMT)
SA-RSQ: A Versatile Sparse Representation Framework for Multi-modal Recommender Systems [10.5] ハード量子化はコンパクトだが境界歪みをもたらすが、高密度なソフト量子化は限られたストレージ予算に表現品質を結合する。
本研究では,Sparse-based Residual Soft Quantization (SA-RSQ)を提案する。
プロプライエタリなフードデリバリー広告データセットの実験では、アイテムあたり8~48バイトのストレージ予算間での、良好な再構築パフォーマンスとCTRトレードオフが示されている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:07:23 GMT)
''You Can't Open an LLM With a Screwdriver'': The De-Democratization of Software [10.4] 生成AIがすぐにすべてのコードを書くという主張は、プログラミングが終わりに近づいているという予測につながった。
このビジョンペーパーでは、AIはソフトウェアエンジニアリングの専門知識を排除するのではなく、その専門知識がもっとも重要になる場所を変える、と論じている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:35:40 GMT)
An Echo Chamber of One: Should AI Psychosis Be a Distinct Clinical Entity? [10.3] 精神病症状の発症・悪化のラベルとして「AI精神病」が公言・臨床談話に登場している。
我々は、AI関連精神病が別個の臨床的実体としての認識を保証しているかどうかを検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:53:46 GMT)
Simthesizer: An Agent-Driven Simulation Framework for LLM Serving Systems [10.3] 本稿ではエージェント駆動シミュレータ開発を実現するフレームワークであるBorgを紹介する。
Borgは、完全なサービスワークフローを均一に表現する構成可能なシミュレータインフラストラクチャを導入している。
同一のワークロードでは、Borgは2つの最先端シミュレータよりも最大284.96倍、23.19倍高速である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:58:26 GMT)
Method, Mind, and Morality: How People Make Sense of Artificial Intelligence [10.2] 人間は人工知能(AI)の迅速な離陸をどうやって理解できるのか?
我々は、何百万ものAI関連新聞記事やソーシャルメディア投稿の計算テキスト分析を用いて、AIのセンスメイキングダイナミクスを研究した。
我々は、さまざまな社会学的フレーム(集団認知を構成する解釈スキーマ)を特定し、AIプロフェッショナルがフレームを使用して重要な認知的課題に対処する方法を示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:52:55 GMT)
MoRF-AST: Calibrated Probabilistic Virtual Sensing for Structural Monitoring under Changing Operating Conditions [10.2] 本研究では,モーダル残留流マッチングとコンテキスト依存型アフィンスプレッドトランスポート (MoRF-AST) を併用した構造仮想センシング手法を提案する。
MoRFは2つの直接条件流に対して16.1%と17.9%に対して、後平均根平均二乗誤差(NRMSE)が7.20%に達する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:16:59 GMT)
Hierarchical Prototype-Memory Adaptation of SAM for Surgical Instrument Segmentation [10.1] 手術機器セグメンテーションのための階層型プロトタイプメモリ適応フレームワークHPMAを提案する。
具体的には、HPMAは、注釈付き手術シーンから凍結されたマルチスケールのビジュアルプロトタイプメモリバンクを構築する。
提案手法は,既存の基礎モデル適応手法よりも優れた,最先端の性能を実現する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:27:57 GMT)
Game2World Engine: Unlocking In-the-Wild Gameplay Videos for World Model Training [10.1] ゲームプレイUIのグラウンドと削除を形式化したフルスタックフレームワークであるGameUI-TaxonomyとG2WEngineを紹介する。
G2WEngineは、実際のゲームプレイビデオから再利用可能なUIアセットを自動的に抽出し、クリーンな映像に時間的に一貫性のあるUIオーバーレイを合成する。
Game2Worldをベースとして,マルチモーダルなセマンティック理解とビデオ編集機能を組み合わせたマスクレスゲームプレイUI除去モデルであるGameCleanerを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:13:32 GMT)
SelfGraphRAG: Bridging the Supervision Gap in Graph-Based RAG with Synthetic QA Generation [10.1] SelfGraphRAGは知識グラフ構造から直接質問応答ペアを生成し、クエリ条件のグラフ検索をトレーニングするフレームワークである。
本稿では,SelfGraphRAGにより,埋め込みベースラインよりも検索精度と下流推論性能が向上することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:18:05 GMT)
SPECTRA: Subspace-Preserving Embedding Calibration, Transport, and Replay for Fully Few-Shot Class-Incremental Audio Classification [10.0] フリーズエンコーダ上に3つのコンポーネントを追加するフレームワークであるSPECTRAを提案する。
3つのFFCACベンチマークにおいて、SPECTRAは平均精度を改善し、現在の最先端手法の忘れを少なくする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:43:58 GMT)
Towards Reliable, Generalizable, and Specific In-Context Knowledge Editing via Multi-Objective Reinforcement Learning [10.0] 大規模言語モデル(LLM)は強力だが、事前学習が終わると時代遅れになる静的パラメトリック知識によって制限される。
テキスト内知識の編集は、トレーニング不要で、ブラックボックスのLSMにも容易に適用できるため注目されている。
In-context Knowledge Editing (MO-IKE) を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:50:47 GMT)
Safety-aware Model Predictive Path Integral Control with Signal Temporal Logic [9.7] 提案手法は, サンプリング・ベース・リレーディング・ホライゾン・プランニング・フレームワークであるセーフティ・アウェア・ストル-mppiを提案する。
提案手法は離散時間STL式を候補時間変化制御バリア関数に符号化する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:00:50 GMT)
SPECMINE: A Large-Scale Corpus of Spec-Driven Development Artifacts [9.6] 仕様駆動開発(SDD)は、構造化された自然言語仕様がAIコーディングエージェントの実装を駆動する、急速に進化するプラクティスである。
SPECMINEは、GitHubリポジトリ内のSDDを2つの国勢調査でキャプチャするコーパスである。
各仕様には、完全なリポジトリメタデータ、完全なコミット履歴、解析されたドキュメント構造が備わっている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:43:30 GMT)
Multi-Source Complex Network Reconstruction via Wasserstein Distributionally Robust Optimization and Algorithm Unrolling [9.5] 重み付きワッサーシュタインバリセンタを介して異種ソースを融合するグラフ学習フレームワークであるMS-WDROを提案する。
最悪の場合のリスクを最小限に抑えると、確実に収束したADMMスキームによって効率的に解決されるトラクタブル正規化ラプラシアン推定器が得られる。
MS-WDROは、グラフ回復、サンプル効率、下流診断ユーティリティにおいて、7つのベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:18:14 GMT)
Interpretable Fundus Image Classification via Ring-Based Retinal Vasculature Features [9.5] 本研究は、光学ディスクを中心とした網膜血管のリング構造表現に基づく、解釈可能な基底画像分類フレームワークを開発する。
提案手法は,3つの公開ファンドデータセットに対して高い分類性能を示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:37:28 GMT)
RAGSentinel: Certifiable Geometric Consensus for Robust Retrieval-Augmented Generation [9.5] 我々は,ブラックボックスRAGシステムのための,トレーニング不要でラベルのない防衛システムであるRAGSentinelを提案する。
RaGSentinelは、競争精度を維持しながら、攻撃の成功率の低下を一貫して達成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:44:07 GMT)
NeuronGuard: Robust LLM Safety Alignment via Ablation-Aware Safety Signal Redistribution [9.5] 大規模言語モデル(LLM)における安全性の整合性は、拡大する攻撃に対して脆弱である。
ジェイルブレイクはプロンプトによって安全メカニズムをバイパスし、ニューロンレベルの攻撃は、デプロイ後直接、安全クリティカルなニューロンを発生させる。
我々は、より広い範囲のニューロンに安全信号を再分配することにより、両方の攻撃クラスに対してLDMを同時に強化する、微調整段階の防御であるNeuronGuardを紹介する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:36:54 GMT)
Beyond What Meets the Eye: Unveiling Situational Illusions for Multimodal Large Language Models [9.4] 実世界の状況は、その基盤となる物理的状態から逸脱し、実践的な応用においてマルチモーダルな大規模言語モデル(MLLM)の信頼性に挑戦する。
この現象を状況錯覚と呼び、このような錯覚の下でMLLMがどのように機能するかを考察する。
我々は、文脈的理解のための視覚的証拠を体系的に検査し、推論し、クローズドソースモデルのプロンプトを開発し、オープンソースモデルの微調整を監督するという、中核的な考え方に基づいている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:51:53 GMT)
Mind the Student: Behavioral and Contextual Cues for Automated Engagement Prediction in Online Learning [9.3] 我々は,映像,音声,画像エンコーダから抽出した暗黙的特徴と,頭部ポーズ,視線,顔の動き,感情,ウェーブレットに基づく音声特徴などの構造化された行動モダリティを統合するフレームワークを開発した。
我々は、不確実性を考慮した予測のために、顕在回帰およびスペクトル正規化ガウス過程分類ヘッドを用いて、ロバスト性の改善と校正を行う。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:03:07 GMT)
SatDL: Jointly Optimizing Data Redistribution and Training for Satellite-Based Distributed Learning [9.3] 衛星ベースの分散学習は、大規模なグローバル分散センサーデータを使用して、機械学習モデルを軌道上で直接訓練することを約束する。
トレーニング収束は、厳密な非IIDデータ、特にラベルの不均衡によって著しく遅くなる。
エンドツーエンドの学習時間を最小化するために設計されたデータ再分散フレームワークであるSatDLを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:06:24 GMT)
Synergising Local Geo-Environmental Characteristics with Spatial Context for Enhancing Landslide Susceptibility Mapping [9.3] 地すべり点の地環境特性とそれに対応する空間的コンテキストを相乗化して,地域地質・空間的文脈融合(LGSCF)戦略を構築する。
本研究は台湾南都郡のジェナイ郡区とシナイ郡区の約2644km2をカバーしている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:32:10 GMT)
The Gold Rush in AI4Math: Where Are We Now? [9.2] 広範囲にわたる議論にもかかわらず、人工知能が実際に数学で使われていることに関する実証的な証拠は依然として限られている。
我々は2026年3月1日から8月20日までに投稿された32,944件のarXivの投稿を収集した。
我々は3,575件の提出書類を特定し、そのうち1,712件が少なくとも1つの実質的な数学的貢献に関与した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:07:37 GMT)
StarHarness: Evolving Harnesses with Stratified Search for Enterprise Environments [9.1] 本稿では,モデルウェイトを固定したまま環境特異的エージェントハーネスを進化させるフレームワークであるStarHarnessを紹介する。
進化したハーネスには、プロンプトとタスクフレーミング、ツールインターフェース、スキル、MPP支援プロバイダ、サブエージェント構造、エージェントループ構成が含まれる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:48:05 GMT)
Spectrum-Aware Bounds on Invertibility for Privacy-Enhancing Instance Encoding [9.0] 我々は、完全決定論的エンコーダにも適用可能な、より厳密な新しい境界の族を導入し、MSEを超えて他のノルムベースの類似度指標に拡張することができる。
私たちは、さまざまなエンコーダ、データセット、アタックのバウンダリを評価し、そのバウンダリを一貫して保持し、既存のバウンダリを改善しています。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:09:51 GMT)
Distributed Resource Theory of Entanglement and Magic [8.7] フォールトトレラント量子コンピューティングにおいて、絡み合いと魔法は量子通信と普遍的なフォールトトレラント計算にとって不可欠な資源である。
エンタングルメントとマジック(DREAM)の分散資源理論を紹介する。
DREAMには絡み合いや魔法ではない非自明な資源状態が含まれているので、これら2つのリソースを個別に扱うよりも厳密にリッチである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:25:16 GMT)
The RAT: A Unified Bayesian Model for RAG Evaluation [8.7] 本稿では,検索成功,棄却行動,回答正当性を共同でモデル化するベイズ評価フレームワークを提案する。
フレームワークを3つのデータセット、3つのレトリバー、3つのジェネレータにわたる27のRAG構成に適用する。
我々は、LLM-as-a-judgeアノテーションをキャリブレーションされたノイズ観測として組み込むようモデルを拡張した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:54:30 GMT)
GaussVLA: Geometry-Aware Spatial Reasoning for Vision-Language-Action Model [8.6] GaussVLAは、内在的な幾何学的構造を持たないフラットな2Dパッチトークンとして視覚観測を符号化する。
学習クエリと、構造化された非自己回帰的な幾何学的推論を実行するemphDepth-Aware Chain-of-Thought (DA-CoT)をプールする。
LIBEROでは平均93.5%の成功、100.0%の成功で2億のパラメータしか持たない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:28:28 GMT)
Joint-Embedding Prediction of Masked Point Tubes for Self-Supervised Learning on 4D Point Cloud Videos [8.6] 本稿では、教師なしの点雲から潜時予測を通じて学習するJEPAスタイルのフレームワークを提案する。
学習した表現は、下流のファインレベルアノテーション、限定レベルのアノテーション、およびデータセット間の転送を改善する。
これらの結果は,JEPAスタイルの予測が,4Dポイントクラウドビデオの再構成中心の事前トレーニングの代替となることを示唆している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:38:43 GMT)
Joint Distribution Alignment for Universal Domain Adaptation [8.5] We propose a novel UniDA algorithm called Joint Distribution Alignment for Universal Domain Adaptation (JAUA)。
提案した一般化誤差境界に基づき,Universal Domain Adaptation (JAUA) のための結合分布アライメント(Joint Distribution Alignment for Universal Domain Adaptation)と呼ばれる新しいUniDAアルゴリズムを提案する。
6つの公開画像データセットに対する実験結果は、UniDA問題に対処する上でのJAUAの優位性を示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:43:51 GMT)
Observing Bell Inequality Violation Beyond the Qubit Bound in a Spinor Bose--Einstein Condensate [8.4] 量子力学によって許される相関関係は、ベル非局所性が最も深く、操作的に強力な表現であるような古典的な説明に反することができる。
ここでは, スピン-1 87$Rb のボース=アインシュタイン凝縮体におけるクォートベル相関の観測について報告する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:53:16 GMT)
Mechanistic Circuit Identification for Controllable Data Generation [8.3] トレーニング力学に基づくデータバリュエーションと機械的解釈可能性とを結合する回路基底フレームワークを提案する。
具体的には,データ品質を3つの相補的ユーティリティ軸,学習可能性,課題,アライメントに沿って概念化する。
この能力に基づいてSAMS(Stage-Aware Mechanistic Scheduling)を導入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:53:19 GMT)
Reinforcement Learning on Benign Facts Amplifies Leakage of Memorized Private Data [8.3] 検証可能な報酬付き強化学習(RLVR)は、推論タスクにおいてモデルをより良くするためにデプロイされる。
事実に基づくRLVRは、インストラクションモデルがすでに記憶していた個人識別情報(PII)の抽出を増大させることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:48:49 GMT)
HMGCLIP: Heterogeneous Multi-Granularity Contrastive Learning for E-commerce Representation Learning [8.3] HMGCLIPは統合マルチモーダル埋め込みフレームワークである。
ハイパーグラフトポロジを利用して構造認識型ハードネガをマイニングし,多粒質セマンティクスを関係レベルとハイパーエッジレベルの両方で整列する。
この設計により、細粒度と粗粒度の両方の下流タスクの属性エビデンスを動的に融合する二重粒度推論機構が実現される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:15:05 GMT)
Rethinking Semantic Alignment in LLM-Enhanced Collaborative Filtering: A Spectral Decoupling Approach [8.3] 協調的および意味的な信号は、異なるスペクトル部分から恩恵を受けることを示す。
協調表現と意味表現を保存しながら、信号固有のスペクトルフィルタリングを適用するUniSpecRecを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:19:41 GMT)
Cross-Domain, Multi-Task Data-to-Text Generation without In-Domain Training Data [8.3] ドメイン内トレーニングテキストもテスト参照も使用できない環境で、ドメイン間D2T生成について検討する。
データ駆動型知識蒸留とゼロショット推論を比較し,ドメイン外D2Tデータの微調整を行う。
5つのベンチマーク実験により、DDKDはモデルサイズが一定であり、微調整とゼロショットの推論の両方で常に優れていた。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:17:54 GMT)
SandwichQuant: Which Parameters Matter Before and After Quantization? [8.1] パラメータ部分空間から見た量子化補正について検討する。
低次元正規化-アフィン部分空間は、一致した予算の下で高い効率の補正方向を提供することを示す。
2段階の正規化-アフィン補正フレームワークであるSandwichQuantを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:40:06 GMT)
Representation Learning in Diffusion and Flow-based Model: An Application Aspect [8.1] 拡散モデルとフローベースモデルは近年、生成モデリングにおいて支配的なパラダイムとなっている。
これにより、生成モデルと表現学習の双方向な関係が生まれる。
既存の作品を3つの視点から整理する3層プログレッシブフレームワークを提案する。
我々は,画像分類,濃密な視覚予測,インスタンスレベルの知覚,アノテーションの難解なシナリオなど,幅広い下流タスクを対象とした代表手法を体系的に分類した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:55:15 GMT)
Vision Language Model Fusion for Explainable Face Recognition [8.1] 視覚言語モデル(VLM)は、説明可能な顔認識のための有望な基盤を提供する。
本研究は、複数のVLMを組み合わせて認識精度を向上させることができるかどうかを検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:44:31 GMT)
MediSkill-Evo: Process-Constrained Self-Evolution for Evidence-Grounded Clinical Interaction [8.0] バックボーンを微調整することなくプロセス知識を自己進化させるメディスキル・エボを紹介する。
Qwen FullChainでは、メディスキル・エボは診断精度を7.81%改善し、最も優れた先行剤よりも70.67%向上した。
マルチモーダルNEJM診断において、オプションのMedSkill-Evoは診断精度を2.56%、コアスコアを18.96%向上させる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:41:01 GMT)
A Durable Vision-Based Tactile Fingertip for Robotic Manipulation [7.9] 現在利用可能な視覚ベースの触覚センサーは、豊富な接触情報を提供するが、摩耗や繰り返しロードに弱いままである。
軟質シリコーンゲルと、無孔質でテクスチャ化され、薄型熱可塑性ポリウレタン保護膜と、交換可能な感光カートリッジとからなる耐久性のある触覚指先を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:45:32 GMT)
When "Must" Becomes "Maybe": Constraint Weakening in LLM Agent Workflows [7.8] 大規模言語モデル(LLM)は、マルチロールとマルチステージで複雑なタスクを協調する。
行動制限状態においては、トピックの保持が不十分である。
我々は、この行動結合の役割を運用状態の保存として研究する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:51:52 GMT)
Diverse by Reasoning: Harnessing the Wisdom of LLM Crowds for Future Prediction [7.7] 大規模言語モデル (LLMs) は将来の予測にますます使われており、複数のモデルの知恵のメカニズムとしての利用を動機付けている。
多様なLLM群集を構築するための行動認識フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:46:28 GMT)
Human-Inspired Social Engagement Analysis via Interpretable Mutual Visual Attention [7.7] 本稿では,相互視覚の心理的理論に着想を得た社会的エンゲージメントの解釈可能な計算モデルを提案する。
本フレームワークは,視覚的注意を明示的にモデル化し,これらの手がかりを個人と集団の関与の解釈可能な尺度に集約する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:05:35 GMT)
Cost-Utility Alignment in LLM Agent Trajectories:Profiling,Attribution,Diagnosis,Adaptation,and Evaluation [7.7] LLMエージェントは、トークン、レイテンシ、金銭的手数料、環境リスクにコストを蓄積する多段階のトラジェクトリを通じてタスクを実行する。
我々は,資源消費とタスクコントリビューションを同一実行上の二重台帳として扱うトラジェクトリ中心のコストユーティリティアライメントフレームワークを開発した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:31:00 GMT)
Certified Randomness without Structure Against Shallow-Query Adversaries [7.7] 山川とZhandryは量子ランダムオラクルモデル(QROM)における量子性の証明を構築した
我々は、未証明のアーロンソン・アンバイニス予想を頼らずに、無条件で山川・山東の証明可能なランダム性プロトコルの安全性を証明した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:15:01 GMT)
Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows [7.4] 大規模言語モデル(LLM)は、財務開示を処理するためのAIアナリストとして、ますます多くデプロイされている。
長文財務分析における検索積分ギャップを同定する。
リスク開示が投資判断に与える影響は、実験的なノイズフロアに該当することがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:31:25 GMT)
Lowering the Barrier to AI-Driven Inspection: A No-Code Workflow for Automated Structural Defect Detection [7.4] 本稿では, オープンソースGUIベースの YOLOEZ モデルアプリケーションについて紹介する。
YOLOEZはデータラベリング、トレーニング、推論を単一のインターフェースに統合し、コードなしで高性能なモデル開発を可能にする。
YOLOEZは、精度とアクセシビリティを組み合わせることで、予測保守、デジタルツイン、インテリジェントな構造システムのためのAI駆動監視をより広く活用する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:46:03 GMT)
Improved Analysis for Hessian-free High-resolution Monte Carlo Sampling [7.3] Hessian-free High- resolution (HFHR) dynamics augments underdamped Langevin dynamics (ULD)
我々は,ポアンカレの不等式の下で,HFHR力学に対する明示的な定量的収縮速度を確立する。
時間拡張されたポアンカレの不等式は、ランゲヴィン力学の収縮率を改善する明示的な速度をもたらす。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:42:23 GMT)
Where Entropy Is Measured Matters: Policy Geometry in Bounded Continuous-Control PPO [7.3] エントロピーが測定される場所は,政策最適化によって学習された政策形状を変化させることを示す。
独立なCleanRLベースのPPO実装による38次元ドッグスタンダードレプリケーションは、平均幾何学における順序付けを再現する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:36:09 GMT)
Towards LLM-Enhanced Android Taint Analysis [7.3] 既成のLarge Language Modelsが,Androidアプリにおいて,テナントフローを効果的に推論できるかどうかを検討する。
我々のアプローチはエージェントインタラクション戦略に依存しており、LCMが反復的にコードを探索し、データフローを推論することができる。
予備的な知見は、LSM推論が従来の静的なテイント分析を効果的に補完する可能性があることを示唆している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:57:13 GMT)
Linear Probing Provides Robust and Efficient Detection of Machine-Generated Text [7.2] 我々はMGT表現の線形性と品質を分析し、単純な線形プローブが幅広い検出器より優れていることを示す。
プローブは多種多様な設定にまたがって一般化する共有遅延MGT方向を復元する。
全体として、我々の研究はMGTとHWTの潜時空間差に関する洞察を提供し、線形プローブが頑健で試料効率の良いMGT検出器としての可能性を示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:21:24 GMT)
The Changing Geometry of Grammar: Dimensionality and Neighborhood Reorganization across Transformer Layers [7.0] トークンの文法的役割が、その部分音声(PoS)タグに特徴付けられるように、この多様体の局所幾何学を形作るかどうかを問う。
幾何学的特徴だけでトークンの文法的役割を回復し,各PoSのセマンティック内容が下流分類タスクにおいて層間でどのように進化するかを解釈する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:27:21 GMT)
$(\text{DNN})^2$: Doubly Non-Negative Relaxations for Deep Neural Networks [6.8] そこで本研究では,有効証明のための非特異乗算器空間を探索する新しい固有値対応手法を提案する。
実験により,本手法は標準SDP法よりも一貫した境界を生成することが示された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:48:32 GMT)
Evaluating Language Models on Cross-Language Code Functional Equivalence [6.8] CPP、Java、Pythonで書かれたプログラムのデータセットであるPolyHumanを紹介します。
本データセットを用いて,オープンウェイトおよびプロプライエタリLLM間の言語内および言語間同値検出を評価する。
モデルが関数同値性を誤って判断する系統的不一致の81例を分析した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:41:00 GMT)
Rare Diseases, Common Dilemmas: LLMs Prioritize Equal Resource Distribution over Patient Benefit in Decision-Making [6.7] 臨床的意思決定は、しばしば患者の自律性や正義を尊重する、善意、非正当性などの倫理的価値の優先順位付けを伴う。
最近の研究は、大規模言語モデル(LLM)がそのような主観的で価値の高い臨床判断をいかに行うかを評価し始めている。
本報告では,208種類の臨床症状を呈し,それぞれが真に高いコンフリクトを呈する稀な疾患ヴィニグレットについて検討した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:54:22 GMT)
CARO: Contact-Agnostic Residual Observation for Zero-Shot Robust Quadruped Locomotion [6.6] CAROは、政策適応のための接触に依存しない残留観測フレームワークである。
固定ベースオイラー-ラグランジュモデルを強化学習制御ループに組み込み、トルクレベルの残留観測を構築する。
外乱オブザーバは、動的ミスマッチを表す構造化信号を抽出し、ポリシーは、このフィードバックをオンライン適応に活用することを学ぶ。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:23:24 GMT)
Beyond Semantic Accuracy: Consequence-Aware Evaluation for Safety-Critical Language Understanding [6.6] 操縦士と操縦士の通信がほぼゼロに近いエラー耐性を必要とする航空交通管制の問題点について検討する。
結果認識評価を用いて,セマンティックスコアが動作の信頼性を損なうかどうかを判定する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:39:02 GMT)
Toward a Semiparametric Efficiency Theory under Equality Constraints in Nested Markov Models [6.5] 遅延変数を持つ有向非巡回グラフ(DAG)の確率モデルは、観測されたデータ分布に等式制約を課す。
We developed results to establish a semiparametric framework for statistics model defined by Verma constraints。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:23:40 GMT)
Apodex 1.1: Scaling Agentic Intelligence for Complex Work [6.4] 私たちはこれを、現実の目標に向けて持続的で検証可能な進歩(containmented, verible progress)と呼んでいます。
アポデックス 1.1は、多くのフロンティアシステムよりもかなり小さなモデルを使っているにもかかわらず、主要なパフォーマンスバンドに到達した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:06:44 GMT)
Expectation, Backlash, Recovery, and Excitement: How Model Releases Shape Reddit Perceptions of Conversational AI Systems [6.4] 我々は、Redditの議論の長期的かつ大規模な分析を行い、ユーザーがプロバイダ間のモデルリリースの介入をどのように感じているかを調べる。
感情分類とテーマ概念分析を組み合わせることで,CAISの知覚が動的かつ介入に敏感であることを示す。
これらの結果から,モデルリリースは単なる技術的更新ではなく,感情や期待,公開議論を形作るユーザ対応の介入であることがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:00:44 GMT)
DeMMO: Longitudinal and Cross-Disease Modelling of Digital Mobility Outcomes via Multi-Task Learning [6.3] 縦長・多相・マルチアウトカム学習のためのフレームワークであるDeMMOを提案する。
DeMMOは、縦方向のDMO係数行列により、各疾患のアウトカム目標を表す。
我々は、最近リリースされた大規模マルチ中心モビライズ-Dデータセット上でDeMMOを評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:07:32 GMT)
SeisMamba: Low-Latency Single-Station Seismic Magnitude Estimation for Spatially Distributed Earthquake Early Warning [6.3] シングルステーション学習は低コストの代替手段を提供するが、既存のモデルは、しばしば精度-遅延トレードオフに直面し、地域分布シフトによって劣化する可能性がある。
本稿では, 単一局で記録された最小処理3成分地震波形から, 低遅延等級推定のための軽量マンバアーキテクチャであるSeesMambaについて述べる。
STEADベンチマークでは、SeisMambaはテストベースラインの中で最高のMSE、RMSE、R2$を達成し、NVIDIA T4 GPU上の32の波形のバッチに対してわずか0.55msしか必要としない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:44:42 GMT)
Auto-Policy, not Auto-Skill: Compiled Agent Skills for the Physical World [6.2] 自己進化型スキルハーネスは、自動的によりアドバイザリなオーケストレーションを生成する。
スキルはエージェントがどのように振る舞うかを記述し、ポリシーはどの動作がアクションになるかを決定します。
ツール間ではなく、Skillアーティファクト内に存在する型付き権威層であるEdge Skillguardを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:40:50 GMT)
SPO++: Stream-Aligned Policy Optimization for Asynchronous Agentic RL [6.2] グループ相対強化学習は、同じプロンプトの兄弟ロールアウトを待つ。
トラジェクトリセンタリングは一般的に,アクターが消費するトークン重み付け量を中心にしないことを示す。
また、学習者の受取命令ではなく、それを生成する政策イベントによって、プロンプトエビデンスを整理する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:52:19 GMT)
A Unified Framework for Operator Backpropagation and Observable Measurement in Quantum Computing [6.1] オペレーターバックプロパゲーションは、サーキットを通して観測可能なものを古典的にバックプロパゲーションすることで回路深度を下げる方法として提案されている。
誤差はバックプロパゲーション手順と測定中に発生し、最終的な計算に蓄積される。
所望の精度を実現するための適切な測定プロトコルを決定するための包括的フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:32:00 GMT)
CARE: Camera-Residual Reserves for First Sightings in Adaptive LiDAR Sensing [6.1] 既存のLiDARスキャンポリシーは過去のトラックに依存しているため、未確認のオブジェクトは遅く検出されるか見逃される。
本稿では,CARE(CAmera-Residual Reserve)について紹介する。これは,トラック予測では説明できない電流検出方向の固定線予算の一部を予約する,トレーニング不要なアロケーションルールである。
CAREは歴史政策の10%、20%、および35%の予算で5.2、5.2、および4.3ポイント、対の間隔をゼロに設定している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:06:23 GMT)
Automatic Model Card Generation Using an LLM [6.1] モデルカードは、機械学習モデルに関する重要な情報を要約した構造化文書である。
多くのモデルはモデルカードを提供しておらず、比較と解釈が難しい。
既存のモデルカードを標準化テンプレートに再構成する LLM ベースのアプローチである MCTidy を提案する。
モデルリポジトリデータから直接モデルカードを生成するLCMベースのシステムであるMCGenieについても紹介する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:49:37 GMT)
What FID Hides: Detecting, Ranking, and Diagnosing Deviations in Generative Evaluation [6.1] 生成モデルは通常、Fréchet Inception Distance(FID)とKernel Inception Distance(KID)によってランク付けされる。
ZIDは幅広い出発点を検出し、そのスコアは対応するスイープに沿って深刻度を増す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:58:46 GMT)
VideoHarness-RSI: Recursive Harness Self-Improvement for Long-Video Understanding with Frozen Vision-Language Models [6.1] 長いビデオの理解は、より長いビデオから限られたモデルコンテキストを構築する方法に依存する。
既存のアプローチでは、圧縮、検索、メモリ、エージェントエビデンス獲得によってこのプロセスを改善している。
実行可能なコンテクスト構築プログラムを単独で改善することで、どれだけの利益を得ることができるかを検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:27:47 GMT)
Anatomy of a Scam Call: What 10,000 real scam and spam calls reveal about how phone scammers operate [6.0] 我々は10,211件のインバウンド詐欺とスパム通話の完全コーパスを分析した。
我々は、捕食的だが合法的なリード生成の大きな流れから、機密情報を誘惑するアウトライト詐欺を分離する。
営業時間(週末日より平日あたり6.6倍)
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:41:12 GMT)
NeurRAFT: Robot Motion Planning via Anchor-Level Flow Matching with Clearance-Aware Preference Tuning [6.0] 我々は,アンカーレベルのフローマッチングとクリアランスを考慮した選好チューニングに基づく生成計画フレームワークNeurRAFTを提案する。
実験は最先端のプランナーよりも大幅に改善され、実世界の実験ではフランカロボットへのゼロショット転送が実証された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:31:24 GMT)
Equivariant Covariance Tensors: Guaranteed SPD Uncertainty for Tensor-Valued Geometric Learning [5.8] 対象が6つのケルビン-マンデル座標を持ち、完全不確実性は6Times6$共分散行列で表される対称ランク2テンソル予測に焦点を当てる。
平均と共分散の両方が回転対称性を保った完全な予測分布をモデル化し、E(3)-同変UQの枠組みを導入する。
提案手法は, 競合性能を達成し, 有効リスクとOOD感度を有する物理的に一貫した対称性を保った不確実性推定値を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:46:47 GMT)
Fiber Optic Sensing Glove for High Performance Dexterous Manipulation Capture [5.7] フルハンドポーズトラッキングのための光ファイバーセンシンググローブを提案する。
新規パイプラインは、再構成された各ファイバ形状を共通ハンド参照フレームに登録する。
新しい逆運動論的解法は60Hzでフルハンドポーズを再構築する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:59:35 GMT)
Lifted Model Construction under Approximate Commutativity [5.6] 本稿では, 昇降モデル構築, 下流確率推定, および誘導近似誤差の厳密な境界を証明するために, 可換性をどのように活用するかを示す。
これらの理論的保証は実証的に確認され、低いランタイムで同等のクエリ精度を示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:32:47 GMT)
PhysicsBench: A Unified Leaderboard for Generative and Predictive Models in Engineering Design and Simulation [5.6] PhysicsBenchは、生成モデルと予測モデルのためのベンチマークとリーダーボードである。
評価は、SからXLまでの、現実的で限られたデータスケールにまたがる。
トップモデルは、7つのタスクのうち6つのタスクでデータスケールで変更され、モデルが1つ以上のタスクをリードすることはない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:32:18 GMT)
$\texttt{findr}$: Transparent and Fair Credit Risk Decisions through Semi-Structured Regressions [5.6] $texttfindr$はバイナリクレジットリスクモデリングのための半構造化フレームワークである。
これはロジットを解釈可能な構造成分と神経残基に分解する。
これは、ロジット変動、決定合意、および局所的な方向整合性に対する構造化されたコンポーネントの貢献を測定する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:08:07 GMT)
SNAP-KG: Streaming Node Assignment via Projection for Knowledge Graph Entity Integration [5.6] SNAP-KGは、グラフ構造的マルチビューリレーショナルクラスタリングとストリーミングエンティティのインダクティブ推論をサポートするフレームワークである。
プロジェクタに、新しいエンティティを直接学習した埋め込み空間にマッピングするように訓練する。
5つのベンチマークデータセットで62-75%の候補検索を削減し、エンティティの解像度とリンク予測のためにOGB-WikiKG2で97%を達成している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:56:01 GMT)
ALPHABET: A Laplace-Pole History Aggregator with Banked Exponential Transport [5.5] 本稿では、時間履歴を安定な複素極モードに圧縮するコンパクト線形時間モデルALPHABETを紹介する。
固定82タスクレジストリ全体で、ALPHABETは10家族比較の平均ランク3.97に達した。
共通幅のD=64アンカーでは、6,437のパラメータは平均で5.02倍の推論と3.93倍の完全なトレーニングステップを提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:20:19 GMT)
SteerCheck: Attribution Specificity and Alignment Leakage in Activation-Steering Audits [5.4] 活性化ステアリングは、その効果が意図された概念に固有のものであることを証明せずに行動を変えることができる。
我々は、ターゲット外のKLにマッチし、平均、保護されたテール、極性、転送、セマンティッククレームを分離する、事前登録された属性監査であるSteerCheckを紹介する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:00:29 GMT)
Beyond Uniform Local Isometry and Topology: FactoMap for Disentangled Representations [5.4] 本稿では,因子領域,ジェネレータによる同定,位置依存尺度を組み合わせた因子空間構造を提案する。
統計的に独立な因子は幾何学的に分離できないことを示す。
本稿では,因子空間の格子でインデックス付けされた解釈可能なプロトタイプを学習する因子空間地形図(FactoMap)を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:59:59 GMT)
Real-time decoder for a MegaQuOp quantum computer using a single CPU [5.3] 本稿では,フォールトトレラントな量子コンピュータアーキテクチャのためのエンド・ツー・エンドのリアルタイムデコードスタックを示す。
我々は、408個の論理量子ビット、最大100万ドルのゲートにまたがる実用的な量子アプリケーションについてデコーダをベンチマークする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:15:58 GMT)
CoDrift: Compositional Drifting for Offline Reinforcement Learning [5.3] CoDriftは、一段階の生成ポリシー学習のための構成フレームワークである。
我々は,OGBenchとD4RLの73タスクに対するCoDriftの評価を行った。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:54:59 GMT)
Sequential operator learning under dependent data [5.2] 逐次収集データからの学習演算子は適応的な実験設計、ベイズ最適化、動的システムモデリングに現れる。
ベクトル値雑音を持つヒルベルト空間の過程に対する時間一様自己正規化濃度境界を導出する。
我々の結果は、独立性や仮定の混合なしに無限次元の入力と出力が可能である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:42:09 GMT)
Common-Center Geometry and Certified Radial Reconstruction for Energy-Form Full Conformal Regions [5.2] この注記は、経験的エネルギー形対のスコアによって生成されるフル共形予測(FullCP)領域の幾何学について研究する。
結果として生じる再構成の観点は、高次元の改善ではなく、低次元の出力を意図している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:38:04 GMT)
Physics-Informed Error Field Learning: A Post-Training Optimization Framework for Physics-Informed Neural Networks [5.1] 本稿では,PINNのための物理インフォームド・エラー場学習フレームワークを提案する。
物理制約下での誤差制御方程式の導出により、PIEFLは現在の近似と正確な解との相違を学習する。
代表的PDEに関する数値実験により、PIEFLは同じ計算予算下で解の精度が向上することを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:34:46 GMT)
Extending Ground-Constraint LiDAR-IMU Calibration to Tilted Surfaces in a Continuous-Time Framework [5.1] 本稿では,地中車両の目標のないLiDAR-IMUキャリブレーションを非平坦環境に拡張する手法を提案する。
通常、センサー・リグの完全な排他的操作を必要とするが、これは通常の運転では地上車両が満たさない要件である。
退化した平面運動に対処するために、最先端の手法は重力と物理的表面の正規ベクトルの線型性を仮定する残差を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:35:18 GMT)
Automating Parent Selection Configuration in Genetic Programming with Agentic AI [5.1] エージェント人工知能が遺伝的プログラミングシステムの設計プロセスの一部を自動化できるかを検討する。
本稿では,大規模言語モデル(LLM)推論と検索拡張生成を用いて,親選択アルゴリズムの識別と実装を行うエージェントフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:52:39 GMT)
ARGUS: Theory-of-Mind Guided Argument Generation with Strategy-Aware Planning and Knowledge Grounding [5.1] 本稿では,古典的レトリックを操作可能なエージェントベースのフレームワークであるArgusを提案する。
理論・オブ・ミンド(ToM: Theory-of-Mind)は、視聴者の信念と価値観を明確に二重の精神モデルを構築し、下流の意思決定を導く。
自動ペアワイズEloとLCM-as-judgeのメトリクスを用いて,Argusを3つの多様なベンチマークで評価した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:52:56 GMT)
A Theory of Finite-Noise Optima and Generalization in Quantum Machine Learning [5.1] 量子ノイズは、回路をノイズレスの実装から遠ざけることで量子機械学習を劣化させると予想されている。
しかし最近の研究では、中程度の雑音は試験誤差を減少させ、弱い雑音の摂動誤差の蓄積や強い雑音の訓練可能性の崩壊によって説明できない振る舞いが示されている。
そこで我々は,微視的ノイズ過程とマクロ的学習性能を結合する統計的学習理論を開発した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:32:46 GMT)
SimVerity: When Does Simulated Agent Success Survive Physical Deployment? [5.1] 検証-転送保証フレームワークであるSimVerityを提案する。
ターゲットとするスマートホームデプロイメントのシナリオをリプレイする。
それは、独立して資格のある身体的目撃者に対して、エージェントの実行を横切り検証する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:00:49 GMT)
Single State Update Predictive Coding training for Time Series Forecasting and Anomaly Detection [5.0] Predictive Coding(PC)は、並列化可能なニューラルネットワークレイヤのアップデートを可能にする、ニューラルネットワークのパラダイムである。
本稿では,生成型PCNとサポート型PCNを組み合わせたトレーニング手法を提案する。
2つのPCNは、連続的な伝播なしに、彼らの神経活動と一致するように並列に訓練されている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:21:23 GMT)
ROBE: Reversed-Order-Biased-Experts for Extracting Extreme Long-tail Events from Historical Texts [5.0] 本稿では、17世紀から18世紀にかけてのオランダの歴史的コーパスから50種類以上のイベントを抽出する方法を提案する。
提案手法は, 長い尾の長い尾の抽出という, 不可能な課題に対処することを目的としている。
19世紀以前の歴史データは、それ自体が大規模言語モデルの事前訓練に含まれていないニッチな領域である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:56:21 GMT)
Validation of HRV Studio: A Transparent and Quality-Control-Aware Platform for Heart Rate Variability Analysis [4.9] オープンソースのPyQt6ベースのデスクトップアプリケーションは、透過的HRV分析と自動品質制御(QC)診断を統合している。
10分間の分析では、コンベンションに敏感なスペクトル出力に対して、より低い不一致で全体のパターンを再現した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:45:05 GMT)
Apples to Apples? Towards Comparable Crosslingual Language Model Evaluation [4.7] 並列データに基づいて訓練された制御単言語言語モデルを用いて言語間評価手法を検討する。
この結果から, トークン化, エンコーディング, 正書法の違いに根ざした多言語的バイアスが広く用いられている。
対照的に、意味論的に等価なシーケンスで計算された文レベルの負の対数類似性は、より有意義で一貫した言語間比較を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:36:15 GMT)
Example-based Robust Abnormality Detection with Minimal Annotations using Exemplar Med-DETR [4.6] 我々は,チェストX線(CXR)画像の異常検出を最小限の監督下で効率的に行うために,スケーラブルなFS検出手法を提案する。
本手法は、アノテーション付きデータの10%未満を用いて、最先端(SOTA)検出性能を実現する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:06:23 GMT)
LibriBrain100: One Hundred Hours of Broad and Deep MEG Data for Neural Speech Decoding at Scale [4.5] 音声復号のための大規模MEGデータセットであるLibriBrain100を紹介する。
LibriBrain100は、1つの被験者から80ドル(約8,800円)の費用で、ディープ・イン・オブジェクト・ニューラルデータのための新しい記録を樹立した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:45:04 GMT)
SIREN-Bench: Behavior-Driven Generation and Evaluation of Emergency-Vehicle Interactions [4.5] 行動駆動型SUMO-CARLA共言語プラットフォームである textbfSIREN について述べる。
このプラットフォームをtextbfSIREN-v1 としてインスタンス化し,緊急レベル L1-L3 の7つのパラメータ化インタラクションテンプレートと3つの行動ファミリからなる。
本稿では,3次元物体検出,軌道予測,視覚言語によるリスク理解という3つの代表的な課題を通じてベンチマークを実証する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:41:34 GMT)
QisMC: A Model Checker for QISKIT Program Debugging [4.5] 本稿では,Qiskitプログラムのデバッグ専用の量子モデルチェッカーであるQisMCを紹介する。
理論的には、量子古典遷移系と量子計算ツリー論理の概念を導入する。
実装面では、QisMCはトランジッションシステム生成、論理式表現、モデルチェックアルゴリズムを含むエンドツーエンドのフレームワークを提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:47:13 GMT)
Mixed-State Symmetry-Protected Topology and Strong-to-Weak Spontaneous Symmetry Breaking in a Superconducting Qubit Array [4.5] 本研究では, 1次元クラスタ状態における対称性保護型位相秩序が, 測定とデコヒーレンスによってどのように変換されるかを実験的に検討した。
これらの実験は、条件付け、平均化、デコヒーレンスが、同じ基盤となるクラスタ状態にエンコードされた順序の明確な表出をいかに明らかにするかを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:00:01 GMT)
LLM-Guided Contextual Action Evaluation for Operational Decisions in Industrial Processes [4.5] 本稿では,産業プロセスにおける運用決定のためのLCMガイドによる文脈行動評価について述べる。
トレーニングの前に大きな言語モデルを使用して、固定されたドキュメントを凍結したアクション-観測-方向-遅延関係ベースに正規化する。
近年の数値的作用-応答履歴は各関係の電流強度を変調し、評価された作用は状態条件の非線形作用効果場を形成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:16:59 GMT)
A Dynamic-Kernel/QPacket Executable for Quantum Repeater Chains in Q2NS/ns-3 [4.4] 本稿では、層を越えたプロトコルスイートからDynamic Kernel/QPacketロジックの最初の実行可能な特殊化について述べる。
この実装は、ns-3 App Storeから利用可能なns-3ベースの量子ネットワークシミュレーションモジュールであるQ2NS上に構築されている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:14:08 GMT)
Training a Knowledge Base: Supervised Structure Learning for Agent-Curated Document Stores [4.4] Retrieval-augmentedジェネレーションは、ドキュメントストアをフリーズインプットとして扱い、その上にビルド構造を行うオフラインパイプラインは、教師なしで構築する。
我々は、知識ベースを(質問、回答)ペアに基づいて訓練された非パラメトリックモデルとして扱う。
キュレーターエージェントは、現在店舗に対して監督された質問に回答し、金の回答を示し、店舗を編集する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:20:32 GMT)
Causal Explanations of Process Monitor Predictions [4.3] 本稿では,プロセス監視予測の局所的(ケースレベルの)説明を生成するための新しい手法を提案する。
トレース内のイベント間の時間的依存関係をキャプチャするプロセスに適した因果モデルを定義する。
本稿では,プロセス構造が因果モデルに反映されていることを考慮し,事象の責任を近似する実用的なモデルに依存しないアルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:08:35 GMT)
Luce: Relightable Gaussians for 3D Asset Generation [4.3] 高忠実な画像から3D生成には、幾何学と外観の両方をキャプチャする3D表現が必要である。
本稿では,Voxelized multimodal Gaussian cloud 内で幾何学とPBRを統一した3次元表現である Luce を提案する。
Toys4Kでは、ルースは最先端の単一画像から3D生成を実現し、最強のベースラインよりもFIDを28%改善した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:03:55 GMT)
Padamitra: Grounded Glossary Generation for Classical Sanskrit [4.3] 我々は,意味論的意味を持つサンスクリット句を復元し,スロカ翻訳ペアから翻訳された意味を生成するために,モデルを必要とする構造的タスクであるグラウンドド・グローサリー生成を導入する。
我々はValmiki RamayanaとSrimad Bhagavatamから31,316個のSloka-translation-glossary trissのベンチマークを構築し,2つの指標を組み合わせた。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:27:28 GMT)
Rank and Range Criteria for Mixed-State Determination from Local Marginals [4.3] 混合量子状態がそのk体境界によって全ての状態の中で一意に決定されるかどうかを決定することは、量子システム認証の根本的な問題である。
我々は,グローバルな状態の範囲の構造を解析することにより,この問題に対する範囲ベースアプローチを開発する。
チャネルベースのマルチパーティイトファミリーでは、状態が$(n-1)$-UDAであるときに正確に特徴付け、下位のマージンが十分でないことを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:47:02 GMT)
How Much Regularization Survives Averaging? Update Masking in Federated Learning [4.1] 非IIDにおけるフェデレートラーニングは、クライアントをまたいで一般化するためにフラットなミニマを求めており、既存の手法は集中トレーニングからシャープネスを意識した最小化を取り入れている。
理由を示します。マスキングは鋭い方向に動くパラメータを課金します。
各クライアントが独自のマスクを描画すると、フェデレーション平均はコホートサイズによってその電荷を弱めます。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:41:44 GMT)
When Similarity Is Interaction-Driven: Quantum Kernels for Regime-Sensitive Learning [4.1] 詐欺や異常検出では、小さな局所摂動は相互作用に敏感な決定境界を横切ることができる。
パウリ弦特徴写像から構築したシンスラブ相互作用モデルと相互作用駆動量子カーネルを導入する。
得られた忠実度カーネルは正の半定値であり、正確なブロック分解されたカーネルを認め、相互作用状態の変化に敏感な幾何を誘導することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:45:40 GMT)
Lost in Speech: Trilingual Spoken Hallucination Detection Across Audio and Transcripts [4.0] 英語,ロシア語,カザフ語にまたがる12,013のニュースサンプルからなる,最初の多言語音声幻覚ベンチマークを示す。
合成コーパスをロシア語(225件)とカザフ語(65件)で収集した290件の偽ニュースを補完し、他の言語に翻訳し、同じTS-ASRパイプラインを通してレンダリングする。
我々は、微調整された多言語エンコーダと、ゼロショットのインコンテキスト設定において、書き起こしベースと直接オーディオ処理によるマルチモーダルデコーダモデルを評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:24:48 GMT)
Quantum Secure Time Transfer for Satellites [4.0] 我々は、地球低軌道衛星-地上通信路のエンタングルメントに基づく量子セキュア時間転送システム(QSTT)を実験的に実証した。
我々の新しいQSTTシステムは、セキュリティパラメータが10〜10ドルである約$3$bits$texts-1$の有限量子鍵分配(QKD)キーレートを提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:37:26 GMT)
Dataset Scarcity Limits Robust Evaluation of Multilingual Embedding Models: A Case Study of Slavic Languages [3.9] 本稿では,データセット不足下での多言語埋め込みベンチマーク解析のための2次元フレームワークを提案する。
このフレームワークは,3つの相補的な側面を共同で分析しながら,タスク固有の評価とタスク間の評価を区別する。
スラヴ語とタスクのペアの多くは、単一のデータセットや高い相関のベンチマークコレクションに依存しています。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:23:31 GMT)
Three-slit interference with a which-path memory ancilla: A bright-dark state formulation [3.9] 本研究は,1パスメモリアンシラが3スリット干渉パターンに及ぼす影響について検討する。
2つの経路に対して、$C_BD$は集団と1対のコヒーレンスによって完全に固定されることを示す。
また、メモリの適切な測定により回復可能な経路コヒーレンス損失の一部を区別する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:46:11 GMT)
Prompt Structure Redistributes, Not Reduces: An Empirical Analysis of Security-Weaknesses in LLM-Generated Python Code [3.9] GPT-4o と LLaMA 3.1-8B を 5 つの変種で生成する。
BanditとCodeQLで、ジェネレーションコンプライアンスとセキュリティの弱点の頻度、重大さ、CWEの2つの軸に沿って評価します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:43:47 GMT)
Compression Trinity: Exploring Sparsity, Quantization, and Low-Rank Approximations for LLM Compression [3.9] この論文は「圧縮トリニティ(Compression Trinity)」という3つの柱を共同で適用する統一的なフレームワークを提案し、インバージョン削減のための空間性、メモリ帯域幅の最小化のための量子化、精度回復のための低ランク近似を提案する。
その結果, 圧縮トリニティの併用は, 効率, 拡張性, 高性能化に不可欠であることが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:09:07 GMT)
More Rejective, Not More Discriminative: The Unit of Verification in Pre-Execution LLM Oversight [3.9] 事前実行監視は、AI制御における信頼できる監視のコアとなる。
既存の設計ではユニットが与えられており、フェールブルモニターに対する効果は計り知れない。
私たちのフレームワークは、この選択のために制御され、事前登録された最初の楽器であり、キャッチのみを読み取ることはありません。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:59:55 GMT)
Heat Transfer and Torque in Enclosing Cylindrical Configurations with Nonreciprocal Materials [3.9] 電磁ゆらぎは、非平衡状態における力、トルク、熱電流、摩擦につながる可能性がある。
2つの物体のうち少なくとも1つが回転対称であれば、トルクは熱伝達によって束縛される。
また, 近接力近似を用いて内筒の安定浮揚条件を解析した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:11:30 GMT)
Beauty is in the ELBO of the Beholder: A Variational Account of Processing Fluency in Face Perception [3.8] 我々は, 4つの顔データセット上で, 魅力を伴わない変分自動エンコーダを訓練し, シカゴ顔データベース上でそれらの表現を評価する。
人間の魅力度評価は,VAEエビデンス(ELBO)が規定する速度歪み空間の方向と密接に一致していることがわかった。
本研究は,美学の古典的記述と学習された生成モデルとを結びつけ,美学の処理理論の変分的解釈を実証的に支援する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:24:46 GMT)
PinSieve: Production Selective VLM Serving and a Governed Memory Flywheel for Enterprise Content-Quality Triage [3.8] 我々は、大規模コンテンツ品質パイプラインのプロダクションケーススタディであるPinSieveを紹介する。
配備されたコンポーネントは、選択視覚モデル(VLM)サービングエージェントであり、軽量上流モデルで未解決のグレーゾーンスライスのみで動作する。
このスライスでは、デプロイされたシステムでは、以前の生産モジュールよりも2.05倍の非動作可能なアイテムをフィルタリングすると同時に、推定ミス率をわずかに削減する。
昇進後、レビューの生産性を25.7%改善し、通常の運用コストを16.2%削減し、翌日から翌日に信号配信を移行した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:57:56 GMT)
The Setting of IMU Parameters in Kalman Filtering-based Information Fusion [3.8] 慣性測定ユニット(IMU)の動作条件は静止校正シナリオよりも複雑である。
IMUパラメータの効果的なチューニングは、主にシステムの経験や深い理解に依存します。
そこで本研究では,Allan分散キャリブレーションに基づくIMUパラメータの設定法を,Kalmanフィルタフレームワーク内で探索する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:58:13 GMT)
Keep-or-Drop? Adaptive Tokenizer for Compact Video Representation [3.8] 非形式的トークンを捨てる適応トークンセレクタを提案する。
実験により,本モデルが最先端圧縮比で強い復元と生成品質を実現することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:19:22 GMT)
PhysElite: How Far Are LLMs from Solving Olympiad-Level Physics Problems? [3.7] PhysEliteはオリンピアードレベルの物理推論のための大規模なバイリンガルベンチマークである。
各問題に対して、対応する視覚図、ステップバイステップのバイリンガルな中国語-英語の解の導出、そして最終回答を提供する。
我々は18個のオープンソースおよびクローズドソースMLLMをベンチマークし、最強モデルでさえ33.7%の正解精度しか得られないことを発見した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:48:42 GMT)
Comparative Assessment of Deep Learning Architectures for Underwater Subsurface Kelp Forest Segmentation with The Kelp-o-Tron [3.7] ResNet34-U-Net、ResNet50-DeepLabV3、ハイブリッドResNet50-ASPP-Transformerアーキテクチャをケルプ検出のために評価した。
独立したテストデータでは、ResNet50-DeepLabV3 が最も高い Dice (0.7120) と Intersection over Union (IoU; 0.6267) を獲得し、続いて ResNet34 U Net (Dice 0.6868; IoU 0.5978) を達成した。
ハイブリッドASPP変換器は高い画素精度(0.8528)を達成したが、Dice (0.6437) と IoU (0.5746) は低い。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:18:40 GMT)
SQLite is Enough. Lexical, Semantic, and Hybrid Search with scrydb [3.7] scrydbはPythonライブラリで、語彙、セマンティック、ハイブリッド検索を可能にする。
Scrydbを使うと、ユーザは検索結果をリランクしてヒューズして、語彙と意味の両方のアプローチを組み合わせられる。
我々は、様々なIRベンチマークデータセット上でcrydbを評価し、キーワードマッチング、セマンティック類似性、ランク融合に基づくテキスト検索の有効性を実証した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:42:54 GMT)
Less can be More: Relieving RAG Bottlenecks via Evidence Frontloading and Pressure-Adaptive Budgeting [3.7] 上流の再ランク付けは、高いクエリ率や大規模な再ランクの予算の下で支配的なボトルネックとなる可能性があることを示す。
予算の見直しは、このボトルネックを和らげる可能性があるが、支持する証拠を減らし、リコールを低下させる可能性がある。
本報告では,textitevidence Frontloading と textitpressure-adaptive budgeting を組み合わせたトレーニングフリーフレームワーク textbftextsfPACE を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:10:06 GMT)
Beyond Information Seeking: Severity-Aware Question Supervision for Proactive Medical Dialogue [3.6] 本稿では,重大度を意識した端末リスクの低減によって各候補を評価可能な,結果認識型質問紙(ESR)を提案する。
一致したESRの監督は、平均的な高重度診断ミスを.0645から.0455(-29.5%)に減らし、平均診断精度を.9123から.9320に改善し、対話毎に0.14の質問しか必要としないことを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:09:45 GMT)
SeriCrypt: An LLM-Driven Context-Aware Serialization Framework for Cryptographic Protocols [3.6] SeriCrypt(セリクリプ)は、暗号プロトコルのためのLLM駆動のコンテキスト対応シリアライズフレームワークである。
これは、非構造化プロトコル仕様からフィールド制約、状態依存、および暗号計算ルールを抽出するために、大きな言語モデルを使用する。
プロトコルに依存しない実行エンジンは、CDSL宣言を解析し、フィールド値解決の自動化、暗号プリミティブ呼び出し、ストリームシリアライゼーションを行う。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:46:34 GMT)
Rethinking the Transferable Adversarial Attacks and Robust Defense in Federated Learning [3.6] 本稿では,異なるクライアントモデル間の逆例の転送可能性について検討する。
本研究では, モデルロバスト性の伝達性から生じる防御機構を設計する。
提案手法は, 様々な環境下での実生活データセットを用いて, 敵攻撃・防御手法の評価を行う。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:30:57 GMT)
StabQ: Quantum Program Analysis via Weighted Stabilizer Representations [3.6] 安定化器表現に基づく量子プログラム解析のためのシンボリックな実行フレームワークであるStabQを提案する。
StabQは、シンボリックステート表現を導入することで、Cliffordのみのプログラムを超えて安定化器ベースのシンボリック実行を拡張している。
本稿では,3つのベンチマークスイート(Algorithms,MQT Bench,QASMBench)上でStabQを評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:08:25 GMT)
GenCoord: Skill-Path Commitments under Private Information [3.5] GenCoordを紹介します。これは、そのようなプライベートな事実のタスクの結果を、実行可能なスキルパスのコミットメントに変換するものです。
ローカルQwen3.5-0.8Bモデルは、複数ステップのSELFプランとピアREQを出力する。
3つの独立して訓練された種子の中で、正しい能力フィードバックは、ペア化された局所情報ギャップを50%から100%に閉じる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:29:18 GMT)
Do Recipes Have Personas? Characterizing and Generating Creator Style in Attributed Procedural Graphs [3.5] 本稿では、一般的な料理ビデオの書き起こしから抽出した手続き的に整列された実行フローグラフのデータセットであるViralRecipesTransを紹介する。
手続き型スタイメトリーをグラフ学習およびプロセス発見タスクとして定式化し、基本的な双対性を明らかにする。
私たちはフレームワークを新しい生成タスクに拡張し、見知らぬ料理のためのクリエーターの正確な構造的実行グラフを予測します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:28:06 GMT)
Controllable blind deblurring with diffusion models [3.5] SuperSharpenは、ぼやけた測定によって復元強度を明示的に制御する拡散型ブラインドデブロアリング法である。
合成および実世界のぼかしに対する我々のアプローチを検証し、知覚的品質と制御可能な復元強度の向上を実証した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:37:08 GMT)
Defending Network Intrusion Detection Systems Based on Graph Neural Networks Against Structural Adversarial Attacks [3.4] グラフニューラルネットワーク(GNN)は、機械学習(ML)ベースのネットワーク侵入検知システム(NIDS)のための有望なソリューションである
GNNは、エッジを注入したりノードを挿入することで、攻撃者が基盤となるネットワークグラフトポロジを乱す構造的敵攻撃に対して脆弱なままである。
本稿では,GNN ベースの NIDS を構造攻撃に対して強化するための対人訓練に基づく防御フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:06:12 GMT)
CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents [3.3] ロングホライゾンGUIエージェントは、完全なアクション履歴をコンパクトテキストとして保持できるが、アクティブコンテキストに適合する歴史的なスクリーンショットはわずかである。
すべてのイベントは要約され続け、固定予算のB$は、どのイベントがアーカイブされたスクリーンショットを復元するかを決定する。
CaulCacheは、予測されたユーティリティが最近のイベントの履歴を超える場合にのみ、古いイベントの完全な履歴をスコアし、スワップする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:24:36 GMT)
Mutation Testing of Simulink Cyber-Physical System Models: Challenges and Solutions in Practice [3.3] サイバー物理システムの文脈では、左のシフトは、設計中のシステムの有効性をシミュレート、プロトタイプ、分析するために使用されるデザインモデルをテストする必要があることを意味している。
本稿では,建物用換気システムを開発するDUCOの文脈において,変異検査を取り入れた際の課題と教訓を分析した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:48:37 GMT)
Authenticated Data Structures for Dynamic Workloads [3.2] Huffman-Merkle Tree (HMT)は、動的ワークロードのための認証データ構造である。
HMTは2つの相補的なメカニズムを通してアクセススキューを動的に変化させる。
我々はHMTを実装し、実際のデータと比較し、MerkleのPatricia Trie (MPT) ADSとその代替案であるUnified Binary Tree (UBT)と比較する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:46:46 GMT)
A mesh-free multiresolution deep energy method with phase-field modeling of brittle fracture [3.2] 脆性破壊の位相場モデリングはき裂を明示的に追跡する必要をなくす。
本稿では,1つのニューラルネットワークが変位場と位相場を表すメッシュフリーな離散化を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:36:14 GMT)
BGPay: An Incentive-Compatible Mechanism for BGP Hijack Filtering [3.1] マーケットベースの代替案として、プレフィックス所有者は、そのプレフィックスの不正な告知をフィルタリングする定額懸賞を掲示する。
この洞察に基づいてBGPayを設計します。これはescrowプロトコルで、フィルタとモニタがいずれかが明らかにする前にコミットします。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:21:17 GMT)
StrokeGuard: A Multi-Agent Guided System for Prehospital Stroke Assessment [3.0] 臨床実践では、FASTベースの尺度が脳卒中前脳卒中評価に広く用いられている。
非臨床ユーザーは、不正確な記述、不完全な症状観察、困難な手術手順などの課題に遭遇することが多い。
本稿では,脳卒中前脳卒中診断のためのマルチエージェントガイドシステムであるStrokeGuardについて述べる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:39:30 GMT)
Efficient, precise DFT calculations of NMR shieldings: Revisiting the finite field approach [3.0] RI加速有限磁場計算はDFTレベルのNMR遮蔽定数を極めて正確に得ることを示す。
その結果、RI加速有限磁場計算はDFTレベルのNMR遮蔽定数を極めて正確に得ることを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:01:01 GMT)
LumiXAI: A Modular Full-Stack Framework for Feature Attribution [3.0] 本稿では、帰属分析を単一のシステムに統合するモジュラーフルスタックフレームワークであるLumiXAIを紹介する。
それは、双方向探索をサポートする対話型GUI、新しいモデルとメソッドを登録するためのプラグインアーキテクチャ、非プログラマ、開発者、拡張層を1つのバックエンドから提供する3つのアクセス層と、分類と生成の属性を結合している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:11:14 GMT)
Solving Robust POMDPs with Omega-regular Objectives via Partially Observable Stochastic Games [3.0] ロバストPOMDP(RPOMDP)は、古典的なPOMDPを、正確な遷移確率が分かっていないような設定に一般化する。
ポリトピック不確実性集合を持つ(s,a)矩形 RPOMDP に対し、オメガ正則目的の下での RPOMDP の解法は、オメガ正則目的下での部分可観測ゲーム (POSG) の解法に還元可能であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:30:40 GMT)
From Numerical Simulators of PDEs to Neural Emulators and Back [3.0] この論文は、ニューラルアーキテクチャが古典的な離散化を反映し、それらの誤差は同じスペクトル分析が可能であり、洞察は両方の方向に利益を上げられると論じている。
モードワイドフーリエ分析は、ソルバエラー、アーキテクチャ上の帰納バイアス、トレーニング目的を同時に読み取ることができる共通の言語を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:34:15 GMT)
Multimodal Injury Risk Prediction in Tennis [2.8] テニス選手のパフォーマンスと怪我のリスクを評価するため,テニス選手のための多モーダル・プレセット・レディネス・フレームワーク(PART)を提案する。
Partは、生理的指標、トレーニングとマッチデータ、ウェアラブルデバイスからの睡眠データ、毎日のアンケートによる自己報告情報、ジャンプアセスメント、マッチプレイビデオからのモーション分析など、9人の大学テニス選手から収集された複数のデータソースを処理する。
全体ウェルネスと傷害リスクの両方を予測し、特定の身体領域の高度な予測を危険にさらす。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:21:05 GMT)
Representation Is Not Enough: Body-Localized Thermal Evidence for Contactless Stress and Craving Sensing in Opioid Use Disorder [2.7] FABLE-Thermは最終決定まで、身体領域、時間、エンコーダ固有の表現にまたがる局所的な証拠を保存する。
オピオイド・ユース障害(OUD)ではストレスが大きな再発の引き金となり,早期回復には持続的なウェアラブルの使用が困難である。
固定熱ビデオを用いて、FABLE-Thermはホールドアウト参加者に対して0.938 AUROCを達成し、その学習された表現は自己報告のクレービングに転送される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:18:56 GMT)
RoG-DAgger: Rollout-Guided Post-Training for End-to-End Driving [2.7] RoG-DAggerは、短期間のロールアウトを使用して、安全クリティカルな州で専門家によるデモンストレーションを構築する、ポストトレーニングフレームワークである。
エンド・ツー・エンドモデルのSimLingoを5.3のドライブスコアポイントと6.2%の成功率で改善する。
また、Longest6 v2では22から44に、Fail2Driveでは55%から66%に改善されている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:11:44 GMT)
Strictly Causal Streaming Video Anomaly Detection with a Theoretically-Grounded State-Space Core [2.6] ルックアヘッドもクリップバッファリングも不要な因果ストリーミング異常検出器を導入する。
その時空コアは、入力と状態依存の崩壊ゲートを持つ対角線状状態空間の再発である。
繰り返し減衰スペクトルと検出遅延と、確実に捕捉できる最も短い異常との間に閉じた形状関係を導出する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:52:32 GMT)
Causal Analysis for Time Series Foundation Models [2.6] 時系列基礎モデルのバイアスと障害モードを,デプロイ前にどのように特定するかを検討する。
我々はChronos-2とTimesFM-2.5に因果解析フレームワークを適用し、6つの異なる時系列パターンでそれらをテストした。
また、両モデルとも持続性を過大評価する傾向を示し、両モデルがレシエーションスイッチパターンに対して突然失敗し、TimesFM-2.5がエネルギー放出パターンに対して失敗する傾向を示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:30:47 GMT)
Mixed-Precision SEM-Based CFD Simulations on GPUs: A Taylor-Green Vortex case [2.6] スペクトル要素法(SEM)に基づくマトリックスフリーCFDソルバNekoを用いたTaylor-Green vortexケースについて検討した。
プロファイリングは流体時間のステップがクリロフ収束のみに支配されないことを示している。
本稿では,3階層型混合精度制御モデルを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:06:48 GMT)
Longitudinal Robot Learning from Demonstration with Care Providers in a Home Environment [2.6] 実演を通してロボットを教える際には,実演ロボットの専門家のフィードバックを伴わずに,エキスパートでないエンドユーザの鍵となる障壁を特定する。
我々は,事前学習と適応フィードバックという,事前作業で開発された2種類の実証的ガイダンスを通じて,非専門家のエンドユーザを支援する。
本稿では,家庭環境への複数回の訪問を通じてロボット支援タスクを指導する介護提供者のLfDデータセットをオープンソース化することを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:21:09 GMT)
Learning from Uncertainty-dependent Missing Labels for Semi-supervised Classification [2.6] ラベルの欠落確率が観測された特徴に依存する半教師付き環境について検討する。
このような不確実性に依存しないラベルに対する可能性に基づく情報理論を開発した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:40:47 GMT)
SoK: ARCUS: On the Efficiency and Efficacy of Hardware Fuzzing [2.6] 主な要因は、入力刺激の品質、突然変異戦略、フィードバックメカニズム、ターゲットプラットフォーム、参照モデル、達成されたカバレッジである。
我々は、インテリジェントな入力生成、信頼性とスケーラブルなゴールデンリファレンスモデル、表現力のあるフィードバックチャネル、層間統合など、現在のハードウェアファジリングプラクティスにおけるいくつかのアンメニーズを特定します。
これらの知見に基づいて、ハイブリッドファジィングフレームワーク、AI支援テスト生成、スケーラブルなリファレンスモデル、標準化された評価指標、ベンチマークなど、今後の研究方向性を概説する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:45:37 GMT)
Words, Spaces and Generative AI: Layers of language in contemporary architecture [2.5] この章は、生成的AIを使用して行われるアーキテクチャ設計における3つの主要な言語形式に基づくものだ。
それは、生成的比喩と生成的AIを結びつけるための研究の議題を概説することで締めくくられる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:15:09 GMT)
When LLMs Slow Down: How Environmental Impacts Mediate University Students' LLM Usage [2.5] ライブのLarge Language Modelsインタラクションにおいて,レイテンシとカーボンのトレードオフを可視化するインターフェースを設計し,デプロイする。
応答遅延が増加するにつれて,エコフィードバックシステムを選択する可能性が著しく低下することが判明した。
より強いエコマインドネスを持つ学生は、低炭素モードを採用することへのベースライン意欲が高かった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:46:54 GMT)
Interferometric Signatures of Zero Modes in Fractional Quantum Hall-Superconductor Heterostructures [2.5] フラクタル量子ホール超伝導体(FQH-SC)を探索するための2つの関連する構成を提案する。
単一量子点接触(QPC)に結合したジョセフソン接合では、トンネルが欠陥融合チャネルを切り替える。
2QPCファブリ・ペロー干渉計にジャンクションを埋め込むことで補間プローブを提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:32:35 GMT)
A Multimodal Foundation Model for Longitudinal Patient Representation and Scalable Insight Generation in Oncology [2.5] 我々は,170万人のがん患者の実世界の腫瘍学コホート上で開発された基礎モデルであるoFMを紹介した。
oFMは、毎日の臨床および分子エピソードを符号化し、それらを時間をかけて統合し、患者の状態の埋め込みを生成する。
予後ベンチマークでは、oFMは治療反応、進行のない生存、全体的な生存のためにAUCを改善した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:17:12 GMT)
Scalable and Versatile Identification for Hierarchical Structural Causal Models: A New Look at Project STAR [2.4] 階層構造因果モデル(HSCM)のための完全でスケーラブルなオープンソースのパイプラインを開発する。
提案手法はグラフ変換,pyAgrum のdo-calculus を統合し,因果効果の自動同定,および適合した局所確率モデルからの数値推定を行う。
このパイプラインを標準HSCMモチーフとベンチマークシナリオで検証し,STAR幼稚園数学結果に適用する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:47:24 GMT)
Automated pipeline for herbarium label digitization [2.4] HERBIOMEは、自動ハーバリウムラベルデジタル化のためのエンドツーエンドパイプラインである。
YOLOv8ベースのコンポーネント検出、CRAFT Hezarワードレベルのテキストローカライゼーション、手書きテキストや印刷テキストの認識のための微調整TrOCR、標準化されたフィールドへのセマンティックメタデータ構造化のためのGPT-4o Miniを統合している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:01:32 GMT)
Clearing the Underbrush: AI-Enhanced RF Interference Suppression [2.4] この作業は、Finite Scalar Quantization(FSQ)トークンライザレイヤを追加することで、従来のAI対応アプローチに基づいている。
我々は、音声品質の知覚評価(PESQ)のような音声メトリクスによるAI対応アプローチの利点を実証する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:55:46 GMT)
Mahalanobis-Based Multi-Head Attention for Complex State Propagation [2.4] textbfMahalanobis-based Multi-Head Attention (MHA-CSP)を提案する。
MHA-CSPは標準的なドット積をtextbfMahalanobis 距離ベースのRBFカーネルに置き換える。
MHA-CSPは、スクラッチからトレーニングされたTransformerとGCNベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:13:28 GMT)
Asynchronous Verifiable Information Dispersal with Low Space and Communication Complexity [2.4] AVIDプロトコルは、ビザンチン環境でのデータ検索のためのストレージと通信の複雑さに最適な空間複雑性を実現する。
本稿では,分散,ストレージ,検索,リカバリの低複雑さを同時に保証する効率的なAVIDプロトコルを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:48:30 GMT)
Who Falls for SMiSh? Learning Through Survey Data Where to Best Target Awareness Training for Mobile Messaging Attacks [2.4] ショートメッセージサービス(SMS)の後、SMiShing(あるいはスマイッシング)と呼ばれる詐欺は、フィッシングリンクをモバイルテキストで送信する詐欺師を巻き込む。
SMiShingの流行にもかかわらず、これらの攻撃に対して最も脆弱な人物に関する情報が不足している。
その結果,若年者や大学生は特に脆弱であることが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:07:17 GMT)
Score-Based Ideal Observer Approximation via Denoising Score Matching for Signal-Known-Exactly Detection Tasks [2.4] Bayesian Ideal Observer (IO)は、バイナリ検出タスクのタスク性能に関する理論的上限を確立する。
本研究は、スコア関数の観点からIOテスト統計を再構成し、スコアベース理想オブザーバ(SIO)を導入する。
提案したSIOは、信号吸収画像にのみ訓練された畳み込み畳み込みニューラルネットワークを用いて、信号吸収スコア関数を推定する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:05:55 GMT)
Guided Riemannian Optimization (GuRO): Bridging Model Predictive Control and Decision Transformers [2.3] 高次元非線形システムの意思決定は、ロボット工学における中心的な課題である。
モデル予測制御(MPC)のようなモデルベースの手法は、サンプル効率と解釈可能性を提供するが、高いサンプル不安定な最適化に悩まされている。
本稿では,MPCをシーケンス決定フレームワークに統合する新しいフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:14:47 GMT)
A Geometric Theory of Robust Fairness Audits [2.3] 特徴空間における類似した個人間の予測を比較することにより、近隣の公正度監査が個人の公正性を評価する。
特徴空間における小さな摂動は、局所的な地区を変え、異なる公平性評価を生成することができる。
本研究では,境界摂動下での近傍の公正度監査の頑健さを解析するための幾何学的枠組みを開発する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:58:57 GMT)
What Should a Large Language Model See? Physical Invariants as a Data Representation for PDE Discovery [2.3] データ解釈(Data interpretation)は、理論家が相談する量にフィールドを計測し、直接入力としてモデルに供給する段階である。
シミュレーションされた場のベンチマークでは、解釈は復元された方程式の精度をほぼ3倍にしている。
言語モデルを理論家としてフィールドデータを読み取ることによって、データ解釈は、自動フィールド理論構築への実践的な経路を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:08:05 GMT)
Provable Quantum--Classical Separation for Continuous Gibbs Sampling [2.2] 連続領域上のサンプリング問題に対する最初の量子-古典的分離を証明した。
古典的境界は情報理論であり、任意の順序でギブスポテンシャルとその微分へのクエリアクセスを持つ全ての古典的アルゴリズムを保持できる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:13:34 GMT)
A Dual-Dimensional LLM Framework for Automated Item Incidental Content Similarity Analysis in Large-Scale Assessments [2.2] 本研究では,Large Language Models (LLMs) を用いた項目類似度自動解析のための2次元フレームワークを提案する。
LLMは構造的分解と意味的関連性を通して類似性を運用する。
心理学的検証は、LCM由来のメトリクスが構成非関連局所依存の指標とより密接に一致していることを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:07:16 GMT)
MC-CXR: A Multi-Context Chest X-ray Benchmark for Context-Induced Disruption in Vision-Language Models [2.2] ヴィジュアル言語モデル(VLM)は、胸部X線が検索された報告、予備メモ、または以前の画像と共に解釈される臨床パイプラインでますます用いられる。
既存のベンチマークでは、モデルが単独で正しく答えるかどうかを計測するが、妥当なコンテキストが画像と矛盾する場合に、正しい画像のみの決定を保持するかどうかを判断する。
マルチコンテキストチェストX線 (MC-CXR) を導入し, 240のケースを2,522のインスタンスに拡張した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:28:17 GMT)
Decoupling candidate dual AGN from chance superpositions in the GOTHIC survey via a deep-learning framework [2.2] 我々は46,061個の銀河を再検討したが、GOTHICパイプラインによってDAGN候補として拒否された。
我々は、アノテーション付きSDSSイメージングに基づいて、YOLOv11指向バウンディングボックスアーキテクチャに基づく教師付きディープラーニングフレームワークを訓練する。
カタログは統計学的に洗練された候補のリストであり、DAGNは確認されていない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:30:33 GMT)
When Less Is More: An Empirical Study of Minimal Responses in Counseling Dialogues and the Behavior of LLMs [2.2] 本稿では,複数のカウンセリング対話データセットにまたがる最小応答の体系的言語間比較分析を行う。
発話長と内容に基づく2段階フィルタリング法を開発し, 大規模言語モデル(LLM)を用いた文脈検証を行った。
我々の分析では、最小応答は人間の収集したデータセットでは一般的であるが、LLM生成データセットではほとんど表現されない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:22:11 GMT)
The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models [2.2] ライトウェイトな監査と2つのフォワードパス、トレーニングやグラデーションなし、因果関係が壊れる場所をローカライズするレイヤ毎のスコアを与えます。
192回中8回のチェックポイント試験ではマスク検査では検出されなかったが, 監査では全192/192を正確な層に局在させた。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:49:06 GMT)
Constrained Hyperparameter Optimization for Streaming Data [2.1] 本稿では,制約付き数値最適化問題における境界制約を効果的に管理するための戦略を提案する。
本研究は,オンライン最適化アルゴリズムにおける境界制約をナビゲートする4つの戦略を紹介する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:29:25 GMT)
ROS2 Connect: A new ROS2 over WAN Solution [2.1] WebSocketベースの通信フレームワークであるROS2 Connectは、ルーティングされたネットワーク間で透過的でセキュアなROS2インタラクションを可能にする。
提案するクライアントサーバアーキテクチャは、認証とアクセス制御機構を統合しながら、双方向の交換トピック、サービス、アクション、システムデータをサポートする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:52:47 GMT)
NVExplain: Explaining Time Series Forecasting with Latent Trajectory Analysis and Structure-Preserving Surrogates [2.0] 時系列予測モデルは、ハイテイクな設定で広く使われている。
既存のポストホック法はしばしば時間的依存を無視し、地平線固有の説明を提供しない。
本稿では,各予測地平線を時間的関係のある歴史的遅れに寄与させることで予測予測を説明するモデルに依存しない説明可能性フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:14:12 GMT)
More GPUs or a Smaller Cache? Tensor Parallelism versus KV Compression for Memory-Bound LLM Serving [2.0] 圧縮は1ドルあたりの容量(16.5倍)をGPUの8倍の費用で1.21倍に乗じる唯一のレバーである。
2つのモデル(Llama-2 at 7B と 70B)、3つのGPUタイプ、そして私たちが構築できる全てのメモリレベルにおいて、圧縮は 1.20x から 2.00x に安い。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:42:08 GMT)
Evaluating Deep Multivariate Imputation Models on Wearable Device Data [1.9] BRITS(英語版)やSAITS(英語版)のような深い計算手法は、現実的な欠損下でのマルチモーダルな生理的データに対して限定的な評価を受けている。
トレーニングデータから連続した欠落テンプレートをマイニングし,ギャップ長単位の量子化によって階層化し,コミストネス構造を保存したブロックマスクとして注入する評価プロトコルを開発した。
一致したトレーニングプロトコルが同一の欠損分布にモデルを公開することで、BRITSの重いギャップMAEを43%削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:48:12 GMT)
Simultaneous inference of environmental and interaction forces in collective dynamics [1.9] 我々は、既存の変動学習アプローチを、相互作用カーネルと環境/エージェント力の両方で集団システムに拡張する。
提案フレームワークは, 環境力の学習中に, 相互作用カーネルを非パラメトリックに推定する。
また,この非パラメトリック学習フレームワークに基づくモデル選択手法を導入し,与えられた軌道観測の集合を最適に説明するモデルを同定する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:55:12 GMT)
WebMCP-Phalanx: Enforcing and Characterizing Trust Boundaries for Browser-Integrated LLM Agents [1.9] W3C WebMCPの提案により、LLMエージェントはWebページが公開するツールを呼び出すことができる。
マルチパーティのWeb環境では、エージェントの実行をブラウザのセキュリティモデルに統合することは、エージェントアクセス可能なツールに対する十分な実績とライフサイクル保証を残している。
本稿では,2層エージェントランタイムアーキテクチャであるWebMCP-Phalanxを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:16:45 GMT)
CRESSim-Neo: A Batched GPU Simulation Engine for Surgical Robotics and Robot Learning [1.9] CRESSIM-Neoは、外科ロボティクスとロボット学習のためのバッチGPUシミュレーションエンジンである。
組織操作、流体吸引、縫合、ケーブル駆動ロボット、超音波画像合成などの応用をサポートする。
本研究では,剛体,変形可能な体,流体シミュレーションのタスクに対して,視覚ベースおよび手術ロボット学習シナリオを含むCRESSim-Neoを実演する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:17:00 GMT)
RetrievalFormer: A Dual-Encoder Transformer for Efficient Approximate Nearest Neighbor Retrieval and Cold-Item Recommendation [1.8] 検索とレコメンデーションの共有インデックスは、検索に探索スロットがないため、機能のみから新しい項目をスコアしなければなりません。
このオープンネスは、6つのシーケンシャルなベースラインに対して推奨され、それぞれがトレーニングされ、修正されたターゲットの5ラウンドで調整されます。
MovieLens-1Mでは、ウォーム精度が5.2%のRecall@20と11.4%のNDCG@20で最強のリトレーニングベースラインを踏襲している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:22:09 GMT)
Benchmarking LLM Judges for Voice-Agent Evaluation: Reliability, Calibration, and Human Oversight [1.8] GPT-4.1 と GPT-5 を会話の質と安全性の面で比較した。
自動でどの属性を確実に判断できるかを特定するために,計量レベルの相関,評価器の整合性,体系的な人間-LLMの不一致について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:44:36 GMT)
Retrieve, Match, Escalate: Accurate and Scalable Product Linking with VLM-Distilled Cross-Encoders and Agentic VLMs [1.8] プロダクトリンクは断片化されたリストを集約するので、下流の検索、レコメンデーション、広告は製品ごとに1つのクリーンなエントリを見ることができる。
市場規模では、何十億もの騒々しいマルチカテゴリのレコードが、何千万もの標準製品に対して解決されなければならない。
本稿では, 難易度に比例した生産回収マッチカスケードを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:26:34 GMT)
Self-Explanation Tutor for Active Study of CS1 Worked Examples [1.8] 本研究では,導入型プログラミングのための自己説明授業であるESSEを構築し,学生が作業例の行を解説する。
我々は,LLMが教師のエンジンとなるのに十分な学生説明を判断するかどうかを問う。
そのフィードバックは、学生が一行を捨てるのではなく、継続し、修正することにつながることに気付きました。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:54:47 GMT)
Dynamical Consequences of Nontrivial Topology of Molecular Conical Intersections [1.7] 我々は,非自明な位相を保ちながら,円錐交差から回避された交差が生成可能であることを示す。
電子トポロジが化学力学に与える影響を,最少スイッチ表面ホッピングシミュレーションにより検討した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:46:28 GMT)
What Does an Evaluation License? A Commit-Bound Census of Claim-Relative Inference in Inspect Evals [1.7] 我々はこの欠落したクレーム・リプレイ層を凍結基板Dを介して形式化する。
次に、機械的に許容できる124の検査Evalsユニットを、ピン留めされたコミットで調査します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:48:01 GMT)
Improved Quantum Codes with Transversal T Gates [1.7] 量子CSSコードを$T$ゲートで研究する。
すべての物理量子ビットに物理的$T$を適用すると、クリフォード補正なしで全ての論理量子ビット上で論理的$T$が得られる。
これらは、$T$ゲートを持つコードに対して$to 0$を達成する最初のコードであり、$$はマジックステート蒸留のオーバーヘッド指数である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:44:20 GMT)
DoublesEval: Diagnosing Multi-Agent Tactical Reasoning in Vision-Language Models via Professional Doubles Badminton [1.7] 視覚言語モデル(VLM)は、視覚的なシーンコンテンツを記述するのに優れていますが、動的マルチエージェントインタラクションについて考えるのに苦労しています。
我々はこの能力をtextbfmulti-agent 戦術推論として定式化し、診断評価フレームワーク textbfDoublesEval を導入する。
DoublesEvalはキーモーメントベースのプロトコルを使用して、ラリーを戦術的に健全な瞬間に分解し、4つの解釈可能な次元にわたってモデルをプローブする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:51:01 GMT)
Hybrid Semantic Tool Discovery for Enterprise MCP Gateway: Architecture and Implementation [1.7] 大規模言語モデル(LLM)エージェントは、事前訓練された知識以上の情報を検索し、推論するために外部ツールを起動する。
Model Context Protocol (MCP)はそのようなツールがどのようにサーフェスされるかを標準化し、プロキシMSPサーバは単一のエンドポイントの背後にある多くのバックエンドサーバを集約する。
SCOUTは、ツールの露出をコンテキスト選択問題として再設定し、現在のステップに関連するツールのみを注入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:33:44 GMT)
Benchmarking AI Agents for Hardware Design Automation via MCP Tool Calling [1.7] ローカルにデプロイされた大規模言語モデルを利用したAIエージェントが、業界現実的なツールコール設定で、専門家が定義したハードウェア設計を確実に自動化できるかどうかを問う。
この設定を研究するために、組み込みシステム開発に使用されるプロプライエタリなハードウェア設計ツールの状態と依存性ロジックを再現するモデルコンテキストプロトコル(MCP)サーバを構築した。
我々は、システムプロンプト、ツール記述の詳細、コンテキストスコープ、シングルエージェント対マルチエージェントアーキテクチャを含むパイプライン選択を比較した7つのオープンソースモデルを評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:33:50 GMT)
RefLAM: A Reference-Grounded Line Annotation Pipeline for Historical Arabic Manuscripts [1.6] RefLAMは、原稿のページイメージとクリーンな書き起こしを検証されたラインレベルの真実に変換するパイプラインである。
RefLAMは、構造化OCRのためのマルチモーダル大言語モデル(MLLM)とディープラーニングページセグメンテーションモデルを結合する。
AraMS-28k:14の歴史的アラビア写本、3,043ページ、27,971のメインテキスト、629のマージンラインアノテーションをリリースします。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:46:11 GMT)
From Natural Language Requirements to Graphical User Interfaces: Automated Prototyping and Verification with Pretrained Language Models [1.6] この作業は、2つの課題に対処する: (C1) NL要求をGUIプロトタイプに変換するのに必要な労力を削減し、 (C2) GUIアプリケーションとプロトタイプの要求検証に必要な労力を削減します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:53:24 GMT)
ConsensusTAS: Self-Supervised Temporal Action Segmentation for Long-Horizon Construction Videos [1.6] 本稿では,連続ビデオストリームを個別のアクティビティフェーズに分割する自己教師型学習手法であるConsensusTASを提案する。
提案手法は,ビデオ監視と人間ロボットのコラボレーションに実用的な価値を提供するCPU上で動作可能である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:05:15 GMT)
Metadata-Aware Adaptation of a Generative Foundation Model for Conditional CMR Synthesis [1.6] 合成画像生成は、医療画像におけるデータ不足と臨床的に重要な表現型の不足に対処するための有望な戦略である。
本研究では, メタデータ条件付心磁気共鳴(CMR)合成について, 事前学習型潜在モデルを用いて検討する。
本フレームワークは,英国バイオバンクの59,058個の短軸CMRに対して,ペア画像類似度,分布忠実度,サブグループレベル解析を用いて微調整および評価を行った。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:03:46 GMT)
Cognitively-Grounded On-Device Runtime Learning for Ground Robots in Unknown Physical Environments [1.5] ulCogRunは、安全クリティカルな地上ロボットがエッジAIデバイス上で完全にランタイム学習を実行することを可能にするフレームワークである。
CogRunはLearning-Agent、Rational-Agent、Coordinatorの3つのコンポーネントで構成されている。
実世界の野生の森の四足歩行ロボットと、シミュレーションされた野生の森のオフロード自動運転車の実験は、CogRunが安全で効率的なランタイム学習を可能にすることを実証している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:12:19 GMT)
Deep Learning Super Resolution for Satellite Cloud Mask Downscaling [1.5] 本研究は,SEVIRIクラウドマスク製品のスケールダウンを正確に行うための2つのDeep Learning手法を提案する。
SEVMOD-CMと呼ばれる新しいクロスセンサークラウドマスクデータセットは、空間的および時間的にMODISとSEVIRIの衛星観測をマッチングすることによって作成される。
実験により,リモートセンシングコミュニティにおいて提案したモデルとデータセットの価値が示された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:34:18 GMT)
Quantum Algorithms and Hardness for Point-Count Approximation over Finite Fields [1.4] 有限体上のローレントルムの解数の近似について検討する。
我々の最初の主要な結果は、成功確率1-$で、$widehat(f)$ fulfilling [ |widehatN(f) - N(f)| le varepsilon qn+s/2-]を出力する量子アルゴリズムである。
2つ目の主要な結果として、ランダム時間チューリング還元の下で同じ問題が$#$P-hardになることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:23:27 GMT)
Low-Latency Activation-Regularized Sparse Neural Operators with Distillation Assistance Towards Real-Time Edge-Deployable Virtual Sensing [1.3] スパイキングニューロンとニューロモルフィックコンピューティングは効率を向上するが、代理段階のトレーニングと多段階スパイキングは収束とレイテンシの課題をもたらす。
本稿では,SAR(Sparse-Activation-ReLU)層を提案する。
これらのアプローチは、それぞれ2倍以上の誤差と7倍近い誤差を減少させ、スパイキングと空間アグリゲーションを減少させる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:26:32 GMT)
Beyond Accuracy: A Dual-Judge Evaluation Protocol for Vision-Language Models in Legally Grounded Tasks [1.3] 我々は、標準の0-10品質判断と厳密な二項意味等価判定とを、人為的な基準に対して組み合わせた二重判断プロトコルを寄贈する。
我々は、制御された視覚的基盤を持つ規制課題について研究し、その意味は、すべての入力に対して既知の参照を持つコーデレートされた質問である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:49:46 GMT)
Learning spatially varying regularisation parameters of low regularity for image reconstruction [1.2] 本稿では,空間適応型正規化重み関数の正則性について考察する。
我々の議論は、モデルベース正規化とディープニューラルネットワークを組み合わせたハイブリッド画像再構成手法の研究に動機づけられている。
学習した重みは、しばしば規則性が低く、画像構造だけでなく、特定の雑音の実現にも適応できることを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:25:44 GMT)
Bridging Teacher Expectations and Robot Learning via Coupling Dynamics [1.2] 人間ロボット教育の最近のアプローチは、人間の教えとロボット学習の結合に焦点を当てている。
そこで本研究では,人間とロボットの相互作用を,人間教師とロボット学習者との結合ダイナミクスに基づいて分類する手法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:34:26 GMT)
AgentWorld: Personality-Aware Reliability Evaluation for Agentic Information Retrieval [1.2] AgentWorldは、パーソナリティ駆動のユーザ人口とステートフルなツール使用環境を組み合わせたシミュレーションフレームワークである。
10のOCEANペルソナにわたる会話分析エージェント(240の評価者判断)、5つのタスクにわたるカスタマーサポートエージェント($times$4のペルソナ変種)、既存のトラジェクタの不安定さを示す5つのタスクの逆ストレステストである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:15:33 GMT)
FedV-KGQA: Multi-Hop Question Answering over Vertically Partitioned Knowledge Graphs [1.2] FedV-KGQAは知識グラフに対するマルチホップ推論のためのフレームワークである。
我々は,実行時とサイロ間通信を伴わずに,適切なグラフ近傍で質問を根拠とするトピックエンティティアンカー機構を導入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:34:27 GMT)
The Sharp Tail of Uniform Stability [1.1] 均一な安定性は、あるトレーニング例がテストポイントでの損失をどの程度変えられるかを制御する。
新しい対数自由な上界は、$[0,L]$の損失を持つ$$一様安定なアルゴリズムが、最大$O left(log(1/) +Lsqrtfraclog (1/)nright)$の一般化ギャップを持つことを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:53:31 GMT)
Aging of Prompt Engineering Techniques Across LLM Versions [1.1] 我々は、モデルファミリー固有の方法で、迅速なエンジニアリングの「年齢」を示す。
新しいGPTモデルは、構造的プロンプトから減少またはマイナスの限界ゲインを示す。
この結果は,モデルファミリーと世代毎に効果的なプロンプト戦略を適用する必要があることを示唆している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:53:12 GMT)
The Evolution of Binary Decompilation in the Modern Era: A Taxonomy, Literature Review, and Future Perspectives [1.1] 本稿は、過去数十年にわたって発行された非コンパイル研究の体系的レビューである。
現代研究における方法論の包括的分類法を開発する。
私たちのレビューでは、信頼できる基盤の真理の欠如や標準化されたベンチマークの欠如など、重要な課題が明らかになっている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:20:54 GMT)
RefineRank: Joint Box Refinement and Ranking for Surgical Spatio-Temporal Grounding [1.1] 既存のアプローチはトレードオフに直面している: 言語モデルは質問コンテキストを理解し、不正確な座標を生成する。
このギャップを候補ボックスレベルで埋めるRefineRankを紹介します。
コンパクトなトレーニング可能なモジュールであるRefineNetは、凍結された医療ビジョン言語モデルの言語と地域特性と、凍結されたオープンセット検出器の提案を組み合わせる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:20:29 GMT)
Output Dilution: Redundant but Fragile Representations in MoE Models [1.1] Mixture-of-Experts (MoE)モデルは、道徳的コンテンツを密度の高いモデルのように堅牢にエンコードしているように見えるが、そのエンコーディングにおいてはるかに脆弱である。
OLMoE-1B-7Bでは、線形プローブは、ほぼすべての専門家層の組み合わせから、平均ピーク層精度を90%以上で復元する。
しかし、これらの表現は、一致した大きさの密度のモデルが容易に許容できるようなアクティベーションノイズのレベルの下で崩壊し、強靭性の4.2倍の違いがある。
MoEブロックは、残留するストリームに寄与する前に、アクティブな専門家によって平均されるため、下流層に到達するフィードフォワード信号は、インよりも2桁近く小さい。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:41:07 GMT)
The Annotation Bottleneck in Persian Text NLP: Persian as an Annotation-Scarce Language [1.1] ペルシア語は、自然言語処理における低リソース言語としてしばしば説明される。
この論文は、ペルシア語はより正確にアノテーション・スカースとして記述されていると論じている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:22:11 GMT)
Rollout-Decoded Reconstruction for Long-Horizon Prediction in Latent World Models [1.0] 潜在世界モデルは、観測に固定された潜水器でデコーダを訓練し、最後の観測から何百歩も経過したモデル自身のフリーランニングロールアウトに展開する。
ロールアウト・デコード・レコンストラクション(RDR)はこのギャップを、トレーニング中のモデルを正確に評価するようにフリーランする単一損失項で埋める。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:05:24 GMT)
Paritok-4B: Intent-Conditioned Context Compression for Coding Agents [1.0] Paritok-4Bは、4BのLoRA圧縮機で、2つのコミットメントに基づいて構築されたコーディング・エージェント・トラジェクトリを駆動する。
書き直しではなくスパンを選択し、96.4%の識別子、パス、および出力した番号が入力にすでに表示されている。
エージェントの現在のタスクでは、主に保持されたセグメント内で動作し、どのラインが生き残るかを選択する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:53:30 GMT)
Rules Before Oracles: Auditable, User-Configurable Argument Selection for Deliberative Polling [1.0] バイポーラの正当性に関する世論調査を定式化し, 根拠範囲, 到着順, 支持質量を定式化した。
エージェントシミュレーターは、投票毎にすべてのスレートを記録し、17,000回以上のシードペアランを実行する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:14:13 GMT)
Data Leakage Inflates Generalizability of Power Outage Prediction Models [1.0] 一般化能力に影響を与える停電予測モデルにおける3つの一般的な方法論的選択を同定する。
2018年から2023年にかけて、米国東海岸で公開されているデータを用いて、さまざまな方法論決定の予測的パフォーマンスへの影響を比較した。
ランダムな列車試験の分割は高い性能をもたらすが、これらの結果は空間的および時間的自己相関によって膨らませられることを示す。
これらの結果は、現在のデータ可用性と評価のプラクティスを考えると、公的に訓練された停止予測モデルが限られた運用価値と不確実な運用価値を提供することを示唆している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:05:55 GMT)
Trust the Mass: Forced Weights in KV-Cache Eviction [0.9] スパースアテンションやKV-cache-evictionルールはキーのサブセットを保持し、残りを破棄し、保持されたセット上の注意重みを再正規化する。
最大の重量を維持することが既に最適に近いことを示しています。なぜなら、最高のサブセットは、完全な注意を引くための残りのギャップの中央値2ドルから5%ドルしか閉じていないからです。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:40:39 GMT)
MoE-based Feature Adapter for Prompt-free Binary Coronary Artery Segmentation in X-ray Angiography [0.9] 冠状動脈分枝切除のためのプロンプトフリー・ミックス・オブ・エキスパート (MoE) 機能アダプタを提案する。
提案手法では,入力依存のトップ$kのルーティングを持つ複数の軽量専門家を用いて,容器関連機能を適応的に洗練する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:24:53 GMT)
ICS Cybersecurity Datasets: A Systematic Meta-Review of Coverage, Evaluation Practice, and Structural Gaps [0.9] 産業制御システム(ICS)における侵入検知の研究は、公開データセットに大きく依存している。
集合データセットコーパスが現在の評価クレームをサポートするかどうかを体系的に評価する以前の研究はない。
本稿は,2019年から2026年までの18研究のメタレビューを通じて,このギャップに対処する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:56:31 GMT)
Does Fine-Tuning Undo Activation Steering? Behavioural Recovery Without Weight-Edit Reversal [0.9] アクティベーションステアリングは、言語モデルの重みに直接組み込むことができる。
本研究は,5つの命令調整モデルにおけるリフレクション抑制とブレビティ誘導のための組込みステアリングの安定性について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:59:57 GMT)
From Gradient-Boosted Trees to Deep Recommenders: Practical Lessons from Migrating a Production Customer Support Recommender [0.8] 本稿では,多クラスモデルからペアワイズ・バイナリ・ディープ・レコメンデータへ,実運用の対話型レコメンデーションシステムの移行について述べる。
この移行を成功させたテクニックを詳述する。ユーザとアイテムの機能から共同で学習するための、ペアワイズなバイナリ予測として、レコメンデーションを変換する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:50:39 GMT)
A Primer on Computational Semantics for Artificial Intelligence Systems [0.8] トランスフォーマーに基づく言語モデルがどのように学習し、言語の意味を表現するかを知ることは重要である。
この文書は、科学的・哲学的な異なる分野から言語的意味がどのようにアプローチされているのかを読者が理解するための試みである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:10:04 GMT)
Learning Whom to Trust : Decision-Generated Credibility in Social Learning [0.8] 社会的相互作用は集団学習を改善するだけでなく、初期の間違いを増幅する。
本研究では,社会情報の信頼性が,送信者の意思決定プロセスによって生成される場合の緊張関係について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:39:32 GMT)
Dynamical System-Based Imitation Learning and Neuroadaptive Control for Trajectory Recovery in Autonomous Ships [0.8] 反復的な海洋操作は、Imitation Learning(IL)パラダイムを使って効果的に学習することができる。
動的システム(DS)は、非線形人間の実演をモデル化するために広く使われている。
本稿では,DSベースのIL参照ジェネレータとニューロアダプティブコントローラを統合したハイブリッド学習制御アーキテクチャを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:04:39 GMT)
ARISMA: Guidelines for AI- and LLM-Assisted Systematic Reviews, Scoping Reviews, and Mapping Studies [0.8] 本稿では,ARISMA(AI Reporting and Integration Standard for Systematic Methods and Analysis)を提案する。
AIを、自律的なレビュアーではなく、検査、ベンチマーク、ログ、可逆的なアシスタントとして扱う。
この論文は、ライフサイクル分類、プロセスガイダンス、レビューパイプライン全体にわたるステップワイズレコメンデーション、ガバナンスと証明モデル、AI統合レポートチェックリスト、バリデーションマトリックスに貢献する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:40:06 GMT)
EMFE: A lightweight, explainable machine learning framework for malaria cell classification [0.7] 染色血液スミア顕微鏡によるマラリアの診断は、深層畳み込み神経ネットワークに支配されている。
単発赤血細胞像を寄生・無感染と分類するための5機能フレームワークEMFEを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:38:04 GMT)
Credit Without Ground Truth: Auditing Step-Level Credit Assignment in LLM Agents Against Executed Replay [0.7] 単一エージェント環境において,実行されたリプレイからポリシー条件の真偽を検査する。
段階的な信用シグナルは、限界整合シャッフル制御以上の信頼度の高いインクリメンタル忠実度を示すものではない。
信頼のみのルータは、チャンスレベルにおいて重要なステップを回復するが、1ターンあたりの審査コストを13.1%削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:45:26 GMT)
Free-Energy-Gated Plasticity for Real-Time Online Motor Learning in Physical Human-Robot Interaction [0.7] 我々は、予測符号化にインスパイアされた変動リカレントニューラルネットワーク(PV-RNN)を拡張して、そのシナプス重みを継続的に適応させる。
変動自由エネルギーに応じて有効学習率を制御する自由エネルギーGated Plasticity (FEGP) を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:22:35 GMT)
Masked Differential-linear Distinguishers and Quantum Approaches [0.7] Masked Auto-correlationは対称キープリミティブの暗号解析のための新しいプリミティブである。
マスクの対と大きなマスクの相互相関があり、MACフィッシング(MAC Fishing)と呼ばれる。
我々は、古典的かつ二次的な量子スピードアップによって、キャパシティベースの区別器とキー回復攻撃を構築する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:43:31 GMT)
PlaceSeek: Human-Centered Geospatial Retrieval of Urban Outdoor Places via Semantic Grounding and Affective Alignment [0.6] そこで我々はPlaceSeekについて紹介する。PlaceSeekは人間中心の屋外場所検索フレームワークで、自然言語クエリを位置情報付きストリートビュー画像にマッピングする。
PlaceSeekは、ユーザクエリを機能的で感情的なサブインテントに分解するインテント対応の検索メカニズムを導入している。
そこで我々は,ミラノの31,956箇所のPlaceSeekを,人間5人の評価者によって注釈付けされた10の自然言語クエリで評価した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:57:29 GMT)
Directed walks shape a universal square-root law of entropy production rate in nonreciprocal systems [0.6] エントロピー生成率(EPR)は、非平衡定常状態の不可逆性を定量化する。
我々はEPRを非対称行列の二次形式として表現し、各長さにおける集合指向歩行の非相互性を測定する。
一致したウォーク条件を満たす密度、スパース、ディープ非巡回ランダム相互作用を横切ると、ノードあたりの平均EPRは平方根法則に従う。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:18:11 GMT)
Optimal Lower Bound for Ground-State Energy Estimation with a Guiding State [0.6] 結合下界$(log(1/varepsilon)/)$を、きつい$varepsilon$-dependenceで証明する。
この下限は、基底状態が一意であることが保証され、$H$はその第1と第2の固有値の間のギャップが$$であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:43:54 GMT)
From Relaxed Indexability to Exact Indexability: A $t$-Step Approach for Partially Observable Restless Bandits [0.6] ウィトルインデックスポリシーは、無限水平信念状態問題を解決するスケーラブルな方法を提供する。
我々は、各補助金$m$に対して、emph$t$-step lookahead threshold Policyを提案する。
我々は、$t$-step 近似ウィトル指数が正確なウィトル指数に幾何的に収束することを証明した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:31:30 GMT)
Image Difference Quantification Using Autoencoder-Based Latent Representations [0.5] 本稿では,潜在空間におけるコサイン類似性を用いて画像差分を定量化するための畳み込みオートエンコーダに基づくフレームワークを提案する。
提案手法は,従来の画素ベースの類似度指標に代えて,計算効率が高く,セマンティックに基礎を置いている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:23:47 GMT)
Stakeholder Insights for Designing In-Home Social Robots for Dementia Disorientation Detection and Caregiver-Aware Intervention [0.5] 認知症介護者と実践者(DCP)を対象に14回の半構造化インタビューを行い, 日常生活における障害の体験, 認識, 管理について検討した。
この結果から, 方向転換は反復的かつ変動的であり, 繰り返し質問や不適切な活動タイミング, 日常の習慣を乱すような行動的手がかりを通じて生じることが多い。
本研究では,社会支援ロボット(SAR)が日常業務に取り入れ,介護者を支援するための時間的エスカレーションを実現する上で,重要な設計上の意味を明らかにする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:17:45 GMT)
Threshold and Parity BosonSampling in the Linear-Mode Regime [0.5] 線形モード状態におけるボソンサンプリングのしきい値とパリティの測定値の計算複雑性について検討した。
特に、閾値とパリティボソンサンプリングにおける典型的な出力確率を推定する平均ケース#P硬度を確立する。
得られたインプレクチャー境界は、標準光子数分解ボソンサンプリングの事前硬度で得られた値と一致する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:56:05 GMT)
On Scaling Coordinate-Based Neuroevolution: The Quadtree Bottleneck in ES-HyperNEAT [0.5] 本稿では,バッチCPPNクエリによるGPU並列化をターゲットとしたJAXベースの実装であるJAX-ESHNを提案する。
我々は、CPUベースのPUREPLESベースラインに対して、XOR、Parity-3、円周分類、正弦回帰、CartPoleの5つのタスクでベンチマークを行った。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:27:24 GMT)
SafeGesture: Evaluating Fine-Grained Hand Gesture Understanding in Vision-Language Models through Scenario-Conditioned Safety Interpretation [0.5] モデルが手の動きからシナリオに適した安全行動を推測できるかどうかを評価するベンチマークであるSafeGestureを紹介する。
5つのモデルのうち4つは、まれに、または決して不確実性ラベルを使用しず、失敗の方向はモデルによって大きく異なる。
その結果,ジェスチャー認識よりもシナリオ条件付き安全推論が主なボトルネックであることがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:46:15 GMT)
Tunable-Size Unruh-DeWitt Detector in a Multimode Cavity [0.5] Bose-Einstein Condensates (BECs) に基づく量子シミュレータは、相対論的量子場現象を研究するための強力なプラットフォームを提供する。
本稿では, 固有運動量選択型Unruh-DeWitt検出器モデルを用いて, この制限を克服することを提案する。
我々は、一様線形加速度と一様円運動に対するそのような検出器の応答を解析的に計算する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:05:25 GMT)
An AI-Based Approach to Early Reporting and Justice Initiation in Image-based Sexual Abuse. A Pilot Study [0.4] 本稿では、画像に基づく性的虐待を報告するための初期報告を起草するAIソリューションが、正義へのアクセスを助長し、支援し、支援する方法について検討する。
我々のアプローチでは、司法へのアクセスは、IBSAを非難する道のりを緩和するだけでなく、早期かつより正確に法執行機関に報告草案を提供することによって促進される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:26:38 GMT)
Multilevel Fair Allocation under Additive Preferences [0.4] エージェント間の木構造的階層関係を考慮したマルチレベルフェアリソース割り当てについて検討する。
まず、通常のエンビーベースフェアネスの概念の多レベル適応を提案する。
同一の選好の下では、3つの適応されたエンビーベースの概念が一致することを証明している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:03:32 GMT)
Transforms for LLM Quantization: The Great Inversion and Format Co-Design [0.4] 我々は、それを組織する原則であるグレート・インバージョンを特定し、形式化する。
43の変換手法を,構造・データ認識・検索・構築・実行コストで分類する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:01:51 GMT)
MRI-based Deep Radiomic Phenotyping of Neuromuscular Disorders: A Topology-driven Characterization [0.4] 本研究は,5つの主要アーキテクチャ領域にまたがるオリジナル機能に基づく自動放射能表現型フレームワークを提案する。
異種筋内脂肪変性の複雑な3次元構造を客観的、形態学的に解釈可能なバイオマーカーにマッピングする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:30:17 GMT)
Evaluating and Preventing Security Smells in AI-Generated Ansible Code [0.3] CISベンチマークに対して、Apache Tomcat v10とMongoDB v7のロールを生成する16のAIモデルを評価します。
セキュリティガイダンスがなければ、すべての16のAIモデルは、セキュリティの臭いを含むコードを生成し、結果として、コンプライアンスの検証に失敗し、人間の開発者が書いたコードを過小評価する脆弱なインフラストラクチャを生み出した。
我々は、ベストプラクティスとCISベンチマークをプロンプトに統合するアプローチを導入し、デプロイ後の検出よりも、合成中のセキュリティの臭い防止を可能にする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:15:16 GMT)
An Ab initio Framework for Simulating Ultrafast Nonlinear Cavity Quantum Electrodynamics Spectra [0.3] 分子偏光子の超高速過渡吸収ポンプ-プローブスペクトルのシミュレーションのための理論的枠組みを導入する。
cQUEDAは幅広い応用性を提供し、様々な非線形分光信号と量子光学応答をモデル化するために一般化することができる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:47:55 GMT)
A Heterogeneous Mixture of Experts Framework for Interpretable Machine Learning [0.3] Mixture-of-Experts (MoE)モデルは、複雑な予測問題を単純なローカル学習タスクに分割するための柔軟なフレームワークを提供する。
既存の解釈可能なMoEアプローチであるMixture of Decision Trees (MoDT)は、均質な決定木の専門家を採用することで透明性を実現する。
我々は、決定木、線形支持ベクトルマシン、二次判別分析を含む不均一な専門家ファミリーを導入することで、MoDTフレームワークを拡張した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:00:40 GMT)
EviGraph: Towards Verifiable Evidence Construction for Information-Seeking Agents [0.3] 本稿では,証拠記録から検索実行を分離するディープ検索フレームワークであるEviGraphを紹介する。
結果として得られるグラフは、永続的なワーキングメモリと、密集したプロセス報酬の源として機能する。
BrowseComp-Plusでは、Qwen3-8B EviGraphエージェントが一致した相互作用予算の下で35.9%の精度を達成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:06:54 GMT)
Physics Attention Transformer Surrogate for Rapid Vertical Instability Growth Rate Prediction: Alcator C-Mod to SPARC [0.3] 我々は,MEQ-FGE-Lラベルをトレーニングした物理注意変換器を用いて,C-Modおよび平衡におけるn=0$の鉛直成長速度を予測した。
平均絶対誤差はC-Mod平衡の場合5.4s$-1$、合成の場合12.7s$-1$であり、空間固有関数誤差は5%近くである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:30:32 GMT)
Constraint-Guided Enterprise Data Mapping with Large Language Models [0.3] i) メタデータmc = tau_c, delta_c>, (ii) カスケード緩和による制約制約付き候補生成により, 雑音下での空でない実現可能な集合を保証し, (iii) 有界な曖昧性を持つニューラルネットワークのランク付けを行う。
方法論的には、制約はポストホックのバリデータではなく仮説空間演算子として機能し、緩和の下で制御された劣化と、監査可能な人間の誘導可能な決定を可能にする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:23:45 GMT)
Understanding the Energy Scaling of Large Language Model Inference Across Context Lengths and Attention Architectures [0.3] 各種推論負荷下でのデコード相エネルギー消費に注意構造がどのような影響を及ぼすかを検討する。
注意が、文脈長でエネルギーをデコードする方法を規定する主要な要因であることを示す。
モデルサイズは絶対エネルギー消費を決定し、生成トークン当たりのエネルギーとレイテンシの両方を最大87%削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:45:30 GMT)
AFDBench: A Reasoning-First AI Scientist for NationalWeather Service Forecast Discussions [0.2] 大規模言語モデル (LLMs) は、高精度な気象テキストを生成する際に、数値を幻覚させる。
AFDBenchというAI気象学者は、構造化されたAI天気予報データを通して推論することで、専門的なエリア予測討論(AFD)を生成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:02:24 GMT)
Feedback-enabled magnomechanics in lithium ferrite [0.2] リチウムフェライト(LiFe)は、マグノンとマイクロ波光子の強い結合を可能にするため、キャビティマグノンにとって有望な材料である。
ここでは、コヒーレントマイクロ波フィードバックを用いて、単一結晶LiFe球におけるマグメカニカル相互作用を観察し、消散を抑制する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:52:10 GMT)
Transport interpretation of entanglement Hamiltonian cumulants in integrable quantum quenches [0.2] 我々は、大域量子クエンチに続く相互作用可能な可積分モデルにおいて、絡み合いハミルトニアンの累積の動力学を研究する。
これらの累積は、初期状態によって選択されたマクロ状態において評価された電流の累積によって正確に与えられることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:31:51 GMT)
On the Representational Geometry of Dynamic Programs [0.2] 標準的なニューラルアーキテクチャは、しばしば動的プログラミング(DP)ターゲットのより長い入力に一般化できない。
我々はこの難易度を幾何学的に調査する。
直列および並列合成は、より小さなサブDAGから全てのDAGトポロジーを構築するのに失敗する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:23:41 GMT)
Optimal copy complexity of quantum state cloning [0.2] 我々は、少なくとも1-ヴァレプシロン$の$d$次元状態に対して最適な複雑性を示す。
また,高忠実度トモグラフィーを同程度の誤差でコヒーレントにクローニングできることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:29:10 GMT)
Parameter-Efficient Self-Supervised Adaptation for EEG-FM under Fixed Computational Budgets [0.1] 目的タスクに表現を合わせるのに十分なパラメータの9%しか更新していないパラメータ効率の自己教師型適応について検討する。
事前学習目的の異なる2つの最先端モデルに対して,本手法の評価を行った。
SSL適応は、線形プローブよりも、最大20倍のAUCPRで一貫した利得が得られる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:38:46 GMT)
HealthBench-Psych: A Mental Health Subset of OpenAI's HealthBench [0.1] 精神的な健康は、何百万人もの人が心理的支援のためにLSMに目を向けるので、深刻な公衆衛生上の懸念である。
われわれはHealthBenchの5000名の医師・医師・医師の会話を,透明なLDMルーブリックと精神健康との関連性について検討した。
再利用可能なリソースとして、サブセット、パイプライン、モデル応答、グレード、分析コードをリリースします。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:05:19 GMT)
What's the Catch? Evaluating Temporal Consistency in Vision-Language Models [0.1] 視覚言語モデル (VLM) はビデオや画像系列のベンチマークで高い性能を発揮するが、時間構造を捉えているかどうかは不明だ。
連続するフレームとフレームレベルの異常をガウス雑音に置き換えることで、時間的異常を発生させるTimeCatchを導入する。
評価の結果,フレームレベルと時間的異常検出との間にはかなりのギャップがあることが判明した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:47:47 GMT)
Deterministic LLM Inference Across GPU Kernels: Power-of-Two INT8 Quantization Scales and the Limits of Tolerance-Based Conformance [0.1] 量子化されたGEMMカーネルのコンフォーマンススイートは、2つの実装が許容範囲内で一致するかどうかを問う。
5つのエピローグ断層(スケール精度、ダブルラウンド、乗算順序、出力トランケーション、融合順序)のうちの1つが、少なくとも1つのbfloat16間隔で出力を移動していることがわかった。
5つの断層のうち4つはスイートのチェック無しで検出され、5番目は2つのスケールでのみ検出される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:05:54 GMT)
Towards Stirling cooler operable single-photon sources based on low-noise GaAs quantum dots [0.1] 低雑音GaAs量子ドットにおける負のトリオンの放射崩壊によって生じる光子の温度依存性の2光子干渉測定について述べる。
この損失は、エネルギ的にクローズドなトリオン状態とのカップリングによって説明できることを示すとともに、エネルギ発生速度のパーセル向上や励起状態のエネルギー分離の増加によって、高温での光子の不識別性を高めることができることを示唆する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:19:57 GMT)
ToolMinimize: Auditing and Rewriting LLM Agent Tool Calls to Minimize Privacy Exposure [0.1] ツールコールをインターセプトし、ツール機能に必要な最小データに引数を書き換える。
307ツールコールのライブ検証は、100%引数レベルのタスク妥当性で、プライバシコストを81.2--92.0%削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:48:16 GMT)
Optimal Quantum Algorithm for Ground-State Energy Estimation with a Guiding State [0.1] 我々は、ガイド付き設定でユニタリ$U$の最大の固有位相を推定する量子アルゴリズムを与える。
このアルゴリズムはトランスデューサ(Transducer)に基づいており、多くの場合、エラー低減のオーバーヘッドなしに量子アルゴリズムを構成することができる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:43:54 GMT)
'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection [0.1] ウルドゥー語は世界で10番目に多く、話者数は2億2600万人である。
現在のLLMは、ウルドゥのスクリプトの品種間の不均一な安全保証を提供する。
オープンウェイトモデルでは、フロンティアクローズドモデルよりも不安定性とミスハームレートが著しく高い。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:58:40 GMT)
Design-to-Plan: A Large Language Model-Based Multi-Agent Framework for Manufacturing Process Planning from 3D CAD Models and 2D Engineering Drawings [0.1] 本稿では,大規模言語モデル(LLM)に基づくエンドツーエンド製造プロセス計画のための多エージェントフレームワークであるDesign-to-Planを提案する。
オーケストレータは、3D特徴認識、2D描画解析、2D-3Dコンテキスト融合、知識検索、プロセスシークエンシング、ツール選択、レポート生成のための特殊エージェントをコーディネートする。
このフレームワークは、3つの下流ReAct対応エージェントにまたがる300のベンチマークケースを用いて評価され、CAD特徴認識、描画解析、2D-3Dコンテキスト融合を別々に評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:57:38 GMT)
Graphix: A software framework for Measurement-Based Quantum Computation [0.0] Graphixは測定ベースの量子コンピューティングのためのソフトウェアフレームワークである。
測定ベースのプロトコルとアルゴリズムを開発し、統合し、探索するための統一された環境を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:23:22 GMT)
Why and When Neural Networks Improve Local Approximation in Optimization [0.0] この矛盾は3つの要因が記述された後に解消され、学習した局所モデルが支払った場合、トレーニング曲線が報告する適合精度よりも、むしろ逸脱していることが示される。
我々は半径対応局所一般化を定式化し、それを古典的完全線型条件に関連付け、固定されたサロゲートクラス、トレーニングパイプライン、ベースメソッドで各因子をテストする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:35:23 GMT)
When More References Hurt: Contamination-Aware DINOv2 Memory Banks for Few-Shot Steel Defect Detection [0.0] 本研究は,いくつかの信頼された正常な画像が,欠陥マスクを使わずに,そのような参照から有用な正常なパッチを安全に回収できるかどうかを考察する。
クリーンシードバンクまでの距離で候補パッチを採点し、最も疑わしい20%を廃棄し、保持されたパッチをシードとマージし、グリーディコアセットの選択によって固定予算を強制する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:49:09 GMT)
When Does Self-Supervised Pretraining Help Tabular Models? A Study of Label Scarcity and Missing Data [0.0] 自己教師付き学習(SSL)は、表データに対する有望なアプローチとして登場した。
14の分類課題において,スクラッチと古典的ベースラインからのトレーニングに対して,マスク・アンド・リカバーSSL事前トレーニングの目標を評価する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:39:30 GMT)
When Do Supervised UQ Ensembles Improve LLM Hallucination Detection? A Robustness Study [0.0] 大規模言語モデル(LLM)における幻覚検出には、不確かさ定量化(UQ)法が広く用いられている。
不均一なUQベースのスコアラー出力に対して、分類器を訓練する教師付きアンサンブルフレームワークについて検討する。
教師付きアンサンブルは32設定中30のスコアで最高のスコアを上回り、100のラベル付きインスタンスからゲインを得られることがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:43:07 GMT)
What You Can't See Is What You Learn: Slot-Selective Evidence Masking Favors Compositional Generalization in Shared-Genome Language-Model Societies [0.0] 我々は、アテンションマスクを除いて、10個のマッチした制限付き/グロバルペアを訓練する。
制限された視認性社会は、両深度で少なくとも20ポイント以上の視認性双生児を上回っている。
ホック選択後の6つの制限された社会では、正しく答えられた保留エピソードに対するパケットの介入は、およそ値インデクシングされたリレー状態と一致している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:22:32 GMT)
What Do Audio-Visual Synchronization Metrics Actually Measure? [0.0] AV-sync メトリクス AV-Align, ImageBind AV-Relevance, JavisScore, Synchformer/DeSync を監査した。
Synchformer/DeSyncは、最も強力な時間オフセットトラッカーである。
AV-sync を信頼度カードメトリック・ファミリーの故障と信頼区間で報告することを推奨する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:08:24 GMT)
Weakly Supervised Seafloor Segmentation for Seagrass Habitat Mapping in Side-Scan Sonar Imagery [0.0] 海草の牧草地はブルーカーボンの生息地であり、その範囲をマッピングすることは海岸管理と炭素在庫にとって必須条件である。
弱教師付きセマンティックセマンティックセマンティクスフレームワークをSSSベントック生息地マッピングに適用する。
沿岸域の海草モニタリングに必要なスケールで, サイドスキャンソナーからの正確な, ラベル効率の高いベントック生息地マッピングが可能であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:55:49 GMT)
Trusted Polytopic Action Sets for Fast Planning in Underactuated Systems [0.0] 不変系は、その運動が関数空間内の軌道の多様体上にあるため、凸運動計画に挑戦する。
本稿では,不活性化および潜在的非線形システムに対する短時間水平動作の高速,オンライン,信頼された凸集合を生成する手法を提案する。
プランナーは数ミリ秒(キノダイナミックRTベースラインよりも14~78倍速い)で乱れた平面シーンを解決し、サンプリングおよびNLPベースラインよりも26~86%、非線形不動ベンチマークでの終端誤差を低減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:18:32 GMT)
Trust, but Verify: Rigorously Profiling Best-Effort High-Performance Computing for Digital Evolution [0.0] デジタル進化は、仮説駆動による多スケールの生物学的現象の探索と応用駆動の進化最適化を前進させる機会を提供する。
880,000プロセッサのCerebras Wafer-Scale Engine(WSE)など、次世代のAI/MLハードウェアアクセラレータプラットフォームは、デバイス上のデータストレージとムーブメントを制約している。
従来の決定論的コンピューティングパラダイムから外れたベストプラクティス緩和は、そのような制約を満たすのに役立つ。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:31:31 GMT)
Towards Reliable AI-Based Histological Staining: A Systematic Study of Scaling and Uncertainty in Unpaired Generative Models [0.0] 慢性肝疾患の長期予後の予測因子である肝線維症は,コラーゲン含量の組織学的検討から報告されている。
ヘマトキシリンとエオシン(H&E)染色は標準的な定量読み出し(コラーゲン領域、CPA)を生成するが、すべての臨床センターで取得されるわけではない。
AIベースの仮想染色は、H&Eから直接SRを生成することができるが、教師なしモデルの体系的なベンチマークは少ない。
我々は、新しくリリースされたH&EとSRマウスの肝データセット上の54のスケーリング構成に対して、6つの教師なしイメージ・ツー・イメージ・アーキテクチャ(GANおよび拡散ベース)をベンチマークした。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:41:57 GMT)
Toward Machine Learning with the Unit as a Primitive: Learning from Unit-Linked Events [0.0] 本稿では,タスクセマンティクスのレベルでの明示的なプリミティブとして,Emphunitを提案する。
機械学習タスクは、まず、永続的な参照と同一性基準の集団を宣言する。
教師付き学習が主要な形式的特殊化である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:14:26 GMT)
Time-Dependent Tunneling in the Thin-Barrier Limit [0.0] 我々は、背が高くて薄い障壁を横切るトンネルとして、アクションが小さいときにトンネルを解析する。
我々は、制御パラメータが電位障壁下の領域の逆である摂動解析を開発する。
境界粒子の共鳴状況では、トンネルの確率は$propto t2$と時間とともに増加するが、非共鳴状態では時間とともに線形に増加する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:41:44 GMT)
The urban right to AI: Pluralistic co-design and governance of public space [0.0] この論文は、スコア、マップ、生成した画像が自治体の意思決定の一部になる時期について尋ねる。
パブリックスペースは競合するので、このアルゴリズム層は技術的パフォーマンスだけでは管理できない。
この論文は、公的な価値の違いを可視化する、AIに対する市民的権利と、アライメントに対する多元的アプローチを発展させている。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:43:20 GMT)
The bottleneck dimension of quantum operations [0.0] ノイズの多い普遍量子プロセッサは$d$-compressible、$d$-simulable、$d$-embeddableとなる。
このしきい値は予想を裏付けるものであり、ヒルベルト空間全体のコヒーレンスを維持することがますます要求される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:02:55 GMT)
The Von-Neumann State-Space Transformer for neural decoding [0.0] 皮質計算は驚くほど低次元である。
フィードフォワードブロックが低ランクの命令バンクであるメモリ拡張トランスを導入する。
VN-SSTは現代のTransformerよりもはるかにデータ効率が高い。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 19:28:33 GMT)
The Shadow Price of Intelligence: Quality Degradation in LLM Inference as a Supply Chain Problem [0.0] 顧客が回答を購入すると、問い合わせの価格が上がるので、会計が間違っていることを示す。
劣化した解答は何らかの確率で失敗し、失敗した解答は再試行として返り咲くか、あるいは解答として出発する。
混雑下では、スロットリングはコストレバーではなく需要レバーである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:26:24 GMT)
The Pauli Probability Spectrum Carries the Pure-State Quantum Fisher Metric [0.0] 量子状態が小さなパラメータの変化にどのように反応するかは、量子臨界度、状態の区別可能性、およびメートルロジカル感度の中心である。
純粋な$N$-量子状態の任意の滑らかな族に対して、完備ラベル付きパウリ分布の古典的フィッシャー行列は、ちょうど2倍の量子フィッシャー情報行列であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 06:34:42 GMT)
The Invisible Editorial Layer: Formalizing Undisclosed Inference-Time Steering, Probability Placement, and the Attribution Problem in Deployed Language Models [0.0] 推論パイプラインは、トークン選択の直前にモデルによって生成される確率分布を変更する。
本稿では,推測時フレーミングバイアスの出現について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:05:19 GMT)
The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses [0.0] 本稿では、意図的に反対する哲学から構築された3つのオープンコーディングエージェントハーネスについて、ソースレベルのマルチケーススタディを提案する。
2つの成熟したハーネスは反対方向に移動したが、5つの繰り返し要素の1つのアーキテクチャの中間形態に向かって収束していることがわかった。
第3のハーネスはその後、ホールドアウトチェックとして読み上げられ、全5つを示し、1つのシームは別の実装をそのまま再利用する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:26:41 GMT)
The AI Adaptation Gap in Higher Education: Students, Faculty, and Administrative Staff [0.0] 本研究の目的は,教員養成専門大の学生,教員,行政スタッフを対象に,人工知能(AI)の利用パターンとAIに対する態度を分析することである。
3つのロール適応75項目のアンケートでは,AI活用の頻度と状況,有用性,信頼とコントロール,学術的整合性の懸念,責任意識の規範,制度的方針の明確化,アウトプット品質の向上について調査した。
学生は、現在のAI利用の強さと、教員や管理スタッフよりも有用性が高いと報告し、教員や管理スタッフは、より強い学術的整合性の懸念と責任利用規範の支持を報告した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:59:12 GMT)
Targeting the Attention Heads Behind Object Hallucination in LLaVA [0.0] LLaVA-1.5-7Bのような視覚言語モデルは、字幕を生成する際に画像から欠落するオブジェクトを幻覚させる。
私たちは、画像の注意が幻覚した言葉の周りでどれだけ落ちてくるかによって注意をランク付けし、候補者の頭を非難することでショートリストを遮蔽する。
ヘッドスライスされたLoRAアダプタと推論時グラウンドングコントローラの2つの介入を制限します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:01:28 GMT)
Static Detection of Post-Quantum Cryptographic Algorithms in Stripped Binaries for Digital Forensic Examination and Migration Assurance [0.0] 現在、量子フロンティアブルアルゴリズムが承認された後量子アルゴリズムに置き換えられたかどうかを、コンパイルされたバイナリコードから検証する方法はない。
本稿では,ストリップされたバイナリコードにおいて,ML-KEMとML-DSAの標準化された格子ベースのスキームを同定する静的解析手法であるKestrelを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:17:08 GMT)
Shortcut Before Circuit: Document Statistics Time In-Context Conflict Resolution [0.0] 我々は、電流と希薄度が正確に一致した合成言語でトランスフォーマーを訓練する。
私たちはこれらを最小限の因果編集で分離し、真実、トークン数、答え位置を固定しながら1つのキューを反転させます。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:09:19 GMT)
Security Education in Higher Education through AI-Powered Gamification [0.0] サイバーセキュリティ教育は、AIによる攻撃がますます現実的になり、検出が難しくなっているため、より多くの課題に直面している。
高等教育における従来のビデオベースのサイバーセキュリティトレーニングは、低いエンゲージメントと限られた有効性の両方に悩まされることが多い。
本稿では,短時間でモバイルフレンドリーなゲームの開発を通じて,サイバーセキュリティ教育におけるAIによるゲーミフィケーションについて検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:18:38 GMT)
Research Methodologies for Cybersecurity in Enterprise Environments: A Narrative Review, Synthesis and Executable Guide [0.0] 本稿では, 検証された151作品のコーパスにまたがって, 方法論的実践の物語的レビューと合成を行う。
私たちはこれらのプラクティスを11の方法論ファミリに整理し、それがどんな質問に答えるか、その裏付けとなる証拠の強さ、そして共通の失敗モードについて詳細に説明します。
各プロトコルは視覚的にマッピングされ、シーケンス、決定、脅威を一目で理解できるようにします。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:38:00 GMT)
Quantization Effects on Bangla Language Understanding in Large Language Models: A Systematic Evaluation [0.0] トレーニング後の量子化は、Large Language Models(LLM)のメモリフットプリントを低くし、推論を高速化する。
バングラ語のような形態学的に複雑な低リソース言語についても、同じことが当てはまるかどうかは定かではない。
Qwen-2.5-7B, LLaMA-3.1-8B, GPT-OSS-20Bの3つのモデルファミリを完全精度と3種類の量子化形式で評価した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:36:09 GMT)
Quantifying the Relationship Between Team Dysfunctions and Performance in Capstone Projects [0.0] 本稿では,エンジニアリングカプストーンプログラムにおけるチームの機能障害とパフォーマンスの関係について検討する。
学生チームから収集した調査データを用いて、チームの5つの機能不全に関するLencioni氏のモデルに基づいて、チームのダイナミクスを定量化する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:48:11 GMT)
QML for Quantum Sensing under Measurement-Induced Information Loss [0.0] ダイヤモンド中の窒素空孔(NV)中心は、磁気測定のための高感度な固体量子センサーとして機能する。
NV中心に着想を得た磁力計設定における磁場推定における量子機械学習(QML)の役割について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:47:38 GMT)
Predictability of El Niño from Delayed Observations [0.0] 2026年7月までの毎月のNio-3.4異常を用いて,指標の遅延観測にどの程度の予測情報が含まれているかを検討した。
リッジ回帰は情報的遅延を識別する一方、多層パーセプトロンとスパース同定は非線形力学(SINDy)モデルで非線形複雑性が追加の直接予測スキルを提供するかどうかをテストする。
将来的な応用として、選択されたモデルを使用して、2026年に発生した事象を最後の観測範囲を超えて予測し、予測された進化を過去のエルニオの事象と比較する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:42:46 GMT)
Parameter-Level Attribution of Symmetry in Trained Networks Though Parameter-Wise Functional Sensitivity [0.0] 滑らかなパラメータ空間の作用は、函数の対称性軌道への接空間が$mathrm d_$の像内にある場合にのみ存在することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:24:11 GMT)
Optimal Allocation of Embedding Dimensions under Finite-Sample Constraints [0.0] 本稿では,次元選択を制約付き割当問題として定式化する。
埋め込み能力は, 明示的な近似-推定トレードオフに従って, 異種カテゴリー予測器間で分配可能であることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:18:11 GMT)
Optical centrifuge as a probe of strong dissipative coupling between a molecular rotor and superfluid helium [0.0] 超流動性のマクロ的な表象は、液体ヘリウムを移動する物体がランダウ臨界速度以下で無視可能な摩擦を経験することである。
ここでは、超低光遠心分離方式による連続運転がこの制限を克服することを示す。
その結果、急激な熱化は、回転誘起レベル分裂が熱化速度を上回るまで分子を回転場にロックする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:15:46 GMT)
One-Shot Learning from Demonstration of Contact-Rich Robotic Manipulation by Identifying Physical Interactions [0.0] デモから学ぶ(LfD)ことで、ロボットは人間から直接操作タスクを学習できる。
ほとんどのLfD法は、ロボットとその環境の間の物理的相互作用を明示的にモデル化していない。
物理的相互作用がどこでいつ起こるかを明確にするLfD法を提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:48:03 GMT)
One Timeline, Many Renderings: A Wolfram Language Paclet for heterogeneous musical output [0.0] テンポラル・システム(Temporal System)は、有理なビート・タイムライン上に1つの不変な型付きエンティティのストアをコンパイルするWolfram Language pacletである。
Csound 合成、 MusicXML 4.0 のベータ、OSC コントロール、ストアを共有しているため同期しているアーティファクトをクリックします。
我々は、時間的、セマンティック、レンダリング・コントラクト・レイヤ、それらの実践的なトレードオフ、そしてこのプロプライエタリなオーサリング環境の限界について説明する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:15:06 GMT)
Non-Subhomogeneity of Minimal Operator Systems over Positive Semidefinite and Lorentz Cones [0.0] rm Mat_k(mathbb C)_+$, $kgeqslant2$, and the Lorentz cones $mathcal L_m$, $mgeqslant4$, are subhomogeneous。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:58:09 GMT)
No Free Compression in Quantum Relaxations for Optimization [0.0] 量子緩和は古典的な決定変数を、より少ない量子ビット上の期待値に圧縮する。
圧縮はコストを制限された期待値幾何、期待値の大きさの小さいもの、あるいはそれを取り除くよりも要求の多い情報回復にシフトできることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:57:14 GMT)
Nearly Optimal Amplitude Estimation at any Depth [0.0] 我々は、可変回路深さ$M$と回路繰り返し$N$の振幅推定アルゴリズムを開発し、アンシラ量子ビットもグロバー演算も必要としない。
Grover角の加算エラー$$は、ほぼ最適なクエリ-深さトレードオフ$M2NinwidetildeO(-2)$を均一に$in[0,/2]$で達成し、古典的なサンプリングの$M=1$から、Heisenbergの$M=(-1)$までの範囲をまたがる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 11:46:21 GMT)
Multipair-resilient entanglement swapping with complementary linear-optical measurements [0.0] マルチペアエミッションはエンタングルメントスワップにおける偽のヘラルドの主要な源である。
連続するスワップステーションが異なる測定を行えるようにすることで、カスケードネットワークがこの曖昧さを解消できることを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:04:23 GMT)
Most of the LLM Routing Gap Is Task Type [0.0] ルータはクエリ毎にどのモデルに答えるべきかを選択する。
全体として、どのモデルが一番良いのかは、いまだに間違っている。
プール内の別のモデルは、その多くを正しく取得します。
すべて同じ294の質問に当てはまり、ホールドアウトはない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:36:52 GMT)
Measuring Digital Labour Market Transitions with a Digital Semantic Score: An AI-Based Methodology Applied to the Dutch Labour Market [0.0] オランダ労働市場のデジタルトランスフォーメーション : 職業言語、キャリアパス、職業関連スキルを変革する。
本稿では、数百万のオランダ人求職者を対象としたデータを用いて、デジタル化を分析するAIベースの手法を開発する。
また、デジタル・セマンティック・スコアを導入し、デジタル・コンセプトと肩書やスキルがいかに結びついているかを測定する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:27:35 GMT)
Markerless Pose Estimation for Resistance Training Technique Assessment [0.0] マーカーレスポーズ推定は、物理的マーカーなしで画像やビデオから身体のランドマークを推測する。
通常の映像から抵抗訓練手法を評価するためのポーズ推定フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:44:05 GMT)
MDTE: Minority-Aware Diffusion over Temporal Edge Events for Imbalanced Node Classification [0.0] MDTEは条件拡散デノナイジングにより、安定かつ差別的な時間的エッジイベント表現を再構成する。
特徴再構成とトポロジー予測を利用して、分布学習におけるクラスワイズの違いを特徴づける。
5つの実世界のデータセットの実験では、MDTEは少数クラス指向のメトリクスにおいて、常に最高のパフォーマンスを達成している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:56:22 GMT)
Long-Range Order and Composite Boson Condensation in Lattice Quantum Hall States [0.0] 量子ホール状態のような物質のトポロジカルな状態は、局所的な順序パラメータの欠如によって特徴づけられる。
ここでは、量子ホール状態を持つハミルトニアン格子にテンソル・ネットワーク法を適用し、基底状態で直接相互作用するこのエキゾチック秩序を明らかにする。
我々の研究は、従来の固体のアプローチの範囲を超えて、トポロジカル量子物質の顕微鏡研究のための新しい道を開く。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:44:13 GMT)
Kochen-Specker Configurations from Grids on Dual Quadrics [0.0] 実空間におけるKochen-Specker構成の構築と整理のためのフレームワークを開発する。
この構成はユークリッド極性に関連する滑らかな二次体の対に有限格子を用いる。
それらの入射幾何学は、直接量子的文脈性の測定コンテキストとパリティ証明を生成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:01:55 GMT)
Knowing When to Ask for Help: Bayesian Self-Escalation in Hierarchical LLM Agents [0.0] 現在のエージェントシステムは、推論を開始する前にデリゲートを決定する。
我々は第3の体制について研究し、それは成功しそうもないと自覚するエージェントである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 05:35:07 GMT)
Improving Cross-Problem Vehicle Routing with Locally Augmented Preferences and Representation Disentanglement [0.0] マルチタスク車両ルーティング問題(VRP)解決者は、単一の統一モデル内で複数のVRP変種を処理しようとする。
そこで本稿では,選好ペアを形成する前に,ローカル検索リファインメントパスを最適な復号化ツアーに適用する,新たなトレーニングアルゴリズムを提案する。
第2に、プログレッシブ層抽出(PLE)エンコーダは、各エンコーダ層を1つの共有専門家と、ゲーティング機構を介してタスク固有の専門家のセットを通じてルーティングする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:44:23 GMT)
Hyperbolic Latent Geometry for Tree-Structured Prototype Networks: A Local-vs-Global Trade-off [0.0] 階層型分類モデルにおいて,クラスプロトタイプレイアウトに対する木構造正則化器について検討する。
ポインケアのプロトタイプは、最も近い近傍グラフのラテント空間における位相をユークリッドのプロトタイプよりもかなり良く保つことが分かる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:42:20 GMT)
Harness Engineering for Predictable Agentic Systems: An Empirical Study of Deterministic Execution Constraints [0.0] LLM(Large Language Model)ベースのエージェントは、同一のタスクやツールが与えられたとしても、実行時から実行時までのかなりのばらつきを示す。
エージェントを決定論的実行層にラップする。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:46:50 GMT)
Hardware-Aware Fermion-to-Qubit Mappings for Simulating the 2D Hubbard Model on Heavy-Hexagon Quantum Processors [0.0] 我々は、ヨルダン・ウィグナー、ブラヴィイ・キタエフ、ボンサイ変換を数値的にベンチマークする。
次に、ボンサイ写像を用いて、2次元スピンフルフェルミ・ハバードモデルの立方体ハミルトニアンを構成する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:10:49 GMT)
Hardness of approximation for minimum-weight decoding of two-dimensional topological quantum codes [0.0] 位相量子符号の最小重復号法の計算複雑性について検討する。
独立な$X$-および$Z$-errorモデルの下でのカラーコードについては、分離最小ウェイトデコードを考える。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:28:35 GMT)
HCC+: Hyperbolic Guarding for Certified Attention Retrieval [0.0] 本稿では,ポアンカレ球の3つの特性を利用する理論的枠組みを提案する。クエリ非依存境界トランケーションを実現する指数体積成長,次元非依存臨界キー同定を可能にする双曲型1中心の対数被覆半径。
厳密な検索では、層ごとの注意偏差はその理想値の10%に制限され、ソフトアテンションでは、全変動距離は$O (1/sqrtn)$、有限サンプル分散の速度で減衰する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:52:28 GMT)
Giraffe: A Mapping Architecture from Hidden Text Representations to Visual Embeddings for Efficient Graphic Design [0.0] 近年のアプローチでは、トークン列の隠れ表現を視覚モデルの埋め込み空間に変換することによってギャップを埋めようとしている。
視覚モデルの埋め込み空間に隠されたトークンレプレンス・テーションをマッピングする新しいアーキテクチャを提案する。
強いパーフォルマンスは、イメージ・ツー・デザインとテキスト・ツー・デザインの両方のタスクで示される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:49:46 GMT)
Geometry-controlled correlated electric-field noise in enclosed ion traps from billiard return spectra [0.0] 電界雑音の空間構造を受動導電幾何学がどのように決定するかを, イオンの捕捉による検討を行った。
我々は、$N$イオン電界クロススペクトル行列とそのブロックワイド運動コサコフスキー発生器を構築する。
任意の有限等高イオンアレイに対して、受動的被覆は正半無限順序の正規場共分散行列を増大させる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:09:36 GMT)
Generalized Efficient Quantum Circuit Implementation of Discrete-Time Quantum Walks on Cayley Graphs [0.0] 1次元ケイリーグラフに対するシフト演算子の系統的多段階分解を導入する。
8-Cayleyグラフと$mathbbZ_16倍のmathbbZ_8$トーラスグラフに対して明示的な回路実装を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:35:46 GMT)
Gauss--Hermite Quadrature for Gaussian-Mixture Entropy with an Action-Space Hermite Surrogate [0.0] ガウス混合微分エントロピーの評価のためのガウスミート二次法を提案する。
二次順序は近似の数値分解能を制御する。
連続作用に対する繰り返し最適化に対しては,数値作用空間におけるHermite surrogateを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:57:11 GMT)
Functional compatibility as a determinant of persistent neural learning [0.0] 入力学習が保持しなければならない動作と共存する程度、機能的互換性を識別する。
同一のニューラル状態から、制約のない学習機会と共通の保持要件とを一致させながら、互換性が変化する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:55:37 GMT)
From local kernels to global form: modeling the emergence of musical content [0.0] 重なり合うスライディングウインドウは,形式的なパーティションではなく,ひとつのシンボルシーケンスから局所遷移カーネルの軌跡を導出することを示す。
我々は、絶対ピッチと通知デュレーションカーネルに同じ検証を適用する。
連続するスライディング・ウインドウ比較の理論的な最大値はウィンドウ幾何学によって設定されるので、ピッチ値が$L=6$であり、その広い台地はそれ自体は強い証拠ではない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:03:45 GMT)
Formal Verification of Romanov's Triplet Logic: A Verified Filter for Sliding-window 3-CNF with Application to Structured Formulas [0.0] Rocqの開発には23,000行以上のコードが含まれ、424の証明済みのsと未証明の仮定がない。
ロマノフのトリプルト論理(TLS)の最初の機械的形式化をRocq証明アシスタントに提示する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:37:46 GMT)
Fluctuation-dissipation structure of quantum geometry [0.0] 一般(混合または純)量子状態に対する距離測度と曲率に関連する構造を同定する。
この構造は、変動散逸の物理的意味を持つ。
この図を用いて、一般的な輸送挙動の幾何学的特徴を与える。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:00:29 GMT)
Federation Is Nearly Free, Reasoning Is Not: Tradeoffs for AI Co-Scientists in Protein Characterization Workflows [0.0] 自然言語による自律的共同科学者は、柔軟性と推論の基本的なトレードオフを含んでいる。
我々は,科学技術のための生産エージェントプラットフォーム上で,制御されたアブレーションを用いてトレードオフを体系的に評価した。
LLMの選択はトポロジーやプロンプトよりも予測品質をはるかに上回っていることがわかった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:11:14 GMT)
Federated Sharing and Continuous Improvement of Medical Device Knowledge Artifacts: A Conceptual Model [0.0] デジタル生産施設を持つ医療センターは、ケア中にデバイスデザインを作成する。
他のサイトは、適切なデザインを見つけるのに苦労するかもしれないし、スタッフがそれを使ったとき何が起きたかを学ぶのに苦労するかもしれない。
モバイル医療センターは、病院システムから離れるとアクセスを失う可能性がある。
本稿では,フェデレートされた交換インフラのためのアーティファクトセントレッドモデルを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:59:41 GMT)
Exact certification of a positive-order Rényi additivity violation for an explicit channel pair [0.0] いずれのチャネルの出力も、$301/100000$から$2/3$の固有値を持つ。
これは、この明示的なペアのための最初の印刷され、コンピュータで検証された正の順序のエンドポイントである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:20:54 GMT)
Exact Quasiprobability Hierarchy of the Double-Morse Oscillator: From Potential Geometry to Operator Ordering [0.0] 我々は、対称二重モード発振器の最低準エクサクサクサクサクタ基底状態の正確な表現整合解析を開発する。
ダブルモースポテンシャルでは、次元のないパラメータ$A$がミニマと中心障壁の分離を制御する。
A$が同じ非ガウス的および非古典的状態が相補表現で解決されるかを制御することを示す。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 02:33:18 GMT)
Evolutionary Recurrent Decision Model in Developing Adaptive and Maladaptive Behaviors [0.0] 本研究は進化的反復決定モデル(ERDM)を紹介する。
ERDMは、進化的ミスマッチ、有界合理性、満足度が適応的かつ不適応な振る舞いにどのように貢献するかを調べるために設計された、計算強化学習フレームワークである。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:45:05 GMT)
Ensemble of Convolutional Neural Networks for StrokePrediction: Towards Improved Diagnostic Accuracy [0.0] 脳卒中は高い死亡率と罹患率で知られており、重大な健康リスクを引き起こす。
近年のディープラーニングの進歩は,脳卒中早期発見のための新しいコンピュータ支援診断技術につながっている。
本研究では,11つの特徴を用いて脳卒中を予測し,教師付き機械学習アルゴリズムを用いて評価する知能システムを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:09:53 GMT)
EncoTESS: Age-Sensitive Encodings from Raw TESS Light Curves [0.0] F期後期からM期にかけてのスペクトル型の主系列星は、光度曲線の体系的な変動を示す。
我々は,TESS 2-min光曲線のサブセットに基づいてトレーニングされた時系列基礎モデルであるEncoTESSを開発した。
EncoTESSは光曲線を固定サイズの潜在パラメータ空間にエンコードし、物理的恒星の性質を推測することができる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 18:06:58 GMT)
Efficient Treatment of Non-Linearity in Quantum Computational Fluid Dynamics Using Hybrid Tensor Networks [0.0] 本稿では,ハイブリッド量子古典テンソルネットワークアルゴリズムを提案する。
従来の状態ベース非線形実装をテンソルベースブロック符号化に置き換える。
完全に古典的なテンソルネットワークソルバと比較して、我々のハイブリッドアプローチはメモリフットプリントと計算コストの両方を大幅に削減する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:13:00 GMT)
Dynamical splitting and a nodal Bose liquid in 2d chiral XYZ model [0.0] 我々は「力学分割」と呼ばれる構造を持つハミルトン群のクラスを研究する。
この構造は、ハミルトニアンの2つの部分が不随意に作用する実効的な自由度に代数的双対性をもたらす。
我々は、三角形格子上の幾何的にフラストレーションされたスピン-1/2$モデルである「キラルXYZモデル」でこれを利用した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:28:30 GMT)
Drift Variation Autoencoder: Unifying Generation and Representation Learning through Conditional Posterior Flow Matching [0.0] この研究は、条件生成の共通統計対象として対応する後続の$P(Xmid C)$を取る。
ドリフト変動オートエンコーダは、マスク付きエンコーダ$Z=E(C)$と、1つのきれいな予測フローマッチング損失を持つ条件付きフローデコーダを訓練する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:38:50 GMT)
Does Probability Require a Single History? [0.0] 崩壊法は、可能な世界的な結果に同じ確率を割り当てる。
私は、この最小限の提案を以前の公理的アカウントに関連付け、それに伴うパーソナライズされたパーソナライズされたパーソナリティーの理論と区別します。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 16:18:43 GMT)
Development of a Voice-Controlled Tendon-Driven Bionic Hand [0.0] 本稿では,自動バイオニックハンドの設計と実装について述べる。
提案手法は, 腱法である。
Bluetoothベースの受信機アーキテクチャとの対話を容易にするために、ボイスコマンドを有効にしたインターフェースがある。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:22:39 GMT)
Design and Empirical Characterization of a Hardware-Realized Turing Machine with Automated Card-Based Programming [0.0] 本稿では,自動多段階実行と再プログラム可能な光入力を実現するハードウェアチューリングマシンを提案する。
このシステムは、状態遷移論理のためのArduino Mega、双方向のテープアクチュエータのためのデュアルNEMA 17ステッパーモータ、シンボル検出のための赤外線センサー、ESP32-CAMベースの光パンチカードリーダーを統合する。
機械的評価では,50回の試験で+/-0.15mm,ラック・アンド・ピニオン位置誤差が0.3mm以下であった。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:48:07 GMT)
Delayed Optimizer-State Transport Shapes Short-Horizon Training Decisions [0.0] 遅延輸送が短期的決定を変えるのに十分な大きさであるかどうかを検討する。
提案手法では,全モデル最適化状態から8ステップのAdamWを区別する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:18:29 GMT)
Cross-Stack Validation of Language-Model Training: A Clinical Fine-Tuning Case Study [0.0] 独立に実装されたトレーニングスタックが、微調整パイプライン全体の微分オラクルとして機能するかを検討する。
168,574対のQwen3-0.6BのLoRA適応に適用した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:55:45 GMT)
Counterfactual Explanations and the Scope of Contestability [0.0] 本稿では,特定の知識の提供によってエージェンシーを復活させる方法について述べる。
我々は、特定のタイプの説明、反事実的説明が、アルゴリズム決定に異議を唱える能力を促進するかどうかを論じる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 13:45:16 GMT)
Control-Oriented Learning for Dynamic Tracking and Stability Analysis of Soft Pneumatic Actuators [0.0] ソフト空気圧アクチュエータは、固有のコンプライアンスと安全な相互作用を提供するが、モデル化と制御は困難である。
本稿では、アクチュエータ動作を非線形静的平衡モデルに分解する制御指向データ駆動モデリングおよび制御フレームワークを提案する。
その結果、構造化された制御指向学習は、ソフトアクチュエータ制御のための正確かつ実用的なフレームワークを提供することを示した。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:39:02 GMT)
Context Localization for Generalized Level-Based Evaluation in Knowledge-Based Systems [0.0] 本研究では,知識ベースシステムにおけるレベルに基づく評価のためのコンテキストローカライゼーションについて検討する。
我々は、その還元特性を生成するポイントワイドおよびブロック生成機構を解析する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:46:57 GMT)
Constrained Entity Selection under Partial Knowledge for LLM-Based Knowledge Graph QA [0.0] 本稿では,不確定解の除去に焦点をあてた問題定式化である部分知識下でのemphConstrained Entity Selection(CES-PK)を紹介する。
実験では、不正な候補をフィルターすることで精度が向上するが、制約が明示的に違反していない候補を保持するため、リコールは保存される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:04:32 GMT)
Confident at the moment of action: belief miscalibration in LLM play under hidden information [0.0] エージェントシステムは、モデル自身の主張する信頼に対するアクションをますますゲートし、信頼は行動の瞬間の正確性を追跡すると仮定する。
我々はこれを秘密裏に、王族の地位を秘密裏に、断片間で繰り返し移動できる秘密情報チェス変種でテストする。
このパターンを示すモデルは、その信念が持つゲームにまだ勝てる可能性があるため、結果のみの評価がそれを検出できない。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:18:18 GMT)
Collective photon echoes in the Tavis-Cummings model: distribution independence, two detuning regimes, and the Dicke ladder [0.0] 基底状態に形成され、空洞を弱体で共有する分子の集合は、単に吸収されない。
強度は崩壊し、集団光子エコーの列車で再帰する。
キャビティ崩壊とデファーシングとフルヒルベルト空間障害シミュレーションのリンドブラッドシミュレーションによる5ビット超伝導デバイスに対する実現可能性解析は、既存のハードウェアでNsim5$-20$で観測可能な最初のエコーを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 03:06:30 GMT)
Change Detection in Probability Flow ODE: Online Testing in Diffusion Latent Spaces [0.0] 金融市場のトレンド逆転を識別するといった一連のデータタスクは、時間順データの分散シフトを検出することなく、完全に対処することはできない。
条件密度が未知の時間で切り替わる逐次的変化点検出問題を考えるが、事前および後変化分布は閉形式を認めない。
凍結文脈エンコーダを用いた事前変更点データに基づいて訓練された条件拡散モデルは、確率フローODEによる決定論的決定を定義する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 01:27:39 GMT)
Certified Fidelity Susceptibility from Classical Shadows [0.0] 本稿では, ランダム化単一コピー計測を用いて, フィデリティの感受性を認証する手法を提案する。
結果として得られる近似は単調な下界を正確な忠実度感受性に結び付け、幾何的に収束する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:41:48 GMT)
CareGraph: An Auditable Hybrid AI Framework for Evidence-Grounded Personalized Longitudinal Health Intelligence [0.0] CareGraphは、診断、結果の予測、治療の選択、または自律的な臨床決定をせずに証拠を整理する。
テストでは、開発、バリデーション、ホールドアウトのために、400人の患者による合成コホートを使用した。
CareGraphは、インテリジェントなパーソナライズされたヘルスシステムのための安全なバウンド基盤を提供する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:03:52 GMT)
Can a Dynamic Internal Field Govern a Transformer's Cognition? Certifiability, not Superiority, in Homeostatic Compute Control [0.0] インテリジェントなシステムは単に理性ではなく、独自の理性を支配する。
その役割は、それを実行せずに認知を調節する動的内部フィールドによって演じられるのか?
Ours は、グラフ Laplacian 上の PDE の族によって支配される加群グラフ上の体である。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:47:03 GMT)
Can You Trust Frozen Hematology Foundation Models under Acquisition Shift? [0.0] 4つの公開シングルセル取得ドメインで15の凍結エンコーダを監査する。
ドメイン内の線形プローブマクロF1は飽和(0.98-0.997)であるが、クロスデータセットマクロF1は34-72%低下する。
ドメイン内で最高のDinoBloom-Lは、RedDinoといくつかの一般および病理エンコーダに次いで、最もシフトしたターゲット(MLL23)で15の10位に落ちる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:55:57 GMT)
CA-less Mutual Co-Signing of Documents over a Unidirectional Visual Channel with Transported Hardware Attestation [0.0] 本稿では,文書の相互署名のためのプロトコルを2つのモバイルデバイスで記述し,解析する。
各パーティの公開鍵に対する信頼は、プラットフォームセキュアな要素によって生成されるハードウェア認証トークンに基礎を置いている。
ECDSA P-256をSecure Enclave/StrongBox、SHA-256、Apple App Attest/Play Integrity、LTスタイルの噴水コードで使用したiOS/Androidの動作インスタンスを報告する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 20:52:50 GMT)
Bound State Analysis of Rank-One Delta Interactions Supported by Deformed Hyperspheres [0.0] 我々は、(n)次元超球面(S_RnsubsetmathbbRn+1)の小さな正規変形に支えられるランクワンデルタ相互作用を研究する。
変形しない超球面に対して、変形したベッセル積 [I_fracn-12(R)K_fracn-12(R) の言葉で (E=-2) の有界方程式を導出する。
特に平均ゼロ変形は変化しない
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:55:10 GMT)
Blockwise Stabilized Adaptive Cubic Regularization with Subsolvers via Recurrence [0.0] 実ブロック Hessian 上のパラメータテンソルあたりの独立立方体モデルを最小化するブロックワイズを導入する。
ステップが立方体モデルを最小限にすることを示す。
この外部スキームの4つの変種は、元の適応正則化に対して評価される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:35:13 GMT)
BioKERN: Biological Kernel Regularization for Histology-to-Transcriptomics Neighborhood Retrieval [0.0] BioKERNは、生物学的構造を明示的で学習可能な帰納バイアスとして組み込んだマルチモーダルな表現学習フレームワークである。
マウス脳ビシウムとヒト肝GSE240429をまたいだバイオケリンは、BLEEPによる生物近傍の検索を一貫して改善している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 17:04:16 GMT)
Better Retrieval, Worse Robustness: How Multi-hop RAG Amplifies Upstream ASR Errors [0.0] 音声ベースのアプリケーションは、任意の検索モジュールの前に自動音声認識(ASR)を介して音声クエリを渡す。
我々は、標準的な検索強化生成(RAG)への2つの拡張、エンティティグラフリンク、反復的な改定、吸収または増幅の2つの拡張を経験的に検証する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 09:48:29 GMT)
Bayesian Flow Networks for Offline Trajectory Planning [0.0] オフライン強化学習(RL)は、静的データセットを活用して、リアルタイム環境インタラクションなしで意思決定ポリシーを学習する。
ベイジアンフローネットワークに基づくオフラインRLのための統合生成モデリングフレームワークであるBFN-RLを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 21:19:35 GMT)
BanglaMamba: Exploring State Space Models for Bangla Fake News Detection [0.0] BanglaBERTのようなトランスフォーマーベースのモデルは、Banglaテキスト分類において強力なパフォーマンスを達成する。
本稿では,バングラ偽ニュース検出の代替手段として,マンバをベースとした状態空間モデル(SSM)について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:09:34 GMT)
Automotive HSMs - Architectural Challenges and Security Implications [0.0] ハードウェアセキュリティモジュール(HSM)は、自動車システムオンチップにおいて重要なビルディングブロックとなっている。
本稿では,自動車用HSMのアーキテクチャ解析を行い,安全なブートとハードウェアの信頼基盤を確立する上での役割について検討する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 23:12:41 GMT)
Arbitrary Polygon Oscillator: Generalizing Polygonal Synthesis to Arbitrary Shapes, Morphing, and Three-Dimensional Polyhedra [0.0] 既存の定式化は正規でパラメトリックに定義されたポリゴンで作用する。
本稿では, アーク長統一エンジンを中心に多角形合成を一般化する。
このシステムはRNBO (Cycling'74) で動作し、サンプルごとの再計算を回避する幾何学的キャッシュ戦略を持つ。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 15:38:41 GMT)
Amortized Set Prediction for Inverse IFS Reconstruction from Density Maps [0.0] 反復関数系(IFS)は、いくつかの収縮アフィン写像から自己相似フラクタルを生成する。
我々は、画像から地図を推定する逆問題と、訪問周波数密度マップから直接アフィンマップを予測する学習推定器を置き換える。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:40:30 GMT)
AlGaAs nanowires as a universal platform for GaAs, InGaAs, and InAs quantum dots [0.0] 量子ドット(QD)は光量子技術の中心であり、異なるスペクトル範囲に調整された製造法である。
鍵となる課題は、高品質の単一ナノワイヤを提供する統一プラットフォームの実現である。
本稿では,GaGaAs QDsとInAsAs QDsの共通ホストとしてAlGaAsナノワイヤを導入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 12:44:09 GMT)
Agentic AI for operating scientific instruments for nanoscale characterization [0.0] 本稿では,原子間力顕微鏡(AFM)ワークフローの実行可能な部分を動作させるエージェントAIフレームワークを提案する。
このフレームワークは、AMM Messenger、AFM Pilot、AFM Doctorという3つのMPPベースのエージェントで構成されている。
微調整および既製のツール使用モデルに対するベンチマークは、このガードされた実行層がモデル機能のみでなく、間違ったコマンド実行をゼロにすることを示している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:55:40 GMT)
AI with Authority, from Application to Silicon [0.0] 5週間で、消費者向けAIサブスクリプションの研究者の1人が、コミュニティのシリコンシャトルに搭載されたRISC-Vプロセッサに、少数のAIエージェントを誘導した。
人間によるレビューを通した証拠はなく、RTLは人間によって書かれたものでもない。
作業の規律 -- ソルト法 -- は、幻覚的証明が通過できない証明カーネルに依存している。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 22:53:45 GMT)
ABSTRACTS: Amsterdam Benchmark Suite for the Time and Resource Analysis of Clifford+T Simulators [0.0] 近年、古典的なハードウェアで非クリフォード量子回路をシミュレートする新しい手法を提示する文献が急速に増えている。
この文献の注目すべき制限は、ベンチマークに対する標準化されたアプローチの欠如である。
本稿では,非クリフォード古典シミュレータの効率を定量化するための標準化された標準ベンチマークスイートとインフラを提案する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 10:29:11 GMT)
A Literate Programming Environment for Human and Machine Agents [0.0] 本稿では,言語対応機械エージェントと協調してリテラトプログラムを構築する環境を提案する。
これには、実行可能なプログラムエッセイのための文法、散文、名前、実行可能なアーティファクトに関連する名前グラフ、既存の言語やテストツールセットのバインディングメカニズムが含まれる。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 14:54:24 GMT)
A Feature-Major Codebook for Memory-Efficient Sparse-Binary Self-Organizing Maps: Scaling a MEDLINE Atlas to 1.05 Million Neurons on a Single Consumer GPU [0.0] 自己組織化マップは、大きなコーパスをブラウズ可能な2次元アトラスに変換する。
トレーニングを支配しているBMU(Best-matching-unit)検索は、エポック毎にコードブックを読むのに必要な帯域幅によって制限される。
このボトルネックは、主にコードブックレイアウトの成果です。
実装、精度、更新ルールが固定されたレイアウトのみを変更すれば、BMU検索は4.5-8.5xに高速化される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 04:55:07 GMT)
A Data-dependent Early Stopping Rule using Rademacher Complexity with L1-norm [0.0] トレーニングニューラルネットワークは、トレーニングデータの適合と、目に見えない入力に対する堅牢なパフォーマンスとのトレードオフのバランスを必要とする。
既存のアプローチは通常、一般化誤差を数値的に推定し、勾配降下訓練と早期停止戦略を必要とする。
トレーニングを必要とせずに早期停止の最適時間を推定する分析フレームワークを導入する。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 08:19:34 GMT)
A Comprehensive Analysis of Arabic Natural Language Processing Research: Trends, Topic Evolution, and Research Gaps -- A Bibliometric and Topic-Based Study [0.0] 本研究は,1960年から2026年の間に発行された7,120個のアラビアNLP論文の文献的およびトピックベースの分析を行った。
我々は、トピックモデリング、回帰分析、ソーシャルネットワーク分析、地理マッピングにBERを使用している。
以上の結果から,2020年以降,トランスフォーマーモデルやLPMによる出版が急増したことが示唆された。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 07:42:44 GMT)
A Categorical Framework for Wave-Particle Complementarity: Continuous Observable Structures and Fourier-Pontryagin Duality [0.0] 定式化波動-粒子相補性とド・ブロリー関係 $=h/p$ をヒルベルト空間上で提示する。
位置と運動量は、局所コンパクトアーベル群 $mathbbR$ とポントリャーギン双対に付随する連続ダガー・フロベニウス構造によって表される。
論文参考訳(メタデータ) (Tue, 25 Aug 2026 00:51:13 GMT)