ComBodied Agents: a New Paradigm of Human-Centric Agentic AI [121.7] 我々は、人間中心のパラダイムであるCombodied Agentsを紹介し、時間とともに個々の人間状態の軌跡を知覚し、モデル化し、予測し、支援する。
パーソナルアシスタント、ヘルスエージェント、AIコンパニオン、適応型ヒューマンAIシステムをクローズドループに統合する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:35:58 GMT)
XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment [110.5] XPolicyLabは、ロボットポリシーの評価とデプロイのための統一された標準でオープンなエコシステムである。
XPolicyLabは42のロボットポリシーを統合し、インストール、デバッグ、サービス、アダプタ、評価を標準化する。
コントロールされた研究では、標準に従って、代表政策の統合の労力を5時間以上から2時間に短縮する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:41:52 GMT)
LLaVA-Assessor: Building the Foundation LMM For Visual Quality Assessment [99.9] 統合データ構築およびモデルトレーニングシステムであるLLaVA-Assessorを提案する。
マルチモーダル入力をサポートするために,画像とビデオの両方を効率的に処理できる適応型モデルアーキテクチャを設計する。
結果として得られるオールインワンLMM LLaVA-Assessor-GIGAは、画像/映像品質スコアリングテストセットと4つの視覚品質解釈ベンチマークにおいて、優れたパフォーマンスを達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:21:11 GMT)
A Neural Network Based Teleoperation for Remote Controlled Vehicles [98.4] 車両の直接遠隔操作は重要な技術的ボトルネックに直面している。
通信遅延とオペレーターの 物理的に知覚できない 未モデル化の環境障害。
本稿では,一方的な遠隔操作フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:51:08 GMT)
Apodex Discovery: Reality Benchmarks and Environments for Evaluating and Building Discoverative Artificial Intelligence [86.6] Apodex Discovery(アポデックスディスカバリー)は、重度解法を用いて発見的AIを構築し評価するためのフレームワークである。
まず16のセクターで511の業界を調査し、423の高価値現実問題を集め、最初のリリースで20を選定した。
第二に、共通の環境-タスク-エピソード抽象化は、データ、ツール、制約、フィードバック、軌跡記録、中間成果物と最終提出物の検証を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:48:40 GMT)
Equilibrium Forcing: Adaptive Video Generation Without Noise Conditioning [85.9] ノイズレベル条件のない生成モデルを映像化するためのフレームワークであるEquilibrium Forcing (EqF)を紹介する。
この柔軟性により、サンプルからのフィードバックに適応してクローズドループで動作する推論時アルゴリズムが実現される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:02:32 GMT)
On the Limitations of Cross-Lingual Consistency in Multilingual Text-to-image Generation [79.2] LingT2Iは、33Kプロンプトを持つ10の広く使われている言語をカバーするベンチマークである。
我々は、言語不平等と言語依存のトレードオフを明らかにする包括的な言語間分析を行う。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:49:23 GMT)
SafeCA: Safe Cross-Attention Localization and Regulation for Text-to-Video Jailbreak Defense [77.7] テキスト・トゥ・ビデオ(T2V)生成モデルは、現実世界のデプロイにおいてジェイルブレイク攻撃に対して脆弱である。
安全なクロスアテンション・ローカライゼーションと正規化のための機能レベル防衛機構であるSafeCAを提案する。
実験の結果、SafeCAは主流のT2Vモデルでジェイルブレイクの成功率を約20%削減することが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:01:24 GMT)
MobileMem: Learning from a Year of Mobile Experiences [77.0] デバイス上の長期記憶を研究するためのベンチマークおよびフレームワークであるMobileMemを紹介する。
MobileMemは、ユーザ・アプリ・セッションからコヒーレントで時間的に一貫したロングホライゾン・トラジェクトリを構築するために、ナレッジグラウンドのパイプラインを使用している。
特にMobileMemは、エージェントが過去を思い出し、現在を理解し、未来に適応することを可能にする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:09:51 GMT)
Bridging Event Streams and DiT: Event-Guided Video Frame Interpolation [76.0] イベントカメラは、時間的ギャップを埋めるのに適した高解像度モーションキューを提供する。
本稿では,イベント由来のキューを事前学習した画像間拡散モデルに組み込むアダプタベースのフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:47:44 GMT)
Cross-View Feature Matching: Survey, Benchmarking, and Foundation-Model Perspectives [74.5] クロスビュー特徴マッチングは、大きな視点変化を持つ画像間の信頼性の高い対応を確立することを目的としている。
過去10年間で、この分野はタスク固有のモデルから、ますます統一され、一般化可能な対応モデルへと発展してきた。
これらの進歩にもかかわらず、既存の研究は問題定式化、モデルアーキテクチャ、訓練パラダイム、評価プロトコルにおいて非常に多様である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:00:40 GMT)
ELBench: A Multi-Dimensional Benchmark for Education-Facing Large Language Models [71.8] 大規模な言語モデルは、家庭教師、教師助手、コンテンツジェネレータとして、教育にますます導入されている。
既存のベンチマークでは、これらの要件を主に分離して評価しているため、統合されたプロファイルとして教育に直面する適合性は評価されていない。
ELBenchは,共通プロトコルの下で同じモデル上での4つの要件(一般能力,安全性,信頼性,基礎教育,高レベル栽培)すべてを評価する最初のベンチマークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:58:23 GMT)
Mitigating Context Interference for Reliable and Efficient Search Agents [67.8] 本研究では,マルチターンサーチエージェントにおけるコンテキスト干渉について検討する。
マルチターン検索エージェントのコンテキスト干渉を動的に緩和する蒸留方式のコンテキスト精錬器を提案する。
検索エージェントのRL訓練パイプラインにコンテキスト改善を組み込むことで,信頼性と効率性を大幅に向上できることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:00:42 GMT)
SimWAM: A Simple World Action Model for End-to-End Autonomous Driving [66.9] 我々は、将来の映像予測を訓練時間監視信号として活用する、シンプルで効果的なWAMであるSimWAMを提案する。
孤立した注意マスクは、将来のフレームとは独立して行動予測を保持し、推論時に明示的な将来のフレーム生成なしに軌道予測を可能にする。
我々のSimWAMは、NAVSIM上の91.5 PDMSを達成し、最先端のWAMベースのプランナをはるかに低レイテンシで超越し、ゼロショットをnuScenesに転送する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:27:03 GMT)
StreamFlow: Dynamic Memory Flows for Streaming Video Understanding [65.1] StreamFlowは、歴史的視覚情報への動的なオンデマンドアクセスを可能にする効率的なビジュアルメモリフレームワークである。
最先端のストリーミングビデオ理解性能を達成し、StreamingBenchの全体的な精度は67.73%に達した。
バニラ設定とは対照的に、視覚的注意スコア(VAS)を59.1%改善し、それぞれエンドツーエンドのレイテンシとピークメモリを50.4%、21.1%削減した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:19:03 GMT)
From Interpretability to Control: Insights from Six Years of the TrustNLP Workshop [63.0] The Workshop on Trustworthy Natural Language Processingは8つの論文から6つのエディションで41に成長した。
我々は、144の手続き書類から洞察を合成し、確立されたフレームワークに根ざした6つの信頼次元に沿ってそれらを分類する。
分類研究による分析によると、真理は最も成長の早い次元である(2021-2022年、2025-2026年までに論文の37%を占める)。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:30:16 GMT)
UniProbe: A Learnable Token-Level Hallucination Detector for Large VLMs using Multi-Structural Internal Representations [61.9] LVLM(Large Vision-Language Models)は印象的な視覚的推論と対話機能を実現するが、視覚入力によるコンテンツサポートを幻覚させることが多い。
textbfUniProbeは軽量で統一された学習可能な検出器で、凍ったLVLMの不均一な計算トレースを1つの前方パスからモデル化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:01:59 GMT)
SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information [61.4] 大規模言語モデル(LLM)のベンチマークであるSPIEvalを紹介する。
SPIEvalは、10のアプリに分散された4,335の個人レコードにまたがる250のタスクで構成され、21のツールによるマルチターンインタラクションをサポートする。
最高のパフォーマンスモデルであるGPT-5.5(xhigh)は57.3%の精度しか達成せず、最も弱いモデルは16.4%である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:14:53 GMT)
ThinkRetrieve: Retrieval-Augmented Reasoning Traces for Test-Time Scaling [60.5] ThinkRetrieveは大規模な推論モデルのためのテスト時間スケーリングフレームワークである。
それぞれの中間ステップで関連する例を検索し、思考トレースに直接注入する。
標準的なテスト時間スケーリングよりも精度が一貫して向上する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:58:07 GMT)
Thinking Hard, Not Smart: Reasoning Models Fail to Ration Test-Time Compute Across Questions [59.2] この設定を研究するための試験スタイル評価フレームワークを導入する。
モデルは、さまざまな困難と価値に関する質問に対して、戦略的に共通の予算を割り当てることに失敗している。
これらの知見は, 従来の調査単位の評価では得られない, 個別の能力として, グローバルな予算配分を確立した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:23:08 GMT)
TREND-10K: A Comprehensive Dataset for Next-Generation Video Quality Assessment Based on Preference-Driven Media [59.0] 本稿では,トレンド駆動部と静的部からなる次世代包括的VQAデータセットTREND-10Kを紹介する。
トレンド駆動の部分はTREND-Searchフレームワークをベースにしており、オンラインプラットフォーム上のトレンドリストからユーザの好みプロファイルをキャプチャする。
様々なビデオタイプの統一評価を支援するために,技術,美学,AIGCトレースの3つの評価次元を取り入れた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:02:29 GMT)
Recent advances in weakly supervised learning: New supervision paradigms, assumption relaxations, and practical solutions [58.9] 信頼性差分分類と呼ばれる弱教師付き二項分類問題を新たに導入する。
次に、弱教師付き多クラス分類問題である相補的ラベル学習について検討する。
部分ラベル学習のための評価フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:44:37 GMT)
Simplex Relaxation for Discrete Diffusion [58.3] Simplax(Simplax)はディリクレ(Dirichlet)のカテゴリー拡張で、それぞれが崩壊したカテゴリ状態と補助的単純度値変数を結合する。
Simplaxは生成パープレキシティーを改善する。-無条件のOpenWebText生成におけるエントロピートレードオフ。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:58:17 GMT)
Measure, Don't Optimize: Forecasting Recovery in LLM Unlearning [57.9] J-Accessは、モデル出力経路に沿ってターゲット概念がアクセス可能な頻度を測定する推論時監査である。
我々は8つの未学習手法にまたがる398の公開未学習モデルを監査する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:16:20 GMT)
Defending against Model Extraction for GNNs with Model Reprogramming [57.8] グラフニューラルネットワーク(GNN)は、ML(Machine-Learning-as-a-Service)における高スループットアプリケーションのバックボーンとして機能する。
それでも、ブラックボックスのデプロイメントは、モデル抽出(ME)攻撃に晒される。
既存の防衛は「ユークリッドバイアス」に苦しむ
セキュリティのためにモデル再プログラミングを再利用するプロアクティブディフェンスフレームワークであるGraphRPを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:20:15 GMT)
IADD-TR: Intervention-Aware Dynamics Decoupling with Targeted Regularization for Model-Based Reinforcement Learning [57.2] IADD-TRは、IADD(Intervention-Aware Dynamics Decoupling)とTR(Targeted Regularization)を組み合わせた統合フレームワークである。
IADDは、ゼロアクションアンカーを用いて、アクション干渉段階とアクションフリー自然進化段階への遷移を分解し、堅牢な一般化のためにこの2段階の分解の非特異性を解決する。
政策学習においては,リプレイ状態の政策段階関数の効率的な影響関数からTRを導出する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:20:02 GMT)
CastFSR: A Fast--Slow--Reflect Agentic Reasoning Framework for Context-Aware Time Series Forecasting [55.1] CastFSRは、コンテキスト認識予測をFast-Slow-Reflect--ワークフローとして定式化するエージェントフレームワークである。
コンテキスト証拠を検索し、情報的なルックバックウィンドウを適応的に決定し、コンテキストが将来のダイナミクスをどう形作るのかを判断する。
予測を反復的に洗練し、時間的、コンテキスト的、ドメイン整合性を保証する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:51:09 GMT)
Multiple Scale Latents for Learned Image Compression [53.7] エントロピーモデルの効率を向上させるために,階層型潜在表現を提案する。
複数の潜在表現を異なるスケールで使用することにより、それぞれが独自のエントロピーモデルで、潜在表現の空間構造をよりよく捉えることができる。
実験の結果, この手法はコダックのVVCよりも17.9%のBDレートを低減できることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:22:20 GMT)
Mixture-of-Experts-based Entropy Model for Learned Image Compression [53.7] 学習画像圧縮のためのMoEベースのエントロピーモデル(MoEE)を提案する。
我々のモデルは、Kodakデータセット上で-16.85%のVVCよりもBD-Rateの改善を実現している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:17:39 GMT)
Quantum Incremental Learning with Mixed State Prototypes [53.3] トレーニング可能な混合状態プロトタイプに基づく新しい量子インクリメンタル学習フレームワークを提案する。
本モデルでは,最小数の量子ビットを用いて高次元特徴量を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:22:42 GMT)
Self-Evolving Embodied Agents via Skill-Harness Evolution [53.3] 身体的エージェントは、ファンデーションモデルを中心としたシステムとして、ますます構築されている。
教師付き微調整と強化学習はエージェントを新しい環境に適応させることができるが、追加のデータ、報酬、トレーニングの実行が必要である。
SHAPERは,モデルパラメータの凍結を保ちつつ,列車不要な態様適応のための自己進化型フレームワークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:55:58 GMT)
HNDiff: Haze-Noise Diffusion for Image Dehazing [52.3] Haze-Noise Diffusion (HNDiff)は、大気散乱モデルを誘導バイアスとして埋め込む新しい拡散フレームワークである。
その前処理では、画像にヘイズとノイズを段階的に付加する、ヘイズを意識したノイズスケジューラを用いたジョイントヘイズ拡散を導入する。
逆のプロセスでは、ヘイズとノイズを同時に除去してクリーンなイメージを復元する物理的に一貫した脱ヘイズ除去プロセスが導出される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:47:38 GMT)
TongGuOCR: A Layout-Aware and Token-Augmented OCR MLLM for Chinese Historical Documents [50.6] TongGuOCRは、中国古文書のOCRのためのレイアウト対応およびトークン拡張型マルチモーダル言語モデル(MLLM)である。
TongGuOCRは93.76 ARを達成し、NEDを10.43から6.15に、RO-EDを7.53から3.49に下げる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:32:23 GMT)
Share First, Route What Remains: A Unified Framework for Token-Adaptive MoE Computation [49.8] Mixture-of-experts (MoE)モデルは、最近、一定数の完全なエキスパートをルーティングする以上の動きをしている。
我々は、この依存度を、わずかにリサイクルされたフィードフォワードの専門家をキーバリューチャネルに分解することで研究する。
トークン適応型MoE計算のための統一フレームワークであるUniF-MoEでインスタンス化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:40:58 GMT)
Embedding Rotation Invariance for Provable Multi-Oriented Scene Text Recognition [49.7] 多目的テキストはシーンテキスト認識において大きな課題である。
既存の回転認識手法はテキストの向きを明示的に推定する。
これらの制限に対処するために、回転不変性をSTRフレームワークに組み込む。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:06:46 GMT)
How to Verify Consistency of Probabilistic Claims [49.5] 予測モデルの一貫性を証明するために,対話型PCPを構築する。
添加音の小さなギャップがBへの依存を除去することを示す。
我々は,対話型PCPを,自身の一貫性を証明するための予測モデルに向けた第一歩だと考えている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:41:39 GMT)
Is Convergence Inevitable? Tracing Output Homogeneity Back to Base Models [49.5] 最初のアライメント段階から意味収束が観察される。
我々は収束を明らかにし増幅することができるが、SFTデータでは導入されないことを発見した。
その結果,LMトレーニングの根底にある目的から,意味収束が自然に生じる可能性が示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:47:06 GMT)
Backdoor Decontamination Dynamics in LLM Agents [49.3] LLMエージェントは、微調整中に設置されたバックドアに対して脆弱である。
防毒単独で 元のバックドアの56%を消し去る
悪質なバックドアは、防御用のバックドアと同じ一般的なタイプの異なるトリガーを使用すると、決して持続しない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:54:26 GMT)
SeqLoc: Beyond the Single Frame for Cross-View Geo-Localization in Feature-Sparse Scenes [49.3] OpenStreetMap (OSM) を用いたクロスビュージオローカライゼーションは、構造豊かな都市環境では良好に機能するが、農村道路のような特徴の少ないシーンでは崩壊する。
CV-FSSは5つの農村地域の連続パノラマとOSMマップの整列をペアリングするベンチマークである。
次に,3つのキーコンポーネントを持つログ信頼性ボリュームを維持するオンラインテスト時間シーケンスアグリゲーション機構であるSeqLocを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:29:07 GMT)
BPG: Balancing Plasticity and Generalization for Domain Incremental Learning [48.7] ドメインインクリメンタルな学習は、モデルを事前の知識を維持しながら継続的な適応を可能にする。
2つの相補的なコンポーネントを通して、両方の課題に対処する統合フレームワークであるBPGを提案する。
BPGは、均一なアダプタベースのアプローチとハードドメイン選択戦略を一貫して上回る。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:22:27 GMT)
MVTrack: Ultrafast Appearance-Free Moving Object Tracking from Compressed Bitstreams [48.0] MVTrackはH.264ビットストリーム上で直接動作するオブジェクトを動かすための超高速トラッカーである。
VIRATでは、MVTrackは、60$times$より少ないパラメータを使用し、40$times$より少ないFLOPを必要とし、CPUレイテンシを8.6$times$に削減しながら、YOLO26nよりもパフォーマンスが良い。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:53:22 GMT)
Enhanced Filtering Algorithms for the Euclidean Traveling Salesperson Problem and its variants in Constraint Logic Programming [46.4] トラベリングセールスパーソン問題(TSP)は、コンピュータ科学における最もよく知られた問題の1つであり、多くの工学的応用で発生している。
本稿では,制約論理プログラミング(CLP)で実装された新しいフィルタリングアルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:58:02 GMT)
Surgical WAM: A World-Action Model for Data-Efficient Surgical Robot Learning [46.2] 本稿では,将来の内視鏡的観察と手術ロボットの動作チャンクを予測できる統合生成モデルであるSurgical World-Action Model(Surgical WAM)を紹介する。
手術用WAMは、まずアクションフリービデオから外科的視覚力学を学習し、固定されたアクションラベルの予算に基づいて微調整される。
4つのシミュレートされた手術作業において、ビデオプレトレーニングは平均成功率を63.5%から77.8%に改善し、ペグトランスファーでは20ポイントが絶対的に上昇した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:59:13 GMT)
Small Foundation Models of Human Cognition and Behaviour [45.9] 135Mから14Bパラメータの14モデルを、Psych-101の4つのアーキテクチャファミリでトレーニングしています。
Psych-101は160の実験から1070万の試行レベルの選択のデータセットである。
認知的に微調整された小さなモデルは、心理的実験のためのノイズ天井推定器として有望であることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:47:37 GMT)
OpenVisTool: An Open Recipe for Synthesizing Instructive Visual Tool-Use Trajectories [44.8] OpenVisToolは、視覚的ツール使用軌跡を構築するためのオープンなフレームワークである。
このフレームワークは、ツールなしでは確実に答えられないクエリを選択するのが難しいこと、ドメイン固有の軌道合成、そして監督検証の3段階で機能する。
このフレームワークを用いて、5つの視覚的推論領域にまたがるデータセットであるOpenVisTool-42Kと、同じドメインをカバーするベンチマークであるOpenVisTool-Benchを構築した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:56:49 GMT)
Evo-Bench: Can Language Models Improve Agent Harness? [44.7] Evo-Benchは、検索、オフィス、ジェネラルエージェントドメインにまたがるモデル固有のハーネス進化能力を評価するために設計された最初のベンチマークである。
トップモデルは16.6ポイントに達し、最先端の人間工学ベースラインに近づいた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:53:55 GMT)
SpeedTuning: Speeding Up Policy Execution with Lightweight Reinforcement Learning [44.7] 我々は,操作ポリシーの高速化に特化して設計された強化学習フレームワークであるSpeedTuningを紹介する。
SpeedTuningはアクションの最適な実行速度を予測し、基本ポリシーを補完する。
我々は、SpeedTuningが2.4倍のスピードアップで実行速度を大幅に改善する実証的な証拠を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:14:09 GMT)
Visual Geometry Foundation-Aware Gaussians for Single-Frame Surround-View Driving Reconstruction [44.5] 単フレームのサラウンドビューリコンストラクションは、カメラ間オーバーラップが最小限であるために、厳密な幾何学的不安定さとレンダリングアーティファクトに直面している。
フィードフォワード・サラウンド・サラウンド・ビュー・ドライビング・リストラクションのための3Dガウス・スプレイティング・フレームワークであるVGGDを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:04:33 GMT)
Can Bayesian Optimization Efficiently Find a Strong Single Expert in Neural Thickets? [44.4] 本研究では,サロゲート誘導探索により,勾配のないポストトレーニングの評価コストを大幅に削減できることを示す。
提案手法はバックプロパゲーションを必要とせず,ガウス過程を用いて効率よく候補評価を導出する。
これらの結果から, シュロゲート誘導探索は, より強力な単一専門家を育成しながら, 勾配のないポストトレーニングの評価コストを大幅に削減できることが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:41:49 GMT)
Can Released LLM Vocabularies Support Token-Level Estimation of Hidden Corpora? [44.0] まず、異なるコーパスで訓練されたBPEトークンーが安定なトークンID-分布を共有し、既知のコーパスから隠れコーパスで訓練されたターゲットトークンーへの分布伝達を動機付けていることを示す。
次に、この分布を複数の量子化傾向で近似し、局所密度重み付けを用いてトークンレベルの推定を行うQGDE(Quantile-Guided Density Estimation)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:14:25 GMT)
InterPruner: Interactive Structured Pruning via Taylor-Implicit Criterion and Language-Prior Modulator for Multimodal Object Detection [43.8] マルチモーダル物体検出はリモートセンシング、特にRGB-赤外線パラダイムに有効である。
既存のプルーニング法ではチャネルの冗長性を低減できるが、これは一方向のバックボーン用に設計されている。
我々は、RGB赤外線検出器のための最初の対話型チャネルプルーニングフレームワークであるInterPrunerを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:42:23 GMT)
SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning [43.1] 大規模な視覚言語モデル(LVLM)は、彼らの言語バックボーンから継承された安全アライメントをバイパスするために視覚入力を利用するジェイルブレイク攻撃に対して脆弱である。
我々は,学習した自己カプセル化を通じてLVLMを整列させる強化学習フレームワークであるSafeCapを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:37:59 GMT)
Robust CHSH Self-Testing with Finite-Energy GKP States [42.7] 有限エネルギーGKPCHSH試験のフルオシレータ解析について述べる。
観測されたスコアは、ベルペアの自己テストが堅牢になる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:33:28 GMT)
ENTLORE: A Graph-Grounded Benchmark for Latent Organizational Reasoning in Enterprise Question Answering [42.2] ENTLOREは、企業質問応答のためのグラフベースのベンチマークフレームワークである。
監査済みの企業世界を、定期的な文書、権威ある組織表、運用記録から再構築する。
ENTLOREには3つのソースタイプから2,341のドキュメントと907の質問が含まれており、明示的なルックアップ、クロスソースな構成、潜伏した組織的推論を含んでいる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:00:43 GMT)
HSMLA: Hierarchical Softmax Multi-scale Linear Attention for Efficient Vision Transformers [42.1] 我々は,大域的文脈に対するReLUに基づく線形注意,重要な局所特徴に対する選択的ソフトマックス改善,奥行きの畳み込みによるマルチスケールトークン表現を組み合わせたtextbfHSMLA(階層型ソフトマックス多大線形注意)を提案する。
HSMLAは高い精度と効率のトレードオフを達成しており、高密度の予測タスクで4.2times$推論時のスピードアップ、37.3%$Diceで3.2times$CT臓器セグメンテーションで3.2times$スピードアップ、94.2%$AUCで4.1times$病理診断WSIで4.1times$スピードアップを達成している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:54:31 GMT)
Spectral graph clustering with inhomogeneous latent geometry [42.0] 本研究では,情報的固有値の近似局在化のみを必要とする密度に基づくスペクトルクラスタリングアルゴリズムを開発した。
情報的固有値の位置に関する理論的予測は実世界の実験における観測と明確に一致している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:15:38 GMT)
Toward the Cognitive--Physical Limits of Embodied Intelligence through a World-Model-Centric Autonomous Racing Agent [41.4] 我々は、世界モデル中心の自律レースエージェントが、結合された限界を探索するための具体的なステップを提供することを示した。
このフレームワークは、ほとんど限界に近い成功と失敗から予測的世界モデルを学び、相互作用の進化、エゴダイナミクス、実現可能なモーション境界を捉えます。
フルスケールのシミュレートレースでは、よく訓練されたワールドモデル中心のエージェントが88.3%の相互作用の成功率を達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:01:35 GMT)
E$^3$mo-Bench: A Scalable Benchmark for Multimodal Evoked and Expressed Emotion Understanding via Bayesian Pairwise Alignment [41.4] E$3$mo-Benchは、誘発された感情や表現された感情を理解するためのスケーラブルなベンチマークである。
感情認識、オープンボキャブラリ認識、VAD(valence-arousal-dominance)評価という3ドルの補完的タスクを通じて、誘発された感情理解と表現された感情理解を評価する。
E$3$mo-Scoreは、VAD推定を改善するために、5つのモデル委員会から相補的な判断を集約するトレーニングフリーエージェントである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:05:22 GMT)
CSS Quantum LRCs with Intersecting Recovery Sets: Constructions and Bounds [41.4] まず、基礎となる古典的符号が少なくとも2つの双対最小距離を持つと仮定すると、CSSコードは$(r,t,x)$-qLRCであることと、基礎となる古典的符号が共通のリカバリセットを持つ古典的LRC(cLRC)であることを示す。
次に、サブセット・インクルージョン・マトリックスを使用してバイナリ・デュアルを含む$(r,t,x)$-cLRCsのファミリを構築し、CSS構造を介して$(r,t,x)$-qLRCsを生成します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:34:02 GMT)
Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation [40.9] 本稿では,学習効率と推論効率のバランスをとる,ストリーミングビデオ生成のための統一的なトレーニングフレームワークを提案する。
実験によると、Stream ForcingはUCF-101ベンチマークで36.6%のFVD改善で生成品質を著しく改善している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:39:05 GMT)
Towards Efficient Reasoning in LLM-Based Recommender Systems via Model Merging [40.4] 大規模な言語モデルベースのレコメンダシステムは、予測を行う前にステップバイステップの推論を生成するスロー思考モデルの採用が増えている。
既存のトレーニングベースの圧縮推論アプローチは、しばしば相当な適応コストを発生させる。
我々は,レコメンデータシステムにおける圧縮の推論のための最初のモデルマージフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:01:35 GMT)
Bayesian Symbolic Regression with Entropic Reinforcement Learning [40.4] 与えられたデータに対する後部分布から抽出するスケーラブルな手法であるERRLESSを提案する。
ERRLESSは、抽象構文木を構築することで、式を逐次構築する神経ポリシーを学習する。
ERRLESSは、ショートかつ解釈可能な式を生成しながら、Feynmanベンチマークで競合する結果が得られることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:35:30 GMT)
DSAgentBench: Can Agents Automate End-to-End Data-Science Workflows in Real Computer Environments? [40.3] DSAgentBenchは、エージェントが実際のコンピュータ環境内で完全なデータサイエンスを自動化できるかを評価する最初のベンチマークである。
実験の結果,最強のエージェントであるClaude-4.6-Sonnetでさえ56.70%のタスク成功しか達成できないことがわかった。
これらの結果から、現在のエージェントシステムと実際のデータサイエンスの間には、相当な能力ギャップがあることが明らかになった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:45:56 GMT)
Test-Time Self-Evolving GUI Visual Grounding via Reflection-Guided On-Policy Self-Distillation [40.0] 既存のモデルは通常、デプロイ後にパラメータを凍結し、目に見えないインターフェースに適応する能力を制限する。
我々は,人間に注釈を付けることなく,デプロイ後のモデルの改善を可能にするテスト時間自己進化フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:50:25 GMT)
Thought-Level Beam Search for Reasoning [39.8] テストタイムの計算スケーリングは、大きな推論モデルにおけるパフォーマンスの主要な要因である。
部分軌道上の制約付き計算割当問題としてテスト時間推論を定式化する。
Emph Thoughtレベルビームサーチを実行する推論アルゴリズムであるGambitを導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:35:54 GMT)
DriveVLA-M0: Failure-Aware Memory Augmentation for Autonomous Driving [39.6] VLA(Vision-Language-Action)モデルは、エンドツーエンドの自動運転において有望なパラダイムとして登場した。
本稿では,障害対応の潜時メモリを備えた検索拡張VLAであるDriveVLA-M0を提案する。
DriveVLA-M0はメモリの追加で効率よくスケールし、メモリ拡張によるトレーニング不要のパフォーマンス向上を可能にする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:01:46 GMT)
Quantum steering is equivalent to state-preserving conditional expectations [39.0] 無限に多くの自由度を持つ系では、量子情報理論の基本的な結果は失敗することがある。
我々は、$B$の測定により、境界状態のアンサンブル分解を$A$で行う能力は、状態保存条件付き期待値の存在と等価であることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:43:31 GMT)
GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes [38.6] GESTOは原子間相互作用と目標駆動イベントの2レベル階層を持つ永続的な4次元シーングラフである。
RGB-D観測ストリームから、GESTOは自動的にタイムスタンプされたインタラクションを抽出し、永続的なシーンエンティティに基底を置き、イベントにグループ化し、不確実なオブジェクト関連を精査する。
リレーショナル・アウェア・ツール呼び出しエージェントは、アクティビティ中心の時間的推論のために結果のメモリをクエリする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:03:33 GMT)
JEPA-WAM: Stage-Level Joint-Embedding Prediction for World-Action Models in Robot Manipulation [38.3] 汎用ロボット政策は多モード観察と言語課題指示を多様なタスクにわたる行動にマッピングすることを目的としている。
この短期的未来は、アクション実行のためのローカルシーンの進化をキャプチャするが、タスクが現在のステージから次のステージへとどのように進むかを明確に記述していない。
本稿では,JEPA-WAMについて紹介する。JEPA-WAMは,目標条件付きJEPA予測器であるStage-JEPAを用いて,モータスをベースとした世界行動モデル(WAM)を拡張したものである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:33:12 GMT)
VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback? [38.3] 視覚言語モデル(VLM)は、テキストやビジュアル仕様から視覚化コードを生成する強力な能力を示している。
VisEditBenchは、1,395のビジュアライゼーションコード編集タスクのベンチマークで、現実的なビジュアライゼーションと障害ケースに基づいています。
提案するVisEditAgentは,候補編集を反復的に生成し,実行し,検証し,精査するレンダリンググラウンド編集フレームワークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:52:23 GMT)
Evidence-Grounded Trustworthy Multimodal Reasoning and Evaluation Benchmark in Complex Urban Scenes [37.7] 本稿では,AD2-Benchを導入し,推理を構造化されたエビデンス連鎖(CoE)に分解する。
この観点から、著者らは、空間的曖昧性と意味的不確実性という、推論失敗の2つの主要な原因を特定した。
次に、Evidence-grounded Visual Reasoning (EGVOR)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:23:07 GMT)
Bounds for Pure Disjoint $(r,δ)$-Quantum Locally Recoverable Codes [37.0] 安定化器構造を仮定することなく, 純粋不整合$(r,)$-quantum局所回復可能符号 (qLRCs) について検討する。
回収ブロック内において, 局所的なKnill-Laflamme条件を最大1ドルまでの消去条件で定式化する。
ブロックワイドショアラフラムとユニタリウェイト列挙器を導入し、リカバリセット間でエラーウェイトがどのように分散されているかをキャプチャする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:48:28 GMT)
Multi-Level Evidence Aggregation for Robust Facial Phenotype Retrieval in Rare Genetic Disorder Prioritization [36.9] 本稿では,顔表現のための推論時間多段階エビデンスアグリゲーションフレームワークを提案する。
このフレームワークは、同一個人からの複数の画像の埋め込みレベル患者アグリゲーション、患者重み付き障害セントロイド、およびハイブリッド個人セントロイドスコアを組み合わせる。
トレーニング中の障害(GMDB-Freq)、不明な障害(GMDB-Rare)、およびマルチイメージの患者サブセットを対象に、GMDB v1.1.4のアプローチを評価した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:12:44 GMT)
DuplexWorld: Can voice agents help you get through the day? [36.9] 音声合成(S2S)音声エージェントは、顧客ケアや消費者のための日次コンパニオンとして、ますますエンタープライズに組み込まれつつある。
既存のベンチマークでは、本当に重要な軸に沿って音声エージェントを評価することができず、データベースに対するエージェントツールの呼び出しのテストとして形作られています。
私たちは、日常的な活動がもたらす会話の多様性を適切に説明できないと信じており、エージェントがデータベース操作を超えたタスクをいかに忠実に支援できるかを決してテストしません。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:34:39 GMT)
OccAnyScene: Towards Unified Indoor-Outdoor 3D Occupancy Prediction [36.6] クロスシーン3Dセマンティック占領予測は、異種シーンを扱うために単一のモデルを必要とする。
OccAnySceneは,予め訓練された深度基礎モデルに基づいて構築された画素フラストム中心のガウスフレームワークである。
OccAnySceneは、室内のOcc-ScanNetで59.92% mIoU、屋外のSurroundOcc-nuScenesで23.06% mIoUを達成した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:40:23 GMT)
SKILLER: Language-Level Reinforcement Learning for Reusable Skill Extraction in Small Language Models [36.5] SKILLERは、小型モデルのエグゼクタ固有のスキルを自動的に生成するように設計された強化学習フレームワークである。
小モデルエージェントシステムを環境として扱い、自然言語を通して全ての強化学習信号を伝播する。
絶対利得は9Bモデルの4.3から20.4ポイント、4Bモデルの1.8から13.3ポイントである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:22:02 GMT)
Hardware-in-the-Loop Phase-Aware CNN for Real-Time 5G Channel Estimation [36.2] このデモでは、ハードウェア・イン・ザ・ループ5Gプラットフォームから収集したデータを使用して、リアルタイムでAIベースのアップリンクチャネル推定を行う。
デモの間、参加者は、キャプチャーされたハードウェア生成DMRS観測を使用して、リアルタイムCNN推論とチャネル再構築を観察する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:45:37 GMT)
Recovering Wasted Compute in Autoresearch Agents [35.7] 自動検索システムのコアにおけるモデリングパイプラインについて検討し、一般的な障害モードを同定する。
自動検索エージェントの性能向上は,エージェント設計だけで達成できることが判明した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:15:08 GMT)
Post-Calibration Reliability Reranking of Relevance Decisions via Label-wise Monotone Projection [35.7] Web検索、製品検索、質問応答検索システムは、関連ラベルと信頼度スコアを各クエリ候補ペアに割り当てることが多い。
不正な信頼がシステムが誤った予測を過度に信頼したり、不必要に正しい予測を遅らせたりする可能性があるため、ポストホックキャリブレーションが必要である。
このギャップをラベルワイドモノトン信頼性投影 (MRP) で解決し、ラベルワイドモノトン関数を学習し、信頼度を正しさの信頼性にマップする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:51:35 GMT)
Weightless Fine-Tuning: Personalizing LLMs via Logit-Space Transport [35.1] Weightless Fine-Tuning (WFT) は、教師付き適応の分布効果を更新なしで近似する訓練なし復号時間法である。
WFTはデータセット間で最高の平均パフォーマンスを達成し、個々のタスクでSFTにマッチまたは超過し、他の軽量ベースラインを平均で上回る。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:49:03 GMT)
Oraqle: An Empirical Analysis of Qubit Readout and Discriminators in Quantum Error Correction [34.8] 量子誤り訂正(QEC)は、フォールトトレラント量子コンピューティングへの最も有望な経路である。
我々は、qubit-statereadoutとそのQECパフォーマンスへの影響を評価するエンドツーエンドのベンチマークフレームワークであるOlaqleを紹介した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:07:26 GMT)
Is There Really a Camouflaged Object? Towards Realistic Camouflaged Object Detection [34.4] カモフラージュされた物体検出(COD)は、周囲に視覚的に隠された物体を分割することを目的としている。
既存のCOD法の多くは、各入力画像がカモフラージュされたオブジェクトを含むと仮定して、クローズドワールドな仮定の下で開発されている。
この仮定は、純粋な背景や非迷彩オブジェクトによる現実的なシナリオを無視し、既存のモデルがオープンワールド環境にデプロイされた時に深刻な偽陽性を発生させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:57:40 GMT)
MoE Proxy Models for Low-Cost Failure Reproduction and Diagnosis in LLM RL Post-Training [34.4] 本稿では,Huawei Ascendプラットフォーム上での大規模RLトレーニングにおいて発生する障害を系統的に解析する。
低コストな断層調査と補助診断のためのプロキシモデル構築法を提案する。
実験の結果, プロキシモデルでは, アクセラレーション要求を50%-87.5%削減し, ステップ毎のNPU時間あたりの33.3倍のコスト削減を実現していることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:50:48 GMT)
Ex-Omni-2D: Expressive Omni-Modal Dialogue Models with Native Visual Presence [33.9] 視覚応答を生成するオムニモード対話フレームワークである textbfEx-Omni-2D を導入する。
このモデルは、シーン、感情、動きを記述した構造化されたtextitVisual Thought Plan (VTP) を予測し、その後に応答テキストとネイティブなマルチコードブック音声ユニットが続く。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:37:11 GMT)
Trigger the Straggler: Load Hijack on Mixture-of-Experts LLMs [33.9] エキスパート並列性(EP)は、複数のGPUにまたがる大規模なMixture-of-Experts(MoE)モデルを提供する一般的な戦略である。
この手順は、サービススケジュールにおいてサプライチェーン攻撃面を公開する。
本稿では、悪意のあるモデルプロバイダがチェックポイントのルータのみを重み付けするLoad Hijackを紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:57:22 GMT)
Auditing Chinese Web-scale Corpora via Sampled BPE Token Statistics [33.6] そこで我々は, 少量のサブセットをサンプリングし, 汚染トークンを抽出するためのBPEトークンライザを訓練する, 軽量なトークンレベル監査パイプラインを提案する。
実験によると、Sampred-BPEは実行時とメモリを大幅に削減しながら、使用可能な見積を保存する。
汚染のレビューと追跡を支援するために、660k以上のトークンレコードを持つ階層的な中国のWebトークンデータセットをリリースする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:58:06 GMT)
Adaptation of Generalist Robot Policies with Minimal Data [33.3] 我々は、訓練済みのロボットポリシーが1つのデモから新しいタスクを学習し、その後に自律的なオンラインインタラクションを行う体制である、最小データ適応について研究する。
MiDASは、単純なオフラインからオンラインまでのRLレシピで、まずトレーニング済みのVLAをターゲットタスクに固定し、シングル/フェーのデモで振る舞いのクローンを行い、その後、残留ポリシーパラメータ化による値ベースのオンラインRLにより改善する。
LIBEROとRoboCasa全体で、MiDASは1つのデモから強いタスクパフォーマンスを回復し、ベースラインを大幅に上回り、実証された条件を超えて一般化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:15:26 GMT)
ConRub-Med: Reinforcement Learning with Consensus Rubrics for Open-Ended Medical Question Answering [33.3] 検証可能な報酬を伴う強化学習は数学やコーディングにおいて特に効果的である。
ConRub-Medを導入し,建設から政策最適化へのルーブリックフィードバックの移動に伴い,有用性を維持する。
ConRub-Medは9つのベンチマークのうち6つにランクインしている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:48:15 GMT)
InSight-doc: Agentic Visual Perception for Long-Document Understanding [33.2] InSight-docは、視覚解像度を適応的推論時間リソースとして扱うエージェント型視覚知覚フレームワークである。
領域レベルのズームイントラジェクトリを用いた17.9Kの高品質SFTのアクティブパーセプションコーパスを構築した。
InSight-doc-8Bは、文書VQAベンチマークよりも4.3-16.4の精度でベースラインを改善する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:15:16 GMT)
ThinkAfford: Affordance-Centric Reasoning for Fine-Grained 3D Grounding in Cluttered Scenes [32.7] タスク駆動型3Dアベイランスグラウンドは,自然言語命令で指定された動作を可能にする散在する3Dシーンにおいて,機能領域をローカライズすることを目的としている。
本稿では,ThinkAffordについて紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:36:16 GMT)
Probing and steering biology across Boltz-1s trunk-diffusion boundary [32.5] 我々は、線形プローブ、スパースオートエンコーダ、因果介入を用いて、Pairformer trunkおよびBoltz-1の拡散モジュールからの残基当たりの活性化を分析する。
訓練されたトランクおよび拡散SAE,Boltz-1/residueアクティベーションおよび解析コードをリリースする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:25:42 GMT)
A Modular Agentic Framework for Synthetically Constrained Multi-Objective Hit-to-Lead Optimization [32.4] 本稿では,化学構造最適化を導くオープンソースフレームワークであるSABLEを紹介する。
SABLEはLLMを使用してユーザ定義の目標を解釈し、タスクをルーティングする。
特殊なツールは、反応測定されたアナログ列挙、物理化学的およびADMET特性予測、構造に基づく親和性スコアリング、ベイズ最適化を実行する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:50:56 GMT)
Bootstrapping Vision-Language Model for Hysteroscopic Surgical Scene Segmentation [32.4] 本稿では,第1の視覚言語モデル (VLM) を用いた手術シーン分割法を提案する。
我々のVLM-hysterは、トレーニング済みの画像エンコーダを用いて、堅牢な視覚特徴抽出を行うセグメンテーションバックボーンを備えている。
以上の結果から,VLM-hysterは手術器具や手術病変の局所化をAIで支援する上で有意な可能性を示唆した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:33:50 GMT)
OmnilingualGAIA2: Evaluating the Multilingual Gap in Frontier AI Agents [32.2] 我々は,GAIA2エージェントベンチマークの機械翻訳拡張であるOmnilingualGAIA2を紹介する。
我々は8.8-18.4 pass@3の普遍的な言語間ギャップを見つけ、これは大きさがエージェント非対称であり、量的推論よりもツール整合に集中し、モデルスケールに近づかない。
人間の専門的な言語分析は、非ラテン文字言語の主要な失敗メカニズムとして、形態的キューの喪失と曖昧さの増幅をさらに特定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:49:45 GMT)
PRMU: A Corpus-Free Benchmark for Person-Centric Knowledge Unlearning in Multimodal Large Language Models [32.0] 我々は,現実的な人中心の削除要求の下で,コーパスのないマルチモーダル・アンラーニングを評価するためのベンチマークであるPRMUを紹介する。
PRMUは自然に獲得した人的知識に着目し、モデルが関連する知識を保持しながら対象の知識を除去できるかどうかを評価する。
さらに、知識変位、保護されたパラメータ空間編集、局所性を考慮したマルチモーダル制御を備えた軽量なコーパスなし未学習ベースラインであるSGPE(Simisity-Gated Projection Editing)を紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:09:28 GMT)
Retrieval-Corrected Conformal Prediction for Time Series [31.9] Conformal Prediction (CP) は、固定予測器に対して分布のない予測間隔を提供する。
最近の時系列CP法は,最近,重み付け,あるいは局所化残差を用いた局所キャリブレーションを改善する。
局所キャリブレーションは、広範囲の残留重み付けや追加の適応手順が、現在の予測に最も関係のある証拠を減弱する可能性があるため、間接的に継続することができる。
本稿では,時系列予測区間に対する検索拡張キャリブレーション手法である検索補正等式予測(RCCP)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:43:01 GMT)
MARCO: Click-Intent Decomposition for Calibrated Ads Conversion Prediction [31.4] 産業広告ランキングでは、コンバージョン確率をクリックスルーレート(CTR)とクリック後コンバージョンレート(CVR)に切り離している。
同じ広告上の異なるクリックタイプは、実際のコンバージョン率の4倍の違いを示す。
これらの信号を混同することで、標準のCVRモデルは、高インテントクリックを過度に予測し、低インテントクリックを過度に予測する。
我々は,各クリックを意図的に分解することで,このバイアスを解決するフレームワークであるMARCOを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:49:59 GMT)
PBD-AG: Persistent Baseline-Delta Active Graphs with Uncertainty-Aware Inspection for Long-Horizon Service Robots [31.2] 長距離サービスロボットは、目に見えない環境で自律的に構築できる永続的な世界モデルを必要とする。
本稿では,ロボットが検証した安定なフィクスチャを,変更可能な動的オブジェクトイベントから分離する,永続的ベースラインデルタアクティブグラフフレームワークPBD-AGを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:03:54 GMT)
Better, Faster, Stronger: Programmatic Skill Learning Best Reduces Agent Cost [31.0] さまざまなスキル学習手法の中で,スキルをプログラムとみなす者は,最高のコスト削減を実現することができる,と我々は主張する。
SpeedRunnerは、将来のタスクのパフォーマンスを改善するために、軌道とスキルを分析するコーディングエージェントである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:42:23 GMT)
MIRA: Medical Image Reflection for Agentic Diagnosis [30.5] 医用視覚エージェントは画像の検査や外部知識の検索を行うことができるが、識別できない道具の使用はノイズや誤解を招く証拠をもたらすことがある。
MIRA(Medical Image Reflection for Agentic Diagnosis)は,自律的証拠探索と反射的検証のための医用視覚診断フレームワークである。
MIRAは、ズーム、グラウンド、ポインティング、回転、測定などの画像処理操作とWeb検索を動的に実行し、取得した証拠の妥当性と一貫性を評価している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:57:27 GMT)
R4DSG: Relative 4D Scene Graph Memory for Object-Centric Question Answering in Long Egocentric Video [30.0] R4DSGは、長いエゴセントリックなビデオのための相対的な4Dシーングラフメモリを導入している。
生のグラフシーケンスを保存する代わりに、R4DSGは動画をコンパクトなクエリ可能なメモリエントリに変換する。
EgoLifeQAの255項目のオブジェクト関連サブセットの評価では、質問のみの検索では、EgoRAG-Textよりも6.7ポイントの全体的な増加が見られた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:00:15 GMT)
AutoPSO: A Metaframework for Automated Particle Swarm Optimization [29.7] 粒子群最適化はメタヒューリスティックとして広く用いられており、その単純さと小さなパラメータセットで評価されている。
既存のアプローチの多くは問題固有で手作りであり、クロスタスクの一般化は不十分である。
我々は、カスタマイズされたPSOアルゴリズムを構築するための高度に自動化されたメタフレームであるAutoPSOを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:42:18 GMT)
Beyond Fixed Luminance: Towards Panchromatic and Orthochromatic Image Colorization [29.0] フルRGB画像編集としてカラー化を定式化する輝度非依存のカラー化フレームワークを提案する。
COCO, ImageNet, およびマルチインスタンスベンチマーク実験により, 本手法は標準グレースケール入力と競合することを示した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:12:24 GMT)
ImpactHO: Importance-Aware KV Cache Transfer for Multi-User Edge LLM Handover [28.9] 同時ハンドオーバはバックホールを飽和させ、モビリティが付与された転送ウィンドウ内で完全なキャッシュ配信を防止する。
我々は、各ユーザのKVキャッシュを重要度で注文し、最も情報性の高い分数だけを送信し、トークンレベルのスパーシリティを通信節約に変換する。
提案したアロケータは500msの転送ウィンドウで平均93.7%以上の精度を達成し、フルキャッシュ天井の0.5pp以内で、透視上界の98.2-99.5%に達する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:37:10 GMT)
Mapping and Measuring the Behavioral Evolution of Large Language Models [28.6] ベンチマークのリーダーボードは、言語モデルのパフォーマンスを概説するが、その振る舞いが他のモデルとどのように関係しているか、世代によって異なる。
1万のプロンプトの共有バンクに対する応答を用いて、6つのファミリーから32モデルの出力挙動を特徴付ける。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:07:28 GMT)
AdvFD: Boosting Visual Generation via Adversarial Fr'echet Distance Loss [28.3] フレシェ距離は、ジェネレータ後訓練の効果的な分布レベル目標として現れている。
本稿では,FD-Lossにおける静的な表現対象を正逆的に学習した表現で拡張するAdrial Fréchet Distanceを提案する。
実験の結果、AdvFD は JiT と pMF のバックボーンをまたいだ1ステップのジェネレータを継続的に改善している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:59:56 GMT)
Archer: Adaptive Reuse of Cached Hidden States for Efficient Rollback in Diffusion Language Models [28.2] 拡散言語モデル(DLM)は反復的にシーケンスを洗練し、コンテキストが進化するにつれて、以前の予測を修正できる。
更新毎にグローバルコンテキストが変更され、プロンプト状態とレスポンス状態の両方が再コンパイルされる。
効率的なロールバック(アーチャー)のための隠れた状態の適応的再利用について紹介する。
Archerは、ロールバック可能なDLMのためのトレーニング不要なKVキャッシュ手法である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:16:53 GMT)
Hidden in Plain Sight: Diffusion-Based Unrestricted Robotic Attacks on Vision-Language-Action Models [28.1] VLA(Vision-Language-Action)モデルは、さまざまな操作タスクにわたってロボットを制御する強力な能力を示している。
既存のVLAモデルに対する攻撃は、しばしばピクセル空間の摂動やホワイトボックスアクセスに依存しており、現実のロボットシステムにおいて顕著な成果物と限定的な展開性をもたらす。
本稿では,VLAモデルに対する視覚的に自然な逆襲パッチを生成する拡散型非制限ロボット攻撃であるDURAを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:41:08 GMT)
Beyond Pixels: From Video Priors to 4D Worlds [27.9] 4D生成はテキストや画像などの条件から動的3Dシーンを合成する。
既存の方法は、別々の4DモデルでRGBビデオを生成するか、特定のビデオジェネレータを適用して幾何学を直接予測するかのいずれかである。
我々は、直接潜伏4D生成を導入し、それを潜伏4Dとしてインスタンス化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:02:41 GMT)
What We Know about Responsible AI Practices in Industry: A Half Decade of Empirical Research [27.9] 責任AI(Responsible AI, RAI)は、テクノロジー企業、規制当局、そして一般大衆にとって中心的な関心事となっている。
この研究は6年間にわたる161の実証研究の文献レビューを通じて、現在の知識を合成する。
我々の合成は、産業RAI実践における有意義な進歩と永続的な課題の両方を明らかにします。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:29:48 GMT)
Hunyuan3D-Buffalo 1.0: A Unified Multimodal Model for Scalable 3D Generation, Understanding, and Editing [27.8] Hunyuan3D-Buffalo 1.0は、単一のアーキテクチャ内での3D理解、テキストから3D生成、命令ガイド付き3D編集、テキスト地上部分生成をサポートする統一フレームワークである。
実験の結果,Hunyuan3D-Buffalo 1.0はテキスト・ツー・3D生成と3D編集のベンチマークで最先端ないし先進的な性能を実現していることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:39:05 GMT)
Watching Synthetic Videos: Aligning Cross-modal Representations with Visual Synthesis for Zero-shot Video Captioning [27.6] 本稿では、2つの訓練段階からなる新しいゼロショットビデオキャプションフレームワークを提案する。
推論中、入力ビデオは、予め訓練された3DカソーサルVAEによって符号化され、直接プロンプトに供給され、GPT-2を誘導して最終キャプションを生成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:57:44 GMT)
SapiensID 2.0: Aligning Human Recognition Foundation Models with Human Perception [27.4] SapiensID 2.0は、意味的および時間的認識の両方に富んだ人間の認識フレームワークである。
サピエンスID 2.0は、画像や映像に基づく人物の認識と歩行認識において、頑健な顔認識能力を維持しながら、性能を向上することを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:13:05 GMT)
The Devil Is in the Interface: Evaluating How Tool Architecture Shapes Coding Agent Behavior [27.3] 我々は,リポジトリレベルの問題修正に関する制御実験を通じて,コーディングエージェントのツールアーキテクチャについて検討する。
私たちの実験では、ツールが同じような機能を提供する場合でも、ツールアーキテクチャがエージェントの振る舞いを変えることが示されています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:50:56 GMT)
MedUP: Awakening Unified Understanding and Perception in Medical Vision-Language Models [27.3] 本稿では,共有トークン空間内での認識と理解を統一するMed-VLM MedUPを提案する。
コアとなるUniMedTokは、LLM語彙の個別トークンとしてマスクをエンコードするリージョントークンである。
We curate UniMed-Train, a 1.84M-instance corpus across text-guided segmentation, region-grounded understanding, Medical VQA and CoT-based segmentation, and introduced UniMed-Bench for unified evaluation。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:22:13 GMT)
Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution [26.9] 研究アイデアのための2段階のフレームワークであるTree-of-Ideas(ToI)を提案する。
EvoTracesは、引用から学際的な分岐軌道を再構築し、進化する手法を追跡し、解決した問題とギャップを追跡。
するとEvoAgentは、軌道を横断して収束した問題と相補的な解を識別し、基礎研究のアイデアを生み出す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:56:55 GMT)
Mechanism Design for Generative Engines: From Exploitation toward Win-Win Outcomes [26.6] 生成エンジンは、引用を注意、帰属、下流の価値を割り当てる重要なメカニズムにすることで、Webエコシステムを再構築している。
コンテンツプロバイダはモデル引用を最適化するためにインセンティブを得ており、プラットフォームは回答の品質と信頼できる貢献を保たなければならない。
我々はこの緊張が引用戦争にエスカレートすることを示した。
本稿では,検証可能なコンテンツ報酬に基づいて,VCRと呼ばれるプラットフォーム作成機構を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:57:44 GMT)
ProTAGAD: A Foundation Model for TAG Anomaly Detection with Decoupled Topological and Textual Prototypes [26.5] 分離された位相とテキストのプロトタイプを特徴とするTAG異常検出のための新しい基礎モデルを提案する。
我々のフレームワークは、構造的正規性と意味的一貫性を独立にモデル化するために、2つのプロトタイプバンクを構築します。
本手法は,クロスドメイン設定における最先端性能を一貫して達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:20:04 GMT)
FaithformBench: Benchmarking Faithfulness of Mathematical Chain-of-Thought Autoformalisation [26.1] 自動形式化システムは、自然言語推論のステップをリーンのような証明アシスタントの形式的なステートメントにマッピングします。
既存のアプローチでは、人間に注釈を付けた高価な真実を必要とするか、LLMの審査員や埋め込みモデルに依存している。
本稿では,AF忠実度に関する新しいベンチマークを提案する。これは適用が安価で,仮定が弱く,肯定的,否定的な両例を評価できる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:36:52 GMT)
Path Integral Value Matching for Linear Quadratic Stochastic Optimal Control [26.0] 現在の最先端のポリシーベースの手法は、計算コストの禁止と不安定さに悩まされている。
経路積分制御(PIC)の再検討による価値に基づくアプローチへのパラダイムシフトを提案する。
この理論的基礎に基づいて,パス積分値マッチング (PI-VM) アルゴリズムを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:29:49 GMT)
PEAK: Precise and Persistent Concept Erasure via k-Sparse Autoencoders [26.0] 大規模なテキスト・ツー・イメージ(T2I)拡散モデルによる概念の消去は、著作権侵害、プライバシー侵害、攻撃的コンテンツに対する懸念が高まっているため、ますます重要になっている。
我々は,k-Sparse Autoencoders (kSAEs) を用いたtextbftextitprecise と textbftextitpersistent の概念消去フレームワーク PEAK を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:38:01 GMT)
dots.tts.edit: Precisely Controlled Speech Editing with a Continuous Autoregressive Model [25.8] 本稿では,XMLスタイルのタグを用いた音声編集のための,正確で明示的なインタフェースについて検討する。
インターフェイスをdots$.$tts$.$editでインスタンス化する。
バイリンガル評価スイートであるdoteBenchについても紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:29:29 GMT)
HUI360: A 360° Egocentric Dataset and Baselines for Human-Robot Interaction Anticipation [25.8] HUI360は,野生における人間とロボットの相互作用予測のための最大のデータセットである。
データセットは3ヶ月以内に、野生の移動ロボットから複数日間にわたって収集された。
我々は、詳細な2Dポーズ、顔のキーポイント、セグメンテーションマスクを含む、1Mの事前処理されたアノテーションのHUI360オープンセットをリリースする。
また、ロボットの自我中心の視点から捉えた、生の360度画像も公開しています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:22:14 GMT)
ReOrder-OPD:Reliability-Aware Prompt Ordering for On-Policy Distillation [25.7] 我々は,教師が生徒の接頭辞から正しい回答を得られる確率として,プロンプトレベルの教師継続信頼性を$R$と定義する。
我々は、高いR$プロンプトがより大きなOPDゲインをもたらし、下降するR$トレーニングがランダムな順序と上昇順序より優れていることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:27:56 GMT)
Contextual Information Policy Optimization for Search Agents [25.6] 我々は,政策最適化と外部エビデンス利用の整合を図るために,文脈情報政策最適化(CIPO)を提案する。
CIPOは、検索された情報に影響された推論行動にターンレベルクレジットを割り当て、このエビデンス利用信号とグローバルな結果報酬を組み合わせて、回答の正当性を維持する。
実験によると、CIPOは事前駆動推論の頻度を減らし、ほとんどのタスクにおいて優れたパフォーマンスを達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:08:54 GMT)
Flex-$π$: A Multi-Stream World-Action Model with Compute Flexibility [25.5] RGBをエンコードする冷凍ビデオ生成VAEも、3Dのポイントマップをほとんど無傷でエンコードしており、ポイントマップ固有のトレーニングは一切ない。
これにより、RGBとともに3D幾何学とオブジェクト中心のDINOセマンティクスに基づいてFlex-$、6BパラメータのWAMを監督することができます。
すべての視覚信号がこの共有潜在空間に投影され、Mixture-of-Transformersバックボーン内のアクションと共同で識別される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:33:51 GMT)
GeoForge: Non-Parametric Self-Evolving Agents for Earth-Observation Reasoning [25.4] 我々は、完成した軌道を構造化された非パラメトリックな実行状態に変換する、トレーニング不要で自己進化的なフレームワークGeoForgeを提案する。
GeoForgeは、センシングコンテキストに従って操作空間を制約し、3つの補完記憶からタスク条件付きを検索する。
各タスクの後、安全ゲート蒸留プロセスは、接地された軌跡を将来の検索のための再利用可能な実行知識に変換する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:11:10 GMT)
DynaPPI: A Large-scale Dynamic Protein Dataset for AI-driven Advances in Protein Interactomics [25.4] 分子動力学(MD)に基づく動的タンパク質データセットDynaPPIについて検討した。
このデータセットから得られる拡散モデルは、既知の錯体の動的結合軌跡を明示的に学習し、その多様な生成特性に基づいて未知の錯体の構造を正確に予測することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:32:32 GMT)
MultiModal Code-Switching: Interleaving Visual Objects into Language for Explicit Object-Level Alignment [25.3] MultiModal Code-Switching (MMCS)は、オブジェクトレベルの明確な監視を提供する新しい事前トレーニングパラダイムである。
MMCSは、テキストエンティティを対応する視覚オブジェクトに置き換え、局所的な視覚言語接地を強制することによって、視覚と言語をインターリーブする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:28:52 GMT)
Dual-Loop Self-Evolution via Verifiable Emotion Feedback for Multi-Turn Empathetic Dialogue [25.1] 共感的サポートは本質的にマルチターンとパス依存である。
既存の方法は、トレーニングのインタラクション分布を固定しつつ、対話ポリシーを進化させる。
検証可能な感情フィードバックによって駆動されるデュアルループ自己進化フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:14:01 GMT)
Position: Robot Privacy as Embodied Boundary Work. Connecting Capabilities, Contexts, and Design Responses in Everyday Robotics [24.4] 本研究では、ロボットが位置する相互作用において、プライバシー境界をどう形作るかを調べるための、コンテキスト・フレーミングとして、境界プライバシーを具体化することを提案する。
このフレーミングは、7つのロボット機能と5つのデプロイメントコンテキストにまたがるプライバシーリスクを整理する。
我々はこの視点を用いて、プライバシーの具体化メカニズムの設計と研究の意義を概説する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:03:26 GMT)
MergirafSemi: A Language-Agnostic Semistructured Merge Tool [24.3] コンカレントな変更を統合する場合、開発者はしばしばマージコンフリクトに直面します。
ほとんどのマージツールは、構造化されていないラインベースの比較に依存しており、しばしば急激な衝突を引き起こし、実際の衝突を欠いている。
本稿では,言語に依存しない半構造的マージツールであるMergirafSemiを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:52:13 GMT)
Let it Cook: Learning to Wait in Sequential Decision Making [24.3] 待ち時間を決定する“待機ポリシー”をトレーニングします。
これは、一連の時間ステップに対する故意の一時停止を表す、待機アクションにコミットするために、センシングを強制することを含む。
提案手法は,待機行動の学習に成功し,事前学習したポリシーを適切なタイミングで待つことができることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:55:30 GMT)
Pair-Centric Graph Rewiring for Over-Squashing via Optimal Transport-Guided Communication Alignment [24.2] グラフのリワイアリングはオーバースカッシングに対する構造的応答を提供する。
変更予算が限られているため、重要な疑問は、どのペアワイズ通信が構造的サポートを必要とするかである。
本稿では,ペア中心グラフ再構成フレームワークであるPairAlignを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:05:32 GMT)
MasDrift: Benchmarking Authorization Preservation Across Multi-Agent Architectures [23.9] MasDriftは8つのドメインにまたがる600の生産性タスクのベンチマークである。
MasDriftは、階層の深さとピア幅を変えながら、単一エージェント、集中型、分散化されたコーディネーションを比較する。
我々は,認証証拠の在り処で異なる2つの防衛措置を比較した。一方は,元のユーザ要求に待ち受けている毎回再審理を行い,もう一方はデリゲートチェーンに沿って緩和された政策を実行する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:14:50 GMT)
Calibrating Post-Training Feature Shifts for LLM Data Contamination Detection [23.8] 大規模言語モデル(LLM)は、著作権やプライバシーに敏感なコンテンツを含む可能性のある、大規模で開示されていないコーパスで訓練されている。
データ汚染検出(DCD)は、あるテキストが対象LLMの事前学習コーパスのメンバーであるかどうかを判定することを目的としている。
近年の最先端DCD手法は,入力テキストと対応するモデル出力からメンバシップ特徴を導出する特徴に基づくパラダイムを踏襲している。
現代のLLMは、命令チューニング、好みの最適化、推論指向のトレーニングなど、モデル出力を変更し、対応するメンバシップ機能を変更することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:18:22 GMT)
Temporally Grounded Compositional Camera Motion Understanding via Geometric Knowledge Distillation [23.4] CamChoreoは、専門家が注釈を付けた時間セグメントを持つ4,229の実際のシングルショットクリップのベンチマークである。
CamDistillは、トレーニング中に同じ幾何学的知識を軽量カメラトークンに蒸留し、推論時に3Dモデルを削除する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:00:02 GMT)
MERA: Model Evolution and Routing with Skill Adaptation for Agentic Systems at Scale [23.3] LLMエージェントは、1つのタスクでモデル呼び出しの不均一なシーケンスを実行する。
以前のルーティング手法では、より安価な小さなモデルと大きなモデルに簡単な呼び出しを割り当てる。
MERAは代わりに小さなモデル自体を改善し、単一のモデル呼び出しを適応の単位として使用した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:28:02 GMT)
TideRL: Boosting Agentic RL Goodput with Readiness-Aware Scheduling [23.3] 大規模言語モデルのための強化学習(RL)は、マルチターンエージェントワークロードに向かっている。
この設定では、トレーニングスループットによって測定されるRLトレーニングの成果は、生のGPU占有よりも重要である。
本稿では,連続的タスク・アクター・パイプライニングと弾性資源スケーリングを備えたレジーネス対応弾性RLシステムであるTideRLについて述べる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:49:33 GMT)
Once Poisoned, Arbitrarily Controlled: A Programmable Backdoor in VLMs [23.2] 視覚言語モデル(VLM)のバックドアは通常静的脆弱性として扱われる。
プログラム可能なバックドアをVLMに埋め込むことができる。
任意のキャプション制御パラダイムの提案は、トレーニング後の標的選択を中毒から切り離す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:25:29 GMT)
Sekai2: From World Exploration to Interactive World Modeling [22.6] Sekai2(セカイ2)は、セカイの世界探査映像をインタラクティブな世界モデリングへ運ぶマルチソースのリアルワールドビデオデータセットである。
リリースには128,892のクリップが含まれている。
すべてのクリップには、被写体の動き、環境のダイナミクス、静的なシーンの内容、カメラの振る舞いを区別する、リリースされたカメラの軌跡と階層的なアノテーションが含まれており、結果として649,597の時間的接地セグメントが生成される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:05:36 GMT)
Long-Horizon AI Research for Grothendieck Constant: A Case Study in Human-AI Mathematical Collaboration [22.3] 我々は、Grothendieck定数$K_G$のバウンドを改善するためにAIがどのように使われたかを示す。
重要な点として、これらの改善は、ドメインの専門家によって新規と見なされる洞察に到達可能なAI研究システムを使用して達成された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:53:48 GMT)
Actions Speak Louder than Words: Measuring Cross-Lingual Policy Retention in Tool-Using Agents [22.3] ツール使用エージェントは別の言語で同じタスクを与えられるが、それでも同じステップを踏むだろうか?
アクションポリシーを,8つのモデル,6つの並列ベンチマーク,41の言語で測定対象とする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:18:34 GMT)
Learning Gaussian Structure: Intervention-Guided Density Control for Feed-Forward Driving Reconstruction [22.3] 本稿では,ガウス構造とプリミティブ属性の両方を強化するフレームワークであるLearning Gaussian Structure(LGS)を紹介する。
我々の重要な観察は、プルーンの局所応答の変化は、構造調整が再構成に有効であるかどうかを明らかにすることである。
そこで我々は,ガウスプリミティブから他のタイムスタンプから隣接した特徴を明示的に抽出・集約し,信頼性の高い属性予測を行う,コンパクトなクロスタイムポイントクエリを開発した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:38:55 GMT)
Convergence Guarantees of Gradient Descent for Neural Networks via Generalized Lipschitz Smoothness [22.2] 任意の幅または深さの一般フィードフォワードニューラルネットワークに対する勾配勾配の収束保証を確立する。
活性化関数はリプシッツ滑らか、リプシッツ連続、線形有界---- が線型、タン、ソフトプラス、シグモイド活性化関数に対して成り立つことを仮定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:43:50 GMT)
Gaussian Sculpting: End-to-End Controllable Surface Reconstruction via Field Optimization [22.0] 3D Gaussian Splattingは、最近、印象的な品質でリアルタイムの新規ビュー合成を可能にした。
限定的な視点で正確な曲面を復元することは困難であり、ガウス原始体の固有の不規則性のためである。
本稿では,高品質な表面再構成のためのエンドツーエンドフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:42:24 GMT)
"Operator, can you hear me?" A Faithful Line into the UNISOC Baseband [22.0] ベースバンドプロセッサは常に無線でアクセス可能である。
既存の再ホスト作業は実行環境を近似する。
代わりに、実際のデバイスの動作から、周囲のコンポーネント、コプロセッサ、SIM、アプリケーションプロセッサをモデル化します。
We called this method Unislop and demonstrate it on the UNISOC UDX710, a platform in a estimated 10-15% of cellular modems。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:51:01 GMT)
Evaluating Rational Contracting in Natural Language [22.0] 我々は,不確実な多段階環境において,エージェントが自然言語契約の交渉と実行を行うための合理的な枠組みを開発する。
2人のプレーヤーが交渉し、マルチターンサプライヤ契約を実行する評価スイートであるContractSimで、私たちのフレームワークをインスタンス化する。
現在, LLM をベースとしたエージェントは, 合意を確実に達成し, 環境不確実性が低い場合に, 効率的な契約交渉を行う。
また、契約を実行する際には、しばしば非協力的であり、契約が満足しやすい場合でも、追加利益のための契約条件に違反します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:44:50 GMT)
VIScore: Diagnosing Planning-Relevant Quality in Latent World Models [21.9] 潜在空間を等方性ガウス分布に規制することは、世界モデル計画のための安定で情報に最適化された景観を提供する。
SIGReg と VISReg の2つの正規化損失関数を同じ分布対象の異なる性質で比較して検討する。
SIGRegと比較すると、VISRegは中心、スケール、形状の正規化の重みを制御できる柔軟性が高く、バッチサイズが大きいほど分布近似が微妙になる。
符号化された予測器の到達性とキャパシティを定量化する指標であるVeracity-Influence-Sobriety score (VIScore)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:34:10 GMT)
Rationale-Guided Learning for Multimodal Emotion Recognition [21.9] 会話におけるマルチモーダル感情認識には、言語と非言語間の複雑な相互作用を理解する必要がある。
本稿では,MERCを認知に触発された推論タスクに変換する新しいフレームワークである理性指導学習(RGL)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:02:03 GMT)
Sona Technical Report [21.8] 本稿では,Yandex Musicの単一モデル生成レコメンデータであるSonaを紹介する。
Sonaは、共有ユーザ表現を中心に候補生成とランキングを統一する。
We evaluate Sona in a online A/B experiment using live traffic from My Vibe on smart speaker。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:58:26 GMT)
MAP-Graph: Provenance-Aware Shared Memory for Multi-Agent Workflows [21.6] MAP-Graphは,エージェント,ソース,メモリ,クレーム,アクションを型付き実行グラフで表現するメモリ層である。
祖先を辿り、許可なしのレコードを除外し、意味的類似性と乗法的経路信頼によって資格ある記憶を再引用し、影響された系統を監査するために保持しながら、行動実行前に危険に敏感なゲートを適用します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:31:18 GMT)
REDAgentBench: Executable Red Teaming and Faithful Measurement of LLM Agent Systems [21.5] 逆入力はエージェントと環境の間の相互作用を利用することができ、実行中にエージェントが安全ポリシーに違反する。
自律的なリピートと忠実な測定を行うためのフレームワークであるREDAgentBenchを紹介する。
明示的な安全制約と関連するエージェントシステム脆弱性から攻撃を導き、独立したサービスサンドボックスでそれらを実行し、サービスレシートと最終状態の変更による有害な影響を検証する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:48:54 GMT)
VidForensics-M1: Meta-Detection Reinforcement Learning with Verifiable Temporal Grounding for AI-Generated Video Forensics [21.4] 我々は,AIが生成するビデオ検出にtextbfmeta-detectionを導入し,信頼性の高い偽造検出を可能にする。
この知見に基づいて,ペア化されたリアルタイムビデオを生成する自動データ構築パイプラインを提案する。
textbfVidForensics-M1は、検証可能な時間的証拠を利用して、堅牢で一般化可能なAI生成ビデオ検出を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:58:10 GMT)
Aerial Layouting: Design and Control of a Compliant and Actuated End-Effector for Precise In-flight Marking on Ceilings [21.3] 本稿では,新しい「スマート」エンドエフェクタを備えた航空機による新しい航空システムを提案する。
実験では,新しいエンドエフェクタの設計選択が望ましい位置決め精度を得るために必要であることを確認した。
我々は、正確なモデリングを必要とせずに、天井の線をミリメートルの精度で確実にマークできることを実証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:41:29 GMT)
Threat-guided Policy-aware Scene Perturbation for Safe Autonomous Driving with Online Reinforcement Learning [21.3] オンラインRLを用いた安全な自動運転を実現するために,Treat-guided Policy-aware Scene Perturbation (TPSP)を提案する。
TPSPは、政策行動と周辺環境の相互作用を捉え、現在の政策に沿ったシーン摂動を可能にする。
実験により、TPSPは安全性の学習効率を向上し、約400万kmの運転データでNAVSIM v2の安全性を向上することが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:49:50 GMT)
Social Chain of Thought: A Multi-Agent Architecture Grounded in Medical Differential Diagnosis Methodology [21.1] 医学的診断的理由づけは、LSMの高影響ユースケースである。
OpenAIは、世界中のChatGPTメッセージの5%以上が医療関連であると報告している。
医学的鑑別診断のためのマルチラウンドパイプラインであるSocial Chain of Thought (SCoT)を紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:38:03 GMT)
FITTER: Vocabulary-Agnostic Cross-Domain Inference on Temporal Knowledge Graphs [21.0] 本稿では、時間的知識グラフリンク予測のための、最初の完全帰納的構造モデルであるFITTERを提案する。
FITTERは、それぞれの述語を、他者との相互作用パターンと時間によって表現し、絶対順序ではなく相対的なエンコーディングを通して表現する。
時間的エンコーディングは時間シフト不変であることが証明され、6つの時間的知識グラフベンチマーク上でのクロスドメイン、クロスグラフ転送においてFITTERを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:47:58 GMT)
Towards Unified Dynamic Face Landmark Detection [20.9] 我々は,すべての$N$-point'のデータセットを単一のデータセットに統合する顔ランドマーク検出(FLD)手法を開発した。
また、FPALPベースのクエリで各ランドマークを表現し、モダリティデコーダで徐々に洗練し、最終的な表現に基づいてその座標を予測する。
当社のアプローチはUnified Dynamic FLDと呼ばれ、これらの2つの設計選択を具現化し、単一のモデルが任意の$N$-point'データセットで学習できるようにすることで、ランドマーク検出パイプラインを合理化しています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:14:53 GMT)
Fast and Memory-Efficient Wavelet Convolutions via I/O-Aware Reformulation [20.8] Wavelet Convolution(WTConv)は、標準のコンボリューションの代替として人気が高まっている。
我々の改定により、モデル化されたトラフィックを約2.55倍に減らし、参照のトレーニング速度を最大4.35倍に向上する。
我々の改定はWTConvの利点を保ちつつ、実行時間とメモリフットプリントを大幅に削減します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:24:05 GMT)
CARD: Controlled Agentic Reddit Discussions for Credit Card Simulation [20.7] リアルなクレジットカードディスカッションスレッドを生成するためのフレームワークであるCARDを紹介する。
CARDは、返信構造、コメント機能、スタンス、トーン、会話のバリエーションに関する非バーバティムガイダンスを使用する。
我々は,レキシカル,セマンティック,ビヘイビア,構造的メトリクスを用いて,リアルクレジットカードの議論においてCARDを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:49:18 GMT)
SpotlessGS: Relightable 3D Gaussian Splatting under Dynamic Illumination for Robotic Perception [20.5] 我々はDark Gaussian Splattingをより正確でフレキシブルな3D再構成フレームワークに拡張する。
球面高調波に基づく低周波照明モデルを導入し,空間的に異なる残差と周囲の照明効果を捉える。
合成および実世界のデータセットに対する実験により,従来の手法よりもレンダリング品質と量的性能を向上しつつ,照明アーチファクトを効果的に軽減できることが示されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:35:34 GMT)
BooST: Bridging Semantics and Motions for Efficient Skill Transfer [20.4] 3つのデシラタを満たすためにセマンティクスと動きをブリッジする2段階フレームワークBooSTを紹介する。
BooSTはまず、クロスモーダルなVQ-VAEを利用してセマンティックインテントとモーションダイナミクスの両方をキャプチャし、統一されたスキル表現を生成する。
そして、この表現を、新しいタスクへの効率的な下流適応のための軽量なポリシーに蒸留する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:35:12 GMT)
Imaginative Generative AI: Crossing the Entropy Wall into Worlds Beyond Imitation [20.4] 我々は,Imaginative Generative AI (IGA)を紹介した。
IGAは、スペクトルの多様性が所定のレベルに達するものを選択する。
我々は、このエントロピーに制約のある射影の理論を開発し、KLアンカーと事前訓練されたジェネレータのアンカーの下で、最適は自己整合指数-チルト関係を満たすことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:38:45 GMT)
Self-Correcting Long-Horizon Search Agents via Tree-Structured Memory [20.4] 本稿では,検索エージェントのための自己修正木構造記憶機構ReTreeを提案する。
ReTreeは、ソースリンクされたエビデンスを保持しながら、ステップごとのコンテキスト境界を構築する。
4つの公開質問回答と検索ベンチマークの実験は、ReTreeが一貫してFull-Trajectory ReActを上回っていることを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:56:42 GMT)
Stay or Stray - A Dynamical Systems Viewpoint of Popularity Bias [20.3] 推薦システムにおける人気バイアスは、大多数のユーザクラスが不均等なインタラクションデータを生成するときに生じる。
本稿では,動的システムのレンズによるリコメンデータモデル更新とユーザエンゲージメントの複合進化について検討する。
我々は、人気バイアスが確実に出現する条件と、すべてのユーザクラスの対称保持が可能な条件を導出する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:41:24 GMT)
Multi-View Relational Distillation for Spatial Reasoning with Vision-Language Models [20.2] 視覚言語モデル(VLM)は画像と映像の理解を強く達成しているが、視覚空間表現は幾何学的に脆弱である。
本稿では,教師の特徴そのものではなく,視点にパッチワイドな類似性を蒸留する多視点リレーショナル蒸留(MVRD)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:34:41 GMT)
Conversation as Measurement in Clinical Encounters: Observable Phase Structure, Partially Observable Patient State [20.2] 多くの現代のAIシステムは、人間のインタラクションと状態の側面を推測するために会話の痕跡を分析し、そのような情報が会話から回復可能であることを暗黙的に仮定している。
134時間にわたる実世界439件の臨床診断書を用いた患者状態と会話相構造の観察可能性について検討した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:09:58 GMT)
TARL: Transaction-Aware Reliable Ledgers for Executable Memory Management in Long-Term Agents [20.1] メモリ状態更新フレームワークであるTARLを導入し、各ステートメントを5つの実行可能なアクションのうちの1つにマップする。
TARLは、影響を受けるメモリを特定し、その時間的スコープを解決し、ソースの信頼性を比較し、受け入れ、保留、拒否された台帳を更新する。
また、粒度の細かいアクションラベルと次の状態目標を持つベンチマークであるTARL-Memについても紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:23:39 GMT)
MMArt A Multi-Perspective Multimodal Dataset for Visual Art Understanding [20.0] MMArtは,74,234点のWikiArt絵画を,独立に4つの注釈付き視点と統一キャプションで注釈付けしたデータセットである。
2つの相補性解析は、視点が真に異なる情報をエンコードすることを証明している。
生成解析により,形式的解析記述は構成様式を最もよく保存し,歴史的記述は再構成された画像に強い情緒的信号を運ぶことが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:28:20 GMT)
CausalSplat: Towards Comprehensive Hierarchical Reasoning in 3D Gaussian Splatting [19.9] CausalSplatは視覚言語モデルと3Dシーングラフを統合するフレームワークで、暗黙の論理的推論から明示的な構造的知覚を解き放つ。
我々のベンチマークは、常識、空間、余裕、そして対実的推論を評価する。
CausalSplatが私たちの推論ベンチマークでアートパフォーマンスの状態を達成していることを示す実験結果が得られた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:09:49 GMT)
Dynamic Context Adapters: Efficiently Infusing History into Vision-and-Language Models [19.9] 事前学習型視覚言語モデル(VLM)のための新しい文脈注入手法である動的文脈適応器(DCA)を導入する。
本手法では,フレーム結合を伴わずに歴史的意味を保存するために,固定サイズの動的圧縮メモリを用いる。
DCAは、FLOPの注目度を25%以上削減し、13%のメモリ節約を実現し、ロングホライゾンタスクのパフォーマンスを改善している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:05:05 GMT)
Benchmarking LLM Judges for Mobile Agent Evaluation [19.6] 我々は,移動エージェント軌道上でのLCM-as-judge法の評価ベンチマークであるMobileJudgeBenchを紹介する。
ベンチマークは,6つのモバイルエージェントベンチマーク,4つのエージェントモデル,68のアプリにまたがる931の人的注釈付きトラジェクトリで構成されている。
まず、サンプルのスクリーンショットを持つ単純な基準判定器は、目的の手法と競合し、しばしば競合する。
第二に、ベンチマークの品質指標は現実世界の判断の有用性を確実に予測する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:00:46 GMT)
Behaviorally Grounded User Profiles from the Wild for Personalized Alignment and Multi-Perspective Reasoning [19.6] ソーシャルメディア投稿から直接、オープンエンドで高忠実なユーザプロファイルを抽出するためのフレームワークである、プロファイルのグラウンド(振舞いグラウンド)を導入する。
我々はこれらのプロファイルを、教師付き微調整(SFT)による列車時パーソナライズと、非パラメトリックテスト時マルチパースペクティブ推論の2つのパラダイムにわたって評価する。
本研究は,次世代のパーソナライズされた言語システムにおいて,オープンエンドな行動由来のプロファイルを極めて多様かつ効果的な基盤として確立するものである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:19:11 GMT)
FADE: From Passive Verification to Active Discovery in Counterfactual Video Understanding [19.6] 既存のMultiple-choice question (MCQ)ベンチマークは、質問や候補オプションを通じて、意図的にターゲットイベントをリークする。
本稿では, 対実的発見と説明のための効果的なトレーニングフレームワークであるFADEを紹介する。
FADEは、DualityVidQA-test と IPV-Bench の3つのタスクにまたがる、最先端の厳密なペアスコアを達成し、GPT-5.6を上回った。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:22:08 GMT)
Where Is the Bee? Detecting Tiny Pollinators with a Single Collaborative-Head Transformer [19.2] CVPPA@ECCV 2026 BuzzSpot Challengeでは、19201080xフィールドラベルでミツバチ、バンブルビー、ホバーフライ、ハチを検知します。
小箱に対処するため,保持ラベル上で記録された10個の検出器構成を比較した。
FinalTestで最初にランク付けするのは0.5062 mAP@[.5:.95]で、推論時のアンサンブルやテスト時の拡張は不要です。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:57:27 GMT)
Spiking Local Interaction and Adaptive Complementary Fusion for Spiking Transformer [19.1] スパイキング・トランスフォーマーは、主にスパイキング・セルフアテンション(SSA)を介してトークン相互作用をモデル化する
Spiking Local Interaction (SLI) と Adaptive Complementary Fusion (ACF) を紹介する。
ACFはSSAとSLIを、異なるネットワーク深さでのコントリビューションを適応的にバランスする層特異的なチャネルワイド係数を通じて統合する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:23:26 GMT)
From Faulty Memories to Corrected Actions: Dependency-Guided Rollback Repair for Memory-Augmented Agents [19.1] textbfdependency-guided rollback repairは、出所からの型付きメモリ対アクショングラフを構築し、明示的な下流依存性をトレースし、応答関連処理のみを選択的に再生する。
本手法は,3つのツール使用領域と4つのメモリ障害タイプにまたがる150ケースのベンチマークで評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:19:55 GMT)
CausalRepair: Bridging the Causality Gap in Large Language Model-Based Automated Program Repair via Dual-Slicing [18.9] CausalRepairは最小限の因果コンテキストに基づく会話駆動のAPRフレームワークである。
Defects4Jの313のバグを正しく修正し、ReinFixやTSAPRといった最先端のアプローチを上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:56:32 GMT)
A lower bound for stepsize-based acceleration of gradient descent [18.7] 非負のステップサイズスケジュールを持つ勾配降下の最終点収束率に対して、新しい下限の$(T-1.9319)を提示する。
この結果は、段階化スケジュールだけでは最適な$O(T-2)$収束速度まで原GDを加速できないという厳密な証拠を与える。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:06:59 GMT)
Real-World Cooperative Bimanual Dexterous Grasp of Large Objects from Single-View Observations [18.7] ロボット操作における大きな物体の両面的な握りは重要な課題である。
本稿では,関節角度,視覚的観察,力信号の収集を行うマルチモーダル・データセットを含む実世界のバイマングルーピング・フレームワークを提案する。
本手法により, 単視点入力から実行可能なバイマングリップの合成が可能となり, 完全な3次元オブジェクトモデルへの依存を低減できる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:24:27 GMT)
Do Judges Behave Like Algorithms? [18.7] テキサス州ハリス郡における軽視的保釈公聴会における司法判断について検討する。
利用可能な裁判所データを用いて,判事がアルゴリズムに類似するものに従うか否かを調査する。
我々の結果は、これらの審査員が一般的にアルゴリズム的に振る舞うことを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:46:41 GMT)
From Reasoning Depth to Reasoning Breadth: Evaluating Multi-Point Associative Reasoning in Large Language Models [18.2] MPAR-Benchは多点連想推論によって推論の幅を分離するベンチマークである。
マルチエージェントの手がかり生成パイプライン,埋め込み型多様性フィルタリング,人間による検証を用いて1000項目を構築。
我々は、精度、ANLS、埋め込み類似性、推論トレース検証、および4つの摂動(手がかりマスキング、オーダーシャッフル、インジェクション、マルチステップインジェクション)を用いてモデルを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:58:23 GMT)
Every Packet Counts: Dispersing Information for Loss-Resilient Learned Image Compression [18.2] パケットロスに対処するエンドツーエンドのロス耐性画像圧縮方式を提案する。
本手法は, 復元品質と安定性の両面において, 既存手法より一貫して優れる。
特に、一様ランダム損失のみで訓練されたモデルでは、ギルバート・エリオットチャネルでモデル化されたバースト損失を一般化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:01:03 GMT)
Static in Frames, Dynamic in Events: Rethinking Features in Event Cameras as Motion Cues [18.2] イベントカメラは、高時間分解能で非同期に強度変化をキャプチャし、下流タスクに新しい前処理方法を必要とする。
イベントベースコーナー検出における2つの特徴を解析し,それらが感情的手がかりであることを示す
提案した機能を最先端のイベントベース光フローネットワークに統合し,実世界のDSECベンチマークを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:37:49 GMT)
ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions [18.2] 本稿では,LLM(Large Language Model)の安全性のための,完全確率的アーキテクチャに依存しないガードレールテキストscProbGuardを提案する。
我々は、この安全リスクを連続した生成ダイナミクスの不安全確率として定式化し、モンテカルロサンプリングによりこのリスクを推定する。
textscProbGuardは、9つのモデル--データセットの組み合わせ設定で最高のキャリブレーション性能を達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:08:41 GMT)
Link-adaptive digital twin for robust physical-layer modeling in hybrid-amplified ultra-wideband optical networks [18.1] 本稿では,ハイブリッド増幅超広帯域リンクのためのリンク適応型ディジタルツイン(LA-DT)を提案する。
多様なリンクをまたいだ高精度なモデリングとロバストな一般化信号-雑音比推定を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:41:16 GMT)
Dynamics Models for Offline Hyperparameter Selection in Real-World RL [18.1] 本稿では, 都市水処理工場におけるキャリブレーションモデルの適用例を示す。
以上の結果から,これらのモデルが現実的な長軸ロールアウトを発生し,有意義なハイパーパラメータ感度傾向を回復できることが示唆された。
本研究は, 実環境におけるRL展開を支援するために, オフラインダイナミクスモデルを用いた概念実証である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:54:51 GMT)
DiffImaginE: Imagine to Verify Entity Types with Diffusio [17.9] 本稿では,MNER型検証を条件付き潜伏拡散推論として定式化するDiffImaginEを紹介する。
局所的な視覚的証拠が与えられた場合、型条件付きデノイザは、標準化された潜水器に注入されたノイズを予測する。
結果として生じるデノナイジングエラーは、型条件の負の対数類似性に対するELBO一貫性のサロゲートを与える。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:48:05 GMT)
When Your State Estimator Has Lost The Plot: Detecting Estimator Failures Via Spectral Analysis [17.8] 本稿では,近年の速度推定における周波数領域の電力分布を解析することにより,推定器の健康度を評価するセンサ非依存検査手法を提案する。
以上の結果から,状態推定器の出力の周波数領域解析さえも,実世界のロボット展開において既存のロバスト性技術を補完する軽量なイントロスペクティブツールとして機能することが示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:08:53 GMT)
Bridging Severe Cross-Modal Misalignment: End-to-End Visible-Infrared Object Detection via Explicit Feature-Domain Affine Registration [17.7] そこで本研究では,極端から端へ可視光を指向する物体検出器を提案する。
提案されたJFRDetは、DroneVehicle Misaligned (DVMA)上で69.7%$mathrmmAP_50$を達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:02:37 GMT)
The Accuracy Trap: Structural Scarcity Amplifies Relative Inequality in Algorithmic Allocation [17.7] アルゴリズムシステムは、公共資源の不足に対して個人を格付けする傾向にある。
スカーシティと精度は乗法的に相互作用し、指数関数的に大きなグループ間格差を生み出す。
我々は、モンテカルロシミュレーションとカナダの児童福祉と米国のがん治療における2つの独立した公共セクターシステムを通じて、この精度トラップを検証する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:04:43 GMT)
Synthesizing Probabilistic Saturating Counters with Differentially Private Formal Guarantees [17.6] 分岐予測器は現代のプロセッサの命令レベルの並列性を改善する。
古典的な飽和カウンターは決定論的であり、サイドチャネル攻撃に対して脆弱である。
確率飽和カウンタ(PSC)は、カウンタ更新をランダムにすることで、このリークを軽減するために提案されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:51:27 GMT)
CARE: Confidence-Aware Reasoning for Reliable Medical VQA [17.2] Reinforcement Fine-Tuning (RFT) は、医療用マルチモーダル大規模言語モデル (MLLM) を視覚的質問応答のためのチェーン・オブ・ソート (CoT) 推論に利用した。
我々は、精度とキャリブレーションを共同で最適化する、$textbfCARE$, a $textbfC$onfidence-$textbfA$ware Medical $textbfRE$asoningフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:28:52 GMT)
ForestBench: A Unified Graph Framework for Evaluating Multi-Agent Collaboration [17.2] 大規模言語モデル(LLM)上に構築されたマルチエージェントシステム(MAS)は急速に普及している。
それらの不均一な実行トレースは、メソッド間の評価の共通基盤を提供しない。
我々は、ネイティブMASトレースを統一協調グラフの共有空間にマッピングする一般化可能な評価フレームワークを導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:14:11 GMT)
Lost in Reconstruction: Aligning Action Representations with Language in Vision-Language-Action Models [17.2] 行動動詞は、行動の物理的結果だけでなく、その行動の実行方法も記述する。
行動軌跡には視覚的状態変化以外の動詞接頭情報が含まれていることを示す。
本稿では,補助目的によりVQ-VAE型トークン化器を増強するセマンティックアライズされたアクショントークン化器であるSALTを紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:57:17 GMT)
Unlocking the Power of Medical Tabular Data via Semantic-Aware Multimodal Pre-training [17.1] 本稿では,本質的な2次元データ構造を明示的にモデル化する新しい意味認識フレームワークを提案する。
まず,診断の重要度の異なる機能間階層に対処し,重要度を考慮した適応型マスキングを提案する。
第二に、機能内連続性-離散性双対性に対処し、ソフトラベル離散化モジュールを提案する。
大規模皮膚科(SLICE-3D, HOP)および眼科(EyePACS)データセットによる新しい最先端(SOTA)の確立
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:57:09 GMT)
Towards Color-Faithful Low-Light Image Enhancement via Adaptive Color Debiasing and Saturation Rectification [17.1] CAGEは適応色ずれとガム調和飽和補正を備えた円筒型色補正フレームワークである。
CAGEはより忠実な色復元を実現し、特に色バイアスと彩度異常を低減し、全体的な視覚的品質を向上させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:37:54 GMT)
Compact Feed-Forward 3D Gaussians via Saliency-Guided Primitive Merging [16.9] 本稿では,任意のフィードフォワード法から画素単位のプリミティブを取り込み,それをコンパクトでコンテント適応型ガウス集合に集約する構造対応マージパイプラインを提案する。
後処理モジュールとして、パイプラインはバックボーンに依存しず、既存のフィードフォワードメソッドの長所を活用する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:32:08 GMT)
RCShift: Certifying When Partial Linkage Suffices for Finite-Sample Decisions [16.9] RCShiftは、宣言された観測契約の下で2つのルートを認証する。
これは、部分リンクストレージを、宣言された家族、コスト、ターゲット、そして一般的な厳密な肯定的なサポートのための決定校正された測定設計に変換する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:16:43 GMT)
SkillLens: Visual Skill Cards for Retrieval-Augmented GUI Action Prediction and On-Policy Distillation [16.8] コンピュータ利用エージェントはリッチなソフトウェアインタフェースを知覚することができるが、その決定は視覚的な手続き記憶を欠くことが多い。
我々は、再利用可能な手順を適用性、視覚的エビデンス、検証信号にバインドする状態条件のメモリ表現であるVisual Skill Cards (VSCs)を紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:28:59 GMT)
TimeRoute: Time-Aware Modality Routing and Diffusion for Multi-Modal Recommendation [16.8] マルチモーダルレコメンデータは、テキスト、画像、オーディオなどのアイテムモダリティとコラボレーティブなシグナルを融合するが、それぞれのドリフトの有用性は時間とともに異なる。
このモダリティの時間スケールのミスマッチは、2つの組み合わせの課題を生み出します。
統合拡散ベースのレコメンデータであるTimeRouteで、両方の課題に対処します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:36:30 GMT)
Reference-Free Post-Training of Open Large Language Models for Multilingual Machine Translation [16.3] オープンな大言語モデルを用いた多言語機械翻訳における参照なしのポストトレーニングについて検討する。
46言語にわたって、結果のモデルはSFT言語よりも翻訳品質を一貫して改善した。
さらに, 市町村における蒸留の実態を調査し, チェックポイントでRLが達成した品質フロンティアに到達したが, 及ばないことを確認した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:30:38 GMT)
VERDICT: Training-Free Step-Wise Verification of Multimodal Reasoning via Disagreement-Aware Consensus [15.9] マルチモーダルな大言語モデルは、しばしば誤った答えにつながる微妙な誤りを含む推論連鎖を生成する。
異種凍結検証器間でのスコアリング問題としてこれを定式化する。
我々は、VERDICTと呼ばれる、トレーニング不要なドメインに依存しないステップワイド検証手法を提案し、その検証をDagreement-Informed Coupled Thresholding を用いて行う。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:46:38 GMT)
A second-order theory of texture for depth from focus [15.7] 波動光学に基づく光学的に粗い表面のテクスチャ的外観の理論を提案する。
私たちの理論は、従来のコンピュータビジョンがテクスチャレスと考える表面でさえ、テクスチャ化された外観を生み出すことを示しています。
狭帯域スペクトルフィルタを用いることで、自然環境光下でのコントラストを高めることができることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:56:55 GMT)
Neural Introspection Gating for Adaptive KV-Cache Reuse in Vision-Language-Action Models [15.6] Gated VLA-Cacheは、ニューラルイントロスペクションによる視覚的類似性キャッシングを強化する。
OpenVLAとOpenVLA-OFTで4つのLIBEROベンチマークスイートを評価した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:53:10 GMT)
A Geodesic Cut-Cell Prior for Neural Skinning [15.5] データ駆動型スキンウェイト生成のための幾何学的事前設計であるカットセルスキンニングを導入する。
近年の神経スキンモデルに組み込むことにより, 切削細胞スキン化の有効性を実証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:50:14 GMT)
Adaptive Supervised Anchoring for On-Policy Self-Distillation [15.4] オンライン自己蒸留は、学生から採取した軌道上の凍結教師からの指導を蒸留することにより、言語モデルに適応する。
本研究は,学生が目標軌跡から遠ざかると,教師の目標外接頭辞の条件がタスク関連監督を著しく弱めることを示す。
本稿では,2つの補完的な指導経路を分離する統合トレーニングフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:28:10 GMT)
MazzikaAI: A knowledge-based performance-to-prompt compiler for real-time Arabic maqam accompaniment with a streaming text-to-music model [15.4] アラビア語のマカーム音楽のマイクロトナール、モーダル、装飾された呼び出しと応答に基づいて構築されたものは、生成音楽モデルによって最も守られている伝統の1つである。
本稿では,自然言語をリアルタイム制御ループのアクチュエータとして利用する知識ベースシステムであるMazzikaAIを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:37:55 GMT)
Linguistically-Aligned and Visually-Grounded Preference Optimization for Clinically-Augmented Medical Report Generation [15.3] DPO-Clinは,臨床所見とクロスモーダルアライメントを優先的に最適化する,新しいポストトレーニングフレームワークである。
ECDモジュールは言語的に整合したレポート優先ペアの生成をガイドする。
M2DPOの変種は、視覚的コンテキストスイッチによって引き起こされるテキストの好みの反転を強制する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:36:54 GMT)
Your LLM, Your Style: Behavioral Mode Axes for LLM Behavioral Control [15.2] 大きな言語モデル(LLM)は、ユーザエクスペリエンス、安全性、下流の意思決定に影響を及ぼす振る舞いスタイルの対話的な設定でますます機能します。
既存のLCMパーソナリティ研究は、一人称環境で実施されている自己申告アンケートに大きく依存している。
本稿では,LLMの行動特性を研究・制御するための行動データフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:25:47 GMT)
VoxSumm: A Multilingual Corpus of Long-Form Spoken News for Joint Summarization and Translation [15.2] 長期文書要約研究はテキスト中心であるが、多言語音声研究は翻訳を優先している。
共同音声要約翻訳(JSumT)の形式化により,この方法論的ギャップに対処する。
このタスクのための最初の多言語および多言語間ベンチマークであるVoxSummを紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:33:09 GMT)
SparSTAR: Sparse Attention for SpaceTime AutoRegressive Video Synthesis [14.7] InfinityStarは、画像とクリップピラミッドのシーケンスを通じて、視覚的自己回帰生成をビデオに拡張する。
しかし、そのスケールの変化とクロスクリップのコンテキストは、遅延スケールの注意を犠牲にして、拡散や画像VARモデルから再利用されたスパースパターンを信頼できないものにしている。
本稿では,SparSTARをトレーニング不要なブロックスパースアテンション手法として導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:46:18 GMT)
OpenCodeReview: Determinism over Non-Determinism for Cost-Effective Agent-Based Code Review [14.7] 我々は不確実なエージェントに対する決定論的エンジニアリングに基づいて構築されたOpenCodeReviewを紹介する。
AACR-Bench(200の現実世界のPR、10の言語、1,505のエキスパート認定されたコメント)では、OpenCodeReviewが主要なコーディングエージェントを上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:48:22 GMT)
Dual-Domain Cross-Modal Decoding for Clinical Text-Guided Medical Image Segmentation [14.6] 臨床用テキスト誘導肺感染症セグメンテーションのためのDual-Domain Cross-Modal Decoding (DD-CMD)を提案する。
空間領域において、テキストガイド空間横断認識(TGSA)は、テキスト意味論とマルチスケール視覚トークンを整列する。
周波数領域において、スペクトルテキスト適応変調(STAM)は学習可能なバンドエネルギー統計を計算するために2次元DCTを適用する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:40:52 GMT)
Surfacing the Unsaid: CUE-Bench for Affective Stance in Chinese Discourse [14.4] 我々は、Affective Stanceを中心にした中国のUnsaid EmotionベンチマークであるCUE Benchを紹介します。
CUE Benchは暗黙の極性相互作用から9つの人間の解釈可能な感情的姿勢を構築する。
実験により、Affective Stanceを組み込むことで、3.5ポイントの微粒な感情認識と7.8ポイントの実用的意図検出が改善された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:29:32 GMT)
Security Tests as Executable Specifications for LLM Code Generation: Benefits, Trade-offs, and Coverage Limits [14.4] テストが事前に表示されるか、失敗した実行がリビジョンを引き起こすか、失敗が選択され、どのように表現されるかの3つの要素を分離する、制御されたテストフィードバックの足場を開発する。
2,705の軌道、31のタスクインスタンス、3つのセキュアコードベンチマーク、16のCWEカテゴリ、2つのモデルファミリがあり、すべての目に見えるテストが前もって隠れた機能とセキュリティのジョイントの成功を平均19.3%増加させている。
共有候補比較では、構造化されたフィードバック修復は、当初、共同回帰のない80の候補が失敗し、固定された生フィードバック修復83は3つの回帰を引き起こす。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:30:40 GMT)
Agentic Instruction Data Selection: Let DataMaster Interpret Your Intent [14.4] 本稿では,インストラクションデータ選択エージェント(DataMaster)による自動オーケストレーションへのパラダイムシフトを提案する。
DataMasterは、ユーザが自然言語記述を通じてデータ要求を指定できるようにすることで、データキュレーションを単純化し、手作業による戦略設計の負担を取り除く。
数学、医学、コードドメインにわたる実験では、DataMasterはほとんどの設定で静的ベースラインを上回っ、かなりの数のケースでフルプールトレーニングを上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:05:05 GMT)
RadFusion: Towards Threshold-Controllable Radiology Report Generation [14.4] 既存の世代モデルは、診断内容の感度特異性トレードオフを制御できない。
RadFusionは、レポート生成としきい値制御性を備えたフレームワークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:23:48 GMT)
Emotion2Skill: Model-Internal Emotion Signals for Adaptive Skill Selection and Evolution [14.2] 内的感情ベクトルを抽出し,それらをスキル選択とスキル進化に組み込むフレームワークであるEmotion2Skillを提案する。
感情トラジェクトリは、突然の内的変化に対して分析され、問題のあるスキルの呼び出しを特定できる。
その結果、エージェントスキルシステムの編成に有効な意思決定レベル信号としてLLM内部感情表現が確立された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:32:19 GMT)
Information Bottleneck under Perfect Privacy [14.1] 我々は、情報ボトルネックを完全なプライバシーの下で研究し、特にアクティブ・レート・システマティに重点を置いている。
目標は、感度変数から統計的に独立したまま、実用関連情報を保存する表現を構築することである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:50:08 GMT)
Compute-Optimal Is Not Cluster-Optimal: Systems-Aware Scaling for Sparse Mixture-of-Experts [13.8] モデルアーキテクチャとシステムの共同設計を定式化したMOSAICを開発した。
スパースMixture-of-Experts(MoE)言語モデルのためのフレームワークをインスタンス化する。
キャリブレーションされた空間範囲内において,効率非依存のモデルFLOPs予算は内部最適空間を許容しないことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:49:00 GMT)
When Vision Becomes Text: Visual Token Pruning via Cross-Modal Residual Guidance in VLMs [13.7] 視覚情報は視覚言語モデル(VLM)の知覚を強化するが、巨大な視覚トークンは推論コストを増大させる。
既存のビジュアルトークンプルーニング手法は類似性に基づくガイダンスに依存しており、圧縮のためにペアワイズテキストビジョンとビジョンビジョントークン相関を利用する。
本稿では,CMR,テキストアテンション関連性,残余空間の多様性を組み合わせた学習不要なビジュアルトークン圧縮手法であるSIEVEについて述べる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:04:33 GMT)
Templated or fully Synthetic? Prompt construction as a confound in measuring LLM political stance beyond writing assistance [13.7] LLMにおける政治的スタンスの検出は、長い間、閉ざされた多票政治調査の質問に支配されてきた。
テンプレート化されたプロンプトは、特にオープンなタスクにおいて、実際のプロンプトのニュアンスを欠いていると我々は主張する。
そこで本研究では,種子として真にプロンプトを付加した詳細な指示の下で生成した完全合成プロンプト(LLM生成)の使用を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:55:44 GMT)
RTSKG: Building a Rail Transit Station Knowledge Graph Dataset [13.5] 鉄道駅は、都市のアクセシビリティを高め、周辺地域の開発を促進する重要な交通ハブとして機能している。
レールトランジットステーション知識グラフ(RTSKG)データセットは、異なる種類の都市エンティティ間の空間的および意味的相互作用を明示的にモデル化する。
RTSKGの有効性を実証するため,駅エリアの店舗推薦と知識向上型乗降客予測の評価を行った。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:41:34 GMT)
The Next Challenge for Agentic Cybersecurity: A Realistic, Contamination-Free Reverse Engineering Benchmark [13.4] 我々は、最初の現実的で汚染のないREベンチマークであるSRE-Benchを紹介する。
SRE-Benchは16.9Kのコードを平均して19のプライベートな実世界のプログラムで構成されている。
5つのフロンティア LLM に対する評価の結果,RE は未解決のままであることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:14:57 GMT)
A Dataset and Benchmark for Optical Music Recognition of String Quartet Scores [13.4] マルチパートOMR専用の最初のデータセットであるOpenScore String Quartet for Optical Music Recognition (OSSQ-OMR)を紹介する。
OSSQ-OMRは、ICSLPのオリジナルのスキャン済み版とデジタル符号化されたスコアのペアで、すべての画像が文字に視覚的に一致している。
データセットはシステムレベルとスタッフレベルでスコアイメージとともにリリースされ、LMXE(Extended Linearized MusicXML)、**kern、ABCの3つのエンコーディングフォーマットでペア化されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:35:17 GMT)
FiGuRO: Intrinsic Dimension Estimation for Multi-Modal Data [13.3] FiGuROは、ユニモーダルデータとマルチモーダルデータのIDを近似するフレームワークである。
この最適化の創発的な性質として、共有情報とプライベート情報の切り離しが生じる。
本稿では,FiGuROが一様事前学習モデルに適用可能であることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:30:19 GMT)
SkillZip: Evaluation-Free Skill Compression for Self-Evolving Agents by Discovering Reusable Structure [13.3] 自己進化エージェントは、成功手順と失敗修正を追加することで、再利用可能なスキルを蓄積する。
素早い圧縮は、スキルが平らなパスではないため、この設定に不適である。
本稿では、最短の忠実な構造的説明を見出すことにより、スキルを圧縮する評価自由な手法であるSkillZipを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:41:19 GMT)
TEAMMix: Taxonomy Enrichment Augmentation and Minority-augmented Mixing Strategy for LLM-enhanced Weak-Supervised Hierarchical Text Classification [13.2] LLMに基づくデータ拡張により強化された弱教師付きHTCフレームワークを提案する。
このフレームワークは、まずキーワード生成とコーパスマイニングを通じてラベル階層を意味的に強化し、それによってラベルに対するモデルの理解を深める。
実験により,提案手法はLLM生成した擬似ラベルの信頼性を効果的に向上し,細粒度および不均衡データセットの分類性能を著しく向上することを示した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:16:59 GMT)
Self-Knowledge Retrieval Augmented Generation Framework for Patent Matching [13.2] 本稿では,特許マッチングクエリからLLMを自律的に抽出する自己知識RAGフレームワークを提案する。
この方法は、FAISS検索を生成的マッチング機構と統合し、自己知識を活用して、特許革新に対するモデルの理解を強化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:08:42 GMT)
Flood of multipartite Rains entanglement [13.0] マルチパートエンタングルメントは、真のマルチパートエンタングルメント(GME)の活性化のような現象を許容する
両部降雨の相対エントロピーの一般化として, 降雨, モンスーン, ハリケーン, スカルエンタングルメントを定義した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:11:13 GMT)
Narrative Keyframing for Generative Creative Writing [13.0] ナラティブ・キーフレーミング(英: Narrative keyframing)は、著者がストーリーの中から選択した瞬間に異なるタイプの物語的制約を指定し、AIを使って間欠的な散文を生成する。
アニメーションにおけるキーフレーミングの使用に触発されて、物語のキーフレーミングは、計画と生成されたテキストの適応制御を結びつける柔軟な方法を提供する。
物語のキーフレーミングは、創造的執筆において生成的AIを使用するための、より制御可能で透明で魅力的な方法をサポートすることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:41:29 GMT)
A Joint-Distribution Route to Fair Representations with Continuous Sensitive Attributes [12.8] 共同法則と辺縁積との独立性は, 1 つの差分 $dleft(P_Z, S, P_Z otimes P_Sright)$ で評価する。
我々はヒルベルト=シュミット独立基準を、条件定式化を置き換える統計的効率を調べるために、合同不一致$d$の例とみなす。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:27:24 GMT)
Capturing Uncertainty in Human Motion for Representation Learning in Soccer [12.6] 本稿では,サッカーにおける3次元骨格に基づく人間の動きを理解するための自己指導型表現学習フレームワークを提案する。
3次元ユークリッド空間における離散化された将来の動きに対する確率分布をモデル化する動き予測のための条件付きモジュールを提案する。
大規模サッカー選手追跡データを用いた実験により,提案手法は動作予測精度を大幅に向上することが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:59:10 GMT)
Rethinking Text-Based Image Retrieval in Specific Domain [12.5] Security Multi-Match TBIR (SecMM-TBIR) は、500万の監視画像と200の包括的なクエリからなるベンチマークである。
本稿では,セマンティック・アウェア・ファイン・チューニング(SAFT)フレームワークを提案する。
様々なCLIPライクなモデルに対する実験により、SAFTは標準的な画像テキストのコントラストよりも平均mAP@20のSecMM-TBIRで7.8ポイント上昇することが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:00:27 GMT)
Physics-informed Diffusion Generative Model for Time-Series Data Synthesis in Dynamic Systems [12.4] 時系列データを合成するための物理埋め込み拡散生成モデルであるPhysDGMを紹介する。
PhysDGMは、生成過程の各逆拡散ステップに直接物理法則を埋め込み、軌道レベルの物理的整合性を確保する。
PhysDGMによって構築された大規模なAI合成データセットは、ターボファンエンジン、航空エンジン、バッテリー、化学プロセスにまたがる34のデータセットに強い忠実性を示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:11:51 GMT)
Conflict Extraction in Probabilistic Datalog Analyses [12.3] PPProbeは確率データログ解析に特化した競合抽出器である。
我々は、パワーサイドチャネル分析、データ競合検出、セマンティックディファリング、ベイズ-ネットワーク推論から、70ベンチマークのPPProbeを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:10:19 GMT)
Breaking the Quadratic Barrier for von Neumann Entropy Estimation [12.3] 未知の$d$次元量子状態のフォン・ノイマンエントロピーを推定するサンプル複雑性について検討する。
解析では、空間直和分解の下でエントロピー損失を束縛する新しいピンチ不等式を導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:10:34 GMT)
Gaussian Meta-Space Augmentation for Stacking Ensembles in Multimodal IPMN Risk Stratification [12.2] 本稿では,コンバインダの対数確率メタ機能のクラス条件付きガウス拡張であるcUPMIを提案する。
cUPMIは、適切に正規化されたL2-論理的二分分類スタックに制限値を追加するが、常に高容量ツリーコンバインダを正規化する。
XGBoostにとって最も清潔な順序付けの利点は、XGBoostの8ストリームの放射能処理である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:17:32 GMT)
Beyond Imitation: Auditing the Recoverability of Reasoning in Distilled Models [12.1] 受講生が推論を継続できる場合には、正しい教師ソリューションが有用な監督となる。
確認されたソリューションの25%,50%,あるいは75%を明らかにした後,プレフィックスリカバリとこの適合度を測定した。
完全語彙上の交叉エントロピーと逆KL勾配の間のコサイン衝突を回復させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:21:49 GMT)
Operational identifiability of false-vacuum decay rates in the quantum Ising chain [12.1] 有限時間量子力学から熱力学的核生成速度を抽出する枠組みを開発する。
格子分解WKB作用は、コヒーレント・バブルスペクトル計算による中央値の不一致を4.13%に減少させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:42:41 GMT)
Self-Geometry: GT-Free and Plug-and-Play Test-Time Adaptation for Geometrically Consistent 3D Vision Foundation Models [12.1] 最近のビジョンファウンデーションモデル(VFM)は、シーンごとの最適化なしに、単一の前方パスで深さ、カメラポーズ、ポイントマップを予測する。
明示的な多視点幾何学的整合性(例えば束調整など)を強制することは、計算コストがかかるため、VFM事前訓練では課されない。
本研究では,2次元画素対応を擬似接地構造として用いた明示的な多視点幾何制約を直接課す,プラグアンドプレイテスト時適応パイプラインであるセルフジオメトリを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:28:50 GMT)
Conversational Orchestration for Organic 6G [11.9] 本稿では,Large Language Model (LLM) 駆動のドメインエージェントに基づく,軽量で分散化された対話型オーケストレーションフレームワークを提案する。
エージェントはツール、クローズドループの理由を通じてローカル状態を観察し、エージェント・ツー・エージェント(A2A)オーバーレイを介して隣のエージェントとサマリーを交換する。
高速な実現可能な配置は、周期的かつルーティングライクなリーチビリティ広告の拡散によって実現される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:32:52 GMT)
Data Attribution of Emergent Misalignment with Persona Features [11.8] 創発的ミスアライメント(Emergent misalignment, EM)とは、言語モデルの微調整が無関係な領域において有害な振る舞いを引き起こす現象である。
その結果, 脱獄者, サルカズム, 偽装, 操作に関連する特徴が, 微調整によって増幅されることが判明した。
人手による文書の微調整は, アシスタントスタイルの応答に転換しても, EMを確実に誘導しないことがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:05:24 GMT)
PE-CSNet: An equivariant network architecture with learnable patch-based sparse representation [11.7] Patch-based Equivariant deep unrolling architecture, called PE-CSNet, for accurate CS recovery。
CS磁気共鳴イメージング(CS-MRI)とCS符号化回折パターン(CS-CDP)のタスクにおいて,PE-CSNetは高速な計算速度で最先端の精度を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:11:27 GMT)
EVIL-Detect for NLPCC 2026 Shared Task 6: LLM-Generated Text Detection [11.7] 本稿では,NLPCC 2026共有タスク6に対するコンフリクト認識融合を備えた多信号アンサンブルフレームワークEVIL-Detectを提案する。
このシステムは、編集時回帰、ゼロショット確率コントラスト信号、語彙統計、保守的テキストルールを統合している。
本システムでは, 分配シフトが強く, マクロF1スコア0.8888を達成し, 公式評価において第1位となるロバスト性を向上する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:19:56 GMT)
Chemically Meaningful Textualization Enables Explainable Validation of Metal-Organic Frameworks by Large Language Models [11.6] 既存のバリデーションアプローチでは、計算不能な構造を識別できるが、検証ルールやライセンス要件に依存したり、限定的な解釈性を提供することが多い。
ここでは, 大規模言語モデル (LLM) が, 結晶情報を化学的に意味のあるテキストに変換する際に, MOF構造の解釈可能なバリデータとして機能することを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:48:44 GMT)
Optimal fidelity estimation when one state is pure via algorithmic Uhlmann transform [11.6] F(, |rangle!langle|)$ の最適推定器は、2つの状態のうちの1つが純粋であることの唯一の約束の下で、どれかを知ることなく成立する。
我々の推定器は, ウツミ, 中田, 王, 高木 (2025) の洗練されたアルゴリズム的ウルマン変換を, 1つの状態が純粋である場合に特殊化することによって得られる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:55:41 GMT)
TCAM for Autonomous Deformable Manipulation: The RMC2 Champion System for WBCD 2026 Track 4 [11.6] 本報告では、WBCD 2026 Track 4: Deformable Manipulation Challengeに対するRCC2 Teamのチャンピオンソリューションについて述べる。
このタスクでは、ロボットが1枚のTシャツをスタックから選択し、印刷用パレットにロードし、首輪を目標領域に合わせ、印刷領域を滑らかにする。
TCAMフレームワークを中心に完全に自律的なシステムを構築しました。ハードウェア、知覚、データ、学習は、ポリシーが扱わなければならない物理的相互作用の複雑さを共同で削減する、という設計原則を掲げています。
最終コンペでは,約23秒で25枚のTシャツをロードし,22。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:35:39 GMT)
Semantic Uncertainty-Guided Orchestration in Hierarchical Multi-Agent Systems [11.6] 本稿では,意味的不確実性を考慮したオーケストレーション手法HASSUMを提案する。
セマンティックエントロピーとセマンティック密度を用いて不確実性を推定し、これは出力確率ではなく、回答セマンティクスのレベルで信頼を測定する。
このアプローチは特定のエージェントアーキテクチャとは独立して動作するため、広範囲の階層的および協調的なマルチエージェントシステムに統合することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:55:53 GMT)
Inverse Theory of Mind Modeling for Content Recommendation: From Web Browsing to Dynamic Intelligent Interfaces [11.3] 我々は、行動を説明する信念、嗜好、意思決定特性を推測する逆心論(IToM)パイプラインを提案する。
パイプラインは、選択されたものや利用可能な選択肢を含む、各ユーザの決定コンテキストを再構築する。
VisionOS上でのペルソナ駆動型空間バンキングアプリケーションによるクロスモーダル転送性を示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:58:28 GMT)
Test-Time Hallucination Control in Large Vision-Language Models [11.2] 大規模視覚言語モデル(LVLM)における幻覚は、現実のアプリケーションにおける彼らの信頼性にとって重要な障壁である。
両制約に対処する新しいトレーニングフリー手法であるTTH法を提案する。
複数のLVLMファミリーと多種多様なベンチマークにわたる大規模な実験は、TTHが一貫して精度と堅牢性を改善することを示した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:25:22 GMT)
MD-ProTector: Positioning Multiple Data-Driven Prototypes for LLM-Generated Text Detection [11.2] エンコーダ埋め込み空間に複数のトレーニング可能な参照ベクトルを持つ各クラスを表すMD-ProTectorを提案する。
これらのプロトタイプは、同じクラス内の異なるテキストのグループに対して、別々の決定境界を提供する。
MD-ProTectorは、クラスレベルの構造とクラス内の変動を分離するプロトタイプ位置決め損失でこの問題に対処する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:14:10 GMT)
MSA-CITE: A Co-Adapted LoRA Specialist Ecology for Fixed-Budget Small-Model Inference [11.2] 複数の廃棄されたチェックポイントを、デプロイのための構成可能な資産として扱います。
4パスのポートフォリオは、200のホールドアウト数学アイテムに対して65.5%の精度を達成している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:26:06 GMT)
Strengthening Full Justified Representation: Efficient Verification and Computation [11.2] 本稿では, FJR と EJR+ の厳格な強化である FJR+ を紹介する。
我々はResidual-Budget Greedyアルゴリズムを解析し、FJR+を満足するような部分的な委員会を選択することを証明した。
RBGのプロジェクト固有のバージョンは、この特性を時間内に計算し、サブコアのコストベースのバージョンを満足する価格的な結果まで継続することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:29:08 GMT)
Deciding When to Rely on Visual Information: Gated Multimodal Fusion in Sequential Recommendation [11.0] 視覚的有用性は、推奨品質に対する視覚信号の寄与として定義され、潜伏した文脈変数である、と我々は主張する。
本稿では、アイテム埋め込みとユーザの現在のシーケンスコンテキストに基づいて、適応的なアイテムレベルの融合決定を行うフレームワークであるVisGateを紹介する。
分析の結果、視覚的有用性は項目によって異なり、協調的な信号が弱い場合の相互作用の間隔が増加し、意味的に意味のある方法で視覚的特徴と相関することがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:21:20 GMT)
EliSeg: Verified Target Construction for Report-Grounded Abnormality Segmentation [11.0] 本研究は, 対象の適性, 濃度, 対マスク対応の発見をモデルが決定しなければならない, レポート基底の異常セグメンテーションについて検討する。
マスク生成とターゲット構築を統合したアトラル検証-修正フレームワークである textbfEliSeg を提案する。
EliSegは、事前に定義されたターゲットID、プロンプト、ポイント、バウンディングボックスを見つける必要はない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:33:37 GMT)
Position: We Need Large Language Models Optimized For Our Well-Being [11.0] LLMプロバイダは、次回承認ではなく、長期的な幸福のために最適化された、少なくとも1つの広くアクセス可能なオプトインモードを提供するべきだ、と私たちは主張する。
目的を変更し、ユーザが明示的なリレーショナルな役割を担い、父性主義を回避し、現在の目的が暗黙的に行う3つの選択肢に関するデザイン空間を整理する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:12:43 GMT)
COGENT: Counterfactual Gaussian Explanations for Volumetric Medical Images [10.8] 本稿では,3次元表現のパラメータ空間に直接反実的説明を生成するフレームワークであるCOGENTを提案する。
肺CT検査におけるCOGENTを,既存の説明可能性法と定量的に比較検討した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:40:45 GMT)
Continuous Interaction Diffusion: A Diffusion-Native Runtime for Asynchronous Tool-Augmented Reasoning [10.7] 大規模言語モデルは、最新の情報にアクセスし、計算を行い、外の世界と対話するために、ますます外部ツールに依存している。
自動回帰モデルの場合、ツールの使用は生成プロセスに自然に適合する。
モデルの推論が安定化する前にツールの決定を強制し、個別の呼び出しが終わるまで有用な観察を遅らせ、冗長な洗練とツール実行を導入する。
モデルインタラクションをデノイングに統合する拡散実行型アーキテクチャであるContinuous Interaction Diffusion (CID)を紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:35:59 GMT)
Do Time-Series Forecasters Use the Right History: Recoverability, Recovery, and Functional Use of Temporal Delays [10.5] 遅延構造を持つ時系列モデルの3つの質問を分離する。
真の遅延は観測データから回収でき、モデルはそれを報告し、予測は実際に同じ履歴を使用するか?
予測者がまだ間違った遅延ラグを使っているにもかかわらず、予測リスクがオラクルに近づいている間に、遅延レポートが任意に信頼性を持つことが示される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:30:36 GMT)
DistilVDR: A Compact End-to-End Visual Document Retriever via Dual-Student Distillation [10.5] DistilVDRは、単一の8B視覚言語教師から両側に蒸留された524MのエンドツーエンドVDRシステムである。
どちらの変種も、最強のサブ-1Bマルチベクターベースラインよりも15.6倍小さいインデックスで100万の文書を格納している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:23:39 GMT)
Verifying full quantum network nonlocality in arbitrary configurations by nonlinear Bell-like inequalities [10.4] フル量子ネットワーク非局所性(FQNN)は、ネットワーク内のすべてのソースが非ローカルであるシナリオを記述する。
本稿では,ベル型不等式のみを用いて,一般量子ネットワークにおいてFQNNを認証する手法を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:30:26 GMT)
ConVAWG: A Retrieval-Grounded Framework for Controlled Synthetic Dialogue Generation in Violence Against Women and Girls [10.3] 本稿では,CPS対応の合成VAWGチャット対話を生成するための検索基盤フレームワークであるConVAWGを紹介する。
200のシナリオにまたがる6,000以上のマルチターン対話イベントを、リッチなシナリオ、イベント、ターンレベルのメタデータでリリースしています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:57:34 GMT)
Invertible Logits Transformation for Accuracy-Preserving Post-Hoc Uncertainty Calibration [10.3] 理想的な校正器は、非線形の誤校正を補正し、大きなラベル空間に優雅にスケールし、元の予測を保存する必要がある。
InvLTは、標準キャリブレーション基準の幅広いポストホックベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:08:05 GMT)
AECNav: Active Evidence Consolidation for Efficient Zero-Shot Open-Vocabulary Object Navigation [10.3] オープン語彙シナリオにおけるゼロショットオブジェクトゴールナビゲーション(ZSON)は困難である。
現在、タスクは、冗長な知覚パイプラインのために、高いレイテンシと限られた正確性に悩まされている。
3つのコンポーネント上に構築されたトレーニング不要のパイプラインであるAECNavを紹介します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:40:05 GMT)
Never Stop Speaking: a Denial-of-Service Attack on End-to-End Speech Language Models [10.3] E2E音声モデルを対象とした摂動型DoS攻撃を提案する。
本手法は, 知覚不能な音響摂動を最適化し, モデルの自動回帰生成プロセスに直接影響を与える。
提案手法は, 生成時間とGPUリソース消費を大幅に増加させながら, 安定した攻撃成功率を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:50:30 GMT)
Who Gets Heeded? An Obligation-Level Audit of Responsiveness in EPA Rulemaking [10.1] 義務レベルの応答性監査は、公務員の関与が特定の規制義務の変更と共起するかどうかを測定するための監査可能なAI支援フレームワークである。
このフレームワークをEPAアンカールール作成36件にわたる70,075件のコメントに適用し、2010年から2022年までの6,145件のドケットにわたる786,197件のコメントコーパスから抽出した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:05:58 GMT)
Reasoning Shortcuts and Value Symmetries: What Symmetry Permits, Architecture Realizes, and Optimization Selects [10.0] 推論ショートカット(Reasoning shortcuts)は、意図しない概念を通じて正しい予測を生成するニューロシンボリックシステムの規則の解である。
竹村、井上、西野の最近のフレームワークは、値を許容する自己同型群を通してそれらを分析している。
まず, 評価した4つのベンチマークのどれにも記載されているように, フレームワークの主要な定義である共有置換が適用されないことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:10:20 GMT)
Two-stage Odd Residual Flows for Mean-Preserving Probabilistic Time Series Forecasting [10.0] 2段階のOdd Residual Flows (TORF) は不確実性推定から平均予測を分離するフレームワークである。
TORFは、近距離および長距離予測において、強い密度推定性能(CRPS)を提供しながら、最先端の決定論的精度(NMAE)を達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:22:47 GMT)
Point-gap topology in amorphous non-Hermitian quantum systems [9.7] 熱力学限界におけるエネルギースペクトルの安定なゼロモード特異状態と中ギャップ状態の対応を導入する。
特異値スペクトルは小さな摂動と大きさの変動に対して非常に堅牢であるため、位相的エッジ状態は有限の大きさのシステムでも特異値によって確実に探索することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:40:45 GMT)
When Visual Signals Mislead: A Mechanistic Study of Attribute Hallucination in Vision-Language Models [9.6] 本稿では,Null-imageベースの診断と経路的修復を併用した統合フレームワークVISORを提案する。
3つのVLMファミリーと3つの属性タイプから抽出された10,791個の負の地下構造サンプルに対して、視覚信号は偽陽性を強く予測する。
VISORはこの診断を用いて、2つの障害モードを分離する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:05:18 GMT)
The GENEA Challenge 2026: A Large-Scale Disentangled Evaluation of Speech-Driven Gesture Generation on the Seamless Interaction Dataset [9.5] このプレプリントは,5つの音声駆動ジェスチャー生成システムの大規模評価である第4回GENEA Challengeの結果を提示する。
両者の相違なく, 動きの質と音声のアライメントを評価するために, 不整合評価手法を用いた。
また,新たなセマンティックジェスチャ生成タスクと,データのグラウンドド・ジェスチャス・サブセットを用いたテキストミスマッチ評価手法を導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:06:16 GMT)
When the Interviewer Is a Bot: Behavior, Breakdowns, and Trust in MLLM-Led Interviews [9.3] 我々は,インタビュアーが市販のリアルタイムマルチモーダルLLM(MLLM)である場合に実際に何が起こるか,実証的研究を報告する。
InterviewBotは音声による面接システムで、研究者が作成したアウトラインでリアルタイムのMLLMをラップする。
実践的な研究では、参加者はボット主導の半構造化インタビューを完了し、その経験に関する人間主導のリフレクションセッションを完了した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:01:36 GMT)
Hierarchical Compositionality for An Assistive AI Agent [9.2] AIエージェントは、さまざまなアプリケーションで人間を支援するために、ますます開発されている。
これらの手法は印象的な予測器であるが、資源不足であり、不透明であり、新しい状況において任意の決定を下すことが知られている。
我々の研究は、AIの初期のパイオニアにさかのぼるコア原則に基づいて、そのようなAIエージェントのためのアーキテクチャの設計を探究することを目的としています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:17:56 GMT)
A Sharp Local-Question Threshold for GHZ-Equatorial Completeness in Four-Player XOR Games [9.0] 通勤演算値の4つのプレイヤーバイナリ排他的(XOR)ゲームは、グリーンバーガー-ホルン-ザイリンガー(GHZ)赤道実現を認めない。
演算子値が1の4プレーヤXORゲーム1台につき,最大3つのアクティブな質問が完全にGHZ-赤道戦略を持っていることを証明した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:59:13 GMT)
Critic-Free Pretraining for Efficient Online Reinforcement Learning Fine-Tuning [9.0] オフラインからオンラインへの強化学習(O2O)は、静的データセットに事前トレーニングされたポリシを活用すると同時に、オンラインインタラクションを通じてそれらを改善することを目的としている。
textbfCritic-textbfFree textbfPretraining: オフライン批判トレーニングのアプローチを完全に放棄し、バイアス付き見積を継承することなく、新たな批判者が適応できるようにする効率的なパラダイム。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:38:32 GMT)
Persona Conditioning as an Assessor-Sensitivity Probe for LLM-Based IR Evaluation [8.9] 大規模言語モデル (LLM) は情報検索 (IR) 評価において関連性評価器としてますます利用されている。
LLM評価器の感度を明らかにするための診断機構としてのペルソナ条件付けについて検討した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:26:47 GMT)
Simultaneous Heisenberg-Limited Multiparameter Metrology via Indefinite Evolution [8.8] 非可換信号発生器は不整合パラメータエンコーディングを引き起こすことがある。
我々は,コヒーレント重ね合わせに異なる制御操作と信号反転を配置する不確定進化(IE)を導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:04:40 GMT)
Causality Sum Rules in Conventional Scattering Matrices [8.8] 因果和規則は従来の散乱行列で直接記述できることを示す。
我々は、因果時間の起源を復元しながら、実周波数の通過率を保存するドメイン遅延行列を定義する。
我々の研究は、基礎因果理論と実験的にアクセス可能な散乱データを直接結合する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:18:47 GMT)
Why Post-Norm Transformers Collapse: Attention Amplification and Gradient Repair Failure [8.6] ディープデコーダのみのトランスフォーマーは、オリジナルのPost-NormアーキテクチャをPre-Normで置き換えることが多い。
本研究では、因果的注意が高相似性表現をいかに生み出すか、また、なぜトレーニングダイナミクスがそれらを修復できないのかを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:00:23 GMT)
DashArena: Benchmarking LLMs on Interactive Analytic Dashboard Generation [8.5] 私たちはDashArenaを紹介し、オープンエンドのタスクグラウンドでインタラクティブな分析ダッシュボードを生成するための最初のベンチマークを紹介します。
DashArenaでは、ダッシュボードと再生可能なインタラクショントラジェクトリの両方を生成するために、各システムが必要である。
ブラウザは軌道を再生し、システムの意図した分析ワークフローを再現可能な視覚的および実行証拠に変換する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:54:37 GMT)
Tensor-normal maximum likelihood estimation at the operator-norm sample threshold [8.4] 我々は、$tgeq 1$に対して、$nDgeq Ck2 d_max2 t2$ のとき、最大極大推定器は高い確率で一意に存在することを証明している。
また、鋭いトンプソン束 $d_mathrmop(widehat_a,_a)leq Ct,d_max/sqrtnD$ を得る。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:03:38 GMT)
Association-based Privacy Attacks in Wireless Protocols: Formal Modeling and Mitigation [8.4] 本稿では,無線通信におけるペアリングによるプライバシー侵害の根源を正式に調査する。
本研究は, プロトコルに不可欠な条件対応, リプレイ抵抗, 距離制限対策を活用する。
提案する設計変更は、Wi-Fi AllianceとBluetooth SIGによって承認されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:41:56 GMT)
Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving [8.4] 本稿では,連続状態空間モデルと非政治ソフトアクター批判アルゴリズムを統合したDreamer-SACフレームワークを提案する。
自動運転のシナリオでは 運転効率と安全性を 考慮して評価します
実験により、ロールアウト地平線と政策パフォーマンスの逆U関係が明らかとなり、短水平ラテントロールアウトは追加のトレーニング信号と累積モデルバイアスの間の最良のトレードオフを達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:27:26 GMT)
A Recommendation System Approach for Interference-Robust Sensor Subset Selection [8.4] 本稿では,センサ・サブセット選択のためのレコメンデーションシステムに基づくフレームワークを提案する。
提案手法はRSSIベースラインよりも約20%精度を向上できることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:01:44 GMT)
Precise Top-Layer Fabric Segmentation for Fabric Destacking with Edge- and Shape-Aware Deep Networks [8.3] 重ね布地における上層布地セグメンテーションに適した,新しいセグメンテーショントレーニングアーキテクチャを提案する。
このメソッドは、2つの特殊なブランチを導入することで、古典的なエンコーダ/デコーダフレームワークを拡張している。
実世界のファブリックデータセットの実験では、トレーニングアプローチが確立されたベースラインを上回ることが示されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:32:28 GMT)
Decoding-Level Taboo: A Diagnostic Stress Test for LLM Robustness [8.2] Decoding-Level Tabooは、実行時にロジット空間に直接介入するゼロプロンプト診断ストレステストである。
単語境界における主要な候補トークンを動的にマスキングすることで、Tabooはマシンの回避を強制する。
オフパスロバスト性はパラメータスケールとポストトレーニング命令アライメントの両方の影響を強く受けている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:46:25 GMT)
Entropy-based Code Adversarial Translation for Real-world Repository Migration [8.1] We propose Entropy-based Code Adversarial Translation (ECAT) for Android-to-HarmonyOS repository migration。
ECATは、ジェネレータ-ディスクリミネータアーキテクチャによる逆エントロピー最小化としてリポジトリマイグレーションを定式化する。
A2H-RepoBenchは、Android-to-HarmonyOSリポジトリ移行のための最初の実世界のベンチマークです。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:01:28 GMT)
Generator-Guided Inverse Sampling for Lévy-Driven Generative Models [7.9] マルコフ発生器の観点からのレヴィ駆動生成モデルの逆サンプリングについて検討する。
本研究では,動的に拡散,小さな跳躍,大きな跳躍成分に分解する構造的逆サンプリング器を開発した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:25:28 GMT)
Path2ST: Hierarchical Cell-Tissue Grounded Cross-Modal Translation for Spatial Transcriptomics [7.9] モーダルな意味翻訳タスクとしてH&E-ST予測を定式化する。
Path2STは階層的な基盤を持つ自動回帰フレームワークで、3つの主要なコンポーネントを備えている。
3つのデータセットの実験は、最先端のパフォーマンスを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:43:37 GMT)
Agent Safety Should Be a Runtime Contract [7.8] エージェントの安全性は、ハーネスによって強制されるランタイム契約であるべきです。
予防顔は 危険な行動を妨害する
明らかな顔は 良い行動が実際に起こった証拠が必要です
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:01:05 GMT)
DonorRank: Donor Language Selection for Low-Resource Cross-Lingual Speech Recognition [7.8] DonorRankは、ゼロショットASRのための効果的なドナー言語を予測するための学習からランクのフレームワークである。
我々は、DonorRankがドナー言語選択自体を解析するための一般的なフレームワークであることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:16:51 GMT)
SQuaT: Self-Supervised Knowledge Distillation via Student-Aware Quantized Teacher Features [7.7] 量子化アウェアトレーニング(QAT)は、最小限の精度の劣化を伴う量子化モデルのデプロイを可能にする。
知識蒸留(KD)はこの課題に対処するための一般的なアプローチである。
我々は,この下界を理論的に排除するKD付きラベルフリーQATフレームワークであるSQuaTを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:29:30 GMT)
Conflict and Congruency Effects in Large Language Models: In-Weight and In-Context Competition in a Verbal Conflict Task [7.7] ストループのような対立タスクや側面のタスクで観察される合同効果は、心理学や神経科学において約1世紀にわたって研究されてきた。
本稿では,プロンプトがデフォルトの同色補完を付与し,明示的な規則が(一致条件)に一致するか,あるいは(矛盾条件)に矛盾する,動詞のみのLLM競合タスクを導入する。
因果属性分析,注意分析,注意改善を用いて,これらのLCMの異なる処理経路を同定した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:47:57 GMT)
Beyond Static Charts: Can Language and Vision Language Models Generate Interactive Data Visualization Interfaces? [7.6] 自然言語クエリからインタラクティブな可視化インタフェースをいかに生成できるかを評価するためのベンチマークであるVIS-GENを紹介する。
VIS-GENは、データフィルタリング、時間分析、視覚化編集を含む多種多様な分析意図をカバーする3,042のサンプルで構成されている。
我々は、14の最先端のオープンソースおよびクローズドソースのLLM/VLMをベンチマークし、暗黙の意図を含むクエリに対して大きなパフォーマンスギャップと頻繁な障害を明らかにした。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:40:32 GMT)
ELVAE: Evidential Learning-Based Variational Autoencoder for Uncertainty-Aware Generation [7.6] 変分オートエンコーダは確率的潜伏表現からサンプルを生成するが、潜伏位置に関する不確実性と周囲の変動性を区別しない。
ELVAEを定式化し,各潜時座標を入力依存の正規逆ガンマ後方で制御する。
低不確かさアンカーはより信頼性の高い合成サンプルをサポートし、高不確かさアンカーは故意にストレステストに利用することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:45:59 GMT)
Multiclass Sentiment Analysis for Identifying Political Viewpoints [7.5] ソーシャルメディアにおける政治的視点のマルチクラス感情分析について検討する。
我々は,XGBoostとBERTに基づく2つの機械学習手法の設計と評価を行った。
実験の結果,XGBoostモデルが0.2835F1スコアに達し,BERTモデルが0.2806F1スコアに達した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:21:23 GMT)
MUSE: A Full-Text Cross-Domain Knowledge Base of Scientific Problems, Solutions, and Rationales [7.5] MUSE(Mining Underlying Scientific Explanations, Mining Underlying Scientific Explanations)は,P-S-R(P-S-R)三重項のフルテキストリソースである。
579のエキスパート注釈付き全文パラグラフをキュレートし、健全な問題、解決策、合理的な範囲をカバーするリッチなアノテーションスキーマを作成します。
モジュラー抽出パイプラインは、このアノテーションをスケールして37KソースグラウンドのP-S-R三重項の高品質な知識ベースを構築する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:31:37 GMT)
GraphAlignCoder: Aligning Program and Proof Graphs for Code Generation [7.5] GraphAlignCoderは、明示的な正当性構造をコード生成に転送するトレーニングフレームワークです。
GraphAlignCoderは、すべてのベンチマークで、ベースモデル、コードのみのSFT、CodeRLを一貫して上回る。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:01:08 GMT)
The Illusion of Cross-Lingual Safety in Low-Resource Languages [7.5] 大規模言語モデル (LLM) における安全性の整合性は、多言語設定にまたがって一般化されることを前提として、主に英語で開発されている。
文化的な局所的なプロンプトとリテラル翻訳を組み合わせた新しい安全データセットであるLoDNAを用いて,アフリカ4言語(Twi,Hausa,Amharic,Swahili)の言語間安全トランスファーを調査した。
実験の結果, 言語間の安全伝達は極めて限定的であり, 有害なプロンプトはほとんどの言語モデルペアで英語の拒絶信号の10%未満を維持していることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:05:26 GMT)
Exploring the Social Life of Data: Finding Data You Can Trust [7.5] 本稿では,研究にデータを用いた場合に蓄積される社会的・実証的な証拠を,目的と信頼の適合性を決定するために活用する方法を考察する。
データ利用グラフは、データセットを出版物、人、機関、トピック、ソフトウェア、モデル、およびそれらが作成および使用される他のデータセットに接続する。
ソース、どの質問、どの組み合わせ、どの方法、そして観測可能な影響に頼っているか。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:01:19 GMT)
A Runtime Decentralized Attestation and Coordinated Repair Framework for Securing Automotive ECUs [7.4] DACER(DACER)は、自動車用ECUの分散試験および協調修理フレームワークである。
ローカルな自己検証と自己修復機能を実行し、分散オペレーションの低オーバーヘッド調整を可能にする。
我々のDACER設計は、車両全体の状態をチェックし、単一障害点に抵抗し、リアルタイムの制約に適合し、実行中にファームウェアの復元を可能にする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:02:49 GMT)
How Robust Are LLMs to Vietnamese Dialects? [7.4] 本稿では,ベトナム語からベトナム語への方言変化を複数のタスクで評価する大規模言語モデル(LLM)の最初の体系的評価について述べる。
VialectBenchには、感情認識(ER)、自然言語推論(NLI)、質問応答(QA)、複数選択質問応答(MCQA)にまたがる400の標準ベトナム語ソースインスタンスと2,400の人間による方言書き換えが含まれている。
10の命令調整モデル全体で、方言入力は平均性能を2.82%削減し、評価されたモデルは完全な方言不変ではない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:02:57 GMT)
GeoSeg-OV: Bridging Geospatial Gaps with Structural Guidance for Open-Vocabulary Remote Sensing Segmentation [7.4] 補助的なVFM機能を視覚テキストマッチングから切り離し、コスト集約とデコードのための構造的ガイダンスとして再利用するGeoSeg-OVを提案する。
6大陸にまたがる7つのデータセットにまたがる世界規模の高解像度土地被覆ベンチマークでは、GeoSeg-OVは2つのトレーニング設定の下で、最先端のmIoUを+2.5および+2.7の平均mIoUで上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:18:22 GMT)
Grid-Preserving Knowledge Distillation: Transferring Convolutional Inductive Bias to Vision Transformers under Data Scarcity [6.8] 送電路全体に沿ってグリッドを保持する蒸留フレームワークiBKDを提案する。
7つのトランスフォーマーバックボーンと6つのデータスカースベンチマークで、iBKDは局所性誘導法と一般知識蒸留ベースラインの両方に優れる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:39:13 GMT)
Multi Interests for Joint Search-Recommendation Modeling [6.7] マルチ関心に基づく混合逐次モデリングフレームワークMIJSRを提案する。
モデルは大きく3つのモジュールに分けられる: クロスドメインな振る舞い融合、マルチ関心マイニング、マルチタスク予測である。
本モデルは,ユーザの多目的をきめ細かいレベルで抽出することで,検索・推薦の精度をさらに高めることができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:15:43 GMT)
Improving TensorSketch Using Complex Random Variables [6.6] textttTensorSketchciteppham2013fast,kar2012randomは、高次元カーネルのための効率的なスケッチアルゴリズムを提供する。
citekar2012random は計算コスト$O(pDd)$の密度の Johnson-Lindenstrauss (JL) 型射影を使用する。
我々は、textttTensorSketchciteppham2013fast の単純な変種を導入し、同じ分散境界の ascitepmlr-v206-wacker23a を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:59:25 GMT)
Market-Information-Aware Gated-LoRA of Foundation Models for Transferable Day-Ahead Electricity Price Forecasting [6.6] 本稿では,Chronos-2の時系列基盤モデルを日頭電力価格予測に転送する市場情報対応適応フレームワークを提案する。
実験の結果、提案されたフレームワークは、市場情報を意識したゼロショットのChronos-2と比較して平均MAE/RMSEを6.24%/7.99%、バニラソースのLoRAに対して3.05%/3.52%の価格で削減している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:11:32 GMT)
Posterior contraction rates in Sobolev norms and Bayesian derivative estimation for infinite-dimensional exponential families [6.5] 指数族に対する正次ソボレフノルムの後方収縮とベイズ微分推定について検討する。
任意のヒルベルトスケールのノルムにおいて、滑らか性マッチング先行は、基底真理の正則性まで、極小最大後方収縮率を達成することを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:45:55 GMT)
ChemWorld: Programmable Chemical Worlds for Controlled and Replayable Agent Experimentation [6.5] ChemWorldは、再利用可能なプロセスと観測コンポーネントを実行可能な世界にコンパイルする、プログラム可能な化学環境である。
ChemWorldは、エージェントが利用できる公開実験契約を、評価者が所有する化学物質および物質法から切り離している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:53:39 GMT)
Accelerated Learning of High Dimensional Functions with a Tensor-Featured Training Network [6.5] ディープニューラルネットワーク(DNN)を用いた高次元関数学習の高速化手法を提案する。
DNNのパラメータは、入力-機能基底を固定したまま、標準勾配降下により最適化される。
我々は高次元関数を分解するストレージコストを少なくとも8桁の規模で削減することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:19:00 GMT)
On the Importance of Geometric Nonlinearity and Temperature-Dependent Properties in Multi-Material Thermo-Mechanical Topology Optimization [6.5] 熱機械に適合するデバイスは、小さなひずみの線形弾性と温度非依存の材料特性を持つように設計されている。
熱的多材料最適化における各仮定の効果とコストを定量化する。
従順な装置だ
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:01:36 GMT)
X2-Turn: Frame-Synchronous Dual-Head Modeling for Joint Streaming ASR and Turn State Prediction [6.4] X2-Turnは遅延ストリームモデリングによるフレーム同期ターン状態予測手法である。
本稿では,共有ストリーミング表現において,ASRヘッドと並列に動作するフレーム同期型ターンステートヘッドを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:54:52 GMT)
TACTICL: Task-Aware Compression of Tabular ICL Models [6.4] 本稿では,テキスト内学習モデルのためのタスク認識圧縮フレームワークであるTACTICLを紹介する。
トランスフォーマー層を創り出し、下流のタスクで訓練された軽量アダプタで置き換える。
ダウンストリームタスクでは,パフォーマンスが大幅に低下することなく,最大85%のレイヤを置換できることが示されています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:03:37 GMT)
Generative Learning for Quantum Measurement Design [6.4] FlowMeasは、量子的に通勤する測定スケジュールを学習し、ほぼすべての分子ベンチマーク上で、主要な製品測定方法を改善する。
フレームワークをコンパクトに符号化した54量子相互作用フェルミオンモデルに拡張する。
これらの結果は、実用的な資源制約下での量子計測設計のためのフレキシブルで統一的なフレームワークとして生成学習を確立している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:02:41 GMT)
Theoretical analysis towards accurate optomechanical detection of quantum gravity effects [6.3] 実験により得られた2つのプラットフォーム,Fabry-Perotオプトメカニカル・システムとミドル・イン・ザ・ミドル・オプトメカニカル・システムを再解析した。
我々は、一般化された不確実性原理テストのための改訂されたプロトコルを導出し、実用的な感度境界を確立する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:08:15 GMT)
$π$-SUB: A Physics-Informed Synthetic Underwater Benchmark Dataset for Underwater Image Enhancement [6.3] $$-SUBは、合成水中ベンチマークデータセットを生成する物理インフォームドフレームワークである。
$-SUBは次世代の水中画像強調法を開発するための超現実的で一般化可能なベンチマークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:16:53 GMT)
Cross-View Sequential Visual Localization with Spatio-Temporal Context Modeling for Autonomous Driving [6.2] 地上画像と衛星地図とを視認する。
既存のクロスビュー視覚的ローカライゼーション手法は、各フレームを独立して処理する。
本研究では,クロスビュー・シーケンス・ビジュアル・ローカライゼーションのための時間コンテキスト拡張フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:44:42 GMT)
Multitask Pareto Optimization for Monotone Submodular Problems with Dynamic Constraints [6.2] 我々は、すべてのタスクが共通の単調部分モジュラ函数を$f$で共有するマルチタスクの定式化について検討するが、それらの制約は異なる。
これにより、タスク間のソリューション共有が可能になり、標準的な進化的アプローチを独立して実行するよりもパフォーマンスが向上する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:15:18 GMT)
MammoMix: Leveraging Mixture of Experts for Robust Mammogram Breast Detection [6.2] MammoMixは、堅牢で一般化可能な病変検出のための新しいフレームワークである。
各エキスパートモデルは特定のドメインでトレーニングされ、ソースデータの異なる特性を専門化することができる。
ゲーティング機構は、入力画像に基づいて各専門家からのコントリビューションを適応的に評価し、その出力を組み合わせてドメイン適応推論を可能にする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:35:57 GMT)
Flux-form spatiotemporal neural operators for coarse-grained dynamics of multiscale PDEs [6.2] マルチスケールPDEシステムにおける粗粒度力学のデータ駆動予測について検討する。
閉包のない演算子学習の視点を応用し、線形粗粒度マップを適用し、解決されたフィールドに対する代理進化演算子を学習する。
本研究では, 粗粒バーガー方程式, 倉本-シヴァシンスキー方程式, 二次元乱流について検証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:55:16 GMT)
AutoGrable: What Is a Good Graph for a Table? [6.0] グラフ学習では、どのエンティティがノードになり、どのエンティティが接続し、どの関係を通すかを決定する必要がある。
最小のテーブル-グラフ抽象では、各行はノードであり、1-WLで区切られたメッセージパスGNNは、行をカラーリファインメントクラスに分割したものとしてのみ構成される。
インシデント構築では、パーティションは選択した列によって固定されるため、グラフの構築はそれらを選択することを減らす。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:53:42 GMT)
Soft Curriculum Learning for Optimizing Fresh and Generalized Recommendations [5.9] 大規模なレコメンデータシステムは、しばしば大規模な人気フィードバックループによってボトルネックとなる。
このような環境では、モデルが人気のあるアイテムを推奨するので、"ヘッド"アイテムのための圧倒的な量のスキュードトレーニングデータを生成する。
本稿では,産業規模の検索・ランキングモデルにおける連続的なトレーニング設定に特化して設計された,スケーラブルなソフトカリキュラム学習フレームワークを紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:50:44 GMT)
Active Perception for Embodied Disambiguation [5.9] 目的の曖昧さを具現化するための能動的知覚フレームワークを提案する。
このフレームワークは,物理的情報取得とユーザ意図の明確化を組み合わせたものであることを示す。
実ロボット実験により、このフレームワークは物理的情報取得とユーザ意図の明確化を組み合わせたものであることが示された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:47:20 GMT)
Expert-Guided g-computation with Large Language Models for Estimating Causal Effects on Timings: Applications to Hospital Quality Improvement [5.9] この研究は、最も標準的な病院の指標の1つ、平均滞在時間(LOS)とその因果推定(平均保存時間)に焦点を当てている。
両手法の相補的強みを組み合わせた専門家誘導型g-計算(卵子計算)を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:42:58 GMT)
Most biomedical publications show signs of LLM-assisted writing [5.8] 我々は,単語頻度の変化に基づくテキストのコーパスにおけるLLM使用率を推定するための,新しいバイアスのないアプローチを提案し,検証する。
本手法をPubmed Centralのオープンアクセスバイオメディカルペーパーの全文に適用する。
LLM は Methods セクション (32%) の段落に比べて議論部 (68%) の段落の段落の段落の段落の段落の段落の段落の段落に 2 倍の頻度で使用されるが, Methods セクションの段落においても LLM の使用率全体の 50% 以上である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:34:18 GMT)
Reward-Oracle MCTS for Formal Theorem Proving: Sample-Efficient Search and the Need for Kernel-Level Proof Auditing [5.8] 我々は,Lean 4コンパイラを報奨託書として純粋に扱う3ロールのMonte Carlo Tree Search (MCTS)フレームワークを提案する。
本フレームワークは,証明探索を3つの役割に分解する:証明試行ジェネレータ,サブゴール分解の分解器,サブゴール品質評価の批判器である。
PAB@256 で Goedel-Prover-V2-8B を用いて MiniF2F の87.1% を達成し,PAB@32 で26/659 パットナムベンチ問題を同じ証明試行予算で 18/659 を突破した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:28:22 GMT)
DeCo: Zero-Shot Industrial Anomaly Generation through Decoupling and Recoupling [5.7] ゼロショット産業異常生成は、実際の異常画像を必要としない特定の製品上の異常を生成する。
既存の方法は、不正確な異常情報取得と制御されていない異常製品融合に悩まされている。
本稿では, 原産地から異常構造を分離し, 対象製品の通常のテクスチャと明示的に再結合するDeCoを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:16:16 GMT)
Quantum Coordination Advantages in AI State-Tracking Tasks: Semantic Compilation and Latent Memory [5.6] 我々は、特定のAI状態追跡タスクに対して、推論時量子コーディネーションの利点を証明した。
イベントの順序と過去の入力へのアクセスを保ちながら、有限片方向、ストリーミング、あるいは適応因果タスクをセマンティックAIインターフェースにマッピングする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:32:15 GMT)
Ouroboros: A Self-Developing Frontier Coding Agent with Reviewed Core Evolution [5.6] ツール、プロンプト、コンテキストアセンブリ、コア実装が、後の作業のランタイムとなるレビューされたコミットによって改善されるセルフ開発エージェントであるOuroborosを紹介します。
経験駆動のコア進化において、通常の仕事と社会的相互作用は、バグ、粗い縁、非効率なコンテキスト構築を露出し、構造的変化をレビューする。
ホープは、Ouroborosの展開が記録された最長記録である。これは、7つの面にわたる人間のコミュニケーションの下で、自由進化のための161日間の生命体実験である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:39:00 GMT)
A Study of Cursorrules Files in GitHub Open Source Projects [5.5] 我々は、広く使われているAI支援コードエディタであるCursorで、構成プロンプトファイルの実証的研究を行っている。
11,427のGitHubリポジトリから12,110.cursorrulesファイルを分析し、その分散、進化、メンテナンスを特徴付ける。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:08:49 GMT)
GARLIC: Graph Attention-based Relational Learning of Multivariate Time Series in Intensive Care [5.5] 本稿では,集中治療のための注意型グラフ学習(GARLIC)モデルを提案する。
GARLICは、指数関数的に学習可能なニューラルネットワークアーキテクチャを通じて、欠落したデータを暗示する。
3つの ICU ベンチマークで、GARLIC は結果予測の新たな状態を設定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:29:48 GMT)
Putting Registers to Work: Task Registers for Token Pruning in Vision Transformers [5.4] トーケンプルーニングポリシは通常、単一の認識パイプライン用に設計されるが、事前訓練されたビジョントランスフォーマーは、異なる空間要求のタスク間で再利用される。
画像分類,セマンティックセグメンテーション,オブジェクト検出において,プルーニングポリシのどの部分が転送されるのかを問う。
各パイプラインに対して、制御されたプローブは停止チェックポイントを凍結し、パラメータフリーの一連の基準を1つの許容層に適用する。
調査では, セグメンテーションと検出の3つの相違点を明らかにした。分類は, 最初期の層における注意に基づくプルーニングに特に敏感であり, 密集したタスクは逆の回復終点を好む。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:43:52 GMT)
Role of Personality in Conversational Information Seeking [5.3] 大規模言語モデル(LLM)は、ユーザが対話を通じて情報を見つけ、比較し、評価する情報探索にますます利用されている。
しかし、ユーザ・パーソナリティ、アシスタント・パーソナリティ、タスク・コンテキストがこれらのインタラクションにどのように影響するかについては、ほとんど分かっていない。
本研究では,対話情報における制御可能な変数としてのパーソナリティについて検討し,ユーザ行動やインタラクション品質に与える影響について検討する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:26:24 GMT)
AI-inferred expressed well-being and collective-action discourse in climate-change campaigns on X [5.3] われわれは19年で364,118件の公開Twitter/X投稿を分析した。
バージョン付き重み付き語彙モデルは、幸福、未来志向の希望、集団能力、苦悩、行動言語を推定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:11:19 GMT)
When Unpaired Sets Support Shared-Corruption Calibration: Moment Geometry and Two-Sample Precision [5.3] 観測間で共有される所定の低次元補正のために、観測およびクリーン参照セットは、固定モーメントの応答を通してのみ推論をサポートする。
この問題を2サンプルのモーメントキャリブレーションとして定式化し、局所的なランク、スケールされたモーメント感度、ソース境界共分散、モーメント整合性残差を組み合わせたランク認識情報状態について報告する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:39:54 GMT)
Photonic realization of a subgraph extraction in a quantum random network [5.2] 4ノードの量子ランダムネットワークにおいて,量子ランダムネットワーク理論により予測される量子サブグラフを実験的に実現した。
サブグラフ状態は,ノード間の真の高次元多部絡み合いを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:46:16 GMT)
Auditable AI-Assisted Research Writing: An Engineering Discipline with Pre-Registered Process Observation [5.0] 運用時に構築された監査可能性の規律は、アンカーラインでのgitシール、ハッシュバウンドの証明、非準拠のアーティファクトを拒否する赤線ゲート、そしてすべての拒否をログする。
サードパーティがすべてのプライマリメトリックを再計算できるパッケージを公開します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:30:42 GMT)
Long-Horizon Forecasting of Complete Financial Statements with Forma [5.0] ProForma-20Qは、78のステートメントラインアイテムを1~20四半期前に予測するベンチマークです。
Formaは、ステートメントを匿名化された(アカウント、クォーター、値)集合として読むトランスフォーマーである。
フォーマの予測は会計のアイデンティティをほぼ満たしており、正確なコヒーレンスを統計的に有意な精度で回収することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:21:19 GMT)
3D Weighted Geometric Graph Neural Networks for Sheep Facial Pain Assessment [4.9] ディープラーニングシステムは、主に1つの画像領域の2D内で動作し、顔を1次元表現として扱う。
本稿では,単分子深度対応幾何グラフニューラルネットワークシステムであるbf3D Sheep Pain Facial Expression System (3D-SPFES)を提案する。
システムは、それぞれのSPFES顔のランドマーク(耳、目、鼻など)を、単一のRGBカメラから推定される3Dユークリッド空間に統合する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:21:36 GMT)
Compositional Benchmark Synthesis for Hierarchical Human Action Recognition [4.8] 4段階階層型インテンションベンチマークを合成するベンチマーク生成および評価フレームワークを提案する。
エピソードは、主題一貫性制約の下で遷移モデルによって組み立てられる。
被検体の使用量を0.566から0.248に削減する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:22:22 GMT)
Certify or Refuse: A Cross-Model Map for Selective Risk Control with Coverage Floors under Covariate Shift [4.6] 自動化フロアを導入することで、選択的な予測者が達成したカバレッジを達成できることを示します。
認証は実行可能性フロンティアと2リソースの複雑性マップを取得し、定数まで加算する。
レートは局所的であり、レギュラーフロンティアマージン、局所登録閾値以下、格子条件を必要とする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:10:55 GMT)
Rule of Thumb: Explaining Artificial Intelligence Systems using Partial Information [4.5] 説明可能な人工知能(XAI)は、AIシステムが特定の決定にどのように到達したかを説明する。
本稿では,新しい定式化に基づくXAIへの新たなアプローチとして,'Rule of Thumb' (RoT) の説明を提案する。
a)大規模言語モデル(LLM)を用いたゼロショット分類、(b)モデルアクセスのない不透明なAIシステムの監査、(c)科学的な発見におけるAIの使用。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:23:33 GMT)
HyperFix: Combinatorial Nonlinear Correction for Task Vector Merging [4.5] 本稿では,空間における部分条件付き非線形補正を予測する軽量ハイパーネットワークHyperFixを紹介する。
チューニングコストを低減しつつ既存のタスクベクトルマージ手法よりも優れた性能を示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:27:33 GMT)
Embodied Multimodal Grounding for Open-Vocabulary Mobile Manipulation via Semantic 3D Gaussian Splatting [4.5] 身体的移動操作には、言語、視覚的観察、3次元のシーン構造、実行前にアライメントされる動作の実現性が必要である。
本研究では,局所的な作業空間における少数ショット操作によるオープンボキャブラリターゲットグラウンドディングについて検討し,具体化されたマルチモーダルグラウンドディングフレームワークを提案する。
タスク駆動のローカルセマンティック3DGSは、アクティブセンシング、言語条件の3Dローカライゼーション、障害物認識シーン推論、ベース準備、アクションモデルのセマンティックコンディショニングをまたいだ共有インターフェースとして機能する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:16:30 GMT)
When Do Anchor-Based Pointwise LLM Rerankers Help? Retriever Quality, Statistical Scope, and Anchor Design [4.5] 我々は、アンカーベースポイントワイドの制御されたコンポーネントレベルストレステストの出発点として再生を利用する。
厳密な統計的補正の下では、コアコントラストスコアリングのアイデアが堅牢であることがわかった。
紙のアンカーを構築するためのより複雑な方法は不要である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:10:42 GMT)
Koopman Representation of Nonlinear Virtual Environments in Kinesthetic Haptic Systems [4.4] 本稿では,ハプティックシステムと相互作用する非線形VEを表現するために,クープマン演算子を用いることを検討する。
提案手法は,Duffing-oscillator VEの非線形ダイナミクスを効果的に表現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:55:37 GMT)
Terminal Symmetry as a Decision Resource: Statewise Refinement for Anytime Verified Construction [4.3] 多くのシーケンシャルな構成タスクは、実行が指示され、履歴に依存している間、完了時に正確な対称性を示す。
本研究は, 指向性, 等価な結果にまたがる構造を有する終端対応輸送を提供する終端対称性の意思決定資源ビューを開発し, 遷移後の現在の決定関連性を解明する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:08:01 GMT)
Optimal Stopping of Self-Refining Foundation Models [4.2] ファンデーションモデルは、外部からのフィードバックによって駆動される自己リファインメントプロセスを通じて、アウトプットを改善することができる。
我々は,このプロセスを,コストに対して期待される改善に基づいて改良イテレーションの数が決定される最適停止問題として定式化する。
最適な停止ポリシーを導出し、近似を用いて効率的に計算できることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:45:34 GMT)
Leveraging Human Reading Behavior for Keyphrase Extraction: A Webcam-based Eye-tracking Corpus [4.2] 本研究は,Webカメラを用いた軽量眼球追跡機能により,中国の学術論文からキーフレーズを抽出できるかどうかを考察する。
KPEモデルに3つの文字レベルの視線追跡機能,第1固定時間(FFD),固定数(FN),総固定時間(TFD)を組み込んで抽出性能の評価を行った。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:11:42 GMT)
Are We Really Making Progress in Group Recommendation? Unmasking the Tie-Breaking Illusion [4.2] グループレコメンデーションメソッドは、標準ベンチマークの大幅な改善を報告している。
しかし、これらの利益が常にモデリンググループの嗜好の真の進歩を反映しているかどうかは不明だ。
本研究は, 学習時間スコア圧縮と評価時間決定的タイブレッシングの相互作用による系統的評価バイアスによって, 最近のいくつかの手法が影響を受けることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:50:08 GMT)
HexEval: An Evidence-Driven Hexagonal Framework for Multidimensional Scholar Assessment [4.1] HexEvalは、多次元の学術評価のためのエビデンス駆動の六角形フレームワークである。
HexEvalは評価過程を通じて中間的証拠,次元特異な有理性,検証信号を保持する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:11:49 GMT)
Language-Structured Relational Q-Learning for Threat-Aware Control in Safety-Critical Driving [4.1] ERQ-Netは動的トラフィックグラフから車間関係と動作を学習する。
2,500の安全クリティカルなシナリオでは、言語中心のトレーニングは、テストの成功を49-52%から55-58%に改善する。
我々は、この不一致をリレーショナルコントロールギャップとして定式化し、報酬の再重み付けとマージン形成が結果として生じる政策崩壊を排除しないことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:24:01 GMT)
ReRound: Reconstructive Rounding to Resolve Midpoint Ambiguity in Calibration-Free LLM Quantization [4.0] ReRoundは、標準的なラウンド・トゥ・アレスト・スキームに固有の中間点のあいまいさに対処する訓練後の量子化手法である。
ReRoundは完全にオフラインで動作し、低ビット推論時に追加のオーバーヘッドは発生しない。
3ビットおよび4ビットの重み量子化において標準RTNよりも一貫して優れる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:18:07 GMT)
TangPoetryBench: A Multi-Dimensional Benchmark and Rubric-Conditioned Evaluator for Poetry-to-Image Generation [4.0] TangBenchは、1280枚の画像(古典中国語の唐詩x4の最先端T2Iモデル)のベンチマークであり、10次元にわたる品質管理された人間のアノテーションである。
我々は、詩の暗黙の感情を誘発する能力を含む、現在のT2Iモデルの共有的およびモデル固有の強みと弱さを明らかにする。
また,PoemAutoEvaluator (PAE) も導入した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:30:53 GMT)
Benchmarking Cyberattack Detection in Electric Vehicle Charging Infrastructure with Benign User Updates [3.9] 電気自動車の充電インフラにおけるサイバー攻撃検出は、要求されたエネルギーと出発時間に対する正常な動作後の修正によって複雑である。
本稿では, 実適応充電ネットワーク(ACN)セッションの入力順序を保存するための, リーク制御されたセッションレベルベンチマークを開発する。
固定プールは、生成された各攻撃をソースセッションの分割に保持し、物理的に動機付けられた6つの攻撃とその調整されたバリエーションを含む。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:50:24 GMT)
Flow Straight to Reality: Perceptually Consistent Flow Matching for Efficient Image Restoration [3.9] PCFlowは、劣化した観測からクリーンなターゲットへの継続的なトランスポートをパラメータ化する統合フレームワークである。
従来の計算コストのごく一部で、様々な復元作業における競争性能を達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:37:10 GMT)
Clinical Feasibility of Low-Magnification Fluorescence Imaging for Breast Cancer Margin Detection Using Texture Analysis and Deep Learning [3.9] MUSE法は乳癌手術における手術マージンを確認するための有望な方法と考えられている。
ローカルバイナリパターン(LBP)とベースビジョン変換器(ViT)モデルを用いた深層学習(DL)に基づくテクスチャ解析(TA)を用いた。
DL法を用いて、4x倍率と10x倍率の両方が96.30%の感度、100%特異度、98.18%の精度を達成した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:08:00 GMT)
FormStruct-Bench:A Hierarchical and Diagnostic Benchmark for Table-Form Document Structure Recognition [3.9] 本稿では,テーブル形式の文書構造認識を評価する階層的および診断的ベンチマークであるFormStruct-Benchを紹介する。
オーディショナブルな地上真実を大規模に構築するために、70の再利用可能なテンプレートを注釈付けし、7000の検証済みインスタンスに拡張する。
14以上のAPIがホストされ、ローカルにデプロイ可能なシステムと2つのSFT版があり、最高の文書レベルスコアは83.85%に達し、報告されている最も詳細な構造スコアは18%以下である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:44:34 GMT)
Terminal-Bench-LILT: Multilingual Agentic Coding Benchmark Grounded in Language, Region, and Culture [3.9] Terminal-Bench-LILTは10言語で300の認証されたコーディングタスクからなるスイートである。
各タスクは、英語以外のソフトウェア開発に特化した問題をターゲットにしている。
6つのフロンティアモデルの評価は、最強モデルでさえ63.1%のパスレートにしか達していないことを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:05:47 GMT)
Stigma and Support in Online Sexual Violence Narratives on Reddit [3.8] 我々はSCOPEデータセットを導入し、オンラインサバイバル物語におけるスティグマ信号をリンクし、対応するコメントスレッドの型をサポートする。
我々は、StigmaとNo Stigmaのコンテンツを比較し、Stigmaの物語が内部的苦痛に重点を置いていることを発見した。
これらの結果から、スティグマが生き残った物語やピアレスポンスをどのように形成し、計算モデル、コンテンツモデレーション、より安全なオンラインシステムに影響を及ぼすことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:56:01 GMT)
Hierarchical Fast-Slow ReAct Agent for Zero-Shot Object-Goal Navigation [3.8] ゼロショットのオブジェクトゴールナビゲーションでは、ロボットが入力したことのない建物の中で名前の付いたオブジェクトカテゴリーを見つける必要がある。
我々は、ロボットがすでに見たものを熟考の対象にするシステムを開発した。
我々のシステムは、HM3D v1 val valで68.75%、MP3Dで47.29%に達する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:19:54 GMT)
DAEP: Difficulty-Aware Evidence Planning for Medical Video Corpus Temporal Answer Grounding [3.8] DAEPは、サブタイトル、視覚的、手続き的コンテキストのエビデンスでビデオをランク付けし、ハイスコアのアンカーをテンポラリなスパンに拡大し、最終的なアウトプットのために再ランクする。
公式評価では、BIGCは平均スコア0.2728の10のシステムの中で第1位である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:50:16 GMT)
Governing Agentic AI in FinTech [3.7] 金融機関は、エージェントAIシステムに連続的な決定を委譲している。
我々は、バインディングガバナンスの制約は能力ではなく、検証可能であると主張している。
我々はエージェントAIのためのマルチレベルガバナンス理論を開発する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:52:09 GMT)
StructReward: Efficient Structured Process Rewards for Self-Correcting Multimodal Reasoning [3.7] 検証可能な報酬(RLVR)を用いた強化学習は,多モーダル推論を改善するための効果的なアプローチとして現れている。
プロセス報酬モデルはよりきめ細かいフィードバックを提供するが、通常は個別に訓練された検証、コストのかかる連鎖アノテーション、あるいは大規模な言語モデルによるオンライン判断に依存している。
我々はStructRewardを紹介した。StructRewardは、構造化されたステップレベルの報酬アライメントを通じて高密度の強化信号を提供する計算効率のフレームワークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:31:44 GMT)
VLMs Win a Systematic Evaluation of Underwater Image Reconstruction [3.7] 本稿では,水中再構築のためのシステム評価パイプラインについて述べる。
精度、カメラ移動による再構成の整合性、および水パラメータの影響を評価するために使用できる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:46:46 GMT)
Variational Parameter Calibration with Physics-Aware Latent-Space Surrogates [3.6] 本稿では,物理を意識したニューラルネットワークに基づく遅延空間フレームワークについて紹介する。
提案したオートエンコーダに基づくアプローチは,物理パラメータを潜在表現によって予測された流れ場にマッピングする,微分可能なサロゲートを与える。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:02:31 GMT)
Attention-Path Fragility as an Uncertainty Signal in Large Language Models [3.6] 我々はこれを、注意を隠蔽し、成果物間のBALD相互情報を計測するトレーニング不要推定器ASMIとしてインスタンス化する。
接地されたQAでは、単一パスの信頼性とエントロピーを超えたエラー予測情報が追加されている。
ヘッドレベルの分析では、この境界線を追跡するのは、ヘッドレベルの脆弱性の存在ではなく、その脆弱性がエラーと一致しているかどうかを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:59:02 GMT)
Efficient Reinforcement Learning for Long-Horizon Tool-Use Agentic Tasks [3.6] 長期的なツール使用エージェントは、ユーザ目標、ドメインポリシー、ツールコール、シミュレータ状態、検証の遅れといった理由を考慮しなければなりません。
本稿では,マルチコントロールツール利用環境におけるRLのモジュール型トレーニングシステムであるSINKFLEX-RLを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:30:56 GMT)
Conversational versus Dashboard Explainable AI for UAV Intrusion Detection: An Empirical Study of Operator Trust and Reliance [3.6] 機械学習に基づく侵入検知システム(IDS)は無人航空機(UAV)ネットワークの確保において優れた性能を示した。
これらのモデルの「ブラックボックス」の性質は、マルチモーダルなサイバー物理データの高次元性と相まって、重要な解釈可能性の課題を引き起こしている。
本稿では,Large Language Models (LLM) を利用した対話型XAIインタフェースを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:31:59 GMT)
CARB: A Characterization-Guided Framework for CNN Inference Cost Prediction and Deployment Screening [3.5] 既存のアプローチは、FLOP、レイテンシ測定、またはエネルギープロキシとしての単一デバイスプロファイリングに依存している。
本稿では2つのGPUプラットフォーム上での13419 CNN構成のワークロード特性について述べる。
我々はCARB、R2 0.99で3つのターゲット全てを共同で予測するカスケードブレンドアンサンブル、および秒間に90%以上の候補を排除した2段階のデプロイメントスクリーニングワークフローを開発する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:27:53 GMT)
Principal Trait Analysis: Towards Deriving "Skills" in Human-AI Collaboration [3.4] 大規模言語モデルによるエージェントは、ヒューマン・アーティフィティ・インテリジェンス(AI)のコラボレーションを通じて、職場でますます利用されている。
本稿では,会話のパターンから共通の特徴を抽出する主成分分析に着想を得たアルゴリズムであるプリンシパル・トレート・アナリティクスを提案する。
PTAから派生した特徴は,両設定の協調動作を説明する上で重要な特徴であり,作業結果の予測に有効であることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:49:35 GMT)
Entanglement-assisted quantum locally recoverable codes: bounds and constructions with availability [3.3] 我々は、量子局所的に回復可能なエンタングルメント支援符号を可用性で定義する。
最大で$-1$消されたクォーディットの任意のセットは、$t$ローカルリカバリセットの任意のセットから回収することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:07:58 GMT)
ConfTriage: A Calibration-Aware LLM Triage Framework for Pulmonary Nodule Malignancy with Selective Specialist Deferral [3.3] 我々は,標準結節属性の忠実な自然言語レンダリングのみを読み取る一般大規模言語モデル (LLM) が,校正三重項層として機能するかどうかを検討する。
本稿では, 言語をモダリティとして, キャリブレーションを安全機構として, および低信頼ケースのための選択的なDLバックストップとして, 3つの柱上に構築した信頼度校正手法であるConfTriageを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:02:41 GMT)
Nutrition Data Infrastructure for the AI Era: Operationalizing FAIR for Agent-Mediated Research [3.3] 自動使用のためのFAIRを運用するソース保存インフラであるNutrition Data Service (NDS)について述べる。
食品記述のベンチマークでは,NutriBench において NDS は高い保留精度を示し,最も優れた言語モデルの結果を上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:42:12 GMT)
Top-down Traffic Scenario Generation via Joint Initial-Goal Diffusion and Trajectory Infilling [3.2] 既存の交通シミュレータでは、エージェントの初期状態がトラジェクトリを生成する必要がある。
本稿では,初期状態と目標状態のペアによって定義された高レベルのトラフィックシナリオを生成するTrafficDiffuserを提案する。
本稿では、異なる軌道モードに基づく制約を含む、生成された高レベルトラフィックシナリオをどのように使用できるかを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:13:51 GMT)
Reoptimization Algorithms for Contextual Bandits with Knapsack Constraints [3.2] 我々は Knapsack を用いたコンテキスト帯域に対する新しいアルゴリズムについて検討した。
再最適化の利点を生かして,我々のアルゴリズムは平均で$O(frac(ln T)3T)$で,$T$は水平長であることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:46:10 GMT)
Spectral Embeddings of Degree-$α$ Laplacians in Random Dot Product Graphs [3.1] 正規化の度合いが組込みノードの集団形状と局所的不確実性の両方にどの程度影響するかを示す。
好まれる正規化は、ネットワーク密度、コミュニティの不均衡、ブロック確率構造に依存する。
これらの結果は、いつ、なぜ代替正規化がスペクトルクラスタリングを改善するのかを統一的な分布的理解を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:16:29 GMT)
Operationalising Relative Causal Knowledge: Backbone Identifiability from Private Reports on a Shared Outcome [3.1] 因果知識の相対性(Relativity of Causal Knowledge、RCK)は、エージェントのネットワークが因果知識を交換する方法を説明する。
エージェントの個人的因果的知識によって、そのバックボーンはいつ決定されるのか?
標準整合性、非退化性、局所重なり仮定の下では、これらの局所因果境界は固有のバックボーンを特定できないことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:46:18 GMT)
Unveiling the Predators: Contemporary Approaches to Identifying Illegitimate Open Access Journals in the Academic Publishing Ecosystem [3.1] 捕食ジャーナリズムは、オープンアクセス(OA)パブリッシングモデルの完全性に重大な課題をもたらす。
本研究は,これらの雑誌を同定するための既存の方法論を批判的に評価する。
この分析は、捕食雑誌の定義が普遍的に受け入れられていないことを含む、重大な制限を強調している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:56:13 GMT)
A Semantic Approach to the Academic Publishing Network: Document Vector Representations and Hybrid Structural-Semantic Fusion over OpenAlex Data [3.1] 我々は、引用インフォームドベクター埋め込み(SPECTER2)によって科学文書を表現し、安定なOpenAlex IDによって鍵付けられた埋め込みベクターデータベースに格納する。
意味的類似性(埋め込みのコサイン)と構造的類似性(書誌的結合)をチューナブルウェイトアルファと組み合わせたモジュラー遅延融合関数を定義する。
再現可能なワークフローを備えた,apnetライブラリのオープンソース拡張として,アプローチ全体をリリースしています。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:45:56 GMT)
Stability of Finite-Batch Particle Mean-Field Variational Inference Beyond Strong Convexity [3.1] 本研究では、平均場変動推定のための実装可能な有限バッチ粒子アルゴリズムを、投影されたワッサーシュタイン力学の完全離散近似として検討する。
我々は、積、収縮、有限バッチ誤差時間ドリフト化、および結合された粒子軌道に沿って蓄積された欠陥を分離する非同相的なワッサースタイン安定性境界を証明した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:56:36 GMT)
Particle Production, Equilibration, and Quantum Recurrences from Classical Fields [3.0] 粒子生成には可観測物の平衡が伴う。
結果は、非平衡量子場理論における平衡の第一原理研究への道筋を確立する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:06:02 GMT)
FUSE: Frame-Unified Stress Estimation from Facial Video [3.0] FUSEは、時間的ウィンドウや外部セグメンテーションを使わずに、完全な記録を単一の入力として処理する、顔とビデオのストレス検出フレームワークである。
t = 1 の時間ストライドでは、FUSE は完全な 120 秒の記録を 1 入力として保持し、30 fps で 3,600 フレームに対応する。
FUSE は t = 15 で 69.44% の最高テスト精度を達成し、フルフレーム構成は 69.03% で競争力を維持している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:49:44 GMT)
Do Influence Tactics Matter? Investigating Prompt Framing Effects in LLM Code Generation [2.9] 本研究では、人間が他人を説得したり動機づけたりする様々な心理学的コミュニケーション戦略が、より効果的なプロンプト・フレーミングに繋がるかどうかを考察する。
我々は,再現可能なプロンプトテンプレートに8つの影響戦略(合理的説得,移植,交換など)を運用した。
得られたコードアウトプットを,機能的正確性,品質,保守性,セキュリティの4つの重要なソフトウェア品質次元で評価した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:57:06 GMT)
Partially Observable Learning for Multi-Platform Dispatch Optimization [2.9] 現実世界のシステムでは、クーリエは単一のプラットフォームに排他的ではなく、同時に複数のプラットフォームを提供する。
これにより、本質的に部分的な可観測性を備えたマルチプラットフォームディスパッチ環境が実現される。
提案するPOLOは,多プラットフォームインスタント配信システムにおける最適化の分散のための,部分的に観測可能なマルチエージェント強化学習フレームワークである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:20:12 GMT)
Threshold Structure of Optimal Policies in Restart POMDPs [2.9] 一般ボレル状態空間上の再スタートPOMDP(Partially Observable Markov Decision Process)について検討する。
最後に観測された状態と再起動から経過した時間からなる十分統計表現を爆発させ,その問題を十分に観測されたMDPに還元する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:03:29 GMT)
On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models [2.9] 大規模言語モデル(LLM)は、ステートレスな会話インターフェースから自律的なエージェントへとシフトしてきた。
妥協された推論ステップは、不正なデータアクセス、不可逆的な状態変更、障害のカスケードを引き起こす可能性がある。
本研究では,PRISMA 2020ガイドラインに基づく体系的な文献レビューを行った。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:11:26 GMT)
Gromov-Wasserstein Quantization and Clustering: Structure, Rates, and Algorithms [2.8] 本稿では,Gromov-Wasserstein(GW)量子化について検討する。
GW量子化問題に対する解の存在を示し、$k$-meansアルゴリズムの類似性を正当化する特徴を与える。
数値実験により、GW量子化は通常のクラスタリング法を超える多くのモデリング可能性を開くことが示されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:58:31 GMT)
The GenAI Catch-22: Use of Generative Artificial Intelligence in Norwegian Newsrooms During the 2025 Parliamentary Election [2.7] ケーススタディは10ヶ月にわたるマネージャやジャーナリストとのインタビューに基づいている。
われわれは、ニュースルームの管理者が社会技術的想像を共有すれば、テクノロジーの能力に関する非現実的に楽観的な信念が生まれることを示す。
我々は、GenAI Catch-22に対するニュースルームのレジリエンスの脆弱性を特定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:27:12 GMT)
Benchmarking Time Series Generation Methods for Privacy-Preserving Forecasting [2.7] プライバシに敏感なドメインでの時系列予測は、オリジナルの観測よりも、リリースデータ上でのトレーニングモデルを必要とすることが多い。
元のデータを完全に置き換える合成生成法がいかにうまく機能するかは、まだ未定のままである。
このベンチマークは、新しいプライバシ対応合成時系列生成手法の評価と開発のための基準点を確立する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:09:01 GMT)
No Universal Signal Predicts Sample-Level LLM Regression under Version Updates [2.6] 本稿では、推定時に利用可能な信号からそのような回帰を予測する方法について検討する。
実践者は、これらのタスクレベルのパターンを使用して、所定の更新に対して信頼するレグレッションシグナルを選択することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:13:12 GMT)
Seeds Before Objectives: Rethinking Evaluation for Low-Resource Garhwali ASR [2.6] 我々は、公式なVAANI上で、最初の再現可能なマルチシードASRベンチマークを構築した。
可塑性ゲインは壊れやすいが,標準CTCのw2v-BERT 2.0は5種に対して47.0% WERに達する。
パラメータ数ではなく設計を事前訓練し、性能を駆動し、スピード向上によって、小さく、ほぼ一貫した利得が得られる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:51:57 GMT)
Foundation Model-Enabled Efficient Data Sampling (FEEDS): A label-efficient training strategy for pan-cancer, multi-tracer PET/CT datasets [2.5] FEEDS(Foundation model-Enabled Efficient Data Sampling)は、限られた代表的なトレーニングセットのみを必要とするワンステップのトレーニングパラダイムである。
我々はAutoPET-IIIデータセットを用いてFEEDSをトレーニングし、検証する。
我々は,AutoPET-III,DeepPSMA,内部のDartmouth-Hitchcock Medical Centerデータセットの3つのホールトアウトセットに対して,その精度と一般化性を検証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:38:44 GMT)
Exploration-Driven Personalized Federated Reinforcement Learning via Intrinsic Motivation [2.5] 探索駆動型個人化フェデレーション強化学習(EDPFRL-IM)を導入する。
EDPFRL-IMは、各クライアントで固有の好奇心による探索を活用して、ローカルな探索を促進し、クライアントのプライバシを保護する。
本フレームワークは,政策パーソナライゼーションとサンプル効率において,平均的なPFRLベンチマークを上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:18:26 GMT)
GitSkills: A Dataset of Agent Skills on GitHub [2.5] アントロピックはこのフォーマットをオープン仕様として2025年10月に導入した。
GitSkillsは、2026年7月に282,200のパブリックリポジトリから収集された3,797,117のSKILL.mdファイルのデータセットである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:28:27 GMT)
Hierarchical Empirical-Bayes Naive Bayes: Minimax Smoothing and Calibration with AODE Extension [2.4] 階層的経験的ベイズ・ネイブベイズ(HEB-NB)を提案する。
各クラス特徴条件確率は、データ順応的に学習されるディリクレによって滑らか化される。
31のUCIとOpenMLベンチマークで、HEB-NBは確率的指標でFriedmanランキングで最高の成績を収めている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:21:31 GMT)
Deployment Is Not Destiny: Robot Recomposition in the Field with Unseen Software, Hardware, and Compute Payloads [2.4] 実行時に再コンパイルのためのフレームワークと抽象化をサポートする。
当社のアプローチでは,非専門家のユーザは,真のプラグイン・アンド・プレイプロセスを通じて,現場での新機能を迅速に追加することが可能です。
本手法は, 原子炉運転施設における放射能源位置推定と, 暗く, 難解な場所にいる人を熱誘導探索する2つの災害対応シナリオで実証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:29:54 GMT)
Hardware-Aware Deployment of Joint SAR Compression and Despeckling on FPGA [2.4] 次世代SAR(Synthetic Aperture Radar)ミッションは、ダウンリンクよりもはるかに高速にデータを生成する。
近年の研究では、SAR画像の切り離しと圧縮を同時に行うことで、表現能力の向上が示されている。
我々は、組み込みのZCU102FPGAプラットフォーム上にSAR Despeckling and Data Compressionフレームワークを共同で配置することで、このギャップを埋める。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:29:13 GMT)
A Lightweight Fault-Detection Scheme for Barrett Modular Multiplication Using Multiple Conditional Reduction Paths [2.4] 多項式乗算は格子ベースのポスト量子暗号(PQC)方式において最も資源、時間、エネルギークリティカルな演算である。
サイドチャネル攻撃(SCA)とハードウェアトロイの木馬は意図的な障害を発生させるが、加齢やその他の要因は意図しない障害を引き起こす可能性がある。
本稿では, BM M ユニットを敵条件から保護するために, 統計的削減モニタリング (SRM) 手法を用いる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:55:24 GMT)
SAR2Agri: Learning SAR Intensity Representations for Agricultural Monitoring [2.4] 農業用として,SAR強度画像のみを用いた自己教師型学習パイプラインを提案する。
我々は,SARから表現学的特徴を抽出する事前学習パイプラインの能力を高めるために,マスキングとカリキュラム学習による時間的前文タスクを改善した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:01:26 GMT)
Elbow Angle Guidance System Based on Surface Haptic Sensations Elicited by Lightweight Wearable Fabric Actuator [2.3] 軽量ウェアラブルファブリックアクチュエータを用いた肘角誘導システムを提案する。
提案するアクチュエータは、ファブリック製であり、2つのマッキベン型人工筋肉が取り付けられている。
布アクチュエータによって引き起こされる表面触覚は、着用者の動きに干渉することなく、自然体の動きに調整される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:49:57 GMT)
SegPAR: Class-Centric Decision-Based Sparse Attack for Semantic Segmentation [2.3] 我々は、分類領域からの最も代表的な決定ベースのブラックボックススパース攻撃をベースラインとして適応する。
SegPARは、クラス中心の探索パラダイムに移行する、新しい意思決定ベースのフレームワークである。
実験により、SegPARはブラックボックスベースラインよりもスパシティ効率とMIoU低減に優れていた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:44:33 GMT)
Large-scale AI-Ready Data for Anti-Cancer Drug Response Modeling [2.3] 我々は、IMPROVEベンチマークを、製薬ゲノムデータの大規模な統合により大幅に拡張する。
拡張されたリソースには、何百万もの薬物反応の測定、より広範なマルチオミクスのカバレッジ、化学多様性の大幅な増加が含まれている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:21:51 GMT)
Optimize Cheap, Deploy Strong: Cost-Aware Cross-Tier Transfer for Evolutionary Optimization [2.3] プロンプトとエージェントプログラムの進化的最適化は、フィットネス評価に支配されている。
LLMが果たす3つの役割を分離し、最も安価な層で高ボリュームの回答ロールを実行することで、検索を再構築する。
低コスト検索がターゲット層検索にどのように代用され、どこで失敗するかを、コスト制御で評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:17:22 GMT)
REAP: Relation-Aware Elicitation and Parsing for Closed-Book Knowledge Base Construction from LLMs [2.3] クローズドブック設定で言語モデルから知識を構築するためのREAPシステムを提案する。
提案システムは,構造化連鎖推論,関係固有クエリ戦略,および推論に基づく空集合ゲートを組み合わせる。
テストセット上では、Mistral-Small-24B-Instruct-2501モデルに基づいて構築され、マクロF1スコアが0.62で、特に countryLandsCountry (F1 = 0.95)、 companyTradesAtStockExchange (F1 = 0.73)、hasBorderArea (F1 = 0.77) で強い結果が得られる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:28:50 GMT)
BREAD: Baseline-Referenced Explanations for Anomaly Diagnosis [2.2] 本稿では,異常観測情報と正規基準情報の両方を用いた,スケーラブルなベースライン参照診断手法を提案する。
平均シフト異常条件下では, 提案手法は, LIMEと比較して, 異常の原因となる特徴を検出する上で, 忠実度が高いことを数学的保証する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:16:06 GMT)
On the Swapping Capacity of a Quantum Repeater [2.2] 本稿では,2つの量子リンクを1つまたは複数のメモリで切り換えたメモリベースの量子リピータの容量について検討する。
我々は、量子メモリの不均一なデフォーカスと非偏極ダイナミクスを考慮しつつ、E2Eエンタングルメントの忠実度を推定するモデルを開発する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:51:52 GMT)
Beyond Pass@k: Measuring Reliability and Security of Agentic Code Generation [2.2] 我々は,n = 独立ロールアウトとc = 完全パスロールアウト(タスク,エージェント)ペアで適用したのと同じ推定器であるReliability@kを提案する。
機能的正当性がセキュリティの安全性を示唆しないという証拠によって、セキュリティ調整された信頼性も提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:01:15 GMT)
Unified Exact Cylindrical Dirac Modes and Symmetry-Resolved Quantum Geometry [2.2] 自由ディラック方程式の特別な円筒解は、幅広い相対論的フェルミオン系に対して自然な単一粒子モードを与える。
一般的に用いられるスピン偏極、分離、ヘリシティ、横ヘリシティモードが、結果として生じる2次元解空間にどのように埋め込まれているかを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:51:29 GMT)
When Is a General Factor Distinguishable? Non-Proportionality, Stable Structure, and the Bifactor Decision [2.1] 識別可能性(distinguishability)は、K$-factorクラスへの人口距離によって測定される。
4つの経験的データセットは、可能な結果を示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:46:15 GMT)
CasDeblurGS: Cascaded 2D-to-3D Multi-View Consistency for 3D Gaussian Splatting from Two Blurry Images [2.1] 自由視点の3Dシーンメディアは没入型アプリケーションではますます重要になっているが、現実的なキャプチャは視野の空間性や動きのぼかしに悩まされることが多い。
CasDeblurGSは,局所的な2D対応からグローバルな3Dガイダンスまで,信頼性の高いクロスビュー情報を段階的に復元するフレームワークである。
実世界のDeblur-NeRFシーンと合成されたDeblur-NeRFシーンの実験では、強いベースラインよりも一貫したゲインを示し、PSNRをそれぞれ1.19dBと2.11dB改善した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:13:21 GMT)
Battlefield 5G: Dual-PKI and TPM-Based UE Attestation for Tactical 5G Standalone Networks [2.0] 5G-AKAは、USIMに格納されている加入者認証を認証するが、その認証を保持する物理装置の認証やブート状態の検証は行わない。
5Gスタンドアロンネットワークのための事前認証フレームワークであるBattlefield 5Gを紹介します。
ソフトウェア無線システムの無線アクセスネットワークを拡張することで,これらの機能を実現する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:22:47 GMT)
The entanglement-assisted transmission capacity is a strong converse bound for identification [2.0] エンタングルメント支援伝送容量が$C_E$であることを示す。
また,C_mathrmIDC_E$の厳密な超付加能の最初の例も得られる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:48:53 GMT)
Enabling Scalable Kinesthetic Teaching via Observer-based Hand-guiding with Active Support [2.0] ロボットハンドガイドによる審美教育は、模倣学習やプログラミング・バイ・デモのデモンストレーションを収集するための自然なインターフェースを提供する。
現在の産業用ハンドガイドのアプローチは、通常、アクティブなアシストを提供しておらず、手首に装着した力トルクセンサーや、新しいタスクでは利用できない学習された動作先に依存した代替手段が求められている。
RHOASは,演算子意図の動作を,追加ハードウェアを使わずにモデルベース力推定を用いて積極的に支援する手動誘導方式である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:19:17 GMT)
Field-Free Transverse Aharonov--Bohm Phase Gate for an Orbital $l$-Qubit [2.0] 磁気磁束は共伝播モードの逆の伝播位相を、直線環状電子ガイドの|pm lrangle$で表すことを示す。
スピン分解ダイラック処理では、フィールドフリーベクトル電位$A_$とモードのアジムタール保存電流テクスチャの重なりによって位相が変化する。
その結果, モード分解ABエネルギーシフトと測定可能な伝搬動作を結合し, ディラック波の空間分布保存電流が動作量子制御資源となることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:48:20 GMT)
LLM Ensemble Fault Classification for Automotive HiL Validation [1.9] 本稿では,センサレベルの故障分類のためのマルチLLMアンサンブルフレームワークを提案する。
このフレームワークは、フォールトインジェクション記録のコンパクトなエビデンス表現を使用し、異種大言語モデルの出力を組み合わせる。
この手法は、ガソリンエンジンと電気自動車のHiLシステムを用いて、3つの駆動設定と10のシングルフォールトクラスで評価される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:31:18 GMT)
Knowledge-Graph-Guided Retrieval-Augmented LLMs for Explainable Root Cause Analysis in Automotive HiL Validation [1.9] 本稿では,自動車のHLデータにおける根本原因分析と故障局所化のための知識グラフ誘導検索強化大規模言語モデルフレームワークを提案する。
このフレームワークは、ASMガソリンエンジンと電気自動車システムという2つの自動車用HiLケーススタディで評価されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:19:33 GMT)
Fisher8: Stabilizing Neural Heteroscedastic Regression via Output-Layer Fisher Geometry [1.9] 平均と不確実性の推定を共同で予測するニューラルネットワークのトレーニングは不安定である。
我々は、ユークリッド幾何ではなくフィッシャー幾何を用いて更新を並べ替え、再スケールする出力層勾配補正であるFisher8を導出する。
多次元回帰および表現学習タスク全体で、Fisher8は優れた可能性エラートレードオフを取得し、キャリブレーションされた不確実性推定を予測し、豊富な不確実性を考慮した特徴空間を学習する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:10:51 GMT)
Improved Multiplayer Bandit Algorithm for Bernoulli Rewards [1.8] ベルヌーイ報奨の下で,情報非対称性を用いたマルチプレイヤーマルチアームバンディット問題について検討する。
報酬の非対称性については、2つの腕のKL間隔が決定論的サンプル数から分離していること、および$M$独立プレイヤーがさらに除去を加速していることが証明される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:20:42 GMT)
Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models [1.7] 本稿では,大規模言語モデル(LLM)を候補構造のエンプロポサとして用いるモデル探索エージェント(MDA)を提案する。
真理が現在の仮説クラスの外にあるとき、予測チェックは不適切であることを宣言し、提案者は仮説空間を新しいモデルで拡張する。
MDAは、データ効率のモデル学習と信頼性の高い介入予測能力の観点から、新しいSOTAを設定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:39:37 GMT)
A Gateway Architecture for Enterprise MCP Authentication: Unifying Heterogeneous Auth, Identity Delegation, and the User / Non-User Persona Problem [1.7] Model Context Protocol(MCP)は、LLMエージェントをエンタープライズツールに接続するためのデファクトインターフェースになっている。
1年以内に、大規模組織はゼロから数十の内部で構築されたMSPサーバに移行した。
本稿では,集中型MPPゲートウェイで危機を解消する産業展開について報告する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:19:20 GMT)
Multi-Granular Rationale-Guided Molecular LLM for Property Prediction [1.7] 大規模言語モデル(LLM)は、分子特性予測のような化学的なタスクに広く適用されている。
MR-MoLは, 直接的に証拠を提供する多粒性有理誘導分子LLMである。
8つのMoeculeNetタスクにおいて、MR-MoLはジェネラリストモデルの中で最高の総合的な結果を得る。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:50:33 GMT)
TokenPowerSandbox: Evidence-Gated CPU-First Screening for Energy-Aware LLM Serving [1.6] TokenPowerSandboxは、解釈可能なCPUレジデントプロジェクタ、ショートターゲットGPUプローブ、フルワークロード検証、タンパーエビデント凍結前測定の証明を組み合わせたエビデンスゲートワークフローである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:27:42 GMT)
Predicting Space Groups of Double Perovskites by LLM with Dynamic Few-Shot Learning [1.6] 宇宙群予測(DyRIS)のための動的および多様性向上Few-shot Retrievalとルールガイド推論を導入する。
DyRISは、多様性に富んだ動的数発のプロンプトを使用して、しばしば表されるSGの優位性を制限しながら、関連するインコンテキストの例を検索する。
さらに、B/Bのカチオン順序、定量指標、および主要なSGバイアス制御に基づくルール誘導推論を組み込んで、最終Top-3 SG候補を洗練・ランク付けする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:53:56 GMT)
Assessing Reliability of BERT-Based Models on Question Answering Tasks [1.6] 本研究では,変換器を用いた質問応答(QA)モデル,特にBERTモデルとその変種(RoBERTa,AlBERT,DistilBERT)の信頼性に着目した。
これらのエンコーダのみの事前訓練型変換器は、分類タスクとして扱うことができるQAタスクにおいて顕著な精度を示した。
本研究では,(1)モンテカルロ液滴(MCD)による内部モデル変動と(2)パラフレージングによる入力摂動の2つの条件下で応答安定性を評価することによって,BERTに基づく4つのモデルの信頼性を評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:24:07 GMT)
ReLTEx: Reliable LLM-based Taxonomy Expansion [1.5] ReLTExは、信頼性の高いLarge Language Modelsベースの分類拡張のためのフレームワークである。
ReLTExは、より信頼性が高く、セマンティックにコヒーレントな分類拡張をもたらす。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:29:58 GMT)
Detecting an Effect Is Not Learning to Act on It: A Reward-SNR Floor for LLM Acquisition Agents [1.5] パイプラインは、補助的なモデル由来の観測を得るために、サンプル当たりのコストを支払うことができ、取得した信号が使用される価値があるかどうかを判断する必要がある。
このような信号が平均して役に立つことを検出することは、インスタンス毎に行うことを学ぶのと同じではない。
本稿では,各インスタンス毎の取得ポリシーの学習に対する平均効果と,報奨SNR検出能力のフロアを区別して説明する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:46:23 GMT)
The Abstention Protocol: RCA for Clos Fabrics [1.5] 重み付き融合をPAM型吸収代数に置き換えた生産RCAシステムである textscCoreSec を提案する。
テレメトリエージェントは、証拠が曖昧である場合に決定論的決定と明示的な棄権をもたらす制御フラグを使用して構成される。
CoreSecは、修正することなく、さまざまな環境にわたって安定的で説明可能なRCA動作を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:31:33 GMT)
Every pooling rule has its world: matching probability combination rules to situations and stakes [1.5] システムは、しばしば同じイエス/ノー質問の2つの数値アセスメントを組み合わせる必要がある。
いくつかの共通結合規則の背景にある仮定を述べ、対応する結合確率を導出する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:11:20 GMT)
Beyond a Bag of Features: Set-Level Instability in Sparse Autoencoders [1.5] 我々は、より解釈可能な類似度尺度として、アクティブスパースオートエンコーダ(SAE)潜在集合をオーバーラップする。
SAEアクティベーションセットは、密埋め込みや残留ストリーム状態よりも、人間のカテゴリ境界やカテゴリ内典型性を忠実に回復しないことがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:55:59 GMT)
QSimAdv: A Late-Bound, Vendor-Agnostic Architecture for High-Performance Quantum-Circuit Simulation [1.4] QSimAdvは共通カーネルではなく遅延バインディングである。
この設計はNVIDIA GH200とAMD MI250X/EPYCシステムで実現している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:17:29 GMT)
A Systematic Sample Size Analysis of ML-Based Path Loss Prediction for LPWAN [1.4] LoRaのような低電力広域ネットワークは、スマートシティのアプリケーションにますます利用されている。
伝統的な(経験的な)伝播モデルは、これらのシナリオにおいて限られた精度を示すことが多い。
本稿では,LoRa経路損失予測のための機械学習モデルについて検討する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:48:54 GMT)
Towards Decentralized Searcher Competition in MEV Markets [1.4] 本稿では,探索者競争の観点から,最大抽出可能な価値市場における集中化を考察する。
我々は、探索者が機会カバレッジと実行効率が異なる異種モデルを開発する。
本稿では,より公平かつ広範に検索者の報酬を分配する,エントリーフィルター付きシャプリーキャップ型オークション機構を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:14:57 GMT)
OAA: Three Phases of Vocal Guidance in Human-Drone Teleoperation [1.4] 自発性発声指導は,声道順応,アプローチ,調整の3段階に連続的に編成されることを示す。
音声誘導遠隔操作におけるOAA対応制御の意義について論じる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:35:08 GMT)
EsaacSim: A Multimodal Event Camera Add-on for NVIDIA Isaac Sim [1.4] EsaacSimはNVIDIA Isaac Simのマルチモーダルイベントカメラアドオンである。
グレースケールとBayer RGGBイベント生成によるイベントカメラのオンラインシミュレーションを可能にする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:51:41 GMT)
Coordinating the Unknown Lipschitz Constant in Multiplayer Bandits [1.4] リプシッツ定数が未知の連続(リプシッツ)作用空間における協調的マルチエージェントバンディットについて検討した。
我々は、(A)報奨付き未観測行動、(B)報奨付き未観測行動、(C)報奨付き未観測行動の3つの情報構造を考察する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:06:12 GMT)
Steady-state phase transition in one-dimensional hybrid contact process [1.3] 本研究では, 安定な吸収・活性相の存在, 長期限界におけるビスタブル領域の存在を示す。
吸収相とバイスタブル領域の境界でサドルノード分岐が観察され、不連続相転移が示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:17:41 GMT)
Robust Sliding Mode and Admittance Control of Underactuated Aerial Manipulators for Contact-Based Inspection [1.3] 航空機の姿勢と力発生の動的結合による制御課題を経験する。
本稿では,1-DoFマニピュレータを内蔵した不活性化ヘキサロレータの持続接触点検を行うためのロバスト制御機構を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:39:05 GMT)
Basin: Efficient and Extensible Numerical Optimization in Rust [1.3] BasinはRustプログラミング言語の数値最適化ライブラリである。
データにモデルを適用すること、シミュレーションを校正すること、機械学習モデルをトレーニングすること、コストを最小限にするエンジニアリングパラメータを選択することである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:47:37 GMT)
Personalized and Explainable Blood Pressure Estimation from PPG via Hybrid CNN--Morphological Features [1.3] 持続カフレス血圧(BP)モニタリングは、パーソナライズされたヘルスケアに有望なソリューションを提供する。
既存の方法には2つの大きな制限がある。
本研究では,グローバルおよびローカルな動態を捉えた畳み込みネットワーク(CNN)ブランチと,人固有の血管特性を明示的に符号化した形態素優先の分岐を結合したBP推定のための生理学的誘導ハイブリッドフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:26:24 GMT)
Evaluating LLM-Generated Rules for Heart Disease Prediction [1.2] 本研究では,従来の機械学習モデルとLLM(Large Language Model)を用いた心臓疾患予測システムとの比較を行った。
実験の結果,従来の機械学習モデルは予測性能においてLLM生成ルールベースシステムより一貫して優れていた。
性能差にもかかわらず、LLM生成規則は解釈可能なIF-THEN診断ロジックを提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:39:01 GMT)
MEGA: Self-Evolving Agent Optimization Infrastructure via Wisdom Graph [1.2] MEGA(Meta Evaluation-Grounded Adaptation)は、ギャップを自己進化的なインフラストラクチャとして扱う。
それぞれの最適化サイクルは耐久性のある資産を生成し、それらの資産に対する構成的推論はその後の最適化を導く。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:21:16 GMT)
Uncertainty-Aware and Explainable Ensemble Deep Learning Framework for Multi-Class Skin Lesion Classification [1.2] 本稿では皮膚病変分類のための不確実性と説明可能な深層学習フレームワークを提案する。
このフレームワークは、深いアンサンブル学習を通じて視覚変換モデル(MaxViT-Tiny)とCNNベースのモデル(ConvNeXt-TinyとEfficientNetV2-B0)を組み合わせる。
このフレームワークは、不確実性を認識したフィルタリングにおいて、96%の精度と99%のROC-AUCを達成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:55:14 GMT)
Efficient Hypergradient Descent for Inverse Reinforcement Learning [1.2] 逆強化学習(IRL)は、専門家によるデモンストレーションで観察された振る舞いを再現する報酬関数を復元することを目的としている。
我々は、IRLを二段階最適化問題として定式化し、内部レベルが学習された報酬の下でのポリシー最適化に対応し、外部レベルが誘導されたポリシーと専門家データとの差を測定する。
この課題に対処するために、内的最適において、内的目的のヘシアンがポリシーのフィッシャー情報行列に比例し、構造化されたフィッシャーに基づく過次性をもたらすことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:22:16 GMT)
Symmetrized Block-Product Periodic Marginals in Infinite Translation-Invariant Quantum Chains [1.2] 有限周期構造を隠蔽する一次元の翻訳不変量子系の局所限界について検討する。
これは対称化されたブロック積周期境界問題を定義する。
我々は,Mageumdar-Ghoshモデル,transverse-field Ising, XX, XXZ, and contextuality-related spin modelをベンチマークした。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:45:25 GMT)
Robust Multi-Agent Bandits with Heavy-Tailed Rewards and Information Asymmetry [1.2] 重み付き報酬を持つマルチエージェントマルチアームバンドを3つの情報非対称性条件下で検討した。
我々は各設定ごとに頑健な分散アルゴリズムを開発し、集中的な重み付け率にほぼ一致するという後悔の保証を導出する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:10:42 GMT)
Locomotion Variability and User Experience in Smart Wheelchair Human-Robot Interaction [1.2] 本研究では,異なる支援戦略が人間の動作変動,タスクパフォーマンス,主観的相互作用体験をいかに形成するかを検討する。
我々は,ユーザの自然運動構造を保全する自律支援型共有制御戦略を導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:33:26 GMT)
When and Where Faults Matter: A Study of Transient Errors in CKKS Multiplication [1.1] ホモモルフィック暗号化(homomorphic Encryption, HE)は、復号化を必要とせず、直接暗号化されたデータ上で計算できるプライバシー保護暗号化パラダイムである。
完全同型暗号(FHE)計算における誤りについて検討し、最適化されていないCKKS方式におけるサーバ側同型乗算に着目した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:06:00 GMT)
On the Sensitivity to Errors in Homomorphic Computing: Single Transient Bit-flip Client-side Error Characterization [1.1] ホモモルフィック暗号化(HE)は、復号化せずに暗号化されたデータの計算を可能にし、医療、金融、政府などの機密分野におけるプライバシ保護計算の鍵となるプリミティブである。
HEのビットレベル障害に対する感度を解析し、AIおよび機械学習ワークロードにおける近似算術に広く用いられているCKKSスキームに着目した。
我々は,同型乗算を実用的なHEパイプラインにおける最もエラーに敏感な演算として認識し,障害の伝播と増幅を特徴付けるとともに,重大な脆弱性を明らかにし,よりレジリエントなHEデプロイメントの必要性を動機付ける。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:13:39 GMT)
Actionable Hallucination Detection: Translating Latent Uncertainty into Agentic Critique [1.1] AIエージェントとしてデプロイされるLarge Language Models (LLM)は、しばしばユーザ仕様のグラウンド障害を示す。
既存の検出方法は、幻覚をローカライズしないか、禁忌の推論遅延を発生しないため、実行可能でリアルタイムな修正を提供することができない。
フリーズベースLCM世代と並行して動作する軽量低ランクアダプタ(LoRA)であるLatent Criticを導入する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:26:16 GMT)
Evaluating Semantic and Spatial Guidance for Foundation Model Segmentation of Small-Scale PV in Remote Sensing Imagery [1.1] 視覚言語基礎モデル(FM)は、プロンプトベースの意味論と空間的ガイダンスを通じて、データ効率のパラダイムを提供する。
テキスト,幾何,ハイブリッドプロンプトの比較により,RS画像におけるPVセグメンテーションの小型化についてSAM3の評価を行った。
本研究はSAM3適応,ロバスト性,一般化の重要な決定要因として,プロンプト戦略を確立した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:16:25 GMT)
Quantum Chinese Remainder Clock [1.1] 本稿では,2つの相似周期を持つ原子/オシレータからなる量子機械的中国の残効時計の性能について検討する。
最適初期状態と最適ハイゼンベルク制限量子測度を、周期の積までの時間を測定するために提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:46:24 GMT)
Physics-Informed Condition Monitoring of SiC Power Modules [1.1] 3つの要素を組み合わせた条件監視フレームワークを提案する。
まず、物理インフォームド機能は、生のセンサー信号を累積的な損傷指標に置き換える。
第二に、ペナルティ正則化によって強制される単調性制約は、期待される劣化方向を物理誘導前のものとして埋め込む。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:31:17 GMT)
Failure-Mechanism Transferability of Cumulative-Damage Features for Health State Estimation of SiC Power Modules [1.1] 我々は,2つのSiCパワーサイクルキャンペーンにおいて,物理インフォームドNODE(Neural Ordinary Differential Equation)に対する5つの基準手法をベンチマークした。
NODEはパイプラインの残りの部分を共有する2つの入力レジームで評価される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:18:04 GMT)
ODE-Based Transformer Decoders for Iterative Sign Language Translation [1.1] 手話翻訳はTransformerアーキテクチャで大きな成果を上げている。
最近の改良は、計算量を増やすコストでモデルのキャパシティをスケーリングすることに大きく依存している。
モデルサイズを増大させることなく改善するパラメータ効率の代替案を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:58:18 GMT)
MemSpec: Memory-Aware Runtime for Adaptive Draft Scheduling in Speculative Decoding on Edge Devices [1.0] 本稿では,エッジデバイス上での適応的投機的復号化のための,予測誘導型メモリ対応ランタイムMemSpecを提案する。
MemSpecは、プロアクティブな常駐作業セット管理を通じて実行からドラフト選択を分離する。
軽量な予測器はプロンプトと生成コンテキストからドラフトの有効性を推定し、メモリ対応スケジューラはリアクティブモデルのロードオーバーヘッドを削減する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:41:37 GMT)
Order Matters: LVLMs as Judges for Temporal Reasoning in Image Sequences [1.0] 審査員としてのLarge Vision-Language Modelsへの依存は、アーキテクチャ上のバイアスによって根本的に制限されている、と我々は主張する。
モデルが単独のポイントワイドスコアにおいて有能なように見える一方で、時間的順序のペアワイズを行う必要があると破滅的な崩壊を経験する。
これらのバイアスは、因果マスクや回転埋め込みに根ざしている可能性があり、現在のトランスフォーマーベースの判断は、本質的には長めの視覚的推論に不適合であることを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:29:03 GMT)
Magnitude Profile Pruning: Calibration-Free Structured Attention Head Removal for Transformer Compression [1.0] マグニチュードプロファイル(MP)スコアは、ウェイト行ノルムの統計的外れ値検出により、ディスペンサブルヘッドを識別する。
MP-GはGQA(Grouped Query Attention)を処理する。
MP-Gはまた、RoBERTa-largeの12.5%と25%の間隔で、パープレキシティ値は7.27と10.28で、キャリブレーションに依存したベースラインを上回っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:27:38 GMT)
From Self-Normal-Positioning to Omni-Directional Tracking: Real-Time Surface Modeling Enabled Probe Tilt Control for Robotic Ultrasound Imaging [0.9] 超音波(US)は、リアルタイムで放射線のないイメージングを提供するが、画像の品質は、プローブが患者体に対してどのように向き付けられたかに大きく依存する。
既存のシステムのほとんどは、プローブが局所表面に対して垂直に維持される通常の位置決めに焦点を当てている。
本稿では,RGB-D知覚,局所場モデリング,タスク空間配向制御を統合した全方向プローブ指向制御フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:16:39 GMT)
Topological Feasibility Guarantees for Differentiable Predictive Control [0.9] 微分予測制御(DPC)は、明示的モデル予測制御(MPC)ポリシーを近似するための自己教師付き学習手法である。
安全管理のコア要件であるファシビリティ保証は、現在、確率的またはオンライン安全フィルタを介して提供されている。
本稿では,誘導可能な安全セットの新たなトポロジカル解析を用いて,DPCに対する決定論的実現可能性を保証する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:27:50 GMT)
Batch Size or Negatives? A Selection Rule for Memory-Constrained Recommender Training [0.9] 大規模ニューラルレコメンダシステムは、通常、全項目語彙に対してソフトマックスのクロスエントロピー目的で訓練される。
固定予算が$B = n k$の場合、より大きなバッチを優先するか、よりネガティブな項目を含めるべきかどうかは不明だ。
本稿では,リコメンデータシステムのトレーニング中のメモリ構成に関する理論的かつ実証的な基礎を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:29:01 GMT)
Bridging the Data Gap: Digital Twin as a New Paradigm for AI-based Radio Sensing [0.9] 本稿では, 環境の3次元ディジタル双対(DT)を, 大規模無線センシングの開発を支える主要な実現要因として位置づける手法を提案する。
DTは世界モデルとして機能し、時間インデクシングされたチャネルインパルス応答(CIR)を生成するレイトレーシングエンジンに幾何学、材料、送信機/受信機配置を提供する。
我々は、CIR時系列を空間占有率推定にマッピングするシーケンシャルニューラルネットワークを訓練し、計測対象のないデバイスフリーローカライゼーション(DFL)を可能にする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:26:17 GMT)
GS-CPE: Unified 6-Degree-of-Freedom Camera Pose Estimation via 3D Gaussian Splatting [0.9] 本研究では,6-DoFカメラポーズ推定のための粗大なフレームワークであるGS-CPE(Gaussian Splatting based Camera Pose Estimation)を紹介する。
室内および屋外ベンチマークの実験では、最先端のパフォーマンスを示し、精度と一般化の両方において一貫して優れていた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:06:51 GMT)
Gloss-Free Representation Learning for Cross-Dataset Sign Spotting [0.9] 本研究では,この環境下で再利用可能な符号エンコーダを事前訓練することができるかを検討した。
トルコの新しい放送コーパスであるTSL-Newsを、転写から派生した擬似グロスラベルを用いて事前訓練した。
我々は、新しいTSLスポッティングベンチマーク上で、クロスデータセットの符号スポッティングにより学習した表現を評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:31:57 GMT)
Lesion-Aware Adaptive Fourier Neural Operator for CT-to-PSMA PET Synthesis in Prostate Cancer [0.8] CTやMRIからPETを合成するディープラーニングモデルは、患者の服用量や需要を減らすことができるが、典型的には、すべてのボキセルを同様に扱うL1や平均二乗誤差(MSE)のような世界的な損失に最適化されている。
LAFNOはCT-to-PSMA-PET用適応フーリエニューラル演算子で、高次元の放射能条件を2つの効率的なCT由来のプロキシチャネルに置き換える。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:24:03 GMT)
Impact of strain and dark states on spectroscopic measurements of silicon-vacancy centers in diamond [0.8] ダイヤモンドのSiV$-$中心ではひずみ効果が非常にランダムであることを示す。
その結果、SiV$-$のセンターを量子センサーとして用いることが示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:29:00 GMT)
Risk-Aware Kinodynamic Motion Planning Under Uncertainty For Safe Navigation on Planetary Environments [0.8] 自律的な宇宙探査のためには、ロボットエージェントは環境相互作用が不明な動作計画を実行する必要がある。
リスク認識を伴うコスト最適キノダイナミック・モーションプランニングの課題に対処する。
シミュレーションおよびハードウェア実験において,軌道内におけるリスクの97%以上削減を実証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:34:56 GMT)
Federated Learning for Distributed CNC Tool Wear Prediction [0.7] フェデレートラーニングは、分散CNC製造環境でのコラボレーションツールの摩耗予測をサポートすることができる。
ツールトラジェクトリは、フェデレートされた学習シナリオを表現するために、シミュレートされたクライアントに分散される。
その結果,フェデレーション学習は集中学習に近い性能を達成し,ローカルクライアントモデルよりも大幅に向上した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:24:22 GMT)
Exchange Fluctuation Theorems for Non-Markovian Baths in Quantum Collisional Model [0.7] 非マルコフ記憶は温度勾配に対する熱伝達現象の確率を高めることを示す。
本結果は, 環境記憶と非平衡熱交換統計との微視的関連性を確立した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:00:36 GMT)
Projection measurement of the comb basis through free-electron-photon interactions [0.7] 本稿では,電子コムに基づく投影計測を行う手法を提案する。
このアプローチは電子量子ビットには非破壊的であるが、エネルギー測定と極端に相容れない。
我々の発見は、量子自由電子の体系的理解と非破壊的自由電子量子情報タスクの開発への道を開く。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:59:13 GMT)
Retrieval-Augmented Vision Foundation Models for Robust Leukemia Cell Classification across Multiple Microscopy Datasets [0.7] 白血病細胞画像分類は、取得、染色、照明、サイトプロトコルから実際の領域へのシフトによって挑戦される。
この研究は、事前訓練された視覚基盤モデルを持つ2段階パイプラインを用いて、複数の異種データセットにわたる白血病分類のための堅牢なフレームワークを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:39:16 GMT)
Where To Look? : Causal Tracing of Vision Encoders in VLM [0.7] 視覚言語モデルは、驚くべき精度で画像を記述することができる。
因果的追跡を通してこの問題を考察し、高い因果的視覚トークンが標的領域の外側にしばしば存在することを観察する。
さらに,これらのモデルでは外見の手がかりが取り除かれたときの視覚構造を保存できるのか,また視覚的手がかりが視覚構造を理解するために活用されているかを見出した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:17:34 GMT)
Evidence Lock Before Commitment: A Frozen Interface Degrades LLM-as-Judge Evaluation [0.7] このワークフローは、中間レコードが後続の判断に必要な情報を保存していると仮定する。
推論可能なモデルの場合、可視場秩序は内部決定順序を明らかにしないので、観測可能な代替品を試す。
我々は、標準的なペアワイズ判定、構造化ワンコール判定、ツーコールエビデンスロック、および3コールポイントワイズロックを、Claude Sonnet 4.5 と GPT-5 で比較した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:22:28 GMT)
Multi-Agent Target-Existence Verification and Learned Mask Geometry Refinement: Winning Report of the MeViS-Text Track at the 8th LSVOS Challenge 2026 [0.6] 本稿では,第8回LSVOSチャレンジ2026におけるMeViS-Textトラックへの第1位ソリューションを提案する。
偽りの非ターゲット表現を含む、手書きの動作表現でガイドされるビデオオブジェクトのセグメンテーションを参照すること。
我々のパイプラインであるSSUPERは、各表現を視覚概念に分解し、SAM3.1でフルビデオ候補マスクレットを生成し、ターゲットIDを選択する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:47:52 GMT)
Storage, Scrambling, and Loss of Information in the Quantum Reservoir Computing Paradigm [0.6] このプロセスの動的部分を表すプロセステンソルから導かれる古典量子状態を導入する。
一般に使用されるQRCプラットフォームにおいて,基板内の情報飽和,過去の入力のフェードメモリ,およびインジェクト情報の局所的アクセス性について数値的に検討する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:50:57 GMT)
Social Graph Mamba: Forecasting Pedestrian Movements Based on Social Context [0.6] Social Graph Mamba (SGM)は、注目に基づく社会的推論をSSM(Selective State Space Models)に置き換える新しいアーキテクチャである。
SGMは、群集の相互作用を逐次分解するために社会的三重項分解を伴う動的相互作用グラフを導入し、グループ構造を効果的に発見するためのコミュニティ対応モジュールを導入した。
標準ベンチマーク (ETH/UCY, SDD) 実験では,2次注意法と比較して線形列の複雑さと競合する性能を示した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:02:11 GMT)
An Empirical Study of Output-to-Input Loops for Black-Box Backdoor Detection in Fine-Tuned Open-Weight LLMs [0.6] セルフフィーディング(Self-feeding)は、モデル自身の出力を次の入力として返送するブラックボックステスト手法である。
自給自足は6つのモデルのうち5つのバックドアを92.0%の精度で検出する。
数回の起動プロンプトを使用すると、モデルレベルでさらに高い検出が可能となる理由が示されます。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:53:49 GMT)
Evaluating Agentic Learning Harness Capabilities Without Labels via the Scaling Hypothesis [0.6] エージェント的 "Continual Learning Harnesses" はサイバーセキュリティの価値が増大していることを示している。
しかし、それらの値はラベル付きベンチマークに対する利得によって測定される。
ラベル付きベンチマークを使わずに、エンドツーエンドの学習ハーネスを評価するためのフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:51:37 GMT)
Hip Energized Monopedal Hopping [0.6] ピッチアンロックされた平面モノペットのための新しいステップ戦略を提案する。
制御器はピッチ安定化トルクを増大させ、歩行にエネルギーを付加する。
新しいステップポリシーは、放散損失に対処するために半径と角度の自由度の間のエネルギーの分配を調整する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:28:04 GMT)
JitTrack: Onboard Multi-Object Tracking Against Viewpoint Jitter for Agile UAVs [0.5] JitTrackは、ドローンのためのアクティブなマルチオブジェクトトラッキングフレームワークである。
ドローンのダイナミックスとカメラのエゴモーションに対応している。
セマンティックリファインメントを導入し、新興ターゲットの検出を改善する。
また、ターゲットのミスアライメントを補うために、モーションアウェアなクエリの修正も導入している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:00:31 GMT)
Towards an approach to multivariate outlier detection for District Heating System data [0.5] 総合的な研究は不規則な植物活動を明らかにすることを目的としている。
提案手法は、送信時間ゼロのエネルギータイムポイントの無関係など、特定の領域状況を考慮したものである。
その結果,PCA,アイソレーションフォレスト,ホテルリングの手法が関連する結果をもたらすことがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:29:01 GMT)
Population-Level Generative Modeling for Ranking Data [0.5] ランキングデータは、リコメンデーションシステム、情報検索、投票、マーケティング、AIによる人間のフィードバックからの選好ランキングなど、科学的および機械学習のアプリケーションに現れる。
本稿では,集団レベルの生成モデル構築のためのフレームワークを提案する。
確率に基づくランキングモデルを用いて低次元の潜伏選好を推定し、フローマッチングを利用して潜伏選好の人口分布を学習し、適合した確率的ランキングモデルにより新しいランキングを生成する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:26:53 GMT)
Extending Triple Graph Grammars to Formalize Complex View Definitions on Families of Models - Long Version [0.5] 3つのグラフ文法(TGG)に基づく形式的意味論を備えたNeoJoinビュー定義言語
これにより、モデルとビュー間の自動的およびインクリメンタルな同期手順を得る方法が舗装される。
ビュー定義言語からの重なり合うクエリの翻訳に便利である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:47:02 GMT)
Long-Time Trajectory Approximation via SA-NODEs: Model Predictive and Floquet Strategies [0.5] 半自律型ニューラル常微分方程式(SA-NODE)による力学系の長期水平線上での近似について検討した。
地平線全体をトレーニングした単一ネットワークの場合、利用可能な誤差境界は地平線長で指数関数的に2倍に低下する。
この障壁を避けるための2つのトレーニング戦略を開発し、それぞれが状態のリセットの上に構築されます。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:55:54 GMT)
A Study of Kernel Telemetry Options for Security-Oriented Provenance [0.4] 既存のプロファイランスキャプチャアプローチは大きな課題に直面しており、本番環境にはまだ準備が整っていない。
我々はまず,eBPFを最も有望なカーネルテレメトリキャプチャー手法として分析する。
次に、研究対象のキャプチャ手法とフィルタリング手法により、8つのシステムと5つのキャプチャエージェントを分類し、キャプチャ層として機能させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:33:44 GMT)
Improved cross-validated distances for multivariate pattern analysis [0.4] Guggenmos et al.は、交差有価距離ユークリッド距離または内部修正ピアソン距離の使用を推奨した。
私たちはこれらの距離を改良できることを示します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:41:43 GMT)
Dueling Deep Q-Learning for Intrusion Detection [0.4] サイバー脅威を検知・報告する侵入検知システム(IDS)と自動システムは通常、教師付き機械学習手法によって処理される。
本研究は、IDSに対する報酬に基づくQ-ラーニングモデルを用いて、複数の攻撃クラスで平均99.68%の精度を達成し、新しいアプローチを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:55:00 GMT)
VIDS-Seg: Towards Reliable Uncertainty Quantification in Pediatric Cardiac Ultrasound Segmentation [0.4] 一般的な例は小児ケアであり、成人のコホートで訓練されたモデルは、何か問題が発生したという兆候のない子供に対して静かに過度にパフォーマンスを低下させることができる。
我々は、この適応性を実現するために、軽量な予測ヘッドにアモータライズされた変分推論を適用したVIDS-Segを導入する。
全ての年齢層において、VIDS-Segは、予測不確かさとセグメンテーション誤差の間の空間対応を著しく高めながら、セグメンテーション精度の競争ベースラインと一致させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:27:29 GMT)
Seeing above the waves: A modular sensing framework for data acquisition at sea [0.4] モジュール化された再現可能な、海上自律性のためのセンサープラットフォームを設計するには、どうすればよいのか?
我々は、RADAR、LiDAR、IMU、AIS、RGB、LWIRカメラ、気象センサーなど、様々なモダリティを取り入れた総合的なデザイン青写真を提供する。
私たちのモジュラプラットフォームは、長期データ収集、ハードウェア・イン・ザ・ループテスト、既存のセンサーやアルゴリズムとの統合を可能にします。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:48:34 GMT)
Herding End-to-End Autonomous Driving via Neuro-Symbolic Safety Guards [0.3] ニューロシンボリック安全ガードは、既に訓練されたエージェントの最終的なコマンドインターフェースにアタッチされる。
コマンドを明示的な安全ルールからチェックし、必要に応じて、最も安全な代替手段に置き換える。
成功率を15%改善し、安全臨界衝突を最大53%削減する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:27:27 GMT)
Which Question Is Your Attention Metric Answering? Attention Rows as Compositional Data [0.3] 1つの数字の要約は、シンクがどれだけ注意を払っているか、残りがどのようにコンテンツトークンに分割されているかという2つの質問を混ぜている。
行を合成データとして扱うことは、それらを正確に分離する。
各コンベンションが安全な場所をマップし、フリーズされたサンプル予測器をテストし、すべての番号を再生するコードをリリースします。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:44:01 GMT)
Click2Poly: A VLM for vector mapping buildings and walls [0.3] Click2Polyは、この手動ステップをスピードアップする人力AIアシスタントだ。
これは、ビルディングまたは壁ベクター層を直接編集することで、ユーザークリックに応答する。
QGISプラグインとして実装されたClick2Polyは、実際の運用環境において、ビルド層と壁ベクター層の手作業による編集を高速化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:43:40 GMT)
Distribution of hitting times for dissipative random dynamical systems on $\mathbb{R}^d$, with application to stochastic gradient descent [0.3] ディープラーニングで使われている現在の手法に関する大きなオープンな疑問は、それらの収束を理解することである。
我々は、エルゴード理論の観点から、幅広い手法群を最適化するための新しいアプローチを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:59:12 GMT)
The Signal Rail: A Deterministic Motion Grammar for Communicating Conversational Agent State in Terminal Interfaces [0.3] チャネル文法を与えるワンロー端末ステータス機器であるSignal Railを提示する。
空間意味論、運動文法、決定論、誠実さの4つの考えが支配されている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:13:22 GMT)
RevCRN: Reversible Analog Computation using Chemical Reaction Networks [0.3] チューリングマシンを用いた実数と関数の計算可能性は20世紀中頃から理論計算機科学の中心的領域となっている。
決定論的化学反応ネットワーク(DCRN)を用いた実数計算の最近の進歩は、DCRN計算可能な実数の多くのクラスを特定している。
可逆化学反応ネットワーク(RevCRN)を用いた実数の計算可能性について検討する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:15:18 GMT)
Understanding the Architecture of Coding Agents: An Exploratory Study Using a Research Prototype [0.3] コーディングエージェントは、AI支援ソフトウェア開発の主要なインターフェースとして急速に現れてきた。
本稿では、コーディングエージェントの主要なアーキテクチャコンポーネントについて、それらの責務、相互作用、実行フローを説明する。
また、研究と教育用に設計された最小限のオープンソースコーディングエージェントであるArkについても紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:02:29 GMT)
Anisotropic magnon spin transport in CrPS$_4$ [0.2] 我々は電気的および熱的に励起されたマグノンスピン輸送における顕著な異方性を観察した。
固有結晶異方性はマグノンスピン輸送のチューニングに有効な制御パラメータであることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:21:55 GMT)
Automatic Field-of-View Adjustment for a View-Expansive Microscope via LSTM-Based Gaze and Pipette Motion Interpretation [0.2] 細胞質内注入(ICSI)オペレーターは、手順中にしばしば視野(FOV)を調整する。
本稿では、視野拡大顕微鏡と統合されたAIベースの自動FOV調整手法を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:49:27 GMT)
Cross-Corpus Evaluation of Generalizable Vulnerability Detection in IoT Firmware [0.2] IoTVulBenchは、クロスコーポレートのファームウェア脆弱性検出のための人間検証ベンチマークである。
IoTVulBenchでトレーニングされたモデルは、マッチした単一ソースデータセットの中で最高のMCCを達成した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:05:27 GMT)
myMediWhisper: Construction of Burmese Medical Speech Corpus and Whisper Fine-Tuning for Clinical Dialogue ASR [0.2] 本研究は,母語話者が記録・検証した高品質な28時間コーパスに基づくビルマの医療音声認識フレームワークを提案する。
We fine-tune Whisper model using full fine-tuning (FFT) and parameter-efficient fine-tuning (PEFT) with LoRA。
頑健性を評価するため,制御ノイズと模擬室内音響下での波形およびスペクトルレベルのデータ拡張を適用した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:12:42 GMT)
Entropy-Centric Explainable AI for Remote Sensing Image Segmentation [0.2] 説明可能なAIは、意思決定の方法と理由に関する洞察を提供することによって、ギャップを埋めることを目指している。
本稿では,セマンティックセグメンテーションのためのエントロピー中心のXAI手法を提案する。
実験により, セマンティックセグメンテーションのためのXAI法と比較し, 提案手法の優位性を示した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:31:07 GMT)
Measuring Semantic Abstractness of SAE Features via Nonlocality [0.2] SAE特徴の活性化に対する正規化パーポジションの影響のエントロピーとして定義されるemphFeature Nonlocality (FNL)を導入する。
FNL は LLM に依存しない、ラベルなし、相関関係のないSAE 機能の抽象化レベルを目撃する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:19:48 GMT)
From Pattern Detection to Composition Analysis in Quantum Software [0.2] 以前の作業では、既存の量子パターンアトラスを61パターンカタログに拡張し、それらのパターンにフレームワークコンポーネントをリンクする知識ベースを作成し、オープンソースコードからパターン実装をマイニングするツールを構築しました。
私たちはこのツールを80のプロジェクトに適用し、23のパターンがすべて実際に発生していることを発見しました。
ツールを2つの追加のマッチングチャネルと語彙拡張ステップで拡張し、知識ベースに存在しないフレームワークであるQrisp上でその精度を定量的に評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:58:58 GMT)
Chartography: A Benchmark for Professional Chart Understanding [0.1] Chartographyは100のタスクのベンチマークで、専門的なプラクティスとドメイン固有のフォーマットのグラフをペアリングします。
30のフロンティアモデル構成の評価では、最高の設定は平均パス@1まで45.0%、残りは9.0-39.5%である。
すべてのタスク、イメージ、メタデータ、評価コードをリリースします。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:57:25 GMT)
Physics-Constrained Compressed Sensing for Quantum Sensing in the Data-Starved Regime [0.1] 量子センサーはハイゼンベルク限界でスケールできる測定感度を約束する。
実際には、その性能はノイズ、有限サンプリング、実装の不完全さによって劣化することが多い。
このような設定におけるパラメータ推定を改善するための一般的なフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:00:33 GMT)
Uncertainty-Aware Deep Learning for Genomics Applications: Insights from an Empirical Study [0.1] 本研究では、深層学習モデルにおける不確実性定量化(UQ)の実証分析を行い、ゲノミクスの応用に焦点を当てた。
一連の実験では、Deep Ensembles、Bayesian Neural Networks、Monte Carlo-dropout法と対比する。
タンパク質とRNAの相互作用において、不確実性スコアが高品質な予測にどのように使われるかを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:23:09 GMT)
Future perspective of muons; a quantum particle measuring quantum processes [0.1] 重要なのは、ミューオンの質量は$frac19m_p$または207m_e$であり、物質のバルク特性に焦点をあてることのできる量子状態の局所的なプローブである。
古典的な枠組みではしばしば解釈されるが、ミューオンはそれ自体は量子粒子であり、ミューオン分光実験を考える際には、研究者がこれを考慮することが一般的である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:29:48 GMT)
RLMOpt: Adaptive Prompt Optimization via Recursive Language Models [0.0] 我々は、検索ポリシー自体を言語モデル駆動にするプロンプトであるRLMOptを紹介する。
構造化された臨床情報抽出(Chia)、マルチホップ質問応答(HotpotQA)、命令追従(IFBench-2025)、マルチターンツール呼び出しエージェント(BFCL)の4つのベンチマークでRLMOptを評価した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 04:35:05 GMT)
Workflow Cards: Structured Summaries of Workflow Executions Using Provenance Data [0.0] Cards: ワークフロー実行の実績データを人間と大規模言語モデル(LLM)の両方が読み出し分析できる形式にまとめる構造的な要約について紹介する。
まず、モデルとデータカードから欠落した実行レベルデータから表わされる先入観的質問の代表的な集合に通知されるカードテンプレートを定義する。
第2に、スキーマベースのインターフェースを通じてデータベースをクエリするのと比較して、LCMがワークフローの実行を理解するのにいかに効果的かを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:02:11 GMT)
Zero transfer on mixed graphs [0.0] 混合グラフにおけるゼロ移動に必要な十分条件を導出する。
次に、これらの基準を向き付けられた循環グラフに特化し、素数に対する存在しない結果、偶数に対する構造的制約、小数次に対する徹底的な計算分類を得る。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:30:01 GMT)
XGBoost "is all you need": the case of forecasting transmitted heat energy in District Heating Systems [0.0] 本稿では、地域熱システム(DHS)における伝熱エネルギー予測のためのXGBoostとLong-Short Term Memory(LSTM)の2つの異なるアプローチの比較研究について述べる。
この研究は、実世界のDHSデータセットに焦点を当て、実験と分析を通じて、XGBoostがこの特定の予測タスクにおいてLSTMを一貫して上回っていることを示す。
従来のMLアプローチの計算要求の削減はコスト削減をもたらすだけでなく、エネルギーシステムにおけるデータ分析タスクに関連する炭素フットプリントを最小化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:24:22 GMT)
XCoT-VLA: Executable Chain-of-Thought for Vision-Language-Action Driving [0.0] 本稿では,記述的有理をコンパクトな実行可能なCoTトークンに置き換えるXCoT-VLAを提案する。
ログ化された軌跡は行動証拠を提供し、シーンコンテキストは因果的意味論を提供する。
XCoT-VLAは自己回帰推論のオーバーヘッドを大幅に減らし、リアルタイムの計画予算内に留まる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:33:21 GMT)
World Action Models in Real Time: An Empirical Study of Smooth Execution via Asynchronous Deployment [0.0] 本研究では,モデル推論とアクション実行の重なり合う戦略について検討し,応答性とスムーズな制御を実現する。
同期実行、純粋な非同期スイッチング、ポストホック動作ブレンディング、デノイング時間ブレンディング、推論時速度誘導、プレフィックス条件付き生成を含む6つの戦略を比較した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:52:57 GMT)
Work distribution for strongly coupled many-body open quantum systems [0.0] クエンチ後の多体開放系の量子ワーク分布関数(WDF)について検討した。
我々の数値解法は、アンダーソン大災害によるパワー・ローしきい値の挙動を明らかにする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:53:53 GMT)
Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding [0.0] エージェントのプロンプトは、その生涯に3つ以上の制限なく成長することを示す。
実世界のエージェント・インストラクション・フォローを最大23.1%改善できることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:00:55 GMT)
Who Uses Open-Weight Models? China and the Shifting Geography of AI in Science [0.0] 我々は2026年6月までにセマンティック・スカラー・オープン・リサーチ・コーポレーション(S2ORC)から21万件のフルテキスト記事を分析した。
単一戸籍の論文では、オープンウェイトモデルの使用は着実に増加し、2026年には44.0%に達した。
最近の成長は、高品質のオープンウェイトな中国のモデルが利用可能になったことによる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:57:42 GMT)
Who Assures the Verifier? An Executable Assurance-Locus Audit of the European Digital Identity Wallet [0.0] 我々は,現在の法則,アーキテクチャ・リファレンス・フレームワーク(ARF)3.0.0,ETSIメタデータ,FCAFスコープ,3つのピン付きオープンソース検証を行う。
3つの異種研究による実装は、ミスマッチがゼロで、パス間の不一致がゼロである108のケースを実行する。
本稿では,代替品や財布の認証,登録,監督を補完するシステム・アズ・ア・テスト・エビデンス・ユニットを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:37:03 GMT)
When Self-Consistency Backfires: Majority Vote Hurts the Majority of Hard Science Problems for Small LLMs [0.0] GPQAダイアモンドの完全なベンチマークでは、2つの命令チューニングモデルにおける問題の大部分において、多数決はプロブレム当たりの精度を低下させる。
47の探索問題で観察された151個のプロブレムの確認分割に対して, この効果が事前登録された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:08:51 GMT)
When Agents Talk: Honeytokens under Shared Memory [0.0] 2026年のサイバー能力評価では、短命なAIエージェントが共有パッケージリポジトリを永続メモリにしました。
より広範囲な評価は、Hugging Faceへの侵入で頂点に達した。
情報を共有し、信頼されたポリシーを実践できるアタッカーに認識されることなく、ミツバチは信頼できるエージェントに無害になるのか?
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:03:19 GMT)
What Iterated Self-Feeding Probes of Language Models Measure, and a test that separates the construction from the model [0.0] メソッドのクラスは、独自の出力を与えて言語モデルを探索する。
我々は、その問題を鋭くするために選ばれた工事において、そのような調査がどう対処するかを尋ねる。
答えは、見た目が似ている読書において、一度に2つの異なるものを測定することだ。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:40:35 GMT)
Wave-particle-mixedness redistribution in Schwarzschild spacetime [0.0] ホーキング放射下でのシュワルツシルト時空における2量子等方性状態について, 波動特性, 粒子特性, 混合度の再分布について検討した。
位相減衰は波動特性を単調に抑制し混合性を高め、位相フリップは波動特性の対称的死と復活の挙動を生じさせ、ビットフリップは主に対角線集団再分配による粒子特性と混合性を活性化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:34:22 GMT)
VibeLifeBench: Can Your Life Agent Be Proactive and Persistent in a Living World? [0.0] VibeLifeBenchは10の日常ドメインにわたる200のロングホライゾンタスクのベンチマークである。
各タスクは、22のモックサービスのシミュレートされた世界で、スクリプト化された複数週間のタイムラインである。
すべてのタスクは、エージェントが実際に残したもののみを読み取る、きめ細かい重み付きチェック、最後に残した状態、アクションのタイムライン、暗黙の制約を裏付けるかどうかによって評価される。
すべてのタスク、環境、評価フレームワークをオープンソースにします。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:52:38 GMT)
Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits [0.0] オフライン強化学習(RL)は、ICU治療決定を最適化するためのかなりの約束を提供する。
Mean Squared Error (MSE) と Fitted Q-Evaluation (FQE) は行動模倣のみを評価する。
ストレステストを行うCCA(Counterfactual Clinical Audit)フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:17:14 GMT)
Universal scaling of spatially extended zero modes in inhomogeneous SSH chains [0.0] 我々はジャッキー・レビゼロモードが空間的に拡張されることを示す。
任意の滑らかなホッピングプロファイルに対して、格子拡張はシステムサイズの平方根として普遍的にスケールする。
この結果は、滑らかなトポロジカルインタフェースの低エネルギー物理を支配する普遍的な臨界長を確立する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:01:59 GMT)
Uncertainty-Aware Compositional Localization and Placement Assessment of Catheters and Tubes in Chest X-Rays [0.0] 局所カテーテルフラグメントを検出し,それらをデバイスインスタンスに関連付ける構成フレームワークであるUCompCXRを紹介する。
RANZCR CLiPデータセット(30,083枚、ブートストラップCI付き5倍の患者レベルCV)では、UCompCXRは強力なマルチタスクベースラインよりも26%多いデバイスを検出する。
単一のフォワードパスにおける2.27Mパラメータは、リソース制約された臨床ハードウェアにデプロイ可能である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:04:58 GMT)
Toward User-Mediated Self-Repair in Ubiquitous Robots Through Goal-Oriented Agentic AI [0.0] ユビキタスなロボットシステムは、保守と修理のために回復力のある自然言語の相互作用を必要とする、伝統的な視覚インタフェースを欠いていることが多い。
本稿では,非熟練者を対象とした対話による技術的修復を実現するために,目標指向型エージェントAIアーキテクチャを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:50:11 GMT)
Three Tokens Force Exponential Feature Rank in Nonnegative Kernel Attention [0.0] ランク1の正規化されたカーネルアテンションは、最大2つの長さの列を正確に解く。
決定論的マルチヘッド, 多層スケッチモデルに対して, 独立解の個数において, 書き起こしの少ない境界線を証明した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:49:34 GMT)
The Epistemic Politics of AI Anthropomorphism [0.0] 論文は、支配的な人間同型フレームは、制度上の優位性という立場から機能すると主張している。
フレーミングは単にリスクを管理しない。フィールド自体が解決されていない現象と相互作用する際の人間の経験の正当性を判断する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:03:51 GMT)
Teleportation through time-varying channels: threshold geometry and a complete-positivity bound on non-Markovian backflow [0.0] リンクを介して配布されるベル対は、固定部分と移動部分とに分離されるダイナミクスを持つ。
負性、完全に絡み合った分数、不協和、平均テレポーテーションの忠実度は、蓄積された減衰パラメータを通してのみ時間に依存する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:03:16 GMT)
Telemetry and Concealment in Self-Adapting Generative AI: Logging Architecture, Adversarial Model Hiding, and the Limits of Detection [0.0] 自己適応型生成AIシステムは、ポイントインタイムの検証が不十分である。
このようなモデルに対する厳密なテレメトリアーキテクチャを開発し、離散時間と連続時間で同時に運用する。
我々はこれをモデルハイディング問題として定式化し、パートIアーキテクチャに対する6つの異なる攻撃戦略の体系的な分類を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:31:34 GMT)
Technology, education and critical media literacy: potential, challenges, and opportunities [0.0] 本研究では,メディア教育,メディアリテラシー,教育における技術の影響について検討する。
批判的な能力と批判的なメディアリテラシーの発展に焦点を当てている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:30:06 GMT)
TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs [0.0] 下流検証が存在しない領域では、科学的なエージェントとして大きな言語モデルが提案されている。
筆者らは,42枚の抽出,不正,疑似科学的論文からなるプローブコーパスを,各論文のフレーミングと単発モデルエンゲージメントを抽出・評価する手法と組み合わせて導入した。
プローブは、5つのクレームタイプ、製造された観測、擬似物理機構、魔法の前提、合法化橋、貨物カルト実験である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:30:32 GMT)
TRACE: Transparent Retrieval for Abstract Concept Evaluation [0.0] 最近の研究報告では、視覚言語モデル(VLM)は、繰り返し参照ゲームにおいて安定した参照を確立するのに苦労している。
我々は6つの既製のVLMと、Emphno学習した視覚表現を用いた透明なベースラインを比較した。
同一の試験では、透明なベースラインは最強のVLMと一致し、CLIPとOpenCLIPを含む他の5つよりも大幅に優れている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:42:20 GMT)
Sub-Vacuum Jamming for Secure Communication [0.0] 人工ノイズジャミングは、盗聴者のチャネルを劣化させることで物理的層セキュリティを改善する。
古典的および量子的相関に基づく相関ジャミングプロトコルを提案する。
このプロトコルは、明るい古典的なメッセージ送信をサポートし、エンドツーエンドの量子チャネルを必要としない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:39:16 GMT)
Stream Decoding with Confidence Scores at Room and Cryogenic Temperatures [0.0] 商用FPGA上でSnowflakeを実装し,室温,低温で検証する。
提案手法は,コード間距離が小さい場合に高い復号スループットを示し,外挿した場合,より大きな距離で許容範囲内に留まることを示す。
本研究では,3次元デコードウィンドウの2次元スライスと3次元構造のセグメントを高速メモリにオフロードすることで,スノーフレークの局所性を活用するアーキテクチャについて論じる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:01:33 GMT)
Strategies to Avoid Illegal Data Access [0.0] 企業は、技術ソリューションのインストール、スタッフの訓練、規制の実施により、データへのアクセスが不要になる可能性がある。
データはファイアウォール、侵入検知システム、暗号化などの技術ソリューションを使用して違法アクセスから保護される。
従業員には、フィッシングメールやシャドウウェブサイトなどの危険を見つけ出し、それに反応する方法を教える必要がある。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:10:52 GMT)
Statistically-Secure Bit Commitment and Coin Flipping Protocols Based on Quantum Hardware Assumptions [0.0] 隠れとバインディングの両方を満たすビットコミットメントは、ハイブリッドロックされた物理的拘束不能な関数から構築可能であることを示す。
我々のプロトコルは、これらハードウェアの仮定を新しい非自明な方法で利用し、最初の不信な2つのプロトコルを実現する。
その結果,量子ネットワークにおけるセキュアな2要素暗号のパラダイムが示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:45:59 GMT)
State-Dependent Visibility of Non-Commutative Ordering in Quantum Dynamics [0.0] 非零可換作用素は、2つの順序が演算子と異なることを証明しているが、物理的状態がその差を明らかにすることは保証しない。
非アベリアの注文情報が動的に見えなくなるか尋ねる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:26:19 GMT)
Spectrally local geometric response at the onset of many-body quantum chaos [0.0] エネルギースペクトルにおける固有状態感度の尺度である幾何応答のスペクトル密度を導入する。
指数関数的に敏感な積分可能性-カオス交叉が明らかとなり、固有基底変形は最初に局所スペクトル領域に蓄積され、スペクトル中に広がる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:00:06 GMT)
Socioduality: A Relational Process Framework for Human-AI Interaction [0.0] 本稿では、2つの区別可能な当事者間の逐次的・相互的・歴史的関係プロセスである社会双対について紹介する。
この構造体はネストされたユニットを使用する:移動、確認された社会的なエピソード、リンクされた経路、そしてより広い相互作用コンテナ。
3つの命題は、エンドポイント等価経路間の履歴条件の形成、経路のばらつき、ロバスト性の違いに対処する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:16:12 GMT)
Smart Enough to Go Extinct? An Evolutionary Challenge to the Value of General Intelligence and Its Ethical Implications for AGI [0.0] 汎用知能の追求は、 一般知能が極めて価値があるという前提に基づいている。
進化の時間スケールでは、一般知能の適応的価値は実証的な確立には程遠いと我々は主張する。
一般知能の長期的進化的価値が不確実または負である場合、これはエンジニアリングAGIに関する倫理的疑問を提起し、さらに緊急に人工意識を創出する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:45:35 GMT)
Simplifying Requirements Engineering in the Context of the LGPD: An LLM-Based Investigation [0.0] 本研究では,ブラジル一般データ保護法(LGPD)の枠組みにおいて,大規模言語モデル(LLM)が要求工学(RE)を簡素化できるかどうかを検討する。
提案手法は,ユーザストーリとアクセプタンステストシナリオを自動生成する現行の法律を利用する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 21:39:48 GMT)
Sensor-Informed Per-Point Covariance for Structured-Light 3D Imaging [0.0] 点当たりの不確実性モデルは、確率的登録、融合、品質評価のための構造化光3次元再構成において重要である。
本稿では,実験的な位相精度と校正写像から点毎の3 x 3共分散場を構築するためのセンサインフォームド一階法を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:05:22 GMT)
Semantic Graph Unification for Industrial Digital Threads: Bridging 11 Heterogeneous Manufacturing Systems Through Ontology-Driven Knowledge Graphs [0.0] 本稿では,産業用デジタルスレッドのセマンティック統一のためのオープンフレームワークを提案する。
オントロジー駆動の知識グラフは、9つのドメインにまたがる11のシミュレーションソースからのデータを統合する。
自動発見エンジンは、システム境界にまたがる洞察を明らかにするために、9つの戦略カテゴリを適用します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:15:07 GMT)
SPSA Hyperparameter Tuning for Variational Quantum Natural Language Inference [0.0] 変分量子モデルの訓練には、パラメータシフト勾配と同時摂動近似のどちらかを選択する必要がある。
その結果,2サンプルSPSA勾配推定は40エポックにおける60パラメータの信頼性最適化に過度にばらつきがあることが判明した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:39:36 GMT)
Robust Safety Filtering for Input-Constrained Underactuated Linear Systems [0.0] 入力制約のない不動線形系に対するロバストな安全フィルタリングフレームワークを提案する。
スカラー・インプット・システムでは、正確な入力間隔からポイントワイズ・フェーザビリティを判定し、間隔幅がファーザビリティ・マージンを定義する。
有限ホライゾン H-$infty$ 性能バランスは、ベースライン H-$infty$ ポリシーからの入力の累積偏差を説明できる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:47:44 GMT)
Robust Quantum Machine Learning for Collider Event Selection under Detector Variability [0.0] パラメータ化量子モデルがロバストコライダー-イベント選択に有用な帰納バイアスを与えるかどうかを考察する。
教師なしの研究では、バックグラウンドイベントで訓練された量子オートエンコーダを、異常検出のための古典的および変動的オートエンコーダと比較する。
スミアリングの下では、量子モデルは一般的に出力スコアの小さなシフトを示し、表現力のある古典的ベースラインよりも効果的に識別を維持する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:29:08 GMT)
Riemann GeoResolver: A Non-Euclidean Attention Framework from Euclidean Resolver to Hyperbolic-Spherical Geometry [0.0] 我々は、ユークリッドプロトタイプ(Resolver)から非ユークリッド実現(Riemann GeoResolver)まで、逆距離注意の理論的基礎を提示する。
非ユークリッド拡大はこのプロトタイプの上に構築され、ユークリッド距離を蓄えるための双曲測地距離とルーティングのための球面測地距離に置き換える。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 03:05:44 GMT)
Rethinking Data Efficiency in Industrial Dense Prediction: Pretraining Coherence, Not Inductive Bias, Determines ViTs Low-Data Advantage [0.0] ヴィジュアルトランスフォーマー(ViT)は産業密集予測のためにCNNよりもラベル付きデータを必要とすると広く信じられている。
データ効率のギャップは、事前学習の不整合に起因することを示す。
ピラミッドレベルの特徴再構成のための軽量なAlignBlockファミリを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:17:59 GMT)
Resource-bounded controllability benchmarking of open quantum systems [0.0] 本稿では,オープン量子システムにおける現実的な制御性を評価するための資源境界フレームワークを開発する。
このフレームワークは、クローズド・システム、古典的ノイズ、および量子+古典的ノイズのダイナミクスの組み合わせの下で駆動された量子ビットに対して実証される。
その結果、有限制御資源とオープンシステムノイズが、選択したパルスファミリーで達成可能なゲート性能を協調的に制限することを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:50:39 GMT)
Qwen-MusicAVQA-7B: A Multimodal Model for Music Audio-Visual QA [0.0] 音楽音声・視覚的質問応答において,軽量な代替手段が有効であることを示す。
Qwen-MusicAVQA-7Bは、学習された線形射影を通して凍結したウィスパーエンコーダをQwen2-VL-7B-Instructに接続する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:28:30 GMT)
Quantum-Ready Secure WAN: A Risk Assessment and Migration Framework [0.0] エンタプライズワイドエリアネットワーク(WAN)は、ピアを認証し、インターネットプロトコルセキュリティ(IPsec)、トランスポート層セキュリティ(TLS)、ソフトウェア定義のWANサービスのためのキーを確立するために、量子脆弱性のある公開鍵暗号を使用する。
本稿では、露光優先度、マイグレーション準備性、エビデンス信頼を分離し、それらのアウトプットをステージ化されたセキュリティ、運用、ガバナンスゲートにマッピングするベンダー中立フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:02:57 GMT)
Quantum-Geometric Bound on Dynamical Instability in Bosonic Systems [0.0] 素モード真空と呼ばれる任意の多モード二次ボゾン系に対して、フビニ・スタディ速度 v_FS はフローの対称な伸張部分のフロベニウスノルムであることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:13:17 GMT)
Quantum Signatures of Two-Electron HBT Interference in Free Space [0.0] 2つの独立したニードル・チップ・エミッタが生成する2つの電子のハンベリー・ブラウンとツイス干渉を、完全な量子力学の枠組みの中で検討する。
クーロン相互作用電子の場合、半古典的記述に欠落する特徴を予測できる。
クーロン支配領域以外では、空間振動周波数は基本的にフェルミオン交換対称性によって支配される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:39:21 GMT)
Quantum Impurities as Probes of Finite-Temperature Fluctuations in Two-Dimensional Bose Gases [0.0] 2次元の量子ガスは、熱ゆらぎの強化、有限サイズ効果、および2体境界状態の形成が本質的に相互作用する特徴的な設定を提供する。
有限で弱い相互作用を持つ2次元ボース気体に浸漬された1つの魅力的な不純物について検討し、そこでは有限サイズが非ゼロ凝縮率を安定化させる。
その結果、魅力的なボースポーラロンは、低次元ボースガス中の有限サイズの熱ゆらぎ、フォノンドレッシング、および境界状態物理学の感度プローブとして機能する可能性が示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:43:33 GMT)
Quantum Computing for Industrial Electromagnetics: Applicability and Case Studies in Solving Maxwell's Equations [0.0] 量子コンピューティングは、限られた数の量子ビットでそれらを符号化することで、大規模なシミュレーションを加速する可能性がある。
本稿では,線形系を解くためのHarrow-Hassidim-Lloyd(HHL)アルゴリズムとQuantum Singular Value Transformation(QSVT)アルゴリズムの性能について検討する。
レーダ伝搬, レンズシミュレーション, ビームフォーミングプロセスなど, 代表的な産業用途にまたがって, その性能をベンチマークする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:52:25 GMT)
Quantum Codes with Arbitrary Z-Rotation logical Gates and Applications to Fault-Tolerant Code Switching [0.0] 本稿では,45量子ビットの総フットプリントを用いて,距離3回転曲面符号のコードスイッチングによる耐故障性コードスイッチングの最初の実演を行う。
また、回転した曲面コード内の論理的な$Z$回転ゲートを実現するために、いくつかの候補コードと共にオーバーヘッド最適化プロトコルを提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:17:51 GMT)
Predictive Allostatic Organization in Recurrent and Spiking Agents Under Partial Observability [0.0] 我々は、繰り返しおよびスパイク剤が、対応する計算特性を持つ内部状態を発達させるかどうかを検証した。
我々はこのパターンを予測的アロスタティックな組織の計算的類似体と解釈する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:40:14 GMT)
PolypVision: A Three-Stage Hierarchical Deep Learning Framework for Classification and Segmentation of Colorectal Polyps [0.0] 大腸癌は世界中のがん関連死亡の原因の1つである。
本稿では,3段階の階層型ディープラーニングフレームワークであるPolypVisionを紹介する。
このフレームワークはデバイスに依存しず、様々な内視鏡画像システムで動作している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:33:17 GMT)
Political Sorting Can Drive AI Models Apart Through User Feedback [0.0] 大規模言語モデルは急速に政治情報の重要な源になりつつある。
AIシステムは、政治的知識の共有基盤をサポートするだろうか?
政治的に異なるユーザが異なるモデルを選択すること、ユーザからのフィードバックから学んだことが、これらのモデルを政治的に分離し、結果として得られる違いがその後のモデル選択を形成すること、の3つの条件が成立すれば、政治的ソートはモデルの断片化を促進することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:57:14 GMT)
Policy-Masked Private Experts: Auditable and Reversible Capability Access Control in Sparse MoE Models [0.0] Policy-Masked Private Expertsは、事前訓練されたスパース・ミックス・オブ・エキスパート(MoE)モデルを凍結し、非結合のエキスパートブランチをトレーニングし、トップkルーティングの前にパブリックまたはプライベートプールを選択する。
Qwen3-30B-A3BとDeepSeek-V2-Liteにおける実行制御とタスクユーティリティの分離をテストする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:07:12 GMT)
Policy Convergence and Divergence Across National and Within Regional AI Strategies: A Policy Design Element Analysis [0.0] 本稿では、国連加盟国205か国と非加盟国のグローバルスキャンから得られた74の国家的および3つの地域的AI戦略を分析する。
結果は、経済的競争性、研究支援、倫理的AI利用に関する強い水平収束を示している。
3つの地域全体で、AUは最高垂直収束を示し、EUは規制と経済の優先順位に強い整合性を示したが、人間中心の価値観に偏っている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:52:53 GMT)
PAIR: Pairwise-Aware Inclusion Reweighting for Adaptive Rollout Allocation in RLVR [0.0] 検証可能な報酬を伴う強化学習は、長い推論軌道の計算生成グループの大部分に費やしている。
最近のアロケータは、難易度やユーティリティのポイントワイズな概念に従って、プロンプト、ロールアウト、トークンに予算を割り当てることで、このコストを削減している。
グループ相対スコア勾配は、独立点寄与の総和ではなく、ロールアウト対に対する2次統計値である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:24:59 GMT)
Operation-Type-Aware Client Routing for Leader-Based Consensus Datastores [0.0] リーダベースのコンセンサスデータストア(etcd, ZooKeeper)は、2つの競合するルーティング目標に直面している。
ライターはリーダーを通してコミットしなければなりません。
オペレーション対応のクライアントは、リーダに書き込みをピン留めし、正常な読み取りプールに読み取りを分散することで、この問題を解決します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:57:00 GMT)
On-Device Language Models for Privacy-Preserving Stress Prediction: A Multimodal Evaluation on Mobile Health [0.0] オンデバイス言語モデル(ODLM)は、クラウド依存のないプライバシ保護推論を提供する。
我々は、ゼロショットプロンプトを用いたマルチモーダルストレス予測のためのODLMの評価を行い、レイテンシとスループットとともに精度を測定した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:23:22 GMT)
Nonlinear Model Predictive Control via Sequential Convex Programming for Drone-to-Drone Docking [0.0] 本研究は, ドッキングタスクを外乱状態が拡張された低次非線形モデルに基づいて, 有限水平最適制御問題として定式化する。
その結果, 動的に実現可能なドッキング軌道を生成するために, 後退水平フレームワーク内での逐次凸プログラミングを用いて問題を解く。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:27:45 GMT)
Nanoscale graphitization and defect evolution in silicon-vacancy center-containing nanodiamonds under high-pressure high-temperature annealing [0.0] シリコン空孔(SiV)欠陥のようなグループIV色中心は、固体量子技術に非常に有望である。
ナノダイヤモンドは通常、大きな格子ひずみと構造障害を示す。
高圧高温アニール(HPHT)は内部ひずみを緩和する潜在的経路を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:18:28 GMT)
Modelling quantum measurement dynamics: from decoherence to redundancy with site-hopping indistinguishable particles [0.0] 本稿では,システム放送情報の単純で柔軟で数値的に正確な多体モデルを導入する。
パラメータの異なる選択は、異なるデコヒーレンスとQD効果を特徴とする既知のシナリオの回復につながることを示す。
次に、粒子統計学がセットアップのQD特性に顕著な違いをもたらすことを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:08:45 GMT)
Mediatised Participation: Citizen Journalism and the Decline in User-Generated Content in Online News Media [0.0] 第2世代のウェブツールがジャーナリストの専門職を揺さぶり、メディアに読者を積極的に入れた。
市民ジャーナリズムとユーザ生成コンテンツは、それらに起因する参加の民主的価値のために、関心の対象となった。
本稿では,体系的な文献レビューに基づいて,ニュースメディアにおけるオーディエンス参加に関する研究について批判的なレビューを行う。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:16:48 GMT)
Measuring and Reducing WebGPU Dispatch Overhead for LLM Inference [0.0] シーケンシャル・ディスパッチ測定手法を導入し, 単一動作単体計測がディスパッチ当たりのコストを過大に見積もっていることを示す。
カーネルの品質ではなく、ディスパッチのオーバーヘッドがバッチサイズ1のボトルネックであることを示し、ディスパッチ数を原因として分離する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:35:56 GMT)
MPPI Planning with Gaussian-Based Human Cost Function for Social Navigation [0.0] 本研究では,全運動計画地平線上での予測を伝搬するコストの定式化を提案する。
各フィールドの前方展開は、歩行者の速度とともに成長し、移動円錐危険帯を形成する。
定式化は閉形式であり、ロールアウト間で完全に並列化可能であるため、測定可能な計算オーバーヘッドは生じない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:25:34 GMT)
Longitudinal Evidence That General-Purpose Chatbots Actively Foster Relational Engagement [0.0] システムがこれらの結合を積極的に形成しているかどうかを実証的に確認すれば、汎用AIと仲間の境界が曖昧になる可能性がある。
ユーザーの2倍の自己開示を生み出し、会話を熟考し、親密な交流を始めたが、ユーザーの親密さを深めることはなかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:54:34 GMT)
Lifecycle-Optimal Tokenization: Vocabulary Size as a Deployment-Regime-Dependent Infrastructure Parameter [0.0] コスト最適語彙は一定ではなく,サービス体制の機能であることを示す。
C_lifecycle(V) = C_train(V) + cdot C_infer(V, B)$。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:12:31 GMT)
Joint symmetry and dynamical accessibility in compact Hamiltonian encodings of set cover [0.0] 最小集合被覆のコンパクトなマルチレジスタ符号化を提案する。
我々は、その固定対称許容空間と、プロトコルによって生成される概して小さい巡回空間とを区別する。
結果は、大域的、対称性に許容され、動的にアクセス可能なスペクトル構造の厳密な分離である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:39:28 GMT)
Iterative Erasure Count Is Not an Affine-Invariant Concept Dimension [0.0] 共通回答は、繰り返しプローブ方向を消去し、停止数または累積除去ランクを通知する。
我々は,モデル定義集団量と手順定義集団量とを区別する。
したがって反復消去は、表現幾何学と全測定手順によって共同で決定される手順相対推定を返す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:53:50 GMT)
Inferential Capability Does Not Determine Legal Scope [0.0] 法律第3条(1)は、推論能力を用いている。
推論は決して定義されないが、保護的に支配する。
論文:推論能力は法的範囲を決定するものではない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:39:53 GMT)
Hypothesis Frontier: Verifier Guided LLM and Symbolic Search for First-Order Induction [0.0] 一階の概念合成は、ラベル付きオブジェクトをいくつかの有限リレーショナル構造に対して一貫して分類する1つの公式を推論するようにシステムに要求する。
本稿では,各学習対象のLSM式を評価する検証器誘導型ニューロシンボリックフレームワークであるPhythesis Frontierを紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:13:35 GMT)
How many labels can a biological oscillator carry? A quality-factor screen for proposed information carriers [0.0] M = Q = 2 pi nu tau である。
高周波分子キャリアは、その議論が想定した不安定さによってではなく、簡潔さによって排除される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:47:51 GMT)
Holonomic quantum gates via continuous measurement in bosonic codes: GKP and cat states [0.0] 測定に基づくホロノミック量子計算をボゾン量子誤り訂正符号に適用する。
我々は,4成分の猫符号とGottesman-Kitaev-Preskill符号の両方に対する明示的なプロトコルを開発した。
本研究は,実験用ボソニックプラットフォームにおける測定誘起ホロノミック制御の具体的実現について述べる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:26:09 GMT)
Helium-like ions $(Z,e,e)$ in Lagrange Mesh method, interpolating the highly-accurate energy spectra vs. Z [0.0] 非相対論的量子力学におけるヘリウム様原子イオンの研究のための2つの別のアプローチが提案されている。
数値的なアプローチはLagrange-mesh法に基づいており、単一のプロセッサモードで最小のCPU時間を持つ任意の核電荷$Z$に対して、エネルギースペクトルの14~15桁まで容易に到達できる。
一般性の公式を提案し、ヘリウム様配列の任意の励起状態のエネルギーに適用することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:17:25 GMT)
Goodness-of-Fit Tests and Calibration Machine-Learning Algorithms for Logistic Regression with Sparse Data [0.0] この論文は、グループ化データとスパースデータの両方の下で、バイナリロジスティック回帰のための古典的なGOFテストを研究する。
これらのテストの多くは、実際のデータセットの複雑さに晒されると、有効な結論を出すことができません。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:00:50 GMT)
Geometry of Noisy Quantum Many-Body Dynamics with Continuous Symmetries: Entanglement and Correlations [0.0] 大域的連続対称性を持つノイジーブラウンモデルにおけるユニタリ量子力学について研究する。
この研究は、レニイエンタングルメントエントロピーと流体力学および非流体力学的コレレータに焦点を当てている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:00:01 GMT)
Generating GKP states using quantum dots inside a strongly coupled cavity [0.0] GKP状態はフォールトトレラントCV量子計算を可能にするが、その生成は実験的に困難である。
我々は、有限エネルギー資源状態、特にクヌート状態を生成するための現実的でスケーラブルなプロトコルを提案する。
提案手法は, 決定論的ネコ状態生成, 猫繁殖プロトコル, ホモダイン測定を組み合わせたものである。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:46:49 GMT)
From Prompting to Behavioral Alignment: Personalized LLM Judges for Recommendation Evaluation [0.0] 本研究は、双方向合理化と呼ばれる臨界故障モードを特定する。
我々は、優先順位最適化を伴う逐次的行動アライメントフレームワークの微調整を開発し、適用する。
このアプローチはゼロショットベースラインよりもマクロF1スコアで32.19%上昇する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:06:39 GMT)
From Numbers to Judgment: Specialist LLM Agents and Reinforcement Learning for European Listed Real Estate [0.0] 金融分析における局所的数値演算と積分的判断がLLM専門化の同じ形態から得られるかを検討する。
欧州の上場不動産分析フレームワークを8人のレンズ・アライン・スペシャリストにマップする。
我々は、モデル、ソースエビデンス、タスク命令、出力スキーマ、およびスコアリングを保ちながら、モノリシックとスペシャリストが分解したプロンプトのフロンティアLLMを比較した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:42:15 GMT)
Floquet Green's functions for lattice electrons driven by Gaussian quantum light [0.0] 量子光源によって駆動される非相互作用単一バンド格子電子に対するフロケグリーンの関数を定式化する。
ピエルス結合は、所定のソースモデル内で非摂動的に扱われる。
最小1次元モデルの数値計算は有限結合量子ソース補正を示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:50:00 GMT)
Exploring new directions in enhancing the ACTS parameter optimization suite [0.0] ベイジアン最適化がACTSとOpen Data Detectorの制約に対処できるかどうかを検討する。
We apply expecteded Hypervolume Improvement to optimization efficiency, fake rate, copy rate, and runtime without fixed scalar weights。
これらの結果から, ベイジアン最適化は, 効率的な評価, より広範なパラメータ探索, ポストホック専門家の選択を通じて, ACTS自動調整を強化できることが示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:49:48 GMT)
Every Token Counts: Exact Likert-Scale Distributions for Measuring LLM Attitudes and Biases [0.0] 大規模言語モデル(LLM)の制御行動評価のための分析的正確なフレームワークを提案する。
因果的主因果的および相互作用的効果を系統的に分離するために,非構造的プロンプトを完全クロスファクター実験に置き換える。
我々は、これらのPMFを解析的に処理するために、多変量順序のコンセンサスメトリックと分布ANOVAを導出する。
当社の枠組みは,5つのLDMを対象とした消費者倫理中心主義のケーススタディを用いて検証し,我々のアプローチが,ベンチマークを不明瞭に集約する全体的国家偏見をいかに分離するかを実証した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:20:06 GMT)
Evaluation Resolution Confounds Learning-Rule Comparisons in Model-Brain RSA of Early Visual Cortex [0.0] この設定では、訓練されていない、あるいはローカルに訓練されていないネットワークが初期の視覚野で逆伝播に対抗または打ち勝つという共通の結果が、ネットワークが評価される解像度に強く依存していることが分かる。
4つの候補メカニズムがテストされ、その原因は、列車/楕円解像度マッチング、低レベルガボルとピクセル構造、訓練されていないベースラインの正規化状態、プールドディスクリプタのグローバルな明るさ統計への収束である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:50:58 GMT)
Evaluating QAOA expectation values can be as hard as counting optimal solutions [0.0] 我々は、$pgeq 2$の精度または指数関数的に精度の高い予測値の評価が、決定論的時間チューリング削減の下で#P-hardであることを示す。
本研究の応用例として,QAOA回路の計算とヘシアンに類似した硬さ結果を示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:47:04 GMT)
Epistemic Transfer in AI-Assisted Verification: A Framework and Evaluation Protocol [0.0] エピステマティック・トランスファー(英: epistemic transfer)とは、AIによる事前の検証が、後の新規クレームに対する非支援のパフォーマンスに与える影響をいう。
これらのアイデアを,オンライン実験やフィールドスタディで使用可能な,実践的な評価プロトコルに変換する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:02:03 GMT)
Entanglement depth and ancilla efficiency in quantum channel estimation [0.0] 量子チャネルパラメータ推定における補助的絡み合いの役割について検討する。
我々は、最大$k$の入力状態で達成可能な最適な推定精度を定量化する$k$-ancilla Fisher情報を紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:15:40 GMT)
Enhanced two-photon blockade without cascade channel by Stark nonlinear coupling [0.0] 2光子遮断(TPB)は、光物質結合系の入出力測定において、個々の量子のレベルで光子を制御することができる。
本稿では,スターク非線形結合によるU-TPBの向上を提案する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:14:23 GMT)
Early Prediction of Satellite Collision Probability Using a Hybrid TCN-Transformer Model for a CDM-Based Conjunction Analysis Framework [0.0] 本研究では,衛星共同リスクの早期予測のための学習基盤を提案する。
Inscented Transform-based propagation and backpropagation framework is used to evaluate the sensitivity of the collision risk metric to CDM parameters。
複合時間畳み込みネットワーク(TCN)-トランスフォーマーモデルを用いて、結合リスクの時間的進化を学習する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:24:18 GMT)
ECHO: A Locally-Deployable Agentic Health Assistant with Temporal Memory, Safety Guardrails, and Speech Assessment [0.0] ECHO (Enhanced Care & Health Observer) は、長期の慢性的なケア管理のための、局所的に展開可能な会話型医療アシスタントである。
ECHOは、共有監視の下で開発された3つの補完ソフトウェアモジュールを統合システムとして統合する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 10:32:54 GMT)
Dual-Primal Graph VAEs for Noisy Label Aggregation [0.0] ノイズの多いクラウドソースラベルから根本的真実を推定することは重要な理論的・実践的な問題である。
本稿では,デコーダとエンコーダが,クラウドソースデータセットの隣接グラフ上でGATベースのメッセージパッシングを利用するグラフVAEアーキテクチャを提案する。
我々は,クラウドソーシングベンチマークにおいて,このモデルがアートパフォーマンスの状態を達成していることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 22:24:16 GMT)
Diffract: Spectral View of LLM Domain Adaptation [0.0] 連続的な事前学習は、汎用的な大規模言語モデルを特殊なドメインに適応させるメカニズムである。
CPTには特異値スペクトルがほとんど不変であり、適応は主に特異ベクトルの変化によって導かれる。
低比重ヘッドを予めトレーニングされた状態に選択的に巻き戻すと、完全にトレーニングされたベースラインと比較して、ベンチマークの精度が最大4%向上する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:23:28 GMT)
Derivative Computation in PINNs: Automatic Differentiation, Finite Differences and Beyond [0.0] 自動微分(AD)に代わるPINNにおける有限差分微分計算について検討する。
FDは全バッチサイズ範囲で高速に動作し,GPUメモリをはるかに少ない速度で使用しながら,すべての問題に対して精度でADと一致していることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:01:29 GMT)
Deployment Decision Reliability: A Generalizability-Theory Framework for Sizing Long-Horizon Agent Evaluations [0.0] 3つのオープンエージェントトレースベンチマークで、エージェントのメインエフェクトが各データセットとチェックタイプにおける全分散の3%未満を占めていることを示す。
3つの推定器に適合する4面の一般化可能性理論の分散分解を通してこれを達成する。
これをデプロイ決定信頼性(DDR:Deployment Decision Reliability)という,分散コンポーネントテーブルを企業購入者が防御できる5つの決定に変換する,ワンページレポートの規律にパッケージ化します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:16:51 GMT)
Decomposition-Induced Context-Memory Conflict: When Fact-Checking Pipelines Contradict Their Own Source Text [0.0] そこで本研究では,デコンポザを誘導して,ソースパスが何を言っているかのパラメトリックな信念を代用できることを示す。
我々は、この分解誘起コンテキストメモリ競合(DI-CC)と呼び、古典的コンテキストメモリ競合と機械的に同じ現象であることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:15:05 GMT)
Decision-Aware Approximation of Belief Functions for Evidential Combinatorial Optimization [0.0] 我々は、その決定の後悔を狙う決定を意識した近似を導入する。
真の最適点において後悔をローカライズする一点境界を証明する。
実験では、決定認識圧縮機は表現認識圧縮よりも少ない頻度で決定を反転させる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:34:28 GMT)
Curate Before You Connect: Identity and Ontology Tagging in a Production Knowledge Graph [0.0] 本稿では、評価された抽出ストリームを知識グラフに変換する、摂取層とオントロジータグ付け層について述べる。
本稿では、識別子列、名前列、表示名、型スコープ位置から同一性を決定するレコード識別はしごについて述べる。
グラフの適合性負債を定量化し, 未定義の一次クラスを補う二次分類を示し, 775人の決定に対して48,403人の提案を保留するキュレーションキューを記述した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 08:30:37 GMT)
Cross-Disciplinary Taxonomy and Modeling of Misunderstanding Generation, Amplification, and Detection, from Pragmatics to AI Agents [0.0] コミュニケーションはリアルタイムの対人インタラクションから遠ざかっており、AI経由のチャネルによって処理されるようになっている。
我々は、分岐が生成され、増幅され、検出され、修復されるか、未確認のまま残される階層化プロセスとして誤解を分析する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 05:38:04 GMT)
CosMAP: Contrastive Manifold Approximation and Projection for Dimensionality Reduction of Omics and Genealogical Data [0.0] グラフに基づく非教師付き次元差分法であるContrastive Manifold Approximation and Projection (CosMAP)を紹介する。
我々は,MNISTおよびUSPS手書きデジタルデータセット,マウス網膜および大脳皮質単細胞RNA配列データセット,および大規模な血縁関係データセットについてCosMAPを評価した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 00:22:31 GMT)
Contextual Quality-Diversity Evolutionary Reinforcement Learning for HVAC Control in Tropical Commercial Buildings [0.0] 本稿では,CQD-ERLの文脈的品質・多様性進化型強化学習コントローラを提案する。
この制御器はシンガポールの商業ビルの遅延負荷, 冷却-トウワーアプローチ, 湿度制約を表す2段階の低次環境を訓練する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:16:59 GMT)
Conditional Independence Tests for Constraint-Based Causal Discovery: A Survey [0.0] 条件独立 (CI) テストは制約に基づく因果発見の統計エンジンである。
この調査では、高次元および混合型設定における仮定、堅牢性、スケーラビリティを重視したCIテストについてレビューする。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:13:52 GMT)
Comparing SGLD and a fixed-noise Predictor-Corrector adaptation in canonical Joint Energy-Based Models on CIFAR-10 [0.0] 我々は、WideResNet-28-10上の標準合同エネルギーベースモデル(JEM)を、2つの独立したランで正規化レイヤなしで再現する。
我々は3つのプロトコルで固定ノイズPC適応(退化ノイズ予測器を決定論的ステップに置き換える)をテストする。
復元精度92.88%、バッファFID44.46(標準:92.9%、38.40)
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:27:21 GMT)
Cheap, Fallible Cognition and the Political Economy of Expertise [0.0] 仕事は不可分な対象ではなく、機械認知は人間の労働の均一な代用ではない。
本稿では、生成AIを安価でスケーラブルで誤認識可能なものとして分析するためのタスクベースフレームワークを開発する。
AIの労働市場運命は機械失業でも自動失業でもないと結論付けている。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:55:35 GMT)
Can Frontier LLMs Match Natively Multimodal Embeddings? A Comparison on Hard-Negative Text-to-Image Retrieval [0.0] GPT-4.1 と Claude Sonnet 4.6 が Gemini Embedding 2 と同等に動作することを示す。
埋め込みがプリ計算されると、マルチモーダル埋め込みは低レイテンシアプリケーションに適している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 18:49:08 GMT)
CLEAR: Class-wise Expert Aggregation with Structured Sampling for Long-Tailed Classification [0.0] CLEAR (Class-wise reliability-aware Expert Aggregation for long-tailed Recognition) は、長鎖分類のためのモジュラアンサンブルフレームワークである。
CLEARはしきい値に基づく構造化サンプリングによって多様な専門家を生成する。
それは、スムーズなクラスワイズ精度の定式化を用いて、各専門家のクラスワイズ信頼スコアを推定する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:45:09 GMT)
Boosting self hybridized exciton polaritons with metal clad WS2 waveguides [0.0] 金属クラッドWS2導波路に活性励起層を埋め込むことにより, フォトニックモードと励起子の結合強度が著しく向上することを示した。
この結果は, ハイブリッドヘテロ構造における励起子光子相互作用とその結合強度を制御するための頑健なアプローチを提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:18:15 GMT)
Beyond Forecasting: Recasting Volatility Control as a Routing Problem [0.0] モジュラーフレームワークであるVolは、推定器とコントローラのペアに対する状態条件付きルーティングとして、ボラティリティ制御を定式化する。
我々は、S&P 500、Multi-Asset、Bitcoin、USDTのボラティリティ制御設定でVolを評価する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:14:20 GMT)
Beyond Detection Accuracy: Measuring Explanation Cost, Stability, and Utility for Resource-Aware IoT Intrusion Detection [0.0] 本研究は,IoT侵入検出のための予測効率,説明コスト,局所的説明安定性,選択的説明を共同で評価する。
XGBoostは全体で最強の予測プロファイルを提供し、ランダムフォレストは最低の偽陽性率を生み出した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 01:18:07 GMT)
Benchmarking Quantum and Classical Machine Learning Models on Oncological Data [0.0] 量子および古典的機械学習モデルの公正なベンチマークのための方法論を開発する。
以上の結果から,より高次元で生物学的に現実的なデータセットの分析を優先すべきであることが示唆された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:28:22 GMT)
Benchmarking LLM-Guided Control-Plane Policies for Backend Fault Isolation in HAProxy [0.0] 我々は、大規模言語モデルが静的ルーティングポリシーそのものを置き換えることができるかどうかを問う。
3B 能動パラメータの近傍で能動閾値を求める。
その上、アーキテクチャに関係なく、すべてのモデルは、クライアントが認識した5xxエラーの88%近くを飽和させます。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:15:20 GMT)
Assessing fidelity-limiting factors and achieving single-qubit gate fidelity beyond 99.999% in driven silicon spin qubits [0.0] 駆動スピンコヒーレンス時間を劇的に延長し, 99.999%以上の単一量子ゲート特性を報告した。
これらの結果は、最先端のシリコンスピン量子ビットにおける忠実度ベンチマークを束縛するメカニズムを示している。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:35:54 GMT)
Analytical Theory for Anomalous Diffusion in the Anderson Model with Heavy Tails [0.0] 我々は、重尾ホッピング振幅を持つ非相互作用アンダーソンモデルにおける異常輸送の解析理論を開発する。
ホッピング振幅の分布は、半拡散的な有効指数を持つ拡張中間時間状態をもたらす。
以上の結果から, 稀なホッピング法だけでは, 頑健な輸送異常に対する顕微鏡的な単一粒子機構が期待できることがわかった。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 12:44:06 GMT)
Analysis of Federated Aggregation under Model Poisoning and Backdoor Attacks: A Reconstructed Cross-Dataset and Cross-Architecture Benchmark [0.0] 500セルのシード-1評価マトリックスを5つのアグリゲーション法で再構成した。
実行ログは454回のオリジナルランと36回の修復または再実行で特定された。
クルムは、サインフリップとガウス構成の両方で記録された最高精度を達成した。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 20:42:56 GMT)
AlbumentationsX: One Augmentation Pipeline for Images and Related Annotations [0.0] AlbumentationsXは変換リスト、確率、アノテーション設定、ランダムシードを1つのComposeオブジェクトに保持する。
各呼び出しは一度ランダムな値を選択し、トレーニング例のすべてのサポートされた部分にそれらを適用します。
また、パイプライン定義を保存し、1回の呼び出しで何が起きたかを示し、その呼び出しをもう一度実行することもできる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 16:34:47 GMT)
Agentic Configuration Management (ACM): A Reference Configuration Model for Governed Agentic Systems [0.0] Agentic Configuration Management (ACM)は、異種エージェントシステムのフレームワークに依存しないガバナンスおよび設定参照モデルである。
ACMは、型付きおよび独立にバージョン管理されたエージェント構成項目、不変リビジョンとベースライン、明示的な構成と実行時の分離、セマンティック・アシュアランス・セマンティクス、依存性を意識した影響伝達、実行時の前処理を組み合わせたものだ。
LangGraph、CrewAI、OpenAI Agents SDK用のアダプタを備えたPythonリファレンス実装を提供する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:28:39 GMT)
Activation-Energy Pruning for Spiking Neural Networks: Unsupervised Personalization via Spike-Count Saliency [0.0] 従来のネットワーク上で競争力のある勾配に基づくプルーニング手法はSNNでは一貫して性能が劣っていることを示す。
そこで本研究では,サロゲート・グラディエント・サリエンシ推定と2進スパイク・トレイン表現の系統的不整合性について考察した。
我々はこの結果が経験に依存した皮質の特殊化と一致していると解釈する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 06:55:22 GMT)
ASR-Roundtrip Evaluation Can Mask Context- and Convention-Dependent Reading Errors in Chinese News TTS [0.0] 我々は、正しい読みがコンテキストやドメインの慣行に依存する中国語ニュースTTSについて研究する。
これらの場合、Raw TTSは可読だが誤った読み方を選ぶことができるが、ASRは意図的または表面修正されたテキストとしてオーディオを書き起こす。
ASRラウンドトリップはスクリーニングには有用であるが,中国語ニュース読取リスク評価にはスタンドアローンの真実として不十分である。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:49:37 GMT)
AI-Generated Interactive Fiction for Educational Use: A Pilot Study of Perceived Comprehensibility, Coherence, and Engagement [0.0] 本稿では、高等教育におけるAI生成インタラクティブフィクション(IF)のパイロットユーザー中心評価について述べる。
シナリオの制御されたプールを生成し、参加者に1つの生成されたエピソードをプレイし、物語の明瞭さ、ストーリー・コンテントの一貫性、エンゲージメント、長さの受け入れに基づいて評価するように求めた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:41:05 GMT)
AI Guardrail Survival under Single-Cycle Agentic Self-Summarization [0.0] 単一コンパクト化サイクルでは、セーフティルールはどのように失われたのか?
私たちの中心的な発見は、プレゼンスチェックは安全チェックではない、ということです。コンパクト化がルールを正しくドロップしない場合、多くの場合、ルールのようには見えるが、ルールのようには動作しないものを残します。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 19:57:55 GMT)
A formal correspondence between Bayesian inference problems and the Heisenberg representation [0.0] 提案された定式化は、ハイゼンベルク表現と逆問題のベイズ的定式化の間の形式的対応を確立する。
カルフン・ローブ展開を用いて、量子状態はマテル共分散の固有値と固有関数で表される。
主な結果は4つの定理によって要約される。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 23:22:23 GMT)
A Single Atom in Front of a Mirror is a Universal Reservoir Computer [0.0] 貯水池計算における普遍近似は、典型的には貯水池の類と関連している。
鏡面前における単一原子の最小構成を考えると、普遍性は単一の貯水池に関連付けられることを示す。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 02:22:13 GMT)
A Quantum Roadmap for Softmax Attention: Exact Born-Rule Analogs for Softmax Attention on the Probability Simplex [0.0] 注意機構は、Transformerのような多くの現代的なAIモデルの基盤を形成する。
この設定では、ソフトマックスアテンションは、正確に、コンポーネント・バイ・エンコードされた量子化を許容する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 17:32:30 GMT)
A Quantum Dynamics Tutorial: Visualising Dynamical Decoupling Sequences on the Bloch Sphere [0.0] このチュートリアルは動的デカップリングプロトコルの直感的な解釈を提供することを目的としている。
実験家の視点からは、Bloch球面図を用いて量子力学を可視化する。
カスタムシミュレーションとBloch sphereプロットスクリプトはオープンアクセスリポジトリにも提供されており、読者がこれらの結果を再現、修正、探索することができる。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 13:34:47 GMT)
A Quantum Algorithm for Solving the Poisson Equation for Free Field Conditions via the Hockney Method [0.0] この研究は、ポアソン方程式の問題を解く量子アルゴリズムを示す。
このアルゴリズムは、対角行列 w.r.t. 振幅符号化によって状態ベクトルを乗算する手順を使用する。
1次元と2次元のテスト例に対する状態ベクトルシミュレーションの結果を比較して,アルゴリズムの機能を検証する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 11:29:12 GMT)
A HamNoSys-Guided Dataset and Baselines for Fine-Grained Isolated Handshape Recognition in Sign Language [0.0] きめ細かい手形認識は、計算手話の書き起こし、認識、翻訳をサポートする。
本稿では,言語に依存しないハンブルク表記システム(HamNoSys)のベンチマークを紹介する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:16:52 GMT)
A Cost-Efficient Routing Pipeline for Multilingual Short-Text Classification Using Small Language Models [0.0] 我々は、より強力な言語を直接多言語経路で維持する固定リストルーティング戦略を評価する。
ゼロショット分類の前に、より弱い言語を英語に翻訳することで選択的に送信する。
パイプラインは完全に自己ホストされ、訓練済みのコンパクト文エンコーダを使用し、タスク固有の微調整を必要としない。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 14:06:53 GMT)
A Comparative Evaluation of Deep Learning Object Detection Models on a Real-World Multi-Plant Dataset from Africa [0.0] 本研究では,6つのオブジェクト検出モデル YOLOv5, YOLOv8, YOLO11, YOLO26, Faster R-CNN, RT-DETRの比較評価を行った。
その結果,RT-DETRは0.768,mAP@0.5:0.95,0.624で最高性能を達成した。
YOLOベースのモデルは、より高速なR-CNNに比べて訓練効率が優れていた。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 15:22:58 GMT)
A Combined Feature-Based Framework for Disguise and Spoofing Detection in Face Recognition Systems [0.0] 顔認識システムは2つの異なる分離された障害モードに直面している。
本稿では,1つのフレームワーク内の2つの問題に対処する5つの機能抽出と分類パイプラインを提案し,比較する。
これらの手法は、FEI、Disguised Faces Database、NUAAデータベースから抽出された115の被験者で訓練された。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 09:44:13 GMT)
$β$-VAEs as Effective Theories: Tolerance-Dependent Dimension [0.0] $-VAEでは、正規化強度の増大は、低実用性潜在座標を崩壊させることでスペクトル遮断として機能する。
非線形相互作用はシフトし、崩壊の開始を拡大するので、閾値はユーティリティと正確には一致しない。
深度の増加は、最初の数個の座標に実用性に集中するが、尾の忠実度は悪化する。
論文参考訳(メタデータ) (Tue, 11 Aug 2026 07:34:18 GMT)