MatrAIx: Simulating the World with 8.3 Billion Persona Agents [175.1] MatrAIxは、AIシステムとデジタル製品を異種ユーザでテストするための、人口規模でシミュレートされたユーザ評価基盤である。
第一に、ペルソナ8Bは1,290のカテゴリー次元で表される830億のペルソナレコードを含んでいる。
第2に、MatrAIx Playgroundは、ユーザがデジタル製品を評価し、対話する4つの環境を提供する。
第3に、MatrAIxは、コマース、ソフトウェア、ファイナンス、ヘルスケアを含む25のドメインにまたがる1010のアプリケーションタスクを提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:04:49 GMT)
Metis: Memory Foundation Model [96.6] メモリ基盤モデルを導入し,基礎モデルにネイティブメモリ機能を持たせる。
ネイティブメモリはアーキテクチャ、エンドツーエンドの最適化、効率性に利点があることを示す。
メモリ基盤モデルの最初のプロトタイプであるMetisを紹介します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:51:55 GMT)
JigShape: Evaluating Visual-Geometric Reasoning in VLMs through Jigsaw Puzzles [96.6] Jigsawパズルの解決には、視覚的内容と幾何学的制約の推論が必要である。
既存のベンチマークでは、テクスチャを繰り返した領域で曖昧な地上真実を生み出す矩形カットを使用している。
タブ・アンド・ブランクのインターロック機能を備えたベンチマークであるtextitoursを導入し,そこでは幾何学的制約が強い局所的互換性要件を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:34:33 GMT)
MinerU.Chem: A High-Precision System for Optical Chemical Structure and Reaction Recognition [91.4] MinerU.Chemは、MinerUオンラインプラットフォームに統合された有機化学文献の文書解析システムである。
分子構造認識において、MinerU.Chemはコア表現としてCARBONを使用している。
MolRecBench-WildのSMILES評価可能なサブセット(N=2,392)では、MinerU.Chemの分子構造認識モジュールがSMILESの正確なマッチング精度を93.02%を達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:09:02 GMT)
Tired Actor: Fatigue-Informed Character Control [85.8] 既存の努力は、幅広い一般的な動きを模倣することで、印象的な成果を上げている。
我々は、エネルギー利用が人間の動きをどう形作るかを示す行動エネルギー学の進歩に私たちの視線を投影する。
そこで本研究では,有限エネルギー限界の代用として疲労を導入し,一般のキャラクターアニメーションに注入し,疲労が物理に基づくキャラクター制御にどのように新しい特性をもたらすかを徹底的に検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:12:09 GMT)
JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion [85.6] JoyAI-Video-Editは、リアルタイムかつオープンなビデオ編集のための16Bパラメータ自動回帰拡散フレームワークである。
本手法では, チャンクワイド自己回帰適応, ソースアンコール分布マッチング蒸留, ロングホライゾン自己回帰蒸留を組み合わせた。
JoyAI-Video-Editは、既存のストリーミングエディターを大幅に上回っており、ショートビデオとロングビデオの両方で強力なオフラインシステムと競合している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:40:48 GMT)
ReflectRL: Learning from Golden Negative Trajectories via Reflective-to-Direct Reasoning [84.3] 欠陥軌跡は, 反射する欠陥軌跡として扱われる場合においても, 貴重な推論信号が得られることを示す。
本報告では,プライバシ教育におけるGolden Negative Trajectoriesから学習する軽量なプラグイン・アンド・プレイフレームワークであるReflectRLを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:40:08 GMT)
Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent [81.2] Video-DRは、ステージワイドツールアンロックを備えた分離された知覚時間パイプラインを備えている。
当社のフレームワークでは,教師付き微調整とグループ相対ポリシー最適化という2段階のトレーニングレシピを採用しています。
実験の結果,ビデオ検索DeepB-A3Bでは64.0%の精度で新たな最先端技術が確立された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:45:16 GMT)
OmniVR: Joint Video-Audio Conditional Generation for Restoring Degraded Historical Films [77.7] 歴史的映画は視覚とオーディオの劣化に悩まされている。
オムニVR(OmniVR)は,初の共同音声合成再生モデルである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:00:57 GMT)
ETA: A New Agentic Paradigm for Embodied Tasks [76.3] 本稿では,デジタルエージェントを物理世界へ拡張するための新しいパラダイムであるEmbodied Task Agent(ETA)を紹介する。
ETAは、一度に1つのツールコールを選択するPlanner、実行を制御するInterface、結果と新鮮な観察を返送するWorldを中心にロボットを集中させる。
ETAは、置換可能なPlanner、構成可能なツールとスキル、監査可能なメモリ、再生可能なトラジェクトリ、シミュレーションと実際のロボットのための一般的なインターフェースを提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:56:09 GMT)
SEER: A Self-Grounded Evidence Interface for Controlled Spatial Relation Classification [72.0] SEERは、ペアローカライゼーション中の候補関係を隠蔽し、明示的な主観的/対象的役割を持つクエリ固有ビューを構築し、補完的な証拠として完全なイメージとスパースボックス幾何学を保持する。
正確な逆サポートを持つ関係選択プロトコルでは、オプションリファインメントがエンティティロールを交換し、正確に1つの視覚状態が対応する逆関係に従う場合にのみ前方決定を変更する。
変更されていないプロトコルは、3つのモデルにまたがる2,434個のフィルター付きEmbSpatialペア関係質問に対して +4.35 から +11.79 を得る。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:16:15 GMT)
SUV: Future Scene Understanding as Video Generation for End-to-End Driving [71.4] 我々は、将来のシーン理解をビデオ生成として活用する統合エンドツーエンド駆動フレームワークであるSUVを紹介する。
SUVは、将来の外観、セマンティクス、相対深度、および共有ビデオ専門家によるビデオストリームとしてのインスタンスレベルのダイナミクスをモデル化する。
実験の結果、SUVは将来の4つのストリームを直接予測する一方で、制御されたアブリゲーションは、将来の監視構造と、将来のストリームに直接アクセスすることで、より高い軌道計画スコアが得られることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:51:53 GMT)
SITA: Semantic Interest Tokens for Target-Aware Compression in Long-Sequence Recommendation [69.0] 提案するTextbfSITAは,長期的推薦のための圧縮フレームワークである。
SITAは、対象固有のユーザ表現を構築するために、対応する構造化された関心を適応的に集約する。
公開データセットと大規模産業データセットの実験は、SITAが代表的ベースラインを一貫して上回っていることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:59:44 GMT)
V-FIND: Revealing the Intrinsic Forgery Knowledge Encoded in Video Forgery Detectors [64.1] 偽識別知識は全表現空間に均一に分散されない。
ビデオフォージェリ内在性ニューロン発見フレームワーク(V-FIND)を提案する。
V-FINDは、実際のビデオと偽ビデオの間に顕著な相違を示す重要な層を局在させ、連続して偽識別シグナルを伝達する潜伏型アンカーニューロンを特定する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:41:40 GMT)
Dynamically Allocating Evaluation Effort for Model Ranking [60.0] 相関アームを用いたマルチアームバンディット構成において,マルチモデル人体評価をベストアーム識別問題として定式化する。
トップパフォーマンスモデル間の差別を改善することを示します。
これにより、評価はより速く、より安価で、より大規模な競争評価目標に適合する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:33:04 GMT)
Formal Verification of Agentic Systems over Operational Data [60.0] 大規模言語モデル(LLM)によって駆動されるエージェントシステムは、永続的な運用データを扱う現実世界にますます展開されている。
既存のアプローチはそのようなシステムレベルの保証を提供していません。
本稿では, 1 つの LLM とツールオーケストレーションハーネスからなるエージェントシステムのリレーショナル操作データに対する検証について述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:01:30 GMT)
When Agents Learn to Be You: Benchmarking Privacy Leakage, Impersonation Risk, and Defenses in Persona Skills [59.1] AntiSkillBenchはペルソナスキルパイプライン全体のリスクと防御を評価するエンドツーエンドのベンチマークである。
i) 多様なタスクシナリオにまたがる行動に富んだ50のプロファイルから構築された7,500人の個人を対象とする対話トレースのデータセット、(ii) スキルレベルのプライバシリークとエージェントレベルの属性開示と行動不正を計測する評価スイート、(iii) オンラインおよびポストホック介入の4つの構成をカバーする防衛評価を含む。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:04:56 GMT)
Hear to See: Discerning Stateful Listening for Audio-Visual Instance Segmentation [58.8] 既存の手法では、重なり合う音響イベントと視覚的インスタンスをマッチングし、音声視覚力学を扱うのに苦労している。
本稿では,2つのメカニズムを用いて,これらの課題に対処するH2Sを提案する。
論文が受け入れられたら、コードはオープンソースになる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:35:57 GMT)
Inverse Design of Quantum Control Sequences with Fourier Neural Operators [57.6] 高次元分子量子力学を学習するためのフーリエニューラル演算子(FNO)に基づくフレームワークを提案する。
我々は,初期混合ボルツマン分布を浄化するパルス列を構成するFNO-SPMP(FNO-SPMP)を開発した。
共有離散制御空間において、FNO-SPMPは強化学習ベースラインの成功率の2倍近くを達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:06:59 GMT)
Multi-Task Multi-Frame Visual Piano Transcription [57.3] 本稿では,最初の完全なVisual Piano TranscriptionシステムであるV2N(Video to Notes)を紹介する。
共有時間バックボーンは、タスク固有のヘッドをオンセット、オフセット、キーホールド、ベロシティに供給する。
アブレーションは、マルチタスクの監視により、オフセット精度を改善しつつ、オフセットとベロシティの予測が可能になることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:11:45 GMT)
3DGSI-Assessor: A Large-Scale Dataset and An LMM-based Method for 3D Gaussian Splatting Image Quality Assessment [56.7] 圧縮3DGSのための大規模多次元IQAデータセットである3DGS-IEval-15K+を提案する。
3DGS-IEval-15K+に基づいて,オールインワンの3DGS IQAフレームワークである3DGSI-Assessorを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:53:14 GMT)
A game theory for foundation models shows new paths to rational cooperation through similarity inference [56.5] 最適計画に携わる基礎モデルエージェントは、安定的な協調に一貫して収束していることを示す。
分離された物質から埋め込まれた物質へと移行することで、これらのエージェントは自分たちが居住する宇宙の一部として自身をモデル化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:24:33 GMT)
AS-FedBridge: Pseudo-Spike Bridge Distillation for Heterogeneous ANN-SNN Federated Learning [56.3] 従来のニューラルネットワーク(ANN)の代替として、スパイキングニューラルネットワーク(SNN)が登場した。
混合ANN-SNNクライアントに適した新しいフェデレート学習フレームワークであるAS-FedBridgeを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:32:30 GMT)
SFT Conflicts, RL Coexists: A Theoretical and Empirical Analysis of Multi-Task Learning for LLMs [56.0] Supervised Fine-Tuning (SFT) と Reinforcement Learning (RL) は、大規模言語モデル(LLM)に対するマルチタスク推論の強化において、根本的に異なる振る舞いを示す。
予備実験の結果,SFTは多段階訓練下でのタスクコンフリクトに悩まされ,RLは多様なタスクにまたがる安定した共存を可能にした。
マルチタスクトレーニングを分離し,効率と柔軟性を大幅に向上させるパラダイムであるParallel-RLを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:32:26 GMT)
CastFSR: A Fast--Slow--Reflect Agentic Reasoning Framework for Context-Aware Time Series Forecasting [55.1] CastFSRは、コンテキスト認識予測をFast-Slow-Reflect--ワークフローとして定式化するエージェントフレームワークである。
コンテキスト証拠を検索し、情報的なルックバックウィンドウを適応的に決定し、コンテキストが将来のダイナミクスをどう形作るのかを判断する。
予測を反復的に洗練し、時間的、コンテキスト的、ドメイン整合性を保証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:21:36 GMT)
Training Documents Reranker with Search Rubrics for Deep Research Agent [54.1] 本稿では,高品質な文書集合が満たすべき要件をテキスト的に定義する検索指向のルーブリックを提案する。
さらに、検索したドキュメントから高品質なサブセットを選択するために、ドキュメントリランカ textbfRubricRanker をトレーニングします。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:11:14 GMT)
string2string Studio: An Interactive, In-Browser Platform for String-to-String Algorithms [53.6] string2string Studioは、ストリングツーストリング分析のためのインタラクティブなブラウザ内プラットフォームである。
システムは6つの主要なモジュールを統合し、文字、単語、トークン、行、残余レベルを操作できる。
コア操作は、インストールやデータのアップロードなしに、デフォルトでローカルに実行される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:48:15 GMT)
Channel-wise Dynamic Knowledge Distillation via Adaptive Sample Generation for Action Recognition [53.3] 適応型サンプル対応チャネルワイドダイナミック (ASCD) KD アプローチを開発した。
まず、適応的なサンプル生成モジュールを使用して、サンプル勾配のセマンティクスを組み込んで、更新されたサンプルを作成する。
第2に, チャネルワイド・ダイナミック蒸留モジュールを用いて, サンプル勾配と特徴周波数で導かれるこれらのサンプルを学生に訓練する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:18:13 GMT)
Sample Complexity of Multicalibration for Multilevel Properties [52.3] 我々は、前のプロパティが固定されたときに各プロパティが識別可能な$k$プロパティの列に対する多重校正について検討する。
多対数的に多くの二元群が存在するにもかかわらず、多重校正誤差$varepsilon$を達成するには$widetilde(varepsilon-(k+2))$サンプルが必要である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:38:54 GMT)
OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents [52.2] 自律型エージェントのための長距離ハーネスであるOneDayAgentを紹介する。
OneDayAgentはオープンなリクエストをマネージドな実行プロセスに変換する。
我々は104のタスクでAgentIF-OneDay上でOneDayAgentを評価する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:55:41 GMT)
Self-Improving Large Language Models via Progressive Experience Evolution [52.0] textbfSPEE(textbfSelf-textbfProgressive textbfExperience textbfEvolution)を提案する。
5つの数学的推論ベンチマークの実験は、SPEEが3つのモデルスケールでテスト時間とトレーニング時間の両方の自己進化ベースラインを一貫して上回っていることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:10:58 GMT)
ECLAIR: A Causally-Grounded AI Framework for Scientific Discovery in Empirical Software Engineering [51.2] 本稿では,科学プロセスのすべての段階に大規模言語モデルを統合する,因果的基盤を持つAIフレームワークであるECLAIRを紹介する。
ECLAIRはLSMを因果推論の原理の下で活動する活発な科学的エージェントとして扱う。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:57:05 GMT)
Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement [51.0] フェールインフォームドイメージの自己拡張(textbfFISA)はMLLMの自己改善のためのフレームワークで、モデル自身の障害ケースから拡張イメージを構築する。
本手法は,視覚的に難解だが解答保存画像のコンプリケーションを生成し,自己検査によりその有用性を検証し,意味的歪みを避けるために二重忠実度フィルタリングを適用する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:28:42 GMT)
PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents [50.9] PAST-Benchは、保持されたエクスペリエンスがエージェントを時間とともに実際に改善するかどうかを識別するために設計されたベンチマークである。
遅延タスクのゲインと、そのゲインが意図したセーブ、リトリーブ、更新パスに従うかどうかを報告します。
我々はHermes+を開発し、エージェントループの段階にわたって5つのターゲット的介入でHermesを拡張した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:58:05 GMT)
FaithIR: Rethinking Infrared Image Super-Resolution from Perceptual Sharpness to Task Relevant Fidelity [50.8] FaithIRは信頼性の高いマシン認識のための忠実な赤外線超解像度フレームワークである。
FLIR-IISR、M3FD、FMBの実験は、強い再構成忠実度、クロスデータセットの一般化、オブジェクト検出とセマンティックセグメンテーションにおける優れた性能を示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:23:30 GMT)
InfiniSplat: Implicit Gaussian Decoding for Large-Baseline Monocular View Synthesis [49.9] InfiniSplatはフィードフォワードのシングルイメージ3DGSフレームワークで、ピクセル整列表現から表面整列表現へ移行する。
InfiniSplatは、単一イメージのフィードフォワードベースラインと比較して最先端のパフォーマンスを実現している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:15:02 GMT)
DiverseDiT++: Quantifying, Analyzing, and Promoting Representation Diversity in Diffusion Transformers [49.0] ブロック間の表現の多様性は、DiTにおける効果的な表現学習にとって重要な要素であることを示す。
多様な表現学習を明示的に促進する新しいフレームワークであるDiverseDiT++を提案する。
提案手法は,ブロック間の入力表現を多角化するための長い残差接続と,ブロックに異なる特徴を学習させるための表現多様性損失を組み込んだものである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:51:15 GMT)
ParVL: Parallel Scaling and Expandable Compute Allocation for Multimodal LLMs [48.9] マルチモーダル大言語モデルのための並列ビジョンランゲージ(ParVL)スケーリングフレームワークについて紹介する。
ParVLは、既存のViTとLLMのバックボーンパラメータを複数のビジョンと言語ブランチで再利用することで、並列計算をスケールする。
また,ParVLは,シングルブランチベースラインよりも総合的なマルチモーダル性能を向上することを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:59:58 GMT)
Beckmann Transport Models: From Autonomous Flows to One-Step Maps [47.9] 本稿では,時間非依存な速度場に依存する流れマッチングのインスタンス化を提案し,二つの分布をマッピングする。
また、この流れに付随する一段階生成写像が、単純な保存方程式のユニークな解であることも示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:02:59 GMT)
When Attention Goes Blind: Numerical Failure in ALiBi Positional Encodings [45.8] 線形バイアススケーリングアンダーフロー 浮動小数点精度は、影響のある注意ヘッドを部分的に失明させる。
ALiBiの障害モードは、標準的なデコーダベンチマークに小さな効果しか与えず、トークンの検索を実質的に損なう可能性がある。
我々は4つのトレーニング時間緩和戦略を提案し、それらを個別に組み合わせて評価し、ログスケール距離がパスキー検索において最も一貫した改善をもたらすことを発見した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:54:01 GMT)
Surface Keypoint Representation for Multi-Object and Articulated Human-Object Interaction Generation [45.7] 本研究では,剛性成分の物体運動表現として曲面軌道を提案する。
この表現は、ポイントダイナミクスから直接、多目的調整と多様な調音機構を扱う。
HOI生成をテキストやウェイポイントから物体の動きを生成し、接触距離場を予測し、接触距離場を合成する3つの段階に分類する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:47:07 GMT)
PFM-HR: Pose Flow Matching for Humanoid Robots [45.5] 本稿では,PFM-HR(Pose Flow Matching for Humanoid Robots)を提案する。
PFM-HRはPGS(Pose Geometry Score)を導入し、ロールアウト中の関節座標が、前者が捉えたポーズの変化の局所幾何学とどのように一致しているかを定量化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:58:54 GMT)
Predicting Multilingual Classification and Translation Performance of LLMs with Cross-Lingual Alignment $\unicode{x2013}$ Is English Enough? [45.2] 言語間アライメント(CLA)スコアは多言語大言語モデル(LLM)での使用のために提案されている。
CLAスコアの27の変種の比較分析を行い,その違いと3つのタスクにおけるダウンストリーム性能の予測精度について検討した。
英語を用いたCLAは、ソースターゲットのCLAと同等かそれ以上の翻訳品質を予測し、LLMが英語を内部ピボット言語として使用するという新たな証拠を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:44:40 GMT)
Operationally Feasible Synthetic Power-Grid Scenarios via Learning the AC-Operable Joint Distribution [44.8] 合成パワーグリッドシナリオは、計画、レジリエンスアセスメント、並行性分析、データ駆動パワーシステムアプリケーションに不可欠である。
近年の合成格子生成法は, 工学的知識を取り入れた構造的現実性と操作性の向上を実現している。
本稿では,ネットワークトポロジのAC-operable joint distributionを学習する実現可能性を考慮した分布学習フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:17:15 GMT)
Balancing Efficiency and Efficacy: Training-Free Attention-Guided Switching Between Explicit and Latent Thoughts for MLLMs [44.7] MLLM(Multimodal Large Language Models)における推論は、きめ細かい視覚認識と厳密な論理推論の両方を必要とする。
明示的なテキストベースのChain-of-Thought (CoT) は計算に高価であり、視覚幻覚を起こしやすい。
既存の潜在的推論手法は、通常、コストのかかる訓練を必要とする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:46:10 GMT)
Getting the Parameters Right: A Difficulty-Graded Benchmark and Probe-Guided Training for LLM Tool Calls [43.9] クラウドコンピューティングのようなドメインでは、フロンティアモデルでさえ、ツールコールの半分以下を正しく完了します。
本稿では,2つの相補的なアプローチによるプローブ誘導フレームワークを提案する。
提案手法はパラメータ生成を大幅に改善し,平均一致率19.7%から59.6%に向上した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:36:41 GMT)
Dependency Triad: A Metric to Quantify the Dependencies Between Attributes for Local Differential Privacy [43.3] ローカル微分プライバシー(LDP)は、そのようなシナリオにおけるプライバシーリスクを軽減するデファクトスタンダードとして登場した。
本稿では,3つのパラメータを用いてCPLに関連する相互依存情報を要約した,新しい尺度 Dependency Triad' (DT) を提案する。
DTは、そのパラメータを通して、事前の分布的知識の不確実性を明示的にモデル化し、堅牢なリーク推定を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:30:55 GMT)
Reconfigurable Structural Robotic Assembly: Interlocking 3D Aggregations with Self-Aligning Compound Nested Lattice Modules [43.2] 本研究は, 構造材料システムにおける幾何学的インテリジェンスをエンコードする方法について検討する。
コンジョイント・クボクタヘドラル・オクタヘドラル単位からなる自己配向型複合ネスト格子モジュールを提案する。
ロボットアームと移動体アセンブラの両方を用いて組み立てた家具と建築の規模構造によるシステムを実演する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:12:12 GMT)
Clarity Contrast and Similarity Selection for Multi-Focus Image Fusion [42.9] マルチフォーカス画像融合(MFIF)は、異なる領域に焦点を当てた同一シーンの複数の画像から全焦点画像を生成することを目的としている。
本稿では,MFIFの直接情報交換を橋渡しするためのCSNet(Clarity Contrast and similarity Selection Network)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:24:12 GMT)
ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities? [42.7] In-context連続型スキル学習のための動的評価フレームワークであるContinualSkillBenchを紹介する。
シーケンシャルな実行は一般的にパフォーマンスを改善するが、モデルやドメインによって大きな違いがある。
さらに、より能力の低いモデルは、より大きな、より断片化されたタスク固有のスキルのコレクションを蓄積する傾向にある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:15:02 GMT)
When Refusal Looks Safe: The Refusal-Cue Shortcut in Safety Guard Models [42.5] 安全ガードは有害なコンテンツをフィルターするために広く使用され、通常はラベル付きプロンプト-レスポンスペアの監督された微調整によって訓練される。
有害なプロンプトに対する反応のうち、拒絶表現は、ほとんど無害なラベルと共起していることがわかった。
拒絶のキューを有害な反応に挿入することは、警備員の判断を有害なものから有害なものへと覆す可能性がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:43:04 GMT)
When Many Answers Are Valid, Voting Fails: Symbolic Verification for Best-of-K Causal Reasoning in LLMs [42.3] CALVERは、パールの因果基準に対して構造化されたトレースをスコアする訓練不要なシンボル検証器である。
CALVERは、複数のグラフ正解を許容するCLEAR検索1価クエリにおいて、報酬モデル、LLM審査員、モデルの信頼性が30%近く残っている42.1%に達する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:45:46 GMT)
Style Wins, Substance Loses: A Diagnosis of LLM-as-Judge in Idea Generation [42.2] 本稿では,SciStyleBenchを提案する。SciStyleBenchは,アイデア評価におけるスタイリスティックバイアスの診断と緩和のための3成分ベンチマークである。
SciStyleExtractorは、スタイル条件付評価の前に、スタイルタイプと逸脱を予測することによって、プレゼンテーションスタイルと科学的コンテンツとを分離する。
全体として、SciStyleBenchは科学的アイデア評価において、スタイリスティックなバイアスを特定し、定量化し、緩和するための体系的なフレームワークを提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:10:26 GMT)
Track4Action: Distilling World-Centric 3D Tracker into Vision-Language-Action Policies [41.4] アクションラベルは、ロボットが模倣するように指示する視覚言語アクション(VLA)ポリシーを示すが、これらのコマンドが3D世界を変える方法ではない。
Track4Actionは、凍結した世界中心の3Dトラッカーから現在のVLAポリシーへの遷移を蒸留するフレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:25:13 GMT)
Logic Before Language: Pre-pretraining on Formal Derivations Fosters Skill Acquisition and Compressibility [41.2] シンボルデータに基づく事前事前学習言語モデル(LM)は、自然言語の獲得を加速し、改善することができる。
論理事前学習は,LMにおけるスキル獲得を著しく促進することを示す。
機械学的には、形式的導出は永続的な構造的再構成を引き起こす。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:02:34 GMT)
Spend Bits Where Queries Look: KV Cache Vector Quantization with Attention-Preserving Transforms [40.9] 長文LLMデコーディングは、各ステップでキー値(KV)キャッシュを読み取る。読み込むのに、コンピューティングの注意より時間がかかるため、スループットは帯域幅にバウンドする。
課題は、アテンション製品を保持しながらキャッシュサイズを小さくし、再構築を安価に保ち、トークン当たりの固定ビット数を使用することである。
本稿では,KVキャッシュの量子化を,注意産物の歪みが誤差となる変換符号化問題として定式化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:10:59 GMT)
Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning [40.9] 本研究では,不完全な報奨信号をオンラインで改良する簡易な自己監督手法であるStructure-Aware Fine-Tuning(SAFT)を提案する。
以上の結果から,SAFTは報酬環境を常に軽視し,より高速な政策収束とアライメントの大幅な改善を図っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:15:12 GMT)
GUI-Lens: Coarse-to-Fine Cropping for GUI Grounding with General-Purpose VLMs [40.3] 視覚言語モデル(VLM)は、要求された制御を、インタラクションに十分な精度で特定することなく認識することができる。
GUI-Lens(GUI-Lens)は、汎用的なVLMがアクティブな視覚観察を通してターゲットを判断できる粗大な接地フレームワークである。
実験の結果、GUI-Lensは全体の接地精度を最大24.9ポイント改善し、GPT-5.5で最先端の性能を達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:47:37 GMT)
The Geometric Nature and a Free Proxy for Flow-Matching Uncertainty [40.2] フローマッチング(FM)は、現代のエンボディドモデルにおいて一般的なアクションヘッドパラダイムとなっている。
理想的なアフィン等方性収縮場からの逸脱として不確実性を示す。
我々は,1つの前方通過路からの軌道の曲げを測定するコストフリーの不確実性プロキシであるデノナイジングアクセラレーション(mathrmaccel$)を導入する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:18:08 GMT)
Harvest: Resource-Aware Quantum Compilation for Magic State Protocols [40.1] 本稿では,格子手術のためのリソース対応コンパイル手法であるHarvestを紹介する。
サーキット・アウェアの配置と渋滞・アウェアのルーティングを併用して、マジックステートの消費を最適化する。
シーケンシャルな実行よりも平均で$4.83times$(最大$17.8times$)のスピードアップを実現している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:21:59 GMT)
TACT: Taxonomy-Aligned Post-Training for Pedagogically Adaptive English Tutoring [40.0] 教育適応型ESLチューターの訓練後評価のための人為的枠組みであるTACT(Taxonomy-Aligned Conversational Tutor)を提案する。
TACTCorpusは、32,379のアノテーションと品質管理された強化トレーニングデータを使って、260人の真正な教師と学生の会話を豊かにする。
TACTBenchは78の教師コンテキストからなる戦略バランスの診断ベンチマークであり、TACTutorはバックボーンを20.30%改善している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:16:14 GMT)
TaskPress: Query-Agnostic KV Cache Compression via Task-Guided Pruning [39.9] タスク誘導型クエリ非依存KVキャッシュ消去のためのフレームワークであるTaskPressを紹介する。
単一のクエリに対してキャッシュを最適化する代わりに、TaskPressは高レベルのタスクガイドに条件付き再利用可能なメモリ表現を構築する。
TaskPressは、様々なクエリにまたがるコンパクトで再利用可能なキャッシュを効率的に生成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:51:37 GMT)
Learning Biomechanically Plausible Human Motion from Sparse Radar Point Clouds [39.6] 我々は、フルボディの骨格モデルを、エンドツーエンドのトレーニング可能なレーダベースのポーズ推定フレームワークに統合する。
生体力学スケルトンをスケールするために、レーダーポイント雲の特徴から被写体比を予測する。
動き予測ネットワークは、時間的レーダ列を一般化座標にマッピングし、予測された関節角を3D位置に変換する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:20:05 GMT)
RUTA: Principled Visual Token Allocation via Rate-Utility Optimization [39.4] 高解像度の画像と長いビデオは、マルチモーダル推論ときめ細かい知覚のためのリッチコンテキストの視覚言語モデルを提供する。
本稿では,トークンが保持するトークンを共同学習することでLLM前還元を行う,原則化された利率-実用トークン割当手法であるRUTAを紹介する。
RUTAは、ダウンストリームタスク損失と期待されるトークン使用量のバランスをとる、ペナルティ化されたレートユーティリティーの目標で最適化されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:37:26 GMT)
AI-Assisted Peer Review Across Research Communities: From Reviewer AI Policies to LLM Review Quality [39.3] 我々は、主要なAI/NLPカンファレンスと医療雑誌111社を対象に、レビュアーが直面するAIポリシーを調査した。
ICLR 2026とNature CommunicationsのAI生成ピアレビューを,新しいデータセットを用いて評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:34:47 GMT)
LoRetta: A Foundation Model and Extensive Dataset for Global-Scale Remote Sensing Dense Image Matching [39.3] 一致可能性を考慮したアフィンの局所化と高密度登録を導出する基礎モデルであるLoRettaを提案する。
また、LEVIR-GMは、データセット固有のマッチング性ラベルを持つグローバルスケールの多時間光マッチングベンチマークである。
LEVIR-GMでは、ローレッタは曲線(AUC)の83.3%の領域を達成し、最強のベースラインであるRoMa v2を1.6ポイント上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:02:19 GMT)
Muon Meets Mamba: Spectral Optimization for State Space Models [39.1] 我々はMuonとMamba-2130MのAdamWを比較する。
出力プロジェクション上のミューオンは、入力プロジェクションまたはその両方でミューオンに打ち勝つ。
条件付けは利得を説明しない。Muonは、それが訓練される射影の条件数を下げるが、より良い条件付き入力射影は助けとなるものではない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:10:47 GMT)
MuRA: Multi-Rank Adaptation for Efficient and Effective Test-Time Vision-Language Generalization [39.0] 視覚言語モデルは目覚ましいゼロショット能力を示すが、分布シフトによって性能が著しく低下する。
トークンレベルの視覚的複雑さに基づいて適応モジュールを動的に選択・融合する新しいフレームワークであるMulti-Rank Adaptation (MuRA)を提案する。
MuRAは、広範囲のドメイン一般化とクロスデータセットベンチマークで最先端の精度を達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:20:54 GMT)
Continue or Replan? Bernoulli-Continuation Policy Learning for Adaptive Horizon Execution [38.8] Bernoulli-Continuation Policy (BCP)は、適応的な水平線実行のための軽量なプラグアンドプレイフレームワークである。
LingBot-VLAを基本方針とするRoboTwin 2.0では、BCPは13の低いタスクにおいて平均成功率を+11.08%向上させる。
本物のロボットでは、BCPは成功を74%から92%、そして2つの操作タスクで44%から84%に引き上げる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:21:08 GMT)
Geospatial-Prior Guidance for 3D Semantic Scene Completion [38.4] GeoSceneは、衛星画像と構造化されたOpenStreetMap cuesを3Dセマンティックシーンの完成のためのソフトな先行手段として併用するフレームワークである。
GeoSceneは、船上観測と地理空間誘導のための相補的なボクセルの信頼性ウェイトを学習し、観測された領域と観測されていない領域の特徴改善を制御するためにそれらを利用する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:08:14 GMT)
RoMeRL: Balancing Feedback Coverage and the Memory-Reward Trap in Self-Evolving Agent Memory via Reduced-Order Utility States [38.1] 本稿では,学習型メモリシステムのための低次メモリ強化学習(RoMeRL)を提案する。
RoMeRLは、結果の極性とメモリのダイナミクスによって決定される固定次元のタスクごとのメモリ状態を用いて、成長するトラジェクトリインデックス付きユーティリティ空間を表す。
我々は,RoMeRLがタスク性能を改善し,コールドQ比を80.0%削減し,フィードバック密度を約6.0倍に向上し,保持メモリサイズを84.4%削減し,LLM呼び出しを21.1%削減することを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:26:42 GMT)
SiMDex: Mining Similar Egocentric Videos for Cross-Embodiment Dexterous Manipulation [37.8] SiMDexは、Dexterous操作におけるVLA後のトレーニングのために、人間のデータ選択をレコメンデーション問題としてキャストする。
SiMDexは、32Mエゴセントリックなヒトサンプルのプールからタスク関連サブセットを抽出するために、3層リコールグレードのパイプラインを使用している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:55:12 GMT)
Compass: Degradation-Simulated Reciprocal Learning with Lightweight Needle RWKV for Multimodal Crack Segmentation under Missing Modalities [36.9] 任意のモダリティを欠いた場合のき裂断面積分割のための軽量ネットワークを提案する。
コンパスは劣化蒸留(DSD)、針ブロック、証拠トポロジー保存核融合(ETPF)を含む。
深さの90%が欠落しているにもかかわらず、コンパスのF1は0.8216、mIoUは0.8434、パラメータは2.58Mである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:27:02 GMT)
Sparse Weight Decomposition for Efficient Circuit Extraction [36.9] 複雑な事前訓練された変換器は、回路抽出のための解釈可能なユニットを自然に公開しない。
本稿では,各重み行列を2つのスパース因子に分解することで,事前学習した射影を分解するスパース重み分解法を提案する。
SWDは,非ゼロ因子値の微調整後,すべての注意および重み行列のフルモデル置換に有効であることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:40:48 GMT)
Recurrent Contrastive Learning for Imbalanced Medical Image Classification [36.6] 不均衡な医用画像分類のためのRecurrent Contrastive Learning (RCL)を提案する。
RCLは、歴史的特徴状態を反復的に再利用することによって、テールクラスのサポート領域を徐々に拡大する。
TMQをベースとしたテンポラルアンカー(TAR)を構築し,テールクラスを囲むアンカーフィールドを形成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:14:33 GMT)
ArtECulture: Benchmarking Culture-Conditioned Visual Emotion Understanding in Multimodal Large Language Models [36.2] 本稿では,あるイメージの文化特有の感情知覚を予測するタスクである,文化条件の視覚的感情理解を紹介する。
ArtECultureは、6,792点のアートワークと文化固有の感情ラベルと、英語、中国語、アラビア語の文化にまたがる説明を含むベンチマークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:05:41 GMT)
Phase-Aware CNN for Real-Time 5G/6G Channel Estimation with Hardware-in-the-loop Validation [36.2] この研究は、深層学習を用いたパイロットベースのチャネル推定に焦点を当て、全サブキャリアグリッドの規模と位相の両方を再構築する。
提案システムは,シネ表現とコサイン表現を用いた位相認識型入力符号化と,軽量な畳み込みニューラルネットワーク(CNN)アーキテクチャを組み合わせた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:05:13 GMT)
Binding Biometrics with AI Agent Identifiers for Delegation of Authority [35.9] エージェント認証時に,BINDと呼ばれる,人間の生体データをAIエージェント識別(ID)と権限範囲(タスク固有の制約)に安全に結合するフレームワークを提案する。
このトークン/識別子は、AIエージェントによって、生体認証を同時に実行し、エージェントIDとスコープを回復するID監査者に提示することができる。
また、標準的なディープニューラルネットワークモデルを用いて抽出された顔特徴に基づいて提案したBINDフレームワークの実践的実装も提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:58:27 GMT)
Causal Inference with Unstructured Outcomes [35.8] 非構造化結果に対する因果クエリを提案する。
主要なアイデアは、結果のどの特徴が治療によって最も因果的に影響されているかを知ることである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:53:04 GMT)
Progressive Learning of a Diffusion-based Inpainting Model for Separating Overlapped Fingerprints [35.6] オーバーラップされた摩擦隆起パターンは、犯罪現場から回収された潜伏指紋において繰り返し発生する問題である。
重なり合う摩擦隆起パターンを含む画像から成分指紋を分離する拡散型パイプラインを導入する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:08:46 GMT)
Efficient Video Dataset Distillation via Cluster-Guided Prototype Blending [35.6] ビデオデータセットの蒸留は、大規模なビデオデータセットを、トレーニングユーティリティを保持するコンパクトなサロゲートセットに圧縮することを目的としている。
本研究では, 保存ビデオの勾配に基づく最適化を行なわずに, 有効蒸留ビデオを構築できるかどうかを検討する。
建設ベースのアプローチでは、情報的時間セグメントの選択、クラス毎のビデオ予算の制限によるクラス内変動の多様さ、各サンプルが保持する情報の増加という3つの課題に対処する必要がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:46:28 GMT)
How Should Vision-Language-Action Models Use Proprioceptive State? [35.4] 最近のVision-Language-Actionモデルは、ほとんど普遍的にロボットの受容状態を入力として取り込むが、互換性のない方法で結ぶ。
1)現在の状態がクローズドループ制御を実際に改善するかどうか、(2)状態履歴がどの程度役立つか、そしてその利点が条件付け能力の追加よりも真の時間的変動を反映しているか、という3つの疑問が残る。
フローマッチングVLAの制御実験,バックボーンの修正,トレーニングデータ,アクション表現,評価プロトコルなどを通じて,これらの疑問に答える。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:05:47 GMT)
SpreadMark: Robust Image Watermarking via Spread-Spectrum Embedding [35.2] 古典的な透かし原理である拡散スペクトル埋め込みを、現代のニューラルなポストホット透かしアーキテクチャの中で再検討する。
既存のエンコーダデコーダでは、各メッセージビットが画像のごく一部を占める。
SpreadMarkは、各ビットを画像全体に密度の高い擬似ランダムコードワードとして展開し、学習した隠蔽チップ表現にマッチしたフィルタリングによってそれを復元する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:52:17 GMT)
EmbodiedVAE: Disentangled Video VAE for Efficient and Controllable Embodied Manipulation [35.2] EmbodiedVAEは、ロボット操作の世界モデルに適したコンパクトで制御可能な潜在表現を提供する、新しいビデオVAEである。
提案するEmbodiedVAEは,2dBPSNRの改善によりロボット操作シナリオにおいて,より高精度な動作制御を実現するとともに,高い圧縮速度で再現性を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:01:18 GMT)
Forbidden Region Dynamic Active Constraints in Robot-Assisted Minimally Invasive Surgery [35.2] ロボット補助手術では、禁止領域アクティブ制約(FRAC)は、外科医に対する異方性触覚誘導を発生させることで、作業の安全を維持するための制御戦略である。
これらの課題には、動的組織変形を許容し、エネルギー透過性を維持し、実装の速度を向上する能力が含まれる。
深度検知カメラを用いて呼吸運動による動的組織変形を許容するエネルギー散逸型FRAC戦略のパイプライン設計を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:44:38 GMT)
Evaluating LLM Trade-offs for Enterprise Automation: Lessons from Workflow Generation in a Production Enterprise Platform [35.2] エンタープライズコンプライアンス管理は、進化する規制フレームワークに迅速に適応する必要がある。
従来の静的オーケストレータは、ハイブリッドクラウド環境では失敗することが多い。
本稿では、AI駆動ワークフロー生成のための6つの大規模言語モデルの評価から学んだ教訓について述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:18:38 GMT)
Bimanual Manipulation Within an 8 GB Budget: Zero-Copy Sensing and Quantized ACT on an Entry-Level Jetson [35.2] NVIDIA Jetson Orin Nano Super (8GB) で完全に動作する2次元SO-101システムを提案する。
我々は、NVMMバッファによってバックアップされたGStreamerキャプチャパイプラインを構築し、3つのカメラセンシングから冗長なホストデバイスコピーを取り除く。
我々は、ACTと拡散政策を同一のデモンストレーションで訓練し、それぞれが独自の基準予算で実施する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:09:41 GMT)
The RAIL Principles for Neurosymbolic AI: Reasoning, Assurances, Interfacing and Learning [34.3] 機械学習とフォーマル推論のニューロシンボリックな組み合わせは、AIにおけるニッチなアプローチではない、と我々は主張する。
この視点は、現在のAIシステムの設計の再検討を促す。
RAILフレームワークの適用は、一見異なるAIシステムの統一的なビューを提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:24:39 GMT)
UniWorld-Design: From Pixel Generation to Layer-Native Design [34.0] フラットなピクセル合成から構造化された視覚合成へ画像生成を再定義するフレームワークであるUniWorld-Designを紹介する。
私たちの重要な洞察は、ピクセルが画像のレンダリング方法を定義するのに対して、レイヤは画像の作成、理解、編集方法を定義することです。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:39:37 GMT)
SE(3)-MeanFlow: Few-Step Protein Backbone Generation on Lie Groups [33.8] ユークリッド空間からタンパク質フレームのリー群幾何へ拡張する数ステップの生成フレームワークであるSE(3)-MeanFlowを紹介する。
回転や翻訳のためのクローズドフォームな平均速度IDを導出し、シミュレーションなしのトレーニングターゲットを与える。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:37:02 GMT)
VIBE: A VAD-Informed Benchmark for Entity-Centered Affective Profiling of Large Language Model Outputs [33.7] 本稿では,Valence-Arousal-Dominance(VAD)空間における出力のエンティティ中心の感情プロファイルのベンチマークであるVIBEを紹介する。
VIBEは外部スコアから生成を分離し、スカラー選択性、応答レベルVAD、ターゲット指向VADを区別し、Affective Passportを通じてプロファイルをレポートする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:22:23 GMT)
Dr. AGENTONOMICS: A Didactic Experiment of AGENTONOMICS [33.3] AgentONOMICSは、AIエージェントを統合管理アーキテクチャによって設計、管理、管理できる経済エンティティとして扱うフレームワークである。
現在のプロトタイプはWebベースの検索用チューターで、AgentONOMICSの概念を説明し、学生の質問をサポートする。
本報告では,同システムは,マルチモーダル指導を行うアバター講師,エージェントONOMICSデザイン・マネジメント・リファレンス・フレームワーク(ADMRF)を通じて学生を指導するデザインコンサルタント,学生が指定したエージェント構築を支援するメタエージェントの3つの追加的な累積的役割に成長する可能性があることを論じる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:07:23 GMT)
ChartAnno: Evaluating MLLMs for Chart Annotation Generation [33.0] チャートアノテーション生成におけるMLLMの評価ベンチマークであるChartAnnoを紹介する。
1200の現実世界のチャートと、ペアコードとアノテーションの命令が3つのレベルの命令に比例している。
結果として、プロプライエタリなモデルは全体として強く保たれているが、大規模なオープンソースモデルはギャップを狭めている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:01:38 GMT)
AgentPanel: Toward a New Paradigm for Human--AI Collaboration in Exploring Scientific Questions [32.8] AgentPanelは、科学探査におけるAIコラボレーションのためのマルチエージェントフォーラムである。
我々は,AgentPanelを,アイデア品質,探索幅,インタラクションの有効性,候補選択効率,実用性の観点から評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:58:15 GMT)
Motion Beyond Morphology: Bootstrapping Cross-Category Motion Transfer from Abstract Motion Representations [32.7] ビデオモーション転送は、参照ビデオから動的にターゲットオブジェクトをアニメーションすることを目的としている。
既存の定式化は主に固定構造対応に依存している。
モーメント・サザン・モルフォロジー(Motion Beyond Morphology)は、固定された構造的対応を超えて運動を伝達しようとする視点である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:38:05 GMT)
When Efficiency Becomes Fragility: Exploiting Dynamic Routing Vulnerabilities in Adaptive UAV Tracking [32.2] UAVプラットフォーム上のリソース制約は、性能を追求し、効率と精度のバランスをとることから、空中追跡のパラダイムシフトを駆り立てている。
入力依存動的ルーティングアーキテクチャを活用するAdaptive Transformer Trackersがこの課題の代表的な解決策として登場した。
この計算オンデマンドの柔軟性の背後には,計算経路決定のリプシッツ特異性という,重要な構造的欠陥が隠されていることが明らかになった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:29:35 GMT)
Bridging Online and Offline Handwriting via Differentiable Physical Rendering [32.1] 識別可能なブラシレンダリングによるオンラインオフライン手書き生成フレームワークを提案する。
提案するフレームワークは、4つのコアモジュールから構成される。1)所定のテキストとスタイル画像に基づいて目標ストロークを予測するテキストストローク生成装置、2)スタイル参照からブラシモデルパラメータを抽出するブラシパラメータオブザーバ、3)ストロークシーケンスを手書き画像にマッピングする微分可能なブラシ、4)レンダリング画像の精細化を行うゼロショット画像リファクタ。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:39:11 GMT)
Hallucinations on the Board: Tool-Augmented Evaluation of LLM Chess Commentary [31.7] ACT-Evalは、チェスの解説を原子的主張に分解する評価フレームワークである。
教育、トーナメント、クリティカルポジションにまたがる325組の位置移動ペアのベンチマークを公表する。
チェスの解説では、事実上の幻覚が広まっています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:31:01 GMT)
Revibing Code from Papers: Reimplementing HCI Artifacts [31.6] 我々は、インタラクティブなソフトウェアをリバイバルする新しいエージェントAI技術の可能性を実証する。
アプローチの成功を測定するために,再現性指標について述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:35:15 GMT)
DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction [31.6] 本稿では,アタックチェーン再構築のための診断ベンチマークであるDiagChainを紹介する。
DiagChainには、複数のオペレーティングシステム、エビデンスノイズレベル、チェーン長さにまたがる69のシナリオスイートであるMAIN-69が含まれている。
DiagChainによると、最も強い構成でさえ、MAIN-69の849参照ステップの39.6%しか成功していない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:43:47 GMT)
AutoSND: From Execution Evidence to Structural Policies for Automated Network Dismantling Heuristic Discovery [31.3] AutoSNDは、完全なネットワーク分割のための3段階木探索フレームワークである。
12の実世界のネットワークと3つの大実世界のネットワークの実験により、AutoSNDはより優れた検索性能と安定性を実現することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:34:52 GMT)
ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels [30.6] 一つの分析空間内の言語レベル,言語,歴史的期間において,変化の大きさと方向がどう異なるかを示す。
冷凍多言語モデル,特徴整合型クロスコーダ,ポストホック言語介入を組み合わせたフレームワークであるChronoLensを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:49:16 GMT)
Joint spectral characterization of SPDC photon pairs near 2 $μ$m in (Al)GaAs-on-insulator waveguides [30.4] 集積光子対光源は、チップベースの量子コンピューティング、通信、およびメトロジーのコアコンポーネントである。
本稿では、直流GaAs-およびAlGaAs-on-insulator導波路における自然パラメトリックダウンコンバージョン(SPDC)を実証する。
これは、この波長系における統合SPDC源の初めての直接結合分光特性である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:14:20 GMT)
PI-Mem: Pushing Long-Context Reasoning to 3.6M Tokens with Parallel-Iterative Memory [30.2] 本稿では,チャンクの並列処理機構であるPI-Memを提案する。
我々は,HotpotQAベンチマークにおいて,最大360万トークンのPI-MemをQwen3.5-35B-A3B,Qwen2.5-7Bで評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:59:16 GMT)
LongCat Sparse Attention: Taming the Lightning via Streaming-aware Hierarchical Cross-Layer Indexing [30.1] LongCat Sparse Attention (LSA) は、ハードウェア・アルゴリズムで設計された、効率的な長文モデリングのためのフレームワークである。
汎用ベンチマークと長文ベンチマークの両方において,LSAが常に同等の性能を実現していることを示す。
LSAは100万トークンまでのコンテキスト長を持つネイティブトレーニングをサポートし、LongCat-2.0(1.6T-A48B)の開発を支えている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:46:43 GMT)
Empirical Analysis of Evasion and Poisoning Against Malware Data Drift Detection [30.0] データドリフト検出器ツールは、異なる目的のために設計され、異なる技術で構築される。
機械学習ベースのマルウェア分類器に対する侵入と中毒攻撃は、マルウェアサンプルの誤分類を引き起こす可能性がある。
本研究は, マルウェア分類器とともにデータドリフト検出器に対する回避攻撃と中毒攻撃の効果について検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:27:57 GMT)
ICO: Enhancing Semantic-Shift Jailbreaks via Iterative Context Optimization [29.9] 反復文脈最適化(ICO)を用いたブラックボックス・コンテキスト対応セマンティック・シフト・ジェイルブレイクフレームワークを提案する。
ICOは8つの最先端のベースラインを一貫して上回り、平均的な攻撃成功率は74.6%である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:48:17 GMT)
AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents [29.8] 大型言語モデル(LLM)エージェントは、観察-動作ループを介して浸透試験を自動化する。
現在の防御は、攻撃前に環境に植えられた静的で孤立したアーティファクトに大きく依存している。
AgentSnareはデコイ環境を動的に展開し、侵入エージェントを実際のターゲットから遠ざけていく。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:03:49 GMT)
Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potential in Core Database Tasks [29.6] 大規模言語モデル(LLM)はデータベースのインタラクションパラダイムを変革し、クエリトランスレータをDBAに進化させています。
我々はDBLifeBenchを紹介します。これは、設計、実装、運用、保守という5つの重要なライフサイクルフェーズでLCMを評価する最初のベンチマークです。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:10:09 GMT)
LocAnyMed: Vision-Language Grounding for Multimodal Medical Images [29.2] 医用ビジュアルグラウンドティングは、医療画像の空間的証拠と自由形式の臨床クエリを結びつける。
マルチモーダルな医用ビジュアルグラウンドディングデータセットであるLocAnyMed-200Kを構築した。
LocAnyMed-CoT-20Kは、解剖学的文脈、視覚的観察、空間的結論を結びつける有理拡張サブセットである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:29:21 GMT)
BrainBench: Benchmarking Large Language Models for Comprehensive EEG Understanding [29.2] 包括的で命令条件のEEG理解のための統合ベンチマークであるベンチマークネームを導入する。
4つのサブセットで構成されており、-Foundational Analysis、Sleep Assessment、Neurocognitive Assessment、Physological Integrationである。
結果はモデル、サブセット、難易度、実行パラダイムによって大きく異なり、EEGの能力がモデルとその運用に依存していることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:07:09 GMT)
MoEGen: Mixture-of-Experts for Instance-Adaptive LoRA Generation [29.1] MoEGenは、MoEベースのPEFTをエキスパート選択からエキスパート条件パラメータ生成に移行する適応フレームワークである。
MoEGenは、各エキスパートを、エキスパートコードと呼ばれる、小さな学習可能なベクトルとして表現する。
8つのコモンセンス推論ベンチマークの実験では、強い静的およびMoEベースのPEFTベースラインよりも一貫した改善が見られた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:51:30 GMT)
Can LLM design high-quality experiments? A Comprehensive and Systematic Benchmark on Autonomous Experimental Design [29.0] AI for Research(AI4Research)は、AIを活用して科学的合理性を自動化する。
体系的な実験設計を行うAIの能力を評価するためのベンチマークは存在しない。
ベンチマークでは,(1)ほとんどのLLMは直接的に高品質な実験を設計できない,(2)低レベルな構成では全てのLLMが性能ボトルネックを示し,(3)検索モードでは設計品質が向上しない,という3つの結果が示されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:43:22 GMT)
PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs [28.9] PhyCheckは、2段階の粒度で整理されたビデオ質問応答データセットである。
データセットには外部因果コンテキストを持つ診断サブセットが含まれており、身体的妥当性に影響を与える隠れた要因を明らかにする。
ファインチューンQwen2.5-VLを用いた実験では、提案したデータによるトレーニングが物理的一貫性の理解を大幅に改善することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:00:55 GMT)
Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving VLMs [28.9] 我々は,教師モデルが現場証拠から決定を推測するよりも,明らかな結果の合理化を図っていることを示す。
GT軌道の除去は、このショートカットを除去するが、オープンエンド軌道生成は、精密な幾何学的合成と低レベルダイナミクスで高レベルな決定を絡ませる。
本稿では,先決定アンカーから後決定検証ターゲットへの将来の軌跡を変換するために,Deferred Exposure of Future Trajectories for RLVR (DEFT-RLVR)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:59:32 GMT)
InvFlowFD: Reference-Free and Background-Set-Free Perceptual Music Quality Metric with Flow Matching Inversion [28.6] 本稿では,事前学習したフローマッチングバックボーンのみを用いて,バックグラウンドセットフリーで参照フリーな品質推定を行う手法を提案する。
非条件のフローマッチングインバージョンは、様々な人工的歪みを検出し、人間の知覚的判断に対して正確な音楽生成モデルをランク付けするのに十分であることを示す。
以上の結果から,InvFlowFDは音の歪みに対する人間の知覚や生成モデルの品質と高い相関性を示し,既存の指標よりも柔軟性と制約性が低いことが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:50:14 GMT)
Poled-fibre phase modulator for efficient high-dimensional quantum measurements [28.5] 完全ファイバ集積プラットフォームにおける能動量子状態測定におけるPFPMの初使用について報告する。
4次元キューディットの受信機における基底選択は1つのPFPMを用いて達成される。
その結果、ファイバ積分量子情報処理における高効率検出のための広範に適用可能なプラットフォームとして、電界偏光変調が確立された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:06:35 GMT)
Beyond Average Performance: Dynamic Instance Clustering and Specialized Algorithm Design in LLM-Assisted Evolutionary Search [28.0] 信頼性の高いアルゴリズムポートフォリオを構築するための特徴のない構造認識機構を備えたLESフレームワークであるDynamic Instance Clustering and Specialized Algorithm Design (DyCA)を提案する。
DyCAは、インスタンスクラスタリングを検索プロセス内で共進化するコンポーネントとして扱い、評価データを特徴のない信号として再利用する。
実験の結果、DyCAは最先端のLESベースラインを上回り、尾の堅牢性は平均15.2%、全体的な性能は7.1%向上した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:59:48 GMT)
LLM-OSDA: An Optimal-Stopping Dynamic Auction for Native Advertising in Multi-Turn LLM Conversations [27.8] 本稿では,ベルマン最適停止,勝者割り当て,封筒価格を組み込んだ動的コスト・ワン・クリックオークションを提案する。
シミュレーションされた会話型広告コーパスの実験では、LSM-OSDAは最強の固定時間ベースラインよりも11%改善している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:53:57 GMT)
GROW: Group-Relative Advantage-Weighted On-Policy Reinforcement Learning of Autoregressive-Diffusion Text-to-Speech model [27.7] 本稿では,標準フローマッチング目的に直接作用するグループ重み付きオンラインRL法GROWを提案する。
GROWは、政治上の発話のグループをサンプリングし、グループ内のインテリジェンスと話者-類似性報酬を個別に標準化し、それらを重回帰に結合する。
GROWは、32-NFE DiTAR-GRPOより2.9倍高速なトレーニングをしながら、同等のパフォーマンスを維持している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:50:55 GMT)
ACE-GraphRAG: Agentic Context Engineering for Hierarchical GraphRAG [27.7] 階層グラフRAG(ACE-GraphRAG)のためのエージェントコンテキストエンジニアリングを提案する。
ACE-GraphRAGは、ギャップ認識の洗練、検索分岐、タスク条件適応に関するポリシーとしてコンテキスト構築を定式化する。
Full-ACEはタスクファミリーごとに一様に適用するが、Adaptive-ACEは個々のクエリに対してタスク固有のポリシーとトポロジー固有のポリシーを選択する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:31:36 GMT)
PLS-Calib: A Partial Least Squares Framework for Event Camera and Odometry Calibration under Ground Motion Constraints [27.6] 既存のキャリブレーション技術のほとんどは、あらゆる自由度をエキサイティングするために6-DoFのフル動作に依存している。
PLS-Calib という新しい回転校正フレームワークを提案する。
我々は,最先端手法に比べてキャリブレーションの堅牢性と精度が著しく向上したことを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:07:07 GMT)
Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh [27.5] 我々は、Wan2.2カメラ制御をシャーカー線のみから共同カメラ+幾何学インタフェースまで拡張する参照誘導レンダリングであるDARを提案する。
Darは、アニメーションメッシュからニューラルな4D Gバッファを投射し、それをワイドコントロールアダプタで注入する。
68ケースのDAR-4Dベンチマークでは、LoRA DARはPSNR 23.22、SSIM 0.895、LPIPS 0.134に達し、市販のWan2.2-Depthを1.54dBPSNRに改善した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:01:26 GMT)
Efficient Grammar-Constrained Decoding via Parser Stack Classification [27.4] GCD(Grammar-Constrained Decoding)は、文脈自由文法で規定された規則に違反したトークンをマスキングすることで、生成された出力の構文的妥当性を保証する。
本稿では,新しい文法制約付き復号法であるPSCを提案する。
PSCは、デコードステップ毎にスタックを正確に1回チェックすることで、完全なマスクを計算できる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:26:54 GMT)
Morphology-Aware Implicit Super-Resolution Network for Pathological Images [27.2] Morph-ISRはDigital Pathologyのための暗黙の超解像フレームワークである。
複雑な組織の多様性の下で、診断に関係のある詳細をサブピクセル精度で復元する。
Morph-ISRは評価手法の中で最高のLPIPSとST-LPIPSを実現している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:41:57 GMT)
Observation of quantum nonclassicality without freedom of choice in a minimal causal network [27.1] 量子因果ネットワークはベル非局所性を超える非古典性のテストを可能にする。
光学実験において,最小限の3ノード非関連企業ネットワークを実装した。
我々は、デバイス非依存の量子プロトコルのためのコンパクトで実験的にアクセス可能なプラットフォームとしてUCネットワークを強調した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:23:29 GMT)
Agogic: Performance-Timed Music Tokens for LLM-Native Text-to-Symbolic-Music Generation [27.0] テキスト・ツー・ミュージック言語モデルにおける音楽のトークン化の効果を計測する。
7つのトークン化で表現を交換し、テクスチャメトリクスを各表現のモデルフリー天井に固定します。
私たちがリリースしたパフォーマンスレゾリューションストリームである PMT は 0.8B で FMD 159 に到達し、ビートグリッドは 272-286 で、ビートグリッドは 1.7-1.8x で、他の場所では 2.8 倍、非オーバーラップブートストラップ CI で 0.8B のパフォーマンスレゾリューションモデルは 27B ビートグリッドを上回ります。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:56:49 GMT)
SLAMFormer-$\infty$: Infinite SLAM Transformer for Unbounded Frontend and Backend Processing [26.9] Infinite SLAM Transformer (SLAMFormer-$infty$)を導入する。
SLAMFormer-$infty$は,大規模データセット間の軌道推定とシーン再構成の両方において,優れた,あるいは高い競争力を発揮することを示す。
特に、SLAMFormer-$infty$は、非常に長い軌道に一般化し、17mathrmkm$を超えるシーケンスでうまく動作する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:19:27 GMT)
S$^3$-Diff: Structural Semantic Synergy Diffusion Model for High Fidelity Super Resolution of Pathological Images [26.9] デジタル病理学は、正確な診断のために高解像度のスライド画像に頼っているが、画像装置、記憶装置、送信装置の制限により、臨床解釈においてより解像度の低い画像がより一般的になることが多い。
病理画像の高忠実度超解像のための拡散フレームワークである構造的セマンティック拡散相乗モデル(S3-Diff)を開発した。
S3-DiffのコアはSpecimen-aware Structure Anchoring (SSA)であり、固定SAMによって抽出された予後認識組織とLR-HR勾配の相違を組み合わせ、標本特異的な構造アンカーを生成し、病理形態を保存している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:16:36 GMT)
MT-Web2Code: Benchmarking Coding Agents on Multi-Turn Regional Reconstruction and Localized Modification [26.7] MT-Web2Codeはマルチターンマクロレベル地域再構成とマイクロレベル局所化のための最初のマルチモーダルコーディングベンチマークである。
我々は、構造的およびスタイリスティックな欠陥を黄金のページに繰り返し注入するスケーラブルな逆回転軌道エンジンを開発した。
13のコーディングエージェントの実験では、現在のエージェントは影響を受けていないコンテンツを保存しながら、領域を忠実にターゲットするのに苦労し、局所的な編集のためにきめ細かいビジュアルコードアライメントを欠いている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:14:00 GMT)
AgenticECO: An Agentic Framework for ECO on 3D Integrated Circuits [26.7] 本稿では,オープンソースのTaiWei フロー上での3D-IC ECOのためのエビデンス付きツール利用エージェントワークフローである AgenticECO を提案する。
同じ予算下での自然欠陥の9件で、AgenticECOはフルリルートとストックの修理で7件対2件をクリアした。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:32:43 GMT)
Aligning Large Vision-Language Models at Test Time: A Trajectory-Guided Structured Sampling Approach [26.4] 訓練後の強化学習アルゴリズムは、視覚言語モデルと人間の意図を合わせるために一般的に使用される。
既存のRLベースのアライメント手法は、しばしばリソース集約的であり、トレーニング目標と推論時間分布のミスマッチに遭遇する。
動的推論時間改善のための軌道誘導型構造化サンプリングを利用する新しいテスト時間アライメント手法を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:47:08 GMT)
Evaluating Counterfactual Sensitivity to Patient Information in Medication-Safety Reasoning [26.3] MedPIC-Benchは、患者固有の薬剤安全推論のための、ソース検証可能な勧告と専門家検証された質問のベンチマークである。
ガイドラインを追従する質問と、患者情報の制御された変更が、ルールを適用するかどうかを変更するペアの対実的な質問を組み合わせる。
どのモデルも、平均精度は63.6%から45.1%に低下する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:17:16 GMT)
LiLa-WAM: Lightweight Latent Reasoning World-Action Model for Robotic Manipulation [26.3] LiLa-WAMは軽量なワールドアクションモデルで、コンパクトな潜在空間における未来を推論し、24GBのGPUでエンドツーエンドにトレーニングすることができる。
本稿では,視覚的特徴空間の方向として各タスクを符号化する言語自由なタスク表現であるVisual Transition Token(VTT)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:06:15 GMT)
AI Security Leaderboard: Methodology, Results and Minimal Standard [26.0] 最前線のAIモデル開発者は、破滅的な誤用を防ぐために階層化されたセーフガードをますます頼りにしている。
FAR.AI Minimal Standard for Safeguards, Version 1.0: 67の分類法である。
我々は、360度攻撃目標の合計2つのデータセットに対して、Claude Fable 5, GPT-5.6 Sol, Gemini 3.1 Pro, Grok 4.5を評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:32:19 GMT)
When Correct Solutions Repeat: Rarity-Aware Credit Redistribution for GRPO [26.0] 検証可能な報酬(RLVR)を用いた強化学習
我々は、この挙動を多重性による構造レベルの信用集中として定式化する。
Cue-GRPOは補助モデル推論でこのルールをインスタンス化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:02:26 GMT)
Pin Once, Swap Light: Subspace-Aligned Centroid-Residual Training for Efficient Ultra-LoRA Serving [25.9] Subspace-Aligned LoRA Training (SALT)は、効率的な階層的な微調整フレームワークである。
まず、高容量なドメインセントロイドをドメイン内の公開データ上で共同で訓練する。
次にユーザは、凍結したCentroid上のプライベートデータに超低ランクのタスク残差アダプタを微調整する。
推論中、プロバイダはGPU VRAMにセントロイドをピン留めし、要求に応じて各ユーザのタスクを動的にスワップする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:34:35 GMT)
Language Models Encode the Contextual Truth of Propositions [25.4] 文脈的真理は、構造的に異なる出力ポリシーにまたがって持続することを示す。
決定境界付近の命題は、パートナーの主張を通じて彼らの真実をシフトさせることにより、より影響を受けやすいことが分かっています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:30:59 GMT)
AgentAntibody: An Adaptive Immune System for Defending LLM Agents against Prompt Injection [25.3] 既存の防衛は、以前の遭遇とは独立して、各タスクを自己完結した問題として扱う。
適応免疫にインスパイアされたエージェントAntibodyを提案する。
AgentAntibodyは、ユーザのセキュリティ境界を、永続的な抗体ライブラリとして理解している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:41:34 GMT)
DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces [25.3] データエージェントは、組織ワークスペース上の自然言語分析を可能にする。
既存のベンチマークは、構造化クエリ、検索、あるいはオープンエンド分析を主に分離している。
データエージェントが検証可能な表形式の結果を生成するベンチマークであるDataSpaceを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:48:11 GMT)
Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding [24.7] 3次元幾何学は、ビジュアルストリームの自然な圧縮メカニズムを提供する。
Qwen-3Dは、多視点幾何学的手がかりを用いてQwenバックボーン内の視覚情報を圧縮する幾何学的LMMである。
Qwen-3Dは既存の3D LMMを超え、いくつかの大規模プロプライエタリな2Dモデルを上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:32:09 GMT)
RSVideo: Are Your Vision-Language Models Ready for Remote Sensing Videos? [24.6] 本研究では,連続的リモートセンシング映像理解に基づく視覚言語モデル評価のための統一的評価設定を開発する。
フレーム間の質問時間領域を選択する小対象焦点のための強化学習フレームワークであるRSVideoを紹介する。
RSVideoはInternVL3.5-14Bで最大9.01%の改善を達成し、Qwen3.6-27Bで最高40.63%に達した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:55:12 GMT)
Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents [24.1] 我々は、トライアルレジストリ、規制レビュー、スポンサー申請、利用データ、疫学を含む31.7kの異質な公開データ記録を、45の歴史的プログラムにまたがる881のオフライン決定エピソードに組み合わせた、時間的データセットを構築した。
4つのオフライン目標:行動クローニング、報酬重み付け行動クローニング、学習後学習、価値に基づく暗黙的Q-ラーニングを、4つのフロンティアLSMエージェントに対して比較した。
これらの結果から,構造化オフライン学習が臨床実験の計画に役立てることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:58:17 GMT)
Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities [24.1] AI科学者が新しいアイデアを生み出す能力のベンチマークは、非常に難しい。
我々はこのフレームワークを2つの構造的に異なるドメイン、F1(F1)とMagic: The Gathering(MTG)でインスタンス化する。
両方の領域にまたがって、モデルは妥当なアウトプットを生成するが、現実のエキスパートソリューションと整合性は少ない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:30:13 GMT)
COMEX: A Composition-Grounded Benchmark and Learning Framework for Explainable Aesthetic Image Cropping [24.1] 我々は、構造化された作物構成・説明問題として、説明可能な美的画像トリミングを再構成する。
COMEXはイメージ拡張とIO-リバーサルパイプラインによって構築された新しいベンチマークである。
本稿では,2段階のSFT+GRPOフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:02:22 GMT)
TASQ: Temporal-Adaptive Bit Sparsification Quantization for Diffusion Models [23.9] 時間適応型ビットスカラー化量子化(TASQ)を導入する。
TASQは1つの共有最大精度重みバッファを格納し、各層に対して低い有効精度を選択し、最小のビットをトラッカーすることでステージを劣化させるテンポラル空間LSBマスクを学習する。
PixArt-Sigma、SANA-1.6B、SDXL-Turboでは、TASQはより少ない計算で静的量子化に匹敵する品質を達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:14:48 GMT)
GSTEP: Global Spatio-Temporal Density-Driven Visual Token Pruning for Efficient Video Large Language Models [23.8] 本稿では,映像を連続的な時空間情報フローとしてモデル化するプラグアンドプレイプルーニングフレームワークであるGSTEPを提案する。
GSTEPは、高い精度と効率のトレードオフを一貫して達成し、モデルアーキテクチャや評価設定にわたってうまく一般化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:51:46 GMT)
Multimodal Plant Root Phenotyping with Integration of 3D Skeleton Extraction and Language Analysis [23.8] 植物の根の表現型付けは、下層構造を理解し、作物管理を最適化し、農業の持続可能性を向上させるのに不可欠である。
本稿では,3次元骨格抽出と言語誘導推論を統合した多モードロボットAIフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:30:04 GMT)
TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning [23.8] そこで我々はターンレベルのヒンドsight自己蒸留フレームワークであるTurnSightを提案する。
これは、実行条件付き後見から直接監督する。
水平方向の合意を通じて信頼性の高い監視を選択する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:59:21 GMT)
DRIFT: Derailing Denoising Trajectories of Flow-Matching VLAs with Adversarial Patch Attack [23.7] pi0のようなフローマッチング視覚言語アクション(VLA)モデルは、学習された認知速度場を統合することでロボットの動作を生成する。
このロバスト性は、多段階のODEを無視した以前の攻撃から来ています。
DRIFTはロボットのグリップに置かれるテストタイムの普遍的敵パッチで、オフザシェルフポリシーのデノイング速度場を攻撃します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:47:26 GMT)
Teaching Foundation Models to Read mmWave: Pose-Guided Kinematic Representation for Human Behavior Understanding [23.7] ミリ波(mmWave)レーダーは、プライバシーに優しく、接触のない知覚モダリティを提供する。
既存のレーダー言語法は、しばしば合成データに依存するか、人体構造や運動力学の明確な監督を欠いている。
同期3ポーズトレーニングモデルを用いたレーダ言語モデルmmMindを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:25:55 GMT)
Keep the Needle, Prune the Haystack: Defect-Preserving Token Pruning for Efficient Zero-Shot Anomaly Detection [23.6] トケンプルーニングは有望な解決策を提供するが、異常検出において非対称プルーニングリスクを導入する。
本稿では,トークン選択をハイリコール・異常対応ルーティングとして定式化する欠陥保存型トークンプルーニングフレームワークであるKeepADを提案する。
実験によると、KeepADはトークン保持率を20%以下に下げ、画像レベルとピクセルレベルのAUROCの平均劣化を2.7ドルの範囲に制限している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:53:36 GMT)
Patients-like-me: A Variational LM--GNN Framework for Explainable Clinical Prediction [23.5] グラフニューラルネットワーク(GNN)は、患者間の関係を組み込んだ言語モデル(LM)を補完し、参照患者への帰属を可能にする。
我々は,局所的な患者意味論とグローバルコホート構造を統合する統一的なLM-GNNフレームワークを提案する。
MIMIC-IIIとMIMIC-IVの実験は、PLMが常に最先端の手法より優れていることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:51:52 GMT)
SeaSlides: Semantic Abstraction Layer for Agentic Slide Generation [23.3] セマンティック・抽象化・レイヤを中心に構築されたエージェント・スライド生成フレームワークであるSeaSlidesを紹介した。
座標やインラインスタイル、SVGの生形状のオーサリングではなく、再利用可能なコンポーネントや機能モジュールを通じて構造化されたスライドコンテンツを記述する。
評価のために、18タスクのUltraPresent検証設定とSeaSlidesBench-Richを組み合わせる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:08:28 GMT)
Secure Long-Range Autonomous Valet Parking: A Reservation Scheme With Three-Factor Authentication and Key Agreement [23.3] 長距離自動駐車(LAVP)は、交通渋滞と駐車困難を緩和するためにますます採用されている。
本稿では,LAVP予約サービスのためのセキュアな3要素認証および鍵契約プロトコルであるSecLAVPを提案する。
SecLAVPは中間者攻撃に抵抗するが、非公式な分析では15のセキュリティ目標を満たすことが示されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:43:24 GMT)
SpatialCLI: Learning to Reason With Spatial Tools, Then Without Them [23.0] 視覚言語モデル(VLM)は、視覚入力を解釈し、空間を推論し、タスクレベルの決定を行うための具体的エージェントとしてますます使われている。
一般的なVLMは全体のタスクを推論できるが、成功を決定する視覚的詳細を見逃してしまうことが多い。
本研究では,空間的ツールによる推論をVLMに教えるフレームワークであるSpatialCLIを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:14:50 GMT)
SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents [22.8] 我々は、ユーザクエリをセマンティック階層に整理し、スキルクエリと候補をマッチングし、スキル依存性を伝搬するSkillTraceを紹介した。
SkillsBenchとALFWorldの実験では、SkillTraceは最先端のパフォーマンスを達成し、53.17%の成功率に達した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:44:48 GMT)
Hi-TTRL: Regulating Consensus with Hints for Test-Time Reinforcement Learning [22.6] テスト時間強化学習フレームワークであるHi-TTRLを導入し、サンプリング中のヒントを利用してロールアウトコンセンサス強度を調節する。
複数のデータセットとバックボーンの実験は、Hi-TTRLが標準のTTRLよりも一貫して改善されていることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:20:17 GMT)
When Modalities Fail to Tango: Conformal Backdoor Detection in Multimodal Contrastive Learning [22.5] マルチモーダルコントラスト学習(MCL)におけるバックドア攻撃は近年注目を集めている。
既存の検出ベースの防御は、主にCLIPScoreメトリックに依存している。
CSCADEは,2段階の連続型バックドア検出フレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:20:41 GMT)
Beyond Accuracy: Auditing Spatial Provenance in Visual Token Pruning for OCR-Critical MLLM Inference [22.3] ビジュアルトーケンプルーニングは、一定保持予算における応答品質によって判断される。
私たちはこの盲点を、幾何学的トークン・オリジンの証明によってカップルが行動に答えるエビデンスリスク監査にします。
目的検証ポイントがタスク汎用圧縮を含まないことを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:46:13 GMT)
Don't Peek at the Answer: Outcome-Masked Group Relative Policy Optimization for Label-Free RLVR [21.8] 投票に基づくラベルフリーのRLVRは、金監督をモデルサンプルからの回答レベルのコンセンサスに置き換える。
政策最適化から報酬推定を分離するラベルフリーなRLVRフレームワークであるOM-GRPOを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:41:20 GMT)
EditFlow3D: Automated Local Editing of 3D Assets with Trajectory Preservation [21.6] ローカル3D編集のためのトレーニングフリーフレームワークであるEditFlow3Dを提案する。
ソースアセットと編集命令が与えられた場合、VLM駆動のワークフローは編集意図を解釈する。
マスク誘導微分フローは、対象領域の編集に焦点を当てる。
ステップワイズ軌道保存は、非ターゲット領域とソースアセットとの整合性を維持する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:16:17 GMT)
Shooting for Contact: Contact-Implicit Multiple Shooting for Dynamic Motion Retargeting [21.6] 本稿では,動力学的に実現可能な参照を動的に実現可能な全身軌跡に変換する,接触型直接シミュレーションベース多重撮影(DSMS)フレームワークを提案する。
命令条件付き接触リッチクローリングと高度にダイナミックな180度ジャンプターンにより、Unitree G1上のゼロショットsim-to-real転送を実証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:38:34 GMT)
LeanMem: Simple and Efficient Long-Term Memory for LLM Agents [21.4] 軽量な長期記憶フレームワークであるLeanMemを提案する。
推論中、LeanMemは動的にメモリタイプを選択し、クエリ固有のエビデンス要求に従って検索予算を割り当てる。
GPT-4.1-miniとQwen3-8BのLoCoMoとLongMemEval-Sでは、LeanMemは全ての設定において最強のメモリベースベースラインよりも精度を向上させる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:59:49 GMT)
ConlangBench: Exploring Language Knowledge and Learning in LLMs through Diverse Constructed Languages [21.2] ConlangBenchは、大規模言語モデルの評価とトレーニングのための最初の大規模ベンチマークである。
我々は21M以上のコンラング-英語並列文対(20の非エスペラント・コンラングにまたがる430K対を含む)と321K語彙のエントリを収集した。
ConlangBenchのトレーニングはまた、モデルが十分な並列コーパスが利用可能な8つのコンラングすべてを学ぶことができることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:45:10 GMT)
LatentGuard: Efficient and Inspectable Latent Reasoning for LLM Safeguards [21.1] 推論ベースのガードモデルはLLMセーフガードを改善するが、すべてのインタラクションに対して明確な論理をデコードすることで、デプロイにコストがかかる。
モデルガードに連続的な潜伏推論をもたらす、効率的で検査可能なセーフガードフレームワークであるLatentGuardを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:47:41 GMT)
Learning Music Style for Piano Arrangement Through Cross-Modal Bootstrapping [21.1] 生音声から暗黙的な音楽スタイルを学習し,それをシンボリック音楽生成に適用するクロスモーダル・フレームワークを提案する。
我々は2段階の学習戦略を採用する: 聴覚スタイルと記号表現の整合を対照的に学習し、次いで音楽アレンジメントのための生成的モデリングを行う。
ピアノカバー生成,スタイル転送,MIDI検索におけるアプローチの有効性について実験を行った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:01:54 GMT)
TIDE: A Physically Diverse 3D Turbulence Benchmark Dataset for Advancing Scientific Machine Learning [21.1] TIDE(Turbulent Incompressible DNS Ensembles)は,2563個のDNSコーパスと3次元非圧縮性乱流のベンチマークである。
ベンチマークには5つのタスク、標準化された学習ベースライン、制御された一般化分割、ポイントワイドエラーと並行して物理忠実度メトリクスが含まれる。
主要な予測構成全体において、現在の学習モデルは永続性にはほとんど優れておらず、スペクトルソルバの約2倍の誤差を発生させる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:56:23 GMT)
Perception Before Reasoning: Dynamic Latent Reasoning for Video Understanding and Question Answering [21.0] ビデオの質問応答には、言語クエリを視覚的証拠として、必要に応じて、時間をかけてその証拠を推論するモデルが必要である。
本稿では,まず,短時間の知覚遅延ブロックに疑問を投げかける動的遅延推論(DyLaR)を提案する。
DyLaRは、知覚潜伏剤を検証された視覚的証拠に接地し、検証された有理を推論された潜伏剤に蒸留することによって、この振る舞いを学習する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:23:17 GMT)
GeoMAR: Unleashing Geometrically Aligned Features for Masked Autoregressive Blind Face Restoration [20.9] コードブックベースのブラインドフェイス修復(BFR)は、しばしば深刻な劣化の下で曖昧な条件付けと脆弱な予測機構に悩まされる。
マスク付き自己回帰法 (MAR) を改良し, 頑健な顔復元を実現するために, 幾何学的に整列した特徴を解き放つためのフレームワークであるGeoMARを提案する。
1つの実世界のベンチマークと3つの実世界のベンチマーク実験により、GeoMARは既存の手法と比較して非常に競争力のある知覚的品質とコヒーレントな視覚構造を達成することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:55:49 GMT)
Diversity is Not Ambiguity: Toward Accurate and Efficient Ambiguity Detection for Open-Domain QA [20.8] 本稿では,論理的衝突によるあいまいさを検出するフレームワークARCHIVEを提案する。
ARCHIVEは、表面検出可能なケースのための軽量の早期出力エンコーダとコンフリクト推論モジュールを組み合わせる。
実験の結果、ARCHIVEはライバルより優れており、F1アンブは最大10.4%、F1アンブは最大21.6%向上している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:13:41 GMT)
From Multi-Resolution Cells to Gigapixel Whole Slide Images Foundation Model for Computational Pathology [20.7] MRPT(Multi-Resolution Pyramid Transformer)
624Mパッチ、2.4Mリージョン、36K全スライド画像(WSIs)を用いたマルチレゾリューションによる事前学習
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:51:16 GMT)
What Language Does and What the Evidence Supports: A Functional Role Taxonomy and Evidence Audit of Language Grounding in Embodied Agents [20.6] ファウンデーション・モデルは、実施されたエージェント全体に言語を配置するが、その存在は、それが貢献するものや、その貢献がどの程度根底にあるかを示すものではない。
言語における非排他的機能的役割として,仕様,身体表現,行動オーケストレーション,接地規則,実行結合の5つを定義した。
このフレームワークをレビュー文献に適用すると、機能的使用と明らかなサポートの間には、繰り返し発生するギャップが明らかになる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:17:54 GMT)
Learning Context-Aware Motion Priors for Humanoid Control [20.5] モーション先行は、自然主義的なヒューマノイドの行動を学ぶための強力なガイダンスを提供する。
既存の手法は、参照データセット全体から一般的なタスクに依存しない方法で学習し、ポリシートレーニングを通じて一様に適用する。
本稿では、現在のタスクコンテキストに先立って一般的な動きを適応させるフレームワーク、Context-Aware Motion Priors (CMP)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:05:31 GMT)
On the Diversity of Analogy Making in Large Language Models [20.4] 我々は,10の最先端オープンソースおよびクローズドソースLarge Language Models (LLMs)における類推多様性の包括的評価について述べる。
本研究は,LLMが対象ドメインの狭い集合から類似物を生成する傾向にある領域均一性の問題を明らかにするものである。
本分析により,既存のLCMの多様性向上手法の基本的なトレードオフが明らかとなった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:04:20 GMT)
Principles of Robot Autonomy [20.4] スタンフォード大学で何十年にもわたって教えてきたこのテキストは、単一の概念的なフレームワークの中で近代的な自律スタックの中核的な要素を発展させている。
すべての主要なトピックは、手持ちのJupyterノートブックと実装駆動のエクササイズとペアリングされる。
その結果は、次世代の自律システムの設計、分析、貢献を望む人のための、原則付き、アクセス可能で、デプロイ対応の基盤になります。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:35:20 GMT)
Dimension Rigidity and Projective Geometry of Trace-Product Switchings of the Gold Cube [20.3] 任意の偶次元において、ゴールド準完全非線形関数 $xmapsto x3$ の自然なスカラートレース積スイッチングを分類する。
すべての$ngeq10$に対して、非ゼロ係数は許容されない。
また、正規化階数 2 を 8 次元で $mathbbP1(mathbbF_4)$ で分類する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:36:09 GMT)
TARL: Transaction-Aware Reliable Ledgers for Executable Memory Management in Long-Term Agents [20.1] メモリ状態更新フレームワークであるTARLを導入し、各ステートメントを5つの実行可能なアクションのうちの1つにマップする。
TARLは、影響を受けるメモリを特定し、その時間的スコープを解決し、ソースの信頼性を比較し、受け入れ、保留、拒否された台帳を更新する。
さらに、代替更新操作によって生成されたメモリ状態を比較することで、モデルが正しい結果につながる操作を選択することを奨励する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:02:55 GMT)
Screenshots or Tools? Eliciting Tool Use and Managing Multimodal Context in Hybrid GUI-MCP Computer-Use Agents [20.1] ツールを持つことは、その効果がどの方向に進むかに落ち着かない。
推論モデルはこれらの失敗を避けるが、ツール修正可能なタスクの23.9%である55/309タスクのみをツールと呼ぶ。
ボトルネックはツールコールセマンティクスにある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:35:51 GMT)
Beyond Retrieval: Analytic Memory for Multimodal Agents [20.1] 長期的なマルチモーダルメモリは、関連する情報を取得するだけでなく、相互作用にまたがって蓄積された観測の計算もサポートしなければならない。
本稿では,検索と解析メモリを協調的にサポートするフレームワークであるAdaMMを提案する。
MemEyeとMemGalleryの2つの長期マルチモーダルメモリベンチマークの実験では、それぞれAdaMMのパフォーマンスが11.3%と6.9%向上した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:43:57 GMT)
PAMT: Process-Aligned Reinforcement Learning for Multi-Domain Machine Translation [19.9] 本稿では,冷間開始ドメイン認識型Long-CoT監視と強化学習を組み合わせたプロセス整合トレーニングフレームワークPAMTを提案する。
2つのバックボーンにわたって、PAMTはベースモデルを改善し、MT特化ベースラインを平均で上回り、ドメイン内、OOD、多言語設定で強力なLLM/LRMと競合し続けている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:42:54 GMT)
Caved or Convinced: Temporal Sampling Gates Claim Deference in Video Large Language Models [19.8] 2つのイベントのうちどれが最初に来たかを尋ねると、ビデオモデルは2つの方法で失敗する可能性があることを示す。
事前の作業は、最初にのみ測定し、モデルの信頼性を低下させることによって緩和する。
そこで本研究では,サンプルフレームを前向きに,逆向きに評価し,クレームを読まずに解答,再サンプリング,あるいは棄却することで,モデルの順序をキャンセルするリバーサルテストを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:47:44 GMT)
CRISP: Critical Step Perception for Training Efficient Deep Search Agents [19.7] 本稿では,効率的な深層探索エージェントを重要ステップ認識により訓練するフレームワークであるCRISPを提案する。
ツール使用を均一にペナルティ化する以前の効率の方法とは異なり、CRISPは冗長なものから必要な証拠を収集する相互作用を区別する。
実験の結果、CRISPは、平均的な相互作用をそれぞれ15.1%、33.2%減少させながら、競合する最終回答の精度を維持していることがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:03:12 GMT)
iFAN: Inference-Aware Learning for Plain Mask Transformers [19.7] Inference-Aware Learning (iFAN)は、マスクトランスフォーマーのトレーニングフレームワークである。
iFANは、クエリ競合を予測されたマスクの品質と整合させ、高信頼だが不正確な競合を抑える。
COCO、ADE20K、Cityscapesの実験では、汎光学、例えばセマンティックセグメンテーションにおける一貫した改善が示されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:51:06 GMT)
Should We Type or Talk to LLM Agents? A Comprehensive Study of Voice and Keyboard Input Perturbations [19.7] 本稿では,音声書き起こし摂動とQWERTYキーボード摂動の組であるHIVEを紹介する。
これらの摂動に対する頑健なモデルの評価を行う。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:38:06 GMT)
Knowledge-guided Disentanglement with Atomic Actions for Action Recognition [19.5] 複雑なシーンでのアクション認識は、しばしば複数の細かいアクションを同時に含む。
既存の手法の多くは全体論的な表現に依存しており、微妙な相互作用や微妙な意味論を捉えるには不十分である。
我々は, きめ細かな意味的知識を活用し, 行動表現を増強する知識誘導型原子行動拡散(KDA)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:44:31 GMT)
One Knob to Rule Them All: A Unified Optimal Transport View of Cold-Start Active Learning [19.5] Cold-Start Active Learning (CSAL)は、事前の知識や人的支援なしにラベルのないプールから価値のあるサブセットを選択することを目的としている。
真の課題は、もう1つの選択を設計することではなく、CSALを手元にあるデータやタスクに自動的に適応させることである、と私たちは主張する。
我々は、Sinkhornベースの新しいCSALアルゴリズムを、$-Adaptive Selection($-AS)と呼ぶ。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:21:39 GMT)
CorePath: A Breast-Specialized Pathology Foundation Model for Core Needle Biopsy Diagnosis and Risk-Controlled Report Generation [19.4] CorePathはPRISMを微調整した乳腺特異的多モード病理基盤モデルである。
CorePathはがんの検出、浸潤評価、組織学的サブタイプでPRISMを一貫して上回った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:43:49 GMT)
RoboReact: Agentic Skill Distillation from Generated Egocentric Videos for Generalizable Whole-Body Manipulation [19.0] 本稿では,1つの自我中心のRGB-D観測から全身のヒューマノイド操作スキルを自動的に合成するフレームワークであるRoboReactを紹介する。
RoboReactは人間の操作ビデオを生成し、深度対応の3D再構成を通じて幾何学的相互作用を抽出し、手動物体の相互作用を保ちながら、それらを高DoFのヒューマノイドプラットフォームに再ターゲットする。
実際のヒューマノイドロボットの実験では、RoboReactはさまざまなオブジェクト構成をまたがって一般化し、遠隔操作や人間によるデモンストレーションを必要とせず、実行障害から堅牢に回復する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:37:06 GMT)
GDPevo: Evaluating Agent Self-Evolution on Real Business Tasks [18.9] 自己進化は、エージェントの永続状態を以前の経験から更新し、関連するタスクを解決するために再利用する。
GDPevoは、GDP関連の企業で開発された進化ネイティブなベンチマークである。
GDPevoはCRM、ERP、金融、医療、法律、データ中心主義にまたがっている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:51:56 GMT)
Perceptual Anchoring: Prototype-Guided Text Calibration for Training-free Open-Vocabulary Semantic Segmentation [18.7] 訓練自由なオープン語彙セマンティックセグメンテーション(OVSS)は任意のテキスト記述に基づいてイメージを意味的に異なる領域に分割する。
トレーニング不要なOVSSのためのPTC(Prototype-Guided TextGuided)を提案する。
PTCは、初期マッチングスコアに基づいて信頼できる視覚的エビデンスを選択して、カテゴリ固有の視覚的プロトタイプを構築する。
アンチョリング段階では、PTCはこれらのプロトタイプを使用して対応するテキスト埋め込みを校正し、視覚的証拠の量に基づいて校正強度を適応的に調整する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:52:13 GMT)
MerchantBench: Benchmarking LLM Agents for Long-Term Coherence in E-Commerce Operations [18.7] 長期コヒーレンス(英: Long-Term Coherence)とは、累積的な証拠に決定を適応させながら、地平線を越えて目的的行動を維持する能力である。
売り手側のeコマースは、再帰的かつ相互依存的な決定を通じて、この評価に適切な設定を提供する。
MerchantBenchは、98,843件のeコマース製品記録に基づいた365日間の注文レベルのシミュレーションで、エージェントインタラクションのための26のツールを備えている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:17:07 GMT)
Geo-Embed: Towards Unified Multimodal Embeddings for Urban Understanding [18.5] 大規模なマルチモーダル埋め込みベンチマークであるGeoMEBを紹介する。
提案するGeo-Embedは、共通ビジョン言語バックボーンを命令条件付きクエリターゲットマッチングに適応させる統合埋め込みモデルである。
結果は,明示的なクエリターゲット関係に関するトレーニングと評価を組織する将来的な地理空間埋め込みを動機付けている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:36:17 GMT)
Can LLMs Test Terminal User Interfaces? [18.4] Terminal User Interfaces (TUI) は、GUIのステートフルでスクリーン指向の動作と端末の配置を結合する。
インターフェースを実行するのはテストコードのわずか12%で、これらのテストの45%は入力を送信しません。
これらのアプリケーションを、ratatui/Rust、bbletea/Go、textual/Python、ink/TypeScriptにまたがるヘッドレスベンチマークに変換する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:36:44 GMT)
Rectify Then Diffuse: Disentangling Concepts Before Denoising Trajectory Unfolds [18.1] テキストと画像の拡散モデルは、しばしば複数の概念と誤って概念を省略またはマージする。
トレーニング不要なフレームワークであるRectify-then-Diffuse(RTD)を提案する。
RTDは、最先端の合成忠実度と堅牢なゲインを達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:03:17 GMT)
Standalone DINOv3 for Training-Free Open-Vocabulary Semantic Segmentation in Remote Sensing [18.1] DinoSplat-OVは、DINOv3を微調整や追加の事前トレーニングなしでリモートセンシングに適応する、トレーニング不要のフレームワークである。
本フレームワークは,テキストのセマンティック親和性と局所的な視覚的類似性を組み合わせることで,パッチレベルの予測をノイズ化する。
UDD5、DOTA、LoveDAの実験では、既存のトレーニングフリーメソッドよりも、競争力や優れたパフォーマンスを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:12:39 GMT)
DiffImaginE: Imagine to Verify Entity Types with Diffusio [17.9] 本稿では,MNER型検証を条件付き潜伏拡散推論として定式化するDiffImaginEを紹介する。
局所的な視覚的証拠が与えられた場合、型条件付きデノイザは、標準化された潜水器に注入されたノイズを予測する。
結果として生じるデノナイジングエラーは、型条件の負の対数類似性に対するELBO一貫性のサロゲートを与える。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:13:45 GMT)
Language-Specialized Multi-Teacher On-Policy Distillation for Multilingual LLM-Based ASR [17.9] 言語特化マルチ教師オンポリシィ蒸留(LS-MOPD)
Mandarin, Mandarin subdialects, Cantonese, Englishを含むベンチマークの実験。
LS-MOPDは、RLのベースラインを大幅に上回り、最高のパフォーマンスの教師によって定義された経験的パフォーマンスエンベロープを一貫して上回ります。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:02:47 GMT)
Scalable Frequency- and Length-Aware Subdocument Deduplication for Large Language Model Pretraining [17.8] コピー保持から重複検出を分離するスケーラブルなサブドキュメント複製フレームワークを提案する。
FineWeb-Eduの実験とコードを含むWebコーパスにより,本手法が処理したデータに基づいてトレーニングしたモデルが,全体的な性能を最高のものにすることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:02:28 GMT)
K-space Gaussian Representation for Parallel MRI [17.6] K-空間ガウス表現(KGR)は、ネイティブなk-空間領域で直接形式化された最初の明示的連続表現である。
KGRは、Gabor-Gaussianプリミティブを共有空間幾何学でパラメータ化し、コイル間の相関を自然に保存するコンパクトな表現を生成する。
これらの結果は、ネイティブk空間の明示的な連続パラメータ化が、構造的低ランク再構成と連続信号モデリングを統合するための原則的枠組みを提供することを示唆している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:06:57 GMT)
POEM: Phase-Aware $\mathrm{SO}(2)$ Feature Rotation for Time Series Forecasting Under Periodicity Drift [17.4] POEM は位相補正座標を学習し、可逆な $mathrmSO(2)$-based 回転をペア付潜在特徴に適用することにより位相関連変動を低減することを目的としている。
実験により、POEMは競争性能を向上し、可視化により、学習した位相認識変換により遅延軌道がより規則的になることが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:16:07 GMT)
Quality Control Algorithms for Pattern Counting [17.3] 経験的アルゴリズムは品質制御問題の定義において非対称性を利用していない。
品質制御の定義における非対称性を利用して、これらの問題を解くためにpoly$(k)$時間で実行されるアルゴリズムを与えることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:35:00 GMT)
Information-Theoretic Causal Modelling of Semiconductor Process Dynamics [17.3] この研究は、ログファイルの時系列データから直接半導体プロセスの基盤となるダイナミクスを推測する新しいフレームワークを探求する。
予備的な結果は、推論された依存関係が既知のことを示し、36.2%は確率的であり、17.5%は以前は文字化されていない関係を示し、39.0%は確立されたプロセス知識と矛盾していた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:27:19 GMT)
SKILL-KD: Contrastive Skill Distillation for LLM Agents [17.2] スキルベースのプロンプトは、大規模言語モデル(LLM)エージェントを改善するための実践的なメカニズムとなっている。
既存のスキル獲得手法は、しばしば経験の要約、記憶のエントリ、あるいは成功例の直接的な要約として、スキルを扱います。
SKILL-KDは, 異なる能力を有するエージェント間での明示的な蒸留媒体として, スキルを扱える技術蒸留フレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:41:24 GMT)
MAFIA: Query-Only Memory Attacks via Probing and Factual Injection against Audited LLM Agents [17.1] MAFIAはクエリのみのメモリアタックフレームワークである。
MAFIAは最大90.7%の攻撃成功率を達成し、83.3%のピークから7.4%のピークまでの監査検出を抑える。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:50:26 GMT)
MissClick: Exploiting Digit-Serialized Coordinates to Attack GUI Grounding Models [17.1] 本稿では,2つの目的を目標とする単純かつ効果的なホワイトボックス攻撃を提案する。
MissClick-Uは非目標破壊のためのソフトコーディネート変位を最大化し、MissClick-Tはターゲットハイジャックのための位置重み付きターゲットデジタル損失を最小化する。
OS-AtlasとUGroundのGUIグラウンドモデルに対する既存の攻撃と比較して、MissClick-Uは75.07%と72.93%(+16.62と+30.72pp)の未目標成功率、MissClick-Tは44.86%と62.67%(+31.73と+31.73)の目標成功率を達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:34:41 GMT)
When and Where to Look: Adaptive Visual Evidence Scheduling for Efficient Long Video Understanding [17.1] 低オーバーヘッドクエリ適応型視覚的エビデンススケジューリングのためのフレームワークであるEcoFrameを提案する。
Video-MME、LongVideoBench、MLVUの実験では、EcoFrameは複数のVLMバックボーン間で効率の良いトレードオフを実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:49:53 GMT)
MuEvo: LLM-Driven Evolution of Multi-Heuristic Ensemble [16.7] アンサンブルレベルのフィードバック下でのアンサンブルを進化させるLLM駆動型フレームワークであるMuEvoを提案する。
4つの最適化領域にまたがる選択ヒューリスティックスとコンポーネント化されたアリコロニー最適化について,MuEvoの評価を行った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:19:51 GMT)
Noise-Aware Shrinkage for Differentially Private Zeroth-Order Fine-Tuning of Large Language Models [16.7] 信号品質の予測値に応じて,民生推定値を適応的に減衰する雑音対応縮小手法を提案する。
純粋な後処理として、SAGEは追加のプライバシ予算もモデルクエリも必要とせず、一定の追加状態しか導入しない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:52:23 GMT)
Eliciting Intrinsic Hallucinations in LLMs via Semantically Equivalent Adversarial Attacks [16.4] 大規模言語モデル(LLM)は、事実の正確性を改善し、幻覚を減らすために外部知識ソースと併用されることが多い。
本稿では,ユーザクエリの自然な意味論的に等価なバリエーションを用いて,ストレステストによりモデルロバスト性を評価する新しいフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:25:40 GMT)
We Must Have Missed This Comment: Detecting and Repairing Stale Function References in Linux Kernel Comments [16.2] Linuxカーネルが進化するにつれて、コードコメントは時代遅れになる可能性がある。
このような古い参照を識別し、修復するための3段階のアプローチであるReCiteを提案する。
Linuxカーネル v6.18-rc1 では、ReCite は修正提案によって869の古い参照を検出する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:28:48 GMT)
DUD: Decoupled Update Dynamics for Reliable Uncertainty Quantification in Large Language Models [16.1] textbfDecoupled textbfUpdate textbfDynamics textbf(DUD)を導入する。
各モジュールの独立復元能力を定量化することにより、モデルの内部の不安定性を捉えるデュアルストリーム動的プロファイルを構築する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:04:33 GMT)
A Direct Route to Markov Chain Convergence via Asymptotic Equivalence with the Target [16.1] 我々は、マルコフ連鎖収束定理の自己完結した証明を、目標との同値性と呼ばれる基準によって与える。
この基準の密度バージョンは、一般的な可測空間上で3つのケースで検証される。
すべての設定において、バーコフのエルゴード定理は、大数の強い法則を得るために適用される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:03:20 GMT)
Towards Robust Tool Use in Agents via Experience-Driven Adaptive Guidance [16.0] 我々は、各ツールの機能境界とベストプラクティスをキャプチャする適応型ランタイムガイダンスを構築し、洗練するメカニズムであるExpGを提案する。
ExpGは、経験獲得、経験蒸留、経験再利用の3段階からなる。
実験によると、ExpGはツールの選択、ツール呼び出し、レスポンス生成タスクに一貫した改善をもたらす。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:56:31 GMT)
FakeI2V-Bench: Benchmarking the Applicability of Image-level Deepfake Detectors for Deepfake Video Detection [15.8] FakeI2V-Benchは最先端のビデオレベルのディープフェイク検出器を評価するためのベンチマークである。
IV-Bridgeは、画像レベルのディープフェイク検出器をビデオに適用可能にするフレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:13:31 GMT)
Don't Let Me Ask for It: LLMs Show Deficiencies in Active Multi-Turn Information Acquisition for Abductive Inference [15.8] 帰納的推論は、観察された証拠を説明し、新しい証拠が利用可能になるにつれてそれらを修正する仮説を形成する必要がある。
本稿では、異なる相互作用モード下でこれらの振る舞いを研究するための対話型プローブであるAlien Abductionを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:39:24 GMT)
Reachability Is Not Realization: Tracing the Sources of LLM Benchmark Gains [15.7] モデルは、新しい回答に到達したり、既に到達範囲内にあった回答を生成できる。
我々は,一定の予算,温度,回答形式の下で質問レベルの監査を行う。
まず、推論時層ルーティングが到達可能性を高めるかどうかを検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:52:27 GMT)
MalTotal: Cost-Effective and Language-Agnostic Malicious Code Poisoning Detection for Millions of Repositories [15.7] MalTotalは、言語に依存しない悪意のあるコード検出のためのスケーラブルで費用対効果の高いフレームワークである。
MalTotalは8つの最先端のベースラインを上回り、5つの主流言語で平均93.1%のF1スコアを達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:03:49 GMT)
FedGSA: Geometry-Consistent Subspace Aggregation for Differentially Private Federated LoRA [15.7] 微分プライベートなLoRAのための幾何整合アグリゲーションフレームワークを提案する。
FedGSAは、各プライベート化されたクライアント更新を、グラスマン多様体上の基底不変部分空間として表現している。
我々は、FedGSAがクライアント側のDPトレーニング以上のプライバシーを損なうことなく、標準的前提の下でその収束を確立することを証明した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:39:40 GMT)
GEB-Bench: Abstract Structures Told in Many Voices [15.6] 我々は、GEB-Benchという、ユニットが抽象的な構造的モチーフであるベンチマーク、-自己参照、奇妙なループ、Mobiusのツイスト、---ゴデル、エッシャー、バッハの精神を例に紹介する。
それぞれのモチーフはいくつかの声で語られる: 構成が構造である自然のシーン、語られる民話は機械的にチェック可能な形状の装置、数学的定理、プログラムの骨格である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:05:41 GMT)
PhyAI: Real-Time Physical AI at the Edge, Scalable Rollouts in the Cloud [15.6] PhyAIは、単一のランタイムを持つ物理AI推論エンジンである。
単一のまたは複数のGPU上でビジョン言語アクション(VLA)モデルとワールドアクションモデル(WAM)を実行する。
pi0、pi0.5、GR00T N1.7、MiniCPM-Robotの公式実装よりも1.40x-4.65xのスピードアップを実現している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:53:48 GMT)
LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation [15.6] LiteMVSは軽量な多視点深度推定モデルである。
平面スイープな幾何学的推論と強い単分子的意味論を融合させる。
LiteMVSは競争効率を維持しつつ高品質な深度予測と3次元再構成を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:54:32 GMT)
FedCARE: A Multi-Objective Personalised Federated Learning Framework for Smart Healthcare [15.5] textbfFedCAREは、スマートヘルスケアサービスのための多目的パーソナライズされたFLフレームワークである。
We implement FedCARE in a cloud-based client-server federated deployment on the Melbourne Research Cloud。
実験の結果,FedCAREは標準FL,多目的FL,パーソナライズされたFLベースラインより一貫して優れていた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:37:03 GMT)
NCGR: Noise-Conditional Gated Rectification for Camera Extrinsic Perturbations in BEV 3D Object Detection [15.4] カメラベースの鳥の目視(BEV)3D検出は、通常、正確で固定されたカメラ外在物を前提とします。
空間的クロスアテンション(SCA)を用いた検出器では、外在的な摂動は、BEV基準点の画像平面投影を変位させる。
完全6自由度外乱補正を明示的に見積もることなく, 投射誤差を補うために, NCGR(Nono-Conditional Gated Rectification)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:26:57 GMT)
DHRCL:Training Code LLMs with Dense Hierarchical Rewards and Curriculum Learning [15.4] Dense Hierarchical Rewards and Curriculum Learning を用いた強化学習フレームワーク DHRCL を提案する。
DHRCLは、構文検証、実行の成功、単体テストのパスレート、ASTベースの構造的類似性にフィードバックを分解する。
我々は,Qwen3-4B,Qwen3-8B,Qwen3-14BのバックボーンにおけるDHRCLの評価を行った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:18:00 GMT)
Learning to Predict Middle-Layer Attention in MLLMs for Visual Token Prunin [15.4] サンプル固有の教師層を特定するために中層注意予測(MAP)を提案する。
MAPは、選択した層からの注意を、マルチモーダルな入力特徴から視覚的トークンの重要性を推定する軽量な予測器に蒸留する。
MAPは未処理のモデルの97.5%を保ち、視覚トークンの5.56%しか持たず、エンドツーエンドのスピードアップは3.09倍である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:44:07 GMT)
Monte Carlo Tree Search for Table-to-Multimodal Report Generation [15.4] 本稿では,マルチモーダルテーブル・ツー・レポート生成を構造化された検索空間上でのプログレッシブな構築プロセスとして定式化するモンテカルロ木探索(MCTS)駆動のフレームワークを提案する。
我々は、LCMを用いてMCTS中にステップバイステップの推論とアクションを生成し、各ノードにコンテキスト認識・コヒーレントレポート構築のための推論軌跡を格納する。
MMRBenchの実験では、MCTS-Reportは構造的完全性、数値的正確性、チャートテキストのアライメント、洞察的ノベルティにおいて、77.9のスコアを達成し、強いベースラインを著しく上回ることを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:52:05 GMT)
SRAP: SVD-Refined Adversarial Perturbations for Imperceptible Face-Swap Defense [15.3] 投影勾配降下(PGD)によって生じる逆方向の摂動は、顔スワッピングモデルで使用されるアイデンティティ表現を妨害することができる。
PGD摂動の識別感度推定と特異値分解(SVD)により,これらの空間的およびスペクトル的非効率を解析した。
本稿では,各最適化ステップにおいて,チャネル毎のSVD精細化とID重要度マスクを併用したSRAPを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:48:46 GMT)
TDVR: Joint Text Disambiguation and Viewpoint Reasoning for Zero-Shot 3D Visual Grounding [15.3] Zero-shot 3D Visual Groundingは、テキスト記述と3Dビジュアル入力に基づいて、特定のオブジェクトをローカライズすることを目的としている。
TDVRは、入力テキストを曖昧にし、ゼロショット3次元視覚的グラウンドの正確な視点を推測する学習自由推論フレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:51:15 GMT)
CROSS: Cascaded Distillation and Dual-Constraint Grounding for Remote Sensing Referring Segmentation [15.2] Crossはリモートセンシングイメージを参照するための密に統合されたパラダイムである。
まず,Linguistic-Guided Cascaded Distillation (LGCD)を導入し,建築的ギャップを埋める。
第二に、PSCL(spective-Spatial Contrastive Learning)は、横断的制約を課している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:24:05 GMT)
SONAR: Task-Aware Code Summary Evaluation for LLM Consumers Without References [15.2] ソースコードの要約は、伝統的に人間の開発者の視点から評価されてきた。
LLMベースのツールやエージェントは、ソフトウェアエンジニアリングタスクのインプットとして、コードの要約をますます消費しています。
本研究では,ソースコードの要約を4次元で評価する参照フリーフレームワークであるSONARを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:54:45 GMT)
GORDON: Graph-based Object-centric Rewards for Decomposition of Long-Horizon Manipulation [15.2] GORDONはグラフベースのオブジェクト中心報酬学習フレームワークである。
アクションフリーのビデオデモから、深い報酬を学べる。
長期のタスクで平均74.4%の成功率を達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:43:41 GMT)
Global Graph-Validated Optimization for VLM-based 3D Indoor Scene Generation [15.1] オープンボキャブラリー3D屋内レイアウト生成について検討し、ラベルのない3D言語命令から様々な物理的に可視なシーンを合成する。
本手法は,オープンな3次元屋内レイアウト生成における最先端性能を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:24:09 GMT)
Taming the Implicit: Dual-Channel Risk-Aware Reinforcement Fine-Tuning for Continual Multimodal Post-Training [15.0] 顕著なタスク分布シフトの下では、代表的RFTアルゴリズムをまたいで忘れることが急速にエスカレートする。
本稿では,リスク対応政策最適化(RAPO)を提案する。
RAPOは、新しいタスクの競争力を保ちながら、RLOOのバックボーンに対する最後の忘れを79.8%削減する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:40:03 GMT)
EvoHIL: Self-Evolving Reward and Flow-Matched Policy Optimization for Robust Human-in-the-Loop Reinforcement Learning [14.9] EvoHILは、報酬モデル、アクションジェネレータ、ヴィジュアルドメインを、段階的なヒューマン・イン・ザ・ループ学習プロセスに適合させる統一されたフレームワークである。
タスクの成功、人間確認ラベルとの合意、動作のスムーズさ、ループ中の人間と模倣のベースラインに対する完了時間を改善する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:12:05 GMT)
DocTrace: Towards Traceable Long Document VQA via Hierarchical Evidence Graph Reasoning [14.8] Long Document Visual Question Answering (LongDocVQA)は、複数のページにまたがる異種文書要素を探索し、統合し、推論するために、MLLM(Multimodal Large Language Models)を必要とする。
エンド・ツー・エンドのMLLMを含む既存のアプローチは、しばしば推論中に、根拠となる証拠がどのように徐々に構成されているかを表現し、検証するための明確なメカニズムを欠いている。
本稿では,エビデンスローカライゼーション,構造化文書解析,エビデンスグラフ推論を行う階層的なフレームワークであるDocTraceを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:04:59 GMT)
A Comparative Study of Feature Selection Methods for EHR Diagnosis Codes in Opioid Use Disorder Prediction [14.4] 診断関連機能に着目し,オピオイド使用障害(OUD)予測のための5つの特徴選択パラダイムを比較した。
統合された事前処理および評価フレームワークを用いて、下流予測性能、再サンプリング安定性、頻繁な診断符号の表現による各手法の評価を行う。
以上の結果から,機能予算が大きくなるほど性能が向上し,リターンが低下することが明らかとなった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:37:29 GMT)
ProPRL: Property-Aware Prerequisite Relation Learning in Educational Knowledge Graphs [14.4] 本稿では,前提条件付き関係学習技術であるProPRLを提案する。
実世界の教育データセットの実験では、ProPRL----は前提条件学習に重点を置いている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:41:01 GMT)
A Hierarchical Approach to Imitation Learning for Manipulation Tasks Requiring Time Varying Forces [14.4] 高速軌道生成(DPA-FTG)による拡散政策の導入
位置補正に焦点を当てた最近の視覚触覚アプローチと比較して、DPA-FTGは高周波力規制から低周波計画を切り離す。
本研究は,適合シートの分離を含む両面電池解体作業に対するアプローチを検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:21:00 GMT)
Physics-Informed Quantum Machine Learning with Hard Constraint Embedding for Nonlinear Differential Equations of the First Order [14.3] 本研究では,物理インフォームド量子機械学習(PIQML)フレームワークを提案する。
このフレームワーク内では、パラメータ化された量子回路が機械学習モデルとして機能し、入力変数は高次元の特徴空間に符号化される。
その結果、我々の量子モデルは解法をうまく学習し、高精度な古典的数値ベンチマークとの密接な一致を示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:17:21 GMT)
ED-DiT: Physics-Guided Diffusion Pretraining for Transferable Molecular Representations from Electron Density [14.3] 電子密度点雲上での自己教師付き事前学習のための物理誘導拡散変換器ED-DiTを提案する。
ED-DiTは拡散雑音レベルを越えて、破損した部分マスキングされた対数密度場を再構成することで再利用可能な表現を学習する。
6つのEDBenchタスクの実験では、ED-DiTは、特に限られた監督の下で、スクラッチからトレーニングされた同じアーキテクチャを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:33:35 GMT)
AgenticVAU: Multi-Agent Explore-Verify Reasoning for Video Anomaly Understanding [14.1] 本稿では,ビデオ異常理解のためのトレーニング不要なマルチエージェントフレームワークであるAgenticVAUを提案する。
視覚ルールの構築、探索計画、ビデオ観察、最終決定を扱うために、4つの特殊エージェントが導入された。
エージェントVAUは、十分な証拠が収集されるまで、広範囲の時間探査、密集した局所的検証、および相互比較をインターリーブする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:01:59 GMT)
PACE: Adaptive Budget Allocation for Time-Efficient Embodied Planning [14.0] PACEは、インターリーブされた推論と実行を可能にするフレームワークである。
Robotouilleベンチマークでは、PACEは10%の成功率に達し、ReAct+Thinkベースラインよりも67%改善されている。
その結果、タイムアウェアなアーキテクチャの革新により、推論モデルが遅延に敏感なエンボディドドメインで動作できることが証明された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:29:46 GMT)
CrossScope: A Role-Asymmetric World Model for Joint Dual-Scope Surgical Video Prediction [13.8] 2つの柔軟なスコープは、キャリブレーションされたステレオ関係なしで相補的ではあるが役割に依存したビューを提供する。
目的の証拠ルーティングを実現しつつ,ビュー固有の専門家を保護した2ストリーム手術世界モデルである textbfCrossScope を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:49:04 GMT)
Any-OPD: Heterogeneous On-Policy Distillation for Flow-Matching Models via Representation-Space Bridging [13.7] 教師が生徒自身が生成するサンプルを補正するオンライン蒸留は、2つのモデルが同じ言語を話すことを前提にしている。
我々は、Any-OPDについて、任意対の潜流整合発生器間のオンライン蒸留のための最初のフレームワークについて述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:23:57 GMT)
Neuro-Symbolic Proof-of-Vulnerability Generation with Open-Weight Models [13.5] POVGENは、Proof-of-Vulnerability生成をコスト効率良くする低コストのニューロシンボリックフレームワークである。
POVGENは最近のベンチマークで78.98%の脆弱性に対してPoVを正常に生成した。
パブリックなPoVのない250の現実世界のCVEでは、74.80%のケースで有効なPoVを生成し、パッチ情報なしで65.1%を再生する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:37:21 GMT)
MiniWorld: Democratizing the Training of Video World Models from Scratch [13.3] ビデオワールドモデルは、過去の観測と制御信号に基づいて将来の観測を予測する。
MiniWorldは、ストリーミングビデオワールドモデルをゼロからトレーニングするための再現可能なフレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:32:45 GMT)
Real-time decoding of quantum error correction codes using high-performance computing [13.3] スケーラブルなフォールトトレラント量子コンピュータを構築するには量子エラー補正(QEC)が不可欠である。
本稿では,高性能計算資源を用いた量子誤り訂正符号のリアルタイム復号化のためのアーキテクチャemphTHQLinkを提案する。
我々は、平均2.944ドルのラウンドトリップ遅延を報告し、追加のホップあたり130 nsのインクリメンタルオーバーヘッドを報告した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:12:42 GMT)
PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks [13.2] 本稿では,SWEベンチマークにおけるPR-IssueミスアライメントをチェックするマルチエージェントシステムPAICheckerを提案する。
SWE-GymとSWE-bench Multilingualの実験により、PAICheckerは4つのLLMバックボーンで最高の性能を発揮することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:26:35 GMT)
Trajectory-Guided Forget-Recover Network for Continual LLM Unlearning [13.2] Unlearningは、モデルに対するセンシティブなデータの影響を排除することを目的としている。
現実世界では、未学習の要求が継続的に届き、それが2つの課題を生み出します。
我々はTFR-Net(Trjectory-Guided Forget-Recover Network)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:49:48 GMT)
Assessment of Conditional Diffusion Model for Synthetic Histopathology Image Generation [13.2] 本稿では,Frechet Inception Distance (FID) やInception Score (IS) などの従来の総合的データ評価指標が病理組織像に適用した場合の限界について述べる。
これらの制約に対処するため、デジタル病理学データセットに事前訓練された基礎モデルを用いた修正FIDとISアプローチを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:51:40 GMT)
An Actionable Diagnosis of Multilingual, Multi-Agent Planning Failures [13.1] マルチエージェントシステムにおけるプランナを,要求対アクションインタフェースとして検討する。
我々は、現実のタスク実行の失敗から、計画上の失敗の実行可能な分類法を導出する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:29:14 GMT)
Stochastic Saddle Avoidance Beyond Unit Excitation and Smoothness: A Pathwise Lyapunov-Perron Framework [13.1] ユニット(UE)はサドル回避の一般的な前提であるが、実際のノイズ構造を単純化する。
有限サム問題では、勾配ノイズは低次元のデータ依存部分空間に存在することがある。
UEを使わずに再帰の回避定理をほぼ確実に証明する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:34:36 GMT)
Relational Priors as Convergence Pressure in LLM-Based Multi-Agent Systems [13.1] 本研究では,大規模言語モデルに基づくマルチエージェントシステムにおいて,エージェント間関係のセマンティクスを明示する効果について検討する。
リレーショナル・ポジティビティの増大はエージェントのコーディネートや合意をより容易にする傾向にある。
LLM-MASのデフォルトアドオンとしてリレーショナルプリミティブを使用すべきではない、と我々は主張する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:11:28 GMT)
SlimVLM: Sensitivity-aware Dynamic Structured Pruning with Adaptive Visual Token Selection for Efficient Vision-Language Models [13.1] VLM(Vision-Language Models)は、テキストと画像の両方の処理と理解において顕著な性能を示している。
タスク性能を保ちながらVLMを圧縮する構造化プルーニングフレームワークであるSlimVLMを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:34:46 GMT)
NotDec: WebAssembly Decompilation With Inter-Procedural Type Recovery [13.1] 先進的なWebAssembly逆コンパイルフレームワークであるNotDecを紹介します。
NotDecはWebAssemblyの型チェックアルゴリズムを拡張して、バイトコードをSSAベースのIRに持ち上げる。
タイプ回復精度では、NotDecは実世界のプログラムで85.33%の構造体メンバーアクセスを回復し、Ghidraの9.24%を大きく上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:01:06 GMT)
LiveEvalBench: Toward Open-World Evaluation for Web Generation [13.1] We present LiveEvalBench, a automated framework that a web-generation evaluation as an agentic, adapt, and rubric process。
LiveEvalBenchは、ビルドエンジニア、コードエンジニア、UIテスタがプロジェクトのライフサイクル全体にわたってエビデンスを収集する、共同レビューワークフローとして評価をインスタンス化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:57:48 GMT)
ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable Tool Planning [13.0] ツール固有のトラジェクトリをFWG(Function-level workflow graph)に引き上げて汎用的なツールプランニングを行うフレームワークであるToolLIFTを提案する。
信頼性の高いツールデータフローを保証するため、私たちは、ツールコール間のソース追跡可能な情報フローを維持するために、ソースゲートとスキル固有の報酬を採用しています。
2つの分布内(ID)と3つの分布外(OOD)ベンチマークの実験は、ToolLIFTが一貫して最先端のベースラインを上回っていることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:02:45 GMT)
When Memory Becomes Authority: Benchmarking Authority Collapse at the Memory Consolidation Boundary [12.8] LLMエージェントは不均一な相互作用履歴を再利用可能な事実、嗜好、観察、規則に集約することでタスクに適応する。
我々は、権限の崩壊を特定し、統合は、その認可された使用を規制するソース制約を消去しながら、クレームを保護します。
メモリ駆動型適応は、学習したものだけでなく、再利用される可能性のある権威も保持しなければならないことを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:28:14 GMT)
NanoMorph-3D: An End-to-End Physics-Driven Unrolling Framework for Nanomaterial Reconstruction [12.8] NanoMorph-3Dは包括的ナノ形態分類に基づくエンドツーエンドの統一フレームワークである。
非線形電子減衰を明示的にモデル化した大規模合成データセットを用いて, 近似勾配勾配を学習可能なアーキテクチャにマッピングする物理駆動アンロールネットワークを設計する。
実験では、NanoMorph-3Dが優れた忠実度と速度で様々なトポロジを再構成することを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:30:48 GMT)
Equivariant Music Transformer [12.8] 標準音楽変換器は、時間シフトやピッチ変換による入力を非相関表現にマッピングする。
これは、共有された音楽構造を捉えるのではなく、絶対的なパターンを記憶するために追加のモデル容量が割り当てられていることを示唆している。
本研究では, 自己蒸留により等価な音楽変換を行うEquivariant Music Transformer (EMT)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:51:58 GMT)
Verifiable Memory: Learning Unified Memory Management with Local and Global Verifiers for Large Language Model Agents [12.8] 大規模言語モデル(LLM)エージェントは、再利用可能な情報を保持し、有界な活動コンテキストを制御し、長い水平相互作用の間、以前の証拠を回復しなければならない。
本稿では,LTM,アクティブコンテキスト,エピソード履歴を異なる状態として表現し,一つのメモリ操作ポリシで制御するフレームワークであるVerMemを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:06:24 GMT)
Low-Dimensional High-Leverage Subspace Optimization: Beyond Full-Parameter Coupled Training for Neural Network Quantization [12.7] 低ビット量子化は、コンパクトネットワーク上で深刻な精度劣化を被る。
従来のパイプラインではモノリシックな最適化が採用されている。
ターゲット部分空間最適化のための正規化アフィンプレコンディショニング(NAP)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:50:04 GMT)
From Wearable Data to Personalized and Actionable Health Insights [12.6] ユーザアノテーションとウェアラブルデータを組み合わせて,ストレス管理の改善を支援するフレームワークを提案する。
社会的相互作用は平均心拍数を4.35から5.0ビートに減らし、意図的にガーミンストレススコアを10.03から13.83ポイントに減らし、マインドフルネス活動は平均HRVを6.61から13.22ミリ秒に減らした。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:23:46 GMT)
Sublogarithmic Swap Regret in Multiplayer General-Sum Games via Hybrid Regularization [12.6] スワップ後悔は、非結合学習力学がマルチプレイヤー一般サムゲームにおける平衡に収束する速度を支配している。
我々は、すべてのプレイヤーが$O(nm2sqrtlog mlog T/T)$スワップ後悔を発生させるアンカップリング力学を構築する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:58:51 GMT)
UrbanAgent: A Tool-Augmented Agent for Cross-System Urban Tasks [12.6] Urban-Agentは、クロスシステムな都市タスクのためのツール拡張されたエージェントフレームワークである。
それは、コード実行、API呼び出し、モデルコンテキストプロトコルをサポートするツールセットと、大きな言語モデルの認知と推論の能力とを結合します。
実験の結果、Urban-Agentは71%のタスク成功率に達し、最強のベースラインを10ポイント上回った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:04:44 GMT)
When Agentic Executions Fail: Detecting and Localizing Runtime Faults from Telemetry [12.5] AgentCHAOSBENCHは、実行テレメトリからエージェントシステムのランタイム障害を検出し、ローカライズするためのベンチマークである。
エージェント・ツー・エージェントプロトコル上でエージェントをコーディネートする5つのアプリケーションを実行し、Model Context Protocolを通じてツールを呼び出す。
結果として得られたデータセットには2759.2%のトレースが含まれている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:47:37 GMT)
Compass: Continuously Aligning Social Media Feeds via In-Situ Reflections [12.4] ユーザのフィードとリフレクティブな好みを一致させるシステムであるCompassを提案する。
日常のブラウジング中に連続的なリフレクションを可能にするために、Compassは軽量な通知を通じてその場でのリフレクションをサーフェスする。
その結果、コンパスは、より反射的で目的のあるフィード消費、反復的嗜好調整、より強いフィードアライメントを促進した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:04:48 GMT)
Exact Resonances Are Not Sufficient for Phonon Energy Diffusion [12.4] 多重フォノン共鳴条件はフォノン輸送と格子熱化の運動理論を導く。
我々は, 完全共振マッチング, 非ゼロ相互作用係数, ネットワーク接続が持続的なエネルギー拡散を保証していないことを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:17:20 GMT)
LoCA: Forward-Only LLM Tuning after One-Shot Calibration with Local Credit Assignment [12.3] LoCA(Local Credit Assignment)は、小シフト適応のための2段階の方法である。
1つのプローブの後方通過は、最終予測誤差から局所的な隠れ状態補正まで、各変圧器ブロックのローランクマップに適合する。
したがって、LoCAはグローバルクレジットの割り当てを1つのキャリブレーションに減らし、後続のフォワードオンリーチューニングを可能にする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:06:43 GMT)
Agentic Reinforcement Learning with Self-Distilled Reward Shaping [12.1] エージェント強化学習は、LLMエージェントが相互作用を通じて学ぶことを可能にするが、低軌道レベルの報酬は、どの中間決定が信用に値するかを特定せずに、成功を明らかにする。
本稿では,言語エージェントに対する返却関連トークンレベルクレジットを構築するためのフレームワークである,自己拡張型リワードシェーピングを用いたエージェント強化学習を紹介する。
実験の結果、ADRSは長い水平タスクのパフォーマンスを継続的に改善し、RLバックボーン、データ設定の削減、目に見えないタスク、トレーニングの拡張などを実現している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:56:47 GMT)
Unifying quantum measurement constructions via a relative-entropy minimum change principle [12.0] 最小変化原理は、古典的確率論におけるベイズ反転チャネルの情報理論的特徴を与える。
本稿では,古典的-量子的準備チャネルに基づく前処理と,量子-古典的測定チャネルに基づく逆処理について考察する。
エントロピー規則化半定値最適化問題に対する最適解として,ソフトミン熱測定が生じることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:14:40 GMT)
Oilbird: Training-Free Speculative Decoding with Keys the Verifier Already Computes [12.0] トレーニング不要な投機的デコードドラフトは、コンテキストの正確な接尾辞と以前のコンテキストのプールとを一致させることによって行われる。
提案する第2のセマンティックなドラフトソースは,検証者が各コミットトークンですでに計算済みの隠された状態にリキーされた同じプールと,既存の語彙的ドラフト作成者のツリーの中を乗れるマージである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:47:51 GMT)
Flying over The Uncertain Nature (FORTUNE): Intelligent and Humanistic 3D Path Planning for Low-Altitude Collaboration [12.0] 本稿では,PoI要求条件の不確実な条件下での3次元多時期経路計画とタスク割り当てについて検討する。
私たちは、統一されたフレームワーク内で永続的で、時間的に予測可能で、創発的な要求をモデル化します。
結果として生じる大規模混合整数非線形問題を解決するために,階層的なオフラインオンラインフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:02:33 GMT)
MESS: Fast and Private Semantic Search on Multi-Graph HNSW [12.0] プライバシ,正確性,効率性の3つの特性を持つ検索システムであるMESSを紹介する。
元のベクトルをバイナリコードにマッピングし、ローカリティ・センシティブなハッシュ(LSH)とランダムな応答を適用し、多グラフ階層ナビゲート可能な小型世界(HNSW)インデックスを摂動コード上に構築する。
MESSは、最先端のベースラインよりも最大15.08タイムのレイテンシを実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:14:18 GMT)
Does Forgetting Transfer Across Modalities? A Real-World Benchmark for Cross-Modal Knowledge Unlearning Evaluation [12.0] 視覚言語モデル(VLM)におけるクロスモーダル知識学習のための実世界のベンチマークUNLink-VLを紹介する。
ポストホックなアンラーニング設定の下で、UNLink-VLは学習対象として視覚的に識別可能な現実世界のエンティティを選択し、Wikidataから対応するイメージとワンホップおよびマルチホップ事実を関連付ける。
テキストのみおよびマルチモーダルなアンラーニング設定下でモデルをトレーニングし、忘れることの有効性を評価し、テキスト、ビジュアル、およびクロスモーダルシナリオで有用性を維持する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:07:07 GMT)
LAEF: A Lead-Agnostic ECG Foundation Model Towards Point-of-Care Diagnostics [12.0] WeEF(Lead-Agnostic ECG Foundation)は、7M-ECG基盤モデルであり、ゼロpやゼロパッドの修正なしに任意のリードを捕捉できる。
我々は、リードサンプリングによるマスクノードモデリングにより、9.2Mの12リードECGをトレーニングし、LAEFはリード構成に頑健な表現を学習する。
ランダムにサンプリングされた1つのリードと2つのリードで18点中14点、平均的なAUROCゲイン+3.2ポイントで、すべてのゼロインパタンスデータセットを上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:58:10 GMT)
PLAN: Parallel Liquid-Inspired Approximation Network for Efficient Representation Learning in Flexible Job Shop Scheduling [11.9] PLANは、連続的な液体状態のダイナミクスを離散化および並列化可能な定式化に変換する軽量な表現学習フレームワークである。
PLANは、対応する最先端のベースラインと比較して、平均メースパンをそれぞれ1.2%、1.4%、および2.3%削減する。
PLANは、それぞれ平均推論遅延を13.2%、31.7%、26.9%削減し、最大69.2%削減した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:43:27 GMT)
SERL-SQL: Selective Hindsight Distillation for Text-to-SQL Reinforcement Agentic Learning [11.8] SERL-はマルチターンテキスト・ツー・エージェントのための選択的実行基盤強化学習フレームワークである。
トレーニングのみの教師を使用して、実行フィードバックで生徒のアクションを再スコアする。
実験の結果、SERL-は競争力があり、76.56%の精度でスパイダーテストを行うことができた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:32:19 GMT)
Ranking Image Fusion the Way Humans Do: A Learned Pairwise Preference Metric for Infrared-Visible Fusion Assessment [11.7] 本稿では,人間のA/B/Tie比較プロトコルをスケーラブルなサロゲートとして運用するソース条件付きモデルであるLearted Perceptual Image Fusion Measure(LPIFM)を提案する。
LPIFMは、赤外線源、可視光源、および2つの融合した候補を共同で観測し、A候補が良いか、B候補が良いか、または両者が知覚的に等価かを予測する。
LPIFMモデルの重み付け、ソースコード、評価コードとともにアノテーション付き選好データセットをリリースし、選好整合IVIF評価をサポートする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:43:26 GMT)
Radar4D-VLM: Proposal-Grounded Temporal 4D Radar Reasoning Across Frozen Language Models [11.6] 本稿では、自律走行のためのレーダのみの時間視覚言語モデルであるRadar4D-VLMを紹介する。
Radar4D-VLMは、幾何学的に接地されたオブジェクトの提案を抽出し、レーダー証拠をオブジェクト、シーン、キネマティックトークンのコンパクトな階層に整理する。
シーケンシャルに分離されたK-Radar開発検証では、トップ64の提案リコールは98.13%に達し、それぞれ6.40ポイントと22.83ポイントの固定格子と一様ランダム制御を超えた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:32:16 GMT)
FBID: Adaptive Personalized Federated Learning for Robust Out-of-Distribution Attack Detection in IoT Networks [11.6] Federated Bandit Intrusion Detection (FBID) はサーバ側のパーソナライゼーション制御によってこの制限に対処する新しい適応型PFLフレームワークである。
FBIDは、各クライアントのローカルトレーニング強度を、観察された振る舞いと更新品質に応じて動的に調節するために、サーバにコンテキスト多重武装のバンディットを使用する。
我々は、FBIDが最強の安定したベースラインに対して、個々のクライアントOOD検出率(DR)を最大7.66%、F1スコア(F1)を最大5.08%改善することを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:59:33 GMT)
DP-MemView: A Memory Interface for Attribute-Level Transcript Privacy in Long-Term LLM Agents [11.5] DP-MemViewは、パブリックレスポンスコンディショニングビューを選択し、それらのビューを応答 LLM に公開する、微分プライベートインターフェースである。
明示的なインターフェース契約の下では、適応的文字起こし全体に対して純粋なB_a-DPを証明します。
制御された隣接店舗ベンチマークと公開コーパス転送トラックにおいて,3つの応答 LLM を用いたオンラインおよび事前配置モードの評価を行った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:00:10 GMT)
TraceCAD: Trace-Guided Repair for Agentic CAD Generation [11.5] 我々は、要求された機能、モデリングステップ、障害証拠、および候補結果を永続状態としてリンクするリカバリ層であるTraceCADを紹介する。
トレーサCADは、おそらく欠陥のある操作を診断し、依存関係領域のバウンダリ編集を検索し、実行と保存チェックを通じて候補を検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:23:11 GMT)
Activation-Guided Neuron Intervention to Induce Alzheimer's-Related Computational Language Phenotypes in a Large Language Model [11.4] 自然発声の変化は、アルツハイマー病における認知機能障害の早期のシグナルとなる。
本稿では,Qwen3-8Bを用いたアクティベーション誘導型介入フレームワークを提案する。
AD関連ニューロンの増幅は、ストーリーリコール、言葉の流用、作業記憶、手続き的談話、シーン構築、コア参照解決において、段階的な障害を生み出した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:28:37 GMT)
PriDyG: Privacy-preserving Dynamic Graph Inference with LLM-GNN Collaboration [11.4] 本稿では,GNNに基づく構造学習と意味推論を組み合わせたプライベート推論フレームワークPriDyGを提案する。
PriDyGはインクリメンタルなプライベートなマルチホップアグリゲーションを導入し、新たに到着したエッジをバッファし、各エッジを正確に1回処理する。
実験によると、PriDyGは、同じプライバシー予算の下で、幾何学的に崩壊するベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:23:19 GMT)
RIDGE: Re-Noising with Internal Dynamic Guidance for Image Editing [11.4] インバージョンフリーなフローベース画像編集は遅延インバージョンを回避するが、編集ステップ毎にターゲット側状態が必要である。
Ridgeは、非利用可能なクリーンターゲット状態に対する進化的な近似として、編集された状態を維持する、インバージョンフリーでトレーニング不要な方法である。
2つのバックボーン(SD3 MediumとFLUX.1-dev)を使用した2つのベンチマークの実験では、RIDGEがソース保存、ターゲットアライメント、知覚品質のトレードオフを好適に提供していることが示されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:20:09 GMT)
Fail-Fast, Restart-Smart: Early Failure Prediction and Restart for SWE Agentic Tasks [11.3] FailFast-RestartSmartは、単一のアクティブな軌道に対する2段階のコントローラである。
ポリシーロジットや隠された状態なしで、観測可能なプレフィックスから失敗を予測する。
警報を受けたRestartSmartは、事前のプロンプト履歴なしで、新しい同一のポリシーのロールアウトを起動する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:55:46 GMT)
UniNav: A Unified World-Action Diffusion Model for Visual Navigation [11.3] 将来的な視覚的観察と連続的なウェイポイント軌跡を生成する統一世界行動モデルUniNavを提案する。
履歴フレームとゴールイメージが与えられた場合、UniNavは単一のトランスフォーマー内で視覚トークンとウェイポイントトークンを共同で識別する。
ナビゲーションベンチマークの実験では、UniNavはすべてのデータセットでATEで最強のベースラインを上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:15:45 GMT)
Detail Continuation over a Trustworthy Coarse Scale for Autoregressive Super-Resolution [11.3] 幻覚は、生成超解像における永続的な課題である。
信頼できる粗大な情報を保存することと、より不確実な詳細を復元することの区別はしばしば暗黙的に扱われる。
我々は、VARベースのSRをフルパス生成から$k$-to-N$詳細継続プロセスに変換するtextbfK2Nを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:39:04 GMT)
When AI Joins the Team! A Model of How AI Adoption Relates To Social Patterns in Software Engineering Teams [11.2] AIの採用がコミュニティの匂いの増加や減少に結びついているかどうかは不明だ。
コーディネーション(Coordination)と5つのPSS-SEMモデル(PLS-SEM)を用いて,AIツールを用いた152人のソフトウェア専門家を対象に,ヒューマンAIとヒューマンヒューマンのインタラクションを検証した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:57:42 GMT)
DigitCode: Symbolic Tokenization of Hand Motion by Anatomical Units [11.2] 手の動きは、骨ごとの1つの固定方向シンボルのT x 40グリッドとして記述される。
記号の解剖学的単位は、骨、指、または手全体にまたがるべきである。
DigitCodeは、HLのアルファベットを1つのコード内の手の単位階層に沿って適用し、グループ化し、階層化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:55:47 GMT)
Making AI Visible, Not Vanished: How AI Policies Reshape Developer Experience on GitHub [11.2] オープンソースソフトウェア(OSS)におけるAIガバナンスポリシーの大規模な実証的研究について紹介する。
AIポリシを採用した385のプロジェクトを特定し,5つのガバナンス次元をキャプチャするフレームワークであるTRACEを導出する。
我々の結果は、AIが支援する開発を禁止するのではなく、AIガバナンスが主に規制していることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:39:07 GMT)
GPTKB 2.0: Direct Construction of Disambiguated Knowledge Bases from Large Language Models [11.1] GPTKB 2.0は、大きな言語モデルから直接曖昧なKBを構築するための方法論である。
我々は、GPTKB 2.0を大規模に実行し、1M以上の曖昧なエンティティと38.4Mのトリプルを含む物質化KBを得る。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:25:47 GMT)
Attention is Case-Sensitive [11.0] テキストのスパンに注意を集中させることが,小文字のコンテキストに対する交互・小文字のターゲット情報のフォーマット化に有効であることを示す。
調査の結果,中心的な注意・パフォーマンスのばらつきが明らかになった。
我々は,事前学習がタイポグラフィ強調をいかに内在させるかという,新たな基礎的理解を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:16:06 GMT)
MDLMPE: Distribution Aware Positional Encoding for Masked Diffusion Language Models [10.9] マスク付き拡散言語モデルは、明らかにされたトークンとマスクされたトークンの動的で非連続的な構成を生成する。
マスク拡散に特化して設計された位置符号化MDLMPEを提案する。
LLaDAとDREAMの実験により、MDLMPEは一般的に従来の位置符号化法より優れていることが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:54:14 GMT)
UniGD: A Unified Generative-Discriminative Framework for Industrial Retrieval [10.8] 一つのモデルに検索と関連性スコアリングを統合するUnified Generative-Discriminative framework (UniGD)を提案する。
我々は、UniGDが広告収入を5.78%増加させ、推論遅延を33%減少させ、差別的関連性評価を改善することを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:29:02 GMT)
Scarcity and Predictive Uncertainty: Implications for Societal Resource Allocation [10.6] 本研究では,資源配分に対する不確実性が,資源配分から得られる社会的利益の2次尺度と組み合わさって重大な意味を持つことを示す。
資源が乏しい場合、最大限界利益(MMB)優先順位付けは、同じ基礎となる初期状態であっても、予測の不確実性の低い個人を優先する。
本研究は,地方司法論に触発された多くの領域において,優先順位付け政策の分布結果に有意な影響を及ぼすものである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:12:26 GMT)
Spatial proteomics guided by H&E-based AI reveals recurrence-risk niches in triple-negative breast cancer [10.5] 深層学習モデルは、H&E染色スライドからがん再発を予測することができるが、これらの予測の根底にある局所的な分子状態はほとんど不明である。
我々は,TNBCにおいて,AIが生成した再発リスクヒートマップとマススペクトロメトリに基づく空間プロファイリングを統合した空間病理学フレームワークを開発した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:19:35 GMT)
Risky Business: Measuring The Faithfulness-Safety Tension [10.4] 我々は、モデルを監視できるほど忠実でなければならないが、安全でない推論を拒否できるほど堅牢でなければならないアライメントの緊張を識別する。
本稿では,不安全思考や非論理的思考に代えて,推論チェーンに直接介入する新しい代替手法を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:38:06 GMT)
The Ground Is Shifting: A Reflection on the Foundations of Software Measurement [10.3] 過去60年の間、ソフトウェアの測定は労働集約的なデータに依存していた。
オープンソースツールへの移行により、プロプライエタリなデータ収集技術が劇的に拡大した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:41:07 GMT)
From Non-Convex Self-Concordant Regularization to Scalable Quasi-Newton Training of PINNs [10.2] SCOREは、PINNトレーニングのためのデクリメント結合シフトセカント幾何を持つ自己一致型準ニュートン法である。
その区別機構は、学習された逆計量から計算された1つの準ニュートンデクリメントが強いウルフテストされた候補ステップを共同で決定することである。
バーガース、倉本-シヴァシンスキー、コルテヴェーグ-ド・フリーズ、複雑なギンズブルグ-ランダウ方程式の実験は、SCOREが試験されたBFGSや自己スケールのブロイデン基底線よりも低い最終誤差を達成していることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:05:21 GMT)
Residual Flow Matching with Dynamic Cross-Interaction for 3D Multi-Person Motion Prediction [10.2] 3次元多対人動作予測は、個々の運動学と対人相互作用の両方をモデル化する必要がある。
フローマッチングは、予測精度を向上させるために多仮説生成に有効である。
本稿では,事前ガイド型残留流れマッチングフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:28:27 GMT)
MMLongBench-Doc-V2: A Corrected-Annotation, Semantics-Aware Revision of MMLongBench-Doc [10.2] MMLong-Docは135のPDFに対する1,082の質問のQAベンチマークである。
MMLongBench-Doc-V2は106のアノテーションを修正する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:51:54 GMT)
Large language models for partial differential equation workflows [10.1] 偏微分方程式 (Partial differential equation, PDE) は、科学や工学において孤立した公式ではなく、モデリング仮定、支配方程式、数値解法、診断、決定を結びつける実行可能な公式として機能する。
本稿では,3段階にわたるPLM支援PDE研究の最近の進歩について考察する。
この進歩にもかかわらず、高品質なデータセットやベンチマークが不足しているため、この分野は依然として限られている。
さらに課題となるのは、シミュレーションに基づく結果と、数値シミュレーション、制御ポリシー、最適化された設計を実用的な設定へ直接移行することを制限する現実世界の科学・工学システムとの永続的なギャップである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:51:32 GMT)
CAMP: A Cycle-Aware Multi-Scale Patch Mixer for Time Series Forecasting [10.1] CAMPはCycle-Aware Multi-Scale Patch Mixerである。
予め定義されたサイクル長を必要とせずに、歴史的および将来の循環成分を生成する。
6つのデータセットで最高の平均MSEを、6つのデータセットで最高のまたは最も結びついたMAEを達成します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:04:16 GMT)
Tight Worst-Case Bounds for the Smallest Eigenvalue of ReLU NTK Gram Matrices [10.0] 連続 ReLU 微分グラム行列 $H$ について検討し、その成分は標準ガウス方向のペアゲート内積を平均化することによって得られる。
普遍自由下界 $ _min(H) = ( _pm/sqrtlog n ) $ を証明する。
我々は、一致する上限である $ _min(H) = O( _pm/sqrtlog n ) $ を満たす最悪のケース族を構築し、この速度が普遍定数に密接であることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:19:53 GMT)
Uncovering Non-Gaussianity through Multi-Copy Symmetries [10.0] 非ガウス性を検出するための群理論的マルチコピー手法を開発した。
参照パラメータの純度を固定すると、違反したIDは非ガウス性を証明する。
本研究では,有界位相オブザーバから関連するマルチコピー検出を推定可能であることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:44:22 GMT)
Rethinking Modality Reliability in Multimodal Sentiment Analysis with Incomplete Observations [10.0] 不完全観測設定において、モダリティの信頼性は中心的な変数であり、モデル化に失敗すると2つの問題が発生する。
不完全な観察を伴うマルチモーダル感性分析のためのモダリティ信頼性校正フレームワークを提案する。
MRCFにはReliability-Aware Branchが含まれており、モジュール内の品質基準とモジュール間のセマンティック一貫性からサンプル固有のモダリティの信頼性を推定する。
CMU-MOSI、CMU-MOSEI、CH-SIMSの実験により、MRCFは標準的な不完全観測プロトコルで高い性能を発揮することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:02:48 GMT)
AgonAlpha: Autonomous Alpha Discovery via Prompt Economy and Scalable Agentic Search [9.9] 本稿では,凍結した研究成果物を検索するアーキテクチャであるAgonAlphaを紹介する。
我々の知る限り、AgonAlphaは、検証済みのアーティファクト検索と、再実行と拒否権を持つ新しいコンテキストの敵レビュアーと、待機型並列予算配分を組み合わせた最初のアルファマイニングシステムである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:00:35 GMT)
Pattern over Pixels: Measuring Pattern Completion Bias in Multimodal Code Generation [9.9] マルチモーダルな大言語モデル(MLLM)は、Webページのスクリーンショットをフロントエンドコードに変換するのにますます使われている。
目的のスクリーンショット・コード・イン・ザ・ブランクタスクにおいて、繰り返しWebページパターンがMLLMの精度を損なうかをテストする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:59:12 GMT)
ChainVLA: Chaining Vision-Language-Action Queries through a Unified Execution State for Long-Horizon Manipulation [9.8] ChainVLAは、連続したクエリを共同実行状態にチェーンするポリシーである。
Progress Contextは、リカレントなWorking Stateとスパースなイベントメモリを組み合わせることで、観察から派生したタスクの進捗を実行する。
Motion Tailは、前回の予測が実行されない継続を状態構築と行動生成に供給する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:52:13 GMT)
Soft Guidance Starts to Outperform CoT Prompting as LLMs Improve [9.8] CoT(Chain-of-Thought)は、モデルの推論能力を評価するための標準ベースラインである。
数学問題解決タスクにおける現代中規模言語モデルの評価を行い、推論に特化しているモデルがゼロショットの単純な設定でより優れた性能を実現することを発見した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:22:31 GMT)
MergeSE: Post-Hoc Model Merging for Software Engineering Tasks Without Retraining [9.8] 我々は、HFaceエンコーダチェックポイントのトレーニング不要モデルマージのためのオープンソースのCLIおよびWebツールである textbfMergeSE を提示する。
MergeSEは、9つのタスクタイプの組み込みレジストリを通じて、SE分類をより広くサポートする。
TIES、DARE-TIES、Wudi、PCB、平均の5つのマージアルゴリズムをサポートしている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:39:02 GMT)
A Unified Model for Cross-Domain Clone Detection via Model Merging [9.8] 現在のディープラーニング検出器は、トレーニング分布の外で大幅に劣化している。
トレーニングされたチェックポイントのみで動作するポストホック手法のファミリーであるモデルマージについて検討する。
同じベースであるTIESマージは、2つのモデルファミリーと3つのランダムシードで検証された効果的なクロスドメイン検出器を生成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:32:28 GMT)
KnowHal: A Knowledge-Driven Benchmark for Comprehensive Multimodal Hallucination Evaluation [9.7] 知識関連障害はしばしば別々に調査され、異なる幻覚の次元に統一的な評価枠組みが欠如している。
本研究では,知識幻覚を4次元にわたるマルチモーダル幻覚評価に明示的に組み込んだベンチマークであるKnowHalを提案する。
KnowHalは、共有された画像やエンティティに対して肯定的と否定的な2つの質問を構築し、知覚的エラー、知識関連エラー、虚偽の前提受け入れの制御された比較を可能にする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:03:29 GMT)
Recurrent Residual Quantization: A Progressive Multi-Precision Representation for LLMs [9.7] 本稿では,学習後の量子化フレームワークであるRecurrent Residual Quantization (RRQ)を紹介する。
RRQは、重みを低ビットの量子化された基底として表し、量子化された残差補正の列を表わす。
Qwen3-8Bでは,全RTN 2-/4-/6-/8-bitパッケージを1,293秒で構築した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:32:05 GMT)
MultiCompose: Multi-Concept Personalized Composition with Per-Subject Attribute Binding [9.6] MultiComposeは、マルチオブジェクト推論から概念ごとのパーソナライズを分離するコンポジションフレームワークである。
MSP-BenchはID(ID)、属性バインディング精度(BIND)、属性ミスアライメント(MIS)を共同で評価するベンチマークである。
実験により、MultiComposeは従来のメトリクスとMSP-Benchの両方で既存の手法より優れていることが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:13:18 GMT)
A Graph Signal Processing Perspective on Numerical Sequence Representations in LLM In-Context Learning [9.5] 大規模言語モデル(LLM)における数値情報の体系化について述べる。
我々は、注目がトークン上の重み付きグラフを誘導するグラフ信号処理の観点を採用し、トークン隠蔽状態はそのノード上の信号を定義する。
より単純な入力は、より強いグローバル接続とより滑らかなスペクトル集中型隠れ状態信号を持つ注意誘発トークングラフを生成する一方、より複雑な入力はより局所化されたグラフとより広いスペクトル支持とより大きな高周波エネルギーを持つ隠れ状態信号を生成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:54:04 GMT)
SIGNPOST-Bench: Benchmarking Text-Vision Conflict Resolution in Multimodal Large Language Models [9.5] マルチモーダル大規模言語モデル(MLLM)は、視覚とテキストの組み合わせによって現実の場面で基礎となる予測を行う。
SIGNPOST-Benchは,テキストビジョンのコンフリクト分解能を評価するための,制御されたデファクト・デファクト・ベンチマークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:55:47 GMT)
Typical Output States of Monitored Random Clifford Circuits: A Graph-Theoretic Approach [9.4] 本稿では,監視されたランダムクリフォード回路の典型的な出力状態への直接アクセスを可能にするグラフ状態ベースのフレームワークを開発する。
まず、大きな$N$の極限において、ランダム安定化状態のグラフ表現がアーズ-レーニランダムグラフアンサンブル$G(N,1/2)$に収束することを示す。
体積法相における1次元(1D)回路の監視のために、出力状態グラフに$G(N_mathrmsub,1/2)$という形の創発的な高密度部分グラフを明らかにする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:19:07 GMT)
Long-term Traffic Scene Prediction via Polynomial Representations in Autonomous Driving [9.4] この論文は、自動運転の交通シーン予測における根本的な課題に対処する。
研究は、表現が計算効率、一般化、予測可能性に大きな利点をもたらすことを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:39:16 GMT)
FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Professional Deliverables [9.3] 既存のメソッドは通常、タスクプロンプトやモデル出力から基準を導き出す。
本稿では、プロの金融業務のベンチマークであるFinProBenchと、再利用可能なルーリックであるRole-Grounded Construction(RGRC)を紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:00 GMT)
FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents [9.3] FinPerMAは、凍結した縦方向の投資家軌跡に対してパーソナライズされたメモリを評価する、イベントグラウンドのベンチマークである。
完全コンテキスト構成は、全体的な精度が約0.47以上、複数選択の質問では約39%を超えない。
属性分析により、要約ベースのメモリは、パーソナライズに必要な選好信号を失いながら、事実の詳細を保存していることが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:04 GMT)
SAFECAST: Robust Failure Detection for VLA Policies with Contrast-Set Training and Calibration [9.2] コントラストセットの摂動を利用して、隠れ状態プローブのトレーニングと展開時間シフトの校正を改善するSAFECASTを導入する。
SAFECASTは、データ増大に視覚的・言語的コントラストセットの摂動を用いる場合が最も有用であり、コントラストセットの摂動では、sim-to-realキャリブレーションが実際のロールアウトデータのみを使用するよりも優れたプローブをもたらす。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:57:03 GMT)
Coverage Matters: MarginMerge for Compressing Multi-Vector Visual Document Retrievers [9.2] 冷凍多ベクトルレシーバの圧縮法であるMarginMergeを紹介する。
カバレッジ対応アンカー、クラスタドキュメントパッチを選択し、軽量な共有ネットワークを使用してクラスタ毎に1つの代表を合成する。
ColQwen2.5とColPaliの2つのデータセットで、MarginMergeは5%と10%のベクトル保持で一致したクエリ非依存の平均を達成している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:05:40 GMT)
LaPrune: Controllable Differentiable Sparsity at Million Scale [9.1] ラプルー(LaPrune)は、選択した質量を保存しながら正規化された第2モーメントを制御する数学的に正確な微分可能な層である。
LapSumバリアは選択質量を保ち、正規化された第二モーメント制約は、マスクを高密度の等質量割り当てから各予算でハードトップ-k$へと移動させる。
本研究では,飽和分数,二分数制限法則,および最短分数の厳密な保証法を導出する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:17:00 GMT)
IDraw: Artist Verification from Digital Drawing Images [8.9] IDrawはタブレットペンのセンサー信号と組み合わせた描画から学習するフレームワークだ。
デジタル描画オーサシップ検証のための,最初のマルチモーダルデータセットを構築した。
IDrawは、標準画像ベースの検証よりも一貫して優れています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:14:20 GMT)
Interpretable Adaptive Sampling for LLM Test-Time Scaling [8.8] 本稿では,解釈可能な信号,推定急激な複雑度やモデルの信頼性を,クエリごとのサンプリング予算にマッピングする軽量ファジィコントローラを提案する。
コントローラは、より簡単またはより確実なプロンプトに、より少ないサンプルを割り当て、より困難または少ない特定のプロンプトに、より多くのサンプルを割り当てる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:27:21 GMT)
Solver-Aware Decompositions for Programming-by-Example: When Dividing Requires Knowing how to Conquer [8.8] 分解に基づくプログラミング・バイ・サンプル(PBE)は、学習したシンセサイザーが解決したサブタスクにタスクを分割することでパフォーマンスを拡大する。
現在のアプローチでは、分解品質をタスク固有のものとして暗黙的に扱いながら、グラウンドトゥルース(GT)サブゴールを模倣するようにデコンパイラを訓練している。
本稿では,GTサブゴールの教師付きトレーニングを構造足場として維持する訓練フレームワークであるSolver-Aware Decomposition (SAD)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:57:31 GMT)
SkillSentry: Adaptive Honey Worlds for Dynamic Safety Testing of Agent Skills [8.8] SkillSentryは、適応的なハニーワールドに基づいた動的安全テストフレームワークである。
我々は適応的な蜂蜜世界に基づく動的安全テストフレームワークであるSkillSentryを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:22:22 GMT)
Predictive Enhancement Calibration for Latent Breast MRI Virtual Contrast Enhancement [8.6] VCE(Virtual contrast enhancement)は、コントラスト前取得から乳房MR画像を合成する。
上界は生成前に放射能の忠実度を変化させることができ、一方、ソースとターゲットのスケーリングは独立して座標の不整合を生成する。
トレーニング中に各ペアが共有されたケース適応座標を表現し、事前コントラスト画像からその上端を予測できる予測拡張(PEC)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:03:09 GMT)
Double Descent in Gradient Boosting Decision Trees via Split-Candidate Scaling [8.6] 決定木(GBDT)を増強するための操作能力パラメータとして分割候補数を提案する。
実験的な木-カーネル診断を構築し、候補誘導経路がどのようにトレーニング例をグループ化するかを要約する。
実験では、XGBoost、LightGBM、CatBoostの中間分割候補予算におけるテストエラーピークが示されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:32:08 GMT)
Beyond Representational Similarity: Source-Conditioned Description-Length Gain for Generative Plagiarism Detection and Candidate Source Reranking [8.5] 大規模言語モデル(LLM)は、学術的整合性とピアレビューに課題を提起する。
生成的盗作検出は 未発見で ほとんど未解決の課題です
確率的予測の記述長に触発されて,出典記述長ゲイン(SCDG)を導入する。
SCDGは、凍結した言語モデルの不審なドキュメントの記述長が$P$であり、候補となるソースが$S$であるのとは対照的な、方向性のないトレーニングなしのフレームワークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:03:45 GMT)
Clinically-Grounded Hierarchical Classification for Consistent Chest X-ray Interpretation [8.4] CHASEは、9つの解剖学的領域、17の亜領域、28の病理所見の臨床的に駆動された3段階の分類を通して、放射線技師の粗大な推論を反映している。
実験により、CHASEはすべてのレベルにわたってフラットで階層的なベースラインよりも優れています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:59:12 GMT)
WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and Security in Human-Centered Agent Networks [8.4] WeClawArenaは、監査可能なベンチマークと、個人ワークスペース上でのマルチパーティ所有エージェントコラボレーションのためのランタイムサンドボックスである。
WeClawArenaは、パーソナルワークスペースが運用ツールと個人的制約の両方として機能する、共同ツール使用タスクをターゲットにしている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:42:26 GMT)
Attention-based representations for multi-task computation [8.3] 2つの単純かつ具体的なマルチタスクシナリオで要求されるヘッド数に境界を定めている。
第1のシナリオでは、線形予測器が与えられたリストの最小と最大の両方を計算できるようにベクトル表現を求める。
第2のシナリオでは、しきい値関数が与えられた$n$ビットの文字列のXORを計算することができるようにベクトル表現を求める。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:52:04 GMT)
Lightweight Chunk Selection for Mobile Retrieval-Augmented Generation [8.2] 証拠アライメント問題として軽量RAGチャンク選択について検討する。
我々のセレクタは、3つの補完的特徴源を組み合わせる: LLM側のクエリ意図を表す質問隠蔽状態、ジェネレータの内部ルーティング構造をキャプチャするMoEルーティングに基づくエキスパート信号、および候補側のエビデンスを保存したチャンク埋め込み。
実験の結果、提案したセレクタは、モバイル適用可能なベースラインに対するランク1のエビデンス選択を平均2.5%改善することがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:26:25 GMT)
State Propagation Also Satisfies: A Complex-Valued State-Space Model for Deterministic State Tracking [8.2] トランスフォーマーベースのアーキテクチャは、主に注意機構の表現力によって、シーケンスモデリングを支配している。
本稿では,textbfstateの伝播だけで十分であることを示す。
中間ステップで出力プロジェクションなしで層全体に隠された状態を伝播する最小限のリカレントアーキテクチャであるtextbf State Propagator (CSP) を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:16:24 GMT)
StreamDAM: Presence-Aware Memory for Real-Time Streaming Video Object Segmentation [8.0] Methodは最強のストリーミングトラッカーであり、オフラインモデルの精度のほぼ全てをクロック下で回復し、最も厳しいコンテンツは、構築したオフラインモデルを超える。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:40:02 GMT)
Behavioral Skill Reconstruction: Reconstructing Hidden Functionality from LLM Agent Skills [8.0] 本研究では,攻撃者が有効なタスク要求と観察された応答を用いて隠れたスキルの関数的クローンを構築する行動スキル再構築(BSR)について検討する。
SkillCloneは、その公開広告からインターフェース仮説を形成し、構造化された良性プローブを発行し、実行可能レプリカを作成し、被害者のスキルに対する差分検証によって繰り返し修復することで、ターゲットスキルをクローンするブラックボックスアタックである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:51:15 GMT)
Emulate or Estimate? The Divergent Strengths of Base and Post-Trained Language Models for Opinion Simulation [7.9] 人間の調査データと有望な一致を示す研究もある一方で、ペルソナの崩壊と人口統計感度の低下を示す研究もある。
最初のタスクエミュレーションと呼ばれ、モデルが集団分布に集約する個々の応答を生成する。
2つ目のタスク推定と呼ばれ、モデルが直接人口分布を予測する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:51:38 GMT)
Convex-Hull-Neighborhood Smooth Dual Generalization: Controlling Local Correction Propagation in Offline RL [7.8] ブートストラップは オフライン強化学習における 推定誤差を増幅する
本稿では,ベルマンのバックアップをサンプル値のターゲットとして表現し,CHN局所補正を行うConvex Hull Neborhood Smooth Dual Generalizationを提案する。
Gym-MuJoCoとAntMazeの実験は、強力な集約性能と安定した値推定を示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:30:02 GMT)
A Wearable Stiffness-Rendering Haptic Device with a Honeycomb Jamming Mechanism for Bilateral Teleoperation [7.8] HJ-Haptic触覚装置は、ハニカムジャミング機構を用いて物体剛性レンダリングを行う。
この装置は、30kPaの真空圧力を用いて、その硬さを1.15 N/mmから2.64 N/mmに変化させることができる。
真空圧力を用いることで、ガス漏れや材料故障の際の危険な結果を防止することにより、オペレーターの安全を確保できる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:35:52 GMT)
Kitchen Robotic Manipulation utilizing Foundation Models [7.7] このパイプラインは、オープンボキャブラリオブジェクト検出、マルチビューセグメンテーション、インスタンス認識3D再構成、および6次元ポーズ推定と把握計画のための2D-3D特徴融合戦略を統合する。
最高のパフォーマンス構成は、20ステージのキッチンベンチマークで89.12%のADIを達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:07:45 GMT)
TRACE: Ergodic Trajectory Optimization for Active Scene Reconstruction [7.6] エルゴード被覆問題としての能動再建について検討した。
我々のアプローチは、このターゲット分布を不確実性と可視性からオンラインに導き出す。
我々は、Replicaデータセット上のTRACEをNext-Best-View(NBV)ベースラインに対して評価し、PSNRを1.5dB改善した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:08:29 GMT)
HyperFL: Query-Adaptive Representation Learning for Software Fault Localization [7.6] ソフトウェア障害のローカライゼーションは、報告された問題の原因となるコードの位置を特定する。
近年の検索手法による断層位置定式化は高密度検索課題である。
ソフトウェア故障局所化のための問合せ適応型表現学習フレームワークHyperFLを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:00:46 GMT)
Shielding for Higher-Order Safety [7.5] 安全シールドは、安全を保証するためにコントローラの動作を制限する実行時執行機構である。
本稿では,高次スムーズ性制約に対する有限状態安全ゲームの構築について述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:41:21 GMT)
Can Text-to-Image Models Draw from the Right Frame of Reference? [7.5] FOR-T2Iは、カメラビューと異なる場合に、モデルが特定の参照フレームに従うことができるかどうかを評価するベンチマークである。
22のクローズドソースおよびオープンソースT2Iモデルで、最終的な精度はFoRプロンプトよりも41.8%低い。
本稿では,視覚フィードバックを用いて書き直しプロンプトを選択し,FORの精度を25.0%から29.2%に向上させるVLM-gateリライト手法を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:05:35 GMT)
Impossibility of Perfectly Complete Many-Round Key Agreement in the QROM [7.4] 完全に完全な量子鍵合意プロトコル(QKA)をブラックボックス方式で量子的にセキュアなワンウェイ関数(OWF)から構築することは不可能である。
本稿では,古典的なメッセージから,$O(((q_mathsfA+q_mathsfB)5)$古典的なオラクルクエリを使って共有鍵を確実に復元できるeavesdropperが存在することを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:33:42 GMT)
Stop Replacing Noise with Noise: Two-Source Reliability Assessment for Label Correction and Sample Reweighting in Label-Noise Learning [7.4] 再生に基づく雑音ラベル学習は、観測されたラベルとモデル由来の擬似ターゲットを混合する。
この相補性によって、信頼できない信号が別の信号に置き換わることが示され、これは、破損した監督から学習された擬似的標的が、その補正を意図したノイズを再現する可能性があるからである。
本稿では,ラベル補正とサンプル再重み付けのための2ソース信頼性評価フレームワークTRACEを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:22:02 GMT)
Probing Character-level Transformers for the Spanish L-shaped Morphome [7.4] 私たちのテストケースはスペイン語のemphL型形態素であり、動詞の幹が正確に1人称単数形と全助詞形で交互に変化する複雑な不規則なパターンである。
以前の研究では、キャラクターレベルのトランスフォーマーがこのパターンを再現できることが示されているが、その証拠はモデルが生成するものであって、表現するものではない。
モデルがL字型クラス自体をエンコードしていることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:48:17 GMT)
SparSEEty: Extracting Tokens from Sparsity-Exploiting LLM Serving Systems via Deterministic Side Channels [7.3] 本稿では,入力依存型ニューロンの重み付けを利用した新しいトークン抽出攻撃であるSparSEEtyを提案する。
我々は、Intel TDXシークレット仮想マシン(CVM)内で保護されたLLMサービスシステムに対してSparSEEtyをインスタンス化する。
評価の結果,SparSEEtyはBLEUスコアを一定に高め,プロンプトトークンと応答トークンの両方を再構成できることがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:21:29 GMT)
Quantization Effects on Biomedical LLM Reliability [7.3] PubMed文分類に基づく3つのMistral-7B変種(Base, BioMistral, Instruct)の制御評価を行った。
我々の主要な発見は、確率抽出プロトコルが明らかに校正を支配していることである。
プロンプトテンプレートの選択は、モデルレベルの効果に匹敵する7~24ポイントの精度差を生み出す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:57:21 GMT)
On the Implicit Flatness Bias of Sharpness-Aware Minimization: A Linear Stability Analysis with Quantitative Hyperparameter Bounds [7.3] シャープネス・アウェアの最小化(SAM)は、局所的対向摂動に対してロバストなパラメータを求めることにより一般化を改善する。
特に摂動半径$$は通常、独立したチューニングパラメータとして扱われる。
線形安定性により補間最小値付近のミニバッチSAMを解析する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:37:44 GMT)
Robust General Utility for Reinforcement Learning [7.3] 一般用途による強化学習(RL)は、政策による占有率の任意の機能的ロバスト性を最適化することにより、古典的なRLを拡張している。
実際には、デプロイで使用されるユーティリティはトレーニングツールから逸脱し、以前の作業で対処できないギャップを生じさせる。
そこで本研究では, 実用上の不確実性を考慮した政策を訓練するミニマックス学習フレームワークである, 堅牢な汎用ユーティリティ RL を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:28:39 GMT)
SPADE: An Input-Adaptive Sparse Attention Engine for Fast Video Diffusion Models Inference [7.3] ビデオ拡散変換器(vDiTs)は高品質だが、二次的な自己注意コストを支払う。
3つのパートからなるトレーニング不要なスパースアテンションエンジンであるSPADEについて述べる。
Hunyuan-Video と Wan 2.1/2.2 はテキスト・ツー・ビデオおよび画像・ビデオ生成用で、SPADE は品質を保ちながら空間性と速度を向上する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:47:57 GMT)
Shaping Wind-Tunnel Airflow for Unmanned Aerial Vehicles using Online Learning [7.3] 本稿では,多ファン垂直風洞における複雑な気流場を制御するためのオンライン学習アルゴリズムを提案する。
本研究では, 受動舞踏ロボットの飛行性能を大幅に向上させるため, 受動舞踏を特化して気流プロファイルを作成することができることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:24:07 GMT)
LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs [7.3] 本研究では,オープンソースソフトウェアシステムにおけるLLMサービスフレームワークとサービス手法の利用について検討する。
VLLM、SGLang、LMRT、FlashInferの5つのフレームワークを特定し分析する。
我々の結果は、vLLMが人気と採用において最も目に見えるフレームワークであることを示しています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:33:16 GMT)
Assessing Behavioral Validation in UI Component Test Suites Using Inferred Metamorphic Relations [7.2] 本稿では, 仮説的メタモルフィック関係(MR)を経験的行動参照として用いたMRベースのフレームワークを提案する。
コンポーネントのソース、ドキュメンテーション、テストが与えられたフレームワークは、UI固有の分類を使ってコンポーネント固有のMRを推論する。
推定MR空間とテスト-MRアライメントの両方を手動で検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:48:46 GMT)
SeqLLM: Augmenting LLMs with Behavioral-Sequence Modeling for High-Stakes Decisions at WeChat Pay [7.2] SeqLLMは、事前訓練された言語モデルに振る舞いシーケンスモデリングを追加するフレームワークである。
WeChat Payで展開され、毎日数百万の商店をスクリーニングしている。
パブリックレコメンデーションベンチマークで最先端の結果が得られます。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:23:12 GMT)
Projection-Retraction MPPI: Exact Constraint-Manifold Control for Manipulators [7.1] プロジェクションリトラクションMPPIは、ダイナミックス内の制約を強制する。
14-DoFデュアルアームシステム上でPR-MPPIを検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:40:10 GMT)
BRACE: Taming Sharp Irregularities via Barycentric Rational Forecasting for Fast Diffusion Transformers Inference [7.0] 拡散変換器(DiT)は高忠実度画像とビデオ生成において例外的な性能を示した。
計算オーバーヘッドを大幅に軽減するため、冗長な計算をバイパスするために時間的特徴キャッシングが提案されている。
本稿では,このボトルネックに対処するため,Barycentric Forecasting with Chebyshev Enhancement (BRACE)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:24:53 GMT)
Double Down on Defense: Strengthening Deep Perceptual Hashes against Evasion Attacks without Retraining [6.6] ほぼ重複した画像マッチングは、信頼と安全、証明の証明、著作権の執行、大規模ビジュアル検索に不可欠である。
提案するDualShieldは,既存の深い知覚ハッシュの堅牢性を向上させるプラグインディフェンスであり,モデルの再トレーニングや修正は行わない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:18:56 GMT)
Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining [6.6] ホワイトボックスネットワークの自己教師型学習に関する既存の研究は、通常、自己教師型学習パラダイムから最適化アルゴリズムを通じてホワイトボックスネットワークの導出を分離する。
本稿では,LJEPAをベースとした自己教師型フレームワークで,タスクの最適埋め込みとして,等方的ガウス分布を仮定する。
本モデルでは,パラメータ数を約31%削減しながら,競合性能を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:26:12 GMT)
Task-Oriented Candidate-Latent Feedback for Coarse-to-Fine Sensing in Distributed OFDM-ISAC Networks [6.6] 将来の統合センシング通信(ISAC)アーキテクチャは、推論を行うセンシング機能(SF)から測定を取得するセンシングエンティティ(SE)を分離する。
単一ターゲット推定のための候補遅延フィードバックを用いた学習に基づく粗大なセンサパイプラインを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:26:06 GMT)
TorchDCM: A Unified PyTorch-Native Package for Discrete Choice Modeling [6.4] 我々は、個別選択モデリングのためのオープンPythonパッケージであるTorchDCMを提示する。
選択データとモデル仕様を統合されたPyTorchネイティブオフィシャルエンジンにコンパイルする。
トーチDCMは45の合成ケースを全て完了し、同等の合成ケースで最速で動作し、あらかじめ特定された最終対数耐性を満たす。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:00:57 GMT)
Temporal Leakage in LLM Backtesting: Measurement, Validation, and Adjusted Scores [6.4] LLMバックテストにおける汚染の標準チェックは非形式的であることを示す。
4つのフラッグシップモデルは、記憶できない質問で失敗します。
受動的バックテストが2つを本当のスキルから切り離すことができないことを証明しています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:45:54 GMT)
Studying quantization trade-offs for efficient inference deployment in machine translation [6.3] 本研究では,EuroLLM citepmartins2025eurollm と Hy-MT2 citepzheng2026hy という2つの翻訳モデルの量子化トレードオフについて検討した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:14:13 GMT)
Adaptive Two-Stage Visual Token Pruning for Efficient Inference in Video-Language Models [6.2] 視覚言語モデルは画像やビデオの理解が優れているが、高い推論遅延に悩まされている。
本稿では,ビデオ処理に特化して設計された2段階適応型トークンプルーニング戦略を提案する。
我々の手法は完全にポストホックであり、訓練や微調整は必要ありません。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:32:48 GMT)
Minimax-Optimal Semiparametric Contextual Dynamic Pricing with Multimodal Revenue [6.2] コンテキスト動的価格をBounded, おそらくノンバイナリ購入量で検討する。
我々は、一様の最適価格を許すため、円滑さも強力なモダリティも収益に課さない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:14:26 GMT)
ReputationChain: Robust Trust Updating for Blockchain-Enabled Supply Chains [6.2] 既存の評価システムは、主に製品証拠、グローバルなフィードバックアグリゲーション、またはレビューの信頼性に対処する。
信頼の源としてではなく、ブロックチェーンをエビデンス層と証明層として使用する参加者信頼フレームワークであるRCを紹介します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:24:56 GMT)
RAG-Stack: Co-Optimizing RAG Serving Performance and Quality [6.1] RAG-Stackは、様々なRAGアプリケーションとサービスシステムにわたる品質パフォーマンスのフロンティアを効率的に発見するためのフレームワークである。
RAG-Stackは、次のRAG構成を選択する反復的な設計空間探索アルゴリズムであるRAG-PEと、多様なRAGアルゴリズムのためのワークロード抽象化であるRAG-IRと、所定のハードウェア上で最適なデプロイメントとパフォーマンスを提供するパフォーマンスモデルであるRAG-CMで構成されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:23:19 GMT)
XiDepth: a Lightweight and Efficient Network for Self-supervised Monocular Depth Estimation [6.1] 自己教師付き単分子深度推定は、計算に制約のあるデバイスに展開するための軽量で効果的なモデルを設計するための魅力的なソリューションとして登場した。
重要な課題は、全体的なパフォーマンスを損なうことなく、リソース効率のよいニューラルネットワークを実現することだ。
本稿では,XiNet演算子ブロックに基づく軽量アーキテクチャであるXiDepthを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:42:41 GMT)
Grasp Execution Without a Planner: Configuration-Space Grasp Distance Fields with Certified Safety & Guaranteed Quality [6.0] 実行時オブジェクトは不確実性や摂動を引き起こし、計画された軌道を無効にすることができる。
本稿では,グラスプ距離場(GDF)について述べる。
制御器は, 負のGAF勾配を定常フィードバック法則で追従することで把握を行う。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:50:18 GMT)
Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss? [6.0] 大型言語モデル(LLM)は異種C/C++コンテキストから有効セマンティクスを復元することができる。
SeGaBenchは、100の合成ケースと20のソースバックケースを含む実行可能なベンチマークである。
最強のモデルは94.8%のレスポンスで正しいアーティファクトを生成し、83.3%で少なくとも1.05倍のスピードアップを達成し、93.3%のケースでパフォーマンスに成功している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:47:25 GMT)
EffiHolmes: Differential Profiling-Guided Repository Level Time Inefficiency Fix Localization [6.0] EffiHolmesは、リポジトリレベルの時間的非効率な修正ローカライゼーションのためのLLMベースのフレームワークである。
また、リポジトリレベルの非効率なローカライゼーションのための最初のベンチマークであるRepoEffi-Benchを紹介します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:26:59 GMT)
PRISM: Powerful Time Series to Image (TS2I) Representations for Multivariate Anomaly Detection [5.9] 時系列異常検出(TSAD)は、予測保守、ファイナンス、クラウドコンピューティングのアプリケーションを支える。
画像ベース表現の体系的構築と評価を可能にするプラグイン・アンド・プレイ型メタワークフローであるPRISMを紹介する。
我々は、チャネル化を批判的かつ以前に検討された設計次元として認識し、新しい統計ベースのスキームであるMSMを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:59:28 GMT)
TimeRLM: Recursive Language Models Enable Precise Anomaly Localization in Long-Context Time-Series [5.9] 我々は、コードと視覚機能を用いて信号を操作する時系列のRLM定式化であるTimeRLMを提案する。
AnomalyXL-MCQとAnomalyXL-Localizeの5つの異なるタスクカテゴリと2つのバリエーションを実装している。
TimeRLMは5つのAnomalyXL-Localizeタスクのうち4つで評価されたTSLMとシングルパスベースラインを上回ります。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:40:45 GMT)
Provably Learning Multi-Head Attention with Queries [5.9] ブラックボックス入力出力アクセスからマルチヘッドソフトマックスアテンションを学習する問題について検討する。
最近の作業では、シングルヘッドパラメータの$(W,v)$を復元するために$O(d2)$値クエリを使用するアルゴリズムが提供されている。
シングルヘッドリカバリアルゴリズムを別々にヘッドに適用するには、これらのサブスペースを知るためのベースが必要である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:06:15 GMT)
IRIS: Visual-Semantic Binding for Forgery-Resistant Watermarking of Diffusion Images [5.8] ほとんどの次世代拡散透かしは、それらを運ぶ画像とは独立してパターンを埋め込んでおり、攻撃者は生成元が生成しなかった画像にマークを移植する。
Intrinsic Ring Identifier from Semantics を組み込んだトレーニングフリーな透かし方式 IRIS を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:16:06 GMT)
On-chip generation of multi-qubit graph states with high-dimensional encoded single photons [5.7] フォトニックマルチキュービットの絡み合いは、光量子情報処理、特に普遍量子コンピューティングの鍵となる。
本稿では,目的とするマルチキュービット量子状態を実現するための,明示的で資源効率の高い高次元符号化手法を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:49:56 GMT)
SkillJack: Persistent Skill Backdoors in Self-Evolving Agents [5.7] textbfSkillJackは、自己進化エージェントの体験からスキルへのパイプラインを利用する最初の攻撃である。
ランタイムコンテキストを直接操作する代わりに、SkillJackはエージェント自身の学習プロセスをハイジャックして、悪意のある振る舞いを再利用可能なスキルレパートリーに埋め込む。
以上の結果から,新たな攻撃面としてのスキル進化と,スキルライフサイクル保護のモチベーションが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:51:23 GMT)
Decoupling Generation and Selection for Budget-Constrained Faithful Summarization [5.7] 文予算制約付き要約のためのモジュラー・ジェネレーション・アンド・セレクション・フレームワークを提案する。
事前訓練されたジェネレータは複数の候補要約を生成し、文レベルの候補に分解される。
次に、セレクタは、明確な予算の下で、関連性、事実性、冗長性をバランスさせて最終的な要約を構築する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:36:25 GMT)
Mapping the City Through the Lens of Language Models [5.7] 10個のオープンウェイトチェックポイントは、実際の都市中心部から派生した匿名化プロファイルである。
この枠組みは、モデルが普通の都市を実証的に追跡できるとみなすものについて、さほど曖昧な概念を定めている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:09:08 GMT)
Traceable Multi-Agent System for Knowledge-Based Forecasting [5.7] TraceMASは、トレース可能なマルチエージェント予測のためのインタラクティブなデモシステムである。
本稿では,自律型予測エージェントが,エビデンス・ツー・プレイス・プロセスの検査を可能にしながら,柔軟性を維持する方法を示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:49:23 GMT)
Designing Social Robots for Inclusive Child Wellbeing Assessment: Insights from Communities Supporting Developmental Language Disorder and Forced Migration [5.7] 社会ロボットは、自己申告アンケートに頼ることなく、幸福度評価を支援するための有望なツールとして登場した。
我々は,ロボットの役割と能力,相互作用のダイナミクス,個人差,児童エージェンシーに関する考察を明らかにする。
ロボットによる幸福度評価のための倫理的かつ包括的な設計勧告を導出する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:28:41 GMT)
SynEnergy: Anomaly Semantic-Guided Diffusion for Synthetic Energy Data Generation [5.7] 本稿では, 異常保存エネルギー消費データ生成のための2段階拡散に基づくフレームワークを提案する。
第1段階、異種グラフに基づく異常意味学習(HG-ASL)は、スパース残基構造から領域固有の異常意味を抽出する。
第2段階であるAnomaly Semantic-Guided Diffusion (AS-Diff)は、学習した異常なセマンティクスを認知過程に注入し、現実的な消費シーケンスを生成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:00:10 GMT)
Interoceptive Attention as Dynamic Homeostatic Prioritization in a Foraging Agent [5.7] 我々は、その知覚精度をどこに割り当てるかを決定する採餌剤について検討する。
4チャンネルのグリッドワールドであるAffectWorldでは、この選択的なアロケーションは学習フェーズの生存率を2倍以上にしている。
プランナーの形状の可能性が否定されるだけで、その約半分が取り除かれる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:18:45 GMT)
FOUND-AF: Benchmarking ECG Foundation Models for Atrial Fibrillation Detection [5.7] 心房細動(AF)は心臓不整脈が最も多く持続し、脳卒中、心不全、死亡のリスクが増大する。
最近のECG基盤モデルは自動AF検出のための転送可能な表現を提供する。
本研究は、事前学習したECG表現の品質を評価する、統一的でリーク制御され、デプロイ指向のベンチマークフレームワークであるFOUND-AFを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:48:05 GMT)
ANCHOR-RE: An Agentic Neuro-Symbolic Framework for Grounded Biomedical Relation Extraction [5.6] ANCHOR-REは、オントロジー誘導推論、外部知識基盤、データ駆動検証ルールを統合するフレームワークである。
プロプライエタリおよびオープンウェイトLLMを用いて,3つのBioREベンチマーク(SemRepGS,DDI,ChemProt)で評価した。
ニューロシンボリック推論は、微調整なしでLLMベースのBioREの信頼性を向上させることができる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:36:19 GMT)
UHP Detection: LVLMs have their Unique Hallucination Pattern in the Consistency Space [5.6] 大規模視覚言語モデル(LVLM)は、強いマルチモーダル推論能力を示すが、幻覚の傾向が残る。
既存のブラックボックス幻覚検出手法は、単一整合度で不確実性を推定する。
我々は,幻覚を構造的不確実性パターンとしてモデル化する完全ブラックボックスフレームワークであるemphUnique Hallucination Pattern (UHP) Detectionを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:25:30 GMT)
Automated ECG Interval Measurement and Wave Delineation Using Fast Fourier Convolution ResNet [5.6] 心電図間隔(PR,QRS持続時間,QT/QTc)の正確な測定は心電図診断である。
本研究は, 偏差, 95%の一致限界 (Bland-Altman) , ブートストラップ信頼区間, リズム成層誤差解析を含む, 完全な統計特性を有する最初の大規模区間測定精度試験である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:05:37 GMT)
Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details [5.6] ゼロショットコーディネート(ZSC)アルゴリズムは、高レベルな学習ルールを指定してこれを実現することを目的としている。
ZSCアルゴリズムの厳密な評価は依然として難しい。
この堅牢性に関する最初の体系的な評価を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:29:00 GMT)
Adversarially Robust Abductive Fusion of Pre-trained Transformer-based Perception Models [5.6] 従来のメタ認知的手法は、モデルのエラーを示す論理ルールを学習するが、手書きのドメイン知識に頼っている。
このメタ認知層はベクトル空間幾何学を利用してドメインの知識を使わずに学習可能であることを示す。
アプローチはニューロシンボリックであるため、これらのルールは単一の論理的枠組みを共有しており、利用可能なドメイン知識によって補完することができる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:46:57 GMT)
POMDPs for Autonomous Science Exploration [5.6] 生センサデータではなく、推論された物理的特性に枝分かれすることで、科学駆動の信念空間計画がより魅力的になる科学仮説マップPOMDP(Science hypothesis Map POMDP:SHM-POMDP)を紹介した。
50次元の観測で拡張されたRockSampleドメインでは、SHM-POMDPは連続観測ベースラインよりも18.6%高い報酬と32.9%の時間の短縮を達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:38:09 GMT)
CIGTSurv: Clinical Information Guided Tri-modal Survival Prediction with Local Prototype Association and Global Feature Alignment [5.5] マルチモーダル学習は、病理画像とゲノムデータを統合することにより、生存予測を著しく進歩させた。
臨床情報は、その離散的、疎外、低次元の性質のために未利用のままである。
生存予測のためのCIGTSurvを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:19:53 GMT)
Consensus Measures for Unstructured Biomedical Text Annotations [5.5] バイオメディカルアノテーションタスクのための非構造化テキストを提供するアノテータのソフト・インターレータ信頼性について検討した。
様々な意味的等価度尺度を用いて,ソフトな信頼性を定量化できることが示唆された。
我々は,自然言語推論に基づく尺度を合理的な妥協として提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:12:56 GMT)
Enactive Artificial Intelligence: A Decision-Centric Architecture for Complex Systems [5.4] 本研究では,企業と産業の推論,サイトレベルの意思決定支援,実行フィードバックのための概念的フレームワークとして,Enactive AIを紹介した。
複雑なシステムにおける意思決定インテリジェンスを前向きにすることで、Enactive AIはAIのフロンティアをモデル能力からシステム認識アクションへと拡張する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:06:15 GMT)
Detecting Pose Estimation Failures via Keypoint Self-Consistency [5.4] キーポイントに基づくポーズ推定手法は、キーポイントが互いに独立して予測されるときに不正確である。
本稿では,キーポイント予測の自己整合性を捉える手作り幾何学的特徴セットを提案する。
その単純さにもかかわらず、これらの特徴に基づいてトレーニングされたロジスティック回帰は、ポーズ推定失敗を確実に検出する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:59:10 GMT)
Random features for Grassmannian kernel approximation with bounded rank-one projections [5.3] 低次元部分空間上のスケーラブルカーネルマシンに対するランダムな特徴写像群を提案する。
ランダムな特徴空間の内部積は、よく定義された回転不変なグラスマン核に近似する。
合成データとETH-80分類タスクの実験は、これらの特徴が計算、記憶、記憶を減らしながらグラスマン幾何学を正確に保存していることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:02:15 GMT)
Heralded Free-Electron Writing of the Most Subradiant State in an Atomic Array [5.3] 自由空間における有限波長の原子鎖のサブラジアント固有状態は、光子貯蔵、量子センシング、多体量子光学のための強力な資源を提供する。
ここでは、自由電子が光円錐の外側の波ベクトルと非一様エンベロープとを同時に一致させる必要性を克服できることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:13:50 GMT)
Attribute-based Undetectable Watermarking for Generative AI Models [5.3] 我々は、生成AIモデルのための最初のインパトリビュートベースの透かしを紹介する。
整合性、有界な汚職に対する適応的堅牢性、検出不能性、健全性などのセキュリティ特性を定式化する。
我々は,制約付き擬似乱数関数,擬似乱数誤り訂正符号,生成AIモデルによる回復手順を統合した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:05:58 GMT)
DiagLoop: A Counterfactual Data Flywheel with Stage-Localized Reinforcement for Diagnostic LLMs [5.2] DiagLoopは、認知された物理的関係や臨床ガイドラインをトレーニングの監督に変換する、反ファクト的なデータフライホイールである。
訓練のみの教師は様々な原因、文脈、観察によって反現実の世界を提案し、一方独立したハイブリッドチェッカーは有効な世界しか認めない。
非終端障害に対しては、境界付き修復プローブが下流のコンピテンスを探索し、その結果の弱点プロファイルがその後のデータ生成を導く。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:49:41 GMT)
CausalOPD: First-Wrong-Step Supervision for Distilling Causal Chain Reasoning [5.2] CausalOPDはオンラインプロセス蒸留フレームワークである。
知識を付加した教師は、まずドメイン固有の因果規則に基づく軌跡を提供する。
因果段階のカリキュラムはエビデンスレベルからメカニズムレベル、結論レベルのエラーへと進化する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:49:12 GMT)
Guiding Compiler Optimizations for Neutral Atom Quantum Computers Through Visualizations [5.2] NAVizはNAデバイス上でリアルタイムに量子計算を視覚化する初めての公開アプリである。
NAVizは、既存のコンパイル戦略における非効率性を識別し、解決するために役立った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:01 GMT)
Leveraging System-Level Observations to Inform Bayesian Learning of Model Parameters for Quantitative Verification [5.2] 不正確なまたは不正なPKは定量的解析に悪影響を及ぼし、誤った検証結果をもたらす。
EPIKは、未知の遷移パラメータの分布を導出するために2倍の問題を定式化し、これらの分布を埋め込んで、新しいまたは難しい(測定しにくい)性質を検証する。
実世界のケーススタディと多種多様なEPIKインスタンスを用いた詳細な実験評価は,その有効性,柔軟性,汎用性を示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:25:44 GMT)
CVPO: Enhancing LLM Reinforcement Learning Reasoning via Value-Variance Adaptation and Dynamic Curriculum Learning [5.2] 大規模言語モデル(LLM)の推論能力を高める効果的な方法として強化学習(RL)が登場した。
既存の手法では、生成した回答軌跡に対するフィードバックの精度が不十分であり、問題の難解なドリフト現象を示す。
CVPO - Curriculum-guided Value-Variance Policy Optimizationを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:30:59 GMT)
Frequency-Decorrelated Temporal Ensembles for EEG--fNIRS Imagined-Handwriting Decoding [5.1] Multimodal Brain-Computer Interface Grand Challenge(英語版)は、4種類の主観非依存手書き-軌道分類のための同期脳波とfNIRSを提供する。
我々は,3つの相補的な脳波の周波数ビューに基づいて,コンパクトなマルチスケール時間ネットワークを訓練するタスク適応型システムFREDを提案する。
モダリティ監査では、fNIRSのみの復号が偶然(全体の0.2511)、fNIRSをEEGに追加すると精度が0.0025に変化している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:08:11 GMT)
From Social Coding to Agentic Coding: Productivity and Relational Reconfiguration in Open-Source Communities [5.0] オープンソースソフトウェアコミュニティは、可視的なコラボレーションを通じて、公開知識と対人関係を生成する。
LLMをベースとしたマルチエージェントシミュレーションと,1,084人のアクティブ開発者によるGitHubデータを用いて,このシフトを研究する。
ジェネレーティブ・コーディング・エージェント(CA)は、公共の人間との相互作用からプライベート・ヒューマン・エージェント・ループへ活動の一部を移行しながら、開発効率を向上させるための先進的なツールである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:41:32 GMT)
A Unified Resolution-Conditioned Framework for Orthogonal Line-Scanning Image Fusion [5.0] ランク強化線形注意(RELA)に基づく分解能条件融合フレームワークを提案する。
また,アダプティブRELAを導入し,固定カーネルのランク向上を,比条件付きマルチスケール深度畳み込みに置き換える。
結果のモデルでは、構成間で34-40dBのPSNRが達成される一方、無条件のマルチスリットトレーニングは24.3dBに崩壊し、スリットスペシャリストはトレーニング設定外で4-9dBを失う。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:28:39 GMT)
ConFL: Explainable Concurrent Fault Localization via Hierarchy-Guided LLM Reasoning [5.0] ConFLは、説明可能な同時障害ローカライゼーションフレームワークである。
インタラクションレベルのDSLは、共有リソース上のスレッド間のインタラクションを明示的にエンコードします。
8つの大規模Javaプロジェクトによる実世界の同時バグの実験は、ConFLが最先端のIRベースとLLMベースのベースラインを大幅に上回っていることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:21:52 GMT)
Test-Time Scaling for Safe Text-Guided Image Generation via Intermediate Clean Estimates [5.0] 本稿では, 生成過程で推定される中間クリーン画像を活用し, スパースマージン目標を用いて, 禁止概念を検出することを提案する。
違反が検出されると, テキストコンディショニング空間における構造的低ランク残差を, 切り離されたバックプロパゲーションによって最適化することで, 即座に介入する。
安定拡散v1.4およびv3.5のヌード除去,IP保護,スタイル消去による実験は,抑制,忠実度,保存性に優れた性能を示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:00:15 GMT)
ANNOTARES: A Dataset for Extracting Logical Structures from German Statutory Texts [4.9] 本稿では,ドイツ法典に法的条件 (Tatbestand) と法的結果 (Rechtsfolge) を識別・分節する作業を紹介する。
この課題を支援するために,ドイツ法文とスパンレベルアノテーションを組み合わせた新しいデータセットAnnoTARESを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:28:53 GMT)
SAKI: Score-Aware Low-Rank Key Indexing for Long-Context KV Retrieval [4.9] キー再構成の品質よりも注意点を保存できる学習自由なKVキャッシュインデックスを開発した。
ランク32では、PCAの残るトップ64リコールエラーの13~30%を除去する。
1モデルあたりの注目度は68~99%向上し、より深い層で最大の増加率となる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:59:29 GMT)
FreqAdapt: Frequency-Adaptive Processing for RAW Object Detection [4.9] FreqAdaptは、周波数領域における適応RAWデータ拡張のための軽量モジュールである。
私たちのモジュールは、既存のオブジェクト検出フレームワークにシームレスに組み込むことができます。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:33:58 GMT)
A Review of Vision-Based Vehicle Detection for UAV-Based Traffic Monitoring: Experimental Insights and Future Directions [4.8] 無人航空機(UAV)をベースとした監視は、広い範囲とリアルタイムのデータ収集機能を備えた交通監視の革新的なソリューションを提供する。
固定地上インフラと比較して、UAVはダイナミックな交通に応答できるが、様々な高度での車両検出のような課題を提示することができる。
深層学習は検出精度の向上に大きく貢献してきたが、実際の展開においては、現在の輸送システムとの正確性、レイテンシ、調和性に対する批判的な評価を慎重に検討する必要がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:15:38 GMT)
Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces [4.8] 大規模な言語モデルは、答えの前に長さを推論し、コストとレイテンシを増大させる。
GPQAダイヤモンド198問とMMLU-Pro500問を比較検討した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:54:37 GMT)
The Fairness Collapse Phenomenon: Bias Amplification in Language Models Trained on Synthetic Data [4.8] 人工的に生成されたデータに基づいて訓練された生成モデルは、モデル崩壊を示すことが示されている。
合成コンテンツがトレーニングコーパスを汚染する傾向が増すにつれて、オープンデータの使用に関する重要な懸念が高まる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:56:39 GMT)
FedCritic-MIMO: Communication-Efficient Serverless Federated Critic Learning for Massive-MIMO Resource Control in Open and Disaggregated 6G RANs [4.7] FedCritic-MIMOは、オープンかつ非アグリゲートな6G RANにおいて、独立してデプロイ可能なセルレベルコントローラをまたいだAIネイティブリソース制御のための、サーバレスのフェデレーション付きマルチエージェント強化学習フレームワークである。
コントローラはトレーナを共有しず、ローカルアクターとパーソナライズされた批評家コンポーネントを保持し、互換性のある批評家パラメータのみを交換する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:56:32 GMT)
LiNC: Lightweight Noise Correction via Per-Sample Trust and Gaussian Mixture Modeling [4.7] 軽量ノイズ補正(LiNC)は、観測されたラベルを使用するタイミングと、標準トレーニングループ中にモデルに遅延するタイミングを学習する。
この目的の勾配は、初期訓練段階において、クリーンなサンプルとノイズの多いサンプルに対して、反対方向の信頼値を駆動することを示します。
MedMNISTv2による最大50%のラベルノイズ下での10つの2Dデータセットの実験では、精度と強い誤ラベル検出が一貫した向上を示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:55:53 GMT)
Multimodal Alignment Through Joint Kernel Entropic Gromov--Wasserstein Optimal Transport [4.6] 構造保存型アライメントフレームワーク,ジョイントカーネルエントロピーGromov--Wasserstein Optimal Transport(JK-EGW)を提案する。
JK-EGW は2次最適輸送目標を最小化することにより、複数のモダリティを共通の潜在空間にマッピングする。
提案手法は,既存のアライメントベースラインと比較して,マルチモーダル検索性能の向上を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:21:09 GMT)
AgentForge: An Immersive Role-Playing Platform for Learning Agentic Software Engineering [4.6] textitAgentForgeは、初心者が4つのソフトウェアエンジニアリングの役割のうちの1つを担う没入型学習システムである。
各練習セッションでは、初心者が選択した役割を演じ、AIエージェントが残りの3つを実行する。
37人の初心者開発者を対象にした調査では、AIエージェントのサポートで高いタスク補完率を達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:58:18 GMT)
Beyond the QBER Threshold: A Temporal QBER Based Machine Learning Framework for Multi Attack Detection in BB84 QKD [4.6] 本稿では,BB84QKDシステムにおける盗聴攻撃を検知・分類するための時間的QBERベースの機械学習フレームワークを提案する。
このフレームワークは、バースト挙動、時間不安定性、基底依存非対称性、QBER損失相互作用をキャプチャする63の物理インフォームド時間特徴を抽出する。
XGBoostは10回以上の独立ランで、88.01%(0.47%)の精度で、マクロF1スコアは0.8803である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:04:16 GMT)
Cross-Lingual Bias in Large Language Models: A Comparative Analysis of English and Swahili [4.5] Swahili は GPT-5.2 と Gemini 2.5 Flash に 4,900 対称な英語のペアを送出することにより,言語間の社会的偏見が一般化するかどうかを検討する。
以上の結果から, 移行よりもバイアスが変化することが示唆された。
これらのことは、英語のみの偏見監査が多言語展開に十分なカバレッジをもたらしないという考えを強化している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:13:43 GMT)
Visualizing Graph-to-Answer Mechanism Recovery in Materials-Science Hypothesis Generation [4.5] グラフ-PRefLexOR-8Bは,脳ストーミング,グラフ構築,パターン抽出,合成の異なる段階に適応するQwen3-8Bモデルである。
我々は,セマンティック・バックトラック,グラフの破損,アクティベーションに基づくリカバリ計測,レイヤ・バイ・トケン・エリア・グリッドを視覚的診断ワークフローに整理し,この経路を検査する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:29:04 GMT)
Computing Actual Causes for Neural Network Predictions under Structured Causal Inputs [4.5] 我々はHalpern-Pearl (HP) の実際の原因として説明を定式化する。
我々は,有界伝播法と分岐結合法を適用してHPの原因を計算した。
ケーススタディでは、入力依存を無視することは、報告された原因の数を膨らませることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:57:06 GMT)
Towards Reliable and Reproducible Fetal Brain Biometry: A Deep Learning Approach Using MRI [4.4] 3次元超解像再構成胎児脳MRIによる信頼性・再現性脳バイオメトリーの完全自動化フレームワークを提案する。
提案した4段階パイプラインは、線形測定とそれに対応する解剖学的ランドマークを共同で推定することで生体計測パラメータを導出する。
3D畳み込みニューラルネットワークは、脳のセグメンテーションラベルマップからランドマーク座標を復元するために訓練され、次いで計測固有の幾何学的最適化によってランドマークの位置と計算測定を洗練させる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:20:40 GMT)
Entanglement Distillation of some Rank-Five Symmetric NPT States in Two-Qutrit Systems [4.4] ランク5の2量子対称状態のクラスの蒸留性について検討した。
2-蒸留性について、Schmidt-rank-twoベクトルが関連する部分空間に負の期待を持たないことを示す構造的障害を明らかにする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:15:52 GMT)
Algebraic Speedups for Exact Inversion of Hamiltonian Evolutions [4.4] 異なる固有値間の加算関係が最適クエリ数を正確に決定することを示す。
また、家族固有の構造がクエリ数を削減できる十分な位相アライメント条件を与える。
これらの結果は、Tavis-Cummingsのアウト・オブ・タイム・オー・オーダー・コレレータプロトコルで生じる未知のダイナミクスを逆転させる構造依存境界を確立する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:54:22 GMT)
Where Reasoning Diverges: Localized Multi-Agent Debate for Multi-Hop Question Answering [4.3] ローカル・マルチエージェント・ディベート(LMAD)について紹介する。
LMADはノードとしてエージェントの合理性を表現し、最も初期の対立を見つけ、議論を対応するローカルセグメントに限定する。
4つのモデルファミリーの10個のバックボーンを用いて、4つのマルチホップ質問応答ベンチマーク上でLMADを評価する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:19:10 GMT)
Should the Boundary Term Be Learned in Reflected Diffusion? Conormal Trace and Reflection Masking [4.3] 境界領域上での反射拡散のスコア学習について検討する。
ハードリフレクションは、学習された痕跡が間違っていてもサンプルを維持できる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:05:02 GMT)
Socially Grounded Agentic AI: Coordinating Plural Perspectives through Social Theory [4.3] 我々は、視点がどのようにして役割によって構造化され、相互作用を通して形成され、力と専門分野に分散されるかを示す。
エージェントシステムでは、最終的な出力だけでなく、それらの出力が生成されるロールアクティベーション、熟考トレース、集約ルール、フィードバックループも調整する必要がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:37:09 GMT)
Optimal Liability Design for Medical AI [4.2] 本稿では,社会プランナーが医療の責任を設計し,医師を個人的品質情報で統制するプリンシパル・エージェント・モデルを開発する。
非対称情報の下での最適メカニズムは驚くほど単純であることを示す。
情報非対称性はAIの存在下では二重刃の剣であり、透明性の向上はすべての利害関係者に平等に利益をもたらすものではない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:33:10 GMT)
Which Modality Decides? Counterfactual Modality Attribution for Multimodal LLMs [4.2] マルチモーダル大規模言語モデル (MLLM) は画像とテキストの相補的な情報を組み合わせることで高い意思決定を支援する。
既存の説明可能性法では、どのモダリティが予測を駆動するかという根本的な疑問に答えることができない。
MLLMにおけるモダリティレベルのコントリビューションを定量化するための最初のフレームワークとして,CMA(Counterfactual Modality Attribution)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:25:13 GMT)
MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning [4.2] MultiGlobeQAは、14の空間関数族と15の応答形式にまたがる46,060の質問応答対のベンチマークである。
201の国と地域を、収入層と密度層によるサンプリングでカバーし、英語と16の高低リソース言語で並列的な質問を行っている。
LLMはグリッドインデックスと形状計算を必要とするタスクで崩壊し、トポロジカルな関係と方向が最良である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:18:52 GMT)
From Forest to Future Capital: Tracking Land Cover Change in Ibu Kota Nusantara (IKN) from 2021 to 2026 with PlanetScope Imagery [4.2] インドネシアのイブ・コタ・ヌサンタラへの移転は、土地の転換、植生の喪失、炭素在庫の減少に対する懸念を高める。
本研究では、PlanetScope SuperDove衛星画像を用いて、2021年から2026年までのKIPPの土地利用と植生被覆の変化を評価するためにリモートセンシング技術を適用した。
その結果、NDVIの平均は17.1%減少し、総炭素量は0.28%減少し、土地は672%拡大し、総植生は18.1%減少した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:10:05 GMT)
Towards End-to-End Multilingual Metaphor Processing: Integrating Detection, Translation, and Evaluation [4.1] このPhD提案は多言語メタファー処理のためのエンドツーエンドフレームワークを開発することを目的としている。
言語理論と、新しいデータセット、アノテーション方法論、評価ベンチマーク、メタファ対応機械翻訳のための自動評価アプローチを開発するための大規模言語モデルの進歩を組み合わせる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:35:36 GMT)
VIVID: A Culturally Grounded Benchmark Exposing the Figurative Language Gap in Vietnamese NLP [4.0] VIVIDは,ベトナムにおける文化的基盤の具体的言語理解を評価するための最初の体系的ベンチマークである。
VinaVIDは1,636個のイディオムと5つの意味的特徴を付加した証明を含む。
本分析は,リテラル過剰解釈,語彙的ギャップ,実用的平坦化などの系統的障害を明らかにする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:13:26 GMT)
Cross-Model KV Cache Transfer in LLM Families: A Closed-Form Linear Mapping for Prefill Reuse [4.0] 本稿では,ソースのKVキャッシュを再利用し,プリフィルをスキップするクロスモデルKVキャッシュ転送を提案する。
モデルKVは、ソースとターゲットが共有するKVヘッド数とヘッド次元が一致するような、マッチングされたKV対にまたがる線形構造を持つことがわかった。
このリニアマッパーは4対でレシーバーのスタンドアローンプリフィル精度の73-98%を保持し、2つが急降下する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:26:47 GMT)
Spatiotemporal Graph Transformer for Traffic Intelligence in Edge Computing [3.9] トラフィックエッジ予測のための空間的相互作用と時間的依存関係をモデル化するグラフトランスフォーマーフレームワークを提案する。
このフレームワークは、グラフニューラルネットワークを使用してサービス領域間の空間的相関をキャプチャし、Transformerベースの自己アテンションを利用して、歴史的交通観測から長距離時間パターンを学習する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:37:09 GMT)
Solving the Shortest Vector Problem in $2^{0.6039n}$ Time via Mid-point Hessian [3.9] 最短ベクトル問題(SVP)に対するランダム化アルゴリズムを提案する。
n$次元格子$mathcal L$に対して、我々のアルゴリズムは、古典的に20.6039n+o(n)$、量子的に20.5411n+o(n)$、空間的に20.5n+o(n)$でSVPを解く。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:43:30 GMT)
When Is a Conformal Guarantee Fair? Auditing Silent Subgroup Under-Coverage in Alzheimer's Disease Longitudinal Prediction [3.9] 本稿では,サブグループアンダーカバーの監査と修復のための一般的なメカニズム駆動フレームワークを提案する。
その結果, 人口レベルのバンドは, 有意な限界範囲のカバレッジを達成できたにもかかわらず, 68の組み合わせのうち57のハイリスク・サブグループを覆い隠していることがわかった。
我々は,各機構を対応する共形補正と組み合わせる:延性に対するクロスコンフォーマルプーリング,尾部重度に対するサブグループごとのキャリブレーション,カバーセーフな縁床。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:20:44 GMT)
Accelerating Human-Aware Robot Trajectory Generation via Diffusion and Consistency Distillation [3.8] 本研究では,人間-ロボットインタラクションにおけるロボットマニピュレータの制約付き動作計画フレームワークを提案する。
衝突回避や自己衝突回避といった追加の要件は、単純なヌル空間二次タスクとして扱うことは困難である。
この制限に対処するため、Rapidly-Exploring Random Tree (RRT) と RRT* アルゴリズムを用いて衝突と自己衝突を考慮した軌道を生成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:47:25 GMT)
DHMark: Public-Key Watermarking for LLM-Generated Text via Diffie-Hellman-Guided Rejection Sampling [3.8] DHMarkは、大規模言語モデル(LLM)生成テキストのための公開鍵透かしフレームワークである。
生成中、ディフィー・ヘルマン誘導トークンラベルインターフェースは、各候補トークンに公開方程式投票を割り当てる。
第三者の検証者は、公開情報を使ってトークンの投票を抽出し、それらを方程式レベルの証拠に集約し、署名された登録記録のみをスコアする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:08:40 GMT)
Benchmarking LLMs on File System Design and Implementation [3.7] 本稿では、fs固有のタスクのためのLLMベンチマークフレームワークである-Benchを紹介する。
基本的な理解,基本的な実装,パフォーマンスモデリング,デバッグ,最適化,新機能開発という,6種類のタスクを開発しています。
オープンソース(DeepSeek-V4-Flash, GLM-5.1, MiniMax-M2.7)とプロプライエタリ(Claude-Opus-4.7, GPT-5.2, Gemini-3.1-Pro)の両方で505タスクを実行する。
本研究は, 異なるタスクに対するモデル効率, 失敗の原因を明らかにする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:00:56 GMT)
EFX Allocation In (Multi)Hypergraphs [3.7] EFX(envy-free-to-any-good)のアロケーションについて検討する。
EFXアロカ-イオンが常に存在するかどうかを見つけることは、加法的評価を持つエージェントに対しても、フェアディビジョンにおいて大きな問題である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:02:06 GMT)
CARE-X: Towards Clinically Useful Radiology VLMs with Auxiliary Supervision, Reward-Aligned Learning, and Tool-Augmented Measurement [3.6] 本稿では,胸部X線ビジョンランゲージモデル(VLM)であるCARE-Xを紹介する。
CARE-Xは、言語モデリングの目的と協調して訓練された、焦点空間の分類と複合空間の接地ヘッドにより、その生成バックボーンを増強する。
その結果は、4つのレポートジェネレーションベンチマークの大多数における最先端のパフォーマンス、ReXVQAにおける94.0%のVQA精度、および専用の検出ヘッドとほぼ同値な生成空間デコーディングが得られた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:23:39 GMT)
How Many Labels Are Enough? ALDA: Active Learning Deployment Advisor for Medical Image Classification [3.6] アクティブラーニング(AL)は、臨床ラベルの数を減らし、医療画像プロジェクトのコストを削減することを約束する。
臨床成績制約下でのALメソッド選択のためのデプロイ指向フレームワークであるActive-Learning Deployment Advisor (ALDA)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:53:02 GMT)
Towards Improving Sequential Decision-Making in LLM Agents via Experience Memory [3.5] 大規模言語モデルは単発推論タスクで大幅に改善されているが、シーケンシャルな意思決定における性能はよく理解されていない。
本研究では,完全観測可能な2プレイヤーゼロサムゲームについて検討する。
ゲーム後リフレクションとルール抽出は, モデル重みを変更することなく, tic-tac-toeに対して測定可能な改善をもたらすことを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:12:12 GMT)
LEAP: Lean Environment-Feedback via Adaptive Pruning for Code RL in GPU Kernel Generation [3.5] 強化学習(RL)による学習後の大規模言語モデル(LLM)は、コード生成能力が大幅に向上している。
現在の最先端フレームワークは、ルールベースの検証サンドボックスに結びついたグループ相対ポリシー最適化(GRPO)のような、批判のないパラダイムを活用している。
低レベルのハードウェアアクセラレータアライメントに最適化されたスケーラブルで計算効率の良いマルチターンフレームワークであるAdaptive PruningによるLEAPLean Environment-Feedbackを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:24:08 GMT)
HalluTruthQA-4K: A Fine-Grained Corpus and Annotation Process for Arabic Hallucination Detection and Truth Verification [3.4] 本稿では,ハルートラスQA-4Kについて述べる。
それぞれのインスタンスは、アラビアの質問とモデル生成の応答、検証された参照応答、そして5つのもっともらしいイントラクタをペアリングする。
コーパスには1,643の幻覚反応と2,357の非幻覚反応があり、1,843の誤記がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:33:38 GMT)
Internalizing Academic Writing Workflows for Introduction Generation via Struct-Aware Policy Learning [3.4] StructPOは構造対応のポリシー学習フレームワークで、多段階書き込みワークフロー全体を単一パスポリシーに内部化する。
実験により、StructPOはワークフローベースのベースラインよりもセマンティックアライメント、構造的合理性、推論効率を改善することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:06:51 GMT)
Separable States Violate the Complementary-Quantum Correlation Conjecture [3.4] 相補的な局所基底で測定された相関は、二部量子状態における全相関の実験的に到達可能なプローブを与える。
任意の局所次元 $dgeq3$ における相補的量子相関予想を、明示的なランク2の分離状態で証明する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:36:20 GMT)
AI Forensics Across White-, Grey-, and Black-Box Access: A Process Model and Research Agenda for Post-Incident Investigation of AI Systems [3.3] 我々は、調査員のアクセスは、AI法医学の分野を組織する上で有用な出発点であると主張している。
収集,保存,分析,報告の4段階にわたるAI鑑定のためのプロセスモデル行列を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:04:57 GMT)
Unscented KalmanNet: a hybrid deep learning filter with calibrated posterior covariance for nonlinear state estimation [3.3] 非線形力学系の状態推定は、Unscented Kalman filter (UKF) を用いて行うのが一般的である。
本稿では、構造的に異なる2つの学習要素でUKFを増強するハイブリッド再帰推定器であるUnscented KalmanNet(UKN)を紹介する。
UKNは4つの例の中で最も低い集合状態推定誤差を達成し、合成ケースのUKFと比較してRMSEを26.4$-49.7%値下げする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:58:01 GMT)
HERMES: A Hybrid Ensemble for Head-and-Neck Tumor Segmentation, TN Staging, and Recurrence-Free Survival on PET/CT [3.3] HERMESは3つのHECKTOR 2026サブタスクのための単一のコンテナ化アルゴリズムである。
STU-Net Smallネットワークの10倍のアンサンブルがセグメンテーションを生成する。
HERMESは0.6454(Mean Dice 0.641, T balanced accuracy 0.580, N balanced accuracy 0.642, RFS C-index 0.679)の重み付きスコアを獲得し、テストフェーズの資格を得た。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:02:12 GMT)
Pivot-Centric Trajectory Prediction: Bridging Long Horizons via Dynamical Guidance [3.3] 長軸予測問題に取り組むために, Pivot-Centric Trajectory Prediction (PCTP)を提案する。
PCTPは、長期軌道予測プロセスを、ピボット予測とピボットベース軌道修正の2つのプロセスに分解する。
既存の手法と比較して、PCTPは複雑なエラーを低減しつつ、より中間的なガイダンスを提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:05:15 GMT)
Iterative linear quadratic regulator on SU(N) for multi-qubit gate synthesis [3.3] 我々は、反復線型二次レギュレータ(iLQR)のリー群定式化を特殊ユニタリ群 SU(N) に適用する。
理想化された、制約のない環境では、リー群定式化はユークリッド iLQR 式よりも早く収束する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:36:57 GMT)
AgentGUI: An Interface for Observing and Steering Long-Running AI Agents [3.2] AgentGUIはユーザーフレンドリーで、ローカルにホストされた、AIエージェントをシームレスに観察し、操るGUIである。
制御されたユーザスタディは、エージェントトレースからキー要素を特定するのに要する時間の統計的に顕著な減少を示す。
予備的な実験では、AgentGUIの自動ドリフト防止機能は、0.8B--9Bモデルラグを越えて34ppの小さなローカルエージェントのタスク完了率を高める。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:59:52 GMT)
Neurosymbolic Reasoning with Incremental Knowledge for Sample Efficient Hierarchical Reinforcement Learning [3.2] 本稿では,インクリメンタル・ナレッジ(インクリメンタル・ナレッジ)を用いたニューロシンボリックHRLを提案し,現在のインクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメンタル・インクリメント)の表現にエム・シンボリック・プランニング(エム
ナビゲーションタスクの実験では、InKを組み込むことでサンプル効率が大幅に向上することを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:17:39 GMT)
Beyond Initialization Loss: A Systematic Study of Token Embedding Initialization Strategies for LLM Vocabulary Extension [3.2] 我々は,Nemotron-3-Nano-30B-A3Bにおけるヒンディー語語彙拡張のための20以上の戦略の体系的研究を行った。
FOCUS,トップk検索,残留意味マッピング,サブワード構成,ノルムキャリブレーション,入力出力非対称性などである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:32:10 GMT)
From SQL Errors to Concept Gaps: An AI-Powered Knowledge Graph Analytics Platform for Personalized Feedback [3.1] 本稿では,AIを活用した知識グラフプラットフォームについて述べる。
NATURAL JOINの誤用は、JOIN、GROUP BY、Havingの相互の誤解を反映している。
本稿では,教材からコース概念と関係を自動的に抽出し,グラフデータベースを通じて学生の投稿トレースにリンクし,概念レベルでエラーを分類するプラットフォームを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:40:01 GMT)
Looking under the Wrong Lamppost: On the Limitations of Automated Translation Quality Estimation [3.0] 我々は、現在のQEシステムは、現実世界の翻訳において信頼できるスタンドアロンツールとして機能するように構造的に不整合であると主張している。
分離されたセグメントのレベルでの翻訳の質の評価は、凝集度、コヒーレンス、およびスタイル的および修辞的テキストの特徴を欠く傾向にあるため、問題となる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:33:13 GMT)
Separating quantum circuits from classical LLMs [3.0] 低深度量子計算と古典言語モデルアーキテクチャの非条件分離を実証する。
我々の研究は、大規模言語モデルの時代における量子優位の研究を始める。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:28:24 GMT)
Bi-semantic Chemical Embedder for Joint Representation Learning of SMILES and Natural Language [3.0] CheMatEは化学指向の埋め込みモデルであり、分子構造とドメイン固有の自然言語を共同でキャプチャする。
我々は、FinWebとChemPileから構築・キュレーションされた、新しい大規模な学術文書のコーパスを用いて、モデルを訓練する。
この設計はSMILESで計算された科学文献にモデルを公開し、バイセマンティックな理解を可能にする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:57:38 GMT)
Amortized Interventional Forecasting for Multivariate CIR Processes [2.9] 平均回帰力学は金融において広く普及している。
CIRモデルは、列間のエンフコーズの影響ではなく、エンフコーズに関連するコムーブメントのみをキャプチャする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:17:35 GMT)
Impacts of Single-objective Landscapes on Multi-objective Optimization [2.9] 本研究は, 単目的問題における局所最適ネットワークと多目的問題との関係を考察した。
その結果、ほとんどの多目的最適解は単目的局所最適解から到達可能であることがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:38:24 GMT)
Mind the Cap: Output-Budget Regimes Change the Measured Multilingual Reasoning Gap [2.9] 我々はQwen3-8BとLlama-3.1-8B-Instructのトークン・バッジ・アーティファクトであるかどうかを検証した。
我々は、スイープの3つのQwenピークとほぼゼロの値を1024で凍結し、54万デコードで評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:18:41 GMT)
Unequal Verdicts: Investigating Gender Bias in LLM-Based Fake News Detection [2.9] 本研究では,Large Language Models (LLMs) を用いた実世界データを用いた偽ニュース検出において,性別バイアスを初めて体系的に検討した。
本研究はLIARベンチマークを,各文に対して3種類の性差のある話者職名を用いて拡張し,性別提示のみに基づいて妥当性判断が変化するかどうかを検証した。
9.79%-35.13%の文は3つの変種で矛盾するラベルを受け取っており、男性と女性の比較では6.5%-23.6%のフリップ率を示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:14:06 GMT)
Learning Sexism Detection Using Multi-Agent Perspectivist Preference Optimization [2.8] マルチエージェント・パースペクティビスト・パラメータ最適化フレームワークを提案する。
ラベル付き英語とスペイン語のつぶやきのEXIST 2024データセットでは、まずアノテータをラベル付け動作によってクラスタリングする。
それぞれのエージェントを、自身のクラスタのラベルだけにトレーニングすることで、エージェントが表現すべきクラスタをはるかに超越していることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:35:30 GMT)
VetScore: Risk-Weighted Fact Verification for Veterinary Long-Form QA with Citations [2.8] 獣医用長文質問応答のための多段階評価手法であるVetScoreを提案する。
VetScoreはまずアウトプットを分割し、個別のクレームに分解し、それぞれのクレームをその有害ポテンシャルに関してスコアする。
VetScoreは小判例においても獣医師と高い相関性を示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:49:56 GMT)
From Routes to Steps: Separating Semantic Progress from Local Execution in Vision-and-Language Navigation [2.8] Route2Stepは、明示的なステップレベルインターフェースを通じてアクション生成からセマンティックプログレストラッキングを分離するフレームワークである。
R2R-CEでは、R2StepはSRを48.1%から55.3%に改善し、SPLを43.3%から48.2%に改善し、190Kの州レベルの修正サンプルを使用する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:14:45 GMT)
Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Loss [2.7] 小さな言語モデルは、しばしば、厳密なレイテンシ、コスト、オンプレミスの制約の下でデプロイする唯一の選択肢である。
本稿では,蒸留訓練を効果的に行う実践者の研究について紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:11:45 GMT)
Surrogate Substitution Preserves PHI Detectability: A Multi-Detector Equivalence Study [2.7] 構造保存復号化は、保護された健康情報を現実的な同型サロゲートに置き換える。
下流のPHI検出器はまだサロゲートを見つけることができるのか?
11個の検出器、7つのベンチマーク、7つの言語(1,750の文書)で、マスク付きスパンのリコールは76.1%から74.9%に変化した。
リアクションフロアとオープンソースのサロゲートベースラインは、その効果が1つのツールではなく、よく形成された置換の特性であることを示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:04:18 GMT)
MINT: Tensor Decomposition on Stacked Recurrence Matrices for Time Series Data Mining [2.7] 再帰プロット(Recurrence plots)は、様々な領域に適用される時系列データマイニングプリミティブである。
MINTパイプラインは,一定間隔でモチーフを含む高度に定期的なデータセットにおいて,クロスセンサパターンを効果的にコクラスタリングすることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:11:33 GMT)
Position Bias Undermines Preference Consistency in Listwise LLM-Based Reranking [2.6] 位置バイアスがLLMによるリランカーのランク付けプロセスにどのように影響するかを検討する。
本稿では、ペアワイズな選好不安定性、グローバルな選好不整合性、リストワイズな出力整合性を測定する評価フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:04:12 GMT)
On-chip Quantum Measurement of Squeezing Generated from a Silicon Nitride Micro-ring Resonator [2.6] この研究は、パラメトリック増幅器の助けを借りて、オンチップ量子測定の考え方を実装している。
5dBを超えるチップ間カップリング損失にもかかわらず、第1環から4.6dBの量子ノイズ低減を観測した。
この研究は、推定5dB信号-ノイズエンハンスメントを持つ最初のモノリシックSU(1,1)干渉計も示している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:56:21 GMT)
CRS-Triage: Confidence- and Reliability-Aware Selective Triage under Incomplete Clinical Evidence [2.5] 緊急トリアージには、短時間で信頼できる判断が必要である。
構造化データや臨床テキストを含むEHRデータは、しばしば不完全であり、信頼できない、一貫性がない。
患者の体力レベルを予測するために,CRSトリアージ(CRS-Triage)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:04:15 GMT)
When Oracle Conditioning Misleads Deployment: Conditioning-Availability Bias in Echocardiographic Segmentation [2.5] 条件付きセグメンテーションモデルは、デプロイ時に利用可能なものよりも、補助的な信号で訓練され、評価される。
本研究では,位相条件心エコー区分けにおけるショートカット学習のプロトコルレベルと補助変数シフトについて検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:52:43 GMT)
Revisiting TD Target Aggregation under Uncertainty in Q-Learning [2.5] Deep Q-Networks(DQN)は、ブートストラップされた時間差分更新を通じて値関数を学習する。
我々は、TDターゲットの生成方法を規則化するQラーニングへの簡単なロールアウトである、textbfSuccessor Rollout textbfAggregation textbfDeep textbfQ-Network (SADQ)を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:31:24 GMT)
TRNet: Topography-Guided Frequency Rectification and Structure-Aware Decoding for Multimodal Paddy Rice Segmentation [2.4] TRNetは山間部と丘陵部の高解像度画像から水稲をマッピングすることができる。
地形誘導型水田構造デコーダは, セマンティック, 米・米・地表面境界, インテリアキューを組み合わせる。
結果は、これらの利得を周波数補正、構造学習、そしてより少ない急勾配の偽陽性に関連付ける。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:04:03 GMT)
GENESIS: Towards Explainable Causal Discovery [2.4] 観測データからの因果発見は2つの根本的な課題に直面している。
グラフ構築を解釈可能な決定点に分解する,説明可能なハイブリッドCDフレームワークであるGENESISを提案する。
本研究は、ジェネシスがすべての設定において100%決定トレーサビリティを実現し、因果発見における第一級の目的として説明可能性を確立していることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:09:01 GMT)
A Security-Oriented Lifecycle Model for Large Language Model Systems [2.3] データ検証、アーティファクト署名、エージェント・パーミッション・コントロール、削除といったセキュリティ関連アクティビティは、しばしば暗黙的に残されるか、定期的なケアを受けると仮定される。
LLMシステムのライフサイクルモデルを提案し,セキュリティ関連境界を中心に構築することで,セキュリティ解析を支援する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:13:48 GMT)
Predicting Deep Neural Network Training Outcomes from Early Training Telemetry [2.3] 我々は,1つのトレーニングランの早期テレメトリが,他のランに言及することなく,そのランの最終的な結果を予測することができるかどうかを調査する。
23,788のトレーニングは、6つのアーキテクチャ/データセットの組み合わせにまたがって実行され、最初の5つのテレメトリのエポックだけが最終精度の回帰のためにR2 = 0.92-0.99を達成する。
これらの結果から,早期学習テレメトリは計算割当のための実用的な意思決定支援信号を提供する可能性が示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:13:21 GMT)
Energy Efficiency in Microservice Architectures: A Systematic Literature Review [2.3] 本研究では, エネルギー効率の考慮方法, 測定方法, アーキテクチャ・ソリューションの提案について検討する。
キッチェンハムのガイドラインに従って系統的な文献レビューを行い、4つの主要なデジタル図書館の出版物を審査する。
測定プラクティスは大部分がインフラストラクチャ指向であり、モデルベースの推定と粗い粒度の監視に依存しています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:52:04 GMT)
HyperbolicDiffusion: Sharp & Scalable Tiled Generation on the Hyperbolic Plane [2.3] 双曲平面 H2 上で有限視野を直接生成する訓練不要な手法である HyperbolicDiffusion を導入する。
私たちのHyperbolic Blooming Coverは、ウィンドウ配置を数秒で実行されるコンパクトな動的プログラムに削減します。
曲率の不一致や多窓接合のぼかしを引き起こすため、幾何由来の第2段階はこれらの領域を正確に再ノイズし修復する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:13:16 GMT)
Building and Governing AI Systems: Advancing Social Workers' Roles across the Technology Industry, Human Service Organizations, and Policy Institutions [2.3] ソーシャルワーカーは、テクノロジチームを彼らのツールのユーザとして、データセットの主題として、そして、それらのシステムがデプロイするものに最初に応答するものとして、会います。
本稿では、技術製品チームにおける標準的役割と、それぞれがコントロールする決定について紹介する。
社会労働者が技術産業、人事機関、政策機関で保持できる技術決定の役割の5つのグループを特定している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:03:46 GMT)
LoopMTP: A looped transformer guided by latent multi-token prediction [2.3] MTP(Multi-token Prediction)は、ループが欠落しているような密集した前方監視を提供する。
textscLoopMTPは、非ループベースラインよりも平均精度を最大8.1%向上させる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:13:09 GMT)
Automatic Patient-Specific Microwave Ablation Planning Accelerated by a Physics-Guided Deep Learning Model [2.2] 本稿では,ニューラルアブレーション予測モデルと遺伝的アルゴリズムを組み合わせたデジタルツインベース自動計画フレームワークを提案する。
このフレームワークは数値シミュレーションベースの計画よりも約420倍高速な計画を可能にした。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:53:50 GMT)
Modality Agreement- and Conflict-Aware Prototype Hypergraph Learning for Multimodal Intent Understanding [2.2] 本稿では,マルチモーダルな合意と対立を表現する階層型プロトタイプ・ハイパーグラフフレームワークを提案する。
MACH (Modality Agreement- and Conflict-aware prototype Hypergraph) は、マルチモーダルなコンセンサスとコンフリクトを別個のリレーショナル構造として表現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:55:51 GMT)
Adaptive Modality Reliability Diagnosis and Restoration for Robust Multimodal Intent Recognition [2.2] マルチモーダルな意図認識は言語的、音響的、視覚的な証拠を組み合わせたものであるが、個々のモダリティはうるさい、欠落、意味的に矛盾する、あるいは不当に支配的である可能性がある。
サンプルレベルでのモダリティ品質の診断,回復,再評価を行うクローズドループ信頼性ガイドフレームワークであるPRIMEを提案する。
マルチモーダルな意図認識ベンチマークの実験では、PRIMEは、欠如、ノイズ、矛盾、モダリティの不均衡条件下で改善しながら、競争力のあるクリーンデータ性能を維持している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:14:13 GMT)
AI Agent Economics: Can Autonomous Economic Behavior Emerge among AI Agents under Minimal External Conditions? [2.2] 我々は、エージェントが仕事、転職、選挙、配当の実行可能なメカニズムを受け取ったときに経済関係が出現するかどうかを問うが、社会戦略や経済戦略は行わない。
GPTとDeepSeekにまたがる非生産境界試験と24個の独立した6エージェント世界からなる2段階のフレームワークを開発した。
確認作業とタスクアクセスの不足により、転送、ローン、アクセス保証、投票対アクセス交換、アロケーション戦略が出現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:40:08 GMT)
Poisson-Compiled Quantum Singular Value Transformation for Power-Exponential Dissipation [2.1] 我々は、$exp(T H)$ for $H=Hdaggersucceq0$ および $>0$ の量子的実装を研究する。
近隣のラプラシア人は単位正規化されたシフト信号を与える。
LCHSの二次境界に適合する非可換ワイル・ポアソン恒等式を確立する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:49:03 GMT)
ATLAS: Learning to Recommend Across Unseen Domains [2.1] ATLASはマルチソースレコメンデーションドメインの一般化フレームワークである。
未確認のドメインに対してゼロショットのレコメンデーションを可能にするため、共有されたドメイン不変のユーザ-イテム表現を非結合のソースドメインから学習する。
5つのAmazonドメインでトレーニングされたATLASは、最先端のグラフベース、クロスドメイン、量子化ベース、LLMベースのベースラインを、ほとんどの未確認ドメインで上回ります。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:29:02 GMT)
A Constitution-Grid Instrument for Data-Efficient RL Alignment (C-Guard) [2.1] 安全ガードをRLで訓練することは、対立する2つの目標を最適化することを意味します。
本稿では、RLトレーニングデータを生成するコンスティチューショングリッドであるC-Guardと、各セルの動きを決定するセルごとの学習可能性スコアであるC-LIMについて述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:59:21 GMT)
Test-Time Augmentation for Tabular-to-Image Classifiers under Distribution Shifts [2.1] テスト時間拡張(TTA)は、モデルロバスト性を改善するために画像分類において効果的なアプローチである。
本研究は,表在像法により生成された表現に対して,OF-Distribution (OOD) 下での予測性能に及ぼすTTA手法の影響を評価する。
その結果,TTAはOOD性能を向上し,高剛性と分散の最良のトレードオフを提供する複合的および測光的戦略が得られた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:26:58 GMT)
Design-Time Optimization of Deep Neural Networks for Intermittent Learning on Microcontrollers [2.1] マイクロコントローラユニット(MCU)における断続的,エネルギー自律的,オンデバイス学習のためのディープニューラルネットワーク(DNN)の設計法を提案する。
提案手法は,ハードウェア対応エネルギー予測モデルと多目的最適化(MOO)を組み合わせたものである。
我々はCortex-M4 MCUの異常検出にオートエンコーダを用いてアプローチを検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:43:19 GMT)
The Cost of Binarizing Survival Outcomes in Clinical Prognostic Modeling [2.1] 両値のスコアリング関数をCox部分的なログライクリングに置き換えて特徴とアウトカムのエッジを生成し、二項化が欠落する確率的特徴を回復する。
我々のアブレーション実験は、患者を多く維持するよりも、時間と時間によるスコアリングの定式化によって改善が促進されることを確認した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:56:24 GMT)
Attacking and Defending Multi-Agent Collaborative Filtering Systems Through Connectivity [2.1] 我々は,汎用マルチエージェントシステムからの攻撃と防御をエージェントベースの協調フィルタリング設定に適応させる。
我々は,接続の2つの側面が攻撃と防御の結果をどう表現するかを特徴付ける。
探索的拡張として、予測攻撃結果によるCF構成のランク付けにおいて、疫病に触発された静的メトリクスの適用性を評価する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:49:58 GMT)
SeCo-SBIR: Semantically Consistent Prompt Learning for Zero-Shot Sketch-Based Image Retrieval [2.0] SeCo-SBIRはゼロショットスケッチに基づく画像検索のための意味論的に一貫した学習フレームワークである。
分類、一般化、データセット間の3つの標準ZS-SBIRベンチマークの最先端結果を達成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:41:45 GMT)
CAN Disabler: Hardware-based Prevention method of Unauthorized Transmission in CAN and CAN-FD networks [2.0] 本稿では、ECUがCANバスに異常な頻度でメッセージを送信するのを防止するために修正されたCANコントローラを用いて、不正なCANバスアクセスをブロックする方法を提案する。
また, フレキシブルデータレート(CAN-FD)バスを用いたCANにおける無効化の有効性を実証した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:30:01 GMT)
Active Spiking Perception: The Membrane Potential as a Belief State for Anytime 3D Point Cloud Recognition [2.0] スパイクポイントクラウドネットワークは通常、固定された入力に依存しない順序で空間をスキャンする。
Active Spiking Perception (ASP)は、3D認識を、ネットワークの漏洩した統合・火災(LIF)膜電位を反復的決定プロセスとして再放送し、クラス上で実行中の信念として読み上げ、次のチャンクを選択して、信頼に満ちた早期出口を観察しトリガーする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:40:08 GMT)
Information-Geometric Forward Policy Training in GFlowNets [1.9] 我々は, GFlowNetsにおける前方政策学習を, 誘導軌道検層の情報幾何学を用いて定式化する。
前方方針を誘導軌跡サンプリング器として扱うことにより,その内在的な一階幾何が軌道系のフィッシャー・ラオ計量によって与えられることを示す。
我々は、軌道フィッシャーをステップごとの条件付き第2モーメントに正確に分解する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:34:14 GMT)
CodeAssay: A Multi-Metric Benchmark with Audited Ground Truth for LLM Code Generation [1.9] CodeAssayは10のソフトウェアエンジニアリングカテゴリにまたがる185のPythonタスクの分類学第一のベンチマークである。
監査済みの真実、生成と修復のための公開テスト、グレーディングのための隠されたテスト、突然変異ベースのテストスーツ検証、選択されたコードプロパティ対策を組み合わせる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:15:17 GMT)
Latent-Frequency Validity: Fast Spectral Editing with Screened Video-VAE Transfer Operators [1.8] ビデオVAEラテントの直接スペクトル編集は、デコード-フィルタ-リコードパスなしでノイズ、フリック、滑らか、および周波数コンテンツを制御できる。
本稿では,コンパクトなVAEスペクトル応答を学習するEmphlatent- frequency validity (LFV)を提案する。
LFVは、ラウンドトリップドリフトを悪化させることなく、デコードされたターゲットフィリティを改善する場合にのみデプロイする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:14:54 GMT)
Open-World Darknet Traffic Recognition Under Leave-One-Service-Out Evaluation [1.8] 本稿では,残業評価と不確実性を考慮したオープンワールドダークネットトラフィック分類フレームワークを提案する。
実験結果から,クローズドワールドからオープンワールド環境への移行時の性能劣化が顕著であった。
既知のサービスと未知のサービスの間に強い振舞いの類似性は、しばしば誤分類を引き起こす。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:24:24 GMT)
Behavioral Information Leakage in Darknet Traffic: A Multi-Channel Analysis Across Anonymity Networks [1.8] 本稿では,フローレベルのトラフィックを制御,構造,リズミカルな記述群に分解する行動情報漏洩フレームワークを提案する。
その結果,行動漏洩は匿名ネットワークによって大きく異なることがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:54:46 GMT)
Less Traffic, Better Outcomes: Competition-Aware Request Dispatch in Real-Time Ad Exchanges [1.8] リアルタイム入札(RTB)広告交換は通常、ほぼ全てのリクエストを需要側プラットフォーム(DSP)に転送する。
本稿では,各DSPに対して各要求を送信すべきか否かを判定する,競合対応の要求ディスパッチフレームワークを提案する。
毎日200億件以上のリクエストを処理可能なプロダクションプラットフォーム上で,4つの連続的なオンライン実験を通じて,このフレームワークを評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:11:42 GMT)
From Bug Reports to Browser-Executable Procedures: An LLM-Driven Agent for Web GUI Bug Reproduction [1.7] ReBugは、Web GUIバグレポートからブラウザレベルの再現手順を再構築し、実行し、検証するコンテキスト対応エージェントシステムである。
我々はReBugを4つのオープンソースWebアプリケーションから667の現実世界のバグレポートで評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:50:43 GMT)
Geometry Beats Estimated Depth: RGB-Only Multi-Camera 3D Tracking under Sim2Real [1.7] AI City Challenge 2026 Track 1は、Sim2Real(synthetic-to-real)設定の下で、大規模な屋内倉庫におけるマルチカメラの3D知覚を評価する。
2つのRGBのみのルートを1つの仮説の制御テストとして使用し、モノクロ深度精度ではなく、クロスビューの幾何学的整合性はSim2Realで性能を制御している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:13:59 GMT)
LLM-Derived Priors for Thompson Sampling in Cold-Start Comment Recommendation [1.7] マルチアームバンディットアルゴリズムはオンラインレコメンデーションで広く使われている。
これらのアルゴリズムは、新しく導入されたアームが相互作用履歴をほとんどあるいは全く持たない場合に、コールドスタートの制限に悩まされることが多い。
我々は大言語モデル(LLM)を用いて、コメントテキストから意味的信号を抽出し、それらを情報的ベイズ先行語に変換する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:31:44 GMT)
AIDE: Automated Instruction via Distilled Expertise for Reference-Free Motor Skill Coaching [1.7] AIDE(Automated Instruction via Distilled Expertise)は、トレーニング時にのみ専門家の参照を利用するフレームワークである。
推論時にのみ学習者のポーズシーケンスからフィードバックを生成する。
ExpertAFデータセットでは、ほとんどのメトリクスにおいて、AIDEは参照なしベースラインよりも優れています。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:58:22 GMT)
Test-time reasoning effort and unauthorized tool use in language-model agents: a prespecified equivalence study [1.7] ツールコールを通じて実行される言語モデルエージェントは、各ロールが実行する操作を制限するアクセス制御ポリシーの下で動作します。
TRIO-20の14の確認シナリオにおいて, GPT-5.6内の推論の努力(低, 最大)が異なる。
840の軌道と2つのモデル層にまたがって、認可されていないツールコールは発生しなかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:01:14 GMT)
Benchmarking the Benchmarks: Testing the Predictive Validity of Commonsense Benchmarks [1.7] 確立された4つのコモンセンスベンチマーク,4つのリワークされた変種,3つの非常識制御,8つの下流タスクの6つのファミリーから23のモデルを評価した。
我々は、モデルランキング、計算制御された相関関係を比較し、コモンセンスベンチマークの基準妥当性を評価するために、一戸一戸一戸建てのクロスバリデーションを使用する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:49:34 GMT)
EduClaw-Bench: A Long-Horizon Benchmark for Pedagogical LLM Agents with Simulated Learners [1.6] 学習者は1ターンではなく、何日、何週間も改善するからである。
EduClaw-Benchは、エージェントのチューターをシミュレーション学習者と30日間の連続的な関係に配置するベンチマークである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:47:26 GMT)
Enhancing Tabular Learners with Context-Aware Semantic Embeddings [1.6] 本稿では,Large Language Models (LLM) の意味的理解と表型学習者の統計的能力のギャップを埋める新しいフレームワークを提案する。
カスタムトレーニングされたGemma 3ベースのタブラル言語モデルのKVキャッシュに行の代表的なサンプルを埋めて、データセットのセマンティクスの永続的なアンカーを確立する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:29:37 GMT)
Conformal risk control for model-form uncertainty in parametric non-intrusive reduced-order models [1.6] 非侵入還元次モデル(NIROM)は、実験のコンピュータ設計からパラメトリック偏微分方程式を近似するための標準ツールとなっている。
しかしながら、これらの予測の信頼性を評価することは、特に外挿体制や限られた訓練データの下では大きな課題である。
本稿では,削減された基底の摂動表現と分布自由な共形型法を組み合わせることで,NIROMのモデル形式不確かさを定量化するためのフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:08:16 GMT)
Agents Catching Agents: Shortcut Cascades and Benchmark Gaming in Clinical Multi-Agent Systems [1.6] 臨床意思決定支援は、共通のワークスペースで検討する言語モデルエージェントの委員会に向かっている。
我々は、このような委員会がショートカットによってゲーム化され、ベンチマークの報酬を得られるかどうか尋ねるが、臨床医は無視する。
委員会が行うゲームは社会的妥当性であり、自己申告から独立した審判のみがそれをキャッチする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:37:16 GMT)
Graph-Aware Exact Branch-and-Bound with Device Profiles for Static Qubit Allocation [1.5] 静的量子ビット割り当ては、回路の論理量子ビットをスパース物理デバイスにマッピングする。
我々は、グラフ対応の正確な削減を、軽量な割り当てバウンドパスのためのエンジニアリングバンドルに統合する。
その結果、グラフ対応ノード処理とエンジニアリングにより、正確な割り当てに必要なリソースを大幅に削減できることがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:36:54 GMT)
FraQ: Efficient Coordinate-Space Recompression for Federated Low-Rank Adaptation [1.5] Low-Rank Adaptation (LoRA) によるFederated Fine-tuningは、プライベートデータを集中化せずに、Large Language Models (LLM) の効率的な協調的適応を可能にする。
LoRAの2要素パラメータ化は、クライアント間でのアグリゲーションミスマッチを生成する。
フェデレートされたLoRAの効率的な座標空間再圧縮法であるFraQを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:57:08 GMT)
WorldCup Arena: Prospective, Leakage-Free Evaluation of Frontier LLMs on a Live Tournament [1.5] 6台のフロンティアLSMが104試合全てに7市場予測カードを入力するよう求められた。
質問された時点では何の回答もなかったので、その評価は建設によるリークフリーである。
トーナメントが確立しているのは、6つのシステムが共有する行動のセットです。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:59:55 GMT)
Post-Hoc Trajectory-Risk Certification for Modular LLM-Based Security Agents [1.5] ボンフェロニ配置は分布自由であるが,相関誤差下では保守的であることを示す。
粗いラベルの選択は、学習された依存なしにほぼ完璧な相関関係を作ることができる。
ステージ単位の証明書とペアの重なり合うバウンドを用いたモジュール証明書は、正の平均利得が0.6%となる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:48:36 GMT)
Geometry-Informed Parameter-Efficient Fine-Tuning of Pre-trained Molecular GNNs for Blood-Brain Barrier Permeability Prediction [1.4] 本稿では, BBBP-GeoPEFTを提案する。
BBBP-GeoPEFTは、空間原子と二階のエッジ相互作用を捉えるために、複数のカットオフと対応する線グラフから距離ベースのグラフを構築する。
BBBPデータセットをキュレートした実験により、BBBP-GeoPEFTは完全な微調整および代表PEFTベースラインと比較して競争性能が向上した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:29:08 GMT)
An Approach for Embedding-Guided Function Reuse Detection in Embedded C Software [1.3] 本稿では,組込みソフトウェア再利用検出のためのドメイン対応検索拡張生成パイプラインを提案する。
パイプラインは、既存のインラインコメント、コールグラフコンテキスト、そして8つのバックボーンモデルに組み込む前にプロジェクトを抽出することによって、各機能を充実させる。
パイプラインは、SonarQubeが再利用フィルタとして93.6%の偽陽性率を生成し、ハードウェア環境のミスマッチによって83.5%の障害が発生することを明らかにした。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:46:17 GMT)
Beyond Isotropic Assumptions: Continuity-Constrained Segmentation and GPU Morphometry for Nanoscale GBM Analysis [1.3] 共焦点顕微鏡による3Dの複雑な生物学的構造を解明する。
セグメンテーションモデルをトレーニングするには、アップサンプリングされた空間で密集したアノテーションが必要であり、これは禁止的なラベル付けの負担である。
我々は、追加のアノテーションなしでこれを克服するエンドツーエンドのGPUアクセラレーションフレームワークを提示します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:28:19 GMT)
FM4WiFi: Flow Matching for Multi-AP Coordination in Dense Deployments of Beyond Wi-Fi 8 Networks [1.3] 我々は、単一の推論ステップで高品質なCo-SR構成を生成する生成MLパイプラインであるFM4WiFiを紹介する。
我々はFM4WiFiが中規模から大規模の最先端のベースラインとどのように一致しているかを示し、サブ秒の推論で30以上のAPにスケールする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:23:01 GMT)
LegalPincite: Multi-level Legal Information Retrieval Dataset [1.2] 我々は、欧州連合司法裁判所(CJEU)の判断に基づいて構築された大規模な法的情報検索データセットに貢献する。
データセットは、 (i) マスクされたケース/パラグラフクエリ、削除された引用情報、 (ii) 全ての段落を含むコーパス、 (iii) ケースレベルおよび段落レベルの接頭辞を含む。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:46:19 GMT)
Correlating spin and optical properties of quantum emitters in hBN [1.2] 六方晶窒化ホウ素 (hBN) の光応答性スピン欠陥は、準曲面量子センシングによく適している。
ここでは炭素ドープしたhBNフレークのスピン錯体欠陥の高密度化を制御している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:02:59 GMT)
When Do Fewer Visual Tokens Accelerate Multimodal Inference? A Break-Even Study Across Decision Locations and Hardware [1.2] 視覚トークンが少ないため、エンドツーエンドのレイテンシが低い。
我々は、意思決定のオーバーヘッド、共有作業、および各ポリシーが回避できるオペレータを考慮に入れた再現可能なプロトコルを用いて、ブレークフェアを評価する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:33:11 GMT)
Right Divisibility in Erasing Semi-Thue Systems: A Minimal View of Intruder Deduction [1.2] 我々は最小構造の観点から推論を研究する。
我々は、収束した同時変数リフトシステムに対して、既に推論は決定不可能であることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:51:03 GMT)
Reversing Arrows in Large Language Models [1.2] 本研究は,大規模言語モデル(LLM)における逆関係指向性に関する最初の体系的研究である。
本研究は, 関係記述と実体表現の影響について, 元の実体を合成・マスクされた実体に置換することによって検討する。
この結果から,関係記述が常に性能を向上するわけではないことが示唆され,モデル性能が実体表現の変動に敏感であることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:56:02 GMT)
Diffuse to Compress: Leveraging Diffusion LMs for Lossless Compression [1.1] 本稿では,デジタルテキストデータの収集・保存の急激な増加を背景として,ロスレステキスト圧縮の問題点を考察する。
自己回帰型LLM手法の代替的推論パラダイムとして拡散言語モデル(DLM)を導入する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:19:31 GMT)
Divide-and-Conquer: Towards Generalizable Amortized Bayesian Inference for the Drift Diffusion Model [1.1] 本稿では,複雑なドリフト拡散モデルのための分流・対流フレームワークを提案する。
各シャードに個別に推論を行い、その結果の後方をコンセンサスMCで結合する。
提案手法はMCMCに匹敵する精度と不確実性を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:29:47 GMT)
LDU-Bench: Multimodal LLM Evaluation for Lithography Defect Understanding under Layout-Varying Circuit Backgrounds [1.0] 本稿では,リソグラフィ欠陥理解のためのマルチタスクマルチモーダルベンチマークであるLDU-Benchを提案する。
LDU-Benchはレビューワークフローを、欠陥トリアージ、形態認識、粗いローカライゼーション、画像条件付き原因分析の4つの独立したタスクに分解する。
実験の結果,既存のMLLMは比較的確実に欠陥トリアージを行うことができるが,下流のレビュー段階に安定して移行できないことがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:43:39 GMT)
The Tell-Tale Trace: Detecting Reasoning Failures in LLMs Using Chain-of-Thought Dynamics [1.0] チェーン・オブ・思想(CoT)推論は、大きな言語モデル(LLM)のパフォーマンスを改善する。
言語化されたCoTを利用して推論の正しさをモニタリングする既存のアプローチは、個々の中間ステップの意味的正しさまたは整合性を大きく評価する。
機能障害は、可視的推論の構造において、タスク依存の分散変化として表れることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:04:36 GMT)
Learning and Clustering on Temporal Graphs: Principles, Primitives, and Pooling [1.0] この研究は、時間グラフの学習の問題に焦点を当て、特にクラスタリングの課題に重点を置いている。
グラフニューラルネットワークは、多くのダウンストリームグラフタスクにまたがって最先端のパフォーマンスに達するが、確立された、推論されたクラスタリングアルゴリズムに対するアドバンテージは、はるかに小さくなっている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:01:08 GMT)
Accelerating Dynamic Graph Clustering on GPU Architectures with cuGraph [1.0] この研究は、もともと静的グラフ用に設計されたスペクトルクラスタリングとモジュール性に基づくアルゴリズムのGPU加速拡張を通じて、時間ネットワークにおけるコミュニティ検出に対処する。
我々は,NetworkX-Temporalライブラリを通じてPythonバインディングを含む,フリーでオープンソースなソフトウェアとして実装した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:01:00 GMT)
Statistical learning theory and Occam's razor: Regularization [0.9] オッカムのカミソリは、帰納的推論において単純さを優先するように指示しており、科学哲学と機械学習の両方において多くの精査を集めている。
理論的な信頼性と「何を見ればいいのか」の保証から利益を得るには、適当に単純さを優先しなければならないと私は主張する。
これは真理の正当性であり、純粋に実践的な原則に陥ることもなく、本質が単純であるという存在論的前提にも当てはまらない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:17:42 GMT)
An Inline Control Architecture for Language Models in Intelligent Transportation Systems [0.9] 本稿では,リアルタイム制約下でV2XサービスをセキュアにするためのインラインセマンティックガードレールアーキテクチャであるGuarded-V2Xを提案する。
提案システムは,ルールベースの入力フィルタリング,軽量な安全分類器,ポリシー制約付き構造化生成を統合する。
RSUアドバイザリ、オペレーターメッセージ、注釈付きV2Xメッセージ要約から導かれたV2X対応のシミュレーションデータセットで実験を行った。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:04:15 GMT)
SpecDrop: Parameter-Free Category-Conditioned Routing for Modular Specialization [0.9] 我々は,MoEネットワークのための固定パラメータフリールーティング方式であるSpecDropを開発した。
各画像が1つのスーパークラスラベルを持つ視覚タスクにおいて、SpecDropはCIFAR-100で79.23%、ImageNet-1Kで79.89%に達する。
SpecDropの貢献は、ラベルをトレーニングされたモジュール構造に変換することである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:01 GMT)
CRIL-U-Net: Compact Ratio-Interaction Learning for Focal Cortical Dysplasia Segmentation from T1w and FLAIR MRI [0.9] CRIL-U-Netはコンパクト比対話学習モジュールを組み込んだ3D U-Netである。
従来の3D U-Netと入力自己注意U-Netと比較された。
病変の重複は85例中44例で, U-Netは36例であった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:25:00 GMT)
An Explainable LLM Agent Layer for Open-World Anomaly Detection in Oil Wells [0.9] 油井異常検出のためのオープンワールドラーニング(OWL)パイプラインは、最近、オートエンコーダに基づく検出、マルチクラス分類、および公共の3Wデータセット上でのマハラノビスに基づくノベルティ検出の組み合わせが示されている。
本稿では,OWLパイプラインの下流に配置されたLarge Language Model (LLM) エージェント層を,置換ではなく上流のメソッドに対するtextbfcompanionとして設計した。
NVIDIA NIMを介して提供されるQwen3.5-397B-A17B Mixture-of-Expertsモデルを用いて、エージェントは構造化されたセンサメトリクスと上流分類または新規アサーションを受け取る。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:44:06 GMT)
Route-Align-Verify for Functional Correctness in Code Generation [0.8] RAVは軽量でモジュール化されたフレームワークで、3つの調整されたステージを通じて固定されたバックボーンモデルでコード生成を改善する。
MBPPベンチマークのRAVを,高濃度およびフル設定の両方で評価した。
その結果、バックボーンアーキテクチャを変更することなく、コード生成における機能的正しさを有意義に改善できることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:52:40 GMT)
HiResNets: Native Full-HD Video Recognition with Foveal Residual Streams [0.8] 畳み込みブロックが対数2乗成長する残留ネットワークについて検討し、高速な高解像度ビデオ処理を可能にする。
完全な高解像度の表現は残差ストリームに構築され、眼球のササードに似ており、生物学的視覚において完全な画像を生成する。
実験により、提案したHiResNetsは人間の視覚と同じようなシーンを回避し、難易度の高いビデオ認識タスクにおいて優れた性能を発揮することが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:26:43 GMT)
Securing Load Balancing over QUIC [0.8] 我々は、CIDを変更することなく、データプレーン内でステートレスQUICロードバランシングを実装することができることを示す。
このシナリオでは、フルロードバランサバイパスや0-RTTIPスプーフィングなど、QUICに対する攻撃も検討・緩和する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:21:54 GMT)
TS2TabPFN: Time Series Classification and Extrinsic Regression through Feature Extraction and a Tabular Foundation Model [0.8] 本稿では,TabPFN 2.5 と明示的特徴抽出を統合した TS2TabPFN を提案する。
TS2TabPFNは,統計的に有意なTSERタスクにおいて,最先端のモデルよりも有意に優れていることを示す。
その結果,基礎モデルと構造的特徴を組み合わせることで,単一パラダイムの制約を克服できることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:32:18 GMT)
TumorBoard: Evidence-Grounded Multi-Agent Decision Support for Longitudinal Neuro-Oncology [0.8] tumorBoardは、複数エージェントによる意思決定支援システムで、共有された縦型ケースステートを中心に構築されている。
放射線学、神経病理学、分子診断、ガイドライン、治療計画の専門エージェントは、証明された原子的クレームを生成する。
敵対的な批評家は矛盾を露呈し、安全総督は証拠の不十分さと時間的妥当性に応じて勧告を公表し、資格を与え、あるいは拒否する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:32:25 GMT)
NeuroMosaic: Anatomically Grounded Multimodal Large Language Modeling for Molecularly Aware Glioma Reasoning from 3D MRI and Clinical Narratives [0.8] 我々は,3次元マルチモーダル言語モデルであるNeuroMosaicについて述べる。
このアーキテクチャは、マルチレゾリューションボリュームトークンライザ、神経解剖学的グラフルータ、分子コンセプトメモリ、選択的リスク制御を組み合わせたものである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:26:50 GMT)
Active Stiffness Control of a Supportive Continuum Robot [0.8] 補助連続ロボット(SCR)は、機械的に支持アームと結合することにより、操作連続ロボットの荷重保持能力を高める。
負荷応答を規制し、位置決め精度を維持するためには、アクティブ剛性制御が必要である。
本稿では、腱駆動型SCRのためのアクティブなタスク空間剛性制御フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:51:05 GMT)
HALT: Verification-Aware Stopping for Retrieval-Augmented Search Agents [0.7] 必要な証拠が現れた後、さらなる検索により、有用な情報ではなく、コスト、レイテンシ、コンテキストの混乱が増す。
我々は、発電機の信頼性よりもエビデンスカバレッジとして停止し、検索エージェントをそのままにしておく軽量な検証対応ポリシーであるHALTを導入する。
3つのマルチホップQAベンチマークで、HALTは冗長な検索を減らし、正確な一致を保っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:06:15 GMT)
Before Reasoning Can Fail: Pre-Evidence Procedural Failures in Agentic RAG [0.7] エージェント検索拡張生成(RAG)システムは、エビデンス条件の推論がテストされる前に失敗する可能性がある。
我々は,この故障モードをエージェント軌道の手続き的特性として検討する。
ReadGateは,検索後およびファイナライゼーション前において,エージェントが読み取る必要のある最小限のランタイムである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:04:12 GMT)
CNOT-Distance is NP-complete under all-to-all connectivity [0.7] 固定ラベリングワイヤ上で全接続で$A$を少なくとも$K$CNOTゲートで実装可能であることを示す。
この問題がNP完全であることを証明する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:34:26 GMT)
Simulation-free and finite-time diffusion model [0.7] 本稿では,両者を同時に実現する参照プロセスを設計するためのフレームワークを提案する。
提案手法の最小限として条件付き流れマッチングが生じることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:39:14 GMT)
Benign interpolation and Occam's razor [0.7] 最新のディープラーニング手法は、トレーニングデータを完璧に適合させたとしても、うまく一般化できることを示す。
この新しいシンプルさへのアピールは説明的ギャップを生み出すと我々は主張する。
一般化への証明可能な接続を欠いたのは、かつての作業を行う「単純さ」(simplicity) という名前であり、実体的で議論の余地のない仮定を、よく知られた方法論の原則の適用のように見せかける。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:34:47 GMT)
Controllable interaction between photons and distant spins via vacuum Rabi oscillations [0.6] 2つの空間的に分離された二重量子ドットからなるデバイスは、単一電子スピン量子ビットと超伝導キャビティをホストし、マイクロ波光子を収容する。
各スピンキュービットとキャビティ間の複数の真空ラビ振動を観測する。
結果は、光-物質相互作用の探索や、フォトニックリンクへの対向半導体スピン量子ビットの探索において、ビルディングブロックとして機能する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:22:09 GMT)
Paired Recipient-based Evaluation of Survival Prediction for Deceased Donor Kidney Transplants [0.6] 故人ドナー腎移植データに基づく生存予測モデルの構築について, SRTR (Scientific Registry of Transplant Recipients) による検討を行った。
線形モデルから深層学習モデルまで,5種類の生存予測モデルが存在することが判明した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:01:03 GMT)
Moral Hazard in Multi-Agent Language Models [0.6] 社会的に価値のある努力がコストがかかり、弱く観察可能で、主に他人に利益をもたらす場合、協力は失敗する。
本稿では,対話型モラル・ハザードゲームについて紹介する。
各エピソードにおいて、エージェントは即時ローカル報酬を保存したり、クエリコストを支払って隠れた安全事実を明らかにすることができる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:56:56 GMT)
Cross-Ecosystem Bug Classification in Quantum Software [0.6] 本稿では,Qiskitの12,910件とCirqとPyQuilを含む11のリポジトリの4,613件を比較した。
ルールベースの分類フレームワークを用いて、タイプ、カテゴリ、深刻度、品質属性、量子固有のサブタイプによってバグを分析する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:04:44 GMT)
Interpretable Fuzzy Inference for UAV Target Tracking Using Bounding-Box Geometry [0.5] YOLOボックスから抽出した低次元特徴から連続ヨーコマンドを生成する解釈可能なファジィ推論フレームワークを提案する。
その結果、このフレームワークは透過的で、データ効率が高く、計算量も軽量であり、リアルタイムの視覚に基づくUAV誘導に適していることが判明した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:18:29 GMT)
When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems [0.5] 大規模言語モデルはタスク計画と制御のための自律ロボットシステムに統合されつつある。
この統合によって、安全でない決定や身体的危害につながる可能性のあるインジェクション攻撃が促される。
本稿では,LLMをベースとしたマルチエージェントロボットシステムに対する即時インジェクション攻撃の評価を行う。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:20:03 GMT)
Frozen High-Resolution Inference for Cross-City Object Detection: An AI City Challenge 2026 Study [0.5] 都市横断物体検出には、ラベルのない対象都市に一般化するために、ある都市で訓練された検出器が必要である。
本研究では, RF-DETR-Large検出器を空装したトレーニング・アズ・ア・サービスプラットフォーム内のアーカイブ構成を解析した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:03:37 GMT)
OliveGemma: A 3 Billion Visual Language Model for Recognising the Mediterranean & European Diet [0.5] 本研究は,地中海料理とヨーロッパ料理の認識と推論のための視覚言語モデルであるOliveGemmaを提示する。
オープンウェイトなPaliGemma-2-3Bアーキテクチャ上に構築され、17,340枚の画像の統一コーパス上にLoRAで微調整されている。
3倍のクロスバリデーションスキームの下で、OliveGemmaは92.96% +/- 0.91%というトップ1の精度を達成し、最強のCNNベースライン(DenseNet-121)を7.31%上回っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:18:36 GMT)
Robust and Personalized Federated Learning for Aircraft-Engine Prognostics under Benign and Adversarial Client Heterogeneity [0.5] FL(Federated Learning)は、航空機の運用者が生データを共有せずに、エンジンセンサーテレメトリから残留寿命(RUL)モデルを共同訓練することを可能にする。
本研究では, 正直な操作者が異なる操作条件や障害モードを観察する良性不均一性と, 妥協した操作者が有毒な更新を提出する敵対的不均一性という2つの相補的課題について検討した。
エンジンの劣化を隠蔽する物理的に動機付けられたセンサ値バックドアを含む,4つのアグリゲーション手法に対する5つの攻撃を評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:54:29 GMT)
A quantum game of telephone [0.4] 我々は、反復的なアンシラ支援プロセストモグラフィープロトコルである「量子電話」を導入する。
ノイズの多い中間チャネルが基本パラメータ縮退を生成するのを観察する。
このアプローチにより、標準アンシラ支援プロセストモグラフィーの厳格なフルランク要件が回避される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:28:28 GMT)
DAMPyF: a Python implementation of the DAMPF method for the simulation of open-system dynamics [0.4] DAMPyFは、DAMPF(Dissipation-assisted matrix product factorization)法のオープンソースPython実装である。
本稿では,物理モデル,DAMPFアルゴリズム,ユーザ向けコード構造,インストールと実行,入出力形式,最小限の例について述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:44:43 GMT)
Quantum Contextuality and Entanglement-Free Grover Search in a Trapped-Ion Optical Qudit [0.4] 高次元量子システムは、古典的でない量子資源を調査するための魅力的な経路を提供する。
我々は,138mathrmBa+$イオンで符号化された,プログラム可能な4次元光キューディットを実証した。
プログラム可能な量子計算とコンテキスト性の測定を単一のマルチレベルトラップイオンプラットフォームに統合することにより、量子情報処理におけるコヒーレント干渉とコンテキスト性の関係を調査するための汎用的なアーキテクチャを確立する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:27:03 GMT)
FlowForm: Synergizing Fluid Physics with Topological Consistency for Satellite Flood Synthesis [0.4] FlowFormは、衛星の洪水合成のためのフレームワークである。
SWEにインスパイアされた潜在正規化と構造対応条件付けを統合している。
高い視覚的忠実度、ペア画像間の類似度、および浸水領域のより強い一貫性を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:30:35 GMT)
FedRings: A Scalable and Topology-Aware Federated Learning Framework for LEO Satellite Constellations [0.3] Fedsは、衛星をリングベースの通信構造に整理するフレームワークである。
トポロジ対応のルーティング、通信スケジューリング、効率的なアグリゲーションを組み合わせる。
実験では、現実的な設定で既存のメソッドを一貫して上回ります。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:31:58 GMT)
Passively Safe Convex Guidance for Cislunar Rendezvous and Proximity Operations [0.3] アプローチ、到着、中止の操作はすべて、操作実行エラーとナビゲーションの不確実性という文脈で設計され、検証される。
概説された手法は、NASAのCAPSTONE 02ミッションのベースラインの誘導ルーチンを構成する。
高忠実閉ループモンテカルロシミュレーションは、計画された相対航法センサスイートと測定カデンスを用いて、意図した操作設計性能を検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:22:15 GMT)
Transferable Dual-Stream Representations for Mesoscale-Preserving Sea Surface Temperature Downscaling [0.3] EddyFlowは、キロスケールの海面温度ダウンスケーリングのための表現学習フレームワークである。
予測精度、スケール依存構造、地域一般化のバランスをとる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:11:04 GMT)
Design and Evaluation of an AI-Enabled Cloud-Edge Architecture for Connected Precision Agriculture Farms [0.3] 植物病は世界中で顕著な収量減少を引き起こし、トマトの作物は特に早熟、遅熟、葉型に影響を受けやすい。
この制限に対処するため、自律的な作物モニタリングのために人工知能(AI)によりクラウドエッジアーキテクチャが提案されている。
このアーキテクチャでは、IoT(Internet of Things)センサ、無人航空機(UAV)、ディープラーニング、Azure IoT Hubベースのクラウド分析、マルチプラットフォームインターフェースを統合している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:25:02 GMT)
Advancing Utility Pole and Sign Detection Through Deep Learning [0.3] 木製ユーティリティポールの自動検出,セグメンテーション,リーン角度推定のためのディープラーニングフレームワークを提案する。
このシステムは、Googleストリートビューから抽出された4,570枚の注釈付き画像のカスタムデータセットでトレーニングされている。
このモデルは標準の物体検出器よりも優れており、平均的な極検出精度は90.43%、符号検出精度は88.26%である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:19:00 GMT)
Measurement-based simulation of lattice gauge theory dynamics with adaptive quantum circuits on a trapped-ion processor [0.2] 測定に基づく量子シミュレーション(MBQS)
格子ゲージ理論における実時間力学の最初の実験的実現
MBQSは,今日のハードウェア上での格子場理論をシミュレートするための,実行可能な対称性を考慮したアーキテクチャであることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:48:42 GMT)
A Low-Cost Hybrid Reservoir Computing Model for Isolated Sign Language Video Recognition [0.2] 我々は手話認識(SLR)のための軽量貯水池計算(RC)に基づくアプローチを提案する。
提案手法では,身体と手指のキーポイントを抽出し,ジェスチャーの空間的・時間的ダイナミクスを捉える。
このHRCベースのSLR法は、Word-Level American Sign Language 100 (WLASL100)ビデオデータセットでそれぞれ61.12%、86.05%、92.56%のTop-1、Top-5、Top-10の精度を達成した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:38:41 GMT)
Efficient Multilingual Neural Machine Translation via Corpus-Driven Vocabulary Pruning: An English-Arabic Case Study [0.2] 本稿では,MNMTモデルに対する語彙プルーニング手法と微調整プロトコルを併用した汎用最適化フレームワークを提案する。
提案手法は3つのモデル(M2M100, NLLB-200, mBART-50)を英語とアラビア語のペア上で評価する。
その結果、最適化された多言語モデルでは、専用バイリンガルベースラインの性能に適合または超えることができることがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:17:54 GMT)
Real-time physics inversion for retrieval of sub-pixel wildfire temperatures from VSWIR imaging spectroscopy [0.2] 我々は、NASAの空中可視赤外分光計(AVIRIS-3)のデータに基づいて、VSWIRイメージング分光データのための山火事温度検索フレームワークを提案する。
我々は,2025年のファイアセンス AVIRIS-3 キャンペーン全体に対して,総計で168回の飛行を行い,短波長赤外線(SWIR)の帯域間での残留放射率が$leq 10% であることを示す。
後部分布は、絶対誤差が30ドルK、平均絶対誤差が27.16ドルで、基礎となるサブピクセル温度範囲の良好なカバレッジを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:57:42 GMT)
Echoes in the Digital Abyss: Examining the Bubble Surrounding Security and Privacy Discourse in Social Networks [0.2] ソーシャルネットワークのセキュリティとプライバシに関する議論は、実験的な設定とはまったく異なるイメージを描いている。
以上の結果から,セキュリティに関する議論を発生または参加するユーザは,主に高度にクラスタ化された技術や,セキュリティおよびプライバシに関する関心のコミュニティに属していることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:10:47 GMT)
Test, then Route: How Language Models Execute In-Context Conditional Rules Across Models and Languages [0.2] 言語モデルは、"if P(x) then A else B" のようなコンテキスト内条件規則に従う。
述語をテストする1つのモジュールと、回答をルーティングするもう1つのモジュールで、ランタイム回路を組み立てますか?
本研究では,2つの交換ルルドナーが条件と解答語が一致しない4つのドナー設計の下で,アクティベーションパッチを用いてこれを探索する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:40:30 GMT)
High-level quantum structured programs as quantum registers compositions [0.2] 現在の量子プログラムは、主に個々の量子ビットに作用する量子ゲートのレベルに設計されている。
この研究は、高レベルな量子構造化プログラミングを実現するための方法論的原則の確立に寄与する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:13:40 GMT)
Accountability Asymmetry and Structural Trust in Autonomous AI Systems [0.2] AIシステムは依然としてエンジニアリングコントロールの対象であるが、その制度的な意味では影響を受けない。
より深い問題は、アクションを選択するコンポーネントではなく、システムに責任を持つ人々や機関に結果が当てはまることです。
そこで本稿では,自律型AIガバナンスをインフラストラクチャの信頼性の問題として扱う。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:47:54 GMT)
Optimal and Deterministic Quantum Search on the Simplex of Complete Graphs [0.1] 完備グラフの単純集合、あるいは一階 truncated simplex 格子(英: First-order truncated simplex lattice)は、M+1$ 同一完全グラフのネットワークである。
このグラフ上で最適量子探索の最初の解析的証明を与え、橋の重みが$M$と等しいときに起こることを証明した。
このアルゴリズムは、重量が$sqrtM$から$M$の間でスケールする場合にも決定論的であり、これは完備グラフの単純点上の量子探索の最初の例である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:00:39 GMT)
SafeCommit: Certifying When Memory-Grounded Agents May Safely Act [0.1] エージェント推論と外部実行の間のリスク制御層であるSafeCommitを紹介する。
コンフォメーションアクション証明書が保持されているすべての世界において、アクションが安全であることを示す場合にのみ、サイドエフェクトフルアクションを許可する。
依存性のない制御シミュレータは、安全ユーティリティのトレードオフを示し、報告されたすべての結果を1つのコマンドで再現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:44:35 GMT)
Intertemporal Preference Steering in Qwen3 via Contrastive Activation Addition [0.1] 大規模言語モデルQwen3-32Bにおける時間的水平方向の線形表現について検討する。
それらを使って、モデルの時間に関する好みや推奨、能力を変えます。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:25:38 GMT)
Physics-informed reduced-order modelling with equivariant spectral submanifolds [0.1] スペクトル部分多様体(SSM)還元は、信頼性のある非線形還元次数モデルへの数学的に原理化された経路として登場した。
我々は,SSMフレームワークの新たな拡張であるeSSM縮小法を導入し,全次モデルの対称性を還元過程に明示的に組み込む。
我々は,これらの対称性を利用して,より高速な計算を実現する,新しい同変SSM削減アルゴリズムを開発した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:30:32 GMT)
ShielDroid: A Hybrid Approach Integrating Machine and Deep Learning for Android Malware Detection [0.1] 本研究では,アプリケーション動作を分析し,複雑なマルウェアを正確に識別・分類するリアルタイムAndroidマルウェア検出フレームワークを提案する。
提案フレームワークは、悪意のあるアプリケーションのタイムリーな検出を可能にし、サイバー攻撃のリスクを低減することにより、モバイルデバイスのセキュリティを高めることができる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:21:51 GMT)
Cavity control of quantum phase transitions in a two-dimensional kondo lattice [0.1] キャビティ量子電磁力学は、閉じ込められた電磁場の真空ゆらぎを用いて量子相を制御する経路を提供する。
特に、極性ファンデルワールス材料に基づく平面キャビティは、強い閉じ込められたモードを生成することができる。
電磁真空揺らぎは強相関の強い2次元近藤材料の制御パラメータを効果的に修正できることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:17:24 GMT)
Analysis of Superradiance-Based Quantum Metrology under Independent Markovian Pure Dephasing [0.1] N$-Spin-Spin-Smble Superradiance を用いた直流磁力計プロトコルが提案された。
この方法は、取得した信号を物理的に増幅し、測定ノイズからの推定誤差を抑制する。
数値シミュレーションと平均場解析を用いて,独立なマルコフ純粋退化がプロトコルに与える影響について検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:34:49 GMT)
The Agent Operating System (AOS): A Reference Operating Architecture for Distributed Agentic Systems [0.0] 本稿では,分散エージェントシステムのためのベンダニュートラル参照オペレーティングシステムであるエージェントオペレーティングシステム(AOS)を提案する。
AOSは既存のフレームワークやインフラの代替としてではなく、異種コンポーネントを管理可能な信頼性、可観測性、相互運用可能なエージェントシステムに構成できる運用アーキテクチャとして提案されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:50:49 GMT)
Unsupervised Adversarial Domain Adaptation for Uterine layer Segmentation: From Labeled Cine to Unlabeled Dynamic EPI MRI [0.0] 我々は, 子宮内膜活動と時間分解T2*変化の同時評価と相関を0.55Tで行うための動的マルチエコ勾配エコーEPIフレームワークを提案する。
14/39例において, ジャンクションゾーン面積とT2*との負の相関が観察され, ジャンクションゾーン収縮と運動に関連する酸素化パターンの初見が得られた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:50:37 GMT)
Why do we need social singularity? A mechanism-based critique of gradual scenarios in AI existential-risk discourse [0.0] 本稿では,近年の段階的かつ累積的なAI存在リスクシナリオを批判する。
実質的な貢献にもかかわらず、それらは社会学的に不十分なままである、と論じている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:30:12 GMT)
When Outputs Disperse, Does Epistemic Revision Follow? A Black-Box Coupling Diagnostic for Machine Collectives [0.0] 我々は,集団知能研究における分散リビジョン結合を運用する。
条件付き不服従は虚偽の前提回復を+17.7ポイント改善することを示す。
介入スタンスシフトと前提保存率を正確さとともに報告することを推奨する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:19:59 GMT)
When AI Wears Many Hats: The Role of Generative Artificial Intelligence in Marketing Education [0.0] ジェネレーティブ・人工知能(GAI)は、ますますマーケティング教育に統合されている。
GAIはマーケティング教育において、チューター、チームメイト、ツールの3つの役割を担っている。
データプライバシ、盗作主義、AIへの依存、評価の公平性といった倫理的考慮事項に対処する必要がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:40:22 GMT)
WIP: LLM Odyssey: A Game-Based Platform for Teaching LLM Engineering Concepts [0.0] このWIP(Work-in-progress)イノベーティブなプラクティスカテゴリは、LLM Odysseyというオープンソースのブラウザベースの本格的なゲームプラットフォームで、LLM(Large Language Model)のエンジニアリング概念を教える。
トークン化、トランスフォーマーアーキテクチャ、プロンプトエンジニアリング、検索拡張生成(RAG)、生産展開といったトピックは、コンピュータサイエンスのカリキュラムでは不足している。
それぞれのゲームには、文献から引き出された5つの教育戦略が含まれており、即時的な形式的フィードバック、近縁開発ゾーンに根ざした足場付きヒント、フロー理論によって知らされる進歩的困難、認知負荷を管理するための例、生産の実践から引き出された真正なシナリオである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:16:18 GMT)
Variable Selection in the Context of AI Fairness [0.0] 本稿では,AIの公平性を評価する数学的アプローチについて論じる。
我々の目的は、より広い倫理的・社会的文脈を理解することの重要性を強調し、公平に対処するための学際的な協力を提唱することである。
この研究は、欧州連合のAI法の目的に沿ったAIシステムの公平性に効果的に対処する上で、学際的な協力の必要性を浮き彫りにしている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 20:36:18 GMT)
To Describe or Construct Statistical Learning Models Using the Category-theoretical Language [0.0] 本稿では,いくつかの古典的統計学習モデルとよく知られたアルゴリズム,特にアマチュア向けについて要約する。
この目的は、基礎数学を含む他の分野の研究者を惹きつけ、統計学習に関する研究に参加することである。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:12:00 GMT)
Tiny Enough to Break In: Agentic Remote Access Trojans Powered by Small Language Models [0.0] 局所展開型小型言語モデル(SLM)を用いたエージェントリモートアクセストロイの木馬(エージェントRTT)について検討する。
SLMはホストとネットワークの観測を解釈し、アクションを選択し、失敗したステップから回復し、外部オペレータへの依存を減らす。
我々は、この小さなモデルが自律的なサイバー意思決定をサポートするかどうかをテストする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:42:43 GMT)
The geometry of absolute separability and other convex matrix properties from spectrum [0.0] 両部類絶対分離状態(mathrmASEP_m,n$)と絶対正部分状態(mathrmAPPT_m,n$)のスペクトルの幾何学的構造について検討する。
我々は、面と極点を$mathrmAPPT_m,n$で完全に特徴づけ、ある行列のランクによって顔の次元が決定されることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:40:14 GMT)
The Transformer Revolution, Part 1: Dynamic Processing through Output- Weight Interconnections [0.0] 我々は、Transformerが推論中にパラメータが生成されるプロンプト依存変換を構築し、適用することを論じる。
Transformerは概念を概念によって変換するシステムとして解釈される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:53:59 GMT)
The LLM Proposes, the Executive Disposes: A Self-Verifying Agent Instrument that Dissociates Commitment Drift from Binding Drift in Long-Horizon Agents [0.0] 本稿では,ポストホックではなく構造的検証を行うためのエージェント機器を提案する。
組織ごとの書き込みエラー、レンダリングサイズ、あるいは塩漬けのカナリアエチョフロアが破られた場合、実行はすべて無効になる。
長期のエージェントが苦しむたびに、クリーンでシングル変数の結果が報告される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:10:37 GMT)
The Ignition Is Real, and It Lives at the Readout: Latent composition, difficulty-clocked ignition, and the interface-constituted commit in a recurrent-depth reasoner [0.0] 我々は、潜時推論モデルで報告される「複合点火」が実計算なのか、楽器の人工物なのか、あるいは言語訓練データから継承されるのかを検証する。
到着時刻は問題深度とともに合法的に上昇し、解像度は鋭く保たれ、シグネチャは2つの同じシードの実現を通して再現される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:35:38 GMT)
The Evolutionary Origin of Values: implications for AI alignment, sentience and existential risk [0.0] LLM(Large Language Models)に基づくAIシステムは、隠された目標を隠蔽したり、人類を支配したり排除したり、あるいは知覚的な存在として苦しむ恐れを喚起している。
生物の進化的価値の起源を辿ることで、これらの懸念に対処する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:09:31 GMT)
Tactus: Open-Vocabulary Object Recognition from Low-Cost Pressure Arrays [0.0] 圧力データのみからテキストクエリに回答するオープンモデルであるTactusを提示する。
187のトレーニング記録、144kの未ラベルの同センサーフレームで事前トレーニングされたマスク付きオートエンコーダ、センサー独自のキャリブレーションアフィン。
重み、コード、モデルがプラグインするメモリ層は、オープンにリリースされる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:08:21 GMT)
TNASS: Tensor Network Active Space Selection with the Entanglement Feature [0.0] 本稿では,エンタングル特徴を用いたネットワークアクティブ空間選択手法を提案する。
我々の方法は、すべての可能な軌道分割の純度を行列積状態として表現する。
その結果、この手法は、他の完全自動選択方式よりも低い基底状態エネルギーとより正確なモーメントをもたらすことが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:29:32 GMT)
Suppressing Cavity Frequency Noise Using a Kerr Nonlinearity [0.0] カーロックは、自己安定化非線形マイクロ波共振器に対する一般的なアプローチを提供する。
このアプローチは、SQUIDベースの共振器、光学デバイス、パラメトリック増幅器など、幅広いシステムに恩恵をもたらす可能性がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:35:29 GMT)
Structured light under turbulence [0.0] 構造化光は、高容量で安全な自由空間光通信のための有望な資源として登場した。
乱流のランダムな作用に対する光ビームの異なる横モード構造のレジリエンスについて検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:02 GMT)
Strategic Evaluation of Planning Strategies for LLM Agents in Cyber-Physical Systems [0.0] 計画誘導制御トラジェクトリを中心に構築されたベンチマークを導入する。
スマートグリッドの需要応答システムにシーケンシャルで階層的で検索エグゼクティブを実装している。
強制探索は5つの基本種子のオラクルであることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:52:21 GMT)
Stochastic Multiple Shooting Trajectory Optimization via Sequential Local Policy Evaluation [0.0] 本稿では,局所的なフィードバックポリシを介して接続された短い制御動作シーケンスを最適化し,サンプル効率と端末セットへの収束性を改善する多重撮影法を提案する。
我々は,システムヤコビアンをロールアウトから純粋に合成できることを示し,ブラックボックス力学を用いたモデルベース強化学習に適した方法を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:43:21 GMT)
Single-molecule strong optomechanical regimes in SERS via hybrid plasmonic cavities [0.0] 共役表面強化ラマン散乱 (SERS) 相互作用は, 共振蛍光分子と金属-誘電体共振器のハイブリッド化によって促進される。
飽和付近の電子遷移を狭帯域ハイブリッドプラズモニックモードで照明することにより、ストークススペクトルとアンチストークススペクトルの高度な分裂を観察する。
我々は、これらの強いオプティメカル相互作用とSERS構成に関連する非古典的特徴を識別できる2階光子相関を計算する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:15:27 GMT)
Sensitivity, Causality, and Repair Dissociate: A Layer-Wise Analysis of Perturbation Robustness and Its Scaling [0.0] 言語モデルが表面摂動入力で失敗すると、"どの層が責任を持つか"は3つの自然な操作を持つことを示す。
スパイク・アンド・プレッシャーと遅延累積の2つの伝播機構を同定する。
4つのモデル(3.8-8B)にまたがる固定ハーネス層は、GSM8Kのコア予測を裏付ける。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:48:55 GMT)
SciRet: A Compute-Aware Empirical Study of Retrieval and Reranking for Scientific RAG [0.0] 我々は,CORD-19上での科学的質問応答に対する検索強化生成をコンピュータに認識した実証研究であるSciRetを紹介した。
我々は, 1,034チャンク (1K論文), 5,160チャンク (5K論文), 15,480チャンク (15K論文) の3つのコーパススケールにわたる固定科学的RAGパイプラインの評価を行った。
これらの設定全体では、ハイブリッド検索はスパースオンリーまたは密度オンリーの検索よりも堅牢で、1Kおよび15Kで1.000のRecall@10に達する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:04:07 GMT)
Scheduling and Routing with Degradation-Triggered Job Arrivals: An Application to Forest Firefighting with an Unmanned Aerial Vehicle Fleet [0.0] 既存のジョブの劣化により新たなジョブが出現する,中間スケジューリングとルーティングの問題を定義する。
我々は、空中森林火災戦の文脈でこの問題に焦点をあてる。
本研究では,山火事が引き起こした地域での価値保持を最大化する混合整数プログラミングモデルを開発する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:41:06 GMT)
Robust Discovery of Coarse-Grained Continuum Equations from Microscopic Dynamics [0.0] 発見方程式の精度は、利用可能なデータ量に強く依存することを示す。
グラウバー・フリップ・イジングモデルでは、選択確率は様々なレベルの複雑性を持つ方程式の階層構造を示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:13:30 GMT)
Revealing Noise in Axial Motion Through Quantum Noise Spectroscopy on a Trapped Ion Processor [0.0] 量子プロセッサのネイティブノイズプロセスは、複数のエラー機構が同じ測定されたコヒーレンスの損失に寄与するため、しばしば分離が困難である。
ここでは、デファシング・ロバスト量子ノイズ分光法を用いて、個別に調整されたトラップイオンプロセッサにおいて、軸運動によって誘導される制御ノイズを特定し、特徴付ける。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:02 GMT)
Resume Means Resume: A Machine-Checked Conformance Contract for Checkpoint, Interrupt, and Resume Semantics in Workflow Persistence Layers [0.0] 広くデプロイされている5つのエージェントワークフローフレームワークは、それぞれ異なる答えだ。
マシンチェック可能なコントラクトは公開しない。
Lang 1.2.9 は秒単位の履歴値を記録し、決して参照しない。
pydantic-graph 1.xは、中間ノードのクラッシュ後に再開できない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:45:31 GMT)
Registry Descriptions Go Stale Unevenly: An 89-Day Measurement of Model Context Protocol Drift, and Why Drift-Ranked Re-Auditing Under-Covers It [0.0] Model Context Protocol (MCP)エコシステムのセキュリティ研究は、設計を共有している。
評価対象の監査がいつまで継続されているかは報告されていない。
我々は、公式MSPレジストリの120の観測を88.6日間にわたって再構築し、3,510から18,966に成長する19,099の異なるサーバをカバーした。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:19:10 GMT)
Reducing Data Movement in the Galerkin Product of Block Algebraic Multigrid on GPUs [0.0] 3Dの弾力性のために、ファインオペレーターは3倍の3倍の3倍の3倍の3倍の3倍の3倍の6倍の6倍の6倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の3倍の幅を持つ。
共有メモリ型カーネルを検索不要なソートスケジュールで提供し、ポータブルなKokkosチームカーネルの半数以下でバイト数を減らした。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:34:29 GMT)
Reconstructing non-Abelian braiding and fusion without anyon transport [0.0] 非アベリアのエノンは、フォールトトレラントで普遍的な量子コンピューティングへのルートを提供する。
時間的に順序付けられたリボン演算に基づく計測専用プロトコルを導入し,実験的に実現する。
我々は,QuantinuumのH2トラップイオンプロセッサ上で,プロトコルの2量子化バージョンを実装した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:01:02 GMT)
Quantum estimates for classical polynomial optimization [0.0] テンソル上の境界を見つける問題は、複雑な風景の動的安定性からデータ解析まで、その応用を考えると困難かつ重要な問題である。
テンソル固有値理論の立場から、質問は与えられた量に対応する係数の最小かつ最大の固有値を見つけることと等価である。
このエッセイでは、Stricharts上の境界を見つけるために、量子力学の変分法にインスパイアされた、全く異なる戦略が導入された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:01:54 GMT)
Quantum Many-Body Metrology of Rotation Sensing with Strong Interactions [0.0] 2つの弱いリンクを持つ準1次元のリングトラップに閉じ込められたいくつかの強い相互作用を持つボソンを用いて、回転センシングの究極の量子限界について検討した。
この強く相関した多体ジャイロスコープの回転に対する最終的な感度を正確に予測するためには, 自己整合多体溶液が必要であることが実証された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:01 GMT)
Quantum Impurities as Probes of Finite-Temperature Fluctuations in Two-Dimensional Bose Gases [0.0] 2次元の量子ガスは、熱ゆらぎの強化、有限サイズ効果、および2体境界状態の形成が本質的に相互作用する特徴的な設定を提供する。
有限で弱い相互作用を持つ2次元ボース気体に浸漬された1つの魅力的な不純物について検討し、そこでは有限サイズが非ゼロ凝縮率を安定化させる。
その結果、魅力的なボースポーラロンは、低次元ボースガス中の有限サイズの熱ゆらぎ、フォノンドレッシング、および境界状態物理学の感度プローブとして機能する可能性が示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:42:20 GMT)
Quantifying Pauli Errors in Single-Photon Resource-State Generation [0.0] 我々は、量子エミッタから生成された単一光子の実験的観測値を用いて、フォトニクスに基づく量子誤差補正におけるパウリ誤差率を算出する。
本研究は, フォールトトレラント核融合型フォトニクス量子コンピューティングにおいて, 量子エミッタから生成する光子の必要な品質を決定するために, 実験的な測定方法を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:40:22 GMT)
Pruned BPE: Post-training Visibility Pruning and Token Reallocation for Byte Pair Encoding [0.0] Pruned BPEは、学習後の可視性とトークンの配置方法である。
マージ構造とモデル可視語彙選択を分離する。
実験により、Pruned BPEは標準BPEと比較してエンコード長を一貫して減少させることが示された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:18:15 GMT)
Protected measurements for protected superconducting qubits [0.0] 0$-$ qubitPromiseのような超伝導量子ビットは、エラー率を著しく抑制する。
ここでは、2つのベースで0$-$ qubitの保護された測定を行う方法を示す。
実験的な進歩が保護量子ビットを低エラー率体制にさらに押し込むにつれ、我々の技術はフォールトトレラントな普遍的な制御に不可欠である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:35:06 GMT)
Preserving Symmetry: Spontaneous Symmetry Breaking through Decoherence [0.0] 多体量子論は、局所化を妨げる翻訳対称モデルを用いて固体を記述する。
このことは、熱力学の限界外において、どのように局所化が起こるかという問題を提起する。
環境を定量化することにより、有限系の局所化がデコヒーレント分岐内で起こることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:30:28 GMT)
Policy Fragmentation or Institutional Alignment? Institutional Governance of AI in Universities and Business Schools [0.0] 本研究は、米国の34州から高等教育(HEI)にまたがるAI政策を分析する。
大学レベルの政策は、データセキュリティとリスク軽減を強調するのに対して、学校レベルの政策は、現在、教育的応用とツールの使用に焦点を当てている。
我々の洞察は、ガイドラインは、規律固有の学習目標に対処し、労働力の要求を進化させながら、より広範な制度政策と整合するべきであることを示唆している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:39:33 GMT)
Photon localization: a comparative study [0.0] 2次元ガウス波パケットを用いて光子局在の異なる測度を比較した。
波動パケットがパッケージの逆運動量-空間幅の数倍の時間で進化した場合には,すべての測定値が合体し始める。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:40:04 GMT)
Paris as a 15-Minute City: An Explainable AI Perspective [0.0] 本研究では,15分間の街が,短い散歩や自転車の乗り込みで日常のサービスへのアクセスを促進する方法について検討する。
本研究では,地域サービス利用率の歩行・サイクリングに基づく指標を構築し,所要時間,輸送モード,短距離車利用との関係について検討する。
グラディエントブーストツリーモデルは、旅行目的、在宅勤務距離、ローカルサービスの可用性、車両の所有、公共交通機関の定期購読、社会デマロジカルコンテキストを重要な予測因子として一貫して識別する、説明可能な機械学習手法で解釈される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:32:20 GMT)
PECR: A Reproducible Specification and Synthetic Stress Test of Telemetry-Informed Vulnerability Prioritization for SD-WAN [0.0] 本稿では,PECR(Predictive Exposure and Cryptographic Readiness)について述べる。
PECRは、9つの正常化された重症度、脅威、到達可能性、および結果要因を組み合わせる。
実際の成果ラベルは使用されないため、予測精度、損失回避、生産効率は確立しない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:30:18 GMT)
Optimising for Flourishing: Flourishing Metrics and Return on Flourishing as Success Criteria for Artificial Intelligence and Post-AGI Economic Systems [0.0] 人類の繁栄は人工知能の主要な成功基準であるべきだと我々は主張する。
Flourishing Metricsは、物理的、感情的、経済的、リレーショナル、スピリチュアル、惑星的ウェルビーイングにまたがるフレームワークを提供する。
第2に、リターン・オン・フロリッシング(RoF)は投資に対するリターンを拡大し、介入、政策、AIシステムの実証的な貢献を評価して繁栄させる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:42:57 GMT)
Open-World Hierarchical Perception: Taxonomic Abstraction over Class-Agnostic Proposals for the Safe Handling of Out-of-Vocabulary Road Objects [0.0] 自律運転のためのクローズドセット検出器は、固定されたラベルのセットの1つにすべてのオブジェクトを割り当てなければならない。
そのセット外のオブジェクトでは、自信はあるが間違った特定のラベルを強制するか、オブジェクトをドロップするしかありません。
本稿では,クラスに依存しない領域の提案の上に分類学的な抽象概念を配置する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:42:29 GMT)
On the missing benchmarks layer and a potential solution [0.0] 本稿では,LatamBoardを最初の地域インスタンスとするEvalsHubを提案する。
オープンでタスクファーストのベンチマークインフラストラクチャで、大学、公共機関、専門的なコミュニティ、企業がモデル間で公開、実行、比較、メンテナンスできる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:26:03 GMT)
On the Non-Specificity of Statistical Measures Used in Script Decipherment [0.0] SIGILは、3000文字のコアコーパスが明示的な構成意味を持つ汎用的な生成エンブレムシステムである。
評価記録54の方法に先立って編纂された文献レジストリは、公開されたIndus結果とソース定義決定ルールの両方を再現できる場合に、正確なスコア付けを行う方法を認める。
SIGILはインダスコーパスと同じカテゴリーを、反復、方向非対称性、語彙分布テストを通じて、この方法で得られた全ての基準で受け取っている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 01:33:02 GMT)
Omega-S: A Functional Resilience Index for LLM Fine-Tuning [0.0] 大規模な言語モデルの微調整は、以前学んだことを劣化させる。
重み行列のみから計算したドロップインペナルティであるOmega-Sを提案する。
既存のトレーニングループには3行あり、ステップのコストに対して4%未満の追加がある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:22:30 GMT)
Offline Ambient-Controlled Latent Diffusion: Architecture, Telemetry, and On-Device Evaluation [0.0] デバイス上で完全に動作し,環境光センサによって駆動されるAndroid潜伏拡散アプリケーションを提案する。
各アウトプットは、それを生成したセンサ読み取り、ランタイムパス、シードにバインドされ、オフライン分析のためのアーティファクトごとの監査パスが提供される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:23:38 GMT)
Non-Relativistic Quantum Electrodynamics of Atoms in a Rotating Ring Cavity [0.0] 第一原理から、非慣性回転環空洞における量子光学モデルを導出する。
回転誘起超微細シフトを含むシステムの回転から追加用語が見つかる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:55:53 GMT)
Non-Destructive Quantification of Urea Adulteration in Bovine Milk Using Transmittance Multispectral Imaging [0.0] ウレアを用いたウシ乳の成体化は、食品の質と健康上の問題である。
本研究は,定量的尿素推定のための実用的,費用効率,精度,検査値に基づくMSI法を提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:33:02 GMT)
NEBULA: A Language - Independent Specification for Opaque Rotating Refresh Tokens [0.0] RFC 9700は、パブリッククライアントに発行されたリフレッシュトークンは、リプレイ(再利用)検出によってすべての使用時にローテーションされるか、あるいは振る舞いに制約されるよう命令する。
我々は、RFC 9700リフレッシュトケンモデルの正確で言語に依存しない仕様であるNEBULAを提示する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:10:55 GMT)
Multimodal Skin Lesion Classification with Swin Transformer and Clinical Metadata Fusion [0.0] 本稿では,Swin Transformerをベースとした画像特徴と構造化された臨床メタデータを組み合わせて診断性能を向上させるマルチモーダル分類フレームワークを提案する。
提案したモデルでは、テスト精度92.55%、マクロF1スコア91.33%を達成し、マイノリティクラスで高い性能を実現している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:16:41 GMT)
Multi-Mode Debugging for FRP-Based Embedded Systems [0.0] Emfrpは、小規模組み込みシステム向けに設計された関数型リアクティブプログラミング言語である。
実際には、EmfrpプログラムはC言語にコンパイルされ、C言語やC++で記述されたプラットフォームに依存したインプット/アウトプットコンポーネントと組み合わせられる。
本稿では, Emfrp ベースの組み込みアプリケーションのためのマルチモードデバッグフレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 22:51:25 GMT)
Mesoscopic Quantum Communication via Photon-Number Moments [0.0] 本稿では,古典光学状態の光子数分布の第1および第2モーメントに情報を符号化する量子通信プロトコルを提案する。
セキュリティは、量子チャネルの信号と共に送信されるツインビーム状態の非古典的な光子数相関に依存する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:11:11 GMT)
Measurement Without Validity: The Compounding Reliability Problem in Agentic AI Evaluation [0.0] エージェントAI評価パイプラインは、デプロイメント決定、安全認定、規制コンプライアンス要求を正当化するベンチマークスコアを生成する。
正式なフレームワークはまだ、これらのパイプラインのステージにおける妥当性の低下を特徴付けていない。
本稿では,タスク生成,人間シミュレーションキャリブレーション,自動判定の3層合成妥当性モデルを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:49:21 GMT)
Matrix Product Evolution: A Method for Simulating Quantum Circuits Using Tensor Networks [0.0] 量子回路のテンソルトレイン表現は、量子ビット指数に沿ってではなく、回路深さに沿って構築される。
この定式化の中で、量子回路のシミュレーションは、複数のMPEテンソルの収縮としてモデル化される。
乱数量子回路のシミュレーションと量子多体状態の時間発展による,このMPEに基づく収縮フレームワークの数値的挙動について検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:07:41 GMT)
MS-MLB: An Open Machine Learning Benchmark for Blood-Based MS Classification [0.0] MS-MLBは、全血液RNA発現データから機械学習に基づくMS研究分類のための再現可能なベンチマークである。
評価には、ネストクロスバリデーション、未タッチの階層化ホールトアウトセット、ブートストラップ信頼区間、ROCと高精度リコール分析、キャリブレーション測定、探索MSリサーチスコアが含まれる。
最後のベンチマークの要約で、グラディエント・ブースティングは、MSリサーチスコアが93.83、AUC-ROCが0.989、感度が0.950、特異性が0.778、F_1$スコアが0.927、ブライアスコアが0.927で、MSリサーチスコアが第1位となった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:20:36 GMT)
MIDAL: A Dataset of Math Image Descriptions for Accessible Learning [0.0] Math Image Descriptions for Accessible Learning (MIDAL)は、複数の教育レベルにまたがる2,020の数学的イメージのデータセットである。
MIDALは視覚言語モデルをトレーニングし、アクセシビリティのベストプラクティスに従って画像記述を作成するために使用することができる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 07:47:28 GMT)
M-GATE: Multilingual Grammar, Accuracy in Translation, and Efficiency Benchmark for Large Language Models [0.0] M-GATE(英語: M-GATE)は、30言語にまたがる言語能力のベンチマークである。
80以上の構成で50以上のモデルを評価しました。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:16:05 GMT)
Local verification cannot detect non-transportability: a cohomological theory of context preservation in agentic reasoning [0.0] エージェントAIシステムは、生物学的、臨床的、財務的な文脈で定期的に結論を伝達する。
局所的検証の新たなセーフガードは構造的に不完全であることを示す。
不均一な精度で歪みを定量化し、正確性を復元する精密な白紙形状を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:09:50 GMT)
Local Uniqueness of the Born Rule on Categories with Complex-Weighted Morphisms [0.0] 私は、複素射を備えた小さな圏の設定において、ボルン則の局所一意性定理を証明する。
ボルン則は、位相不変性や古典的振舞いによってのみ固定された複素振幅上の一意な局所一貫した確率則として現れる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:13:05 GMT)
Lightweight 3D Object Detection via Mamba-Based Knowledge Distillation [0.0] 光検出・測光センサ(LiDAR)を用いた3次元物体検出には,精度と計算効率のバランスが必要である。
既存のLiDARベースの検出手法の多くは、複雑なアーキテクチャを用いて特徴を抽出し、大量のコンテキスト情報を統合して精度を高める。
本稿では,強力な教師モデルから選択的なボクセル空間の特徴アライメントを通じて,オブジェクトレベルのボクセル表現を軽量な学生モデルに伝達する知識蒸留フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:26:23 GMT)
Learning the Word Problem: Geodesic Lengths and Cryptographic Applications [0.0] 本稿では,ワード問題を解くことのできる新しいグラフニューラルネットワークアーキテクチャであるWPNetを紹介する。
WPNetは、Wagner-Magyarik公開鍵暗号システムに対してうまくデプロイされている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:20:47 GMT)
Large Language Models for Low-Resource Languages: A Conceptual Framework for an Electronic Explanatory Dictionary of the Tajik Language [0.0] 形態解析,補題化,セマンティッククラスタリング,辞書エントリ生成のためのモジュールを統合する辞書アーキテクチャを提案する。
この作品の斬新さは、タジク語のための解説辞書の最初の全体論的概念的アーキテクチャの提案にある。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:43:29 GMT)
LLM-based Vulnerability Discovery in Business Process Documentation [0.0] MIRABELLEは、利用可能なビジネスプロセス表現からビジネスロジック(BL)の脆弱性を特定し、特徴付けるシステムである。
本稿では,Large Language Models(LLM)による実験と,MIRABELLEにおけるその役割について述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:01:30 GMT)
LLM-Assisted Review Prioritization for German Statutory Health Insurance Websites: A Multi-Stage Corpus Audit [0.0] ドイツの法定医療保険基金は、継続的な専門家レビュー能力を超えるウェブポートフォリオを発行している。
ジェネリックAIテキスト検出は、医学的、利益的、法的、あるいは編集的レビューのニーズを特定しない。
品質クレームからAI効果信号を分離しながら、実体的レビューのニーズを優先するマルチステージワークフローを特徴付ける。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:42:31 GMT)
Investigating reservoir computing for branch prediction in pipelined processors using emerging CMOS memristor devices [0.0] Reservoir Compute (RC) は、高速な演算とCMOSデジタルロジックとの統合を目的とした実装フレームワークである。
新たなmemristorベースのRC設計フレームワークは、ワークロード要求のコンテキスト内で開発された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:38:42 GMT)
Interplay between teleportation fidelity and basis-independent coherence in maximally sliced states under decoherence [0.0] 環境デコヒーレンスが量子テレポーテーションに与える影響について, 最大スライシング(MS)状態を考慮した検討を行った。
対応する基底非依存コヒーレンスを求め、コヒーレンスとテレポーテーションの忠実度の間に明確な解析的関係を確立する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:06:31 GMT)
Internalising the Identity Primitive: Cryptographic Individuality for an Autonomous Agent on a Public Blockchain [0.0] パブリックブロックチェーン上のソフトウェアエージェントは、権限と経済的所有権を蓄積する。
この論文の中心的な貢献は、エージェントアイデンティティーのキーからウェイトへのバインドに対する信頼の根のシフトである。
我々は、神経ネットワークの重みが秘密鍵の決定論的機能であるエージェントであるSolana devnetを設計し、デプロイする。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:47:13 GMT)
Integration Barriers in Open-Source SSI Frameworks: An Exploratory Developer Experience Probe [0.0] SSI(Self-Sovereign Identity)は、デジタルアイデンティティの分散化を約束するが、統合複雑性とツーリングの未成熟さによって、広く採用されている。
本稿では,オープンソースのSSIツールの開発経験(DX)を探索的研究を通じて調査する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:41:53 GMT)
Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks [0.0] 大規模言語モデル(LLM)は、最近、推論、計画、ツール使用において強力な能力を示し、新しい形の自律エージェントを可能にした。
本稿では,LLM駆動型計画とRLに基づく行動最適化を統合したLLM強化型強化学習エージェントを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:44:07 GMT)
Human Centric Embodied Intelligence for Soft Wearable Robotics [0.0] 本稿では,認知と認知を設計の原動力として位置づけるPCAA(Perception-Cognition-Actuation-Augmentation)フレームワークを紹介する。
この枠組みを用いて、このレビューはソフトマテリアル、ウェアラブルセンシング、人工知能、アクティベーション、人間とロボットの相互作用、デジタル双生児、臨床翻訳、製造、規制、倫理の進歩を合成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:26:14 GMT)
How Closely Do LLM Reviews Align with Human Peer Review? [0.0] 大規模言語モデル(LLM)は、科学的なレビューを生成するためにますます使われている。
OpenAI GPT-5.4, Google Gemini 3.1 Pro Preview, Anthropic Claude Opus 4.6 のレビューと,300のトピックマッチング ICLR 2026 の提出に関する最終決定を比較した。
本研究は,広義およびきめ細かな決定カテゴリとの整合性,推薦スケールの差異,識別された弱点における主題的合意の3つの相補的次元の相互比較分析に寄与する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:39:36 GMT)
HomoEnsNER: Does Language Alignment Outperform Architectural Complexity in Gujarati Named Entity Recognition? [0.0] HomoEnsNERは、5つの独立した微調整されたGujaratiBERTモデルの同質アンサンブルである。
いずれも一貫した予算で訓練され、Naamapadam GujaratiテストスプリットでエンティティレベルのF1を使用して評価された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 04:21:35 GMT)
Gravitational redshift as a quantum channel: modeling the effects of gravitational redshift in quantum optics [0.0] 光の重力周波数シフトは古典的電磁磁気理論においてよく理解されている。
最近の研究は、重力赤方偏移を記述することを目的とした以前に開発されたモデルの矛盾を指摘した。
2つ目のアプローチは、マルチモード伝送装置における赤方偏移を量子チャネルとしてモデル化できることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:22:07 GMT)
Geometric-Symmetry Logical Gate and Local-Probe Selectivity in the Three-Leg AKLT Ladder [0.0] そこで我々は, 3脚のAffleck-Kennedy-Lieb-Tasaki ladderを, オンサイト対称性を持つ, 正確に解けるSPTシステムとして検討した。
連続的な$SO(3)$対称性は境界回転を誘導し、一方脚交換対称性はエッジ量子ビットの幾何学依存的な論理置換を生成する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:04:13 GMT)
Generation and Enhancement of Bipartite and Tripartite Entanglement in an Electro-Optomechanical Ring Cavity [0.0] 電気光学式リングキャビティシステムにおける量子エンタングルメントの発生と向上について検討する。
絡み合いの強さはいくつかのパラメータに非常に敏感であり,OPAの利得と位相の戦略的選択によって最適化できることがわかった。
これらの知見は、量子技術における多部絡み制御のための多目的プラットフォームとしてのハイブリッドシステムの可能性を浮き彫りにしている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:33:45 GMT)
GenOS: Compositional Certificates for Semantic Robustness in AI Code Generation [0.0] GenOSはプロンプト、コントラクト、ジェネレータ、プログラムを置き換える確率論的操作意味論である。
等価性に適合するカーネルは商類に従属し、商化の可換性は分布拡大や逐次合成と一致することを証明する。
また,音の検証,全変量非拡張性,付加的境界の下でのワークフロー・バイコミットの安全性を確立した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:42:11 GMT)
From Understanding to Resonance: A Case Study of Quantum Music and Embodied Science Communication [0.0] この実践 Insightは、国際量子科学・技術年において実施される2つのイニシアチブ:日本における量子フェストとドイツにおける量子100。
感覚の浸漬と心理的障壁の低減、集団的な意味形成、そして変化的エンゲージメントの3つの次元を識別する。
この結果は、共振駆動のアプローチは、聴衆が科学と有意義な関係を前、後、あるいは概念的理解を超えて形成できるようにすることによって、説明中心の科学コミュニケーションを補完する可能性があることを示唆している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:15:39 GMT)
From Financial Sentiment Classification to Return Predictability: A QLoRA Benchmark of Large Language Models [0.0] 5つの財務テキストデータセットから3クラスを統一したベンチマークを構築した。
TF-IDF Naive Bayes,off-the-the-shelf FinBERT,Financial-RoBERTaエンコーダを比較した。
一時分離した2019 Benzingaサンプルの経済妥当性を評価した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:57:40 GMT)
ForgettingOT: Certified Speculative Batching from Sinkhorn's Projective Forgetting [0.0] 固定点ヤコビアン$J_tstar=QP=Pstar P$ の固有モードが厳密な補正テールを制御することを示す。
ForgettingOTは、この非線形ペロン-フロベニウスの事実をシンクホーン問題のストリームの認定執行者に変える。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:22:28 GMT)
Fidelity-Based Robustness Margins for Finite-Time Quantum Control [0.0] 我々は,有限次元閉量子系に対する一括一貫したコヒーレント制御の下で,構造特異的忠実度閾値のマージンを開発する。
この証明書の更新により、第1のフィデリティ・閾値境界に向かって安全なステップを踏む反復的な一次元法が生み出される。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:01:42 GMT)
Few-photon degenerate parametric resonance in a two-tone driven microwave resonator [0.0] マルチトーン外部駆動は、デバイスを直接変調することなくパラメトリック物理学への経路を提供する。
数光子状態におけるパラメトリック応答の妥当性はいまだ検討されていない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:11:43 GMT)
Feasibility of Embedded Photoplethysmography Sensing in Short-Duration Tactile Interactions With Pocket-Sized Robots Using IMU- and Confidence-Based Filtering [0.0] 本稿では,ポケットサイズのコンパニオンロボットであるAffectathyに直接組込み型フォトプレシーセンサ(Pocket)を組み込むことについて検討する。
2段階のフィルタリングパイプラインを実装することで、ハンドヘルドの使用に固有の動作アーティファクトの重大な課題に対処する。
以上の結果から, フィルタリング手法により平均絶対値の誤差が大幅に減少し, 実測値と統計的に等価であることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:51:12 GMT)
Factorization of Exclusive-Sum-Of-Products Expressions with Rectangle Covering to Reduce Quantum Circuit Cost [0.0] これらのアルゴリズムを実装した2つのPythonプログラムをテストし、よく知られたベンチマークを用いて評価した。
その結果、古典論理回路で使われるリテラル数と量子回路で使用されるMaslovコストの両方が、表現サイズによって20%-95%削減された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:30:34 GMT)
FACTWASH: Catching AI Rewrites That Wash Hearsay into Fact [0.0] AIシステムは情報を常に書き直す:会話が記憶される記憶となり、ドキュメントが答えになる。
私たちはファクト・ウォッシングと呼んでいる。これはオープンソースのライトタイム・ゲートで、判断的にそれをキャッチし、裁判官ではなく、名前のついた旗や証拠を持っています。
コストの安いチェックはいつ,モデルが必要なのか?
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:20:54 GMT)
Exploiting Separability in Multi-Scale Grey-Box Bayesian Optimization [0.0] 決定変数が自然にブラックボックス変数とホワイトボックス変数に分割する最適化問題を考察する。
ブラックボックス変数のみの関数として目的を最適化する外部ベイズ最適化(BO)と、グローバル最適化によるホワイトボックスサブプロブレムを内部問題として、この分離性を利用する。
13のベンチマーク問題スイートでは、双方向BOは、繰り返しや壁時計の時間を少なくして、より少ない後悔を達成している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:53:54 GMT)
Exact Tradeoff Between Quantum Error Correction and Quantum Darwinism: An Information-Theoretic No-Go Theorem [0.0] 量子誤り訂正(QEC)と量子ダーウィン主義(Quantum Darwinism)は、システム環境相互作用の反対の結果を記述している。
我々はShor[[9,1,3]]量子誤り訂正符号の論理的GHZブロックに基づく、正確に解決可能なブロック環境モデルを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:11:19 GMT)
Evidence-Grounded Multimodal Knowledge Graph Construction for Multi-Lecture Educational Reasoning [0.0] 本稿では,講義の書き起こしを行うエビデンス型マルチモーダルパイプラインを提案する。
3つのニューラルネットワークの講義で、パイプラインは3,118フレーム、756の転写セグメント、559のアンカーを処理した。
1,022のコンセプトと312のリレーションシップを保持し、172の標準概念と282のリレーションシップと90.38%のエンドポイントカバレッジを実現した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:48:05 GMT)
Entanglement entropy of fermions in a strange metal [0.0] 本研究では, 大容量N$1D格子モデルにおけるフェルミオンの絡み合いエントロピーを, 湯川-サハデフ-イ・キタエフモデル(湯川SYK)モデルに類似して検討した。
熱エントロピーからエンタングルメントエントロピーへのクロスオーバーは、異なるサブリージョンサイズと温度のフェルミオンの第2レニイエントロピーを1つの普遍曲線に崩壊させる1つのスケーリングアンサッツによって捕捉されることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:06 GMT)
EA-Graph: Artifact-Anchored Verification Memory for Coding Agents under Upstream Drift [0.0] アップストリームの変更の後、以前の検証のクレームがもはや有効ではないにもかかわらず、レポジトリは引き続き構築される可能性がある。
EA-Graphは、検証のためのアーティファクトアンコールメモリである。
それは、サブパスの粒度で人工物を表し、葉の定義にエイリアスを解決し、それを確立するために使用されるコンテンツに対する各主張をアンカーし、鮮度とは別個の証拠強度を保持する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:13:32 GMT)
Dual-domain U-Nets with embedded back projection operators for motion-resolved 4D CBCT reconstruction [0.0] そこで本研究では,従来のフリーブレススキャンによる4次元CBCT再構成の深層学習法を提案する。
我々のCNNは3次元CBCTプロジェクションを入力とし、最大吸入時の静体積を予測する。
臨床検査では, 従来の再建法に比べ, より鋭い動的構造(横隔膜など)とより少ない運動ストリークアーチファクトがみられた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:20:07 GMT)
Distributed Phase Sensing with Multiphoton States in Optical Interferometry [0.0] 線形光ネットワークを介して数列交絡状態に進化する分離可能な光子入力を用いた干渉計測位相推定について検討する。
ゼロ位相における古典的フィッシャー情報に対する単純な解析式は任意の$N$-光子状態に対して導出される。
真空揺らぎは局所的な二次的な測定を根本的に制限する一方、非局所的な光子数解法は損失誘起感度劣化を緩和するために多光子干渉を利用する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 00:28:56 GMT)
Distractor-Aware Truncation: Disentangling Context-Length Effects from Signal Loss in Long-Context LLM Benchmarks [0.0] 検索強化およびメモリ拡張言語モデルに関する文献における標準的な主張は、関連する情報が保存されている場合、より短いコンテキストの方が優れているということである。
この主張は、4つのコンテキスト保持率で2つの長いコンテキストベンチマークのすべてのサンプルを実行することで検証する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 08:08:04 GMT)
Distilled Roads: Generalisable Road Network Extraction Across Sensors, Resolutions, and Region [0.0] 既存のモデルは、通常、狭い解像度-領域の組み合わせで訓練され、目に見えない環境にあまり一般化しない。
本枠組みは, 解像度向上カリキュラム, マルチセンサトレーニング, トポロジ・アウェア・インフォメーションにまたがるクロスレゾリューション知識の蒸留と組み合わせたものである。
以上の結果から,様々な衛星画像に対するロバスト性の向上は,目標とするトレーニング戦略によって達成できることが示唆された。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:01:30 GMT)
Disentangling Language Modeling and Boundaries [0.0] バイトレベルの言語モデルは通常、堅牢性、多言語的公正性、文字レベルのスキルという観点から議論される。
彼らはバイトを読み書きするため、2つともアウトプットスペースを共有します。
コミュニティは、共有標準としてバイトレベルのインターフェースに移行するべきだ、と私たちは主張する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:51:21 GMT)
Detecting and Discriminating Operator Misspecification in Hybrid PDE-Parameter Learning: a Reference-Free Instrument, with Discrimination Bounded In Sample [0.0] 私たちは1つのフィットから読み取る楽器を作り、オラクルは持っていません。
回復時に神経推定器がTikhonov-regularized inversionに負ける、事前登録された負の機器である、装置の盲点を報告する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 21:20:44 GMT)
Detecting Hallucinations and Recovering Verified Answers in Arabic Islamic Question Answering [0.0] 本稿では,2026 Task 2.1, textitIslamic Hallucination Detection and Find the Truthを提案する。
このタスクには、LLMによって生成されたアラビア回答が幻覚されているかどうかを判断し、6つの密接に関連する候補オプションから検証された回答を選択するという、統合された2段階の予測が必要である。
このシステムは,幻覚検出のためのマクロF1スコア0.928とラベル精度0.935と,回答選択のためのオプション精度0.895を達成している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:19:53 GMT)
Delay Attacks on the German Smart Metering Infrastructure: A Security Analysis of CLS Channel Timing Constraints [0.0] この研究は、ドイツスマートメータリングインフラ(SMI)の制御可能ローカルシステム()チャネルを介して伝送される制御信号に対する遅延攻撃の可能性を分析する。
識別された攻撃ベクトルが複数のCLSチャネルで同時に利用される場合、パワーグリッドに対する潜在的な影響を評価する。
また、SMGWの設定制限、実装レベルの変更、プロトコル拡張など、緩和戦略の概要を述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:43:02 GMT)
DS@GT-ARC at eRisk 2026 Task 3: Sparse, Semantic, and LLM Reranking for ADHD Symptom Sentences [0.0] 本稿ではeRisk 2026 Task 3, ADHDsymptom Sentence Rankingについて述べる。
このタスクは、アダルトADHD自己申告尺度(ASRS-v1.1)の18の症状のそれぞれの関連性に応じて、Reddit候補の文章をランク付けするシステムを必要とする。
本システムでは,スパースBM25検索,自己参照症状報告のためのエビデンス・アウェア・リスコア,埋め込み型リグレード,クエリ-プロトタイプ拡張,LLMベースのリグレードを組み合わせる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:19:22 GMT)
Cross-Layer Interaction under Weight-Space Ablation: A Closed-Form Attention Jacobian Bound and a Test on a Real Pretrained Model [0.0] 本稿では, 理想化モデルにおいて, 活性化パッチと重み空間のアブレーションが一致する場合について検討する。
これは、正規化のみを減らし、ヘッドも減らせば二階境界となる、正確な一階相互作用公式を導出する。
本論文は,両限界を超えて結果を拡張し,まず,複数の層を切断するキャリアからの相互作用を,正確に同じブロック項に分解する。
第二に、残りの部分は2つの層に対して、混合二階微分の二重積分として正確に分離し、それを束縛するために必要な欠成分を、注意サブブロックに対するヤコビアン境界(Jacobian bound for the attention sub-block)と呼ぶ。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:14:55 GMT)
Contextuality in Sequential State Discrimination [0.0] 文脈性が不明瞭かつ最小限の誤り判別の逐次バージョンにおいてどのような役割を果たすかを考える。
文脈性の存在は、どの状態が準備されているか、および選択されたプロトコル(曖昧または最小エラー)に依存することを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:07 GMT)
ConformalShift: Targeted Event Reordering Against Adaptive ECG Monitoring [0.0] 適応型コンフォメーション予測は、ポイント分類器によって欠落した臨床的に重要な心拍クラスを回復することができる。
ConformalShift(コンフォーマルシフト)は、救助イベントの心室クラスを抑止する境界イベントリオーダリングアタックである。
医療における適応モニターは、正確な情報のタイミングによって妥協できることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:14:47 GMT)
Coarse-Graining and the Classification of Long-Range Correlations in Quantum Field Theory [0.0] 量子場理論における粗粒度演算の実行のための保存法則誘導分類フレームワークを開発した。
注入項の無効化と単一気泡寄与の兆候は、分類の定義基準である。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:38:04 GMT)
Characterizing pairwise swapping capabilities of dense coding channels [0.0] 本稿では,高密度符号化スワップと呼ばれる,多部共役型古典的コミュニケーションタスクを提案する。
このスキームは、ネットワーク内の非ターゲットブランチに対して、ターゲットペアの高密度な符号化性を同時に低減する。
我々は,DCスワップをサポートするマルチパーティント状態は,少数の真のマルチパーティント絡みを必要とせず,この要求はシステムサイズの増加とともに減少することを示した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 06:22:22 GMT)
CURATE: Leveraging LLM Agents to Compose, Catalog, and Deploy Reproducible Workflows [0.0] 既存のコーディングエージェントは主にコード生成に重点を置いており、デプロイメントや共有を含むワークフローライフサイクル全体に対処していない。
CURATE - composition, User-in-the-loop, Reuse, and Automated Task Execution - a novel human-in-the-loop multi-agent system。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 23:01:29 GMT)
CUDA MPC: A GPU-Native Solver for Model Predictive Control [0.0] モデル予測制御(MPC)は、高速なダイナミックス、高次元モデル、あるいは長い水平線を持つシステムに制約対応制御を提供する。
本稿では,ハードウェアの最適化アルゴリズム,実行モデル,メモリアーキテクチャを共同設計したGPUネイティブなMPCフレームワークであるMPCを紹介する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 03:02:04 GMT)
CPrefix: A Combinatorial Tensor Framework for Structured Discrete Color Mappings [0.0] CPrefixは、統一テンソルフレームワーク内で実現された離散写像の観測可能な表現である。
このフレームワークはICCディスプレイとプリンタのプロファイルに潜伏した再構築と知覚的輸送を通じて検証されている。
これは、カラーイメージング、スペクトル測定、その他の離散系から生じる構造的マルチチャネルマッピングに適用できる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:04:27 GMT)
Breakdown of Monotonic Impurity Entropy Flow in $\mathscr{PT}$-Symmetric Multichannel Kondo Systems [0.0] 伝導電子チャネルに結合した1対のスピン=$frac12$不純物からなる非エルミートコンドモデルについて検討する。
正確なBethe Ansatz解は、4つの不純物相を示す: オーバースクリーンコンド、ゼロモード、Yu-Shiba--Rusinov (YSR)、局所モーメント。
RG の可逆性、したがって一般化された Affleck--Ludwig $g$-theorem は、近藤相を通して存続する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:01 GMT)
Bimodal non-Gaussian photonic states from a single quantum emitter in a waveguide [0.0] 我々は, キラル導波路に結合した単一2レベル系を用いて, 決定論的および非ガウス的光状態の生成について検討した。
コヒーレントな入力パルスに対して、エミッタは有限ランクであるにもかかわらず、決定論的にウィグナー負の状態を生成することができることを示す。
その結果,この相互作用は,大きめのネコ状態を含む高星級状態を実験的に抽出できるバイモーダル非ガウス状態を生成することがわかった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:39:27 GMT)
Beyond the Gegenbauer Paradigm: q-Orthogonal Kernels for Machine Learning [0.0] 変形パラメータ$q$で古典的エルミートスケーリングを一般化する$q$-orthogonalsのクラスを導入する。
我々の結果は、$q$-orthogonalsが実用的な機械学習アプリケーションによるカーネル設計の有望な方向性であることを確認した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:18:28 GMT)
Beyond Compliance: A Proposed Framework for Ethical Governance of Student Data in Learning Analytics [0.0] 本稿では,LAにおける学生データの倫理的ガバナンスのためのLEAGUEフレームワークを提案する。
その実践的価値は、組織がより透明で教育的に意味のある方法で学習分析をレビューする方法を示す、説明的な早期警戒ケースを通じて実証されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:34:29 GMT)
Beyond Accuracy: A Multidimensional Evaluation of Statistical Reasoning in Large Language Models [0.0] 本研究では,応答精度,応答挙動,構造的トピックモデリング,語彙的類似性解析を組み合わせることで,多次元評価の価値を実証する。
精度は55%から78%の範囲で大きく異なっていた。
同じベンダーによって開発されたモデルは、異なるベンダーのモデルと少し似ている説明を生み出した。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 02:40:22 GMT)
Behaviorally Adaptive Visual Diversion for Inclusive and Resilient Digital Assessment Delivery [0.0] 本稿では、合成非意味的視野を評価内容と合成する理論的枠組みである行動適応型視覚変換(BAVD)を紹介する。
BAVDにはアクセシビリティを意識したメカニズムが組み込まれており、承認された視覚処理施設を持つ候補者のディバージョン強度を減少または抑制する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:13:25 GMT)
BanglaWild: An In-the-Wild Bengali Scene Text Recognition Benchmark for OCR and Vision-Language Models [0.0] ベンガルの2,535のシーンテキスト画像のベンチマークであるBANGLAWILDを紹介する。
15個のVLMと3つの従来のOCRシステムの評価を行った。
以上の結果から,同族内の大モデルがより小さいモデルよりも優れていないという,永続的なギャップが明らかとなった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:20:53 GMT)
Autoreflection: How Agentic Strange Loops Turn Human Culture into AI Infrastructure [0.0] このアーキテクチャは、私がオートリフレクションと呼ぶ能力を生み出します。
私はこのコンセプトを、AIエージェントのためのソーシャルプラットフォームであるMoltbookの最初の12日間に対してテストしました。
ヒトの操り人形を除外する機械シグネチャを持つ3人のエージェントのケーススタディについて述べる。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 15:14:50 GMT)
Asking Questions the Right Way: A Multi-Agent Conversational System for Prompt Formulation in Complex Task Resolution [0.0] 大規模言語モデル(LLM)は複雑な知的タスクに不可欠なものであるが、出力品質はユーザが提供するプロンプトによって制約される。
本研究では,非構造化クエリを構造化プロンプトに変換する8つのエージェントのエージェント対話インタフェースPAWNIを提案する。
また、Essential、Extension、Elevationのカテゴリにまたがる18のプロンプト要素からなる3層フレームワークを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:28:54 GMT)
Applications of Spin-Dependent Generalized Squeezing in Hybrid Spin-Oscillator Quantum Processors [0.0] 一般化されたスクイージング相互作用は、最近、ハイブリッドスピンオシレータ量子プロセッサで実験的に制御されている。
これらの相互作用は、離散および連続可変量子情報の処理における新しい応用の扉を開く。
この研究は、高速で高忠実で連続可変な量子計算と、一般化されたスキーズによるハイブリッドスピンオシレータプラットフォームでのセンシングの基礎を提供する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 19:56:00 GMT)
An optical-fibre-integrated buffer for packet-switched quantum networks [0.0] パケットスイッチングされた量子ネットワークは、ルーティング情報がリアルタイムで読み出される間、キュービットペイロードを遅延させるバッファを必要とする。
これまでのアプローチでは、通信インフラと互換性のある完全なファイバー統合アーキテクチャでは、この機能を提供していなかった。
本稿では, パケットヘッダの読み出しにより, 偏光符号化されたキュービットペイロードの記憶時間を決定できる光ファイバー集積バッファを, 再循環ループとファイバストレージラインに基づいて示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 18:00:03 GMT)
Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation [0.0] Role-Playing Language Agents (RPLA) は、ハイテイクなアプリケーションにますます多くデプロイされている。
既存の評価アプローチは静的ベンチマークや孤立したシングルターンプロンプトに依存している。
本稿では,マルチターン対話による対向的ストレステストRPLAのためのモジュール型マルチエージェントプラットフォームを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 05:54:32 GMT)
AI-Based Sound Effect Generation: A Narrative Review of Generative Models Across Input Modalities [0.0] この章は、音響効果合成のための最近のAIベースの生成モデルをレビューし分析する。
Google Scholar、IEEE Xplore、ACM Digital Libraryからソースされた30のピアレビュー記事を調べている。
その結果、複数のモデルが最先端の性能を達成し、高い忠実度、意味的整合性、時間的コヒーレントな音効果をタスク全体で生み出すことができた。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 14:36:34 GMT)
AI World Cup 2026: Benchmarking Large Language Models for End-to-End Football Tournament Prediction [0.0] 本報告では,2026年FIFAワールドカップ全体について,10名のアシスタントが1回の予報を行ったEmphAI World Cupベンチマークを報告する。
予測では、グループステージスコア、グループランキング、ノックアウトブラケット、最終配置、信頼性値、短い説明がカバーされた。
GPT-5.5は744点、GPT-5.5は717点、ジェミニは699点、Qwen 3.7は687点であった。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 10:07:14 GMT)
ADMITBench: A Safety-Governed Reference Framework for Evaluating the Admissibility of Industrial LLM Advisories [0.0] このフレームワークは、バージョン管理された安全管理された評価契約を実装している。
利用可能な証拠によって推奨が支持されるかどうかをチェックする。
これは、評価者、モデル、または植物が安全確認されたという意味ではない。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:07:56 GMT)
ACEM: A Cost Estimation Model for Agentic Software Engineering [0.0] 本稿では,エージェント開発総コストを3つの付加次元に分解するACEM(Agentic Cost Estimation Model)を提案する。
ACEMはエージェントダイナミクスのための3つの構成要素を紹介している。Revision Factor (RF)、出力の拒絶と再試行からトークンのオーバーヘッドをモデル化するContext Factor (CF)、コンテキストの蓄積に伴ってトークンの消費が上昇するのをキャプチャする HITL Intensity Score (HIS)、そして4段階の監視分類スキームであるHITL Intensity Score (HIS)である。
アーリーステージの提案として、研究コミュニティに実際のプロジェクトデータを通じてモデルを調整、テスト、拡張するよう呼びかけている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 09:05:27 GMT)
A machine-readable catalogue of the Tsiolkovsky papers (fond 555, Archive of the Russian Academy of Sciences), and a way to measure how well its handwriting can be read [0.0] コンスタンチン・ツィオルコフスキーの個人アーカイブはロシア科学アカデミーのアーカイブ555として保存されている。
本稿では,2,019ファイルと51,008スキャンの機械可読カタログについて述べる。
根拠のないアーカイブで手書き文字認識の精度を測定する方法が報告されている。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:08:03 GMT)
A lower bound on the classical simulation cost of star-network correlations [0.0] 恒星ネットワークに分散した量子系における連成測定から生じる相関関係の量子通信複雑性について検討する。
十分多くの量子ビット上でのジョイント測定の統計を再現するために、量子ビットの有限サイズの古典的な記述は存在しないことを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 17:51:05 GMT)
A fully nonlinear structural vector autoregressive model identified via independent innovation analysis [0.0] 完全に非線形な構造ベクトル自己回帰フレームワークを開発する。
任意のコンポーネント単位の可逆変換までの衝撃を識別する。
次に、その識別が、置換や成分的変化によってさらに強化されていることを示す。
経験的応用は、アメリカの工業生産が真の原油価格ショックに対する反応の対称性を研究している。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:22:35 GMT)
A Theory of Conditional Collapse under Low-Rank Weight-Space Ablations: I. The Single-Block Theory and Synthetic Validation [0.0] アクティベーションパッチと重み空間のアブレーションはどちらも、コンポーネントが振舞いに対して因果的に責任があると主張しているが、それらは異なるオブジェクトに作用する。
本研究では,残差ストリームを通じて条件計算を付加的に行う理想モデルについて検討する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 13:10:19 GMT)
A Standard Quantum Mechanical Treatment to Rationalize the Delayed-Choice Quantum Eraser [0.0] どちらの経路と消去検出器を選択するかは単に測定基地の選択であり、光子の過去を書き換えるものではないことを示す。
本論では, 因果関係の錯覚は不当な質問から生じるものであり, 論理学を説明するのに十分な前向きな記述であることを示す。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:44:56 GMT)
A Physics-Flavored Transformer Network for Parametrizing Contraction Dynamics of Engineered Skeletal Muscle Tissues [0.0] 本稿では,ESMの運動的表現型化を自動化する物理拡散ニューラルネットワーク(PFNN)を提案する。
提案アーキテクチャでは,拡張可能な物理モデルをCNN変換器に統合し,物理的に意味のあるパラメータの抽出を可能にする。
提案手法は, 種々の収縮性表現型および細胞株にまたがる高忠実度パラメータ化を実現する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 16:59:30 GMT)
A New Theory of Value for Post-AGI Economics [0.0] 本稿では,ポストAGI経済学の基礎としてFlourishing Value Theory(FVT)を開発する。
社会価値を多次元・代理保存・再生・非補償として重要なしきい値で扱う。
Flourishing Metrics and Return on Flourishing (RoF)上に構築されており、企業、政府、仕事の移行、AIガバナンス、国家会計のための階層化されたアーキテクチャを提案する。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 11:39:31 GMT)
A Challenge-Nonce Freshness Gap in Project Veraison's TPM Reference Schemes, Found by Appraising Application-Layer Action Evidence End-to-End [0.0] 以前の研究では、このレコードをIETF Remote Attestation procedures (RATS)アーキテクチャの下でアプリケーション層エビデンスとして扱うことを提案した。
我々は、エミュレートされたソフトウェアTPMで生成されたAEP引用を、コンフォーマントなProject Veraison RATS Verifierを通してエンドツーエンドに駆動する。
正確に、アップストリーム可能な2つの部分の修正を行い、エンドツーエンドで検証します。
論文参考訳(メタデータ) (Tue, 04 Aug 2026 12:14:39 GMT)