Boogu-Image-0.1: Boosting Open Agentic Multimodal Generation via Understanding under a Minimal Budget [110.7] 本稿では,オープンソースの統合マルチモーダル理解・生成モデルファミリであるBoogu-Image-0.1を紹介する。
高品質なテキスト画像生成、高速推論、命令ベースの編集、バイリンガル(中国語)テキストレンダリングにおいて、競争力のあるパフォーマンスを提供する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 17:28:17 GMT)
Multi-Dimensional Quality Assessment for AI-Generated Human-Centric Videos: Dataset and Model [95.0] HVEval+はAIが生成する人間中心ビデオの総合的品質評価データセットとしては最大である。
MoE-Raterは、Mixture-of-Experts (MoE)にインスパイアされたマルチモーダルな大規模言語モデル(MLLM)ベースのオールインワン方式である。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:04:18 GMT)
UniNDM: A Unified Noise-driven Detection and Mitigation Framework Against Sexual Content in Text-to-Image Generation [90.1] 本稿では,拡散過程におけるノイズダイナミクスのレンズを通して,安全機構を再考する統合ノイズ駆動フレームワークを提案する。
我々の重要な洞察は、早期の予測ノイズは、正常な内容と性的な内容の間に固有の分離性を示すことである。
我々は,計算オーバーヘッドがほとんどなく,精度の高い軽量ノイズベース検出器を開発した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 14:03:39 GMT)
Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning [82.3] オープンでコミュニティ指向のエゴセントリックな操作と,キャプチャからモデルトレーニングまでのツール中心のパイプラインであるOpen-AoEを紹介します。
最初のリリースでは、400以上のスマートフォンを使用して500以上の自然環境で収集された約2000時間のビデオが含まれている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:02:02 GMT)
SPARE-GS: Structural Parsimony and Resource Efficiency for 3D Gaussian Splatting [70.5] 3次元ガウス散乱(3DGS)は,高忠実な新規ビュー合成を実現する。
しかし、その訓練効率と表現のコンパクトさは、過剰な原始的な増殖によって妨げられている。
SPARE-GSは3次元ガウス原始体の分布を局所的な表現要求に動的に整合させるフレームワークである。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:55:12 GMT)
Environment-free Synthetic Data Generation for API-Calling Agents [69.0] API呼び出し大型言語モデル(LLM)エージェントの訓練には、大量の高品質なトラジェクトリが必要である。
本研究では,LLMをオンザフライデジタルワールドモデルとして活用する環境不要な合成データ生成手法を提案する。
我々は,情報検索タスクと状態変更タスクの両方を含む,挑戦的なAppWorldとOfficeBenchベンチマークに対するアプローチを評価した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 17:36:44 GMT)
CNS-Edit++: Category-Agnostic 3D Editing with Coupled Neural Shape Representation [65.2] ニューラル形状表現とニューラル特徴量最適化を組み合わせた潜在空間3次元形状編集フレームワークを提案する。
我々のフレームワークは、カテゴリ固有の3Dインバージョンモデルとカテゴリに依存しない3D基盤モデルの両方でインスタンス化することができる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 01:29:50 GMT)
Model-Driven Discipline for Multi-Agent LLMs: Requirement-to-Verification Generation of Traceable System Models [62.6] RADIANTは、MDEとMulti-Agent Large Language Modelを組み合わせたエンジニアリング方法論である。
工学的なフェーズにまたがる異種モデルを自動的に生成する。
正確かつ自動的な変更インパクト分析を提供する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 08:50:55 GMT)
Training Continuous Chain of Thought Models: A Tale of Two Regimes [39.8] 連続チェイン・オブ・ソート法は、冗長な推論トレースを、密度の高い潜在表現の短い列に置き換える。
C-MTPは、圧縮対象のCoTトレースへの埋め込みの平均として、各遅延をモデル化する、よりシンプルで高速な直接監督手法である。
我々は、連続CoT法の評価を、より長い推論トレースを持つ複雑なタスクに拡張する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 21:32:06 GMT)
From Memory to Skills: Evidence-Grounded Co-Evolution Governance for Long-Horizon LLM Agents [38.9] MSCEはエージェント体験を、基盤となるステップトレース、再利用可能な手続きポリシー、宣言的環境認知に整理する。
証拠に支えられたL2ポリシーを、証拠リンク、適用可能性境界、意思決定ガイダンス、検証ルール、信頼性推定を保持する呼び出し可能なスキルに肯定的なゲインで結晶化する。
EvoAgentBenchとLoCoMoの実験では、MSCEは最先端のスキル強化とメモリ駆動のエージェントベースラインを大きく上回っている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:46:22 GMT)
Group Entropy-Controlled Policy Optimization [38.4] Group Entropy-Controlled Policy Optimization (GEPO) は、グループエントロピーを用いてエントロピー条件の非対称な有利な整形を行うGRPOの軽量拡張である。
GEPOは低エントロピー群の正の利点を減らし、過剰な露光を減らし、高エントロピー群の負の利点を減らし、探索を維持する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 15:13:33 GMT)
TopoTuner: Topological Finetuning of Large Language Models [36.5] TopoTunerは、注意投影行列の選択的凍結のためのトポロジー誘導微調整フレームワークである。
TopoTunerはソースデータセットから再利用可能な凍結プロファイルを学び、ドメイン外のデータセット上で効率的に微調整モデルに転送する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 04:50:23 GMT)
Hierarchical Wireless Foundation Model for Multi-Task Optimization [34.8] マルチタスク最適化のための階層型無線基礎モデル(WFM)を提案する。
提案するWFMは,高忠実度チャネル表現を学習し,競合するマルチタスク最適化性能を実現する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 16:30:23 GMT)
Test-Time Coverage: Test-Conditioned Data Curation for Deployment-Aware Learning [32.5] TTCovは、モデル重みを推論時に更新するのではなく、トレーニング前にテストサイド情報を使用する、データレベルのテスト条件付きキュレーション手法である。
我々は、TTCovを自律運転(AD)に適用し、より多くのデプロイメント関連カバレッジを持つデータを選択しながら、推論パスの適応を保ちます。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 00:28:57 GMT)
From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence [32.5] 本稿では,画像,ビデオ,テキストなど,あらゆる観察をアトミックな命題の袋として表現するマルチモーダルデータに対する言語表現を提案する。
グローバルセマンティックコードブックはこれらを標準原子命題の共通語彙に統一する。
自動運転とオープンワールドデータに関するフレームワークを実演する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 00:08:47 GMT)
A Position Paper on Recommender Systems in the Era of Autonomous Agents [32.4] 本稿では,従来の人間中心型RecSys研究の知見を概観し,このハイブリッド環境への移行について概説する。
我々はエージェントを、プラットフォーム構築コンポーネントではなく、レコメンデータシステムのエンドユーザとして機能する、独立したユーザ整合型アシスタントとして扱う。
このシフトはRecSysの研究に新たな機会をもたらし、評価、アライメント、システム設計に固有の課題を導入します。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 01:18:18 GMT)
Points as Tori: Fast Pointwise Signed Distance for Point Clouds [30.7] 本稿では,符号付き距離を点雲まで計算する手法について述べる。
入力として、本手法は正常な点雲を取る。
出力として、署名された距離のほぼ基底面へのクエリを許容する分析パラメータ化を提供する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 20:01:10 GMT)
G2-Nav: Grounded and Guarded Vision-Language Costmaps for Robot Social Navigation [28.2] 社会的なナビゲーションには、ロボットが複雑な現実世界の環境で推論し、応答する必要がある。
G2-Navは、抽象的な社会的推論を基盤とし、安全な実世界展開を支援する新しいフレームワークである。
我々は、G2-Navが非構造化環境で安全で効率的で社会的に適合した自律ナビゲーションを提供する実世界の実験を通して実証する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 20:18:20 GMT)
When Can Safe Controllers Adapt? Information before Commitment [26.6] 本研究では,学習経路自体の安全保証の下で,安全な適応制御について検討する。
パフォーマンスは、実際のモデルを知っている安全なオラクルに対して測定されます。
我々は,特殊事例の回復を証明し,決定論的線形ガウス系に対する半定値上の証明を導出する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 17:30:41 GMT)
Token-Wise Latent Streaming from Slow Reasoners to Fast Planners for Dynamic Vision Language Navigation [26.1] 動的で人間中心の環境における視覚言語ナビゲーションは、言語推論が遅くて熟考的である、という根本的な緊張を露呈する。
本稿では,動的ソーシャルVLNのためのデュアルシステムフレームワークであるSPARK-VLNを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 12:55:40 GMT)
Foundation-Assisted Active Learning for Object Detection Annotation [25.8] 本稿では,リモートセンシングオブジェクト検出のための基礎モデル協調型アクティブラーニングと半自動アノテーションフレームワークを提案する。
我々は、UPN+SAM2に基づく参照ローカライゼーションソース(SA-source)と検出器予測ソース(OD-source)からなるデュアルソースメカニズムを構築した。
また、DINOv2特徴とSAM2マスクを用いてオブジェクトレベルの表現を構築し、擬似多様性を抑えながらサンプルカバレッジを改善するオブジェクト中心の多様性サンプリングを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:59:08 GMT)
Test-Time Registers as Global Priors for Tokenized Image Generation [25.6] テストタイムレジスタの特徴は, 画素空間の読み出し値とパッチ平均値の両方よりも強い低周波濃度を示す。
これらの診断に動機づけられたRegTokenは、レジスタ構造をグローバルな先行トークンの小さなセットに変換する訓練手順である。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 13:56:19 GMT)
SinD 2.0: A Multi-City UAV Dataset with Semantic Risk Annotations for SOTIF-Oriented Safety Validation at Signalized Intersections [25.4] SinD 2.0は、クロスドメインADS安全分析専用の大規模ドローンベースの交差点データセットである。
中国4都市を横断する6つの信号化交差点を網羅し、異なる交差点地形と地域運転特性を捉えている。
交通違反、リスクの高い対話、視覚的遮蔽、狭い実現可能な領域を含む多次元のセマンティックラベルを提供する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 19:46:37 GMT)
Mixed-Timescale Differential Coding for Downlink Model Broadcast in Wireless Federated Learning [25.0] 参照モデルを調整することにより、2つの異なるレベルで差分符号化を行う混合時間差分符号化方式を提案する。
MTDCでは、差分更新を見逃しても、2つのフルモデル放送間で最新のグローバルモデルを再構築することができる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 19:26:50 GMT)
Digital measurement of droplet flame diameter in microgravity combustion images using Segment Anything Model 2 with automatic prompt selection [19.8] 本研究は,燃焼画像から自動火炎径計測を行うためのAI対応ディジタル計測ワークフローを提案する。
初期径の異なるn-ヘプタン,n-デカン,n-オクタン液滴の19,537個の炎像で検証した。
提案したワークフローの標準不確実性は8.54%であり,手動測定よりも約229倍の効率向上を実現している。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 02:06:22 GMT)
Shortcuts to adiabaticity in five-level systems using counter-diabatic driving and time-rescaling optimization [19.4] 本稿では,複数状態刺激されたRamanショートカット・トゥ・アダバティックパスプロトコルを構築するために,逆ダイアバティック(CD)駆動と時間再スケーリング(TR)方式を提案する。
両プロトコルが完全な人口移動を実現し,すべての中間状態の過渡性人口を効果的に抑制できることを示す。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 14:05:33 GMT)
How to Build Marcus's Algebraic Mind: From Thagard's Brain--Mind Viewpoint [18.6] 接続主義的認知の2つの批判は、1つの欠落した能力に収束する。
1つの基質が両方答える。
VaCoAlは1つの原始的 XOR-and-shift over GF(2) 上に構築された超次元アーキテクチャである。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 01:12:54 GMT)
How to Build Marcus's Algebraic Mind: From Minsky's Emotion-Machine Viewpoint [18.6] The Algebraic Mind』において、マーカスは3つの認知的要素を特定した。
この問題を、GF(2) XOR-and-shift上に構築されたアーキテクチャであるVaCoAlで解決する。
衝突回避スキームはフロンティアサイズ内で正確な回復を保証する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:48:00 GMT)
JOR-Bench: Japanese Operations Research Benchmarks for Large Language Models [16.3] JOR-Benchは、大規模言語モデルの能力を評価するための5つの日本語言語ベンチマークのコレクションである。
JOR-Benchは、任意のプログラミング言語で使用可能な、ソルバに依存しないベンチマークである。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:24:10 GMT)
FUSAR-R1: A Large-Scale Reasoning Model for Intelligent Interpretation of SAR Images [16.0] 大規模視覚言語モデルは、インテリジェントなリモートセンシング画像解釈のパラダイムシフトを推進している。
既存の視覚言語モデルは、人間の専門家のステップバイステップの分析、論理的判断、自己補正能力を持っていない。
本稿では,SAR画像の知的解釈のための大規模推論モデルFUSAR-R1を提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 13:31:11 GMT)
Can Experts Adapt Without Training? On Test-Time Modality Generalization in MVLMs [16.0] テスト時に動的専門家の選択と適応を行う完全最適化フリーのフレームワークであるMoBEを提案する。
MoBEは、MoE設定におけるエントロピー誘導動的ルーティングとエキスパートワイドベイズ適応を組み合わせることで、専門家が信頼を更新し、勾配更新なしでオンラインで適応できるようにする。
パラメトリックな更新がなければ、MoBEはテスト時間ルーティングとオンライン統計を備えた静的MVLMを拡張し、最先端のTTAメソッドよりも平均精度+4.72、+7.17、+4.3を達成する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:24:39 GMT)
TopoGS: Planar Reconstruction via Topology-aware 3D Gaussian Splatting [15.7] TopoGSは,コヒーレントな3次元再構成のための平面的制約と位相的制約を明示的に統合する最初の3DGSフレームワークである。
具体的には、多視点画像セグメンテーションからグローバルな2次元トポロジカルな関係を抽出し、ガウス原始体をこれらの構造要素に固定する。
これらのトポロジ的制約とともに厳密な多視点整合性を持たせることにより、幾何学的ミスアライメントを著しく軽減し、連結された3次元モデルを生成する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 14:27:49 GMT)
Effects of width-dependent model hyperparameters and $\ell_2$-regularization on the loss landscape of two-layer ReLU networks [15.5] 本稿では,2層ReLUネットワークの理論的性質について考察する。
AdamWをパラメータとして使用すると、学習したパラメータが崩壊するのを防ぐ。
入力次元を1に制限すると、2層ReLUネットワークの大域的最適集合に対する解析解が導出される。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:17:23 GMT)
Cross-Branch Conflict as a Shield: Safeguarding Facial Identities in Unified Multimodal Image Editing [14.7] 統一マルチモーダルモデル (UMM) は近年, 命令ベースの画像編集能力の強化を実証している。
既存の対向保護法は主に視覚的理解または画像生成モデルのために設計されている。
我々は,VTとVAEの表現をクリーンな表現から切り離し,協調的に駆動する,統合された敵保護フレームワークであるCSを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 17:35:33 GMT)
Just A Rather Very Intelligent Spoken Agent [14.5] 長期的なAIエージェントはますます有能になってきていますが、ユーザとのインタラクションは驚くほど薄くなっています。
このような仲介者は、ユーザとのリアルタイムな対話をサポートし、労働者を邪魔することなく質問に答え、進捗や混乱を積極的に報告し、有用であればエージェントの実行にユーザーガイダンスを注入する必要がある。
モジュラー参照のJarvisプロトタイプを用いてベンチマークをインスタンス化し、OpenClawで実行される34のテキストのみのWildClawタスクで評価する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:10:19 GMT)
PAVXploreRL: Physical-Action-Visual World Model Reinforcement Learning with Action Exploration [14.4] アクション条件付き世界モデルは、スケーラブルなポリシー評価ツールとして機能する、実施中のAIの重要なコンポーネントである。
PAVXploreRLは、事前訓練された潜在世界モデルに基づいて構築された強化学習フレームワークである。
実験の結果、PAVXploreRLはトレーニング済みのベースラインより一貫して優れていた。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 02:42:27 GMT)
Backpropagation-Free Trunk Training via the Split Forward Gradients [13.6] 中間表現でネットワークを分割するSplit Forward Gradient(Split-FG)を導入する。
Split-FG は出力ヘッド勾配を正確に計算し、ヤコビアンベクトル積のトランク勾配のみを推定する。
ピークメモリは、前モードトランクが成長するにつれてパフォーマンスギャップが拡大するが、マッチしたバックプロパゲーションと比較して最大35%まで削減される。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:23:21 GMT)
MultiLoReFT: Decoupling Shared and Modality-Specific Subspaces in Multimodal Learning via Low-Rank Representation Fine-Tuning [13.3] MultiLoReFTはマルチモーダル学習のための効率的でスケーラブルな低ランク表現フレームワークである。
共有情報とモダリティ固有情報を分離する解釈可能な射影部分空間を学習する。
シミュレーションと実世界のベンチマークでマルチモーダル予測をサポートする表現を生成する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:53:22 GMT)
Dropout and Random Gradient Masking Are Asymptotically Equivalent in Large ResNets [12.9] DropoutとRandom Gradient Masking(RaM)は、ディープラーニングのパフォーマンス向上に使用される2つのトレーニングテクニックである。
本研究では,ResNetsにおける2つの手法の違いが,大深度および幅のダイナミックスにおいて消失することを示す。
また、これらの変種のうちいくつかの変種が同じ極限に崩壊することも示している。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:57:27 GMT)
Robust PnP on a Neuromorphic Processor for Object Pose Estimation [12.5] 本稿では,ニューロモルフィックプロセッサ上でのロバストなオブジェクト推定のための新しいニューロモルフィック展開式を提案する。
SNNの主なレイヤがニューロンの原理に従って設計されたイベントデータから2Dランドマークを予測するために、スパイキングニューラルネットワーク(SNN)を使用します。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 14:13:29 GMT)
Automating structural reliability analysis with a multi-agent large language model framework [12.3] 本研究では,構造信頼性解析プロセスを自動化するマルチエージェント大規模言語モデルフレームワークを提案する。
特殊エージェントは問題定式化、メソッド計画、コード生成、実行、結果解釈を扱う。
その結果,計算信頼性を保ちながら,構造信頼性評価の専門知識を低下させることがわかった。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 01:45:27 GMT)
Semi-Supervised Conditional Generative Learning through Stochastic Interpolation and Sufficient Representations [12.3] 条件固有項と低次元潜在表現を組み合わせた半教師付きフレームワークを提案する。
RepGは生成をラベル依存の潜伏サンプリングと高次元再構成の2段階に分解する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:21:53 GMT)
DataFlow-Harness: A Grounded Code-Agent Platform for Constructing Editable LLM Data Pipelines [9.4] 我々は,LLMエージェントを案内して,プラットフォームネイティブな非巡回グラフを構築するプラットフォームであるtextscDataFlow-Harnessを紹介した。
12タスクのデータエンジニアリングベンチマークでは、textscDataFlow-Harnessが93.3%のエンドツーエンドパスレートを達成した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:30:19 GMT)
Encoding Choices and Fault-Tolerant Resource Estimates for Digital Quantum Hamiltonian Descent [9.4] 量子ハミルトニアン降下(QHD)のための1ホットおよび2進振幅エンコーディングを比較するエンコーディング・アウェア・リソース分析を提案する。
バイナリエンコーディングは、データレジスタを$O(dN)$から$O(dlog N)$ qubitsに還元し、速度論的および潜在的な進化に匹敵するスケーリングを提供する。
低モメンタムスペクトルと近似QFTに基づく速度論的近似は、さらに二項速度論的スケーリングへの二項速度論的コストを減少させる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 23:08:06 GMT)
Agentic Code Review in the Terminal: A Trajectory-Level Analysis of Behavior, Cost, and Human-Alignment [8.9] 端末ベースの環境におけるエージェントコードレビューは、プルリクエスト作成前のローカル開発における早期フィードバックを可能にする。
既存の評価はパフォーマンス中心であり、リポジトリ基底のエージェントレビュアーの動的な振る舞いを捉えられない。
以上の結果から,エージェントレビューの精度は向上するが,十分な調査と検証のオーバーヘッドが生じる一方で,レビューの成功はより強力な計画と下流検証に結びついていることが示唆された。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:03:03 GMT)
A BIM-enabled, Agent-based Discrete-event Simulation Platform for Robotic Studies: A Method based on Graph Theory [8.0] 情報モデリングの構築には、豊かな幾何学的、セマンティック、操作的な情報が含まれており、ロボットアプリケーションではほとんど使われていない。
本研究では,知識駆動型屋内ロボットナビゲーションと操作計画のためのBIM対応エージェントベースシミュレーションプラットフォームを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 18:25:56 GMT)
A Preliminary Study on the Impact of AI in the Creativity and Collaboration in Software Teams [8.0] ジェネレーティブ人工知能(GenAI)ツールは、ソフトウェアエンジニアリングの作業を再構築し、認知パートナとしての役割を増している。
本稿では、ソフトウェアエンジニアリングの専門家が、チーム内の創造性とコラボレーションに焦点を当てたAIツールをどのように認識し、統合するかを検討する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:07:56 GMT)
Mean-State Entropy Hierarchies and Classical Communication through Quantum Convolutions [5.8] 量子畳み込みは古典的畳み込みの離散変数類似を提供する。
我々は、互換性のある安定化器による有限ステップエントロピー階層を確立する。
量子畳み込みチャネルの場合、ワイル共分散はワンショット古典的な通信問題を最小出力エントロピーに還元する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:11:22 GMT)
SurvCF(t): Counterfactual Explanations for Survival Analysis in Predictive Maintenance Multivariate Time Series Data [5.8] textitSurvCF(t)は,時系列データ上で動作している生存モデルに対して,対実的な説明を生成するための最初のフレームワークである。
textitSurvCF(t)は、予測寿命を増加させる、資産の運用履歴に対する最小限、可塑性、時間的に一貫した変更を識別する。
以上の結果から, textitSurvCF(t) は生存予測と規範的メンテナンスのギャップを埋め, メンテナンス戦略における説明可能な, 決定指向のAIを実現する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 21:06:46 GMT)
Value-Monotonicity Matters: A Concordance Loss for Deep Survival Prediction [5.7] ディープサバイバルモデルは、ほぼ独占的にコンコーダンス指標(C-index)によって評価される
小型で高度に検閲された腫瘍学コホート上での高容量エンコーダのエンドツーエンドトレーニングでは、Cインデックスの評価が頻繁に行われる。
この目的のためには、損失の可能性は信頼できない。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 12:49:43 GMT)
MIND-CAVs: Multi-Intelligence Negotiation and Decision System for CAVs based on Intent-Driven Autonomy [5.4] MIND-CAVは、意図駆動の自律性に基づくコネクテッド・自動運転車(CAV)のためのフレームワークである。
各車両は、生のセンサー観測を構造化された意図表現に抽象化し、V2Xリンクを介してそれらを交換し、ロードサイドエッジサーバから一貫した調整計画を受け取る。
我々は、CARLAベースのAI-in-the-loopプラットフォームにMIND-CAVを実装し、マルチレーンハイウェイシナリオで評価する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:23:55 GMT)
Hybrid Machine Learning for Articulation Angle Estimation of Truck-Semitrailer Combinations [5.4] 本稿では,視覚入力と運動入力から直接調音角度を推定する学習モデルを提案する。
提案手法は,実装要件の低減と実用的展開の利点を維持しつつ,正確かつ信頼性の高い調音角推定を実現する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:48:00 GMT)
Position: Explanation Stability Is a Property of the Model Method Pair, Not the Model [5.1] 説明安定性に関する主張は、クロスメソッド検証なしで科学的に無効である。
DenseNet201、ResNet50V2、InceptionV3はAUCの99%以上を達成したが、安定性のランキングは属性メソッド間で逆転した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:09:07 GMT)
A Non-Intrusive Traffic Analysis Framework for Authorization Risk Detection and Coordinated Response in Web Applications [5.1] 有効なWebセッション下での認証違反は、トラフィックからリアルタイムに識別および処理することが困難である。
本稿では,リスク検出と協調応答のための非侵入的トラフィック分析フレームワークを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:34:13 GMT)
HyBDM: Multi-Scale Hybrid Experts for Time Series Forecasting with Bidirectional Dependency Modeling [5.1] HyBDMは、時間的ダイナミクスを大域的なパターンと局所的な変動に分解するハイブリッドモデルである。
予測精度と計算効率の両方において最先端の手法より優れている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 16:51:40 GMT)
From Overload to Insights: How AI Agents Can Support Scientists in Analyzing Complex Data [5.0] 欧州XFELの科学者は、非常に大きく複雑なデータセットを生成する実験を行っている。
その後のデータ分析は、ドキュメントやツール、サポートチャネルに散在する施設やソフトウェア固有の知識と、自身のドメインの専門知識を組み合わせる必要があるため、難しい。
この問題に対処するため、我々は科学者のニーズに合わせてエージェントAIシステムを設計・評価し、欧州XFELの高性能コンピューティング環境と統合した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 15:03:20 GMT)
Tight Sample Bounds for Renyi and Min-Entropy Estimation [4.9] サンプルからエントロピーを推定することは、情報理論とプロパティテストにおいて基礎となる。
定数加法精度に対する最小エントロピー推定が標本複雑性$(klog k)$であることを証明する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 21:01:38 GMT)
Cascading versus Joint Modeling for Hierarchical Offensive Language Detection [4.7] 本稿では,サブタスク毎にトレーニング戦略をカスタマイズした3段階のカスケード検出システムを提案する。
実験では、公式テストセットの3つのサブタスクにおいて、マクロF1スコアが0.795、0.716、0.557に達することが示された。
連立マルチタスクモデルとは対照的に、カスケードアーキテクチャは3つのサブタスクすべてに対して高い精度を達成する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:57:40 GMT)
Show Me How You Reason and I'll Tell You Who You Are: Reasoning Graphs for Robust LLM Authorship Attribution [4.7] LLM生成テキストの推論構造を抽出し,解析し,言語表面を超えて解析する。
議論マイニングパイプラインから抽出した推論グラフを利用するグラフニューラルネットワーク手法を提案する。
パラフレージングやバックトランスレーションなどの難読化攻撃では, ベースラインが最大27ポイント向上した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 15:36:07 GMT)
Though Language Models Err While They Strive: Conformal Prediction for Self-Correcting Scientific Generation [4.0] 本稿では,グラフ構造型共形予測フレームワークであるSFCについて紹介する。
SFCは科学的推論を原子の絶対コヒーレント-事実単位に分解する。
我々は、PhyXマルチモーダル物理学、MATH、ScienceQA、ARC Challengeなど、確立された科学的推論ベンチマークでSFCを実証する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 08:38:19 GMT)
ReqGenX: An Empirical Study of Atomic Decomposition, Artifact Regeneration, and Reconstruction for Legacy SRS Documents [4.0] 従来のSRS文書がトレース可能な合成SRSアーティファクトに変換できるかどうかを検討する。
我々は,7つのPURE SRS文書に対するReqGenXの評価を,グラウンドリング,品質,情報保持,下流再構築解析を用いて行った。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 00:30:33 GMT)
Can Multimodal Large Language Models Understand OCT? [3.9] マルチモーダル大言語モデル (MLLM) は, 医用画像解析において有意な可能性を証明している。
OCT-Benchは、7つの公開データセットにわたる4,137のOCT画像から構築された10,076の高品質な多重選択質問からなる。
我々は,プロプライエタリモデル,オープンソース汎用モデル,医療ドメインモデルを含む20の代表的なMLLMを体系的に評価する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:08:31 GMT)
Entanglement Quantification via Symmetric Extensions: A Resource Theory Hierarchy [3.7] k対称PT拡張に基づく絡み合い尺度Ekの階層化を導入する。
それぞれのEkは最小の固有値シフトによって定義され、自由操作の下で忠実で凸で単調である。
階層構造は k = 1 で PPT-ロバスト性を厳密に洗練し、k = 2 で有界な絡み合いを検出し、分離性測度を k -> 無限大として正確に収束させる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 20:39:35 GMT)
Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL [3.6] 安全なモデルベースの制御でこの位置をインスタンス化し、3つの具体的な設計原則に分解します。
モデル内部のプロキシを3つのワールドフィードバック信号に置き換えることで、ワールドモデルやプランナーを再トレーニングすることなく、衝突を1-14%に削減できる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 02:17:45 GMT)
Multimodal Attention-based Deep Learning for Emergency Triage with Electronic Health Records [3.4] 本研究の目的は,表層データとテキストデータの両方を効果的に扱えるマルチモーダルディープラーニングアーキテクチャを提案することである。
マレーシア大学病院の救急部門から収集された11,102件のトリアージデータからなるデータセットは、モデルの開発と検証に使用される。
提案モデルでは, ベースラインモデルと比較して精度1.95%, F1スコア2.49%, ROC AUC1.41%の増加を示した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:35:23 GMT)
How Do You Choose Your AI Component? An Interview Study of Secure AI Integration in Practice [3.3] 私たちは、ソフトウェアにAIコンポーネントを統合する方法について、22人のソフトウェア開発者、アーキテクト、AI実践者との半構造化インタビューを行います。
分析の結果, 実践者のモデル選択は, 性能, 精度, コスト, 特定の特徴など, 機能的基準によって大きく左右されることがわかった。
AIコンポーネント統合プロセス全体において、セキュリティ上の懸念が一貫した欠如を観察し、確立されたソフトウェアサプライチェーンの教訓を見落としたり無視したりする。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:30:12 GMT)
From Discussion to Execution: Replicating Buggy and Correct Data Science Code [3.2] 我々は、Q&Aフォーラムの投稿から実行可能なバグギーとパッチされたデータサイエンスプログラムを複製するフレームワークであるReprodgenを紹介した。
質問とそれに対応する回答が与えられた後、Reprodgenは質問に記述されたバギーな振る舞いと回答に記述された意図された修正を再構築する。
私たちは7つのデータサイエンスライブラリで、Stack Overflow(SO)とGitHub Issues(GI)上でReprodgenを評価します。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 00:48:26 GMT)
Hazard or Anomaly? Evaluating VLMs for Understanding Dangers and Discrepancies [3.2] 視覚言語モデル(VLM)は複雑なシーンを解釈し、安全関連情報を伝える。
現在の評価では、しばしば二項決定(セーフ/アンセーフ)として危険認識を行う。
危険状態と異常状態とを明確に区別し,危険状態と異常状態とを別々に認識する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 02:24:06 GMT)
Similarity All The Way Up: Multilingual Generalization in LLMs Relies on Language-Level Similarity Structures [3.2] 大規模言語モデル(LLM)は、英語以外の言語への多言語一般化に苦慮していることが知られている。
LLMの表現が、異なる言語間の階層的類似構造をいかにうまく捉えているかを示す。
これは、類似性駆動の大規模一般化に関する古典的な研究を拡張し、類似言語を表すモデルが、類似言語から別の言語へどのようにより良く一般化されるかを示す。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:49:20 GMT)
Beyond Visibility and Technical Reuse: Public Application Transformation in Open-Source Model Ecosystems [3.2] オープンソースプラットフォームにより、AIモデルのパブリッシュが容易になったが、モデルリリースだけでは、モデルが見えるようになるか、技術的に再利用されるか、パブリックアプリケーションに組み込まれるかは明らかになっていない。
本研究では,Hugging Face上に構築されたモデル空間リンクを通じて,モデルインパクトのプラットフォーム可視次元としてパブリックアプリケーション変換を導入する。
我々は、256万のモデルレポジトリ、1.06万のスペース、810,087のデータセットレポジトリ、122万のアカウントプロファイルからなるプラットフォームスケールのデータセットを構築します。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 07:38:38 GMT)
Bridging battery design and health assessment through virtual sensing and physics-informed learning [2.9] リチウムイオン電池(LiB)のスーパーチャージは、耐久性、安全性、ユーザの信頼性を確保するために、堅牢な健康モニタリングを必要とする。
本稿では,仮想センシングを用いた物理インフォームド・ラーニング・フレームワークを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 15:59:29 GMT)
Supporting Autonomous Process Execution within a Multi-Perspective Constraint Frame via Numeric Planning [2.9] Framed Autonomyは、ビジネスプロセス(BP)インスタンスの実行を自律的に進めるシステムの能力を表す。
我々は、プロセスフレームを多視点制約で拡張するWhat-if分析のための新しいツールを提案する。
部分的なプロセス実行を前提として、提案手法は、この拡張されたフレームを利用して、基礎となるプロセス仕様に従って最適な継続を推奨する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:58:35 GMT)
Geometric quantum discord in the black hole quantum atmosphere [2.8] 我々は、シュワルツシルトブラックホールの量子雰囲気におけるホーキング放射の影響を受け、バイパルタイト・ヴェルナー状態の幾何学的量子不協和性について検討する。
物理的にアクセス可能な領域における幾何学的量子不協和は、非単調な振る舞いを示す。
幾何量子不協和の顕著な極端は、ホーキング放射のピーク強度に対応する位置で正確に起こる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 04:58:05 GMT)
A Research Prototype for Closed-Loop Generative Design of Customized Foot Orthoses via Semantic-Physics Alignment [2.8] Text-Aligned Neural Surrogate (TANS)は、クロスアテンションを用いて、連続的な格子密度場に臨床テキストの埋め込みを投影する。
グラフニューラルネットワーク(GNN)サロゲートは有限要素解析(FEA)の代用としてリアルタイムでプランタ応力を予測する
提案方式はパラメトリックCADよりも34.7%, 適合誤差は0.42mmである。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 04:20:51 GMT)
AI-Augmented Model Predictive Control for Safe and Adaptive Rendezvous and Proximity Operations [2.8] 本研究は,多エージェント対逆シナリオにおける自律宇宙船RPOのための適応型モデル予測制御(MPC)フレームワークを提案する。
このフレームワークは、モンテカルロシミュレーションにより、公式のKSPDG(Kerbal Space Program Differential Game)で評価された。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 04:20:23 GMT)
CADENCE: Closing the Reasoning Gap via Coverage-Adaptive On-Policy Distillation [2.6] CADENCEは統合されたフレームワークで、各障害モードに対してターゲットとなる修正を行う。
DRIFTは、学生サンプル軌道上の前方KLと逆KLのサロゲートを混合したトーケンの凸をスケジュールする。
A)COVA、(B)FTB、(B)大域正規化エントロピー参照による高エントロピー位置での勾配集中、(D)LAP、可視性優先正しいロールアウト強化、(E)エントロピー非依存キャリブレーション
論文参考訳(メタデータ) (Sat, 18 Jul 2026 20:16:26 GMT)
What Do They See? Interpreting Complex Road Scenarios Through the Eyes of Vision-Language-Action Models for Safe and Trustworthy Autonomous Vehicle Learning [2.5] フロントカメラ画像から検出対象を体系的に除去するフレームワークを提案する。
これにより、各オブジェクトの存在がモデルの計画行動に与える影響を分離する。
また、モデルが人間ドライバーが考慮する対象に強く反応するケースも見つかる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 19:20:16 GMT)
FST.ai 2.5: Explainable and Uncertainty-Aware AI for Olympic and Para-Taekwondo Decision Support, Athlete Digital Twins, and Federation-Scale Analytics [2.2] 本稿では,オリンピックとパラテコンドーのための説明可能な,不確実性を認識し,セキュアなAIフレームワークである textbfFST$cdot$ai2.5 を提案する。
textbfFST$cdot$ai2.5は、アスリートインテリジェンス、競争分析、フェデレーションスケールのデータ管理、AI支援による意思決定サポート、アスリートとイベントデジタルツイン、説明可能なパフォーマンス指標、適応トレーニングレコメンデーションを統合する、統合されたデジタルエコシステムを導入している。
オリンピックとパラテコンドーのために開発されたが、この方法論は説明可能なAI、デジタルツインに広く応用されている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 02:32:44 GMT)
RoleMix: Unifying Sequential and Non-Sequential Features via Semantic Tokenization for Post-Click Conversion Rate Prediction [1.6] RoleMixは、共有されたロール保存トークンインターフェースを通じて、シーケンシャルかつ非シーケンシャルなエビデンスを表す。
大規模なKDDカップ2026 Tencent UniRec Challengeでは、RoleMixは83.648%のオンラインAUCを達成し、公式産業ベースラインを1.953%上回っている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 15:44:48 GMT)
Reliability Is Not Free in Universal Quantum Work Extraction [1.6] 我々は、位相非依存のギブス保存プロトコルが、コヒーレントなクビット時間変換軌道を通してギブス保存指数を維持することができないことを証明した。
明示的なコヒーレント量子族では、既知の相ギブス保存抽出はエラーフリーであるが、すべての相非依存プロトコルは、有限最悪の点指数を持つ。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 08:30:31 GMT)
An Indoor Navigation System for the Visually Impaired based on UWB Positioning and D* Lite Path Planning Algorithm [1.5] 本稿では,UWB(Ultra-Wideband)位置決め技術とD*Liteパス計画アルゴリズムを用いた視覚障害者のための屋内ナビゲーションシステムを提案する。
システムは低レイテンシで確実に動作し、複雑な屋内空間のユーザに対して安全性と柔軟性を提供する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:24:44 GMT)
A Method for Learning Value Systems in Generative AI [1.4] この研究は、生成AIにおける基底値学習手法の欠如に対処する。
我々は、事前に検証された価値体系学習法を生成AI設定に適用する。
我々のアルゴリズムは、基底学習過程を動的に優先順位付けする。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 17:37:50 GMT)
Quantum Metrological Detection of the Unruh Effect with Optimized Accelerated Two-Level Atoms [1.3] 最小不確実性は全プローブ時間の平方根に逆比例することを示す。
固定された全プローブ時間に対して、原子-磁場相互作用時間を最適化することにより、推定の不確実性を最小化する。
その結果,各プローブの進化時間が短くなるにつれて不確実性が低下することがわかった。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 08:27:17 GMT)
NOWJ@COLIEE 2026: Adaptive Pipelines for Legal Retrieval and Reasoning [1.3] 本稿では,COLIEE 2026コンペティションの5つの課題すべてに対するNOWJチームの参加の方法論と成果について述べる。
タスク1(Legal Case Retrieval)では、4段階の候補フィルタリング,補体埋め込みモデルによる高密度検索,微調整された生成リランカによるクロスエンコーダのリランクを提案する。
第2タスク(Legal Case Entailment)では、BM25ベースのリランク、アテンションベースのリランク、コンセンサスアンサンブルの検証を組み合わせる。
第3タスク(法典検索・内容)については,検索オーグを採用する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 02:46:06 GMT)
A Multi-Agent System for 5G Throughput Prediction in Multi-Operator Urban Environments [1.3] タイアード・マルチエージェント・システム(TMAS)は、マレーシアのサンウェイ市で収集された48,618個のサンプルのデータセットに基づいて、テレメトリをドメインマイクロエージェントに動的にルーティングする。
TMASは予測可能性ボトルネックを克服し、最大0.931の判定係数(R2)と平均絶対誤差(MAE)を0.53Mbpsまで下げる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 18:48:53 GMT)
Real-World Evaluation of an AI Agent Drafting Translational Impact Summaries [1.2] 臨床・翻訳科学賞のプログラムは、学者の研究成果を文書化しなければならない。
各学者の記録を手作業で組み立てるのに 15時間かかります
われわれは、各学者の情報源から得られた証拠を収集する、ループ型AIエージェントを構築した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 22:34:52 GMT)
OpenLanguageModel: Readable and Composable Small-Language-Model Pretraining for Education and Research [1.2] OpenLanguageModel (OLM)は、小さな言語モデルの構築と事前学習のためのオープンソースのPyTorchライブラリである。
このパッケージには、9つの親しみのあるモデルファミリにわたる27のプリセットと、LMの基礎からアーキテクチャ研究まで進歩したドキュメントが含まれている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:55:18 GMT)
Synchronization-Free Algebraic Fingerprints for Large Language Models: From Autoregressive to Diffusion Models [1.1] 大規模言語モデル(LLM)は、信頼できる透かし方法に対する緊急の要求を生み出している。
一対の隣接するトークンから生成される1つのバイナリから構成される新しい同期不要な透かし方式を提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 05:43:22 GMT)
Are Arithmetic Heuristic Neurons Form-Invariant? A Mechanistic Analysis of Symbols, Text, and Code in LLMs [1.1] 我々は,算術ニューロンが記号サブトラクション,自然言語語問題,Pythonコードにまたがる形式不変性について検討する。
ニューロンのコンパクトなセットは3つのフォーマットすべてで共有され、標的となる介入は、この共有回路が遅延層演算に必要かつ十分であることを示す。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 08:02:50 GMT)
Biased-Noise Quantum Reed--Solomon Codes and a Tornado Concatenation for Cat Qubits [0.9] 我々は、Emphbit-flip-only quantum Reed--Solomon (RS) コードを構築した。
エラーは最適有界距離シンドローム・ルックアップテーブルによってデコードされる。
モンテカルロシミュレーションでは、物理ビットフリップ率$p=0.1$で、トーネード符号は論理誤差率$pL で5.3times10-3$に達し、両方の親符号より下にあることが示されている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 20:38:00 GMT)
C3DIR: A Deep Learning 3-Dimensional Cloud Property Retrieval Scheme for Passive Satellite Imagers [0.9] Cloud 3-dimensional Imager Retrieval (C3DIR) は、複数の受動衛星画像に対して3次元クラウド特性を推定するディープラーニングモデルである。
C3DIRは、視線に沿った氷、雲の液体、雨の水量を予測する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 18:46:49 GMT)
Building a Neural Network from Scratch: Implementation, Evaluation, and Optimization [0.9] 本稿では,スクラッチから完全に実装された自己完結型ニューラルネットワークフレームワークを提案する。
この実装は、多層アーキテクチャ、多様なアクティベーション関数、最先端のモジュラリティを含む、すべての必須コンポーネントを含んでいる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 07:31:59 GMT)
A Deep Second-Order Stochastic Residual Method for Fully Nonlinear Parabolic PDEs [0.9] 本稿では,高次元ヘッセン系完全非線形放物型PDEのためのディープ2次残差法(D2SRM)を提案する。
一つの時空ネットワークは、解、勾配、およびヘッセンの微分整合近似を生成する。
100次元のベンチマーク実験では、終端処理を比較し、証明された小ゲイン範囲内外におけるヘッセン結合を探索し、時間ステップが減少するにつれて誤差が減少することを示した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:43:15 GMT)
Harnessing disorder to decouple extension and shear in kirigami metamaterials [0.9] 我々は,工学的障害はキリガミの設計の自由度であることを示した。
我々は、この設計空間を幾何学的認識グラフニューラルネットワーク(GNN)でナビゲートし、カットトポロジを完全な非線形、双方向の応力-ひずみ応答にマッピングする。
この研究は、軟質アクチュエーターから生体組織の異方性にマッチする組織対向デバイスまで、寄生せん断なしで伸びる構造材料を開発する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 01:52:52 GMT)
Extending the Frontiers of QNLP Beyond English: Grammar-Sensitive Pipeline for Hindi Sentiment Classification Using Compositional Quantum Models [0.9] ヒンディー語感情分類のための文法対応量子自然言語処理パイプラインを提案する。
手動でアノテートしたヒンディー語感情データセットを肯定的,否定的,中立的とラベル付けし,前グループ文法型を用いて文をエンコードする。
その結果, 感情分類が有効であること, 形態学的に豊かな言語に対する構成QNLPの可能性を明らかにした。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:04:24 GMT)
Privacy Cost as Equity Input: A Group Fairness Criterion for Differentially Private Machine Learning [0.6] プライバシーのコストは、各グループによって引き起こされる情報漏洩であり、それ自体が害である、と我々は主張する。
我々は、グループごとのオーバーフィッティングギャップによって正規化されるグループの正の予測率として定義されるグループフェアネス計量を導出する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 03:41:01 GMT)
Pediatric Bone Age Prediction Using Deep Learning [0.6] 本稿では,小児骨年齢予測のためのDeep Learning (DL) ベースのアプローチを提案する。
この方法は、RSNA骨年齢データセットから12,000以上のX線画像を利用する。
画像前処理、これらを3チャンネル画像に変換し、手骨画像の特徴を自動学習するために畳み込みニューラルネットワーク(CNN)を訓練する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 19:16:15 GMT)
Translating AI into scientific impact: Field context, career position, and institutional capability in AI-enabled research [0.6] 本研究では、AI知識の統合が科学的影響とどのように結びついているかを検討し、科学におけるAI関連の知識の恩恵を問う。
大規模データを用いて,OpenAlex人工知能サブフィールドの論文を参照して,AI統合を測定する。
結果は、AI参照は一般的により高い引用の影響と関連していることを示しているが、そのリターンは科学分野によって大きく異なることを示している。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:31:04 GMT)
VisionAssist: An Open-Source Smartphone Assistant for AI-Based Visual Accessibility [0.5] textbfVisionAssistは、スマートフォンを通じてAIによる視覚支援を提供することで、独立性を改善するために設計された、オープンソースのモバイルアプリである。
キャプチャされた画像の音声記述を生成し、ユーザーは食品ラベル、文書、日々のオブジェクトなどの視覚的コンテンツを識別できる。
このアプリケーションは音声コマンドによるハンズフリーインタラクションをサポートし、テキスト音声合成によるすべてのフィードバックを提供する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:28:57 GMT)
Retrieval-based and Fine-tuned LLM Approaches for Industrial Asset Health Monitoring and Decision Support [0.5] 工場はポンプ、タービン、圧縮機など多くの重要な機械を運用している。
本研究は,検索専用手法とオープンソースの大言語モデル (LLM) がいかに故障センサの診断的推論を行うかを検討する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:39:25 GMT)
A Measurement Plane for Quantum Networking [0.4] 量子ネットワークテストベッドは、分散測定をコーディネートし、異種デバイス間で実験データを収集するための明確な平面を持たない。
パイプラインを置き換えたり拡張したりするのではなく、データ、制御、管理プレーンを補完する専用プレーンである計測プレーンを提示する。
この評価は、複雑な分散量子実験を支援するためのフレームワークの有効性を示し、オンライン測定とフィードバックを可能にし、構成と実行の労力を大幅に削減した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 19:58:21 GMT)
VIGIL: Verifying Identity via Gated Intermittent Likelihoods for Continuous Biometric Authentication [0.0] VIGIL (Verifying Identity via Gated Intermittent Likelihoods for Continuous Biometric Authentication) は,適応性の高い連続認証フレームワークである。
我々は,モダリティごとの重み付けによるクロスモーダル融合を導入し,演算子による統合戦略の選択を可能にする。
証拠が不確定な場合に複数ラウンドの検証を可能にする3ゾーン検証決定モデルと適応縮小検証ウィンドウを併用する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 05:58:05 GMT)
Two-dimensional solitons in extended GPE models with Lee-Huang-Yang corrections [0.0] 量子液滴環境における2次元孤立波の存在とダイナミクスについて検討する。
我々は、Kadomtsev-Petviashvili方程式とDavey-Stewartson方程式に対応する効果的な非線形可積分モデルを導出する。
その結果、平均場と量子ゆらぎの競合を含むモデルにおいて、前例のない多次元ソリトン解が明らかになった。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 13:39:35 GMT)
TurboVec: A Case Study in Cost-Efficient Private Retrieval for Enterprise RAG via Codebook-Oblivious Quantization [0.0] 我々はTurboQuant上に構築されたオープンソースのベクトルインデックスであるTurboVecを研究する。
DBpedia OpenAI Embeddingsベンチマークでは、TurboQuant 4ビットがトレーニングされたFAISS製品量子化よりも優れています。
Codebook-obliviousデザインは、メンバーシップ推論の精度をほぼランダムに下げる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 21:43:40 GMT)
Tracking Through Decoupling Singularities: A Singularity-Robust Homotopy-Continuation Extension of Feedback Linearization [0.0] 本稿では,正方形非線形制御アフィン系のための軌道追従制御器を開発する。
この方法は、トラッキングをリアルタイムの弧長ホモトピー継続として再キャストする。
結果の流れは、特異集合から離れたフィードバック線形化に一致する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 21:46:41 GMT)
The Value of Depth in Message Passing on Sparse Graphs: A Kesten-Stigum Dichotomy [0.0] グラフニューラルネットワークがスパースグラフにどの程度の深さを持つ必要があるかを研究する。
深さの値は、Kesten-Stigum比$=2$である。
任意の深さの局所分類器は、孤立根によって設定された普遍床 $e-(-)$ を破ることはない。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 07:11:45 GMT)
The Anatomy of a Truth Direction: Knowledge-Dependent Dimensionality, a Relational Law, and a Convergent Category Geometry in Small Language Models [0.0] 大規模言語モデルにおける真理表現は、ステートメントの極性を越えて普遍的であるが、多次元部分空間内に存在することを示す。
サブスペースの次元は、どのアーキテクチャコンポーネントが真理の方向を構築するか、そして何の方向が混在しているかというモデルの知識にどのように依存するか。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:03:21 GMT)
TellTale: Blending Multi-Instance LoRA Text Encoders and a Zero-Shot LLM Judge for Ambivalence/Hesitancy Recognition in Videos [0.0] TellTaleは、インタビュービデオにおけるアンビバレンス/ヘシタシー(A/H)認識に対するテキストのみのアプローチである。
TellTaleは書き起こしのみに依存し、3つの確率ストリームを結合する。
主催者による152本の動画のプライベートテストセットで、TellTaleはMacro-F1の0.7364、平均精度0.7940を達成した。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 04:37:20 GMT)
Specification-Driven Development as the Foundation of AI-Native Enterprise Software Engineering [0.0] 大規模言語モデル(LLM)とエージェントAIは、ソフトウェアエンジニアリングを手作業によるコーディングからインテント仕様、アーキテクチャ、ガバナンスへとシフトさせています。
バイブコーディング(vibe coding)と、観察された振る舞いを通じてAIアーティファクトを受け入れる直観駆動アプローチ(intuition-driven approach)と、構造化仕様を真理の信頼できる情報源として使用する仕様駆動開発(Specification-Driven Development, SDD)の2つのパラダイムが登場した。
この記事では、3つのコントリビューションを行います。まず最初に、生産性-信頼性パラドックス、限られたコンテキストからのアーキテクチャ侵食、セキュリティ露出、技術的負債といった、過度な会話生成の失敗モードを特定します。
第2に、正式な仕様ガバナンス参照モデル(SGRM)を導入する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 07:27:02 GMT)
Spatiotemporal Facial Action Unit Detection using Twin Cycle Autoencoders for Driver Monitoring [0.0] ドライバー監視システムは、悲しみ、気晴らし、認知的負荷をリアルタイムで推測するために、顔の手がかりに依存している。
既存のAU検出器は、空間的外観と時間力学を別々に扱う。
本稿では、2つのサイクル一貫性を持つオートエンコーダブランチからなるツインサイクルオートエンコーダ(TCA)を提案する。
組込みJetson NXプラットフォーム上でのリアルタイムスループットの持続性を示す。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 10:52:08 GMT)
Operational Relation Between One-Time and Two-Time Work Protocols and Measurement-Resolution-Induced Transitions in Quantum Work Statistics [0.0] OTMスキームによるコヒーレンス情報は、すでにTMデータ内に潜んでいる。
有限分解能エネルギー測定の対象となる2段階駆動系の場合、この再構成は分解能駆動の統計遷移を明らかにする。
OTM作業分布の非解析性は、特定の作業値において平方根の発散ピークの形を取ることを示す。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 20:06:14 GMT)
On the Potential of Graph Neural Networks as Metamodels for Supply Chain Optimization: Dataset, Architectures, and Directions [0.0] グラフニューラルネットワーク(GNN)は、構造化システムのための強力な、微分可能な学習モデルのクラスとして登場した。
本稿では,基礎を築き,最初の段階を示し,重要な研究の方向性について論じる。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 11:06:22 GMT)
Mapping Order in Semicrystalline Polymers using Machine Learning of Nanobeam Electron Diffraction [0.0] 我々は、合成データから高分子の回折ピークとその強度を検出するために機械学習(ML)モデルを訓練する。
相関ピーク検出アルゴリズムと比較して、MLモデルは大幅に高速で、ほぼ全てのケースで相関アルゴリズムより優れている。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 00:54:23 GMT)
MafiaScope: Non-Invasive, Time-Resolved Belief Probing for LLM Agents in Social Deduction Games [0.0] MafiaScopeはオープンなテストベッドで、ソーシャルゲームMafiaをマシン理論のための測定器に変える。
エージェントがゲームを読み間違えたために負けたのか、あるいは正しいアセスメントに失敗したのかを区別する。
対話型ビジュアライザは、個々のエージェントの信念からのゲーム推論をリプレイし、タイムラインに沿った精度とキャリブレーションを表示する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 17:54:54 GMT)
Local AI pre-screening for human triple-blind peer review in health sciences [0.0] ICLR 2026の分析によると、75,800人のピアレビューのうち、およそ21%がAIによって生成された。
本稿では,ピアレビューのためのマルチLLMプレスクリーニングフレームワークを提案する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 00:06:33 GMT)
Interpretable Anomaly and Drift Detection with Gaussian Mixture Models [0.0] 本稿では,ガウス混合モデル(GMM)を,異常検出のための軽量かつ解釈可能なツールとして再考する。
3つの実践的な選択を明示し、7つの公開ベンチマークで評価する。
7つのベンチマークでGMMポイント検出器は、分離森林、ローカル・アウトリア係数、一級SVM、ECOD、COPOD、オートエンコーダと競合する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 13:13:56 GMT)
Increasing Line Outage Localization Performance with Ensemble Classifiers [0.0] 多くの場合、システム内の1つの伝送路の停止は、他の伝送路の電力フローを監視して局所化することができる。
本研究では,様々なアンサンブル分類器によって達成されたライン停止位置推定性能の改善について検討する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 23:49:17 GMT)
Hybrid Augmented Lagrangian Method for General Constrained Optimization via Evolutionary Algorithms [0.0] 本稿では,ALフレームワークの制約処理強度と人口探索の探索力を統合するハイブリッド拡張ラグランジアン(Hybrid Augmented Lagrangian, HyAL)手法を提案する。
提案手法は進化的手法を用いてAL反復のサブプロブレムを解き,探索を促進し,局所最適からの脱出を支援する。
その結果,Hyalはベンチマークスイート全体にわたって高品質なソリューションを一貫して生成していることがわかった。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 16:29:06 GMT)
How many degrees of freedom describe a quantum N-particle state? [0.0] ニュートン時空では、N$粒子系の標準記述は3N$自由度を必要とする。
古典物理学において、物理自由度数は独立関係自由度の数と等しい。
これは量子力学ではそうではない。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 22:31:48 GMT)
Half the Experts, All the Code: One-Shot Domain Pruning of Mixture-of-Experts LLMs for Coding [0.0] オープンウェイトコーディングモデルは、Mix-of-experts (MoE)ネットワークである。
その大きさの大半は「エキスパート」ワークの大きなプールから来ています。
専門家のプルーニングは機能しますが、モデルが実際に機能するタスクに対して、モデルごとのバリデーションが必要です。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:17:41 GMT)
Graph State Generation Based on Quantum Photonic Devices, Enabling Measurement-Based Quantum Computing [0.0] フォトニッククラスター状態は、測定に基づく量子コンピューティングの基本的なリソースである。
フォトニッククラスタ状態は、ゲート演算ではなく局所的な測定を適用することで計算を可能にする。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:50:50 GMT)
Bound, Scattering, and Resonance States of the Symmetric Woods--Saxon Potential in Dunkl Quantum Mechanic [0.0] 一次元対称ウッズ-サクソンポテンシャルの有界、散乱、ガモウ共鳴状態の最初の統一的な解析的記述を示す。
我々は、物理的に関連する全てのスペクトル状態を一貫して記述する単一の分析的枠組みを確立する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 19:46:38 GMT)
Beyond Orbital Rotations: Correlation-Rank Limits and Clifford-Accessible Measurement, from Algebra and Global Optimization [0.0] 連続RANGEは物理的回転角を独立に探索し、この正確なトレードオフを裏付ける。
スピン保存するジョルダン・ウィグナー分子ハミルトニアンに対しては、任意のパウリ部分集合に対してパリティ天井$r_X le 2(N-1)$も証明する。
RANGE の離散モードは、分子および生産上の f-要素ハミルトニアンをまたいで、X$-rank commuting family を探索する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 16:14:30 GMT)
Approximate Relative Entropy Constraints for Nonlinear Covariance Steering Under Distribution Ambiguity [0.0] 共分散ステアリングは、線形フィードバックポリシーを設計するための効率的なフレームワークを提供する。
衝突確率や平均二乗誤差などのリスクに敏感な量は不正確な推定が可能である。
この研究は、相対エントロピーに基づく分布的に堅牢な共分散ステアリングフレームワークを開発する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 18:09:59 GMT)
Amortized Inference for Sampling Distributions Where the Bootstrap Fails [0.0] ニューラルネットワークは、配信ファミリ上の前者から引き出されたシミュレーションデータセットに基づいて訓練される。
単一のフォワードパスは、1つのデータセットを全サンプリング分布の推定値にマッピングし、そこから信頼区間が直接従う。
リスクを負う問題に対して、配布不要の手法は名目上は適用できないが、学習した手法は94.7%に達する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 06:49:15 GMT)
Adaptive Compute in Latent World Models: When Depth Helps, Hurts, or Doesn't Matter [0.0] 内在的,6/9タスク,rhoが8倍まで)、奥行きが活発に痛む(逆転,2/9,rhoが0.87倍まで)、あるいは奥行きがほとんど問題にならない(平ら)。
インバージョンは、トランスフォーマー予測子の下で再現されるが、そのマニフェストは構成に依存し、メトリック空間、水平線、エンコーダ、バックボーン、そして最も強い -- トレーニングデータでシフトする。
より多くの計算が世界モデルに役立つかどうかはタスクの特性ではない。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 16:02:20 GMT)
A Reponse to the Sheldon Goldstein Objection to a Series of Covariant Relativistic Bohmian Models [0.0] 我々は、Covariant Bohmian Models type Nikoli と Hernndez-Zapata に対する非常に重要な反論に答えようとしている。
N の時空構成密度が有限積分であることを示すことは非常に有益である。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 18:45:42 GMT)
A Framework for Early Sepsis Prediction via Self-Supervised (JEPA) and Federated Representation Learning [0.0] 電子健康記録からの早期敗血症予測は、不規則なサンプリング、高い欠失、および階級不均衡によって挑戦される。
タスク認識型微調整による自己指導型事前学習は,予測地平線を横断するシャープな近点とロバストな特徴を持つことを示す。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 07:27:04 GMT)
A Deep Reinforcement Learning Algorithm for the Vehicle Routing Problem with Stochastic Demands and Outsourcing [0.0] 要求とアウトソーシングオプションによる車両ルーティング問題(VRP-SDO)
コミットしたサブセットに対してほぼ瞬時にコストを見積もるオフラインルーティングポリシを学びます。
実験の結果,現状の手法と比較して,ルーティングコストを19.6%削減できることがわかった。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 16:27:05 GMT)
A Causal Markov Condition for Value [0.0] 本稿では,価値に対する因果独立原理,すなわち因果マルコフ条件(v-CMC)を提案する。
我々は因果性と実用性をリンクする「因果価値理論」の概念的および数学的基礎を開発する。
論文参考訳(メタデータ) (Sat, 18 Jul 2026 09:13:17 GMT)