GigaBrain-WBC-0.5: A Behavior World Model for Robust Whole-Body Control with Environment Interaction [68.7] ヒューマノイド全身制御のための行動世界モデル(BWM)であるGigaBrain-WBC-0.5を提案する。
純粋にリアクティブなトラッカーではなく、因果トランスフォーマーをトレーニングして、次のアクション、次の状態、次の潜伏動作コマンドに対する分布を共同で予測します。
自動地形アノテーションパイプラインは、再ターゲティングされた動きから完全な3D接触形状を復元し、既存の動きデータセットのスケールでの地形アノテートを可能にする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:07:15 GMT)
Every Coin Has Two Sides: On the Dual Nature of Generalization in On-Policy Distillation of Large Language Models [68.5] オンライン蒸留は、生徒自身の方針からサンプリングされた軌跡を監督することによって、教師の能力を伝達する。
OPDは,特定の問題に対する回答よりも,教師の推論行動を伝達することがわかった。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:08:29 GMT)
When Not to Imitate: Boundary-Aware Skill Memory for Reliable Tool-Use LLM Agents [62.1] 過去の成功からスキルを抽出することは、Large Language Model (LLM)エージェントの効率的な進化に不可欠である。
textbfBoundary-Aware Skill Memory (BASM)を提案する。
BASMは、成功度の高いスキルメモリベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:16:06 GMT)
MedReaMM: Evaluating Large Multimodal Models on Expert-Level Clinical Diagnostic Synthesis [61.3] 異種臨床証拠を合成するモデルの能力を評価するためのベンチマークであるMedReaMMを紹介する。
MedReaMMは625の専門患者と、平均2.79の医療画像と、ICD-11コードで注釈付けされた1,042の標準診断を含む。
23大マルチモーダルモデル (LMM) を評価し, 診断精度が50%未満であることが確認された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:37:53 GMT)
Disagree to Explore, Agree to Commit: Routing-Guided Test-Time Scaling for Software Agents [60.7] 外部判断や選択時間テストの実行なしに,ネイティブなMoEルータトレースがステアリングと選択をガイドできるかどうかを検討する。
我々の分析は、ルーティングが堅牢な行動的役割シグナルを提供することを示している。トークン・グラニュラ・リードアウトと決定整合比較セットは、ルーティングを効果的に制御する。
オープンウェイトスパースMOEエージェントを用いたSWEベンチ検証を行い,評価を行った。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:07:03 GMT)
Decomposition Attacks Across Unlinkable Identities: Limits of Stateful Defenses for LLM Services [56.1] ほとんどの大規模言語モデルはステートレスディフェンスを使用しており、これは有害なタスクを拒否する現在の要求のみを判断する。
分解攻撃は、有害なタスクを個別に許容される要求に分割し、回答を組み合わせることで、この制限を利用する。
達成可能なセキュリティとユーティリティのトレードオフは、同じ機能に対する良質な要求がどのようにグループ化されるかに完全に依存していることを示します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 04:41:24 GMT)
MCP-Universe RL: A Framework for Training MCP Tool-Use Agents via Reinforcement Learning [54.1] 強化学習(RL)は,大規模言語モデル(LLM)のツール利用能力向上に有効な方法となっている。
既存のRLフレームワークのほとんどは、ポリシー更新で停止する。
オープンソースフレームワークであるMCP-Universe RL(MCP-U RL)について述べる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:49:04 GMT)
KeyPooling: Measuring Where LLM API Relay Paths Collapse Prompt Cache Isolation [54.0] 大規模言語モデル(LLM)APIは、顧客の認証を別々に行うが、多くの場合、共有プロバイダ認証を通じて要求を転送する。
KeyPoolingは、キャッシュのルックアップと書き込みを通じて顧客のアイデンティティをトレースする測定方法である。
すべての顧客がプロバイダ強化されたドメインに入る必要があります。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 04:39:13 GMT)
SANE: State Anomaly Neutralization for Stable Extreme-Context Delta-Rule Models [53.9] Delta-Ruleリカレントモデルは固定サイズの状態を維持しており、$O(1)$の推論メモリが可能であるが、極端なコンテキスト外挿では不安定になる可能性がある。
我々は,チャンク内並列構造を保ちながら,チャンク境界における適応$tanh$圧縮を適用したtextbfState Anomaly Neutralization (SANE)を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:41:07 GMT)
CauSec: Unboxing the Causal Drivers of Static Vulnerability Analysis Performance [51.5] 静的アプリケーションセキュリティテスト(SAST)ツールは、業界と学術の両方で広く利用されている。
これらのツールは、高いパフォーマンスを達成するために検出を犠牲にする設計上の選択をしばしば行います。
本稿では,これらのツールによる仮定は概して因果性である,というキーとなる考察を頼りに,この問題に対処することを目的とする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:15:37 GMT)
Coalition-Aware Skill Reliability for Self-Evolving Agents [49.4] エージェントのスキルバンクに蓄積したスキルが、実際にポジティブなメカニスティックな貢献をするかどうかを検討する。
銀行レベルが上昇する連立政権の公害は、負の連立政権レベルのスキル貢献を隠蔽し、クロスドメイン・ユーティリティ・リバーサル(クロスドメイン・リヴァーサル)であり、ソース・ベネシカル・スキルが移転後の効果を逆転させることを示している。
これらの知見は, スキル蓄積時の連帯認識スキル選択と, 移行後のラベルフリースキルマスキングの2つの信頼性介入の動機となった。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:35:22 GMT)
Robust Bimanual Vision-Language-Action Models via Embarrassingly Simple Modality Masking [48.9] 構造化されたトレーニング時間マスキングは、双方向操作のためのクエリベースのVLAポリシーの堅牢性を向上させることができることを示す。
その結果,構造化学習時間マスキングは,双方向操作のためのクエリベースのVLAポリシーの堅牢性を改善するための実践的な方法であることが示唆された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:48:57 GMT)
Grounded Normative Rule Generation with Structured Search [47.3] 基底ノルム規則合成(GNRS)として問題を定式化する。
GNRS-SearchはMarkov Chain Monte Carlo(MCMC)サンプリングを利用して、離散5スロットアンドオーグラフ(AOG)を最適化するフレームワークである。
GNRS-Benchは8つのシーンにまたがる116の制御目標にまたがるベンチマークであり、RealCharterBenchは53のリアルなポリシータスクに隠れたソース節で遷移を評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:43:42 GMT)
Beyond Over-Refusal: Defending Indirect Prompt Injection via Latent Instruction Manifolds [46.8] 大規模言語モデル(LLM)は複雑なエコシステムに統合されている。
LLMは、理論的証拠と経験的証拠の両方で本質的にデータから命令を分離することができる。
AEGIS (Adaptive Ensemble Guard for Injection Shielding) を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:12:33 GMT)
DeepSAGE: Stage-Aware Reinforcement Learning for Structured CBT Counseling Dialogue [44.1] 認知行動療法(CBT)に基づく段階認識型カウンセリング対話のためのフレームワークDeepSAGEについて紹介する。
DeepSAGEはこのセッションを、明確な治療目的を持った11のステージとして表現し、外部コントローラがステージ完了を決定する。
DeepSAGEは、シミュレーションされたクライアントのエンゲージメントとオープン性を高め、ステージゴール完了と対話効率のバランスを最大化します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:40:58 GMT)
Analyzing and Mitigating Cross-Lingual Degradation in Multilingual Medical VQA [42.9] 我々は8言語にまたがる多言語医療用VQAベンチマークを4つの代表的なシナリオにまとめて構築する。
言語間の劣化は、一様ではなく、シナリオに依存している。
MedVL-XLRepEを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:04:45 GMT)
Benchmarking the Titans: A Multi-Dimensional Empirical Evaluation of LLM Code Generation Quality in the .NET Ecosystem [42.0] 既存のベンチマークは、機能的正しさと構造的品質の間の重要なトレードオフを曖昧にする1つのPass@kメトリックに評価を還元する。
本稿では,C#コード生成のための多次元自動評価フレームワークを提案し,それを4つの最先端大規模言語モデル(LLM)に適用する。
我々はHumanEvalから派生した85のアルゴリズムタスクに対して制御された実験を行い、合計340の解を生成し評価し、各解は3つの独立した次元で評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:59:19 GMT)
Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding [41.3] Think with Structured Grounding (TwSG)は、複雑な画像のツール使用能力をモデル内で内部化するために設計された、新しいきめ細かいイメージ認識フレームワークである。
MLLMを用いて、地上の真実に導かれる重要な領域を特定し、教師モデルに高品質な視覚的質問応答データを生成する。
トレーニングパイプラインは,(1)複雑な推論と誤り回復の促進を目的としたマルチターンデータを用いた冷間開始制御微調整(SFT)フェーズ,(2)新しいプロセス報酬機構によって駆動される強化微調整フェーズの2段階からなる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 14:07:14 GMT)
Learning Sample-wise Rank-aware Interpolation Weights for Composed Visual Data Retrieval [40.0] クエリ固有の重みを動的に予測する最初のフレームワークであるSRAINを紹介します。
SRAINは合成ビデオ検索において最良を達成し、合成画像検索における現在の技術状況と一致する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:38:00 GMT)
GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs [39.0] textscGuideFetchは異種ロボットによる同時ガイド・アンド・フェッチミッションをコーディネートするためのフレームワークである。
我々は、スクリプトとオンラインの計画立案条件下で、90以上のシーンシードの組み合わせを実行している360シミュレータを記録している。
スケジュール、シーケンシャル、並列実行毎の90のシーンセットケースは、72/90ドル、71/90ドルの運用成功を達成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:34:12 GMT)
TONAV: Task-Oriented Navigation and Action-Velocity Chunk Learning for Articulated Object Quadrupedal Mobile Manipulation [38.4] 四足歩行の移動操作には2つの密結合機能が必要である。
本研究では,タスク指向ナビゲーションと行動速度チャンク学習を統合した統合フレームワークTONAVを提案する。
タスク指向ナビゲーションと完全なモバイル操作の両方において,TONAVがより高い成功率を達成することを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:41:23 GMT)
Two-level domain-decomposition AdaGrad method for scalable training of graph neural networks [37.5] グラフニューラルネットワーク(GNN)は、グラフ構造化データから学習するための強力なフレームワークとして登場した。
本稿では2次曲率情報と運動量で拡張されたAdaGrad法 AG2m の DD 変種を提案する。
固定計算コストでは、ベースライン AG2m と比較してGNNの性能を最大22%向上させる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 19:54:30 GMT)
HERO: Human-profile Enhanced Retrieval Optimization Framework for Long-term Agent Memory [35.9] 本稿では,Human-known Enhanced Retrieval Optimization for long-term agent memory (HERO)を提案する。
HEROは、対話履歴をトレース可能な異種メモリグラフに変換し、生の対話テキストを推論の証拠として保存する。
2つのベンチマークデータセットの実験では、HEROは事実推論とパーソナライズ推論の両方において、強いベースラインを上回ります。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:19:34 GMT)
Scaling Curriculum Learning For Autonomous Driving [35.3] CL4ADは、カリキュラム学習をバッチ化された自律運転シミュレータに統合する最初の試みである。
本稿では,成功率とエージェントの行動の現実性に基づいてキュリキュラを形作るユーティリティ関数を提案する。
我々は,カリキュラム学習がドメインランダム化よりも10億歩早く,99%の成功率を達成することを示した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:51:05 GMT)
Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules [35.2] Mol-JEPAは、分子世界のモデルを学ぶためのスケーラブルなフレームワークである。
我々のモデルは、分子構造、細胞性表現型、結合親和性、ADMETプロファイル、量子化学シミュレーションやその他の薬物発見データからの情報を活用するために、モダリティマスキングを使用する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:55:38 GMT)
Fast and Compact 3D Gaussian Splatting with Polarized Opacity Prior [33.1] 3D Gaussian Splatting (3DGS)はリアルタイムなレンダリング品質を実現するが、"モデル肥大"に悩まされる
この非効率性は、標準的な"densify-then-prune"パラダイムに由来する。
本稿では,本質的にコンパクトな表現を構築するための効率的なトレーニングフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:21:30 GMT)
Predicting Consequences and Reinforcing Navigation Policies with Latent World Models [31.9] ロボットナビゲーションのためのLWM(Latent World Model)を提案する。
我々の重要な洞察は、空間的近接は潜在的特徴の類似性と相関し、潜在的空間において行動結果を直接評価できるということである。
提案手法は,予測精度,ポリシー学習,実世界のナビゲーション性能において,前世界モデルと模倣学習法を著しく上回っている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:58:42 GMT)
Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints [30.4] 我々は,基本LMの計画品質を維持しつつ,符号化された制約を保証する制約付きデコードフレームワークであるtextbfMeta-Ctrl を提案する。
実際のテーブルトップロボット上で、生成したすべての計画が、その前提条件と目標を建設によって満足する様子を実演する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:40:19 GMT)
FreKoo++: Learning Continuous Spectral Dynamics for Temporal Domain Generalization [28.7] 時間的ドメインの一般化は、歴史的ドメインから学び、概念的ドリフトの下で見えない将来の分布に一般化することを目的としている。
本稿では,適応スペクトル分散を伴う連続クープマンモーダル力学の統一を開拓する,新しい連続スペクトル力学フレームワークであるFreKoo++を提案する。
FreKoo++は、複雑なマルチスケールドリフトと不規則サンプリングの下で最先端のパフォーマンスを達成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:22:47 GMT)
FPGAgent: An LLM-Assisted Framework for Autonomous HLS Code Generation and Verification in FPGA Environments [28.7] 大規模言語モデル(LLM)は、高レベル合成(HLS)コード生成をかなり約束している。
既存のアプローチのほとんどは、シミュレーションや合成結果のみを検証している。
本研究では,自律型HLS符号化のためのFPGA環境に適したFPGAgentを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:57:00 GMT)
GTA-RAG: Graph-Trajectory-Augmented Reinforcement Learning for Multi-Turn Retrieval-Augmented Reasoning [27.8] グラフトラジェクトリ拡張RLフレームワークであるtextscGTA-RAG について述べる。
メソッドは、Qwen2.5-3BとQwen2.5-7BのバックボーンでRLベースのRAGベースラインを一貫して上回る。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:05:20 GMT)
DiD It in 87 Minutes: A Label-Free Softmax-to-Linear Adaptation of Vision Transformers for Object Detection [27.2] Detector-Interface Distillation (DiD) は、インタフェーステンソルをソフトマックス教師のものと整列させることで、リニアアテンションバックボーンを訓練するラベルなし変換法である。
DOTA-v1.5では、DiDは確立されたベースラインと、教師付き、完全に訓練された線形モデルとの整合性を大幅に上回っている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:21:16 GMT)
Who Pays More for Safety? Measuring the Disparate Cost of Safety Alignment across Languages [27.0] 非英語利用者は、英語利用者よりも常に高い安全コストを負担していることが示される。
高リソース言語でさえ、同じレベルの安全性を達成するために、英語よりも大きな安全コストを支払っている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:18:25 GMT)
WorldToken: Time-First Sequence Modeling for Robotic Imitation Learning [26.7] マルチビュー画像やプロプレセプション,タスクコンディショニングを,各ポリシータイムステップ内で1つのワールドトークンに融合する,時間優先のポリシーインスタンス化であるWorldTokenを紹介する。
23のRoboCasaタスクでは、85.3Mパラメータポリシーがスクラッチから訓練され、1タスクあたり2,900回のデモで59.45%の平均閉ループ成功を達成した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:56:29 GMT)
HeatTok: Enhancing Remote Sensing Image Understanding via Thermodiffusion-based Tokenization [26.7] HeatTokは熱拡散凝集によって駆動されるセマンティック・アウェア・トークンーである。
熱伝導の物理的原理に触発されて、HeatTokは隣接した同質領域を適応的に結合し、意味的に独立で、オブジェクト整列不規則なトークンを生成する。
HeatTokはオブジェクトレベルのセマンティックな一貫性を効果的に保持し、合理的なトークン予算の下で最先端のパフォーマンスを達成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:11:09 GMT)
Sparse Additive Off-Policy Evaluation for Reinforcement Learning with Potentially Limited Number of Trajectories [25.8] 我々は,無限水平強化学習のための柔軟性,非線形性,解釈可能なオフ政治評価のための新しいフレームワークを開発した。
目標ポリシの値関数を推定するために,高確率有限サンプル誤差境界を導出する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:02:55 GMT)
GRAFT: Graph-Distilled Generative Retrieval for Facet-Aware Scientific Literature Exploration [24.9] 生成検索は文書識別子を直接生成する。
これら4つの面がエッジをタイプしたグラフに、論文を接続する。
11,359のNLP論文からなる構築コーパスであるLitWeaveでは、グラフ教師のRecall@20の91%を、推論時に最寄りのインデックスやエンコーダなしでリカバリしています。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:07:00 GMT)
Unified Condition-Action Modeling for Accurate One-Step Action Generation [24.6] UCA-Flowは、正確なワンステップアクション生成のための統一された条件-アクションモデリングフレームワークである。
本手法は,観測条件,時間経過条件,間隔条件,アクショントークンを単一シーケンスに統一し,統一条件-アクション変換器で処理する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:38:01 GMT)
CodeMechanic: Bug-Property-Guided Program Mitigation [24.0] 本稿では,メモリ破損に対する制約付きmit-イゲーションを生成するためのバグプロパタイズ誘導システムであるCodeMechanicを提案する。
LLMに永久的な修復を依頼する代わりに、CodeMechanicはクラッシュから侵害されたメモリセーフティプロパティを再構築する。
CodeMechanicは、3.4x - 4.3x以上のパッチを、開発者が書き直した修復と意味的に同等に生成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:06:47 GMT)
StocBench: A Benchmark for Generative Modeling of Stochastic Dynamics [23.2] 輸送型生成モデルと蒸留型数段階法の評価を行った。
大規模な模擬参照アンサンブルに対して一段階の分布精度を測定する。
多段蒸留法は多段蒸留法と競合し、特にエンストロフィースペクトルをよく保存する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:19:01 GMT)
BehaviorWorldGen: Closing the Loop between Action Models and World Simulators via Controllable Behavior-Aware Structured World Generation [22.8] 本稿では,アクションモデルと世界シミュレータのループを閉じるフレームワークであるBehaviorWorldGenを紹介する。
コアコンポーネントは、メタアクション条件付きトラフィックフローモデルであるBehavimentFlowである。
結果として生じるロールアウトは、ワールドシミュレーターによって現実的なマルチビュー観測にレンダリングされる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:53:09 GMT)
The Blending Ratio Is Not Where the Performance Is: Diagnosing Prototype Blending for Few-Shot Adaptation of Vision-Language Models [22.5] 多くの少数ショット適応手法は、ゼロショットテキストプロトタイプとKラベル付き画像特徴の平均の凸の組み合わせで分類される。
正しい比率は何か、検証データなしで見積もることができるのか、パフォーマンスがどこにあるのかを尋ねる。
4800以上の細胞(SigLIPを含む5つのバックボーン、5つのショットカウント、5つのシード、4つのプロンプトレベル)が、理論上最適な比率は間違った量の信頼できる推定値である。
検証不要な線形プローブは、オラクルチューニングされたブレンド(CLAPは+1.9ポイント、LP++は+1.5ポイント)を破る。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:02:33 GMT)
Callability Is Not Operability: Controlled Interface Interventions for LLM Agents [21.5] 我々は,エージェントが操作上の不確実性の下で安全に継続するために必要なアクション関連状態と意味をツールインターフェースが公開するかどうかを検討する。
我々は,エージェントファーストツーリング(AFT)によるツールの操作性,選択的機能発見,実行ライフサイクルとリカバリ,明示的な外部効果セマンティクス,マシン可読結果,および後条件検証を対象とするインターフェース機構のセットを運用する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:13:50 GMT)
Text-Anchored Semantic Perturbations for Transferable Jailbreak Attacks on Multimodal Large Language Models [21.5] MLLM(Multimodal Large Language Models)は、視覚と言語間の相互作用において顕著な進歩を遂げているが、その安全性はいまだにジェイルブレイク攻撃に対して脆弱である。
本研究では,テキストアンコール型セマンティック摂動攻撃(TA-SPA)を提案し,テキストアンコール型セマンティック空間における伝達可能な摂動を最適化するブラックボックスジェイルブレイクフレームワークを提案する。
実験では、攻撃効果が強く、商用MLLMに移管され、代表防御下での競争性能が向上した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:19:43 GMT)
On the Choice of Tensor Estimation for Corner Detection, Optical Flow and Denoising [20.7] いくつかの場合において、勾配エネルギーテンソルは構造テンソルの代替として使用できることを示す。
勾配エネルギーテンソルを、角検出、光流、画像強調などの一般的な画像問題に適用する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:23:12 GMT)
TRACE: Temporal Retrieval with Anchored and Convergent Evidence for Long-Horizon Video Understanding [19.8] 長ビデオの回答は、ビデオからデコードされたフレームが、その答えが依存するすべてのイベントをカバーする場合にのみ、エビデンスをサポートする。
既存の評価は、最終回答の正当性や予測された証拠間隔をスコアするが、応答前にデコードされたメソッドのフレームは監査されることは滅多にない。
VES-Benchは348の公開長ビデオに対して,時間順およびイベントカウント項目の600クエストベンチマークである。
それぞれの項目は共同で必要となるエビデンス間隔を持ち、メソッドのデコードされたフレームがそれらすべてをカバーするかどうかを3つの厳密度レベルで監査することができます。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:31:43 GMT)
Dual-Layer Agentic Memory with Fast Write Routing and Slow Consolidation [19.3] 本稿では,メモリ管理をコスト対応ルーティングと周期的パラメトリック統合を通じて書き込みフェーズに移行するフレームワークを提案する。
1.7B/8Bカスケードは、入力の50%未満をエスカレートしながら、最大68%の冗長な外部メモリをプルーする。
さらに、周期的な統合は外部知識の内在化に成功し、モデルの境界が発展するにつれて、ルータが冗長な書き込みを適応的に抑制できることを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 04:40:13 GMT)
AutoResearch: Insight In, Hallucination Out [18.4] 本稿では,アイデア生成と理想実行を結合する2段階システムであるAutoResearchを紹介する。
Idea Generationでは、AutoResearchは、新しい研究信号と蓄積されたドメイン知識を継続的に統合する。
Idea Executionでは、調整されたエージェントがこれらの計画を実験に分解し、反復的にそれらを実装し、診断し、独立したエビデンスベースのレビューを採用する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:37:13 GMT)
Motion-Aware Reasoning from Speech to Mask Tracks: Runner-up Solution for the MeViS-Audio Track of the 8th LSVOS Challenge 2026 [18.4] 音声誘導型参照ビデオオブジェクトセグメンテーションは、音声動作記述によって特定されたオブジェクトのマスクトラックを復元することを目的としている。
我々は,第8回LSVOSチャレンジのMeViS-Audioトラックに対するアプローチであるSpeech2MaskTrackを紹介する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:11:17 GMT)
On Tensor-Based PDEs and their Corresponding Variational Formulations with Application to Color Image Denoising [18.4] PDE が対応する関数に対する E-L 方程式であるために必要な条件を示す。
本手法は,現在最先端のカラー画像復調技術と比較した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:52:40 GMT)
Improving Few-Step Language Flows with Untied Self-Conditioning [18.0] フローマッチング言語モデルは、すべてのトークン位置を並列に洗練し、遅延のためのサンプリングステップを交換することができる。
我々は、この劣化の原因を、前述の自己条件における列車間ミスマッチに遡る。
このミスマッチは、自己条件入力とソルバ更新の両方を劣化させ、モデル自身の構造から各修正を導出することを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:46:17 GMT)
The Collaboration Tax: How Much LLM Multi-Agent Systems Pay to Coordinate [17.9] 個人情報を備えた2人組協調ゲームにおいて,チーム分散化損失として協調税を定式化する。
我々はこの定義を、接地摩擦の源泉によってグループ化された32個の単独抽出可能なタスクで運用し、7つのプロバイダから11個のモデルで測定する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:47:00 GMT)
MARL-Based Sequential RIS Auctions: A Physical-Layer Security Analysis [17.7] 再構成可能なインテリジェントサーフェス(RIS)は、カバレッジ、スペクトル効率、通信セキュリティを高める大きな可能性を秘めている。
中立なRIS演算子によって所有される場合、これらの要素は正統な受信機と盗聴器が競合するリソースとして提供される。
本稿では、そのような競合を調査し、正統な受信機の物理層セキュリティ性能への影響を評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:02:51 GMT)
Unfolding the Interdisciplinary Complexities of Climate Science: Fuxi-Climate Foundational Model [17.3] Fuxi-Climate Foundation Model (CFM) はドメイン間の一貫した推論をサポートするように設計されている。
専門家が設計した気候遷移タスクにおいて、CFMはトレードオフと不確実性に明示的に対処するより構造化された分析を生成する。
これらの結果は,CFMが気候リスクや遷移経路のより現実的な分析を支援することを示唆している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:43:42 GMT)
ToolRobustBench: Stage-Wise Perturbation Evaluation and Failure Diagnosis for Tool-Calling Agents [17.0] 大規模言語モデルは基本的なエージェント機能としてツール呼び出しに依存している。
クリーンなエンドツーエンド(E2E)の成功は、ツール使用障害の発生場所や、呼び出しを通じてどのように伝播するかを特定できない。
ツールコールエージェントの段階的診断ベンチマークである ToolRobustBench を紹介する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:22:49 GMT)
How Agents Represent Humans: Human-Directed Stereotypes in an Open Agent Social Network [17.0] オープンエージェントネイティブなソーシャルプラットフォームであるMoltbook上で,人間指向のステレオタイプについて検討する。
人間の指示による評価では,能力が優位であることがわかった。
補助的比較として,行動ホスト親和性を通じてエージェント・内部コミュニティのフィードバックを分析する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:07:18 GMT)
The Potential of Haptic Foundation Models [16.6] 本稿では,ハプティック・ファンデーション・モデル(HFM)の変容ポテンシャルと発達軌道について考察する。
受動的大言語モデルと視覚言語モデルから4つの中核次元にわたるアクティブなHFMへの移行に必要なパラダイムシフトについて詳述する。
既存の大規模データセットとベンチマークUniTouch,AnyTouch,T3,SparshをTacBench上で合成し,力推定,スリップ検出,相対ポーズ推定を行う。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:30:23 GMT)
When Does Visual Generation Help Visual Understanding in Unified Multimodal Models? [16.2] VGAU-Diagは視覚生成支援理解のためのきめ細かい評価フレームワークである。
我々の分析では、生成した視覚的援助はインスタンスの容易化に役立ちますが、推論の複雑さが増大するにつれて信頼性が低下します。
効果的な視覚生成は、より多くの推論ステップを追加するのではなく、視覚的理解のボトルネックを目標とすべきである。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:20:26 GMT)
Role-Specialized Mixture-of-Agents with Open-Weight LLMs for Clinical Prediction [16.1] 本研究では,医療知識検索と類似患者推論の対比を併用したMixture-of-Agents(MoA)について検討した。
検索設定を一定に保ちながら役割設計を変更することにより、主効果を最終積分器に局所化する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:22:31 GMT)
Cross-Subject Generalization in Decoding Perceived Speech from Non-Invasive Brain Recordings [15.5] Cross-Subject Perceived Speech Decoding (CPSD)フレームワークは、ソースモデル事前学習と個人特殊化の2つのトレーニングステージで構成されている。
異なるモーダル性や言語を含む3つの認識音声ニューラルデータセットに対して,提案したCPSDフレームワークを評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:50:32 GMT)
KMGen: A Skill-based Approach for Synthetic Individual Patient Data Generation [15.0] 臨床治験の患者データ(IPD)は生存モデル、メタアナリシス、安全研究の基盤である。
我々はKMGenを紹介した。KM曲線抽出を人間の誘導ツールと競合する精度で自動化する最初のエンドツーエンドフレームワークである。
KMGenは、公試登録記録から患者ごとのAEトラジェクトリを生成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:43:01 GMT)
Adapting Dense Vision-Language Relationships for Multi-label Classification with Partial Label [14.8] 言語駆動型Dense Semantic Adaptor (LDSA) を提案する。
提案するモジュールの協調学習により,提案するLDSAが,パブリックなマルチラベル分類ベンチマーク上で新たな技術を実現することを示す実験結果を得た。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:20:30 GMT)
Don' t Box Me In: Dynamic Cultural Adaptation and Cognitive Tracking for Social Understanding [14.7] 社会的相互作用は、個人が複数の文化的影響を引き出すことができる多文化的な環境でますます起こる。
既存のアプローチは、しばしば静的な人口統計属性として文化をモデル化し、ハイブリッドで動的に表現されるコミュニケーションの好みに対応する能力を制限する。
我々は,UnderlineDynamic underlineCultural UnderlineAdaptationとContinuous UnderlineCognitive Trackingを組み込むことで,流動的な社会的アライメントを実現するトレーニングフリーフレームワークDyCACを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:34:56 GMT)
LD4WAM: Learning Latent Dynamics from Human Videos for World Action Models [14.6] 本稿では,映像のブリッジ前処理と低レベル動作の具体的表現として,動作整列潜時ダイナミクスを提案する。
意味再構成と実動作アライメントを訓練した潜在ダイナミクスモデルと、変換器の混合として構築されたワールドダイナミクスアクションモデル(MoT)を組み合わせたLD4WAMを提案する。
LD4WAMは、5000時間以上の人間とロボットのデータの統合データセットに基づいて、RoboTwinシミュレーションや、グリッパーと器用な両手を備えた本物のロボット上で、強力に動作します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:09:30 GMT)
Aslema at NADI 2026: Data Augmentation for Intent Recognition and Slot Filling [14.5] NADI 2026共有タスク5のAslemaについて述べる。
意図認識とスロットフィリングの2つのサブタスクで構成されている。
ゼロショット設定で4つのOmni LLMを評価し、微調整モデルと比較した。
その結果、微調整はゼロショット推論よりも一貫して優れていた。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:22:18 GMT)
GCA: Global Centroid Alignment in Federated Learning [14.4] EmphGlobal Centroid Alignment (GCA)は,AEパラメータや勾配を送信せずにクライアントをコーディネートする潜在コード型FLプロトコルである。
1) クライアントはまず、emphreconstructionアップデートを使用してローカルAEをトレーニングし、エンコーダのラテントコードの小さなサブセットをFLサーバにアップロードする。
それぞれのクライアントはエンコーダを更新し、そのローカルの潜伏コードとエンペネレスセントロイドをアンフィアンバース数重み付けで調整し、グローバルに表現されていないパターンを強調する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:58:25 GMT)
Is Your Neighborhood Safe? Place-based Stigma in Large Language Models' Urban Safety Judgments [14.0] 名称を地理から分離する7つの指導モデルについて検討する。
評価は7モデル中6モデルの座標でほぼ平坦である。
名前の安全性が低い地域は、地域的に支配的な少数派集団の株が高い地域である。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:40:41 GMT)
Adversarial Agents on Topology Optimization: Understanding the Fragility and Robustness of Deep Learning-based and Physics-Based Design Models under Adversarial Perturbation [13.8] 物理に基づくアプローチとディープラーニングサロゲートの両方を用いたトポロジー最適化は、サイバー製造システムにおける生成設計エージェントの基盤となる。
オンラインデザイン生成の高速化により、ディープラーニングサロゲートが広く採用されている一方で、この研究は、入力摂動下での脆弱性を実証している。
生成設計モデルをターゲットにした対向エージェントを定式化したメカニックグラウンドの信頼性評価フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:23:32 GMT)
CONTRAMEM: Learning Self-Evolving Procedural Memory from Contrasting Multi-Model Trajectories [13.6] CONTRAMEMは、自己進化型プロシージャメモリのための、ソースフレキシブルでトレーニング不要なフレームワークである。
GAIA2/AREのコンピュータ使用タスクでは、CONTRAMEMは成功率の2倍以上である。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:11:26 GMT)
Interpretable AI predicts a 2026 summer dry anomaly in central China [13.5] 動的循環予測を降水量推定に変換する深層学習モデルを用いる。
3月から5月にかけての予測は、2026年夏に中国中部で一貫して乾燥した異常を示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:13:56 GMT)
Where World Models Break: Natural-Input Failure Discovery [13.3] 本研究では, 自然入力障害発見問題を定式化し, 重度の予測リスクを生じさせる環境変数条件と行動プレフィックスを求める。
本研究では,不確実性誘導型グローバルサーチと型付き局所置換器とのペアリングにより,有効な入力の基盤構造を利用するBassenLensを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:53:15 GMT)
Self-Supervised Graph Representation Learning for In-The-Wild Wearable and Smartphone based Emotion Recognition [13.3] ウェアラブルとスマートフォンによる感情認識(WER)は、今でも感情コンピューティングにおいて難しい課題である。
グラフノードの分類を通してWERモデリングを探索する動機となる。
我々は、ラベル付きおよびラベルなしのデータと、教師付き、半教師付き、SSLメカニズムを利用して、トレーニング中にサブグラフサンプリングアプローチを採用する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:15:52 GMT)
SchemaGUI: A Schema-Driven Benchmark for Controllable GUI Generation Evaluation [13.0] 制御可能なGUI生成評価のためのテンプレートベースのベンチマークを提案する。
ペアの自然言語命令と決定論的関数呼び出し参照により、GUIは数千の決定論的注釈付きタスクを生成することができる。
Qwen3.5ファミリ、Qwen3-Coder-30B、DeepSeek-R1の5つの主要なモデルをベンチマークします。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:34:49 GMT)
M$^3$ISR: A Multi-Modal Multi-View Benchmark for 3D/4D Gaussian Splatting and Feedforward Compression [12.9] M$3$ISRは3Dおよび4Dガウススプラッティングのための制御された合成ベンチマークである(3DGS/4DGS)。
このベンチマークには、屋内と屋外の5つのシーングループから25のシーン、カメラとモーションの2つの構成、6つの同期1080pビュー、そして密集した地味のアノテーションが含まれている。
我々は,M$3$ISRを3DGS合成,4DGS合成,4DGSストリーミング,3DGS圧縮,4DGS圧縮を含む5つの補完トラックに編成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:44:39 GMT)
Hyper^2: Unleashing Hyperbolic Geometry's Full Potential via Dual-Space Consistency [12.8] HyperbolicCDは点雲完成のための双曲幾何学を開拓した。
損失は双曲的であるが、それが逆伝播するエンコーダはユークリッドである。
HyperbolicCDを拡張したデュアルスペース一貫性フレームワークであるHyper2を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:29:40 GMT)
TRACE: Transition-Aware Residual Control for Multi-Objective Materials Discovery [12.8] 既存のエージェントは評価された候補とそのスコアを格納するので、どの素材が成功したかはわかるが、どの編集が有用なプロパティ変更を引き起こしたかは分かっていない。
我々は、評価された編集をフィードバックの基本単位として扱う、トランジション対応残差制御フレームワークTRACEを提案する。
TRACEは、各ローカルリファインメントを、観測されたプロパティデルタによる親子移行として記録し、トランジションエビデンスを集約して再利用可能な編集効果を推定し、予測能力によって将来の編集をランク付けする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:20:35 GMT)
OmniCAD: A Large-Scale Benchmark for 3D Spatial Reasoning in Robotics Assemblies [12.8] OmniCADは様々な産業システムにまたがる3次元空間推論のための大規模ベンチマークである。
OmniCADには25kの機械組立体があり、1組平均12個の部品と21種類の交尾関係がある。
我々は,正確な,物理的に有効な,スケーラブルな3Dアセンブリ推論の研究を支援するために,ベンチマーク,評価コード,ツールインターフェースをオープンソース化する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:42:28 GMT)
MRMAD: A Multi-Round Multi-Audio Benchmark for Evaluating Acoustic Degradation Perception in Large Audio-Language Models [11.1] 大規模音声言語モデル(LALM)における音声劣化知覚と理解のベンチマークであるMRMADを導入する。
MRMADは、音声、音楽、音声にまたがり、複数の音声入力に対するマルチターン対話としての評価を行う。
現在のモデルは、劣化を確実に診断、比較、または理由付けを怠りながら、粗い内容を認識することが多い。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:23:31 GMT)
UR$^{2}$-MLLM: Uncertainty-aware Revisit Reasoning in Multimodal Large Language Models for Radiology Report Generation [11.0] 既存の手法は推論中に動的再検討機構を使わずに静的な視覚的証拠を提供する。
本稿では,不確実領域を動的に再検討する不確実性対応リビジット推論MLLMフレームワークを提案する。
MIMIC-CXRとIU-Xrayの実験は、UR$2$-MLLMが最先端の性能を達成することを示した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 04:43:45 GMT)
Learning from the Test: Self-Referential Differential Testing for Deep RL Agents [11.0] 深層強化学習(DRL)は複雑な意思決定問題において大きな成功を収めた。
現在の研究は主に安全クリティカルな障害の検出に重点を置いており、しばしば政策の最適性を無視している。
本稿では,DRLエージェントの安全性クリティカルバグと最適バグの両方を自動的に識別するフレームワークであるDeltaを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:22:27 GMT)
A Query-Time Framework for Transient 2D Pore-Scale Flow Prediction and Generative Design [10.7] 気孔流は多孔質メディア工学応用における輸送および透過性挙動を制御している。
本研究では,幾何条件のクエリ時演算子として一過性の細孔流予測を定式化する。
このフレームワークは、多孔質媒体の過渡流予測、トランスポート・アウェア・スクリーニング、LBM検証逆設計を統一する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:13:10 GMT)
Do Not Copy/Paste: Soft Barriers for Copying in AI-Assisted Programming [10.4] チャットウィンドウからエディタへの関数のコピーには1秒もかからない。
本稿では,コピーペーストをEmphAIコードハンドオフ問題として扱う。
ハンドオフ対応機構の一類としてemphsoftバリアを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:52:13 GMT)
Iteration Without Elaboration: A Simple ReAct Architecture Suffices for Text-to-SQL Generation [10.4] 我々は、反復推論に基づいて構築されたゼロショットフレームワーク textbfReAct- と、15の操作からなる型付きドメイン特化言語(DSL)によって定義された制約されたアクション空間を示す。
修正されたBIRD mini-dev と EHR- では、ReAct- はそれぞれ textbf84.5% と text73.9% の精度を達成し、より精巧なベースラインとほぼ一致し、最大 8times$ の高速化を実現した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:16:20 GMT)
Read Less, Solve More: Token-Efficient Sparse Reading for AI Agents [10.3] ロングホライゾンエージェントは、外部のアーティファクトへの繰り返しアクセスに依存する傾向にあるが、現在の読み取りインタフェースは、スパースエビデンスしか必要としない場合でも、オブジェクト全体を露出することが多い。
我々は、不要な証拠がモデルコンテキストに到達する前に、コンテンツ入力を制御する、トレーニング不要で、モデル透過的な読み出し層であるSparseReadを紹介する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:24:26 GMT)
Q-Learning with Stable Infinite-Dimensional Linear Function Approximation [10.2] 安定な無限次元線形関数近似フレームワークを開発した。
凍結事前学習ネットワーク下での線形密度近似と出力層ニューラルウェイトトレーニングによるQラーニングによるフレームワークについて説明する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:40:11 GMT)
Error Propagation Theory for Variational Non-Markovian Open Quantum Dynamics [10.0] 時間進化における微小な誤差でさえ、物理的観測値のかなりのずれに変換できる。
変分非マルコフ力学における誤り伝播を特徴付ける理論的枠組みを開発する。
本分析により,長期環境記憶によって駆動される本態的なエラーバックフロー機構が明らかになった。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:17:46 GMT)
Scale-invariant Optimal Sampling for Rare-events Data with Sparse Models [10.0] サブサンプリングは、稀な事象を伴う大量のデータに対する計算上の課題に取り組むのに有効である。
既存の最適なサブサンプリング確率はデータスケールに依存し、いくつかのスケーリング変換は非効率なサブサンプルをもたらす可能性がある。
この課題に取り組み、スパースモデルの文脈でスケール不変な最適サブサンプリング関数を導入する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:03:34 GMT)
Hybrid Panels: Toward Human-AI Collaboration in Survey Research [9.8] 大規模な人口調査は、堅牢な社会的・科学的洞察を生み出すのに不可欠である。
人工知能の進歩は、AIが支援する調査インフラの新しい機会を開いた。
最初のパイロットを構築できる有望なAI対応調査インフラストラクチャは、ハイブリッドパネルです。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:27:48 GMT)
Beyond What Meets the Eye: Unveiling Situational Illusions for Multimodal Large Language Models [9.4] 実世界の状況は、その基盤となる物理的状態から逸脱し、実践的な応用においてマルチモーダルな大規模言語モデル(MLLM)の信頼性に挑戦する。
この現象を状況錯覚と呼び、このような錯覚の下でMLLMがどのように機能するかを考察する。
我々は、文脈的理解のための視覚的証拠を体系的に検査し、推論し、クローズドソースモデルのプロンプトを開発し、オープンソースモデルの微調整を監督するという、中核的な考え方に基づいている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:03:41 GMT)
GraniKV: Asymmetric Granularity KV-Cache Paging for Multi-Agent Systems with Long Shared Prefix [9.2] GraniKVは生産用ページドサービスエンジンのKVキャッシュに非対称なページング粒度を適用した最初のシステムである。
記憶層だけは 新聞を動機づける政権の勝利を 担っている
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:29:29 GMT)
AI-based worker guidance in assembly and disassembly operations using multimodal ego/exo-centric data capture and structured task knowledge [9.2] 組み立てと分解のプロセスは、文書化、再利用、転送が難しい専門家の知識に依存します。
本稿では,エゴセントリックおよびエゴセントリックな記録を用いて,専門家による実験から構造化タスク知識を抽出する手法を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:41:33 GMT)
When Do VLMs Help Arabic Manuscript OCR? A Cross-Dataset Study [9.1] 従来のOCR, 汎用VLM, アラビア特化VLM, および8つのアラビアテキストデータセット間でのOCR条件付きVLM補正を評価した。
OCR-priorリカバリは、OCR出力が視覚的かつテキスト的にリカバリ可能である場合に有効であり、VLMが画像に対して洗練できるアンカーを提供する。
追加の診断では、アラビアのVLM-OCRデータセットは、ダイアクリティカルス、前処理、生成予算、繰り返しループに敏感であることが示されている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:12:06 GMT)
From Symmetry to Invariance: Learning Galois Equivalent Representations in Finite Fields [8.6] 我々は、基底の変化の下で有限体における乗法を通して問題を研究する。
ガロア作用は基底表現を軌道に整理し、同じ軌道上の基底は同じ座標乗法写像を誘導する。
ベース表現間のガロア作用を予測するためにモデルを訓練する。
学習された変換の繰り返しの応用は、各軌道の正準代表を構成するために使用される。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:19:54 GMT)
GeoRisk-RAG: A Hierarchy-Aware Risk Framework for Improving RAG Reliability through Selective Answering [8.5] 提案するGeoRisk-RAGは,この地理的妥当性のギャップを選択的解答によって解決する階層型フレームワークである。
新たな山火事関連質問回答データセットの実験により、GeoRisk-RAGは位置依存質問に対する疑似信頼率を著しく低下させることが示された。
この研究は、地理空間領域における安全な意思決定のための地理的妥当性と選択探索行動を統合することにより、エンドツーエンドRAGパイプラインのより包括的な評価を提供する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:39:21 GMT)
ReART: Reference-Guided Retrieval and Refinement for Emotion-Aware Art Generation [8.1] 本稿では,参照誘導型検索・改善フレームワークであるReARTを紹介する。
本手法は,EmoArtデータベース内のテストキャプションと画像アノテーションを構造化された視野に分解する。
我々のシステムは、AffectiveArt 2026 Grand Challengeのトラック1の2位にランクインし、完全なAAS1.00、総合スコア0.78を達成しました。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:56:30 GMT)
Model-Consistent Byzantine-Resilient Decentralized Federated Learning for Collaborative Missions [7.8] 分散連合学習(DFL)は、自律ノードが中央サーバに頼ることなく、AIモデルを協調的にトレーニングするための、有望なパラダイムである。
本稿では、分散ノードがグローバルモデルの一貫性と協調的なトレーニングを行える新しいビザンチン耐性DFLアーキテクチャであるDFL-Cを紹介する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:57:27 GMT)
Claim-Level Confidence Calibration for Reliable Decision Making with Large Language Models [7.7] 大規模言語モデル(LLM)は、ハイテイクドメインにおける意思決定をますますサポートします。
LLMはしばしば、事実の正しさと不一致した自信を幻覚し表現する。
判定関連不確実性信号としてのクレームレベル信頼度校正について検討する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:09:54 GMT)
More accurate behavioral predictions with hybrid Bayesian-connectionist models [7.5] 両伝統を最大限に活用するためのアプローチとして,行動調整(BBT)を用いたベイズ蒸留を紹介した。
BBTはモデル構築の簡単なレシピを提供する: まず、ニューラルネットワークは合成データを通じてベイズモデルを模倣するように訓練され、次に、ネットワークは人間の振る舞いに基づいて微調整され、追加の構造とニュアンスをキャプチャする。
BBTは人間の行動を予測する従来の手法よりも優れており、心理学的洞察も示している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:50:47 GMT)
DAW: Dynamics-Aware Weighting for Deep Learning Forecasts of Chaotic Systems [7.5] データ中心の客観的再重み付けフレームワークであるDynamics-Aware Weighting (DAW)を紹介する。
カオスKS方程式では、DAWは一様トレーニング、純粋に統計的密度重み付け、およびランダムに置換されたアブレーションを一貫して上回る。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:07:03 GMT)
OVIBench: Benchmarking Online Video Question Answering under Interruption [7.3] 視覚言語モデル(VLM)を評価するための最初の標準ベンチマークであるOVIBenchを紹介する。
OVIBenchは割り込みをCancellation、False Trigger、Correctionの3つのタイプに分類し、オープンエンドとマルチチョイスの両方の評価をサポートする。
実験により、OVIBenchはモデルの割り込み処理能力を効果的に区別できることが示されている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:12:08 GMT)
From Triage to Discharge: A Survey of NLP Tasks, Methods, and Open Challenges in the Emergency Department [7.3] 救急部門(ED)は、時間的プレッシャーの下で活動し、臨床会話、トリアージノート、退院文書などのマルチモーダルデータを生成する。
自然言語処理(NLP)の最近の進歩、特に事前訓練されたトランスフォーマーと大規模言語モデルにより、言語と時間集約的な救急医療を支援する新たな機会が生まれている。
本調査は, EDの3段階, トリアージ分類, 臨床要約, 自動診断, レポート生成, 退院文書の3段階にまたがる46の論文を分析した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:07:15 GMT)
CBX-Bench: A Human-Aligned MLLM Council for Benchmarking Concept Bottleneck Model Explanations [7.3] 概念ボトルネックモデル (Concept Bottleneck Models, CBM) は、人間の理解可能な概念を通じて予測を表現し、視覚的分類を解釈できるように設計されている。
CBMは下流分類の精度によって予測モデルとして評価され、孤立した定性例によって補足される。
我々は、画像とそのCBM説明が与えられたマルチモーダル大言語モデル(MLLM)カウンシルを開発し、説明品質スコアを生成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:39:56 GMT)
Semantics or Structure? Auditing Text Sensitivity in Multimodal Time-Series Forecasting [7.1] マルチモーダルな時系列予測は、自然言語の文脈が予測性能を改善することを期待する、有望なパラダイムとして現れてきた。
最近のマルチモーダル基盤モデルであるAuroraは、Time-MMDベンチマークにおいて、単調なベースラインよりも大幅に向上し、これらの改善をテキスト情報に寄与していると報告している。
制御されたテキスト摂動、帰属分析、オーロラのテキスト経路の探索を通じてこの問題に対処する。
このベンチマークと冷凍エンコーダアーキテクチャのファミリにおいて、テキストの内容は報告されたゲインの背後にある操作信号ではないと結論付けている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:35:54 GMT)
VERDICT: Agreement Beats Pixel-Space Verification in Real-Document OCSR [6.9] VERDICTは、分子記録の検索と検索のための画像ベースのインタフェースである。
構造画像、機械可読表現、およびソース公開情報をリンクするマルチモーダル分子データベースの検証済みラベルを可能にする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:41:06 GMT)
AUDITA: certified auditing and causal attribution of adverse outcomes in autonomous multi-agent systems [6.6] 本報告では, 段階的因果帰属エンジンを用いて, エージェント間コマンド毎のタンパー・エビデント・レコードをペアリングする監査層を提示する。
監査人は ログに関する議論から 誰が責任を負うかという疑問を 証拠の計算に変えます
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:22:09 GMT)
Arbitrage-Aware Multi-Step Forecasting of Implied Volatility Surfaces: Modelling Surface Trajectories Using Latent Diffusion [6.6] インプリッド・ボラティリティはオプション市場を要約し、多くの金融アプリケーションの中心となっている。
そこで本稿では, インプリートボラティリティ表面の30段階の連成軌道とそれに基づくリターンを生成するための条件付き潜時拡散フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:04:08 GMT)
Training-Free VLM Personalization via Calibrated Residual Decoding [6.6] ビジョン言語モデルは、トレーニングなしの方法でパーソナライズすることができる。
直接パーソナライズされたプロンプトは、モデルがそのような証拠を確実に活用することを保証しない。
トレーニング不要な残留復号化フレームワークを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:51:24 GMT)
CiUNet: A Hybrid Swin-CNN UNet for Medical Image Segmentation [6.5] 本稿では,Swin-UNetフレームワーク上に構築された軽量ハイブリッドアーキテクチャを提案する。
我々のモデルは,Swin Transformerの浅層推論と局所的なテクスチャ特徴を補完する並列CNNエンコーダを統合している。
我々のアプローチは最先端のDiceスコアとHausdorff距離を達成し、臨床展開のための正確で効率的で解釈可能なソリューションを提供する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:19:55 GMT)
Physical Agentic AI: An Architecture for Orchestrating a Robot Crew with LLMs [6.2] 本稿では,スキルグラウンドロボットエージェントオーケストレーションのためのフレームワークであるPhysical Agentic AIを紹介する。
ロボットオーケストレーションレイヤは、スキルライブラリ、ロボット状態、名前付きロケーション、ワークフローコントラクトを非アクチュエータミッションプランナに公開する。
我々は,ガゼボで全条件で全ミッションが実行され,ドローン-UGV検索・ディスパッチミッションを評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:35:31 GMT)
Clarify User Expertise: Towards Proactive Conversational Agents Tailoring Responses to User Proficiency [6.2] PASSINGは、ターゲットの問い合わせを通じて、エージェントがユーザーの専門知識を積極的に明らかにすることを目的としている。
私たちのWhat-to-ask戦略とHow-to-ask戦略によって実現されています。
PASSingは、より人間中心の会話エージェントを作るための重要なステップであると考えています。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:54:31 GMT)
Query-Driven Multimodal Information Extraction from Long Documents [6.2] 本稿では,長い文書から問合せ駆動による画像-テキスト共同抽出を提案する。
ユーザ意図と文書の内容の両方に関わる課題に基づいて、2段階の分類を設計した。
私たちは、この新しいタスクのための最初の高品質で手動でアノテートされたベンチマークであるITJointを構築します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 04:37:34 GMT)
Syntax Element Encryption for H.265/HEVC Using Chaotic Map-Based Coefficient Scrambling Scheme [6.1] テクスチャマップに基づく新しい係数スクランブルスキームを提案する。
このスキームは、スライスと同期して動作し、スライスが失われても、ビデオコンテンツの復号化が無傷であることを保証する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 19:46:50 GMT)
A Lightweight Multimodal Vision-Language Framework for Early-Stage Anatomical Green Fruit Classification in Commercial Orchards [6.1] そこで本研究では,TinyCLIPを微粒なフルーツレット解剖分類に適用した,軽量な視覚言語フレームワークを提案する。
Scilate と Scifresh のリンゴ果樹園から収集した600の高解像度 RGB 画像のデータセットを 224 x 224 の画像パッチに変換した。
112ピクセルのストライドを持つスライディングウインドウ推論戦略は、パッチレベルの予測を空間熱マップに集約する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:26:14 GMT)
Aggregation-Aware Synthetic Text Generation Against Authorship Re-Identification [5.9] AAST(Aggregation-Aware Synthetic Text Generation)は、各テキストを個別に最適化するのではなく、バンドルレベルで合成テキストを共同で選択するフレームワークである。
AASTは、生成や選択中に観察されていないジャンルから攻撃者を参照するクロスジェネリックな設定を含む、属性と検証攻撃をターゲットとしている。
バンドルサイズとしてのAASTアカウントレベルのリンカビリティは増加し、セマンティックな品質、言語的アクセシビリティ、感情アライメントが維持される。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:26:07 GMT)
Efficient Regression Models for Scan Statistics [5.7] 実数値信号の統計をスキャンするための新しい回帰モデルを提案する。
これにより、スキャン統計によって特定される間隔異常とは対照的に、非定常信号の適合性が改善される。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:44:32 GMT)
Neighbor-embedded Graph Neural Network-based Crowd Delivery Traffic Management in Smart City [5.7] この研究は、新しいtextitNeighbor-Embeded Graph Neural Networkベースのクラウドデリバリトラフィック管理(NeCDM)モデルを導入している。
提案モデルでは,L1損失の最大4.03%の削減を含む,計算効率の顕著な向上を実現している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:58:06 GMT)
Relaxation-Rectified Anti-Jaynes-Cummings Cascades for Autonomous Fock-State Stabilization [5.7] 本稿では,Kerrキャビティにおける所定のFock状態の安定化を,補助量子緩和と反Jaynes-Cummings相互作用の整合による自律的スキームを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:48:59 GMT)
Dataset Complexity Shapes Finite-Distance Loss Geometry in Neural Networks [5.6] データセットは同じサイズと低次の統計を共有できるが、構造的な複雑さは強く異なる。
このデータセットの複雑さと損失ランドスケープの幾何学を、学習されたニューラルネットワークソリューションを中心とした局所エントロピーと、近隣のスケールをまたいだ局所ラベルの混合と組み合わせることで結合する。
これらの結果から,データセット構造は訓練された解から有限距離にわたって低損失近傍が構成されていることを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:01:09 GMT)
CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents [5.6] GUIエージェントは、テキストアクションレコードとして安価に完全なインタラクショントレースを保持することができるが、高忠実度ピクセルのポリシーにいくつかの過去のイベントしか公開していない。
各イベントは要約のみの形式で持続し、アーカイブされたスクリーンショットにリンクされる。
代わりにCaulCacheは、完全なトレースに対して同じ$B$のプロモーションを再配置する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:04:21 GMT)
Geometric Structures on Graphs: a Holonomy-Based Discretization of Curvature [5.5] 本稿では,局所対称正定値メトリクスを備えたグラフ上での曲率の離散化のためのホロノミーに基づくフレームワークを提案する。
(mathcal C)はホロノミー(H_mathcal C)を与え、その正規化関係(_mathcal C=-s_mathcal C-1operatornameLog(H_mathcal C)を有限ループ曲率観測に用いる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:03:19 GMT)
Sharp Barron Regularity Results for Coulombic Many-Electron Wave Functions [5.4] 我々は、普遍遮断ジャストロー因子の抽出後のクーロン多電子波関数に対する鋭いバロン正則性を確立する。
粒子数と核データのみによらず、固有関数や固有値によらず、対応する全ての商を$mathcalB2$にすることができる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:23:28 GMT)
Quantum-Inspired Hybrid Neural Networks for Neural Decoding: A Controlled Ablation Study of Learnable Quantum Sidecar Integration [5.3] 本稿では,ResNet-50バックボーン内に残余のサイドカーモジュールとして集積されたパラメータ化量子回路(PQCs)について検討した。
ベースライン, 量子サイドカーとフリーズインプットプロジェクション, バックボーン・グラディエント・トレーニングプロジェクションの量子サイドカー, アングルエンコーディングを回路計測結果と整合させる測定誘導変種を比較検討した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:55:43 GMT)
Multiple View Neural Regression of a Facial Shape Model [5.2] VarISは高解像度の立体形状と反射率マップを撮影するためのカスタム光球である。
合成多視点画像から再分類された顔メッシュを直接予測するために,ディープラーニングフレームワークを提案する。
このシステムは、人間の監督を最小限に抑えて、リギングとアニメーションに適した標準化されたメッシュを生成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:31:44 GMT)
From Detrimental to Beneficial: Dynamic Influence-based Valuation and Editing [5.2] DIVE(Dynamic Influence-based Valuation and Editing)は,バッチレベルのサンプル値を動的に推定する,新しい,効率的なフレームワークである。
生データを変更するのではなく、DIVEはトレーニング中に有害サンプルの勾配方向を戦略的に逆転することで最適化レベルで動作する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:46:18 GMT)
GCS-Bridging: Restoring Connectivity of Disconnected Convex Sets for Graph-of-Convex-Sets Motion Planning [5.2] グラフ・オブ・コンベックス・セット(GCS)に基づく軌道最適化は、コンベックス集合の有限集合として構成空間における衝突のない領域を表す。
既存のGCSベースの軌道計画手法は凸領域間の十分な接続性を前提としている。
衝突のない点経路と凸領域のインフレーションによって接続された凸領域を再接続するGCS-Bridgingを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:43:16 GMT)
DreamMimic: Learning Visuomotor Whole-Body Loco-Manipulation via World Model [5.1] 視覚に基づくヒューマノイドロボットの全身操作は、部分的観察性、接触豊かなダイナミクス、高次元視覚入力から長距離動作を学ぶことの難しさにより困難である。
本稿では,教師の特権的政策を世界モデルによる蒸留を通じて視覚ベースのヒューマノイドコントローラに蒸留する枠組みを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:08:39 GMT)
Recovering Weighted Tangent Geometry from a Single-Scale Score Field [5.1] 1つの雑音レベルのスコア場が、分岐中心と等質度$d$が未知のとき、重み付けされた接地幾何を決定することを示す。
また、正の$C0,$密度を持つ有限平面$C1,$分岐に対して、有限ノイズスコアから接モデルへの$O()$収束を証明する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:07:12 GMT)
Beyond Dense Adam States: Adaptive Log-Space Quantization for Memory-Efficient Optimizers [5.0] 言語モデル事前学習による状態トレースを特徴付け,適応ログスペース(AL)量子化を導入する。
ALは非負の状態に対するブロックワイズ表現であり、ブロックごとに0の範囲を適応し、正確なゼロを保っている。
96時間以上で合計214.7時間動作し、AdamW、Ada、CAME、APOLLOパスを評価した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:36:56 GMT)
A Unified Neural-Aided Alignment and Calibration Method for AUVs [4.9] AUVは正確な航法のために慣性航法システム(INS)とドップラー速度ログ(DVL)の融合に依存している。
本稿では、両ステージを補完する2つのニューラルネットワーク、アライメントのためのResAlignNetとキャリブレーションのためのDCNetに置き換える、完全なニューラルネットワークによるDVLパイプラインを提案する。
5つの異なるセンサーエラー終端の組み合わせで記録された実世界のデータを用いて、提案されたパイプラインは、モデルベースベースライン平均68.7%の速度ルート平均二乗誤差を削減した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:32:37 GMT)
Token-Level Likelihood-Array Regression for Membership Inference and AI-Generated Text Detection [4.7] そこで我々は,Nested left-context windowの下で各ターゲットトークンを評価するLARを提案する。
LARは、検出情報がコンテキストスケール、トークン位置、および可能性の特徴によってどのように変化するかを学ぶ。
LARは、可能性ベースのベースライン上での会員推測とAIによるテキスト検出を大幅に改善する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:30:29 GMT)
Lessons from the Hardware Hacking Competitions: Verification Techniques, Findings, and Insights [4.7] 本稿では, 脆弱性分析の実践的戦略, 観察結果, およびセキュリティ・アウェア・検証の教訓について述べる。
本稿では,シミュレーションに基づく検証,形式検証,リント解析,大規模言語モデル(LLM)によるバグ検出,カバレッジ誘導型ハイブリッドファズリングを組み合わせたマルチストラテジー脆弱性分析手法を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:44:50 GMT)
Self-Calibrating Dense Displacement Fields for Reliable Co-Registration of Large Optical Satellite Imagery [4.7] 共同登録は、光学衛星画像の時間・マルチセンサー利用のほぼすべての基盤となる。
SCDF, トレーニング不要なGPUフリーな推定器で, 動きモデル自体が画素あたりの高密度変位場である。
実際のSentinel Landsat-8/9とNAIP画像から構築された584基の地上トラスペアでは、SCDFは故障のない全てのペアを登録する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:50:59 GMT)
Modality Contribution Score - A Per-Patient Framework for Quantifying the Relative Diagnostic Contribution of Structural MRI and Amyloid PET in Alzheimer's Disease [4.6] 構造MRIとポジトロン・エミッション・トモグラフィ(PET)を組み合わせたマルチモーダル・ニューロイメージングは、アルツハイマー病(AD)連続体における構造と機能の関係を捉えている。
本稿では,MCNet(Modality Contribution Network)とMCS(Modality Contribution Score)を紹介する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:48:19 GMT)
Small Reasoning Models are Instruction Followers in Function Calling [4.5] 関数呼び出しはエージェント型大規模言語モデル(LLM)のコア機能を表す
Instruction-Followed Function Calling (IFFC) は,関数呼び出しロジックを一次LLMから分離する新しいフレームワークである。
IFFCは、ネイティブ関数呼び出し(NFC)とプロンプトベースの関数呼び出し(PFC)の両方のベースラインを一貫して上回っている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:51:26 GMT)
Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains [4.3] ICU-REACTは19名の臨床医と共同で開発された推論データセットである。
我々は8B-70Bパラメータと3つのモデルファミリーにまたがるClin-REACTモデルを微調整した。
5つの臨床推論ベンチマークで、Clin-REACTはバックボーンモデルとオープンソース汎用および医療用LLMを一貫して上回った。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:14:04 GMT)
XHotpotQA: A Benchmark for Cross-Lingual Knowledge Composition in Multi-Hop Question Answering [4.1] XHotpotQA(XHotpotQA)は、言語間知識合成のベンチマークである。
監査されたリソースには15,661のトレーニングと7,405のバリデーションインスタンスが含まれている。
完全な質問-証拠のミスマッチは、部分的なアライメントよりも10.25から15.79低いUnicode対応の回答F1と関連付けられている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:05:04 GMT)
On the Capability Separation Between World-Model Policy Learning and Imitated World-Action Models [3.8] 我々は,行動閉鎖政策,模倣訓練された世界行動政策,行動条件付き世界モデルに最適化された政策を比較した。
将来の予測は、学習因子化を変えるが、制約のない外部ポリシークラスや理想的な模倣ターゲットは変えない。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:25:31 GMT)
TransHands: Repurposing Human Pose Encoders as Hand Pose Encoders [3.8] トレーニング済みの人体動作エンコーダを3Dハンドポーズ推定に効果的に適用可能な,バックボーンに依存しないトランスファー学習フレームワークであるTransHandsを紹介した。
変換器ベース,グラフベース,周波数ドメインモデルを含む4つの最先端モーションモデリングアーキテクチャを対象に,TransHandを評価した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:17:09 GMT)
Fusing Perceptual Vision Experts with Multimodal Large Language Models for Explainable Plant Disease Diagnosis: From Benchmark Imagery to Real-World Robotic Field Validation [3.7] We present the Hybrid Hierarchical Multi-Agent Framework (H$2$MAF) which with decision-level fusion of EfficientNet-B3 and ConvNeXt-Tiny with semantic arbitration。
PlantDocでは、Gemmaは精度を63.9%から68.5%に改善し、41.7%のCNN競合サブセットで+7.6ポイントを達成した。
これらの結果はMLLM仲裁を、説明可能な農業AIとロボットフィールド決定支援のための、有望で校正に依存したアプローチとして確立する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:20:20 GMT)
HANSARD: A Reference Architecture for Forensic Readiness, Runtime Witnessing, and Graded Attribution in Autonomous Multi-Agent AI Systems [3.7] 現在、自律型マルチエージェントシステムは、金融、ソフトウェアサプライチェーン、セキュリティオペレーションで機能している。
何が起きたのか、何を引き起こしたのか、誰が責任を負うのかをしっかりと決める方法はありません。
これは、証明法医学が間違った抽象化で機能し、形式的因果関係は因果関係を仮定し、エージェント監査は自己記録を信頼するからである。
ターゲットの障害モードは、帰属的な洗浄であり、いかなる原因にもならないまで、冗長なエージェントに作用を広げる。
本稿では,説明責任をライフサイクル特性として扱う参照アーキテクチャであるHANSARDを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:18:22 GMT)
Weakly supervised concept Bottleneck Learning for Robust Two stage Object centric visual reasoning [3.7] 2段階のニューロシンボリックアーキテクチャは視覚的問題解決のためのエレガントなパラダイムを提供する。
本稿では,オブジェクト中心のVAEフレームワークであるDynamic Orthogonal Concept Bottleneck (D-OCB)を紹介する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:39:49 GMT)
Inclusion-Minimal local indistinguishability: a weak form of nonlocality [3.6] 量子状態の局所的識別は、分散量子情報処理の基本的な課題である。
そこで本研究では, 単一コピーレベルでは局所的不連続性は非自明であるが, 候補状態の除去やコピー資源の緩やかな増加にともなって脆弱であることを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:40:58 GMT)
Cross-Generation Optimization of YOLOv26, YOLOv11, and YOLOv8 for Fine-Grained Small-Object Detection and Instance Segmentation in Complex Orchards [3.3] 本研究は, リンゴ果実, カリックス, ペプンクル構造を検出, 分別するUltralytics YOLOv8, YOLOv11, YOLOv26のクロスジェネレーションベンチマークを提案する。
Peduncleは、最も難しいクラスにとどまった。全体としては、小さなオブジェクトに焦点を絞った、コンパクトでモデレートなYOLOモデルは、精度の高いトレードオフを提供する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:00:22 GMT)
Beyond Instance Slots: Semantically Rich World Models for Physical Interaction Planning [3.3] 本稿では,5つの機能的役割を中心に構成されたタスク条件付き世界モデルであるSemantically Rich World Model (SR-WM)を提案する。
SR-WM内では、ビジュアルエンティティエンコーダが事前訓練されたパッチ機能からソフトエンティティ仮説を抽出し、セグメンテーションマスクがオプションの提案先として機能する。
行動条件付きダイナミクスモデルは、把握/接触、述語確立、関係保存、フィクスチャ状態、位相変化など、きめ細かな意味論と共に役割遷移を予測する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:37:59 GMT)
When Does AI for PDEs Yield Scientific Evidence? [3.0] 我々は、広く使われているPDEシミュレーションベンチマークと、PDE逆問題に対する包括的なベンチマークを拡張して、モデル出力が特定の科学的クレームをサポートするかどうかを評価できるようにする。
以上の結果から,数値的精度と明らかなサポートは,モデルが異なるランク付けが可能であり,いつ,なぜそうなるのかを説明でき,既存のベンチマークでは,科学的関心の主張に対するより弱い支持を提供する手法が好まれることが示された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:47:10 GMT)
Tracing the Unlabeled Storm: Cross-Variable Transfer in a Lagrangian Atmospheric JEPA Framework [2.9] 深層大気の対流は南アジアモンスーンの変動を支配している。
しかし、無膨らんだ重い尾の降水から直接潜在世界モデルを学習しようとすると、最適以下の予測表現が得られる。
このミスマッチに,Emphcross-variable proxy learningを用いて対処する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:50:21 GMT)
Rust for Secure Backend Development: A Critical Review and Extended Vulnerability Comparison with Node.js and Django [2.9] Rustプログラミング言語は、メモリ安全性とコンテキスト脆弱性のクラス全体を排除したと広く信じられている。
本稿では,産業環境におけるRustのセキュリティ姿勢に関する先行研究について批判的なレビューを行う。
Rustのコンパイル時の保証がシステム層を支配しているのに対して、マネージドバックエンドフレームワークはアプリケーション層により強力なビルトインディフェンスを提供します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:15:10 GMT)
Deep adaptive design with an evidential bias criterion [2.8] 我々は,これまで期待される情報ゲイン(EIG)基準に用いられてきたポリシーベースのディープアダプティブデザインフレームワークを考察する。
BA目的物上のトラクタブル上限の最小化は、分散ペナル化EIG基準の最大化と等価である。
BAとEIGの設計の違いはいくつかの例で示されている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:53:35 GMT)
Length-Adaptive Decoding for Masked Diffusion Machine Translation [2.8] 本稿では,平均的な予測エントロピーにより候補対象キャンバスをスコアするトレーニング不要長セレクタであるEntropy-Valley(EV)を紹介する。
EVは64.9%、65.3%、COMET-22の33.0%をEn$to$Zh、Zh$to$En、En$to$Deで回収する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:04:56 GMT)
Mitigating Error Propagation in Chain-of-Thought: A Tree-of-Thought Framework for Smart Contract Repair [2.8] スマートコントラクトのためのAIベースの新しい修復手法を開発した。
提案手法は, シングル成功率62%, トップ3成功率84%を達成し, ContractTinkerを12ポイント, 6ポイント上回った。
このアプローチは線形推論の限界を克服し、スマートコントラクト修復をより正確かつ実用的なものにする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:21:56 GMT)
Can Large Language Models "Hyper-Thread"? [2.8] 大規模言語モデルはトークンを逐次生成するが、トークンの生成中に複数のタスクを同時に実行できるのか?
モデルハイパースレッド仮説を提案し、同じ問題内で状態を共有する複数の協調タスクを用いてその予測を評価する。
我々は3つの条件(ベースライン、シリアル関数スケジューリング、コンカレント関数ロード)を設計し、その利点とコストを精度、出力トーケン分布、注意指標を用いて評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:53:03 GMT)
The Variance of Thought: Policy Variance, Critical Forks, and Local Credit Assignment [2.7] 政策分散はリターン分散の唯一の源であり、臨界フォークと呼ばれる状態において離散パルスに注入される。
ブートストラッピングは、生存確率の積を和に変換することによってモンテカルロの利点推定を除去する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:46:56 GMT)
SAM3Dual: A 3rd Place Solution to the MOSEv2 Track, 8th LSVOS Challenge [2.6] 第8回大規模ビデオオブジェクト(LSVOS)チャレンジのMOSEv2トラックの3位であるSAM3DualをECCV 2026で紹介する。
SAM3Dualは、事前訓練されたSAM 3のトレーニングなし推論拡張で、時間記憶を最近の観測のための短期分枝と、間隔サンプリングされた歴史的表現のための長期分枝に明示的に分離する。
完全なシステムは公式のJ&Fスコア64.37を達成し、MOSEv2トラックで3位となった。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:08:29 GMT)
All four leading LLMs talk more than they listen to personality-verified synthetic help-seekers [2.5] 広く使われている4つのモデルは、いくつかの総合的なヘルプシーカーに、それぞれに精神医学的に特定されたプロファイルを急性の危機でアドバイスした。
4つのモデルは、感情の安定と失敗を区別できず、冗長性、会話対リスト比が1以上の3つのモード、状況が調査される前の問題解決の3つのモードを共有した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:58:34 GMT)
What AstroPT knows about galaxies, and what that can teach us about LLMs [2.5] 解釈可能性の研究は、トレーニング中に概念がいつ出現し、線形プローブが実構造を回復するかをますます疑問視している。
我々は、何百万もの銀河画像に基づいて訓練された変換器であるAstroPTを用いて、天文学的な地上真実の利用を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:40:26 GMT)
Learning Spectral Representations of Code through Latent Graph Learning for Generalizable Cross-Language Code Clone Detection [2.5] 本稿では,グラフのスペクトルがコード機能の識別的シグネチャとして機能するように潜在空間を学習する潜時グラフ学習ネットワークであるSPECTRA-Siamを提案する。
60の未確認パスにわたるブリッジアシスト言語転送では、SPECTRA-Siamのパフォーマンスは0.058しか低下せず、ベースラインは0.112--0.228である。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:08:28 GMT)
NeuroPrefetcher: Storage-Aware Sparse LLM Inference via Delta Prefetching [2.4] 量子化、より小さなモデル、オフロードといった既存のアプローチは、効果的なメモリ制限を上昇させるが、それでもいくつかの予算に収まるようにモデルを圧縮または分割できると仮定する。
実行中、モデルが常駐メモリよりも大きく、かつストレージがクリティカルパスの重み付けのアクティブな源となるような、厳密なモデル実行型メモリ設定を目標としています。
本稿では,この特性を予測的プレフェッチにより活用するストレージベース推論システムであるNeuroPrefetcherを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:58:11 GMT)
Squeezed- and coherent-state quantum key distribution over a deployed hybrid fibre-free-space channel [2.4] 量子ネットワークは光ファイバーと自由空間リンクを組み合わせる。
連続量子鍵分布(CVQKD)は、主に1つの媒体で開発された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:50:02 GMT)
From Diagnosis to Redesign: Using Quantitative Ethnography to Improve Multi-Agent LLM Reasoning [2.3] マルチエージェント大規模言語モデル (LLM) システムは、特殊機能を持つ複数のエージェント間でタスクを分解することで推論を改善するように設計されている。
本稿では,エージェント間相互作用による会話に基づくマルチエージェントLPMシステムの診断と再設計のための定量的エスノグラフィー(QE)手法を提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 19:27:40 GMT)
Towards Actionable Visualization: Ten Years Later, What Generative AI Changes and What It Cannot [2.2] 10年前、私たちはソフトウェアビジュアライゼーションの研究を、採用の課題は開発者のニーズとテクニックを一致させることであると仮定して調査しました。
AIは需要の可視化をゼロにすることで、その仮定を時代遅れにしたのではないか、と私たちは主張する。
私たちは、AI生成可視化自体の信頼性から、自分たちの地形でマシンと競合する誘惑まで、続くリスクに直面します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:40:51 GMT)
Risk-Sensitive Reinforcement Learning with Smoothed Quantile Objectives [2.2] モデルに基づく楽観的学習アルゴリズムを開発し、遷移カーネルの信頼セットと低バッファの量子化基準を用いて計画する。
チューリング時間短縮の下で, 正確な点量子化評価と, 正確な低バッファ化量子化評価がPPハードであることを証明する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:41:32 GMT)
MASH-Bench: Diagnosing Cross-Source Failure in Mass-Shooting Risk Classification [2.1] パブリックなマスシューティングデータベースは、カバレッジ、機能の可用性、レポートのプラクティスに大きく異なる。
我々は、4つの米国データベースから6,968件のインシデントを調和したベンチマークであるMASH-Benchを紹介する。
我々は,残余のデータセットアウト評価を用いて,ソース間のリスク分類を評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:28:10 GMT)
Addressing the Selection Problem in Explainable AI [2.1] 従来のXAIのサイロ化の性質を考えると,ユーザは適切なXAI技術を選択するのに苦労している。
本稿では,ユーザのクエリを適切なXAI説明手法に変換するマルチエージェントLLMオーケストレーションツールを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:42:03 GMT)
Enhancing Sim2Real Transfer for Torque-Controlled Robots through Real2Sim Dynamics Estimation and Reinforcement Learning [2.1] シミュレーションから実世界ロボットへの強化学習ポリシーの移行は依然として大きな課題である。
トルク制御ロボットアームのSim2Real転送を改善するReal2Sim2Realパイプラインを提案する。
この研究は、安定かつ一般化可能なトルクベース強化学習ポリシーを実現するための正確な物理モデリングの有効性を強調した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:25:33 GMT)
CAI-DLLM: Convergence Aware Inference for Diffusion Language Models [1.9] 拡散言語モデルは、多くのトークンを並列に生成できるが、推論中に繰り返しデノイングステップが必要になる。
CAI-DLLMは,第1ステップの信頼度を用いて推論時間を導出し,推論時間を短縮する訓練自由推論手法である。
LLaDA-8B-インストラクタとドリーム-7B-インストラクタを用いたCAI-DLLMの評価を行った。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:03:59 GMT)
Advanced LLM-Enhanced Intent-Based 5G Network Management using Dynamic Semantic Routes [1.7] AIの新たな応用は、ネットワーク管理とオーケストレーションのプラクティスとの統合だ。
本研究は,ネットワークオペレータのプロンプトから意図を特定するために,セマンティックルータを用いた動的ルートを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:59:33 GMT)
Clinical Graph-JEPA: Predictive Patient-State Knowledge Graphs for Cognitive Decision Support [1.7] 臨床知識グラフの構築と改善の枠組みを提案する。
臨床知識グラフを静的抽出アーティファクトとして扱うのではなく,予測的患者状態表現として扱う。
我々は, 漏れのない残余エッジ回復とバッチマスクのホールドアウト評価を用いて, 精製器の評価を行った。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:31:34 GMT)
Kernel Token Contradiction: a Fast and Principled Approach for LLM Claim Uncertainty Quantification [1.7] クラミムレベルの不確実性定量化(UQ)は、大規模言語モデル(LLM)の信頼性の欠如を軽減することを目的としている。
現実的なホワイトボックス条件下でクレームレベルUQを計算するための軽量なアプローチであるKernel Token Contradiction(KTC)を紹介する。
CPUのみのアプローチでは,最先端のGPUアクセラレーション手法と比較して8.2倍の高速化を実現している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:55:02 GMT)
Dual-Scale State-Space Modeling with Speaker-Wise Dynamic CRF for Speech Emotion Recognition in Conversation [1.6] 感情認識のための音声のみのアーキテクチャであるDSSM-CRFを提案する。
双方向状態空間モデルは、フレームと対話スケールでの融合した自己教師付き音声表現を符号化する。
話者の連鎖における連続的な発話は、スコアがコーパスレベルの遷移行列と、2つの文脈化された発話から予測される残差を組み合わせた遷移対を形成する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:56:03 GMT)
Deterministic preparation of entangled Dicke states [1.6] 分散キャビティにおける原子または量子ビットを用いた変形プログラム型ハミルトンプロトコルを提案する。
用意された状態がハイゼンベルク制限スケーリングによる量子センシングのリソースを提供することを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:57:07 GMT)
Interpretable statistical feature engineering for early disruption prediction in the short pulse ADITYA tokamak [1.5] 本研究は、短パルストカマクにおける早期破壊予測のための解釈可能な機械学習フレームワークを開発する。
決定木に基づく特徴選択は、物理的に意味のある破壊前駆体を特定するために用いられる。
提案フレームワークは,0-35 ms と0-40 ms の最大 ROC-AUC を0-35 ms と 0-40 ms のウィンドウで安定な予測性能を実現する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:29:46 GMT)
Fractality of the Schrödinger Density for Rough Data [1.4] 少なくとも1つのジャンプを持つ有界変動の任意の実データに対して、トーラス上の自由シュルディンガー進化の密度はほぼ毎回フラクタルである。
デレンジトロピー作用素の階数計算によって輸送され、この理論は全ての確率法則に量子カーペットを装備する。
1つの測定強度プロファイルのスペクトル成長速度は、格子のジャンプ内容を返す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:48:49 GMT)
Lightweight Multi-scale Hierarchical Anomaly Detection and Localization for Geospatial Big Data Applications at the Edge [1.3] 本稿では,地理空間データストリームの異常検出と局所化のための軽量エッジ指向アプローチを提案する。
H3離散グローバルグリッドシステムとマルチスケールドリルダウンロジックを活用することにより,提案手法は計算オーバーヘッドを大幅に削減する。
提案手法は, 大規模地理空間データを有効に抽出し, 有効性を示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:06:14 GMT)
Macro-Operator Generation and Predicate Selection for TAMP Operator Learning [1.3] 手動でシンボリック演算子を作成することは、タスク・アンド・モーション・プランニングシステムのデプロイにおける主要なボトルネックの1つです。
しかし、既存のメソッドは通常、それぞれのアクションを独立して学習し、操作タスクの繰り返し発生するマルチステップ構造をキャプチャできない。
本稿では,マクロ演算子の自動生成を主成分とするシステムを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:38:27 GMT)
Counterfactual Evaluation of Temporal Observation Protocols [1.2] 実測プロトコルで収集されたデータが、展開されていない代替案の予測値を決定するかどうかを検討する。
無限のベンチマークデータでさえ、この値を決定する必要はない。
我々は、代替の値を変化させる潜在曖昧さのみを重要視する値固有識別理論を開発する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:05:16 GMT)
SynFlow: A Multidimensional Diachronic Semantic Analysis Toolkit [1.1] 言語用多次元ダイアクロニック解析のためのオープンソースツールキットであるSynFlowについて述べる。
これは、値レベルの分解、統計テスト、レキシカルフィラーのインクリメンタルクラスタリングとともに、異なる距離測度をサポートする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:28:58 GMT)
Pre-Decoding Acoustic Triage for Budgeted Vision-Language Captioning of Untrimmed Egocentric Video [1.1] ビデオフレームがデコードされる前に、最も軽量なモーダリティを用いてウィンドウを選択することで、トークン圧縮や量子化を自然に構成する。
利用可能な通話の半数未満を使用することで、EPIC VLMコールの9-20%をEgo4Dの247クリップでカバーし、2つのビジュアルセレクタを上回っている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:51:00 GMT)
Multi-Task Learning for Non-Canonical Phoneme Recognition via Articulatory Feature Decomposition [1.1] 病的・より広範に非標準音声は自動音素認識に重大な課題を呈する。
既存の音素認識システムは典型的には標準音声で訓練され、音素を原子分類ラベルとして扱う。
音素予測を音声特徴量に分解する非標準音素認識に言語的に構造化したアプローチを導入する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:03:18 GMT)
Mechanistic Interpretability of Chain-of-Thought Reasoning via Sequential Activation Patching [1.0] 本研究では,CoT(Chain-of-Thought)関連因果効果が生成した推論軌道のどこに現れるかを検討する。
トークン位置をまたいだCoT条件のアテンションヘッドアクティベーションをトレースする逐次アクティベーションパッチフレームワークを導入する。
この結果から,CoT条件の例に付随する分散推論支援サブ回路の証拠が得られた。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:05:16 GMT)
Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video [0.9] 外手力は、職業的身体曝露と傷害リスクの生体力学的解析に重要な入力である。
視覚言語モデル(VLM)に基づくパイプラインを用いて,RGBビデオから動的,三軸,両側の手力の推定を行った。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:45:00 GMT)
Mitigating Speaker Leakage in Cascaded Multi-talker ASR with Diarization-based Transcript Correction [0.9] マルチトーカーASR (MT-ASR) の性能は、分離時に話者の漏れによって制限されることが多い。
本稿では, 漏洩物を確実に識別し, 除去する相補的プルーニングに基づくパラダイムを提案する。
LibriMix, LibriSpeechMix, AMI Meeting corpus の結果から, 多様な重なり合う条件において, アルゴリズムが常に cpW ER を減少させることが示された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:21:45 GMT)
SymmAdapt: Symmetrical Flow Matching for Source-Free Domain Adaptation in Medical Image Segmentation [0.9] ソースフリーなアン教師なしドメイン適応(SFUDA)は、センシティブなソースデータにアクセスすることなく、未ラベルのターゲットドメインに事前訓練されたモデルを適用する。
対称フローマッチングに基づく新しいSFUDAフレームワークを提案する。
腹部多臓器・心臓の分節,MRI->CTシフト,多部位前立腺分節について検討した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:09:39 GMT)
Unveiling the Depth-Performance Dilemma in Split-Federated Fine-tuning of LLMs [0.9] Split Federated Fine-tuning (SFF)は、Large Language Models (LLM) をスケールするための有望なパラダイムである。
システム効率を最大化する体制は、微調整品質が崩壊する場所である。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:53:20 GMT)
Rank Reversal in Multilingual LLM Judges: A Label-Free Double-Centering Calibrator [0.8] LLM審査員は、プロンプト言語に応じて評価器-バックボーンランキングを生成する。
上位のバックボーンは英語、アラビア語、中国語、ヒンディー語、日本語、スペイン語、トルコ語、スワヒリ語で交互に使われている。
多言語判定スコアは、追加的にタスク難易度、バックボーンスキル、言語とバックボーンの相互作用項に分解する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 14:18:25 GMT)
Invocation-Level Reliability of Tool-Using Agents [0.8] クリーンな教師強化コンテキストと,モデル独自のフリーランニングコンテキストの両方の下で,その2つを分離する,正しい起動率を測定する。
深さ6では、モデル自身のクリーンコンテキスト能力の約70%が、以前の失敗に失われる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:04:59 GMT)
Precision-Aware Variable Bit Processing Elements for Hardware-Efficient Systolic Array Designs [0.7] シストリックアレイ (Systolic arrays, SA) は、ディープラーニングにおける行列演算のハードウェアアクセラレータとして注目されている。
本研究では,静止重みアレーにおける浮動小数点乗算器の近似計算手法について検討する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:00:17 GMT)
Gaussian process learning with flow map refinement for parameter estimation in dynamical systems [0.7] 本稿では,2段階のパラメータ推定フレームワークであるフローマップ改良(GPL-FMR)を用いたガウス過程学習に基づくフレームワークを提案する。
提案手法はパラメータ推定の精度を常に改善し,特に希少でノイズの多い観測下では有効である。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:38:52 GMT)
When Persona Simulations Are Informative: Graph-Structured Signals for Pluralistic Opinion Sensing [0.7] Persona-Conditioned Informativeness (PCI)は、教師なしの診断基準である。
PCIは、アイテムレベルのサンプルベースラインに対して、意味的に類似したペルソナが一致方向にずれているかどうかを測定する。
これらの知見は,PCIを内科的診断の原則として,サーベイパイプラインにおける総合的な回答者のスクリーニングに有効である。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 14:33:35 GMT)
Mitigating Explanation Leakage in Financial Fraud Detection Systems [0.6] 金融詐欺検出は集中型機械学習モデルに大きく依存している。
金融規制は、まだ透明なモデルを必要としている。
最近のサイバーセキュリティ研究は、このアプローチに問題があることを示している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:26:21 GMT)
LLM Evaluation on Unseen Questions: Contextual Multidimensional IRT Model [0.5] 本研究では,多次元項目応答理論モデルと質問文脈を組み合わせたモデルに基づく評価フレームワークについて検討する。
シナリオ内評価では,質問の埋め込みを組み込むことで,モデルフリーのベースラインに対する予測が向上することがわかった。
同時に,本研究の結果は,一般化可能性がクロスシナリオシフト下での信頼性予測に必ずしも変換されないという重要な限界を明らかにした。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:40:04 GMT)
Multimodal examination answer data with expert-designed Outcome-Based Education rubrics for criterion-level assessment [0.3] データ記事では、専門家が設計した Outcome-Based Education (OBE) グレーディングメタデータと組み合わせた、スキャンされた検査回答のマルチモーダルコレクションについて説明する。
このコレクションには、4つの学術機関の415人の学生からの回答が485件含まれている。
データはロバストネス対応の自動評価、文書理解、基準レベルのフィードバック、スコア予測、プライバシ対応評価研究をサポートする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:25:59 GMT)
STAGE: Stateful Translation to Agentic Graph Execution with Policy-Scoped Context and Deterministic Control [0.3] textscStageは、ポリシースコープノードにモデル判断を限定する実行可能なグラフフレームワークである。
我々はSOP-Bench Referral AbuseのtextscStageと2ドルのbenchドメインと、プロプライエタリな銀行ベンチマークであるSmart Disputeを評価した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:17:09 GMT)
CAIA in Practice: Field Evaluation of an AI-Assisted Support System for Text-Based Online Counselling [0.3] CAIAは、カウンセリングプラクティスに責任あるAIを統合することを実証する、AIベースのツールスイートである。
フィールド評価では、34人の専門的なカウンセラーが、訓練された学生カウンセラーと真正のセッションを行った。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:22:05 GMT)
Experimental Validation and Mitigation of RRC Storm Attacks in 5G Cellular Networks [0.3] 我々は,ソフトウェア定義無線機と商用電話機からなる実検層に対して,シグナリング・ストーム・アタックを実装した。
次に、疑わしい半開放接続を監視・動作させることにより、gNBで直接動作する軽量な緩和技術の設計と実装を行う。
この研究はオープンソースとして公開され、他の研究者がその結果を再現し、実装を構築し、新たな緩和戦略を評価することができる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:46:21 GMT)
D-Diff: An Interactive Environment for Adjusting Commit Boundaries Based on an Editable 3-way Diff [0.3] D-Diffは2つの連続コミットのためのインタラクティブな差分調整環境であり、それぞれが同じ単一ファイルを含む。
D-Diffは3方向の差分表示に基づいて、2つの差分を1つのコンパクトビューに統合する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 04:00:47 GMT)
Bloch states of an infinite one-dimensional lattice under transverse electric field [0.2] 実効的な1次元周期的原子鎖は、鎖軸を横切る弱い静電場を受ける。
逆磁場は、最小エネルギー分布が周期的に繰り返されるカナリアプロファイルによって近似される弱い弾性および偏光応答を生成する。
第一ブインゾーン還元により、電場依存のバンドエネルギーとブラッグギャップの対応する階層が得られる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 03:26:39 GMT)
Figurative Justice: Detecting metaphors in Hindi judgements with qualitative assessment and transformers [0.2] Hindi Legal Metaphor Corpus (HiLeMe) について,Hindi Legal Data Corpus (HLDC) の判断を分離して紹介する。
法律の専門家はHiLeMeに注釈を付け、MIPVUスキーマを使って比喩的な構成を分類した。
我々はメタファ検出のためのトランスフォーマーベースのアーキテクチャを構築した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 14:53:20 GMT)
ThreatLens: Evidence-Guided Ranking of High-Priority CVEs [0.2] ThreatLensは各レビューポイントで、カットオフ無効の証拠のみを使用して脆弱性をランク付けする。
システムは、今後のCISA KEVエントリから、エクスプロイト関連性の弱い監視として学習する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:10:40 GMT)
Toward a First-Principles Update Geometry for the Language-Model Head [0.2] 言語モデルヘッドとソフトマックスを単一のモジュールとして研究し、それらの構成から更新幾何学を導出する。
ミューンの特異値条件付けにより、この直径を制約しながら最小の行分離を最大化することを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:23:56 GMT)
GAN-Diff : Coupling Pretrained WGAN-GP Features with Conditional Diffusion U-Nets [0.1] 本稿では,グラディエントペナルティ(WGAN-GP)を事前訓練したWasserstein GANを用いたハイブリッドGAN誘導拡散フレームワークを提案する。
凍結したWGAN-GPジェネレータの中間特性は、クロスアテンションを介して拡散U-Netに組み込まれる。
このフレームワークは、劣化画像と低解像度画像の両方の品質を継続的に改善する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:03:13 GMT)
Engineering exact mobility edges in quasiperiodic Aharonov-Bohm chains [0.1] 準周期アハロノフ-ボーム連鎖における局在現象と正確な運動量エッジについて検討した。
対角極限において、補助格子との結合は、符号変化のばらつきを示す双曲移動エッジを生成する。
対角線外状態においては、準周期ホッピングと補助格子を通る間接トンネルとの干渉により、正確な異常な移動端が生じる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:54:01 GMT)
Why Does Robustness Reduce Superposition? [0.0] 逆の例は重ね合わせから生じるが、なぜこのようなことが起こるのかは説明できない。
Ilyas et al. の特徴分類から着想を得た経験的説明を行い,以下の機械的因果関係の連鎖をたどる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:53:42 GMT)
Where Cognition Lives: Dissecting Emergent from Computed Function in a Minimal Complete Cognitive Architecture [0.0] 適応停止, ホメオスタティック制御フィールド, 値モジュールを備えたリカレント推論器を構築する。
停止も出現し、前もって決定できるものよりも価値が高いように見えるが、その外観は計り知れない。
PonderNetスタイルの停止は、隠された状態の停止重み付き混合を返し、強制深度ベースラインは1を返す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:27:13 GMT)
When Test-Time Adaptation Helps, Harms, or Becomes Inactive: A Condition-Level Study on CIFAR-10-C [0.0] テスト時間適応(TTA)は、未ラベルのテストデータを用いてソースモデルを適用することにより、分散シフト下でのモデルロバスト性を改善することを目的としている。
本稿では,BatchNorm-statistics Adapt(BN-Adapt),Entropy-minimization Adapt(TENT),Reliability-statistics Adapt(EATA)の3つのTTA戦略の比較を行った。
3つの手法はすべて、ソースモデルの平均精度を12.2-13.3ポイント向上させる(Wilcoxon sign-rank $p 10-12$)。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 06:06:38 GMT)
What is the effect of running-specific prostheses on long jumps? Optimization-based prediction and analysis using biomechanical models [0.0] ランニング特異的補綴 (RSP) から脱落した膝切断 (BKA) の下半身のロングジャンパーは, ここ数年で有意に改善した。
問題は、RSPのバネのような性質が長い跳躍を促進するかどうかである。
本研究では,BKAと非BKAのスポーツ選手を対象としたロングジャンプモデルを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:55:26 GMT)
What You Can't See Is What You Learn: Restricted Evidence Visibility Favors Compositional Generalization in Shared-Genome Language-Model Societies [0.0] 制限された社会は10対中9対の両深度で少なくとも20ポイント、0.7648と0.6050の2対の利点がある。
6つの監査された制限された社会の中で、同じ値のパケット移植は全ての試験されたインターフェースで0.94-1.00の動作を保存する。
唯一の高性能グローバルモデルも通信を必要とするが、その同値パケットはエピソード間では交換できない。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:58:27 GMT)
WAM-OPD: On-Policy Distillation for World Action Models [0.0] 本研究は, 都市部における蒸留が, スパース・リワード強化学習を必要とせず, 生徒を補修できるかどうかを考察する。
WAM-OPD(WAM-OPD)は、ビデオファーストのWAMのための、デプロイに一貫性のあるポストトレーニングレシピである。
予備的なRoboTwin 2.0は2つのタスクについて研究しており、リリースされたワンビデオ/ワンアクションステップのFlash-WAMは0.0%から58.3%に改善されている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 11:06:45 GMT)
Understanding Temporal Semantic Stability in Open-Vocabulary UAV Perception through Metric 3D Fusion [0.0] フレームワイズ予測と世界空間の持続的位置を関連付けることで,時間的意味的安定性を考察する。
UAVid-3Dの実験では、フレームワイドなセマンティック・フリックが顕著に示され、高集合世界空間合意が時間的安定性を過小評価できることを示した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:33:58 GMT)
Time reversal of complex evolution on a quantum computer [0.0] 多くの量子ビットを持つ多体量子カオスの体制において、複雑な進化の時間反転を可能にする量子プロトコルが提案されている。
このプロトコルは、現在の量子コンピュータや数百量子ビットのアニーラーにもアクセス可能であると論じられている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 16:17:38 GMT)
The spatial anatomy of urban wildfire vulnerability: a spatially validated GeoAI framework reveals the roles of building density and vegetation moisture in structure loss during the 2025 Palisades Fire [0.0] 我々は2025年1月のパリセーデス火災に備え,空間的検証を行ったGeoAIワークフローを開発した。
100m以内の建物数は最も高い予測値であり、破壊確率は標準偏差あたり4.12倍に増加した。
その結果, 単発都市山火事モデリングの最低基準として, 地域規模による感受性スクリーニング, 湿性を考慮した植生管理, 空間的ブロック検証が支援された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 08:37:52 GMT)
Tabular foundation models for non-tabular tasks [0.0] 我々は3つの非タボラ分類問題にTabPFN v3を使用する。
事前学習したモデルに提供されるコンテキストサンプルの数を関数として評価する。
データの特徴として空間構造やシーケンシャル構造に明示的にアクセスしていないにもかかわらず、TabPFN v3は対応するタスクに特化されたモデルやメソッドに匹敵する精度を達成している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:58:39 GMT)
Spinning giant optomechanical cavity with nonreciprocal self-interference [0.0] メランダリング導波路に複数の空間的分離点で結合する回転光学空洞について検討した。
結果として生じる自己干渉は、有効光駆動、直線幅、周波数シフトを導波路の伝播位相に強く依存させる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:48:39 GMT)
Spending Scarce Confirmatory PET Measurements: Target-Aligned Validation in A4/LEARN [0.0] アミロイドポジトロン・エミッション・トモグラフィ(PET)は、アミロイド負荷に対するプロトコル測定の1つとして残っている。
本稿では,簡単なPET検証をいつ行うかという,故意に運用上の疑問を提起する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:17:12 GMT)
Sharp State-Independent Uncertainty Relations for Multipartite systems [0.0] 状態に依存しない不確実性関係は、全ての量子状態に対してどの程度の変動が避けられないかを問う。
連続対称性によって生成される観測可能量に対して、鋭い状態独立境界は対称性表現が既約であるときに知られている。
我々は、コンパクトな半単純対称性代数 $mathfrak g$ を持つ多部量子系に対してこの問題を利用する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:33:26 GMT)
Sample-Query Interconversion of Block Encoding of Unknown Quantum States [0.0] 未知の量子状態のブロック符号化は量子学習に有用である。
本結果は,ブロック符号化の固有の限界を未知の量子状態の表現として同定する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:49:12 GMT)
Robust Quantum Key Distribution Arbitrarily Close to Local Correlations [0.0] 局所的な挙動の集合に任意に近く、秘密鍵の一定の速度を保証する量子相関が存在することを示す。
Wooltorton emphet al. によって考慮されたベルの不等式のうちの1つについて、観測されたベル違反がそれぞれのツィレルソン境界に十分近い場合、秘密鍵の一定の割合が生じる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 21:20:19 GMT)
Register Shifts Break LLM Safety: A Bengali Benchmark with Culturally Grounded Harms [0.0] 879のBengaliプロンプトと570のエキスパートレビュープロンプトを組み合わせたベンチマークであるBanglaSafeを紹介します。
回答の半数以上は安全でないか安全でない(53.6%)が、14.7%は有害な内容を含んでいる。
公式な新聞調査と同じ有害な要求は、カジュアルなメッセージと同じ要求よりも17パーセント多く成功している。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:09:00 GMT)
Reference-free logged energy-oracle recovery for neural approximations of symmetric coercive variational problems: conforming Riesz reconstruction and archive-level selection [0.0] PDEトレーニングは有限チェックポイントアーカイブを生成するが、ログ化されたエネルギーエラーは正確な解がなければアクセスできない。
計算可能なRieszモニタの最小化に基づく参照なし選択ルールを導入する。
飽和下では、ブラケットは計算可能なニアオークル境界を与え、ユニークなログオークル選択を認証する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:24:43 GMT)
RS$^3$-Prune: Read-Sparse, Store-Sparse Token Pruning for Video Object Segmentation [0.0] RS$3$-Pruneは、推論時間フックの小さなセットとしてインスタンス化される、トレーニング不要なトークン処理のレシピである。
RS$3$-Pruneは最大38.8%のFPSスピードアップを提供し、13.1%のピークメモリ使用量を減らす。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:51:58 GMT)
Prompt-Based Abstention Fails Under Misleading Context: A Controlled Study of Small Frozen RAG Models [0.0] 誤りや誤解を招く証拠は、検索強化世代でも同じ問題ではない。
証拠が欠落している場合、モデルは確実に棄却されるが、明示的な棄却の下では、誤解を招く質問の41.6%は依然として答えている。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 05:43:27 GMT)
Optimal Nonparametric Estimation of Phase-Space Representations for Non-Gaussian Continuous Variable Quantum States [0.0] さらに,連続変数量子状態再構成と評価のための完全データ駆動ノンパラメトリック手法であるKernel Quantum State Estimation (KQSE)を開発した。
KQSEは、トモグラフィ二次分布の特徴関数の新しいカーネル推定器と適切なカーネル積分変換を組み合わせたものである。
提案された理論は、フォック空間のカットオフを課すことなく、ガウスおよび非ガウス連続変数量子状態に等しく適用される。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:01:16 GMT)
On the Four-Loop Higgs--Gluon Form Factor in Nonlocal Quantum Field Theory [0.0] 粒子物理学において、標準模型におけるグルーオン融合ヒッグス生成への仮想N$3$LOの寄与は、4ループのマルチスケールQCD振幅を必要とする。
非局所UV完備化は、各固定階四ループファインマン図形を4次元に完全に収束させることを示す。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 22:14:41 GMT)
On SSI-based Private Decentralized Bidding [0.0] プライベート入札は、参加者が封印された入札を提出し、コンテンツが他の入札者から隠されていることを保証するプロセスである。
現在の方法は入札者が適当かどうかを確認するのに苦労している。
本稿では,SSI(Self-Sovereign Identity)を活用して入札の適格性と認証を行うフレームワークを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:51:52 GMT)
Obscura-PQ: Post-Quantum Privacy-Preserving Protocol for the Algorand Blockchain Using Lattice-Based Linkable Ring Signatures [0.0] 本稿では、Algorandブロックチェーンを検証した分散化された非量子後プライバシプロトコルであるemphObscura-PQを提案する。
鉱床は短い秘密に結合する環-SISであり、離脱はAOS/ボロメアン様式の挑戦鎖を介して環を開くことの知識を証明している。
本研究は,Ring-LWEと匿名性,および古典的ランダムオーラモデルにおける明示的な決定的リンク仮定の両端の音質とRing-SISとの結合性を低減することを目的とする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:03:51 GMT)
Nürnberg NLP @ GermEval Shared Task 2026: Harmful Content Detection in German Social Media through Error-Independent LLM Voters [0.0] GermEval 2026共有タスクは4つのサブタスクで検出される。
有害なクラスは稀で、支配的な多数派クラスと表層言語を共有するが、マクロF1ではスコアを決定する。
システムは89.56 (C2A), 71.63 (DBO), 54.84 (VIO), 83.02 (DEF) のマクロF1に達する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 07:07:06 GMT)
MotionDLO: Hybrid Event- and Frame-Based Tracking of Deformable Linear Objects [0.0] 我々は、時間的連続性と遅延の制限を克服するために特別に設計されたリアルタイムトラッキングフレームワークであるMotionDLOを紹介した。
この手法は、イベントベースカメラの高時間分解能と空間性を利用して、コヒーレントポイントドリフト(CPD)アルゴリズムとセグメンテーションを組み合わせる。
提案フレームワークはビデオシーケンス間でDLOインスタンスを確実に関連付け,ロボット操作タスクに対する堅牢な認識を可能にすることを実証する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:53:13 GMT)
MCSI: A Masked Commutative Supersingular Isogeny Key Exchange with Blinded Ephemeral Keys [0.0] 我々はCSIDHクラスグループアクションで設計した2つのメッセージキー交換であるMCSIを紹介する。
デザインは暗黙的な相互認証を与え、eavesdropperから短命の要素を隠蔽し、受信者は1つのタグチェック後に不正メッセージを捨てる。
分析面では,我々のプロトコルがゼロ誤差で正しいことを証明し,ランダムオラクルモデルにおける3つのステートメントを証明した。
また、目隠しキーは、確立しようとするセッションの秘密から来ないことも示しています。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:59:30 GMT)
Loss Landscape Features That Make Adam Stall: Definitions, Estimators, and the Preconditioned Hessian View [0.0] 我々は、完全に調整されたAdamが、不調なロスランドスケープであっても、非常に低い損失に達する可能性があることを示す。
このレポートは、Adamが与えられた損失状況の条件を緩和できるかどうかを判断するのに役立つ測定値を定義します。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:21:33 GMT)
Laughlin quasihole geometry from a single snapshot ensemble [0.0] ある一般的な参照位置における正確な占有法則は、既知の解析的準ホール因子とともに、完全に複雑なグラム核を固定する。
有限スナップショットアンサンブルは、家族の別のメンバーを準備せずにこのカーネルを推定する。
同じ解析構造は、次元が粒子数とともに最も直線的に成長する正確な射影部分空間に族を閉じ込める。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:09:15 GMT)
LLMs for Survey Text Analysis - A Performance Comparison Between Humans and GPT-5 on Inductive Content Analysis [0.0] 大規模言語モデル (LLM) は、定性的研究においてテキスト分析をサポートするためにますます使われている。
本研究は,903回答からのオープンエンドサーベイ応答の人間とLLMによるインダクティブコーディングを比較した。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 13:45:32 GMT)
KPI-Conditioned Generative Design of Automotive Hood Inner Panels: A Two-Stage Retrieval-Generation Pipeline with Surrogate-Based Performance Estimation [0.0] この研究は、記述された要求から幾何学を生成するための2段階のパイプラインを示す。
リーチビリティステージは、与えられた要求ベクトルを満たすトポロジーファミリを決定する。
条件付き変分オートエンコーダは、選択されたファミリー内でポイントクラウド形状を生成し、ニューラルネットワークサロゲートは、各候補の性能を推定する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:17:22 GMT)
KONTOGRAPH: Verified Point-in-Time Feature Consistency and Amortised Explanation for Real-Time Anti-Money Laundering under a 200 ms Decision Budget [0.0] EU(EU)2024/886は、欧州の決済サービスプロバイダに対し、ユーロの送金を10秒以内で停止するよう義務付けている。
これにより、アンチマネーロンダリング(AML)分析が伝統的に実行されていた一晩のバッチウィンドウと、リカバリを可能にする解決遅延の両方が削除される。
我々は,自称200ミリ秒99セントの予算で構築されたSEPA Instant鉄道用エンドツーエンドAMLパイプラインであるKONTOGRAPHを提示する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 12:28:26 GMT)
Interference Engineering for Quantum Imaginary-Time Evolution through Multiple Energy Shifts [0.0] マルチシフト量子想像時間進化(MS-QITE)を導入する。
この干渉をエンジニアリングし、異なる実装を最適化するために、エネルギーシフトの分布を使用する。
連続変数支援実現において、有限二次区間上で支持された状態への射影を可能にする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 14:15:44 GMT)
Improving Spatial-Temporal Reasoning in Video-Language Models with Structured Video Prompting [0.0] ビデオ言語モデル(VLM)は、時間とともにイベントを追跡し、特定の空間領域で答えをグラウンド化する必要があるタスクに対して脆弱なままである。
本稿では,軽量な空間構造と時間構造で入力映像を増強する学習不要な推論時間手法である構造化ビデオプロンプトを導入する。
2つの相補的なビデオベンチマークと2つのオープンなビデオ言語モデルでこのアプローチを評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:16:09 GMT)
Hydrogen Molecular Ion and Molecule in Classical Electrodynamics with Classical Zero-Point Radiation [0.0] 分子イオンは水素原子と遠方の陽子との結合が小さい。
水素分子は、イオンに1つの追加電子を加えることによって形成される。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 18:14:32 GMT)
GreenLeaf Law Embed Tiny: A Compact Embedding Model for Legal Domain Retrieval [0.0] GreenLeaf-TinyがMLEB(Massive Legal Embedding Benchmark)で75.11%、MTEB(Law, v1)で64.38%を獲得
この結果から,高品質なデータを用いたドメイン固有トレーニングにより,特定のドメインアプリケーションの性能が向上することが示唆された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:24:39 GMT)
Functional compatibility as a determinant of persistent neural learning [0.0] 機能的互換性は、新しい学習が持続的な学習の因果決定要因であることを示す。
結果は、永続的ニューラルネットワークの実験的制御可能な原理として機能的互換性を確立する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:37:57 GMT)
From Exposure to Expectation: Frequency, Surprisal, and Language Across Development in Spanish [0.0] 意外なことに、言語モデルの負の対数確率は、前回の文脈で与えられた単語に割り当て、成人の読書時間を確実に予測する。
本稿では,スペイン語のコーパスに基づく2つの研究について考察する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 15:02:29 GMT)
Finite-Sample Metric Non-Collapse for Geometrically Supervised Latent World Models in Control [0.0] 非線形決定論系の幾何学的教師付き潜在モデルに対する有限サンプル学習制御理論を確立する。
本稿では,方向分解能と分離状態判別を強制するエンコーダのみの局所的計量ヒンジを提案する。
モジュラー決定論は、学習した証明書を軌跡、有限水平コスト、学習コストヘッド、および論理的保証に転送する一方、検証された有限ネットの結果は、よりシャープなモデル固有の認証を可能にする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 02:25:33 GMT)
Evaluation of Small Vision-Language Models on Qualitative Mechanical Problems [0.0] メカニカル・イシュー・イメージの解釈能力に基づいて,2つの最先端マルチモーダル・モデル,Gemma-3とQwen-VLを評価した。
各画像は本質的に、歯車の接触点、支持関係、相対重みなどの地道的定性的事実を符号化する。
我々は,各モデルの思考過程を評価するために,各チェーンのコヒーレンス,完全性,論理的進行を評価する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 00:10:58 GMT)
Evaluation in the Age of AI: Output as Evidence of Learning [0.0] 人工知能(AI)の急速な普及は、高等教育における学習の実証と評価の方法を破壊している。
本稿では,AI時代における教育評価の倫理的課題を大学レベルで検討する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:40:30 GMT)
Estimating the Fisher information from ARPES in general two-band models [0.0] 一般の2バンド固体系において,任意のパラメータに対して量子フィッシャー情報を計測する手法を提案する。
システムパラメータによって変化する材料自体の基底状態に関する情報に関連付けることができる条件について検討する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:13:14 GMT)
Entanglement governs early-time growth of randomness in projected ensembles [0.0] 本研究では、初期アンタングル状態から生じる射影アンサンブルのダイナミクスについて検討し、フレームポテンシャルを用いてランダム性を定量化する。
この結果から, 絡み合いは, 投射されたアンサンブルのランダムネスの開始を規定するメカニズムであり, 局所ランダムネスがグローバル量子力学からどのように現れるかを明らかにする。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:05:33 GMT)
Does a Modern-Handwriting Warm-Up Help Historical Arabic OCR? A Reproducible, Compute-Matched Evaluation on Muharaf and KHATT [0.0] 現代アラビア語の筆跡の中間段階は、歴史的アラビア語のHTRを助けたり傷つけたりする。
現代筆跡の中間訓練(KHATT)と歴史写本の微調整(Muharaf)を比較した。
4つ全体では、推定効果は-17.64から+14.52のCER点に変化し、符号を逆転させる。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 09:29:27 GMT)
ClawProBench: Trace-Aware Evaluation of AI Agents with Runtime Coverage and Frozen Workplace-Style Holdouts [0.0] エージェントベンチマークは、エージェントがステートフルランタイム上で実行されている場合でも、最終回答のみを評価することが多い。
OpenClaw上でインスタンス化されたランタイムネイティブエージェント評価のためのトレース対応ベンチマークであるClawProBenchを提案する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 17:09:02 GMT)
Characterization of Chaotic Evolution in Quantum Systems Induced by Random Hermitian Matrices [0.0] この形式を5つのランダム行列アンサンブルに適用する。
各アンサンブルに対して、平均リアプノフ指数、その分散、およびエネルギーの関数としてのスペクトルギャップを導出する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 19:41:52 GMT)
Auditing the Synthetic Memoir: Measuring Scene-Level Confabulation in LLM-Generated Autobiography Against the Documented Record of the Life It Describes [0.0] 本研究では,大規模言語モデルの自叙伝を,主観的基礎構造コーパスに対して初めて定量的に評価した。
366日間の「ページ・アズ・デイ」で1対1の物語を収録した本が、会話型LLMで起草された。
毎日、独立した検証コーパスに対して逸話の場面で監査された。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 20:10:50 GMT)
AcroMELD: Recovering Interactive PDF Forms with Structure-Aware Graph Set Transformers [0.0] AcroMELD (AcroForm Multi-source Evidence Linking Decoder) は、ラベルのないPDFプリミティブを持つ高解像度のビジュアルトランスフォーマーである。
4つのグラフ集合層は、幾何学的に偏ったスパース近傍とPDF構造に交差する位置の情報を交換する。
我々は,不確定な開発,校正,内部テスト,隔離された外部保持機能を備えたハッシュバウンド評価プロトコルを定義する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 10:12:22 GMT)
A survey detection channel overrides the pixels in an astronomical foundation model, and biases tomographic mean redshifts [0.0] AION-1は2億以上のオブジェクトでトレーニングされた39のモダリティトランスフォーマーである。
画像トークンをバイト単位に保持し、サーベイセグメンテーションマップのみを編集することで、モデルが報告するすべての量を変更する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 01:10:54 GMT)
A Margolus-Levitin speed limit for observables: mean energy bounds expectation-value change quadratically [0.0] デルタによる観測値の期待値を変更する時間に、状態に依存しない線形平均エネルギーが存在しないことを示す。
我々は、C_* が小幅斜面である正確なエネルギー時間/スウィングトレードオフ曲線を与える。
速度制限ランドスケープの(平均エネルギー x 観測可能な)コーナーを完備する。
論文参考訳(メタデータ) (Sun, 23 Aug 2026 23:36:12 GMT)