PAPT++: Risk-Aware Adversarial Tuning and Generation for Single Domain Generalization [99.3] 単一ドメインの一般化は、特定対象ドメインに一般化するラベル付きソースドメインからモデルを学習することを目的としている。
本稿では,単一ドメインの一般化のためのリスク認識型逆生成学習フレームワークPAPT++を紹介する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:54:30 GMT)
SMILE: Self-Explainable Multimodal Information Bottleneck for Medical Diagnosis [72.0] 説明可能性(Explainability)は、AIベースの診断、特に安全クリティカルな臨床的意思決定において、ますます重要な要件とみなされている。
本稿では,情報ボトルネック(IB)フレームワーク内で定式化することで,自己説明可能なマルチモーダル診断の問題に対処する。
本稿では,予測性能とモダリティ固有の説明可能性とを協調的に最適化する統合学習パラダイムを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:13:24 GMT)
Post-Training Language Models for Gold-Medal Performance in Coding Competitions [70.8] 本稿では,大規模問題キュレーション,合成推論トレース,教師付き微調整,強化学習を組み合わせたエンドツーエンドの特殊化パイプラインを提案する。
SFTとRLでNemotron-3-Nano-CCを,SFT単独でNemotron-3-Ultra-CC(550B-A55B)を訓練した。
IOI 2025では、Nano-CCはポストトレーニング後の130点から291点に改善され、GenCorrectでは468点に改善され、Ultra-CCは502点に達した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:57:06 GMT)
RAPTOR: Role-Aware Private Training for Mixture-of-Experts [68.6] RAPTORはRole-Aware Private Trainingフレームワークである。
RAPTORは共有と専門家の最適化を交互に行い、各障害を直接ターゲットする。
GLUEタスク間でのSwitch TransformerとOLMoEの微調整およびDeepSeek-VL2-Tinyの実験では、標準のDPベースラインよりも一貫した利得を示している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 23:16:12 GMT)
How do LLMs Evaluate Perceived Moral Agency? Investigating Moral Decision-Making in Human-Artificial Agents Interactions [66.4] 人間は道徳的エージェンシーを持ち、倫理的に導かれた決定を行い、その結果に対して責任を負う能力を持っている。
ロボット、ドローン、非暴力的AIシステムなどの人工知能(AA)がスマートシティ環境に埋め込まれるにつれ、道徳的エージェンシーが新たな緊急性にどう影響するかという疑問が持ち上がっている。
本稿では,人間とLLMが人間と自律的な人工エージェント間で知覚される道徳的エージェンシー(PMA)をどのように評価するかを,私たちの知る限りで比較した最初の実証的研究について述べる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:56:59 GMT)
RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks? [65.2] VLA(Vision-Language-Action)モデルは、言語条件のロボット操作において有望な進歩を示している。
textbfRobot textbfSpatial-textbfProcedural textbfAssessmentは,ロボット操作の大規模データセットであり,具体的推論を診断するためのベンチマークである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:19:01 GMT)
Do LLMs Exhibit Coherent Knowledge Structures in Mathematical Reasoning? A Perspective from Knowledge Space Theory [64.5] 数学的推論における知識構造を評価するためのKST-grounded frameworkを導入する。
実際の学習者に対して,オープンソースかつクローズドな8つのLCMを評価した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:11:56 GMT)
GE-Act 2.0: Pretraining and Scaling a World-Action Model for Robotic Manipulation [63.9] 本稿では,ジェニー・エンスペクタ法 2.0 (GE-Act 2.0) について紹介する。
制御指向オートエンコーダ(CoAE)、ワンステップビジュアルプランナー(SVP)、逆ダイナミクスモデル(IDM)を組み合わせている。
それらのコンポーネントは、知識に整合した選択最適化(KASO)で共同で訓練され、記録された行動に適合していると判断された予測された未来のみを選択することで、ミスマッチした監視を減らす。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:16:48 GMT)
TourPhysics: Bringing Physics to World Models for Exploration and Manipulation from a Single Image [53.2] TourPhysicsは、単一のイメージと宣言的な物理的な設定から得られるオンラインフレームワークである。
各動作について、シミュレータは、対応する観測が生成される前に、有限の物理およびカメラ軌道を計算する。
TourPhysicsは、評価されたベースラインよりも、所定のカメラとオブジェクトの軌跡に従う。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:15:03 GMT)
WeAgent-MMGenEdit: A Full-Stack Recipe for Multimodal Agentic Image Generation and Editing [51.9] WeAgent-MMGenEditはマルチモーダルハーネス、スケーラブルなデータ構築パイプライン、包括的なベンチマーク、エージェントポリシーとイメージバックエンドのためのポストトレーニングメソッドを含むフルスタックのレシピである。
最初にWeAgent-Harnessを紹介した。これは、永続的なエビデンス管理と、検索したマルチモーダルエビデンスを高密度キャリアにまとめる専用の検証と統合ツールである。これを用いて、高速な合成とエージェント軌道収集のためのスケーラブルなパイプラインを開発し、23Kの教師付きトラジェクトリと14.7KのRLタスクを3層検証チェックリストで生成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:12:03 GMT)
MePo++: Unifying Representation Refinement and Reconciliation for General Continual Learning [47.3] 一般的な連続学習(GCL)は、タスクの同一性、明示的な境界、あるいは以前のデータへの繰り返しアクセスのない、進化するデータストリームから学ぶことを目的としている。
MePo++は、表現の洗練と和解を通じて、事前訓練された知識と下流のGCLをブリッジする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:33:18 GMT)
Beneath the Surface of Chains-of-Thought: A Mechanistic Interpretation of Reasoning Operations in LLMs [47.0] 本研究では,異なる推論操作が隠れ表現に対応する幾何学的構造を示すか否かを考察する。
操作は保持された表現で分離可能であり、分離性は中間層でピークとなる。
本研究は,言語モデルが言語推論表現とその内部幾何学構造との表現的対応を維持することを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:37:12 GMT)
CPL: A Compact C-like Systems Language with Explicit Low-Level Control [45.9] Cordell Programming Language (CPL) は、C言語のようなコンパクトなシステム言語である。
CPLはCのメモリ、レイアウト、マシンインターフェースへの直接アクセスを維持している。
本稿では,C-likeが現代的アプローチやパラダイムよりもコンパイラ実験に有用かどうかを考察する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:07:15 GMT)
From Vision to Language: Investigating Causal Information Flow in Multimodal Decision-Making [45.9] 視覚情報がどのように言語に基づく決定に寄与するかを考察する。
その結果,視覚情報は主に統合され,モデルが候補回答を処理していることがわかった。
時間的推論において、VLMはビデオフレーム間のシーケンシャルな情報再構成に苦慮していることを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:52:27 GMT)
ConsensusBench: Benchmark of Consensus Nodes for LLM Reasoning via Outcome Reward Densifying [45.3] 我々はConsensusPRという新しい強化学習信号を開発した。
長い推論軌跡にまたがる結果報酬の幅を、直接的に減少させる。
AIME 2024, AIME 2025, GSM8K, MATH-500および我々のConsensusBenchにおける実験により,提案手法がGRPOスタイルのアプローチを一貫して超越していることが実証された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:29:10 GMT)
ReaDiT Guidance: Control for Image and Video Generation using Diffusion Transformer Features [43.2] 本稿ではDiffusion Transformer(DiT)モデルで生成を制御するためのフレームワークであるDiT Readout (ReaDiT) Guidanceを提案する。
ReaDiT Guidanceは、単一のDiTブロックの機能を使用して、テスト時に提供される空間的ターゲットに応じて生成プロセスを制御します。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:30:18 GMT)
A complete characterization of sequential testability and change detectability in i.i.d. models [42.8] あらゆる代替品に対してパワー 1 のレベル-() テストが存在するのは、その代替品が有限ブロック事象の可算族によってヌルから分離されているときである。
実際に同じ条件は、オプションの水平平均ラン長制御の下での変更検出可能性も特徴付ける。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 22:11:07 GMT)
Why Is SHAP Not a Reliable Standalone Explanation Framework for Malware Detection? [42.0] これらの保証は、信頼性のあるマルウェアの解釈には不十分である、と我々は主張する。
条件付きSHAPはモデルの特徴クレジットを$m-1$の冗長な特徴に対して1/m$で希釈する。
EMBER-2018、EMBER-2024、BODMASの固定光GBMとXGBoost検出器による実験により、これらの効果が確認された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:00:11 GMT)
ProtLingo: Efficient Protein Language Modeling via Conditional Memory and Expert Routing [39.8] タンパク質言語モデル(PLM)は、ラベルなし配列から配列-関数関係をモデル化するためのスケーラブルなアプローチを提供する。
ProtLingoは、条件付きローカルメモリとスパースエキスパートルーティングを備えた事前トレーニングされた単一シーケンスバックボーンを増強する、効率的なPLMフレームワークである。
ProtLingoは、突然変異効果予測の強力なパラメータ効率を含む、1億5000万スケールのバックボーンと競合するパフォーマンスを実現している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:46:42 GMT)
The Normalization of Deviance in AI Development [39.1] スペースシャトルチャレンジャー、スリーマイル島事故、ボーイング737MAX事故のケーススタディに基づいて、各失敗の前の共通構造機構を特定し、それらを現代のAI開発にマッピングする。
既存の安全インフラは、組織が完全なコンプライアンスで安全プロセスを完了し、なおも破滅的な結果をもたらすことができるため、見かけより少ない保護を提供する可能性があることを示唆している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 22:00:42 GMT)
Coincidence-based spectral engineering for spectral matching in cascaded downconversion [39.1] カスケード型自然パラメトリックダウンコンバージョンによって生成される3光子状態は、多粒子絡みへの直接的な経路を提供する。
本研究では,第2段階に入るポンプ光子のスペクトルを条件的に調整することで,偶然に基づくスペクトルフィルタリングが要求を緩和することを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:29:08 GMT)
WearableQA: A Benchmark for Health Reasoning over Real-World Wearable Data [37.5] WearableQAは、実際のユーザの経時的ウェアラブルレコードに対するAIシステムの推論を評価するためのベンチマークである。
我々は,2つの相補的軸に沿って整理された16の質問型(データ対健康推論,シングル対信号間推論)を紹介した。
14のプロプライエタリでオープンソースのLCMの評価は、WearableQAがモデル機能を効果的に差別化し、性能は19.6%から72.9%であり、10%の確率ベースラインであることを示している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:52:37 GMT)
Large Language Models for HVAC Operations in Building Energy Systems: A Critical Review of Methods, Applications, and Deployment Readiness [37.4] 自動化システムの構築は、不均一なポイント命名、メタデータの欠如、断片化されたドキュメントのために、リッチなセンサデータを生成するが、洞察力に乏しいままである。
2023年から2026年にかけて発行されたHVACオペレーションのための大規模言語モデル(LLM)に関する66のピアレビュー研究を体系的にレビューする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:08:05 GMT)
BIT.UA at BioASQ 14B: Modular Retrieval with pg_textsearch and Qdrant, and Agent-Based Answer Generation [37.2] 本稿では,BIT.UAチームによるBioASQ Task Bチャレンジのバイオメディカル質問応答への参加について述べる。
パイプラインの検索と生成の両方に、大幅にモジュール化されたアプローチを導入します。
SPLADE や ColBERT の統合など,これらのアーキテクチャ変更の影響,学んだ教訓,今後の作業の方向性について論じる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:10:07 GMT)
When Linguistic and Internal Confidence Diverge in Large Language Models [36.6] 大きな言語モデル(LLM)が内部の信頼度を追跡するかどうかは不明である。
分類において,言語的信頼度とロジットに基づく信頼度を比較する。
言語的信頼度が意味エントロピーに基づく不確実性を追跡するかどうかを世代毎に検証する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:39:21 GMT)
When LLM Decompilers Recompile More and Preserve Less [35.3] 我々は、ある関数が出荷された全てのテストに合格し、他の正当な入力で分岐することを示します。
De-Divergeは,定型あるいは手作業によるテストに頼らない行動比較オラクルである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:16:18 GMT)
Communication-Efficient Personalized Federated Learning via Layer-Wise Multi-Threshold Random Sketching [34.9] レイヤワイドマルチスレッドランダムスケッチによる通信効率のよいPFLフレームワークを提案する。
提案手法は,コンパクトな低ビットスケッチを用いた双方向通信を支援する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:35:24 GMT)
LookStep: Efficient Vision-Language Navigation with Linguistic Foresight and Event Driven Memory [33.6] Vision-Language Navigation (VLN) は、目に見えない環境で自然言語の指示に従うための具体的エージェントを必要とする。
我々は、Language Centric Future State ModelingとEvent Driven Rolling Memoryを組み合わせた、統合されたエンドツーエンドフレームワークであるLookStepを提案する。
LookStepはR2R-CE Val-Unseenで49.7%の成功率を達成した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:59:59 GMT)
IndicSafeEval: Safety Robustness of Large Language Models under Multilingual Persuasive Jailbreak Attacks [33.1] IndicSafeEvalは、インドの言語に対する説得力に基づくジェイルブレイク評価フレームワークである。
私たちのベンチマークでは、安全クリティカルなコンテンツカテゴリー10と、異なる4つのインドの言語にわたる6つの人間のような説得戦略を組み合わせています。
我々の分析は、モデルがすべての言語やプロンプトスタイルに対して均等に振る舞うわけではないことを示している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:46:25 GMT)
VisCAD: A Foundation Model Suite with Multimodal Industrial CAD Intelligence [33.0] パートレベルの生成は、レンダリング、テキスト記述、2D描画、実際の写真など、さまざまな形式のユーザインテントをマップする。
アセンブリレベルの生成は、相互作用する部分、計画的な交際関係、見積もりのポーズ、すべての部分の正しい配置を、追加で処理する必要があります。
本稿では,現実的な産業製品に対して,広範な一般化と強力なCAD機能を実現するための基礎モデルスイートであるVisCADを紹介する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:31:25 GMT)
First Things First: Teaching LLM-Based Agents to Prioritize Must-Haves before Nice-to-Haves [29.4] 我々は3,649個の慎重に構築された問題に対して,最先端のマルチモーダル言語モデル (MLLM) を評価する。
既存のMLLMはあらゆるシナリオで破滅的な失敗を示す。
マルチプライオリティなユーザ要求に対する推論を明示的に最適化する,First Things First Reinforcement Learning FTF-rlを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:54:30 GMT)
What Matters, When? Diagnosing and Improving Conditional Visual Grounding in Visuomotor Imitation Policies [28.1] Visuomotorの模倣ポリシーは、分布内視覚条件下では高い性能を達成できるが、視覚的に類似したオブジェクトが導入されると失敗する。
色と形状の類似性を制御したディストラクタオブジェクトを導入し、ピックと配置の失敗をローカライズする。
視覚的類似度の種類と操作段階の両方に障害感度が比例していることが判明した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:27:35 GMT)
A Robust Watermark-based Fingerprint Framework for GNNs Ownership Verification [28.0] グラフニューラルネットワーク(GNN)のための堅牢なwatErMArkベースのfingeRprint frameworKを提案する。
本稿では,REMARKが保護モデルの有用性を維持しつつ,最先端のOV精度とロバスト性を実現することを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:06:54 GMT)
NavArena: Automated Construction of Goal-Oriented Navigation Benchmarks from 3D Gaussian Splatting Reconstructions [27.7] NavArenaは、固定された3DGS再構成を目標指向のビジュアルナビゲーションのためのベンチマークに変換する自動化フレームワークである。
NavArenaは2000以上のシーンで2220万のエキスパートトラジェクトリを生成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 01:02:03 GMT)
How Does mHC Use Its Residual Streams? Selective Routing and Near-Identity Mixing [27.3] ハイパーコネクションとその多様体に制約のある変種 mHC は、1つのストリームから n への残留経路を広げる。
本研究では,DeepSeek-V4-Flashの4流残留経路におけるこれらの特性について,実効的なストリーム数,ストリーム間残留重量,ストリーム間コサイン類似性を用いて検討した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:02:20 GMT)
Better Understanding, Better Fixes? A Study of Hallucination in LLM-based Automated Program Repair [27.3] 大規模言語モデル(LLM)は、大幅に進歩した自動プログラム修復(APR)を備えている。
APRでは、幻覚は最終パッチだけでなく、パッチ生成を導く中間アーティファクトにも生じうる。
我々は幻覚を、利用可能な修復証拠に忠実に根ざしていないパッチや中間的アーティファクトの生成として特徴づける。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:11:27 GMT)
Coupled Control and Wireless World Models for Resilient Remote Robotic Control [26.8] 本稿では,JEPA(Joint Embedding Predictive Architecture)と結合制御に基づく通信対応遠隔ロボット制御フレームワークを提案する。
学習した潜伏表現は、将来のロボットの状態と無線条件を共同で予測することにより、予測的な通信スケジューリングを可能にする。
適応型レジリエンス機構は、潜時予測の不一致を検出し、知覚埋め込みを効率よく適応して、無線および視覚環境の変化に対応する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:09:55 GMT)
Synthetic Worlds for Temporal Evaluation and Knowledge Updating in LLMs [26.7] 大規模言語モデル(LLM)は静的事前学習コーパスに依存しており、その知識は時間が経つにつれて時代遅れになる。
知識編集を評価する既存のアプローチは、急激な汚染に悩まされるか、あるいは、厳格な知識と矛盾する対実的な編集に依存している。
制御された評価のためのコヒーレントなイベントトラジェクトリを生成する架空の、現実的な未来の世界のベンチマークであるSc ParallelEventsを紹介する。
sc Synapseは、モデル生成データを用いて、ミッドトレーニングとインストラクションチューニングを通じてモデルパラメータを更新するトレーニングフレームワークである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:29:17 GMT)
Almost Free State Prediction Separation [25.8] 無料の一時停止トークンは、言語モデルに次の入力予測を生成する余分な計算を与える。
1Bパラメータモデルで実際に2~3セントで次トーケン予測を改善する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:55:56 GMT)
From Interpretability Methods to Interpretable Models [25.7] 我々は、フィールドの焦点をメソッドからモデルに変えることについて論じる。
既存のツールは、異なるモデルの表現と計算を特徴付け、比較することができます。
もう1つは難しく、ほとんど無視されています。モデルが実際にそれに依存している人間によって理解できるかどうかです。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:46:33 GMT)
What Matters in On-Policy Distillation? A Perspective on Data Efficiency and Data Selection [25.4] On-Policy Distillation (OPD) は、ドメイン推論において大規模言語モデルを強化するための訓練後パラダイムとして広く採用されている。
本稿では,OPDにおけるデータ効率とデータ選択に関する実証的研究について述べる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:32:08 GMT)
Compression Beyond the Uncompressed: A Two-Stage Training Recipe for Soft Context Compression in RAG [24.9] 我々は、RAG推論のための2段階のトレーニングレシピであるDEX-Compを提案する。
DEX-Compは、検索したコンテキストを16times$で圧縮し、推論を4times$--24times$で高速化する。
検索深度における5つのオープンドメインのQAベンチマークでは、DeX-Compは検索したコンテキストを16Times$で圧縮し、推論を4times$--24times$で高速化する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:53:43 GMT)
ViT3Flow: A Test-Time Training Transformer MeanFlow for Postoperative Radiograph Synthesis in Scoliosis [24.8] われわれは,この問題を術後硬化性X線写真合成として定式化し,この課題のための最初のペアデータセットであるScoliSurgを構築した。
効率的な術後X線合成のための単一NFE条件付きMeanFlowフレームワークであるViT$3$Flowを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:14:33 GMT)
UniMate: One Unified Model to Animate Diverse Skeletons [23.0] 任意の骨格の関節運動を3Dアセットとテキストプロンプトから合成する基礎モデルUniMateを提案する。
UniMateは、骨格トポロジを注意に組み込むトポロジ対応拡散トランスフォーマーを導入している。
また,二足歩行,四足歩行,鳥類,海産,昆虫型,セルペンチン,関節状固形物を対象とし,UniML3D,13,006の運動配列を治療した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:59:00 GMT)
Shadow Queries for Private Retrieval in Vector Databases [22.5] 組込み反転攻撃(EIA)に対するセマンティック分解および組込み分離防御であるSHAQを提案する。
ドキュメントの埋め込みを直接格納する代わりに、SHAQは生成言語モデルを使用して、各ドキュメントの異なるセマンティックな側面をキャプチャする多様なシャドウクエリを生成する。
実験により、SHAQは検索ユーティリティを保ちながら、プライバシーを大幅に改善することが示された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:59:54 GMT)
Human-Human & Human-Robot Interaction Transformer (H2INT) for Robot Navigation in Dense and Uncertain Crowds [22.5] 本稿では,政策学習における歩行動作のロボット条件変化を継続する強化学習フレームワークを提案する。
応答性は、ロボットが見えるが、ポリシー入力として供給されないときの群集のダイナミクスに影響を与える。
カリキュラムは、歩行者の応答性を徐々に減少させ、相互作用の困難を増大させる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:53:56 GMT)
Controversy and Group Certainty Jointly Shape Everyday Moral Judgments [22.4] 本研究では,ニュアンス付き対人ジレンマの判断が,集団的意見を伝える社会的情報にどのように反応するかを検討した。
Redditのr/AmItheAssholeに投稿された54,827の判定結果から,これらの信号を抽出した。
これら3つの治療法はいずれも弱体化、評定の変更、あるいは信頼性の低下、そして、評定変更なしに信頼度を高めた。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:29:47 GMT)
Grounded Skill Synthesis from Code at Scale for Agentic Intelligence [22.3] 既存の手法には2つの制限がある: 軌道に基づく合成は特定の環境との相互作用を必要とするが、文書由来のスキルは実行可能な証拠や検証を欠いている。
Code2Skillは、選択されたコードユニットを、アトミック操作、コンポジットレポジトリ、繰り返しパターンの実装アンコールされたレコードに変換する、完全に自動化されたパイプラインである。
Code2Skillは、ワークフロー、バウンダリ、プロビデンス、およびソースエビデンスメタデータを備えた、1,006,822の受け入れレコードからなるグラウンドドバンクであるCodeSkillBankを生成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:37:06 GMT)
Towards Efficient Evaluation of Evolutionary Transfer Optimization: Case Studies on Task-Parameterized Applications [22.0] 評価のスケーリングは、評価されたタスクの数と、各タスク内のワークロードの2つのレベルに分類します。
マルチタスク最適化では、累積リンク方向の累積行列表現を用いて行列再帰的キネマティックアームの評価を再構成する。
逐次移動最適化では、軌道および衝突計算のための混合行列表現を用いて、点方向のB-スプライン軌道の評価を再構成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:01:53 GMT)
BLASt3R: Bundle Adjustment of Any Image Set with Multi-View Matching and Monocular Priors [19.9] 近年のStructure-from-Motion (SfM) システムは,フィードフォワード3次元再構成の堅牢性と従来のバンドル調整(BA)の精度を画素マッチングと組み合わせている。
本稿では,初期化と正規化のために,高速なマルチビューマーカとモノクラー先行処理を利用する正規化BAフレームワークを提案する。
既存のシステムとは対照的に、当社の統一的なアプローチは、オンラインVSLAMと、同じ最適化フレームワーク内の未順序画像コレクションからのオフライン再構築の両方をシームレスにサポートしています。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:41:52 GMT)
Improving Language Identification for Code-Switched Utterances with Integer Linear Programming [19.9] 本稿では,コードスイッチング(CS)識別のための最先端技術であるMaskLIDを再検討する。
MaskLIDはトレーニングを必要とせず、任意の言語の組み合わせを検出する。
a) MaskLIDの大きな問題、(b) 基礎となる最適化アルゴリズムを線形プログラムとして再構成すること、(c) これらの改善はいずれもベースラインシステムを大幅に改善する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:30:01 GMT)
A Cost-Aware Agentic Architecture for NL-to-SQL over Nested Enterprise Schemas, with a New Benchmark [19.9] 我々はDevRev NL2ベンチマークを紹介した: ネスト型およびリンクグラフ構造を持つ900の検証クエリを実行する。
本稿では,この方式が課す要求に対して,スキーマ選択,エラー検索といったコンポーネントを設計した,コスト対応の単一世代エージェントアーキテクチャを提案する。
DevRev NL2ベンチマークでは、システムは91.7%の正当性を達成し、次のベストベースラインで54.6ポイントのマージンを得た。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:20:53 GMT)
Simulation-free Unbalanced Dynamic Optimal Transport with General Growth Penalty [15.1] 単細胞スナップショットから細胞動態を推定するには、状態遷移と人口増加または死の両方をモデル化する必要がある。
非平衡動的最適輸送(UDOT)は、輸送経路に沿って成長をペナル化することによってこの問題に対処する。
textbfSimulation-free textbfUn Balanced textbfDynamic textbfOptimal transport (SUDO)を導入する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:30:05 GMT)
Measuring the Novelty of Biomedical Papers Using the Latent Distances between Knowledge Units [14.8] 本研究では,知識単位間の3種類の関係を包含した包括的ノベルティ測定手法を提案する。
PLoS ONEで発行された142,036項目のデータセットとH1 Connectプラットフォームからの検証データセットを用いて、各関係型がMeSH項間の異なる遅延距離をキャプチャすることを示した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:14:26 GMT)
SimFuse3D: Source-Guided Target Simulation and Confidence-Guided Multi-Stage Localization Reweighting for Cross-Platform 3D Object Detection [14.5] センサ高さと視点の変化は、オブジェクトレベルの点分布を変化させ、クロスプラットフォームのLiDAR非教師なし領域適応を困難にする。
そこで,SimFuse3Dを導入し,ラベル付きソーススキャンから計測した幾何を用いて,対象の配置を保存し,関連する擬似オブジェクトを修復する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:41:56 GMT)
PAC-Bayesian Reconstruction Guarantees for Time Series Variational Autoencoders [14.5] PAC-Bayesian framework for latent variables model applied to time series。
PAC-Bayesian 保証を Markovian latent 構造に拡張し、逐次生成過程を通じて時間的依存関係をキャプチャする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:44:20 GMT)
Robust Coverless Linguistic Steganography via Sentence Embedding Space with Global Resynchronization [13.3] 言語ステガノグラフィーは、自然言語による秘密のコミュニケーションを可能にする。
既存の手法はトークンレベルの操作に依存しており、単語や文レベルの摂動の下で信頼性を維持するのに苦労している。
本稿では,トークン空間ではなく文埋め込み空間で機能する頑健な非被覆型ステガノグラフィーフレームワークを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:22:35 GMT)
Understanding the Privacy-Preserving Potential of HTTP/2 Against Webpage Fingerprinting [13.2] Webサイトフィンガープリント(WF)攻撃は、暗号化されたHTTPSトラフィックからユーザーが訪問するWebページを推測することができる。
WFディフェンスは通常、ノイズ、パディング、遅延、フロースプリットを通じてトラフィックを形作る。
私たちは、最も広くデプロイされたHTTP、HTTP/2によって実現されるアプリケーション層防御に焦点を当てています。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:16:30 GMT)
Personalized Task Dependency Graphs for Mitigating Signal Erosion in Multi-Task Recommendation [12.8] パーソナライズされたタスク依存グラフ(PTDG)を提案する。
PTDGは、構造的堅牢性を確保するために、低ランク近似を通じて各項目の依存性経路の強度を「リワイヤ」する。
KuaiRand1Kの実験と工業データセットによれば、PTDGはスパース変換タスクのAUCを最大1.45%改善している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:23:12 GMT)
Controlling and Assessing Appropriate Persona Use in LLM-based Dialogue Generation [12.6] SCONPOS(Self-contrastive Persona Overuse Suppression)は、乱用と乱用の両方を罰する新しい指標である。
Persona Appropriateness Score(PAS)は、乱用と乱用の両方を罰する新しい計量である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:08:29 GMT)
CoMLP: Cooperatively-Gated MLPs for Fine-Grained Cross-Modal Information Fusion in Medical Image Segmentation [12.5] マルチモーダルな医用画像と臨床報告は、医用画像セグメンテーションのための相補的解剖学的、機能的、意味的な情報を提供する。
既存の融合アプローチは、空間分解能によって計算負担が急速に増加するクロスアテンションにしばしば依存する。
医用画像セグメンテーションにおける細粒度クロスモーダル情報融合のための協調制御モジュールであるCoMLPを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:18:44 GMT)
CoSkill: Joint Reinforcement Learning of Reasoning and Meta-Skill Agents for Hierarchical Skill Evolution [12.5] CoSkillは、静的メタスキルワークフローを学習可能なメタスキルエージェントとして再キャストする統合マルチエージェントRLフレームワークである。
ReasoningとMeta-Skill Agentsを単一のバックボーンを共有する協力チームとしてモデル化することで、CoSkillはエンドツーエンドのコ適応を可能にする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:25:30 GMT)
Towards Neuro-Symbolic Procedural Reasoning for Long-Horizon Vision-Language-Action Manipulation [12.5] 視覚言語アクション(VLA)モデルは短い操作スキルを実行することができるが、長い水平手順では不安定である。
本稿では,学習したVLA制御と明示的なタスクグラフ,マルチモーダル・プロシージャ記憶を組み合わせたニューロシンボリック・フレームワークについて検討する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:14:50 GMT)
MINT: A Unified Model for World-Space Camera and Hand Motion Estimation from Scalable Egocentric Pipeline Supervision [12.3] 我々は,エゴ中心のRGBビデオから世界空間の2手軌跡を完全生成する最初のモデルであるMINTを紹介する。
ペアのワールドスペースカメラと手書きアノテーションが不足しているため、そのようなモデルを大規模にトレーニングすることは難しい。
1,021時間のエゴセントリックな軌道データセットをリリースします。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:05:11 GMT)
MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following in Vision-Language Models [12.3] MM-IFEval-Proは中国語と英語のタスクと多様な命令ハイジャックケースをカバーするマルチモーダル・インストラクション・フォロー・ベンチマークである。
MM-IFEval-Proは4つの主要なタスクカテゴリと24のサブカテゴリと52のサブカテゴリを持つ8の命令カテゴリを含む。
MM-IFEval-Pro 上でのモデル性能を大幅に向上させるため,中国語と逆行命令に富んだ強化学習セットを構築した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:18:00 GMT)
GUT: Quantifying and Optimizing the Reasoning Uncertainty of LLMs via Graph Complexity [12.2] グラフ複雑度に基づくUncerTainty(GUT)法を提案し,Large Language Models(LLMs)の推論の不確実性について検討する。
GUTの鍵となる考え方は、各推論鎖の潜在的な枝を有向非巡回グラフで特徴づけることである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:40:12 GMT)
Constructing and Evaluating Clinical Reasoning Trajectories for Medical Agent [12.2] 提案するMedTrajは,推論軌道を設計,評価,最適化のための重要な対象として扱うフレームワークである。
パイプラインは、医療的推論源から構造化された多段階推論連鎖を生成する。
制御されたエラーインジェクションは、特定の推論失敗と測定可能な品質劣化の因果関係を確立するために、ターゲットの障害を正しい軌道に導入する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:44:10 GMT)
Some Tokens Behave like Magnets: Revealing Linguistic Organization in the Layers of Language Models [12.0] 大規模言語モデル(LLM)内のトークンベクトルの特別なグループを特定し、それらを引き付けるか、取り除くことで、周囲のトークンを整理する。
言語カテゴリーでは,関数語が初期層における磁石の反発として一貫して機能する,統計的に重要なパターンが見つかる。
この現象は、言語モデルが階層にまたがる言語計算をどのように幾何学的に整理するかを理解するための、最初のプローブなしの道を開くことで、さらなる調査が保証されると考えている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:42:18 GMT)
GeoContext: One Context Ladder, Two Failure Modes in Vision-Language Geolocation: Flat Reliance on User-Provided Location Context and False Confirmation of Location Claims [12.0] GeoHintとGeoVerifyは、画像が主張された場所から150m以内で撮影されたかどうかのバイナリ検証である。
GeoContextは、距離と参照可能性に応じて近くの参照ポイントを階層化することでコンテキストはしごを構築する。
ベンチマークは30都市の109のサイトをカバーし、21,933のGeoHintレスポンスと6,270のGeoVerifyレスポンスを使用して5つのビジョン言語モデルを評価する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 22:52:31 GMT)
Dressing in Motion: A Human Motion-Aware Diffusion Policy for Robot-Assisted Dressing [11.9] 静的な専門家によるデモンストレーションからドレッシングスキルを学び、ダイナミックなユーザモーションシナリオに一般化するビジュモータポリシーを提案する。
衣服と人間の相互作用の幾何学に合わせた拡散政策は、腕の姿勢の異なる部分的な観測点の雲から学習する。
本研究では,9人の被験者,3種類の衣服,6つの腕の動きパターンを含む実世界の人間実験とシミュレーションによる手法の評価を行った。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:42:04 GMT)
Design Docs Are All You Need: An AI-native Machine-Learning Performance Tool [11.9] 機械学習のパフォーマンスモデリングは、長期間のソフトウェアにとってユニークな敵意のある分野である。
本稿では,ほとんどコードを持たないMLシステムのための厳密なシンボル的性能モデリングライブラリについて述べる。
人間の変更はすべて、自然言語でドキュメントを編集する作業です。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:08:51 GMT)
Ask Before You Optimize: Dynamic Pre-Formulation Clarification for Interactive Optimization [11.8] 本稿では,事前定式化のためのベンチマークであるOR-Clarifyを紹介する。
本稿では,未解決な定式化クリティカルギャップを識別する2段階フレームワークInterOPTを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:19:38 GMT)
SAM-D2Q: Aligning Multimodal Doc2Query with Search Demand and Conversion for E-commerce [11.8] 電子商取引検索は、しばしばユーザクエリと商人が所有する製品タイトルの語彙ミスマッチに悩まされる。
従来の手法はテキストのみであり、eコマースビジネスの目的に最適化されていない。
本稿では,ビジネス対応のマルチモーダル文書拡張フレームワークであるE-Commerce Multimodal Doc2Query (SAM-D2Q)を提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:09:04 GMT)
Training Large Language Models for Small-Molecule Design with Synthetic Task Scaling [11.8] 大規模言語モデル(LLM)は、この問題に先立って有用な生成を提供する。
多くの化学的に関連するスコアリング機能は、評価に数時間または数日を要するため、オンライントレーニング中に直接使うのが違法に高価である。
我々は,LLMが高価な分子リード最適化設定に一般化する安価な合成タスクから分子設計戦略を学習できるかどうかを検討する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:05:44 GMT)
CHAMP: Cross-domain Hybrid Architecture for Matchmaking and Prediction in Online Multi-Player Games [11.5] マルチプレイヤーオンラインバトルアリーナ(MOBA)ゲームは、競争バランスを維持するためにマッチメイキングに依存している。
デプロイメントボトルネックを解決するクロスドメインマッチングフレームワークであるCHAMPを紹介します。
CHAMPはターゲットモードのみのプレイヤープロファイルをハイブリッドドメイン機能コレクションに置き換える。
67.73%の勝利率予測精度を達成し、評価されたすべての注意とシーケンスベースラインを上回っている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:30:29 GMT)
Whose record is this? Diagnosing and authorizing record use in personalized multimodal models [11.5] コンテキスト化された視覚的パーソナライゼーションは、真のレコードを取得して、間違った視覚的主題に適用することができる。
主観的存在(P$)、記録的有効性(E$)、回答支援(S$)は全て保持しなければならない。
RecordAuth-Diagは3,690ケースの一致した診断スイートで、クエリ、質問、記録テキスト、画像多重セットを保持しながら、1つの画像-記録エッジを変更する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:00:14 GMT)
TruthInsightBench: An Evidence-Grounded Benchmark for Automated Evaluation of Open-Ended Scientific Discovery Agents [11.4] 本稿では,発見のためのベンチマークであるTruthInsightBenchを紹介する。
10の科学領域にわたる40の査読された研究から引き出された40の盲目タスクは、中立的な科学的目的と凍結したデータのみを露呈する。
固定LDMベースの審査員は、6次元に沿ってエージェント自身のクレームの明らかな成熟度を評価する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:37:20 GMT)
Connecting Score Matching, Maximum Likelihood, and Expectation-Maximization in Mixed Linear Regression [11.2] 混合線形回帰(MLR)における応答の分散保存拡散と未知の混合重みについて検討した。
本分析では,不規則な拡散雑音レベルにおける損失幾何と最適化信号から,スコアマッチングの統計的保証を分離する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:52:26 GMT)
FluxDisco: Symbolic Regression for Stoichiometric Dynamical Systems via Monte Carlo Graph Search [11.1] 本稿では,フラックスをベースとした統計的ODEシステムに適した物理インフォームフレームワークであるFluxDiscoを提案する。
筆者らはモンテカルログラフ探索アルゴリズムを用いて, 連立フラックス発見に係わる特異な課題について検討した。
本手法は,様々な物理・生物学的システムにまたがって評価され,解釈可能な方程式を用いて制御力学を正確に回復する能力を示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:38:59 GMT)
ReCAST: Restoration-aware Cascaded Stage-wise Training for Obfuscated SMS Risk Classification [11.0] 中国のSMSでは、攻撃者はさまざまな難読化戦略を利用して、リスクを負うフレーズを隠すことができる。
頑健な難読化中国語SMS分類のための再生対応カスケード段階訓練フレームワークであるReCASTを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:36:21 GMT)
PLUME: Parameter-Efficient Personalization of Large Language Models via Low-Rank User Modulation in Shared Subspaces [10.9] PLUMEは、共有タスク固有のサブスペースを活用することで、ユーザごとの効率的かつ表現力のある適応を実現するフレームワークである。
PLUMEは、ユーザ毎のパラメータを95%以上削減しながら、強力なベースラインと同等または優れたパフォーマンスを実現している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:38:50 GMT)
A Unified Physics-Aware Quantum Machine Learning Framework across Power GaN HEMTs and Logic Nanowire FETs: Predicting Unseen Process Splits and Held-Out Geometry Combinations with Lower Error and Tighter Split-to-Split Variability [10.9] データスカースデバイスモデリングのための小型パラメタライズド量子回路(PQC)を探索する統合強化学習フレームワークを提案する。
グラフニューラルネットワーク(GNN)ポリシーは、ホールドアウトプロセスや幾何グループに対するLOGOCV(Left-one-out cross-validation)エラーを報奨として回路アーキテクチャを探索する。
このフレームワークは、11の目標に対して6つの古典的ベースラインに対して最低平均絶対誤差(MAE)を達成し、59%の誤り(Ioff)、81%のHEMTに対する厳密な折りたたみ変動(VTH)、84%の誤り(V)を達成している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:15:40 GMT)
Nonparametric Hypothesis Testing of High-dimensional Clustering With Application to Single-cell RNA Data [10.9] 単細胞RNAシークエンシングの研究では、クラスタリングを用いて細胞の種類や細胞状態を定義する。
本稿では,高次元データにおけるそのようなクラスタリング構造の形式的意義試験について検討する。
SigClust-LCPは1つのクラスタを対数凹面分布でモデル化する非パラメトリック拡張である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:36:26 GMT)
How Do Language Models Represent and Use Phonological Information for Allomorph Selection? [10.8] トリガトーケン埋め込みにおいて,音韻条件は単一の線形方向に沿って符号化されていることを示す。
そして、このルールのような一般化が、英語の記事選択を超えて拡張されるかどうかを問う。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:28:56 GMT)
Who Maintains Agent Skills? A Longitudinal Study of Human-Governed, AI-Assisted Skill Maintenance [10.6] 最近の研究は、スキルキュレーションの自動化を目指しているが、自動化されたベースラインに対して大きく評価され、人間のメンテナンスは未測定のボトルネックとして扱われる。
2025年10月から2026年6月までの873のコミット、143のスキルファイル、254の実質的なポストクリエーション編集を含む、5つの公開AIスキルレポジトリ、AIツーリング組織のサンプルの完全なコミット履歴を掘り下げました。
まず、すべての実体的編集は、名前のついたヒューマンアカウントを通じて作成またはマージされ、62%は、大きなリポジトリレベルのバリエーションを持つAI共著者トレーラーを担っている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:18:18 GMT)
Mitigating Performance Discrepancy in Cross-Domain 3D Class-Incremental Learning [9.4] 3D知覚は、自律運転、ロボット工学、AR/VRといった現実世界の応用において重要な役割を果たす。
2D画像とは異なり、3Dポイントの雲は本質的に異質である。
性能劣化の程度はドメインによって大きく異なり、これはパフォーマンスの相違という現象である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:20:00 GMT)
Temporal Residual Neural Radiance Fields for Monocular Video Dynamic Human Body Reconstruction [9.4] 本稿では,動的シーンの人間の3次元モデリングにおいて,効果的に複雑な信号を処理する手法を提案する。
ビデオシーケンスにおける時間的信号の表現の問題に対処するため,アーキテクチャとは無関係な時間的残留場を構築する。
第二に、再構成効率を向上させるために、トレーニング可能なパラメータを削減し、レンダリングを高速化する統合的なアプローチを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:40:30 GMT)
A Rubric-Guided Large Language Model Solution for Opioid Use Disorder Computable Phenotyping [9.3] オピオイド使用障害(Opioid use disorder, OUD)は、アメリカ合衆国における公衆衛生上の危機である。
本研究は,OUD計算可能表現型(CP)のためのOPRO(Prompting)による最適化を取り入れたLugric-Guided Large Language Model (LLM)を開発した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:34:22 GMT)
A Location-Invariant Estimator of Extremal Quantile Treatment Effects for Heavy-Tailed Distributions [9.3] 量子処理効果(QTEs)は、結果の分布に対する処理の効果を測定する。
重み付けされた潜在的な結果に対して、既存の極端QTE推定器は、因果極値指数(EVI)推定器と組み合わせて外挿に依存する。
Inverse propensity score weighting を用いて、EVI の位置不変フラガ推定器を因果設定に適用する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:49:00 GMT)
ARC-Loc: Leveraging Azimuthal Ray Convergence as a Geometric Cue for Direct Cross-View Localization [9.2] クロスビュー・ローカライゼーション(CVL)は、地上画像とジオレファレンス衛星画像とのマッチングにより、地上画像のポーズを推定する。
衛星画像のマッチングと位置決めを外部の深度基礎モデルに頼らずに直接行うことができるリセクションと呼ばれる人間のナビゲーション技術に着想を得たアプローチを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:19:37 GMT)
Synergistic Information Disentanglement for Omni-modal Slide Representation Learning in Computational Pathology [9.1] スライド表現学習のための相乗的情報分散フレームワークであるtextsc$mathrm$-Omniを紹介する。
標準的なコントラストアプローチとは異なり、textsc$mathrm$-Omniでは、提案された$mathrmtextID$ objectiveによって規制されたSynergistic Information Bottleneck (SIB)を採用している。
textsc$mathrm$-Omniは、5つの独立した外部データセット間で優れた数ショットパフォーマンスを示している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:51:58 GMT)
Real-World Multi-Modal and Longitudinal Lung Cancer Dataset [9.1] 本研究では,現実的な条件下での幅広い学習パイプラインの評価を支援するために,新たにキュレートされたデータセットを提案する。
このデータセットは、合計1,365人の肺癌患者からなり、3つの画像モダリティ(全スライディング画像、CTスキャン、PETスキャン)、構造化された臨床データ、転写学的および経時的追跡および治療情報を含んでいる。
その結果、高いレベルの欠落にもかかわらず、相補的なモダリティを統合することで、ユニモーダルアプローチよりも予測性能が一貫して向上することが示された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:35:10 GMT)
Facial Age Estimation for Age Fraud Detection in National ID Systems [9.0] 生体認証の登録と更新の際のアイデンティティ詐欺は、大規模な国家認証システムにとって大きな課題である。
本稿では,Aadhaarのバイオメトリック学習パイプライン内での利用を目的とした顔年齢推定システムであるSwinAgeを紹介する。
SwinAgeは2.94年の平均絶対誤差(MAE)を同じテストセットで達成し、全てのベンチマークで3つのゼロショットビジョン言語モデルを上回っている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:16:00 GMT)
An Evaluation Framework for Generating Multi-View Images of a Person in a Scene [8.8] 無料のカメラアングル変更を実行するための基礎モデルのトレーニングにおける主要なボトルネックは、特別なトレーニングデータがないことである。
本研究では,人物の周囲のカメラの動きを定量的に評価するために,頭部回転差(HSRD)尺度を提案する。
HSRDは、シーン内の人物の3次元空間視差を評価するために必要なパイプラインを提供し、高品質なマルチビュー合成データセットを確実に構築する方法を提供する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 01:02:12 GMT)
Capsule Lens: Locating and Tracking Concept Geometry in Model Representations [8.8] 提案するCapsule Lensは、その領域のコンセプトを、シンプルで追跡可能な幾何学形式にマッチさせるフレームワークである。
静的表現では、様々なモデルにまたがる概念幾何学の発見方法と、スパン曲線とノルム曲線が重要な幾何学的特徴を明らかにする方法を示す。
動的表現について、異なるトレーニング設定によって誘導される表現のドリフトを追跡する3つのケーススタディを提示する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:15:04 GMT)
Can Large Language Models Anticipate Behavioral Responses to Social Policies? A Case of Pension Enrollment Prediction among China's Flexible Workers [7.8] 中国におけるフレキシブルワーカー間での階層的年金参加予測タスクのためのドメイン特化大型言語モデルFlexPension-LLMを提案する。
DKI-RDistillは,プロビット由来の辺縁効果やフルクープロンス年金規則など,政策的な手がかりをインジェクターに注入する。
この方法はLoRA/SFTを使って、理性に富んだ指導をオープンウェイトなMoE学生に蒸留し、これらのケースを再生することで教師のエラーを修正する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:24:27 GMT)
Solving Hard XAI Queries Based on a Compiled Dual-Rail Encoding [7.1] 現実のアプリケーションにおける人工知能(AI)の採用は、その信頼性に関する多くの懸念を引き起こしている。
eXplainable AI(XAI)の分野は、AIシステムによる決定について、ユーザに説明を提供することを目的として登場した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:33:00 GMT)
Refuse without Refusal: A Structural Analysis of Safety-Tuning Responses for Reducing False Refusals in Language Models [7.1] また, 否定文は, 表面的手がかりに依存することによって, 有害問合せと良性問合せの正確な識別を阻害することを示した。
また,合理性のみを訓練することで,同等の安全性能を維持しながら誤認を低減できることを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:37:10 GMT)
Research and simulation of analytical polarization control enabled by optical computing on an integrated photonics chip [6.8] 4相シフタと光学計算を用いた分析偏光制御(APC)法を提案する。
我々は、無限制御ユニットの偏極制御への影響をシミュレートし、第4相差が出力消滅率に及ぼす影響を定量化する。
その結果、フォトニクスチップの光学計算に基づく実用的なAPCアーキテクチャが確立された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:57:53 GMT)
Ritgard: T(r)opical Islands of Socio-Technical Artifacts on GitHub [6.1] 私たちは、社会技術的アーティファクトのためにGitHubリポジトリをマイニングするツールであるRitgardを紹介します。
Ritgard氏は、課題、プルリクエスト、議論を、木で覆われた3D島として視覚化している。
島々の地形は、話題が活発になると海から立ち上がり、沈むと再び沈む。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:31:52 GMT)
Does the Selected Object Reach the Reader? Auditing Identity Handoffs in Grounded Language-Model Pipelines [6.0] 接地された言語モデルパイプラインは、オブジェクトの選択、パスの取得、そしてそのエビデンスを使って答える3つのステージに分けられる。
我々は3つのセレクタファミリーで600のHybridQA質問を監査する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 00:20:12 GMT)
Interface-Aware KV Cache Quantization for Dense On-Chip NVM in Long-Context LLM Decoding [6.0] キーバリュー(KV)キャッシュは、Long-context Large Language Model(LLM)デコードにおいて、主要なメモリボトルネックである。
既存のKV量子化法はGPUスタイルのメモリシステムのために設計された。
本稿では,KVキャッシュが固定レンジコンバータの背後にNVM内に存在する場合のコストについて検討する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 22:58:21 GMT)
SiLR: Structure-Preserving Admission and Process Reward for LLM Tool Agents [5.9] 当科では, システムが違反状態にある間, 進展を認めなければならない, 退院後の入院について検討する。
SiLRは各提案をシャドウ実行し、ブランチレベルの違反状態に対して製品順序で承認する。
この順序に対してスカラーサロゲートが存在しないことが証明されるので、失敗はしきい値チューニングの問題ではなく表現的である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:03:52 GMT)
DeepAffinity: Long-Term Aspect Preference Prediction in eCommerce using Small Language Models [5.8] このタスクを解決することで、顧客の理解が向上し、レコメンデーション、検索、マーケティングにおける細かいパーソナライズが可能になる。
本稿では,SLM(Small Language Models)を利用したDeepAffinityを提案する。
本稿では,DeepAffinity が標準生成ファインチューニング法より優れており,汎用オープンソース LLM はタスク固有のチューニングなしでは性能が良くないことを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:50:20 GMT)
Open-Set 3D Scene Graphs for Field Robotics: An Outdoor Case Study [5.8] 3次元シーングラフ(3DSG)は幾何学的に接地された意味情報を持つ地図を構築するための有望なアプローチとして現れている。
複雑な屋外環境において発生する課題を特徴付けるために、5つの屋外ロボットデータセットにまたがるほとんどの3DSG表現に共通するコンポーネントを分析した。
以上の結果から,屋外3DSGはコンパクト(マルチキロメータトラジェクトリの600$MB以下)と比較的一貫した大規模環境表現を維持できることが示唆された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 01:14:09 GMT)
A Tree-based RAG Framework for Evidence-Intensive QA via Adaptive Planning and Topology-Aware Evidence Gathering [5.7] 最近の構造化RAG法は、木またはグラフに基づく推論構造を利用してマルチホップQAを改善する。
APT-RAG(Adaptive Planning and Topology-Aware evidence gathering RAG framework)を提案する。
証拠集約型QAベンチマークの実験では、APT-RAGは既存の構造化RAG法よりも優れている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:34:14 GMT)
One Word, Different Action: A Real-Robot Benchmark for Language-Conditioned Embodied Reasoning [5.5] 物理決定状態と実行可能なアクションに基づいて構築された実ロボットのベンチマークであるOne Word, Different Actionを紹介する。
実験により、現代のモデルは単一制約の命令変更でほぼ飽和状態にあるが、複数のタスク制約を1つの実行可能決定に組み込まなければならない場合、いくつかのモデルは顕著に劣化していることが示された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:21:58 GMT)
What Makes a Redundant Representation Remember? Lineage Isolation, Not Masking [5.4] 動的最適化のためのメモリベースの進化アルゴリズムは、しばしばジェノタイプの冗長な2番目のコピーを持ち、目的に1つのコピーしか公開しない。
この仮定は、通常実装されているように偽であることを示すとともに、シールドされたコピーが情報を保持するかどうかを実際に決定する構造的特性を特定する。
2つの独立設計軸を持つゲート二重コピー表現のような手法を定式化する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:57:10 GMT)
Gaussian Linear Functional Manifold Method for Massive Point Cloud Data [5.2] 本稿では,連続表面トポグラフィーを表す物理インフォームド統計フレームワークであるGaussian Linear Functional Manifold (GLFM)を紹介する。
GLFMはグラウンドポイントを自動的にフィルタリングし、形態的特徴を抽出し、フィールド検証されたグラウンド真理に対して0.9933の調整されたランドインデックス(ARI)を達成する。
このフレームワークは、大規模クラウド分析のための厳格で解釈可能なスケーラブルな基盤を提供する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:43:16 GMT)
Strict Modes Everywhere - Bringing Order Into Dynamics of Mechanical Systems by a Potential Compatible With the Geodesic Flow [5.1] このレターでは、構成空間を厳密な正規モードで満たすポテンシャルを設計する。
必要なトルクのほとんどは、アクチュエーターではなく、システムの弾性要素から来る。
実験により,本手法は実例システムで良好に動作したことが示された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:14:48 GMT)
Train What You Deploy:Token-Faithful Post-Training of a Production Coding [5.0] コーディングと終端エージェントのための既存のトレーニング後のパイプラインは、深刻なトークンを被り、忠実度エラーを制御する。
本稿では,練習者側サンプリングを元のプロンプト上で保持する忠実度対応型トレーニング結合フレームワークを提案する。
本稿では,C-DPPO(Certified Divergence Proximal Policy Optimization, C-DPPO)を提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:11:09 GMT)
One Bit of Collective Information Is Worth N ln 2 Bits of Local Information in a Many-Body Quantum Battery [5.0] 1ビットのデーモンは 集団スピンと相関して エネルギーをロックできる。
1ビットはNとは独立に固定されたエネルギーの一定割合を回復し、完全な読み出しの約2倍の処理を出力する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:56:17 GMT)
Knowing When to Stop: Adaptive Action Chunking via Internal Cross-Attention Dynamics in VLAs [4.8] アクションチャンキングは、現代のVision-Language-Action(VLA)フレームワークにおける標準的な実行戦略である。
短いチャンクは頻繁な推論を必要とするが、長いチャンクは新しく観測された状態と不一致となることがある。
我々は,この制限を,アクションエキスパートの内部的クロスアテンションダイナミクスに基づく適応的アクションチャンキングアプローチで解決する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:35:27 GMT)
On Epistemic Diversity in Large Language Models [4.8] 大きな言語モデル(LLM)は、質問に答えたり、説明したり、教えたり、質問をサポートするためにますます使われています。
認識の多様性は,LLMが知識集約的なタスクを支援するために使用される設定において有用な評価指標である,と我々は主張する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:49:59 GMT)
BEAM3R: Beam's-eye-view architecture with Mamba-3 for implicit dose reconstruction [4.7] ビームアイビュー(BEV)で動作する線量推定フレームワークBEAM3Rを提案する。
我々の中心となるイノベーションは、状態空間の深さシーケンスコアと物理ベースの輸送条件を組み合わせることである。
ビームレットは、ブラッグピーク位置を符号化した水等価厚さ残留範囲で条件付けされている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:26:08 GMT)
Newton Matching for Generative Modeling: A Unified Framework for Fine-Tuning and Sampling [4.6] 生成モデルにおける微細チューニングとサンプリングのための統合フレームワークであるNewton Matchingを開発した。
分離された損失から、標準モデルよりも反復的な最適化へとパラダイムをシフトする。
我々の研究は、生成モデルのための強化学習の理論とアルゴリズムを前進させる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:17:05 GMT)
Computing 256-bit elliptic curve discrete logarithms in 26 days on a fault-tolerant trapped-ion quantum computer with 20,000 qubits [4.5] 本稿では,$mathttsecp256k1$上の256ドルの楕円曲線離散問題対数(ECDLP)を解くための概念実証を行う。
我々は、Schrottenloherの最近の研究から得た回路を最適化し、約1450ドルの量子ビットと40cdot 106ドルのトフォリゲートを用いてECDLPを解くための論理量子回路に到達した。
我々のアーキテクチャに基づく量子コンピュータは、$mathttsecp256k1$でCDLPを解くことができると結論付けている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:04:05 GMT)
How to Speculate about Uncertainty in Agentic Coding? A Draft-Model Gate Method [4.4] ブラックボックスエージェントの予測故障信号を復元する手法である投機的不確実性(SU)を提案する。
我々は、推論とアクションスパンを分離して位相認識の特徴を抽出し、検証対象に対して校正する。
SUは、ルーティング、人間の介入、テストタイムの余分な計算など、ダウンストリームポリシーが直接的に消費できる、障害に似たスコアを生成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:30:22 GMT)
The marginal is pretty good [4.3] 最適状態の代わりに限界値を用いる場合の多くは十分に良好であり、小さな要因によってのみ結果が変化することを示す。
また、忠実度についても同様の関係を示し、サンドイッチ付きレニイ発散に対する純粋あるいは量子古典状態の場合も同様である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:55:19 GMT)
Proton Irradiation Characterization of an Open-Source ML Accelerator on a Zynq UltraScale+ MPSoC [4.3] 本研究は、Zynq UltraScale+システム上にデプロイされたオープンソースTensil NNアクセラレーターのための、システムレベルの陽子照射ベースラインを確立する。
20から58MeVの陽子照射の下では、監視された運転窓に4.29倍の1010/cm$2ドルを供給した。
このベースラインは、宇宙システムにおけるニューラルネットワーク推論のためのCOTS FPGA-SoCの将来のソフトウェア強化をサポートする、可用性損失とサイレント出力の破損を文書化している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:14:59 GMT)
Software Engineering in the Agent Era From Trustworthy Change to Human Agent Software Organizations [4.2] ソフトウェアエージェントはデジタル実行を弾力的にします。
問題フレーミング、セマンティックコミットメント、検証、統合、注意、残余リスクの受け入れは、人間の認知によって制限されている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:05:35 GMT)
A Fairness Audit of the Duckworth-Lewis-Stern Method: Format-Specific and Gender-Differential Bias, with an Interpretable Calibration Layer for Cricket Target Revision [4.2] ダックワース・ルイス・スターン法(Duckworth-Lewis-Stern、DLS)は、1999年以来、雨期限定クリケットの目標スコアを改訂するための国際規格である。
20年以上の運用期間にもかかわらず、その予測バイアスに関する大規模な実証的な監査は公開されていない。
我々は,Cricsheetから8,150の国際試合(3,095 ODIs,5,055 T20Is)を行い,時間分割を伴う233,550の合成中断シナリオを生成した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:38:00 GMT)
AI for Computational Design Science: A Responsible Human-AI Framework and Case Study on Short-Form Video Safety Surveillance [4.1] 我々はAI4CDS(Computational Design Science)のためのAIを開発する。
ChildRiskGuardは、子供に不適切な短いビデオを検出するための解釈可能なアーティファクトだ。
ChildRiskGuardはF1スコアの0.769を達成し、汎用コンテンツセーフティモデルの直接的な適用率を大幅に上回っている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:26:41 GMT)
Information-Guided Safe Reinforcement Learning for Autonomous Gas Source Localization using sUAS [3.8] 乱流大気境界層では、断続的なスカラー濃度場は古典的な勾配に基づく航法の前提に反する。
Information-Guided Safe Reinforcement Learning framework for a custom, GPU-accelerated 3D Simulation environment。
我々のフレームワークは、複雑なモバイルソース上で80%近いローカライズ成功を達成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 00:29:37 GMT)
Strong-Drive Limits in Josephson Circuits: From Chaos to an Unbound-Resonance Threshold [3.8] 駆動周波数とdcフラックスバイアスにまたがる磁束および電荷駆動ジョセフソン回路の強い駆動限界について述べる。
フラックス駆動SQUIDにおける低周波閾値の予測dcバイアス依存性を実験的に検証し, 両しきい値の解析基準を導出する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:23:57 GMT)
Training-Free Halving of Activated Experts in Fine-Grained Mixture-of-Experts Models [3.7] 再正規化は暗黙的に専門家のアウトプットゲインをトレーニングのトップ$k$に校正することを示す。
再正常化を完全に除去することは破滅的であり、適切な基準質量を維持することが重要であることを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 00:11:28 GMT)
Quantum Quenches across the Bose-glass Transition [3.7] 光準結晶中の超低温ボソンを用いた超流動-ボースガラス転移における量子クエンチの非平衡ダイナミクスについて検討した。
ボースガラス状態への高速なクエンチは運動量空間の量子ウォークを誘導し、より高次の運動量秩序を越えて広がる。
速度の遅いクエンチをより深い格子に解析し, 相転移におけるコヒーレンス崩壊を観察する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:21:53 GMT)
An overview of 3D Vision-Language Models [3.6] 3D Vision-Language Models (VLM) は、視覚とテキストの埋め込みを調整することでコンピュータビジョンを再構築している。
従来の3Dディープラーニングモデルは一般的に、分類、セグメンテーション、検出といった特定のタスクのために訓練されている。
Contrastive Language-Image Pretraining (CLIP) ベースの手法は、3D埋め込みを事前訓練された画像やテキスト表現と整合させる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:43:51 GMT)
Choosing the Right Language Mode at Inference Time for Multilingual Reliability [3.6] 大規模な言語モデルは、低級から中級の言語では推論に苦慮することが多い。
以前の研究によると、翻訳は、より強い英語中心の表現へのアクセスを支援することで、多言語推論を改善することができる。
これは、多言語の大言語モデルが確実に推論するためにどのくらいの翻訳が必要かという、中心的な疑問を提起する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:36:26 GMT)
InsightToast: Proactive Information Retrieval & Glanceable Visualization in the Side Channel of Data-Rich Meetings [3.6] InsightToastは、リアルタイムで会話を監視し、話題や情報のニーズを特定し、関連情報を積極的に検索する。
セレンディピティーな洞察を得られる可能性を示すために、会議の文脈として、立法文書の知識ベースを含む利用シナリオを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:05:06 GMT)
The convergent laboratory: when AI reasoning, autonomous experiments, high performance and quantum computing reshape chemistry [3.4] TPC26は、AI、自律エージェント、自動運転ラボ、より高いパフォーマンスと量子コンピューティングが、物質科学発見に対する個々の影響を増幅するためにどのように収束するかを探求した。
AIによる推論、自律エージェントフレームワーク、自動運転研究所、フォールトトレラント量子プロセッサが同時に成熟するにつれ、このコメントを参考にしています。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:25:07 GMT)
VizIt: A multi-view framework for exploring single-cell, spatial, and genetic data online [3.3] VizItは、単一細胞および空間転写学、エピゲノミクスおよび遺伝データのマルチビュー探索のためのオープンソースのフレームワークである。
カスタマイズ可能な対話型マルチオミックリソースであるParkinson's Cell Atlasを用いて、VizItを実演する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:40:47 GMT)
A Comparative Study of Counterfactual Explainers for Graph Neural Networks Enabling Multiple Types of Graph Edit [3.3] グラフ構造化データに対する対実的説明は、モデル予測を事前定義された出力に変更するために入力グラフで必要となる最小限かつ現実的な修正を決定しようとする。
本研究は,実世界および合成データセットの多種多様なセットにおける6つの最先端(SOTA)モデルを比較した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:07:55 GMT)
EuroAlpaca: Task-Preserving Localisation of Instruction Data for European Languages [2.9] 機械翻訳はタスククリティカルな制約と必要な出力を歪めることができる。
タスク保存型ローカライゼーションパイプラインであるEuroAlpacaを紹介する。
タスクセマンティクスの保存は多言語命令のチューニングに不可欠であることを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:05:53 GMT)
Does Your Agent's Memory Survive a Model Upgrade? A Controlled Study of Memory Portability [2.9] 長文読解(LC-RAW)における記憶量と記憶量の比較を行った。
ランダム化された応答符号を持つ48の合成ヒストリー、正確なスコアリング、100億以下のパラメータを持つ2つのオープンウェイトモデルを使用する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:44:17 GMT)
Has MIMO decoding been proved hard from lattice problems? [2.8] マルチインプット多重出力(MIMO)技術は、現代の無線通信の基本である。
物理層セキュリティは、ノイズの多い通信チャネルの特性を利用して送信された情報を保護する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:23:49 GMT)
When Financial Fine-tuning Fails: A Three-Level Detectability Analysis of Numerical Hallucination in Domain-Adapted Language Models [2.8] 我々は3つのモデル変種にわたる財務要約における数値幻覚の費用対効果、制御された研究を行う。
本稿では,過剰幻覚(通貨化製造),隠蔽排他幻覚(プロフェッショナル・コンベンション番号),隠蔽単純幻覚(アングラウンドド定量的クレーム)とを区別した3段階の検出可能性分類を導入する。
その結果,ドメインの微調整は,あらゆる検出可能性レベルにおいて,数値的な抑制を著しく低下させることがわかった。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:02:42 GMT)
TACIT-Switch: Cost-Aware Model Escalation for LLM Agents from Censored Supervision [2.7] より小さな言語モデルバックボーンを持つエージェントは永続的な障害モードにドリフトできるが、より大きなバックボーンを持つエージェントは一般的により信頼性が高いがよりコストがかかる。
この信頼性の高いトレードオフは、より大きなバックボーンを持つエージェントをいつ呼び出すかを決定するルーティングメソッドを動機付けます。
提案手法であるTACIT-SWITCHは,蓄積された軌跡の証拠から永久的ハンドオフポリシーを学習する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:33:01 GMT)
Fast Gauss Sums via Flash Attention [2.6] 任意の符号付き重み付きガウスカーネル和がフラッシュアテンションにより評価可能であることを示す。
fp16における特徴次元D>8の場合、このアプローチはコンパイル済みのPyTorchコードを高速、メモリオーバヘッド、精度で上回る。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:11:45 GMT)
Benchmarking Dexterity of Multifingered Robot Hands: A Review and Perspective [2.6] 我々は,多指ロボットハンドのデキスタリティをベンチマークする際の技術の現状を調査した。
本稿では,米国国立科学財団 HAND Engineering Research Center の展望を紹介する。
システム複雑性の増加に対応する3つのベンチマークレベルからなるフレームワークを導入する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:02:04 GMT)
MoirfEolas and CríochScore: Developing Resources for and the Evaluation of Tokenization Alignment with Irish Morphology [1.8] 私たちは、それぞれの日食、接頭辞、接尾辞にマッピングされた35,000以上のアイルランド語のデータセットであるMoirfEolasを紹介します。
我々はCrochScoreを用いた共通トークン化アルゴリズムと、トークン化文献に存在する固有のメトリクスを評価する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:41:28 GMT)
Towards Scaling Quantum Fine-Tuning of Foundational Time Series Models for Classification [1.8] 時系列基礎モデルは、リッチな埋め込みを生成するが、量子モデルがそれらを活用できるかどうか、そしてハイブリッド古典量子アーキテクチャがどこまでスケールするかは、まだ不明である。
モデル埋め込み上に量子ヘッドを持つパワーグリッドイベント分類(PSML-5)のためのクロノスを微調整することでこの問題に対処する。
より微細な特徴により、量子ヘッドは同じ入力に対してより大きな古典的な多層パーセプトロンを1.7-2.0の精度で上回る。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:56:24 GMT)
Non-local games and communication complexity with noisy entanglement [1.7] 雑音が量子非局所性と絡み合い支援通信複雑性の理論に与える影響について検討する。
我々は,任意の対話型絡み合い支援通信プロトコルが,雑音の多い共有ランダム性を持つSMP通信プロトコルによってシミュレート可能であることを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:20:51 GMT)
What Price Fairness? Evaluating Energy - Fairness - Accuracy Trade-off in Recommender Systems [1.7] 提案するプロバイダ側の公正性は,測定可能なグリーンコストが伴うかどうかを評価する。
発見者は、公正を意識した推奨を、正確性、公正性、計算コストの3つのトレードオフとして評価する必要がある。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 22:38:49 GMT)
Multi-Step Tool-Calling over Korean Open Public APIs: A Benchmark and a Data-Synthesis Recipe [1.4] 実世界の145のタスクからなるKorea Open Public API Benchmark(KOPA-Bench)を紹介する。
EDGEは,ライブ実行によって駆動されるツールコールデータ合成のための動的グラフである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:44:52 GMT)
FinalityBench: An Effect-Level Benchmark for Agent Decisions Under Delayed and Conflicting Financial Finality [1.4] FinalityBenchは、ファイナリティゲーティング決定のための実行可能なベンチマークである。
グラディングは実行された金銭的効果に基づいており、あるエピソードは商人の経済的な立場によって記録される。
権威的ファイナリティプローブ上の不可逆的なアクションをゲーティングするランタイムは85.4%に達し、全てのポーリングポリシーとは異なり、パス5には何も失われない。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:24:10 GMT)
Cost-Aware Hierarchical Multi-Agent Ransomware Detection and Family Attribution [1.3] 本稿では,適応型ランサムウェア検出のためのコストアウェア階層型マルチエージェントシステム(HMAS)を提案する。
コストモデルでは、計算コストに対する解析性能のバランスをとるために、モダリティの使用と処理オーバーヘッドが組み込まれている。
HMASは96.57%の精度、0.96F1スコア、0.99ROC-AUCを達成している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:17:09 GMT)
Large Language Models with At Most One Spike per Neuron [1.1] タイム・ツー・ファースト・スパイク(TTFS)符号化は、時間ウィンドウ内でニューロン当たりのスパイクを少なくとも1つ生成し、非常に低い発火率をもたらす。
4つの中核LCMコンポーネントをエンコードする参照ベースの戦略を導入する。
完全にTTFSベースのSNNアーキテクチャを構築し、エンドツーエンドでトレーニングします。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:53:28 GMT)
From Tokens to Semantics: Leveraging Complementary Signals for Hallucination Detection in Black-Box LLMs [1.0] 偽のアラームが人間の視認能力に限られているのに対して、偽のアラームはユーザーや機関に害を与える可能性がある。
ブラックボックスモデルAPIを通じてアクセス可能な2つの信号:意味エントロピーとトークンログ確率から導出される不確実性について検討する。
トークンレベルの信号をTopK法によるサンプル応答に集約することでトークンベースの不確実性検出を拡張した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:30:29 GMT)
Why We Care About Understanding: Competence through Predictive Compression [1.0] 哲学者は、関係を把握し、説明し、新規性を扱うという観点からの理解を特徴付けてきた。
この論文は2枚の絵を3枚のインターロックで橋渡しする。
それは、AIシステムの調査可能性に光を当てながら、理解の圧縮主義者の魅力と限界の両方を説明する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:10:02 GMT)
Risk-Aware Optimal Control with Rulebooks [1.0] 評価において、異なる優先順位と不確実性を有する複数の要件を含む安全クリティカルな制御問題を考察する。
リスク対応ルールブックを使用してこれらの要件を表現し、各要件にはリスク尺度と許容しきい値が割り当てられる。
各要件は、ポリシーを違反に関連するリスクにマッピングするリスク評価関数を誘導する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:32:12 GMT)
Mitigating Disease Spread by Design in Refugee and IDP Camps [0.8] キャンプ内の人々の移動と相互作用は、その配置に影響され、病気の拡散に大きな影響を与える可能性がある。
本研究の目的は、居住地内の病気の拡散を緩和する要因として、異なるキャンプレイアウトの潜在的な影響を探索する方法論を作成することである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:45:24 GMT)
Optimal inequalities for completely bounded polynomials and the limitations of quantum query algorithms [0.8] 完全有界法を用いて量子クエリアルゴリズムのパワーの限界を確立することの問題点を考察する。
我々は、完全有界の異なる概念を含むいくつかの最適機能不等式を証明した。
これらの不等式は、以前の作業を改善する量子クエリアルゴリズムのパワーの制限につながる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:34:56 GMT)
Kerr Induced Control of Synchronization and Quantum State Recovery in a Driven van der Pol Oscillator [0.6] 我々は,Kerr相互作用が,サドルノード分岐を駆動する振幅依存性の周波数シフトを生じさせることを示す。
この遷移はシステマティックな周波数引き込みとスペクトル拡大として現れ、一方定常なウィグナー関数は量子状態と半古典的誘引子の間の連続的な対応を示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:10:23 GMT)
From the Light Quantum to the Photon: The Evolution of a Physical Concept [0.5] 本研究は、プランクの黒体理論から電磁場の量子化に繋がる理論的および実験的発展への光量子の進化を考察する。
本研究は、アインシュタインの放射の量子論(1916-1917)において決定的な遷移が起こったことを示唆している。
物質の新しい量子的記述と放射の古典的記述の間に生じる非対称性は、自然放出現象によって問題を呼び起こされ、電磁場の量子化に繋がる物理的問題を特定する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 10:41:09 GMT)
Spectroscopy With Intelligent Feature Tracking for automated characterization of excited-state structure in semiconductor quantum dot devices [0.4] 半導体量子ドット(QD)デバイスにおける励起状態構造のキャラクタリゼーションは、スピン量子ビット演算のためにそれらをチューニングする重要な要素である。
本稿では、機械学習(ML)支援特徴識別と物理インフォームド幾何処理を組み合わせたフレームワークであるSWIFTについて述べる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:47:09 GMT)
MomentQuant: an even more minimalist interval method with linear time complexity for time series classification [0.4] 時系列データは、多くの現実世界のアプリケーションや多くの領域で非常に一般的である。
時系列分類は、新しい、目に見えない各時系列にラベルを割り当てることによって構成される。
過去数十年にわたって多くのアルゴリズムが開発され、予測性能と計算コストのトレードオフが一貫して議論されている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:37:51 GMT)
PRICE: A Systematic Study of LLM Adaptation Choices for Bitcoin Price Forecasting [0.4] 本研究は,短期的なBitcoin価格予測に大規模言語モデルを適用するための構造化アプローチであるPRICEを紹介する。
PRICEは4ビット量子化LLaMA-3 8Bモデルに基づいており、微調整、数値表現、プロンプト、推論、復号化がパフォーマンスにどのように影響するかを調査している。
プライスは、評価期間にわたって堅牢なパフォーマンスを維持しながら、検証セットとテストセットの両方で最も低い予測エラーを達成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:01:38 GMT)
Tree species mapping in Denmark: A comparison of spectral-temporal features with geospatial foundation model embeddings [0.3] 我々は,デンマーク全土の樹種を,国立森林発明計画(National Forest Inventory plots)とEOデータ(EO data)を用いてマッピングするとともに,大規模森林評価のための基盤モデルの可能性を評価した。
木種分類における2つの代替入力表現の比較を行った。 (i) 多時期のSentinel-1とSentinel-2観測から得られたスペクトル時間的特徴 (STF) と, (ii) EO FMs TESSERAとAlphaEarthによる埋め込みである。
最高性能モデルはその後、デンマークの10mの木種マップを作成するために全国規模で適用され、面積調整により全体の地図精度は79.9%である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:48:56 GMT)
Endogenous Exploration in Reinforcement Learning with Intrinsic Curiosity [0.3] 本研究では,本質的な好奇心によって探索が促される強化学習フレームワークを提案する。
中心的な仮説は、効果的な探検は中間レベルの不整合で現れるというものである。
また,同一解析条件下では,好奇性ウィンドウがアクティブ推論エージェントでは復元されないことを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:30:41 GMT)
Microkelvin resolution thermometry at the nanometre scale [0.2] 等方的に精製された双対NVナノダイアモンドと、ベスポーク量子センシングチップを用いて、温度測定感度の桁違いの改善を示す。
我々は、温度測定自体によって誘起される温度変化、特にNVスピン状態の探査に用いられる光励起レーザを定量化する。
サブミルモシルビン分解能とミリケルビン感度熱測定により、生体系における微小な熱ゆらぎのモニタリングが可能となる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:09:42 GMT)
The Impact of GenAI on the Future of Requirements Engineering [0.2] 大規模言語モデル(LLM)は、システムの設計と構築方法を変えています。
ジェネラリストSEエージェントによる実装のコストが下がるにつれて、エンジニアリングの取り組みは正しいコードを書くことから離れる。
この記事では、RE研究者が将来の研究優先事項の選択において、この変革をどのようにナビゲートできるかを知らせることを目的としている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:01:09 GMT)
A Nuclear-Norm Lower Bound for Dithered Scalar Quantization of Matrix Products [0.1] 量子化行列乗算における誤差を最小化する問題を$C=AB$とする。
C$を変更せずに、ファクタ範囲やグリッドステップを変更する製品保存変換を最適化します。
2ドルの電力の場合、条件付き期待値は決定論的に$O((m+n))$正実演算でアダマール符号を選択する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:22:01 GMT)
MARLA: A Conceptual Scaffold for Regulatory Learning under the EU AI Act [0.1] EU AI法は、安全で信頼性が高く、市場対応のイノベーションのためのインフラの一部として規制を定めている。
本稿では,規制学習を5段階サイクルとする概念的足場を提案する。
MARLAは、技術的および法的ステークホルダーに、最初の3つのステージのそれぞれが独自の規制学習形式を生成する、共通の語彙を与える。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:35:01 GMT)
Ancilla mediated steady-state engineering in open quantum systems [0.1] 本稿では,アシラキュービットがターゲット系と貯水池との結合を媒介するプラットフォームを提案する。
従来型の熱処理を実験的に実証し, 抗熱処理も実現した。
我々は、核スピンを量子電池として利用し、理論最大値の70%を超える定常エルゴトロピーを達成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:07:30 GMT)
A Generalizable Feature Extractor for Alzheimer's-Related Brain MRI Tasks [0.1] 我々は、小型で教師付き事前訓練されたモデルが、下流のニューロイメージングタスクの再利用基盤モデルとして機能するかどうかを評価する。
脳年齢を監督するコンパクトモデルは再利用可能なバックボーンとして機能し、各タスクに1%の追加パラメータで適応する。
以上の結果から、厳密なデータ制約下であっても、慎重に訓練された脳年齢モデルがアルツハイマー関連タスクの効果的な基礎モデルとして機能することが示唆された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:47:28 GMT)
Continuous Cognitive Coverage for Autonomous Robots via Event-Dependent Cognitive Treatment and Learning [0.1] 本稿では,自律型ロボットのための継続的認知カバレッジフレームワークを提案する。
認知的に認められたすべての出来事は、その状態、状況、そして歴史に応じて、イベント依存の認知治療が割り当てられる。
実験では96.76%の構造化された処理精度、93.66%の自動処理、92.64%の認知的カバレッジ、79.53%の連続学習関節の精度が達成されている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:05:41 GMT)
RefactorPlatform: An Open-Source Harness for Controlled Evaluation of Repository-Scale Refactoring Agents [0.1] RefactorPlatformは、環境を固定し、各設計軸を変化させるオープンソースの評価ハーネスである。
各実行は、ライブ端末ストリーミング、トークン、差分、およびトランスクリプトのタスクごとのロギング、ASTベースの検証、監査と再生のためのエクスポート可能なテレメトリを備えた、独立したワークスペースで実行される。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:58:10 GMT)
Fast universal parametric spin control in an acoustically modulated quantum dot [0.1] 量子通信、分散コンピューティング、ハイブリッドアーキテクチャは、量子モードの伝播のために量子ビットと結合のコヒーレントな制御を可能にするノードに依存している。
機械波との弱い相互作用は、単一QDスピン量子ビットをオンチップで音響的に結合されたハイブリッドシステムに統合することを制限する。
既存の音響QDスピン制御の理論は回転軸角の限られた範囲に悩まされており、ゲートプリミティブと長いゲートタイムの複雑な実現を強制している。
これらの問題を克服するパラメトリック制御を提案する。我々は、光遷移の音響変調と相まって、光結合をトリオン状態に調整し、スピン状態と混合する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:10:47 GMT)
Better Together: Complementary Query Rewriting Under a Strong RAG Baseline [0.0] 私たちは4つのクエリ書き換え戦略(S1-S4)と2つの強力なベースライン(HyDE、Query2Doc)を比較します。
私たちの見出しは、書き直しだけでは強力なベースラインと最良に競合するが、異なる戦略が異なる質問で失敗するため、メソッドを組み合わせることで大きな利益を得る。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:15:57 GMT)
Who Should Grade My Work? Student Perspectives on Transparent AI-Assisted Writing Assessment in Higher Education [0.0] GenAIツールの高等教育評価への統合は、学生がAIによる評価を理解し、解釈し、反応する方法に関する重要な疑問を提起する。
本研究は,サウジアラビアの公立大学におけるコンピュータ学生のための学部技術コミュニケーション講座における定性的な教育的調査の結果を報告する。
学生は、ChatGPTがスコアとフィードバックを生成したことを明示的に知らされ、文章の評価を反映するよう求められた。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:49:33 GMT)
When Does an Interpretation Count as Established? The Formation, Evaluation, and Responsibility of Interpretation in Generative AI [0.0] この論文は、社会技術プロセスの中でどのように解釈が認識されるのかを問うものである。
資料とバージョン、明確な役割、失敗、契約修正、責任に関する5つの公的な要件を提案している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:58:41 GMT)
When Do Internal Probes Beat Reading the Answer? Miscalibrated Readouts and Behavior-Concealed Knowledge in Language Models [0.0] 1200の論理的結論の検証を依頼された言語モデルは、毎回YESに答える。
隠れた状態の線形プローブは、0.96 AUCで正しい判定を読み取った。
判決がどこで失われるかを問うと、支配的な失敗は1つのスカラーであることがわかった。
診断は、90のセマンティックラベル構成で、5つのモデル、3つのファミリーの因子的、行動的精度が閾値オフセットの1つの関数に崩壊する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 00:26:45 GMT)
What LLM Trading Agents Actually Do in Production: A Six-Month, Population-Scale Record from Two Fleets [0.0] 本稿では,2つのシステム間で生産されている自律型言語モデル取引エージェントの人口規模を連続的に測定する。
記録は約6ヶ月で、7.5Mのシングルモデル呼び出しと約300Kのオンチェーンアクションがあり、さらに231,638個のマルチツールが14,596個のフィリングを生成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:56:31 GMT)
WEECFP-SuRGE: Wide Embedded Extended Connectivity Fingerprint with Substructure Rotary Graph-distance Encoding [0.0] We introduced WEECFP, a parameter-free 1024-dimensional continuous molecular fingerprint that each Morgan substructure across around 3,32 signed position of a single vector。
また,分子最短パスグラフ距離でパラメータ化されたRoPEのような回転法であるSuRGEを自己学習するトランスフォーマーアーキテクチャであるWEECFP-SuRGEを紹介する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:05:29 GMT)
Unifying ICL, SFT, KL-Regularized RL Through a Bayesian Lens [0.0] このノートは、これらの手順を同じ足場に置くベイズ的な視点を発展させている。
パートIは、いくつかのショットICLとSFTを、ベイズの後部予測への償却および重み付き投影として定式化する。
パートII-IVは,KL規則化RLHF/RLVR,報酬重み付きSFT,報酬重み付きICL,利得重み付きSFTが,報酬や利益によって誘導される後部への前方KL投射の例であることを示した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:06:29 GMT)
Uncensored Open-weight Models: Redistribution as the Persistence Layer [0.0] アクターの急速なエコシステムは、オープンウェイトAIモデルからビルトインの安全ガードレールを取り除いている。
私たちはHuggingFaceで3,471個のオリジナルの非検閲モデルを特定し、それぞれ平均2.4回再パッケージしました。
ULLM(uncensored large language model)を統合した1,643のGitHubアプリケーションのうち、25%が明示的に悪意のあるものとして分類されている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:06:39 GMT)
Transition between weak and strong measurements in the presence of post-selection [0.0] 本研究では, 測定結果の計測強度依存性について検討した。
弱い測定と強い測定の中間状態におけるメートル法統計は、測定強度とほぼ無関係であることがわかった。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:09:37 GMT)
Too Rare to Learn: Prescribed Cyclone Tracks Degrade a Bay of Bengal Ocean Emulator [0.0] ベンガル湾において,ネットワークのサイクロンを所定の入力として処理する選択を検証した。
3つの種にまたがって、海洋のみのモデルが実行毎に永続性を打ち負かし、嵐条件のモデルが実行毎にそれを失う。
余分な誤差は所定の嵐のフットプリント内にあり、実際のサイクロンマップを推論時にノーストームマップに置き換えると、各種において保持される嵐の予測は7.5から16.4%向上する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 02:15:07 GMT)
The Mirror Agent Model: a Bayesian Architecture for Interpretable Agent Behavior [0.0] このアーキテクチャをミラーエージェントモデルと呼ぶのは、エージェントのミラーとして明示的で暗黙的なコミュニケーションのターゲットであるオブザーバモデルを定義するためである。
既成のサリエンシ手法による説明のために,アーキテクチャに新たな機能を持たせた後,予備的な定性的な結果が得られた。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:25:37 GMT)
Technical Manual for a Toolkit for Measuring Contextual Individuation in Transformer Language Models [0.0] トランスフォーマー言語モデルは、その埋め込み層における単語タイプに単一の文脈非依存ベクトルを割り当てるが、その単語が後の層でコンテキストによって発生すると広く信じられている。
この信念をきれいにテストするには、文脈と意図された感覚が制御されたラベル付けされた方法で変化している間に、単語の形式を固定する構造が必要である。
このマニュアルはそのような構造を中心に構築されたオープンツールキットを文書化し、それをブリッジ形式と呼ぶ。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:38:39 GMT)
TamilEOT: A Dataset and Model for Semantic End-of-Turn Detection in Tamil Telephone Speech [0.0] TamilEOT: 18,485のラベル付き通話境界は、実際の116の電話通話から切り離された。
2つのオーディオ専用検出器は、Smart Turn v3から微調整されている。
どちらのモデルも、ラップトップのCPU上で150ms未満のシングルスレッドで動作する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:09:11 GMT)
TPMSpy: Validation of Measured Boot Systems by Low-Level Tracing of TPM Usage [0.0] Measured Bootは、実行されたソフトウェアとシステム状態の暗号化測定をTrusted Platform Module (TPM)に記録することでブートシステムへの信頼を拡大する
システム-TPM相互作用のレベルでの低レベルTPM使用量を分析するためのプラットフォームに依存しない手法を提案する。
実装の詳細に依存しないので、オープンシステムとクローズドシステムの両方に適用できる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:23:19 GMT)
Restricting the effects hides a nonphysical symmetry from every causal structure [0.0] 実振幅量子理論(Real-Amplitude quantum theory)は、複素共役の下での量子論の不変部分理論である。
部分閉包は任意の有限群の下でのギャップの欠如に対して十分であることを示す。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:16:58 GMT)
Residual detuning in the laboratory-frame anti-Jaynes--Cummings model with a squeezed vacuum [0.0] AJC相互作用は、回転フレームモデルから外れた残差2f$を維持している。
引用されるすべてのコントラストは、原子基底状態の集団の最初の旋回点の振幅である。
計算は数値的なコントロールランドスケープであり、新しい可解極限ではない。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 00:20:23 GMT)
Repeated Queries Exhaust an LLM's Brand Recommendations but Not Its Sources [0.0] 300の質問エンジンのセルで、ウェブ検索なしで答える5つのエンジンは、まだ15.7の時点では見当たらないブランドを追加している。
4つの深層細胞が24時間でドメインを追加し, 59~84%のChao2値が観測された。
エンジン全体の中央値は38の組織で、うち15の中央値は正確に1つのエンジンに表示される。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:22:03 GMT)
Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM [0.0] 我々は、許可付き互換ネットワークのための秘密の銀行間決済プロトコルを提案する。
このモデルでは、起動機関は、説明責任とコンプライアンスのためのオンチェーンを公的に特定できるままである。
このプロトコルはシールド、秘密転送、および非シールド状態遷移をサポートする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:18:17 GMT)
Reducing Catastrophic Risk from AI with Systematic Monitoring and Evaluation of Rogue AI Progression [0.0] 本稿では,人工知能システムによる潜在的壊滅的脅威への進展を示唆する行動指標の構造的枠組みを提案する。
我々は、サイバーセキュリティと国家安全保障の確立した方法論にインスパイアされた実践的なアプローチを採用する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 20:20:08 GMT)
Recovering Temporal and Geographic Signals from Language Model Embeddings [0.0] 構造化実世界の情報をエンコードする言語モデル埋め込みについて検討する。
出力埋め込みを直接操作するプロジェクションベースの手法を用いる。
埋め込みプロジェクションは意味のある時間的・空間的構造を復元する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:03:06 GMT)
Reaching the Cards Apple Wallet Leaves Behind: Direct NFC Acquisition of PRO100, HUMO and UZCARD Payment Cards on iOS [0.0] 本稿では,NFC対応iPhone上でPpro100,HUMO,UZCARDカードをテストするためのアプリケーションレベルのカードキャプチャ手法について述べる。
この方法は登録データをキャプチャし、カードをエミュレートしたり、支払いを許可したり、NFC読み取りを所有権の証明として扱ったりしない。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 18:04:48 GMT)
Qlippy: A Retrieval-Augmented GenAI Assistant for Reproducible Quantum Workflows and Experiment Tracking [0.0] 汎用言語モデルは役に立ちますが、幻覚を与え、ドメイン固有のツールの基盤を欠く傾向があります。
我々は、量子工学の知識をキュレートしたコーパスに応答を基盤とした、検索強化されたGenAIアシスタントであるQlippyを開発環境に組み込んだ。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:59:55 GMT)
Propagation Model for SSC attacks: Why SBOM (tools) don't tell the whole truth [0.0] 本研究では,SSCセキュリティに対する伝搬中心型アプローチを提案し,さらに4段階の伝搬モデルを提案する。
現在のSBOMツールは、ステージ1とステージ2のみを体系的にサポートする。
SSCセキュリティ研究の中心に伝播効果を投入することは、サイバーリスクがシステム的リスクに進化するのを防ぐのに不可欠である、と我々は主張する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:31:30 GMT)
Planning and Scheduling Business Processes under Control-Flow Uncertainty [0.0] ビジネスプロセスにおける計画活動は効率性を改善する(例:makepanの削減)が、ケースの完了に必要なアクティビティの正確なシーケンスは不確実であることが多いため、難しい。
このような決定に関する確率情報は、しばしば過去の実行ログから推定または導出される。
特定の実行経路での計画は、実現可能性、すなわち、成功の確率、計画されているが実行されない過剰な活動の数に影響を与える。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:12:11 GMT)
Phase Transition Frequency as a Training Time Predictor of Test Accuracy in ResNets [0.0] ResNetファインタニング中に観測された個別のクラスセパビリティジャンプ数について実験的に検討した。
75以上の実験では、標準の分類ベンチマークで強いデータセット内負の相関が得られた。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:28:57 GMT)
Parametric and feedback-controlled multiparameter quantum estimation in a double cavity optomechanics: steady and dynamical state [0.0] 2つのメカニカルモードが駆動光キャビティと相互作用する結合キャビティ・オプティメカニカル・プラットフォームについて検討する。
我々は、コヒーレントフィードバックが量子ゆらぎとパラメータ依存の相関関係を工学するために調整可能な資源として機能することを発見した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:48:44 GMT)
On the growth of operator entanglement in brickwork circuits with Yang--Baxter gates [0.0] 本研究では,2サイトゲートがブレイド関係を満たす1次元回路における局所作用素の演算子絡みについて検討する。
作用素のシュミット階数はすべてのクビットヤン-バクスターゲートに間に合うように一様有界であることを示す。
双対ユニタリ性を持たない7状態の非帰納的ヤン・バクスターゲートと、正確な作用素であるシュミット階数が指数関数的に増加するワンサイト作用素を構築する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:19:46 GMT)
On Being Prepared: Automated Vehicle Incident Management Exercise Practices [0.0] インシデント管理(IM)は、何十年にもわたって発展し、ますます拡大するハザードとシステムをカバーしてきた。
企業のレジリエンスと運用の準備の一環として、IM実践者は、インシデントに効果的かつ効果的に対応する能力を理解し、構築するための演習を設計する。
本稿では,エクササイズを効果的にし,ギャップを識別し,キャパシティを向上する方法について述べる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:16:08 GMT)
Morphology and actuation as inductive biases in robotic hand manipulation [0.0] キネマティックおよびアクティベーションステージを別々に、かつ構成的に分析する統合された枠組みが提示される。
対立する設計哲学、シャドウ・デクスタース・ハンド、解剖学的に正しいバイオメカトロニクス・ハンドの2つの手に適用される。
全てのパラメータは手の標準的なデジタル表現から導かれる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:38:13 GMT)
Moral Competence Before Moral Content: Why LLM Agents Lack the Prerequisites for Coherent Alignment [0.0] 価値多重性の下では、正しいターゲットは存在しないが、共有の前提条件は、システムの振る舞いが一貫性のあるポリシーを表現することである。
このようなコヒーレントな政策に4つの構造条件を導入する。
3つのデプロイメントで一貫性のあるポリシを表現しているモデルはありません。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:56:44 GMT)
Moral Advice as Interactional Negotiation: Framing, User Pressure, and Social Position in Large Language Model Responses [0.0] 我々は, LLMのモラルアドバイスを, フレーミング, 持続的ユーザプレッシャー, およびモラル対象の社会的地位によって形成される相互作用交渉として検討する。
GPT-4o-miniの場合、LLMの道徳的アドバイスは、規範的応答傾向とユーザ圧力の間の部分的に安定した交渉を通じて発展することができる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:48:33 GMT)
Molecular Déjà Vu: Digit-Level Retrieval of Published Values in Frontier Language Models [0.0] 大規模言語モデル (LLM) は分子特性ベンチマークでますます評価されている。
12の回帰ベンチマークで22のフロンティアモデルを評価した。
広く使われているが、比較的ベンチマークに特化している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:32:48 GMT)
Model Retirement Creates Reproducibility Risk in Biomedical AI Publications [0.0] バイオメディカルタスクに特定の大規模言語モデルを適用した研究論文について,PubMedを検索した。
我々は,5,242冊にまたがる8,931冊の論文を同定した。
全体の42%は、公式発表の時点で既に引退していたモデルか、2年以内に引退する予定のモデルであった。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:00:54 GMT)
MedWER: A Reproducible, Model-Free Evaluation Protocol for Medical Speech Recognition [0.0] 医療用AIRの評価プロトコルMedWERとオープンソースツールMedWERについて述べる。
このプロトコルは、ピン付きテキスト正規化器と、フレーズ対応の項制限付きWER、MedWERを結合する。
カバーは、リストから作成されていない独立した州の薬物利得ファイルに対して検証される。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:19:18 GMT)
Measuring AI Accountability Through Argumentation Analysis: Can Model Reasoning Withstand Scrutiny? [0.0] 現実的な曖昧さにもかかわらず機能するように設計された代替規格について検討する。
我々は、ウォルトンの議論スキームの理論とGovierの議論の緊急性に関する基準に基づく4相弁証法を用いる。
推論の異なるフレームに適応し、多重選択フレーミングを越えて拡張し、評定に先立つ推論とポストホックの正当化の両方を扱う。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:40:39 GMT)
Long Horizon Transformer Quantile Fault Prediction for Multi Site Industrial Predictive Maintenance [0.0] ロングホライズン予測メンテナンスは、時間ではなく数日で測定される計画ウィンドウに対して、通常の運用/登録の変動からゆっくりと変化する劣化を区別するモデルを必要とする。
本稿では,明示的な条件量子表現が,この問題に対して情報型分類器インタフェースを提供するか否かを評価する。
提案するTQRNN30dフレームワークは,2段量子回帰ニューラルネットワーク(QRNN)特徴抽出器とマルチストリーム時間融合分類器を組み合わせたものである。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 07:57:33 GMT)
LexFlip: A Dissociation Diagnostic for Legal Meaning Preservation Metrics [0.0] レックスフリップはトークンの0.93を保存しながら法的強制を覆す。
FrJudgeでは、素長の機能はすべてのセマンティックメトリックを上回り、測定するマージンが最低です。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:49:09 GMT)
Language models judge war differently when tested for alignment [0.0] 安全評価は、人工知能システムが評価に応答した場合に、デプロイされた振る舞いを誤認する可能性がある。
我々はこの可能性を、戦争を開始するための決定に関する完全な要素的結合実験でテストする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:22:30 GMT)
LLM-Guided Program Evolution for Circle Packing: Breaking 10 Packomania Records for $28 [0.0] 本稿では,大規模言語モデル(LLM)を用いて最適化アルゴリズムを反復的に進化させる軽量システムであるDiscovery Loopを提案する。
Packomania circle-packingベンチマークの適用により、このシステムは101-114の範囲でNの10値に対して最もよく知られた解を改善し、以前の記録より2.4%-5.4%向上した。
本稿では,適応型プラトー検出機構を含む費用対効果のダイナミクスを解析し,自動化された科学的発見を民主化する上での意義について論じる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:48:13 GMT)
Influence Score and Transformers interpretability: Measure of the Effective Impact of Attention Heads at inference time [0.0] 本稿では,Transformer を用いたモデルを用いた分類決定におけるアテンションヘッドの寄与を定量化するための影響スコアを提案する。
スコアは、ロジットへの方向の影響と残留ストリーム内の構造的寄与を組み合わせ、マルチスケール分析を可能にする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:32:57 GMT)
Impact of Data Loss in Postprocessing on Training and Inference of Quantum Neural Networks [0.0] 後処理ルーチンは、ユーティリティスケールデバイスをもはや保持しない仮定をエンコードする。
本稿では,Qiskit Machine Learningライブラリのサンプリングベース量子ニューラルネットワーククラスである texttSamplerQNN のケーススタディを示す。
ビットストリングが100以上の物理量子ビットにまたがる量子ハードウェアの動作では、このフィルタは85から99.6%の有効な測定ショットが失われる結果となった。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:22:13 GMT)
How a Chatbot's Response Style Shapes a Classroom: A Multi-Agent Simulation of Students Consulting AI [0.0] 我々は、20人の学生エージェントが交流し、ストレスを受けると友人やカウンセラーAIに相談する仮想教室シミュレーションを構築した。
非AIコントロール,3教室15日以上,50日以上,相談閾値の低下など7つの条件を比較した。
結果は、人間に対する測定結果ではなく、シミュレーションシステムについて記述した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:33:28 GMT)
How Faithful Is Attribution for Sales Forecasting? A Counterfactual Study [0.0] WaveNetスタイルの拡張畳み込みネットワークのような販売予測のための深いモデルは正確だが不透明である。
我々は、Corporacion FavoritaのフルデータセットでトレーニングされたマルチシリーズWaveNet予測層に、ポストホックでアーキテクチャに依存しない非現実的な解釈層を追加します。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:52:15 GMT)
How Developers Discuss Generative AI: A Longitudinal Study of the Visual Studio Code Community [0.0] GitHub Copilot、ChatGPT、コーディングエージェントといったジェネレーティブAIツールは、日々のソフトウェア開発の一部になっている。
本稿では,Visual Studio Code (VS Code) GitHubリポジトリにおける生成AI関連議論の経時的分析について述べる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:16:08 GMT)
Hessian-based molecular conformation augmentation for a scalable and efficient strategy of machine learning interatomic potentials [0.0] 本稿では,機械学習の原子間ポテンシャルに対する2つのヘッセン系データ拡張手法を提案する。
提案手法は,実用的なタスク固有のガイドラインを提供しながら,モデルの精度を向上させる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:00:27 GMT)
Hadamard Rigidity of Positive Sojourn Time Distributions for Rotation Coins [0.0] Konnoは、Adamardのウォークでは、この条件分布は正確に4.99ドルで割り切れる。
正確な均一性は、回転コインをアダマールコインに強制することを示している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 11:54:30 GMT)
HB-PVI: A Hierarchical Bayesian Personalization and Value-of-Information Framework for Complex Activity Recognition [0.0] パーソナライゼーションは行動認識性能を改善するが、参加者固有の利得は不均一である。
本研究では,階層型ベイズパーソナライズと情報の価値の枠組みであるHB-PVIを提案する。
情報分析の価値は、生の予測精度ではなく、健康センシングアプリケーションにおけるパーソナライズ決定を導出すべきであることを示している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:38:07 GMT)
Governing Bring Your Own AI: A Parameterized Maturity Model [0.0] Bring Your Own AI(BYOAI)は、従業員認証された個人アカウントが企業IDとセキュリティコントロールの外部で使用されるシャドウAIの別形態である。
既存のフレームワークは組織によって管理されるAIツール用に設計されており、そのカバレッジは個人アカウントで使用されるアンマネージドなAIツールにまで拡張されていない。
リスク分類とフレームワーク導入プロファイルを生成する文献を体系的にレビューし,ガバナンスモデルを開発する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:03:49 GMT)
GNN-Guided Graph Coarsening and Adaptive QUBO Penalties for the Capacitated Vehicle Routing Problem with Time Windows on a Quantum Annealer [0.0] グラフの粗化は、大きな擬似非制約バイナリ最適化(QUBO)の定式化を減少させる。
Capacitated Vehicle Problem with Time Windows (CVRPTW) では、既存の粗大化は家族固有のチューニングを必要とし、ランダムなインスタンスでは信頼性が低い。
シミュレーションアニーリングとD-Wave Advantage2プロセッサを用いて,Solomonベンチマークのこれらの制限に対処する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 00:49:57 GMT)
From Voice to Leverage in Data Governance. Building Enforceable Social License for Data ReUse [0.0] 市民集会、熟考調査、コードサインワークショップ、コミュニティアドバイザリパネルは、現在、信頼の構築とデータの再利用のための社会的ライセンスの確保のために定期的に提案されている。
本稿では、音声をレバレッジで補う必要があると論じる。
個人やコミュニティは、信用できる法的、制度的、契約的、経済的、または評判的なコストを無視されるように付加することで、その参加を連続的に行うことができる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:30:57 GMT)
From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Digital, Social, Virtual, and Physical Environments [0.0] このレビューは2026年8月31日までに利用可能な主要な研究と公式な技術仕様を合成する。
我々は、モデル、ハーネス、環境を分離しながら、委任された権限、時間的持続性、環境結合に沿った証拠を整理する。
このフレーミングは、モデルハーネスの評価、能力に基づくパーミッション、耐久性のある状態、クロスエージェントのアカウンタビリティ、ステージ化された物理的なバリデーションに関する研究課題をもたらす。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:52:28 GMT)
From 80x to 385x: A Best-Matching-Unit Search at the L2 Roof, Measured Against a Symmetrically Tuned Baseline [0.0] 私は、新しいSOMアルゴリズム(SparseBin)と、それと比較されたベースラインアルゴリズム(cuSPARSE)の両方をチューニングしたプログラムを報告します。
自己組織化マップトレーニングを統括する最良マッチングユニット探索は、4つのレバーで調整された。
チューニングされたカーネルはL2バンド幅の屋根をピークの77%、他のユニットは40-65%、さらにレバーは1.3倍に制限した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:38:42 GMT)
Fixed Suffix Dependency Ratio: Quantifying the Dual-Track Mechanism of Gender Assignment in Latvian Loanwords [0.0] 本研究では,固定接尾辞依存率(FSDR)を用いて,性別の異なる固定派生接尾辞への依存度を定量化する。
1,832のラトビア名詞の補題型を調べた結果,借用語体系内のFSDR非対称性が顕著であった。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:14:07 GMT)
FORESIGHT-9: Prospective and Process-Aware Evaluation of Adaptive Trading Agents [0.0] FORESIGHT-9は、9つの監査可能な対実的ストレスワールドラインから構築された、将来的でプロセス対応のベンチマークである。
共通契約は、各エージェントのネイティブ適応ループを保持しながら、観察と実行を標準化する。
我々は,36ランにわたる2つの基盤モデルバックボーンを持つ2つの適応型トレーディングエージェントフレームワークを評価した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:31:11 GMT)
Environment-assisted transport in a strongly correlated boundary-driven Fermi-Hubbard chain [0.0] 境界における粒子貯留層に結合した一次元フェルミ・ハバード鎖の定常輸送について検討した。
スピンレスフェルミオンでは従来報告されていた1つの増強とは対照的に,デファス化による輸送促進機構が2つ存在する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:38:15 GMT)
Deep belief networks are exact [0.0] 我々は、(-1,1n) 上のすべての厳密な正の確率分布が、有限パラメータを持つシグモイド信念ネットワークによって正確に表現されていることを証明した。
この証明はブリューワーの不動点定理を用いて確率共有近似を正確な表現にアップグレードする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:36:23 GMT)
Deep Microcompression: Structured Pruning and Bit-packed Quantization for Microcontrollers [0.0] 本稿では,ベアメタルマイクロコントローラ上でのディープラーニング推論のためのハードウェア対応パイプラインであるDeep Microcompression (DMC)を紹介する。
DMCは構造化プルーニング、量子化対応トレーニング、固定長ビットパッキングを統合し、LeNet-5の55.8倍の重量圧縮比(98.77%の精度)を達成する。
DMCは、2KBに制限されたデバイスであるATmega328P上での標準CNNのドキュメント展開を初めて可能にする。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 12:38:07 GMT)
DODR: Deterministic Operator-Driven Reasoning in Latent Space [0.0] 本稿では,ラテントスペースアーキテクチャにおける決定論的演算子駆動推論を提案する。
高次元線形代数空間における推論グラフ計算としての推論を再構成する。
このアーキテクチャは構造的ゼロハロシン化保証と3層連続学習機構を提供する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:20:35 GMT)
Cross-dataset transportability of pediatric chest X-ray deep learning across three countries: discrimination, calibration, operating-point failure, and limited-label recovery [0.0] 小児肺炎分類において, 識別, 確率校正, 固定操作点輸送, 限定ラベル回復性を別々に検証する計算プロトコルについて検討した。
国間でのデータセット間のシフトは、ランク付け、確率アライメント、ソース定義決定行動に異なる影響を及ぼした。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:39:48 GMT)
CrisisKD: Five-Stage Knowledge Distillation for Aspect-Level Sentiment and Emotion Analysis in Crisis Discourse [0.0] アスペクトレベルの感情分析と感情分析のための5段階の知識蒸留フレームワークであるCrisisKDを提案する。
我々は50,615のアスペクトレベルラベルを含むデータセットをオープンソースリソースとしてアノテーションと微調整スクリプトとともにリリースする。
CrisisKDは、同じモデルであるQwen2.5-7B ICLベースラインをATEで2.8F1ポイント、ATE+AECで3.8F1ポイント改善する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 22:37:19 GMT)
Conserved Immune Topology Improves Pathology Foundation Model Generalization for Cross-Cancer MSI-H Prediction [0.0] 我々は,クロスカメラMSI-H予測のための軽量空間表現であるConserved Immune Top (CIT)を提案する。
CITは、免疫関連タイルの同定に教師なしクラスタリングを使用し、リンパ構造、経時的免疫反応、マルチスケールの腫瘍浸潤性リンパ球密度をコードする。
以上の結果から,CITはMSI-H予測のための臓器不変表現であり,病理基盤モデルのクロスカンサー一般化をサポートする可能性が示唆された。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:17:03 GMT)
Compiling the 2D Fermi-Hubbard ground-state energy estimation algorithm for active volume quantum architectures [0.0] 本稿では,Fermi-Hubbardモデルに対する基底状態エネルギー推定アルゴリズムのアクティブ・ボリューム・アウェア・コンピレーションを提案する。
提案したコンパイルは、Ltimes L$2乗格子のアクティブボリュームを$L=4$から$20$に減らし、非クリフォード数に最適化された前の作業よりも3.9times$に減らした。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:10:12 GMT)
Cheap Verifiers, Large Blind Spots: Measuring the Reliability Cost of Cost-Saving Cascades [0.0] 推論カスケードは、ほとんどのクエリを安価なモデルで答え、検証として機能するフロンティアモデルにハードテールをエスカレートすることでコストを削減する。
検証者の拒否に対して安価な学生を微調整することで、エスカレーション率とコストは各ラウンドで低下する。
このループを実LLMで測定し,4つの知見を報告する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:32:03 GMT)
Building a research-software catalog with a coding agent: from hackathon prototype to public deployment [0.0] 生成AIとコーディングエージェントは、研究ソフトウェア開発を加速するだけでなく、効率的なソフトウェア発見とメンテナンスの必要性も増す。
ハッカソン中にリポジトリカタログを開発し,公開デプロイメントに適合させるために必要なエンジニアリングについて検討する。
このプロトタイプから学んだ教訓が、もっと大きな人事ポータルに移行できるかどうかを調査する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 04:31:51 GMT)
Beyond Code Generation: Reliability, Verification, and Cost Economics in the Agentic Software Development Lifecycle [0.0] AIコーディングシステムは、自動補完とチャットから、リポジトリを検査し、複数のファイルを編集し、ツールを実行し、テストを書き、プルリクエストをオープンし、監督が限定された長時間作業できるエージェントへと移行している。
近年のフィールド研究は、コーディング活動において有意義な利得を示しているが、より新しい証拠は、それらの利得が、コードを書き込むことと、信頼性の高いソフトウェアを出荷するの間に著しく弱まることを示している。
本稿では,ピアレビューされたソフトウェア工学の研究,大学研究,ベンチマーク監査,大手技術企業の生産報告,開発者テレメトリ,コスト管理のエビデンスを合成する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 03:16:30 GMT)
Balance of Benchmarks: Semantic Density Reweighting for Benchmark Multiplicity and Task-Conditioned Evaluation [0.0] ベンチマークのバランスはベンチマーク記述を埋め、各ベンチマークに逆密度のセマンティックウェイトを割り当てる。
残留フィールドは同じ幾何学を用いてタスククエリのランク付けを条件付けする。
BoBは最も高い平均プロファイルを獲得し、最寄り、調整されたトップ(k)、半径、クラスタベースのアグリゲーションを著しく上回っている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:47:26 GMT)
AxQM: A Textbook-Scale Benchmark for Formal Proof Synthesis in a Library of Finite-Dimensional Quantum Mechanics [0.0] AxQMは物理学における最大の証明合成ベンチマークである。
タスク数によっては、物理における証明合成のベンチマークとしては最大で4倍である。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:58:19 GMT)
Attention-guided super-resolution of 4D flow MRI in carotid arteries [0.0] 本研究では,4次元フローMRIデータジオメトリの品質向上のために,マルチスケールの特徴抽出とアテンション機構を統合したディープラーニングベースのフレームワークを提案する。
提案アーキテクチャは、畳み込みブロックアテンションモジュール(CBAM)を用いて、ネットワークを臨床的に関連する空間的特徴へ誘導し、低分解能入力におけるノイズを抑制する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 08:48:32 GMT)
Artificial Intelligence in Equity and Crypto Markets: Progress, Profitability Evidence, and the Limits of Automated Investing [0.0] しかし、技術的能力は投資収益性の証拠ではない。
このレビューでは2026年8月31日までに上場株式、為替取引資金、中央集権暗号スポット、永遠の先物、およびオンチェーン市場に関する公開研究について検討する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 09:19:51 GMT)
Analytical model for polarization transfer during gas-phase collision events in spin-exchange optical pumping: Spin-$\frac{1}{2}$ $^{129}$Xe versus spin-$\frac{3}{2}$ $^{131}$Xe [0.0] スピン交換光ポンピング(英: spin-exchange optical pumping、SEOP)は、129Xeや131Xeなどのスピン超分極希ガス核を製造する方法である。
SEOPでは、光学偏光アルカリ金属原子が気相衝突時にスピン偏光を希ガス核に伝達する。
我々は、任意の核スピンを持つ希ガスに適用可能な、偏極移動の上限、緩和、簡単な解析モデルを得る。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 05:21:28 GMT)
Analysis of Respiratory Sinus Arrhythmia with Neural Networks [0.0] 呼吸性副鼻腔不整脈(RSA)のフェノメノンを利用して心電図信号を分析し呼吸速度を推定するためのニューラルネットワークによるアプローチを提案する。
本手法は心電図入力データから直接呼吸波形を予測するために訓練された深層学習モデルを用いている。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 20:09:30 GMT)
An Integrated Vision-and-Language Pretraining (VLP) and Visual Question Answering (VQA) model to Automate Nondestructive Evaluation Image Analysis [0.0] ChatNDE Figure to Captionは、ディープラーニングと自然言語処理(NLP)を用いたNDE画像の解釈を自動化することを目的としている。
VisionandLanguage Pretraining戦略は、モデルが視覚的特徴と意味のある言語を接続する方法を学ぶのを助けるために開発された。
このシステムはResNet50モデルを組み合わせて、画像から重要な特徴を抽出し、GPT2言語モデルを使ってこれらの特徴を自然な音声テキストに変換する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 15:58:20 GMT)
An Empirical Study on Learning Paths and Gender Dynamics in Scrum Master Roles [0.0] 私たちは、多文化のソフトウェア企業におけるスクラムマスターの役割を学ぶ道に焦点を合わせます。
本稿では,チーム規模やキャリアパスの学習プロセス,ソフトスキル開発を監視する企業の役割について検討する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:23:22 GMT)
An Attention-Guided Global and Local Fusion Framework for Lesion-Focused Image Classification [0.0] 本研究では,大域的文脈情報と病変に焦点を絞った局所情報の適応的融合により分類性能が向上する可能性が示唆された。
本稿では,特徴属性,解釈可能性,分類信頼性を改善するために,三分岐型,注意誘導型ディープラーニングフレームワークを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 06:36:06 GMT)
After Cheap Discovery: From unknown to known-and-unfixed [0.0] 脆弱性の発見は、ほとんどのソフトウェアを保護した専門家の注意の欠如を排除した。
反応は発見と修理に集中しており、どちらも安くなっている。
この記事は、どちらのコスト曲線も露光を決定しないと主張している。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 19:55:44 GMT)
Adaptive Gated Deepfake Detection for Low-Resolution and Resource-Constrained Environments [0.0] 本稿では,適応型ゲート型ディープフェイク検出フレームワークであるAdaGate-DFを提案する。
AdaGate-DFは、画像品質の手がかりを使用して、サンプルをデュアルマルチエグジットシステムにルーティングすることで、高品質な画像が早期に終了し、計算を省くことができる。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 16:14:57 GMT)
Adaptive Cost-Sensitive Machine Learning for Autonomous Robot Navigation Failure Prediction: When Not All Errors Are Equal [0.0] 信頼感下での低速度での近距離距離は、急速運動、近接障害物アプローチ、劣化知覚において同じ事象と等価ではない。
本稿では、ナビゲーション障害予測を結果に敏感な予測として再設定する。
エピソードレベルのグループKFoldを用いて,2000回のディファレンシャルドライブエピソードの評価を行った。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:45:51 GMT)
A photonic source with half-a-GHz single-photon flux [0.0] 決定論的単一光子源は、高い励起率と高いシステム効率を同時に組み合わせ、500MHz以上のインファイバー単光子フラックスに達する。
出力は100pW以上で、オフザシェルフのパワーメーターで測定される。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 17:39:43 GMT)
A Verifier-Guided Explainable Reasoning Framework with Gold-Anchored QLoRA, Task-Aware Mixture-of-Experts, and Group-Relative RLVR [0.0] 大規模言語モデル(LLM)は、強い推論能力を示すが、それらの説明は一貫性がなく、基盤が弱く、検証が難しい。
我々は,ゴールドアンコールQLoRA,タスク認識型シンボリックルーティング,グループ相対RLVRを組み合わせた検証者ガイドによる説明可能な推論フレームワークを提案する。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 14:52:06 GMT)
A Schema Bounded Language Model for Refining Robot Policies Without Destabilizing Local Learning [0.0] 3つのロボットはモーションダイナミクスを共有するが、異なるLLMバックエンドを使用する。
各ロボットは、大言語モデル(LLM)ポリシーエージェント、アッパー信頼境界(UCB)バンディット、ダブルディープQネットワーク(Double DQN)コントローラを独立に結合する。
ロボットは、ポリシー、結果、学習フィードバックを含む共有ラウンドサマリを通じて、クロスLLM通信を行う。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:35:55 GMT)
A Multi-Source Ensemble Approach to Candidate Generation for Alternative Vacation Rental Property Recommendations [0.0] 本稿では,休暇レンタル代替案の候補生成手法について包括的に検討する。
大規模休暇レンタルプラットフォームを用いた実験では,アイテムベース協調フィルタリングとGNNベース検索を組み合わせたハイブリッドアーキテクチャが,最強ベースラインよりも14.8%向上した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 21:56:44 GMT)
A Hybrid Predictive Ensemble of Machine Learning and Deep Neural Networks for Early Cardiovascular Disease Risk Assessment [0.0] 本研究では、機械学習とディープニューラルネットワークアンサンブル技術を統合した、心血管疾患の早期発見と予後診断を行うインテリジェントフレームワークを提案する。
このシステムは、ECGセンサー、心拍モニター、血圧計など、IoT(Internet of Medical Things, IoMT)デバイスから収集されたリアルタイムの生理的データを利用する。
本フレームワークは, 心血管疾患のリスク予測, 精度の向上, 偽陽性率の低減, 従来法に比べて整合性の向上に優れた性能を示した。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:49:44 GMT)
A Human-in-the-Loop Framework for AI-Assisted Scoring in Large-Scale Writing Assessment [0.0] 本研究では,大規模国家評価における筆記応答のためのAI支援スコアリングフレームワークの設計と妥当性について述べる。
提案手法は,約150~200ワードの短いテキストに焦点をあて,手作業量を削減するとともに,評価品質の維持を図る。
論文参考訳(メタデータ) (Fri, 04 Sep 2026 13:47:29 GMT)