論文の概要: Is the Geometry Doing the Work? An Operating-Point Audit of Hierarchy in Hyperbolic Vision-Language Models
- arxiv url: http://arxiv.org/abs/2607.05268v2
- Date: Mon, 13 Jul 2026 12:17:38 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-07-14 17:47:21.259692
- Title: Is the Geometry Doing the Work? An Operating-Point Audit of Hierarchy in Hyperbolic Vision-Language Models
- Title(参考訳): 幾何学は作業を行うのか?双曲型視覚・言語モデルにおける階層の運用点監査
- Abstract要約: 必要条件診断を開発し、3つの双曲型視覚言語族を検査する。
すべての収束チェックポイントはユークリッド近傍に残っている。
曲率フロアのリリースは、このレギュレーションを離れることなく$c$と標準を変更します。
エンターメントコーンは不活性または飽和である。
- 参考スコア(独自算出の注目度): 9.503955118903454
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Whether a hyperbolic representation model uses its geometry cannot be inferred from curvature alone: what matters is the dimensionless operating point $\sqrt{c}ρ$ and whether the radial and cone mechanisms are operational there. We develop necessary-condition diagnostics and audit three published hyperbolic vision-language families -- MERU, HyCoCLIP, and PHyCLIP -- across released checkpoints and matched interventions. All converged checkpoints remain near-Euclidean ($H(u)\approx1$; none reaches $\sqrt{c}ρ>1$), and releasing the curvature floor changes $c$ and norms without leaving this regime or substantially degrading downstream performance. Entailment cones are inactive or saturated, and graded traversal fails under controlled readouts, including the models' native distance metrics. External parent-child ordering shows no shuffle-controlled pair-specific radial signal at quantified sensitivity; the only surviving pair-specific signal, a statistically detectable but small residual on the GRIT box-to-full-caption relation, remains non-operative under the evaluated readouts. Taxonomy correlations show no detectable norm contribution beyond cosine, and coarse-retrieval gains co-vary with box/compositional supervision without establishing an active radial mechanism. Gradient diagnostics expose a low-curvature, wide-cone shortcut in the entailment objective. A closed-form aperture identity places the saturation edge at $\sqrt{c}ρ\le2K$: with the floor released, all trained relation-level parent means lie at or below this edge, leaving the parent cones fully or nearly saturated. Entailment-off runs pass the edge and continue contracting. The shortcut is the dominant accelerator of collapse, not its sole cause. These audited formulations do not show an operative radial/cone mechanism under our diagnostics. We distill the audit into a five-number geometry report for hierarchy claims.
- Abstract(参考訳): 双曲表現モデルがその幾何を使用するかは、曲率だけでは推測できない: 重要なことは、次元を持たない操作点 $\sqrt{c}ρ$ と、半径と円錐の機構がそこで動作しているかどうかである。
我々は,必要条件診断と3つのハイパーボリック視覚言語ファミリー(MERU,HyCoCLIP,PHyCLIP)を,リリースされたチェックポイントと一致した介入で実施する。
すべての収束チェックポイントは、ほぼユークリッド ($H(u)\approx1$; 決して$\sqrt{c}ρ>1$に到達しない) に留まり、曲率フロアを解放すると、このレギュレーションを残したり、ダウンストリームのパフォーマンスを著しく低下させることなく、$c$とノルムが変化する。
エンターメントコーンは不活性または飽和しており、モデルのネイティブ距離測定値を含む制御された読み出し条件下ではグレードされたトラバーサルが失敗する。
統計的に検出できるがGRITボックスとフルカプセルの関係で残存している唯一のペア固有信号は、評価された読み出しの下では動作しない。
分類学的相関はコサインを超えて検出可能なノルム寄与は示さず、粗い検索は活性な放射能機構を確立することなくボックス/コンポジションの監督と共変する。
グラディエント診断は、エンテーメント目的において、低曲率で広円錐のショートカットを露呈する。
閉じた形状の開口恒等式は、飽和エッジを$\sqrt{c}ρ\le2K$: 床が解放されたとき、すべての訓練された関係レベルの親は、このエッジの上か下にあることを意味する。
エンタテインメント・アウト・ランはエッジを通過して契約を継続します。
このショートカットは、唯一の原因ではなく、崩壊の主流の加速器だ。
以上より, 当科の診断では, 術中放射状/錐体機構は示されていない。
オーディションを5桁の幾何学的レポートに抽出し,階層的クレームについて検討する。
関連論文リスト
- The Anatomy and Boundary of Adaptation under Temporal Tabular Shift [14.709439807376505]
診断解剖学的属性は、ストリーミングプロトコルの下で4つの繰り返しメカニズムに到達する。
第二に、$L2$プロジェクションウォールは凍結表現が表現できないものを定量化する。
8つの産業用ストリーム上のストリームレベルのプロキシは、条件付きで困難な状況に陥る。
論文 参考訳(メタデータ) (2026-09-10T19:08:28Z) - Common-Center Geometry and Certified Radial Reconstruction for Energy-Form Full Conformal Regions [5.188221150628459]
この注記は、経験的エネルギー形対のスコアによって生成される共形予測(FullCP)領域の幾何学に焦点を当てる。
12ドルと$mge2$の場合、明示的なデータチェック可能な微分境界は、ラジアル出口と正確な共形ラジアル関数のリプシッツ制御を与える。
論文 参考訳(メタデータ) (2026-08-25T07:38:04Z) - Intrinsic Structure: Spectral Identifiability for Mechanistic Interpretability [51.56484100374058]
機械論的解釈可能性プリミティブに対する最初の識別可能性定理を証明した。
スペクトルは、正当性分解ではなく、記述されたエラーバーを持つ識別可能なモデル固有の指紋である。
論文 参考訳(メタデータ) (2026-08-10T19:42:01Z) - Statevector-Referenced Geometry Survival of a Four-Qubit ZZ Quantum Kernel on IBM Quantum Hardware: A Fixed-Subset Diagnostic Across Three Execution Configurations [0.0]
量子カーネル法は、データセットの幾何学をグラム行列にエンコードする。
実室内の空気品質の高い窓上で, 凍結した4量子ZZ特徴写像カーネルの生存率をN=24$とする。
論文 参考訳(メタデータ) (2026-07-22T17:05:42Z) - Geometric Collapse: When Vision Models Fail to Verify Physical Causality [52.43819179934414]
スクランブルドエッジ(Scrambled Edges)は、サリアントエッジのようなキューを注入する制御されたカウンターファクトである。
エネルギー整合制御と構造整合制御により, 高周波エネルギーとエッジ間隔から支持エッジエビデンスの効果を分離する。
CNN/ViT/SSL深度予測器を通して、Scrambled Edgesはエネルギー整合ノイズよりもクリーンな予測から最大3.2倍大きな偏差を誘導する。
論文 参考訳(メタデータ) (2026-07-08T00:04:02Z) - Nonlinear Geometrizability of State-Dependent Proto-Area in Approximate Holographic Codes [0.0]
近似回復によって生成される状態依存型プロト面積データは、単一の局所的バルク計量と互換性がない。
我々は、正確な有限分解能基準を導出し、双曲円盤の近傍では、通常のプロト面積2ジェットの必要十分条件を導出する。
ハミルトニアスキュード符号は、第一次非幾何と、第一の障害物が二次的にのみ現れるキャリブレーション応答の両方を実現する。
論文 参考訳(メタデータ) (2026-06-21T17:16:10Z) - What Accuracy and Gradient Cosine Miss: Evaluating Feedback Alignment via Scale Stability, Reference Validity, and Depth Utility [48.10132234701036]
本稿では,3つのチェック(スケール安定性,参照妥当性,深度ユーティリティ)に基づく診断評価プロトコルを提案する。
複数のアーキテクチャや手法にまたがって、我々のプロトコルは広い校正マージンを持つ全ての障害を識別する。
論文 参考訳(メタデータ) (2026-06-19T06:04:17Z) - Riemannian-Manifold Steering: Geometry-Aware Generative Autoencoders for Label-Free Steering [3.854000879223449]
我々は、活性化空間上のtextbfRiemann 測地線計算として多様体のステアリングをリキャストする。
我々はこれを、小さな概念整合スキーマ上で出力距離を訓練した学習エンコーダと近似する。
論文 参考訳(メタデータ) (2026-05-24T08:41:56Z) - Self-Attention as Transport: Limits of Symmetric Spectral Diagnostics [0.0]
均一な因果的注意は、$n$に依存しないフロア$ge 1/5$で、最悪のカットは$tast/n approx 0.32$で、ウィンドウアテンションは$O(w/n)$で、フロアは$O(w/n)$である。
結果として生じる2軸の診断は、ファルシブルな極性予測をもたらす。
論文 参考訳(メタデータ) (2026-05-06T13:25:13Z) - SpatialEvo: Self-Evolving Spatial Intelligence via Deterministic Geometric Environments [75.60795462502949]
SpaceEvoは3D空間推論のための自己進化型フレームワークである。
16の空間推論タスクカテゴリを明示的な幾何学的検証規則で定式化する。
注釈のない3Dシーンをゼロノイズのインタラクティブなオラクルに変換し、モデルコンセンサスを客観的な物理的フィードバックに置き換える。
論文 参考訳(メタデータ) (2026-04-15T17:59:12Z) - Enhancing Fine-Grained Spatial Grounding in 3D CT Report Generation via Discriminative Guidance [16.566888073449714]
ラジオロジーレポート生成(RRG)のための視覚言語モデル(VLM)は、ボリュームスキャンから長めの胸部CTレポートを生成することができる。
既存の方法は2つの重要な制限に直面している: (i) トレーニングの監督は、しばしば粗くなり、きめ細かい属性や病理の場所を明示的に調整することなく、CTのボリューム全体を完全な自由テキストのレポートと整列する。
本稿では,フリーテキストレポートから微細なキューを蒸留し,レポート生成をガイドするプラグイン・アンド・プレイフレームワークであるPrompt Dropout (DCP-PD) を用いたemphDiscrimi Cue-Promptingを提案する。
論文 参考訳(メタデータ) (2026-04-12T03:25:41Z) - Tight Convergence Rates for Online Distributed Linear Estimation with Adversarial Measurements [66.94250413799232]
分散パラメータ-サーバ-ワーカー設定における乱数ベクトル$X$の推定について検討する。
主な課題は、敵の計測と非同期である。
その結果, 分散線形推定におけるロバスト性, 識別性, 統計的効率の統一的有限時間評価が得られた。
論文 参考訳(メタデータ) (2026-04-07T11:45:55Z) - Robust Sequential Tracking via Bounded Information Geometry and Non-Parametric Field Actions [0.0]
LiDARによるターゲット追跡、高周波暗号秩序フロー、量子状態トモグラフィーの3つの領域にわたる実証的なベンチマークでは、この情報ジオメトリが異常値を解析的に減らすことを実証している。
論文 参考訳(メタデータ) (2026-03-13T21:40:44Z) - Distributional Stability of Tangent-Linearized Gaussian Inference on Smooth Manifolds [3.632189127068905]
我々は、投射限界化と表面測定条件付けのために、明示的な非漸近的な$W$安定性境界を導出する。
境界は局所的な2次幾何学的歪みと非局所的な尾の漏れを区別する。
実験では、$sqrt||_mathrmop/Rapprox 1/6$付近で予測されたキャリブレーション遷移を検証し、正規方向の不確実性が局所性破壊時の支配的な障害モードであることを示す。
論文 参考訳(メタデータ) (2026-02-22T13:18:45Z) - Rethinking the Encoding and Annotating of 3D Bounding Box: Corner-Aware 3D Object Detection from Point Clouds [69.84768614060559]
中心方向の回帰はLiDARベースの3Dオブジェクト検出において依然として支配的だが、基本的な不安定さに悩まされている。
本稿では,予測対象を不安定な中心から幾何学的情報的コーナーへシフトするコーナーアライン回帰を提案する。
我々は、既存の検出器に差し込むことができる、シンプルで効果的なコーナー認識検出ヘッドを設計する。
論文 参考訳(メタデータ) (2025-11-18T13:49:30Z) - Exploring Active 3D Object Detection from a Generalization Perspective [58.597942380989245]
不確実性に基づくアクティブな学習ポリシーは、ポイントクラウドの情報性とボックスレベルのアノテーションコストの間のトレードオフのバランスを取れません。
冗長な3次元境界ボックスラベルの点群を階層的にフィルタリングするtextscCrbを提案する。
実験により,提案手法が既存のアクティブラーニング戦略より優れていることが示された。
論文 参考訳(メタデータ) (2023-01-23T02:43:03Z) - Bayesian Active Learning by Disagreements: A Geometric Perspective [64.39292542263286]
モデル不確実性推定と相互作用するコアセット構築においてBALDを実行するフレームワークである不一致による幾何学的アクティブラーニング(GBALD)を提案する。
GBALDはノイズや繰り返しのサンプルに対してわずかに摂動があり、BALDやBatchBALDなど既存の深層学習アプローチよりも優れています。
論文 参考訳(メタデータ) (2021-05-06T09:37:59Z) - Analytic Signal Phase in $N-D$ by Linear Symmetry Tensor--fingerprint
modeling [69.35569554213679]
解析信号位相とその勾配は2-D$以上の不連続性を持つことを示す。
この欠点は深刻なアーティファクトをもたらす可能性があるが、問題は1-D $シグナルには存在しない。
本稿では,複数のGaborフィルタに頼って線形シンメトリー位相を用いることを提案する。
論文 参考訳(メタデータ) (2020-05-16T21:17:26Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。