論文の概要: GEB-Bench: Abstract Structures Told in Many Voices
- arxiv url: http://arxiv.org/abs/2608.04111v1
- Date: Tue, 04 Aug 2026 18:05:41 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-06 14:48:43.576993
- Title: GEB-Bench: Abstract Structures Told in Many Voices
- Title(参考訳): GEB-Bench:多くの声で書かれた抽象構造
- Authors: Tong Zhang, Zhiyuan Shi, Yun Peng, Tao Xie,
- Abstract要約: 我々は、GEB-Benchという、ユニットが抽象的な構造的モチーフであるベンチマーク、-自己参照、奇妙なループ、Mobiusのツイスト、---ゴデル、エッシャー、バッハの精神を例に紹介する。
それぞれのモチーフはいくつかの声で語られる: 構成が構造である自然のシーン、語られる民話は機械的にチェック可能な形状の装置、数学的定理、プログラムの骨格である。
- 参考スコア(独自算出の注目度): 15.628659207220077
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Can a model look at a river delta and a lightning bolt and see that they share a structure? We introduce GEB-Bench, a benchmark whose unit is an abstract structural motif--self-reference, a strange loop, a Mobius twist--in the spirit of Godel, Escher, Bach. Each motif is told in several voices: a natural scene whose composition is the structure, a folk story whose telling enacts it through a mechanically checkable form device, a mathematical theorem, and a programmatic skeleton; surface parameters are declared nuisance variables and never scored. Motifs, voices, and the structural changes between them form a small cross-modal category, and GEB-Bench's tasks are its questions. Evaluating twelve open and proprietary models, we find that abstraction failure is lawful. The central finding is a gap between recognition and cross-voice mapping: models identify a structure within one voice far better than they carry it across voices; every model pays this tax, and mapping strong enough to narrow it appears only at the frontier tier. Two patterns support it. Errors align more strongly with the designed formal geometry than with measured perceptual geometries, and frontier models from different vendors converge on the same wrong answers; and surface complexity taxes every model that reads structure, with capacity buying headroom rather than immunity. GEB-Bench is fully generative and released with its pipeline.
- Abstract(参考訳): モデルは川のデルタと稲妻を見て、それらが構造を共有しているのを見ることができますか?
我々は、GEB-Benchという、ユニットが抽象的な構造的モチーフであるベンチマーク、-自己参照、奇妙なループ、Mobiusのツイスト、---ゴデル、エッシャー、バッハの精神を例に紹介する。
それぞれのモチーフはいくつかの声で語られる: 構成が構造である自然のシーン、語られる民話は機械的にチェック可能な形状の装置、数学的定理、プログラムの骨格を通してそれを実行し、表面のパラメータはニュアンス変数と宣言され、決して得点しない。
モチーフ、声、それらの間の構造的変化は、小さなクロスモーダルなカテゴリーを形成し、GEB-ベンチのタスクはその問題である。
12のオープンモデルとプロプライエタリモデルを評価すると、抽象化の失敗は合法であることが分かります。
すべてのモデルは、この税を支払って、フロンティア層にのみ現れるのに十分な強度のマッピングを行う。
2つのパターンがそれをサポートする。
エラーは知覚的幾何学よりもデザインされた形式幾何学と強く一致し、異なるベンダーのフロンティアモデルは間違った答えに収束する。
GEB-Benchは完全に生成され、パイプラインでリリースされている。
関連論文リスト
- Context Is King: How In-Context Specification Shapes the Geometry of Concepts [0.0]
モデルが実際に使用する構造は、コンテキスト内仕様によって設定されます。
宣言的な規則は、幾何学がエンコードする関係だけでなく、トポロジーの型も修正する。
仕様が事前の強い事前訓練と矛盾する場合、コンテキストセット幾何が有能なモデルでそれを支配する。
論文 参考訳(メタデータ) (2026-07-27T13:36:18Z) - The Giant Hippocampus: From Structural Monoculture to a System of Systems [0.0]
AIの研究者たちは、最先端のモデルを、大規模に繰り返される1つのものだ、と説明している。
神経科学者は、この皮質を、空間的エンコーディングのための視覚野のモザイク層4、時間的統合のための運動野の厚い層5/6と表現している。
本稿では, このギャップは構造的誤差であって, 構造的誤差ではなく, 測定可能であることを論じる。
論文 参考訳(メタデータ) (2026-07-22T09:55:25Z) - Lacuna Inc. at SemEval-2026 Task 4: Structurally Gated State-Space Models for Disentangling Narrative Similarity [41.99844472131922]
Invariant-Variant Disentangled State-Space Model (IVD-SSM)を提案する。
本稿では,物語類似性と物語表現学習に関するSemEval-2026タスク4について紹介する。
論文 参考訳(メタデータ) (2026-07-03T16:48:39Z) - Are Common Substructures Transferable? Riemannian Graph Foundation Model with Neural Vector Bundles [53.65187206795911]
我々はニューラルベクトルバンドルと呼ばれるグラフ固有の幾何学学習フレームワークを開発した。
GAUGEは,ベクトルバンドルを構築し,幾何学的に整合した局所座標を平坦化する,事前学習可能なニューラルネットワークアーキテクチャである。
ゼロショットリンク予測やグラフ同型を含む課題タスクにおいて,その優れた表現性を実証的に検証する。
論文 参考訳(メタデータ) (2026-06-02T07:35:42Z) - The Topology of Multimodal Fusion: Why Current Architectures Fail at Creative Cognition [0.0]
本稿では、パラメトリックではなくトポロジカルな現在のマルチモーダルAIアーキテクチャの限界を特定する。
十字架の枠組みは、Xang を病理的交点に配置し、両軸に沿って 2 つの huacai (変換と切断) を実行する。
これは二重層力学を生み出す:チュアンフア(自然の出来事としての創造的変容)とフアカイ(制度化して繰り返し形にする)である。
トポロジカル正規化を用いたLIPによるUOO実装,エラー型計量を用いたANALOGYベンチマーク,アーキタイプ-TOP3層ベンチマークによるクロスシビライズ型トポロジカル同型試験を提案する。
論文 参考訳(メタデータ) (2026-04-06T06:23:55Z) - TopoOR: A Unified Topological Scene Representation for the Operating Room [54.50897207203292]
手術シーングラフは外科手術室(OR)の複雑さを実体の構造とその関連性に抽象化する。
マルチモーダルな手術室を高次構造としてモデル化する新しいパラダイムであるTopoORを紹介する。
また,多様体の構造やモジュラリティに特有な特徴を明示的に保存する高次アテンション機構を提案する。
論文 参考訳(メタデータ) (2026-03-10T10:19:42Z) - Synthesizing Composite Hierarchical Structure from Symbolic Music Corpora [32.18458296933001]
構造時間グラフ(STG)と呼ばれる音楽構造の統一的階層的メタ表現を提案する。
シングルピースの場合、STGは、より微細な構造的音楽的特徴の階層構造とそれらの間の時間的関係を定義するデータ構造である。
論文 参考訳(メタデータ) (2025-02-21T02:32:29Z) - GeoMFormer: A General Architecture for Geometric Molecular Representation Learning [84.02083170392764]
我々はこの目的を達成するためにGeoMFormerと呼ばれるトランスフォーマーに基づく新しい分子モデルを導入する。
我々は,GeoMFormerが,異なる型やスケールの不変タスクと同変タスクの両方において,高い性能を達成することを示す。
論文 参考訳(メタデータ) (2024-06-24T17:58:13Z) - Physics of Language Models: Part 1, Learning Hierarchical Language Structures [51.68385617116854]
トランスフォーマーベースの言語モデルは効率的だが複雑であり、内部の動作や推論メカニズムを理解することは大きな課題である。
本稿では,長文を生成可能な階層規則を生成する合成CFGのファミリーを紹介する。
我々は、GPTのような生成モデルがCFG定義階層を正確に学習し、推論し、それに基づいて文を生成することを実証する。
論文 参考訳(メタデータ) (2023-05-23T04:28:16Z) - A study of latent monotonic attention variants [65.73442960456013]
エンドツーエンドモデルは音声認識の最先端性能に達するが、グローバルソフトな注意は単調ではない。
本稿では,新しい潜在変数を導入することで,単調性を導入する数学的にクリーンな解を提案する。
モノトニックモデルがグローバルソフトアテンションモデルと同等の性能を発揮することを示す。
論文 参考訳(メタデータ) (2021-03-30T22:35:56Z) - Generalized string-net models: A thorough exposition [0.0]
一般化文字列ネットモデルの構築方法について述べる。
これらのモデルの基底状態は、異なる「ストリングネット構成」の重ね合わせと考えることができる。
これらのモデルで任意の励起を生成する文字列演算子を構築する方法を示す。
論文 参考訳(メタデータ) (2020-12-28T18:59:27Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。