論文の概要: Animarium: an open, reproducible pipeline for synthetic populations of Italian cities, from ISTAT sources to open data (Tech Report v1)
- arxiv url: http://arxiv.org/abs/2608.27111v1
- Date: Thu, 27 Aug 2026 13:25:35 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-08-28 16:30:58.415623
- Title: Animarium: an open, reproducible pipeline for synthetic populations of Italian cities, from ISTAT sources to open data (Tech Report v1)
- Title(参考訳): Animarium: ISTATソースからオープンデータまで、イタリアの都市の合成人口のためのオープンで再現可能なパイプライン(Tech Report v1)
- Abstract要約: イタリアの11の自治体の人口は、単独で公表された集合体から発生した。
アーキテクチャ、ソースとその認証、リリースタグにおける品質測定、ビューアー、そして物語層についてレポートする。
- 参考スコア(独自算出の注目度): 0.0
- License: http://creativecommons.org/licenses/by/4.0/
- Abstract: Synthetic populations of eleven Italian municipalities (1,814,317 individuals in 887,937 households) generated from published aggregates alone: ISTAT census and register tables, census-section counts, the national civic-address register, public-use survey microdata, and six municipal open-data portals, every source certified in a registry with licence, fingerprint and declared affordances. Four rings give every attribute a declared place: a maximum-entropy joint model of up to nine demographic attributes; whole-vector donation of twenty-three attitudinal and health variables from survey respondents; placement to census section, single year of age and address; and households constrained by the census size distribution per section. Every downstream layer (detailed titles, work, names, biographies) is a declared derivation adding no information. The pipeline is deterministic to the byte: regenerating all eleven municipalities from the tagged commit reproduces every file of every ring bit for bit, in 33 minutes on one workstation. Populations are released in a public regime enforced in the data (no names, no addresses, coordinates randomised within census section), browsable in Animarium, a dependency-free web viewer where every number carries its comparison and every view is a citable URL, and downloadable as an open dataset. The report documents the architecture, the sources and their certification, the reproducibility and quality measurements at the release tag, the viewer, and the narrative layer that renders records into personas for LLM-driven simulation, with the platform's controllability demonstrated in companion experiments, and validation explicitly out of scope.
- Abstract(参考訳): 11のイタリアの自治体(887,937世帯の1,814,317人)の合成人口は、ISTATの国勢調査と登録表、国勢調査区画数、全国市民登録簿、公用調査用マイクロデータ、および6つの自治体のオープンデータポータルから生成され、全てのソースは、免許、指紋、資格が宣言された登録簿に登録されている。
4つのリングはすべての属性に宣言された場所を与える: 最大9つの人口統計属性のエントロピー結合モデル、調査回答者からの23の縦横変数と健康変数の全ベクター寄付、国勢調査部門への配置、一年ごとの年齢と住所、および地域ごとの国勢調査サイズ分布に制約された世帯である。
すべての下流層(詳細タイトル、仕事、名前、伝記)は、情報を追加せずに宣言された派生である。
タグ付けされたコミットから11の自治体を再生すると、すべてのリングビットのファイルをビット単位で再生し、1つのワークステーションで33分で再生する。
人口は、データで強制されるパブリックレギュレーション(名前、住所、国勢調査セクション内でランダム化された座標)、Animariumでブラウズ可能な、すべての番号が比較され、すべてのビューがcitable URLで、オープンデータセットとしてダウンロードされる、依存性のないWebビューアでリリースされる。
このレポートは、アーキテクチャ、ソースとその認証、リリースタグにおける再現性と品質の測定、ビューアー、およびLCM駆動シミュレーションのペルソナにレコードを描画する物語層を文書化しており、プラットフォームの制御性は共同実験で実証され、スコープ外を明確に検証されている。
関連論文リスト
- A Hybrid State-Space Approach for Census-Tract Population Estimation [45.88028371034407]
MambaPopは、行政単位のイメージから直接人口を学習する方法である。
平均絶対誤差(MAE)は1トラル当たり1141ドルであり、最も強い畳み込みベースラインと一致する。
論文 参考訳(メタデータ) (2026-08-30T23:43:06Z) - Benchmarking LLMs for Community Governance Simulation with Life-history Narratives [46.86050402684712]
大規模言語モデル(LLM)は、人間の態度や振る舞いを低コストでシミュレートするためにスケーラブルである。
本稿では,データセット,ベンチマーク,アルゴリズム,システムを対象とした総合的な研究フレームワークを提案する。
システムはカリキュラム-LoRAをクローズドループポリシー評価パイプラインに統合する。
論文 参考訳(メタデータ) (2026-05-22T15:48:49Z) - Using Zero-Shot LLM-Generated Survey Data for Geographically Explicit Population Synthesis [0.0]
本稿では,ゼロショット大言語モデル(LLM)が生成する健康調査データが,従来の反復比例フィッティングワークフローの入力として機能するかどうかを評価する。
GPT-4.1 と Gemini-2.5-Pro でコロラド州とミシシッピ州の総合調査記録を作成した。
生成したデータをIPFベースの合成パイプラインに使用し、結果の国勢調査レベルの合成人口を外部ベンチマークに対して評価する。
論文 参考訳(メタデータ) (2026-04-23T21:27:36Z) - A Deep Generative Framework for Joint Households and Individuals Population Synthesis [0.562479170374811]
世帯・個人・個人・個人関係を持つ合成集団を創出するための深い生成枠組みを提案する。
米国デラウェア州での申請の結果は、生成された家庭内レコードのリアリズムを確実にする能力を示している。
論文 参考訳(メタデータ) (2024-06-30T23:01:58Z) - Least Squares Estimation For Hierarchical Data [0.7366405857677227]
アメリカ合衆国国勢調査局の2020年開示回避システム(DAS)はノイズ測定に基づく出力をベースとしている。
本稿では,非常に高次元の最小二乗推定値を計算するために,入力データの階層構造を利用するアルゴリズムについて述べる。
論文 参考訳(メタデータ) (2024-04-19T20:18:16Z) - Deep Efficient Private Neighbor Generation for Subgraph Federated
Learning [57.39918843245229]
そこで我々は,FedDEPを提案する。FedDEPは,部分グラフの欠落が原因で,局所的な部分グラフ上での不完全な情報伝達に対処する。
FedDEPは,(1)GNN埋め込みを利用した深部近傍世代,(2)埋め込みプロトタイピングによる近接世代に対する効率的な擬似FL,(3)ノイズのないエッジ局所微分プライバシによるプライバシ保護という,一連の新しい技術設計で構成されている。
論文 参考訳(メタデータ) (2024-01-09T03:29:40Z) - A Simulated Reconstruction and Reidentification Attack on the 2010 U.S. Census [6.851716728384597]
2010年国勢調査の個々の機密マイクロデータ記録を正確に再構築できることを示す。
9700万人の記録(すべての国勢調査ブロックの70%に居住している)は、公的な情報のみを使用して証明可能な確実性で正確に再構築されている。
差分プライバシーフレームワークに基づく2020年国勢調査で使用される手法は、可能な代替手段よりも、より正確なデータ精度で、この種の攻撃に対してより優れた保護を提供することを示す。
論文 参考訳(メタデータ) (2023-12-18T15:23:12Z) - Fine-grained Population Mapping from Coarse Census Counts and Open
Geodata [19.460864948909936]
詳細な人口地図は、都市計画、環境モニタリング、公衆衛生、人道活動など、いくつかの領域で必要とされる。
POMELOは、粗い国勢調査数と開地データを用いて、100mの地中サンプリング距離を持つ詳細な人口分布図を推定する深層学習モデルである。
サハラ以南のアフリカにおけるいくつかの国に対する一連の実験において、POMELOareで作成した地図は、最も詳細な参照数とよく一致している。
論文 参考訳(メタデータ) (2022-11-08T06:43:52Z) - QuTE: decentralized multiple testing on sensor networks with false discovery rate control [93.1040521878626]
本稿では、偽発見率(FDR)の証明可能な保証を備えたグラフ上での分散多重仮説検定法を設計する。
異なるエージェントが無向グラフのノードに存在し、各エージェントはそのノードに局所的な1つ以上の仮説に対応するp値を持つ。
各エージェントは、グラフ全体の大域的FDRが予め定義されたレベルで制御されなければならないという共同目的のもと、隣人とのみ通信することで、それぞれのローカル仮説の1つ以上の拒絶を個別に決めなければならない。
論文 参考訳(メタデータ) (2022-10-09T19:48:39Z) - Releasing survey microdata with exact cluster locations and additional
privacy safeguards [77.34726150561087]
本稿では,プライバシ保護を付加した独自のマイクロデータの有用性を活用した,代替的なマイクロデータ配信戦略を提案する。
当社の戦略は, 再識別の試みにおいても, 任意の属性に対する再識別リスクを60~80%削減する。
論文 参考訳(メタデータ) (2022-05-24T19:37:11Z) - Building a large synthetic population from Australian census data [2.707154152696381]
本稿では,オーストラリアにおける人口統計データから,メルボルン大都市圏に適用した人工人口の創出について述べる。
我々は,集団合成における標本のないアプローチを用いて,元の個体群から分離した標本に依存しない。
我々のアルゴリズムは、現代のコンピュータで3分以内に、180万世帯の450万人からなるメルボルンの合成人口を作り出すことができる。
論文 参考訳(メタデータ) (2020-08-18T05:38:15Z) - Differential Privacy of Hierarchical Census Data: An Optimization
Approach [53.29035917495491]
国勢調査局(Census Bureaus)は、個人に関する機密情報を明らかにすることなく、大人口に関する社会経済的データをまとめて公開することに興味を持っている。
最近の出来事では、これらの組織が直面しているプライバシー上の課題がいくつか特定されている。
本稿では,階層的な個人数を解放する新たな差分プライバシ機構を提案する。
論文 参考訳(メタデータ) (2020-06-28T18:19:55Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。