US Population by County (米国の郡別人口)

2000 年および 2010 年に実施された 10 年ごとの国勢調査をソースとする、米国の郡ごとの性別および人種別の米国人口。

このデータセットは、米国国勢調査局の Decennial Census Dataset API から提供されます。 このデータセットの使用に関する諸条件については、「Terms of Service (サービス利用規約)」および「Policies and Notices (ポリシーと通知)」をご覧ください。

Microsoft は、Azure Open Datasets を "現状有姿" で提供します。 Microsoft は、データセットの使用に関して、明示または黙示を問わず、いかなる保証も行わないものとし、条件を定めることもありません。 現地の法律の下で認められている範囲内で、Microsoft は、データセットの使用に起因する、直接的、派生的、特別、間接的、偶発的、または懲罰的なものを含めたいかなる損害または損失に対しても一切の責任を負わないものとします。

このデータセットは、Microsoft がソース データを受け取った元の条件に基づいて提供されます。 データセットには、Microsoft が提供するデータが含まれている場合があります。

容量と保持期間

このデータセットは Parquet 形式で保存されており、2000 年および 2010 年のデータが含まれています。

保存先

このデータセットは、米国東部 Azure リージョンに保存されています。 アフィニティを考慮して、米国東部にコンピューティング リソースを割り当てることをお勧めします。

[列]

Name データ型 一意の 値(サンプル) 説明
countyName 文字列 1,960 ワシントン州ジェファーソン郡 郡名。
decennialTime 文字列 2 2010 2000 10 年ごとの国勢調査が行われた時期 (例: 2010、2000)。
maxAge INT 23 9 66 年齢範囲の最大値。 null の場合、すべての年齢が対象となるか、年齢範囲に上限がなくなります (> 85 歳など)。
minAge INT 23 35 67 年齢範囲の最小値。 null の場合、すべての年齢にわたります。
母集団 INT 47,229 1 2 このセグメントの人口。
レース 文字列 8 アジア単独2つ以上のレース 国勢調査データの人種カテゴリ。 null の場合、すべての人種にわたります。
性別 文字列 3 男性女性 男性または女性。 null の場合、男女両方にわたります。
stateName 文字列 52 テキサス ジョージア 米国の州の名前。
INT 2 2010 2000 10年単位の年(整数)。

プレビュー

decennialTime stateName countyName 母集団 レース 性別 minAge maxAge
2010 テキサス クロックット郡 123 ホワイト アローン 男性 5 9 2010
2010 テキサス クロックット郡 1 アジアのみ 女性 67 69 2010
2010 テキサス クロックット郡 111 ホワイト アローン 女性 55 59 2010
2010 テキサス クロックット郡 64 2 つ以上のレース null 値 2010
2010 テキサス クロックット郡 18 null 値 男性 85 2010
2010 テキサス クロックット郡 16 アメリカインディアンとアラスカネイティブ単独 女性 2010
2010 テキサス クロックット郡 7 ホワイト アローン 男性 21 21 2010
2010 テキサス クロックット郡 45 null 値 女性 85 2010
2010 テキサス クロックット郡 0 ハワイ先住民およびその他の太平洋諸島民のみ 女性 67 69 2010

データ アクセス

Azure Notebooks

# This is a package in preview.
from azureml.opendatasets import UsPopulationCounty

population = UsPopulationCounty()
population_df = population.to_pandas_dataframe()
population_df.info()

Azure Databricks

# This is a package in preview.
from azureml.opendatasets import UsPopulationCounty

population = UsPopulationCounty()
population_df = population.to_spark_dataframe()
display(population_df.limit(5))

Azure Synapse

# This is a package in preview.
from azureml.opendatasets import UsPopulationCounty

population = UsPopulationCounty()
population_df = population.to_spark_dataframe()
# Display top 5 rows
display(population_df.limit(5))

Azure SQL Database

Azure SQL Databaseは、データ仮想化を使用してこのデータセットに直接クエリを実行できます。 OPENROWSETを使用して、HTTPS 経由で Parquet ファイルを読み取ります。

その場でクエリ

SELECT TOP 100 *
FROM OPENROWSET(
    BULK 'abs://censusdatacontainer@azureopendatastorage.blob.core.windows.net/release/us_population_county/**',
    FORMAT = 'PARQUET'
) AS [src];

テーブルに永続化する(任意)

SELECT *
INTO dbo.UsPopulationByCounty_Local
FROM OPENROWSET(
    BULK 'abs://censusdatacontainer@azureopendatastorage.blob.core.windows.net/release/us_population_county/**',
    FORMAT = 'PARQUET'
) AS [src];

次のステップ

Open Datasets カタログの残りのデータセットを表示します。