Skip to contents

nad_dataset() opens every installed county Parquet file as one lazy Arrow dataset. The storage schema contains primitive columns suitable for filtering, projection, and collection with dplyr. state and county_fips are Hive partition columns. Use nad() when reconstructed addr and s2 columns are needed for one county.

Usage

nad_dataset(version = 23L)

Arguments

version

integer, length one; NAD revision to use. Only revision 23 is supported.

Value

An Arrow FileSystemDataset.

Examples

if (FALSE) { # \dontrun{
nad_dataset() |>
  dplyr::filter(state == "OH", county_fips == "39017") |>
  dplyr::select(uuid, address_number, street_name, longitude, latitude) |>
  dplyr::collect()
} # }