spark

nomad.io.spark.sample_users(data, frac_users=0.1, user_id='user_id')[source]

Return a sample of users using hashing without shuffle

nomad.io.spark.table_columns(path, include_schema=False, spark=None)[source]

Return column names or full schema of a parquet dataset (including partition columns).