sumanthn/spark-query
Query dataset using SparkSQL
Ingest , process, query, report large amounts of data
This repository is cataloged as part of our automated global GitHub synchronization. Full telemetry, velocity snapshots, and code summaries are scheduled for continuous enrichment.
Query dataset using SparkSQL
Aggregation computation with apache spark
Aggregation based on hashing
Data generator mimics access log