PySpark-Confluent-Kafka-Apache-Drill-

(★ 28)

A code-based tutorial for production level data streaming with PySpark plus Optimus for data cleaning, Confluent Kafka, & Apache Drill using Docker and Cassandra (NoSQL DB) for storage; This allows for for fast feature engineering and data cleaning.

PySpark-Confluent-Kafka-Apache-Drill- 최신버젼 다운로드

최종 버전 다운로드 (.zip)
// repository documentation