A Spark module for structured data processing. It provides a programming abstraction called DataFrames and can also act as a distributed SQL query engine. It enables unmodified Hadoop Hive queries to run up to 100x faster on existing deployments and data.
Sign up for updates straight to your inbox
This website uses cookies
We use cookies to continuously improve your experience on our site. More info.