Spark-SQL-on-HBase
Native, optimized access to HBase Data through Spark SQL/Dataframe Interfaces
File Explorer
Download Latest Version (.zip)- hbase-sql
- pyspark-hbase
- SparkSQLOnHBase_v2.2.docx
- README.md
- sales1m.csv.tar.gz
- spark-hbase-demo1.md
- spark-hbase-demo2.md
- spark-hbase-demo3.md
- teacher1k.csv
- __init__.py
- context.py
- __init__.py
- shell.py
- AdditionalComparatorsProtos.java
- CheckDirProtos.java
- AdditionalComparators.proto
- CheckDirService.proto
- PartialPredicateOperations.scala
- NotPusher.scala
- AddCoprocessor.scala
- hbaseCommands.scala
- HBaseSQLTableScan.scala
- HBaseStrategies.scala
- HBaseBytesType.scala
- PartialOrderingDataType.scala
- RangeType.scala
- bytesUtils.scala
- comparators.scala
- DataTypeUtils.scala
- HBaseKVHelper.scala
- Util.scala
- CheckDirEndPointImpl.scala
- HadoopReader.scala
- HBaseCatalog.scala
- HBaseCriticalPoint.scala
- HBaseCustomFilter.scala
- HBasePartition.scala
- HBasePartitioner.scala
- HBaseRelation.scala
- HBaseSerializer.scala
- HBaseShuffledRDD.scala
- HBaseSQLCliDriver.scala
- HBaseSQLConf.scala
- HBaseSQLContext.scala
- HBaseSQLDialect.scala
- HBaseSQLParser.scala
- HBaseSQLReaderRDD.scala
- IndexMappable.scala
- package.scala
- ScanPredClassifier.scala
- SparkSqlRegionObserver.scala
- JavaAPISuite.java
- .part-r-00001.gz.parquet.crc
- .part-r-00002.gz.parquet.crc
- _common_metadata
- _metadata
- _SUCCESS
- part-r-00001.gz.parquet
- part-r-00002.gz.parquet
- 131_regions.txt
- cf.txt
- joinTable1.txt
- joinTable2.txt
- joinTable3.txt
- joinTable4.txt
- loadData.txt
- loadNullableData.txt
- log4j.properties
- onecoljoin1.txt
- onecoljoin2.txt
- people.txt
- splitLoadData.txt
- splitLoadData1.txt
- store_sales.txt
- store_sales_stringformat.txt
- teacher.txt
- testTable.txt
- BytesUtilsSuite.scala
- CriticalPointsTestSuite.scala
- HBaseAdditionalQuerySuite.scala
- HBaseAdvancedSQLQuerySuite.scala
- HBaseAggregateQueriesSuite.scala
- HBaseBasicOperationSuite.scala
- HBaseBasicQueriesSuite.scala
- HBaseBulkLoadIntoTableSuite.scala
- HBaseCatalogTestSuite.scala
- HBaseCFTestSuite.scala
- HBaseInsertTableSuite.scala
- HBasePartitionerSuite.scala
- HBaseSQLQuerySuite.scala
- HBaseTpcMiniTestSuite.scala
- HBaseTpcStringFormatMiniTestSuite.scala
- TestBase.scala
- TestBaseWithNonSplitData.scala
- TestBaseWithSplitData.scala
- TestData.scala
- TestHbase.scala
- .gitignore
- LICENSE
- pom.xml
- README.md
- spark-hbase_2.10.iml
# Installation Guide
1. Get the code
git clone https://github.com/Huawei-Spark/Spark-SQL-on-HBase
Downloads the entire project code from GitHub to your computer.
cd Spark-SQL-on-HBase
Moves into the project folder you just downloaded.
2. Maven (Java)
Medium RecommendedPrerequisites
- Git Needed to download the project code from GitHub.
- JDK (Java) Required to build and run Java projects.
- Maven The build tool used for the mvn command.
$ mvn -DskipTests clean install
Installs dependencies and builds the project using Maven.
$ mvn clean install
Installs dependencies and builds the project using Maven.
mvn -Phbase,hadoop-2.4 test
Installs dependencies and builds the project using Maven.
mvn -Phbase,hadoop-2.4 test -DwildcardSuites=org.apache.spark.sql.hbase.BasicQueriesSuite
Installs dependencies and builds the project using Maven.
A BUILD SUCCESS message means it worked. The output is created under target/.
Pulled directly from this repo's README.
// repository documentation
Was this content helpful?
(0 ratings)
