Package com.dataai.etl.spark.functions
Class AnalyticsFunctions
java.lang.Object
com.dataai.etl.spark.functions.AnalyticsFunctions
-
Method Summary
Modifier and TypeMethodDescriptionstatic org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>correlations(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, List<String> numericFields) static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>correlationThreshold(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, List<String> numericFields, double minimumAbsoluteCorrelation, String direction) static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>groupedSummary(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, List<String> groupFields, String valueField, Aggregation aggregation) static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>linearRegression(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, String xField, String yField, String groupField, Double predictionX) static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>pivot(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, String rowField, String columnField, String valueField, Aggregation aggregation) static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>ranking(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, String rankField, List<String> withinGroupFields, String valueField, Aggregation aggregation, RankMode mode, int limitPerGroup) static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row>variance(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, List<String> groupFields, String compareField, String baseValue, String comparisonValue, String valueField, Aggregation aggregation)
-
Method Details
-
groupedSummary
public static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> groupedSummary(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, List<String> groupFields, String valueField, Aggregation aggregation) -
pivot
public static org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> pivot(org.apache.spark.sql.Dataset<org.apache.spark.sql.Row> input, String rowField, String columnField, String valueField, Aggregation aggregation) -
variance
-
ranking
-
correlations
-
correlationThreshold
-
linearRegression
-