我有一个数据帧,其中有几个数值列是不固定的(它们在每次执行过程中都会发生变化)。假设我有一个带有数字列名称的Seq对象。我想对这些列中的每一列应用一个聚合函数。,exprs: org.apache.spark.sql.Column*)org.apache.spark.sql.DataFrame <and>
(ex
我们使用Spark的SQL对集群上的Hive表执行查询。如何对查询中的列执行REPARTITION ( SQL-API )?请注意,我们不使用Dataframe,而是使用SQL (例如,SELECT * from table WHERE col = 1)。我理解PySpark在Dataframe API中提供了一个相同