我正在尝试用以下方式过滤我的pyspark数据框:我有一个包含long_text的列和一个包含数字的列。如果长文本包含我想要保留的列的number。我正在尝试使用SQL LIKE语句,但似乎不能将其应用于另一列(这里是number)我的代码如下: from pyspark.sql.functions import regexp_extract, col, concat, l
我有一个有10609行的dataframe,我希望一次将100行转换为JSON,并将它们发送回一个webservice。我尝试使用SQL的限制子句,如这将返回前100行,但如果我想要下::org.apache.spark.sql.catalyst.parser.ParseException:不匹配的输入“,”期望(第1行,pos 44)
select it