我想用map-L2L3Map的值替换column-PRIMARY_CATEGORY中的值。(ClosureCleaner.scala:108) at org.apache.spark.rdd.RDD$$anonfun$mapPartitionsWithIndex$1.apply(RDD.scala:841
我有一个格式为((x,y),( sim,sim'))的SparkRDD,其中x和y是两个索引,sim和sim‘是x和y的两个不同的相似性度量。我有兴趣寻找具有最大sim’值的元组。方法1在每个分区中查找具有最大sim‘值的配对,然后在返回的配对列表中选择具有最大sim’的配对。(BlockManager.scala:661)
at org.apache.spark.rdd.RDD.getOrCompute(RDD<