Spark 3.2.1中使用unionByName合并异列DataFrame报错求助
解决Spark Scala中unionByName的allowMissingColumns参数报错问题
你的报错原因很明确:Scala语言里的布尔值常量是小写的true,而你使用了Python风格的大写True,这属于基础语法错误,和Spark版本是否支持allowMissingColumns参数无关。
修正后的代码如下:
import spark.implicits._ val data = Seq(("1","[unassigned]")) val DefaultResponseDF = data.toDF("try_number","assessment_item_response_xid") val data2 = Seq(("2")) val DefaultResponseDF2 = data2.toDF("try_number") DefaultResponseDF.unionByName(DefaultResponseDF2, allowMissingColumns=true).show()
运行这段代码后,Spark会自动为缺失的列填充null值,顺利完成两个DataFrame的合并操作。
内容的提问来源于stack exchange,提问作者PriyalChaudhari
相关产品推荐
相关产品推荐

