Windows环境下Spark WordCount代码运行报错UnsupportedOperationException求助
问题解决步骤
1. 修正Maven依赖配置
你的pom.xml里Spark依赖的artifactId存在错误,针对Scala 2.12版本的Spark核心依赖,artifactId应为spark-core_2.12;同时需要添加适配Windows环境的Hadoop客户端依赖,避免本地库缺失引发的问题。修正后的pom.xml如下:
<?xml version="1.0" encoding="UTF-8"?> <project xmlns="http://maven.apache.org/POM/4.0.0" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation="http://maven.apache.org/POM/4.0.0 http://maven.apache.org/xsd/maven-4.0.0.xsd"> <modelVersion>4.0.0</modelVersion> <groupId>org.example</groupId> <artifactId>untitled1</artifactId> <version>1.0-SNAPSHOT</version> <properties> <project.build.sourceEncoding>UTF-8</project.build.sourceEncoding> <scala.version>2.12.15</scala.version> <spark.version>3.3.0</spark.version> <hadoop.version>3.3.4</hadoop.version> </properties> <dependencies> <!-- Spark Core依赖 --> <dependency> <groupId>org.apache.spark</groupId> <artifactId>spark-core_2.12</artifactId> <version>${spark.version}</version> </dependency> <!-- Hadoop客户端依赖,适配Windows --> <dependency> <groupId>org.apache.hadoop</groupId> <artifactId>hadoop-client</artifactId> <version>${hadoop.version}</version> </dependency> </dependencies> </project>
2. 配置Windows本地Hadoop库
Spark依赖Hadoop的本地IO库,Windows环境下需手动配置:
- 下载对应Hadoop版本(如3.3.4)的Windows二进制包(包含winutils.exe等文件),解压到本地目录(例如
D:\hadoop-3.3.4)。 - 设置系统环境变量:
- 新建
HADOOP_HOME,值为解压路径(D:\hadoop-3.3.4)。 - 将
%HADOOP_HOME%\bin添加到系统PATH变量中。
- 新建
- 也可在IDEA的运行配置中添加VM参数替代系统环境变量配置:
-Djava.library.path=D:\hadoop-3.3.4\bin
3. 调整代码中的路径与配置
- 确保输入文件路径
datas/words存在,Windows环境下建议使用绝对路径避免歧义,比如"D:/datas/words"。 - 保存结果的路径
datas/words/result不能提前存在,Spark会自动创建该目录,若已存在需先删除。 - 若上述配置仍未解决问题,可在SparkConf中添加安全管理器相关配置作为临时 workaround(优先推荐前面的依赖与库配置):
val conf = new SparkConf() .setMaster("local[*]") .setAppName("WordCount") .set("spark.driver.extraJavaOptions", "-Djava.security.manager=allow")
4. 验证运行
重新加载Maven依赖,清理并重新构建项目,然后运行WordCount程序,观察错误是否解决。
内容的提问来源于stack exchange,提问作者AKCqhzdy
相关产品推荐
相关产品推荐

