Eclipse导入GitHub项目文本编码异常,求有效解决办法
解决VnCoreNLP在Eclipse中运行输出乱码问题
问题描述
将GitHub上的VnCoreNLP项目导入Eclipse IDE运行后,输出出现乱码(异常输出为乱码字符,预期为正常越南语分词结果)。已尝试以下操作但未解决:
- 调整
Window/Preference/General/Workspace编码为UTF-8 - 修改
Window/Preference/General/Content Type中相关文件的编码为UTF-8 - 通过
Edit/Set Encoding设置文件编码为UTF-8 - 重装Eclipse
项目地址:https://github.com/vncorenlp/VnCoreNLP
解决方案
1. 配置JVM启动编码参数
Eclipse默认JVM参数可能未指定UTF-8编码,需手动添加:
- 右键项目 →
Run As→Run Configurations - 选中对应Java应用配置,切换到
Arguments标签页 - 在
VM arguments中添加:-Dfile.encoding=UTF-8 - 点击
Apply后重新运行项目
2. 修正控制台编码设置
- 打开Eclipse控制台,点击右上角下拉菜单(小三角图标)→
Preferences - 在
Console Encoding选项中选择UTF-8,点击Apply and Close - 重启控制台后重新运行项目
3. 检查Maven项目编码配置(若适用)
如果项目基于Maven,确保pom.xml中添加编码配置:
<properties> <project.build.sourceEncoding>UTF-8</project.build.sourceEncoding> <project.reporting.outputEncoding>UTF-8</project.reporting.outputEncoding> </properties>
执行mvn clean compile命令重新构建项目
4. 验证资源文件编码
- 找到项目中的资源文件(如
.properties、.txt等) - 右键文件 →
Properties→Resource,确认编码为UTF-8 - 若编码不符,修改后保存并重新运行
5. 尝试外部终端运行
若Eclipse控制台编码问题无法解决,可导出可运行JAR包,在系统终端(CMD/Terminal)中运行,确保终端默认编码为UTF-8后查看输出
内容的提问来源于stack exchange,提问作者P. Hammer Nick
相关产品推荐
相关产品推荐

