在Pandas中读取含欧美特殊字符的CSV文件编码问题
解决CSV特殊字符乱码问题
你给出的乱码示例(
Üs本应为Üs、Ärz本应为Ärz)是典型的UTF-8编码内容被用ISO-8859-1/Latin-1解码的结果,但你试过UTF8仍无效的话,大概率文件实际编码是Windows-1252——它是ISO-8859-1的扩展集,包含更多欧洲特殊字符,先试试这个:pd.read_csv("file.csv", encoding='windows-1252')如果还是不行,建议先确认文件真实编码:
- 用VS Code、Notepad++这类文本编辑器打开文件,查看编辑器自动识别的编码
- 或者用Python的
chardet库检测:
把检测出的编码代入import chardet with open("file.csv", 'rb') as f: detect_result = chardet.detect(f.read()) print(detect_result['encoding'])pd.read_csv的encoding参数即可。
内容的提问来源于stack exchange,提问作者user7675621
相关产品推荐
相关产品推荐

