You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

在Jupyter中加载CSV文件时出现UnicodeDecodeError错误求助

解决Jupyter加载CSV时的UnicodeDecodeError错误

这个错误是因为你的CSV文件并非UTF-8编码,而Python默认使用UTF-8解码,导致无法识别特定字节。以下是几种可行的解决方法:

  • 指定已知的替代编码
    尝试用常见编码格式读取,比如latin-1、cp1252(适用于西欧语言文件)或gbk(适用于中文文件):

    import pandas as pd
    # 用latin-1编码读取
    df = pd.read_csv('your_file.csv', encoding='latin-1')
    # 或用cp1252编码
    df = pd.read_csv('your_file.csv', encoding='cp1252')
    
  • 自动检测文件编码
    借助chardet库自动识别文件编码:

    1. 先安装库:
      !pip install chardet
      
    2. 检测编码:
      import chardet
      with open('your_file.csv', 'rb') as f:
          detection_result = chardet.detect(f.read())
      print(f"检测到的编码:{detection_result['encoding']}")
      
    3. 使用检测到的编码读取:
      df = pd.read_csv('your_file.csv', encoding=detection_result['encoding'])
      
  • 忽略解码错误(临时应急)
    如果可以接受丢失部分特殊字符,可添加errors='ignore'参数跳过错误:

    df = pd.read_csv('your_file.csv', encoding='utf-8', errors='ignore')
    

    注意:此方法会丢弃无法解码的字符,可能导致数据缺失,仅建议临时使用。

内容的提问来源于stack exchange,提问作者Carlos Scharth

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.06 09:31:16