You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用pd.read_csv读取含引号内逗号的CSV文件失败求助

解决pandas读取CSV时含转义引号行的解析问题

你的CSV格式有两个关键问题导致解析失败:

  • 字段内的双引号用两个连续双引号进行转义(符合CSV标准,但需要显式开启对应解析规则)
  • 每行结尾带有分号,干扰了默认的行终止逻辑

直接用以下参数组合即可正常解析:

import pandas as pd

df = pd.read_csv(
    "你的文件名.csv",
    sep=",",
    quotechar='"',
    doublequote=True,  # 核心:识别双引号转义(两个""代表一个")
    lineterminator=";",  # 指定行结束符为分号,避免把分号当成字段内容
    engine="python"  # 处理复杂格式时python引擎兼容性更好
)

参数说明

  • doublequote=True:这是解决引号内逗号解析错误的核心,告诉pandas将CSV中的""解析为实际的",从而正确识别被引号包裹的含逗号字段。
  • lineterminator=";":你的每行数据以分号结尾,指定这个参数后,pandas会把分号当作行的结束标记,而不是字段的一部分。
  • engine="python":默认的C引擎在处理非标准或复杂CSV时可能出现兼容性问题,切换到Python引擎能更好地处理这类转义和行终止符的组合场景。

如果不想指定行终止符,也可以先读取再清理最后一列的分号:

df = pd.read_csv(
    "你的文件名.csv",
    sep=",",
    quotechar='"',
    doublequote=True,
    engine="python"
)
# 移除最后一列末尾的分号
df.iloc[:, -1] = df.iloc[:, -1].str.rstrip(";")

测试后,原本被错误归入第一列的行会被拆分为正确的多列,不会出现NaN值。

内容的提问来源于stack exchange,提问作者Bruno Egan

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.17 08:05:21