如何去除pandas to_csv生成DAT文件首尾的双引号?
解决pandas to_csv生成.dat文件首尾出现双引号的问题
直接给出可行的参数组合方案,核心是通过to_csv的参数彻底禁用不必要的引号输出:
import csv import pandas as pd # 假设你的DataFrame名为df df.to_csv('output.dat', sep='|', quoting=csv.QUOTE_NONE, escapechar=None, index=False, header=True)
关键参数解析:
sep='|':指定列分隔符为竖线,匹配需求的输出格式quoting=csv.QUOTE_NONE:完全禁用所有引号输出,这是消除首尾双引号的核心设置,使用前需导入csv模块escapechar=None:无需设置转义字符,因为已经禁用了引号功能index=False:避免输出多余的行索引列(如果业务不需要索引可保留此设置)header=True:保留表头行,若不需要表头可改为False
如果执行后仍存在引号,需检查DataFrame本身的数据是否包含首尾双引号,可先对字符串列做清洗:
# 批量清洗所有字符串列的首尾引号 df = df.apply(lambda col: col.str.strip('"') if col.dtype == 'object' else col)
注意:不要直接用replace处理整个文件内容,容易误改数据中合法的引号字符,优先通过to_csv的参数控制输出格式。
内容的提问来源于stack exchange,提问作者Arpit Jain
相关产品推荐
相关产品推荐

