使用patentpy导出CSV时最后一列内容换行问题求助
解决patentpy导出CSV最后一列自动换行问题
CSV文件最后一列自动换行,本质是字段内容本身包含内嵌换行符,而默认的CSV写入逻辑没有正确用引号包裹这些特殊内容,导致读取工具(如Excel)误将内嵌换行识别为单元格分隔。可以通过以下两种方式解决:
方法1:手动用Pandas处理CSV写入(推荐)
先获取数据对象,再通过Pandas的to_csv方法强制所有字段加引号,包裹内嵌换行:
from patentpy.acquire import get_bulk_patent_data import pandas as pd import csv # 获取专利数据(不直接写入文件) df = get_bulk_patent_data(year=2023, week=1, output_file=None) # 写入CSV,开启全字段引用 df.to_csv(r"E:\test.csv", quoting=csv.QUOTE_ALL, index=False)
quoting=csv.QUOTE_ALL:强制所有字段用双引号包裹,确保内嵌换行、逗号等特殊字符不会破坏CSV结构- 路径用原始字符串
r"E:\test.csv"避免转义问题
方法2:检查patentpy参数(如果版本支持)
查看patentpy的get_bulk_patent_data是否支持传递CSV写入参数,部分版本可能允许直接传入quoting或其他csv模块参数:
from patentpy.acquire import get_bulk_patent_data import csv get_bulk_patent_data(year=2023, week=1, output_file=r"E:\test.csv", quoting=csv.QUOTE_ALL)
如果该参数不被支持,优先用方法1。
内容的提问来源于stack exchange,提问作者PhD Student
相关产品推荐
相关产品推荐

