使用Python同步CSV数据到Google Sheets首列丢失问题求助
问题根因
首列丢失的核心原因是pandas读取CSV时自动将首列识别为行索引(index)而非普通数据列,而Azulejos.values默认不会包含索引内容,因此同步到Google Sheets时就会丢失该列数据。你提供的打印输出也可验证这点:公司名称内容显示在列名行的左侧,属于pandas的索引展示区域,并未计入统计的59个普通列中。
解决方案(二选一即可)
方案1:调整CSV读取参数,避免首列被识别为索引
在pd.read_csv中添加index_col=None参数,强制pandas将所有列识别为普通数据列:
Azulejos = pd.read_csv( 'IMPORTACIONES-2021-01-01-2021-08-31--6907.23.00.000E (2).csv', sep=";", encoding="latin-1", na_filter=False, index_col=None # 新增该参数 )
修改后可通过print(Azulejos.columns)验证,列数会变为60,第一列即为公司名称列。
方案2:将已有索引重置为普通列
如果不需要调整读取逻辑,可直接对已读取的DataFrame执行重置索引操作,将当前存储公司名称的索引转为普通数据列:
# 重置索引,将索引内容转为名为Importador (prob.)的普通列 Azulejos = Azulejos.reset_index(names='Importador (prob.)')
完成上述任意一种修改后,再执行原有的Google Sheets同步代码即可,首列公司名称会正常同步。可先执行print(Azulejos.head())确认数据结构无误后再同步。
内容的提问来源于stack exchange,提问作者Julian Ruggiero
相关产品推荐
相关产品推荐

