Pandas读取CSV时FIPS列标题不显示,求技术指导
解决Pandas读取FIPS列及删除阿拉斯加行的问题
第一步:确认FIPS列的实际名称
新手常遇到列名带空格、隐藏字符或拼写不一致的问题,先读取文件并打印所有列名:
import pandas as pd # 替换为你的CSV文件路径 df = pd.read_csv("your_file.csv") # 打印所有列名,找到FIPS列的真实名称 print("所有列名:", df.columns.tolist())
如果列名有多余空格,先清理列名:
# 去除列名前后空格,转为小写(可选,方便后续调用) df.columns = df.columns.str.strip().str.lower() print("清理后的列名:", df.columns.tolist())
第二步:处理FIPS列数据类型
FIPS是5位编码(如02000),需确保是字符串类型(避免数字丢失前导零):
# 假设清理后的列名为"fips",替换为实际列名 # 如果原列是整数,先转字符串并补前导零到5位 df['fips'] = df['fips'].astype(int).astype(str).str.zfill(5) # 如果原列已是字符串,直接转字符串即可 # df['fips'] = df['fips'].astype(str)
第三步:删除阿拉斯加FIPS行
阿拉斯加FIPS以"02"开头(02000-02999),用筛选保留非阿拉斯加数据:
# 筛选出FIPS不以"02"开头的行 df_filtered = df[~df['fips'].str.startswith('02')] # 也可以用范围判断(字符串比较) # df_filtered = df[(df['fips'] < '02000') | (df['fips'] > '02999')] # 保存处理后的文件(index=False避免保存索引列) df_filtered.to_csv("filtered_data.csv", index=False)
额外排查:CSV编码问题
如果读取文件时乱码或列名异常,指定编码重试:
# 常见编码:utf-8, gbk, latin-1 df = pd.read_csv("your_file.csv", encoding='utf-8')
内容的提问来源于stack exchange,提问作者Rohan Sharma
相关产品推荐
相关产品推荐

