Python中使用pandas读取CSV数据报错无法读取的问题咨询
问题排查与解决
核心问题分析
- 重复读取DataFrame:你已经通过
pd.read_csv将CSV文件加载为DataFrame对象data,却错误地再次调用pd.read_csv(data)尝试读取该对象,这是直接引发报错的原因。 - 数据类型混合警告:CSV文件的第85列存在混合数据类型,pandas分块加载时无法确定统一类型,因此抛出
DtypeWarning。
修正后的代码
import pandas as pd import sklearn from sklearn.datasets import load_iris # 加载CSV数据,添加参数解决类型混合警告 data = pd.read_csv('D:/Projects/FLGRU_Model/FLDataset/01-12/DrDoS_LDAP.csv', low_memory=False) # 直接赋值DataFrame,无需重复读取 df = data # 执行数据分析 df.head() # 显示前几行数据 df.describe() # 生成数据统计摘要
额外优化建议
- 若需要精准指定第85列的数据类型,可使用
dtype参数(示例假设该列为字符串类型):data = pd.read_csv('D:/Projects/FLGRU_Model/FLDataset/01-12/DrDoS_LDAP.csv', dtype={85: str}) low_memory=False会让pandas一次性加载整个文件以推断数据类型,避免分块加载时的类型冲突警告。
内容的提问来源于stack exchange,提问作者user24748686
相关产品推荐
相关产品推荐

