如何结合pandas与dataclasses导入数据?遇AttributeError问题求助
错误原因及解决办法
核心错误原因
- 你执行
df = Collect("national_news_scrape.csv")后得到的df是Collect类的实例对象,不是pandas的DataFrame,所以它没有head()方法,这就是报错的根源。 - 你的
collect方法定义有误:作为类的实例方法,第一个参数必须是self(指代当前实例),否则调用时会把实例本身传给url参数,导致逻辑混乱;而且你也没调用这个方法去实际读取CSV生成DataFrame。
修正方案
方案1:初始化时自动加载数据
让类在实例化时自动读取CSV并把DataFrame存为实例属性,之后直接访问该属性即可调用head():
from dataclasses import dataclass import pandas as pd @dataclass class Collect: url: str df: pd.DataFrame = None def __post_init__(self): # 实例初始化完成后自动读取CSV self.df = pd.read_csv(self.url) # 实例化时自动加载数据 collect_instance = Collect("national_news_scrape.csv") # 调用DataFrame的head方法 collect_instance.df.head()
方案2:手动调用方法获取DataFrame
如果不想在初始化时加载数据,就修正collect方法的定义,之后手动调用它获取DataFrame:
from dataclasses import dataclass import pandas as pd @dataclass class Collect: url: str def collect(self): # 使用实例自身的url属性读取文件 return pd.read_csv(self.url) # 创建类实例 collect_instance = Collect("national_news_scrape.csv") # 调用collect方法得到DataFrame,再调用head() df = collect_instance.collect() df.head()
内容的提问来源于stack exchange,提问作者elksie5000
相关产品推荐
相关产品推荐

