Python入门求助:这段Pandas代码的含义及解读方法
这段Pandas代码的逐行解读
第一行代码:
col_desc = pd.read_csv('/content/drive/MyDrive/zenius/Home-Credit/HomeCredit_columns_description.csv', encoding='Latin-1')- 调用Pandas的
read_csv()函数,读取谷歌云盘(路径/content/drive/MyDrive/...是Colab挂载的云盘路径)里的HomeCredit_columns_description.csv文件,把读取到的表格数据存入col_desc变量,这个变量是Pandas的DataFrame(类似Excel表格的结构)。 - 指定
encoding='Latin-1'是为了适配文件的字符编码,防止读取时出现乱码问题。
- 调用Pandas的
第二行代码:
col_desc[col_desc['Table'] == "application_{train|test}.csv"]- 从
col_desc这个表格里筛选数据:先取出名为Table的列,判断该列的每个值是否等于application_{train|test}.csv,得到一组True/False的判断结果;再用这组结果去过滤原表格,只保留判断结果为True的行。 - 这里的
application_{train|test}.csv是一种写法,实际对应application_train.csv和application_test.csv两个文件,目的是筛选出描述这两个文件中列信息的所有行。
- 从
内容的提问来源于stack exchange,提问作者Black Lotus
相关产品推荐
相关产品推荐

