在Spyder中如何实现Pandas DataFrame链式调用的print输出?
给Pandas DataFrame添加链式调用的print方法
在Spyder用runfile运行脚本时,单独写表达式不会自动输出结果,必须套print(),但把一长串链式调用整个包进print()里又麻烦,还得调整缩进。这里给你两个简单方法,实现直接在链式末尾加.print()输出DataFrame:
方法1:临时猴子补丁(快速上手)
直接给pd.DataFrame加个print方法,适合临时探索分析用:
import pandas as pd # 给所有DataFrame添加print方法 pd.DataFrame.print = lambda self: print(self)
之后你的链式调用就能直接这么写:
dfShipName[['ShpNm','ShipNamesPrShpNm']] \ .drop_duplicates() \ .groupby('ShipNamesPrShpNm',as_index=False)['ShipNamesPrShpNm'] \ .agg(['count']) \ .rename(columns={'count':'nShpNm'}) \ .sort_values(by='nShpNm',ascending=False) \ .head(20).print()
不想输出的时候,直接把.print()注释掉就行,不用动前面的链式代码。
方法2:自定义访问器(更规范安全)
如果不想污染原生DataFrame类,用Pandas官方推荐的自定义访问器更稳妥:
import pandas as pd @pd.api.extensions.register_dataframe_accessor("debug") class DebugAccessor: def __init__(self, pandas_obj): self._obj = pandas_obj def print(self): print(self._obj) # 要是想继续链式调用其他方法,可以返回原DataFrame # return self._obj
用法改成:
dfShipName[['ShpNm','ShipNamesPrShpNm']] \ .drop_duplicates() \ .groupby('ShipNamesPrShpNm',as_index=False)['ShipNamesPrShpNm'] \ .agg(['count']) \ .rename(columns={'count':'nShpNm'}) \ .sort_values(by='nShpNm',ascending=False) \ .head(20).debug.print()
这个方法不会影响原生方法,也能快速注释开关输出,适合长期使用。
内容的提问来源于stack exchange,提问作者user2153235
相关产品推荐
相关产品推荐

