如何使用plydata的query命令基于预定义变量值筛选数据行
使用plydata的query命令基于固定变量筛选数据行
plydata的query()命令支持通过Python格式化字符串(f-string)语法直接引用外部已定义的固定变量,实现数据行的筛选,具体操作如下:
核心用法
在query()的筛选字符串参数中,用{变量名}的格式嵌入预先定义好的变量,即可让筛选逻辑基于这些变量的值执行。
完整示例代码
# 预先定义筛选用的固定值变量 lower_age_limit = 10 upper_age_limit = 40 # 使用plydata管道+query命令筛选年龄在指定区间的数据行 titanic_data >> query('age > {lower_age_limit} & age < {upper_age_limit}')
关键说明
- 用于筛选的变量需要在当前代码作用域中提前定义,确保
query()能正常读取到它们的值 - 筛选字符串里的逻辑运算符(如
>、<、&)要符合pandas的query语法规则,&代表逻辑与,多条件可通过它连接 - 这种方式同样适用于字符串、布尔值等其他类型的变量,只要在筛选字符串中正确嵌入即可
内容的提问来源于stack exchange,提问作者Ransingh Satyajit Ray
相关产品推荐
相关产品推荐

