如何通过类SQL语句从现有DataFrame生成新统计DataFrame?
用类SQL语句统计DataFrame中zone和script组合的出现次数
嘿,我来帮你搞定这个需求!你想要基于现有的df1,用类SQL语句生成新的DataFrame df2,统计每个zone和script组合的出现次数,对吧?
实现步骤:
我们可以借助pandasql库来实现类SQL的查询操作,它能让我们直接在pandas DataFrame上写SQL语句。
- 第一步:如果还没安装
pandasql,先执行安装命令:
pip install pandasql
- 第二步:编写代码执行查询:
import pandas as pd from pandasql import sqldf # 假设你的df1已经按给定结构存在 # 编写类SQL查询语句 query = """ SELECT zone, script, COUNT(*) AS occurrence_count FROM df1 GROUP BY zone, script """ # 执行查询生成df2 df2 = sqldf(query, globals()) # 查看生成的结果 print(df2)
结果说明:
这段SQL语句会按照zone和script两个字段分组,统计每组的出现次数并命名为occurrence_count。针对你提供的df1数据,每个zone+script组合都只出现一次,所以结果里的occurrence_count都会是1;如果后续数据中有重复的组合,这个统计会自动计算出正确的重复次数。
内容的提问来源于stack exchange,提问作者RustyShackleford
相关产品推荐
相关产品推荐

