如何在Python的DataFrame列中提取唯一词汇并统计各词汇出现次数
Python实现DataFrame指定分隔符字段拆分与频次统计
完整实现代码
import pandas as pd # 示例输入数据,实际使用时替换为你自己的数据集读取逻辑 df = pd.DataFrame({ 'Movie': ['movie 1', 'movie 2'], 'genre': ['Action/Animation/Sci-Fi', 'Adventure/Animation/Drama/Mystery/Sci-Fi'] }) # 核心处理逻辑 result = ( df['genre'] .str.split('/') .explode() .value_counts() .reset_index() .rename(columns={'index': 'Genre', 'genre': 'count'}) ) print(result)
输出说明
运行后得到的result完全符合要求的输出格式:
| Genre | count |
|---|---|
| Sci-Fi | 2 |
| Animation | 2 |
| Action | 1 |
| Adventure | 1 |
| Drama | 1 |
| Mystery | 1 |
适配实际场景的调整点
- 从文件读取数据时,替换df构造代码为
df = pd.read_csv("你的文件路径")即可 - 若genre列存在空值,可在拆分前添加
.dropna()过滤:df['genre'].dropna().str.split('/')
内容的提问来源于stack exchange,提问作者Srikanth Ayithy
相关产品推荐
相关产品推荐

