You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在Python的DataFrame列中提取唯一词汇并统计各词汇出现次数

Python实现DataFrame指定分隔符字段拆分与频次统计

完整实现代码

import pandas as pd

# 示例输入数据,实际使用时替换为你自己的数据集读取逻辑
df = pd.DataFrame({
    'Movie': ['movie 1', 'movie 2'],
    'genre': ['Action/Animation/Sci-Fi', 'Adventure/Animation/Drama/Mystery/Sci-Fi']
})

# 核心处理逻辑
result = (
    df['genre']
    .str.split('/')
    .explode()
    .value_counts()
    .reset_index()
    .rename(columns={'index': 'Genre', 'genre': 'count'})
)

print(result)

输出说明

运行后得到的result完全符合要求的输出格式:

Genrecount
Sci-Fi2
Animation2
Action1
Adventure1
Drama1
Mystery1

适配实际场景的调整点

  • 从文件读取数据时,替换df构造代码为df = pd.read_csv("你的文件路径")即可
  • 若genre列存在空值,可在拆分前添加.dropna()过滤:df['genre'].dropna().str.split('/')

内容的提问来源于stack exchange,提问作者Srikanth Ayithy

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.06 23:45:04