You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python实现:找出两个文件中频率大于1的共同单词

嘿,我来帮你搞定这个问题!既然你已经用字典存储了两个文件的单词出现次数(应该是指这个吧?😂),那接下来筛选目标单词的逻辑其实很直接,咱们一步步来:

核心思路
  • 第一步:先找出两个字典中共同存在的单词——也就是同时出现在两个文件里的单词,用集合的交集操作就能快速搞定
  • 第二步:遍历这些共同单词,筛选出在两个字典里出现次数都大于1的单词
代码示例(Python)

假设你已经有两个处理好的字典,分别是file1_word_counts(存储第一个文件的单词-次数映射)和file2_word_counts(第二个文件的),直接用这段代码就能得到结果:

# 获取两个文件中都出现的单词集合
common_words = set(file1_word_counts.keys()) & set(file2_word_counts.keys())

# 筛选出两边次数都大于1的单词
target_words = [
    word for word in common_words
    if file1_word_counts[word] > 1 and file2_word_counts[word] > 1
]

# 输出结果
print("符合条件的单词:", target_words)
额外小提示

如果你的单词还没做过标准化处理,建议先预处理一下:

  • 统一转成小写:避免"Apple"和"apple"被当成不同单词
  • 去除标点:比如把"hello,"和"hello"统一成同一个词,处理方式可以用word.strip('.,!?;:').lower()这类方法

内容的提问来源于stack exchange,提问作者user2717225

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.20 08:06:23