如何将给定的nltk text2处理代码改写为输出一致的Python3函数
实现代码
你可以直接把原有逻辑封装为可复用函数,以下是两种实现方案,输出结果和你提供的参考代码完全一致:
灵活可配置版本(推荐)
from nltk.book import text2 def filter_sort_corpus_words(corpus=text2, min_length=5, max_length=11): # 筛选符合长度要求的单词转小写后排序,默认参数完全匹配原代码的筛选规则 target_words = [word.lower() for word in corpus if min_length <= len(word) <= max_length] return sorted(target_words) # 直接调用即可得到和原代码相同的结果 output = filter_sort_corpus_words()
这个版本支持自定义输入语料、长度筛选阈值,复用性更高。
极简固定逻辑版本
如果不需要额外扩展能力,只要完全还原原有逻辑可以用这个版本:
from nltk.book import text2 def get_processed_text2_words(): return sorted([word.lower() for word in text2 if len(word) > 4 and len(word) < 12])
内容的提问来源于stack exchange,提问作者sarkle
相关产品推荐
相关产品推荐

