Python中NLTK stopwords资源缺失及SSL证书错误解决求助
解决NLTK stopwords资源下载及SSL证书问题
方法一:代码内禁用SSL验证
直接在代码开头添加SSL绕过逻辑,再执行资源下载:
import nltk import ssl # 绕过SSL证书验证 try: _create_unverified_https_context = ssl._create_unverified_context except AttributeError: pass else: ssl._create_default_https_context = _create_unverified_https_context # 下载stopwords资源 nltk.download('stopwords') # 正常调用stopwords from nltk.corpus import stopwords english_stop_words = set(stopwords.words('english'))
方法二:手动放置资源包
- 获取NLTK官方的
stopwords资源压缩包,解压得到stopwords文件夹 - 在Python中运行以下代码查看NLTK的数据存储路径:
import nltk print(nltk.data.path)
- 选择输出路径中的任意一个(比如
~/nltk_data),若该路径下无corpora文件夹则新建 - 将解压后的
stopwords文件夹放入corpora目录 - 直接运行原代码即可调用stopwords资源
方法三:命令行指定HTTP源下载
命令行下载时改用HTTP源规避SSL验证问题:
python3 -m nltk.downloader -d ~/nltk_data stopwords --url http://nltk.github.com/nltk_data/
注:-d参数后的路径需与nltk.data.path输出的路径一致,确保NLTK能识别资源位置。
内容的提问来源于stack exchange,提问作者My Car
相关产品推荐
相关产品推荐

