从GitHub直接读取CSV文件时出现ParserError的问题求助
从GitHub直接读取CSV文件时出现ParserError的问题求助
嗨,我来帮你排查这个问题~
你遇到的ParserError其实是因为用的URL不对!当前你复制的https://github.com/marcopeix/AppliedTimeSeriesAnalysisWithPython/tree/main/data/jj.csv是GitHub上该文件的网页展示链接,不是原始CSV文件的直接访问链接。pd.read_csv()会尝试解析这个URL返回的内容,但它拿到的其实是GitHub的网页HTML代码,而非真正的CSV数据,自然就会出现分词错误(毕竟HTML的结构和CSV完全不一样)。
而你本地读取时没问题,是因为本地文件就是纯粹的CSV格式内容,没有多余的HTML代码干扰,所以pandas能正常解析。
解决方法很简单:获取原始文件的URL
- 打开你要访问的CSV文件在GitHub上的页面(就是你现在用的那个URL)
- 找到页面右上角的Raw按钮(在"Code"按钮旁边),点击它
- 此时浏览器地址栏里的链接就是可以直接读取的原始CSV文件地址,把它复制下来替换原来的
url变量
修改后的代码示例:
import pandas as pd # 替换为Raw按钮对应的原始文件链接 url = 'https://raw.githubusercontent.com/marcopeix/AppliedTimeSeriesAnalysisWithPython/main/data/jj.csv' df = pd.read_csv(url)
这样就能正常从GitHub直接读取CSV文件啦~
备注:内容来源于stack exchange,提问作者locus
相关产品推荐
相关产品推荐

