You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

执行Pandas的pd.read_table读取TSV文件时触发ParserError求助

解决pd.read_table读取Chipotle数据时的ParserError问题

Hey there! Let's work through that ParserError you ran into when using pd.read_table to load the Chipotle dataset. This error usually pops up when pandas can't parse the data correctly—most often because the downloaded content is incomplete (thanks to network blips) or there's a tiny formatting hiccup. Here are a few fixes you can try:

1. 显式指定编码并确认URL

首先,你的URL是正确的,但有时候显式指定编码能避免解析时的字符问题,试试这段代码:

import pandas as pd
k1 = pd.read_table("https://raw.githubusercontent.com/justmarkham/pandas-videos/master/data/chipotle.tsv", encoding='utf-8')

2. 跳过有问题的行(适用于pandas 1.3.0及以上版本)

如果数据里存在少数格式异常的行,用on_bad_lines参数跳过它们就能正常解析了:

k1 = pd.read_table("https://raw.githubusercontent.com/justmarkham/pandas-videos/master/data/chipotle.tsv", on_bad_lines='skip')

3. 先验证下载的内容是否正常

有时候网络波动会导致你下载的不是完整的TSV文件,而是部分内容甚至错误页面。可以用requests先检查获取到的内容:

import requests
from io import StringIO
import pandas as pd

url = "https://raw.githubusercontent.com/justmarkham/pandas-videos/master/data/chipotle.tsv"
response = requests.get(url)
# 打印前500个字符,确认是不是正常的TSV格式数据
print(response.text[:500])
# 再从响应内容中读取数据
k1 = pd.read_table(StringIO(response.text), sep='\t')

如果打印出来的是HTML内容(比如404错误页面),那说明你的网络请求没有成功获取到目标数据,可能需要检查网络连接或者换个网络环境试试。

4. 下载文件到本地再读取

如果网络问题一直存在,直接绕开网络限制:

  • 在浏览器中打开那个URL,把页面内容复制下来,保存成本地文件chipotle.tsv
  • 然后读取本地文件:
k1 = pd.read_table("chipotle.tsv")

这些方法应该能帮你解决ParserError,顺利加载数据集!

内容的提问来源于stack exchange,提问作者prvreddy

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.20 11:08:47