加载Iris数据集时遇ValueError:不允许重复名称,求助解决
解决加载Iris数据集时的"不允许重复名称"错误
错误根源
你编写的代码中,names列表存在两个重复的petal-width字段,且列表长度(6个元素)与Iris数据集的实际列数(5列)不匹配,这直接导致了ValueError: Duplicate names are not allowed,以及后续修改时可能出现的其他列数不匹配错误。
修正后的代码
import pandas as pd url = "https://archive.ics.uci.edu/ml/machine-learning-databases/iris.data" # 修正列名:移除重复项,确保列数与数据集一致(5列) names = ['sepal-length', 'sepal-width', 'petal-length', 'petal-width', 'class'] dataset = pd.read_csv(url, names=names) # 验证输出,查看数据集前5行 print(dataset.head())
修正说明
- 移除重复列名:确保
names列表中每个列名唯一,符合pandas对DataFrame列名的要求。 - 匹配列数:Iris数据集包含4个花卉特征列和1个类别列,共5列,修正后的
names列表长度与之完全对应。
执行修正后的代码,即可得到包含正确列名的Iris数据集,与你期望的输出一致。
内容的提问来源于stack exchange,提问作者Varun Prakash
相关产品推荐
相关产品推荐

