You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

df.duplicated()未识别重复:为何索引1显示False而非True?

问题解析:为什么df.duplicated()索引1返回False?

你的两行数据并非重复行,这是导致结果不符合预期的核心原因。

看你创建的DataFrame:

import pandas as pd

df = pd.DataFrame({'A':['1','2'],
                   'B':['1','2'],
                   'C':['1','2']})

索引0的行是A='1', B='1', C='1',索引1的行是A='2', B='2', C='2',两行的每一列值都完全不同。而Pandas的duplicated()方法默认逻辑是:只有当某一行的所有列值和之前已出现的行完全一致时,才会标记为True(重复)。

所以这两行不存在重复关系,duplicated()返回的结果自然都是False。

如果要得到你预期的输出,需要让两行的列值完全相同,比如修改代码为:

df = pd.DataFrame({'A':['1','1'],
                   'B':['1','1'],
                   'C':['1','1']})
print(df.duplicated())

此时输出会是:

0    False
1    True
dtype: bool

内容的提问来源于stack exchange,提问作者Hello World

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.06 01:10:15