df.duplicated()未识别重复:为何索引1显示False而非True?
问题解析:为什么
df.duplicated()索引1返回False? 你的两行数据并非重复行,这是导致结果不符合预期的核心原因。
看你创建的DataFrame:
import pandas as pd df = pd.DataFrame({'A':['1','2'], 'B':['1','2'], 'C':['1','2']})
索引0的行是A='1', B='1', C='1',索引1的行是A='2', B='2', C='2',两行的每一列值都完全不同。而Pandas的duplicated()方法默认逻辑是:只有当某一行的所有列值和之前已出现的行完全一致时,才会标记为True(重复)。
所以这两行不存在重复关系,duplicated()返回的结果自然都是False。
如果要得到你预期的输出,需要让两行的列值完全相同,比如修改代码为:
df = pd.DataFrame({'A':['1','1'], 'B':['1','1'], 'C':['1','1']}) print(df.duplicated())
此时输出会是:
0 False 1 True dtype: bool
内容的提问来源于stack exchange,提问作者Hello World
相关产品推荐
相关产品推荐

