You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python读取CSV文件时字段引号问题:修复排序去重后的列表异常

解决方案

核心思路:先清洗数据去除多余单引号,再进行去重排序

直接上适配你场景的可运行代码:

import pandas as pd

# 替换成你的CSV文件路径
df = pd.read_csv('your_data.csv')

# 清洗reason列:仅移除首尾的单引号(只影响带引号的'business')
df['reason'] = df['reason'].str.strip("'")

# 去重→排序→转成有序列表
sorted_unique_reasons = df['reason'].drop_duplicates().sort_values().tolist()

print(sorted_unique_reasons)

关键细节说明

  • str.strip("'"):只移除字符串首尾的单引号,不会改动其他正常内容(比如allow、school完全不受影响),完美匹配你只有'business'带单引号的场景
  • 如果后续数据出现中间带单引号的特殊情况(比如'bus'iness'),可以改用str.replace("'", "")移除所有单引号,但前者更贴合当前需求且更安全
  • drop_duplicates() 剔除重复值,sort_values() 按字母顺序排序,tolist() 把pandas的Series对象转成普通Python列表

内容的提问来源于stack exchange,提问作者AJ E.

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.11 01:45:33