Python读取CSV后mileage列值前出现\n\n的问题咨询
解决CSV读取后mileage列前出现\n\n的问题
问题描述
在Excel中查看mileage列时显示正常(如第一行是“35 kmpl”),但用Python的pandas读取对应CSV文件后,该列每个值前都带有\n\n,需要去除这些多余换行符,保留“X kmpl”格式的数值。
解决方案
通过pandas的字符串处理方法即可快速清理多余字符,以下两种方式都能解决问题:
修改后的代码
import pandas as pd from sklearn.tree import DecisionTreeClassifier # 读取CSV文件 bikes = pd.read_csv('/content/bikes sorted final.csv') # 方式1:移除mileage列字符串首尾的所有空白字符(包括\n\n、空格等) bikes['mileage'] = bikes['mileage'].str.strip() # 方式2:精准替换掉特定的\n\n(确定只有该多余字符时可用) # bikes['mileage'] = bikes['mileage'].str.replace('\n\n', '') # 打印处理后的数据 print(bikes)
说明
str.strip():会统一移除字符串开头和结尾的所有空白类字符(换行符\n、空格、制表符\t等),适合处理多种可能的多余空白场景。str.replace('\n\n', ''):仅针对\n\n进行精准替换,若确认数据中只有这一种多余字符,使用该方法更直接。
内容的提问来源于stack exchange,提问作者lucyinthesky
相关产品推荐
相关产品推荐

