如何从Pandas DataFrame的distance列中移除特定字符串'km'?
移除Distance列中的"km"字符串并处理0.0值
- 先构建原数据并导入依赖库:
import pandas as pd # 模拟用户提供的原始数据 data = { 'distance': ['114 km', '114 km', '9.1 km', '33.1 km', '182 km', '93.2 km', '40.4 km', '0.0', '0.0', '43.4 km'] } df = pd.DataFrame(data)
- 执行数据处理逻辑:
# 移除" km"后缀,同时将"0.0"转为空字符串 df['distance'] = df['distance'].str.replace(' km', '', regex=False).replace('0.0', '')
- 处理后输出结果:
0 114 1 114 2 9.1 3 33.1 4 182 5 93.2 6 40.4 7 8 9 43.4 Name: distance, dtype: object
说明
str.replace(' km', '', regex=False)是精准匹配带空格的"km"后缀,避免误处理其他含"km"的异常文本.replace('0.0', '')直接将原数据中的"0.0"转换为空字符串,完全匹配需求格式
内容的提问来源于stack exchange,提问作者Jonas S
相关产品推荐
相关产品推荐

