如何从数据集第二列的每行内容中移除‘year olds’?
移除数据集第二列中的‘year olds’字符串
以下是几种常用的解决方法:
Python pandas 处理
- 导入库并读取数据集:
import pandas as pd # 替换为你的数据集路径,支持csv/excel等格式 df = pd.read_csv('your_data.csv') - 直接替换掉‘year olds’字符串(保留原内容中的数字部分):
# iloc[:,1] 表示选中第二列(索引从0开始计数) df.iloc[:, 1] = df.iloc[:, 1].str.replace(' year olds', '', regex=False) - 如果只需要提取数字部分:
df.iloc[:, 1] = df.iloc[:, 1].str.extract('(\d+)', expand=False) - 处理完成后保存清理后的数据集:
df.to_csv('cleaned_data.csv', index=False)
Excel 可视化处理
- 选中数据集的第二列
- 使用快捷键
Ctrl+H打开替换窗口 - 在「查找内容」输入框中填写
year olds,「替换为」输入框留空 - 点击「全部替换」即可完成批量处理
内容的提问来源于stack exchange,提问作者Aidan
相关产品推荐
相关产品推荐

