如何在R语言中提取仅包含特定单词"bunt"的字符串?
提取包含单词"bunt"的数据集行
你可以用R中的grepl()函数结合正则表达式的单词边界来精准匹配包含独立单词"bunt"的行,避免误匹配类似"bunted"这类衍生词。
实现代码
# 示例数据集 data <- data.frame(des=c("Austin Hedges bunt single", "Francisco Lindor Homerun", "Pete Alonso out on a ground ball bunt", "Yonathan Daza sac bunt ground out to shortstop", "Jose Ramirez pop up to second baseman")) # 筛选包含完整单词"bunt"的行 filtered_data <- data[grepl("\\bbunt\\b", data$des), ]
代码说明
\\bbunt\\b中的\b是正则表达式的单词边界,确保匹配的是独立的"bunt"单词,而非其他单词的组成部分- 如果需要忽略大小写匹配(比如同时匹配"Bunt"),可以添加
ignore.case = TRUE参数:grepl("\\bbunt\\b", data$des, ignore.case = TRUE) - 运行后
filtered_data即为仅包含"bunt"描述的数据集
内容的提问来源于stack exchange,提问作者user19422662
相关产品推荐
相关产品推荐

