You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用gsub/sub提取文本字符串中的中间部分?

解决R字符串提取日期的问题

原代码的问题在于正则表达式里的.会匹配日期的第一个字符,导致提取结果缺失首字符。可以调整正则,精准捕获day-到--之间的日期内容:

dd <- c ("2day-2023-1-5--20-0.csv", "1day-2023-2-5--20-0.csv", "3day-2021-1-5--20-0.csv")
sub(".*day-(.*?)--.*", "\\1", dd)

运行后输出:

"2023-1-5" "2023-2-5" "2021-1-5"

正则说明:

  • .*day-:匹配字符串开头到day-的所有内容
  • (.*?):非贪婪匹配,精准捕获day-之后到第一个--之前的内容,避免过度匹配
  • --.*:匹配--及之后的所有内容

如果要更严谨,只提取符合数字-数字-数字格式的日期部分,可用以下正则:

sub(".*day-(\\d+-\\d+-\\d+)--.*", "\\1", dd)

内容的提问来源于stack exchange,提问作者GrBa

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.27 02:32:01