使用正则表达式提取HTML字符串中的身高体重值
提取身高体重值的正则方案
先看你提供的目标文本:
'"height": { "@type": "QuantitativeValue", "value": "6-1" }, "weight": {"@type": "QuantitativeValue", "value": "195 lbs" } }'
方案1:精准匹配指定键的value值
如果只针对height和weight的value提取,可用以下正则:
"height":\s*{\s*".*?"\s*:\s*".*?"\s*,\s*"value"\s*:\s*"([^"]+)"|\"weight\":\s*{\s*".*?"\s*:\s*".*?"\s*,\s*"value"\s*:\s*"([^"]+)"
该正则会分别捕获height对应的value(第一个捕获组)和weight对应的value(第二个捕获组)。
方案2:通用匹配所有value字段值
如果文本中还有其他同结构的value需要提取,或不想写死键名,可用更通用的正则:
"value"\s*:\s*"([^"]+)"
这个正则会匹配所有"value": "xxx"格式里的xxx,直接提取所有符合格式的内容,包括你需要的6-1和195 lbs。
匹配说明
[^"]+:匹配除双引号外的任意字符,确保只捕获双引号内的目标内容,不会超出范围\s*:匹配任意数量的空白字符(空格、换行、制表符),兼容文本中的排版空格
内容的提问来源于stack exchange,提问作者codextrmz
相关产品推荐
相关产品推荐

