如何从"urn:li:fsd_jobPosting:xxxx&格式字符串中提取数字?
提取指定格式字符串中的数字
当然可以,核心是用正则表达式匹配固定前缀后的数字部分,以下是几种常见场景的实现方法:
核心正则模式
使用 urn:li:fsd_jobPosting:(\d+)& 作为匹配规则:
urn:li:fsd_jobPosting:匹配固定前缀(\d+)捕获一个或多个连续数字(这就是你要提取的内容)&匹配末尾的固定符号
Python 实现
import re # 示例文本 text = '"urn:li:fsd_jobPosting:3374616185&' # 匹配并提取数字 match_result = re.search(r'urn:li:fsd_jobPosting:(\d+)&', text) if match_result: job_posting_id = match_result.group(1) print(job_posting_id) # 输出:3374616185
JavaScript 实现
const text = '"urn:li:fsd_jobPosting:3374616185&'; const regex = /urn:li:fsd_jobPosting:(\d+)&/; const matchResult = text.match(regex); if (matchResult) { const jobPostingId = matchResult[1]; console.log(jobPostingId); // 输出:3374616185 }
命令行批量处理(grep)
如果需要从HTML文件中批量提取,可以用:
grep -oP 'urn:li:fsd_jobPosting:\K\d+' your_file.html
-o:仅输出匹配到的内容-P:启用Perl兼容正则\K:忽略前面的前缀内容,直接输出后续的数字
以上方法都能适配所有仅末尾数字不同的目标字符串,准确提取出数字部分。
内容的提问来源于stack exchange,提问作者Peter Penzov
相关产品推荐
相关产品推荐

