You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python如何在字符串中查找指定字符串并提取其后指定长度的字符

实现方法

前置处理:先提取script标签的纯文本

你之前存入列表的是BeautifulSoup的Tag对象,需要先提取其纯文本内容再做匹配,修改提取代码如下:

# 直接取第三个script标签的纯文本内容,无需先转列表
script_content = soup.findAll("script")[2].text

方法1:用字符串原生方法实现(最简单)

直接用find()定位目标字符串位置,再切片取后续指定长度字符:

# 替换为你要查找的特殊字符串
target_key = "你需要匹配的特殊字符串"
# 替换为你要取的后续字符数x
get_length = 200

# 定位目标字符串起始索引
start_index = script_content.find(target_key)
if start_index != -1:
    # 计算目标字符串结束位置,从该位置往后取get_length个字符
    content_start = start_index + len(target_key)
    result = script_content[content_start : content_start + get_length]
    print(result)
else:
    print("未匹配到指定字符串")

方法2:用正则表达式实现(适合复杂匹配场景)

如果目标字符串有可变部分,或者需要自动忽略换行等特殊字符,用正则匹配更灵活:

import re

target_key = "你需要匹配的特殊字符串"
get_length = 200

# 正则规则:匹配目标字符串后最多get_length个字符,re.S 让.可以匹配换行符
pattern = re.compile(re.escape(target_key) + r"(.{0," + str(get_length) + r"})", re.S)
match_res = pattern.search(script_content)
if match_res:
    result = match_res.group(1)
    print(result)

关于json.loads失效的说明

之前解析失败大概率是你截取的内容不是完整纯JSON结构:script标签里的JSON通常前面带JS变量赋值、后面带分号/换行等冗余字符,你可以先用上面的方法截取到完整JSON片段后,再调用json.loads()解析即可。

内容的提问来源于stack exchange,提问作者lanavargas2002

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.29 09:15:01