You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python中如何提取字符串内以SF-开头的不重复单词

提取无重复"SF-"开头字符串的正确实现

原代码问题分析

你的代码输出和原字符串一致,是因为两个关键错误:

  • 循环遍历的是字符串的单个字符,而非目标片段
  • 判断条件"SF-" in str1只要原字符串存在SF-就始终为真,导致所有字符被加入列表

方案1:正则表达式(推荐)

正则能精准匹配以SF-开头的字符串,结合集合自动去重,是最可靠的方法:

import re

str1 = '"SF-9632":"schema,names","startAt":0,"maxResults":50,"total":58,"issues","SF-6349","total":70,"SF-6533'
# 匹配所有带可选引号的SF-xxxx格式字符串
sf_matches = re.findall(r'"?SF-\d+"?', str1)
# 去重并去掉引号
unique_sf = list({item.strip('"') for item in sf_matches})

print(unique_sf)

说明:

  • r'"?SF-\d+"?' 正则规则:
    • "?" 匹配前后可选的双引号
    • SF- 匹配固定前缀
    • \d+ 匹配1个或多个数字(如果SF-后是其他字符,可改成\w+匹配字母数字下划线)
  • 用集合{...}去重,再转列表得到最终结果

方案2:字符串分割筛选(适合简单场景)

如果字符串格式固定(SF-片段不包含逗号),可以用分割+筛选的方式:

str1 = '"SF-9632":"schema,names","startAt":0,"maxResults":50,"total":58,"issues","SF-6349","total":70,"SF-6533'
# 按逗号分割所有片段
parts = str1.split(',')
# 筛选含SF-的项并去引号
sf_items = [part.strip('"') for part in parts if 'SF-' in part]
# 去重
unique_sf = list(set(sf_items))

print(unique_sf)

局限性:

如果SF-开头的字符串本身包含逗号,分割会导致匹配失败,此时优先用正则方案。


内容的提问来源于stack exchange,提问作者Nir Eyal

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.17 08:05:20