You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用正则表达式去除字符串重复值并返回唯一值

用正则去除字符串中的重复值方案

这里给你两种可行的解决思路,对应不同场景:

方法一:提取元素去重后重构字符串(通用可靠)

这种方法不管重复元素是不是连续的都能处理,步骤是先把字符串里的元素提取出来,去重后再重新拼成目标格式:

import re

# 你的输入字符串
input_str = "['234.78','234.78']"
# 提取所有单引号包裹的数值元素
elements = re.findall(r"'([^']+)'", input_str)
# 去重(用dict.fromkeys可以保留元素出现的顺序)
unique_elements = list(dict.fromkeys(elements))
# 重新拼接成目标格式的字符串
result = f"Value = \"['{',''.join(f'\'{e}\'' for e in unique_elements)}']\""
print(result)
# 输出:Value = "['234.78']"

方法二:正则直接替换连续重复项(适合简单场景)

如果你的重复元素都是连续出现的,直接用正则匹配重复项并替换更简单:

import re

input_str = "['234.78','234.78']"
# 先提取引号内的列表部分
value_content = re.search(r'"(.*)"', input_str).group(1)
# 匹配连续重复的元素,替换成单个
unique_content = re.sub(r"'([^']+)',\s*'\1'", r"'\1'", value_content)
# 拼接回完整结果
result = f"Value = \"{unique_content}\""
print(result)
# 输出:Value = "['234.78']"

注意事项

  • 如果字符串里的重复元素不是连续的,比如"['123','456','123']",方法二就失效了,这时候优先用方法一,通用性更强。
  • 正则里的\s*是为了匹配元素之间可能存在的空格,比如['234.78', '234.78']这种带空格的情况也能处理。

内容的提问来源于stack exchange,提问作者riku_zac

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.22 09:02:40