如何提取子串间内容?从LDAP字符串中获取CN字段值
解决LDAP DN中提取指定CN内容的问题
嘿,我来帮你搞定这个问题!首先得说清楚:trim()函数只负责去除字符串首尾的空白字符,完全处理不了LDAP这种结构化的DN字符串,更识别不了里面的转义字符,所以用它肯定达不到需求。
咱们一步步来解决:你的目标是从CN=van der Valk\, Marco,OU=UT,...这个DN里提取出van der Valk,核心要处理两个关键点:
- 正确提取CN字段的完整值(里面的
\,是转义后的逗号,不能当作DN的键值分隔符) - 从完整的CN值里拆分出转义逗号前的部分
方法一:用正则表达式(Python示例)
正则可以精准匹配出CN字段的完整内容,再拆分出你要的部分:
import re # 你的LDAP DN字符串,注意转义符在Python里要写双反斜杠 dn = "CN=van der Valk\\, Marco,OU=UT,OU=NL,OU=EMEA,OU=associates,OU=usersAndGroups,DC=corporate,DC=ingrammicro,DC=com" # 第一步:匹配出CN字段的完整值(包含转义逗号) cn_match = re.match(r'^CN=([^\\,]*(?:\\.[^\\,]*)*)', dn) if cn_match: full_cn = cn_match.group(1) # 第二步:按转义逗号拆分,取第一部分并去除多余空格 target_name = full_cn.split(r'\\,')[0].strip() print(target_name) # 输出:van der Valk
方法二:纯字符串处理(Python示例)
如果你不想用正则,也可以通过遍历字符来找到CN字段的结束位置:
dn = "CN=van der Valk\\, Marco,OU=UT,OU=NL,OU=EMEA,OU=associates,OU=usersAndGroups,DC=corporate,DC=ingrammicro,DC=com" # 定位CN=的起始位置 start_idx = dn.find('CN=') + 3 end_idx = start_idx # 遍历找到未转义的逗号(作为CN字段的结束标记) while end_idx < len(dn): # 遇到逗号且前面不是转义符时,停止遍历 if dn[end_idx] == ',' and (end_idx == 0 or dn[end_idx-1] != '\\'): break end_idx += 1 # 提取完整CN值并拆分 full_cn = dn[start_idx:end_idx] target_name = full_cn.split(r'\\,')[0].strip() print(target_name) # 输出:van der Valk
思路说明
- 首先必须区分DN里的分隔逗号和CN值里的转义逗号:DN的键值对用未转义的逗号分隔,而CN值里的
\,是合法内容,不能当作分隔符。 - 提取出完整的CN值后,再按
\,拆分,就能得到你要的van der Valk部分。
内容的提问来源于stack exchange,提问作者myron
相关产品推荐
相关产品推荐

