You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Python处理不规范街道号字段:拆分整数部分与字母/小数后缀

原代码的问题

你的实现思路方向是对的,但代码存在几个逻辑漏洞导致结果错误:

  • 第一个判断逻辑错误:isalnum()会把同时包含数字和字母的字符串(比如567M)也判定为真,导致这类值直接被存入l1,没有做拆分
  • 处理带小数点的值时,i.split(".")没有接收返回值,原字符串没有被修改,后续取i[0]实际取的是原字符串的第一个字符,i[-1]取的是最后一个字符,所以4321.5拆分后得到了错误的4和5
  • 第三个分支永远不会被触发,你给出的测试用例都满足前两个分支的条件,字母后缀的拆分逻辑根本没运行

更简单的实现方法

直接用正则匹配提取开头的连续数字作为街道号,剩余所有字符作为后缀即可,不需要多分支判断,兼容你提到的所有场景:

import re

lst = ['1234', '4321.5', '567M']
l1 = []
l2 = []

# 正则规则:匹配开头连续的数字作为第一组,剩余所有内容作为第二组
pattern = re.compile(r'^(\d+)(.*)$')
for item in lst:
    match_res = pattern.match(item)
    if match_res:
        # 第一组是开头的整数部分,需要转int的话直接套int()即可
        l1.append(match_res.group(1))
        # 第二组是后缀,空值也存空字符串保证两个列表长度一致
        l2.append(match_res.group(2))

运行后结果:

  • l1:['1234', '4321', '567']
  • l2:['', '.5', 'M']
    完全符合提取整数部分到新字段、后缀部分存入街道后缀字段的需求。

内容的提问来源于stack exchange,提问作者geoJshaun

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.26 18:24:01