You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何用Python提取字符串中的大写标识及大写后跟浮点数的内容?

解决方案

你可以借助Python的正则表达式模块re精准提取目标内容,核心思路是匹配逗号前内容里的全大写标识(可附带版本号),修改后的脚本如下:

import re

# 定义正则模式:匹配全大写字母开头,可后续跟空格和多段版本号(如3.1.1、2.1)
extract_pattern = r'([A-Z]+(?:\s\d+(?:\.\d+)+)?)'

for file in files:
    # 获取文本并去除首尾空白
    raw_text = file.text.strip()
    # 截取逗号前的内容部分
    content_before_comma = raw_text.split(',')[0].strip()
    # 查找所有符合规则的匹配项,取最后一个(对应目标标识)
    matched_items = re.findall(extract_pattern, content_before_comma)
    if matched_items:
        print(matched_items[-1])

效果说明

  • 对ESRI Shapefile, (50.7 kB),会提取出ESRI
  • 对GML 3.1.1, (124.9 kB),会提取出GML 3.1.1
  • 对Google Earth KML 2.1, (126.5 kB),会提取出KML 2.1
  • 对MapInfo MIF, (53.5 kB),会提取出MIF

内容的提问来源于stack exchange,提问作者h1m aga1n

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.16 05:10:23