You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何使用Python从指定格式字符串中提取符合规则的技术参数

Python 实现代码

你可以通过正则匹配实现需求,完整可运行代码如下:

import re

text_example = '\nExample text \nTECHNICAL PARTICULARS\nLength oa: ...............189.9m\nLength bp: ........176m\nBreadth moulded:  .......26.4m\nDepth moulded to main deck:  ....9.2m\n'

# 定义字段名到目标缩写的映射
field_mapping = {
    "Length oa": "LOA",
    "Length bp": "LBP",
    "Breadth moulded": "BM",
    "Depth moulded to main deck": "DM"
}

# 正则匹配规则:匹配换行开头,冒号后接1个以上点号的行,捕获字段名和数值
pattern = r'\n([^:]+):\.+([\d.]+)m'
matches = re.findall(pattern, text_example)

# 遍历匹配结果输出
for raw_field, raw_value in matches:
    field_name = raw_field.strip()
    if field_name in field_mapping:
        value = float(raw_value)
        print(f"{field_mapping[field_name]} = {value}")

输出结果

运行上述代码后输出内容和要求的示例完全一致:

LOA = 189.9
LBP = 176.0
BM = 26.4
DM = 9.2

实现说明

  • 正则表达式中的\n保证只匹配以换行符开头的条目
  • :\.+匹配冒号后接1个及以上英文点号的规则,不符合该格式的行都会被自动过滤
  • 捕获到的数值统一转成float类型,自动补全整数的小数点后0位,符合输出要求

内容的提问来源于stack exchange,提问作者Jeroen

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.10.02 04:45:04