You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

开发应用时如何解析二维码扫描传输的含NDC编号、疫苗批号与有效期的字符串数据?

嘿,这个问题我熟!你遇到的是GS1标准的药品/疫苗二维码数据解析,这类字符串都是用**应用标识符(AI)**来分隔不同字段的,我给你一步步拆解和实现思路:

先搞懂核心规则:GS1应用标识符(AI)

这类二维码文本遵循GS1全球标准,每个字段都以两位数字的AI开头,不同AI对应不同的信息类型,常用的几个和你的需求匹配:

  • 01:GTIN-14(全球贸易项目代码,你提到的NDC编号通常可以从这个字段转换而来,后面会说)
  • 17:有效期,固定6位数字,格式为YYMMDD
  • 10:批号,可变长度(最多20个字符),直到下一个AI或字符串结束
拆解你的示例字符串

咱们拿你给的0110358160825436172302061095EJ7来拆分:

  • 从开头找到AI 01,后面紧跟14位数字:10358160825436 → 这是GTIN-14。如果要转成NDC编号,需要参考FDA的映射规则:通常美国的GTIN前两位是00,后面跟着10位NDC+1位校验码;如果你的GTIN开头不是00,可能需要核对具体的厂商编码规则,或者直接用GTIN关联数据库查询对应的NDC。
  • 接下来找到AI 17,后面6位是230206 → 转换为日期就是2023年2月6日
  • 最后找到AI 10,后面的所有字符直到结尾:95EJ7 → 这就是疫苗批号
代码实现思路(以Python为例)

你可以用正则表达式来匹配不同的AI段,轻松提取字段:

import re

def parse_vaccine_qr(gs1_str):
    parsed_data = {}
    
    # 提取GTIN(对应NDC的源数据)
    gtin_match = re.search(r'01(\d{14})', gs1_str)
    if gtin_match:
        parsed_data['GTIN'] = gtin_match.group(1)
        # 可选:根据规则转换为NDC(示例逻辑,需按实际需求调整)
        # 假设GTIN前两位是国家码,后面10位是NDC,最后一位是校验码
        # parsed_data['NDC'] = parsed_data['GTIN'][2:-1]
    
    # 提取有效期并格式化为标准日期
    exp_match = re.search(r'17(\d{6})', gs1_str)
    if exp_match:
        exp_raw = exp_match.group(1)
        parsed_data['有效期'] = f"20{exp_raw[:2]}-{exp_raw[2:4]}-{exp_raw[4:]}"
    
    # 提取批号(匹配字母数字直到下一个AI或结尾)
    lot_match = re.search(r'10([A-Z0-9]+)(?=\d{2}|$)', gs1_str)
    if lot_match:
        parsed_data['疫苗批号'] = lot_match.group(1)
    
    return parsed_data

# 测试你的示例字符串
sample = "0110358160825436172302061095EJ7"
print(parse_vaccine_qr(sample))

运行后会得到:

{'GTIN': '10358160825436', '有效期': '2023-02-06', '疫苗批号': '95EJ7'}
注意事项
  • 如果你的业务必须严格获取NDC,建议对接FDA的NDC数据库,通过GTIN关联查询,因为不同厂商的GTIN转NDC规则可能有差异
  • 要考虑异常情况:比如字符串缺失某个AI、格式不符合GS1标准,代码里要加对应的错误处理
  • 其他可能的AI:如果后续遇到更多字段(比如生产日期11),只需要扩展正则匹配规则即可

内容的提问来源于stack exchange,提问作者Greybeard

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.04.28 19:33:11