如何从包含本体URI的每行文本中提取URI后方的数字内容?
提取本体嵌入数值的实现方案
你的数据每行结构固定为1个URI + 空格分隔的3个浮点数值,你当前编写的代码仅能获取每行的最后1个字符,无法匹配提取需求,可通过按空格分割行内容后取末尾3个元素的方式实现:
# 方案1:提取为字符串格式存入列表,和你示例的目标输出格式一致 my_list = [] with open('3D_10W_Hermit.txt', 'r', encoding='utf-8') as f: for line in f: # 去除首尾换行、空白后按空格拆分 line_parts = line.strip().split() # 取最后3个元素拼接为空格分隔的字符串 target_value = ' '.join(line_parts[-3:]) my_list.append(target_value)
# 方案2:提取为浮点型数值存入列表,方便后续计算使用 my_list = [] with open('3D_10W_Hermit.txt', 'r', encoding='utf-8') as f: for line in f: line_parts = line.strip().split() # 把最后3个元素转为float类型 target_value = [float(part) for part in line_parts[-3:]] my_list.append(target_value)
以上方案兼容你给出的所有数据格式,不受URI中特殊字符的影响,只要每行末尾固定为3个数值就可以正常提取。
内容的提问来源于stack exchange,提问作者TheAfg
相关产品推荐
相关产品推荐

