You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何从包含本体URI的每行文本中提取URI后方的数字内容?

提取本体嵌入数值的实现方案

你的数据每行结构固定为1个URI + 空格分隔的3个浮点数值,你当前编写的代码仅能获取每行的最后1个字符,无法匹配提取需求,可通过按空格分割行内容后取末尾3个元素的方式实现:

# 方案1:提取为字符串格式存入列表,和你示例的目标输出格式一致
my_list = []
with open('3D_10W_Hermit.txt', 'r', encoding='utf-8') as f:
    for line in f:
        # 去除首尾换行、空白后按空格拆分
        line_parts = line.strip().split()
        # 取最后3个元素拼接为空格分隔的字符串
        target_value = ' '.join(line_parts[-3:])
        my_list.append(target_value)
# 方案2:提取为浮点型数值存入列表,方便后续计算使用
my_list = []
with open('3D_10W_Hermit.txt', 'r', encoding='utf-8') as f:
    for line in f:
        line_parts = line.strip().split()
        # 把最后3个元素转为float类型
        target_value = [float(part) for part in line_parts[-3:]]
        my_list.append(target_value)

以上方案兼容你给出的所有数据格式,不受URI中特殊字符的影响,只要每行末尾固定为3个数值就可以正常提取。

内容的提问来源于stack exchange,提问作者TheAfg

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.30 08:06:06