You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用llama_index索引PDF后,如何通过node_sources获取对应文档引用?

获取LlamaIndex答案对应的PDF文件引用
  • 在创建索引阶段,给每个PDF文档添加自定义元数据,比如文件名或文件路径:
    from llama_index import SimpleDirectoryReader
    
    # 读取PDF时注入自定义元数据
    reader = SimpleDirectoryReader(
        input_dir="./your_pdf_dir",
        file_metadata=lambda x: {"file_name": x.name, "file_path": x.path}
    )
    documents = reader.load_data()
    
  • 查询得到结果后,遍历result.node_sources里的节点,从节点的metadata字段提取预先设置的文件名/路径:
    # 假设result是查询返回的结果对象
    for node in result.node_sources:
        source_file = node.metadata.get("file_name")
        source_path = node.metadata.get("file_path")
        print(f"答案参考文件:{source_file},路径:{source_path}")
    
  • 如果已经创建好索引但没加元数据,可重新加载文档补充元数据后重建索引;若索引规模较小,也可直接修改现有索引节点的元数据。

内容的提问来源于stack exchange,提问作者edencorbin

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.21 08:19:56