使用llama_index索引PDF后,如何通过node_sources获取对应文档引用?
获取LlamaIndex答案对应的PDF文件引用
- 在创建索引阶段,给每个PDF文档添加自定义元数据,比如文件名或文件路径:
from llama_index import SimpleDirectoryReader # 读取PDF时注入自定义元数据 reader = SimpleDirectoryReader( input_dir="./your_pdf_dir", file_metadata=lambda x: {"file_name": x.name, "file_path": x.path} ) documents = reader.load_data() - 查询得到结果后,遍历
result.node_sources里的节点,从节点的metadata字段提取预先设置的文件名/路径:# 假设result是查询返回的结果对象 for node in result.node_sources: source_file = node.metadata.get("file_name") source_path = node.metadata.get("file_path") print(f"答案参考文件:{source_file},路径:{source_path}") - 如果已经创建好索引但没加元数据,可重新加载文档补充元数据后重建索引;若索引规模较小,也可直接修改现有索引节点的元数据。
内容的提问来源于stack exchange,提问作者edencorbin
相关产品推荐
相关产品推荐

