Python中如何从分片字节流构建部分PDF并提前读取页面?
PDF分片传输过程中能否解析已接收的部分内容?
场景背景
现有一PDF文件,以等长字节分片(最后一片除外)的形式传输至目标端。Python端读取该文件的代码如下:
with open(filename, 'rb') as file: chunk = file.read(3000) while chunk: #the sending method here await asyncio.sleep(0.5) chunk = file.read(3000)
核心问题
能否在剩余文件片段传输过程中,在目标端构建可解析的部分PDF?
尝试过程与问题
尝试使用pypdfium2/PyPDF2进行解析时,仅当完整PDF文件接收完成后才能正常实例化PdfDocument,否则会抛出错误,测试代码如下:
full_pdf = b'' def process(self, message): self.full_pdf += message partial = io.BytesIO(self.full_pdf) try: pdf=pypdfium2.PdfDocument(partial) print(len(pdf)) except Exception as e: print("error", e)
核心需求
即使PDF文件未完全接收,也能读取已传输部分对应的页面内容。
内容的提问来源于stack exchange,提问作者Patrick Visi
相关产品推荐
相关产品推荐

