使用textract模块的Node.js在线PDF网页抓取技术咨询
没问题,我帮你把这段关于Node.js在线PDF内容抓取的内容翻译成中文,全程保留代码和技术术语,整理后的内容如下:
Node.js在线PDF内容抓取需求与代码片段
我有一个Node.js应用,需要对在线PDF进行内容抓取,以下是相关代码片段:
var textract = require('textract'); const util = require('util'); var methods = {}; var urls = [ {year: '2016', link: 'http://www.url2016.pdf'}, {year: '2015', link: 'http://www.url2015.pdf'} ]; var result = []; const textractFromUrl = util.promisify(textract.fromUrl); methods.download = function(req, res) { return extractText(); } async function extractText() { try { var config = { preserveLineBreaks:...
内容的提问来源于stack exchange,提问作者user6118527
相关产品推荐
相关产品推荐

