Scrapy爬虫问题:仅抓取商品描述标签内容而非全部标签数据
解决Scrapy仅抓取商品描述并写入CSV的问题
你当前的Scrapy爬虫会将商品标题、价格和描述全部写入CSV文件,要实现仅抓取「Description」标签下的商品描述并写入CSV,只需对代码做以下修改:
修改要点:
- 移除不必要的商品标题、价格抓取代码(若无需这些数据)
- 调整CSV的表头和写入逻辑,仅保留商品描述字段
- 更新日志输出内容,匹配新的抓取结果
修改后的完整代码:
# scrapy Spider Definition import scrapy import csv class ProductSpider(scrapy.Spider): name = "product_spider" # 爬虫要遍历的URL start_urls = [ 'https://softwarekaufen24.de/microsoft-office-2021-home-and-student/' ] # 起始URL的解析函数 def parse(self, response): # 抓取商品描述 product_description = response.css( 'div.product--description').xpath('.//text()').getall() if product_description: product_description = " ".join(product_description).strip() # 创建CSV文件并写入商品描述 filename = 'product.csv' with open(filename, mode='w', encoding='utf-8-sig', newline='') as file: writer = csv.writer(file, delimiter=';') writer.writerow(['Product Description']) writer.writerow([product_description]) # 输出确认日志 self.log( f'商品描述 "{product_description}" 已成功保存到 {filename}。')
补充说明:
如果只是不想把标题和价格写入CSV,但仍需要保留抓取逻辑,只需修改CSV写入部分,将表头和写入行改为仅包含Product Description即可。
内容的提问来源于stack exchange,提问作者angelableckwenn
相关产品推荐
相关产品推荐

