(self, request, response)
| 30 | yield feapder.Request(url, task_id=task_id) # 携带task_id字段 |
| 31 | |
| 32 | def parse(self, request, response): |
| 33 | title = response.xpath("string(//div[@class='sku-name'])").extract_first(default="").strip() |
| 34 | |
| 35 | item = Item() |
| 36 | item.table_name = "jd_item" # 指定入库的表名 |
| 37 | item.title = title |
| 38 | item.batch_date = self.batch_date # 获取批次信息,批次信息框架自己维护 |
| 39 | item.crawl_time = tools.get_current_date() # 获取当前时间 |
| 40 | yield item # 自动批量入库 |
| 41 | yield self.update_task_batch(request.task_id, 1) # 更新任务状态 |
| 42 | |
| 43 | |
| 44 | if __name__ == "__main__": |
no test coverage detected