|
|
@@ -52,8 +52,9 @@ class ApiSpider(scrapy.spiders.Spider):
|
|
|
#首先获取body标签,然后再获取body标签中的所有字符串,为节约代码,下面使用三元操作符号,不熟悉的学生去学习一下三元
|
|
|
#python的三元比较奇葩,估计是不入流程序员写的,h = "变量1" if a>b else "变量2"
|
|
|
#_content=response.xpath('/html/body').xpath('string(.)').extract()[0];
|
|
|
- _content=response.xpath('/html/body').xpath('string(.)')
|
|
|
- #_content=response.xpath("//div[@class='book']").xpath('string(.)')
|
|
|
+ #_content=response.xpath('/html/body').xpath('string(.)')
|
|
|
+ #获取类名为book的div中的内容
|
|
|
+ _content=response.xpath("//div[@class='book']").xpath('string(.)')
|
|
|
apiItem['content']=_content[0].extract() if _content else ""
|
|
|
|
|
|
yield apiItem
|