chuwanghui 8 роки тому
батько
коміт
239e6a89d0
1 змінених файлів з 3 додано та 2 видалено
  1. 3 2
      ApiCrawler/ApiCrawler/spiders/apispider.py

+ 3 - 2
ApiCrawler/ApiCrawler/spiders/apispider.py

@@ -52,8 +52,9 @@ class ApiSpider(scrapy.spiders.Spider):
         #首先获取body标签,然后再获取body标签中的所有字符串,为节约代码,下面使用三元操作符号,不熟悉的学生去学习一下三元
         #python的三元比较奇葩,估计是不入流程序员写的,h = "变量1" if a>b else "变量2"
         #_content=response.xpath('/html/body').xpath('string(.)').extract()[0];
-        _content=response.xpath('/html/body').xpath('string(.)')
-        #_content=response.xpath("//div[@class='book']").xpath('string(.)')
+        #_content=response.xpath('/html/body').xpath('string(.)')
+        #获取类名为book的div中的内容
+        _content=response.xpath("//div[@class='book']").xpath('string(.)')
         apiItem['content']=_content[0].extract() if _content else ""
 
         yield apiItem