Scrapy提取多个标签的text

本文转载自查看原文 2016-10-01 17:39 3071 Scrapy

对于要提取嵌套标签所有内容的情况, 使用string或//text(), 注意两者区别

>>> from scrapy import Selector
>>> 
>>> doc = "<p id='test'>hello<b>world!</b></p>"
>>> 
>>> sel = Selector(text=doc, type='html')
>>> 
>>> sel.xpath("/p[@id='test']/text()").extract()
[]

使用text()

>>>#使用两个反斜杠
>>> sel.xpath("//p[@id='test']/text()").extract()
[u'hello']
>>> #这样提取出来是一个列表, 
>>> sel.xpath("//p[@id='test']//text()").extract()
[u'hello', u'world!']
>>>

使用string

>>> sel.xpath("//p[@id='test']").xpath('string(.)').extract()
[u'helloworld!']
>>> 
>>> sel.xpath("string(//p[@id='test'])").extract()
[u'helloworld!']
>>>

免责声明！

本站转载的文章为个人学习借鉴使用，本站对版权不负任何法律责任。如果侵犯了您的隐私权益，请联系本站邮箱yoyou2525@163.com删除。

猜您在找 xpath提取多个标签下的text xpath提取多个标签下的text xpath提取多个标签下的text scrapy xpath中提取多个class值 scrapy response.xpath可以提取包含字符XX的标签 xpath提取目录下所有标签内的内容，递归 //text（） JQuery 获取多个select标签option的text内容 scrapy提取数据 scrapy xpath选择文本中有空格和回车导致用//text()提取不到想要的文本？完美解决！！ Scrapy 运行多个爬虫