python-爬蟲中的extract()

本文轉載自查看原文 2020-08-19 13:44 3283 python

<ul class="list">
  <li>123</li>
  <li>abc</li>
</ul>
 
#1
xx.xpath("./ul[@class='list']/li")   #xx是html文檔
#xpath解析返回一個解析器列表
 
#2
xx.xpath("./ul[@class='list']/li").extract()
#output
#['123','abc]
#extract使提取內容轉換為Unicode字符串，返回數據類型為list
 
#3
xx.xpath("./ul[@class='list']/li").extract()[0]
#output
#['123']
#返回列表中第一個元素
 
#4
xx.xpath("./ul[@class='list']/li")[0].extract()
#output與3相同
#返回SelectorList里的第一個元素
 
#5
#xx.xpath("./ul[@class='list']/li".extract_first()
#output與3相同
#和3作用效果相同
 
#6
xx.xpath("./ul[@class='list']/li")[0].extract()[0]
#output
#'1'
#返回SelectorList里的第一個元素的第一個字符

參考鏈接:

https://blog.csdn.net/nzjdsds/article/details/77278400

https://blog.csdn.net/w2blue/article/details/80070131

https://www.zhihu.com/question/63370553/answer/247633004

免責聲明！

本站轉載的文章為個人學習借鑒使用，本站對版權不負任何法律責任。如果侵犯了您的隱私權益，請聯系本站郵箱yoyou2525@163.com刪除。

猜您在找 python-虎撲爬蟲 python-爬蟲之re模塊 Python-簡單的爬蟲語句 python-爬蟲-selenium模塊爬蟲入門【7】Python-文件的讀寫和JSON Python-爬蟲-（Json和Csv）文件存儲 Python-天天基金網爬蟲分析 Python-爬蟲-針對有frame框架的頁面 Python-爬蟲案例（持續更新） Python-爬蟲-針對有frame框架的頁面