Python lxml解析HTML并用xpath获取元素的方法

yipeiwu_com6年前 (2020-03-06)Python基础

代码

使用方法见注释

#-*- coding: UTF-8 -*-

from lxml import etree

source = u'''
<div><p class="p1" data-a="1">测试数据1</p>
<p class="p1" data-a="2">测试数据2</p>
<p class="p1" data-a="3" style="height:100px;">
<strong class="s">测试数据3</strong></p>
<p class="p1" data-a="4" width="200"><img src="1.jpg" class="img"/><br/>
图片</p>
'''

# 从字符串解析
page = etree.HTML(source)

# 元素列表
ps = page.xpath("//p")
for p in ps:
  print u"属性：%s" % p.attrib
  print u"文本：%s" % p.text

# 文本列表
ts = page.xpath("//p/text()")
for t in ts:
  print t

# xpath定位 
ls = page.xpath('//p[@class="p1"][last()]/img')
for l in ls:
  print l.attrib

以上这篇Python lxml解析HTML并用xpath获取元素的方法就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持【听图阁-专注于Python设计】。

返回列表

上一篇：Python字符转换

下一篇：PHP生成静态页面详解

利用python开发app实战的方法

我很早之前就想开发一款app玩玩，无奈对java不够熟悉，之前也没有开发app的经验，因此一直耽搁了。最近想到尝试用python开发一款app，google搜索了一番后，发现确实有路可寻...

django 框架实现的用户注册、登录、退出功能示例

本文实例讲述了django 框架实现的用户注册、登录、退出功能。分享给大家供大家参考，具体如下： 1 用户注册： from django.contrib import auth fr...

Python标准库之collections包的使用教程

前言 Python为我们提供了4种基本的数据结构：list, tuple, dict, set，但是在处理数据量较大的情形的时候，这4种数据结构就明显过于单一了，比如list作为数组在某...

Python算术运算符实例详解

Python算术运算符以下假设变量a为10，变量b为20：运算符描述实例 +...

matplotlib subplots 设置总图的标题方法

如下所示： matplotlib subplots 设置总图的标题： fig.suptitle(dname,fontsize=16,x=0.53,y=1.05,) 以上这篇matplo...

宜配屋

Python lxml解析HTML并用xpath获取元素的方法

相关文章

利用python开发app实战的方法

django 框架实现的用户注册、登录、退出功能示例

Python标准库之collections包的使用教程

Python算术运算符实例详解

matplotlib subplots 设置总图的标题方法

© YiPeiWu.com 【宜配屋】粤ICP备17031333号

Powered By Z-BlogPHP. Theme by TOYEAN.

宜配屋

Python lxml解析HTML并用xpath获取元素的方法

相关文章

利用python开发app实战的方法

django 框架实现的用户注册、登录、退出功能示例

Python标准库之collections包的使用教程

Python算术运算符实例详解

matplotlib subplots 设置总图的标题方法

© YiPeiWu.com 【宜配屋】 粤ICP备17031333号 var _hmt = _hmt || [];(function() { var hm = document.createElement("script"); hm.src = "https://hm.baidu.com/hm.js?8aa60ae04b767b2af31903508928acc0"; var s = document.getElementsByTagName("script")[0]; s.parentNode.insertBefore(hm, s);})();

Powered By Z-BlogPHP. Theme by TOYEAN.

© YiPeiWu.com 【宜配屋】粤ICP备17031333号