python解析库的使用--PyQuery-电子产品世界论坛

这些小活动你都参加了吗？快来围观一下吧！>>

电子产品世界 » 论坛首页 » 嵌入式开发 » MCU » python解析库的使用--PyQuery

共23条 1/3 1 2 3 › 跳转至页

python解析库的使用--PyQuery

卢风

工程师

2022-04-15 23:39:39 打赏

只看楼主 1楼

PyQuery介绍与安装

PyQuery库也是一个非常强大又灵活的网页解析库，如果你有前端开发经验的，都应该接触过jQuery,那么PyQuery就是你非常绝佳的选择。

PyQuery 是 Python 仿照 jQuery 的严格实现。

语法与 jQuery 几乎完全相同，所以不用再去费心去记一些奇怪的方法了。

官网地址：https://pyquery.readthedocs.io/en/latest/

PyQuery的安装

pip install pyquery

URL初始化：

# 推荐使用requests爬取信息
from pyquery import PyQuery as pq
import requests
res = requests.get("http://www.baidu.com")
res.encoding = "utf-8" # 因为原编码为ISO-8859-1
#print(res.text)
doc = pq(res.text)
print(doc("title"))

PyQuery的使用

首先创建一个html文件：my.html 用于测试pyquery的解析效果

我的常用链接

百度
京东
搜狐
新浪
淘宝

使用pyquery解析my.html

# 读取my.html的文件内容，并使用pyquery来查找节点
from pyquery import PyQuery as pq

doc = pq(filename='my.html',encoding="utf-8")

print(doc('title')) #通过html标签名获取元素节点
print(doc('#hid'))  #获取id属性值为hid的元素节点
print(doc('.bb'))  #获取class属性值为bb的元素节点
print(doc('title,h3')) #选择符组的使用

print(doc("ul li.shop a")) #关联选择符的使用

print(doc("a")) #获取所有a
print(doc("a:first")) #获取第一个a
print(doc("a:last")) #获取最后一个a
print(doc("a:lt(2)")) #获取前连个a
print(doc("a:eq(2)")) #获取索引位置2的a（第三个）

print(doc('a[href="http://www.sina.com"]')) #获取指定属性值的节点

print("="*60)
# 节点的二次筛选：

lilist = doc("ul li") #获取ul中所有的li
print(type(lilist)) #
print(lilist.find("a.bb")) #在结果的基础上再次查找
print(lilist.children("a.bb")) #在结果的基础上再次查找

print(doc("a.bb").parent()) #获取指定元素的直接父节点
#print(doc("a.bb").parents()) #获取指定元素的所有父节点
print(doc("a.bb").parent().siblings()) #获取兄弟节点

print("="*60)
# 遍历：

alist = doc("a")
for a in alist.items():
    print(a.attr.href)
    #print(a.attr('href')) #同上
    print(a.text())  #获取内容
    print(a.html())

313949724

工程师

2022-04-15 23:39:54 打赏

2楼

谢谢lz分享

HangYongmao

专家

2022-04-16 00:03:19 打赏

3楼

感谢楼主的分享，很实用了。

suncat0504

专家

2022-04-16 08:09:14 打赏

4楼

python真是越来越抢眼了。辛苦那些开发工程师了

zwei9

专家

2022-04-16 08:25:06 打赏

5楼

学习一下

emmnn

工程师

2022-04-16 09:13:49 打赏

6楼

学习

abc9981

院士

2022-04-16 09:18:07 打赏

7楼

感谢分享

ming4129

专家

2022-04-16 09:34:18 打赏

8楼

感谢分享

yzw92

专家

2022-04-16 09:43:40 打赏

9楼

谢谢楼主分享

laocuo1142

专家

2022-04-16 12:22:14 打赏

10楼

学习了

共23条 1/3 1 2 3 › 跳转至页

发新帖

每日签到

有奖活动
硬核工程师专属补给计划——填盲盒
“我踩过的那些坑”主题活动——第002期
【EEPW电子工程师创研计划】技术变现通道已开启~
发原创文章【每月瓜分千元赏金凭实力攒钱买好礼~】
【EEPW在线】E起听工程师的声音！
高校联络员开始招募啦！有惊喜！！
【工程师专属福利】每天30秒，积分轻松拿！EEPW宠粉打卡计划启动！
送您一块开发板，2025年“我要开发板活动”又开始了！

我要赚赏金打赏帖
【S32K3XX】Standby RAM 重启后数据异常问题调查被打赏￥38元
【分享开发笔记，赚取电动螺丝刀】MAX78000开发板驱动2.4寸SPI液晶屏模块240*320TFT模块ILI9341被打赏￥26元
【S32K3XX】Memory 访问默认权限配置被打赏￥25元
基于stm32f401retc对0.96寸tft的lvgl移植被打赏￥30元
【分享开发笔记，赚取电动螺丝刀】VSCode环境下移植u8g2的使用方法被打赏￥25元
【分享开发笔记，赚取电动螺丝刀】MAX78000FTHR开发板，切换到最高时钟频率100Mhz方法！被打赏￥17元
关于st7735s屏幕旋转的理解被打赏￥21元
【分享开发笔记，赚取电动螺丝刀】MAX78000FTHR开发板，更新DAPLink固件方法！被打赏￥22元
【分享开发笔记，赚取电动螺丝刀】在NUCLEO-F412ZG部署MicroPython被打赏￥25元
【调试】使用OZONE调试Cortex-M hardfault被打赏￥40元

热门分类
STM32	MCU
通讯及无线技术	物联网技术
电子DIY	板卡试用
基础知识	软件与操作系统
我爱生活	小e食堂

python解析库的使用--PyQuery

回复