栏目分类:
子分类:
返回
名师互学网用户登录
快速导航关闭
当前搜索
当前分类
子分类
实用工具
热门搜索
名师互学网 > IT > 软件开发 > 后端开发 > Python

xpath匹配 获取子标签所有文本内容

Python 更新时间: 发布时间: IT归档 最新发布 模块sitemap 名妆网 法律咨询 聚返吧 英语巴士网 伯小乐 网商动力

xpath匹配 获取子标签所有文本内容

问题

这是接单时,使用xpath匹配,想到的一个小技巧,记录和分享给大家。
描述如下:


一个tr标签对应一行数据
每个tr标签中有很多td标签,但是有的td标签有子标签,有的没有,想要爬取每个td标签的所有文本内容

问题就是有的td格式不一致,想要将每个td的内容放在一起。
最终每行生成一个列表。
使用xpath(’./td//text()’) 会将td子标签文本分开

解决

使用 列表推导式 和 string(.) 返回所指元素的所有子节点文本内容所拼接的一个字符串

from lxml import etree

tree3 = etree.HTML(resp.text)
trs = tree3.xpath('//*[@id="cb_hq"]/tbody/tr')
for tr in trs:
	hang = [i.xpath('string(.)') for i in tr.xpath('./td')]
	print(hang)
转载请注明:文章转载自 www.mshxw.com
本文地址:https://www.mshxw.com/it/580496.html
我们一直用心在做
关于我们 文章归档 网站地图 联系我们

版权所有 (c)2021-2022 MSHXW.COM

ICP备案号:晋ICP备2021003244-6号