午夜剧场伦理_日本一道高清_国产又黄又硬_91黄色网战_女同久久另类69精品国产_妹妹的朋友在线

您的位置:首頁技術文章
文章詳情頁

xpath - python怎么用lxml處理

瀏覽:151日期:2022-09-22 09:54:52

問題描述

例如:

<p>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒<em><!--red_beg-->aa<!--red_end--></em>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒</p>

就是在p標簽里可能會出現同樣的em標簽,而且數量不定,那我怎么獲取p的內容,包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后,怎么把里面的內容轉換為字符串

問題解答

回答1:

今天偶然學到處理這個問題的方法,特意翻出來這個問題回答。題主你可以看一下xpath的軸,比如你要取得第二個<p>標簽的“沒aa沒aa”,實際是取得它全部后代節點的文本內容,可以使用element_dom.xpath('//p[2]//descendant::text()')來取得,拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了,比如''.join(list)。同理,如果你需要進行其他操作,也可以使用類似的方法。

回答2:

換bs4,string和text之間的異同就在這里。

回答3:

lxml.html的.text_content()方法,可以獲取當前節點和所有子節點的文本內容。

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 精品成人免费一区二区在线播放 | 天堂va蜜桃一区二区三区 | 色播开心网 | 中文字幕一区视频 | 亚洲一区 中文字幕 | 最新中文字幕在线视频 | 免费一级片 | 色中色综合网 | 久久国产小视频 | 国产欧美日韩在线观看 | 国产美女视频免费 | 中文区中文字幕免费看 | 精品视频在线看 | 日本欧美一区二区三区 | 手机在线亚洲 | 手机在线观看av网站 | 久久成人精品视频 | 在线观看免费av网站 | 狠狠干欧美 | 手机超碰 | 久久久精品久久久久 | 国产黄色免费大片 | 成人看片在线观看 | 久久cao| 黑人操亚洲人 | 最新日本中文字幕 | 伊人成综合 | 一区二区三区视频网站 | 成人黄色在线 | 日韩第六页 | 神马久久网 | 免费黄色小视频在线观看 | 国产成人自拍一区 | 成年人在线视频观看 | 九色在线播放 | 深夜福利在线视频 | 成人看片黄a免费看视频 | 噼里啪啦国语完整在线观看高清 | 拔插拔插视频 | 天天操女人 | 久久精品在线观看视频 |