亚洲免费在线视频-亚洲啊v-久久免费精品视频-国产精品va-看片地址-成人在线视频网

您的位置:首頁技術文章
文章詳情頁

xpath - python怎么用lxml處理

瀏覽:96日期:2022-09-22 09:54:52

問題描述

例如:

<p>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒<em><!--red_beg-->aa<!--red_end--></em>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒</p>

就是在p標簽里可能會出現同樣的em標簽,而且數量不定,那我怎么獲取p的內容,包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后,怎么把里面的內容轉換為字符串

問題解答

回答1:

今天偶然學到處理這個問題的方法,特意翻出來這個問題回答。題主你可以看一下xpath的軸,比如你要取得第二個<p>標簽的“沒aa沒aa”,實際是取得它全部后代節點的文本內容,可以使用element_dom.xpath('//p[2]//descendant::text()')來取得,拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了,比如''.join(list)。同理,如果你需要進行其他操作,也可以使用類似的方法。

回答2:

換bs4,string和text之間的異同就在這里。

回答3:

lxml.html的.text_content()方法,可以獲取當前節點和所有子節點的文本內容。

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 国产精品久久人人做人人爽 | 国产日韩一区二区三区 | 国产欧美一区二区三区久久 | 国产精品久久久久久久久久久久久久 | a级片免费观看 | 看成年女人免费午夜视频 | 日韩在线不卡一区在线观看 | 日本精品在线观看 | 亚洲综合久久综合激情久久 | 一级黄免费 | 国产在线观看精品一区二区三区91 | 在线看国产视频 | 视频一区在线播放 | 亚洲精品一区二区综合 | 欧美视频成人 | 天堂一区二区在线观看 | 国产免费成人在线视频 | 亚洲欧美成人综合久久久 | 国产综合视频在线观看一区 | 色射网| 国产精品拍自在线观看 | 亚洲免费人成在线视频观看 | 成人国产欧美精品一区二区 | 亚洲国产成人va在线观看网址 | 国产视频久久 | 成人爽a毛片在线视频 | 日本成人一级片 | 亚洲视频在线网站 | 成年人网站在线 | 欧美一级做 | 国产成人区 | 久久99热精品免费观看欧美 | 国产日韩精品欧美一区视频 | 国产自线一二三四2021 | 亚洲天堂在线视频播放 | 国产成人无精品久久久 | 日本欧美不卡一区二区三区在线 | 69欧美| 久久精品三级视频 | 成年人在线观看免费 | 97超级碰碰碰碰在线视频 |