国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

您的位置:首頁技術文章
文章詳情頁

xpath - python怎么用lxml處理

瀏覽:96日期:2022-09-22 09:54:52

問題描述

例如:

<p>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒<em><!--red_beg-->aa<!--red_end--></em>沒<em><!--red_beg-->aa<!--red_end--></em></p><p>沒</p>

就是在p標簽里可能會出現同樣的em標簽,而且數量不定,那我怎么獲取p的內容,包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后,怎么把里面的內容轉換為字符串

問題解答

回答1:

今天偶然學到處理這個問題的方法,特意翻出來這個問題回答。題主你可以看一下xpath的軸,比如你要取得第二個<p>標簽的“沒aa沒aa”,實際是取得它全部后代節點的文本內容,可以使用element_dom.xpath('//p[2]//descendant::text()')來取得,拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了,比如''.join(list)。同理,如果你需要進行其他操作,也可以使用類似的方法。

回答2:

換bs4,string和text之間的異同就在這里。

回答3:

lxml.html的.text_content()方法,可以獲取當前節點和所有子節點的文本內容。

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 国产欧美一区二区三区在线看 | 国产亚洲欧美日韩综合综合二区 | 精品网址| 91精品国产免费久久久久久 | 91欧美一区二区三区综合在线 | a级毛片毛片免费很很综合 a级毛片免费 | 国产看片视频 | 在线亚洲精品国产波多野结衣 | 波多野结衣免费视频观看 | 色偷偷在线刺激免费视频 | 国产短视频精品一区二区三区 | 手机看片日韩日韩 | 国产成人a视频在线观看 | 日韩 国产 欧美 | 久久精品国产99久久6动漫欧 | 2018久久久国产精品 | 成年视频国产免费观看 | 国产欧美精品三区 | 亚洲精品色综合色在线观看 | 91亚洲成人 | 欧美日韩高清不卡一区二区三区 | 99九九精品免费视频观看 | 日韩欧美在线观看视频 | 日韩欧美一区二区三区在线观看 | 黑人一级黄色片 | 欧美国产日韩在线播放 | 女人张开腿让男人添 | 99久久国产综合精品1尤物 | 免费韩国一级毛片 | 成人欧美精品一区二区不卡 | 欧美无极品 | 亚洲天堂资源网 | 久草在线视频看看 | 国产精品v免费视频 | 久久久国产精品视频 | 手机看片1024精品日韩 | 特级a毛片 | 亚洲最黄网站 | 中文毛片 | 国产高清美女一级a毛片久久 | 高清国产精品久久 |