文章詳情頁

xpath - python怎么用lxml處理

瀏覽：70日期：2022-09-22 09:54:52

問題描述

例如：

沒aa沒aa沒aa沒

就是在p標簽里可能會出現同樣的em標簽，而且數量不定，那我怎么獲取p的內容，包括em里的內容。例如第二個p獲取輸出是‘沒aa沒aa’

或者獲取到p節點之后，怎么把里面的內容轉換為字符串

問題解答

回答1：

今天偶然學到處理這個問題的方法，特意翻出來這個問題回答。題主你可以看一下xpath的軸，比如你要取得第二個標簽的“沒aa沒aa”，實際是取得它全部后代節點的文本內容，可以使用element_dom.xpath('//p[2]//descendant::text()')來取得，拿到的結果是一個這樣[’沒’, ’aa’, ’沒’, ’aa’]的list,然后自己手動拼接成字符串就可以了，比如''.join(list)。同理，如果你需要進行其他操作，也可以使用類似的方法。

回答2：

換bs4，string和text之間的異同就在這里。

回答3：

lxml.html的.text_content()方法，可以獲取當前節點和所有子節點的文本內容。

Python 編程

上一條：python - 如何爬取豆瓣電影的詳細信息下一條：python - [Errno 2] No such file or directory: ’我為什么是一個文件，為什么返回值是這樣的呢？

相關文章：

1. 數據庫 - mysql如何處理數據變化中的事務？2. mysql - 怎么生成這個sql表？3. 關于docker下的nginx壓力測試4. java - mongodb分片集群下，count和聚合統計問題5. java - ehcache緩存用的是虛擬機內存么？6. javascript - JS如何取對稱范圍的隨機數？7. docker-machine添加一個已有的docker主機問題8. java - 自己制作一個視頻播放器，遇到問題，用的是內置surfaceview類，具體看代碼！9. dockerfile - 我用docker build的時候出現下邊問題麻煩幫我看一下10. dockerfile - [docker build image失敗- npm install]

排行榜

					
					數據庫 - mysql如何處理數據變化中的事務？
java - mongodb分片集群下，count和聚合統計問題
關于docker下的nginx壓力測試
javascript - JS如何取對稱范圍的隨機數？
mysql - 怎么生成這個sql表？
java - ehcache緩存用的是虛擬機內存么？
docker-machine添加一個已有的docker主機問題
dockerfile - [docker build image失敗- npm install]
dockerfile - 我用docker build的時候出現下邊問題  麻煩幫我看一下
java - 自己制作一個視頻播放器，遇到問題，用的是內置surfaceview類，具體看代碼！
javascript - vue2如何獲取v-model變量名
				

熱門標簽

国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

xpath - python怎么用lxml處理