文章詳情頁

網頁爬蟲 - python 爬取網站并解析非json內容

瀏覽：110日期：2022-06-27 10:19:15

問題描述

小弟剛學會獲得json的內容，但今天爬的網站返回的并不是json內容并且會有一個隨機數的生成在每次請求鏈接的后面

不知道會不會影響我要爬的內容

需要獲得內容是下圖中間的內容

網頁爬蟲 - python 爬取網站并解析非json內容網站鏈接 http://www.szse.cn/main/discl...

我自己嘗試的代碼：

import requestsdir = ’/Users/S1Lence/Desktop/new_html/szse/許可類重組問詢函’headers = {’Host’: ’www.szse.cn’, ’Referer’: ’http://www.szse.cn/main/disclosure/jgxxgk/wxhj/’, ’User-Agent’: ’Mozilla/5.0 (Macintosh; Intel Mac OS X 10_12_5) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/59.0.3071.109 Safari/537.36’ }payload= {’ACTIONID’: ’7’, ’AJAX’: ’AJAX-TRUE’, ’CATALOGID’: ’main_wxhj’, ’TABKEY’: ’tab1’, ’selecthjlb’: ’許可類重組問詢函’, ’tab1PAGENO’: ’1’, ’tab1PAGECOUNT’: ’7’, ’tab1RECORDCOUNT’: ’63’, ’REPORT_ACTION’: ’navigate’}res = requests.post(’http://www.szse.cn/szseWeb/FrontControllere’, data=payload)print(res.text)

輸出的內容并不是我想要的求解應該怎么爬

問題解答

回答1：

把他的header信息拷過來用。。

回答2：

你post的url地址寫錯了，應該是

http://www.szse.cn/szseWeb/FrontController.szse

Python 編程

上一條：numpy - python [:,2][:,None]是什么意思下一條：（python)關于如何做到按win+R再輸入文件文件名就可以運行？

相關文章：

1. docker - 如何修改運行中容器的配置2. javascript - Web微信聊天輸入框解決方案3. 請教各位大佬，瀏覽器點提交實例為什么沒有反應4. docker images顯示的鏡像過多，狗眼被亮瞎了，怎么辦？5. Matlab和Python編程相似嗎，有兩種都學過的人可以說說嗎6. css - 對于類選擇器使用的問題7. javascript - 音頻加載問題8. javascript - history.replaceState()無法改變query參數9. 大家好，請問在python腳本中怎么用virtualenv激活指定的環境？10. javascript - 移動端textarea不能上下滑動，該怎么解決？

排行榜

					
					docker - 如何修改運行中容器的配置
docker images顯示的鏡像過多，狗眼被亮瞎了，怎么辦？
請教各位大佬，瀏覽器點 提交實例為什么沒有反應
javascript - Web微信聊天輸入框解決方案
Matlab和Python編程相似嗎，有兩種都學過的人可以說說嗎
javascript - log4js的使用問題
docker start -a dockername 老是卡住，什么情況？
在mac下出現了兩個docker環境
javascript - vue提示語法錯誤，請問錯誤在哪？
java-ee - JAVA的注解@Api和@ApiOperation的作用是什么，怎么跳轉頁面的
html5 - video ios不能播放怎么辦？
				

熱門標簽

国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

網頁爬蟲 - python 爬取網站 并解析非json內容

網頁爬蟲 - python 爬取網站并解析非json內容