文章詳情頁

html - Python爬蟲，翻頁數據怎么爬，URL不變

瀏覽：191日期：2022-08-09 14:14:12

問題描述

網址：http://quote.eastmoney.com/ce...我想爬所有頁的名稱數據，（這里只有兩頁），判斷有沒有下一頁的條件該怎么寫呢？代碼：

from selenium import webdriverdriver=webdriver.PhantomJS()url=’http://quote.eastmoney.com/center/list.html#28003684_0_2’driver.get(url)usoup = BeautifulSoup(driver.page_source, ’xml’)n=[]while True: t=usoup.find(’table’,{’id’:’fixed’}) utable=t.find_all(’a’,{’target’:’_blank’}) for i in range(len(utable)): if i % 6 ==1: n.append(utable[i].text) if #停止條件怎么寫: break driver.find_element_by_xpath(r’//*@id='pagenav']/a[2]’).click() usoup = BeautifulSoup(driver.page_source, ’xml’)

后面這里就不會寫了。。。

問題解答

回答1：

可以判斷每一頁的條目，每一頁共20條，如果當前頁不足20條的時候，說明此頁是最后一頁了，爬完當前頁就該停止了

回答2：

話說這個表格不是都有個jsonp的返回接口嗎？為什么還要爬？

回答3：

走的就是jsonp接口，直接拿就好了。

非要抓取的話，只能用selenium + phantomjs 之類的模擬頁面去獲取了。

回答4：

http://nufm.dfcfw.com/EM_Fina...{rank:[(x)],pages:(pc)}&token=7bc05d0d4c3c22ef9fca8c2a912d779c&jsName=quote_123&_g=0.5385195357178545

Python 編程

上一條：python - Django ManyToManyField 字段數據在 admin后臺顯示不正確，這是怎么回事？下一條：python - pyspider 如何獲取某個列表中的第n個元素

排行榜

					
					關于docker下的nginx壓力測試
Docker for Mac 創建的dnsmasq容器連不上/不工作的問題
docker - 如何修改運行中容器的配置
關docker hub上有些鏡像的tag被標記““This image has vulnerabilities””
docker鏡像push報錯
angular.js - angularjs的自定義過濾器如何給文字加顏色？
html - css氣泡，實現“倒三角（不知道算不算三角了）”可透明的。
javascript - 請指條明路，angular的$event，在select中卻是undefined？
運行python程序時出現“應用程序發生異常”的內存錯誤？
我何時應該在Java中使用JFrame.add（component）和JFrame.getContentPane（）。add（component）
java - 如何點擊按鈕，重新運行（我是初學者）？
				

熱門標簽

午夜剧场伦理_日本一道高清_国产又黄又硬_91黄色网战_女同久久另类69精品国产_妹妹的朋友在线

html - Python爬蟲，翻頁數據怎么爬，URL不變