文章詳情頁

html - Python爬蟲，翻頁數據怎么爬，URL不變

瀏覽：125日期：2022-08-09 14:14:12

問題描述

網址：http://quote.eastmoney.com/ce...我想爬所有頁的名稱數據，（這里只有兩頁），判斷有沒有下一頁的條件該怎么寫呢？代碼：

from selenium import webdriverdriver=webdriver.PhantomJS()url=’http://quote.eastmoney.com/center/list.html#28003684_0_2’driver.get(url)usoup = BeautifulSoup(driver.page_source, ’xml’)n=[]while True: t=usoup.find(’table’,{’id’:’fixed’}) utable=t.find_all(’a’,{’target’:’_blank’}) for i in range(len(utable)): if i % 6 ==1: n.append(utable[i].text) if #停止條件怎么寫: break driver.find_element_by_xpath(r’//*@id='pagenav']/a[2]’).click() usoup = BeautifulSoup(driver.page_source, ’xml’)

后面這里就不會寫了。。。

問題解答

回答1：

可以判斷每一頁的條目，每一頁共20條，如果當前頁不足20條的時候，說明此頁是最后一頁了，爬完當前頁就該停止了

回答2：

話說這個表格不是都有個jsonp的返回接口嗎？為什么還要爬？

回答3：

走的就是jsonp接口，直接拿就好了。

非要抓取的話，只能用selenium + phantomjs 之類的模擬頁面去獲取了。

回答4：

http://nufm.dfcfw.com/EM_Fina...{rank:[(x)],pages:(pc)}&token=7bc05d0d4c3c22ef9fca8c2a912d779c&jsName=quote_123&_g=0.5385195357178545

Python 編程

上一條：python - Django ManyToManyField 字段數據在 admin后臺顯示不正確，這是怎么回事？下一條：python - pyspider 如何獲取某個列表中的第n個元素

排行榜

					
					Docker for Mac 創建的dnsmasq容器連不上/不工作的問題
docker安裝后出現Cannot connect to the Docker daemon.
docker - 如何修改運行中容器的配置
nignx - docker內nginx 80端口被占用
python3.x - python連oanda的模擬交易api獲取json問題第五問
為什么我ping不通我的docker容器呢？？？
docker-machine添加一個已有的docker主機問題
angular.js - angular內容過長展開收起效果
debian - docker依賴的aufs-tools源碼哪里可以找到??？
angular.js - angularjs的自定義過濾器如何給文字加顏色？
docker-compose 為何找不到配置文件？
				

熱門標簽

久久r热视频,国产午夜精品一区二区三区视频,亚洲精品自拍偷拍,欧美日韩精品二区

html - Python爬蟲，翻頁數據怎么爬，URL不變

html - Python爬蟲，翻頁數據怎么爬，URL不變