文章詳情頁(yè)

python獲取整個(gè)網(wǎng)頁(yè)源碼的方法

瀏覽：33日期：2022-07-15 13:20:58

1、Python中獲取整個(gè)頁(yè)面的代碼：

import requestsres = requests.get(’https://blog.csdn.net/yirexiao/article/details/79092355’)res.encoding = ’utf-8’print(res.text)

2、運(yùn)行結(jié)果

實(shí)例擴(kuò)展：

from bs4 import BeautifulSoupimport time,re,urllib2t=time.time()websiteurls={}def scanpage(url): websiteurl=url t=time.time() n=0 html=urllib2.urlopen(websiteurl).read() soup=BeautifulSoup(html) pageurls=[] Upageurls={} pageurls=soup.find_all('a',href=True) for links in pageurls: if websiteurl in links.get('href') and links.get('href') not in Upageurls and links.get('href') not in websiteurls: Upageurls[links.get('href')]=0 for links in Upageurls.keys(): try: urllib2.urlopen(links).getcode() except: print 'connect failed' else: t2=time.time() Upageurls[links]=urllib2.urlopen(links).getcode() print n, print links, print Upageurls[links] t1=time.time() print t1-t2 n+=1 print ('total is '+repr(n)+' links') print time.time()-tscanpage(http://news.163.com/)

到此這篇關(guān)于python獲取整個(gè)網(wǎng)頁(yè)源碼的方法的文章就介紹到這了,更多相關(guān)python如何獲取整個(gè)頁(yè)面內(nèi)容請(qǐng)搜索好吧啦網(wǎng)以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持好吧啦網(wǎng)！

Python 編程

上一條：python爬蟲(chóng)使用正則爬取網(wǎng)站的實(shí)現(xiàn)下一條：python線(xiàn)程里哪種模塊比較適合

相關(guān)文章：

1. CentOS郵箱服務(wù)器搭建系列——SMTP服務(wù)器的構(gòu)建（ Postfix ）2. PHP基礎(chǔ)之生成器4——比較生成器和迭代器對(duì)象3. ASP新手必備的基礎(chǔ)知識(shí)4. Docker 啟動(dòng)Redis 并設(shè)置密碼的操作5. asp文件用什么軟件編輯6. 通過(guò)IEAD+Maven快速搭建SSM項(xiàng)目的過(guò)程(Spring + Spring MVC + Mybatis)7. JS中6個(gè)對(duì)象數(shù)組去重的方法8. vue+element開(kāi)發(fā)一個(gè)谷歌插件的全過(guò)程9. 利用CSS制作3D動(dòng)畫(huà)10. Vue axios獲取token臨時(shí)令牌封裝案例

排行榜

					
					ASP新手必備的基礎(chǔ)知識(shí)
asp文件用什么軟件編輯
CentOS郵箱服務(wù)器搭建系列——SMTP服務(wù)器的構(gòu)建（ Postfix ）
PHP基礎(chǔ)之生成器4——比較生成器和迭代器對(duì)象
Docker 啟動(dòng)Redis 并設(shè)置密碼的操作
JS中6個(gè)對(duì)象數(shù)組去重的方法
vue+element開(kāi)發(fā)一個(gè)谷歌插件的全過(guò)程
JAVA 實(shí)現(xiàn)延遲隊(duì)列的方法
IDEA 2020.1.2 安裝教程附破解教程詳解
IDEA 配置 JRebel 熱部署的方法(推薦)
js實(shí)現(xiàn)計(jì)算器功能
				

午夜剧场伦理_日本一道高清_国产又黄又硬_91黄色网战_女同久久另类69精品国产_妹妹的朋友在线

python獲取整個(gè)網(wǎng)頁(yè)源碼的方法