Python模擬登錄的幾種方法-創(chuàng)新互聯(lián)

方法一:直接使用已知的cookie訪問

創(chuàng)新互聯(lián)公司專注于景洪網(wǎng)站建設(shè)服務(wù)及定制,我們擁有豐富的企業(yè)做網(wǎng)站經(jīng)驗。 熱誠為您提供景洪營銷型網(wǎng)站建設(shè),景洪網(wǎng)站制作、景洪網(wǎng)頁設(shè)計、景洪網(wǎng)站官網(wǎng)定制、小程序定制開發(fā)服務(wù),打造景洪網(wǎng)絡(luò)公司原創(chuàng)品牌,更為您提供景洪網(wǎng)站排名全網(wǎng)營銷落地服務(wù)。

特點:

簡單,但需要先在瀏覽器登錄

原理:

簡單地說,cookie保存在發(fā)起請求的客戶端中,服務(wù)器利用cookie來區(qū)分不同的客戶端。因為http是一種無狀態(tài)的連接,當(dāng)服務(wù)器一下子收到好幾個請求時,是無法判斷出哪些請求是同一個客戶端發(fā)起的。而“訪問登錄后才能看到的頁面”這一行為,恰恰需要客戶端向服務(wù)器證明:“我是剛才登錄過的那個客戶端”。于是就需要cookie來標(biāo)識客戶端的身份,以存儲它的信息(如登錄狀態(tài))。

當(dāng)然,這也意味著,只要得到了別的客戶端的cookie,我們就可以假冒成它來和服務(wù)器對話。這給我們的程序帶來了可乘之機。

我們先用瀏覽器登錄,然后使用開發(fā)者工具查看cookie。接著在程序中攜帶該cookie向網(wǎng)站發(fā)送請求,就能讓你的程序假扮成剛才登錄的那個瀏覽器,得到只有登錄后才能看到的頁面。

具體步驟:

1.用瀏覽器登錄,獲取瀏覽器里的cookie字符串

先使用瀏覽器登錄。再打開開發(fā)者工具,轉(zhuǎn)到network選項卡。在左邊的Name一欄找到當(dāng)前的網(wǎng)址,選擇右邊的Headers選項卡,查看Request Headers,這里包含了該網(wǎng)站頒發(fā)給瀏覽器的cookie。對,就是后面的字符串。把它復(fù)制下來,一會兒代碼里要用到。

注意,最好是在運行你的程序前再登錄。如果太早登錄,或是把瀏覽器關(guān)了,很可能復(fù)制的那個cookie就過期無效了。

Python模擬登錄的幾種方法

2.寫代碼

urllib庫的版本:

Python模擬登錄的幾種方法

requests庫的版本:

Python模擬登錄的幾種方法

方法二:模擬登錄后再攜帶得到的cookie訪問

原理:

我們先在程序中向網(wǎng)站發(fā)出登錄請求,也就是提交包含登錄信息的表單(用戶名、密碼等)。從響應(yīng)中得到cookie,今后在訪問其他頁面時也帶上這個cookie,就能得到只有登錄后才能看到的頁面。

具體步驟:

1.找出表單提交到的頁面

還是要利用瀏覽器的開發(fā)者工具。轉(zhuǎn)到network選項卡,并勾選Preserve Log(重要?。?。在瀏覽器里登錄網(wǎng)站。然后在左邊的Name一欄找到表單提交到的頁面。怎么找呢?看看右側(cè),轉(zhuǎn)到Headers選項卡。首先,在General那段,Request Method應(yīng)當(dāng)是POST。其次最下方應(yīng)該要有一段叫做Form Data的,里面可以看到你剛才輸入的用戶名和密碼等。也可以看看左邊的Name,如果含有l(wèi)ogin這個詞,有可能就是提交表單的頁面(不一定?。?/p>

Python模擬登錄的幾種方法

這里要強調(diào)一點,“表單提交到的頁面”通常并不是你填寫用戶名和密碼的頁面!所以要利用工具來找到它。

2.找出要提交的數(shù)據(jù)

雖然你在瀏覽器里登陸時只填了用戶名和密碼,但表單里包含的數(shù)據(jù)可不只這些。從Form Data里就可以看到需要提交的所有數(shù)據(jù)。

Python模擬登錄的幾種方法

3.寫代碼

urllib庫的版本:

Python模擬登錄的幾種方法

requests庫的版本:

Python模擬登錄的幾種方法

明顯感覺requests庫用著更方便啊~~~

方法三:模擬登錄后用session保持登錄狀態(tài)

原理:

session是會話的意思。和cookie的相似之處在于,它也可以讓服務(wù)器“認(rèn)得”客戶端。簡單理解就是,把每一個客戶端和服務(wù)器的互動當(dāng)作一個“會話”。既然在同一個“會話”里,服務(wù)器自然就能知道這個客戶端是否登錄過。

具體步驟:

1.找出表單提交到的頁面

2.找出要提交的數(shù)據(jù)

這兩步和方法二的前兩步是一樣的

3.寫代碼

requests庫的版本

Python模擬登錄的幾種方法

方法四:使用無頭瀏覽器訪問

特點:

功能強大,幾乎可以對付任何網(wǎng)頁,但會導(dǎo)致代碼效率低

原理:

如果能在程序里調(diào)用一個瀏覽器來訪問網(wǎng)站,那么像登錄這樣的操作就輕而易舉了。在Python中可以使用Selenium庫來調(diào)用瀏覽器,寫在代碼里的操作(打開網(wǎng)頁、點擊……)會變成瀏覽器忠實地執(zhí)行。這個被控制的瀏覽器可以是Firefox,Chrome等,但最常用的還是PhantomJS這個無頭(沒有界面)瀏覽器。也就是說,只要把填寫用戶名密碼、點擊“登錄”按鈕、打開另一個網(wǎng)頁等操作寫到程序中,PhamtomJS就能確確實實地讓你登錄上去,并把響應(yīng)返回給你。

具體步驟:

1.安裝selenium庫、PhantomJS瀏覽器

2.在源代碼中找到登錄時的輸入文本框、按鈕這些元素

因為要在無頭瀏覽器中進(jìn)行操作,所以就要先找到輸入框,才能輸入信息。找到登錄按鈕,才能點擊它。

在瀏覽器中打開填寫用戶名密碼的頁面,將光標(biāo)移動到輸入用戶名的文本框,右鍵,選擇“審查元素”,就可以在右邊的網(wǎng)頁源代碼中看到文本框是哪個元素。同理,可以在源代碼中找到輸入密碼的文本框、登錄按鈕。

Python模擬登錄的幾種方法

3.考慮如何在程序中找到上述元素

Selenium庫提供了find_element(s)_by_xxx的方法來找到網(wǎng)頁中的輸入框、按鈕等元素。其中xxx可以是id、name、tag_name(標(biāo)簽名)、class_name(class),也可以是xpath(xpath表達(dá)式)等等。當(dāng)然還是要具體分析網(wǎng)頁源代碼。

4.寫代碼

Python模擬登錄的幾種方法

另外有需要云服務(wù)器可以了解下創(chuàng)新互聯(lián)cdcxhl.cn,海內(nèi)外云服務(wù)器15元起步,三天無理由+7*72小時售后在線,公司持有idc許可證,提供“云服務(wù)器、裸金屬服務(wù)器、高防服務(wù)器、香港服務(wù)器、美國服務(wù)器、虛擬主機、免備案服務(wù)器”等云主機租用服務(wù)以及企業(yè)上云的綜合解決方案,具有“安全穩(wěn)定、簡單易用、服務(wù)可用性高、性價比高”等特點與優(yōu)勢,專為企業(yè)上云打造定制,能夠滿足用戶豐富、多元化的應(yīng)用場景需求。

網(wǎng)站題目:Python模擬登錄的幾種方法-創(chuàng)新互聯(lián)
標(biāo)題來源:http://muchs.cn/article20/dchpco.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供網(wǎng)站收錄、網(wǎng)站內(nèi)鏈、網(wǎng)頁設(shè)計公司、網(wǎng)站設(shè)計公司網(wǎng)站策劃、外貿(mào)建站

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網(wǎng)站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時需注明來源: 創(chuàng)新互聯(lián)

外貿(mào)網(wǎng)站制作