正文

方法一：直接使用已知的cookie訪問

特點：

　　簡單，但需要先在瀏覽器登錄

原理：

　　簡單地說，cookie保存在發起請求的客戶端中，服務器利用cookie來區分不同的客戶端。因為http是一種無狀態的連接，當服務器一下子收到好幾個請求時，是無法判斷出哪些請求是同一個客戶端發起的。而“訪問登錄后才能看到的頁面”這一行為，恰恰需要客戶端向服務器證明：“我是剛才登錄過的那個客戶端”。於是就需要cookie來標識客戶端的身份，以存儲它的信息（如登錄狀態）。

　　當然，這也意味着，只要得到了別的客戶端的cookie，我們就可以假冒成它來和服務器對話。這給我們的程序帶來了可乘之機。

　　我們先用瀏覽器登錄，然后使用開發者工具查看cookie。接着在程序中攜帶該cookie向網站發送請求，就能讓你的程序假扮成剛才登錄的那個瀏覽器，得到只有登錄后才能看到的頁面。

具體步驟：

1.用瀏覽器登錄，獲取瀏覽器里的cookie字符串

　　先使用瀏覽器登錄。再打開開發者工具，轉到network選項卡。在左邊的Name一欄找到當前的網址，選擇右邊的Headers選項卡，查看Request Headers，這里包含了該網站頒發給瀏覽器的cookie。對，就是后面的字符串。把它復制下來，一會兒代碼里要用到。

　　注意，最好是在運行你的程序前再登錄。如果太早登錄，或是把瀏覽器關了，很可能復制的那個cookie就過期無效了。

2.寫代碼

　　urllib庫的版本：

[ 復制代碼 ](javascript:void(0)😉

import sys
import io
from urllib import request

sys.stdout = io.TextIOWrapper(sys.stdout.buffer,encoding='utf8') #改變標准輸出的默認編碼

#登錄后才能訪問的網站
url = 'http://ssfw.xmu.edu.cn/cmstar/index.portal'

#瀏覽器登錄后得到的cookie，也就是剛才復制的字符串
cookie_str = r'JSESSIONID=xxxxxxxxxxxxxxxxxxxxxx; iPlanetDirectoryPro=xxxxxxxxxxxxxxxxxx'

#登錄后才能訪問的網頁
url = 'http://ssfw.xmu.edu.cn/cmstar/index.portal'

req = request.Request(url)
#設置cookie
req.add_header('cookie', raw_cookies)
#設置請求頭
req.add_header('User-Agent', 'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/60.0.3112.113 Safari/537.36')

resp = request.urlopen(req)

print(resp.read().decode('utf-8'))

[ 復制代碼 ](javascript:void(0)😉

　　requests庫的版本：

[ 復制代碼 ](javascript:void(0)😉

import requests
import sys
import io

sys.stdout = io.TextIOWrapper(sys.stdout.buffer,encoding='utf8') #改變標准輸出的默認編碼

#登錄后才能訪問的網頁
url = 'http://ssfw.xmu.edu.cn/cmstar/index.portal'

#瀏覽器登錄后得到的cookie，也就是剛才復制的字符串
cookie_str = r'JSESSIONID=xxxxxxxxxxxxxxxxxxxxxx; iPlanetDirectoryPro=xxxxxxxxxxxxxxxxxx'

#把cookie字符串處理成字典，以便接下來使用
cookies = {}
for line in cookie_str.split(';'):
    key, value = line.split('=', 1)
    cookies[key] = value

[ 復制代碼 ](javascript:void(0)😉

方法二：模擬登錄后再攜帶得到的cookie訪問

原理：

　　我們先在程序中向網站發出登錄請求，也就是提交包含登錄信息的表單（用戶名、密碼等）。從響應中得到cookie，今后在訪問其他頁面時也帶上這個cookie，就能得到只有登錄后才能看到的頁面。

具體步驟：

1.找出表單提交到的頁面

　　還是要利用瀏覽器的開發者工具。轉到network選項卡，並勾選Preserve Log（重要！）。在瀏覽器里登錄網站。然后在左邊的Name一欄找到表單提交到的頁面。怎么找呢？看看右側，轉到Headers選項卡。首先，在General那段，Request Method應當是POST。其次最下方應該要有一段叫做Form Data的，里面可以看到你剛才輸入的用戶名和密碼等。也可以看看左邊的Name，如果含有login這個詞，有可能就是提交表單的頁面（不一定！）。

　　這里要強調一點，“表單提交到的頁面”通常並不是你填寫用戶名和密碼的頁面！所以要利用工具來找到它。

2.找出要提交的數據

　　雖然你在瀏覽器里登陸時只填了用戶名和密碼，但表單里包含的數據可不只這些。從Form Data里就可以看到需要提交的所有數據。

3.寫代碼

　urllib庫的版本：

[ 復制代碼 ](javascript:void(0)😉

import sys
import io
import urllib.request
import http.cookiejar

sys.stdout = io.TextIOWrapper(sys.stdout.buffer,encoding='utf8') #改變標准輸出的默認編碼

#登錄時需要POST的數據
data = {'Login.Token1':'學號', 
        'Login.Token2':'密碼', 
        'goto:http':'//ssfw.xmu.edu.cn/cmstar/loginSuccess.portal', 
        'gotoOnFail:http':'//ssfw.xmu.edu.cn/cmstar/loginFailure.portal'}
post_data = urllib.parse.urlencode(data).encode('utf-8')

#設置請求頭
headers = {'User-agent':'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/60.0.3112.113 Safari/537.36'}

#登錄時表單提交到的地址（用開發者工具可以看到）
login_url = ' http://ssfw.xmu.edu.cn/cmstar/userPasswordValidate.portal

#構造登錄請求
req = urllib.request.Request(login_url, headers = headers, data = post_data)

#構造cookie
cookie = http.cookiejar.CookieJar()

#由cookie構造opener
opener = urllib.request.build_opener(urllib.request.HTTPCookieProcessor(cookie))

#發送登錄請求，此后這個opener就攜帶了cookie，以證明自己登錄過
resp = opener.open(req)

#登錄后才能訪問的網頁
url = 'http://ssfw.xmu.edu.cn/cmstar/index.portal'

#構造訪問請求
req = urllib.request.Request(url, headers = headers)

resp = opener.open(req)

print(resp.read().decode('utf-8'))

[ 復制代碼 ](javascript:void(0)😉

　　requests庫的版本：

[ 復制代碼 ](javascript:void(0)😉

import requests
import sys
import io

sys.stdout = io.TextIOWrapper(sys.stdout.buffer,encoding='utf8') #改變標准輸出的默認編碼

#登錄后才能訪問的網頁
url = 'http://ssfw.xmu.edu.cn/cmstar/index.portal'

#瀏覽器登錄后得到的cookie，也就是剛才復制的字符串
cookie_str = r'JSESSIONID=xxxxxxxxxxxxxxxxxxxxxx; iPlanetDirectoryPro=xxxxxxxxxxxxxxxxxx'

#把cookie字符串處理成字典，以便接下來使用
cookies = {}
for line in cookie_str.split(';'):
    key, value = line.split('=', 1)
    cookies[key] = value

#設置請求頭
headers = {'User-agent':'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/60.0.3112.113 Safari/537.36'}

#在發送get請求時帶上請求頭和cookies
resp = requests.get(url, headers = headers, cookies = cookies)
        
print(resp.content.decode('utf-8'))

[ 復制代碼 ](javascript:void(0)😉

　　明顯感覺requests庫用着更方便啊~~~

方法三：模擬登錄后用session保持登錄狀態

原理：

　　session是會話的意思。和cookie的相似之處在於，它也可以讓服務器“認得”客戶端。簡單理解就是，把每一個客戶端和服務器的互動當作一個“會話”。既然在同一個“會話”里，服務器自然就能知道這個客戶端是否登錄過。

具體步驟：

1.找出表單提交到的頁面

2.找出要提交的數據

　　這兩步和方法二的前兩步是一樣的

3.寫代碼

　　requests庫的版本

[ 復制代碼 ](javascript:void(0)😉

import requests
import sys
import io

sys.stdout = io.TextIOWrapper(sys.stdout.buffer,encoding='utf8') #改變標准輸出的默認編碼

#登錄時需要POST的數據
data = {'Login.Token1':'學號', 
        'Login.Token2':'密碼', 
        'goto:http':'//ssfw.xmu.edu.cn/cmstar/loginSuccess.portal', 
        'gotoOnFail:http':'//ssfw.xmu.edu.cn/cmstar/loginFailure.portal'}

#設置請求頭
headers = {'User-agent':'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/60.0.3112.113 Safari/537.36'}

#登錄時表單提交到的地址（用開發者工具可以看到）
login_url = 'http://ssfw.xmu.edu.cn/cmstar/userPasswordValidate.portal'

#構造Session
session = requests.Session()

#在session中發送登錄請求，此后這個session里就存儲了cookie
#可以用print(session.cookies.get_dict())查看
resp = session.post(login_url, data)

#登錄后才能訪問的網頁
url = 'http://ssfw.xmu.edu.cn/cmstar/index.portal'

#發送訪問請求
resp = session.get(url)

print(resp.content.decode('utf-8'))

[ 復制代碼 ](javascript:void(0)😉

方法四：使用無頭瀏覽器訪問

特點：

　　功能強大，幾乎可以對付任何網頁，但會導致代碼效率低

原理：

　　如果能在程序里調用一個瀏覽器來訪問網站，那么像登錄這樣的操作就輕而易舉了。在Python中可以使用Selenium庫來調用瀏覽器，寫在代碼里的操作（打開網頁、點擊……）會變成瀏覽器忠實地執行。這個被控制的瀏覽器可以是Firefox，Chrome等，但最常用的還是PhantomJS這個無頭（沒有界面）瀏覽器。也就是說，只要把填寫用戶名密碼、點擊“登錄”按鈕、打開另一個網頁等操作寫到程序中，PhamtomJS就能確確實實地讓你登錄上去，並把響應返回給你。

具體步驟：

1.安裝selenium庫、PhantomJS瀏覽器

2.在源代碼中找到登錄時的輸入文本框、按鈕這些元素

　　因為要在無頭瀏覽器中進行操作，所以就要先找到輸入框，才能輸入信息。找到登錄按鈕，才能點擊它。

　　在瀏覽器中打開填寫用戶名密碼的頁面，將光標移動到輸入用戶名的文本框，右鍵，選擇“審查元素”，就可以在右邊的網頁源代碼中看到文本框是哪個元素。同理，可以在源代碼中找到輸入密碼的文本框、登錄按鈕。

3.考慮如何在程序中找到上述元素

　　Selenium庫提供了find_element(s)_by_xxx的方法來找到網頁中的輸入框、按鈕等元素。其中xxx可以是id、name、tag_name（標簽名）、class_name（class），也可以是xpath（xpath表達式）等等。當然還是要具體分析網頁源代碼。

4.寫代碼

[ 復制代碼 ](javascript:void(0)😉

import requests
import sys
import io
from selenium import webdriver

sys.stdout = io.TextIOWrapper(sys.stdout.buffer, encoding='utf8') #改變標准輸出的默認編碼

#建立Phantomjs瀏覽器對象，括號里是phantomjs.exe在你的電腦上的路徑
browser = webdriver.PhantomJS('d:/tool/07-net/phantomjs-windows/phantomjs-2.1.1-windows/bin/phantomjs.exe')

#登錄頁面
url = r'http://ssfw.xmu.edu.cn/cmstar/index.portal'

# 訪問登錄頁面
browser.get(url)

# 等待一定時間，讓js腳本加載完畢
browser.implicitly_wait(3)

#輸入用戶名
username = browser.find_element_by_name('user')
username.send_keys('學號')

#輸入密碼
password = browser.find_element_by_name('pwd')
password.send_keys('密碼')

#選擇“學生”單選按鈕
student = browser.find_element_by_xpath('//input[@value="student"]')
student.click()

#點擊“登錄”按鈕
login_button = browser.find_element_by_name('btn')
login_button.submit()

#網頁截圖
browser.save_screenshot('picture1.png')
#打印網頁源代碼
print(browser.page_source.encode('utf-8').decode())

browser.quit()

[ 復制代碼 ](javascript:void(0)😉

免責聲明！

本站轉載的文章為個人學習借鑒使用，本站對版權不負任何法律責任。如果侵犯了您的隱私權益，請聯系本站郵箱yoyou2525@163.com刪除。

猜您在找 Python模擬登錄的幾種方法 Python模擬登錄的幾種方法 Python 模擬登錄幾種常見方法使用javascript和css模擬幀動畫的幾種方法淺析 Python 模擬淘寶登錄的兩種方法爬蟲模擬登陸的幾種方法破解FTP登錄密碼的幾種方法 python 解壓的幾種方法 Python 下載的幾種方法使用Python下載A股行情的幾種方法

使用Python模擬登錄的幾種方法

Python模擬登錄的幾種方法

目錄

正文

方法一：直接使用已知的cookie訪問

特點：

原理：

具體步驟：

方法二：模擬登錄后再攜帶得到的cookie訪問

原理：

具體步驟：

方法三：模擬登錄后用session保持登錄狀態

原理：

具體步驟：

方法四：使用無頭瀏覽器訪問

特點：

原理：

具體步驟：

免責聲明！