91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

如何使用代理服務器爬取數據

發布時間:2021-04-30 14:58:09 來源:億速云 閱讀:197 作者:Leah 欄目:編程語言

這篇文章將為大家詳細講解有關如何使用代理服務器爬取數據,文章內容質量較高,因此小編分享給大家做個參考,希望大家閱讀完這篇文章后對相關知識有一定的了解。

1、爬取步驟

(1)導入程序所需的庫。使用代理服務器,可以新設函數(use_proxy)參數分別登錄的網站和必要的代理服務器地址。然后定義代理服務器的具體IP地址和端口號。建立opener,其中opener需要添加相應的參數,即IP對象和urlib.request.HTTPHandler(固定)。然后將opener對象添加到全局對象。使用urlopen(url)打開特定的網站。

(2)輸入代理服務器的IP地址和端口號,輸入打開的網頁url,使用use_proxy()函數返回所需的data,因為數據很多,所以只顯示數據的長度。

2、實例

import urllib.request
def use_proxy(url,proxy_addr):
proxy=urllib.request.ProxyHandler({"http":proxy_addr})
opener=urllib.request.build_opener(proxy,urllib.request.HTTPHandler)
urllib.request.install_opener(opener)
data=urllib.request.urlopen(url).read().decode("utf-8","ignore")
return data
proxy_addr="112.85.130.14:9999"
url="http://www.baidu.com"
data=use_proxy(url,proxy_addr)
print(len(data))

關于如何使用代理服務器爬取數據就分享到這里了,希望以上內容可以對大家有一定的幫助,可以學到更多知識。如果覺得文章不錯,可以把它分享出去讓更多的人看到。

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

白水县| 芦溪县| 桐城市| 格尔木市| 汽车| 海口市| 岳阳县| 兴宁市| 峡江县| 建德市| 从江县| 德安县| 石渠县| 东乌珠穆沁旗| 晋州市| 冷水江市| 扬州市| 全南县| 乐昌市| 冕宁县| 出国| 南投市| 阿鲁科尔沁旗| 延安市| 合阳县| 杭锦后旗| 象山县| 将乐县| 诏安县| 新巴尔虎左旗| 新丰县| 南安市| 汤原县| 湾仔区| 东乡族自治县| 新晃| 青神县| 南昌县| 定日县| 扶沟县| 保山市|