91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

Python如何爬蟲淘寶商品數據

發布時間:2020-09-22 13:50:42 來源:億速云 閱讀:316 作者:小新 欄目:編程語言

這篇文章將為大家詳細講解有關Python如何爬蟲淘寶商品數據,小編覺得挺實用的,因此分享給大家做個參考,希望大家閱讀完這篇文章后可以有所收獲。

這次的主要的目的是從淘寶的搜索頁面獲取商品的信息。其實分析頁面找到信息很容易,頁面信息的存放都是以靜態的方式直接嵌套的頁面上的,很容易找到。主要困難是將信息從HTML源碼中剝離出來,數據和網頁源碼結合的很緊密,剝離數據有一定的難度。

然后將獲取的信息寫入excel表格保存起來,這次只爬取了前面10頁的內容。

代碼如下:

import requests
import re
from xlwt import Workbook
import xlrd
import time
def key_name( number ):
    #獲取頁面的內容并返回
    name = '手機'
    URL_1 = "https://s.taobao.com/search?ie=utf8&initiative_id=staobaoz_20170905&stats_click=search_radio_all%3A1&js=1&imgfile=&q="
    URL_2 = "&suggest=0_1&_input_charset=utf-8&wq=u&suggest_query=u&source=suggest&p4ppushleft=5%2C48&s="
    URL = ( URL_1 + name + URL_2 + str(number))
    #print(URL)
    res = requests.get( URL )
    return res.text
def find_date( text):
    #根據整個頁面的信息,獲取商品的數據所在的HTML源碼并放回
    reg = r',"data":{"spus":\[({.+?)\]}},"header":'
    reg = re.compile(reg)
    info = re.findall(reg, text)
    return info[0]
def manipulation_data( info, N, sheet ):
    #解析獲取的HTML源碼,獲取數據
    Date = eval(info)
    for d in Date:
        T = " ".join([t['tag'] for t in d['tag_info']])
        #print(d['title'] + '\t' + d['price'] + '\t' + d['importantKey'][0:len(d['importantKey'])-1] + '\t' + T)
        
        sheet.write(N,0,d['title'])
        sheet.write(N,1,d['price'])
        sheet.write(N,2,T)
        N = N + 1
    return N
    
    
def main():
    
    book = Workbook()
    sheet = book.add_sheet('淘寶手機數據')
    sheet.write(0,0,'品牌')
    sheet.write(0,1,'價格')
    sheet.write(0,2,'配置')
    book.save('淘寶手機數據.xls')
    #k用于生成鏈接,每個鏈接的最后面的數字相差48.
    #N用于記錄表格的數據行數,便于寫入數據
    k = 0
    N = 1
    for i in range(10+1):
        text = key_name( k + i * 48 )
        info = find_date(text)
        N = manipulation_data( info ,N, sheet )
    
        book.save('淘寶手機數據.xls')
        print('下載第' + str(i) + '頁完成')
if __name__ == '__main__':
    main()

關于Python如何爬蟲淘寶商品數據就分享到這里了,希望以上內容可以對大家有一定的幫助,可以學到更多知識。如果覺得文章不錯,可以把它分享出去讓更多的人看到。

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

利津县| 汤原县| 将乐县| 惠州市| 庆阳市| 浑源县| 克什克腾旗| 清丰县| 延长县| 连平县| 白沙| 鄱阳县| 三台县| 图木舒克市| 丰原市| 曲麻莱县| 北安市| 汨罗市| 枝江市| 阳西县| 崇义县| 大化| 昌黎县| 闸北区| 长宁区| 原平市| 南安市| 固镇县| 克什克腾旗| 远安县| 呼和浩特市| 洛南县| 龙山县| 娱乐| 防城港市| 瑞昌市| 中西区| 安徽省| 新巴尔虎左旗| 平阳县| 南和县|