91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

怎么用Python爬取2022春節檔電影信息

發布時間:2022-01-26 09:00:50 來源:億速云 閱讀:152 作者:小新 欄目:開發技術

這篇文章將為大家詳細講解有關怎么用Python爬取2022春節檔電影信息,小編覺得挺實用的,因此分享給大家做個參考,希望大家閱讀完這篇文章后可以有所收獲。

實驗環境

Python 3.x (面向對象的高級語言)
Resquest 2.14.2 (python第三方庫)
Pandas 1.1.0(python第三方庫)
Time (python標準庫)
Lxml(python第三方庫)

具體步驟

目標網站

https://movie.douban.com/cinema/later/shenzhen/

怎么用Python爬取2022春節檔電影信息

分析網站

按F12打開瀏覽器操作臺

怎么用Python爬取2022春節檔電影信息

按Ctrl+Shift+C快捷鍵

怎么用Python爬取2022春節檔電影信息

按Ctrl+F快捷鍵,控制臺出現搜索框

怎么用Python爬取2022春節檔電影信息

復制Xpath

Xpath為//*[@id=“showing-soon”]/div[1]/div/h4/a

怎么用Python爬取2022春節檔電影信息

粘貼到搜索框,驗證Xpath

怎么用Python爬取2022春節檔電影信息

查看HTML,尋找共性

怎么用Python爬取2022春節檔電影信息

發現目標元素都在一個div框里,修改Xpath

Xpath修改為//*[@id=“showing-soon”]/div/div/h4/a

怎么用Python爬取2022春節檔電影信息

其余目標元素,以此類推

怎么用Python爬取2022春節檔電影信息

最后,用Pandas保存為CSV文件

# 利用pandas保存文件
df = pd.DataFrame()
df['上映日期'] =  Ondate
df['片名'] =  name
df['類型'] =  movie_class
df['制片國家/地區'] = area
df['想看人數'] = num
df['超鏈接'] = href

怎么用Python爬取2022春節檔電影信息

代碼實現

# -*- coding: utf-8 -*-
"""
Created on Tue Jan 25 10:07:11 2022
@author: TFX
"""
import time
import requests # 請求庫
import pandas as pd
from lxml import etree# 提取信息庫
# 日期
today = time.strftime('%Y{y}%m{m}%daegqsqibtmh',time.localtime()).format(y='年',m='月',d='日')
# 網址
url = 'https://movie.douban.com/cinema/later/shenzhen/'
# 請求頭
headers = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/80.0.3987.163 Safari/537.36'
        }
# 發送請求
response = requests.get(url=url,headers=headers)
# 數據解析,xpath可以用瀏覽器檢查元素獲得
html = etree.HTML(response.text) #類型變換
# 電影詳細超鏈接
href = html.xpath('//*[@id="showing-soon"]/div/div/h4/a/@href')
# 上映日期
Ondate =  html.xpath('//*[@id="showing-soon"]/div/div/ul/li[1]/text()')
# 片名
name = html.xpath('//*[@id="showing-soon"]/div/div/h4/a/text()')
# 類型
movie_class = html.xpath('//*[@id="showing-soon"]/div/div/ul/li[2]/text()')
# 制片國家 / 地區
area = html.xpath('//*[@id="showing-soon"]/div/div/ul/li[3]/text()')
# 想看人數
num = html.xpath('//*[@id="showing-soon"]/div/div/ul/li[4]/span/text()')
# 利用pandas保存文件
df = pd.DataFrame()
df['上映日期'] =  Ondate
df['片名'] =  name
df['類型'] =  movie_class
df['制片國家/地區'] = area
df['想看人數'] = num
df['超鏈接'] = href
df.to_csv('2022春節檔電影_'+today+'.csv',mode='w',index=None,encoding='gbk')
print('保存完成!')

輸出結果

怎么用Python爬取2022春節檔電影信息

怎么用Python爬取2022春節檔電影信息

怎么用Python爬取2022春節檔電影信息

關于“怎么用Python爬取2022春節檔電影信息”這篇文章就分享到這里了,希望以上內容可以對大家有一定的幫助,使各位可以學到更多知識,如果覺得文章不錯,請把它分享出去讓更多的人看到。

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

仪陇县| 周口市| 安陆市| 长阳| 大余县| 永城市| 荣昌县| 利川市| 镇江市| 乌鲁木齐县| 石家庄市| 福海县| 岳池县| 岳阳市| 华坪县| 三河市| 乐安县| 合江县| 景谷| 达拉特旗| 禹州市| 湛江市| 仲巴县| 亚东县| 得荣县| 永善县| 县级市| 英吉沙县| 荥经县| 古蔺县| 湖南省| 梁平县| 六安市| 岱山县| 和静县| 宝兴县| 阜阳市| 和政县| 贵港市| 清原| 寿宁县|