91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

python批量爬取xml文件

發布時間:2020-06-11 21:40:41 來源:網絡 閱讀:1144 作者:zddnyl 欄目:編程語言

1.網站鏈接:https://www.cnvd.org.cn/shareData/list

2.需要下載的頁面文件:
python批量爬取xml文件

3.該頁面需要登陸,然后批量下載共享漏洞文件,我們就通過cookie來實現。

#!/usr/bin/env python
# -*- coding: utf-8 -*-

"""
Date: 2019-08-17
Author: Bob
Description: python爬取xml文件
"""

import requests
from bs4 import BeautifulSoup

def cnvd_spider():
    url = 'https://www.cnvd.org.cn/shareData/list?max=240&offset=0'

    headers = {
        "Cookie": "__jsluid_s=65d5e7902f04498e89b16e93fb010b3c; __jsluid_h=1ab428e655aee36ac3c9835db29b6714; JSESSIONID=91BB91B37543D365AA64895EDFCD828F; __jsl_clearance=1566003116.655|0|CYPFsKirGYBG12qtoOrS5Kq1rM0%3D",
        "User-Agent": "Mozilla/5.0 (Macintosh; Intel Mac OS X 10_14_6) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/76.0.3809.100 Safari/537.36",
    }

    html = requests.get(url=url, headers=headers).text
    soup = BeautifulSoup(html, 'lxml')
    links = soup.find_all('a', attrs={'title': '下載xml'})

    for link in links:
        url = 'https://www.cnvd.org.cn' + link.get('href')
        file_name = link.get_text()
        html_data = requests.get(url=url, headers=headers)
        with open(file_name, 'w') as f:
            f.write(html_data.content)

if __name__ == '__main__':
    cnvd_spider()
向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

九江市| 甘南县| 会宁县| 溧阳市| 达日县| 太和县| 读书| 宁城县| 嘉禾县| 雷山县| 云南省| 隆昌县| 浪卡子县| 大宁县| 谷城县| 大安市| 澜沧| 衢州市| 府谷县| 临猗县| 舞阳县| 钟山县| 梁河县| 堆龙德庆县| 孟村| 伊宁市| 北辰区| 大港区| 红桥区| 达日县| 水城县| 开阳县| 沁阳市| 信丰县| 鄂尔多斯市| 汤原县| 宁晋县| 江安县| 贵溪市| 西藏| 平原县|