91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

java爬蟲實戰之模擬登陸的示例分析

發布時間:2021-04-27 14:04:47 來源:億速云 閱讀:247 作者:小新 欄目:編程語言

這篇文章主要介紹了java爬蟲實戰之模擬登陸的示例分析,具有一定借鑒價值,感興趣的朋友可以參考下,希望大家閱讀完這篇文章之后大有收獲,下面讓小編帶著大家一起了解一下。

Java是什么

Java是一門面向對象編程語言,可以編寫桌面應用程序、Web應用程序、分布式系統和嵌入式系統應用程序。

使用jsoup工具可以解析某個URL地址、HTML文本內容,是java爬蟲很好的優勢,也是我們在網絡爬蟲不可缺少的工具。本文小編帶領大家使用jsoup 實現java爬蟲模擬登陸,通過省力的API,很好的實現java爬蟲模擬登陸。

一、使用工具:Jsoup

jsoup 是一款Java 的HTML解析器,可直接解析某個URL地址、HTML文本內容。它提供了一套非常省力的API,可通過DOM,CSS以及類似于jQuery的操作方法來取出和操作數據。

二、實現java爬蟲模擬登陸

1、確定想要爬取的url

import java.io.BufferedWriter;
import java.io.FileOutputStream;
import java.io.IOException;
import java.io.OutputStreamWriter;
import java.util.Map.Entry;
import java.util.Set;
 
import org.jsoup.Connection;
import org.jsoup.Jsoup;
import org.jsoup.nodes.Document;
import org.jsoup.nodes.Element;
 
public class SplitTable {
 
    public static void main(String[] args) throws IOException {
        //想要爬取的url
        String url = "http://jwcnew.nefu.edu.cn/dblydx_jsxsd/xskb/xskb_list.do?
Ves632DSdyV=NEW_XSD_PYGL";
        String username = "";
        String password = "";
        String sessionId = getSessionInfo(username,password);
        spiderWebSite(sessionId,url);
    }

2、獲取sessionId

private static String getSessionInfo(String username,String password)
 throws IOException{

3、登錄網站,返回sessionId信息

Connection.Response res = Jsoup.connect("http://jwcnew.nefu.edu.cn/dblydx_jsxsd/xk/LoginToXk")

4、獲得sessionId

 String sessionId = res.cookie("JSESSIONID");
        System.out.println(sessionId);
        return sessionId;
    }

5、爬取內容

private static void spiderWebSite(String sessionId,String url) throws IOException{
 
        //爬取
        Document doc = Jsoup.connect(url).cookie("JSESSIONID", sessionId).timeout(10000).get();
        Element table = doc.getElementById("kbtable");
        //System.out.println(table);
        BufferedWriter bw = new BufferedWriter
(new OutputStreamWriter(new FileOutputStream("F:/table.html")));
        bw.write(new String(table.toString().getBytes()));
        bw.flush();
        bw.close();
    }
}

感謝你能夠認真閱讀完這篇文章,希望小編分享的“java爬蟲實戰之模擬登陸的示例分析”這篇文章對大家有幫助,同時也希望大家多多支持億速云,關注億速云行業資訊頻道,更多相關知識等著你來學習!

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

天长市| 三穗县| 鄂伦春自治旗| 萨嘎县| 五家渠市| 车致| 兴仁县| 沾化县| 屏边| 东至县| 双江| 海原县| 绥芬河市| 高州市| 邵阳县| 墨江| 克山县| 金川县| 四子王旗| 高安市| 新津县| 喜德县| 茌平县| 进贤县| 黄浦区| 怀远县| 克什克腾旗| 岳阳市| 吉林市| 宁河县| 丹棱县| 新建县| 行唐县| 胶州市| 循化| 贡嘎县| 莱芜市| 石家庄市| 桂平市| 黄骅市| 越西县|