前言: 这是一篇迟到很久的文章了,人真的是越来越懒,前一阵用jsoup实现了一个功能,个人觉得和selenium的webdriver原理类似,所以今天正好有时间,就又来更新分享了. 实现场景: 爬取博客园https://www.cnblogs.com/longronglang,文章列表中标题.链接.发布时间及阅读量 思路: 1.引入jar包 2.通过httpclient,设置参数,代理,建立连接,获取HTML文档(响应信息) 3.将获取的响应信息,转换成HTML文档为Document对象 4.使…