java爬虫抓取网页数据(java写爬虫没python好吗)

  前言:网络矿工采集教程——车质量数据采集,适合新手。  目标网站:https://www.12365auto.c...

  前言:网络矿工采集教程——车质量数据采集,适合新手。

  目标网站:https://www.12365auto.com/zlts/0-0-0-0-0-0_0-0-1.shtml

  翻页数量:5251

  采集类型:翻页采集数据

  第一步:增加采集网址

  在网址参数选择【递增变量】起始值1、结束值5251 、点击确定 。

  正确的是:https://www.12365auto.com/zlts/0-0-0-0-0-0_0-0-{Num:1,5251,1}.shtml

  第二步:采集数据

  点击采集数据 ,增加。

  /body[1]/div[2]/div[4]/div[2]/table[1]/tr[{Num:2,31,1}]/td[2]

  填写采集数据名称:投诉品牌

  选择可视化配置

  点击可视化提取

  输入其中一天页数网址:https://www.12365auto.com/zlts/0-0-0-0-0-0_0-0-1.shtml

java爬虫抓取网页数据(java写爬虫没python好吗)

  点击转到

  1、点击开始捕获

  2、选择多条

  3 、鼠标单击上海通用雪弗兰

  滚动条拉到最后

  4、单击之后 xPath表达式会有变化,自动匹配是{Num:2,7,1} 要把7修改成30,一般不需要修改 ,这里的页面特殊,所以修改,7代表匹配了7条数据 ,但实际上一页是30条数据。所以要修改成30!

  xPath:/body[1]/div[2]/div[4]/div[2]/table[1]/tr[{Num:2,30,1}]/td[2]

  然后点击确认退出

  点击确定

  点击测试

  点击启动测试

java爬虫抓取网页数据(java写爬虫没python好吗)

  看到数据列表就代表数据测试成功!后面步骤和之前一样!看下演示:

本文来自作者[恭喜发财]投稿,不代表华智号立场,如若转载,请注明出处:https://www.bjxhzyykj.cn/miao/750.html

赞 (1)

文章推荐

发表回复

本站作者才能评论

评论列表(4条)

  • 恭喜发财
    恭喜发财 2026-09-27

    我是华智号的签约作者“恭喜发财”!

  • 恭喜发财
    恭喜发财 2026-09-27

    希望本篇文章《java爬虫抓取网页数据(java写爬虫没python好吗)》能对你有所帮助!

  • 恭喜发财
    恭喜发财 2026-09-27

    本站[华智号]内容主要涵盖:华智号,生活百科,小常识,生活小窍门,百科大全,经验网

  • 恭喜发财
    恭喜发财 2026-09-27

    本文概览:  前言:网络矿工采集教程——车质量数据采集,适合新手。  目标网站:https://www.12365auto.c...

    联系我们

    邮件:华智网络@sina.com

    工作时间:周一至周五,9:30-18:30,节假日休息

    关注我们