当前位置 博文首页 > 文章内容

    yuhaosun's blog:Python-爬虫基础—查看网页。

    作者:shunshunshun18 栏目:未分类 时间:2021-10-17 20:12:19

    本站于2023年9月4日。收到“大连君*****咨询有限公司”通知
    说我们IIS7站长博客,有一篇博文用了他们的图片。
    要求我们给他们一张图片6000元。要不然法院告我们

    为避免不必要的麻烦,IIS7站长博客,全站内容图片下架、并积极应诉
    博文内容全部不再显示,请需要相关资讯的站长朋友到必应搜索。谢谢!

    另祝:版权碰瓷诈骗团伙,早日弃暗投明。

    相关新闻:借版权之名、行诈骗之实,周某因犯诈骗罪被判处有期徒刑十一年六个月

    叹!百花齐放的时代,渐行渐远!



    爬虫时有些网站没有api接口,需要转换成json格式,这期教程来分享一下,如何获取网页headers和一些参数。只要你有Chrome。

    第一步

    来到你想爬取的网页,右键选择检查,选择network,如果进去后没有那刷新一下。

    刷新好后,里面会有一个.json结尾的文件,单击他。你就可以看到,网页的json网址。

    获取User-Agent就往下翻,翻到这。

    总之,携带的参数都在这个json文件里。

    一起学习,一起进步!

    cs