当前位置: 首页 » 综合知识 » it知识 » 正文

如何用python获取免费代理IP

发布时间:2023-07-22 以下文章来源于网友投稿,内容仅供参考!

首先创建scrapy项目, 运行一下命令:

$ scrapy startproject getProxy kuaidaili

$ scrapy genspider proxyKdlSpider kuaidaili

百度搜索免费代理ip, 我进的是快代理, 页面通过列表显示代理ip及其相关信息的。

3. 通过以上的界面, 改写items.py, 增加如下项, 用来保存代理ip的相关信息

4. 通过观察页面源码, 发现我们需要的代理ip信息可用xpath轻易获取。

5. 通过上图观察到的规律改写proxyKdlSpider.py文件, 通过如下xpath可获取代理ip信息。

6. 改写pipelines.py, 将解析提取出来的代理ip信息保存到文件proxy.txt中。

7. 改写settings.py, 增加以下行:

其中USER_AGENT会改写请求headers。 因快代理网站会通过USER_AGENT来判断访问者是否爬虫, 不这样设置会导致运行爬虫的ip被封禁。

设置DOWNLOAD_DELAY=5含义是爬虫每5s请求一个网页, 这样设置的目的是为了避免快速访问大量网页触发网站的反爬虫机制

设置ITEM_PIPELINES是告诉爬虫在过滤完需要的信息后如何保存。

8 运行编写的爬虫:

$ scrapy crawl proxyKdlSpider

由于我们限制了采集速度, 过程会有点长。 运行完毕后采集结果如下:

  • • Linux Ecdsa密钥长度选择有何依据

    在Linux

  • • Linux Khook在内核监控中的应用如何

    Linux

  • • Linux Gsoap是否支持异步通信

    GSOAP是

  • • Linux Coremail如何提升用户体验

    提升Linu

  • • Linux Ecdsa算法有哪些局限性

    ECDSA

  • 哎呀音乐钢琴键盘学习《 钢琴主人训练营》 西瓜学琴
    郭蝈 陪练钢琴 30节课时 考级刚需 让孩子每一次练琴都是高质量的
    30天轻松学会五线谱 流行钢琴自学初级教程 牙牙学琴
    流行爵士钢琴实战技巧VIP课 - 继伟 哎呀音乐
    【海上钢琴师】原版 MT1990钢琴谱
    百首经典流行钢琴实战曲集 - 继伟
    雷费尔德电钢琴重锤88键专业考级儿童初学者数码电子钢琴家用
    小练咖 真人钢琴陪练 1v1服务 2999随时退 1课时50分钟 考级刚需
    雅马哈电钢琴88键重锤CLP735智能数码电子钢琴家用专业初学者考级
    【原装进口】Yamaha/雅马哈钢琴 b121 SC2原声静音钢琴
  • 珠海专业调钢琴
  • 天津宝坻区调钢琴
  • 天津静海区钢琴调音
  • 成都简阳市钢琴调律
  • 大连瓦房店市钢琴调音
  • 眉山调钢琴联系方式
  • 惠州大亚湾钢琴调琴师
  • 长治调琴师
  • 厦门湖里区钢琴调音师
  • 上海普陀区钢琴调音师