Python 爬虫老是被封的解决方法

链接 / 382 / 0 / 创建于 4年前

分享链接：http://www.zhiyoudaili.com/article-id-820....
在爬取的过程中难免发生ip被封和403错误等等，这都是网站检测出你是爬虫而进行反爬措施，在这里为大家总结一下Python爬虫动态ip代理防止被封的方法。

\

首先，设置等待时间：

\

常见的设置等待时间有两种，一种是显性等待时间（强制停几秒），一种是隐性等待时间（看具体情况，比如根据元素加载完成需要时间而等待）图1是显性等待时间设置，图2是隐性。

Python爬虫动态ip代理防止被封的方法

Python爬虫动态ip代理防止被封的方法

第二步，修改请求头：

\

识别你是机器人还是人类浏览器浏览的重要依据就是User-Agent，比如人类用浏览器浏览就会使这个样子的User-Agent：’Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/45.0.2454.101 Safari/537.36’

Python爬虫动态ip代理防止被封的方法

第三步，采用代理ip/建代理ip池

\

直接看代码。利用动态ip代理，可以强有力地保障爬虫不会被封，能够正常运行。图1为使用代理ip的情况，图2是建ip代理池的代码，有没有必要需要看自己的需求，大型项目是必须用大量ip的。

Python爬虫动态ip代理防止被封的方法

做好以上3个步骤，大致爬虫的运行就不成问题了。

\

转载注明来自：智游代理IP http://www.zhiyoudaili.com/

2 声望

暂无个人描述~

推荐文章：

更多推荐...

Python Masonite 框架中文翻译召集（Python 中的类 Laravel 框架） 23 / 25 |

收集了一些各大网站 python 的登陆方式,希望对学习 python 的小白，和想写爬虫的你们有所帮助,,本项目用于研究和分享各大网站的模拟登陆方式 16 / 5 |

Python 3.7 的一些新特性 10 / 2 |

快速掌握一个语言最常用的 50% 11 / 1 |

使用 Python 一步步搭建自己的区块链 22 / 1 |

讨论数量: 0

(=￣ω￣=)··· 暂无内容！

讨论应以学习和精进为目的。请勿发布不友善或者负能量的内容，与人为善，比聪明更重要！

帮助