python爬取js动态网页 js注入和selenium的优缺点？

2021-03-11

1238

js注入和selenium的优缺点？静态爬网方法太多，而且非常简单。但动态抓取不一样，普通网站抓包也能找到接口文件，但大型网站不那么容易找到，所以在数据量小的情况下还是乖乖使用selenium来抓取。

js注入和selenium的优缺点？

静态爬网方法太多，而且非常简单。

但动态抓取不一样，普通网站抓包也能找到接口文件，但大型网站不那么容易找到，所以在数据量小的情况下还是乖乖使用selenium来抓取。

硒的优点：好像没有它就爬不上去，操作简单。

硒的缺点：耗时，效率低，模仿手动点击。

爬行不行，爬行的本质是用脚本批量访问。就像你去过无数次一样。

知网的访问权是爬行知网的首要要求。

未经允许，您不能爬行。

其次，即使您有访问权限，也不能批量下载。知网对访问有限制。如果你抓取超过20篇论文，你的帐户将被锁定，你无法继续下载它们。