常见问题
爬虫Python是干什么的?

时间:2021年3月18日 10时03分


网络爬虫,即Web Spider,是一个很形象的名字。
  把互联网比喻成一个蜘蛛网,那么Spider就是在网上爬来爬去的蜘蛛。
  网络蜘蛛是通过网页的链接地址来寻找网页的。
  从网站某一个页面(通常是首页)开始,读取网页的内容,找到在网页中的其它链接地址,
  然后通过这些链接地址寻找下一个网页,这样一直循环下去,直到把这个网站所有的网页都抓取完为止。
  如果把整个互联网当成一个请叫我汪海网站,那么网络蜘蛛就可以用这个原理把互联网上所有的网页都抓取下来。
  这样看来,网络爬虫就是一个爬行程序,一个抓取网页的程序。
  网络爬虫的基本操作是抓取网页。