首页
网络爬虫概述笔记
网络爬虫概述
什么是网络爬虫?
通俗理解:爬虫是一个模拟人类请求网站行为的程序,可以自动请求网页,并抓取下来,然后用一定的规则提取有价值的数据。
通用爬虫和聚焦爬虫
通用爬虫
是搜索引擎抓取系统的重要组成部分。主要是将互联网的内容下载到本地,形成一个互联网内容的镜像备份。
聚焦爬虫
是面向特定需求的一种网络爬虫程序,他与通用爬虫的区别在于:聚焦爬虫在实施网页抓取的时候会对内容进行筛选和处理,尽量保证只抓取与需求相关的网页信息
爬虫
笔记
相关
Git--学习笔记(三)远程仓库克隆到本地
rocketmq入门笔记
ClickHouse源码阅读笔记(二)之Interpreter介绍
[学习笔记] 整数规划之割平面法 How and why?
计网学习笔记(5) - 物理层与媒介
09-面向对象课堂笔记
python-面向对象-01课堂笔记
04-函数-课堂笔记
爬虫安装相关软件
python爬虫
Python爬虫--beautifulsoup 4 用法
R语言入门视频笔记--10--数据挖掘
标签