<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="zh-Hans-CN">
	<id>https://ac-wiki.cn/index.php?action=history&amp;feed=atom&amp;title=%E7%88%AC%E8%99%AB</id>
	<title>爬虫 - 版本历史</title>
	<link rel="self" type="application/atom+xml" href="https://ac-wiki.cn/index.php?action=history&amp;feed=atom&amp;title=%E7%88%AC%E8%99%AB"/>
	<link rel="alternate" type="text/html" href="https://ac-wiki.cn/index.php?title=%E7%88%AC%E8%99%AB&amp;action=history"/>
	<updated>2026-08-24T04:33:45Z</updated>
	<subtitle>本wiki上该页面的版本历史</subtitle>
	<generator>MediaWiki 1.45.3</generator>
	<entry>
		<id>https://ac-wiki.cn/index.php?title=%E7%88%AC%E8%99%AB&amp;diff=2044&amp;oldid=prev</id>
		<title>天明：​创建页面，内容为“网络爬虫（Web Crawler）是一种按照特定规则自动抓取互联网信息的程序或脚本。其核心功能是遍历网页链接并提取页面内容，常用于搜索引擎索引构建、数据采集、内容聚合与监测。爬虫通常由URL调度器、下载器、解析器及存储模块组成，需遵守爬取频率限制与robots.txt协议。自1993年世界首个爬虫“World Wide Web Wanderer”诞生以来，爬虫技术随互联网发展…”</title>
		<link rel="alternate" type="text/html" href="https://ac-wiki.cn/index.php?title=%E7%88%AC%E8%99%AB&amp;diff=2044&amp;oldid=prev"/>
		<updated>2026-06-08T04:16:47Z</updated>

		<summary type="html">&lt;p&gt;创建页面，内容为“网络爬虫（Web Crawler）是一种按照特定规则自动抓取互联网信息的程序或脚本。其核心功能是遍历网页链接并提取页面内容，常用于搜索引擎索引构建、数据采集、内容聚合与监测。爬虫通常由URL调度器、下载器、解析器及存储模块组成，需遵守爬取频率限制与robots.txt协议。自1993年世界首个爬虫“World Wide Web Wanderer”诞生以来，爬虫技术随互联网发展…”&lt;/p&gt;
&lt;p&gt;&lt;b&gt;新页面&lt;/b&gt;&lt;/p&gt;&lt;div&gt;网络爬虫（Web Crawler）是一种按照特定规则自动抓取互联网信息的程序或脚本。其核心功能是遍历网页链接并提取页面内容，常用于搜索引擎索引构建、数据采集、内容聚合与监测。爬虫通常由URL调度器、下载器、解析器及存储模块组成，需遵守爬取频率限制与robots.txt协议。自1993年世界首个爬虫“World Wide Web Wanderer”诞生以来，爬虫技术随互联网发展持续演进，从单线程脚本演变为分布式、支持JavaScript渲染的复杂系统，广泛应用于商业情报、学术研究及运维监控等领域。&lt;/div&gt;</summary>
		<author><name>天明</name></author>
	</entry>
</feed>