转载

Scrapy: 10分钟写一个爬虫抓取美女图

scrapy 是一个 python 下面功能丰富、使用快捷方便的爬虫框架。用 scrapy 可以快速的开发一个简单的爬虫，官方给出的一个简单例子足以证明其强大：

当然，开始前，可以先看看之前我们写过的 scrapy 入门文章《Scrapy 从这里开始：Hello Scrapy》。

Scrapy: 10分钟写一个爬虫抓取美女图

下面开始10分钟倒计时：

1. 初始化项目

scrapy startproject mzt

cd mzt

scrapy genspider meizitu meizitu.com

2. 添加 spider 代码：

定义 scrapy.Item ，添加 image_urls 和 images ，为下载图片做准备。

修改 start_urls 为初始页面, 添加 parse 用于处理列表页，添加 parse_item 处理项目页面。 Scrapy: 10分钟写一个爬虫抓取美女图

3. 修改配置文件：

DOWNLOAD_DELAY = 1 # 添加下载延迟配置 ITEM_PIPELINES = {'scrapy.pipelines.images.ImagesPipeline': 1} # 添加图片下载 pipeline IMAGES_STORE = '.' # 设置图片保存目录

4. 运行项目：

scrapy crawl meizitu

看，项目运行效果图

Scrapy: 10分钟写一个爬虫抓取美女图

等待一会儿，就是收获的时候了

Scrapy: 10分钟写一个爬虫抓取美女图

项目源码已经放到了 Github 上面，欢迎大家 star !

https://github.com/zhangheli/ScrapyLabs

原文 http://www.factj.com/archives/609.html

正文到此结束

所属分类：编程技术

本文标签： ip GitHub python 源码 IDE http 目录 UI src 配置开发 tar URLs parse https HTML 下载 git 代码文章
版权声明： 本文为互联网转载文章，出处已在文章中说明(部分除外)。如果侵权，请联系本站长删除，谢谢。
本文海报： 生成海报一生成海报二

本站定位：个人技术类博客

本站作用：写博客、记日志、闲聊扯淡鼓捣技术。