Scrapy 源码阅读（一）：Twisted 基础和 Scrapy 数据流

2020年4月18日 kevinbai 1,574 人阅读

本文记录下自己看 Scrapy 源码的一点经验，没有涉及框架的方方面面，更多的是关注数据的流转以及代码的组织。如果你想深入框架的某个细节，那么这篇文字可以给你一个切入点。

阅读源码常规的步骤

准备好必须的基础知识
熟悉框架有哪些功能
看源码，了解代码是怎么组织的，最后按需关注特定部分的实现细节

我们一步一步来。

1 Twisted

Scrapy 基于 Twisted，所以除了要有一定的 Python 基础外，还要对 Twisted 有一些了解。

你可以将 Twisted 和 Asyncio 类比，它们都是为了支持协程而诞生的，只是前者比后者出现的更早。这 2 个技术实现的核心都是事件循环，当程序执行到某个耗时的 IO 操作时，程序的执行权限会被退回给事件循环，事件循环会检测其它准备就绪的协程，然后将执行权限交给它，当之前的协程 IO 操作完毕后，事件循环会将执行权限转给它，继续后面的操作。这样，就能在单线程内实现并发，作用和多线程类似，只是比多线程更轻量。事件循环在 Asyncio 中被叫做 event_loop，在 Twisted 中叫做 reactor。我们看一些简单的例子

…

阅读全文

kevinbai

Less is more

Browsed by
月份：2020年4月

Scrapy 源码阅读（一）：Twisted 基础和 Scrapy 数据流

2020年4月18日 kevinbai 1,574 人阅读

1 Twisted