crawlee.dev
CR
Crawlee
Apify 出品的生产级网页抓取与浏览器自动化库(JS/TS 与 Python):队列、重试、代理轮换、浏览器指纹一应俱全。
立即开始了解更多
立即试用
GPT-4o什么是 Crawlee?
Crawlee 是 Apify 出品的免费 Apache-2.0 抓取框架,专门解决大规模爬取的难题:持久化请求队列(广度/深度优先)、按资源自动扩缩并发、自动重试与错误处理、内置代理轮换与会话池、浏览器指纹管理让爬虫更像真人。它用统一接口同时覆盖快速的 HTTP/Cheerio 抓取与无头 Puppeteer/Playwright 抓取,并自带数据集、键值存储、Dockerfile 与项目脚手架CLI,从单页到百万URL无需换工具。
4.5
评分
免费
定价模式
4+
平台
0
收藏
优点
- 百万页规模久经考验、生产就绪。
- 防封能力内建而非临时拼凑。
- 快速HTTP与重型浏览器抓取同一API。
- Apache-2.0,商用也免费。
- 文档完善、有Apify生态背书。
缺点
- 比单一HTTP客户端学习面更大。
- 浏览器模式较吃资源。
- 好用的代理可能要花钱。
- 选择器与抽取逻辑仍要自己写。
同类工具对比
| 功能 | Crawlee | MediaCrawler | Scrapy | Scrapling |
|---|---|---|---|---|
| 评分 | 0.0 | 4.4 | 0.0 | 0.0 |
| 定价模式 | 免费 | 免费 | 免费 | 免费 |
| 起价 | — | Free | — | — |
| API | — | — | — | — |
| 免费版 | — | — | — | — |
| 移动端 | — | — | — | — |
适用人群
大
大规模抓取
用队列与自动扩缩可靠爬百万URL。
防
防封项目
用会话/代理/指纹保持不被封。
混
混合站点
一个爬虫里按页面选HTTP或浏览器。
数
数据管线
结果直接落数据集/存储。
爬
爬虫SaaS
把可维护爬虫做成Docker服务上线。
开发者
Apify
支持平台
网页版 暂不支持
Windows 暂不支持
Mac 暂不支持
iPhone/iPad 暂不支持
安卓 暂不支持
华为 暂不支持
Linux 暂不支持
支持语言
中文, English
更新于
2026-09-13
常见问题
Apify开源、面向生产规模的可靠抓取库,支持JS/TS与Python。