github.com/D4Vinci/Scrapling
SC
Scrapling
首个自适应、自愈的Python爬虫库:网站改版后能自动重新定位元素,内置隐秘抓取器可绕过 Cloudflare 级反爬。
立即开始了解更多
立即试用
GPT-4o什么是 Scrapling?
Scrapling 解决生产爬虫最烧钱的两件事:拿到响应、让选择器一直有效。它基于 lxml 的高速解析器支持 CSS/XPath/正则/文本查询;当网站改版时,自适应模式(adaptive=True)用元素指纹——结构、文本规律、兄弟节点关系——自动重新定位同一元素,让爬虫“对改版免疫”。三个渐进增强的抓取层覆盖纯HTTP、完整Playwright浏览器、以及基于 Camoufox 的 StealthyFetcher(隐藏 CDP/WebRTC 泄漏、自动过 Cloudflare Turnstile/Interstitial)。还提供类Scrapy蜘蛛框架(可暂停/续跑、代理轮换)、会话管理,以及用于AI抽取的 MCP 服务(BSD-3)。
4.5
评分
免费
定价模式
3+
平台
0
收藏
优点
- 独有的自适应重定位,省掉大量选择器维护。
- 开箱即用的反爬能力强。
- 解析快、渐进增强API清晰。
- 会话/蜘蛛/代理齐备。
- BSD-3开源。
缺点
- 隐秘/浏览器层比纯请求重。
- 网站彻底重写时自适应只是尽力匹配。
- 反爬是军备竞赛,偶尔需更新。
- 只能采集获允许的站点与数据。
同类工具对比
| 功能 | Scrapling | curl-impersonate | MediaCrawler | Crawlee |
|---|---|---|---|---|
| 评分 | 0.0 | 0.0 | 4.4 | 0.0 |
| 定价模式 | 免费 | 免费 | 免费 | 免费 |
| 起价 | — | — | Free | — |
| API | — | — | — | — |
| 免费版 | — | — | — | — |
| 移动端 | — | — | — | — |
适用人群
长
长期运行的爬虫
网站频繁改版也能持续采集。
受
受保护站点
普通请求被封时用StealthyFetcher。
生
生产管线
一套代码里快速HTTP+浏览器兜底。
A
AI抽取
通过MCP让助手驱动抓取。
缺
缺维护的团队
避免每次UI改版就重写选择器。
开发者
D4Vinci
支持平台
网页版 暂不支持
Windows 暂不支持
Mac 暂不支持
iPhone/iPad 暂不支持
安卓 暂不支持
华为 暂不支持
Linux 暂不支持
支持语言
中文, English
更新于
2026-09-13
常见问题
自适应解析在网站变化后重定位元素,外加内置隐秘抓取。