第三方开源 · 非本人原创数据采集 / 实验中

Scrapling

受限制的白名单网页提取实验

D4Vinci 的 Scrapling 是覆盖请求、浏览器驱动、选择器和爬取流程的 Python 框架。本站没有公开任意网址采集器,只提供 Cloudflare 服务端固定白名单演示,不接收 Cookie、自定义请求头、内网地址或任意端口。

Scrapling 项目封面
GitHub 仓库社交预览图,版权归原项目作者所有

01 / PROJECT POSITIONING

这个项目在实验室里的位置

只允许固定公开示例域名的服务端文本提取,用来展示合规采集边界与错误处理。

01固定域名白名单
02文本提取
03超时与频率限制
MY ADAPTATION / 我的适配

Cloudflare Pages Functions 固定白名单演示,未运行原仓库完整 Python 后端

02 / TECHNOLOGY

技术与能力

PythonCrawlerPlaywrightData Extraction

03 / SAFE ONLINE DEMO

在线演示

仅允许 https://example.com,不允许 localhost、内网、云元数据、重定向、Cookie、自定义请求头或任意端口。

边界由服务端强制执行,不依赖前端提示。

BOUNDARY / 使用边界

功能真实,边界也真实。

仅允许 https://example.com,不允许 localhost、内网、云元数据、重定向、Cookie、自定义请求头或任意端口。