jaypyles

Scraperr

jaypyles

Self-hosted webscraper.

AI 简介

Scraperr 是一个开源的自托管网页爬虫平台,支持零代码配置完成网站数据抓取。核心功能包括基于 XPath 的精准元素提取、任务队列管理、同域页面自动爬取(Spidering)、自定义请求头、媒体文件自动下载、结构化结果可视化及 CSV/Markdown 导出,并支持通知集成。技术栈采用 FastAPI 后端、Next.js 前端、MongoDB 存储,提供 Docker 和 Helm 一键部署方案。适用于合规的数据采集场景,如市场监测、公开信息归集、内容聚合等需长期稳定运行且重视数据主权的中小规模应用。

TypeScript
MIT License
4.9k
Stars
241
Forks
9
Watchers
3
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分59.15
默认分支master