wxpath 是自动化工作流领域的开源项目,由 rodricios 开发,2025 年首次发布。
它收录于自动化工作流分类,该分类目前共有 503 个项目,GitHub 星标数为 110。
项目仍在小幅维护中,最近一次代码更新于 2026-08-22。AGPL-3.0许可,可自行部署使用,完全免费。
它主要面向的使用场景是:快速构建结构化网页数据采集任务。同类可对比的替代方案包括 Scrapy、BeautifulSoup、lxml。

用查询语言写爬虫,像查数据库一样抓网页数据
wxpath 是一个基于 XPath 的声明式网页爬取工具,它提出了一种称为 Web Query Language(WQL)的查询语言,让开发者可以用类似 SQL 的简洁语法来定义网页数据的提取规则。它解决了传统爬虫需要编写大量命令式代码(如 requests + BeautifulSoup 循环解析)的痛点,将数据提取过程抽象为声明式查询,从而降低爬虫开发门槛并提高代码可读性。核心能力包括:通过 XPath 定位网页元素、支持数据清洗与转换、支持多页面抓取与数据合并,并可能内置了请求调度和缓存机制。该项目处于早期阶段,星标数不多,但理念新颖,适合对声明式爬虫感兴趣的开发者探索。
Scrapy、BeautifulSoup、lxml
wxpath 是自动化工作流领域的开源项目,由 rodricios 开发,2025 年首次发布。
它收录于自动化工作流分类,该分类目前共有 503 个项目,GitHub 星标数为 110。
项目仍在小幅维护中,最近一次代码更新于 2026-08-22。AGPL-3.0许可,可自行部署使用,完全免费。
它主要面向的使用场景是:快速构建结构化网页数据采集任务。同类可对比的替代方案包括 Scrapy、BeautifulSoup、lxml。
n8n
开源
拖拽搭建自动化流程,轻松接入 AI 与 400+ 应用,搞定重复工作。
Fair-code workflow automation platform with native AI capabilities. Combine visual b···
feishu-docx
开源
让 AI 代理轻松读写飞书文档,双向转换 Markdown
Feishu/Lark Docs、Sheet、Bitable <-> Markdown | AI Agent-friendly knowledge base exp···
robotcode
开源
让 Robot Framework 拥有现代 IDE 体验,调试、补全、运行一气呵成。
Open Source Toolkit for Robot Framework, providing Language Server Protocol support,···
puppeteer
开源
用 JavaScript 轻松操控无头浏览器,搞定自动化测试与网页抓取。
JavaScript API for Chrome and Firefox