searcharvester

自建 AI 搜索+抓取 API,一键替代 Tavily

searcharvester 是一个面向 AI 代理的自托管搜索与网页内容抓取服务,将 SearXNG 的 100+ 搜索引擎聚合能力与 trafilatura 的正文提取能力整合为统一的 API。它提供与 Tavily 兼容的 /search 和 /extract 接口,支持内容大小预设和分页,方便 AI 代理快速获取结构化搜索结果和干净的网页正文。项目通过 Docker Compose 一键部署,解决了 AI 应用在搜索和抓取环节对第三方付费 API 的依赖,同时保证了数据隐私和可控性。核心能力包括多引擎搜索聚合、正文提取、API 兼容层和简单部署,适合需要自建搜索基础设施的 AI 应用开发者。

开源 free 搜索知识
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 263
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类搜索知识
开发团队vakovalskii
所属国家
定价模式free
价格说明开源项目,AGPL-3.0许可,可自行部署,无付费版本。
访问状态
是否开源是
开源协议AGPL-3.0
主要语言Python
技术栈/模型agentic-ai,ai-agents,docker-compose,fastapi,llm,llm-tools,markdown,rag,search-api,searxng,self-hosted,tavily,trafilatura,web-scraping
GitHub 星标★ 263
30天Star增速
HF 下载量
上线时间2025-09-11 00:00:00
最近更新2026-09-13 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数1

使用教程

核心亮点

  • 兼容 Tavily 的 /search 和 /extract 接口,迁移成本低
  • 基于 SearXNG 聚合 100+ 搜索引擎,结果覆盖面广
  • Docker Compose 一键部署,自带完整服务栈

不足之处

  • 早期项目,文档和社区生态待观察
  • 依赖 SearXNG 实例,需自行维护搜索质量

适用场景

  • AI 代理需要实时搜索和网页内容提取
  • 自托管搜索 API 以降低第三方依赖和成本
  • 构建私有知识库或 RAG 系统的数据采集层

替代项目

Tavily、SearXNG、Firecrawl

项目介绍

searcharvester 是搜索知识领域的开源项目,由 vakovalskii 开发,2025 年首次发布。

它收录于搜索知识分类,该分类目前共有 585 个项目,GitHub 星标数为 263。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-13。AGPL-3.0许可,可自行部署,无付费版本。

它主要面向的使用场景是:AI代理需要实时搜索和网页内容提取。同类可对比的替代方案包括 Tavily、SearXNG、Firecrawl。

上一篇:rag-chat

下一篇:LongRAG

同类项目推荐

firecrawl 开源

网页抓取像喝水一样简单,开发者省下整周加班

The web data API to search, scrape, and interact at scale.

★ 183325 2026-08-09
contoso-chat 开源

一键跑通 Azure RAG 应用,从代码到评估部署全流程

This sample has the full End2End process of creating RAG application with Prompty an···

★ 766 2026-08-09
graphify 开源

整个代码库画成一张图,找问题一眼定位

Turn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable k···

★ 120493 2026-08-09
ragflow 开源

让大模型用上你的私有知识,搭建可靠的企业级RAG应用

RAGFlow is a leading open-source Retrieval-Augmented Generation (RAG) engine that fu···

★ 91170 2026-08-09