search
本站收录 72 个带「search」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
qdrant用 Rust 编写的高性能向量数据库与向量检索引擎,专为新一代 AI 应用设计,支持亿级向量的规模化管理与毫秒级相似度搜索。内置丰富的过滤条件与多种距离度量,并★ 34,882
gpt-researcherGPT Researcher 是一个开源的自主研究智能体,能针对任意主题自动完成资料检索、网页抓取、信息筛选与报告撰写。它解决的是传统人工调研耗时、信息碎片化、★ 29,706
DocsGPTDocsGPT 是一个面向企业的私有 AI 平台,专注于智能文档问答与知识检索。它解决了企业内部文档分散、查找困难、信息利用率低的问题,通过自然语言交互,让用户★ 18,295
dorisApache Doris 是一款基于 MPP 架构的实时分析型数据库,同时融合了全文检索与向量检索能力,定位为面向 AI Agent 场景的混合搜索数据库。它主★ 16,011
txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988
paper-qapaper-qa 是一个面向科学文献的高精度 RAG(检索增强生成)工具,旨在帮助研究者从大量 PDF 论文中快速获取带引用的准确答案。它解决的核心问题是通用 ★ 9,277
R2RR2R 是一个面向生产环境的 AI 检索系统,专注于智能体检索增强生成(Agentic RAG)。它解决了传统 RAG 系统在部署和集成上的痛点,将文档摄取、分★ 8,012
eSearcheSearch 是一款基于 Electron 和 TypeScript 开发的跨平台截屏与 OCR 工具,支持 Windows、Linux 和 macOS。它解★ 7,222
vespaVespa 是一个开源的 AI 搜索引擎平台,由雅虎开发并维护。它解决了传统搜索引擎在处理大规模数据、实时更新和复杂查询时的性能瓶颈,同时支持向量检索、语义搜索★ 7,113
MindSearchMindSearch 是一个基于大语言模型的多智能体 Web 搜索引擎框架,目标是打造类似 Perplexity.ai Pro 和 SearchGPT 的 AI★ 6,931
airweave面向 AI Agent 的开源上下文检索层,专注解决智能体的上下文获取问题。它支持连接多种数据源、清洗并向量化数据,为 Agent 提供高质量、低延迟的检索能力★ 6,560
wigolowigolo 是一个面向 AI 编程代理的本地优先搜索与检索工具,通过 MCP 协议为 Claude 等智能体提供网络搜索、网页抓取、爬虫和研究能力。它解决了 ★ 5,427
WindrecorderWindrecorder 是一款开源的屏幕记忆搜索工具,类似微软 Windows Recall 或 Rewind。它持续在后台以极小的存储占用录制屏幕内容,让用★ 3,943
StringZillaStringZilla 是一个跨语言的高性能字符串处理库,专为加速字符串搜索、哈希、排序、编辑距离计算、相似度草图和内存操作而设计。它利用现代 CPU 的 SI★ 3,569
swirl-searchSwirl Search 主张「AI 搜索与 RAG 无需迁移数据」:在不移动数据的前提下,从 100+ 应用中即时获取公司知识答案,同时保障数据安全。几分钟即★ 3,047
trieveTrieve 是一个基于 Rust 构建的一站式搜索与 RAG 平台,通过 API 提供搜索、推荐、检索增强生成和数据分析能力。它解决了开发者需要集成多种搜索和★ 2,719
obsidian-omnisearchObsidian Omnisearch 是一款为 Obsidian 笔记软件打造的全文搜索插件,目标是让搜索「开箱即用」。它基于 MiniSearch 实现快速★ 2,156
SeekStormSeekStorm 是一款用 Rust 实现的高性能搜索库,同时支持向量检索与词法检索,提供进程内库和多租户服务器两种形态。它兼具速度与灵活性,适合构建高性能、★ 1,917
bm25sbm25s 是一个基于 Python 的快速 BM25 搜索引擎库,利用 Numpy 和 Numba 实现高性能的文本检索。它解决了传统 BM25 实现在处理大★ 1,796
DirectorDirector 是一个面向下一代视频交互与工作流的 AI 智能体框架,基于 Python 构建。它旨在解决视频内容生成、编辑和处理过程中缺乏统一智能编排的问题★ 1,540
korvusKorvus 是一个基于 Postgres 的搜索 SDK,它将完整的 RAG(检索增强生成)流程统一到单个数据库查询中。它解决了传统 RAG 架构中需要拼接向★ 1,471
EmbedAnythingEmbedAnything 是一个基于 Rust 构建的高性能、模块化、内存安全的向量嵌入与索引引擎,专为生产环境设计。它解决了传统 Python 嵌入库在性能★ 1,309
search2aisearch2ai 是一个让大语言模型具备联网搜索能力的开源工具,核心解决 LLM 知识截止和无法获取实时信息的问题。它通过 Function Calling ★ 1,280
bing-chatbing-chat 是一个基于 Node.js 的 TypeScript 客户端,用于调用 Bing 新版 AI 搜索能力,本质上是将 Bing 的 AI 对话★ 1,203
coding_agent_session_search这是一个用 Rust 编写的命令行工具,提供统一的 TUI 和 CLI 界面,用于索引和搜索本地编码代理的会话历史。它支持超过 11 种主流 AI 编码工具,如★ 1,153
fessFess 是一款基于 OpenSearch 构建的开源企业级搜索服务器,支持自托管,可爬取网页、文件、数据库与云端数据源,支持 20 多种语言,提供 REST ★ 1,138
elasticsearch-labselasticsearch-labs 是 Elastic 官方维护的示例集合,提供大量 Jupyter Notebook 和示例应用,演示如何将 Elastic★ 1,137
elastic-labselastic-labs 是 Elastic 官方维护的示例仓库,用 Jupyter Notebook 和可运行的小型应用演示如何把 Elasticsearch★ 1,137
SearChatSearChat 是一个将传统搜索引擎与 AI 对话能力深度融合的开源项目,旨在解决大模型知识截止和幻觉问题。它通过接入 OpenAI、Anthropic、Ve★ 1,061
GPT-Conversation-ToolkitGPT-Conversation-Toolkit 是一个针对 ChatGPT 网页版的浏览器扩展插件,主要解决长对话场景下的浏览卡顿、记录查找困难、导出不便等问★ 960
lanternlantern 是一个基于 PostgreSQL 的向量数据库扩展,专为构建 AI 应用而设计。它通过扩展 PostgreSQL 的能力,使其能够高效地存储和检★ 894
statespacestatespace 是一个面向智能体(agent)的网页搜索工具,用 Rust 编写,旨在为 AI 代理提供高效、可靠的搜索能力。它解决的是传统搜索 API ★ 869
nucliadbNucliaDB 是一个专为 RAG(检索增强生成)设计的 AI 搜索数据库。它解决了传统数据库在非结构化数据(如文本、PDF、视频等)上难以进行语义检索和向量★ 721
ketchketch 是一个用 Go 编写的快速、无状态的命令行工具,专为 AI 代理设计,用于网页搜索和抓取。它解决了 AI 代理在获取实时网络信息时面临的效率低、状态★ 675
QmediaQmedia 是一款专为内容创作者设计的开源 AI 内容搜索引擎。它解决了创作者在海量素材中查找、整理和问答的痛点,支持从文本、图片和短视频中提取信息,并构建多★ 635
docsagentDocsAgent 是一个本地优先的个人知识库检索工具,通过 MCP 协议为 Claude、Cursor、Cline 等 AI 客户端提供即时、私密的资料访问能★ 623
aisearch-openai-rag-audio这是一个基于VoiceRAG模式的开源示例项目,旨在通过语音交互与RAG(检索增强生成)结合,构建生成式AI语音体验。它使用Azure AI Search作为检★ 562
agent-searchAgentSearch 是一个用于构建搜索代理(search agents)的 Python 框架,旨在让开发者能够轻松地将自定义搜索能力集成到 AI 代理中。★ 556
awesome-generative-engine-optimization这是一个关于生成式引擎优化(GEO)的资源精选列表,旨在帮助内容创作者、SEO从业者和营销人员提升在AI驱动的搜索引擎(如ChatGPT、Perplexity等★ 516
StreamRAGStreamRAG 是一个基于 Python 的视频搜索与流式处理代理,旨在解决视频内容检索和实时流式处理中的效率问题。它利用检索增强生成(RAG)技术,将视频★ 503
ragrag 是一个基于 txtai 的检索增强生成(RAG)实现,旨在将搜索引擎与大语言模型(LLM)结合,帮助用户从自有数据中挖掘洞察。它解决了传统 LLM 无法★ 465
Awesome-RAG-ReasoningAwesome-RAG-Reasoning 是一个聚焦于检索增强生成(RAG)与推理能力交叉领域的资源清单,收录了 EMNLP 2025 相关的前沿论文、数据集★ 457
redis-vl-pythonRedisVL 是 Redis 官方推出的 AI 原生 Python 客户端库,旨在弥合传统 Redis 数据库与向量检索、AI 应用之间的鸿沟。它解决了开发者★ 430
annotateaiannotateai 是一个利用大语言模型自动为学术论文添加注释的开源工具。它解决了科研人员手动阅读和标注论文耗时费力的问题,能够自动提取论文中的关键信息、生成★ 426
VibeSearchBenchVibeSearchBench 是一个面向真实世界复杂搜索场景的基准测试集,旨在评估和推动搜索系统在模糊、多轮、主动式交互中的表现。它包含200个长时程任务,每★ 409
llm4freellm4free 是一个集成了 40 多个免费 AI 提供商的 Python 工具包,前身是 WebScout。它解决了开发者需要聚合多个免费 LLM 服务、统★ 371
colpali-cookbooksColPali Cookbooks 是一个面向多模态 RAG(检索增强生成)场景的实战教程仓库,专注于 ColPali 模型的微调与适配。它解决了传统文本嵌入无★ 357
txtchattxtchat 是一个本地优先的 AI 聊天助手工具,旨在让用户通过自然语言与本地文件(如文本、文档)进行交互。它解决了在本地环境中使用 AI 时数据隐私和上下★ 337