hybrid-search
本站收录 36 个带「hybrid-search」标签的 AI 开源项目
qdrant用 Rust 编写的高性能向量数据库与向量检索引擎,专为新一代 AI 应用设计,支持亿级向量的规模化管理与毫秒级相似度搜索。内置丰富的过滤条件与多种距离度量,并★ 34,882
weaviate开源向量数据库,同时存储对象与向量,将向量相似度检索与结构化过滤无缝结合,兼具云原生数据库的容错性与可扩展性。支持多种嵌入模型与模块化扩展,常被用于构建语义搜索★ 16,860
infinityInfinity 是一个专为 LLM 应用打造的 AI 原生数据库,核心解决大模型应用中知识检索的效率和准确性问题。它支持稠密向量、稀疏向量、张量(多向量)和全★ 4,728
seekdbseekdb 是一个 AI 原生的搜索数据库,专为智能体(Agent)存储设计。它将向量、全文、结构化及半结构化数据统一到一个引擎中,解决了智能体应用中多类数据★ 3,088
memsearchmemsearch 是一个为 AI 智能体(如 Claude Code、Codex)设计的持久化统一记忆层,基于 Markdown 和 Milvus 向量数据库★ 2,684
xerjXERJ 开创了 AI 搜索数据的新方式,其自动索引能力让智能体无需消耗大量 token 即可掌握你的数据。一条命令即可索引代码、文档、日志与 PDF,服务于搜★ 2,563
vearchvearch 是一个面向 AI 原生应用的分布式向量搜索引擎,由京东开源。它解决了传统数据库无法高效处理高维向量数据的问题,为推荐系统、图像检索、自然语言处理等★ 2,330
SeekStormSeekStorm 是一款用 Rust 实现的高性能搜索库,同时支持向量检索与词法检索,提供进程内库和多租户服务器两种形态。它兼具速度与灵活性,适合构建高性能、★ 1,917
endeeEndee 是一款高性能向量数据库,单个节点即可承载多达 10 亿条向量,通过优化的索引与执行引擎带来显著的性能提升。同时提供云端版本,适合需要极致扩展性与检索★ 1,296
FlashRankFlashRank 是一个轻量级、超快的重排序库,专为搜索和检索管道设计。它解决了在生产环境中部署大型重排序模型时面临的延迟和资源消耗问题,通过优化推理过程,实★ 1,008
Local_Pdf_Chat_RAG这是一个用纯原生 Python 实现的 RAG(检索增强生成)框架,专注于本地 PDF 文档的智能问答。它解决了本地文档无法直接与大模型对话的问题,通过 FAI★ 957
rag-timeRAG Time 是一个为期五周的开源学习路径,旨在帮助开发者系统掌握检索增强生成(RAG)技术。该项目以 Jupyter Notebook 形式呈现,从基础概★ 909
mossmoss 是一个面向生产环境 AI 系统的检索层,主打闪电般的搜索速度(<10ms),且无需依赖向量数据库。它专为浏览器、边缘设备、端侧和云端场景设计,旨在解决★ 790
MimirQMimirQ 是一个面向中文企业场景的 RAG 知识库解决方案,核心解决企业文档解析难、检索不准、引用不可控的问题。它提供从文档解析、数据治理、智能切块到混合检★ 558
ai-powered-search这是 Manning 出版社 2025 年出版的《AI-Powered Search》一书的配套代码库,同时服务于同名 Maven 课程。项目聚焦现代检索系统,★ 411
mcp-local-ragmcp-local-rag 是一个面向开发者的本地优先 RAG(检索增强生成)服务器,旨在解决代码和技术文档的语义搜索与关键词搜索问题。它通过 MCP(模型上下★ 405
ThinkRAGThinkRAG 是一个专为笔记本电脑设计的轻量级检索增强生成(RAG)系统,旨在让个人用户轻松在本地部署大模型知识库问答。它解决了在资源受限环境下运行完整RA★ 351
knowledge-ragknowledge-rag 是一个面向 Claude Code 的本地 RAG(检索增强生成)MCP 服务器,旨在为 AI 编程助手提供私有知识库检索能力。它解★ 288
skillsskills 是 Qdrant 官方推出的智能体技能包,旨在为 AI 编程助手(如 Claude Code、Codex、Cursor)提供关于 Qdrant 向★ 253
PharosRAGPharosRAG 是一个面向团队文档库的本地优先智能检索增强生成(RAG)系统。它解决的是企业或团队在内部文档中高效、安全地获取知识的问题。核心能力包括:支持★ 243
memexmemex 是一个用 Rust 编写的本地检索工具,专门用来搜索和恢复各类 AI 编程助手的历史会话记录,包括 Claude Code、Codex、Pi、Ope★ 233
semble_rssemble_rs 是一个用 Rust 编写的、面向 AI 智能体的高性能代码搜索工具,旨在替代 grep、cat、read、ls 等传统命令,成为 Claud★ 212
ClawMemClawMem 是一个为 AI 智能体设计的本地优先(on-device)记忆层,旨在解决智能体在长期对话或任务中缺乏持久记忆的问题。它通过 Hooks(钩子)★ 212
WritWrit 是一个 Claude Code 插件,旨在为 AI 编码代理引入人工审批机制,防止其未经确认就执行有风险的代码写入。它通过拦截写入操作,要求人类先批准★ 205
flexible-graphragflexible-graphrag 是一个基于 Python 的灵活图检索增强生成(GraphRAG)框架,旨在解决传统 RAG 在复杂关系推理和多源数据整合上★ 188
VectorRAG.NetVectorRAG.Net 是一个面向 .NET 生态的高性能向量数据库库,专为语义搜索和 RAG(检索增强生成)场景设计。它采用随机超平面 LSH(局部敏感哈★ 164
docmind-ai-llmDocMind AI 是一个基于 Streamlit 的开源文档分析应用,核心思路是把 LlamaIndex、LangGraph 与本地大模型串起来,让用户在自★ 155
vault-curatevault-curate 是一个面向 Obsidian 用户的本地优先第二大脑工具,旨在解决笔记库日益庞大后难以查找、关联和回顾的问题。它提供强大的语义搜索能力★ 152
OneRAGOneRAG 是一个生产就绪的 RAG(检索增强生成)框架,基于 Python 和 FastAPI 构建。它旨在解决企业在构建 RAG 应用时面临的集成复杂性和★ 126
GenAI-AgenticAI-From-Zero-to-Production这是一个从零开始学习生成式AI(GenAI)和智能体AI(Agentic AI)的实战教程仓库,目标是将学习者从基础概念带到生产级应用。项目以Jupyter N★ 115
deepmemdeepmem 是一个面向 AI Agent 的开源记忆层基础设施,定位为 Mem0 的平替方案。它解决的核心问题是:让 AI 应用具备长期记忆能力,同时避免高★ 114
Flamehaven-FilesearchFlamehaven-Filesearch 是一个自托管的 RAG 搜索引擎,旨在解决个人或团队在本地文件检索中面临的格式多样、语义理解不足和部署复杂等问题。它★ 109
LodeDBLodeDB 是一个用 Rust 编写、提供 Python 接口的嵌入式向量数据库,主打本地优先、默认精确检索、多模态与 GPU 加速。它要解决的问题是:现有向★ 101
CodeInsightCodeInsight 是一个面向本地代码仓库的智能理解工具,基于 Hybrid RAG(混合检索)与 LangGraph 构建。它要解决的问题是:开发者面对陌★ 97
personal-ai-memory这是一个本地优先的 Chrome 扩展,用于被动捕获 ChatGPT、Gemini、Claude、Grok、Perplexity 等主流 AI 对话,并构建私人★ 67
codebase-contextCodebase Context 是一个为 AI 编程代理提供代码库上下文感知能力的开源工具。它通过语义代码搜索、团队约定、模式识别和记忆机制,让 AI 代理在★ 63