vector-search
本站收录 122 个带「vector-search」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
redisRedis 是一个开源的内存数据结构存储系统,常被用作数据库、缓存和消息代理。它支持字符串、哈希、列表、集合、有序集合等多种数据结构,并提供丰富的数据操作命令。★ 76,547
milvusMilvus 是一款高性能、云原生的向量数据库,专为可扩展的向量近似最近邻(ANN)搜索而设计。它解决了海量非结构化数据(如图像、文本、音视频)的向量化存储与检★ 46,282
qdrant用 Rust 编写的高性能向量数据库与向量检索引擎,专为新一代 AI 应用设计,支持亿级向量的规模化管理与毫秒级相似度搜索。内置丰富的过滤条件与多种距离度量,并★ 34,882
onyxOnyx 是一个开源的企业级 AI 知识助手平台,旨在解决企业内部信息分散、检索困难的问题。它能够连接各种内部知识源(如文档、wiki、工单等),通过 RAG ★ 32,289
WeKnora腾讯开源的 LLM 知识平台,将原始文档转化为可查询的 RAG、自主推理 Agent 与自动维护的 Wiki。构建企业级知识中枢,让知识自动沉淀、检索与推理,助★ 31,212
Resume-MatcherResume-Matcher 是一个本地优先的 AI 简历工具,核心目标是帮求职者把简历改到能通过 ATS(申请人跟踪系统)筛选,同时生成匹配岗位的求职信和 P★ 28,533
TencentDB-Agent-Memory腾讯云推出的团队级 AI 智能体记忆中枢,将对话、文档与代码转化为聊天记忆、技能、LLM 知识库、代码图谱四类可复用记忆资产,跨智能体与框架共享治理。★ 27,512
turbovecturbovec 是一个基于 TurboQuant 构建的向量索引库,使用 Rust 编写并提供 Python 绑定。它旨在解决大规模向量检索场景下的性能瓶颈问★ 17,262
weaviate开源向量数据库,同时存储对象与向量,将向量相似度检索与结构化过滤无缝结合,兼具云原生数据库的容错性与可扩展性。支持多种嵌入模型与模块化扩展,常被用于构建语义搜索★ 16,860
txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988
LEANNLEANN 是一个面向个人设备的轻量级 RAG(检索增强生成)引擎,旨在解决传统 RAG 系统在存储和隐私方面的痛点。它通过创新的索引压缩技术,将向量索引的存储★ 12,970
fiftyoneFiftyOne 是一个面向计算机视觉团队的开源数据集管理与模型评估工具,由 Voxel51 开发。它解决了视觉 AI 开发中数据质量差、模型错误难以定位、数据★ 11,130
GPTCacheGPTCache 是一个面向大语言模型(LLM)的语义缓存工具,核心解决 LLM 推理成本高、响应慢的问题。它通过缓存相似的查询结果,让重复或相近的请求直接命中★ 8,206
vespaVespa 是一个开源的 AI 搜索引擎平台,由雅虎开发并维护。它解决了传统搜索引擎在处理大规模数据、实时更新和复杂查询时的性能瓶颈,同时支持向量检索、语义搜索★ 7,113
superduperSuperduper 是一个端到端的开源框架,用于构建自定义 AI 应用和智能代理。它解决了将 AI 模型(如 LLM、预训练模型)与现有数据基础设施(尤其是 ★ 5,327
infinityInfinity 是一个专为 LLM 应用打造的 AI 原生数据库,核心解决大模型应用中知识检索的效率和准确性问题。它支持稠密向量、稀疏向量、张量(多向量)和全★ 4,728
m_flowm_flow 是一个受生物启发的认知记忆引擎,为 Graph RAG 提供全新范式。它模拟人类大脑的记忆形成与检索机制,将信息组织为动态的认知图谱,而非静态的图★ 4,511
zvec-grepzvec-grep 是一个用 Rust 编写的本地优先搜索工具,面向开发者和 AI Agent 场景,目标是在整个工作区里做统一检索。它把传统全文搜索(BM25★ 3,796
siesie 是一个开源的推理服务器和生产级集群,专为智能体(agent)所需的各类模型提供统一部署和调度。它解决了多模型、多副本在生产环境中难以统一管理的问题,提供★ 3,337
SocratiCodeSocratiCode 是一款面向企业级大型代码库的智能分析工具,专为处理超过 4000 万行代码的复杂项目而设计。它无需复杂配置即可本地运行,保护代码隐私,可★ 3,326
fastembedfastembed 是一个轻量级、高性能的 Python 库,专注于生成高质量的文本嵌入向量。它基于 ONNX Runtime 和 Transformers.j★ 3,227
corecore 是一个基于 Python 的 AI 智能体微服务框架,旨在为开发者提供构建对话式 AI 应用的核心基础设施。它解决了从零搭建智能体服务时面临的协议复杂★ 3,093
prompttoolsprompttools 是一个开源的提示词测试与实验工具集,专为 LLM 和向量数据库设计。它解决了提示词工程中缺乏系统化测试和对比的问题,让开发者能快速评估不★ 3,055
examplesPinecone 官方提供的 Jupyter Notebook 示例集合,帮助开发者快速上手 Pinecone 向量数据库。它通过一系列可交互的 noteboo★ 3,044
trieveTrieve 是一个基于 Rust 构建的一站式搜索与 RAG 平台,通过 API 提供搜索、推荐、检索增强生成和数据分析能力。它解决了开发者需要集成多种搜索和★ 2,719
ReadAnyReadAny 是一款基于 AI 的跨平台电子书阅读器,支持 EPUB 等格式,内置语义搜索、RAG 聊天、本地向量存储、笔记、TTS 朗读和 WebDAV 同★ 2,687
xerjXERJ 开创了 AI 搜索数据的新方式,其自动索引能力让智能体无需消耗大量 token 即可掌握你的数据。一条命令即可索引代码、文档、日志与 PDF,服务于搜★ 2,563
SAGSAG 是一个全新的 RAG(检索增强生成)检索架构,旨在解决传统 RAG 在知识检索中的准确性和效率问题。它提供了一种原创的检索架构,并附带一个面向人类和智能★ 2,512
vearchvearch 是一个面向 AI 原生应用的分布式向量搜索引擎,由京东开源。它解决了传统数据库无法高效处理高维向量数据的问题,为推荐系统、图像检索、自然语言处理等★ 2,330
langchainrblangchainrb 是 Ruby 生态中构建 LLM 驱动应用的框架,将 LangChain 的核心概念移植到 Ruby,解决 Ruby 开发者无法便捷集成★ 1,999
SeekStormSeekStorm 是一款用 Rust 实现的高性能搜索库,同时支持向量检索与词法检索,提供进程内库和多租户服务器两种形态。它兼具速度与灵活性,适合构建高性能、★ 1,917
grepaigrepai 是一个面向 AI 编程代理的本地语义搜索与调用图工具,用 C 语言编写,主打 100% 本地运行、隐私优先。它解决的核心问题是:传统 grep 只★ 1,894
VectorChordVectorChord 是一个基于 Postgres 的向量检索扩展,是 pgvecto.rs 的继任者。它旨在解决 Postgres 中向量搜索扩展在数据量大★ 1,808
nextjs-openai-doc-search这是一个基于 Next.js、OpenAI 和 Supabase 构建的文档搜索模板,旨在帮助开发者快速打造类似 ChatGPT 的定制化文档问答助手。它解决了★ 1,729
memfreeMemFree 是一款混合型 AI 搜索引擎,同时内置 AI 网页生成器。它将传统搜索与大模型能力结合,既能高效检索信息,也能自动生成网页内容,为用户提供从搜索★ 1,511
ragliteRAGLite 是一个面向检索增强生成(RAG)场景的 Python 工具包,核心特点是基于 DuckDB 或 PostgreSQL 作为向量存储与元数据存储,★ 1,208
chromem-gochromem-go 是一个为 Go 语言设计的嵌入式向量数据库,提供与 Chroma 类似的接口,且零第三方依赖。它主要解决 Go 开发者在构建 AI 应用时★ 1,059
MyScaleDBMyScaleDB 是一个基于 ClickHouse 二次开发的开源数据库,专注于高性能向量搜索与全文搜索的融合。它解决了传统向量数据库在数据管理、实时更新和复★ 1,045
raftRAFT 是 NVIDIA 开源的 CUDA 加速算法与基础原语库,面向机器学习和信息检索场景。它把常用但实现复杂的底层算子(如距离计算、聚类、线性代数、最近邻★ 1,042
fastembed-rsfastembed-rs 是一个用 Rust 实现的向量嵌入与重排序库,旨在本地生成高质量的文本嵌入向量,并支持本地重排序。它解决了在 Rust 生态中缺乏高性★ 1,030
FlashRankFlashRank 是一个轻量级、超快的重排序库,专为搜索和检索管道设计。它解决了在生产环境中部署大型重排序模型时面临的延迟和资源消耗问题,通过优化推理过程,实★ 1,008
rag-fusionRAG-Fusion 是一个改进检索增强生成(RAG)流程的开源项目,核心解决传统 RAG 中单一查询可能遗漏关键信息、导致生成结果不准确的问题。它通过多查询生★ 959
azure-search-vector-samples这是微软官方维护的 Azure AI Search 向量搜索能力示例代码库,用 Jupyter Notebook 集中演示如何在 Azure 认知搜索中构建向量★ 910
rag-timeRAG Time 是一个为期五周的开源学习路径,旨在帮助开发者系统掌握检索增强生成(RAG)技术。该项目以 Jupyter Notebook 形式呈现,从基础概★ 909
vectordbEpsilla 是一个高性能的向量数据库管理系统,专为 AI 应用设计。它解决了大语言模型应用中知识库检索和语义记忆的痛点,提供向量存储、索引和相似性搜索的核心★ 875
cuvscuVS 是 NVIDIA 开源的 GPU 向量搜索与聚类库,属于 RAPIDS 生态的基础设施组件。它把近似最近邻搜索(ANN)、距离计算、邻居图构建和聚类等★ 857
WaxWax 是一个面向 AI 代理的轻量级记忆层,以单个 Swift 文件实现,专为 Apple Silicon 设备优化。它解决了 AI 代理在本地设备上缺乏快速★ 802
nucliadbNucliaDB 是一个专为 RAG(检索增强生成)设计的 AI 搜索数据库。它解决了传统数据库在非结构化数据(如文本、PDF、视频等)上难以进行语义检索和向量★ 721
agentosagentos 是一个用 TypeScript 编写的 AI 智能体框架,旨在解决复杂任务中智能体的记忆、工具使用和多智能体协作问题。它提供了认知记忆能力,让智★ 673
SkillCorpusSkillCorpus 是一个开源基础设施,旨在将分散的 SKILL.md 文件转化为经过整理、可直接用于检索的智能体技能语料库。它解决了 AI 智能体在技能管★ 673