vector-database

本站收录 151 个带「vector-database」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

anything-llm主打本地优先的全能 AI 助手,集聊天、RAG、文档管理等能力于一身,支持多种模型后端,让你真正「拥有」自己的智能,不再租赁。★ 66,603llm-app开箱即用的云端模板,快速搭建 RAG、AI 流水线与企业级实时数据搜索应用。Docker 友好,可实时同步 SharePoint、Google Drive、S3★ 58,870llama_indexLlamaIndex 是一个开源的数据框架,旨在连接大语言模型(LLM)与外部数据源,解决 LLM 无法访问实时或私有数据的问题。它提供了一整套工具,用于数据摄★ 52,361milvusMilvus 是一款高性能、云原生的向量数据库,专为可扩展的向量近似最近邻(ANN)搜索而设计。它解决了海量非结构化数据(如图像、文本、音视频)的向量化存储与检★ 46,282PageIndexPageIndex 是一个面向 RAG(检索增强生成)场景的文档索引框架,核心思路是放弃传统向量检索,转而通过推理(reasoning)来定位信息。它解决的问题★ 37,145qdrant用 Rust 编写的高性能向量数据库与向量检索引擎,专为新一代 AI 应用设计,支持亿级向量的规模化管理与毫秒级相似度搜索。内置丰富的过滤条件与多种距离度量,并★ 34,882cogneecognee 是一个开源的 AI 记忆平台,专为智能体设计,提供跨会话的持久长期记忆。它通过自托管的图知识引擎,让 AI 代理能够存储、检索和推理结构化知识,解★ 31,221RAG_TechniquesRAG_Techniques 是一个专注于检索增强生成(RAG)技术的开源教程仓库,汇集了从基础到前沿的多种 RAG 实现方法。它通过一系列详细的 Jupyte★ 29,631weaviate开源向量数据库,同时存储对象与向量,将向量相似度检索与结构化过滤无缝结合,兼具云原生数据库的容错性与可扩展性。支持多种嵌入模型与模块化扩展,常被用于构建语义搜索★ 16,860memvidmemvid 是一个为 AI 代理提供记忆层的开源项目,旨在用无服务器、单文件的记忆层替代复杂的 RAG 流水线。它解决了 AI 代理在长期对话或任务中缺乏持久★ 16,566zveczvec 是一个轻量级、极速的进程内向量数据库,专为需要高性能向量检索的 AI 应用设计。它解决的是传统向量数据库部署重、延迟高的问题,将向量索引和检索能力直接★ 16,030langchain4jLangChain4j 是一个面向 JVM 生态的 Java 开源库,旨在为构建 LLM 驱动的应用提供地道、简洁的开发体验。它解决了 Java 开发者难以像 ★ 13,176txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988LEANNLEANN 是一个面向个人设备的轻量级 RAG(检索增强生成)引擎,旨在解决传统 RAG 系统在存储和隐私方面的痛点。它通过创新的索引压缩技术,将向量索引的存储★ 12,970claude-context专为 Claude Code 打造的代码搜索 MCP 服务,让整个代码库都能成为任意编程代理的上下文。通过精准的代码检索,Agent 无需翻阅大量文件即可找到关★ 12,575lancedbLanceDB 是一个用 Rust 编写的开源嵌入式向量检索库,面向多模态 AI 应用。它把向量数据库能力做成可嵌入的库,无需单独部署服务,开发者可以直接在应用★ 11,562deeplake面向 AI Agent 的数据运行时,提供无服务器 PostgreSQL 与多模态数据湖,支持大规模数据的高效检索与训练。开发者可以像使用数据库一样管理图像、文★ 9,245reorreor 是一款面向高熵人群的本地优先、注重隐私的个人知识管理应用。它利用 AI 技术(如嵌入模型和向量检索)自动建立笔记之间的语义关联,帮助用户在大量碎片化信★ 8,549serverMariaDB Server 是 MySQL 的社区分支,由原 MySQL 核心团队成员发起,旨在提供功能更丰富、更稳定且许可证更友好的开源 SQL 数据库。它★ 8,298deep-searcherdeep-searcher 是一个开源的深度研究工具,旨在替代商业深度研究服务,专注于在私有数据上进行推理和搜索。它用 Python 编写,核心解决的是如何让用★ 8,289vespaVespa 是一个开源的 AI 搜索引擎平台,由雅虎开发并维护。它解决了传统搜索引擎在处理大规模数据、实时更新和复杂查询时的性能瓶颈,同时支持向量检索、语义搜索★ 7,113postgresmlPostgresML 是一个将机器学习直接集成到 PostgreSQL 数据库中的开源扩展,用 Rust 编写,并利用 GPU 加速。它解决了传统 ML 工作流★ 6,825genkitGenkit 是 Google 推出的开源框架,用于在 JavaScript、Go、Dart 和 Python 中构建智能体应用。它解决了开发 AI 智能体时面★ 6,457helix-dbHelixDB 是一个用 Rust 构建的 OLTP 图向量数据库,运行在对象存储之上。它旨在解决传统图数据库和向量数据库在数据规模、成本与实时性上的矛盾:既能★ 6,103MineContextMineContext 是一个主动式的上下文感知 AI 助手,基于 Context-Engineering 理念构建,结合 ChatGPT Pulse 技术,旨★ 5,532infinityInfinity 是一个专为 LLM 应用打造的 AI 原生数据库,核心解决大模型应用中知识检索的效率和准确性问题。它支持稠密向量、稀疏向量、张量(多向量)和全★ 4,728OpenMemory面向 LLM 应用的本地持久化记忆存储,兼容 Claude Desktop、GitHub Copilot、Codex 等多个主流 AI 工具。数据完全存储在本地★ 4,512LongMemoryLongMemory 是一个面向 LLM 应用的本地持久化记忆存储基础设施,专为 Claude Desktop、GitHub Copilot、Codex、Ant★ 4,512knowhereKnowhere 是一个专注于为 AI Agent 和 RAG 系统提供高质量结构化数据提取与解析的开源工具。它解决了从非结构化文档(如 PDF、网页、Word★ 3,571SocratiCodeSocratiCode 是一款面向企业级大型代码库的智能分析工具,专为处理超过 4000 万行代码的复杂项目而设计。它无需复杂配置即可本地运行,保护代码隐私,可★ 3,326examplesPinecone 官方提供的 Jupyter Notebook 示例集合,帮助开发者快速上手 Pinecone 向量数据库。它通过一系列可交互的 noteboo★ 3,044autoflowautoflow 是 PingCAP 开源的基于 Graph RAG 的对话式知识库工具,利用 TiDB Serverless 的向量存储能力,将知识库管理与智★ 2,975yu-ai-agentyu-ai-agent 是一个面向 Java 开发者的 AI 应用实战教学项目,基于 Spring Boot 3、Java 21 和 Spring AI 构建。★ 2,707xerjXERJ 开创了 AI 搜索数据的新方式,其自动索引能力让智能体无需消耗大量 token 即可掌握你的数据。一条命令即可索引代码、文档、日志与 PDF,服务于搜★ 2,563bootcampBootcamp 是一个专注于非结构化数据搜索与分析的教程型开源项目,涵盖反向图像搜索、音频搜索、分子搜索、视频分析、问答系统及 NLP 等主题。它通过 Jup★ 2,445VCPToolBoxVCPToolBox 是一个部署在 AI 模型 API 与前端应用之间的智能体开发框架,旨在解决大语言模型无状态、无记忆、无工具调用能力的问题。它通过统一指令协★ 2,341vearchvearch 是一个面向 AI 原生应用的分布式向量搜索引擎,由京东开源。它解决了传统数据库无法高效处理高维向量数据的问题,为推荐系统、图像检索、自然语言处理等★ 2,330JustHireMeJustHireMe 是一个本地优先的 AI 求职情报工作台,专为求职者设计。它通过爬取招聘信息、评估职位匹配度,并自动生成定制化的申请材料,帮助用户高效管理求★ 2,255pgvecto.rspgvecto.rs 是一个基于 Rust 开发的 Postgres 向量检索扩展,旨在为 Postgres 数据库提供可扩展、低延迟且支持混合检索的向量搜索能★ 2,189neuron-aineuron-ai 是 PHP 生态中的智能体框架,旨在帮助开发者构建生产级 AI 驱动应用。它解决了 PHP 开发者难以将大语言模型、工具、向量数据库和记忆模★ 2,109featureformFeatureform 是一个虚拟特征存储(Virtual Feature Store)系统,它不重新搭建存储,而是将你已有的数据基础设施(如 Postgres★ 1,991SeekStormSeekStorm 是一款用 Rust 实现的高性能搜索库,同时支持向量检索与词法检索,提供进程内库和多租户服务器两种形态。它兼具速度与灵活性,适合构建高性能、★ 1,917Large-Language-Model-Notebooks-Course这是一个面向开发者的实用大语言模型(LLM)课程,以Jupyter Notebook为载体,通过大量可运行的代码示例,系统讲解LLM的核心概念、主流架构、微调技★ 1,823VectorChordVectorChord 是一个基于 Postgres 的向量检索扩展,是 pgvecto.rs 的继任者。它旨在解决 Postgres 中向量搜索扩展在数据量大★ 1,808raptorRAPTOR 是论文《Recursive Abstractive Processing for Tree-Organized Retrieval》的官方实现,提★ 1,763LLPhantLLPhant 是一个面向 PHP 生态的开源生成式 AI 框架,灵感来自 Langchain,旨在将 OpenAI GPT-4 等大模型能力无缝集成到 PHP★ 1,710ava-whatsapp-agent-courseAva 是一个基于 WhatsApp 的 AI 代理项目,旨在将 WhatsApp 转变为智能助手平台。它解决了用户在日常沟通中无法直接利用 AI 完成复杂任务★ 1,678pixeltablePixeltable 是一个面向 AI 数据应用的多模态数据后端,旨在统一管理图像、视频、文本等非结构化数据及其相关的元数据和 AI 模型输出。它解决了 AI ★ 1,631OpenContractsOpenContracts 是一个面向构建者和开发者的开源文档智能平台,定位为智能体世界的文档管理系统(DMS)。它解决的是非结构化文档(如 PDF、扫描件)在★ 1,492memory-osmemory-os 是一个为 Hermes Agent 设计的七层记忆操作系统,旨在解决 AI 代理在长期交互中缺乏持久记忆和上下文管理的问题。它通过 Qdra★ 1,373