retrieval

本站收录 50 个带「retrieval」标签的 AI 开源项目

PageIndexPageIndex 是一个面向 RAG(检索增强生成)场景的文档索引框架,核心思路是放弃传统向量检索,转而通过推理(reasoning)来定位信息。它解决的问题★ 37,145airweave面向 AI Agent 的开源上下文检索层,专注解决智能体的上下文获取问题。它支持连接多种数据源、清洗并向量化数据,为 Agent 提供高质量、低延迟的检索能力★ 6,560OpenKBOpenKB 是一个面向大语言模型(LLM)的开源知识库系统,旨在解决 LLM 在专业领域知识不足、回答不准确的问题。它允许用户将私有文档(如 PDF、Mark★ 4,658SimpleMemSimpleMem 是一个为大型语言模型(LLM)智能体设计的终身记忆模块,旨在解决智能体在长期交互中遗忘历史信息、缺乏持续学习能力的问题。它通过高效的记忆存储★ 3,819siesie 是一个开源的推理服务器和生产级集群,专为智能体(agent)所需的各类模型提供统一部署和调度。它解决了多模型、多副本在生产环境中难以统一管理的问题,提供★ 3,337fastembedfastembed 是一个轻量级、高性能的 Python 库,专注于生成高质量的文本嵌入向量。它基于 ONNX Runtime 和 Transformers.j★ 3,227memobasememobase 是一个为 AI 聊天机器人提供长期用户记忆的开源项目。它解决的是大语言模型在对话中缺乏持续记忆、无法记住用户偏好和历史信息的问题。核心能力包括★ 2,922beirBEIR是一个异构信息检索基准测试平台,旨在解决IR模型评估碎片化的问题。它整合了超过15个多样化的检索数据集,覆盖问答、生物医学、金融、法律等多个领域,并提供★ 2,305intel-extension-for-transformersIntel Extension for Transformers 是英特尔推出的开源工具包,旨在让开发者快速构建聊天机器人,并在英特尔平台上高效运行大语言模型(★ 2,170bm25sbm25s 是一个基于 Python 的快速 BM25 搜索引擎库,利用 Numpy 和 Numba 实现高性能的文本检索。它解决了传统 BM25 实现在处理大★ 1,796raptorRAPTOR 是论文《Recursive Abstractive Processing for Tree-Organized Retrieval》的官方实现,提★ 1,763agent-memoryagent-memory 是一个面向 AI 智能体的长期记忆运行时,解决智能体在多次会话之间无法记住用户偏好、项目背景和历史决策的问题。它把纯 Markdown★ 1,308SearchCLISearchCLI 是火山引擎推出的开源命令行工具,帮助开发者把 AI 搜索、推荐与对话式检索能力集成到智能体系统和业务系统中。通过简洁的 CLI 即可接入强大★ 1,188fastembed-rsfastembed-rs 是一个用 Rust 实现的向量嵌入与重排序库,旨在本地生成高质量的文本嵌入向量,并支持本地重排序。它解决了在 Rust 生态中缺乏高性★ 1,030VisRAGVisRAG 是一个基于视觉语言模型(VLM)的解析免检索增强生成(RAG)框架。传统 RAG 依赖文本解析(如 PDF 转文本),而 VisRAG 直接将文档★ 981vectordbEpsilla 是一个高性能的向量数据库管理系统,专为 AI 应用设计。它解决了大语言模型应用中知识库检索和语义记忆的痛点,提供向量存储、索引和相似性搜索的核心★ 875NeumAINeumAI 是一个专注于大规模向量嵌入创建与同步的框架,旨在解决 RAG(检索增强生成)应用中数据管道复杂、难以维护的痛点。它提供了一套声明式配置,让开发者能★ 869byaldibyaldi 是一个让开发者用几行代码就能调用 ColPali 等晚期交互多模态模型的 Python 库。它解决了传统文本检索无法理解图片、表格等视觉信息的问题★ 851mossmoss 是一个面向生产环境 AI 系统的检索层,主打闪电般的搜索速度(<10ms),且无需依赖向量数据库。它专为浏览器、边缘设备、端侧和云端场景设计,旨在解决★ 790searchGPTsearchGPT 是一个基于 LLM(如 ChatGPT/OpenAI API)的接地搜索工具,旨在解决传统搜索引擎结果缺乏上下文和引用来源的问题。它不仅能进★ 711RankifyRankify 是一个面向检索、重排序和检索增强生成(RAG)的综合性 Python 工具包,旨在为信息检索和 RAG 研究提供一站式解决方案。它集成了 40 ★ 685EasyRAGEasyRAG 是一个易用的 RAG(检索增强生成)框架,源自 CCF AIOps 国际挑战赛 2024 的季军方案。它旨在解决企业落地 RAG 时面临的工程复★ 639sigmapsigmap 是一个面向 AI 编程会话的代码上下文压缩工具,核心目标是把喂给大模型的代码信息压缩到原来的约 3%,从而显著降低 token 消耗。它通过提取代★ 637ArXivChatGuruArXivChatGuru 是一个基于 LangChain、OpenAI、Streamlit 和 Redis 构建的科研论文对话工具。它允许用户直接与 ArXi★ 561atomicmemoryAtomic Memory 是一个面向 AI 代理的可移植语义记忆引擎,旨在解决代理在长时间运行中丢失上下文、记忆碎片化的问题。它提供核心引擎、TypeScri★ 433colpali-cookbooksColPali Cookbooks 是一个面向多模态 RAG(检索增强生成)场景的实战教程仓库,专注于 ColPali 模型的微调与适配。它解决了传统文本嵌入无★ 357memlayermemlayer 是一个为大型语言模型(LLM)提供即插即用记忆能力的 Python 库,旨在用三行代码为任何模型快速添加持久化、智能且类人的记忆与回忆功能。它★ 294bergenbergen 是一个专注于 RAG(检索增强生成)系统的基准测试库。它解决了 RAG 应用开发中缺乏标准化评估工具的问题,提供了一套统一的测试框架和指标,帮助开★ 281vidore-benchmarkViDoRe 是一个针对视觉文档检索(Vision Document Retrieval)的基准测试项目,源自 ColPali 论文。它提供了一套标准化的评估代★ 279rag-arenarag-arena 是一个开源的 RAG(检索增强生成)评估平台,核心思路是通过真实用户的反馈来评估和比较不同 RAG 系统的性能。它解决了传统 RAG 评估依★ 223hermes-memory-installerhermes-memory-installer 是一个生产级的外挂记忆系统,为 AI 智能体提供持久化、可检索的记忆能力。它解决了智能体在对话中缺乏长期记忆、无★ 208fastembed-jsfastembed-js 是一个面向 Node.js 环境的向量嵌入生成库,基于 TypeScript 编写,旨在为 JavaScript 开发者提供快速、轻量★ 177Sibyl-MemorySibyl-Memory 是一个面向 AI 智能体的持久化长期记忆解决方案,采用文件与 SQLite 存储,无需向量数据库和嵌入模型。它提供五个子包:核心 SD★ 173ChatIndexChatIndex 是一个面向长对话记忆的树状索引与检索工具,用 Python 实现。它解决的是大语言模型在长对话中记忆丢失、检索效率低的问题。核心能力包括:将★ 168coircoir 是一个面向代码信息检索(Code Information Retrieval)的综合基准测试集,发表于 ACL 2025 Main。它旨在解决现有代码★ 154ContextLatticeContextLattice 是一个面向 AI 智能体的本地优先智能层,旨在解决智能体在跨工具、跨会话场景中缺乏持久记忆和可解释检索的问题。它提供持久连续性、可★ 152denser-chatdenser-chat 是一个基于检索增强生成(RAG)的开源对话助手,专门用于与 PDF 文件进行交互式问答。它解决了传统 PDF 阅读器无法快速定位信息、难★ 152OneGenOneGen 是一个针对大型语言模型(LLM)的高效统一生成与检索框架,发表于 EMNLP 2024。它解决了传统 RAG(检索增强生成)中生成与检索分离、需要★ 149memoket-kitememoket-kite 是一个面向 AI Agent 的开源长期记忆引擎,最大特点是「无向量」——不依赖向量数据库和嵌入模型,而是通过结构化检索与压缩策略来组★ 142primitive-benchprimitive-bench 是一个面向 AI 智能体结果的可验证评测与交付层。它把「任务」当作商品:用户声明要完成的任务,平台先给出固定价格,再自动在多种工★ 122VeraVera 是一个本地代码搜索引擎,结合了 BM25 关键词匹配、向量相似度和交叉编码器重排序,提供多阶段检索以提升搜索准确性。它使用 tree-sitter 解★ 114VeraVera 是一个完全离线运行的本地代码搜索引擎,用 Rust 编写。它解决的是开发者在大型代码库中快速定位代码的问题,尤其适合需要语义理解而非单纯关键词匹配的场★ 114voyageai-pythonVoyage AI 的官方 Python 库,用于调用其嵌入(Embedding)和重排序(Rerank)API。它解决了开发者在应用中集成高质量文本向量化能力★ 113fastembed-gofastembed-go 是 Qdrant 官方 fastembed 的 Go 语言实现,旨在为 Go 开发者提供轻量、高效的文本嵌入生成能力。它解决 Go 生★ 104briniclebrinicle 是一个用 C++ 编写的向量索引引擎,面向低内存的生产环境。它解决的是向量检索场景中内存占用过高的问题:传统 HNSW 等索引在千万级向量时往★ 102Advanced-RVC-InferenceAdvanced-RVC-Inference 是一个面向 RVC(Retrieval-based Voice Conversion)模型的推理加速与部署工具,旨★ 87BeyondCLIPBeyondCLIP 是一份面向工程师的多模态检索实战手册,而非中立的学术综述。它系统梳理了构建、训练和部署多模态检索系统所需的核心知识,提出 C-L-I 三角★ 83vllm-factoryvllm-factory 是一个为编码器模型(如 ColBERT、GLiNER、ColPali 等)提供生产级推理服务的开源项目,以 vLLM 插件的形式实现,★ 82safe-clipSafe-CLIP 是一个针对视觉-语言模型的安全增强工具,主要解决 CLIP 类模型在图像生成和检索任务中可能生成或检索到 NSFW(不宜工作场所)内容的问题★ 68retrieval-augmented-ddpm这是一个基于 PyTorch 实现的检索增强去噪扩散概率模型(Retrieval-Augmented DDPM)。它解决的是传统扩散模型在生成图像时依赖单一训练★ 66