information-retrieval

本站收录 61 个带「information-retrieval」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

PageIndexPageIndex 是一个面向 RAG(检索增强生成)场景的文档索引框架,核心思路是放弃传统向量检索,转而通过推理(reasoning)来定位信息。它解决的问题★ 37,145onyxOnyx 是一个开源的企业级 AI 知识助手平台,旨在解决企业内部信息分散、检索困难的问题。它能够连接各种内部知识源(如文档、wiki、工单等),通过 RAG ★ 32,289haystackHaystack 是一个开源的 AI 编排框架,用于构建生产级、上下文工程化的 LLM 应用。它通过模块化管道和代理工作流,让开发者对检索、路由、记忆和生成等环★ 26,634DocsGPTDocsGPT 是一个面向企业的私有 AI 平台,专注于智能文档问答与知识检索。它解决了企业内部文档分散、查找困难、信息利用率低的问题,通过自然语言交互,让用户★ 18,295weaviate开源向量数据库,同时存储对象与向量,将向量相似度检索与结构化过滤无缝结合,兼具云原生数据库的容错性与可扩展性。支持多种嵌入模型与模块化扩展,常被用于构建语义搜索★ 16,860unstructuredUnstructured 是一个开源的 ETL 工具,专注于将复杂文档(如 PDF、Word、PPT、图片等)转换为干净、结构化的数据,以便直接用于大语言模型(★ 15,519txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988FlagEmbeddingFlagEmbedding 是一个专注于检索与检索增强大语言模型(RAG)的开源工具库,由北京智源人工智能研究院(BAAI)开发。它解决了文本嵌入(Embedd★ 12,208airweave面向 AI Agent 的开源上下文检索层,专注解决智能体的上下文获取问题。它支持连接多种数据源、清洗并向量化数据,为 Agent 提供高质量、低延迟的检索能力★ 6,560AdalFlowAdalFlow 是一个用于构建和自动优化大语言模型(LLM)应用的开源 Python 库。它旨在解决 LLM 应用开发中提示词调试繁琐、流程编排复杂以及性能调★ 4,218langroidLangroid 是一个面向大型语言模型(LLM)的多智能体编程框架,旨在让开发者通过简洁的 Python 代码编排多个智能体协作,完成复杂任务。它解决了直接调★ 4,108StringZillaStringZilla 是一个跨语言的高性能字符串处理库,专为加速字符串搜索、哈希、排序、编辑距离计算、相似度草图和内存操作而设计。它利用现代 CPU 的 SI★ 3,569catalystCatalyst 是一个面向深度学习研究与开发的 Python 框架,旨在加速从实验设计到模型部署的全流程。它解决了深度学习项目中代码重复、实验管理混乱、复现困★ 3,387siesie 是一个开源的推理服务器和生产级集群,专为智能体(agent)所需的各类模型提供统一部署和调度。它解决了多模型、多副本在生产环境中难以统一管理的问题,提供★ 3,337beirBEIR是一个异构信息检索基准测试平台,旨在解决IR模型评估碎片化的问题。它整合了超过15个多样化的检索数据集,覆盖问答、生物医学、金融、法律等多个领域,并提供★ 2,305bm25sbm25s 是一个基于 Python 的快速 BM25 搜索引擎库,利用 Numpy 和 Numba 实现高性能的文本检索。它解决了传统 BM25 实现在处理大★ 1,796WFGYWFGY 是一个面向 AI 推理、RAG、智能体及真实世界工作流的开源项目,正迈向 5.0 Polaris Protocol 重大版本。它提供问题地图(Prob★ 1,791fastRAGfastRAG是一个专注于高效检索增强生成(RAG)的开源框架,旨在解决企业落地RAG时面临的性能瓶颈和部署复杂性问题。它基于Haystack构建,但针对生产环★ 1,787awesome-ai-web-search这是一个精选AI驱动的网页搜索工具列表,收录了各种利用大语言模型增强搜索体验的开源项目和商业服务。它解决了传统搜索引擎结果冗余、难以直接获取答案的问题,通过整理★ 1,459EmbedAnythingEmbedAnything 是一个基于 Rust 构建的高性能、模块化、内存安全的向量嵌入与索引引擎,专为生产环境设计。它解决了传统 Python 嵌入库在性能★ 1,309SearchCLISearchCLI 是火山引擎推出的开源命令行工具,帮助开发者把 AI 搜索、推荐与对话式检索能力集成到智能体系统和业务系统中。通过简洁的 CLI 即可接入强大★ 1,188raftRAFT 是 NVIDIA 开源的 CUDA 加速算法与基础原语库,面向机器学习和信息检索场景。它把常用但实现复杂的底层算子(如距离计算、聚类、线性代数、最近邻★ 1,042rag-fusionRAG-Fusion 是一个改进检索增强生成(RAG)流程的开源项目,核心解决传统 RAG 中单一查询可能遗漏关键信息、导致生成结果不准确的问题。它通过多查询生★ 959pylatepylate 是一个专注于晚期交互模型(Late Interaction Models)训练与检索的开源项目,基于 Python 实现。它解决了传统稠密检索在细★ 896statespacestatespace 是一个面向智能体(agent)的网页搜索工具,用 Rust 编写,旨在为 AI 代理提供高效、可靠的搜索能力。它解决的是传统搜索 API ★ 869cuvscuVS 是 NVIDIA 开源的 GPU 向量搜索与聚类库,属于 RAPIDS 生态的基础设施组件。它把近似最近邻搜索(ANN)、距离计算、邻居图构建和聚类等★ 857s3s3 是一个专注于提升检索增强生成(RAG)系统搜索效率与效果的训练框架,核心方法是通过强化学习(RL)和可验证奖励(RLVR)来训练搜索代理,仅需极少量数据即★ 849RAG-FiTRAG-FiT 是一个用于增强大语言模型在检索增强生成(RAG)任务中表现的微调框架。它解决了通用微调方法未针对 RAG 场景优化、导致模型在检索上下文利用和答★ 767DeepRetrievalDeepRetrieval 是发表于 COLM'25 的研究项目,通过强化学习(RLVR)训练搜索智能体,以检索结果作为奖励信号优化模型。它探索了让 AI 学会★ 718xynexyne 是一个面向工作场景的 AI 优先搜索与问答引擎,定位为 Glean 的开源替代品。它解决的是企业内部信息分散、检索效率低下的问题,通过连接各种工作工具★ 692RankifyRankify 是一个面向检索、重排序和检索增强生成(RAG)的综合性 Python 工具包,旨在为信息检索和 RAG 研究提供一站式解决方案。它集成了 40 ★ 685SkillCorpusSkillCorpus 是一个开源基础设施,旨在将分散的 SKILL.md 文件转化为经过整理、可直接用于检索的智能体技能语料库。它解决了 AI 智能体在技能管★ 673MiniSearchMiniSearch 是一个极简的网页搜索平台,内置 AI 助手,完全在浏览器中运行,无需后端服务器。它解决了传统搜索依赖云端服务、隐私易泄露的问题,通过本地化★ 598EnterpriseRAG-BenchEnterpriseRAG-Bench 是一个专为企业内部文档场景设计的 RAG(检索增强生成)评测基准与数据集。它解决的核心问题是:通用 RAG 评测集(如自★ 576AnglEAnglE是一个用于训练和推理高质量句子嵌入(Sentence Embeddings)的Python开源库,旨在解决文本语义相似度计算、检索和聚类等任务中嵌入表★ 575agent-searchAgentSearch 是一个用于构建搜索代理(search agents)的 Python 框架,旨在让开发者能够轻松地将自定义搜索能力集成到 AI 代理中。★ 556LLM4IR-SurveyLLM4IR-Survey 是一个关于大语言模型(LLM)在信息检索(IR)领域应用的综合综述仓库。它系统性地整理了近年来将LLM用于搜索、推荐、问答等IR任务★ 545continuous-evalcontinuous-eval 是一个面向 LLM 应用的、数据驱动的评估工具。它解决的是 LLM 应用在开发迭代过程中缺乏客观、可量化评估标准的问题,帮助开发★ 517antflyantfly 是一个用 Zig 语言构建的智能体框架,专注于解决 AI 应用中的信息检索与多模态数据处理问题。它集成了 RAG(检索增强生成)、语义搜索和弹性搜★ 463ai-powered-search这是 Manning 出版社 2025 年出版的《AI-Powered Search》一书的配套代码库,同时服务于同名 Maven 课程。项目聚焦现代检索系统,★ 411adaptive-chunkingAdaptive Chunking 是一个用于 RAG(检索增强生成)的智能文本分块工具,核心思想是根据每篇文档的自身特点自动选择最优的分块策略,而不是对所有文★ 394megabotsmegabots 是一个旨在让 LLM 应用开发变得极其简单的开源框架,主打“生产就绪”和“开箱即用”。它解决了开发者从零构建聊天机器人时面临的高复杂度问题,通★ 350VeritasGraphVeritasGraph 是一个开源的 Knowledge Graph 与 GraphRAG 框架,旨在解决大模型在处理复杂多跳推理和事实溯源时的不足。它允许用★ 324rag-experiment-acceleratorRAG Experiment Accelerator 是一个用于加速检索增强生成(RAG)实验与评估的 Python 工具,主要面向 Azure Cogniti★ 312text2texttext2text 是一个面向多语言场景的文本到文本生成工具包,旨在简化跨语言 NLP 任务的开发流程。它基于 Python 构建,整合了多种主流语言模型(如 ★ 304rust-docs-mcp-serverrust-docs-mcp-server 是一个基于 Rust 的 MCP(模型上下文协议)服务器,旨在解决 AI 编程助手(如 Copilot、Cursor ★ 297direct-rag-learningDirect RAG Learning 是 TOIS2026 论文《Direct Retrieval-augmented Optimization》的官方代码库★ 263marginaliaMarginalia 是一个受图书馆学启发的个人知识管理系统,利用 LLM 智能体来组织、关联和检索个人知识。它解决的是传统笔记工具中信息孤立、难以发现关联的问★ 247tool-retrieval-benchmark这是一个用于评估大语言模型工具检索能力的基准测试框架,源自ACL2025论文。它解决了当前检索模型在工具调用场景下表现不佳的问题,提供了标准化的评测方法和数据集★ 215INTERSINTERS 是一个面向搜索场景的大语言模型指令微调开源项目,源自同名论文。它旨在解决通用大模型在信息检索任务中表现不佳的问题,通过构建大规模的搜索指令数据集,★ 208