bm25
本站收录 20 个带「bm25」标签的 AI 开源项目
infinityInfinity 是一个专为 LLM 应用打造的 AI 原生数据库,核心解决大模型应用中知识检索的效率和准确性问题。它支持稠密向量、稀疏向量、张量(多向量)和全★ 4,728
AdalFlowAdalFlow 是一个用于构建和自动优化大语言模型(LLM)应用的开源 Python 库。它旨在解决 LLM 应用开发中提示词调试繁琐、流程编排复杂以及性能调★ 4,218
agentic-rag-for-dummies这是一个用 LangGraph 构建的模块化 Agentic RAG 教程项目,旨在帮助开发者快速掌握检索增强生成(RAG)智能体的核心概念与实现。它解决了传统★ 4,216
zvec-grepzvec-grep 是一个用 Rust 编写的本地优先搜索工具,面向开发者和 AI Agent 场景,目标是在整个工作区里做统一检索。它把传统全文搜索(BM25★ 3,796
SeekStormSeekStorm 是一款用 Rust 实现的高性能搜索库,同时支持向量检索与词法检索,提供进程内库和多租户服务器两种形态。它兼具速度与灵活性,适合构建高性能、★ 1,917
bm25sbm25s 是一个基于 Python 的快速 BM25 搜索引擎库,利用 Numpy 和 Numba 实现高性能的文本检索。它解决了传统 BM25 实现在处理大★ 1,796
wink-nlpwink-nlp 是一个面向开发者的自然语言处理(NLP)工具包,用 JavaScript 编写,旨在让 NLP 功能更易用、更友好。它解决了开发者在 Java★ 1,392
Local_Pdf_Chat_RAG这是一个用纯原生 Python 实现的 RAG(检索增强生成)框架,专注于本地 PDF 文档的智能问答。它解决了本地文档无法直接与大模型对话的问题,通过 FAI★ 957
EasyRAGEasyRAG 是一个易用的 RAG(检索增强生成)框架,源自 CCF AIOps 国际挑战赛 2024 的季军方案。它旨在解决企业落地 RAG 时面临的工程复★ 639
docsagentDocsAgent 是一个本地优先的个人知识库检索工具,通过 MCP 协议为 Claude、Cursor、Cline 等 AI 客户端提供即时、私密的资料访问能★ 623
mcpproxy-gomcpproxy-go 是一个用 Go 语言编写的 MCP(Model Context Protocol)代理服务器,旨在为 AI 智能体提供安全、可控的上下文★ 379
pmbpmb 是一个面向 AI 编程助手的本地优先持久记忆工具,通过 MCP 协议为 Claude Code、Cursor、Codex 等提供跨会话记忆能力。它解决 ★ 280
memexmemex 是一个用 Rust 编写的本地检索工具,专门用来搜索和恢复各类 AI 编程助手的历史会话记录,包括 Claude Code、Codex、Pi、Ope★ 233
semble_rssemble_rs 是一个用 Rust 编写的、面向 AI 智能体的高性能代码搜索工具,旨在替代 grep、cat、read、ls 等传统命令,成为 Claud★ 212
VectorRAG.NetVectorRAG.Net 是一个面向 .NET 生态的高性能向量数据库库,专为语义搜索和 RAG(检索增强生成)场景设计。它采用随机超平面 LSH(局部敏感哈★ 164
VeraVera 是一个本地代码搜索引擎,结合了 BM25 关键词匹配、向量相似度和交叉编码器重排序,提供多阶段检索以提升搜索准确性。它使用 tree-sitter 解★ 114
VeraVera 是一个完全离线运行的本地代码搜索引擎,用 Rust 编写。它解决的是开发者在大型代码库中快速定位代码的问题,尤其适合需要语义理解而非单纯关键词匹配的场★ 114
Flamehaven-FilesearchFlamehaven-Filesearch 是一个自托管的 RAG 搜索引擎,旨在解决个人或团队在本地文件检索中面临的格式多样、语义理解不足和部署复杂等问题。它★ 109
codesearchcodesearch 是一个用 Rust 编写的多仓库语义代码搜索 MCP 服务器,专为 AI 编程助手(如 OpenCode、Claude Code、Curs★ 85
patent-literature-search-mcppatent-literature-search-mcp 是一个基于 Model Context Protocol (MCP) 的智能体服务,专注于专利与学术文★ 82