embeddings
本站收录 152 个带「embeddings」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
claude-memclaude-mem 是一个为 AI 智能体提供跨会话持久记忆的开源工具。它解决了 AI 助手在每次对话后丢失上下文、无法记住用户偏好和历史决策的核心痛点。该工★ 94,920
WeKnora腾讯开源的 LLM 知识平台,将原始文档转化为可查询的 RAG、自主推理 Agent 与自动维护的 Wiki。构建企业级知识中枢,让知识自动沉淀、检索与推理,助★ 31,212
RAG_TechniquesRAG_Techniques 是一个专注于检索增强生成(RAG)技术的开源教程仓库,汇集了从基础到前沿的多种 RAG 实现方法。它通过一系列详细的 Jupyte★ 29,631
turbovecturbovec 是一个基于 TurboQuant 构建的向量索引库,使用 Rust 编写并提供 Python 绑定。它旨在解决大规模向量检索场景下的性能瓶颈问★ 17,262
langchain4jLangChain4j 是一个面向 JVM 生态的 Java 开源库,旨在为构建 LLM 驱动的应用提供地道、简洁的开发体验。它解决了 Java 开发者难以像 ★ 13,176
InsForgeInsForge 是一个开源的、面向智能体编程的全栈后端平台,旨在为 AI 编码智能体提供一站式基础设施。它整合了数据库(PostgreSQL + pgvect★ 13,030
txtaitxtai 是一个全栈 AI 框架,旨在将语义搜索、大语言模型编排和语言模型工作流整合到一个统一的工具中。它解决了从非结构化文本中高效检索信息、构建 RAG 应★ 12,988
FlagEmbeddingFlagEmbedding 是一个专注于检索与检索增强大语言模型(RAG)的开源工具库,由北京智源人工智能研究院(BAAI)开发。它解决了文本嵌入(Embedd★ 12,208
h2ogpth2oGPT 是一个由 H2O.ai 开发的私有化大语言模型聊天助手,旨在让用户完全掌控自己的数据,实现 100% 私密的本地 AI 对话。它解决了企业或个人在★ 11,959
seatunnelSeaTunnel(原名Waterdrop)是一个高性能、分布式、海量数据集成工具,支持多模态数据同步。它解决了传统数据同步工具在异构数据源间传输效率低、配置复★ 9,688
lancelance 是一个面向多模态 AI 数据的开源列式存储格式,基于 Rust 和 Apache Arrow 构建。它解决了传统 Parquet 格式在随机访问、向★ 7,123
postgresmlPostgresML 是一个将机器学习直接集成到 PostgreSQL 数据库中的开源扩展,用 Rust 编写,并利用 GPU 加速。它解决了传统 ML 工作流★ 6,825
obsidian-smart-connectionsobsidian-smart-connections 是一个 Obsidian 插件,旨在写作时自动发现并展示相关笔记和摘录,充当链接构建的副驾驶。它利用本地嵌★ 5,473
AutoRAGAutoRAG 是一个基于 TypeScript 构建的本地智能搜索工具,旨在让 AI 代理能够快速查找你电脑中的任何内容。它通过索引文件、应用数据、浏览器历史★ 5,112
text-embeddings-inferencetext-embeddings-inference 是一个用 Rust 编写的高性能文本嵌入模型推理服务,专为大规模生产环境设计。它解决了传统嵌入模型推理速度慢★ 5,064
OpenMemory面向 LLM 应用的本地持久化记忆存储,兼容 Claude Desktop、GitHub Copilot、Codex 等多个主流 AI 工具。数据完全存储在本地★ 4,512
LongMemoryLongMemory 是一个面向 LLM 应用的本地持久化记忆存储基础设施,专为 Claude Desktop、GitHub Copilot、Codex、Ant★ 4,512
ruby_llmruby_llm 是一个为 Ruby 语言打造的 AI 框架,旨在统一接入各大主流 AI 提供商(如 OpenAI、Anthropic、Gemini、DeepS★ 4,422
twinnytwinny 是一款 Visual Studio Code 的 AI 代码补全与对话插件,定位是 GitHub Copilot 的免费替代方案。它支持本地模型和★ 3,653
awesome-generative-ai这是一个精心整理的生成式AI资源清单,汇总了工具、模型、论文和参考链接,覆盖ChatGPT、Midjourney、DALL-E等主流技术。它解决了AI领域信息过★ 3,546
towheeTowhee 是一个专注于神经数据处理的 Python 框架,旨在让构建和运行 AI 驱动的数据管道变得简单高效。它解决的是从原始数据(文本、图像、音视频等)到★ 3,450
siesie 是一个开源的推理服务器和生产级集群,专为智能体(agent)所需的各类模型提供统一部署和调度。它解决了多模型、多副本在生产环境中难以统一管理的问题,提供★ 3,337
SocratiCodeSocratiCode 是一款面向企业级大型代码库的智能分析工具,专为处理超过 4000 万行代码的复杂项目而设计。它无需复杂配置即可本地运行,保护代码隐私,可★ 3,326
fastembedfastembed 是一个轻量级、高性能的 Python 库,专注于生成高质量的文本嵌入向量。它基于 ONNX Runtime 和 Transformers.j★ 3,227
prompttoolsprompttools 是一个开源的提示词测试与实验工具集,专为 LLM 和向量数据库设计。它解决了提示词工程中缺乏系统化测试和对比的问题,让开发者能快速评估不★ 3,055
ReadAnyReadAny 是一款基于 AI 的跨平台电子书阅读器,支持 EPUB 等格式,内置语义搜索、RAG 聊天、本地向量存储、笔记、TTS 朗读和 WebDAV 同★ 2,687
memsearchmemsearch 是一个为 AI 智能体(如 Claude Code、Codex)设计的持久化统一记忆层,基于 Markdown 和 Milvus 向量数据库★ 2,684
bootcampBootcamp 是一个专注于非结构化数据搜索与分析的教程型开源项目,涵盖反向图像搜索、音频搜索、分子搜索、视频分析、问答系统及 NLP 等主题。它通过 Jup★ 2,445
ailia-modelsailia-models 是一个汇集了预训练、前沿 AI 模型的集合,专为 ailia SDK 设计。它解决了 AI 模型从研究到部署之间的鸿沟,提供了统一、易★ 2,393
vearchvearch 是一个面向 AI 原生应用的分布式向量搜索引擎,由京东开源。它解决了传统数据库无法高效处理高维向量数据的问题,为推荐系统、图像检索、自然语言处理等★ 2,330
generative-ai-docsgenerative-ai-docs 是 Google 官方维护的生成式 AI 文档仓库,主要面向 Gemini API 和 Gemma 模型,提供丰富的 Ju★ 2,260
agentsetagentset 是一个开源的 RAG(检索增强生成)平台,旨在解决企业或个人在构建知识库问答系统时面临的文档解析、检索准确性和答案可追溯性问题。它内置了引用机★ 2,099
featureformFeatureform 是一个虚拟特征存储(Virtual Feature Store)系统,它不重新搭建存储,而是将你已有的数据基础设施(如 Postgres★ 1,991
DotDot 是一个完全本地化的 AI 音频工具集,专注于文本转语音(TTS)、检索增强生成(RAG)和大语言模型(LLM)的整合。它解决了用户对数据隐私和离线使用的★ 1,913
grepaigrepai 是一个面向 AI 编程代理的本地语义搜索与调用图工具,用 C 语言编写,主打 100% 本地运行、隐私优先。它解决的核心问题是:传统 grep 只★ 1,894
GPTDiscordGPTDiscord 是一个基于 Python 的 Discord 机器人,旨在为 Discord 服务器提供一站式 GPT 接口。它解决了在 Discord ★ 1,852
ModernBERTModernBERT 是一个旨在将经典 BERT 模型现代化升级的开源项目,通过架构改进和规模扩展,让 BERT 在当今硬件和任务上表现更优。它解决了原始 BE★ 1,753
LLPhantLLPhant 是一个面向 PHP 生态的开源生成式 AI 框架,灵感来自 Langchain,旨在将 OpenAI GPT-4 等大模型能力无缝集成到 PHP★ 1,710
lightly-trainlightly-train 是一个面向视觉模型的一体化训练框架,支持 YOLO、ViT、RT-DETR、DINOv3 等主流架构,覆盖预训练、微调和蒸馏全流程。★ 1,692
hivemindHivemind 是一个将 AI 代理的运行轨迹转化为可复用技能的开源工具,基于 TypeScript 构建。它解决了 AI 代理在完成任务后,其执行过程(tr★ 1,622
amazon-bedrock-samplesamazon-bedrock-samples 是亚马逊官方提供的 Amazon Bedrock 服务示例代码仓库,包含大量 Jupyter Notebook 示★ 1,514
korvusKorvus 是一个基于 Postgres 的搜索 SDK,它将完整的 RAG(检索增强生成)流程统一到单个数据库查询中。它解决了传统 RAG 架构中需要拼接向★ 1,471
Awesome-LLM-RAGAwesome-LLM-RAG 是一个精心整理的检索增强生成(RAG)资源列表,聚焦于大语言模型中的高级 RAG 技术。它系统梳理了 RAG 领域的论文、框架、★ 1,365
chromem-gochromem-go 是一个为 Go 语言设计的嵌入式向量数据库,提供与 Chroma 类似的接口,且零第三方依赖。它主要解决 Go 开发者在构建 AI 应用时★ 1,059
fastembed-rsfastembed-rs 是一个用 Rust 实现的向量嵌入与重排序库,旨在本地生成高质量的文本嵌入向量,并支持本地重排序。它解决了在 Rust 生态中缺乏高性★ 1,030
vectordb-recipesvectordb-recipes 是一个围绕向量数据库和 LLM 的多模态 AI、RAG 与智能体应用示例与教程集合。它旨在解决开发者在使用向量检索构建实际 A★ 976
rag_apirag_api 是一个基于 ID 的 RAG(检索增强生成)API 服务,使用 FastAPI 构建,并与 Langchain 和 PostgreSQL/pgv★ 911
rag-apirag-api 是一个基于 FastAPI 的检索增强生成(RAG)后端服务,核心特点是围绕“ID”组织文档与向量检索,并与 Langchain、Postgre★ 911
azure-search-vector-samples这是微软官方维护的 Azure AI Search 向量搜索能力示例代码库,用 Jupyter Notebook 集中演示如何在 Azure 认知搜索中构建向量★ 910
lanternlantern 是一个基于 PostgreSQL 的向量数据库扩展,专为构建 AI 应用而设计。它通过扩展 PostgreSQL 的能力,使其能够高效地存储和检★ 894