embedding

本站收录 32 个带「embedding」标签的 AI 开源项目

Langchain-Chatchat基于 Langchain 与 ChatGLM、Qwen、Llama 等大语言模型构建的本地知识库 RAG 与 Agent 应用。支持文档问答、知识检索与智能体编★ 38,666TencentDB-Agent-Memory腾讯云推出的团队级 AI 智能体记忆中枢,将对话、文档与代码转化为聊天记忆、技能、LLM 知识库、代码图谱四类可复用记忆资产,跨智能体与框架共享治理。★ 27,512turbovecturbovec 是一个基于 TurboQuant 构建的向量索引库,使用 Rust 编写并提供 Python 绑定。它旨在解决大规模向量检索场景下的性能瓶颈问★ 17,262ms-swiftms-swift 是魔搭社区推出的国产大模型全流程训练与部署工具,旨在解决开发者微调大模型时面临的框架割裂、上手门槛高、多模态支持不足等痛点。它支持从增量预训练★ 15,754PaddleNLPPaddleNLP 是百度飞桨生态下的自然语言处理库,定位为易用且强大的大模型与小模型库,内置丰富的模型动物园。它解决从文本分类、序列标注到大规模预训练模型微调★ 12,981claude-context专为 Claude Code 打造的代码搜索 MCP 服务,让整个代码库都能成为任意编程代理的上下文。通过精准的代码检索,Agent 无需翻阅大量文件即可找到关★ 12,575all-in-ragall-in-rag 是 Datawhale 社区推出的大模型应用开发实战指南,聚焦检索增强生成(RAG)技术全栈。它系统讲解从基础概念到高级优化的完整知识体系★ 11,554UltraRAGUltraRAG 是一个基于 Python 的低代码 MCP(Model Context Protocol)框架,用于构建复杂且创新的 RAG(检索增强生成)流★ 5,711infinityInfinity 是一个专为 LLM 应用打造的 AI 原生数据库,核心解决大模型应用中知识检索的效率和准确性问题。它支持稠密向量、稀疏向量、张量(多向量)和全★ 4,728myGPTReadermyGPTReader 是一个社区驱动的 AI 阅读与对话工具,利用 ChatGPT 技术帮助用户高效阅读和交互。它通过爬虫抓取网页内容,结合嵌入技术,让用户能★ 4,412telegram-searchtelegram-search 是一个开源工具,用于导出 Telegram 聊天记录并进行模糊搜索。它解决的是 Telegram 内置搜索功能弱、无法跨聊天统一★ 4,108LlamaIndexTSLlamaIndexTS 是 LlamaIndex 的 TypeScript 版本,专为 LLM 应用提供数据框架,聚焦服务端解决方案。它解决了 JavaScr★ 3,080trieveTrieve 是一个基于 Rust 构建的一站式搜索与 RAG 平台,通过 API 提供搜索、推荐、检索增强生成和数据分析能力。它解决了开发者需要集成多种搜索和★ 2,719node-llama-cppnode-llama-cpp 是一个将 llama.cpp 绑定到 Node.js 的库,让你能在本地机器上直接运行 AI 模型(如 Llama、Mistral★ 2,186modelfusionModelFusion 是一个用于构建 AI 应用的 TypeScript 库,旨在为开发者提供一套统一、类型安全的接口来集成多种大语言模型(LLM)、嵌入模型★ 1,319MyScaleDBMyScaleDB 是一个基于 ClickHouse 二次开发的开源数据库,专注于高性能向量搜索与全文搜索的融合。它解决了传统向量数据库在数据管理、实时更新和复★ 1,045chatWebchatWeb 是一个基于 Python 的开源对话助手,能够抓取网页、读取 PDF、DOCX、TXT 等文档,提取主要内容后,结合 OpenAI GPT 模型★ 917VLM2VecVLM2Vec 是一个将视觉语言模型(VLM)适配为多功能嵌入模型的开源项目,核心解决多模态内容(图像、文本、视频等)的统一向量化表示问题。它提出了 MMEB(★ 689embedJsembedJs 是一个基于 Node.js 的 RAG(检索增强生成)框架,旨在简化 LLM 与嵌入模型(Embedding)的集成工作。它解决了开发者在构建 ★ 601NLP_pytorch_project这是一个基于PyTorch的自然语言处理(NLP)教程与实战项目集合,涵盖词嵌入(Embedding)、神经机器翻译(NMT)、文本分类、文本生成、命名实体识别★ 567chipperchipper 是一个面向创客和开发者的 AI 命令行界面工具,旨在简化本地 AI 模型(如 Ollama)的交互,并集成 Haystack RAG 框架和 P★ 485solon-aisolon-ai 是一个面向 Java 生态的 AI 应用开发框架,旨在简化 LLM 应用的构建过程。它支持 LLM 工具调用、技能封装、RAG 检索增强生成、★ 459ai4jai4j 是一个面向 Java 8+ 的 agentic SDK,旨在为 Java 开发者提供统一的 LLM 访问接口,支持 OpenAI、Anthropic、★ 433redis-vl-pythonRedisVL 是 Redis 官方推出的 AI 原生 Python 客户端库,旨在弥合传统 Redis 数据库与向量检索、AI 应用之间的鸿沟。它解决了开发者★ 430ThinkRAGThinkRAG 是一个专为笔记本电脑设计的轻量级检索增强生成(RAG)系统,旨在让个人用户轻松在本地部署大模型知识库问答。它解决了在资源受限环境下运行完整RA★ 351rag-experiment-acceleratorRAG Experiment Accelerator 是一个用于加速检索增强生成(RAG)实验与评估的 Python 工具,主要面向 Azure Cogniti★ 312gpt_servergpt_server 是一个面向生产环境的 AI 服务部署框架,旨在统一集成多种主流模型能力,包括大语言模型(LLM)、Embedding、Reranker、A★ 253nosianosia 是一个基于 Ruby 的自托管 AI 平台,专注于 RAG(检索增强生成)和 MCP(模型上下文协议)能力。它旨在解决用户在私有环境中构建智能问答和★ 213nano-vectordbnano-vectordb 是一个极简、易修改的向量数据库,用 Python 编写,专为学习和快速原型设计而生。它解决了在轻量级场景下使用向量检索时,重型数据库★ 209RAG-ReActAgentRAG-ReActAgent 是一个结合检索增强生成(RAG)与 ReAct(推理+行动)智能体循环的开源问答系统,专注于多跳推理的智能问答。它解决传统 RAG★ 208raftRAFT(Retrieval-Augmented Fine-Tuning)是一个结合检索增强生成(RAG)与微调的开源方法库,旨在让AI代理更真实地模拟特定人类★ 176sd-lora-trainersd-lora-trainer 是一个用于训练 Stable Diffusion 模型 LoRA 和 embedding 的开源工具,支持 SDXL 和 SD1★ 70