similarity-search
本站收录 14 个带「similarity-search」标签的 AI 开源项目
qdrant用 Rust 编写的高性能向量数据库与向量检索引擎,专为新一代 AI 应用设计,支持亿级向量的规模化管理与毫秒级相似度搜索。内置丰富的过滤条件与多种距离度量,并★ 34,882
weaviate开源向量数据库,同时存储对象与向量,将向量相似度检索与结构化过滤无缝结合,兼具云原生数据库的容错性与可扩展性。支持多种嵌入模型与模块化扩展,常被用于构建语义搜索★ 16,860
zveczvec 是一个轻量级、极速的进程内向量数据库,专为需要高性能向量检索的 AI 应用设计。它解决的是传统向量数据库部署重、延迟高的问题,将向量索引和检索能力直接★ 16,030
lancedbLanceDB 是一个用 Rust 编写的开源嵌入式向量检索库,面向多模态 AI 应用。它把向量数据库能力做成可嵌入的库,无需单独部署服务,开发者可以直接在应用★ 11,562
GPTCacheGPTCache 是一个面向大语言模型(LLM)的语义缓存工具,核心解决 LLM 推理成本高、响应慢的问题。它通过缓存相似的查询结果,让重复或相近的请求直接命中★ 8,206
chonkieChonkie 是一个轻量级的 Python 文本分块(chunking)库,专为 RAG(检索增强生成)管道设计。它解决的是将长文档切分为适合嵌入和检索的文本★ 4,777
VideoPipeVideoPipe 是一个基于计算机视觉模型和多模态大语言模型(mLLM)的跨平台视频结构化分析框架。它解决的是视频数据从原始帧到结构化信息的端到端处理问题,将★ 2,962
MyScaleDBMyScaleDB 是一个基于 ClickHouse 二次开发的开源数据库,专注于高性能向量搜索与全文搜索的融合。它解决了传统向量数据库在数据管理、实时更新和复★ 1,045
cuvscuVS 是 NVIDIA 开源的 GPU 向量搜索与聚类库,属于 RAPIDS 生态的基础设施组件。它把近似最近邻搜索(ANN)、距离计算、邻居图构建和聚类等★ 857
quaterionQuaterion 是一个专注于相似度学习模型微调的 Python 框架,核心解决的是在检索、去重、聚类等场景下,如何高效训练出能输出高质量向量表示的模型。它把★ 663
caisscaiss 是一个用 C++ 实现的跨平台、多语言支持的相似向量/相似词/相似句高性能检索引擎。它旨在解决开发者在构建聊天机器人、语义搜索、推荐系统等应用时,对★ 549
Image-MetaHubImage-MetaHub 是一个本地优先的数字资产管理工具,专门为 AI 生成图像设计。它解决了生成式 AI 用户面临的核心痛点:图像文件与生成参数(如提示词★ 323
ScalableVectorSearchScalableVectorSearch 是一个用 C++ 实现的向量搜索引擎,专注于提供高性能的相似性搜索能力。它解决的是在海量高维向量数据中快速查找最近邻的★ 237
duckdb-embedding-searchduckdb-embedding-search 是一个基于 DuckDB 的快速向量相似度搜索工具,专为轻量级嵌入检索场景设计。它利用 DuckDB 的列式存储★ 152