Pair-VPR 是计算机视觉领域的开源项目,由 csiro-robotics 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 446 个项目,GitHub 星标数为 66。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-20。无在线服务,需自行部署,完全免费。
它主要面向的使用场景是:机器人长期自主导航中的重定位。同类可对比的替代方案包括 NetVLAD、CosPlace、EigenPlaces。

用视觉Transformer让机器人认路更准,不怕光照季节变化
Pair-VPR 是一个基于视觉 Transformer 的视觉地点识别(VPR)开源模型,发表于 IEEE RA-L 2025。它解决的是在环境变化(如光照、季节、视角)下,机器人或自动驾驶系统如何准确识别“回到同一地点”的问题。核心能力包括:提出一种地点感知的预训练方法,让模型在预训练阶段就学习地点相关的判别特征;设计对比对分类框架,将 VPR 任务转化为对图像对是否来自同一地点的分类问题,从而提升匹配精度。项目提供官方训练和评估代码,支持主流 VPR 数据集,方便研究者复现和扩展。相比传统基于 CNN 或全局描述子的方法,Pair-VPR 在视觉 Transformer 架构上实现了更鲁棒的地点识别,尤其适合复杂环境下的长期定位。
NetVLAD、CosPlace、EigenPlaces
Pair-VPR 是计算机视觉领域的开源项目,由 csiro-robotics 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 446 个项目,GitHub 星标数为 66。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-20。无在线服务,需自行部署,完全免费。
它主要面向的使用场景是:机器人长期自主导航中的重定位。同类可对比的替代方案包括 NetVLAD、CosPlace、EigenPlaces。
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3