SurgicalDINO 是计算机视觉领域的开源项目,由 BeileiCui 开发,2023 年首次发布。
它收录于计算机视觉分类,该分类目前共有 446 个项目,GitHub 星标数为 70。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-11。本地部署,完全免费。
它主要面向的使用场景是:手术导航中实时深度感知,辅助器械定位。同类可对比的替代方案包括 Depth Anything、MiDaS、ZoeDepth。

用基础模型适配器,让内窥镜图像秒变深度图,助力手术导航。
SurgicalDINO 是一个针对内窥镜手术场景的深度估计开源模型,基于视觉基础模型 DINOv2 进行适配器学习,解决术中单目深度感知难题。项目核心在于利用预训练基础模型的强大表征能力,通过轻量级适配器微调,在少量手术数据上实现高精度深度估计,无需从头训练。其能力包括:从内窥镜图像中恢复场景三维结构,辅助手术导航、增强现实叠加和器械定位。技术栈以 Python 为主,依赖 PyTorch 和 DINOv2,提供了训练和推理代码。该模型在 IPCAI 2024 发表,针对手术场景中纹理稀疏、反光、组织变形等挑战进行了优化,相比传统方法在精度和泛化性上有显著提升。目前项目处于早期阶段,代码结构清晰,适合作为手术视觉研究的基础工具。
Depth Anything、MiDaS、ZoeDepth
SurgicalDINO 是计算机视觉领域的开源项目,由 BeileiCui 开发,2023 年首次发布。
它收录于计算机视觉分类,该分类目前共有 446 个项目,GitHub 星标数为 70。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-07-11。本地部署,完全免费。
它主要面向的使用场景是:手术导航中实时深度感知,辅助器械定位。同类可对比的替代方案包括 Depth Anything、MiDaS、ZoeDepth。
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3