EndoDAC 是计算机视觉领域的开源项目,由 BeileiCui 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 97。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-16。代码公开,可自行部署使用,无收费计划。
它主要面向的使用场景是:内窥镜手术中的实时深度感知与导航。同类可对比的替代方案包括 Depth Anything、Monodepth2、EndoSLAM。

让基础模型秒变内窥镜深度感知专家,无需标注即可用
EndoDAC 是一个面向内窥镜手术场景的自监督深度估计模型,发表于 MICCAI 2024。它解决了基础模型(如 DINOv2)直接应用于内窥镜图像时因域差异导致性能下降的问题,通过引入高效的适配模块,使得模型能够适应任意内窥镜相机,无需真实深度标注即可从单目视频中学习深度信息。其核心能力包括:利用自监督学习框架,结合基础模型的强大特征提取能力,通过轻量级适配器实现快速迁移;支持多种内窥镜数据(如胃镜、肠镜等),并保持实时推理性能。项目提供完整训练和评估代码,基于 Python 和 PyTorch 实现,适合医学影像分析、手术导航等研究与应用。
Depth Anything、Monodepth2、EndoSLAM
EndoDAC 是计算机视觉领域的开源项目,由 BeileiCui 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 97。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-16。代码公开,可自行部署使用,无收费计划。
它主要面向的使用场景是:内窥镜手术中的实时深度感知与导航。同类可对比的替代方案包括 Depth Anything、Monodepth2、EndoSLAM。
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3