DeepCamera
开源
让普通摄像头秒变AI保安,自动看懂并守护你的家
DeepCamera 是一个开源的 AI 摄像头技能平台,定位为智能 NVR 和闭路监控系统。它解决传统监控只能···
汇聚全球AI计算机视觉项目,OCR识别、目标检测、图像分割、人脸识别工具大全。
共收录 447 个开源项目
DeepCamera
开源
让普通摄像头秒变AI保安,自动看懂并守护你的家
DeepCamera 是一个开源的 AI 摄像头技能平台,定位为智能 NVR 和闭路监控系统。它解决传统监控只能···
segmentation_models.pytorch
开源
一行代码调用 500+ 预训练分割模型,快速搭建语义分割流水线。
segmentation_models.pytorch 是一个基于 PyTorch 的语义分割模型库,提供 500+ 预训练骨干网络(涵···
BiaPy
开源
拖拽配置,快速搭建生物图像深度学习分析流程
BiaPy 是一个开源的 Python 库,旨在简化生物图像分析流程的构建。它基于深度学习,提供从数据预处···
pytorch-image-models
开源
一行代码调用数百个预训练视觉骨干,省去复现选型成本
pytorch-image-models(常被称为 timm)是 PyTorch 生态中规模最大的图像编码器与骨干网络集合,由···
Brain-Tumor-Segmentation
开源
用U-Net一键分割脑肿瘤,医学影像分析上手快
这是一个基于U-Net架构的脑肿瘤图像分割项目,使用PyTorch实现,旨在从医学影像中自动分割脑肿瘤区···
frigate
开源
本地实时识别摄像头物体,低延迟高隐私,智能家居联动神器
Frigate 是一个开源的网络录像机(NVR),专为 IP 摄像头设计,内置实时本地对象检测功能。它解决了···
OCR4all
开源
古籍扫描件上传,自动识别加人工校对,一键导出文本
OCR4all 是一个面向历史文献与古籍数字化的开源 OCR 平台,通过 Web 应用提供从图像预处理、版面分···
kimimaro
开源
一键提取3D分割骨架,助力神经元与血管分析
kimimaro 是一个用于三维图像分割骨架化的开源工具,基于 TEASAR 算法实现中轴变换。它主要解决生物···
MIVisionX
开源
在 AMD 硬件上跑视觉推理,用 OpenVX 图加速
MIVisionX 是 AMD 推出的开源计算机视觉工具包,核心是符合 Khronos OpenVX 1.3.2 规范的高度优化实···
smriprep
开源
一键自动化处理结构MRI,让预处理标准化可复现
sMRIPrep 是 NIPreps 家族中专门用于结构磁共振成像(sMRI)预处理的自动化工作流工具。它解决了神···
geti
开源
少数据快训练,轻松搞定计算机视觉模型
geti 是英特尔推出的计算机视觉模型训练平台,旨在用更少的数据和更短的时间构建高性能视觉模型。它···
zotero-ocr
开源
在 Zotero 里直接给扫描 PDF 做 OCR,文字可搜可引。
zotero-ocr 是一个为文献管理工具 Zotero 开发的 OCR 插件,主要解决扫描版 PDF 无法直接复制、搜索···
Biodiversity
开源
把红外相机和录音自动变成物种数据,省去人工翻图
这是微软 AI for Good 实验室的生物多样性研究枢纽仓库,集中托管面向生态保护的开源 AI 模型、边缘···
2d-diffusion-limited-aggregation-exp···
开源
用物理模拟生成有机分形图案,探索形态设计新玩法
这是一个基于JavaScript的二维扩散限制聚集(DLA)可视化实验项目,将经典的DLA物理模型用作二维形···
yolov3
开源
用PyTorch训练和部署YOLOv3,实现实时目标检测
这是一个基于PyTorch实现的YOLOv3目标检测项目,支持YOLOv3、YOLOv3-SPP和YOLOv3-tiny三种模型。它···
kornia
开源
让图像变换可微,深度学习视觉更灵活
Kornia 是一个基于 PyTorch 的可微计算机视觉库,专注于几何视觉和空间 AI。它解决了深度学习与经典···
2d-differential-growth-experiments
开源
用代码模拟自然生长,生成有机形态和纹理
这是一个基于JavaScript的2D形态生成实验项目,探索差分生长(differential growth)作为一种二维形···
GestureGAN
开源
上传一张手势图,一键生成指定新手势,背景身份不变
GestureGAN 是一个基于生成对抗网络(GAN)的手势到手势转换工具,发表于 ACM MM 2018(Oral)。它···
supervisely
开源
用 Python 把 CV 标注和训练流程自动化跑起来
Supervisely SDK 是 Supervisely 计算机视觉平台的 Python 开发包,用于自动化、定制和扩展平台能力···
GammaCV
开源
浏览器里用 GPU 跑图像处理,实时滤镜和特征提取不卡顿
GammaCV 是一个面向浏览器环境的 WebGL 加速计算机视觉库,使用 JavaScript 编写。它把图像处理与特···
OneShotTranslation
开源
一张图搞定跨域转换,无需配对数据
OneShotTranslation 是论文《One-Shot Unsupervised Cross Domain Translation》(NIPS 2018)的 P···
xview-yolov3
开源
用YOLOv3快速训练卫星图像目标检测模型
xview-yolov3 是一个基于 YOLOv3 的遥感卫星图像目标检测项目,专为 xView 数据集和检测挑战赛设计···
awesome-ocr-resources
开源
OCR 论文与数据集一站清单,省去到处搜资料
awesome-ocr-resources 是一个面向 OCR(光学字符识别)领域的资源聚合项目,系统整理了该方向的重···
SeGAN
开源
用GAN补全遮挡区域,让图像分割与生成一步到位
SeGAN 是一个基于生成对抗网络(GAN)的早期开源项目,旨在解决图像中不可见部分的语义分割与生成问···