rio-tiler
开源
把遥感大图切成地图瓦片,按需读取不浪费流量
rio-tiler 是一个基于 Rasterio 的 Python 插件,专门用于从栅格数据集中读取和生成地图瓦片。它解···
汇聚全球AI计算机视觉项目,OCR识别、目标检测、图像分割、人脸识别工具大全。
共收录 495 个开源项目
rio-tiler
开源
把遥感大图切成地图瓦片,按需读取不浪费流量
rio-tiler 是一个基于 Rasterio 的 Python 插件,专门用于从栅格数据集中读取和生成地图瓦片。它解···
pyod
开源
一站式异常检测库,60+算法开箱即用,自动选最优模型
PyOD是一个专注于异常检测的Python库,覆盖表格、时间序列、图、文本、图像和音频等多种数据类型,···
PerceptionMetrics
开源
跨模态统一评测检测分割模型,省去重复造轮子
PerceptionMetrics 是一个面向计算机视觉的评估工具包,旨在统一和简化目标检测与分割模型的评测流···
event-based_vision_resources
开源
事件相机资料一站集齐,快速入门不迷路
这是一个面向事件相机(Event-based Vision)领域的开源资源合集,由社区协作维护,把散落在各处的···
mSRGAN-A-GAN-for-single-image-super-···
开源
用GAN把模糊显微图变清晰,助力药物筛选分析
mSRGAN 是一个面向高内涵筛选(HCS)显微图像的单图像超分辨率生成对抗网络(GAN)项目。它解决的是···
webcam-pix2pix-tensorflow
开源
让摄像头画面实时变身,玩转 pix2pix 风格转换
webcam-pix2pix-tensorflow 是一个基于 TensorFlow 的实时图像转换项目,它利用 pix2pix 生成对抗网···
Synthesize3DviaDepthOrSil
开源
从多视图深度图或轮廓,一键生成3D形状
这是一个2017年CVPR论文的开源实现,用于通过多视图深度图或轮廓图来生成和重建3D形状。项目核心是···
photonix
开源
自建私有云相册,用AI自动分类,秒搜你的照片
Photonix 是一个基于 Web 的现代化照片管理服务器,可部署在家用服务器上,让你在任何设备上快速找···
Doxa
开源
一键对比十多种图像二值化算法,选型调参不再愁
Doxa 是一个用 C++ 编写的图像二值化框架,专注于局部自适应阈值处理,支持 Otsu、Bernsen、Niblac···
cvkit
开源
轻量 C++ 工具,快速查看图像与 3D 模型
cvkit 是一个面向计算机视觉研究与开发的 C++ 工具集,主要解决图像与三维模型的可视化和分析需求。···
emgucv
开源
用 C# 直接调用 OpenCV,跨平台做图像处理与识别
Emgu CV 是 OpenCV 图像处理库的跨平台 .NET 封装,让 C#、VB.NET、F# 等 .NET 开发者无需编写 C++···
anyline-ocr-react-native-module
开源
React Native 一套代码,接入 Anyline 移动端 OCR 扫描
anyline-ocr-react-native-module 是 Anyline 公司为 React Native 提供的 OCR 原生桥接模块,让 i···
vision
开源
一站式搞定视觉数据与模型,让 CV 开发像写文本一样简单
vision 是 Hugging Face 团队开发的计算机视觉工具库,专注于提供图像、视频数据集、变换(transfo···
unrealcv
开源
在虚幻引擎里一键生成带标注的视觉数据,省去真实采集成本
UnrealCV 是一个将计算机视觉与虚幻引擎(UE4/UE5)连接起来的开源工具,旨在为视觉研究提供高保真···
tesseract
开源
在 R 里一行代码把图片文字变成数据框
tesseract 是一个为 R 语言提供 Tesseract OCR 引擎绑定的开源包,让 R 用户无需离开统计与数据分析···
rabbit-ear
开源
用代码设计折纸,自动计算折叠过程,输出矢量图。
rabbit-ear 是一个用 JavaScript 编写的计算折纸库,专注于折纸设计与几何算法。它解决了传统折纸设···
compv
开源
ARM/x86 上跑视觉算法,比 OpenCV 快最多 50 倍
compv 是一个面向 ARM 和 x86 设备的开源计算机视觉库,主打极致性能,官方宣称在部分任务上比 Ope···
scanbot-sdk-example-android
开源
几行代码给安卓 App 加上文档扫描与 OCR 识别
scanbot-sdk-example-android 是 Scanbot SDK 官方提供的 Android 示例工程,用 Kotlin 编写,展示···
deepdetect
开源
一键部署深度学习模型,提供高性能推理服务
deepdetect 是一个开源的深度学习服务器和命令行工具,最初由 Jolibrain 开发,旨在简化深度学习模···
kraken
开源
多语言古籍手写文本,一键转成可编辑文字
Kraken 是一个面向多语言与历史文献的开源 OCR 引擎,由 Python 编写,核心目标是解决传统 OCR 在非···
Meshroom
开源
拖拽节点,从照片自动生成三维模型
Meshroom 是一款基于节点的开源三维重建软件,由 AliceVision 项目提供支持。它通过可视化节点图(···
AliceVision
开源
多张照片一键生成带纹理三维模型
AliceVision 是一套开源的 3D 计算机视觉框架,用 C++ 编写,核心目标是从多视角照片自动重建三维场···
reacTIVision
开源
摄像头识别标记与触摸,把桌面变成可交互表面
reacTIVision 是一个用 C 编写的计算机视觉框架,专门用于构建实体交互界面(tangible interactive···
kwiver
开源
用配置拼装视觉算法,运行时换模块不重编译
KWIVER 是一个面向计算机视觉的 C++ 框架,目标是把分散的视觉算法(检测、跟踪、特征提取、视频处···