计算机视觉

汇聚全球AI计算机视觉项目,OCR识别、目标检测、图像分割、人脸识别工具大全。

共收录 495 个开源项目

rio-tiler 开源

把遥感大图切成地图瓦片,按需读取不浪费流量

rio-tiler 是一个基于 Rasterio 的 Python 插件,专门用于从栅格数据集中读取和生成地图瓦片。它解···

★ 595 评分 2017-10-06
pyod 开源

一站式异常检测库,60+算法开箱即用,自动选最优模型

PyOD是一个专注于异常检测的Python库,覆盖表格、时间序列、图、文本、图像和音频等多种数据类型,···

★ 10029 评分 2017-10-03
PerceptionMetrics 开源

跨模态统一评测检测分割模型,省去重复造轮子

PerceptionMetrics 是一个面向计算机视觉的评估工具包,旨在统一和简化目标检测与分割模型的评测流···

★ 113 评分 2017-07-14
event-based_vision_resources 开源

事件相机资料一站集齐,快速入门不迷路

这是一个面向事件相机(Event-based Vision)领域的开源资源合集,由社区协作维护,把散落在各处的···

★ 3662 评分 2017-06-27
mSRGAN-A-GAN-for-single-image-super-··· 开源

用GAN把模糊显微图变清晰,助力药物筛选分析

mSRGAN 是一个面向高内涵筛选(HCS)显微图像的单图像超分辨率生成对抗网络(GAN)项目。它解决的是···

★ 58 评分 2017-06-21
webcam-pix2pix-tensorflow 开源

让摄像头画面实时变身,玩转 pix2pix 风格转换

webcam-pix2pix-tensorflow 是一个基于 TensorFlow 的实时图像转换项目,它利用 pix2pix 生成对抗网···

★ 361 评分 2017-05-01
Synthesize3DviaDepthOrSil 开源

从多视图深度图或轮廓,一键生成3D形状

这是一个2017年CVPR论文的开源实现,用于通过多视图深度图或轮廓图来生成和重建3D形状。项目核心是···

★ 170 评分 2017-03-09
photonix 开源

自建私有云相册,用AI自动分类,秒搜你的照片

Photonix 是一个基于 Web 的现代化照片管理服务器,可部署在家用服务器上,让你在任何设备上快速找···

★ 1955 评分 2017-03-07
Doxa 开源

一键对比十多种图像二值化算法,选型调参不再愁

Doxa 是一个用 C++ 编写的图像二值化框架,专注于局部自适应阈值处理,支持 Otsu、Bernsen、Niblac···

★ 194 评分 2017-02-24
cvkit 开源

轻量 C++ 工具,快速查看图像与 3D 模型

cvkit 是一个面向计算机视觉研究与开发的 C++ 工具集,主要解决图像与三维模型的可视化和分析需求。···

★ 281 评分 2017-02-20
emgucv 开源

用 C# 直接调用 OpenCV,跨平台做图像处理与识别

Emgu CV 是 OpenCV 图像处理库的跨平台 .NET 封装,让 C#、VB.NET、F# 等 .NET 开发者无需编写 C++···

★ 2300 评分 2017-01-04
anyline-ocr-react-native-module 开源

React Native 一套代码,接入 Anyline 移动端 OCR 扫描

anyline-ocr-react-native-module 是 Anyline 公司为 React Native 提供的 OCR 原生桥接模块,让 i···

★ 111 评分 2016-12-05
vision 开源

一站式搞定视觉数据与模型,让 CV 开发像写文本一样简单

vision 是 Hugging Face 团队开发的计算机视觉工具库,专注于提供图像、视频数据集、变换(transfo···

★ 17946 评分 2016-11-09
unrealcv 开源

在虚幻引擎里一键生成带标注的视觉数据,省去真实采集成本

UnrealCV 是一个将计算机视觉与虚幻引擎(UE4/UE5)连接起来的开源工具,旨在为视觉研究提供高保真···

★ 2221 评分 2016-09-08
tesseract 开源

在 R 里一行代码把图片文字变成数据框

tesseract 是一个为 R 语言提供 Tesseract OCR 引擎绑定的开源包,让 R 用户无需离开统计与数据分析···

★ 252 评分 2016-03-02
rabbit-ear 开源

用代码设计折纸,自动计算折叠过程,输出矢量图。

rabbit-ear 是一个用 JavaScript 编写的计算折纸库,专注于折纸设计与几何算法。它解决了传统折纸设···

★ 651 评分 2016-01-02
compv 开源

ARM/x86 上跑视觉算法,比 OpenCV 快最多 50 倍

compv 是一个面向 ARM 和 x86 设备的开源计算机视觉库,主打极致性能,官方宣称在部分任务上比 Ope···

★ 212 评分 2015-12-28
scanbot-sdk-example-android 开源

几行代码给安卓 App 加上文档扫描与 OCR 识别

scanbot-sdk-example-android 是 Scanbot SDK 官方提供的 Android 示例工程,用 Kotlin 编写,展示···

★ 115 评分 2015-06-01
deepdetect 开源

一键部署深度学习模型,提供高性能推理服务

deepdetect 是一个开源的深度学习服务器和命令行工具,最初由 Jolibrain 开发,旨在简化深度学习模···

★ 2550 评分 2015-05-22
kraken 开源

多语言古籍手写文本,一键转成可编辑文字

Kraken 是一个面向多语言与历史文献的开源 OCR 引擎,由 Python 编写,核心目标是解决传统 OCR 在非···

★ 1080 评分 2015-05-19
Meshroom 开源

拖拽节点,从照片自动生成三维模型

Meshroom 是一款基于节点的开源三维重建软件,由 AliceVision 项目提供支持。它通过可视化节点图(···

★ 12995 评分 2015-04-22
AliceVision 开源

多张照片一键生成带纹理三维模型

AliceVision 是一套开源的 3D 计算机视觉框架,用 C++ 编写,核心目标是从多视角照片自动重建三维场···

★ 3512 评分 2014-12-30
reacTIVision 开源

摄像头识别标记与触摸,把桌面变成可交互表面

reacTIVision 是一个用 C 编写的计算机视觉框架,专门用于构建实体交互界面(tangible interactive···

★ 328 评分 2014-10-21
kwiver 开源

用配置拼装视觉算法,运行时换模块不重编译

KWIVER 是一个面向计算机视觉的 C++ 框架,目标是把分散的视觉算法(检测、跟踪、特征提取、视频处···

★ 203 评分 2014-08-22