计算机视觉

汇聚全球AI计算机视觉项目,OCR识别、目标检测、图像分割、人脸识别工具大全。

共收录 447 个开源项目

techniques 开源

用深度学习搞定卫星图,从数据到模型一站通

这是一个专注于卫星与航空影像深度学习技术的开源项目,汇集了针对地球观测数据的卷积神经网络、数···

★ 10270 评分 2018-04-16
neuriplo-infer 开源

一个 C++ 程序跑通检测分割分类光流多任务

neuriplo-infer 是一个用 C++ 编写的计算机视觉推理应用,目标是把多种视觉任务的推理流程统一到一···

★ 107 评分 2018-04-14
CHINESE-OCR 开源

经典 CTPN+CRNN 方案,快速跑通中文场景文字识别

CHINESE-OCR 是一个面向中文自然场景文字的端到端检测与识别开源项目,采用 CTPN 做文本检测、CRNN···

★ 2957 评分 2018-04-14
ExprGAN 开源

连续控制表情强度,精准编辑人脸表情

ExprGAN 是一个基于 TensorFlow 实现的面部表情编辑开源项目,核心创新在于可控的表情强度编辑。它···

★ 125 评分 2018-01-18
core 开源

把零散 OCR 工具串成标准化流水线,古籍数字化更省心

OCR-D 的 core 是面向历史文献与古籍数字化场景的 Python 工具集与封装库,属于 OCR-D 生态的核心组···

★ 136 评分 2017-11-28
rio-tiler 开源

把遥感大图切成地图瓦片,按需读取不浪费流量

rio-tiler 是一个基于 Rasterio 的 Python 插件,专门用于从栅格数据集中读取和生成地图瓦片。它解···

★ 595 评分 2017-10-06
pyod 开源

一站式异常检测库,60+算法开箱即用,自动选最优模型

PyOD是一个专注于异常检测的Python库,覆盖表格、时间序列、图、文本、图像和音频等多种数据类型,···

★ 10013 评分 2017-10-03
event-based_vision_resources 开源

事件相机资料一站集齐,快速入门不迷路

这是一个面向事件相机(Event-based Vision)领域的开源资源合集,由社区协作维护,把散落在各处的···

★ 3648 评分 2017-06-27
mSRGAN-A-GAN-for-single-image-super-··· 开源

用GAN把模糊显微图变清晰,助力药物筛选分析

mSRGAN 是一个面向高内涵筛选(HCS)显微图像的单图像超分辨率生成对抗网络(GAN)项目。它解决的是···

★ 58 评分 2017-06-21
webcam-pix2pix-tensorflow 开源

让摄像头画面实时变身,玩转 pix2pix 风格转换

webcam-pix2pix-tensorflow 是一个基于 TensorFlow 的实时图像转换项目,它利用 pix2pix 生成对抗网···

★ 361 评分 2017-05-01
Synthesize3DviaDepthOrSil 开源

从多视图深度图或轮廓,一键生成3D形状

这是一个2017年CVPR论文的开源实现,用于通过多视图深度图或轮廓图来生成和重建3D形状。项目核心是···

★ 170 评分 2017-03-09
photonix 开源

自建私有云相册,用AI自动分类,秒搜你的照片

Photonix 是一个基于 Web 的现代化照片管理服务器,可部署在家用服务器上,让你在任何设备上快速找···

★ 1956 评分 2017-03-07
Doxa 开源

一键对比十多种图像二值化算法,选型调参不再愁

Doxa 是一个用 C++ 编写的图像二值化框架,专注于局部自适应阈值处理,支持 Otsu、Bernsen、Niblac···

★ 194 评分 2017-02-24
cvkit 开源

轻量 C++ 工具,快速查看图像与 3D 模型

cvkit 是一个面向计算机视觉研究与开发的 C++ 工具集,主要解决图像与三维模型的可视化和分析需求。···

★ 281 评分 2017-02-20
emgucv 开源

用 C# 直接调用 OpenCV,跨平台做图像处理与识别

Emgu CV 是 OpenCV 图像处理库的跨平台 .NET 封装,让 C#、VB.NET、F# 等 .NET 开发者无需编写 C++···

★ 2300 评分 2017-01-04
anyline-ocr-react-native-module 开源

React Native 一套代码,接入 Anyline 移动端 OCR 扫描

anyline-ocr-react-native-module 是 Anyline 公司为 React Native 提供的 OCR 原生桥接模块,让 i···

★ 111 评分 2016-12-05
vision 开源

一站式搞定视觉数据与模型,让 CV 开发像写文本一样简单

vision 是 Hugging Face 团队开发的计算机视觉工具库,专注于提供图像、视频数据集、变换(transfo···

★ 17928 评分 2016-11-09
unrealcv 开源

在虚幻引擎里一键生成带标注的视觉数据,省去真实采集成本

UnrealCV 是一个将计算机视觉与虚幻引擎(UE4/UE5)连接起来的开源工具,旨在为视觉研究提供高保真···

★ 2217 评分 2016-09-08
tesseract 开源

在 R 里一行代码把图片文字变成数据框

tesseract 是一个为 R 语言提供 Tesseract OCR 引擎绑定的开源包,让 R 用户无需离开统计与数据分析···

★ 251 评分 2016-03-02
rabbit-ear 开源

用代码设计折纸,自动计算折叠过程,输出矢量图。

rabbit-ear 是一个用 JavaScript 编写的计算折纸库,专注于折纸设计与几何算法。它解决了传统折纸设···

★ 649 评分 2016-01-02
deepdetect 开源

一键部署深度学习模型,提供高性能推理服务

deepdetect 是一个开源的深度学习服务器和命令行工具,最初由 Jolibrain 开发,旨在简化深度学习模···

★ 2551 评分 2015-05-22
kraken 开源

多语言古籍手写文本,一键转成可编辑文字

Kraken 是一个面向多语言与历史文献的开源 OCR 引擎,由 Python 编写,核心目标是解决传统 OCR 在非···

★ 1073 评分 2015-05-19
Meshroom 开源

拖拽节点,从照片自动生成三维模型

Meshroom 是一款基于节点的开源三维重建软件,由 AliceVision 项目提供支持。它通过可视化节点图(···

★ 12981 评分 2015-04-22
AliceVision 开源

多张照片一键生成带纹理三维模型

AliceVision 是一套开源的 3D 计算机视觉框架,用 C++ 编写,核心目标是从多视角照片自动重建三维场···

★ 3503 评分 2014-12-30