techniques
开源
用深度学习搞定卫星图,从数据到模型一站通
这是一个专注于卫星与航空影像深度学习技术的开源项目,汇集了针对地球观测数据的卷积神经网络、数···
汇聚全球AI计算机视觉项目,OCR识别、目标检测、图像分割、人脸识别工具大全。
共收录 447 个开源项目
techniques
开源
用深度学习搞定卫星图,从数据到模型一站通
这是一个专注于卫星与航空影像深度学习技术的开源项目,汇集了针对地球观测数据的卷积神经网络、数···
neuriplo-infer
开源
一个 C++ 程序跑通检测分割分类光流多任务
neuriplo-infer 是一个用 C++ 编写的计算机视觉推理应用,目标是把多种视觉任务的推理流程统一到一···
CHINESE-OCR
开源
经典 CTPN+CRNN 方案,快速跑通中文场景文字识别
CHINESE-OCR 是一个面向中文自然场景文字的端到端检测与识别开源项目,采用 CTPN 做文本检测、CRNN···
ExprGAN
开源
连续控制表情强度,精准编辑人脸表情
ExprGAN 是一个基于 TensorFlow 实现的面部表情编辑开源项目,核心创新在于可控的表情强度编辑。它···
core
开源
把零散 OCR 工具串成标准化流水线,古籍数字化更省心
OCR-D 的 core 是面向历史文献与古籍数字化场景的 Python 工具集与封装库,属于 OCR-D 生态的核心组···
rio-tiler
开源
把遥感大图切成地图瓦片,按需读取不浪费流量
rio-tiler 是一个基于 Rasterio 的 Python 插件,专门用于从栅格数据集中读取和生成地图瓦片。它解···
pyod
开源
一站式异常检测库,60+算法开箱即用,自动选最优模型
PyOD是一个专注于异常检测的Python库,覆盖表格、时间序列、图、文本、图像和音频等多种数据类型,···
event-based_vision_resources
开源
事件相机资料一站集齐,快速入门不迷路
这是一个面向事件相机(Event-based Vision)领域的开源资源合集,由社区协作维护,把散落在各处的···
mSRGAN-A-GAN-for-single-image-super-···
开源
用GAN把模糊显微图变清晰,助力药物筛选分析
mSRGAN 是一个面向高内涵筛选(HCS)显微图像的单图像超分辨率生成对抗网络(GAN)项目。它解决的是···
webcam-pix2pix-tensorflow
开源
让摄像头画面实时变身,玩转 pix2pix 风格转换
webcam-pix2pix-tensorflow 是一个基于 TensorFlow 的实时图像转换项目,它利用 pix2pix 生成对抗网···
Synthesize3DviaDepthOrSil
开源
从多视图深度图或轮廓,一键生成3D形状
这是一个2017年CVPR论文的开源实现,用于通过多视图深度图或轮廓图来生成和重建3D形状。项目核心是···
photonix
开源
自建私有云相册,用AI自动分类,秒搜你的照片
Photonix 是一个基于 Web 的现代化照片管理服务器,可部署在家用服务器上,让你在任何设备上快速找···
Doxa
开源
一键对比十多种图像二值化算法,选型调参不再愁
Doxa 是一个用 C++ 编写的图像二值化框架,专注于局部自适应阈值处理,支持 Otsu、Bernsen、Niblac···
cvkit
开源
轻量 C++ 工具,快速查看图像与 3D 模型
cvkit 是一个面向计算机视觉研究与开发的 C++ 工具集,主要解决图像与三维模型的可视化和分析需求。···
emgucv
开源
用 C# 直接调用 OpenCV,跨平台做图像处理与识别
Emgu CV 是 OpenCV 图像处理库的跨平台 .NET 封装,让 C#、VB.NET、F# 等 .NET 开发者无需编写 C++···
anyline-ocr-react-native-module
开源
React Native 一套代码,接入 Anyline 移动端 OCR 扫描
anyline-ocr-react-native-module 是 Anyline 公司为 React Native 提供的 OCR 原生桥接模块,让 i···
vision
开源
一站式搞定视觉数据与模型,让 CV 开发像写文本一样简单
vision 是 Hugging Face 团队开发的计算机视觉工具库,专注于提供图像、视频数据集、变换(transfo···
unrealcv
开源
在虚幻引擎里一键生成带标注的视觉数据,省去真实采集成本
UnrealCV 是一个将计算机视觉与虚幻引擎(UE4/UE5)连接起来的开源工具,旨在为视觉研究提供高保真···
tesseract
开源
在 R 里一行代码把图片文字变成数据框
tesseract 是一个为 R 语言提供 Tesseract OCR 引擎绑定的开源包,让 R 用户无需离开统计与数据分析···
rabbit-ear
开源
用代码设计折纸,自动计算折叠过程,输出矢量图。
rabbit-ear 是一个用 JavaScript 编写的计算折纸库,专注于折纸设计与几何算法。它解决了传统折纸设···
deepdetect
开源
一键部署深度学习模型,提供高性能推理服务
deepdetect 是一个开源的深度学习服务器和命令行工具,最初由 Jolibrain 开发,旨在简化深度学习模···
kraken
开源
多语言古籍手写文本,一键转成可编辑文字
Kraken 是一个面向多语言与历史文献的开源 OCR 引擎,由 Python 编写,核心目标是解决传统 OCR 在非···
Meshroom
开源
拖拽节点,从照片自动生成三维模型
Meshroom 是一款基于节点的开源三维重建软件,由 AliceVision 项目提供支持。它通过可视化节点图(···
AliceVision
开源
多张照片一键生成带纹理三维模型
AliceVision 是一套开源的 3D 计算机视觉框架,用 C++ 编写,核心目标是从多视角照片自动重建三维场···