imagenet

本站收录 13 个带「imagenet」标签的 AI 开源项目

pytorch-image-modelspytorch-image-models(常被称为 timm)是 PyTorch 生态中规模最大的图像编码器与骨干网络集合,由 Hugging Face 维护。★ 37,182cvatCVAT(Computer Vision Annotation Tool)是一个开源的计算机视觉标注平台,旨在帮助AI团队高效构建高质量视觉数据集。它解决了从原★ 16,821segmentation_models.pytorchsegmentation_models.pytorch 是一个基于 PyTorch 的语义分割模型库,提供 500+ 预训练骨干网络(涵盖卷积和 Transfo★ 11,749TensorLayerTensorLayer 是一个面向科学家和工程师的深度学习与强化学习库,基于 Python 构建。它旨在解决深度学习研究和工程应用中模型搭建复杂、调试困难、部署★ 7,382ml-cvnetsCVNets 是苹果开源的计算机视觉训练库,基于 PyTorch 构建,目标是把分类、检测、分割等任务的训练流程统一到一套可复用的框架里。它解决的核心问题是:视★ 1,991torchdistilltorchdistill 是一个基于 PyTorch 的免编码深度学习框架,专注于知识蒸馏(Knowledge Distillation)研究。它解决了知识蒸馏★ 1,633datumarodatumaro 是一个面向计算机视觉的数据集管理框架,提供 Python 库和命令行工具,用于构建、分析和维护 CV 数据集。它解决的核心问题是深度学习项目中★ 692keras_cv_attention_modelskeras_cv_attention_models 是一个基于 TensorFlow/Keras 的计算机视觉模型库,汇集了众多主流和前沿的视觉骨干网络,如 B★ 626RSPRSP是《An Empirical Study of Remote Sensing Pretraining》论文的官方代码库,专注于遥感图像预训练模型的实证研究★ 159MHLAMHLA 是一个面向图像生成与语言建模的线性注意力机制改进项目,旨在解决线性注意力在表达力上的不足。传统线性注意力通过核函数近似 softmax 注意力,虽降低★ 157ml-autofocusformerml-autofocusformer 是 CVPR 2023 论文《AutoFocusFormer: Image Segmentation off the Gr★ 126lpdlpd 是一个面向自回归图像生成的高效并行解码算法,由 ICLR 2026 Oral 论文提出。它针对自回归图像生成中逐 token 串行解码速度慢的问题,利用★ 105MergeVQMergeVQ是一个面向视觉生成与表征学习的统一框架,核心思路是将token合并(Token Merging)与向量量化(Quantization)结合,在Im★ 51