deeplearning

本站收录 37 个带「deeplearning」标签的 AI 开源项目

VoxCPMVoxCPM2 是一款无分词器的多语言语音生成模型,支持多语种语音合成、创意音色设计与高保真声音克隆。无需传统分词器即可直接生成语音,带来更自然、更真实的合成效★ 38,137learnopencvLearn OpenCV 是一个专注于 OpenCV 与计算机视觉教学的开源项目,由 Satya Mallick 等人维护,提供大量 C++ 和 Python ★ 23,171SpeechSpeech 是一个面向研究人员和开发者的可扩展生成式 AI 框架,专注于大型语言模型、多模态和语音 AI(自动语音识别与文本转语音)。它提供统一的模块化架构,★ 18,524LangGPTLangGPT 是一个致力于让每个人都能成为提示词专家的开源框架,由云中江树创建,是结构化提示词(Structured Prompt)的提出者和元提示词(Met★ 12,567ludwigLudwig 是一个基于 Python 的低代码机器学习框架,旨在让开发者无需编写大量底层代码即可构建、训练和部署定制化的大语言模型、神经网络及其他 AI 模型★ 11,771awesome-chatgpt-zh这是一个面向中文用户的 ChatGPT 实用指南和精选资源清单,旨在帮助用户更高效地使用 ChatGPT 及相关 AI 工具。项目解决了中文用户在使用 Chat★ 11,723introtodeeplearningMIT 6.S191《深度学习导论》课程的官方实验材料,包含一系列Jupyter Notebook教程,覆盖深度学习基础、计算机视觉、自然语言处理、生成模型等核★ 8,822optimateoptimate 是一个专注于优化 AI 模型性能的 Python 库集合,旨在帮助开发者和研究人员在不改变模型结构的前提下,通过量化、剪枝、蒸馏等压缩技术,显★ 8,328clearmlClearML 是一个开源的 MLOps/LLMOps 平台,旨在统一管理机器学习项目的全生命周期。它解决了 AI 开发中实验跟踪、数据管理、流水线编排、模型部★ 6,895contrastive-unpaired-translationCUT(Contrastive Unpaired Translation)是一个基于对比学习的无配对图像到图像翻译框架,由Taesung Park等人于ECCV★ 2,556BitNetBitNet 是微软论文《BitNet: Scaling 1-bit Transformers for Large Language Models》的 PyTo★ 1,946mlreefmlreef 是一个面向机器学习团队的协作工作区,旨在解决 ML 项目中代码、数据和实验管理分散、协作效率低的问题。它提供统一的项目空间,集成代码仓库、数据版本★ 1,460Awesome-TimeSeries-SpatioTemporal-LM-LLM这是一个精选列表,收录了用于时间序列、时空数据和事件数据的大语言模型(LLM)与基础模型(FM)的相关论文、代码和资源。它解决了该领域研究资料分散、难以追踪的问★ 1,233Omega-AIOmega-AI 是一个基于 Java 的深度学习框架,目标是让 Java 开发者无需切换到 Python 生态,就能直接构建、训练和推理神经网络。它内置自动微★ 855Deep-learning-in-cloud这是一个整理深度学习云服务提供商的精选列表,旨在帮助开发者和企业快速找到适合的云端AI训练与推理平台。项目以清单形式汇总了各大主流云厂商(如AWS、Google★ 828onepanelOnePanel 是一个开源的端到端计算机视觉平台,旨在统一标签标注、模型构建、训练、调优、部署和自动化流程。它解决了计算机视觉项目从数据标注到模型上线的全生命★ 733awesome-segmentation-saliency-dataset这是一个整理图像分割与显著性检测数据集的精选列表,旨在为相关领域的研究者和开发者提供一站式的数据集索引。项目收集了包括语义分割、实例分割、全景分割以及显著性目标★ 644CycleGAN-VC2CycleGAN-VC2 是一个基于 CycleGAN 的语音转换(Voice Conversion)开源项目,旨在实现无需平行语料的音色转换。它解决了传统语音★ 572AlbumentationsXAlbumentationsX 是经典图像增强库 Albumentations 的延续版本,面向计算机视觉训练场景,提供高性能、多样化的数据增强能力。它解决的核★ 563kochatkochat 是一个开源的韩语聊天机器人框架,基于 Python 构建,专注于韩语自然语言处理任务。它解决了韩语对话系统中缺乏专用工具的问题,提供了从语料抓取、★ 461OlympusOlympus 是一个面向计算机视觉任务的通用任务路由器,由 CVPR 2025 Highlight 论文官方开源。它旨在解决多模态大模型(如 LLaVA)在处★ 427mega-data-factorymega-data-factory 是一个面向大规模基础模型训练的多模态数据流水线框架,专注于解决数据质量与数据规模之间的平衡问题。它提供了一套从数据采集、清洗★ 379peacassoPeacasso 是一个用于实验多模态(文本、图像)模型的可视化界面,主要面向 Stable Diffusion 等图像生成模型。它解决了开发者在使用 Stab★ 365clearml-agentClearML Agent 是 ClearML 平台的核心调度与编排组件,负责执行远程任务、管理队列并调度 GPU 等计算资源。它解决了 MLOps/LLMOp★ 313Paper-Rebuttal-TipsPaper-Rebuttal-Tips 是 MLNLP 社区维护的论文 rebuttal 经验整理仓库,旨在帮助科研人员在论文评审后撰写有效的 rebuttal★ 311fastapi-templatefastapi-template 是一个基于 FastAPI 的完全可扩展的项目模板,专为机器学习、深度学习及其他软件项目设计。它解决了从零搭建 FastAPI★ 229so-vits-models这是一个收集AI模型与应用的资源汇总项目,聚焦于声音、图像、视频和文本生成领域。它整理了so-vits-svc(歌声转换)、TTS(文本转语音)、Stable ★ 210ai-learning-kitai-learning-kit 是一个精选的 AI 学习资料合集,旨在为开发者、学生和研究者提供系统化的 AI 学习路径。它解决了 AI 领域信息过载、学习资源★ 197ML-news-of-the-week这是一个每周更新的机器学习与人工智能新闻精选集,旨在帮助从业者和爱好者高效获取领域内的重要动态。项目将分散在网络各处的优质内容(包括最新研究论文、行业新闻、实用★ 183fake-news这是一个从零构建假新闻检测器的开源项目,覆盖从想法到模型部署的完整流程。项目以Jupyter Notebook为主要载体,逐步演示如何收集数据、清洗文本、特征工★ 171icfaceICface 是一个基于 GAN 的人脸重演(Face Reenactment)开源项目,旨在实现可解释且可控的人脸动画生成。它通过解耦人脸的身份特征与动作单元★ 164ChatbotChatbot 是一个基于 Python3 和深度学习技术的多用途聊天机器人项目。它通过人工神经网络和深度神经网络模型,旨在为开发者提供一个可训练、可扩展的对话★ 131kamonohashiKAMONOHASHI 是一个面向 AI 开发的基础设施平台,旨在为机器学习团队提供从数据管理、模型训练到部署的全流程支持。它解决了 AI 开发中环境配置复杂、★ 86GenDataAttributionGenDataAttribution 是一个面向文本到图像模型的视觉数据归因基准测试工具,旨在评估和量化训练图像对生成结果的影响。它解决了生成模型可解释性不足的★ 80aiml-companionAI-ML Companion 是一个交互式学习平台,旨在通过可视化方式帮助用户理解人工智能和机器学习。它包含22个学习轨道和300多个模块,提供实时可视化演示★ 70polyaxon-examplespolyaxon-examples 是 Polyaxon 平台的官方示例代码库,提供了一系列教程和示例,帮助用户快速上手 Polyaxon。Polyaxon 是★ 67aio2024-mlops这是一个面向初学者的MLOps实践入门项目,基于Jupyter Notebook编写,旨在通过动手实验帮助用户快速上手机器学习运维中的核心工具链。项目覆盖了从模★ 61