nvidia
本站收录 47 个带「nvidia」标签的 AI 开源项目
NemoClawNemoClaw 是一个基于 NVIDIA OpenShell 的安全智能体运行框架,旨在让 Hermes、LangChain Deep Agents 和 Op★ 22,590
openwhispropenwhispr 是一款开源的语音转文字听写应用,主打隐私优先和跨平台支持。它解决了用户在使用语音输入时对云端数据隐私的担忧,允许用户通过自带密钥(BYOK★ 8,837
GuardrailsNeMo Guardrails 是 NVIDIA 开源的 LLM 对话系统安全护栏工具包,旨在为基于大语言模型的对话应用添加可编程的、可组合的安全约束。它解决的★ 7,219
ODSODS 是一个开源的本地 AI 服务器解决方案,旨在将个人电脑(PC、Mac 或 Linux)转变为功能全面的 AI 中心。它解决了用户对数据隐私、离线可用性和★ 6,900
flashinferFlashInfer 是一个面向大语言模型推理服务的高性能 GPU 内核库,用 CUDA 和 PyTorch 实现,专注解决 LLM 部署中注意力计算、MoE ★ 6,516
FluidAudioFluidAudio 是一个面向 iOS/macOS 开发者的 Swift 框架,旨在将前沿的 CoreML 音频模型无缝集成到原生应用中。它解决了开发者难以在★ 2,927
CV-CUDACV-CUDA 是字节跳动与英伟达联合开源、面向云规模图像处理与计算机视觉的 GPU 加速库。它针对传统 OpenCV 在 CPU 上处理高并发视频流时吞吐不足★ 2,727
DataDesignerDataDesigner 是 NVIDIA 开源的合成数据生成工具,基于 NeMo 框架构建。它解决的是高质量训练数据获取难、成本高的问题,允许用户从零开始或基★ 2,293
dstackdstack 是一个厂商中立的编排平台,专为 AI 训练、推理和智能体工作负载设计。它解决了 AI 团队在混合基础设施(云、Kubernetes、裸金属)上运行★ 2,264
NemotronNemotron 是 NVIDIA 官方的开发者资源中心,旨在为使用 Nemotron 模型进行训练和微调的开发者提供一站式支持。它解决了模型训练过程中配方分散★ 2,115
alpamayoalpamayo 是 NVIDIA 开源的 10B 参数推理型 VLA(视觉-语言-动作)模型,专为自动驾驶设计。它把驾驶轨迹预测与 Chain-of-Caus★ 2,030
InferenceXInferenceX 是一个开源的持续推理基准研究平台,专注在大规模 LLM 推理场景下做可复现、可持续的性能评测。它把当下主流大模型(如 Kimi、MiniM★ 1,792
gpu-hotgpu-hot 是一个基于 JavaScript 开发的实时 NVIDIA GPU 监控仪表盘,以网页形式直观展示 GPU 的实时状态。它解决的是开发者和运维人★ 1,634
nvidia_gpu_exporternvidia_gpu_exporter 是一个用 Go 编写的 Prometheus 导出器,通过调用 nvidia-smi 二进制文件采集 NVIDIA GP★ 1,561
ucclUCCL 是一个面向 GPU 的高效通信库,专注于解决大规模 AI 训练和推理中的数据传输瓶颈。它覆盖了集合通信(如 AllReduce、AllGather)、★ 1,533
alpasimAlpaSim 是一个面向端到端自动驾驶策略研发与测试的开源仿真平台。它要解决的核心问题是:端到端自动驾驶模型(从传感器输入直接输出控制指令)在真实道路上训练和★ 1,248
TurboOCRTurboOCR 是一个基于 C++ 实现的高性能 OCR 服务,专为追求极致吞吐量的场景设计。它集成了百度飞桨的 PP-OCRv6 模型,并利用 Tensor★ 1,098
SavantSavant 是一个基于 Python 的计算机视觉与视频分析框架,构建在 NVIDIA DeepStream 和 CUDA 之上,目标是让开发者用声明式 YA★ 858
SOMA-XSOMA-X是一个统一参数化人体模型的Python开源库,旨在解决现有3D人体模型(如SMPL、SMPL-X、MANO等)格式不统一、难以互操作的问题。它提供了★ 797
app.enfugue.aiENFUGUE 是一个开源的 Web 应用,用于通过生成式 AI 制作工作室级别的图像和视频。它主要面向设计师、艺术家和内容创作者,解决了本地部署生成式 AI ★ 758
llm-algo-leetcodellm-algo-leetcode 是一个面向大模型算法与系统方向的开源实战教程,以 Jupyter Notebook 为主要载体,把大模型入门到进阶所需的核心★ 619
aikitaikit 是一个面向开源大语言模型的轻量级工具链,旨在简化 LLM 的微调、构建和部署流程。它解决了开发者在使用开源模型(如 Llama、Gemma 等)时面★ 539
plotoptixplotoptix 是一个基于 NVIDIA OptiX 9.1 框架的 Python 数据可视化和光线追踪库。它旨在将高性能的光线追踪渲染能力引入 Pytho★ 518
light-ocrlight-ocr 是一个面向 Node.js 和 C++ 的快速离线 OCR 库,基于 PP-OCRv6 模型,解决在本地环境中进行文字识别时依赖云端 API★ 508
CUDA-L2CUDA-L2 是一个通过强化学习自动生成高性能矩阵乘法内核的开源项目,目标是在 NVIDIA GPU 上超越 cuBLAS 的性能。它解决了传统手写 CUDA★ 481
tautau 是一个用 TypeScript 编写的自适应 AI 智能体项目,定位为“为你工作服务的 AI 代理”。它面向开发者与日常办公场景,试图把大模型能力封装成★ 353
nim-anywherenim-anywhere 是一个面向生成式 AI 开发者的开源工具集,旨在通过 NVIDIA NIM 和 NVIDIA AI Workbench 加速 AI 应★ 279
VLM-AutoYOLOVLM-AutoYOLO 是一个面向目标检测的端到端自动标注与 YOLO 训练平台。它想解决的问题是:做目标检测时,人工画框标注图片和视频极其耗时,且标注完还要★ 253
onnx-webonnx-web 是一个基于 Web 的图形界面,用于运行 GPU 加速的 ONNX 推理管线,特别针对 Stable Diffusion 等图像生成模型。它解★ 233
GenAI4ADGenAI4AD 是一个系统梳理生成式人工智能(GenAI)在自动驾驶全栈中应用的开源项目。它并非一个可直接运行的模型,而是一份深度综述与知识图谱,覆盖从感知、★ 233
LLMKubeLLMKube 是一个 Kubernetes Operator,用于在异构 GPU 集群上自托管大模型推理。它解决的核心问题是:家里或公司机房里混着 NVIDI★ 220
AI-BlueprintsAI-Blueprints 是一个由惠普(HP)发起的开源项目,旨在提供一系列端到端可运行的 AI 蓝图示例。每个蓝图都基于 Jupyter Notebook ★ 216
homelab-monitorhomelab-monitor 是一个即插即用的家庭实验室(homelab)仪表盘,以单个容器形式部署,集中展示 GPU 使用率、本地 AI 显存占用、Dock★ 207
isaac_ros_object_detectionisaac_ros_object_detection 是 NVIDIA 为 ROS 2 生态提供的图像空间目标检测加速包,属于 Isaac ROS 系列。它把深★ 204
qwenimage-ncnn-vulkan这是一个把通义千问图像模型 Qwen-Image-2.1 移植到 ncnn 推理框架的开源项目,用 C++ 编写并基于 Vulkan 做 GPU 加速。它解决的★ 197
alpamayo-recipesalpamayo-recipes 是 NVIDIA Alpamayo 的开发者中心,面向自动驾驶与物理 AI 场景,提供一整套可直接运行的模型配方。它解决的核心★ 193
locate-anythinglocate-anything 是一个为 NVIDIA LocateAnything-3B 模型打造的轻量级 Web 界面,通过一条 docker compos★ 161
llm-metahumanllm-metahuman 是一个开源解决方案,旨在构建由 AI 驱动的照片级逼真数字人。它解决了传统数字人开发中需要整合多种复杂技术(如大语言模型、语音合成、★ 146
keda-gpu-scalerkeda-gpu-scaler 是一个基于 KEDA 外部 gRPC 扩展器的 GPU 自动扩缩容组件。它通过 DaemonSet 方式在每个节点上运行,直接利★ 131
tacotron2Tacotron2 是一个基于 Tacotron 2 和 Waveglow 的多说话人、情感语音合成(TTS)开源项目。它解决了传统语音合成中音色单一、缺乏情感★ 128
StableDiffusionUIStableDiffusionUI 是一个基于 Python 和 C# 构建的 Windows 桌面应用,旨在为 Stable Diffusion 模型提供简洁★ 127
isaac_ros_image_segmentationisaac_ros_image_segmentation 是 NVIDIA 推出的 ROS2 语义分割加速包,基于 TensorRT 和 GPU 推理,为 Je★ 127
UGTLiveUGTLive 是一款面向游戏玩家、漫画读者和语言学习者的实时屏幕翻译工具。它通过 GPU 加速的 OCR 识别屏幕上任意区域的外文文本,再调用 LLM(支持 ★ 117
Stable-Diffusion-WSL2-Docker这是一个为Windows用户提供的一键安装脚本,旨在通过WSL2和Docker简化Stable Diffusion的部署流程。它解决了在Windows原生环境下★ 113
llm-scratch-pytorch这是一个从零开始用PyTorch实现大语言模型(LLM)的教学型项目,面向初学者,通过逐步构建GPT-2风格的模型来理解LLM的核心原理。项目解决了“只懂调用A★ 101
Omniverse-Virtual-Assisstant这是一个基于NVIDIA Omniverse平台的虚拟助手项目,核心功能是结合Audio2Face面部动画技术与Riva SDK的语音能力,打造一个能听会说的3★ 73
gpu-telemetrygpu-telemetry 是一个面向 GPU 可观测性的开源项目,核心解决 GPU 资源在 Kubernetes 或 Slurm 集群中“被谁使用”的问题。它★ 70