onnx

本站收录 68 个带「onnx」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

yolov5YOLOv5 是 Ultralytics 团队开发的基于 PyTorch 的目标检测框架,是目前计算机视觉领域最流行的开源项目之一。它解决了实时目标检测、实例分★ 58,097sherpa-onnxsherpa-onnx 是一个基于下一代 Kaldi 和 ONNX Runtime 的语音处理工具包,专注于离线场景下的语音识别(ASR)、文本转语音(TTS)★ 15,039llmwarellmware 是一个面向企业级 RAG(检索增强生成)场景的统一框架,专注于使用小型、专用模型构建高效、可控的 AI 应用。它解决了企业在落地大模型时面临的成★ 14,828supertonicsupertonic 是一个极速的端侧多语言文本转语音(TTS)引擎,基于 ONNX Runtime 原生运行,支持 iOS、Flutter、Node.js、P★ 13,789supertonicsupertonic 是一个超快速、完全离线的多语言文本转语音(TTS)引擎,基于 ONNX Runtime 原生运行,无需云端依赖。它解决了传统 TTS 服务★ 13,789langchain4jLangChain4j 是一个面向 JVM 生态的 Java 开源库,旨在为构建 LLM 驱动的应用提供地道、简洁的开发体验。它解决了 Java 开发者难以像 ★ 13,176yolov3这是一个基于PyTorch实现的YOLOv3目标检测项目,支持YOLOv3、YOLOv3-SPP和YOLOv3-tiny三种模型。它解决了从模型训练到部署的全流★ 10,612RTranslatorRTranslator 是一款开源的 Android 实时翻译应用,完全在本地运行,无需联网,保护用户隐私。它利用 Meta 的 NLLB 模型和 ONNX R★ 10,469PyTorch-Tutorial-2nd《PyTorch实用教程》(第二版)是一份面向深度学习工程师的开源教程,以Jupyter Notebook形式呈现。它系统覆盖了从PyTorch基础语法、张量操★ 4,610obs-backgroundremovalobs-backgroundremoval 是一个 OBS Studio 插件,用于在直播或录制视频时实时移除人像背景,方便主播和内容创作者无需绿幕即可替换或虚★ 4,583RuVectorRuVector 是一个用 Rust 构建的高性能实时向量数据库,专为 AI 应用设计,集成了图神经网络(GNN)和记忆数据库能力。它解决了传统向量数据库在实时★ 4,527lite.ai.toolkitlite.ai.toolkit 是一个轻量级的 C++ AI 推理工具包,集成了 100 多个预训练模型,支持 MNN、ONNX Runtime 和 Tenso★ 4,436MOSS-TTS-NanoMOSS-TTS-Nano 是 MOSI.AI 与 OpenMOSS 团队开源的多语言轻量级语音合成模型,参数量仅 0.1B,专为实时语音生成设计。它解决了传统★ 4,428spark-nlpspark-nlp 是一个基于 Apache Spark 和 Spark ML 构建的自然语言处理库,提供生产级、可扩展的 NLP 解决方案。它解决了在大数据环★ 4,158anylabelingAnyLabeling 是一款开源的 AI 辅助数据标注工具,目标是让图像标注从纯手工变成半自动甚至自动。它把 YOLO 系列目标检测模型与 Segment A★ 3,491AudioMuse-AIAudioMuse-AI 是一个开源的智能音乐分析引擎,专注于解决音乐库中“有歌却难找”的痛点。它通过声学分析技术,不依赖任何元数据或外部服务,直接对音频文件进★ 2,672ortort 是一个基于 Rust 的 ONNX 模型推理与训练库,它封装了微软的 ONNX Runtime,为 Rust 开发者提供了高性能的机器学习推理能力。该项★ 2,542inferenceinference 是一个将任何计算机或边缘设备转变为计算机视觉项目指挥中心的开源工具。它解决了视觉模型从开发到生产部署的复杂性问题,提供统一的推理 API,支★ 2,462OnnxStreamOnnxStream 是一个轻量级的 ONNX 推理库,用 C++ 编写,专为资源受限环境设计。它解决了在低内存、低算力设备(如树莓派 Zero 2)上运行大型★ 2,089ai-dev-galleryai-dev-gallery 是一个面向 Windows 开发者的开源示例项目集合,旨在帮助开发者学习如何将本地 AI 模型和云端 API 集成到 Window★ 1,504nncfNNCF(Neural Network Compression Framework)是 Intel 开源的神经网络压缩框架,专为提升 OpenVINO 推理性能★ 1,204Stable-Diffusion-NCNNStable-Diffusion-NCNN 是一个基于 C++ 和 NCNN 推理框架的 Stable Diffusion 轻量级实现,支持在移动端(如 And★ 1,069CodeProject.AI-ServerCodeProject.AI Server 是一个自包含的 AI 服务,开发者可将其嵌入或随应用分发,以快速为软件增添 AI 能力。它解决了传统 AI 集成中环★ 983ai-video-editorai-video-editor 是一个本地优先的浏览器端 AI 视频编辑器,利用 WebGPU 在浏览器中直接运行 AI 模型,无需上传视频到云端,保护隐私。它★ 881libreyoloLibreYOLO 是一个采用 MIT 许可证的开源计算机视觉库,用 Python 编写,目标是为开发者提供自由、可商用的 YOLO 系列目标检测实现。它解决的★ 815APTAPT 是一个开源的 AI 生产力工具,旨在通过本地化部署和隐私保护提升用户效率。它内置了 ChatGPT、DeepSeek、Phi、Qwen 等模型的本地专属★ 770timbertimber 是一个面向经典机器学习模型的高性能推理编译器,定位为“Ollama for classical ML models”。它通过 AOT(Ahead-★ 687DocufinderDocufinder 是一款专为韩文文档设计的离线全文搜索引擎,支持 HWP、PDF 和 Office 格式。它解决了传统文件搜索只能按文件名匹配、无法检索文件★ 655axodox-machinelearning这是一个纯 C++ 实现的 ONNX 离线 AI 模型库,专注于图像生成与相关视觉任务。它无需 Python 或 PyTorch 运行时,直接通过 Direct★ 634x-stable-diffusionx-stable-diffusion 是一个专注于 Stable Diffusion 实时推理加速的开源项目,目标是将延迟降低至 0.88 秒。项目集成了多种主★ 556azure-ai-travel-agents这是一个部署在 Azure Container Apps 上的企业级 AI 旅行代理示例应用,展示了如何利用 MCP(模型上下文协议)和多种 AI 代理框架(L★ 482ModelAssistantModelAssistant 是矽递科技(Seeed Studio)推出的开源嵌入式 AI 工具链,属于 SenseCraft 生态的一部分。它面向边缘设备上的★ 446samexportersamexporter 是一个专注于将 Segment Anything 系列模型导出为 ONNX 格式的工具,支持 SAM、MobileSAM、Efficie★ 429parakeet-rsparakeet-rs 是一个用 Rust 编写的语音识别工具库,基于 NVIDIA Parakeet 系列模型(通过 ONNX 运行),提供极快的语音转文字能★ 404rust-mlops-templaterust-mlops-template 是一个正在开发中的开源项目,旨在使用 Rust 语言构建机器学习运维(MLOps)解决方案的模板。它针对当前 MLOps★ 385onnx-asronnx-asr 是一个轻量级 Python 语音识别包,核心思路是让开发者直接加载 ONNX 格式的 ASR 模型完成语音转文字,而不必依赖 PyTorch、★ 381unpaintunpaint 是一款面向 Windows 和 Xbox 平台的本地 AI 图像生成应用,基于 Stable Diffusion 模型,利用 DirectML ★ 285utekeuteke 是一个面向 AI 智能体的本地优先记忆引擎,用 Rust 编写,提供单一二进制文件,零配置即可运行。它解决 AI 智能体在对话或任务中缺乏长期记忆的★ 268nix-ttsNix-TTS 是一个轻量级、端到端的文本转语音(TTS)开源项目,通过模块级蒸馏技术大幅压缩模型体积,同时保持高质量语音合成。它解决了传统 TTS 模型体积大★ 263bkmrbkmr 是一个面向人类和 AI 代理的本地优先知识管理工具,用 Rust 编写。它解决的是传统书签管理器无法满足的语义检索和智能体集成需求。核心能力包括:通过★ 262StableDiffusionStableDiffusion 是一个用 C# 和 ONNX Runtime 实现 Stable Diffusion 模型推理的开源项目,旨在让 .NET 开发★ 246KokoroSharpKokoroSharp 是一个基于 C# 和 ONNX Runtime 的本地 TTS(文本转语音)推理引擎,专注于为 .NET 开发者提供即插即用的语音合成能★ 245piper-pluspiper-plus 是一个多语言神经语音合成(TTS)引擎,基于 VITS 模型并引入韵律增强,支持日语、英语、中文、西班牙语、法语、葡萄牙语等 6 种语言(★ 217MIVisionXMIVisionX 是 AMD 推出的开源计算机视觉工具包,核心是符合 Khronos OpenVX 1.3.2 规范的高度优化实现。它主要解决在 AMD 硬件★ 217ML-Model-CIMLModelCI 是一个面向机器学习服务的 MLOps 平台,旨在打通模型训练与线上部署之间的断层。它提供模型管理、格式转换、性能剖析和自动部署等一站式能力,★ 198OnnxTROnnxTR 是 docTR 文档文本识别库的 ONNX 推理管线封装,目标是在不依赖深度学习训练框架的前提下提供高性能、易接入的 OCR 能力。它把 docT★ 197BB 是一个用 Python 构建的自主上下文感知 AI 桌面伴侣。它通过实时屏幕视觉、自定义 ONNX 语音合成、活动窗口跟踪和带反应式面部表情的动态浮动 UI★ 189textsnaptextsnap 是一个轻量级 OCR 工具,目标是把任意图片、截图或网页内容一键转成纯文本。它基于 ONNX 和 PaddlePaddle 运行,无需 GPU★ 186AivisSpeech-EngineAivisSpeech-Engine 是一个基于 Python 的 AI 语音合成引擎,专注于日文文本到语音(TTS)转换,并支持声音模仿。它整合了 BERT-★ 181SwiftSemanticSearchSwiftSemanticSearch 是一个面向 Apple 设备的实时本地语义搜索开源项目,基于 Swift 语言开发,结合 USearch 向量搜索引擎和★ 162