cpp

本站收录 33 个带「cpp」标签的 AI 开源项目

sherpa-onnxsherpa-onnx 是一个基于下一代 Kaldi 和 ONNX Runtime 的语音处理工具包,专注于离线场景下的语音识别(ASR)、文本转语音(TTS)★ 15,039supertonicsupertonic 是一个极速的端侧多语言文本转语音(TTS)引擎,基于 ONNX Runtime 原生运行,支持 iOS、Flutter、Node.js、P★ 13,789supertonicsupertonic 是一个超快速、完全离线的多语言文本转语音(TTS)引擎,基于 ONNX Runtime 原生运行,无需云端依赖。它解决了传统 TTS 服务★ 13,789rerunrerun 是一个用于多模态机器人数据可视化和流式处理的开源工具,采用 Rust 编写,提供 Python 和 C++ 接口。它解决机器人开发中传感器数据(如摄★ 11,515pclPCL(Point Cloud Library)是一个大型开源的C++点云处理库,专门用于2D/3D图像和点云数据的处理。它解决了机器人、自动驾驶、三维建模等领★ 11,135runanywhere-sdksrunanywhere-sdks 是一个面向生产环境的 C++ 工具包,旨在让 AI 模型在本地设备上高效运行。它解决了云端推理带来的延迟、隐私和成本问题,提供★ 10,318wav2letterwav2letter 是 Facebook AI Research 开源的端到端自动语音识别工具包,基于 C++ 实现,专注于高效、高性能的 ASR 研究与应用★ 6,437CTranslate2CTranslate2 是一个专为 Transformer 类模型设计的高性能推理引擎,用 C++ 编写,支持 CPU(含 AVX、AVX2、NEON 等指令集★ 4,690particle-lifeparticle-life 是一个用 HTML/JavaScript 实现的粒子生命模拟器,通过定义粒子之间的吸引/排斥力规则,在二维平面上模拟出类似生命体的自★ 3,354ComputeLibraryComputeLibrary 是 Arm 官方开源的高性能计算库,用 C++ 编写,面向计算机视觉与机器学习场景,针对 Arm CPU 和 GPU 做了深度优化★ 3,194audio.cppaudio.cpp 是一个基于 ggml 的纯 C++ 音频模型推理引擎,旨在为音频 AI 应用提供一体化、高性能的本地推理解决方案。它解决了传统音频 AI 工★ 3,180CV-CUDACV-CUDA 是字节跳动与英伟达联合开源、面向云规模图像处理与计算机视觉的 GPU 加速库。它针对传统 OpenCV 在 CPU 上处理高并发视频流时吞吐不足★ 2,727symforceSymForce 是面向机器人、自动驾驶与 SLAM 场景的开源符号计算与非线性优化框架。它把符号表达式自动生成高效的 C++ 与 Python 代码,让开发者★ 1,646tiny-vllmtiny-vllm 是一个用 C++ 与 CUDA 从零实现的高性能 LLM 推理引擎教学项目,定位为 vLLM 的精简版。它解决的核心问题是:主流推理框架(如★ 1,135Stable-Diffusion-NCNNStable-Diffusion-NCNN 是一个基于 C++ 和 NCNN 推理框架的 Stable Diffusion 轻量级实现,支持在移动端(如 And★ 1,069sherpasherpa 是一个基于下一代 Kaldi 的语音识别服务端框架,用 C++ 实现,提供端到端的语音转文字能力。它解决了传统语音识别系统部署复杂、实时性差的问题★ 997axodox-machinelearning这是一个纯 C++ 实现的 ONNX 离线 AI 模型库,专注于图像生成与相关视觉任务。它无需 Python 或 PyTorch 运行时,直接通过 Direct★ 634agenttyagentty 是一个运行在终端里的 AI 结对编程工具,采用 C++ 编写并编译为单一静态二进制文件,启动时间低于毫秒级,支持接入任意模型(如 Anthrop★ 615BigMoeOnEdgeBigMoeOnEdge 是一个让 MoE(混合专家)大模型跑在内存不足设备上的推理方案,核心思路是流式加载专家权重:模型的总参数量可以远超设备 RAM,但每次★ 595neverclickneverclick 是一个用本地计算机视觉驱动的键盘鼠标控制工具,目标是让用户尽量不碰鼠标也能操作桌面。它通过屏幕截图和视觉识别定位界面上的可点击元素(如按钮★ 472audio.cpp-webuiaudio.cpp-webui 是一个基于 ggml 的纯 C++ 音频模型推理引擎,为 audio.cpp 提供全任务 WebUI。它支持语音合成(TTS)、★ 369unpaintunpaint 是一款面向 Windows 和 Xbox 平台的本地 AI 图像生成应用,基于 Stable Diffusion 模型,利用 DirectML ★ 285tiny-dreamTiny Dream 是一个嵌入式、仅头文件的 Stable Diffusion C++ 实现,旨在将强大的文生图模型压缩到资源受限的设备上运行。它解决了传统 ★ 269mod_audio_streammod_audio_stream 是一个 FreeSWITCH 模块,用于把通话中的实时音频通过 WebSocket 双向流式传输出去,并接收远端返回的音频或控★ 241ocr这是一个基于 PaddleOCR 模型与 ONNX Runtime 构建的高精度文字检测 OCR 库,支持 JavaScript/TypeScript 在 No★ 209nekodrawNekoDraw 是一款专为 CLIP STUDIO PAINT(CSP)设计的插件,旨在将 Stable Diffusion 的文本生成图像(txt2img)★ 157TinyGPTTinyGPT 是一个从零开始用 C++ 实现的轻量级大语言模型推理引擎,旨在提供极简、无依赖的 LLM 推理方案。它解决了在资源受限环境(如边缘设备、嵌入式系★ 129langchain-coderlangchain-coder 是一个基于 Web 的代码生成与调试工具,用户输入自然语言需求后,它调用 GPT、Gemini、PALM 等多种大语言模型生成代★ 124CustomCharCustomChar 是一个基于 C++ 的轻量级 AI 助手框架,旨在让开发者将定制化的语音助手部署到任意硬件上,包括嵌入式设备和低功耗平台。它整合了 lla★ 121docwireDocWire SDK 是一个基于 C++20 的本地优先文档数据处理框架,主打确定性、可审计、可私有化部署的工作流。它解决的是企业或开发者在处理大量异构文档时★ 113MIDI-GPTMIDI-GPT 是一个基于 GPT-2 架构的符号音乐生成模型,专注于可控的多轨音乐创作。它解决的核心问题是传统音乐生成模型难以对旋律、和弦、节奏等多轨元素进★ 102sd.cpp.gui.wxsd.cpp.gui.wx 是一个基于 C++ 和 wxWidgets 构建的 Stable Diffusion 图形界面工具,旨在为 Stable Diffu★ 99lotei-qflipperlotei-qflipper 是一个基于 qFlipper 的粉色主题分支,集成了 LOTEI——一个完全本地运行的 AI 海豚助手(基于 Ollama)。它解★ 64