huggingface
本站收录 146 个带「huggingface」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
VoiceStudioVoiceStudio 是一个开源的 AI 语音工作站,旨在成为 ElevenLabs 的替代方案。它集成了语音克隆、配音、听写、转录、有声书创作和语音工作流编★ 47,464
agents-courseHugging Face Agents Course 是 Hugging Face 官方推出的智能体(Agent)系统学习课程,旨在帮助开发者从零基础到精通掌握★ 33,024
datasetsdatasets 是 Hugging Face 推出的开源数据集库,旨在成为 AI 模型就绪数据集的中心枢纽。它解决了机器学习从业者在数据获取、处理和加载过程中★ 22,016
langchain4jLangChain4j 是一个面向 JVM 生态的 Java 开源库,旨在为构建 LLM 驱动的应用提供地道、简洁的开发体验。它解决了 Java 开发者难以像 ★ 13,176
speechbrainSpeechBrain 是一个基于 PyTorch 的开源语音工具包,旨在为语音识别、说话人识别、语音增强、语音分离、情感识别等多种语音任务提供统一、灵活且易用★ 11,848
chat-uichat-ui 是 Hugging Face 官方开源的对话助手前端代码库,支撑 HuggingChat 产品运行。它基于 SvelteKit 和 TypeSc★ 10,968
YuEYuE 是开源的全曲目音乐生成基础模型,功能类似 Suno.ai 但完全开放。支持生成带人声的完整歌曲,涵盖歌词、旋律与编曲,为音乐创作者提供可本地部署、可自由★ 10,578
SoupSoup 是一个用于微调大语言模型(LLM)的开源工具,它通过一个 YAML 配置文件即可完成整个微调流程,极大简化了操作。其核心亮点是采用“层流式训练”(La★ 7,822
swarmsswarms 是一个企业级的多智能体编排框架,旨在解决复杂任务中多个 AI 智能体的协同工作问题。它提供了一套完整的工具和抽象,让开发者能够轻松地创建、编排和部★ 7,219
chronos-forecastingChronos是一个基于Transformer架构的预训练时间序列预测模型库,由Amazon Science团队开发。它解决了传统时间序列预测模型需要针对每个数★ 5,926
sahiSAHI 是一个专注于计算机视觉的切片推理框架,旨在解决大尺寸图像(如卫星影像、医学图像)在目标检测和实例分割时因内存限制或小目标密集而导致的性能问题。它支持任★ 5,518
text-embeddings-inferencetext-embeddings-inference 是一个用 Rust 编写的高性能文本嵌入模型推理服务,专为大规模生产环境设计。它解决了传统嵌入模型推理速度慢★ 5,064
stable-diffusion-videos通过探索 Stable Diffusion 的潜在空间并在文本提示词之间平滑变形,让 AI 生成酷炫的动态视频。无需复杂训练管线,仅凭提示词即可驱动出令人惊艳的★ 4,710
LimiXLimiX 是一个专注于结构化数据建模的开源项目,旨在增强通用人工智能(AGI)对表格、数据库等结构化数据的理解与生成能力。它解决了当前大语言模型在处理非文本结★ 4,327
csghubCSGHub 是由 OpenCSG 团队开发的开源大模型管理平台,旨在提供类似 Hugging Face 的功能,但支持私有化部署和 SaaS 两种模式。它帮助★ 4,117
Baichuan2Baichuan2 是百川智能推出的系列大语言模型,包括基座模型和对话模型,覆盖 7B、13B 等参数规模。它旨在提供高质量的中英文双语能力,解决通用对话、内容★ 4,084
cascadeflowCascadeFlow 是一个面向 AI 代理(Agent)的级联运行时,旨在解决代理循环中成本、延迟、质量和策略决策的优化问题。它允许开发者将多个模型或处理步★ 3,999
deep-chatdeep-chat 是一个高度可定制的 AI 聊天机器人前端组件,专为网站集成而设计。它解决了开发者需要快速嵌入对话功能但又不想从零构建的痛点,提供开箱即用的 ★ 3,727
EagleEagle 是一个前沿的视觉-语言模型(VLM)项目,强调以数据为中心的策略来提升模型性能。它解决了当前多模态模型在数据利用效率和训练效果上的瓶颈,通过精心设计★ 3,641
distilabelDistilabel 是一个面向工程师的合成数据与 AI 反馈框架,旨在帮助用户快速构建可靠、可扩展的数据流水线。它基于经过验证的研究论文,将复杂的合成数据生成★ 3,401
second-brain-ai-assistant-course这是一个教你构建“第二大脑”AI助手的开源课程项目,基于Jupyter Notebook编写。它系统性地讲解如何利用大语言模型(LLMs)、智能体(Agents★ 3,099
LLM-FinetuningLLM-Finetuning 是一个专注于大语言模型微调的开源项目,基于 PEFT(Parameter-Efficient Fine-Tuning)库实现。它旨★ 2,986
evadbEvaDB 是一个专为 AI 应用设计的数据库系统,旨在简化 AI 功能的集成。它允许开发者通过类似 SQL 的查询语言,在数据库内部直接调用机器学习模型,处理★ 2,674
griptapegriptape 是一个模块化的 Python 框架,用于构建 AI 智能体和复杂工作流。它解决了开发者在集成多种大语言模型(LLM)时面临的编排难题,提供了链★ 2,580
mPLUG-OwlmPLUG-Owl是阿里巴巴达摩院开发的多模态大语言模型家族,旨在让AI同时理解文本和图像,并基于指令进行对话。它解决了传统语言模型只能处理文本、无法理解视觉信★ 2,539
trainertrainer 是一个基于 Kubernetes 的分布式 AI 模型训练与 LLM 微调平台,由开源社区维护。它解决了在 Kubernetes 上运行大规模训★ 2,234
simple-llm-finetunersimple-llm-finetuner 是一个为 LLM 微调提供简单图形界面的开源工具,旨在降低大模型微调的门槛。它解决了非专业开发者难以直接使用复杂训练脚★ 2,053
obsidian-textgenerator-pluginText Generator 是一款 Obsidian 插件,旨在将 AI 文本生成能力无缝集成到笔记工作流中。它解决了用户在 Obsidian 中需要切换不同★ 1,990
Large-Language-Model-Notebooks-Course这是一个面向开发者的实用大语言模型(LLM)课程,以Jupyter Notebook为载体,通过大量可运行的代码示例,系统讲解LLM的核心概念、主流架构、微调技★ 1,823
DeTikZifyDeTikZify是一个将科学图表和手绘草图自动转换为TikZ代码的开源AI模型。它解决了科研人员在撰写LaTeX文档时,需要手动编写复杂TikZ代码来绘制矢量★ 1,819
dialoqbaseDialoqbase 是一个基于 TypeScript 构建的开源聊天机器人创建平台,旨在让开发者能够轻松构建、部署和管理基于大语言模型的对话应用。它解决了从零★ 1,790
katibKatib 是一个基于 Kubernetes 的自动化机器学习(AutoML)平台,旨在解决在云原生环境中进行超参数调优、神经网络架构搜索(NAS)和早停(Ea★ 1,704
VibeThinkerVibeThinker是一个基于多样性驱动优化的小型语言模型项目,核心目标是在1.5B参数规模下实现接近大型模型的推理能力。它通过创新的训练策略,让小型模型在逻★ 1,579
rocketnotesrocketnotes 是一款 AI 驱动的 Markdown 编辑器,旨在将大语言模型(LLM)能力无缝集成到文档编写流程中。它支持 100% 本地运行或云端★ 1,497
Chatterbox-TTS-ServerChatterbox-TTS-Server 是一个自托管的文本转语音(TTS)服务,基于强大的 Chatterbox 模型。它解决了用户需要灵活、可扩展的语音合★ 1,460
generative_ai_with_langchain这是《Generative AI with LangChain》一书的配套代码仓库,面向希望用Python、LangChain和LangGraph构建生产级LL★ 1,430
mlx-tunemlx-tune 是一个专为 Apple Silicon Mac 设计的 LLM 微调工具,基于 MLX 框架原生运行,让开发者无需云端 GPU 即可在本地完成★ 1,414
aws-genai-llm-chatbot这是一个基于AWS CDK构建的多LLM与多RAG聊天机器人解决方案,旨在帮助企业快速在AWS上部署生产级生成式AI助手。它解决了单一模型或检索方案难以满足多样★ 1,400
gpu_poorgpu_poor 是一个用于估算任意大语言模型(LLM)在本地部署时所需 GPU 显存和推理速度(token/s)的命令行工具。它通过解析模型的参数量、量化方式★ 1,400
modelfusionModelFusion 是一个用于构建 AI 应用的 TypeScript 库,旨在为开发者提供一套统一、类型安全的接口来集成多种大语言模型(LLM)、嵌入模型★ 1,319
sd-webui-inpaint-anythingsd-webui-inpaint-anything 是一个基于 Stable Diffusion WebUI 的扩展,它将 Segment Anything 的★ 1,295
binioubiniou 是一个自托管的 WebUI,聚合了 30 多种生成式 AI 模型,覆盖图像、音频、视频等模态。它基于 Gradio 构建,集成 Hugging F★ 1,151
csghub-serverCSGHub Server 是 CSGHub 平台的后端服务,用 Go 语言编写,面向大模型与数据资产的统一管理。它解决的是团队在模型、数据集、推理、微调和应用★ 1,051
NATSpeechNATSpeech 是一个非自回归语音合成(NAR-TTS)框架,基于 PyTorch 实现,集成了 PortaSpeech(NeurIPS 2021)和 Di★ 1,004
ChattyPlay-AgentChattyPlay-Agent 是一个基于 Python、React、TypeScript、Hono、SQLite3 和 Redis 构建的“All in O★ 943
mindnlpmindnlp 是一个开源项目,旨在将 Hugging Face 生态的 Transformers 和 Diffusers 模型无缝迁移到华为 MindSpor★ 920
MindActMindAct 是一个让 Hugging Face 的 Transformers 与 Diffusers 模型无缝运行在华为昇腾 MindSpore 框架上的适★ 920
dataset-viewerdataset-viewer 是 Hugging Face 官方开源的后端服务,为数据集页面上的在线预览功能提供公共 API。它解决的核心问题是:用户无需下载动★ 902
deepfabricdeepfabric 是一个面向 AI 数据工程的一体化流水线工具,旨在解决高质量合成数据生成、模型训练、评估与蒸馏的割裂问题。它提供从数据生成到模型优化的完整★ 886
llm-lsllm-ls 是一个用 Rust 编写的 LSP(语言服务器协议)服务器,核心目标是把大语言模型接入各类代码编辑器,提供代码补全等智能辅助能力。它本身不绑定特定★ 883