hummingbird 是基础设施领域的开源项目,由 prayangshuuu 开发,是 2026 年新上线的项目。
它收录于基础设施分类,该分类目前共有 1,130 个项目,GitHub 星标数为 58。
项目仍在小幅维护中,最近一次代码更新于 2026-09-21。无官网,需自行部署,完全免费。
它主要面向的使用场景是:个人开发者本地运行100B+MoE模型进行实验。同类可对比的替代方案包括 llama.cpp、vLLM、Ollama。

消费级硬件上跑超大 MoE 模型,统一内存调度
hummingbird 是一个轻量级、零依赖的 C 语言运行时,专为大规模开源混合专家(MoE)语言模型设计。它通过统一 SSD、RAM 和 VRAM 为单一智能内存层次,使得 GPT-OSS 120B、GLM、DeepSeek、Qwen 等大型模型能够在消费级硬件上运行。该项目解决了 MoE 模型推理时内存容量与带宽的瓶颈问题,核心能力包括智能内存调度、高效模型加载和推理加速。它无需外部依赖,便于集成和部署,特别适合个人开发者或小团队在本地设备上体验和运行超大模型。目前项目处于早期阶段,星标较少,但技术方向具有创新性,有望降低大模型使用门槛。
llama.cpp、vLLM、Ollama
hummingbird 是基础设施领域的开源项目,由 prayangshuuu 开发,是 2026 年新上线的项目。
它收录于基础设施分类,该分类目前共有 1,130 个项目,GitHub 星标数为 58。
项目仍在小幅维护中,最近一次代码更新于 2026-09-21。无官网,需自行部署,完全免费。
它主要面向的使用场景是:个人开发者本地运行100B+MoE模型进行实验。同类可对比的替代方案包括 llama.cpp、vLLM、Ollama。
上一篇:tokenu
下一篇:langfuse-java
freebuff-proxy
开源
聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。
Multi-account OpenAI-compatible gateway for coding models. Pooled keys, session life···
microduck
开源
用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。
A Tiny biped duck robot
soperator
开源
用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。
Run Slurm in Kubernetes
ollama
开源
一条命令本地跑起大模型,免费、私密、不卡顿
Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···