llmman

把模型装进 OCI 镜像,任意 Agent 一键换模型跑

llmman 是一个用 Rust 编写的模型与 Agent 运行管理工具,核心思路是把大语言模型当作 OCI 镜像来存储和分发,让模型像 Docker 镜像一样可拉取、可版本化、可复用。它解决的是本地跑模型和 Agent 时环境配置繁琐、模型文件散落各处、不同推理后端切换成本高的问题。核心能力包括:统一管理 llama.cpp、MLX、vLLM 等推理后端的模型资产;通过 OCI 标准让模型具备可移植性,方便在团队或机器间共享;支持把 Claude Code、Codex、opencode 等 Agent 框架接到任意模型上运行,实现 Agent 与模型解耦。项目处于早期阶段,星标约 500,适合喜欢折腾本地推理、想统一管理多后端模型和 Agent 的开发者。

开源 free 基础设施
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 506
维护状态 活跃
是否开源
定价模式 free

项目数据

分类基础设施
开发团队llmmanorg
所属国家
定价模式free
价格说明开源项目,免费使用,定价信息待确认
访问状态
是否开源
开源协议Apache-2.0
主要语言Rust
技术栈/模型claude-code,codex,llama-cpp,llm,mlx,oci,opencode,vllm
GitHub 星标★ 506
30天Star增速
HF 下载量
上线时间2026-03-22 00:00:00
最近更新2026-09-18 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0

使用教程

核心亮点

  • 用 OCI 镜像管理模型,天然获得版本化、可分发、可缓存的能力,比手动下载权重文件规范得多
  • 统一抽象 llama.cpp、MLX、vLLM 等后端,切换推理引擎不用改 Agent 侧代码
  • 支持 Claude Code、Codex、opencode 等 Agent 框架接任意模型,Agent 与模型解耦,方便做对比测试

不足之处

  • 项目早期,生态和文档成熟度有限,部分后端集成可能不稳定
  • OCI 存模型对镜像仓库带宽和存储要求较高,大模型场景下拉取成本明显

适用场景

  • 本地同时跑多个推理后端,想统一管理模型文件和版本
  • 把 Claude Code 或 Codex 这类 Agent 接到自部署模型上做离线使用
  • 团队内共享模型资产,用镜像仓库分发而不是各自下载权重

替代项目

Ollama、LM Studio、llama.cpp

项目介绍

llmman 是基础设施领域的开源项目,由 llmmanorg 开发,是 2026 年新上线的项目。

它收录于基础设施分类,该分类目前共有 1,114 个项目,GitHub 星标数为 506。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-18。免费使用。

它主要面向的使用场景是:本地同时跑多个推理后端,想统一管理模型文件和版本。同类可对比的替代方案包括 Ollama、LM Studio、llama.cpp。

上一篇:1Cat-vLLM

下一篇:llm-scaler

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

OpenAI-compatible gateway for FreeBuff coding models. Token pool, session lifecycle,···

★ 202 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 8576 2026-09-10
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 437 2026-08-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 181269 2026-08-09