
TurboLLM
一条命令把 Claude Code 接到自己显卡上跑
TurboLLM 是一个面向本地大模型推理的基础设施工具,用 TypeScript 编写,目标是让任何人都能在自己的显卡上跑起任意本地 LLM 引擎。它自动检测并调优 GPU 参数,省去手动配置 llama.cpp 的繁琐过程,同时提供一个精致的 Web UI 用于模型管理和对话。更关键的是,它暴露了与 OpenAI 和 Anthropic 兼容的 API 接口,这意味着你可以把 Claude Code 等工具直接指向自己的机器,一条命令完成接入,无需改动客户端代码。项目强调离线优先、无 Electron 依赖、无 Python 环境要求,安装和启动都更轻量。适合希望在本地私有化运行模型、又想复用现有 AI 编程工具链的开发者,兼顾隐私、成本和可玩性。
开源
unknown
基础设施
GitHub 星标
★ 275
维护状态
活跃
是否开源
是
定价模式
unknown
项目数据
分类基础设施
开发团队mohitsoni48
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议
主要语言TypeScript
技术栈/模型ai,anthropic-api,claude-code,gguf,gpu,inference,llama-cpp,llama-server,llm,local-llm,offline,openai-api,self-hosted
GitHub 星标★ 275
30天Star增速
HF 下载量
上线时间2026-06-12 00:00:00
最近更新2026-09-18 00:00:00
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-16
浏览次数0
使用教程
核心亮点
- 自动检测 GPU 并调优推理参数,省去手动配置 llama.cpp 的麻烦
- 同时提供 OpenAI 与 Anthropic 兼容 API,Claude Code 可一键指向本机
- 无 Electron、无 Python 依赖,TypeScript 实现,部署轻量且离线优先
不足之处
- 项目仍处早期,272 星标,生态与文档完善度有限
- 仅支持本地单机场景,缺少多用户、集群或远程调度能力
适用场景
- 开发者想在本地私有化运行大模型,避免数据外传
- 用 Claude Code 等 AI 编程工具但希望走本地推理省 API 费用
- 需要统一管理多个 GGUF 模型并快速切换的本地实验环境
替代项目
Ollama、LM Studio、llama.cpp
项目介绍
同类项目推荐
freebuff-proxy
开源
聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。
OpenAI-compatible gateway for FreeBuff coding models. Token pool, session lifecycle,···
microduck
开源
用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。
A Tiny biped duck robot
soperator
开源
用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。
Run Slurm in Kubernetes
ollama
开源
一条命令本地跑起大模型,免费、私密、不卡顿
Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···