inferock-bench 是基础设施领域的开源项目,由 inferock 开发,是 2026 年新上线的项目。
它收录于基础设施分类,该分类目前共有 1,130 个项目,GitHub 星标数为 141。
项目仍在小幅维护中,最近一次代码更新于 2026-09-07。本地部署,完全免费。
它主要面向的使用场景是:本地开发调试时监控LLMAPI调用成本。同类可对比的替代方案包括 Helicone、LiteLLM、OpenLLMetry。

本地代理,实时追踪 LLM 调用成本与失败,账单一目了然
inferock-bench 是一个面向本地 LLM 调用的成本追踪代理,支持 OpenAI、Anthropic、Gemini 以及固定的 OpenRouter 调用。它解决的是开发者在本地或测试环境中难以精确统计 token 消耗、失败率和账单一致性的问题。核心能力包括:拦截并记录所有 LLM API 请求,实时统计 token 用量,监控调用失败情况,并生成可审计的账单完整性收据,确保费用计算透明可追溯。项目基于 TypeScript 构建,轻量易集成,适合作为本地开发调试或自托管 LLM 网关的辅助工具。
Helicone、LiteLLM、OpenLLMetry
inferock-bench 是基础设施领域的开源项目,由 inferock 开发,是 2026 年新上线的项目。
它收录于基础设施分类,该分类目前共有 1,130 个项目,GitHub 星标数为 141。
项目仍在小幅维护中,最近一次代码更新于 2026-09-07。本地部署,完全免费。
它主要面向的使用场景是:本地开发调试时监控LLMAPI调用成本。同类可对比的替代方案包括 Helicone、LiteLLM、OpenLLMetry。
上一篇:VectorChord
下一篇:llmtrim
freebuff-proxy
开源
聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。
Multi-account OpenAI-compatible gateway for coding models. Pooled keys, session life···
microduck
开源
用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。
A Tiny biped duck robot
soperator
开源
用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。
Run Slurm in Kubernetes
ollama
开源
一条命令本地跑起大模型,免费、私密、不卡顿
Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···