ChatMock 是基础设施领域的开源项目,由 RayBytes 开发,2025 年首次发布。
在全站 13,090 个收录项目中,它的 GitHub 星标数(1,547)位列前 30%,在基础设施分类中处于中上游。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。MIT许可证,可自行部署,无在线服务,完全免费。
它主要面向的使用场景是:将现有ChatGPT应用迁移到Codex引擎进行测试。同类可对比的替代方案包括 LocalAI、llama.cpp、vLLM。

用 Codex 引擎替换 OpenAI API,一行配置即享新能力
ChatMock 是一个基于 Python 的轻量级服务,提供与 OpenAI 和 Ollama 兼容的 API,底层由 OpenAI Codex 驱动。它解决了开发者在不修改现有代码的情况下,将应用从标准 OpenAI API 切换到 Codex 引擎的难题,同时支持本地 Ollama 模型作为备选。核心能力包括:无缝替换 API 端点、支持流式响应、多模型路由、以及简单的 Docker 部署。通过模拟 OpenAI 的请求/响应格式,ChatMock 让开发者能快速体验 Codex 的推理能力,或将其集成到现有工具链中,而无需重写客户端。项目处于成长阶段,社区活跃,适合探索 Codex 能力的开发者。
1安装 ChatMock
推荐用 pipx 安装,可隔离依赖;也可用 pip 安装同名包。
pipx install chatmock2或用 Homebrew 安装
macOS/Linux 上可通过 Homebrew 源安装,需先 tap 再 install。
brew tap RayBytes/chatmock
brew install chatmock3登录 ChatGPT 账号
首次使用需登录 ChatGPT 账号;在无头服务器上执行时追加 --headless。
chatmock login4启动本地服务
启动后服务默认监听 http://127.0.0.1:8000,新增配置项写在 serve 之后。
chatmock serve5接入兼容应用
在支持 OpenAI/Ollama 兼容的应用中把地址填为 http://127.0.0.1:8000/v1,API Key 可任意填。
| 配置项 | 必填 | 说明 | 示例 |
|---|---|---|---|
--reasoning-effort | 否 | 控制模型思考强度 | medium |
--reasoning-summary | 否 | 思考摘要的详细程度 | auto |
--reasoning-compat | 否 | 思考过程返回给客户端的方式 | think-tags |
--fast-mode | 否 | 对支持的模型启用优先处理 | false |
--enable-web-search | 否 | 允许模型联网搜索 | false |
--model-sync | 否 | 自动发现账号可用模型 | true |
终端显示服务已在 http://127.0.0.1:8000 运行,浏览器或客户端访问 http://127.0.0.1:8000/v1 可正常返回。
Q:在无头服务器上怎么登录?
A:执行 chatmock login 时追加 --headless 参数,即可在无图形界面的服务器上完成登录。
Q:现有的 OpenAI 客户端如何切换过来?
A:把 base URL 改为 http://127.0.0.1:8000/v1,API Key 可以随意填写,无需修改其他代码。
Q:如何用 Docker 部署?
A:README 指向仓库内的 DOCKER.md,具体命令请查阅该文档。
Q:怎么让模型联网搜索?
A:启动时加 --enable-web-search,或在请求体中加入 responses_tools 与 responses_tool_choice 字段。
LocalAI、llama.cpp、vLLM
ChatMock 是基础设施领域的开源项目,由 RayBytes 开发,2025 年首次发布。
在全站 13,090 个收录项目中,它的 GitHub 星标数(1,547)位列前 30%,在基础设施分类中处于中上游。
项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-21。MIT许可证,可自行部署,无在线服务,完全免费。
它主要面向的使用场景是:将现有ChatGPT应用迁移到Codex引擎进行测试。同类可对比的替代方案包括 LocalAI、llama.cpp、vLLM。
上一篇:gptGrok2api
下一篇:x-ui-yg
freebuff-proxy
开源
聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。
Multi-account OpenAI-compatible gateway for coding models. Pooled keys, session life···
microduck
开源
用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。
A Tiny biped duck robot
soperator
开源
用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。
Run Slurm in Kubernetes
ollama
开源
一条命令本地跑起大模型,免费、私密、不卡顿
Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···