openmac

本地起个服务,图片识别翻译语音一把梭

OpenMac 是一个用 Swift 编写的本地计算机视觉与多模态能力服务,它在本地启动一个 HTTP 服务器,把常见的图像与文本处理能力封装成 API 供调用。它解决的是开发者不想依赖云端付费接口、又希望快速获得 OCR、翻译、网页抓取、人脸检测、二维码/条码识别和语音合成等能力的问题。核心能力包括:图片文字识别(OCR)、多语言翻译、网页内容抓取、人脸及五官位置检测、图片中的二维码与条形码识别,以及文本转语音(TTS)。所有能力通过本地 HTTP 接口暴露,方便被其他语言或应用集成,适合在隐私敏感或离线环境下做原型验证与轻量级集成。项目处于早期阶段,星标数较少,接口与稳定性仍可能快速变化。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 126
维护状态 较活跃
是否开源 是
定价模式 free

项目数据

分类计算机视觉
开发团队echosoar
所属国家
官网地址
定价模式free
价格说明开源免费,本地部署使用
访问状态
是否开源是
开源协议MIT
主要语言Swift
技术栈/模型
GitHub 星标★ 126
30天Star增速
HF 下载量
上线时间2026-06-10 00:00:00
最近更新2026-09-28 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-09-29
浏览次数0

使用教程

核心亮点

  • 一个本地 HTTP 服务同时提供 OCR、翻译、人脸检测、二维码识别和 TTS,能力聚合度高
  • 用 Swift 实现,在 macOS/iOS 生态里集成成本低,适合苹果平台开发者
  • 本地运行不依赖云端 API,隐私数据不出本机,适合离线或敏感场景

不足之处

  • 项目处于早期,星标仅 126,接口稳定性和长期维护存在不确定性
  • 能力依赖系统或第三方模型,识别精度与多语言覆盖范围缺乏公开评测数据

适用场景

  • 在 macOS 上做本地文档扫描工具,调用 OCR 与翻译接口处理图片文字
  • 为内部应用快速搭建人脸检测与二维码识别服务,避免接入云端付费 API
  • 给苹果生态应用加文本转语音与网页内容抓取能力,做离线阅读或播报功能

替代项目

Tesseract、PaddleOCR

项目介绍

openmac 是计算机视觉领域的开源项目,由 echosoar 开发,是 2026 年新上线的项目。

它收录于计算机视觉分类,该分类目前共有 467 个项目,GitHub 星标数为 126。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-28。开源免费,本地部署使用。

它主要面向的使用场景是:在macOS上做本地文档扫描工具,调用OCR与翻译接口处理图片文字。同类可对比的替代方案包括 Tesseract、PaddleOCR。

上一篇:wgai

下一篇:dsh-vision-toolkit

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4045 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90972 2026-08-10
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1431 2026-08-20