
heard
对着电脑说句话,AI 编程助手就能听懂并回你
heard 是一个为编码智能体(coding agents)打造的语音交互层,定位是「AI 编程助手的 Jarvis」。它解决的核心问题是:使用 Claude Code、Codex、OpenClaw、Hermes 等命令行 AI 工具时,开发者必须一直盯着终端、手动敲字输入,效率受限。heard 让智能体可以「开口说话」,你则通过语音免手回复,形成双向语音对话。项目基于 Python 开发,主要面向 macOS,支持 push-to-talk 和免手模式,把语音识别、语音合成与 AI 工作流串起来。它不替代智能体本身,而是叠加一层语音外壳,让写代码、跑任务、确认操作等环节都能用说的完成,适合长时间与 AI 结对编程、或希望解放双手的开发者。当前星标约 181,属于早期项目。
项目数据
使用教程
核心亮点
- 把语音输入输出封装成独立层,可对接 Claude Code、Codex、OpenClaw、Hermes 等多种智能体,不绑定单一工具
- 支持 push-to-talk 和免手两种模式,适配长时间结对编程场景
- 基于 Python 实现,macOS 上部署门槛较低,便于二次开发和接入自有 AI 工作流
不足之处
- 项目处于早期,星标仅 181,文档和社区生态尚不成熟
- 主要面向 macOS,跨平台支持有限,Windows/Linux 用户体验待验证
适用场景
- 双手在键盘上写代码时,用语音向 Claude Code 下达指令或确认操作
- 长时间与 AI 结对调试,免手模式减少反复切窗口和打字
- 在 IDE 或终端外做其他事时,用语音让 Codex 继续跑任务并听取结果
替代项目
whisper.cpp、voice-mode、Open Interpreter
项目介绍
同类项目推荐
obs-localvocal
开源
直播录屏时,本地AI实时生成字幕,保护隐私零延迟
OBS plugin for local speech recognition and captioning using AI
LiveCaptions-Translator
开源
实时捕获系统音频,一键翻译成你懂的语言
Lightweight and powerful real-time audio/speech translation tool based on Windows Li···
speechbrain
开源
一站式 PyTorch 语音工具箱,快速搞定识别、说话人验证等任务
A PyTorch-based Speech Toolkit
whisper-diarization
开源
给语音转写加上说话人标签,会议记录一目了然
Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper