voice-assistant
本站收录 109 个带「voice-assistant」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
agentscope阿里通义实验室开源的智能体开发框架,核心主张是构建并运行「看得见、看得懂、信得过」的智能体。提供统一的多智能体编排、分布式调度与可视化调试能力,支持大模型服务接★ 32,570
agenticSeekagenticSeek 是一个完全本地运行的自主智能体项目,旨在成为 Manus AI 的开源替代品。它无需任何 API 调用,也不产生每月 200 美元的订阅★ 27,382
leonLeon 是开源的 AI 个人助理,可部署在你自己的设备上,数据完全自主可控,支持语音交互与技能扩展,帮你处理日常任务,打造真正属于你的私人智能助手。★ 17,549
clone-voiceclone-voice 是一个带 Web 界面的声音克隆工具,使用 Python 编写。它允许用户用自己的音色或任意声音来录制音频,核心能力包括声音克隆、语音合★ 8,967
awesome-botsawesome-bots 是一个精选机器人资源的开源列表,汇集了与聊天机器人、语音助手等相关的工具、框架、平台、库和文章。它旨在帮助开发者、产品经理和爱好者快速★ 4,183
oliviaOlivia 是一个用 Go 编写的开源个人助理,基于人工神经网络实现自然语言对话。它旨在成为用户的“新好朋友”,通过本地运行的方式解决隐私和定制化问题。核心能★ 3,717
moltismoltis 是一个用 Rust 编写的安全持久化个人智能体服务器。它通过单个二进制文件提供沙箱化执行环境,支持多提供商 LLM、语音交互、记忆功能,并集成了 ★ 2,876
parlorparlor 是一个运行在 Apple 芯片设备上的实时多模态 AI 助手,功能类似 GPT-Live,但完全本地化。它解决了云端 AI 助手延迟高、隐私泄露和★ 2,069
alan-sdk-iosAlan AI iOS SDK 是一个将语音对话能力嵌入 iOS 应用的开发工具包,旨在让开发者无需从零构建语音识别、自然语言处理和对话管理,即可快速为 App★ 1,878
alan-sdk-androidAlan AI 是一个面向 Android 应用的对话式 AI 平台,提供完整的语音助手解决方案。开发者通过 Alan Studio 可视化界面设计对话流程,无★ 1,806
bailing百聆是一个类似GPT-4o的语音对话机器人,通过ASR(语音识别)+LLM(大语言模型)+TTS(语音合成)技术栈实现,集成DeepSeek R1等优秀大模型,★ 1,774
alan-sdk-flutterAlan AI 是一个面向 Flutter 应用的对话式 AI 平台 SDK,旨在让开发者通过几行代码为应用集成语音助手和聊天机器人。它解决了应用内自然语言交互★ 1,756
CyberVerseCyberVerse 是一个自托管的实时数字人智能体平台,旨在帮助开发者快速构建以语音交互为核心的 AI 代理。它解决了传统语音助手缺乏人格化形象和记忆能力的问★ 1,685
alan-sdk-ionicAlan AI SDK for Ionic 是一个让 Ionic 应用快速获得对话式 AI 能力的官方 SDK。它解决了移动应用内构建复杂语音交互的难题,开发者★ 1,648
dicio-androidDicio 是一款开源的 Android 语音助手应用,完全本地化运行,无需云端服务。它解决了用户对隐私敏感、可高度定制的语音助手需求,核心能力包括离线语音识别★ 1,494
Irene-Voice-AssistantIrene-Voice-Assistant 是一个用 Python 编写的俄语离线语音助手,名为伊琳娜。它旨在解决用户在无网络环境下使用语音交互的需求,核心能力★ 1,159
alan-sdk-cordovaAlan AI SDK for Cordova 是一个将对话式 AI 助手集成到 Cordova 应用中的开发工具包。它解决了移动应用内缺乏自然语言交互能力的问★ 1,131
metabotmetabot 是一个面向智能体组织的基础设施项目,旨在构建受监督的、自我进化的 Agent 团队。它解决了在手机端(飞书/Telegram)远程运行和管理 C★ 990
blurrblurr 是一款基于 Kotlin 开发的 Android 自动化工具,旨在让手机应用像人类一样自主操作。它通过模拟点击、滑动、文本输入等交互方式,自动执行重★ 986
voxtvoxt 是一个面向 Mac 的本地优先语音输入工具,通过按住说话(hold-to-talk)的方式,将语音实时转换为文本,并自动进行清理、改写、翻译,还能根据★ 852
bolnabolna 是一个用于构建对话式语音 AI 智能体的开源框架,基于 Python 开发。它解决了开发者从零搭建语音交互系统时面临的复杂集成问题,将语音识别、大语★ 779
vuiVui 是一个实时语音助手框架,基于 WebRTC 流式传输,集成了 faster-whisper 语音识别、本地 LLM(如 Qwen)和 Vui Nano ★ 769
echokit_serverechokit_server 是一个开源的语音代理平台,基于 Rust 构建,旨在为开发者提供构建语音助手和语音交互应用的完整解决方案。它解决了从语音识别(AS★ 592
alan-sdk-reactnativeAlan AI SDK for React Native 是一个将语音助手能力集成到 React Native 应用中的开发工具包。它解决了移动应用内缺乏自然语★ 575
awesome-ai这是一个精选人工智能资源的列表项目,收集了课程、工具、应用和开源项目等各类AI相关资源。它旨在为AI学习者和开发者提供一个导航入口,解决信息过载和资源分散的问题★ 552
StarmoonStarmoon 是一个开源的对话式 AI 设备与软件框架,旨在为陪伴、娱乐、教育、医疗、物联网和 DIY 机器人等场景提供语音交互能力。它结合了 Python★ 549
JARVISJARVIS 是一个基于 Python 的个人语音助手项目,它将语音识别、大语言模型(LLM)和语音合成串联起来,形成一个完整的语音交互闭环,并通过 Web 界★ 529
make-a-smart-speaker这是一个教你从零开始打造智能音箱的资源合集,主要解决DIY爱好者想自己动手做智能音箱却缺乏系统资料的问题。项目收集了硬件选型、语音识别、音频处理、云端接入等各个★ 480
speak-gptspeak-gpt 是一款基于 OpenAI ChatGPT 的安卓语音助手应用,使用 Kotlin 开发。它解决的是用户在移动端通过语音与 AI 自然交互的需★ 445
alan-sdk-pcfAlan AI SDK for Power Apps 是一个将对话式AI能力嵌入微软Power Apps的低代码开发工具包。它通过Power Apps Comp★ 425
jarvis-assistant-vocaljarvis-assistant-vocal 是一个用 Python 编写的本地化法语语音助手,目标是把大模型、智能家居和桌面自动化整合成一套可对话的 Jarv★ 404
sutandosutando 是一个自托管的个人 AI 智能体,主打“白天实时响应,夜间自我进化”。它集成多种主流大模型(如 Claude、Gemini),支持语音交互和多智★ 397
agent-second-brain这是一个将 Telegram 语音笔记自动转化为 Obsidian 知识库的个人助理项目。它利用 Claude 的订阅服务,实现 24/7 全天候运行,解决用户★ 386
autonomous-osautonomous-os 是一个面向机器人的开源操作系统,目标是让开发者像安装普通软件一样给机器人装上"大脑"。它把 LLM、Agentic AI 与嵌入式控★ 368
LiveWhisperLiveWhisper 是一个基于 OpenAI Whisper 的近乎实时语音转文字工具,通过 sounddevice 捕获麦克风音频并流式处理,无需修改 W★ 361
jarvis-ai-assistant这是一个用Python构建的语音激活AI助手,灵感来自钢铁侠的Jarvis。它通过语音识别和自然语言处理,让用户用说话的方式完成日常任务,比如查询天气、播放音乐★ 348
glados-voice-assistant这是一个基于《传送门》游戏角色GLaDOS的DIY语音助手项目,使用C语言编写,主要面向Home Assistant智能家居平台。它解决了用户希望拥有一个具有独★ 347
voiceaivoiceai 是一个面向语音 AI 智能体开发者的精选资源集合,旨在帮助初学者和进阶者快速上手构建实时语音对话系统。它解决了语音 AI 领域资料分散、入门门槛★ 329
openclaw-assistantOpenClaw 是一款面向 Android 的离线语音助手应用,基于 Kotlin 和 Jetpack Compose 构建。它主要解决用户在无网络或注重隐私★ 320
openliveopenlive 是一个开源的、设备端运行的语音与视觉交互层,专为 AI 代理设计。它解决了云端语音服务延迟高、成本高、隐私风险大的问题,让开发者可以自由接入任★ 316
Aetherius_AI_AssistantAetherius AI Assistant 是一个完全私有、本地运行的 AI 助手/聊天机器人/子代理框架,基于开源大语言模型(LLM)构建,强调长期记忆与思★ 313
LLMVoXLLMVoX 是一个将任意大型语言模型(LLM)转换为支持流式语音对话的端到端系统。它解决了传统语音助手需要额外语音识别和合成模块、延迟高且交互不自然的问题。核★ 312
home-generative-agent这是一个为 Home Assistant 打造的生成式 AI 智能体,旨在让用户通过自然语言与智能家居交互。它解决了传统自动化配置复杂、摄像头监控被动等问题,核★ 310
AI-TalksAI-Talks 是一个基于 Streamlit 构建的 ChatGPT 对话助手,旨在提供一个轻量、可快速部署的 AI 聊天界面。它解决了用户直接使用 Ope★ 295
whisper_dictationwhisper_dictation 是一个开源的私人语音键盘和 AI 助手,旨在通过语音控制实现免提操作。它利用 Whisper 模型进行本地语音识别,支持语音★ 294
sapphireSapphire 是一个自托管的 AI 对话助手,定位为“你回家的 AI 伴侣”,主打隐私保护和拟人化陪伴体验。它基于 Python 构建,采用 agentic★ 288
bosunbosun 是一个自主工程(Autonomous Engineering)领域的开源项目,旨在通过 AI 智能体自动完成软件开发中的工程任务。它解决的是传统开发★ 284
hermes-relayHermes-Relay 是一个基于 Kotlin 开发的 Android 应用,旨在将 Hermes AI 智能体装进口袋,让你随时随地通过手机进行聊天、语音★ 280
On-Device-Speech-to-Speech-Conversational-AI这是一个纯CPU上运行的实时语音对话系统,实现与AI模型的双向语音交流。它采用连续流式架构,支持即时响应和自然的打断处理,让对话流畅自然。项目整合了语音识别(A★ 257
SpeakoFlowSpeakoFlow 是一款免费开源的跨平台语音听写与 AI 助手,支持 Windows、macOS 和 Linux。它利用本地 Whisper 模型实现离线语★ 256