Twocast

一键把文章变成双人对话播客,多语言多音色,替代 NotebookLM

Twocast 是一个开源的 AI 播客生成器,专注于生成双语音频节目,支持多语言和多音色,被视为 NotebookLM 的替代方案。它主要解决用户快速将文本内容(如文章、文档)转化为自然流畅的多人对话式播客的需求。核心能力包括:基于大型语言模型生成双人对话脚本,支持多种语言(如中英双语),提供多种 AI 音色选择,并能输出逼真的音频文件。项目采用 TypeScript 开发,架构清晰,适合开发者二次集成或自托管。目前项目处于成长阶段,社区活跃度较高,但文档和生态仍在完善中。

开源 free 音频音乐
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1292
维护状态 低维护
是否开源
定价模式 free

项目数据

分类音频音乐
开发团队panyanyany
所属国家
定价模式free
价格说明开源项目,可自行部署使用,无在线服务,全部功能免费。
访问状态
是否开源
开源协议
主要语言TypeScript
技术栈/模型podcast,podcast-generator,voice-cloning,voice-synthesis
GitHub 星标★ 1292
30天Star增速
HF 下载量
上线时间2025-06-20 00:00:00
最近更新2026-09-22 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数4

使用教程

难度:进阶 约 20 分钟 部署方式:本地安装 6 步

环境要求

  • Node.js 与 yarn 包管理器(用于执行 yarn && yarn start)
  • Docker(用于启动 textract 和 ffmpeg-api 依赖服务,或使用 Docker 一键启动)
  • PostgreSQL 数据库,需手动创建名为 twocast 的库
  • Fish Audio API Key(TTS 必填),可选 Minimax、Google Gemini
  • OpenRouter 的 LLM API Key 与 x.ai 的 Search API Key

安装与启动步骤

  1. 1克隆项目代码

    从 GitHub 拉取 Twocast 源码到本地,之后所有命令都在项目根目录执行。

    git clone https://github.com/panyanyany/Twocast.git
    cd Twocast
  2. 2启动依赖服务

    用 Docker 启动 textract(文档解析,映射 8080)与 ffmpeg-api(音频处理,映射 8081)两个容器。

    docker run -t -d --restart always -p 8080:8080 -e PORT=8080 --name textract bespaloff/textract-rest-api:v4.0.2
    docker run -d --restart always --name ffmpeg-api -p 8081:3000 kazhar/ffmpeg-api
  3. 3配置环境变量

    复制示例文件生成 .env,然后按下方配置项填写 TTS 与 LLM 的密钥。

    cp .env.example .env
  4. 4初始化数据库

    先手动创建名为 twocast 的数据库,修改 .env 中 DATABASE_URL 指向它,再推送表结构。

    npx drizzle-kit push
  5. 5启动项目

    安装依赖并启动服务,首次会下载较多 npm 包,请耐心等待。

    yarn && yarn start
  6. 6Docker 一键启动

    不想本地配置依赖时,改用 Docker 方式启动;README 提示遇到问题应优先回到本地安装。

    cp .env.docker .env
    docker compose up

关键配置

配置项必填说明示例
FISH_AUDIO_TOKENFish Audio 的 TTS API Key,语音合成主通道your_fish_audio_token
LLM_API_KEYOpenRouter 的对话模型 API Key,用于生成播客脚本sk-or-v1-xxxxxxxx
LLM_SEARCH_API_KEYx.ai 的搜索 API Key,用于话题/链接检索xai-xxxxxxxx
DATABASE_URLPostgreSQL 连接串,需指向已创建的 twocast 库postgres://user:pass@localhost:5432/twocast
MINIMAX_TOKENMinimax 平台 API Key,启用后可作为 TTS 备选your_minimax_token
GEMINI_TOKENGoogle Gemini API Key,可选且成本更高your_gemini_token

如何确认成功

docker ps 能看到 textract 与 ffmpeg-api 容器在运行,且 yarn start 终端输出无报错,即视为启动成功。

常见问题

Q:Docker 一键启动报错怎么办?

A:README 明确建议:如果使用 Docker 方式遇到问题,请优先改用 Method 1 本地安装方式部署。

Q:如何生成 5-9 分钟的长播客?

A:选择 List Page(列表页)生成方式即可,普通话题、链接、文档方式生成的是 3-5 分钟节目。

Q:必须配置三种 TTS 平台吗?

A:不必。Fish Audio 的 FISH_AUDIO_TOKEN 填入即可,Minimax 和 Gemini 为可选,需分别设置 MINIMAX_ENABLED=1、GEMINI_ENABLED=1 才生效。

Q:npx drizzle-kit push 报数据库错误?

A:确认 PostgreSQL 中已创建 twocast 数据库,并且 .env 里的 DATABASE_URL 指向正确的主机、端口与库名后再执行。

注意事项

  • 项目支持 Fish Audio、Minimax、Google Gemini 三种语音合成平台,可多语言输出。
  • 生成结果包含音频、大纲和脚本三部分,音频支持下载。
  • Gemini 方案成本更高,属于可选配置。
  • 官方在线版为 twocast.app,可先体验效果再决定自托管。

核心亮点

  • 直接对标 NotebookLM,但开源可自托管,数据隐私可控
  • 支持多语言混合生成,适合双语学习或国际内容创作
  • 提供多种 AI 音色,对话自然度较高,生成流程自动化

不足之处

  • 文档和社区生态尚在早期,示例和教程不够丰富
  • 音色和语言覆盖有限,部分小众语言支持可能不完善

适用场景

  • 将博客文章或报告快速转化为双语播客,用于内容分发
  • 语言学习者通过 AI 对话音频练习听力与口语
  • 自媒体创作者批量生成音频内容,降低制作成本

替代项目

NotebookLM、Podcastly、AudioPen

项目介绍

Twocast 是音频音乐领域的开源项目,由 panyanyany 开发,2025 年首次发布。

在全站 13,014 个收录项目中,它的 GitHub 星标数(1,292)位列前 30%,在音频音乐分类的 738 个项目里位列前 14%。

近 42 天,它的 GitHub 星标从 1,253 增加到 1,292,净增 39。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-22。可自行部署使用,无在线服务,全部功能免费。

它主要面向的使用场景是:将博客文章或报告快速转化为双语播客,用于内容分发。同类可对比的替代方案包括 NotebookLM、Podcastly、AudioPen。

上一篇:ComfyUI-Qwen3-TTS

下一篇:GenVC

同类项目推荐

tango 开源

输入一句话,自动生成匹配的音频内容

A family of diffusion models for text-to-audio generation.

★ 1239 2026-08-09
AuK 开源

一个模型搞定语音生成、编辑与分离

AuK: An Open-Source Foundational Model for Speech Generation and Editing

★ 1236 2026-09-13
swift-tts 开源

Swift 项目三行代码接入系统 TTS,兼容 TCA 和 Combine

A straightforward package containing version for Swift modern concurrency, Point-Fre···

★ 52 2026-08-09
ai-dj 开源

现场演出中实时用 AI 生成音乐,保持人类掌控

AI music generation for live performance - Standalone (Ableton Link) + VST3/AU. 8 tr···

★ 245 2026-08-09