lanshu-create-ai-presenter-video

脚本加照片,自动生成可验证的AI主持人视频

这是一个基于 Codex Skill 的数字人视频生成工具,核心功能是从用户提供的脚本和授权的主持人图片,自动生成经过验证的 AI 主持人视频。它采用提供商中立的架构,不绑定特定视频生成服务,通过 Codex 技能框架实现流程自动化。项目主要解决传统数字人视频制作中流程复杂、依赖特定平台、验证困难等问题,提供从脚本到成片的端到端解决方案。其核心能力包括:脚本解析与结构化、主持人形象授权管理、视频生成流程编排、以及生成结果的自动验证。该工具面向需要批量制作数字人视频的内容创作者、营销团队和开发者,旨在降低视频制作门槛,提高生产效率。项目目前处于早期阶段,使用 Python 编写,技术栈涵盖 AI 视频生成和数字人技术。

开源 free 数字人3D
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 2089
维护状态 较活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类数字人3D
开发团队cclank
所属国家
官网地址
定价模式free
价格说明开源项目,免费使用
访问状态
是否开源是
开源协议MIT
主要语言Python
技术栈/模型ai-video,codex,codex-skill,digital-human,video-generation
GitHub 星标★ 2089
30天Star增速
HF 下载量
上线时间2026-08-20 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-22
浏览次数10

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

难度:进阶 约 15 分钟 部署方式:本地安装 8 步

环境要求

  • Codex 或兼容本地 Skill 的 Agent 环境
  • Python 3.9+
  • FFmpeg 与 ffprobe
  • Bash、jq、awk 和 sed
  • 至少一种当前环境可调用的视频生成、语音生成与口型同步能力

安装与启动步骤

  1. 1克隆到 Skill 目录

    把仓库直接克隆进 Codex 的 skills 目录,目录名需保持为 lanshu-create-ai-presenter-video,否则无法按 Skill 调用。

    git clone https://github.com/cclank/lanshu-create-ai-presenter-video.git 
      ~/.codex/skills/lanshu-create-ai-presenter-video
  2. 2核对运行环境

    按 README 运行环境要求确认 Python 3.9+、FFmpeg/ffprobe、jq 等依赖已就绪,缺一不可。

    python3 --version
    ffmpeg -version
    ffprobe -version
    jq --version
  3. 3准备输入素材

    至少准备一个主题或完整文案,以及一张已授权、包含清晰成年人物的参考图;缺少任一都无法开始。

  4. 4初始化任务目录

    用 init_job.py 在指定目录生成标准任务结构与 job.json,同时显式确认素材授权和人物为成年人。

    SKILL_DIR=~/.codex/skills/lanshu-create-ai-presenter-video
    
    python3 "$SKILL_DIR/scripts/init_job.py" 
      --job-dir ~/Videos/my-presenter-video 
      --presenter-image ~/Pictures/presenter.png 
      --topic "视频主题" 
      --duration 60 
      --aspect 9:16 
      --rights-confirmed 
      --adult-presenter-confirmed
  5. 5补全 job.json

    查看生成的任务文件,补全其中的人工检查项与远程上传许可,未确认前不要继续生成流程。

  6. 6运行预检

    执行 preflight.py 校验任务配置与素材是否满足生成条件,通过后才进入实际生成环节。

    python3 "$SKILL_DIR/scripts/preflight.py" ~/Videos/my-presenter-video/job.json
  7. 7在对话中触发生成

    也可以不手动初始化,直接在 Codex 对话里用 $ 引用该 Skill 并说明文案、画幅、时长与字幕要求。

    使用 $lanshu-create-ai-presenter-video,把这份文案和人物图做成一条 16:9、30 秒、有实时字幕的数字人讲解视频。
  8. 8按阶段读取参考文档

    Codex 会在对应阶段分别读取 generation.md、editing.md、qa-recovery.md,完成生成、剪辑与质量验收。

关键配置

配置项必填说明示例
--presenter-image是已授权且包含清晰成年人物的参考图路径~/Pictures/presenter.png
--topic是视频主题,也可改为提供完整文案"视频主题"
--duration否目标视频时长(秒)60
--aspect否画幅比例,横屏或竖屏9:16
--rights-confirmed是确认素材已获得使用授权--rights-confirmed
--adult-presenter-confirmed是确认参考图中人物为成年人--adult-presenter-confirmed

如何确认成功

preflight.py 执行无报错、job.json 中人工检查与上传许可已补全,最终按 qa-recovery.md 通过技术验收与人工验收。

常见问题

Q:这个 Skill 会绑定某个视频生成服务吗?

A:不会。它是提供商中立的,按当前环境可用的能力选择工具,源码不绑定服务商、模型名称或私有接口。

Q:最少需要提供什么才能开始?

A:一个主题或一份完整文案,加上一张经过授权、包含清晰成年人物的参考图,两者缺一不可。

Q:可以额外提供哪些素材?

A:可选输入包括声音样本、屏幕录制、图片、B-roll、品牌素材、目标平台、时长、横竖屏、风格、水印和结尾引导。

Q:三份参考文档会一次性全部加载吗?

A:不会。Codex 只在进入对应阶段时读取 generation.md、editing.md、qa-recovery.md,以减少上下文占用。

注意事项

  • 人物参考图必须已获授权且为清晰成年人人物,禁止使用未授权形象。
  • job.json 中的远程上传许可需人工确认后才能进入付费生成环节。
  • 项目目前处于早期阶段,能力与流程可能继续调整。
  • 生成结果需按 qa-recovery.md 完成技术验收与人工验收。

核心亮点

  • 提供商中立,可灵活切换不同视频生成服务,避免锁定
  • 内置验证机制,确保生成视频与脚本内容一致,减少返工
  • 基于Codex Skill,自动化程度高,从脚本到视频一键生成

不足之处

  • 早期项目,文档和社区支持待观察
  • 依赖外部视频生成服务,实际效果受服务商能力限制

适用场景

  • 批量制作产品介绍或教学视频,只需脚本和主持人照片
  • 为营销活动快速生成多语言版本的数字人视频
  • 在开发流程中集成自动化视频生成,用于演示或报告

替代项目

HeyGen、Synthesia、D-ID

项目介绍

lanshu-create-ai-presenter-video 是数字人3D领域的开源项目,由 cclank 开发,是 2026 年新上线的项目。

在全站 13,752 个收录项目中,它的 GitHub 星标数(2,089)位列前 30%,在数字人3D分类的 274 个项目里位列前 9%。

近 44 天,它的 GitHub 星标从 237 增加到 2,087,净增 1,850。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-27。免费使用。

它主要面向的使用场景是:批量制作产品介绍或教学视频,只需脚本和主持人照片。同类可对比的替代方案包括 HeyGen、Synthesia、D-ID。

上一篇:GameFactory-3A

下一篇:Procedura

同类项目推荐

A3D 开源

在 three.js 里直接调用 AI 生成纹理和素材,边建模边生成

3D x AI hybrid editor, built with three.js

★ 129 2026-08-09
cube 开源

用一句话生成 3D 模型,在 Roblox 里快速落地 AI 创作

Roblox Foundation Model for 3D Intelligence

★ 1263 2026-08-09
AG3D 开源

用2D图片直接生成3D虚拟人,告别昂贵扫描

Official code release for ICCV2023 paper AG3D: Learning to Generate 3D Avatars from ···

★ 273 2026-08-09
ai-avatar-system 开源

一张照片加一段声音,秒变会说话的数字人。

AI Avatar / digital human platform — upload a photo, clone a voice, talk to any fac···

★ 519 2026-08-09