JavisDiT

一键生成音画同步的短视频,告别无声视频。

JavisDiT 是一个面向音频-视频联合生成的扩散 Transformer 模型系列,由 ICLR 2026 论文官方实现。它解决的是传统视频生成中音频与画面割裂的问题,通过联合建模音频和视频的时空依赖,生成音画同步的短视频。核心能力包括:基于 DiT 架构的联合扩散模型,支持文本/音频条件生成,以及 JavisDiT 和 JavisDiT++ 两个版本。项目处于早期阶段,代码和模型正在完善中。

开源 free 视频生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 382
维护状态 较活跃
是否开源
定价模式 free

项目数据

分类视频生成
开发团队JavisVerse
所属国家
定价模式free
价格说明开源项目,Apache-2.0 许可证,可自由使用和部署,无付费版本。
访问状态
是否开源
开源协议Apache-2.0
主要语言Python
技术栈/模型audio-generation,dit,joint-audio-video,joint-audio-video-diffusion-transformer,joint-audio-video-generation,sounding-video-generation,synchronized-video-audio-generation,video-generation
GitHub 星标★ 382
30天Star增速
HF 下载量
上线时间2025-03-07 00:00:00
最近更新2026-09-08 00:00:00
维护状态较活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 音画联合建模,从架构上保证声画同步,避免后期配音对不齐。
  • 基于 DiT 的扩散架构,生成质量有潜力,且易于扩展。
  • 官方实现,有 ICLR 论文背书,算法可靠性较高。

不足之处

  • 早期项目,代码和文档不完善,上手门槛高。
  • 仅支持音频-视频联合生成,不支持纯视频或纯音频任务。
  • 文档/社区待观察

适用场景

  • 短视频自动配音和配乐,提升创作效率。
  • 电影预告片或广告片的快速原型制作。
  • 辅助视障人士理解视频内容,生成音频描述。

替代项目

VideoPoet、Make-A-Video、CogVideo

项目介绍

JavisDiT 是视频领域的开源项目,由 JavisVerse 开发,2025 年首次发布。

它收录于视频分类,该分类目前共有 472 个项目,GitHub 星标数为 382。

项目保持着较活跃的维护节奏,最近一次代码更新于 2026-09-08。Apache-2.0 许可证,可自由使用和部署,无付费版本。

它主要面向的使用场景是:短视频自动配音和配乐,提升创作效率。同类可对比的替代方案包括 VideoPoet、Make-A-Video、CogVideo。

上一篇:Matrix-Game

下一篇:Video-T1

同类项目推荐

MoneyPrinterTurbo 开源

输入一句话,高清短视频自动出炉,文案配音全包了

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···

★ 125106 2026-08-09
seedance-2.0-api 开源

快速上手字节Seedance 2.0,文本/图片一键生成视频

Seedance 2.0 API — text-to-video and image-to-video examples

★ 334 2026-08-26
openscreen 开源

免费无水印录屏做演示,替代 Screen Studio

Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···

★ 3185 2026-08-10
auto-subs 开源

在剪辑软件里直接生成字幕,省去导出导入的麻烦

On-device subtitle generation that connects directly to DaVinci Resolve, Premiere, a···

★ 4266 2026-08-10