视频

汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。

共收录 478 个开源项目

DiffusionAsShader 开源

像写着色器一样控制视频生成,相机、物体、运动随心调

DiffusionAsShader 是 SIGGRAPH 2025 论文的官方实现,提出将视频扩散模型视为可编程着色器,实现 ···

★ 840 评分 2025-01-07
DrivingWorld 开源

用视频GPT生成驾驶世界模型,模拟未来路况

DrivingWorld 是一个面向自动驾驶场景的世界模型构建项目,基于视频 GPT 架构生成驾驶视频。它解决···

★ 245 评分 2024-12-25
Promptus 开源

用提示词流替代视频流,极低带宽下传输视频

Promptus 是一个基于稳定扩散(Stable Diffusion)的通用语义视频通信框架,源自 AAAI Oral 论文。···

★ 95 评分 2024-12-21
AiShortsVideosGenerator 开源

输入主题,自动生成带字幕的短视频,全程用免费资源。

这是一个基于 ASP.NET Core 和 Next.js 的全栈开源项目,用于自动生成带字幕的 AI 短视频。它整合了···

★ 55 评分 2024-12-20
KrillinAI 开源

一键翻译配音,视频轻松出海

KrillinAI 是一个基于大语言模型的 AI 视频翻译与配音工具,面向个人用户和 AI Agent 提供完整的视···

★ 12403 评分 2024-12-17
NOVA 开源

扔掉向量量化,自回归直接生成流畅视频

NOVA 是一个面向图像与视频生成的自回归模型开源项目,核心创新在于摒弃了传统自回归生成中必需的向···

★ 660 评分 2024-12-16
Kandinsky-4 开源

输入文字或图片,快速生成连贯视频,还自带音频。

Kandinsky-4 是俄罗斯团队开源的视频生成模型,支持文本生成视频和图像生成视频两种模式。它基于扩···

★ 150 评分 2024-12-08
SynCamMaster 开源

输入几个视角,同步生成多路一致视频

SynCamMaster 是一个多视角同步视频生成框架,解决现有单视频生成模型无法在多个不同视角下生成内容···

★ 699 评分 2024-12-06
Imagine360 开源

从普通视频一键生成沉浸式360度全景视频

Imagine360 是一个面向沉浸式 360 度视频生成的开源项目,发表于 NeurIPS 2025。它解决的是从普通视···

★ 189 评分 2024-12-03
PhyT2V 开源

让AI生成的视频更懂物理规律,画面不再反常识

PhyT2V 是一个面向物理感知文本生成视频(Text-to-Video)的官方开源实现,对应 CVPR 2025 论文。它···

★ 67 评分 2024-11-29
HunyuanVideo 开源

写个提示词,电影级视频马上出

腾讯混元出品的大规模视频生成模型系统框架,从数据、模型到训练全面优化,支持高质量文生视频,画···

★ 12572 评分 2024-11-28
TeaCache 开源

给视频生成模型装上加速器,推理速度翻倍,画质不掉线

TeaCache 是一个面向视频扩散模型的推理加速工具,通过缓存时间步嵌入来跳过冗余计算,从而在不明显···

★ 1380 评分 2024-11-27
VideoGrain 开源

用文本精细控制视频编辑,从风格到细节随心调

VideoGrain 是 ICLR 2025 论文的官方实现,专注于多粒度视频编辑。它基于 Stable Diffusion 和扩散···

★ 159 评分 2024-11-23
ComfyUI-LTXVideo 开源

在 ComfyUI 里拖拽节点,轻松生成和编辑视频

ComfyUI-LTXVideo 是 ComfyUI 的官方插件,用于集成 LTX-Video 视频生成模型。LTX-Video 是 Lightr···

★ 4141 评分 2024-11-21
MagicDrive-V2 开源

用文本和轨迹,一键生成高分辨率多视角驾驶长视频

MagicDrive-V2 是 ICCV 2025 论文的官方实现,面向自动驾驶场景的高分辨率长视频生成模型。它解决现···

★ 728 评分 2024-11-21
LTX-Video 开源

一句话或一张图,高清视频马上来

Lightricks 官方开源的 LTX-Video 视频生成模型仓库,基于 DiT 架构实现高质量文生视频与图生视频,···

★ 10987 评分 2024-11-20
Awesome-Efficient-Video-Generation 开源

一站式速览高效视频生成前沿方法,省时省力选型。

这是一个精选列表,收录了近期高效的视频生成方法。它旨在解决视频生成领域计算成本高、推理速度慢···

★ 74 评分 2024-11-16
ConsisID 开源

输入文本和一张人脸,生成身份一致的视频。

ConsisID 是一个面向身份保持的文本到视频生成模型,由 CVPR 2025 Highlight 论文提出。它解决的是···

★ 861 评分 2024-11-15
MikuDance 开源

上传一张角色图,轻松生成自然流畅的动画视频

MikuDance 是一个基于扩散模型的角色动画生成工具,专注于将静态角色艺术图(如插画、立绘)转化为···

★ 186 评分 2024-11-08
openscenesense-ollama 开源

本地跑AI,轻松分析视频画面和声音

OpenSceneSense Ollama 是一个基于 Python 的本地视频分析库,它利用 Ollama 运行的开源 AI 模型,···

★ 53 评分 2024-11-04
AdaCache 开源

让视频生成提速,按内容智能跳过冗余计算

AdaCache 是 ICCV 2025 论文的官方代码,针对视频生成扩散 Transformer(DiT)推理速度慢的问题,提···

★ 173 评分 2024-10-31
Video-Generator-AI 开源

输入一句话,自动生成完整视频,营销教育都能用

这是一个基于 Next.js 的视频生成 SaaS 平台,用户只需输入文字描述,即可自动生成营销、教育或社交···

★ 111 评分 2024-10-28
DAWN-pytorch 开源

用扩散模型快速生成动态说话头视频,告别卡顿和误差累积

DAWN-pytorch 是论文《Dynamic Frame Avatar with Non-autoregressive Diffusion Framework》的官方···

★ 233 评分 2024-10-14
Pyramid-Flow 开源

用金字塔流匹配,让视频生成又快又清晰

Pyramid-Flow 是一个基于流匹配的高效视频生成开源项目,由快手科技提出,论文发表于 ICLR 2025。它···

★ 3212 评分 2024-10-06