DiffusionAsShader
开源
像写着色器一样控制视频生成,相机、物体、运动随心调
DiffusionAsShader 是 SIGGRAPH 2025 论文的官方实现,提出将视频扩散模型视为可编程着色器,实现 ···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
DiffusionAsShader
开源
像写着色器一样控制视频生成,相机、物体、运动随心调
DiffusionAsShader 是 SIGGRAPH 2025 论文的官方实现,提出将视频扩散模型视为可编程着色器,实现 ···
DrivingWorld
开源
用视频GPT生成驾驶世界模型,模拟未来路况
DrivingWorld 是一个面向自动驾驶场景的世界模型构建项目,基于视频 GPT 架构生成驾驶视频。它解决···
Promptus
开源
用提示词流替代视频流,极低带宽下传输视频
Promptus 是一个基于稳定扩散(Stable Diffusion)的通用语义视频通信框架,源自 AAAI Oral 论文。···
AiShortsVideosGenerator
开源
输入主题,自动生成带字幕的短视频,全程用免费资源。
这是一个基于 ASP.NET Core 和 Next.js 的全栈开源项目,用于自动生成带字幕的 AI 短视频。它整合了···
KrillinAI
开源
一键翻译配音,视频轻松出海
KrillinAI 是一个基于大语言模型的 AI 视频翻译与配音工具,面向个人用户和 AI Agent 提供完整的视···
NOVA
开源
扔掉向量量化,自回归直接生成流畅视频
NOVA 是一个面向图像与视频生成的自回归模型开源项目,核心创新在于摒弃了传统自回归生成中必需的向···
Kandinsky-4
开源
输入文字或图片,快速生成连贯视频,还自带音频。
Kandinsky-4 是俄罗斯团队开源的视频生成模型,支持文本生成视频和图像生成视频两种模式。它基于扩···
SynCamMaster
开源
输入几个视角,同步生成多路一致视频
SynCamMaster 是一个多视角同步视频生成框架,解决现有单视频生成模型无法在多个不同视角下生成内容···
Imagine360
开源
从普通视频一键生成沉浸式360度全景视频
Imagine360 是一个面向沉浸式 360 度视频生成的开源项目,发表于 NeurIPS 2025。它解决的是从普通视···
PhyT2V
开源
让AI生成的视频更懂物理规律,画面不再反常识
PhyT2V 是一个面向物理感知文本生成视频(Text-to-Video)的官方开源实现,对应 CVPR 2025 论文。它···
HunyuanVideo
开源
写个提示词,电影级视频马上出
腾讯混元出品的大规模视频生成模型系统框架,从数据、模型到训练全面优化,支持高质量文生视频,画···
TeaCache
开源
给视频生成模型装上加速器,推理速度翻倍,画质不掉线
TeaCache 是一个面向视频扩散模型的推理加速工具,通过缓存时间步嵌入来跳过冗余计算,从而在不明显···
VideoGrain
开源
用文本精细控制视频编辑,从风格到细节随心调
VideoGrain 是 ICLR 2025 论文的官方实现,专注于多粒度视频编辑。它基于 Stable Diffusion 和扩散···
ComfyUI-LTXVideo
开源
在 ComfyUI 里拖拽节点,轻松生成和编辑视频
ComfyUI-LTXVideo 是 ComfyUI 的官方插件,用于集成 LTX-Video 视频生成模型。LTX-Video 是 Lightr···
MagicDrive-V2
开源
用文本和轨迹,一键生成高分辨率多视角驾驶长视频
MagicDrive-V2 是 ICCV 2025 论文的官方实现,面向自动驾驶场景的高分辨率长视频生成模型。它解决现···
LTX-Video
开源
一句话或一张图,高清视频马上来
Lightricks 官方开源的 LTX-Video 视频生成模型仓库,基于 DiT 架构实现高质量文生视频与图生视频,···
Awesome-Efficient-Video-Generation
开源
一站式速览高效视频生成前沿方法,省时省力选型。
这是一个精选列表,收录了近期高效的视频生成方法。它旨在解决视频生成领域计算成本高、推理速度慢···
ConsisID
开源
输入文本和一张人脸,生成身份一致的视频。
ConsisID 是一个面向身份保持的文本到视频生成模型,由 CVPR 2025 Highlight 论文提出。它解决的是···
MikuDance
开源
上传一张角色图,轻松生成自然流畅的动画视频
MikuDance 是一个基于扩散模型的角色动画生成工具,专注于将静态角色艺术图(如插画、立绘)转化为···
openscenesense-ollama
开源
本地跑AI,轻松分析视频画面和声音
OpenSceneSense Ollama 是一个基于 Python 的本地视频分析库,它利用 Ollama 运行的开源 AI 模型,···
AdaCache
开源
让视频生成提速,按内容智能跳过冗余计算
AdaCache 是 ICCV 2025 论文的官方代码,针对视频生成扩散 Transformer(DiT)推理速度慢的问题,提···
Video-Generator-AI
开源
输入一句话,自动生成完整视频,营销教育都能用
这是一个基于 Next.js 的视频生成 SaaS 平台,用户只需输入文字描述,即可自动生成营销、教育或社交···
DAWN-pytorch
开源
用扩散模型快速生成动态说话头视频,告别卡顿和误差累积
DAWN-pytorch 是论文《Dynamic Frame Avatar with Non-autoregressive Diffusion Framework》的官方···
Pyramid-Flow
开源
用金字塔流匹配,让视频生成又快又清晰
Pyramid-Flow 是一个基于流匹配的高效视频生成开源项目,由快手科技提出,论文发表于 ICLR 2025。它···