rcm
开源
把视频扩散模型蒸馏成少步生成,快出视频不降质
rCM(Rectified Consistency Models)是一个专注于视频扩散模型蒸馏的开源项目,旨在将大规模视频扩···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
rcm
开源
把视频扩散模型蒸馏成少步生成,快出视频不降质
rCM(Rectified Consistency Models)是一个专注于视频扩散模型蒸馏的开源项目,旨在将大规模视频扩···
Code2Video
开源
把代码变成教学视频,自动生成讲解动画
Code2Video 是一个基于代码生成教学视频的开源项目,核心思路是将编程代码的执行过程转化为动态视频···
Sora-FullStack
开源
用文本或图片一键生成和编辑 AI 视频,支持语音克隆和多语言。
Sora-FullStack(SoraFlows)是一个基于 OpenAI Sora 模型的开源全栈 Web 应用,旨在让用户通过文本···
EvoWorld
开源
用3D记忆让AI生成的世界不穿帮,长视频场景稳如老狗。
EvoWorld 是一个基于显式 3D 记忆的渐进式全景世界生成框架,旨在解决长时程视频生成中场景一致性和···
cosmos-transfer2.5
开源
用多个空间条件精准控制视频生成,打造可控世界模拟。
Cosmos-Transfer2.5 是 NVIDIA 开源的视频生成模型,基于 Cosmos-Predict2.5 构建,专注于多空间控···
cosmos-predict2.5
开源
用视频预测未来世界,为机器人和自动驾驶提供模拟训练场
Cosmos-Predict2.5 是 NVIDIA 开源的视频生成模型,属于 Cosmos 世界基础模型(WFM)系列的最新版本···
VideoHub
开源
一句话驱动多平台视频下载、转写、配音到成片
VideoHub 是一款本地化多平台视频处理与智能剪辑工具,面向需要批量处理视频内容的创作者与运营者。···
VideoHighlighter
开源
本地离线分析视频,自动找高光、识物体、生成字幕
VideoHighlighter 是一个基于 Ollama 的本地 AI 视频分析工具,目标是让视频理解完全离线、免费运行···
Diff4Splat
开源
从单图生成可控动态 3D 场景,时空一致。
Diff4Splat 是一个面向可控 4D 场景生成的深度学习框架,基于潜在动态重建模型,支持从单张图像或视···
InfinityStar
开源
用自回归统一图像视频生成,告别扩散模型高成本
InfinityStar 是一个基于自回归模型的视觉生成框架,由 NeurIPS 2025 Oral 论文提出,核心思想是统···
Veo3-AI-Video-API
开源
用Veo 3和Sora生成视频,成本直降97%
这是一个AI视频生成API项目,旨在以极低成本(号称比官方低97%)提供Google Veo 3和OpenAI Sora的视···
ComeCut
开源
免费轻量剪视频,网页桌面都能用,自带字幕配音功能。
ComeCut(来剪)是一个轻量级视频编辑器,提供网页版和桌面版,完全免费使用。它的功能设计借鉴了 ···
muapi-comfyui
开源
在 ComfyUI 里一键调用 100+ 主流 AI 生成模型
muapi-comfyui 是 muapi.ai 官方推出的 ComfyUI 自定义节点插件,旨在将 100 多个主流 AI 模型无缝···
openstory
开源
用 AI 把文字脚本变成连贯视频序列
openstory 是一个基于 TanStack Start 构建的开源 AI 视频序列生成平台。它主要解决视频创作中脚本···
HunyuanWorld-Voyager
开源
上传视频,实时生成可交互 3D 场景
HunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决···
BLADE
开源
给视频生成提速:稀疏注意力+步数蒸馏,快数倍不降质。
BLADE 是一个面向视频生成的高效推理加速框架,核心思路是将块稀疏注意力(Block-Sparse Attention···
kandinsky-5
开源
用文本一键生成视频和图像,扩散模型新选择。
Kandinsky 5.0 是一个基于扩散模型的视频与图像生成项目,旨在提供高质量的多模态生成能力。它解决···
videoswarm
开源
海量视频一屏尽览,快速筛选不再头疼
VideoSwarm 是一个基于 Electron 和 React 构建的桌面端大规模视频数据集浏览工具。它采用瀑布流(···
Video-Generation-Paper-List
开源
一站式追踪视频生成前沿论文,紧跟技术趋势
这是一个视频生成领域的前沿论文追踪列表,持续收录CVPR、ICCV、ECCV、NeurIPS、ICLR等顶级会议及a···
Wan2.2
开源
输入一句话,高清视频直接生成
阿里开源的先进大规模视频生成模型 Wan2.2,基于新一代架构实现高质量文生视频与图生视频,在画面质···
ai-video-studio
开源
短剧团队一站式 AI 视频生产平台,时间线驱动,智能体协作出片
ai-video-studio 是一个面向专业短剧制作团队的 AI 视频生产工作流平台。它采用时间线优先的设计理···
fantasy-portrait
开源
让多角色肖像动起来,表情更自然
FantasyPortrait 是一个面向多人物肖像动画的视频生成开源项目,基于扩散变换器(Diffusion Transf···
YUME
开源
用世界模型实时生成可交互视频,从文本或图片秒变动态画面。
YUME 是一个基于世界模型的实时视频生成项目,官方代码库。它支持文本到视频和图像到视频的生成,强···
GeometryForcing
开源
给视频扩散装上3D骨架,生成时空一致的交互世界
GeometryForcing 是一个将视频扩散模型与 3D 表示相结合的统一世界建模框架,旨在解决视频生成中时···