视频

汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。

共收录 478 个开源项目

rcm 开源

把视频扩散模型蒸馏成少步生成,快出视频不降质

rCM(Rectified Consistency Models)是一个专注于视频扩散模型蒸馏的开源项目,旨在将大规模视频扩···

★ 811 评分 2025-10-09
Code2Video 开源

把代码变成教学视频,自动生成讲解动画

Code2Video 是一个基于代码生成教学视频的开源项目,核心思路是将编程代码的执行过程转化为动态视频···

★ 2072 评分 2025-09-29
Sora-FullStack 开源

用文本或图片一键生成和编辑 AI 视频,支持语音克隆和多语言。

Sora-FullStack(SoraFlows)是一个基于 OpenAI Sora 模型的开源全栈 Web 应用,旨在让用户通过文本···

★ 111 评分 2025-09-27
EvoWorld 开源

用3D记忆让AI生成的世界不穿帮,长视频场景稳如老狗。

EvoWorld 是一个基于显式 3D 记忆的渐进式全景世界生成框架,旨在解决长时程视频生成中场景一致性和···

★ 76 评分 2025-09-26
cosmos-transfer2.5 开源

用多个空间条件精准控制视频生成,打造可控世界模拟。

Cosmos-Transfer2.5 是 NVIDIA 开源的视频生成模型,基于 Cosmos-Predict2.5 构建,专注于多空间控···

★ 742 评分 2025-09-25
cosmos-predict2.5 开源

用视频预测未来世界,为机器人和自动驾驶提供模拟训练场

Cosmos-Predict2.5 是 NVIDIA 开源的视频生成模型,属于 Cosmos 世界基础模型(WFM)系列的最新版本···

★ 1373 评分 2025-09-25
VideoHub 开源

一句话驱动多平台视频下载、转写、配音到成片

VideoHub 是一款本地化多平台视频处理与智能剪辑工具,面向需要批量处理视频内容的创作者与运营者。···

★ 161 评分 2025-09-24
VideoHighlighter 开源

本地离线分析视频,自动找高光、识物体、生成字幕

VideoHighlighter 是一个基于 Ollama 的本地 AI 视频分析工具,目标是让视频理解完全离线、免费运行···

★ 136 评分 2025-09-19
Diff4Splat 开源

从单图生成可控动态 3D 场景,时空一致。

Diff4Splat 是一个面向可控 4D 场景生成的深度学习框架,基于潜在动态重建模型,支持从单张图像或视···

★ 125 评分 2025-09-09
InfinityStar 开源

用自回归统一图像视频生成,告别扩散模型高成本

InfinityStar 是一个基于自回归模型的视觉生成框架,由 NeurIPS 2025 Oral 论文提出,核心思想是统···

★ 787 评分 2025-09-08
Veo3-AI-Video-API 开源

用Veo 3和Sora生成视频,成本直降97%

这是一个AI视频生成API项目,旨在以极低成本(号称比官方低97%)提供Google Veo 3和OpenAI Sora的视···

★ 67 评分 2025-09-07
ComeCut 开源

免费轻量剪视频,网页桌面都能用,自带字幕配音功能。

ComeCut(来剪)是一个轻量级视频编辑器,提供网页版和桌面版,完全免费使用。它的功能设计借鉴了 ···

★ 597 评分 2025-09-06
muapi-comfyui 开源

在 ComfyUI 里一键调用 100+ 主流 AI 生成模型

muapi-comfyui 是 muapi.ai 官方推出的 ComfyUI 自定义节点插件,旨在将 100 多个主流 AI 模型无缝···

★ 72 评分 2025-09-05
openstory 开源

用 AI 把文字脚本变成连贯视频序列

openstory 是一个基于 TanStack Start 构建的开源 AI 视频序列生成平台。它主要解决视频创作中脚本···

★ 645 评分 2025-08-28
HunyuanWorld-Voyager 开源

上传视频,实时生成可交互 3D 场景

HunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决···

★ 1599 评分 2025-08-27
BLADE 开源

给视频生成提速:稀疏注意力+步数蒸馏,快数倍不降质。

BLADE 是一个面向视频生成的高效推理加速框架,核心思路是将块稀疏注意力(Block-Sparse Attention···

★ 53 评分 2025-08-14
kandinsky-5 开源

用文本一键生成视频和图像,扩散模型新选择。

Kandinsky 5.0 是一个基于扩散模型的视频与图像生成项目,旨在提供高质量的多模态生成能力。它解决···

★ 828 评分 2025-08-11
videoswarm 开源

海量视频一屏尽览,快速筛选不再头疼

VideoSwarm 是一个基于 Electron 和 React 构建的桌面端大规模视频数据集浏览工具。它采用瀑布流(···

★ 105 评分 2025-08-10
Video-Generation-Paper-List 开源

一站式追踪视频生成前沿论文,紧跟技术趋势

这是一个视频生成领域的前沿论文追踪列表,持续收录CVPR、ICCV、ECCV、NeurIPS、ICLR等顶级会议及a···

★ 171 评分 2025-08-06
Wan2.2 开源

输入一句话,高清视频直接生成

阿里开源的先进大规模视频生成模型 Wan2.2,基于新一代架构实现高质量文生视频与图生视频,在画面质···

★ 17641 评分 2025-07-28
ai-video-studio 开源

短剧团队一站式 AI 视频生产平台,时间线驱动,智能体协作出片

ai-video-studio 是一个面向专业短剧制作团队的 AI 视频生产工作流平台。它采用时间线优先的设计理···

★ 63 评分 2025-07-23
fantasy-portrait 开源

让多角色肖像动起来,表情更自然

FantasyPortrait 是一个面向多人物肖像动画的视频生成开源项目,基于扩散变换器(Diffusion Transf···

★ 511 评分 2025-07-17
YUME 开源

用世界模型实时生成可交互视频,从文本或图片秒变动态画面。

YUME 是一个基于世界模型的实时视频生成项目,官方代码库。它支持文本到视频和图像到视频的生成,强···

★ 684 评分 2025-07-14
GeometryForcing 开源

给视频扩散装上3D骨架,生成时空一致的交互世界

GeometryForcing 是一个将视频扩散模型与 3D 表示相结合的统一世界建模框架,旨在解决视频生成中时···

★ 226 评分 2025-07-14