4k-video-upscaler-colab
开源
免费 Colab 一键将视频提升至 4K 画质
这是一个基于 Google Colab 的免费视频超分辨率工具,利用 Real-ESRGAN 模型将视频提升至 4K 分辨率···
汇聚全球AI视频生成项目,文生视频、图生视频、AI剪辑,多维度数据助您选择。
共收录 478 个开源项目
4k-video-upscaler-colab
开源
免费 Colab 一键将视频提升至 4K 画质
这是一个基于 Google Colab 的免费视频超分辨率工具,利用 Real-ESRGAN 模型将视频提升至 4K 分辨率···
Ground-A-Video
开源
用一句话描述,让视频编辑像改图一样简单
Ground-A-Video 是一个基于扩散模型的零样本视频编辑工具,来自 ICLR 2024 论文。它解决了传统视频···
text2youtube
开源
输入文字,秒出 YouTube 视频,自动配音加字幕
text2youtube 是一个基于 Python 的开源工具,旨在将文本提示快速转化为完整的 YouTube 视频。它解···
sd-wav2lip-uhq
开源
在 Stable Diffusion WebUI 里一键生成高清唇形同步数字人视频
sd-wav2lip-uhq 是一个为 Automatic1111 Stable Diffusion WebUI 开发的扩展,旨在将 Wav2Lip 唇形···
VisionCrafter
开源
一句话生成图片、动画和配乐,让创意动起来
VisionCrafter 是一个基于 Python 的图像生成与动画创作工具,旨在将静态图像转化为动态视觉内容。···
Awesome-Video-Diffusion-Models
开源
一榜在手,视频扩散模型研究全览
这是一个关于视频扩散模型的精选资源列表,源自一篇发表在《计算机科学与技术评论》(CSUR)上的综···
TokenFlow
开源
用文本编辑视频,帧帧连贯不闪烁
TokenFlow 是 ICLR 2024 的官方 PyTorch 实现,用于实现基于扩散模型的视频编辑。它解决了文本到视···
awesome-ai-video-models
开源
一张表看懂所有AI视频模型,选型不纠结
这是一个关于AI视频生成模型的精选资源列表,旨在提供最完整、最新的模型对比信息。它系统性地整理···
Storyblocks
开源
输入文字提示,自动生成带画面的故事视频
Storyblocks 是一个结合 AI 文本生成与图像合成的开源项目,旨在将文字提示转化为带视觉叙事的视频···
AI-Infinite-Zoom-Generator
开源
把AI外绘画变成无限缩放视频,自动生成炫酷特效
AI-Infinite-Zoom-Generator 是一个将 AI 生成的向外扩展(outpainting)图像序列转换为“无限缩放···
ZoomVideoComposer
开源
把静态图片一键变成推拉镜头视频,适合AI绘画作品展示
ZoomVideoComposer 是一个用 Python 编写的脚本工具,旨在从一组静态图片自动生成具有推近(zoom i···
DepthFlow
开源
一张图生成可循环的3D视差运镜视频
DepthFlow 是一个把单张静态图片转成带 3D 视差效果的动态视频的开源工具。它先用深度估计模型为图···
awesome-seedance-2.5-api-prompts
开源
照着用,快速生成高质量 AI 视频
这是一个围绕字节跳动 Seedance 2.5 视频生成 API 的提示词与参数指南集合。它旨在帮助开发者快速上···
Open-AI-Micro-Drama-Generator
开源
输入创意,一键生成完整AI短剧视频
Open-AI-Micro-Drama-Generator 是一个基于多智能体流水线的 AI 短剧视频生成工具,能将任意创意自···
text2video
开源
输入文本,一键生成带语音和画面的视频
text2video 是一个基于 Python 的文本转视频工具,旨在通过简单的文本输入快速生成包含语音和画面的···
Seedance-2.5-API
开源
一行代码调用字节 Seedance 2.5,快速生成 4K 人物一致视频
Seedance-2.5-API 是一个针对字节跳动 Seedance 2.5 视频生成模型的 Python 封装库,旨在简化开发者···
SceneScape
开源
输入一句话,生成连贯不闪烁的场景视频
SceneScape 是一个基于 PyTorch 的文本驱动场景生成模型,核心目标是解决文本到视频生成中常见的时···
videocomposer
开源
像拼乐高一样组合条件,精准控制视频运动生成
VideoComposer 是一个基于扩散模型的视频合成框架,由阿里巴巴研究团队开发。它解决了传统视频生成···
Gen-L-Video
开源
用多文本拼接生成长视频,时间协同去噪无缝衔接
Gen-L-Video 是一个基于扩散模型的多文本到长视频生成与编辑的开源项目,对应论文《Gen-L-Video: M···
StoryGen
开源
输入故事文本,自动生成连贯图像序列
StoryGen 是一个基于潜在扩散模型的开源视觉故事生成系统,来自 CVPR 2024 论文。它解决的是如何根···
swiftube-frontend
开源
像聊天一样,用文字自动生成视频
swiftube-frontend 是一个基于 TypeScript 和 Next.js 构建的 AI 视频生成前端项目,旨在实现“视频···
Open-AI-UGC
开源
自建 AI 演员,批量生成 UGC 广告视频,省下外包费
Open-AI-UGC 是一个免费开源的 AI 视频广告生成工具,旨在替代 Arcads 和 MakeUGC 等商业平台。它通···
ControlVideo
开源
无需训练,用文本和结构图直接生成可控视频。
ControlVideo 是一个无需训练的文本生成视频方法,基于现有文本到图像扩散模型(如 Stable Diffusi···
MindVideo
开源
用脑电波重建你看到的视频,解码视觉体验
MinD-Video 是一个基于脑电信号(fMRI)的视频重建开源项目,旨在通过解码大脑视觉皮层活动来还原人···