video-generation
本站收录 471 个带「video-generation」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)
OpenMontage全球首个开源的智能体视频制作系统,提供 12 条生产流水线、100 余种工具以及 700 多个智能体技能与制作知识文件。可将 AI 编程助手转化为完整的视频生产★ 61,862
LivePortrait快手开源的人像驱动技术,让静态照片“活”起来。基于单张人像即可生成自然流畅的说话、表情与头部动作视频,广泛应用于数字人、直播互动与影视特效,效果生动逼真。★ 19,132
Wan2.2阿里开源的先进大规模视频生成模型 Wan2.2,基于新一代架构实现高质量文生视频与图生视频,在画面质感、运动连贯性与语义理解上表现出色,为开发者与创作者提供强大★ 17,665
hypithypit 是一个用 TypeScript 编写的开源视频生成工具,目标是把爆款视频的完整制作流程交给 AI 代理自动完成。它不只是生成脚本,而是覆盖换脸、改写★ 17,185
Toonflow-app开源的一站式 AI 短剧创作工具,可将小说、剧本快速转化为动画短剧,集成 AI 编剧、智能分镜、角色与视频生成等能力,跨平台桌面端轻量部署,助力创作者低成本批量★ 16,224
waoowaoo行业首个工业级全流程 AI 影视生产平台,以专业 AI Agent 驱动可控的电影与视频制作,覆盖从短视频到真人影视的完整流程,采用好莱坞标准的工业化工作流,为★ 14,320
CogVideo智谱开源的文字与图像生成视频系列模型,包含 2024 年发布的 CogVideoX 与 ICLR 2023 收录的 CogVideo,同时支持文生视频与图生视频★ 13,048
HunyuanVideo腾讯混元出品的大规模视频生成模型系统框架,从数据、模型到训练全面优化,支持高质量文生视频,画面细腻、语义对齐准确,为开源视频生成领域树立了重要标杆。★ 12,576
ViMax智能体驱动的视频生成框架,将导演、编剧、制片人与视频生成器集于一体,通过多智能体协同完成从创意策划到成片生成的全流程,实现真正可控、可编排的视频创作体验。★ 12,527
KrillinAIKrillinAI 是一个基于大语言模型的 AI 视频翻译与配音工具,面向个人用户和 AI Agent 提供完整的视频本地化流水线,涵盖下载、转录、翻译、TTS★ 12,511
video-shotcraft面向 Claude Code 与 Codex 的 AI 视频技能包,基于 Remotion 制作电影级产品视频,内置 106 张分镜配方卡片与 161 个动效预★ 9,927
SanaNVIDIA 开源的高效高分辨率图像合成模型,采用线性 Diffusion Transformer 架构,在保持高质量生成的同时显著降低计算开销,支持超高清图像★ 9,163
vllm-omni面向全模态模型的统一高效推理框架,支持文本、图像、视频、音频等多种模态的高性能推理,延续 vLLM 的工程优势,为多模态大模型应用提供稳定快速的部署方案。★ 7,135
dramaclaw通用 AIGC 视频引擎,以一条流水线打通从剧本到成片的全部环节,支持漫剧、广告、产品视频、乙女游戏等内容形态,帮助创作者低成本、高效率地将创意转化为完整影视作★ 6,583
Awesome-Video-DiffusionAwesome-Video-Diffusion 是一个精心整理的视频扩散模型资源列表,聚焦于视频生成、编辑及相关应用。项目将近年来涌现的扩散模型按用途分类收录,★ 5,789
ArcReelAI Agent 驱动的开源可自部署视频工作台,可将小说与剧本转化为角色、场景、道具资产、分镜、视频及剪映草稿,支持跨镜头一致性、多供应商接入与费用追踪,让短剧★ 5,237
VideoCrafter高质量视频扩散模型 VideoCrafter2,通过创新的训练策略有效克服数据稀缺问题,在有限数据下依然能生成清晰流畅、运动自然的高质量视频,为视频生成研究提供★ 5,085
echomimic_v2蚂蚁集团开源的半身人像动画生成模型(CVPR 2025),在 EchoMimic 基础上实现更自然、更简化的半身人体动画,支持音频驱动的说话与动作同步,效果生动★ 4,659
html-video面向编程智能体的程序化视频生成工具,可在本地将 HTML、CSS 与数据直接渲染为 MP4 视频,内置 21 套模板与可插拔渲染引擎,支持 AI 配乐,Apac★ 4,625
HunyuanVideo-1.5腾讯混元推出的领先轻量级视频生成模型,在保持高画质的前提下大幅压缩模型规模与推理成本,支持高效文生视频,适合资源受限环境下的部署与应用。★ 4,564
FastVideo统一的视频生成加速框架,将推理与后训练(post-training)流程整合一体,通过高效优化实现更快的视频生成速度,降低训练与推理成本,适合研究团队与工程部署★ 4,521
lingbot-world致力于推进开源世界模型的前沿项目,通过大规模数据与先进架构构建可泛化的世界模型,助力视频生成、仿真与具身智能等方向的研究与应用发展。★ 4,494
champChamp是一个基于3D参数化引导的可控且一致的人体图像动画生成框架,由ECCV 2024收录。它解决的是从单张静态人物图片和动作序列生成逼真、连贯的人体动画视★ 4,265
Text2Video-ZeroText2Video-Zero 是 ICCV 2023 Oral 论文的官方实现,核心思路是利用预训练的文生图扩散模型(如 Stable Diffusion)直★ 4,244
VACEVACE 是一个基于扩散模型的全能视频生成与编辑框架,由腾讯等机构在 ICCV 2025 论文中提出。它解决的核心问题是:当前视频生成模型往往只能完成单一任务(★ 3,957
SageAttention清华开源的量化注意力算子,相较 FlashAttention 可实现 2~5 倍加速,在语言、图像与视频模型上均保持端到端指标不损失,被 ICLR 2025、I★ 3,953
youtube-automation-agent这是一个基于AI代理的YouTube频道全自动管理工具,能24/7自动完成视频的创建、优化和发布流程。它解决了内容创作者需要持续产出视频但时间精力有限的问题,核★ 3,928
PersonaLive面向直播场景的表情丰富人像动画生成技术(CVPR 2026),以单张人像照片驱动生动自然的说话与表情动画,专注实时直播应用,让静态形象拥有媲美真人的表现力。★ 3,859
TurboDiffusion面向视频扩散模型的极致加速方案,通过蒸馏与优化实现 100~200 倍推理加速,在保持生成质量的同时大幅缩短出片时间,让高质量视频生成从离线走向实时成为可能。★ 3,850
MAGI-1自回归视频生成大模型 MAGI-1,采用规模化自回归范式直接生成视频,无需扩散过程,在长视频生成与效率上展现出独特优势,为视频生成技术路线提供了全新选择。★ 3,791
awesome-generative-ai-apps这是一个精选的开源生成式 AI 应用合集,收录了 50 多个可直接克隆、部署并商业化的项目,涵盖图像生成、视频工具、虚拟试穿、AI SaaS 模板及平台集成等类★ 3,347
Pyramid-FlowPyramid-Flow 是一个基于流匹配的高效视频生成开源项目,由快手科技提出,论文发表于 ICLR 2025。它针对现有视频扩散模型推理速度慢、计算成本高的★ 3,212
InternGPTInternGPT(iGPT)是一个开源的AI模型演示平台,旨在让开发者轻松展示和交互体验多种前沿AI模型。它集成了DragGAN、ChatGPT、ImageB★ 3,206
DynamiCrafterDynamiCrafter 是一个基于视频扩散先验的开源图像动画工具,能将静态图片转换为动态视频。它解决了开放域图像动画中运动幅度小、动态性不足的问题,通过利用★ 3,008
ResearchStudioResearchStudio 是一个面向科研人员的 AI 协同创作平台,旨在将研究从问题定义到最终发表的整个流程自动化。它集成了想法生成、博客撰写、海报设计、演★ 2,955
LightX2VLightX2V 是一个轻量级的图像到视频(I2V)动作生成推理框架,专注于降低视频生成模型的使用门槛。它解决了现有视频生成工具依赖复杂环境、推理速度慢、资源占★ 2,867
MuseVMuseV 是一个基于扩散模型的开源虚拟人视频生成框架,专注于生成无限长度、高保真的虚拟人视频。它解决了传统视频生成中时长受限、动作不连贯、身份不一致等问题,核★ 2,843
MimicMotionMimicMotion 是一个高质量人体运动视频生成工具,基于扩散模型,通过置信度感知的姿态引导来生成逼真的人物动作视频。它解决了传统姿态驱动视频生成中动作不自★ 2,668
LongLiveLongLive 是一个面向长视频生成的基础设施项目,旨在解决当前视频生成模型在生成长序列视频时面临的显存不足、计算效率低下和推理延迟高等问题。它通过并行化、模★ 2,647
Matrix-GameMatrix-Game 是一个实时流式交互式世界模型,旨在解决长时程视频生成中的记忆与交互问题。它基于Genie架构,支持生成超过10分钟的长视频,并能在生成过★ 2,342
anything2explaineranything2explainer 是一个 Claude Code / Codex 技能,输入任意主题,输出带旁白解说的科普视频。它用 Remotion 在代★ 2,200
HeliosHelios 是一个专注于实时长视频生成的扩散模型开源项目,旨在解决当前视频生成模型推理速度慢、生成时长受限的问题。它支持图像到视频(image-to-vide★ 2,176
vox-directorvox-director 是一个自动化生成 Vox 风格纸板拼贴解说视频的开源项目。它接受一个主题,通过 Atlas Cloud 和 ffmpeg 完成从脚本撰★ 2,096
Code2VideoCode2Video 是一个基于代码生成教学视频的开源项目,核心思路是将编程代码的执行过程转化为动态视频,用于教学演示或技术讲解。它通过多智能体协作,解析代码逻★ 2,090
awesome-seedance-2-prompts这是一个专注于 Seedance 2.0 视频生成模型的提示词精选集,收录了超过 2000 条精心策划的提示词,覆盖电影感、动漫、UGC、广告和表情包等多种风格★ 2,061
LocalMiniDramaLocalMiniDrama 是一款开源的本地 AI 短剧与漫剧生成工具,旨在让创作者在完全离线、数据不出本机的环境下,一站式完成从故事构思、分镜设计到视频成片★ 1,898
ReCamMasterReCamMaster 是一个基于单段视频的相机控制生成式渲染工具,核心解决视频重渲染中相机视角无法自由控制的问题。它利用 4D 场景表示和生成式模型,从输入视★ 1,879
locally-uncensoredLocally Uncensored 是一个即插即用的本地 AI 工作室,旨在解决云端 AI 的隐私泄露和内容审查问题。它集成了无审查的聊天、图像生成、视频生成★ 1,847