image-to-video

本站收录 70 个带「image-to-video」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

Open-Generative-AI不受限制的开源 AI 图像与视频生成平台,集成 Flux、Midjourney、Kling、Sora、Veo 等 500+ 模型,无内容过滤、可自托管,MIT ★ 29,398Toonflow-app开源的一站式 AI 短剧创作工具,可将小说、剧本快速转化为动画短剧,集成 AI 编剧、智能分镜、角色与视频生成等能力,跨平台桌面端轻量部署,助力创作者低成本批量★ 16,224CogVideo智谱开源的文字与图像生成视频系列模型,包含 2024 年发布的 CogVideoX 与 ICLR 2023 收录的 CogVideo,同时支持文生视频与图生视频★ 13,048LTX-VideoLightricks 官方开源的 LTX-Video 视频生成模型仓库,基于 DiT 架构实现高质量文生视频与图生视频,支持实时生成与可控编辑,为视频创作者提供★ 10,995dramaclaw通用 AIGC 视频引擎,以一条流水线打通从剧本到成片的全部环节,支持漫剧、广告、产品视频、乙女游戏等内容形态,帮助创作者低成本、高效率地将创意转化为完整影视作★ 6,583ArcReelAI Agent 驱动的开源可自部署视频工作台,可将小说与剧本转化为角色、场景、道具资产、分镜、视频及剪映草稿,支持跨镜头一致性、多供应商接入与费用追踪,让短剧★ 5,237VideoCrafter高质量视频扩散模型 VideoCrafter2,通过创新的训练策略有效克服数据稀缺问题,在有限数据下依然能生成清晰流畅、运动自然的高质量视频,为视频生成研究提供★ 5,085HunyuanVideo-1.5腾讯混元推出的领先轻量级视频生成模型,在保持高画质的前提下大幅压缩模型规模与推理成本,支持高效文生视频,适合资源受限环境下的部署与应用。★ 4,564lingbot-world致力于推进开源世界模型的前沿项目,通过大规模数据与先进架构构建可泛化的世界模型,助力视频生成、仿真与具身智能等方向的研究与应用发展。★ 4,494ComfyUI-LTXVideoComfyUI-LTXVideo 是 ComfyUI 的官方插件,用于集成 LTX-Video 视频生成模型。LTX-Video 是 Lightricks 推出★ 4,146DynamiCrafterDynamiCrafter 是一个基于视频扩散先验的开源图像动画工具,能将静态图片转换为动态视频。它解决了开放域图像动画中运动幅度小、动态性不足的问题,通过利用★ 3,008HeliosHelios 是一个专注于实时长视频生成的扩散模型开源项目,旨在解决当前视频生成模型推理速度慢、生成时长受限的问题。它支持图像到视频(image-to-vide★ 2,176ai-moive-studioai-moive-studio(AICON)是一个自然语言驱动的无限画布工作流 Agent,面向 AI 视频创作者。它解决的核心问题是:现有 AI 视频工具大多★ 1,600HunyuanWorld-VoyagerHunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决了从普通视频中实时重建 3D 场景的★ 1,599MiniMax-MCPMiniMax-MCP 是 MiniMax 官方推出的 Model Context Protocol (MCP) 服务器,旨在将 MiniMax 的多模态生成能★ 1,584DepthFlowDepthFlow 是一个把单张静态图片转成带 3D 视差效果的动态视频的开源工具。它先用深度估计模型为图片生成深度图,再根据深度信息对画面做分层位移与透视变换★ 1,548HunyuanCustomHunyuanCustom 是一个基于多模态驱动的定制化视频生成架构,旨在解决现有视频生成模型难以对特定主体进行个性化控制的问题。它通过融合音频、图像和文本等多★ 1,229PIAPIA 是一个基于扩散模型的个性化图像动画生成工具,来自 CVPR 2024。它解决的核心问题是:如何将一张静态图片,通过简单的文本提示词,变成一段连贯、生动的★ 973SEINESEINE 是一个基于扩散模型的视频生成工具,专注于短片段到长视频的生成,以及视频之间的平滑过渡。它解决了现有视频生成模型难以生成连贯长视频和实现视频间自然转场★ 966lingbot-videolingbot-video 是一个面向具身智能的视频生成预训练项目,核心思路是用混合专家(MoE)架构扩展视频预训练规模。它解决的是机器人或智能体在真实世界中缺★ 964FancyVideoFancyVideo 是一个早期的视频生成开源项目,支持从文本和图像生成视频,属于第一代此类工具。它主要解决用户快速将文字描述或静态图片转化为动态视频片段的需求★ 919Text-To-Video-AIText-To-Video-AI 是一个基于 AI 的文本转视频生成工具,旨在帮助用户通过简单的文字描述快速生成视频内容。它解决了传统视频制作门槛高、耗时长的痛★ 834Matrix-3DMatrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全景视频,让用户能够在虚拟 3D 空间中自由漫游。该项目★ 833diffusion-forcing-transformerdiffusion-forcing-transformer 是 ICML 2025 论文《History-Guided Video Diffusion》的官方 ★ 710YUMEYUME 是一个基于世界模型的实时视频生成项目,官方代码库。它支持文本到视频和图像到视频的生成,强调交互式与实时生成能力。项目旨在解决传统视频生成速度慢、缺乏交★ 683Google-Colab_Notebooks这是一个汇集多种 Google Colab 笔记本的开源项目,专注于图像生成与视频生成领域。项目整合了多个前沿模型和工具,如 ComfyUI 工作流、Flux ★ 533Open-AI-Micro-Drama-GeneratorOpen-AI-Micro-Drama-Generator 是一个基于多智能体流水线的 AI 短剧视频生成工具,能将任意创意自动转化为完整的短剧视频。它模拟影视★ 519AI-Faceless-Video-GeneratorAI-Faceless-Video-Generator 是一个基于 Jupyter Notebook 的开源工具,旨在通过 AI 全自动生成无脸视频(如短视频、★ 508CVPR23_LFDMCVPR23_LFDM 是 CVPR 2023 论文《Conditional Image-to-Video Generation with Latent Flo★ 470agnes-video-generatoragnes-video-generator 是一个开源、可自托管的 AI 视频生成工具,完全免费。它通过 Web UI 将文本转换为多场景视频,并自动添加旁白、★ 431ltx-video-macltx-video-mac 是一个专为 Apple Silicon Mac 设计的原生 AI 视频生成应用,基于 LTX-Video 模型,支持文本生成视频和图★ 422awesome-seedance-2.5-guide这是一个关于字节跳动 Seedance 2.5 视频生成模型的非官方指南仓库,整理了 36 个官方媒体素材,并保留了 Seedance 2 的旧版指南。项目主要★ 409physgenPhysGen 是一个基于物理模拟的图像到视频生成项目,来自 ECCV 2024。它主要解决现有图像动画方法生成的视频缺乏真实物理交互的问题,比如物体运动不符合★ 353HunyuanPortraitHunyuanPortrait 是腾讯混元团队开源的肖像动画框架,核心解决传统肖像驱动中显式条件(如关键点、深度图)控制粒度不足的问题。它提出隐式条件控制机制,★ 351sdk这是一个面向视频生成场景的TypeScript SDK,核心思路是用JSX语法来声明式地描述视频内容,然后通过统一API接入Kling、Flux、ElevenL★ 340Open-AI-UGCOpen-AI-UGC 是一个免费开源的 AI 视频广告生成工具,旨在替代 Arcads 和 MakeUGC 等商业平台。它通过 Veo 3.1、Seedanc★ 336seedance-2.0-apiSeedance 2.0 API 是字节跳动推出的视频生成模型 Seedance 2.0 的非官方 API 示例项目,主要提供文本生成视频(text-to-vi★ 332awesome-seedance-2.5-api-prompts这是一个围绕字节跳动 Seedance 2.5 视频生成 API 的提示词与参数指南集合。它旨在帮助开发者快速上手 Seedance 2.5,通过提供结构化的提★ 318ComfyUI-MiniMaxH3-DirectorComfyUI-MiniMaxH3-Director 是一个专为 MiniMax H3 视频生成模型设计的 ComfyUI 时间轴编辑器节点。它解决了在 Com★ 301HunyuanPortraitLCMHunyuanPortraitLCM 是腾讯混元团队开源的肖像动画生成框架,对应 CVPR 2025 论文。它解决传统肖像动画中条件控制不精确、生成速度慢的问题★ 290openjourneyopenjourney 是一个开源的 MidJourney 网页界面克隆项目,基于 Google Gemini SDK 实现真实的 AI 图像与视频生成能力。它★ 269VideoGen-EvalVideoGen-Eval 是一个基于智能体的视频生成评估系统,旨在解决视频生成模型评测标准缺失、评估维度单一的问题。它提供了一套完整的评估框架,支持文本到视频★ 269Echo-MemoryEcho-Memory 是一个用于视频世界模型研究的简单基线项目,核心思路是引入显式记忆机制来提升视频生成的时间连贯性与物理合理性。它解决的是当前视频生成模型在★ 253PhosphenePhosphene 是一个专为 Apple Silicon 设计的本地生成视频面板,它封装了 LTX-2 MLX 模型,支持联合音频与视频生成,并提供一键式 P★ 240gflow-cligflow-cli 是一个用 Python 编写的命令行工具,把 Google Flow 的 Veo 视频生成和 Imagen 图像生成能力搬到终端里。它解决的★ 237OpenS2V-NexusOpenS2V-Nexus 是 NeurIPS 2025 D&B 收录的百万级主体到视频生成(Subject-to-Video)基准与数据集项目。它解决当前视频★ 231vox-ai-motion-graphics-generator这是一个为编程代理(如 Claude Code、Codex)设计的智能体技能,能将任意主题自动转化为 Vox 风格的纸拼贴解释视频。它解决了从脚本到成片全流程自★ 225ComfyUI-fal-APIComfyUI-fal-API 是一个将 fal.ai 平台 1400+ 生成式 AI 模型接入 ComfyUI 的官方自定义节点插件。它解决了 ComfyUI★ 220awesome-seedance-2.5-prompts-skills这是一个围绕字节跳动 Seedance 2.5 视频生成模型的中文提示词资源库与智能体技能包。项目收录了 100 多条经过验证的提示词,每条都附带真实视频预览,★ 217LivePhotoLivePhoto 是论文《LivePhoto: Real Image Animation with Text-guided Motion Control》的官★ 206