text-to-video-generation

本站收录 23 个带「text-to-video-generation」标签的 AI 开源项目

LTX-VideoLightricks 官方开源的 LTX-Video 视频生成模型仓库,基于 DiT 架构实现高质量文生视频与图生视频,支持实时生成与可控编辑,为视频创作者提供★ 10,995AIComicBuilderAIComicBuilder 是一个基于 TypeScript 构建的 AI 动画漫画生成器,旨在将文字脚本自动转化为完整的动画视频。它解决了从创意到成片过程中★ 1,885Hotshot-XLHotshot-XL 是一个基于 Stable Diffusion XL 的文本生成 GIF 模型,由 Hotshot 团队开发。它解决了文本到动态图像生成的问★ 1,112MotionDirectorMotionDirector 是 ECCV 2024 Oral 论文的开源实现,专注于文本到视频扩散模型的运动定制。它解决的是现有视频生成模型难以精确控制动作、★ 1,055Causal-ForcingCausal-Forcing 是 ICML 2026 论文的官方代码库,提出了一种自回归扩散模型的蒸馏方法,旨在实现高质量、实时的交互式视频生成。它解决了传统扩★ 983brainrot.jsbrainrot.js 是一个将文本转换为视频的生成器,专门生成“脑腐”风格的短视频。它允许用户选择喜欢的“名人”风格,通过自动化流程将学习内容转化为有趣的短视★ 958Text-To-Video-AIText-To-Video-AI 是一个基于 AI 的文本转视频生成工具,旨在帮助用户通过简单的文字描述快速生成视频内容。它解决了传统视频制作门槛高、耗时长的痛★ 834awesome-video-generation这是一个精选视频生成研究资源的列表,收录了文本到视频生成、视频编辑、视频预测等领域的重要论文、代码和数据集。项目以分类整理的方式,帮助研究者快速了解视频生成技术★ 786AI-Faceless-Video-GeneratorAI-Faceless-Video-Generator 是一个基于 Jupyter Notebook 的开源工具,旨在通过 AI 全自动生成无脸视频(如短视频、★ 508Awesome_Matching_Pretraining_Transfering这是一个精选论文列表项目,收录了大型多模态模型(LMM)在感知、生成、统一方面的前沿研究,同时覆盖参数高效微调(PEFT)、视觉-语言预训练(VLP)以及传统图★ 446Clip-AnythingClip-Anything 是一个基于提示词(prompts)从任意视频中智能剪辑精彩片段的开源工具。它解决了传统视频剪辑中人工筛选素材耗时费力的问题,用户只需★ 299YoLuster-shortsYoLuster Shorts 釉光影是一个独立开发的 AI 短剧创作工作台,覆盖从创意构思、分镜脚本、图像生成到视频合成的全流程,并支持可复用素材管理。它通过★ 289VideoTetrisVideoTetris 是 NeurIPS 2024 收录的组合式文生视频框架,解决现有模型难以生成包含多个对象、动作和场景的复杂视频问题。它通过将视频生成分解★ 237OpenS2V-NexusOpenS2V-Nexus 是 NeurIPS 2025 D&B 收录的百万级主体到视频生成(Subject-to-Video)基准与数据集项目。它解决当前视频★ 231VidProMVidProM 是 NeurIPS 2024 发布的大规模真实提示词数据集,专为文本到视频扩散模型设计。它包含百万级真实用户提示词,解决了当前视频生成领域缺乏高★ 188LLM-groundedVideoDiffusionLLM-grounded Video Diffusion (LVD) 是 ICLR 2024 的官方实现,旨在解决文本到视频生成中语义对齐和时序一致性问题。它利★ 173Video-Generation-Paper-List这是一个视频生成领域的前沿论文追踪列表,持续收录CVPR、ICCV、ECCV、NeurIPS、ICLR等顶级会议及arXiv上的最新研究成果。项目按研究方向(如★ 171VideoElevatorVideoElevator 是一个无需训练的视频生成质量提升方法,发表于 AAAI 2025。它利用现成的文本到图像扩散模型来增强视频生成效果,解决了当前视频生★ 163MaskUnetMaskUnet 是 CVPR 2025 的官方 PyTorch 实现,针对扩散模型提出一种参数掩码策略。核心思想是并非所有参数对生成同等重要,通过训练中动态掩★ 158Awesome-Efficient-Video-Generation这是一个精选列表,收录了近期高效的视频生成方法。它旨在解决视频生成领域计算成本高、推理速度慢的问题,通过整理和分类相关的研究论文、开源代码和工具,帮助研究者和开★ 74Open-PhyGDPOOpen-PhyGDPO 是一个面向文本生成视频(T2V)任务的物理一致性优化框架,核心方法是物理感知的分组直接偏好优化(PhyGDPO)。它解决的是现有视频生★ 73CassetteCassette 是一个用于自动生成 30 秒竖屏解说视频的开源 Python 工具,专为 Instagram Reels 和 YouTube Shorts 等★ 71MojitoMojito 是一个面向视频生成的可控运动轨迹与强度控制的开源项目,源自同名论文。它解决的是现有文本生成视频模型中,用户难以精确控制画面中物体运动方向和幅度的问★ 62