autoregressive
本站收录 10 个带「autoregressive」标签的 AI 开源项目
MAGI-1自回归视频生成大模型 MAGI-1,采用规模化自回归范式直接生成视频,无需扩散过程,在长视频生成与效率上展现出独特优势,为视频生成技术路线提供了全新选择。★ 3,791
Autoregressive-Models-in-Vision-Survey这是一份关于视觉自回归模型(AR models)的综述论文项目,发表于TMLR 2025。它系统梳理了自回归模型在计算机视觉领域的研究进展,涵盖图像生成、视频预★ 808
Awesome-Video-World-Models-with-AR-Diffusion这是一个精心整理的视频世界模型资源清单,聚焦于自回归扩散(AR Diffusion)技术路线。项目系统梳理了该领域的算法、应用与基础设施,旨在为研究人员、工程师★ 711
DALLE-mtfDALLE-mtf 是 OpenAI 官方发布的 DALL·E 模型在 mesh-tensorflow 框架下的实现,用于大规模训练文本生成图像模型。它解决了原★ 430
TTS-CubeTTS-Cube 是一个基于循环神经网络的端到端语音合成项目,旨在直接从文本生成语音波形,解决传统TTS系统需要复杂前端和声码器拼接的问题。其核心能力包括:使用★ 223
ControlVARControlVAR 是一个基于自回归扩散模型的图像生成控制框架,旨在解决传统扩散模型在条件生成中控制粒度不足的问题。它通过将可变长度自回归(VAR)与扩散模型★ 127
LongLive-RAGLongLive-RAG 是一个面向长视频生成的通用检索增强框架,其官方实现基于 PyTorch。它解决的是现有视频生成模型难以生成长时间、多场景连贯视频的问题★ 114
lpdlpd 是一个面向自回归图像生成的高效并行解码算法,由 ICLR 2026 Oral 论文提出。它针对自回归图像生成中逐 token 串行解码速度慢的问题,利用★ 105
DiGITDiGIT 是一个基于自回归建模的图像生成框架,来自 NeurIPS 2024 论文。它提出通过稳定潜空间来统一图像自回归建模的视角,解决了传统自回归模型在图像★ 78
CVPR_2025_Oral_Paper_List这是一个精选的CVPR 2025 Oral论文清单,共收录96篇论文。它解决了计算机视觉领域研究者难以快速获取和筛选顶级会议Oral论文的问题,提供了一个集中、★ 67