zero-shot
本站收录 12 个带「zero-shot」标签的 AI 开源项目
zero123Zero-1-to-3(简称zero123)是一个基于稳定扩散(Stable Diffusion)的零样本单图转3D物体生成框架,由哥伦比亚大学等机构在ICCV★ 3,065
UniTSUniTS是一个统一的多任务时间序列模型,旨在解决传统时间序列模型只能处理单一任务(如预测、分类或异常检测)的问题。它通过一个统一的网络架构,支持分类、回归、预★ 648
VidToMeVidToMe 是 CVPR 2024 的官方 PyTorch 实现,提出一种零样本视频编辑方法,通过视频令牌合并(Video Token Merging)技术★ 228
Awesome-LLM-Papers-Comprehensive-Topics这是一个精选大语言模型(LLM)论文与代码仓库的清单,覆盖了从基础架构、训练方法到应用落地等非常全面的主题。它旨在解决LLM领域信息过载、论文检索困难的问题,通★ 223
pix2gestaltpix2gestalt 是 CVPR 2024 论文的开源代码,专注于模态补全(amodal completion)任务,即从部分可见的物体图像中,推理并合成其★ 210
tttsttts 是一个用于训练下一代文本转语音(TTS)系统的开源项目,基于 Python 构建。它旨在提供一套完整、可扩展的训练流程,帮助开发者和研究人员从零开始训★ 169
FlashSpeechFlashSpeech 是 ACM MM 2024 发表的零样本语音合成(Zero-Shot TTS)项目,主打高效合成。它能在没有目标说话人录音样本的情况下,★ 159
zero123-hfzero123-hf 是 Zero-1-to-3 模型的 diffusers 实现,该模型在 ICCV 2023 上提出,核心能力是从单张 RGB 图像零样本生★ 154
ZeroShapeZeroShape是一个基于回归的零样本三维形状重建项目,旨在从单张图像直接恢复物体的三维几何结构。它解决了传统三维重建方法依赖大量标注数据、泛化能力差的问题,★ 141
Free-BloomFree-Bloom 是一个零样本(Zero-Shot)文本生成视频的开源项目,发表于 NeurIPS 2023。它解决的是无需视频训练数据即可将文本描述转化为★ 98
TurkicTTSTurkicTTS 是一个面向突厥语系的多语言文本转语音(TTS)合成系统,专门支持阿塞拜疆语、巴什基尔语、哈萨克语、吉尔吉斯语、萨哈语、鞑靼语、土耳其语、土库★ 85
SNACSNAC 是一个基于 PyTorch 的非官方实现,专注于零样本多说话人文本转语音(TTS)。它通过引入说话人归一化仿射耦合层,在流式生成架构中实现声音克隆,无★ 57