cvpr2025

本站收录 14 个带「cvpr2025」标签的 AI 开源项目

echomimic_v2蚂蚁集团开源的半身人像动画生成模型(CVPR 2025),在 EchoMimic 基础上实现更自然、更简化的半身人体动画,支持音频驱动的说话与动作同步,效果生动★ 4,6593DTopia-XL3DTopia-XL 是一个基于基元扩散(Primitive Diffusion)的高质量 3D PBR 资产生成框架,由复旦大学和百度等机构联合推出,入选 C★ 1,048Awesome-CVPR2026-CVPR2025-ICCV2025-CVPR2024-ECCV2026-ECCV2024-AIGC这是一个汇集CVPR、ICCV、ECCV等顶级计算机视觉会议中AIGC相关论文与代码的精选列表。项目旨在解决研究者难以系统追踪前沿AIGC成果的问题,按会议年份★ 676semantic-drawSemanticDraw 是 CVPR 2025 论文的官方实现,旨在解决图像扩散模型在交互式内容创作中实时性不足的问题。传统扩散模型生成图像需要多次迭代采样,★ 590RLAIF-VRLAIF-V 是一个面向多模态大语言模型的可信度优化框架,核心解决开源模型在视觉问答中过度自信、生成不可信内容的问题。它利用开源AI反馈(RLAIF)替代昂贵★ 461UniGoalUniGoal 是一个面向通用零样本目标导向导航的框架,发表于 CVPR 2025。它解决的是智能体在未知环境中根据自然语言指令或目标类别进行导航的问题,无需针★ 367GaussianCityGaussianCity 是 CVPR 2025 的官方实现,专注于无边界 3D 城市生成。它利用 3D 高斯泼溅(Gaussian Splatting)技术,★ 340YoChameleonYoChameleon 是一个 CVPR 2025 开源项目,旨在实现个性化图像生成中的身份保持与编辑。它解决的是在文本到图像生成模型中,如何将特定人物(或物体★ 151ObjaversePlusPlusObjaverse++ 是一个面向 3D 视觉研究的高质量 3D 物体数据集项目,由 Objaverse 扩展而来,收录了超过 10 万个 3D 物体,并附带质★ 114VideoGLaMMVideoGLaMM 是一个面向视频像素级视觉定位的大型多模态模型,由南洋理工大学等机构在 CVPR 2025 发表。它解决的是视频中细粒度对象理解与定位问题,★ 106h-edith-Edit 是一个基于扩散模型的图像编辑工具,核心创新在于引入 Doob 的 h-变换理论,将编辑过程建模为条件扩散过程,从而在保持图像结构的同时实现灵活、高★ 81ID-PatchID-Patch 是 CVPR 2025 论文的官方实现,专注于群体照片的个性化生成。它解决的是在多人合影中,如何准确地将每个生成的人物与真实身份对应起来的问题★ 77PhyT2VPhyT2V 是一个面向物理感知文本生成视频(Text-to-Video)的官方开源实现,对应 CVPR 2025 论文。它解决的是现有视频生成模型在物理规律遵★ 67CVPR_2025_Oral_Paper_List这是一个精选的CVPR 2025 Oral论文清单,共收录96篇论文。它解决了计算机视觉领域研究者难以快速获取和筛选顶级会议Oral论文的问题,提供了一个集中、★ 67