generation

本站收录 22 个带「generation」标签的 AI 开源项目

synthetic-data-kitsynthetic-data-kit 是一个用于生成高质量合成数据集的 Python 工具,旨在解决真实数据获取成本高、隐私风险大、样本不均衡等问题。它通过可复★ 1,641PowerPaintPowerPaint 是一个基于 Stable Diffusion 的高质量多功能图像修补模型,由上海AI实验室等机构在 ECCV 2024 提出。它解决了传统★ 1,114ai-commits-intellij-pluginAI Commits 是一款面向 IntelliJ 系 IDE(含 Android Studio)的插件,利用大语言模型自动生成符合规范的 Git 提交信息。它★ 859wav2lip_288x288Wav2Lip 288x288 是一个基于 Wav2Lip 的改进版本,专注于高分辨率(288x288)的唇形同步视频生成。它解决了原始 Wav2Lip 在低分★ 651Cosmos-Drive-DreamsCosmos-Drive-Dreams 是一个基于世界基础模型(World Foundation Models)的可扩展合成驾驶数据生成项目。它利用 NVIDI★ 544Robust-U1Robust-U1 是 ICML 2026 论文的官方实现,聚焦多模态大语言模型(MLLMs)在视觉内容受损时的自恢复能力。它解决的是现实场景中图像被噪声、遮挡★ 499OmniThinkOmniThink 是一个面向机器写作的开源框架,核心思想是让 AI 在生成文章前先进行类似人类的“思考”过程,从而扩展知识边界,提升内容的深度和广度。它解决的★ 485Awesome-3D-AIGC这是一个聚焦3D AIGC(人工智能生成内容)领域的精选资源列表,收录了相关论文和开源项目。它系统梳理了3D生成技术的最新进展,涵盖NeRF、3D高斯泼溅、神经★ 351awesome-segment-anything-extensions这是一个精选列表,汇集了围绕 Meta 的 Segment Anything Model (SAM) 生态的各类扩展项目、工具和资源。它解决了 SAM 社区资源★ 348Mol-InstructionsMol-Instructions 是一个面向生物分子领域的大规模指令数据集,旨在增强大型语言模型(LLM)在生物分子理解与生成任务上的能力。它解决了通用LLM在★ 294bergenbergen 是一个专注于 RAG(检索增强生成)系统的基准测试库。它解决了 RAG 应用开发中缺乏标准化评估工具的问题,提供了一套统一的测试框架和指标,帮助开★ 281WorldLensWorldLens 是一个面向自动驾驶世界模型的全面评测框架,由 CVPR 2026 Oral 论文提出。它旨在解决当前驾驶世界模型评估标准单一、缺乏真实世界关★ 253XingGANXingGAN是ECCV 2020收录的基于PyTorch的人体图像生成模型,核心任务是给定一个人的源图像和目标姿态,生成该人物在目标姿态下的逼真图像。它通过两★ 225vue-pwa-asset-generatorvue-pwa-asset-generator 是一个专为 PWA(渐进式 Web 应用)设计的资源生成工具,尤其适合 Vue.js 项目,但也兼容所有 PWA★ 175audiocraft-infinity-webuiaudiocraft-infinity-webui 是一个为 Meta 的 AudioCraft 音频生成模型打造的无限时长音频生成 Web 界面。它解决了 A★ 170UnilmChatchitRobotUnilmChatchitRobot 是一个基于微软 UniLM 模型的夸夸式中文闲聊机器人项目。它利用预训练语言模型 UniLM 的序列生成能力,针对中文对话★ 157OneGenOneGen 是一个针对大型语言模型(LLM)的高效统一生成与检索框架,发表于 EMNLP 2024。它解决了传统 RAG(检索增强生成)中生成与检索分离、需要★ 149AI-Git-NarratorAI-Git-Narrator 是一款基于 Swift 开发的命令行工具,旨在利用 AI(如 OpenAI 的 ChatGPT)自动生成 Git 提交信息和 P★ 121CoMPaSSCoMPaSS 是一个针对文本到图像扩散模型的空间理解增强工具,核心解决现有 T2I 模型在复杂空间关系(如“左/右/上/下”及多对象布局)上生成不准确的问题。★ 95ecrivaiecrivai 是一个基于 LangChain 和 GPT 系列大语言模型的自动化 AI 博客写作工具。它旨在解决内容创作者和营销人员持续产出高质量博客文章的痛★ 81Stable-Diffusion-Video2Video这是一个为AUTOMATIC1111/stable-diffusion-webui编写的小型脚本,用于将视频逐帧通过img2img模式处理,实现视频到视频的风格★ 62tinylmtinylm 是一个基于浏览器的机器学习推理框架,采用 TypeScript 编写,提供 OpenAI 兼容的 API 接口,让开发者能在浏览器端直接运行 De★ 59