aigc

本站收录 135 个带「aigc」标签的 AI 开源项目(按 GitHub 星标从高到低,此处展示前 50 个)

daily_stock_analysisLLM 驱动的多市场股票智能分析系统:整合多源行情与实时新闻,提供决策看板与自动推送,支持零成本定时运行,助你轻松掌握全球股市动态、高效辅助投资决策。★ 65,791Pixelle-Video主打全自动化的 AI 短视频引擎,输入创意即可自动完成脚本、画面与剪辑,大幅降低短视频制作门槛,帮助个人创作者与团队批量、高效地产出高质量短视频内容。★ 28,519Wan2.2阿里开源的先进大规模视频生成模型 Wan2.2,基于新一代架构实现高质量文生视频与图生视频,在画面质感、运动连贯性与语义理解上表现出色,为开发者与创作者提供强大★ 17,665LiveTalkingLiveTalking 是一个面向实时交互场景的开源数字人项目,主打流式生成和低延迟对话。它通过音频驱动口型同步,结合 NeRF 三维重建与渲染技术,让虚拟形象★ 9,655LangChain-Chinese-Getting-Started-GuideLangChain-Chinese-Getting-Started-Guide 是一份面向中文开发者的 LangChain 入门教程,旨在帮助初学者快速上手 L★ 9,140ChatGPT-ShortcutChatGPT-Shortcut 是一个基于 Docusaurus 构建的开源提示词管理与分享平台,旨在解决 AI 对话中提示词编写效率低、复用难的问题。它提供★ 8,792GPTCacheGPTCache 是一个面向大语言模型(LLM)的语义缓存工具,核心解决 LLM 推理成本高、响应慢的问题。它通过缓存相似的查询结果,让重复或相近的请求直接命中★ 8,206mmagicOpenMMLab 推出的多模态生成智能创作工具箱,提供开箱即用的 AIGC 能力、易用 API 与丰富模型库,涵盖文生图、图像/视频修复与增强等任务,是搭建生★ 7,470dramaclaw通用 AIGC 视频引擎,以一条流水线打通从剧本到成片的全部环节,支持漫剧、广告、产品视频、乙女游戏等内容形态,帮助创作者低成本、高效率地将创意转化为完整影视作★ 6,583understand-prompt这是一个个人知识库与实验记录项目,作者结合编程、绘画和写作经验,系统探索并总结了Stable Diffusion、ChatGPT和GitHub Copilot三★ 5,604RedInkRedInk 是一个基于 Nano Banana Pro 模型的一站式小红书图文生成器。它解决的是小红书创作者在内容制作中面临的文案与配图分离、效率低下的问题。★ 5,596tickflow-stock-panelTSP 是一个自托管、零运维的 A 股量化工作台,集选股、监控、回测于一体。它基于 TickFlow 数据源,利用 LLM 能力实现策略定制、个股分析和复盘,帮★ 5,327ai-agents-from-zero这是一个面向2026年的AI Agent系统学习指南,旨在帮助开发者从零基础成长为能胜任大模型应用开发岗位的工程师。项目以完整学习路径为核心,整合了LangCh★ 4,994AIGC-Interview-Book《三年面试五年模拟》是一份面向AIGC、LLM大模型、AI Agent算法工程师的面试准备资料集,由社区维护并持续更新。它系统整理了AI行业面试笔试中的核心知识★ 4,854Awesome-AIGC-TutorialsAwesome-AIGC-Tutorials 是一个精选的 AIGC 学习资源合集,涵盖大语言模型、AI 绘画、多模态等领域。它解决了 AIGC 领域信息分散、★ 4,548lingbot-world致力于推进开源世界模型的前沿项目,通过大规模数据与先进架构构建可泛化的世界模型,助力视频生成、仿真与具身智能等方向的研究与应用发展。★ 4,494DecryptPromptDecryptPrompt 是一个聚焦大语言模型(LLM)与提示工程(Prompt Engineering)的开源知识库,旨在系统性地整理和解读该领域的前沿论文★ 3,441DreamCraft3DDreamCraft3D 是一个由 ICLR 2024 收录的官方实现项目,专注于从单张 2D 图像生成高质量 3D 模型。它采用分层生成策略,结合引导扩散先验★ 3,028HunyuanWorld-1.0HunyuanWorld-1.0 是腾讯混元团队推出的3D世界生成模型,旨在从文本或图像直接生成沉浸式、可探索且可交互的3D世界。它解决了传统3D内容制作成本高★ 2,936lobe-uiLobe UI 是一个面向 AIGC 网页应用的开源 UI 组件库,基于 React 和 TypeScript 构建,旨在帮助开发者快速搭建聊天机器人、AI 对★ 2,212YiValYiVal 是一个面向生成式 AI 应用的自动提示词工程助手。它解决了提示词调试耗时、效果不稳定、难以量化评估的问题。核心能力包括:自动生成和优化提示词变体、支★ 2,136DemoFusionDemoFusion是一个旨在普及高分辨率图像生成的开源项目,由CVPR 2024收录。它解决了在有限GPU资源下生成高分辨率图像时常见的显存溢出和细节丢失问题★ 2,038ReCamMasterReCamMaster 是一个基于单段视频的相机控制生成式渲染工具,核心解决视频重渲染中相机视角无法自由控制的问题。它利用 4D 场景表示和生成式模型,从输入视★ 1,879VideoClawVideoClaw 是一个基于多智能体系统的 AI 视频生成工具,旨在将用户的一句话创意自动转化为完整影片。它解决了传统视频制作流程繁琐、门槛高的问题,通过集成★ 1,834VBenchVBench 是一个专为视频生成模型设计的综合评估基准,由 CVPR 2024 Highlight 论文提出。它解决了视频生成领域缺乏统一、细粒度、自动化评估标★ 1,800RAG-SurveyRAG-Survey 是一个系统整理检索增强生成(RAG)领域论文的精选列表,由腾讯 AI Lab 团队维护,并基于其发表的综述论文《Retrieval-Aug★ 1,789One-2-3-45One-2-3-45 是一个将单张 2D 图像快速转换为 3D 网格模型的开源项目,来自 NeurIPS 2023 论文。它解决了传统 3D 重建需要多视角图像★ 1,717aigc《构筑大语言模型应用:应用开发与架构设计》是一本开源电子书,面向希望将大语言模型(LLM)落地到实际业务的开发者。它系统讲解了LLM的基础知识、Prompt编写★ 1,650HunyuanWorld-VoyagerHunyuanWorld-Voyager 是一个基于 RGBD 视频生成的交互式 3D 重建模型,由腾讯混元团队开源。它解决了从普通视频中实时重建 3D 场景的★ 1,599PhantomPhantom 是一个基于扩散模型的文生视频(Text-to-Video)开源项目,专注于解决视频生成中主体一致性问题。它通过跨模态对齐技术,确保在生成的视频中★ 1,516hello-aihello-ai 是一个面向 AI 工具使用者的中文资源聚合与导航项目,旨在帮助用户系统性地掌握 ChatGPT、Claude、Gemini、Stable Di★ 1,399FireRed-Image-EditFireRed-Image-Edit 是一个开源的图像编辑基础模型,旨在解决现有图像编辑工具在指令遵循、生成保真度和身份一致性上的不足。它基于扩散模型架构,支持★ 1,375FollowYourPoseFollow-Your-Pose 是 AAAI 2024 的官方实现,解决文本到视频生成中姿态控制难的问题。它利用无需姿态标注的视频训练,通过姿态引导生成符合指★ 1,357StableAvatarStableAvatar 是一个基于视频扩散 Transformer 的端到端数字人视频生成框架,只需输入一张参考图和一段音频,即可生成无限长度、高质量的口播视★ 1,263PowerPaintPowerPaint 是一个基于 Stable Diffusion 的高质量多功能图像修补模型,由上海AI实验室等机构在 ECCV 2024 提出。它解决了传统★ 1,114awesome-llm-role-playing-with-persona这是一个精选资源列表,汇集了关于大语言模型(LLM)角色扮演(带有人设)的相关论文、数据集、模型、框架和工具。它解决了研究者和开发者在构建角色扮演AI时,难以快★ 1,070PIAPIA 是一个基于扩散模型的个性化图像动画生成工具,来自 CVPR 2024。它解决的核心问题是:如何将一张静态图片,通过简单的文本提示词,变成一段连贯、生动的★ 973OpenDeriskOpenDerisk 是一个 AI 原生的风险智能系统,旨在为应用程序提供 7*24 小时的全面深度防护。它解决的是传统安全工具依赖规则、响应滞后、难以应对复杂★ 971ai-audio-datasets覆盖语音、音乐与音效的 AI 音频数据集合集,为生成式 AI、AIGC、模型训练与智能音频工具开发提供高质量训练数据,是构建音频 AI 应用、开展相关研究的实用★ 970ChattyPlay-AgentChattyPlay-Agent 是一个基于 Python、React、TypeScript、Hono、SQLite3 和 Redis 构建的“All in O★ 943clipforgeClipForge(原『带货剪手』)是一个开源的 AI 带货短视频生成工具,主要面向电商卖家、内容创作者和中小商家。它解决的是商品短视频制作成本高、效率低的问题★ 907awesome-ai-persona-skills这是一个汇集了100多个人格化AI技能的合集项目,旨在为多智能体系统提供丰富的角色扮演能力。它解决了AI对话中角色单一、缺乏个性的问题,通过'蒸馏'技术将名人的★ 893UniPicUniPic 是一个开源的 SOTA 多图像编辑模型,专注于通过自然语言指令对多张输入图像进行联合编辑。它解决了传统图像编辑模型只能处理单张图像、难以理解多图之★ 875Matrix-3DMatrix-3D 是一个从单张图片或文本提示生成大规模可探索 3D 场景的开源项目。它通过生成高质量的全景视频,让用户能够在虚拟 3D 空间中自由漫游。该项目★ 833argoARGO 是一个开源的 AI Agent 平台,旨在将类似 Manus 的智能体能力带到桌面端。它解决了用户对本地化、隐私安全的深度研究(DeepResearc★ 827Lora-for-Diffusers这是一个面向AI图像生成研究者的LoRA微调教程项目,旨在用最易懂的方式讲解如何在diffusers框架中使用LoRA(低秩适配)技术。项目解决了Stable ★ 822skyagiSkyAGI 是一个基于大型语言模型(LLM)的智能体框架,旨在模拟人类行为。它利用 LangChain 构建,通过定义不同的智能体角色和交互规则,让 LLM ★ 775APTAPT 是一个开源的 AI 生产力工具,旨在通过本地化部署和隐私保护提升用户效率。它内置了 ChatGPT、DeepSeek、Phi、Qwen 等模型的本地专属★ 770awesome-text-to-video这是一个关于文本生成视频(Text-to-Video)领域的精选资源列表,本质上是一份技术综述。项目系统梳理了该方向的研究论文、开源模型、数据集和工具,覆盖从早★ 746PaddleMIXPaddleMIX是百度飞桨生态下的多模态大模型套件,旨在统一支持主流多模态任务,包括图文理解、视觉问答、图像生成等。它集成了端到端的大规模多模态预训练模型和扩★ 723