scene-language

用程序+文字+嵌入,一句话生成可编辑的3D场景

Scene Language 是一个 CVPR 2025 Highlight 项目,提出了一种用程序、文字和嵌入向量统一表示3D场景的新范式。它解决的是传统3D场景表示方法(如网格、点云)难以兼顾高层语义理解和低层几何细节的问题。核心能力包括:将场景分解为程序化结构(如物体布局)、自然语言描述(如材质属性)和神经嵌入(如精细几何),并支持通过大语言模型自动生成和编辑场景。该项目提供了完整的训练和推理代码,并基于 Blender 等工具构建数据集,适用于3D场景生成、编辑和问答等任务。

开源 free 数字人3D
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 270
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类数字人3D
开发团队zzyunzhi
所属国家
定价模式free
价格说明开源项目,MIT许可证,可自由使用和部署,无付费版本。
访问状态
是否开源是
开源协议MIT
主要语言Jupyter Notebook
技术栈/模型3d-generation,4d-generation,language-model,visual-representation
GitHub 星标★ 270
30天Star增速
HF 下载量
上线时间2024-10-27 00:00:00
最近更新2026-09-08 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数1

使用教程

核心亮点

  • 提出三合一场景表示,兼顾语义和几何细节,创新性强
  • 支持大语言模型驱动的场景生成与编辑,交互自然
  • 提供完整代码和数据集构建流程,复现门槛低

不足之处

  • 项目早期,文档和社区支持待观察
  • 依赖 Blender 等外部工具,环境配置较复杂

适用场景

  • 3D场景自动生成与布局设计
  • 基于自然语言的场景编辑与修改
  • 3D场景理解与问答系统

替代项目

SceneScript、3D-LLM、BlenderGPT

项目介绍

scene-language 是计算机视觉领域的开源项目,由 zzyunzhi 开发,2024 年首次发布。

它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 270。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-08。MIT许可证,可自由使用和部署,无付费版本。

它主要面向的使用场景是:3D场景自动生成与布局设计。同类可对比的替代方案包括 SceneScript、3D-LLM、BlenderGPT。

上一篇:EscherNet

下一篇:CAST

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4019 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90930 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14