Lexicon3D 是计算机视觉领域的开源项目,由 YunzeMan 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 102。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-14。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:三维视觉模型性能横向对比。同类可对比的替代方案包括 ScanNet、SUN RGB-D、SemanticKITTI。
测出视觉模型对三维世界的真实理解力
Lexicon3D 是一个面向复杂三维场景理解的开源评测框架,发表于 NeurIPS 2024。它系统性地探究了视觉基础模型(如 CLIP、DINOv2 等)在三维场景中的感知能力,通过设计多样化的三维任务(如物体识别、空间关系判断、场景描述等),揭示现有视觉模型在从二维图像迁移到三维空间时的表现与局限。项目提供了标准化的评测流程、数据集和基准结果,帮助研究者量化模型对三维结构的理解程度,并指导未来三维视觉模型的改进方向。核心能力包括:多任务三维评测基准、跨模型对比分析、以及可扩展的评测接口。
ScanNet、SUN RGB-D、SemanticKITTI
Lexicon3D 是计算机视觉领域的开源项目,由 YunzeMan 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 102。
项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-14。MIT许可证,完全免费,可自行部署使用。
它主要面向的使用场景是:三维视觉模型性能横向对比。同类可对比的替代方案包括 ScanNet、SUN RGB-D、SemanticKITTI。
上一篇:VideoGLaMM
下一篇:EndoDAC
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
Olympus
开源
一个路由搞定所有视觉任务,免去逐个微调
[CVPR 2025 Highlight] Official code for "Olympus: A Universal Task Router for Comput···