GraspGPT_public

从图像直接预测机器人抓取姿态,快速复现SOTA抓取模型。

GraspGPT_public 是 GraspGPT 和 FoundationGrasp 模型的官方代码实现,专注于机器人抓取领域。它解决的是机器人如何根据视觉输入准确预测抓取姿态的问题,核心能力包括从单张RGB-D图像生成高质量抓取候选框,并支持抓取置信度评估。项目基于深度学习,提供训练和推理代码,可复现论文中的实验结果。对于机器人操作、自动化分拣等场景,它提供了一个开箱即用的抓取检测基线,降低了该领域的研究门槛。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 149
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类开源模型
开发团队mkt1412
所属国家
官网地址
定价模式free
价格说明开源项目,代码公开,可自行部署使用,无收费信息。
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型deep-neural-networks,grasp-planning,large-language-models,pytorch,task-oriented-grasp
GitHub 星标★ 149
30天Star增速
HF 下载量
上线时间2023-08-16 00:00:00
最近更新2026-08-13 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 官方实现,代码与论文对应,适合复现和对比实验
  • 支持RGB-D输入,输出抓取框和置信度,实用性强
  • 模型设计模块化,易于替换骨干网络或损失函数

不足之处

  • 文档/社区待观察,项目早期,使用教程和讨论较少
  • 依赖特定数据集和预训练权重,迁移到新场景需额外适配

适用场景

  • 机器人抓取研究:快速搭建抓取检测基线
  • 工业分拣:从视觉传感器数据实时规划抓取
  • 学术竞赛:作为基础模型参与抓取挑战赛

替代项目

GraspNet-1Billion、anygrasp、Contact-GraspNet

项目介绍

GraspGPT_public 是计算机视觉领域的开源项目,由 mkt1412 开发,2023 年首次发布。

它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 149。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-08-13。代码公开,可自行部署使用,无收费信息。

它主要面向的使用场景是:机器人抓取研究:快速搭建抓取检测基线。同类可对比的替代方案包括 GraspNet-1Billion、anygrasp、Contact-GraspNet。

上一篇:Robust-R1

下一篇:ZoomEye

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4019 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 90930 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1430 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2046 2026-08-14