RotoAI 是计算机视觉领域的开源项目,由 sPappalard 开发,2025 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 63。
项目仍在小幅维护中,最近一次代码更新于 2026-09-19。采用AGPL-3.0许可证,可自行部署使用,无付费版本。
它主要面向的使用场景是:视频后期制作中快速抠像与背景替换。同类可对比的替代方案包括 Segment Anything (SAM)、Grounding DINO、OpenCV。

用一句话描述视频中的物体,自动完成逐帧分割抠像。
RotoAI 是一个开源的视频分割工作室,专注于提示词驱动的视频分割(rotoscoping)任务。它结合了 SAM2 和 Grounding DINO 模型,支持通过自然语言描述来分割视频中的特定对象,并采用混合云-本地架构,既能在本地处理敏感数据,也能利用云端算力处理复杂任务。该项目主要解决传统视频分割需要人工逐帧标注、效率低下的问题,提供自动化的零样本检测与分割能力。核心能力包括:基于文本提示的实时视频对象分割、可交互的编辑界面、以及灵活的部署方式。对于视频后期制作、内容审核、自动驾驶数据标注等场景,RotoAI 能显著提升工作效率。
Segment Anything (SAM)、Grounding DINO、OpenCV
RotoAI 是计算机视觉领域的开源项目,由 sPappalard 开发,2025 年首次发布。
它收录于计算机视觉分类,该分类目前共有 447 个项目,GitHub 星标数为 63。
项目仍在小幅维护中,最近一次代码更新于 2026-09-19。采用AGPL-3.0许可证,可自行部署使用,无付费版本。
它主要面向的使用场景是:视频后期制作中快速抠像与背景替换。同类可对比的替代方案包括 Segment Anything (SAM)、Grounding DINO、OpenCV。
上一篇:ShowAnything
下一篇:diffusion-vas
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
Olympus
开源
一个路由搞定所有视觉任务,免去逐个微调
[CVPR 2025 Highlight] Official code for "Olympus: A Universal Task Router for Comput···