Altbot 是计算机视觉领域的开源项目,由 micr0-dev 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 492 个项目,GitHub 星标数为 143。
项目目前处于活跃维护状态,最近一次代码更新于 2026-10-05。开源免费项目,无付费信息。
它主要面向的使用场景是:Mastodon实例运营者为站内图片自动补充无障碍描述。同类可对比的替代方案包括 alt-text-bot、mastodon-alt-text、captionbot。

给 Fediverse 图片视频自动补 alt-text,视障用户也能刷到内容
Altbot 是一个面向 Fediverse(联邦宇宙)的无障碍机器人,用 Go 语言编写,核心目标是为 Mastodon 等去中心化社交平台上的图片、视频和音频自动生成替代文本(alt-text)。在 Fediverse 中,视障用户依赖屏幕阅读器浏览内容,但大量帖子缺少图片描述,导致信息不可访问。Altbot 通过监听用户提及或时间线,调用视觉/语音识别模型为媒体生成描述性文字,再以回复形式发布,帮助内容创作者快速补全无障碍信息。它解决了手动撰写 alt-text 成本高、覆盖率低的问题,让无障碍描述成为自动化流程。项目支持图片、视频、音频多模态输入,可自托管部署,适合关注数字包容性的社区实例运营者使用。
本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整
—
alt-text-bot、mastodon-alt-text、captionbot
Altbot 是计算机视觉领域的开源项目,由 micr0-dev 开发,2024 年首次发布。
它收录于计算机视觉分类,该分类目前共有 492 个项目,GitHub 星标数为 143。
项目目前处于活跃维护状态,最近一次代码更新于 2026-10-05。开源免费项目,无付费信息。
它主要面向的使用场景是:Mastodon实例运营者为站内图片自动补充无障碍描述。同类可对比的替代方案包括 alt-text-bot、mastodon-alt-text、captionbot。
下一篇:ds-vision-skill
modlens
开源
给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···
opencv
开源
开箱即用的视觉算法库,搞定图像视频处理与识别
Open Source Computer Vision Library
OpenCVTutorials
开源
中文 OpenCV 教程,从入门到实战,边看边跑代码
OpenCV-Python4.1 中文文档
DEIMv2
开源
用DINOv3做实时检测,又快又准,直接落地。
[DEIMv2] Real Time Object Detection Meets DINOv3