Altbot

给 Fediverse 图片视频自动补 alt-text,视障用户也能刷到内容

Altbot 是一个面向 Fediverse(联邦宇宙)的无障碍机器人,用 Go 语言编写,核心目标是为 Mastodon 等去中心化社交平台上的图片、视频和音频自动生成替代文本(alt-text)。在 Fediverse 中,视障用户依赖屏幕阅读器浏览内容,但大量帖子缺少图片描述,导致信息不可访问。Altbot 通过监听用户提及或时间线,调用视觉/语音识别模型为媒体生成描述性文字,再以回复形式发布,帮助内容创作者快速补全无障碍信息。它解决了手动撰写 alt-text 成本高、覆盖率低的问题,让无障碍描述成为自动化流程。项目支持图片、视频、音频多模态输入,可自托管部署,适合关注数字包容性的社区实例运营者使用。

开源 free 计算机视觉
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 143
维护状态 活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类计算机视觉
开发团队micr0-dev
所属国家
官网地址
定价模式free
价格说明开源免费项目,无付费信息
访问状态
是否开源是
开源协议AGPL-3.0
主要语言Go
技术栈/模型accessibility,alt-text,fediverse,fediverse-bot
GitHub 星标★ 143
30天Star增速
HF 下载量
上线时间2024-09-22 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-10-07
浏览次数0

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 支持图片、视频、音频三种媒体类型,覆盖 Fediverse 常见内容形态
  • 以机器人回复方式自动生成 alt-text,无需用户手动操作,降低无障碍描述门槛
  • Go 语言实现,单二进制部署,适合自托管到 Mastodon 等实例

不足之处

  • 自动生成的描述质量依赖底层识别模型,复杂场景可能不够准确
  • 项目星标较少,文档和社区生态仍在早期,长期维护待观察

适用场景

  • Mastodon 实例运营者为站内图片自动补充无障碍描述
  • 视障用户通过提及 Altbot 获取某条帖子媒体的文字说明
  • 内容创作者批量发布图片时用机器人快速生成 alt-text 草稿

替代项目

alt-text-bot、mastodon-alt-text、captionbot

项目介绍

Altbot 是计算机视觉领域的开源项目,由 micr0-dev 开发,2024 年首次发布。

它收录于计算机视觉分类,该分类目前共有 492 个项目,GitHub 星标数为 143。

项目目前处于活跃维护状态,最近一次代码更新于 2026-10-05。开源免费项目,无付费信息。

它主要面向的使用场景是:Mastodon实例运营者为站内图片自动补充无障碍描述。同类可对比的替代方案包括 alt-text-bot、mastodon-alt-text、captionbot。

上一篇:n8n-nodes-tesseractjs

下一篇:ds-vision-skill

同类项目推荐

modlens 开源

给纯文本编码代理装上眼睛,粘贴图片即刻获得结构化视觉证据。

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-o···

★ 4139 2026-08-19
opencv 开源

开箱即用的视觉算法库,搞定图像视频处理与识别

Open Source Computer Vision Library

★ 91081 2026-08-10
OpenCVTutorials 开源

中文 OpenCV 教程,从入门到实战,边看边跑代码

OpenCV-Python4.1 中文文档

★ 1433 2026-08-20
DEIMv2 开源

用DINOv3做实时检测,又快又准,直接落地。

[DEIMv2] Real Time Object Detection Meets DINOv3

★ 2049 2026-08-14