opencode-see-image

给你的文本模型装上眼睛,图片理解无缝接入

opencode-see-image 是一个针对 opencode 生态的插件,核心功能是让不具备视觉能力的非多模态模型(如纯文本 LLM)也能“看懂”图片。它通过智能路由机制,将图片请求转发给具备视觉能力的模型(如 GPT-4V)进行处理,从而在不更换主模型的前提下,为智能体应用补充图像理解能力。该插件解决了多模态能力缺失的痛点,使得开发者可以继续使用轻量级或自托管的文本模型,同时按需调用视觉模型处理图像任务。其核心能力包括:自动识别图片输入、无缝路由到视觉模型、与 opencode 智能体框架深度集成。项目采用 TypeScript 编写,安装配置简单,适合需要低成本扩展视觉能力的 AI 应用场景。

开源 free 智能体
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 88
维护状态 维护中
是否开源 是
定价模式 free

项目数据

分类智能体
开发团队alfaoz
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型ai-agents,opencode-plugin
GitHub 星标★ 88
30天Star增速
HF 下载量
上线时间2026-06-19 00:00:00
最近更新2026-09-10 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 无需更换主模型,即可获得图片理解能力,节省成本
  • 与 opencode 智能体框架深度集成,安装配置简单
  • 智能路由机制,按需调用视觉模型,灵活高效

不足之处

  • 依赖外部视觉模型,增加 API 调用延迟和费用
  • 仅支持 opencode 生态,适用范围受限

适用场景

  • 在文本模型为主的智能体应用中,需要处理用户上传的图片
  • 使用轻量级或自托管模型,但偶尔需要视觉能力辅助
  • 开发基于 opencode 的 AI 助手,需快速集成图像理解

替代项目

LiteLLM、OpenRouter、vLLM

项目介绍

opencode-see-image 是智能体领域的开源项目,由 alfaoz 开发,是 2026 年新上线的项目。

它收录于智能体分类,该分类目前共有 2,517 个项目,GitHub 星标数为 88。

项目仍在小幅维护中,最近一次代码更新于 2026-09-10。MIT许可证,完全免费,可自行部署使用。

它主要面向的使用场景是:在文本模型为主的智能体应用中,需要处理用户上传的图片。同类可对比的替代方案包括 LiteLLM、OpenRouter、vLLM。

上一篇:shodh-memory

下一篇:avibe

同类项目推荐

xinchao-dynamic-mind 开源

给 AI 装上疲惫和欲望,让交互更真实

独立、可自托管的 AI 动态心智状态引擎:驱动力、念头池、疲惫、睡眠与意图。

★ 199 2026-08-09
deepseek-harness 开源

把 AI 能力拆成乐高积木,拼出你的专属智能体。

DeepSeek Harness: Everything is a Plugin.

★ 233327 2026-08-15
AutoGPT 开源

开箱即用的 AI 员工,交代任务就自己干完

AutoGPT is the vision of accessible AI for everyone, to use and to build on. Our mis···

★ 187492 2026-08-09
EvoAgentX 开源

让 AI 智能体自己迭代变强,越用越聪明

EvoAgentX: Building a Self-Evolving Ecosystem of AI Agents

★ 3351 2026-09-12