跳到主内容

dsh-vision-opencode 使用指南

给 DSH 的纯文本主模型挂一个可配置的识图模型:聊天发图自动转成文字,保留原生多模态模型不变。

本文为派生内容(基于 wiki / faq / compatibility_json 自动组装),非 AI 即时创作。

本文由本站基于该插件已收录的字段自动派生(wiki / faq / compatibility_json / readme),非 AI 即时创作。每节末尾标源字段。

快速上手

dsh-vision-opencode

— 源: plugin_wiki.wiki_content

安装与验证

dsh plugin --profile web add github:poiuyjie/dsh-vision-opencode

复制以上命令在 DSH Web Profile 内运行。安装完成后在「插件列表」启用即可。

— 源: plugins.install

关键要点

  • 聊天里发图 → 先交给视觉模型(如 MiMo-V2.5)转成文字,主模型照常回复,不用换模型
  • 输入框右侧「识图模型」下拉,自动列出所有供应商中支持图片的模型
  • 设置 → Vision 独立管理模型;vision_read_image 工具 / vision-image-analysis skill 支持 OCR、图表、截图理解
  • 异常兜底:单次 60s 超时、失败重试 1 次、重试耗尽降级为占位文本,不拖垮回合
  • 只想关掉自动转换(保留工具和选择器):vision-opencode.autoConvert: false 后重启

— 源: plugin_wiki.readme_zh (fallback readme_raw)

常见问题

装了之后必须挑一个识图模型吗?

强烈建议在设置→Vision 或输入框右侧下拉里挑一个。挑完才能发图自动转文字;如果不挑,插件会以占位文本提示"未配置识图模型",主模型仍能正常回答但看不到图。

只想关掉自动转换、保留工具和选择器可以吗?

可以。把 settings.yaml 里的 vision-opencode.autoConvert 改为 false 再重启 dsh;vision_read_image 工具和输入框右侧的识图模型下拉都还在。

图片转换失败 / 选择器不出现怎么办?

通常是没选识图模型、选了非多模态模型,或 DSH 版本与插件不匹配。先确认 settings 里 provider/model 都填了,再看浏览器控制台报错,最后去仓库 issue 区贴控制台日志。

切到原生多模态模型(比如带 image 输入的)会受影响吗?

不会。插件通过 resolveModelInfo 实时识别路由的图片输入能力,原生多模态主模型完整走 DSH 自带图片链路,不会被插件拦下来重转。

关闭思考(推理关闭)真的能省吗?

取决于供应商是否真的声明了"off"档位。少数模型有真"关闭"档(hy3 off:"none");大多模型只能在"强制关闭"档试试 thinking:{type:disabled} / reasoning_effort:"none" / enable_thinking:false 三种参数,插件会逐个试并记住哪个生效,但不能保证所有供应商都能跑通。

卸载前需要注意什么?

先备份包含图片的会话。卸载后旧会话里的图片辅助信息会被回收,纯文本主模型在重启后拿不到那些分析结果,重新发图才能继续识别。

支持哪些图片格式?

PNG / JPEG / WebP / GIF 四种,vision_read_image 工具和聊天发图都按这个白名单走;其他格式在 attachments 服务层就被拒。

能在 CLI / 桌面端 DSH 上用吗?

不能。仓库仅声明 client.platform="web",HTTP 端点、SSE 进度推送、设置面板都绑定 DSH Web 客户端。

— 源: plugin_wiki.faq_json

兼容性

  • DSH: >=0.1.0-rc.6 <0.2.0
  • Node: >=20.3
  • Platforms: Web(DSH Web 客户端)

— 源: plugin_wiki.compatibility_json

踩坑提醒

安装前请审阅上游仓库;本指南基于已收录字段自动派生,可能滞后于最新版本。如发现与官方文档冲突,请以上游为准。

— 来源:通用规则