dsh-vision-opencode 使用指南
给 DSH 的纯文本主模型挂一个可配置的识图模型:聊天发图自动转成文字,保留原生多模态模型不变。
本文为派生内容(基于 wiki / faq / compatibility_json 自动组装),非 AI 即时创作。
本文由本站基于该插件已收录的字段自动派生(wiki / faq / compatibility_json / readme),非 AI 即时创作。每节末尾标源字段。
快速上手
dsh-vision-opencode
— 源: plugin_wiki.wiki_content
安装与验证
dsh plugin --profile web add github:poiuyjie/dsh-vision-opencode
复制以上命令在 DSH Web Profile 内运行。安装完成后在「插件列表」启用即可。
— 源: plugins.install
关键要点
- 聊天里发图 → 先交给视觉模型(如 MiMo-V2.5)转成文字,主模型照常回复,不用换模型
- 输入框右侧「识图模型」下拉,自动列出所有供应商中支持图片的模型
- 设置 → Vision 独立管理模型;
vision_read_image工具 /vision-image-analysisskill 支持 OCR、图表、截图理解 - 异常兜底:单次 60s 超时、失败重试 1 次、重试耗尽降级为占位文本,不拖垮回合
- 只想关掉自动转换(保留工具和选择器):
vision-opencode.autoConvert: false后重启
— 源: plugin_wiki.readme_zh (fallback readme_raw)
常见问题
装了之后必须挑一个识图模型吗?
强烈建议在设置→Vision 或输入框右侧下拉里挑一个。挑完才能发图自动转文字;如果不挑,插件会以占位文本提示"未配置识图模型",主模型仍能正常回答但看不到图。
只想关掉自动转换、保留工具和选择器可以吗?
可以。把 settings.yaml 里的 vision-opencode.autoConvert 改为 false 再重启 dsh;vision_read_image 工具和输入框右侧的识图模型下拉都还在。
图片转换失败 / 选择器不出现怎么办?
通常是没选识图模型、选了非多模态模型,或 DSH 版本与插件不匹配。先确认 settings 里 provider/model 都填了,再看浏览器控制台报错,最后去仓库 issue 区贴控制台日志。
切到原生多模态模型(比如带 image 输入的)会受影响吗?
不会。插件通过 resolveModelInfo 实时识别路由的图片输入能力,原生多模态主模型完整走 DSH 自带图片链路,不会被插件拦下来重转。
关闭思考(推理关闭)真的能省吗?
取决于供应商是否真的声明了"off"档位。少数模型有真"关闭"档(hy3 off:"none");大多模型只能在"强制关闭"档试试 thinking:{type:disabled} / reasoning_effort:"none" / enable_thinking:false 三种参数,插件会逐个试并记住哪个生效,但不能保证所有供应商都能跑通。
卸载前需要注意什么?
先备份包含图片的会话。卸载后旧会话里的图片辅助信息会被回收,纯文本主模型在重启后拿不到那些分析结果,重新发图才能继续识别。
支持哪些图片格式?
PNG / JPEG / WebP / GIF 四种,vision_read_image 工具和聊天发图都按这个白名单走;其他格式在 attachments 服务层就被拒。
能在 CLI / 桌面端 DSH 上用吗?
不能。仓库仅声明 client.platform="web",HTTP 端点、SSE 进度推送、设置面板都绑定 DSH Web 客户端。
— 源: plugin_wiki.faq_json
兼容性
- DSH: >=0.1.0-rc.6 <0.2.0
- Node: >=20.3
- Platforms: Web(DSH Web 客户端)
— 源: plugin_wiki.compatibility_json
踩坑提醒
安装前请审阅上游仓库;本指南基于已收录字段自动派生,可能滞后于最新版本。如发现与官方文档冲突,请以上游为准。
— 来源:通用规则