rapid-mlx-dsh-provider 使用指南
为 DeepSeek Harness 提供 Rapid-MLX 本地模型路由,自动读取服务端模型元数据(上下文窗口、推理/工具解析器),省去手写 settings.yaml 的麻烦。
本文为派生内容(基于 wiki / faq / compatibility_json 自动组装),非 AI 即时创作。
本文由本站基于该插件已收录的字段自动派生(wiki / faq / compatibility_json / readme),非 AI 即时创作。每节末尾标源字段。
快速上手
rapid-mlx-dsh-provider
— 源: plugin_wiki.wiki_content
安装与验证
dsh plugin --profile web add @raullenchai/dsh-provider
复制以上命令在 DSH Web Profile 内运行。安装完成后在「插件列表」启用即可。
— 源: plugins.install
关键要点
-
- id: qwen3.6-35b-8bit
- Installs and activates as a profile layer (no "declares no
dsh.bundle" - Registers the
rapid-mlxroute withctx.llmand serves real queries. - Plain chat, a single tool call, and the multi-step bug-fix task that gates
recommended_sampling— should be applied automatically per model.
— 源: plugin_wiki.readme_zh (fallback readme_raw)
常见问题
安装后还需要手动写 settings.yaml 吗?
不需要。插件启动时会读取本地 Rapid-MLX 服务端的 /v1/models,自动获得上下文窗口、是否支持推理/工具调用等元数据。只需在 settings.yaml 里把 provider 设为 rapid-mlx、model 设为服务端实际跑的模型别名即可。
上下文窗口是从哪里读的?
优先读服务端返回的 max_model_len(按机器统一内存估算的容量上限),老版本服务端只返回 context_window 时回退到该字段;两者都没返回就标记为"未知",不会猜测一个数字。dsh-compaction-basic 按这个数字 × thresholdRatio 触发压缩。
支持图片输入吗?
目前不支持。当请求里包含图片内容时,插件会抛 LlmError('UNSUPPORTED') 明确拒绝,而不是悄悄丢弃让模型"看不到图"还自信地答非所问。如果需要视觉模型,请走通用的 openai-completions provider。
可以从源码安装吗?
可以。包内是纯 JS 无构建步骤,dsh plugin --profile web add github:raullenchai/rapid-mlx-dsh-provider 即可。本地 pnpm link 因依赖解析机制会失败,需要手工创建软链,README 的 Local development 章节有详细步骤。
插件占用磁盘吗?会改服务端模型吗?
插件本身不占磁盘。rapid_mlx_serving/cached/health 三个工具只读(HTTP 查询 + 跑一次 rapid-mlx --version)。只有 rapid_mlx_pull(下载模型)和 rapid_mlx_remove(删除缓存模型,强制 -y 跳过确认)会改变磁盘内容。
和通用的 openai-completions provider 同时存在会冲突吗?
会。两条路由都会试图用 rapid-mlx 这个名字注册,registerAdapter 会因 provider 排他性而冲突。解决办法:二选一,或者把自己在 settings.yaml 里写的 rapid-mlx 改名。
— 源: plugin_wiki.faq_json
兼容性
- DSH: ^0.1.0-rc.8(peerDependencies 声明;rc.7 已在 Apple Silicon 上端到端验证)
- Node: >=22.15.0(README 与 CI 共同声明;dsh 内部用了 Node Zstd stream API)
— 源: plugin_wiki.compatibility_json
踩坑提醒
安装前请审阅上游仓库;本指南基于已收录字段自动派生,可能滞后于最新版本。如发现与官方文档冲突,请以上游为准。
— 来源:通用规则