Yuuz12
dsh-vision-helper
DeepSeek Harness Vision Helper/DeepSeek Harness 视觉辅助方案
- Stars
- 1
- Language
- JavaScript
- Created
- Aug 13, 2026
- Updated
- Aug 14, 2026
Introduction
dsh-vision-helper
English | 中文
为 DeepSeek Harness 打造的持久化视觉插件。
注册 vision_analyze 工具,让智能体通过任意可配置的多模态模型分析图片(OCR、UI/报错截图、图表理解、通用图片描述),并在 Web 应用中提供设置页界面。
零依赖设计 —— 宿主模块没有任何 import,安装只需复制文件夹 + 一行补丁配置。无需 npm install、无需修改 node_modules 结构、无需软链接。
功能特性
vision_analyze工具 —— 接受本地图片路径或data:URI,发送给配置的多模态模型,返回分析文字。- 可配置模型 —— 在「设置 → 视觉助手」中选择提供方与模型(或直接编辑插件目录下的
dsh-vision-helper.json);留空自动选择多模态模型。 - 健壮性 —— 自动剥离粘贴路径中的不可见 Unicode 字符(U+202A 等);按最长边限制图片尺寸(
maxEdge,默认 4096px);去重流式文本;友好的错误提示。 - 自动调用引导 —— 注入系统提示段,让智能体在涉及图片的任务中自动调用
vision_analyze。 - 持久化且全局 —— 宿主组合插件:重启不丢失,所有会话可用。
环境要求(使用者侧)
- DSH Web 部署(设置页仅 Web 端;工具本身在挂载了该插件的任何 profile 中均可用)。
- 在部署的
llm-pi-ai设置(「模型」设置页)中配置好多模态模型路由,或你添加的任意 OpenAI 兼容视觉端点。插件不携带任何 API Key。
安装
本包是 DSH 组合包(声明了 dsh.bundle.patch),已发布到 npm。前提:机器上有 pnpm(Node 自带 corepack,执行 corepack enable pnpm 即可启用)。
方式一:npm 安装(推荐)
npx @deepseek-ai/dsh plugin --profile web add dsh-vision-helper
从 npm registry 拉取预构建代码(纯 JS 包,无 prepare 脚本、无需构建授权),自动激活组合层。
方式二:GitHub 安装
npx @deepseek-ai/dsh plugin --profile web add github:Yuuz12/dsh-vision-helper
拉取仓库源码(同样直接可用,无需构建步骤);网络不佳时优先用方式一。
方式三:手动(备用)
将本 dsh-vision-helper 文件夹复制到 <profile>/node_modules/,并在 <profile>/cordis.patch.yml 添加插件行:
- insert:
- id: dsh-vision-helper
name: 'dsh-vision-helper'
维护者开发模式:
dsh plugin --profile web add ./dsh-vision-helper(link:链接本地源码目录),改动重启即生效,无需重新安装。
无论哪种方式,模块都完全自包含——零依赖,无需解析。安装后验证并重启:
npx @deepseek-ai/dsh --profile web --dump-config # 应看到 dsh-vision-helper 层
# 然后重启 dsh web
配置
通过设置页(设置 → 视觉助手):提供方、模型、温度、最大输出 tokens、最大图片边长。等效的配置文件位于 <profile>/dsh-vision-helper.json —— 即宿主 profile 目录($DSH_HOME/profiles/web/),用户所有、插件更新不丢失:
{
"provider": "opencode-go",
"model": "mimo-v2.5",
"temperature": 0.2,
"maxTokens": 1024,
"maxEdge": 4096,
"mode": "auto"
}
provider/model 留空 = 自动选择;maxEdge 限制图片最长边像素。mode 控制注入智能体系统提示的自动调用引导:
auto(默认)—— 智能引导:若主模型是多模态(图片随对话送达,或可通过read_image直接查看本地图片),直接查看分析、零额外开销;仅当主模型无法查看图片(纯文本模型)时才调用vision_analyze;用户提到图片但缺路径时,先询问路径再调用。force—— 强制:涉及图片的任务必须使用该工具,禁止不调用工具直接作答或拒绝。仅在明确需要专用视觉模型时使用(如主模型纯文本、或需要专门视觉模型的识别能力)——多模态主模型下会产生额外 API 调用。off—— 关闭:不注入任何引导;工具仍注册,由智能体自行决定。
配置每次使用即时读取——无需重启(引导段在保存时自动重新注册)。
卸载
标准方式(组合包安装)
npx @deepseek-ai/dsh plugin --profile web remove dsh-vision-helper
该命令同时移除依赖与组合包层(插件行随之移除)。然后删除配置文件并重启 DSH:
- registry/tarball 安装:
<profile>/dsh-vision-helper.json(如$DSH_HOME/profiles/web/) - 本地
link:安装:<repo>/dsh-vision-helper.json(源码目录——remove只删除 node_modules 链接,源码仓库原样保留)
插件完全自包含,无需其他清理。
手动方式(后备安装)
从 <profile>/cordis.patch.yml 移除插件行,删除 <profile>/node_modules/dsh-vision-helper,删除配置文件,然后重启 DSH。