DeepSeek Harness 插件

dsh-vision-plugin-woyeshishen

describe_image tool that calls an external vision model so text-only DeepSeek Harness sessions can see pictures.(英文原文)

跳到安装方式

来源信息

GitHub 仓库
woyeshishen/dsh-vision-plugin
最近更新
2026年8月15日
分类
视觉与多模态
GitHub stars
3
载体类型
bundle
目录证据
上游声明已找到 dsh.bundle
证据路径
package.json#dsh.bundle
核对版本
0.1.0-rc.8
上游核对日期
2026-08-20

该证据由上游目录提供。本站没有安装、运行或安全审核这个插件。

安装

默认先复制一段 Prompt,让 Agent 读 GitHub 仓库和源码;需要自己装时再切到命令。

复制这段 Prompt,发给 DSH、Codex 或其他 Agent,让它先读 GitHub 仓库和源码。

请先不要安装或执行任何命令。阅读这个插件的 GitHub 仓库、README 和关键源码,然后用清楚、直接的方式回答以下问题,帮助我判断它是否适合我的需求:

1. 这个插件是什么,解决什么问题;
2. 适合哪些用户和典型使用场景;
3. 安装后如何使用,并给出一个最小使用示例;
4. 有哪些已知限制,以及隐私、安全、兼容性或维护风险;
5. 给出“推荐 / 有条件推荐 / 不推荐”的明确建议和理由。

请区分仓库明确说明、根据源码推断和未知信息。证据不足时请明确说明,不要猜测或照抄 README。

GitHub:https://github.com/woyeshishen/dsh-vision-plugin
插件名:dsh-vision-plugin-woyeshishen
作者:woyeshishen

检查来源文件

安装前先看这个插件目录里的 README 和其他文件。

文件资源管理器4 个文件
README.zh.md来源说明 · 只读预览
README 语言

dsh-vision-plugin

![npm version](https://www.npmjs.com/package/@woyeshishen/dsh-vision-plugin) ![license](LICENSE)

English | 中文

DeepSeek Harness(DSH)补齐看图能力:接入一个 OpenAI 兼容的外部视觉模型后,纯文本主模型(如 deepseek)即可通过 describe_image 工具把图片交给它、拿到纯文字描述,从而理解截图、照片、图表、OCR、界面等内容。

> 设计原则:图片只发给副模型(外部视觉模型),主模型始终只处理文字。

特性

🖼️ 看图主模型调用 describe_image,返回纯文字描述
⚙️ 图形化配置在设置页填 URL / API key / 模型,无需手改配置文件
🔒 凭据安全API key 加密存储于凭据库,界面永不回显
📦 一次安装,长期有效随 DSH 启动自动加载,重启不丢

安装

一键安装(推荐)

Windows(PowerShell)

irm https://raw.githubusercontent.com/woyeshishen/dsh-vision-plugin/main/scripts/install.ps1 | iex

macOS / Linux

bash <(curl -fsSL https://raw.githubusercontent.com/woyeshishen/dsh-vision-plugin/main/scripts/install.sh)

dsh plugin 命令安装

从 npm

dsh plugin --profile web add @woyeshishen/dsh-vision-plugin

从 GitHub

dsh plugin --profile web add github:woyeshishen/dsh-vision-plugin

安装完成后,插件会自动挂载到 profile,重启 DSH(或热重载)即生效。

使用

第一步:配置外部视觉模型

打开 设置 → 多模态视觉

字段说明
URL(Base URL)OpenAI 兼容接口地址,如 https://api.example.com/v1
API key外部模型的密钥(加密存储,不回显)
模型点「加载模型」从接口拉取列表并选择

点「保存」。

第二步:让主模型看图

在对话中直接说,例如:

> 看一下 D:\path\to\image.png,描述里面的内容

主模型会自动调用 describe_image,把图片发给外部视觉模型,拿到文字描述后继续推理。

工具

describe_image

参数必填说明
path图片文件路径;支持 png / jpg / jpeg / webp / gif
prompt对图片的具体问题;缺省为「详细描述图片内容」

要求

  • DeepSeek Harness
  • 一个 OpenAI 兼容(/chat/completions)、支持图像输入的外部视觉模型

License

[Apache-2.0](LICENSE)