DeepSeek Harness 插件

dsh-image-pathify

让纯文本模型也能处理聊天贴图,提供原生视觉体验,支持批量看图,走内置 OpenAI 兼容识图工具 analyze_image;具备视觉能力的模型不受影响。

跳到安装方式

来源信息

GitHub 仓库
dami9527/dsh-image-pathify
最近更新
2026年8月21日
分类
视觉与多模态
GitHub stars
0

安装

默认先复制一段 Prompt,让 Agent 读页面和仓库;需要自己装时再切到命令。

复制这段 Prompt,发给 DSH、Codex 或其他 Agent,让它先读页面和仓库。

请先不要安装。阅读这个 DeepSeek Harness 插件,说明它解决什么问题、会访问哪些文件、网络或密钥,以及如何安装和卸载。

插件页面:https://deepseekplugins.org/zh/plugins/dami9527/dsh-image-pathify
GitHub:https://github.com/dami9527/dsh-image-pathify
插件名:dsh-image-pathify
作者:dami9527
安装命令:dsh plugin --profile web add github:dami9527/dsh-image-pathify

确认前不要执行安装命令。

检查来源文件

安装前先看这个插件目录里的 README 和其他文件。

文件资源管理器3 个文件
README.md来源说明 · 只读预览

dsh-image-pathify

deepseek-v4 这类「不能看图」的模型,也能处理你贴进聊天里的图片,并直接调用插件内置的识图工具。

聊天记录和界面里的缩略图不会变。插件只在把消息发给模型前,把图片换成一行本地文件路径;模型再调用 analyze_image 读这个文件,通过你配置的视觉 API 得到文字描述。

你贴一张图  →  聊天里照常显示缩略图
           ↓
发给不能看图的模型前  →  变成:Saved attachments: /某路径/某文件
           ↓
模型调用 analyze_image  →  视觉 API 返回文字描述(多张图一次请求、同一次看见全部)

已经能看图的模型不受影响:图片会原样发给它们,analyze_image 不会出现在它们的工具列表和系统提示里。read_image 在不能看图的模型上会被拒绝,并提示改用 analyze_image

磁盘上的图片文件是 dsh 自己保存的附件~/.dsh/attachments/v1/...),不是本插件另存的一份。

安装

dsh plugin --profile web add dsh-image-pathify
dsh web

打开 设置 → 插件 → 识图,填写后点保存:

  • API 密钥(写入 $DSH_HOME/.credentials.yaml,不进设置文件)
  • 识图模型(默认 qwen-vl-plus
  • 识图 API 地址(默认阿里云 DashScope compatible-mode)

任何 OpenAI 兼容的视觉接口都可以,把地址和模型改成你的服务即可。设置页改动保存后立即生效,不用重启。

![设置 → 插件 → 识图](assets/settings.png)

更新

已装版本落后于 npm 最新版时,识图卡片 header会显示「发现新版本 x → y」和 复制升级命令,点按钮把命令复制到剪贴板。命令里的 --profile 按当前进程解析,取不到兜底 web

![更新](assets/update.png)

1. 结束当前正在跑的dsh,例如: dsh web(终端里 Ctrl+C) 2. 执行复制出来的命令:

dsh plugin --profile web add dsh-image-pathify@version

再启动 dsh web

插件不会自动改你机器上的包。查询失败或已是最新时,卡片上不显示任何提示。

怎么确认可用

1. 设置 → 插件里出现 识图 卡片 2. 给不能看图的模型发一张图:界面里缩略图还在;模型调用 analyze_image 而不是 read_image 3. 给不能看图的模型发本地图片路径或图片URL:应直接调用 analyze_image,不要先 read_image 4. 给能看图的模型发一张图:模型直接回答,不调用 analyze_image 5. 给能看图的模型发本地图片路径或图片URL:应直接调用 read_image,不要先 analyze_image

![给不能看图的模型发图,模型调用 analyze_image](assets/example.png)

配置

设置页保存后立即生效。识图字段写在 $DSH_HOME/settings.yamlimage-pathify 段;API 密钥写在 $DSH_HOME/.credentials.yaml,不进设置文件。

选项默认做什么
apiKeyEnvIMAGE_PATHIFY_API_KEY凭据引用名。密钥本身写在 $DSH_HOME/.credentials.yaml,不进设置文件
visionModelqwen-vl-plus识图模型 id
visionBaseUrlhttps://dashscope.aliyuncs.com/compatible-mode/v1OpenAI 兼容基址
singleMaxTokens1024一张图时视觉模型最多能写多长。截图细节不够可调大
multiMaxTokens4096一次识别多张图时的输出上限。描述被截断可调大
models空 = 全部不能看图的模型只决定哪些模型允许你发图。空 = 都能发。填了就只放行名单里的模型
relaxAdmissiontrue允许给不能看图的模型发图。关闭后按模型能力拒绝贴图

只允许 deepseek-v4-flash 发图的例子:

image-pathify:
  models:
    - provider: deepseek-official
      model: deepseek-v4-flash

模型侧只多一个工具 analyze_image(仅不能看图的模型能看见、能调用)。

  • 一张图:image 填本地绝对路径或 http(s) 图片 URL(不要带路径前缀)
  • 多张图:用 images 一次传入全部路径,插件会在同一次视觉请求里带上所有图片,不必一张一张等
  • prompt 可选

同一轮里有多张图时,系统提示会要求模型把所有路径放进一次 analyze_image 调用,而不是循环调用。

开发与构建

pnpm install
pnpm check

pnpm check 会按顺序执行 typechecktestbuild

License

MIT