DeepSeek Harness 插件

dsh-voice-input-opensqua

SenseVoice 语音输入插件 for DeepSeek Harness:在对话输入框旁添加麦克风按钮,录音后调用本地 SenseVoice 服务转成文本填入输入框。首次使用自动下载模型并显示进度,后端由插件自动启动。(英文原文)

跳到安装方式

来源信息

GitHub 仓库
opensquad-ai/dsh-voice-input
最近更新
2026年8月16日
分类
工具与能力
GitHub stars
0
载体类型
plugin
目录证据
上游声明已找到 dsh.bundle
证据路径
package.json#dsh.bundle
核对版本
0.1.0-rc.8
上游核对日期
2026-08-20

该证据由上游目录提供。本站没有安装、运行或安全审核这个插件。

安装

默认先复制一段 Prompt,让 Agent 读 GitHub 仓库和源码;需要自己装时再切到命令。

复制这段 Prompt,发给 DSH、Codex 或其他 Agent,让它先读 GitHub 仓库和源码。

请先不要安装或执行任何命令。阅读这个插件的 GitHub 仓库、README 和关键源码,然后用清楚、直接的方式回答以下问题,帮助我判断它是否适合我的需求:

1. 这个插件是什么,解决什么问题;
2. 适合哪些用户和典型使用场景;
3. 安装后如何使用,并给出一个最小使用示例;
4. 有哪些已知限制,以及隐私、安全、兼容性或维护风险;
5. 给出“推荐 / 有条件推荐 / 不推荐”的明确建议和理由。

请区分仓库明确说明、根据源码推断和未知信息。证据不足时请明确说明,不要猜测或照抄 README。

GitHub:https://github.com/opensquad-ai/dsh-voice-input
插件名:dsh-voice-input-opensqua
作者:opensquad-ai

检查来源文件

安装前先看这个插件目录里的 README 和其他文件。

文件资源管理器3 个文件
README.md来源说明 · 只读预览

@opensquad/dsh-voice-input

DeepSeek Harness 语音输入插件:在 Web 对话输入框旁添加一个麦克风按钮,录音后调用本地 SenseVoice 服务转写成文本,自动填入输入框。首次使用会引导下载模型并显示实时进度。

> 英文版 / English: [README_EN.md](./README_EN.md)

功能

  • 🎤 输入框旁麦克风按钮,一键录音转文字
  • ⬇️ 首次使用自动下载模型(约 230MB),按钮上显示圆环进度 + 实时百分比
  • ⚙ 独立管理按钮:查看/卸载已安装的语音模型
  • 自动拉起本地 SenseVoice 服务(模型就绪时)

依赖

这是一个全自动插件:Python 后端(依赖安装 + 进程启动)由插件在 dsh 启动时自动完成,首次使用模型也自动下载。 你只需要:

前置说明
Python 3.10+唯一需要手动装的软依赖(插件会自动 pip install 其余依赖)
ffmpeg(可选/推荐)仅用于异常音频的兜底转码,正常使用不需要;winget install ffmpeg 或官网安装并加入 PATH

手动安装 Python 3.10+

> 插件会自动安装剩下的 Python 依赖(flask / onnxruntime 等),你只需装好 Python 本身。

1. 打开 python.org/downloads,下载最新的 Python 3.10+(Windows 选 Windows installer (64-bit))。 2. 运行安装程序,务必勾选底部的 Add python.exe to PATH,再点 Install Now。 3. 安装完成后,重新打开一个终端(PowerShell / CMD),验证安装成功: ``bash python --version # 期望输出类似: Python 3.12.x(3.10 或更高即可) ``

手动安装 ffmpeg(可选)

> 浏览器端会把录音转成标准 WAV,正常使用不需要 ffmpeg。它仅在服务端收到异常/无法识别的音频时作为兜底转码使用,建议安装以免个别浏览器录音无法转写。

  • Windows:在 PowerShell 里执行

``bash winget install ffmpeg ` 安装完成后重启终端,验证: `bash ffmpeg -version ``

``bash brew install ffmpeg ``

  • Linux (Debian/Ubuntu)

``bash sudo apt update && sudo apt install -y ffmpeg ``

  • 通用方式:也可访问 ffmpeg.org/download.html 下载,解压后把 bin 目录加入系统的 PATH 环境变量。

插件启动时自动完成: 1. 探测 Python → 自动安装 flask / onnxruntime / librosa / soundfile / pyyaml 等依赖(首次较慢) 2. 自动拉起下载网关(gateway.py :7102) 3. 首次使用 → 自动下载模型(约 230MB)并启动转写服务(service.py :7101)

安装插件

dsh plugin --profile web add @opensquad/dsh-voice-input

重启 dsh 后,插件会在后台自动准备后端,输入框旁会出现麦克风按钮。

使用

1. 重启 dsh 后稍等片刻(首次会自动装 Python 依赖并启动后端)。 2. 点击麦克风 → 首次会确认下载模型 → 等待进度完成 → 自动启动服务。 3. 再次点击麦克风开始录音,再点一次停止并转写,文字自动填入输入框。

模型已安装时,点旁边的 ⚙ 可卸载后重新下载。

兼容性

  • Node.js ≥ 22.19.0
  • Python 3.10+(且 python 在 PATH)
  • DeepSeek Harness(Web profile)
  • 浏览器需支持 MediaRecorder / getUserMedia

License

[MIT](./LICENSE)