PensiveFei/dsh-voice-scribe
DSH voice input plugin: tap Alt to talk, get text in composer. Web Speech default (zero config), optional OpenAI-compatible ASR, polish via DSH LLM.
项目介绍Project Overview
dsh-voice-scribe 是 DSH 非官方语音输入插件:点按 Alt(或 Alt+空格)开始录音、再按结束,转写文本插入输入框光标处。默认用浏览器内置 Web Speech 识别,零配置、无需 API key;可选 OpenAI 兼容 ASR 云端引擎,并用 DSH 已配置模型做可选润色。适合想在 DSH 中口述代替打字时使用。注意:Web Speech 音频由浏览器语音服务处理,可能离开本机,请勿口述密码等敏感信息。
dsh-voice-scribe is an unofficial voice-input plugin for DSH: tap Alt (or Alt+Space) to start recording, tap again to stop, and the transcript is inserted at the composer cursor. It uses the browser's built-in Web Speech recognition by default—zero config, no API key—with optional OpenAI-compatible ASR endpoints and optional polishing via a configured DSH model. Use it to dictate instead of typing in DSH. Caveat: Web Speech audio is processed by the browser's speech service and may leave the device; avoid dictating secrets.
请帮我了解并安装插件:【dsh-voice-scribe】【https://github.com/PensiveFei/dsh-voice-scribe】
把上面这条消息直接发给当前会话里的 DSH,让它帮你了解并安装。安装命令不一定准确,发给 DSH 更稳。Send this message to DSH in your current session. CLI install commands may not be accurate across systems — DSH will figure it out for you.
或使用命令行安装(适合开发者)Or use CLI install (for developers)
命令行安装CLI Install
dsh plugin --profile web add github:PensiveFei/dsh-voice-scribe
把 PensiveFei/dsh-voice-scribe 加入你的 DSH 配置(web profile)即可启用。
READMEREADME
dsh-voice-scribe
DSH 专属语音输入插件:点按 Alt 说话、再点按结束转文字,文本直接插入输入框光标处。 Voice input for DeepSeek Harness: tap Alt to start recording, tap again to stop — the transcript lands in the composer.
⚠️ 非官方插件(unofficial):本插件由社区成员开发,与 DeepSeek / 深度求索公司无任何关联。 使用前请阅读 免责声明 与 SECURITY.md。
功能 Features
- 🎙️ 点按 Alt 切换录音(默认);若浏览器拦截 Alt,可切换为 Alt+空格(设置中可选)
- 🎧 转写:默认用浏览器内置 Web Speech 识别(Chrome/Edge 自带,零配置、零 API key);可选 OpenAI 兼容 ASR 端点
- ✨ 可选润色:默认关闭;开启后转写文本通过 DSH 已配置的模型 清理口头禅、补标点——无需额外配置 API key
- 🔒 隐私设计:默认 Web Speech 模式音频不出浏览器;ASR API key(如启用云端引擎)只存服务端,浏览器端不可见
为什么默认用浏览器内置识别(Web Speech)
DSH 用户大多只有 DeepSeek 原生 API key,而 DeepSeek 模型是纯文本模型,无法直接"听"音频做语音转文字。 为了让插件开箱即用、无需额外注册任何服务,默认引擎用 Chrome/Edge 内置的 Web Speech 识别——浏览器原生支持中文,不需要任何 key。 如果你已有 OpenAI 兼容的 ASR 服务(Groq / 硅基流动 / 其他),可以在设置中切换为云端引擎获得更高准确率。
安装 Install
# 打包
pnpm pack
# 安装到你的 DSH web profile
dsh plugin --profile web add ./dsh-voice-scribe-0.1.1.tgz
# 重启 dsh web 后刷新页面
使用 Usage
- 点击输入框,按一下 Alt 开始说话;再按一下 Alt 结束并转写(默认引擎零配置,直接可用)
- 转写文本出现在输入框光标处,检查后按回车发送
热键 Hotkeys
| 热键 | 说明 |
|---|---|
Alt(默认) |
点按开始 / 再点按结束 |
Alt+空格 |
备选;当浏览器把 Alt 单键用于菜单聚焦时使用 |
识别引擎 Engine
- Web Speech(默认):浏览器内置,零配置零 key,中文友好。音频由浏览器语音服务处理。
- OpenAI 兼容 ASR(可选):任意
/v1/audio/transcriptions端点(Groq / 硅基流动 / 自建等),需在~/.dsh/voice-input.json配置asrUrl/asrModel/asrApiKey
润色 Polish(可选,默认关闭)
开启后,转写文本会通过 DSH 设置 → 模型 里已配置的某个模型做最小修正(删口头禅、改同音错字、补标点)。 复用 DSH 的模型与 key——你不需要为润色额外配置任何东西。
数据与隐私 Privacy
- Web Speech 模式:音频在浏览器内由浏览器语音服务处理,不经过 DSH host,不落盘、不打日志
- 云端 ASR 模式(可选):音频经浏览器 → 本地 host → ASR 服务一条链路;API key 只存在
~/.dsh/voice-input.json(服务端),页面 JS 拿不到 - 润色:转写文本 + 系统提示词发给所选 DSH 模型,失败时回退原始转写,不丢失内容
- 首次使用需在浏览器授予麦克风权限(DSH 默认 127.0.0.1 属安全上下文,支持)
免责声明(Disclaimer)
使用本插件即表示你理解并同意:
- 浏览器识别:默认 Web Speech 模式下,语音由浏览器及其语音服务(Chrome/Edge 厂商)处理,可能离开本机。请自行评估隐私风险。
- 第三方服务:若切换云端 ASR 引擎,语音会发送给你配置的第三方服务商。请确认其数据处理政策。
- 非官方:本插件非 DeepSeek 官方产品,不提供任何官方支持或 SLA。
- 无保证:插件按"原样"提供,不对转写准确性、服务可用性、数据安全作任何明示或暗示的保证。
- 风险自担:因使用本插件(包括但不限于语音内容泄露、误转写、第三方服务故障)造成的任何损失,开发者不承担责任。
- 敏感信息:请勿在语音中输入密码、密钥、身份证号等敏感信息。
开发 Dev
npm test # 离线单元测试
npm run lint # 语法检查
npm run security # 密钥/路径泄露扫描
License
MIT
nexu-io/open-design
ruvnet/ruflo
amruthpillai/reactive-resume
esengine/DeepSeek-Reasonix
volcengine/OpenViking
Molunerfinn/PicGo
titanwings/distilly
titanwings/colleague-skill