dsh-ears — 给 DeepSeek 加一对耳朵

写了个 dsh 的语音输入插件 dsh-ears
使用 ASR 模型进行语音转写,还能用 dsh 里已经接好的模型自动润色——去口头禅、修错字、把口语整理甚至自定义系统提示词
演示

安装
dsh plugin --profile web add dsh-ears
GitHub: https://github.com/WizisCool/dsh-ears
一行搞定,刷新页面输入框旁边就多了个麦克风。
识别后端
目前支持的识别后端,欢迎提 PR 扩展更多后端
- Groq — 免费
- 阿里云百炼 — 原生 DashScope API 调用,有免费额度
- 本地 Whisper — 插件预装 openai-whisper
- Web Speech — 浏览器原生
- 自定义 OpenAI 兼容接口
润色
这个是比较实用的功能。转写完的文字往往有口头禅、语气词、说错又纠正的内容,直接发出去浪费 token 也导致模型多思考乱猜。插件可以调 dsh 里已经配好的任意模型做一遍润色,提示词可以自定义,也可以用内置的默认提示词。
润色走的是 dsh 自己的模型路由,不需要额外配 key 。
求个 Star🌟 https://github.com/WizisCool/dsh-ears
欢迎 Issue / 提 PR 。如果有在用其他 ASR 服务的,也欢迎贡献新的识别后端。