为 DSH 提供持续语音对话,支持免提监听、按住说话、语音识别、TTS 语音回复和后台 Agent 任务委派。
dsh plugin add lgquan/dsh-voco
已收录的 DeepSeek Harness 扩展 —— 按分类筛选、按能力搜索,直达每个插件的源码仓库。
为 DSH 提供持续语音对话,支持免提监听、按住说话、语音识别、TTS 语音回复和后台 Agent 任务委派。
dsh plugin add lgquan/dsh-voco
豆包式语音对话插件:聊天框麦克风按钮(按住说话)语音转文字并自动发送,AI 回复自动朗读。可选 LLM 转述精简(长回复压缩成口语再播,跟随当前对话模型)、朗读前清洗 markdown/emoji/特殊符号、Edge TTS 多种音色、静音自动结束时长可调,设置嵌入 DSH 自带设置弹窗(voice chat 类目)。
dsh plugin add maoyuching/dsh-voice-chat
朗读助手回复(仅支持 Fish Audio API,需自备 Key):逐条朗读、自动朗读开关,设置页可配模型、音色 reference_id、加密 API Key 与代理。
dsh plugin add MaRi23333/dsh-fish-tts
Web UI 语音输入:输入框一键麦克风按钮,基于 Web Speech API 语音转文字填入草稿,可选识别后自动发送。
dsh plugin add NewDaNew/dsh-voice-input
Web UI 语音输入:输入框麦克风按钮驱动本地 VocoType 离线识别,识别结果自动插入输入框(自动部署/防重复/持续输入)。
dsh plugin add Nothree-code/voco-input-sh
agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。
dsh plugin add PandaPolo/dsh-voice-call
面向 Web UI 的语音输入插件:点按 Alt(或 Alt+空格)开始/停止听写,支持浏览器内置 Web Speech(零配置)或 OpenAI 兼容云端 ASR,可选经 DSH 已配置模型润色,带设置页。
dsh plugin add PensiveFei/dsh-voice-scribe
DeepSeek Harness 对话内朗读:点一下即可朗读、暂停、继续 AI 回复,豆包 TTS 自然音色(BYOK),只读最终回答并过滤代码、表格与图形,本地引擎,插件零 Key。
dsh plugin add PolinniZhong/dsh-omi-voice
为 DSH Web 助手回复提供小米 MiMo 语音朗读,支持预置音色和自定义音色。
dsh plugin add ppy-web/dsh-plugin-xiaomi-mimo-tts
DeepSeek Harness Web UI 全双工语音对话:按钮或 Ctrl+Shift+V 进入,持续聆听(停顿自动发送)或按住说话,zipformer2 流式识别入可编辑草稿、可选唤醒词;回复按句 Edge TTS 朗读并显示实时字幕,开口即打断播放与回合(真 barge-in);识别模型本地推理、Edge TTS 在线合成,无需 API Key。
dsh plugin add qishuilalala/dsh-voice-mode#dsh-voice-mode
输入框麦克风语音输入:浏览器 Web Speech API 实时转写,自动去重/���听、智能标点,支持语言与自动发送设置。
dsh plugin add QT-Chen/dsh-mic-input
通过 CallKit 打电话到你的手机:`call_me` 与 `text_me` 工具,并可在回合结束或等待审批时来电,语音回答转写后送回会话。
dsh plugin add radres/dsh-plugin-call-me
国内可用的输入框语音输入。需要先启动本地 Python bridge(pip install dashscope websockets,运行 bridge/voice-bridge.py)——只装插件不可用。浏览器麦克风采集 16kHz PCM 流式转发给 bridge,由阿里云 DashScope ASR(paraformer-realtime-v2)识别;识别文字在光标处实时填入草稿,静音自动停止,可选识别后自动发送。
dsh plugin add Schumchanvi/dsh-voice-input-cn
面向 DeepSeek Harness Web 的 AI 音频插件 —— 多厂商 TTS、音乐、音效与音色设计,含侧边栏面板、模型对比、资源库与 Agent 工具。
dsh plugin add shimingming520/dsh-audiogen
语音五工具:edge-tts 免费微软神经语音合成、OpenAI 兼容 ASR 转写、音色清单、批量音色试听与健康自检。
dsh plugin add STARDUSTLC666/dsh-voice
DSH 网页端语音控制:按住说话将语音转文字输入发送框(可自动发送),用浏览器语音合成朗读助手回复;右键麦克风打开设置面板,支持 Ctrl+M 全局快捷键。
dsh plugin add SuCriss/dsh-voice-control
dsh web 语音助手:说出唤醒词(如「小鲸」)即可免手听写,说话内容自动转成文字填入输入框;支持口述编辑指令(发送、清空、换行、停止朗读),并可用中文朗读 AI 回复。语音识别基于 sherpa-onnx WASM 在浏览器本地运行,离线可用、无需 API Key。
dsh plugin add supersyh-sss/dsh-voice-assistant
基于火山流式 ASR/TTS 的实时双工语音:回复朗读、打断、唤醒词、实时字幕、30 个中文音色与先响应后思考;在 DSH monorepo 内构建。
dsh plugin add tangzheng202202/dsh-voice-live
将本地高性能 TTS 引擎 GSV-TTS-Lite 实时接入 DeepSeek Harness:语音预设、自动朗读、引擎配置助手、朗读按钮与设置面板。
dsh plugin add TaoruiLiu19/dsh-gsv
dsh 的对话式语音前端 Agent:通过 ByteDance Duplex 自然对话,把语音请求委派给后台任务,并用语音回报异步结果。
dsh plugin add WayneYu430/dsh-voice-agent#voice-app
面向 DeepSeek Harness (dsh) 的语音输入插件:输入框的麦克风按钮把语音转成草稿文本,支持多种语音识别后端,可选经 dsh 自有 LLM 路由润色,并带原生设置页。
dsh plugin add WizisCool/dsh-ears
基于 uisfx 的语义化 UI 音效:任务开始/成功/失败、不同按钮情景 cue,设置页即时试听,12 种音色包,Host 持久化,并提供 `ctx.uisfx` 服务给其他插件。
dsh plugin add XanthanL/dsh-plugin-uisfx
DSH 免费对口型口语视频生成插件,支持 3000+ 声音和 500+ 语言。
dsh plugin add yu-wenchao/dsh-tool-lipsync
第 2 / 3 页
按分类或关键词筛选 —— 每一条都指向公开的 GitHub 项目。
命令按上游列表生成,实际包名请以各仓库 README 为准。
插件会以你的权限运行第三方代码 —— 先读源码再安装。
本目录是社区维护的 awesome-dsh-plugin 列表快照(更新于 2026-09-07)。插件名称与简介取自上游中英文双语列表;条目均链接到作者本人的仓库,收录不代表背书,也不等于安全审计。缺了某个插件?欢迎去上游列表提交。