快速了解
它能做什么
为 DeepSeek Harness Web 提供免手持语音对话和流式回复播报的插件。
本站提供的是中文说明,不代表该项目或 Plugin 自身提供中文界面;语言支持请以上游文档为准。
Web Profile
dsh >= 0.1.0-rc.7
证据已验证
核对日期 2026/9/11 UTC 14:07
有代码证据的贡献
它为 DSH 增加什么
添加全屏通话界面,提供麦克风输入、流式语音播报、逐句高亮、静音、收起和说话打断功能。
机制证据 ↗选择前先看
在对话页点击麦克风即可打开通话式浮层:说完后按设定停顿自动提交,回复生成时同步朗读。它支持朗读进度逐句高亮、静音、收起浮层,以及开口时打断播报。
适合谁
希望减少键盘操作、在走动或不便盯屏时使用 DeepSeek Harness Web 的用户。
常见任务
- 口述提示词,并在设定的停顿后自动发送。
- 一边听生成中的回复,一边在原生信息流中查看推理和工具调用。
- 在移动设备上使用通话式界面进行连续多轮对话。
权限与数据
插件使用麦克风进行语音输入;语音播报可使用本机系统语音或云端服务。
权限- 语音输入需要授予麦克风权限。
- 文档称云端引擎密钥只保存在本机,浏览器不会接触密钥,语音请求也不携带密钥。
- 语音识别使用云端引擎,文档未提供离线识别方案。
- DashScope/千问可提供语音合成和识别。
- 讯飞可提供语音合成和识别。
- 系统语音无需凭证。
- DashScope 云端引擎需要 DashScope API Key。
- 讯飞需要 APPID、API Key 和 API Secret。
局限
- 需要 dsh 0.1.0-rc.7 或更高版本、Web profile、Chrome 或 Edge,以及麦克风权限。
- 语音识别必须配置云端引擎并联网。
- 云服务可能产生费用或受服务商额度限制。
- 本次审核未实际执行安装、运行或语音通话。
DSHub 已核对
- 固定提交中的清单声明了 Web 客户端注入,补丁会插入 voice-talk 插件。
- 仓库文档说明了 npm 安装方式、支持的语音引擎、配置和环境要求。
- 已确认 npm 注册表身份,许可证为 MIT。
DSHub 未核对
- 未测试实际安装、麦克风授权、服务商鉴权或端到端语音通话。
- 未审计 npm 注册表包的具体内容。
固定版本安装
安装 dsh-voice-talk
这个Plugin Bundle没有 DSH Plugin 安装操作,请根据源码文档使用真实交付方式。
维护者原文
项目 README
dsh-voice-talk
DeepSeek Harness Web 的语音对话插件:点一下麦克风,全屏通话层起,边说边听,AI 回复边生成边念。

特性
- 一键通话:对话页点麦克风即进入全屏通话层,红色挂机按钮或
Esc退出。 - 边说边听:AI 回复边生成边播报,只念正文(代码、推理、工具调用不念);右侧信息流与原生一致,思考与工具调用完整展示。
- 逐句高亮:播报进度在信息流里逐句高亮,听到哪读到哪。
- 通话中可静音、可收起:静音不收录也不挂断,收起回到原生界面继续。
- 密钥不出本机:云端引擎的密钥只保存在本机,浏览器全程接触不到。
快速开始
1. 安装
方式一:npm(推荐)
dsh plugin --profile web add dsh-voice-talk
装完重启:
dsh web
方式二:源码(开发 / 使用未发布版本)
git clone https://github.com/duoduoqian708/dsh-voice-talk.git
cd dsh-voice-talk
npm install && npm run build
dsh plugin --profile web add /path/to/dsh-voice-talk
npm run typecheck类型检查;npm run build产出lib/index.js(host 半边)与lib/client.js(浏览器半边)。
2. 启用
设置 → 插件 → 语音对话 → 打开「说」「听」对应引擎的开关。
3. 配置语音(关键)
「说」可以用系统语音(免费离线)或千问、讯飞;「听」只有云端引擎,没有离线识别,必须配置对应密钥。最省事的方式:申请一个阿里云百炼(DashScope)Key,同时填到「说」和「听」的千问引擎,听说就都通了。
语音引擎
| 用途 | 引擎 | 费用 | 凭证 |
|---|---|---|---|
| 说 | 系统语音 | 免费 · 离线 | 无需 |
| 说 · 听 | 千问(主推) | 约 1 元 / 万字符 | DashScope API Key |
| 说 · 听 | 讯飞 | 每日免费额度 | APPID + API Key + API Secret |
密钥入口:设置 → 插件 → 语音对话 → 对应引擎「设置」。填好后可点「试听 / 试音」验证。
配置项
设置页里改的是持久默认;通话层上调的是会话级,挂断保留、新会话回到默认。音色、语速在通话层也能临时调。
| 配置 | 说明 | 默认 |
|---|---|---|
| 说话打断播报 | 说话时打断正在播报的内容(建议戴耳机使用) | 关 |
| 停顿多久自动发送(秒) | 说完停顿多久自动提交 | 2 |
| 播报字数上限 | 单次播报的最大字数,0 为不限 | 0 |
| 声纹效果 | 通话层波形样式:律动 / 波纹 | 波纹 |
| 语速 | 播报语速,按引擎设默认,通话层可临时调 | 1.0x |
| 语言 | 识别与合成使用的语言 | zh-CN |

隐私与安全
云端引擎的密钥只保存在本机,浏览器接触不到,语音请求里也不会带上密钥。
常见问题
点了麦克风没反应,或一直停在「聆听中」? 确认「听」的引擎已配置密钥并启用(设置 → 插件 → 语音对话 → 听 · 语音识别)。
有文字但没有声音? 确认「说」的引擎已启用;云端引擎检查密钥与余额;系统语音检查系统音量与所选音色。
说话打断不了播报? 「说话打断播报」默认关闭,需手动打开;建议戴耳机,否则扬声器声音会被麦克风收录,影响打断判断。
彩蛋
假设你肩酸脖疼不想盯着屏幕,假设你恰好开了代理端口,假设你想运动工作两头兼顾——试着带着手机出门,边散步边聊开发吧。

环境要求
- dsh ≥ 0.1.0-rc.7,
webprofile - Chrome / Edge
- 麦克风权限;云端识别需要网络
License
有意识地管理
安装与管理
前置条件与目标 Profile
目标: Web Profile
交付方式: Git Bundle — duoduoqian708/dsh-voice-talk#35cfb0650b8178b7c373f08b5330f331120791bd。
验证、更新与移除
显示生命周期命令
dsh plugin --profile web list兼容性与访问范围
DeepSeek Harness Web profile; Chrome or Edge required: dsh >= 0.1.0-rc.7。
风险事实
证据与编辑审查Manifest、Bundle patch、分发与新鲜度
不可变证据
审查状态与源码活动
若只需离线朗读可选系统语音;但语音识别仍需云端凭证和网络。
AI 审查于 2026/9/11 UTC 14:08。GitHub 事实核对日期: 2026/9/11 UTC 14:08。
自当前证据基线以来,没有记录到重要源码变化。