证据快照复核于 2026-09-16GitHub 数据核对日期: 2026-08-21
证据已验证Plugin Bundle界面与体验Web Profile

dsh-voice-talk

为 DeepSeek Harness Web 提供免手持语音对话和流式回复播报的插件。

快速了解

它能做什么

为 DeepSeek Harness Web 提供免手持语音对话和流式回复播报的插件。

本站提供的是中文说明,不代表该项目或 Plugin 自身提供中文界面;语言支持请以上游文档为准。

使用场景
界面与体验UI自动化配置
适配技术
dshWebchromeedgedashscopeiflytek
兼容性

Web Profile
dsh >= 0.1.0-rc.7

可信度与状态

证据已验证
核对日期 2026/9/11 UTC 14:07

有代码证据的贡献

它为 DSH 增加什么

语音对话模式

添加全屏通话界面,提供麦克风输入、流式语音播报、逐句高亮、静音、收起和说话打断功能。

机制证据

选择前先看

在对话页点击麦克风即可打开通话式浮层:说完后按设定停顿自动提交,回复生成时同步朗读。它支持朗读进度逐句高亮、静音、收起浮层,以及开口时打断播报。

适合谁

希望减少键盘操作、在走动或不便盯屏时使用 DeepSeek Harness Web 的用户。

常见任务

  • 口述提示词,并在设定的停顿后自动发送。
  • 一边听生成中的回复,一边在原生信息流中查看推理和工具调用。
  • 在移动设备上使用通话式界面进行连续多轮对话。

权限与数据

插件使用麦克风进行语音输入;语音播报可使用本机系统语音或云端服务。

权限
  • 语音输入需要授予麦克风权限。
数据处理
  • 文档称云端引擎密钥只保存在本机,浏览器不会接触密钥,语音请求也不携带密钥。
  • 语音识别使用云端引擎,文档未提供离线识别方案。
外部服务
  • DashScope/千问可提供语音合成和识别。
  • 讯飞可提供语音合成和识别。
凭据
  • 系统语音无需凭证。
  • DashScope 云端引擎需要 DashScope API Key。
  • 讯飞需要 APPID、API Key 和 API Secret。

局限

  • 需要 dsh 0.1.0-rc.7 或更高版本、Web profile、Chrome 或 Edge,以及麦克风权限。
  • 语音识别必须配置云端引擎并联网。
  • 云服务可能产生费用或受服务商额度限制。
  • 本次审核未实际执行安装、运行或语音通话。

DSHub 已核对

  • 固定提交中的清单声明了 Web 客户端注入,补丁会插入 voice-talk 插件。
  • 仓库文档说明了 npm 安装方式、支持的语音引擎、配置和环境要求。
  • 已确认 npm 注册表身份,许可证为 MIT。

DSHub 未核对

  • 未测试实际安装、麦克风授权、服务商鉴权或端到端语音通话。
  • 未审计 npm 注册表包的具体内容。

固定版本安装

安装 dsh-voice-talk

这个Plugin Bundle没有 DSH Plugin 安装操作,请根据源码文档使用真实交付方式。

访问源码项目

维护者原文

项目 README

查看 commit 35cfb06 对应的 README
维护者编写的上游内容原文于 2026/9/11README.md 获取,正文和仓库相对媒体固定到 commit 35cfb0650b81,内容哈希为 38b67e6f37fa。以下是未经 DSHub 翻译的上游原文,语言可能与当前页面不同;第三方托管的 badge 可能独立更新。

dsh-voice-talk

DeepSeek Harness Web 的语音对话插件:点一下麦克风,全屏通话层起,边说边听,AI 回复边生成边念。

npm version license

通话模式

特性

  • 一键通话:对话页点麦克风即进入全屏通话层,红色挂机按钮或 Esc 退出。
  • 边说边听:AI 回复边生成边播报,只念正文(代码、推理、工具调用不念);右侧信息流与原生一致,思考与工具调用完整展示。
  • 逐句高亮:播报进度在信息流里逐句高亮,听到哪读到哪。
  • 通话中可静音、可收起:静音不收录也不挂断,收起回到原生界面继续。
  • 密钥不出本机:云端引擎的密钥只保存在本机,浏览器全程接触不到。

快速开始

1. 安装

方式一:npm(推荐)

dsh plugin --profile web add dsh-voice-talk

装完重启:

dsh web

方式二:源码(开发 / 使用未发布版本)

git clone https://github.com/duoduoqian708/dsh-voice-talk.git
cd dsh-voice-talk
npm install && npm run build
dsh plugin --profile web add /path/to/dsh-voice-talk
  • npm run typecheck 类型检查;npm run build 产出 lib/index.js(host 半边)与 lib/client.js(浏览器半边)。

2. 启用

设置 → 插件 → 语音对话 → 打开「说」「听」对应引擎的开关。

3. 配置语音(关键)

「说」可以用系统语音(免费离线)或千问、讯飞;「听」只有云端引擎,没有离线识别,必须配置对应密钥。最省事的方式:申请一个阿里云百炼(DashScope)Key,同时填到「说」和「听」的千问引擎,听说就都通了。

语音引擎

用途 引擎 费用 凭证
系统语音 免费 · 离线 无需
说 · 听 千问(主推) 约 1 元 / 万字符 DashScope API Key
说 · 听 讯飞 每日免费额度 APPID + API Key + API Secret

密钥入口:设置 → 插件 → 语音对话 → 对应引擎「设置」。填好后可点「试听 / 试音」验证。

配置项

设置页里改的是持久默认;通话层上调的是会话级,挂断保留、新会话回到默认。音色、语速在通话层也能临时调。

配置 说明 默认
说话打断播报 说话时打断正在播报的内容(建议戴耳机使用)
停顿多久自动发送(秒) 说完停顿多久自动提交 2
播报字数上限 单次播报的最大字数,0 为不限 0
声纹效果 通话层波形样式:律动 / 波纹 波纹
语速 播报语速,按引擎设默认,通话层可临时调 1.0x
语言 识别与合成使用的语言 zh-CN

设置页

隐私与安全

云端引擎的密钥只保存在本机,浏览器接触不到,语音请求里也不会带上密钥。

常见问题

点了麦克风没反应,或一直停在「聆听中」? 确认「听」的引擎已配置密钥并启用(设置 → 插件 → 语音对话 → 听 · 语音识别)。

有文字但没有声音? 确认「说」的引擎已启用;云端引擎检查密钥与余额;系统语音检查系统音量与所选音色。

说话打断不了播报? 「说话打断播报」默认关闭,需手动打开;建议戴耳机,否则扬声器声音会被麦克风收录,影响打断判断。

彩蛋

假设你肩酸脖疼不想盯着屏幕,假设你恰好开了代理端口,假设你想运动工作两头兼顾——试着带着手机出门,边散步边聊开发吧。

手机上的通话层

环境要求

  • dsh ≥ 0.1.0-rc.7,web profile
  • Chrome / Edge
  • 麦克风权限;云端识别需要网络

License

MIT · 问题反馈 Issue

有意识地管理

安装与管理

前置条件与目标 Profile

目标 Web Profile

交付方式 Git Bundle — duoduoqian708/dsh-voice-talk#35cfb0650b8178b7c373f08b5330f331120791bd

验证、更新与移除

显示生命周期命令
验证
dsh plugin --profile web list

兼容性与访问范围

DeepSeek Harness Web profile; Chrome or Edge required dsh >= 0.1.0-rc.7

检查兼容性证据

风险事实

microphone_access

Requires microphone permission for voice input.

证据
cloud_speech_credentials

Cloud speech recognition and optional cloud synthesis require provider credentials and network access.

证据
package_lifecycle

The package declares a prepare lifecycle script that runs its build.

证据
证据与编辑审查Manifest、Bundle patch、分发与新鲜度

不可变证据

审查状态与源码活动

AI 已审查

若只需离线朗读可选系统语音;但语音识别仍需云端凭证和网络。

AI 审查于 2026/9/11 UTC 14:08GitHub 事实核对日期: 2026/9/11 UTC 14:08

自当前证据基线以来,没有记录到重要源码变化。

下一步

按 Plugin 安装流程操作

订阅重要变化: dsh-voice-talk