在每条已定稿的助手回复里、紧挨点赞按钮右侧加一个小喇叭:点击用浏览器语音引擎朗读这条回复,鼠标悬停可调倍速与音色。
安装
# npm 包(预构建)
dsh plugin --profile web add dsh-read-aloud
# GitHub 源码(首次需按提示配置 allowBuilds 构建授权后重试)
dsh plugin --profile web add github:cccc12138/dsh-read-aloud
装任何插件都等于在你的机器上跑第三方代码,权限和你本人一样大——能读你的文件、用你的凭据、访问网络,工具审批管不到它。GitHub 来源的插件还会在安装时执行构建脚本——pnpm 默认拦截,所以安装可能停在 ERR_PNPM_GIT_DEP_PREPARE_NOT_ALLOWED 或 ERR_PNPM_IGNORED_BUILDS;dsh 会打印出需要添加的确切键名,把它加进该 profile 的 pnpm-workspace.yaml 的 allowBuilds 下,重跑一次即可装上。放行构建本身就是一次信任判断:请只安装可信来源,并尽量锁定 commit(github:owner/repo#sha)。
README
English | 中文
在点赞按钮旁边加一个小喇叭:朗读 DeepSeek Harness 的任意一条回复。
每一条定稿的助手回复,都会在它本来就有的那行图标里多出一个动作,位置就在 👍👎 的右边:
复制 · 👍 👎 · 🔊 · 分支
点一下,就用你浏览器自带的语音引擎把这条回复念出来。不上传任何内容、不需要 API 密钥、主机端一行代码都不跑。
安装
dsh plugin --profile web add dsh-read-aloud
也可以在 设置 → 插件市场 里一键安装。多数情况下装完刷新页面就生效。
使用
| 操作 | 效果 |
|---|---|
| 点小喇叭 | 从开头朗读这条回复 |
| 朗读中再点一下 | 暂停,图标变成 ▶ |
| 暂停时再点一下 | 从同一句继续 |
| 点另一条消息的小喇叭 | 停掉当前的,开始读那一条 |
按 Esc |
立刻停止,不管鼠标在哪 |
| 鼠标移到小喇叭上 | 弹出倍速与音色面板 |
按钮有三种状态:🔈 待机、⏸ 朗读中、▶ 已暂停。读完会自己结束,图标回到 🔈。
倍速与音色
鼠标移到按钮上会弹出一个小面板,它会跟着你正在听的那条消息:
倍速 [0.5×] [0.75×] [1×] [1.25×] [1.5×] [1.75×] [2×]
音色 [ 跟随系统 ▾ ]
两个选择都立刻对正在念的这句话生效,并记在浏览器本地。音色来自你的操作系统;列表按中文语音优先排序,选「跟随系统」时会自动挑一个跟界面语言匹配的音色。
朗读内容
助手回复是 Markdown,而照着 Markdown 原文念会非常难听——URL 会被逐字符拼读,代码块会变成天书。所以正文会先做清洗:
| 保留 | 丢弃 |
|---|---|
| 正文段落与标题 | 围栏代码块(静默跳过) |
列表条目(去掉 - 1. 等符号) |
表格行 |
| 行内代码的内容(去掉反引号) | 图片语法 |
| 链接文字 | 链接地址与裸 URL |
强调文字(去掉 ** *) |
HTML 标签、文件路径、emoji |
长回复全文读完,不做任何截断。正文会按句子切成小段排队朗读,而不是整段一次性丢给引擎——因为不少语音引擎会把过长的单次朗读悄悄截断或直接丢弃。
环境要求
- DeepSeek Harness 0.1.2-rc.1 或更高版本
- 一个支持 Web Speech API 的浏览器。语音来自你操作系统里已安装的音色,所以如果系统里没有对应语言的音色,就会没有声音——Windows 和 macOS 都自带可用音色,Edge 还会额外提供更自然的在线音色。
- 如果浏览器完全没有语音引擎,按钮会直接告诉你不支持,而不是默默失败。
隐私
- 不发起任何网络请求,插件从不联系任何服务器。
- 没有 API 密钥、没有账号、没有埋点。
- 没有主机端代码:
lib/index.js是一个空的apply,存在的唯一目的是让插件出现在 profile 的加载器里。 - 倍速和音色保存在浏览器本地存储的
dsh-read-aloud/settings键下。清除站点数据只会把它们重置回1×和「跟随系统」,不影响任何其他东西。
兼容性
插件声明 engines.dsh >= 0.1.2-rc.1,并在 conversation.chat.assistant-actions 插槽里以 order: 20 注册一个条目,因此它紧挨着官方反馈按钮(order: 10)而不会替换它。正文通过插槽自带的 useChat 标准 props 读取,所以既不需要主机端 RPC,也不需要抓取 DOM。
开发
npm test
客户端 bundle 是按 Web 外壳加载的模块格式手写的,因此没有构建步骤、不需要打包器——lib/client.js 就是最终产物。测试会用一个桩化模块图加载这个真实文件,覆盖文本清洗、分段、消息查找和音色列举这几组纯函数。
许可
MIT
链接
同类插件
PolinniZhong/dsh-omi-voice★ 73
DeepSeek Harness 对话内朗读:点一下即可朗读、暂停、继续 AI 回复,豆包 TTS 自然音色(BYOK),只读最终回答并过滤代码、表格与图形,本地引擎,插件零 Key。
PensiveFei/dsh-voice-scribe★ 33
面向 Web UI 的语音输入插件:点按 Alt(或 Alt+空格)开始/停止听写,支持浏览器内置 Web Speech(零配置)或 OpenAI 兼容云端 ASR,可选经 DSH 已配置模型润色,带设置页。
WizisCool/dsh-ears★ 21
面向 DeepSeek Harness (dsh) 的语音输入插件:输入框的麦克风按钮把语音转成草稿文本,支持多种语音识别后端,可选经 dsh 自有 LLM 路由润色,并带原生设置页。
1624318455/dsh-plugin-tts★ 19
用免费 Edge TTS 或你自己的 RVC 音色朗读 AI 回复:消息朗读与自动朗读、长文自适应分块渐进播放(无缝衔接)、音色包仓库一键安装、便携 RVC 运行时。
qishuilalala/dsh-voice-mode#dsh-voice-mode★ 12
DeepSeek Harness Web UI 全双工语音对话:按钮或 Ctrl+Shift+V 进入,持续聆听(停顿自动发送)或按住说话,zipformer2 流式识别入可编辑草稿、可选唤醒词;回复按句 Edge TTS 朗读并显示实时字幕,开口即打断播放与回合(真 barge-in);识别模型本地推理、Edge TTS 在线合成,无需 API Key。
Alan2Z/dsh-speak★ 11
零外部依赖、事件驱动、无需额外模型、不消耗任何 token的语音播报插件。使用系统自带自然语音进行播报,支持win/mac双平台;最终回复、审批与提问提醒、可选事件播报(回合结束/命令完成/目标变更/工具出错/待办更新)、最终回复可重播、双语言可视化设置。
社区评论
评论公开保存在 GitHub Discussions。加载评论会连接 GitHub 和 Giscus;发表内容需要 GitHub 账号。