dsh-voice-input-cn
国内可用的输入框语音输入。需要先启动本地 Python bridge(pip install dashscope websockets,运行 bridge/voice-bridge.py)——只装插件不可用。浏览器麦克风采集 16kHz PCM 流式转发给 bridge,由阿里云 DashScope ASR(paraformer-realtime-v2)识别;识别文字在光标处实时填入草稿,静音自动停止,可选识别后自动发送。
China-ready voice input for the composer. Requires a local Python bridge (pip install dashscope websockets, run bridge/voice-bridge.py) — the plugin alone does not work. Browser mic streams 16 kHz PCM to the bridge, which runs Alibaba Cloud DashScope ASR (paraformer-realtime-v2); interim text fills the draft at the cursor, silence auto-stop, optional auto-send.
怎么安装
dsh plugin add dsh-voice-input-cn 简介
dsh-voice-input-cn **DeepSeek Harness Web 语音输入插件(国内可用版)** 在聊天输入框添加麦克风按钮,点击说话即可将语音转为文字填入草稿。基于 **阿里云 DashScope ASR**(国内直连可用),替代原版依赖的 Google Web Speech API(国内无法访问)。 **本项目 fork 自 NewDaNew/dsh-voice-input**,原版使用 Web Speech API(Google 云端),在国内直连不可用;本版重写了识别引擎为**阿里云 DashScope ASR + 本地 bridge**。 **🛠 开发工具**:本插件在 **DeepSeek Harness (DSH)** 中开发与调试(代码重构、排障、测试均由 DSH 辅助完成)。DSH 是一个开源 AI 助手框架:https://github.com/deepseek-ai/dsh --- ✨ 功能 🎤 输入框麦克风按钮,点击开始说话,静音 1.5 秒自动停止 📝 识别文字**实时填入输入框**(光标位置插入,不覆盖已有草稿) 🔀 中文 / English 语言切换 📨 可选"识别后自动发送" 🔌 本地 bridge(Python)中转,国内直连阿里云,低延迟 🧱 架构 浏览器插件 (lib/client.js) ├─ AudioWor…
推荐参考
信息
- 协议
- MIT
- 语言
- JavaScript
- GitHub 星标
- 0
- 月下载
- –
- 最近更新
- 2026-08-20
- 创建于
- 2026-08-19
基础安全检查
- 检查结果
- 无
- 收录来源
- curated:awesome-dsh-plugin.com, curated:awesome-dsh-plugin/awesome-dsh-plugin
- 主题标签
- dsh-plugin
同类推荐
dsh-ears
WizisCool/dsh-ears
面向 DeepSeek Harness (dsh) 的语音输入插件:输入框的麦克风按钮把语音转成草稿文本,支持多种语音识别后端,可选经 dsh 自有 LLM 路由润色,并带原生设置页。
dsh-voice-webspeech
anweat/dsh-voice-webspeech
浏览器 Web Speech API 语音输入:零服务端、零密钥、零模型下载(Edge=Azure 语音、Chrome=Google 语音)。
dsh-fish-tts
MaRi23333/dsh-fish-tts
朗读助手回复(仅支持 Fish Audio API,需自备 Key):逐条朗读、自动朗读开关,设置页可配模型、音色 reference_id、加密 API Key 与代理。
dsh-voice-input-plugin
Zhangbo-cn/dsh-voice-input-plugin
输入框麦克风:点击持续监控、按住对话;浏览器语音识别逐字上屏,回复由 host Edge TTS 边生成边朗读,朗读时暂停识别防回声,点击可停止。