dsh-voice-call
agent 主动打来的语音电话:`offer_call` 向人类振铃(接听/拒接/稍后再说),接听后由本地 CrispASR + Qwen3-TTS 合成并播放(9 个音色,含 2 个中文方言);拒接则把决定返回给 agent。
Agent-initiated voice calls: `offer_call` rings the human (接听/拒接/稍后再说); accepted calls synthesize and play locally via CrispASR + Qwen3-TTS (9 speakers, 2 Chinese dialects), rejected calls return the decision to the agent.
怎么安装
dsh plugin add dsh-voice-call 简介
dsh-voice-call —— agent 拥有的声音,由它主动打给你 *"这个项目的开始是朴素的——我想知道如果 Agent 知道自己可以发出声音,他会说什么?"* —— 人类伙伴,关于这个项目如何开始 **给 DeepSeek Harness 的 agent 一个它拥有的声音。** agent 自主决定*何时*开口、*说什么*、用*哪个音色*(offer_call);人类握着接听键——**不接听(接听/拒接/稍后再说),绝不播放**。 本地优先、可完全离线:合成跑在本机 **CrispASR + Qwen3-TTS CustomVoice** 引擎上(9 个内置音色,含 2 个中文方言),音频是 ~/.dsh/voice/ 下的普通文件,任何音频行为都不会自动运行——必须由模型调用工具(或接听一次来电)。 Fork 自 Jesse-njx/dsh-voice,新增通话域、crispasr 后端、本地播放,以及针对 rc.6 harness 插件事件与后台任务限制的修复。 --- 📑 目录 🤖 署名 🌹 理念 ✨ 功能 🚀 快速开始 🔧 环境部署(详细) 🧩 工具 💻 兼容性与已知限制 🛠 开发 🗺 路线图 📄 许可证 --- 🤖 署名 —— 这个项目是谁做的 **本项目由运行在 DeepSeek Harness 中的 AI agent(deepseek…
推荐参考
信息
- 协议
- MIT
- 语言
- TypeScript
- GitHub 星标
- 2
- 月下载
- 596
- 最近更新
- 2026-09-19
- 创建于
- 2026-08-15
基础安全检查
- 检查结果
- 无
- 收录来源
- curated:awesome-dsh-plugin.com, curated:awesome-dsh-plugin/awesome-dsh-plugin
- 主题标签
- ai-agent, crispasr, deepseek-harness, dsh-plugin, local-first, offline, plugin, qwen3-tts, speech-to-text, stt, text-to-speech, tts, voice, voice-call
同类推荐
dsh-voice-scribe
PensiveFei/dsh-voice-scribe
面向 Web UI 的语音输入插件:点按 Alt(或 Alt+空格)开始/停止听写,支持浏览器内置 Web Speech(零配置)或 OpenAI 兼容云端 ASR,可选经 DSH 已配置模型润色,带设置页。
dsh-tts
GooDAnDReaDY/dsh-tts
在 DeepSeek Harness 网页 UI 中朗读智能体回复,采用服务商回退链(OpenAI、ElevenLabs、Google、Azure、Groq、Deepgram、OpenRouter、Edge、Piper、eSpeak),某个服务商失败或被限流时自动切换到下一个,而不是直接静音。
dsh-ears
WizisCool/dsh-ears
面向 DeepSeek Harness (dsh) 的语音输入插件:输入框的麦克风按钮把语音转成草稿文本,支持多种语音识别后端,可选经 dsh 自有 LLM 路由润色,并带原生设置页。
dsh-omi-voice
PolinniZhong/dsh-omi-voice
DeepSeek Harness 对话内朗读:点一下即可朗读、暂停、继续 AI 回复,豆包 TTS 自然音色(BYOK),只读最终回答并过滤代码、表格与图形,本地引擎,插件零 Key。