OpenClaw小龙虾语音对话方案综述

概述

语音方案力求本地,免费,实现对话模式

本地方案

  1. Web Speech API(免费不开源)

语音识别 (STT) :SpeechRecognition(通常需要联网)
语音合成 (TTS) :SpeechSynthesis(不需要联网)
2. ### openai-whisper + edge-tts
语音识别 (STT) : openai-whisper(openclaw内置技能名,微软出品,clawhub相关变种很多,本地运行,免费开源模型)
语音合成 (TTS) :edge-tts(openclaw外置技能名,微软出品,clawhub相关变种很多,必须联网,个人免费不开源)
3. ### faster-whisper + (beware-)piper-tts
语音识别 (STT) : faster-whisper(openclaw外置技能名,clawhub相关变种很多,本地运行,免费开源模型,更快)
语音合成 (TTS) :(beware-)piper-tts(openclaw外置技能名,clawhub相关变种很多,本地运行,免费开源模型,更快)

联网方案

调用语音大模型,收费但效果更好

备注

上述语音技能均依赖于ffmpeg库,因此必须安装
可以调出麦克风或小喇叭图标手动控制;
也可以使用代码连贯,形成talk对话模式(piper输出流)
kokoro 与 piper tts 新老之争。

posted @ 2026-04-06 12:02  engineer大叔  阅读(80)  评论(0)    收藏  举报