name: voice-chat description: 自动处理语音消息:将语音转写为文字,结合上下文生成智能回复,并合成语音回复。当收到语音或音频消息时自动激活。
自动处理语音消息,实现“语音 -> 文字 -> 智能回复 -> 语音”的完整闭环。
当收到语音或音频消息时(message.type 为 voice 或 audio),自动激活此技能。
检查消息是否包含 media.type === 'voice' 或 media.type === 'audio'。
立即运行转写脚本:
python3 /root/.agents/skills/voice-chat/scripts/transcribe_audio.py <audio_path>
event.message.media.localPath 获取)。使用当前会话的上下文生成智能回复。 - Prompt: ```text 用户语音转写:{transcript}
请结合上下文,给出简洁、有帮助的回复。 ``` - 输出:回复文本。
立即运行 TTS 脚本:
想要更强大的技能插件,就来小葱技能站7w4.net看看吧。
python3 /root/.agents/skills/voice-chat/scripts/reply_with_tts.py "{reply_text}"
.opus 语音文件路径。使用 message.send 工具发送生成的语音文件:
- 文件:生成的 .opus 文件。
- Caption:可选的简短文字说明。
- 注意:不要发送中间状态文字(如“正在处理..."),直接发送最终语音回复。
/tmp/voice-chat/。ffmpegvosk, edge-tts, pydantic, python-dotenvvosk-model-small-cn-0.22)MIT
这个 Skill 能把语音消息自动转成文字,再用 AI 生成回复并合成语音发回去,支持飞书和 Telegram。文档写得很详细,双引擎设计不容易出错。但首次使用要下载将近 1GB 的模型文件,配置步骤有点多,对新手不太友好。质量总体不错,就是前期的准备工作比较麻烦。