Hugging Face 开源 speech-to-speech 实时语音流水线,本地 GPU 实现端到端语音对话

Hugging Face 开源 speech-to-speech 实时语音流水线,本地 GPU 实现端到端语音对话

800_auto

近日,Hugging Face 正式开源speech-to-speech完整实时语音 AI 流水线,打造可本地部署的端到端语音对话方案,实现 “语音输入 - 识别 - 推理 - 语音回复” 完整闭环,整套流程可完全运行在本地 GPU,免费开放使用。

该项目搭建模块化语音交互链路,集成语音活动检测 VAD、语音转文字 STT、大语言模型 LLM、语音合成 TTS 四大核心模块,构成完整 “说、听、想、回” 对话体系。开发者可自由替换...

点击查看剩余70%

{{collectdata}}

网友评论