点击开始
Speech-to-speech 是 Hugging Face 开源的实时语音智能体框架。它不是单个端到端模型,而是把四个开源模型串联起来(语音活动检测、语音识别、大语言模型、语音合成),每个环节都可以替换或本地部署。本页面已接入本地部署的完整链路。
处理链路
http://localhost:8080
/v1/realtime
让助手在对话中调用这些工具,改动即时生效。