-
OpenAI推出GPT-Live,新一代实时语音交互模型上线
OpenAI 近日推出 GPT-Live,这是一款面向实时语音交互场景的新一代语音模型,旨在提升 AI 与用户之间的自然交流体验。该模型重点优化实时语音理解、连续对话和低延迟响应能力,为 ChatGPT Voice 以及未来更多语音 Agent 应用提供底层模型支持。 相比传统语音助手采用“用户讲话 → 语音识别 → 模型处理 → 语音回复”的交互流程,GPT-Live 更强调实时性和连续交流能力…- 791
- 0
-
GPT-Live:OpenAI 新一代实时语音交互模型
GPT-Live 是 OpenAI 推出的实时语音交互模型,具备低延迟语音处理、自然连续对话、多模态协同和多语言交流能力,为 ChatGPT Voice、AI助手、语音Agent和智能设备提供实时交互基础。- 912
- 0
-
Step-Audio:阶跃星辰推出的开源语音交互模型
Step-Audio 是阶跃星辰与吉利联合开发的业内首款开源产品级语音交互模型。它能够根据不同的场景需求,生成具有情绪、方言、语种、歌声及个性化风格的语音,支持自然、高质量的对话。- 9.2k
- 0
-
GLM-4-Voice:智谱推出的端到端情感语音模型
GLM-4-Voice是智谱推出的端到端情感语音模型,具备理解和表达情感、实时交互、语速调节、多语言和多方言支持等功能。作为一个情感语音模型,GLM-4-Voice能够实现更加自然、细腻的语音交流,例如在对话中表达喜怒哀乐等情绪。- 4.2k
- 0




