ElevenLabs发布Eleven v4:迄今最具表现力的文本转语音模型,Turbo版延迟仅约100毫秒
talkingdev • 2026-09-29
2398 views
ElevenLabs正式推出Eleven v4及Eleven v4 Turbo,这是其迄今最具情感表现力的文本转语音模型。Eleven v4能够识别并生成语气、节奏、情绪、角色和上下文等细微变化,使合成语音呈现戏剧化、温柔、紧迫、喜剧或日常对话等多种风格,同时保持说话者身份一致。模型还能结合对话上下文产生自然对话和角色互动,提升有声内容、虚拟角色和交互式语音应用的沉浸感。Eleven v4 Turbo将该技术用于低延迟场景,中位推理延迟约100毫秒,适合实时语音助手、对话式AI等需要快速响应的产品。该系列现已上线ElevenAgents、ElevenCreative和API,为创作者与企业提供更自然的语音生成能力,推动AI语音从播报式合成向更具情感和表达力的方向演进。
核心要点
- Eleven v4可识别语气、节奏、情绪和上下文,生成多种风格且保持说话者身份一致
- 模型能结合对话上下文进行自然对话和角色互动,提升语音交互沉浸感
- Eleven v4 Turbo面向低延迟场景,中位推理延迟约100毫秒,已上线ElevenAgents、ElevenCreative和API