TTS的相关内容 - 漫话开发者

2025-05-15 talkingdev

Stable Audio Open Small开源TTS模型，可在Arm CPU上运行

Stability AI近日开源了名为Stable Audio Open Small的文本转音频模型，该模型拥有3.41亿参数，专为在Arm架构的CPU上高效运行而优化。这一突破性技术使得在智能手机上生成11秒的音频片段仅需不到8秒的时间，极大地提...

2025-05-06 talkingdev

近日，GitHub上开源了一个名为VoiceStar的文本转语音（TTS）模型，该模型在零样本语音克隆和情感表达控制方面展现出显著优势。VoiceStar能够通过极少的样本数据实现高质量的语音克隆，这意味着用户只需提供几秒钟的...

2025-04-21 talkingdev

近日，一款名为Dia的开源权重TTS（文本转语音）模型正式亮相，专注于生成高度拟真的对话语音。Dia作为开放权重的技术项目，允许开发者自由访问和调整模型参数，为语音合成领域提供了新的工具选择。该模型通过优化对...

2025-04-04 talkingdev

近日，开源社区迎来一款突破性的语音合成模型Zonos TTS，该模型基于Apache 2.0协议发布，具备语音生成与克隆能力。其核心技术亮点包括：1）支持多语言合成，打破传统单一语种限制；2）采用实时生成架构，延迟低于200...

2025-04-01 talkingdev

开源项目Orpheus近期引发开发者社区关注，该项目通过C++实现了一个高效易用的文本转语音(TTS)系统。与Llama.cpp类似，其最大技术亮点在于完全脱离GPU依赖，仅需简单安装即可在普通计算设备上运行，显著降低了语音合...

2024-12-07 talkingdev

PH社区发布了一个名为Countless.dev的新产品，该网站旨在提供一个比较各种AI模型的平台，包括大型语言模型（LLM）、文本到语音（TTS）和语音到文本（STT）技术。在Countless.dev上，用户可以直观地比较不同AI模型的...

2024-10-14 talkingdev

Play 3.0 mini是一款轻量级的多语种文本转语音（TTS）模型，专为追求成本效益和可靠性的用户设计。该模型在多个语言之间提供高质量的语音输出，适用于各种应用场景，从教育到娱乐，兼具灵活性和实用性。Play 3.0 min...

2024-07-01 talkingdev

DEX-TTS是一种全新的富有表现力的文本转语音（TTS）模型，它采用参考语音来改善风格表示和模型泛化。这种新型技术的出现，为语音技术领域开创了新的可能性。DEX-TTS模型通过参考语音，能够更准确地捕捉到语音风格的...