NOTES · 期刊
Qwen3 TTS开源模型与3个免费的TTS-API
发布于 2026/10/10 21:39 · 更新于 2026/10/10 21:39
Qwen3 TTS开源模型与3个免费的TTS-API
Qwen3-TTS 是由Qwen开发的一系列功能强大的语音生成,全面支持音色克隆、音色创造、超高质量拟人化语音生成,以及基于自然语言描述的语音控制,为开发者与用户提供最全面的语音生成功能。开源有0.6B和1.8B
本地可轻松运行,8g内存的cpu可以跑
- 🎵 语音合成: 高质量的文本转语音功能。
- 🎭 声音克隆: 支持从短音频示例进行零样本(Zero-shot)声音克隆。
- 🎨 声音设计: 支持通过自然语言描述自定义声音特质。
- 🚀 高效推理: 支持 12Hz 和 25Hz 的语音 Tokenizer 架构。
- 🎯 多语言支持: 原生支持 10 种主要语言(中文、英文、日文、韩文、德文、法文、俄文、葡萄牙文、西班牙文和意大利文)。
官网:https://qwen.ai/blog?id=qwen3tts-0115
ComfyU节点:https://github.com/flybirdxx/ComfyUI-Qwen-TTS/blob/main/README_CN.md
三个免费的TTS-api(Azure、火山、Edge)
不会用把全文复制给agent,可以帮你文生图
Azure
import base64音色列表
"voices": [火山
这个原理是用的火山翻译逆向
import logging音色
"voices": [edgetts
调用简单,调用edge_tts 包
import edge_tts"voices": [