从“能说话”到“会表达”:Qwen-Audio-3.0-TTS 发布
中文摘要
通义实验室发布 Qwen-Audio-3.0-TTS 语音合成模型,通过 Flash 与 Plus 版本实现多语种、方言及自然语言控制,带来更具表现力的语音交互。
English Summary
Tongyi Lab released Qwen-Audio-3.0-TTS, featuring Flash and Plus versions for expressive speech synthesis, supporting multiple languages, dialects, and natural language instruction control.
原文节选
📌 一句话摘要 通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型,通过 Flash 与 Plus 双版本实现从“能说话”到“会表达”的进化,支持多语种、方言及自然语言指令控制。 📝 详细摘要 通义实验室发布了 Qwen-Audio-3.0-TTS 实时语音合成模型,包含面向实时交互的 Flash 版本(延迟约 300ms)和面向高质量生成的 Plus 版本(在 Artificial Analysi...