返回首页
RadarAI··论文与技术

从“能说话”到“会表达”:Qwen-Audio-3.0-TTS 发布

中文摘要

通义实验室发布 Qwen-Audio-3.0-TTS 语音合成模型,通过 Flash 与 Plus 版本实现多语种、方言及自然语言控制,带来更具表现力的语音交互。

English Summary

Tongyi Lab released Qwen-Audio-3.0-TTS, featuring Flash and Plus versions for expressive speech synthesis, supporting multiple languages, dialects, and natural language instruction control.

原文节选

📌 一句话摘要 通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型,通过 Flash 与 Plus 双版本实现从“能说话”到“会表达”的进化,支持多语种、方言及自然语言指令控制。 📝 详细摘要 通义实验室发布了 Qwen-Audio-3.0-TTS 实时语音合成模型,包含面向实时交互的 Flash 版本(延迟约 300ms)和面向高质量生成的 Plus 版本(在 Artificial Analysi...