首页
看点啥
插画图片
首页 看点啥 Qwen-Audio-3.0-TTS - 阿里通义千问发布的语音合成模型

Qwen-Audio-3.0-TTS - 阿里通义千问发布的语音合成模型

2026-07-21 0

Qwen-Audio-3.0-TTS是什么

Qwen-Audio-3.0-TTS 是阿里通义千问推出的语音合成大模型,包含面向实时交互的 Flash 版与面向高质量生成的 Plus 版。模型在 Artificial Analysis 全球 TTS 榜单中斩获冠军,支持细粒度标签控制、自然语言指令定义声音风格,覆盖 16 种语言与 20 种中文方言,音频输出提升至 48KHz 录音棚级品质,单次合成最长 3 分钟。

Qwen-Audio-3.0-TTS的主要功能

Qwen-Audio-3.0-TTS的技术原理

如何使用Qwen-Audio-3.0-TTS

Qwen-Audio-3.0-TTS的核心优势

Qwen-Audio-3.0-TTS的项目地址

Qwen-Audio-3.0-TTS的同类竞品对比

维度Qwen-Audio-3.0-TTS-PlusElevenLabs v3榜单排名Artificial Analysis 第 1未进前 3采样率48KHz通常 44.1KHz标签控制原生支持结构化标签需通过 Prompt 间接控制方言支持20 种中文方言有限多语种 SOTA10 种语言词错误率最优部分语种领先噪声鲁棒性原生语音增强依赖干净参考音频API 定价$27.6 / 1M 字符约 $11 / 1M 字符

Qwen-Audio-3.0-TTS的应用场景

喜欢(0)

上一篇

MiniCPM-Robot - 面壁智能开源具身智能 VLA 模型系列

MiniCPM-Robot - 面壁智能开源具身智能 VLA 模型系列

下一篇

LoHoSearch - 美团打造的下一代搜索智能体评测基准

LoHoSearch - 美团打造的下一代搜索智能体评测基准
猜你喜欢