软件分类 游戏分类 资讯分类

原创音质跃升录音棚级别,阿里千问发布Qwen-Audio-3.0-TTS霸榜Artificial Analysis

编辑:佚名 时间:2026-07-27 17:56:23

      近日,阿里千问震撼发布了全新语音合成大模型 Qwen-Audio-3.0-TTS,该模型一经推出便在全球第三方权威榜单 Artificial Analysis 中力压群雄,荣获冠军宝座。此次发布包含面向实时交互的 Flash 版本与面向高质量生成的 Plus 版本,标志着国产大模型在语音合成领域的技术实力再创新高,实现了从单纯的“能说话”向富有情感的“会表达”的跨越式突破。

      音质跃升录音棚级别,阿里千问发布Qwen-Audio-3.0-TTS霸榜Artificial Analysis

      作为新一代语音合成标杆,Qwen-Audio-3.0-TTS 在技术细节上实现了系统性提升。新模型创造性地支持在文本中嵌入结构化标签,用户可以直接使用 [gasp]、[giggles]、[angry] 等标记,对语气、情绪及呼吸声等细节进行精准调控。这种细粒度的控制能力,配合对 freestyle 指令的完美遵循,使得合成语音的细腻程度大幅提升,真正做到了让机器语音充满情感与表现力。

      在音质与语种支持上,Qwen-Audio-3.0-TTS 同样交出了满分答卷。模型将音频输出采样率从 24KHz 提升至 48KHz,单次合成时长可达 3 分钟,音质规格直接对标录音棚与影视配音级别。同时,模型配套开箱即用的精品音色库,覆盖中、英、日、韩等 16 种语言及广东、四川、东北等 20 种方言,新增阿拉伯、越南等小语种支持,构建了真正面向全球多场景的高质量语音生成生态。

      Qwen-Audio-3.0-TTS 的发布,不仅是阿里千问在多模态大模型领域的又一重要里程碑,更重新定义了语音合成技术的标准。凭借在 Artificial Analysis 榜单的夺冠表现以及在音质、控制力与多语种支持上的全面突破,Qwen-Audio-3.0-TTS 必将为智能客服、有声读物、游戏配音等应用场景带来革命性的体验升级。

热门推荐

相关文章