AI快讯苏晓 2026-01-23 13:10:01 来源:中房网
中房网讯 1月22日,据千问Qwen微信公众号消息,Qwen3-TTS多码本全系列模型已开源,包含1.7B和0.6B两种尺寸,1.7B可以达到极致性能,0.6B均衡性能与效率。
据悉,Qwen3-TTS是由Qwen开发的一系列功能强大的语音生成模型,全面支持音色克隆、音色创造、超高质量拟人化语音生成,以及基于自然语言描述的语音控制,为开发者与用户提供最全面的语音生成功能。依托创新的Qwen3-TTS-Tokenizer-12Hz多码本语音编码器,Qwen3-TTS实现了对语音信号的高效压缩与强表征能力,不仅完整保留副语言信息和声学环境特征,还能通过轻量级的非DiT架构实现高速、高保真的语音还原。Qwen3-TTS采用Dual-Track双轨建模,达成了极致的双向流式生成速度,首包音频仅需等待一个字符。