Memos WorldMemos World
返回 AI Time

Mistral 发布开源语音大模型 Voxtral-4B

模型发布语音
Mistral 发布基于 Voxtral Codec 的开源语音模型 Voxtral-4B-TTS-2603,采用混合 VQ-FSQ 量化方案,仅需 3 秒参考音频即可克隆声纹,支持长文本自然语音生成。

相关主体