Memos WorldMemos World
返回 AI Time

Meta 发布首个实时音频感知模型 Muse Voice Transcribe

模型发布语音
Meta 发布首个实时音频感知 AI 模型 Muse Voice Transcribe,支持在 20 余名说话者的录音中分离不同发言者,并通过流式自动语音识别同步输出文字。开发者可通过 Meta Model API 调用,定价为每 1000 分钟音频 3 美元。

相关事件

相关主体