核心信息
Meta 已发布 Muse Voice Transcribe,这是来自 Meta Superintelligence Labs 的实时音频感知模型,现可通过 Meta Model API、Meta AI for Mac 和 Muse Code 使用。
要点
- 支持实时流式自动语音识别(ASR),并可对 20 位以上说话人进行分离。
- 通过自适应延迟,在“速度-准确率”权衡上达到帕累托前沿(以最终转写时间衡量)。
- 今日起可通过 Meta 的 API、Mac 应用及 Muse Code 使用。