核心信息

Meta 已发布 Muse Voice Transcribe,这是来自 Meta Superintelligence Labs 的实时音频感知模型,现可通过 Meta Model API、Meta AI for Mac 和 Muse Code 使用。

要点

  • 支持实时流式自动语音识别(ASR),并可对 20 位以上说话人进行分离。
  • 通过自适应延迟,在“速度-准确率”权衡上达到帕累托前沿(以最终转写时间衡量)。
  • 今日起可通过 Meta 的 API、Mac 应用及 Muse Code 使用。