核心信息

据称,Meta 的 Muse Spark 1.3 在 DeepSWE 基准测试中以 75.4% 的成绩取得第一名,领先于 GPT-5.6 Sol 和 Fable 5。该模型现已在 Muse Code 和 Meta 模型 API 中推出,max reasoning 版本将在安全测试完成后提供。

要点

  • 在 DeepSWE v1.1 上取得 75.4% 的领先成绩,达到当前最优水平。
  • 可通过 Muse Code 和 Meta 模型 API 使用,后续将扩大开放范围。
  • 显示 Muse Spark 系列持续快速迭代,近期发布节奏明显加快。