核心信息

Perplexity 在 WANDR 基准上对 GPT-6 Astra 进行了评测,其得分达到 0.682,单任务成本为 11.98 美元,是目前所有已测模型中的最高分。

要点

  • GPT-6 Astra 比 Fable 5.1 得分高 13.5%,而单任务成本低 6.1%。
  • 相比 Opus 5,得分高出 27.0%,成本仅高 3.3%。
  • 这一结果使 GPT-6 Astra 成为 Perplexity 在 WANDR 上目前测试过的领头模型。