核心信息

Composio 的基准测试以其庞大的连接器与 MCP 工具库为基础,被定位为衡量 AI 在日常知识工作中表现的标准。Command Code 在运行 GPT-6 Astra 模型时排名第二,表明其不仅擅长编程,也能胜任实际工作场景。

要点

  • Composio 基准测试号称是知识工作的参考标准,使用了目前最全面的连接器和 MCP 工具集。
  • Command Code 在 GPT-6 Astra 模型的基准测试中拿下第二名的成绩。
  • 结果显示 Command Code 的表现不局限于写代码,也覆盖了日常知识工作任务。