核心信息

Command Code 在 29 项任务的基准对比中与 Codex、Hermes Agent 并列第一(21/29),并宣称具备顶级 token 效率。

要点

  • 在六个 AI 编码框架(harness)中,Command Code 与 Codex、Hermes Agent 以 21/29 并列领先;Claude Code 为 20/29,OpenCode 与 Pi Agent 为 19/29。
  • 各框架间差距仅约 7 个百分点:29 项任务中只有 3 项结果不同,18 项全部通过,8 项全部失败。