LongCat-2.0 已在 Command Code 上线并向所有订阅者免费开放
LongCat-2.0 现已免费上线 Command Code,拥有 1.6T 总参数、48B 激活参数和 1M 上下文窗口。
LongCat-2.0 现已免费上线 Command Code,拥有 1.6T 总参数、48B 激活参数和 1M 上下文窗口。
Meta Muse Spark 1.3 现已在 Command Code 的 GOAT、Pro、Max 和 API 方案中上线。官方称其为迄今性能最强、成本最低的模型,基准测试达到 Sol 级别,可与 Opus 5 和 GPT 5.6 对标。
MiniMax 开源模型 FastH3 现已登陆 Reactor 平台,支持带音频的 720p 视频生成,价格低至每秒 $0.007,并支持首帧图像输入。官方提供了可克隆的演示应用。
Command Code 团队对前沿模型与开源模型开展了 26 组以上的并排对比测试,所有运行结果均已公开并开源,并提供基准演示链接。
Command Code 使用相同的 /design 提示在 FlappyBench 上对比了 Muse Spark 1.3、Grok-4.6 和 Gemini 3.8 Flash。Muse Spark 1.3 以最低成本取得最佳表现,而 Gemini 3.8 Flash 成本最高且未完全完成。
在中美AI竞争中,OpenAI和Anthropic定位不同,并非关键变量;真正有威胁的竞争者需要是美国背景、开源模型,并具备大规模推理能力。
Command Code 新增了最便宜的模型选项 Muse Spark 1.3,推文中提到“Flappy bench”作为性能参考。
一位正在构建 AI 编程工具的开发者认为,基准测试排名具有误导性——人们执着的指标并不能反映真正驱动采用和增长的因素。
一位开发者指出,Claude Code 在层出不穷的基准测试中屡屡垫底,却依然是排名第一的 AI 编程工具,并且增长速度超过大多数竞品——这一现象已持续一年。
OpenCode 开发者解释为何不自研模型:能力不足、赛道拥挤,以及希望保持中立,成为各家模型同台竞技的平台。