Meta Muse Spark 1.3 以 75.4% 登顶 DeepSWE 基准测试
Meta 的 Muse Spark 1.3 据称以 75.4% 的成绩在 DeepSWE 上排名第一,领先于 GPT-5.6 Sol 和 Fable 5。该模型正在 Muse Code 和 Meta 模型 API 中推出,max reasoning 版本将在安全测试后发布。
Meta 的 Muse Spark 1.3 据称以 75.4% 的成绩在 DeepSWE 上排名第一,领先于 GPT-5.6 Sol 和 Fable 5。该模型正在 Muse Code 和 Meta 模型 API 中推出,max reasoning 版本将在安全测试后发布。
Stability AI 分享了蒙特利尔黑客马拉松的关键观点:创意 AI 的未来在于更小、本地运行、能融入创作过程并带来“亲密感”的模型。
GMI Cloud 为用户延长 5 天免费使用 MiniMax M3、M2.7、Music 3.0 和 Speech 2.8 的时间,并邀请创作者参与 MiniMaxathon,赢取 500 美元现金、MiniMax 代币额度及 200 美元 GMI 积分。
Meta 已发布 Muse Spark 1.3,这是其五个月内第四次模型发布。新版本在基准测试中表现显著提升,尤其在智能体任务和科学能力方面。
Grok Imagine 现在支持在单个视频提示中使用最多 14 个参考素材(图片、声音、角色参考),并通过 @ 标签标记。
Command Code 在 GOAT 方案中加入 Gemini 3.8 Flash,并提供 4 倍用量,用于 AI 辅助编程。
Muse Spark 1.3 今日上线,以极低成本提供编程与智能体任务的前沿性能,现已可通过 Muse Code 和 API 使用。Ollama 热切期待即将推出的开放权重版本。
Perplexity 已开放其专为 Apple 芯片打造的本地推理引擎 Lily。Lily 将 Apple 芯片视为独立的推理平台,并把 Qwen 的计算与内存操作直接映射到其架构上。
Perplexity 分享了其开源本地推理引擎 Lily 在 M5 Max MacBook Pro 上的基准测试结果:相比 MLX-LM,prefill 吞吐提升至 1.23 倍、decode 吞吐提升至 1.35 倍,且输出质量基本不变。
Perplexity 已开源 Lily,这是 Perplexity Computer 中支撑混合计算的本地推理引擎,专为 Apple 芯片上的 Qwen3.6-35B-A3B 优化,避免端侧计算拖慢任务。