Command Code:DeepSeek V4.1 Flash 发布24小时处理3.1万亿付费Token
Command Code 表示 DeepSeek V4.1 Flash 已成为其使用量最高的模型,并称上线24小时内处理了3.1万亿付费Token,持续吞吐达230–300 TPS。
Command Code 表示 DeepSeek V4.1 Flash 已成为其使用量最高的模型,并称上线24小时内处理了3.1万亿付费Token,持续吞吐达230–300 TPS。
开源编程代理 OpenCode 宣布将用量提升再延长一周,此前的 72 小时 4 倍额度与 Day-0 支持将继续生效。
智能体编程平台 Qoder 发布一系列更新:CLI 支持所有用户接入自定义模型、集成 Kimi K2.8 Preview,以及新增 Canvas 移动开发插件,支持实时交互与可视化标注。
OpenAI 对 Astra 执行重置,修复了技能误触发问题,并禁用了影响约 4-5 千用户的可选上下文管理实验。
阿里巴巴 Qwen 的稠密开源模型 Qwen3.8-27B 现已上线 Cerebras,支持高速推理,并在 Artificial Analysis Intelligence Index 上获得 34 分,与多款前沿模型不相上下。
LiteLLM分享了Vultr团队的官方教程,介绍如何在Vultr上使用Docker Compose部署LiteLLM网关,从而更轻松地为多个LLM提供OpenAI兼容的API接入层。
GMI Cloud 官方迎来一位新大使,将加入 GMI Clouders 社区,并与 GMI Cloud Japan 携手合作。
OpenCode 相关开发者表示,团队已对终端界面中的每个模态框和对话框完成审计,目标是精简元素、统一模式并改进视觉设计;详细解析即将发布。
Cline 数据显示,单任务平均交互轮次从3月的26次增至8月的50次,接近翻倍;官方归因于 DeepSeek V4.1-Flash 等模型的成本效率提升。
一则推文介绍,麻省理工学院EQuS团队的研究人员Bea Yankelevich使用GPT-5.6 Sol与Codex自动执行量子芯片的常规测量,从而腾出时间加快实验设计。