DeepSeek-V4 Flash 已上线并支持视觉能力
DeepSeek-V4 Flash 现已上线并支持视觉能力,标志着 DeepSeek 模型家族在多模态方向的新进展。
DeepSeek-V4 Flash 现已上线并支持视觉能力,标志着 DeepSeek 模型家族在多模态方向的新进展。
LTX Ripple 是一种基于 LTX 2.5 的高效 IC LoRA 视频编辑方法。用户只需编辑首帧,修改便会扩散到整个视频,实现快速且精准的编辑效果。
有用户展示如何用 MiniMax H3 Max 制作交互式游戏,所有决策由玩家决定,且模型速度极快,几乎无延迟。
一条简短动态显示,有人希望资助让大语言模型变有趣的项目,AI喜剧正成为一个值得关注的新兴方向。
一项新研究结果表明,在后训练阶段,改用带注意力汇聚的滑动窗口注意力掩码(无需额外成本)即可超越线性注意力。论文现已公开。
一位开发者表示,他们使用TRL和OpenEnv训练了一个编码模型,使其能够用JavaScript作画,并计划发布包含代码、模型、数据集和RL环境的博客。
有用户用腾讯混元 Hy4 preview 以同一提示词制作《清明上河图》动画,并称效果明显优于 GLM5.3-Flash。
一位测试者用相同提示词进行单次生成对比,发现腾讯混元Hy4预览版表现意外地接近竞品,并称其相比Hy3是巨大飞跃。
用户表示使用 MiniMax H3 Max 制作交互式游戏,所有决策由用户控制,模型速度极快,几乎没有延迟。
Command Code AI 强调其 shell 工具是最高效的 agent harness,声称可减少 30% token 费用,并在 TEF 帕累托前沿上占有一席之地。