据格隆汇消息,8月21日,DeepSeek在DeepSeek API平台上推出了DeepSeek-V4-Flash-Vision-Exp,一款实验性多模态视觉模型。该模型在智能体能力、推理和世界知识方面与DeepSeek-V4-Flash保持同等文本性能,但在视觉理解基准上实现了显著提升,多模态智能体性能接近Claude Opus 4.8的水平。
据 Max For AI 称,小米的下一代大语言模型 MiMo-V3-Pro 据称于 8 月 21 日在 SWE-Bench Pro 上取得了 72.8 分的成绩,这是根据在线社区流传的泄露基准截图所声称的。该报告分数超过了智谱的 GLM 5.3(67.9)和月之暗面的 Kimi K3(65.8),落后于 Claude Opus 5(74.6)和 GPT-5.6 Sol Max(75.4)不到 3 分。然而,小米尚未官方确认该基准测试的真实性或测试条件,且该模型目前缺乏官方公告。最新公开确认的 MiMo 旗舰型号仍是 V2.5-Pro。