❯ DeepSeek 上线实验性多模态模型 V4-Flash-Vision-Exp,单次可读 600 张图
模型上线DeepSeek 发布实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp 并已在自家 API 平台开放。它在 V4-Flash 文本版基础上加了图像理解,公司称文本侧的推理、智能体与世界知识能力与原版持平,支持 JPEG、PNG、GIF、WebP 四种格式,单次请求最多处理 600 张图像。
成绩与口径公司公布的数据里有两项超过 Anthropic 的 Opus 4.8:Agents’ Last Exam 得 27.3 对 25.7,ZeroBench 得 35.0 对 34.0。但这些成绩是 DeepSeek 用自家 Harness Minimal Mode 内部跑出来的,尚未经第三方独立复现,看的时候要带上这个前提。
一天两条把它和当天另一条放在一起才有意思:一个实验性 Flash 档模型对标 Opus 4.8,一个匿名 Flash 档模型压过 GPT-5.6。中国实验室的发布节奏已经不按对方的时间表走了,而厂商自报基准的可信度正在成为读者要自己处理的问题。
▪ SIGNAL自家 Harness 跑出来的对标数字,参考价值取决于第三方多久能复现出来。