❯ DeepSeek V4.1 Flash上线首日出现适配差,英伟达六类GPU率先跑通vLLM
首日适配SemiAnalysis称,DeepSeek V4.1 Flash发布首日,英伟达vLLM已在六类GPU上直接运行,覆盖H100、H200、B200、B300、GB200和GB300;同一时间,AMD文档所指向的对应镜像仍未公开。
工程差距据SemiAnalysis首日测试,作为背景,新模型能否快速投入生产,取决于推理框架、算子和容器镜像是否同步,而不只是芯片峰值性能。英伟达与相关团队在发布时完成适配,让开发者可以立即测试。AMD缺失的公开镜像会推迟真实任务比较,但这仍是发布后23小时内的观察,不能直接推导长期性能差距。
开发选择发布后的前24小时是测试窗口,云平台和开发者会在此时建立首批基准。算力平台争夺的是模型上线速度和工具完整度;谁先跑通,谁就更容易拿到第一批测试、部署和故障反馈。下一步要看AMD镜像何时发布,以及两套平台在同一任务下的吞吐与成本。
▪ SIGNAL新模型发布把芯片竞争压缩到小时级,首日能否提供可用镜像,已经和硬件性能一样影响开发者选择。