DeepSeek V4.1 Flash正式上线:性能全面超越V4 Pro,价格直降60%

DeepSeek V4.1 Flash正式上线:性能全面超越V4 Pro,价格直降60%

DeepSeek V4.1 Flash正式上线了。总参数552B的MoE模型,采用了全新的Causal-Encoder-Decoder非对称结构。输入激活只有8B、输出激活16B,推理成本大幅低于同尺寸模型,还原生支持多模态视觉理解,无需外挂视觉模块。

通过KV Cache压缩,对显存需求降至上一代的1/4、SSD降至1/8,社区实测输出速度达300到500 tokens/秒。各项基准全面超越V4 Pro,GPQA Diamond达90.9。

而且它还降价了。9月10日12:00起,Flash闲时缓存命中输入0.02元、未命中1元、输出4元/百万token,高峰时段翻倍。之前缓存命中是0.05元、未命中1.5元、输出4.5元/百万token。

DSH负责人崔添翼发文表示:”V4.1 Flash正式上线之后,V4 Pro模型的请求都会被路由到V4.1 Flash,并按Flash的价格计费。”Pro的价格是Flash的3倍,这意味着原来用Pro的用户直接降价到Flash水平。

对于开发者省钱攻略来说,核心策略就是:把原来调用V4 Pro的场景全部切换到V4.1 Flash。Flash不仅性能更强,价格还只有Pro的三分之一。

国内另一个定价派代表智谱,GLM-4.7 Flash一直是头号选择。8月26日智谱发布GLM-5.3-Flash(”牛来”),320B-A18B,性能超过DeepSeek V4 Pro,MIT全开源。价格为旗舰模型GLM-5.3的1/10。

总结省钱要点:1.用Flash替代Pro,性能更强价格更低;2.闲时段调用,价格再减半;3.KV Cache命中率优化,闲时缓存命中仅0.02元/百万token;4.关注模型路由变化,V4 Pro已按Flash价计费。

原文来源:字母AI/钛媒体

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注