DeepSeek V4.1 Flash正式发布 大幅降价 缓存命中成本砍掉60%

DeepSeek发布V4.1 Flash 非对称架构 缓存命中输入大降60%

DeepSeek正式发布新一代轻量模型V4.1 Flash。该模型总参数552B、采用MoE架构与Causal-Encoder-Decoder非对称结构,输入侧激活约8B、输出侧激活约16B,原生支持多模态,并通过KV缓存分层存储(约1/4占用HBM、1/8占用SSD)大幅降低推理成本。新定价自9月10日12:00起生效:闲时缓存命中输入0.02元/百万Token、未命中1元、输出4元,峰时价格翻倍,其中缓存命中输入价格降幅达60%。DeepSeek同时宣布V4 Pro自9月14日起路由下线、统一由Flash承接。腾讯WorkBuddy、CodeBuddy、OpenCode等已成为首批接入伙伴,性价比提升有望加速端侧与企业级落地。

原文来源:https://www.myzaker.com/article/6aa13a058e9f0937c3560b69

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注