2026年8月28日,阿里、智谱与DeepSeek几乎在同一时间发布了各自新一代”Flash”轻量旗舰模型。三款模型并非传统的”砍参数”阉割版,而是通过极致的架构优化,在”够用的智能”与”极致的成本”之间找到了最优解。
核心参数对比:
– Qwen3.8-Flash(阿里):总参数125B,激活6B,原生26万上下文,最高百万级
– GLM-5.3-Flash(智谱):总参数320B,激活18B,原生百万级上下文
– DeepSeek-V4-Flash:总参数284B,激活13B,原生百万级上下文
定价对比:
– Qwen3.8-Flash:输入1.0元/百万Token,输出3.0元/百万Token,无峰谷价差
– GLM-5.3-Flash:输入0.8元,输出2.8元,限时半价期间输入仅0.4元
– DeepSeek-V4-Flash:闲时输入1.5元/输出4.5元,高峰时段3.0元/9.0元,缓存命中仅0.05元
能力实测:
– Qwen3.8-Flash在办公生产力智能体任务和视觉推理数学方面领先
– GLM-5.3-Flash在Artificial Analysis综合指数获57分,与Claude Opus 4.8持平,原生多模态和视觉编码能力突出
– DeepSeek-V4-Flash在9项Agent基准测试中全面碾压上一代,终端操作能力逼近Opus-4.8
选型建议:海量API调用选Qwen,AI Agent和自主编程选GLM,仓库级代码生成选DeepSeek。