腾讯混元2.0发布:4060亿参数MoE架构,256K上下文

腾讯混元2.0发布:4060亿参数MoE架构,256K上下文

腾讯正式发布混元2.0大模型,采用MoE架构,总参数量4060亿(激活320亿),支持256K token超长上下文。在数学推理、编码和指令遵循等方面表现优异。同时腾讯还开源了Hunyuan-7B-FP8,通过FP8量化技术实现显存减半、推理提速1.8倍。

原文链接:https://ai-damn.com/tencent-s-hunyuan-2-0-ai-model-takes-a-big-leap-forward-1765148463481

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注