o数据集,包含116K全景视频、22M全景帧,涵盖504个高质量3D场景,为模型提供训练基础。
五、 混元多模态理解模型上新,LMArena Vision 榜国内第一
1. 腾讯发布混元Large-Vis
ion,采用MoE架构,激活参数52B,支持任意分辨率图像、视频、3D空间输入,重点提升多语言场景理解能力;
2. 该模型在国际LMArena Vision排行榜取得1256分,位列第五名(国内模型第一名
本文作者:腾讯研究院
本文转载自:手机搜狐网
原文链接:https://m.sohu.com/a/923426454_455313/
本文由 XZ导师app 自动发布 | 发布时间:2026/8/17 13:57:42