11月中文大模型基准测评出炉:GPT 5.1夺冠、DeepSeek开源第一

快科技11月28日消息, SuperCLUE公布了2025年11月中文大模型基准测评结果。
本次测评围
绕数学推理、科学推理、代码生成(含web开发)、幻觉控制、精确指令遵循五大核心任务展开,题目总量为822
道新题,最终得分取各任务平均分。
本次共测评27个国内外大模型同台竞技,OpenAI的GPT 5.1与国
产模型DeepSeek分别斩获综合冠军与开源领域第一。
OpenAI的GPT-5.1 (high) 以6


本文转载自:太平洋科技
原文链接:https://g.pconline.com.cn/x/2026/20265812.html

本文由 XZ导师app 自动发布 | 发布时间:2026/7/26 14:33:24