、扩大预训练基座,依靠持续拉长、丰富的后训练,同样可以实现能力跨越式升级。
在此之前,DeepSeek最新版本性能提升,同样大量依托后训练阶段投入。行业不难发现,单纯扩充参数规模的边际收益持续下滑。搭建全
算力投入;而后训练路线成本可控,更适合持续针对编程、智能体、安全等垂直场景定向优化。
这意味着接下来的大模型竞争逻辑正在转变。过去比拼谁能训练出更大基座;未来厂商的差距,会体现在任务环境搭建、强化学习框架
本文作者:魏家东
本文转载自:网易新闻客户端
原文链接:https://c.m.163.com/news/a/L4CBJKCC051181RS.html
本文由 XZ导师app 自动发布 | 发布时间:2026/8/17 13:54:12