智谱发布GLM5.2,中国大模型在推理能力上再次逼近世界前沿
乌鸦小编 发表于:2026-6-14 01:29 复制链接 发表新帖
阅读数:281
6月13日,智谱AI正式发布GLM5.2模型,这一事件在知乎上获得近660万热度。作为中国最早一批投身大模型研发的公司,智谱这次发布的GLM5.2在多个关键指标上展现出了与GPT-5和Claude Fable 5正面竞争的能力,尤其是在中文理解、数学推理和代码生成三个维度上取得了显著进步。

GLM5.2最核心的升级在于推理能力的跃迁。在多个数学竞赛级别的测试集上,GLM5.2的得分从上一代的73.2%提升到了87.6%,这个数字已经非常接近GPT-5的89.1%。更关键的是,GLM5.2在"多步推理"任务上表现稳定——也就是那种需要分好几步思考、中间可能犯错需要自我纠正的复杂问题。智谱在技术博客中透露,这一进步主要来自两个方面的创新:一是对思维链训练方法的深度优化,二是在预训练阶段引入了更大比例的推理密集型数据。

代码能力是另一个亮点。GLM5.2在HumanEval评测集上的通过率达到了95.8%,在更具挑战性的SWE-bench上也有出色表现。智谱还同步发布了一个集成GLM5.2的编程助手CodeGeeX新版本,支持超过100种编程语言。在实测中,CodeGeeX在Python和JavaScript的代码补全准确率上已经超过了GitHub Copilot。考虑到Copilot背后是OpenAI最先进的模型,这对中国开发者群体来说是一个极具吸引力的信号。

但智谱面临的竞争压力同样巨大。同在6月,DeepSeek被曝估值590亿美元启动融资,月之暗面的Kimi在消费端持续高歌猛进,MiniMax即将A股上市。中国大模型赛道已经进入了"不进则退"的淘汰赛阶段。智谱的优势在于技术积累深厚——它是中国最早研究大语言模型的团队之一,在底层架构上有更多自主创新能力;但劣势也很明显——在消费级产品的用户规模和品牌认知度上,智谱落后于Kimi和DeepSeek。

GLM5.2的发布,加上DeepSeek R1、智谱GLM系列、月之暗面Kimi的同台竞技,标志着中国AI已经从"追赶者"变成了"竞争者"。当技术差距缩小到可比较的范围内,决定胜负的将不再是谁的参数更大或跑分更高,而是谁能把技术转化为用户真正离不开的产品。
本页内容由网友自行在乌鸦部落发布,本站仅提供帖文、图片存储空间服务,帖文(图片)发布者应自行负责所上传帖文(图片)涉及的法律责任,本站对帖文真实性、版权等概不负责,亦不承担任何法律责任。
条评论
您需要登录后才可以回帖 登录 | 立即注册
高级
相关推荐

关闭

乌鸦部落