当前位置: 首页 » 资讯 » 新科技 » 正文

国产AI大模型GLM-5.1登顶开源第一:可独立编程8小时

IP属地 中国·北京 编辑:陈丽 快科技 时间:2026-04-10 20:23:47

快科技4月10日消息,3月底智谱正式推出了GLM-5.1大模型,编程能力评分45.3分,号称比全球最强的Opus 4.6只低了2.6分。

前两天GLM-5.1大模型也正式开源,也深受开发者喜爱,现在最新的排名也来了——全球权威AI评测平台LMArena(百万用户参与盲测)更新Code Arena专项榜单,GLM-5.1登顶全球开源模型第一,位列全球模型第三。

除了榜单表现优秀,根据智谱的说法,GLM-5.1不仅继承了上一代模型的开源SOTA编码能力,还在长程任务(Long-Horizon Task)上取得突破,实现了:

8小时从零构建Linux桌面

655次迭代打破向量数据库优化瓶颈

1000轮工具调用优化真实机器学习模型负载

值得一提的是,在METR榜单的同等评估标准下,GLM-5.1是唯一达到8小时级持续工作的开源模型,也是全球范围内除Claude Opus 4.6外少数具备这一能力的模型。

此前智谱提到,GLM-5.1大大提高了代码能力,在完成长程任务方面提升尤为显著。

在最接近真实软件开发的SWE-bench Pro基准测试中,GLM-5.1刷新全球最佳成绩,超过GPT-5.4、Claude Opus 4.6。SWE-Bench Pro要求模型在真实GitHub仓库中定位并修复高难度工程Bug,是衡量模型能否胜任专业软件开发的最硬指标。

标签: 模型 全球 开源 能力 登顶 编程 小时 国产 长程 榜单 瓶颈 数据库 向量 平台 定位 专业 用户 任务 仓库 机器 智谱 编码 评分 权威 方面 胜任 大大提高 代码 工程 盲测 专项 标准

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。