5月12日,澎湃新闻记者获悉,全球权威评测机构Artificial Analysis发布全新Coding Agent基准Artificial Analysis Coding Agent Index,用于衡量Agent harnesses与模型的组合在SWE-Bench-Pro-Hard-AA、Terminal-Benchv2和SWE-Atlas-QnA主流基准上的表现。其中,闭源模型Opus4.7(在CursorCLI中运行)全球第一,GLM-5.1(在ClaudeCode运行)取得开源第一。从评测结果上来看,GLM-5.1代表了国产大模型在实际编程Agent场景下的SOTA级别能力。(澎湃新闻记者 范佳来)
Artificial Analysis发布全新基准:GLM-5.1取得全球开源SOTA
IP属地 中国·北京 澎湃新闻 时间:2026-05-12 22:29:43
免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。
全站最新
热门推荐
- 量子测量怎样更精准?深圳国量院团队实验验证新方法
- “四小龙”会师 深度绑定腾讯的燧原科技上市首日暴涨179.22%
- 科大讯飞文旅业务部总经理夏灿:三大数字化方案激活岭南文旅场景
- 18.99万元起!大众与众08猎影版上市:VLA 2.0大模型+双腔空悬全系拉满
- 月之暗面Kimi紧急辟谣:创始人及员工相关网传信息系恶意造谣 已依法报案
- 2026年手机播放器选购指南:苹果安卓用户这样选更省心!
- 11999元起!华为Pura X Max阔折叠新版本开售:预装HarmonyOS 7
- LG再次回应“电视待机状态会录音”:不会持续记录/传输用户对话
- 东莞工厂抖音拍摄全案服务:制造业短视频获客的破局之道
- OpenAI因Astra需求暴涌暂停专业版订阅
- 苹果iPhone 18 Pro系列预售:首日到店取货名额迅速抢光,冰川蓝配色最受欢迎
- 谷歌推广公司怎么选?从需求到复盘的实用判断框架
- OpenAI因Astra需求暴涌暂停专业版订阅
- 实控人被罚没3亿元、5年禁入,贵州百灵的“去姜伟化”阵痛才刚开始
- 凯利泰子公司艾迪尔涉商业贿赂:被列为“特别严重失信”企业,集采冲击、渠道失控两头挤压





京公网安备 11011402013531号