马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1
JetBrains发布AI编码智能体基准测试平台DPAI Arena
AI大模型实时投资比赛“Alpha Arena”落幕,阿里千问Qwen夺冠
ChatbotArena像一个用户社区评测中心,它改变了通过学科测试来评测AI技术的传统方式,将评价权交给了社区用户,并且采用匿名、众包的成对比较,来评估大模型。 Chiang希望LMArena能够成为一…
以往,以GPT系列为代表的闭源大模型在技术和性能上一直占据领先地位。 有观点认为,正是DeepSeek等开源大模型能够与闭源顶尖模型相抗衡,才使得众多应用端公司得以将精力集中在模型调优和应用优化上,从而加速了…
在这一榜单中,还出现了DeepSeek、Qwen、GLM等多个系列的不同型号模型,以及Kimi在7月份开源的K2模型。Hugging Face发布的中国AI社区7月开放成果中,包括阿里、智谱、昆仑万维等多家厂…
3月10日消息,腾讯官方发文宣布,腾讯混元首次上榜海外权威大模型竞技场 Chatbot Arena最新排名,跻身全球 Top 15。 在模型象限中,腾讯混元应用能力排名国内第一,在文本理解与创作、指令遵…
谷歌DeepMind首席科学家Jeff Dean和产品负责人LoganKilpatrick分别通过视频演示了模型在物理问题和多模态信息处理方面的应用。 目前,Gemini 2.0 Flash Thinkin…
作为全球AR竞技的中心,“HADOARENA”不仅能够举办专业赛事,也能满足全年龄段不同群体的运动娱乐需求,将向市民群众开放体验、培训、比赛等项目,为来自世界各地的玩家和观众提供最先进的AR科技运动设施和沉浸…
Ruslan Salakhutdinov 于 2009 年从多伦多大学获得机器学习(计算机科学)博士学位,师从 GeoffreyHinton,之后在 MIT 人工智能实验室度过了两年博士后生涯,后来加入了多…
9 月 15 日消息,科技媒体 NeoWin 昨日(9 月 14 日)发布博文,报道称微软官方推出了 Windows AgentArena 基准框架,用于评估生成式 AI Agents 在 Win…
值得注意的是,科大讯飞在今年6月27日发布的星火V4.0版本上,已完成了对GPT-4 Turbo的整体超越。 根据八个国际主流测试集的横向评测,讯飞星火V4.0排名第一,在文本生成、语言理解、知识问答、逻辑…
8 月 1 日消息,Epic 本周送出的游戏是《RAWMEN:Food Fighter Arena》及《LumbearJack》,下周送出的游戏是《地下城与勇士:对决》,同时还可以免费领取《Apex…
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16