本文由第三方AI基于17173文章http://news.17173.com/content/05262026/120156100.shtml提炼总结而成,可能与原文真实意图存在偏差。不代表网站观点和立场。推荐点击链接阅读原文细致比对和校验。
1541分!阿里 Qwen3.7-Max编程力登顶国产第一 全球仅次 Claude
2026-05-26 12:01:56
神评论
5月26日凌晨,全球权威三方编程榜单Code Arena放榜,阿里最新旗舰模型Qwen3.7-Max得分1541,超越GPT-5.5、Gemini-3.5-Flash、GLM-5.1、Kimi-K2.6等一众模型,仅次于Claude系列,在大模型厂商中排名全球第二,这也标志着在代码理解与生成领域,千问3.7成功跻身全球编程模型第一梯队。

据了解,编程能力是当下模型智能水平的核心指标,而Code Arena是由知名第三方大模型盲测平台LMArena推出的最具影响力的榜单之一。
与传统的代码基准测试不同,Code Arena并不考核孤立的代码片段生成或传统算法题,而是由开发者出题,要求模型从零生成完整的、可交互的Web应用程序,并交由用户对匿名模型的生成效果进行两两PK,由投票综合生成榜单,因此Code Arena也被认为是目前全球最具公信力的AI编程能力评测之一。
经全球开发者以真实使用体验盲测投票,千问3.7模型编程能力位居前4,打破由Claude-Opus-4.7和4.6统治已久的前四格局,Qwen3.7-Max也成为目前榜单中唯一突破1540分大关的国产大模型。
据了解,面向Agent打造的Qwen3.7-Max在编程、智能体、长程任务等核心能力上实现了大幅突破,不但能在数小时内独立完成专业团队耗时2周的复杂项目端到端交付,大幅提升办公自动化和企业级生产力,甚至可以持续运行35小时、累计超1000次工具调用的复杂长程任务,自我编程优化芯片内核。

【来源:快科技】
热门测试游戏
- 1中式武学《猿公剑》试玩报告:进步巨大!属于中国川渝人的大作!
- 2正惊GIF:医患关系缓和,美女医生悉心给患者看病,小伙直接就脸红
- 327年经典MMO重生!《GODIUS》全新重置版公测开启
- 4怀旧周报:《刀剑OL》推出怀旧重铸版,奥尼尔也来砍传奇
- 5《燕云十六声》江南版本更新上线,新和鸣登场,自定义特效染色
- 6科乐美《幻想水浒传》系列新作,武术家三姐妹角色内容或将公开
- 7这恐怖的家伙又来了!在不同的游戏里面对吕布是什么体验?
- 8群雄逐鹿!未来这些国产单机,最值得期待
- 9《天堂2:盟约》金币不够用怎么办?5本紫色技能书哪里获取?
- 10骗兔耳控进来杀?借着DLC上线,我们与《TEVI》的开发组聊了聊

