IT之家 5 月 26 日消息,全球權(quán)威三方編程榜單 Code Arena 昨日(5 月 25 日)更新榜單,阿里旗艦?zāi)P?Qwen3.7-Max 得分 1541 分,僅次于 Claude 系列,在大模型廠商中排名全球第二。

IT之家查詢公開資料,Code Arena 是目前全球人工智能領(lǐng)域含金量最高、最權(quán)威的編程大模型(LLM)能力評(píng)估榜單之一。
該榜單不測(cè)試學(xué)術(shù)化的選擇題,而是評(píng)估模型在生成、調(diào)試、重構(gòu)復(fù)雜代碼時(shí)的實(shí)際編程能力,此外為防止刷榜(Anti-Gaming),采用用戶隨機(jī)盲測(cè),模型無法提前獲知考題,讓模型必須具有真實(shí)的硬核代碼生成能力。
根據(jù)最新榜單成績(jī),阿里旗艦?zāi)P?qwen3.7-max-20260517 得分 1541 分,在全球模型榜單中排名第四,僅次于 claude-opus-4-7-thinking、claude-opus-4-7 和 claude-opus-4-6-thinking。
阿里 Qwen3.7-Max 模型的編程能力已超過 claude-opus-4-6 模型,并超過了 glm-5.1、kimi-k2.6 模型。

IT之家查詢公開資料,在最新放出的 Design Arena 榜單中,阿里旗艦?zāi)P?Qwen3.7-Max 同樣取得耀眼成績(jī),位列第十名。


Design Arena (以及其圖像側(cè) Image Arena / LMArena) 作為一個(gè)基于真實(shí)用戶盲測(cè)的 AI 模型評(píng)測(cè)平臺(tái),在當(dāng)前 AI 行業(yè)中具有極高的含金量。它被認(rèn)為是全球公認(rèn)度最高的 AI 模型評(píng)測(cè)平臺(tái)之一,被稱為“AI 界的奧林匹克”。

相關(guān)閱讀:
廣告聲明:文內(nèi)含有的對(duì)外跳轉(zhuǎn)鏈接(包括不限于超鏈接、二維碼、口令等形式),用于傳遞更多信息,節(jié)省甄選時(shí)間,結(jié)果僅供參考,IT之家所有文章均包含本聲明。