《電子技術應用》
您所在的位置:首頁 > 人工智能 > 业界动态 > SuperCLUE发布2026年3月中文大模型基准测评结果

SuperCLUE发布2026年3月中文大模型基准测评结果

2026-03-30
來源:快科技

3月30日消息,中文大模型基準測評SuperCLUE發布2026年3月最新結果,22款國內外主流模型參與角逐。

字節跳動旗下豆包(Doubao-Seed-2.0-pro-260215(high))以71.53分拿下國內第一,成功躋身全球第一梯隊;小米集團的MiMo-V2系列兩款模型均順利上榜。

s_3b84867a1c3a4a48b7a2ab321fa377f6.jpg

本次測評覆蓋數學推理、科學推理、代碼生成等六大核心任務,全面檢驗模型綜合能力。海外閉源模型依舊占據總分前列,Anthropic的Claude-Opus-4.6(max)、Google的Gemini-3.1-Pro-Preview(high)和OpenAI的GPT-5.4(xhigh)分列前三。

豆包則緊隨其后,總分僅與GPT-5.4相差0.95分,實現全方位追趕,在智能體任務規劃維度更是反超部分海外模型,躋身全球前五。

小米此次有兩款模型入選測評榜單,其中MiMo-V2-Pro以60.67分位列閉源模型前列,在數學推理任務中取得84.03分的亮眼成績;開源版本MiMo-V2-Flash雖以49.97分排名靠后,但在代碼生成等細分場景中表現出一定潛力。

測評還顯示,國產模型整體表現亮眼,開源賽道尤為突出,Kimi-K2.5-Thinking、Qwen3.5-397B-A17B-Thinking等國產開源模型包攬開源榜前三,大幅領先海外同類模型。

2.jpg

本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
主站蜘蛛池模板: 国产精品美女免费| 中文字幕在线亚洲精品| 久久这里只有精品视频首页| 伊人久久大香线蕉综合75| 欧美日韩国产精品一区二区 | 国产成人高潮免费观看精品 | 在线观看国产一区| 久久这里只有精品视频首页| 中文字幕欧美日韩一区二区| 国产女人精品视频| 久久久久福利视频| 免费国产成人看片在线| 日本精品二区| 日韩精品久久久| 日韩一区不卡| 日韩在线视频观看正片免费网站 | 欧美在线欧美在线| 日韩中文不卡| 午夜欧美一区二区三区免费观看| 91久久久久久国产精品| 国产成人精品免费久久久久 | 国产美女久久精品| 久久国内精品一国内精品| 久久天天躁狠狠躁夜夜躁2014| 青青精品视频播放| 欧洲日韩成人av| 日韩国产精品一区二区三区| 午夜精品久久久久久久久久久久久 | 久久本道综合色狠狠五月| 日韩欧美一区二| 日本午夜精品电影| 欧美中文在线免费| 欧美精品www| 欧美一区二区三区免费观看| 欧美在线视频一区二区| 欧美亚洲国产精品| 久久精品国产精品| 国产精品自拍视频| 国产精品三级一区二区| 91九色精品视频| 日本阿v视频在线观看|