《電子技術應用》
您所在的位置:首頁 > 人工智能 > 业界动态 > 阿里千问登顶空间推理全球冠军

阿里千问登顶空间推理全球冠军

超越Gemini3、GPT5.1!
2025-11-27
來源:快科技

11月26日消息,今日,空間推理基準測試SpatialBench更新了最新一期榜單,阿里千問的視覺理解模型Qwen3-VL、Qwen2.5-VL位列頭兩名,超越Gemini 3GPT-5.1、Claude Sonnet4.5等國際頂尖模型。

SpatialBench榜單顯示,Qwen3-VL-235B和Qwen2.5-VL-72B分別斬獲13.5和12.9分,領先于Gemini 3.0 Pro Preview(9.6) 、GPT-5.1(7.5)、Claude Sonnet 4.5等海外頂尖模型。

s_a6de7b2b3a49421597242fba20a8cf04.png

然而,AI大模型的整體表現距離人類仍有差距,人類基準線約為80分左右,可專業處理電路分析、CAD 工程和分子生物學等復雜空間推理任務,目前大模型還無法完全自動化完成此類工作。

據悉,Qwen2.5-VL于2024年開源,Qwen3-VL是阿里在2025年開源的新一代視覺理解模型。

Qwen3-VL在視覺感知和多模態推理方面實現重大突破,在32項核心能力測評中超過Gemini2.5-Pro和GPT-5,不但可調用摳圖、搜索等工具完成“帶圖推理”,也可以憑借一張設計草圖或一段小游戲視頻直接“視覺編程”。

s_23f56825a06742f7a910327632233da1.png

同時,Qwen3-VL專門增強了3D檢測能力,可以更好地感知空間,基于Qwen3-VL,機器人更好地判斷物體方位、視角變化和遮擋關系,實現遠處蘋果的精準抓取。

目前,Qwen3-VL已開源不同版本,包括2B、4B、8B、32B等密集模型以及30B-A3B、235B-A22B等MoE模型,每個模型都有指令版和推理版兩款,是當下最受企業和開發者歡迎的開源視覺理解模型。同時,Qwen3-VL模型也已上線千問APP,用戶可免費體驗。

據了解,SpatialBench是一項近年來興起的第三方空間推理基準測試榜單,主要聚焦多模態模型在空間、結構、路徑等方面的綜合推理能力,被AI社區視為是衡量“具身智能”進展的新興測試標準之一。

SpatialBench不僅測試模型已知的知識,還測試模型在二維和三維空間中“感知”和操控抽象概念的能力,這對具身智能的落地尤為關鍵。


subscribe.jpg

本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
主站蜘蛛池模板: 久久av一区二区| 久久久极品av| 欧美国产综合视频| 国产国语刺激对白av不卡| 国产欧美日韩中文| 国产精品午夜视频| 久久久亚洲精品无码| 日韩在线观看你懂的| www.亚洲视频.com| 日本视频一区在线观看| 亚洲国产精品日韩| 久久久精品免费视频| 欧美日韩精品在线一区二区| 亚洲国产日韩美| 五月婷婷一区| 久久久久久久久久久国产| 国产精品流白浆视频| 日韩欧美在线免费观看视频| 久久精品视频91| 欧美精品久久久久久久免费观看| 国产精品自拍视频| 国产精品日韩专区| 一区不卡视频| 久久手机精品视频| 日韩中文字幕在线| 日韩中文视频免费在线观看| 中文字幕精品在线播放| 久久精品国产精品| 精品国产第一页| 国产高清在线一区| 欧美激情精品久久久久久蜜臀| 99亚洲精品视频| 国产精品免费小视频| 欧美大片va欧美在线播放| 婷婷亚洲婷婷综合色香五月| 国产美女精彩久久| 久久久久久成人| 91精品国产高清久久久久久 | 99福利在线观看| 久久久久久久久久久av| 宅男在线精品国产免费观看|