《電子技術應用》
您所在的位置:首頁 > 人工智能 > 業界動態 > 阿里云開源首個AI推理模型QwQ

阿里云開源首個AI推理模型QwQ

推理水平對標OpenAI o1 數學、編程尤為出色
2024-11-29
來源:IT之家

11月28日消息,今天,阿里云通義團隊宣布推出并同步開源了全新的AI推理模型——QwQ-32B-Preview。

評測顯示,預覽版本的QwQ(Qwen with Questions)在科學推理能力上展現出研究生水平,尤其在數學和編程領域表現卓越,其整體推理能力可與OpenAI的o1相媲美。

據介紹,QwQ是通義千問Qwen大模型最新推出的實驗性研究模型,也是阿里云首個開源的AI推理模型。

阿里云通義千問團隊研究發現,當模型有足夠的時間思考、質疑和反思時,其對數學和編程的理解就會深化,基于此QwQ取得了解決復雜問題的突破性進展。

0.png

在衡量科學問題解決能力的GPQA評測集中,QwQ達到了65.2%的準確率,顯示出其研究生水平的科學推理能力;在AIME評測中,QwQ以50%的勝率證明了其解決數學問題的能力。

在MATH-500評測中,QwQ以90.6%的高分超越了o1-preview和o1-mini。在評估高難度代碼生成的LiveCodeBench評測中,QwQ答對了一半的題目,在編程競賽題場景中也有出色表現。

不僅如此,QwQ在面對復雜問題時,能夠進行深度自省,質疑自身假設,并通過深思熟慮的自我對話,仔細審視其推理過程的每一步。

例如,在解決經典智力題“猜牌問題”時,QwQ通過梳理對話和推演,像個擅長思考的人一樣,并最終得出正確答案。

目前,QwQ-32B-Preview已在魔搭社區和HuggingFace等平臺上開源,發布短短幾小時,引起全球開發者熱情體驗。

有開發者認為該模型“是完全沒有預料到的瘋狂的躍進”、“今年開源領域最重大的突破”、“讓中國在開源大模型和AI推理上占據先機”。

不過通義團隊也表示,雖然QwQ展現了強大的分析能力,但其仍是個供研究的實驗型模型,存在不同語言的混合使用、偶有不恰當偏見、對專業領域問題不了解等局限,未來隨著研究深入模型迭代,這些問題將逐步得到解決。


官方訂閱.jpg

本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
主站蜘蛛池模板: 伊人久久综合精品无码AV专区 | 久久午夜无码鲁丝片午夜精品| 欧美精品色婷婷五月综合| 四虎影视永久免费观看| 香港三级理论在线影院| 国产精品bbwbbwbbw| 亚洲精品一二区| 精品影片在线观看的网站| 国产乱弄免费视频| 国产高清精品入口91| 国产精品免费电影| 97国产精品视频观看一| 好看的中文字幕在线| 中国china体内裑精亚洲日本| 日本中文字幕在线观看| 久久精品综合一区二区三区| 欧亚专线欧洲s码wm| 亚洲成a人片在线不卡| 波多野结衣办公室jian情| 人妻精品久久久久中文字幕69| 精品国产乱码久久久久软件| 国产AV人人夜夜澡人人爽麻豆| 边做饭边被躁欧美三级| 国产在线不卡一区二区三区| 黄色永久免费网站| 国产粗话肉麻对白在线播放| 2022国内精品免费福利视频| 国内精品九九久久久精品| A级毛片内射免费视频| 天天爽夜夜爽人人爽一区二区| yy6080理论影院旧里番| 婷婷国产偷v国产偷v亚洲| 一级特黄女**毛片| 少妇人妻偷人精品视频| 三上悠亚大战黑人在线观看| 成人网在线免费观看| 中文字幕丝袜诱惑| 成人性生交大片免费看| 中文字幕丝袜诱惑| 成人漫画免费动漫y| 丰满人妻一区二区三区视频 |