阿里云开源首个AI推理模型QwQ，推理水平对标OpenAI o1 数学、编程尤为出色

发布日期：2024-11-29

21 次

11月28日消息，今天，阿里云通义团队宣布推出并同步开源了全新的AI推理模型——QwQ-32B-Preview。

评测显示，预览版本的QwQ（Qwen with Questions）在科学推理能力上展现出研究生水平，尤其在数学和编程领域表现卓越，其整体推理能力可与OpenAI的o1相媲美。

据介绍，QwQ是通义千问Qwen大模型最新推出的实验性研究模型，也是阿里云首个开源的AI推理模型。

阿里云通义千问团队研究发现，当模型有足够的时间思考、质疑和反思时，其对数学和编程的理解就会深化，基于此QwQ取得了解决复杂问题的突破性进展。

在衡量科学问题解决能力的GPQA评测集中，QwQ达到了65.2%的准确率，显示出其研究生水平的科学推理能力；在AIME评测中，QwQ以50%的胜率证明了其解决数学问题的能力。

在MATH-500评测中，QwQ以90.6%的高分超越了o1-preview和o1-mini。在评估高难度代码生成的LiveCodeBench评测中，QwQ答对了一半的题目，在编程竞赛题场景中也有出色表现。

不仅如此，QwQ在面对复杂问题时，能够进行深度自省，质疑自身假设，并通过深思熟虑的自我对话，仔细审视其推理过程的每一步。

例如，在解决经典智力题“猜牌问题”时，QwQ通过梳理对话和推演，像个擅长思考的人一样，并最终得出正确答案。

目前，QwQ-32B-Preview已在魔搭社区和HuggingFace等平台上开源，发布短短几小时，引起全球开发者热情体验。

有开发者认为该模型“是完全没有预料到的疯狂的跃进”、“今年开源领域最重大的突破”、“让中国在开源大模型和AI推理上占据先机”。

不过通义团队也表示，虽然QwQ展现了强大的分析能力，但其仍是个供研究的实验型模型，存在不同语言的混合使用、偶有不恰当偏见、对专业领域问题不了解等局限，未来随着研究深入模型迭代，这些问题将逐步得到解决。

版权声明：本站内容除特别声明的原创文章之外，转载内容只为传递更多信息，并不代表本网站赞同其观点。转载的所有的文章、图片、音/视频文件等资料的版权归版权所有权人所有。本站采用的非本站原创文章及图片等内容无法一一联系确认版权者。如涉及作品内容、版权和其它问题，请及时通过电子邮件或电话通知我们，以便迅速采取适当措施，避免给双方造成不必要的经济损失。联系电话：020-2204 2442,邮箱：Sales@greentest.com.cn。

上一篇: 中国半导体硅片替代加速已冲击到海外供应商出货量
下一篇: 边缘AI半导体企业Ambarella首款2nm芯片2025Q4流片,预计由三星电子代工

为您精选

复旦联手百度打造AI开源模型Hallo2,根据音频生成4K分辨率1小时长视频

10 月 21 日消息，复旦大学和百度联合开发了一款名为Hallo2的全新 AI 模型，该模型可以生成长达数小时的 4K 分辨率人物动画，···

更新日期：2024-10-22 177 次
Meta公司发布3D Gen全新AI模型 ,1 分钟内生成高质量 3D 内容

7 月 3 日消息，Meta公司昨日（7 月 2 日）发布研究论文，介绍了名为 Meta3D Gen（3DGen）的全新 AI 模型，可以在 1 分钟内基···

更新日期：2024-07-03 172 次
斯坦福AI团队承认抄袭清华模型，公开道歉并撤下争议项目

6月4日消息，近日，网络上掀起了一场关于开源模型抄袭的争议。斯坦福大学AI团队推出的Llama3-V模型被指套壳抄袭了国内清华大···

更新日期：2024-06-05 173 次
华为云与贵州签约全力打造全球最大智算中心！

3月31日消息，日前华为云官方发布公告称，与贵州贵安新区管理委员会正式签署合作协议。协议指出，华为云将在贵安新区建设华为···

更新日期：2024-04-01 401 次