当前位置:首页 > DeepSeek技术交流 > 正文内容

全国高校首个!东南大学继DeepSeek又上线QwQ-32B

5个月前 (03-09)DeepSeek技术交流329

本文转自【新华日报】;

近日

东大基于昇腾国产算力平台

正式接入阿里最新开源模型QwQ-32B

成为全国首个上线QwQ-32B服务的高校

国产算力基座+头部大模型双轨融合

将为教学科研注入更强的AI动能

QwQ-32B:DeepSeek-R1的超强平替

性能比肩顶级模型

QwQ-32B虽仅有32B参数,但通过大规模强化学习训练,在数学推理(AIME24评测)、代码生成(LiveCodeBench)、工具调用(BFCL测试)等任务中表现媲美671B参数的DeepSeek-R1,甚至部分指标实现超越。

上图展示了 QwQ-32B 与其他领先模型在数学推理(AIME24评测)、代码生成(LiveCodeBench)、工具调用(BFCL测试)中的性能对比,QwQ-32B 表现与 DeepSeek-R1 相当,远胜于 o1-mini 及相同尺寸的 R1 蒸馏模型。

低成本、易部署

模型支持消费级显卡本地部署,大幅降低硬件门槛,适配昇腾平台的高效算力资源,助力师生在科研中快速实现AI推理需求。

智能体能力革新

集成工具调用与动态推理能力,模型可根据环境反馈调整策略,适用于复杂任务处理,如数据分析、实验模拟等科研场景。

来源:东南大学微信公众号


“全国高校首个!东南大学继DeepSeek又上线QwQ-32B” 的相关文章

西部利得基金完成DeepSeek大模型本地化部署

西部利得基金完成DeepSeek大模型本地化部署

证券时报网讯,西部利得基金宣布,公司在数字化建设领域取得重要进展,完成了DeepSeek多个大模型的本地化部署,并搭建了公司内部AI应用平台。这一举措不仅标志着公司在智能化转型上的突破性进展,也为后续...

用了DeepSeek,工作效率竟然提升了300%

用了DeepSeek,工作效率竟然提升了300%

以下是一份结合最新信息与实战技巧的 DeepSeek保姆级教程,涵盖基础操作、进阶技巧与行业应用,帮助用户从入门到精通,全面提升工具使用效率: 一、基础篇:快速上手DeepSeek...

智慧云农平台全面接入DeepSeek

智慧云农平台全面接入DeepSeek

文章来源:昆明日报原文链接:https://kmrb-paper.kbit.kmzscc.com/art-60363.html?id=60363近日,云南省高原特色农业的创新科技平台——智慧云农平台全...

DeepSeek进组《流浪地球3》,十年,“赛博工头”和沈腾一起来了

DeepSeek进组《流浪地球3》,十年,“赛博工头”和沈腾一起来了

电影《流浪地球》的官微几天前给广大网友出了道选择题:哪一项危机不是《流浪地球2》中MOSS说的。选项包括:A、2027年时间不足危机;B、2044年太空电梯危机;C、2058年月球坠落危机;D、207...

梁文锋“藏锋”|DeepSeek爆火100天

梁文锋“藏锋”|DeepSeek爆火100天

编者按:自1月20日DeepSeek R1爆火以来,过去100天的大模型世界中,DeepSeek成了当之无愧的顶流明星。DeepSeek不仅展现了中国AI的力量,也在一定程度上影响了世界AI发展的方向...

日照港:已部署Deepseek,应用于港口设备管理应用决策

日照港:已部署Deepseek,应用于港口设备管理应用决策

金融界3月11日消息,有投资者在互动平台向日照港提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考...