当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

4个月前 (03-25)DeepSeek技术交流331

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

据科技媒体报道,蚂蚁集团正在招聘AI智能眼镜的产品专家。根据职位描述可知,该职位主要负责AI智能眼镜应用相关的产品,要求有2C产品的经验,并且熟悉市面上各位VR、AR和AI智能眼镜。这则招聘信息或显示...

第一批用DeepSeek相亲的年轻人,成功脱单了吗?

第一批用DeepSeek相亲的年轻人,成功脱单了吗?

谈恋爱不知怎么办?问问DeepSeek吧来自浙江杭州的女孩美娜,最近有点烦。去年11月,她认识了一位身高180、长相帅气的公务员男性,两个人一见面就擦出了火花,此后经常聊天约会。经过一段时间的相处,双...

专访学而思CTO田密:接入DeepSeek改变的不只是产品

专访学而思CTO田密:接入DeepSeek改变的不只是产品

开源的DeepSeek大模型火了,在线教育行业也因此卷起千层浪花。近期,学而思、网易有道、中公教育、猿辅导、作业帮等头部企业密集宣布接入DeepSeek大模型,这引发了业界广泛关注。DeepSeek为...

DeepSeek大模型席卷金融业,银行、券商、基金、保险竞相接入

DeepSeek大模型席卷金融业,银行、券商、基金、保险竞相接入

近期,DeepSeek大模型在金融业掀起一股热潮,多家金融机构纷纷宣布接入或部署该模型。据不完全统计,目前已有16家券商、10余家公募基金公司以及多家银行和保险机构宣布接入或部署DeepSeek大模型...

每日互动:已接入DeepSeek相关版本,用于业务垂直场景及研发提效

每日互动:已接入DeepSeek相关版本,用于业务垂直场景及研发提效

金融界3月17日消息,有投资者在互动平台向每日互动提问:请问公司有没有考虑向deepseek一体机方向发展。公司回答表示:公司在2024年上半年就接入DeepSeek相关版本,目前主要用于业务垂直场景...

AI与安全高峰论坛圆满落幕,共探大模型时代安全破局之道

AI与安全高峰论坛圆满落幕,共探大模型时代安全破局之道

引言DeepSeek 的横空出世,标志中国在人工智能领域的重大技术突破,吸引全球的关注。与此同时,飞速发展的人工智能技术为安全行业带来新的思考题:如何利用 AI 赋能安全攻防,如何确保 AI 技术本身...