当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

1个月前 (03-25)DeepSeek技术交流152

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

按下AI产业发展“加速键”,湖北移动全面加快DeepSeek部署

按下AI产业发展“加速键”,湖北移动全面加快DeepSeek部署

今年以来,国产AI大模型DeepSeek热度持续攀升,引发国资央企新一轮合作热潮,近日,记者从中国移动湖北公司获悉,在武汉光谷未来科技城——中国移动大模型产业创新基地(湖北),依托九天大模型MaaS平...

拥抱人工智能,岳阳县数据局开展DeepSeek应用培训

拥抱人工智能,岳阳县数据局开展DeepSeek应用培训

华声在线4月2日讯(通讯员 续鼎)为深化数字技术应用,全面提升干部对人工智能大模型DeepSeek的认知与应用能力,4月2日,岳阳县数据局组织机关全体干部职工进行DeepSeek人工智能技术与应用探索...

神州信息:公司引入国产开源大模型DeepSeek

神州信息:公司引入国产开源大模型DeepSeek

每经AI快讯,有投资者在投资者互动平台提问:公司是否有接入deepseek合作??神州信息(000555.SZ)4月21日在投资者互动平台表示,作为领先的金融科技企业,公司引入国产开源大模型DeepS...

方大集团:已部署应用DeepSeek公司大模型,并已在公司的企业管理等方面应用

方大集团:已部署应用DeepSeek公司大模型,并已在公司的企业管理等方面应用

 证券日报网讯 方大集团3月14日在互动平台回答投资者提问时表示,公司高度重视智能化转型与创新技术应用,已部署应用DeepSeek公司大模型,并已在公司的企业管理等方面应用。公司目前正在推进DeepS...

DeepSeek梁文锋亲自挂名,公开新注意力架构NSA

DeepSeek梁文锋亲自挂名,公开新注意力架构NSA

机器之心报道机器之心编辑部DeepSeek 新论文来了!相关消息刚刚发布到 𝕏 就吸引了大量用户点赞、转发、评论三连。据介绍,DeepSeek 的这篇新论文提出了一种新的注意力机制 ——NSA。这是一...

DeepSeek对未来就业有何影响?

DeepSeek对未来就业有何影响?

据新民晚报报道:2月17日上午,民营企业座谈会在首都北京召开。参与此次座谈会的民营企业代表包括华为创始人任正非、DeepSeek创始人梁文锋、腾讯创始人马化腾、宇树科技创始人王兴兴、比亚迪创始人王传福...