当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

4个月前 (03-25)Deepseek最新资讯358

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

“因为自己淋过雨,所以想为他人撑一把伞。”李连才是科大讯飞(SZ002230,股价47.86元,市值1106亿元)程序员,也是一位在黑暗中摸索的视障者。在2025年4月讯飞星火智能体挑战赛中,他为视障...

DeepSeek智能体正在改变工作方式?学会这3招,提升你的职业竞争力

DeepSeek智能体正在改变工作方式?学会这3招,提升你的职业竞争力

你还在手动整理数据?还在为写不出高质量文案而苦恼?小心被AI淘汰!2024年,职场内卷已经到了白热化阶段。但比内卷更可怕的是什么?是降维打击!当别人用DeepSeek智能体几分钟搞定你一天的工作,你的...

益佰制药接入DeepSeek大模型在人工智能技术应用领域的积极探索与显著成效

益佰制药接入DeepSeek大模型在人工智能技术应用领域的积极探索与显著成效

益佰制药(股票代码:600594.SH)近日在投资者互动平台上积极回应市场关切,详细阐述了公司在人工智能技术应用领域的最新进展。据公司透露,益佰制药已成功通过云部署以及API(应用程序编程接口)的形式...

艾美疫苗全面接入DeepSeek大模型

艾美疫苗全面接入DeepSeek大模型

2月23日晚,港股公司艾美疫苗(06660.HK)发布自愿公告,全面部署接入DeepSeek大模型,通过本地化策略,推动DeepSeek-R1版本在集团全业务场景应用,实现疫苗全生命周期的“降本、提质...

AMD与清醒异构推出免费体验版DeepSeek AI系统测试平台

AMD与清醒异构推出免费体验版DeepSeek AI系统测试平台

IT时报记者郝俊慧近日,AMD-清醒异构人工智能应用联合实验室发布AMD ROCm原生的AI系统测试体验平台。用户免费注册后,只需上传简单的训练素材文件,就可以体验DeepSeek等主流开源大模型的能...

“AI+”行动提速!中国人寿持续布局DeepSeek

“AI+”行动提速!中国人寿持续布局DeepSeek

人工智能是新一轮科技革命和产业变革的重要驱动力,近期DeepSeek强势“出圈”,在业界引发广泛关注,也成为全国两会热词。中国人寿集团推动各成员单位接入DeepSeek人工智能平台,在智能协同、智能客...