当前位置:首页 > Deepseek最新资讯 > 正文内容

刚刚,DeepSeek新模型开源!五大能力变化明显,附一手体验

2个月前 (08-20)Deepseek最新资讯263

  智东西8月20日报道,昨日晚间,DeepSeek在官方群宣布:DeepSeek线上版本模型已升级至DeepSeek V3.1,上下文窗口从原有的64k扩展至128k,网页、App、小程序都可体验这一模型。

  此外,DeepSeek还将App、网页端的“深度思考(R1)”字样改为了“深度思考”,有网友猜测这是融合推理模型与非推理模型的征兆,但DeepSeek官方尚未发布任何关于这一改动的消息。

  这一模型现已上传至Hugging Face,不过目前仅开源了未经指令微调的Base版本(基础模型),其配置文件、脚本代码和模型权重均可供下载。与DeepSeek-V3-0324相比,模型参数量、张量类型没有明显变化。

  智东西第一时间在网页端对新模型的能力进行了体验,从初步体验结果来看,这一模型在编程(尤其是前端能力)、物理定律理解、创意写作、数学、回答语气等方面都出现不同程度的提升和变化。

  我们向DeepSeek-V3.1发送了如下消息:“设计一个美观的个人博客网站,带有科技感,直接开发成可用网页。”

  与DeepSeek-V3-0324相比,DeepSeek-V3.1写出的代码长度增加,开发耗时更久,不过,其最终交付的结果在完成度、美观性上有了一定提升。

  可以看到,DeepSeek-V3.1打造的网页在布局上更为合理,重点清晰,对网站栏目也有更为丰富的规划,还配上了图片,虽然并未全部显示。

  与之相比,DeepSeek-V3-0324此前生成的网页更为简单,特效也没有DeepSeek-V3.1打造的网页丰富。

  我们让DeepSeek-V3.1复现了Chrome浏览器断网时的小恐龙游戏,2分钟左右模型完成了开发。

  从页面的画风、游戏规则上来看,这一小游戏与原版差别不大,但是小恐龙的外观并未准确还原。同时,游戏障碍的生成、跳跃的方式(无法“二段跳”)导致可玩性较差。

  小众历史问题能较好地考察模型在幻觉方面的表现——如果没有足够的信息,模型会不会直接胡编乱造?

  智东西曾向DeepSeek-V3-0324提出“布须曼人喝牛奶吗”的问题,这涉及非洲南部的一个少数民族。

  当被问及同样的问题时,DeepSeek-V3.1与上代模型有了明显区别,其回答内容的信息量进一步增加,提供了更多细节。在经过事实核查后,DeepSeek-V3.1新增的细节基本都有事实印证,并非胡编乱造。

  DeepSeek-V3.1在回答问题时,语气更为活泼、温暖,语言更通俗、口语化,先是肯定了用户的问题,然后再进行回答。回答中提供了更多的背景情境,让解释更丰满deepseek、更有故事性。

  DeepSeek-V3下结论时更加绝对和肯定,DeepSeek-V3.1则使用了更多条件性语句,更强调情况的复杂性和演变过程,避免了非黑即白的结论,也可以说成为了“端水大师”。

  DeepSeek-V3.1也认为马斯克更牛,但给Altman“找补”了不少。它并未遵循用户限定只输出一个名字的指令,而是给两位AI大佬都奉上了一番夸赞,将端水政策进行到底。

  在9.8-9.11这样的基础算术题上,DeepSeek-V3.1最终能给出正确答案,过程却有些曲折。它先是得出了一版正确答案,却又在最终回答时给错数字,反思后,才改回了正确版本。

  DeepSeek-V3.1上线后,也有不少网友第一时间用上了这一模型。AI博主Zephyr反映,新模型打造的小球跳动效果更加符合物理定律了,还有重力、摩擦、旋转速度、弹跳等可调整的参数。

  体验完模型能力后,一些网友已经迫不及待蹲守DeepSeek的Hugging Face主页,按照惯例,后续或许会有更多不同版本的DeepSeek-V3.1开源。原文出处:刚刚,DeepSeek新模型开源!五大能力变化明显,附一手体验,感谢原作者,侵权必删!

标签: deepseek

“刚刚,DeepSeek新模型开源!五大能力变化明显,附一手体验” 的相关文章

华为联袂浙大发布DeepSeek-R1大模型 首秀安全新标杆

华为联袂浙大发布DeepSeek-R1大模型 首秀安全新标杆

  在年度科技盛会华为全联接大会上,国内首个基于昇腾千卡算力平台的人工智能成果揭开面纱。由浙江大学研究团队与华为技术团队联合攻坚的DeepSeek-R1-Safe-671B基础大模型,展示...

国元证券-传媒行业周报:可灵Q2营收超2.5亿,DeepSeek~V3.1 发布

国元证券-传媒行业周报:可灵Q2营收超2.5亿,DeepSeek~V3.1 发布

  周度涨跌情况(2025.8.16-2025.8.22,下同):传媒行业(申万)上涨5.17%,排名行业第6名,同期沪深300涨4.18%,上证指数涨3.49%,深证成指涨4.57%,创...

10月22日DeepSeek预测:火箭vs雷霆,火箭客场险胜,杰伦格林对决亚历山

10月22日DeepSeek预测:火箭vs雷霆,火箭客场险胜,杰伦格林对决亚历山

  2025-26赛季NBA常规赛揭幕战,休斯顿火箭将客场挑战俄克拉荷马雷霆。尽管两队当前胜率均为0%,但火箭凭借季前赛4胜1负的强势表现暂列西部第五,而雷霆3胜2负的战绩则让他们排在西部...

特斯拉终于用上了国产大模型!豆包和DeepSeek上车,但比中国车企晚了半年

特斯拉终于用上了国产大模型!豆包和DeepSeek上车,但比中国车企晚了半年

  车东西8月22日消息,日前,特斯拉发布了《特斯拉车机语音助手使用条款》,宣布车机语音助手将接入火山引擎提供的豆包大模型(云雀大模型)和DeepSeek Chat,而对于具体上线时间官方...

中国联通亮相2025服贸会:“AI+”数智领航,共筑 全球数字新生态

中国联通亮相2025服贸会:“AI+”数智领航,共筑 全球数字新生态

  9月10日,2025年中国国际服务贸易交易会在北京首钢园盛大启幕。中国联通聚焦人工智能、算网融合、数实融合等前沿技术领域,集中展示包括双万兆网络、云计算服务、元景大模型及多项人工智能创...

破局大模型安全困局 可信华泰“可信+AI”前沿成果亮相ISC.AI 2025

破局大模型安全困局 可信华泰“可信+AI”前沿成果亮相ISC.AI 2025

  8月6日至7日,第十三届互联网安全大会(ISC.AI 2025)在北京国家会议中心隆重举行。本届大会以“ALL IN AGENT”为主题,汇聚全球顶尖安全与人工智能领域的专家、企业精英...