当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

2个月前 (02-24)Deepseek最新资讯129

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

长城汽车新增“DeepSeek概念”

长城汽车新增“DeepSeek概念”

2025年4月18日,长城汽车(601633)新增“DeepSeek概念”。据同花顺数据显示,入选理由是:根据2025年4月17日互动易:DeepSeek demo 已完成上车验证,融入到长城汽车自研...

多方恶意抢注DeepSeek商标被驳回

多方恶意抢注DeepSeek商标被驳回

每经快讯,2月24日,国家知识产权局发布通告。近期,DeepSeek在全球范围内引发了广泛关注,个别企业和自然人以社会公众普遍知悉的人工智能大模型名称“DEEPSEEK”等,提交了商标注册申请,个别代...

中原消金:用DeepSeek解锁消费金融新机遇

中原消金:用DeepSeek解锁消费金融新机遇

近日,国产大模型深度求索(DeepSeek)凭借卓越的性能表现,迅速赢得了金融机构的青睐,在金融业内掀起了一股应用人工智能的新热潮。金融机构纷纷接入DeepSeek,期望在实际业务中开拓新的增长点。截...

DeepSeek注册使用教程—轻松掌握,精准搜索从此无忧

DeepSeek注册使用教程—轻松掌握,精准搜索从此无忧

标题:DeepSeek注册使用教程—轻松掌握,精准搜索从此无忧关键词:DeepSeek,注册教程,搜索引擎,使用教程,精准搜索,网络工具描述:了解DeepSeek的注册与使用流程,让您充分发挥强大搜索...

特斯联特AI接入满血DeepSeek,为职场数智化转型注入新动能

特斯联特AI接入满血DeepSeek,为职场数智化转型注入新动能

2025年《政府工作报告》明确提出,要持续推进“人工智能+”行动,推动大模型技术向垂直场景渗透。在数字技术与实体经济深度融合的浪潮下,人工智能正加速重构职场办公的底层逻辑。作为AIoT领域的领军企业,...

科蓝软件:已成功将DeepSeek-R1模型整合至公司魔聚平台

科蓝软件:已成功将DeepSeek-R1模型整合至公司魔聚平台

人民财讯3月5日电,科蓝软件(300663)3月5日在互动平台表示,公司已成功将DeepSeek-R1模型整合至公司的人工智能应用平台——魔聚平台。具体来说,魔聚平台成功部署并全面投入使用了DeepS...