当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

7个月前 (02-24)Deepseek最新资讯325

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

江苏九三科学讲坛|教你用DeepSeek

江苏九三科学讲坛|教你用DeepSeek

3月22日下午,江苏九三科学讲坛邀请九三学社社员、江苏未来网络集团有限公司技术方案部副总监秦子健做客“金陵科普讲坛",主讲“驾驭信息海洋的终极奥义——教你用DeepSeek”的科普讲座。讲座...

DeepSeek赋能:从90亿跃升6700亿

DeepSeek赋能:从90亿跃升6700亿

原创 湖北应急管理 湖北应急管理近日,湖北省应急管理厅传来振奋消息,风险隐患监测预警平台完成重大技术升级,依托移动云算力支撑,核心AI模型“楚小应”对接“满血版”DeepSeek - R1(671B)...

西安举办“解码DeepSeek——大模型技术与应用主题论坛”

西安举办“解码DeepSeek——大模型技术与应用主题论坛”

2月21日,由西安市科学技术局指导,西安电子科技大学人工智能学院、西安市人工智能产业发展联盟等主办的“解码DeepSeek——大模型技术与应用主题论坛”在西安市举行。本次论坛聚焦以DeepSeek为代...

赵满意:DeepSeek浪潮下AI大模型赋能产业发展

赵满意:DeepSeek浪潮下AI大模型赋能产业发展

5月10日,由中国企业改革与发展研究会主办,中企研数字经济与数据资产工作委员会、企业观察报社承办的央企AI+大模型应用论坛在北京举办。论坛上,华为技术有限公司北京昇腾创新中心负责人赵满意以《DeepS...

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

最新的DeepSeek更新了 有网友对新版R1模型进行了测试

5月28日,DeepSeek在官方交流群中公布,DeepSeek R1模型已完成小版本试升级。用户可在官方网页、APP、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek在开源...

接入DeepSeek架构 崂山区率先布局AI智能眼镜赛道

接入DeepSeek架构 崂山区率先布局AI智能眼镜赛道

原标题:接入DeepSeek架构 变身“超级大脑”日前,雷神AI智能眼镜发布,成为崂山区企业在AI眼镜产业链布局竞速赛中迈出的重要一步,也是崂山“玩家”加速驶入AI眼镜赛道的一个缩影。在数字经济与虚拟...