当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

8个月前 (02-24)Deepseek最新资讯454

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

人均DeepSeek!当教育硬件遇上深度推理,AI教育爆发了

人均DeepSeek!当教育硬件遇上深度推理,AI教育爆发了

最近这互联网,确实有点意思。前天上午,我打开微博,映入眼帘的第一条消息就是“微信DeepSeek王炸组合”;昨天中午,趁着上班中途准备打开贴吧摸鱼,结果却看到破防的MYGO粉丝在讨论“用DeepSee...

什么是AI公务员?AI公务员能做哪些工作?

什么是AI公务员?AI公务员能做哪些工作?

AI公务员是指利用人工智能技术,在政府部门中执行特定任务的智能系统。这些系统能够模拟人类公务员的某些职能,提高工作效率和服务质量。以下是对AI公务员所能执行的工作的详细介绍:AI公务员的主要工作公文处...

微信+DeepSeek“王炸组合”或催生AI应用井喷式发展

微信+DeepSeek“王炸组合”或催生AI应用井喷式发展

连日来,中国多家互联网大厂纷纷宣布将大热的国产开源大模型DeepSeek接入自家搜索功能,引发外界高度关注。微信已为搜索功能接入DeepSeek-R1模型,目前处于小范围灰度测试中,可供部分用户免费使...

联想2月25日开始AI PC端侧DeepSeek模型灰度测试

联想2月25日开始AI PC端侧DeepSeek模型灰度测试

联想集团执行副总裁兼中国区总裁刘军透露,2月25日,联想将对天禧AS做大的升级,将在天禧AS里部署DeepSeek 7B的大模型,这是端侧部署这样规模大模型的首家AI PC厂商。此次升级将会使得联想A...

DeepSeek大火,有人惊喜有人忧——突飞猛进的AI会取代人类创作吗?

DeepSeek大火,有人惊喜有人忧——突飞猛进的AI会取代人类创作吗?

春节期间,对大众来说最惊喜的有二:一个是《哪吒2》,另一个是DeepSeek。DeepSeek一问世就以其卓越的逻辑推理能力和多模态理解能力崭露头角,再次刷新了人们对AI的认知。尤其是DeepSeek...

中原消费金融:用DeepSeek重塑消费金融智能化范式

中原消费金融:用DeepSeek重塑消费金融智能化范式

近日,国产大模型DeepSeek凭借卓越的性能表现,迅速赢得金融机构的青睐,成为金融行业数字化转型的重要推动力。金融机构纷纷接入DeepSeek,期望在实际业务中开拓新的增长点。与此同时,消费金融行业...