当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

3周前 (02-24)Deepseek最新资讯63

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

跟DeepSeek聊人体解剖学是一种什么体验?

跟DeepSeek聊人体解剖学是一种什么体验?

人工智能发展飞速,在专业医学课堂教学领域有什么新动向?广东有高校已率先在多个专业课程采用DeepSeek辅助。记者从广东药科大学获悉,日前,该校在智能医学工程、数字媒体技术、临床医学、预防医学四个专业...

DeepSeek的列车,有人准备躺上去了

DeepSeek的列车,有人准备躺上去了

拥挤的DeepSeek列车,快关不上门了。据说,全国的大城市,都在为错过DeepSeek彻夜难眠。江苏省委机关报《新华日报》旗下“交汇点”在2月7日晚、8日上午连发三篇专稿文章《DeepSeek为什么...

普通人如何玩转DeepSeek 别再被付费AI教程“套路”了!

普通人如何玩转DeepSeek 别再被付费AI教程“套路”了!

近日,国产大模型DeepSeek在AI界“大杀四方”,各类付费教程也不断涌现,有人甚至靠卖课进账数十万元。在这场狂欢中,普通人既看到了赚钱门道,也面临着“被套路”的风险。那么,作为普通人,要如何用好D...

家家都有DeepSeek服务,如何谎称速度快?

家家都有DeepSeek服务,如何谎称速度快?

原创 亲爱的数据 亲爱的数据不是人人都有“钞能力”,我们的故事,从用单节点方案部署DeepSeek-R1开始。为什么是单节点呢?因为H200单卡有140GB显存,可用单节点(8卡)方案部署。而H800...

持续看好!华尔街预测DeepSeek将推动A股“牛市”

持续看好!华尔街预测DeepSeek将推动A股“牛市”

中新网2月12日电(宫宏宇)DeepSeek对中国市场的利好还在持续。华尔街最新分析看好DeepSeek推动的发展势头,全球投资者正在重新评估中国的可投资性。据彭博社12日消息,摩根士丹利、摩根大通和...

仙桃“城市大脑”全面接入DeepSeek

仙桃“城市大脑”全面接入DeepSeek

3月12日仙桃DeepSeek大模型本地化部署上线发布会在市民之家举行仙桃市“城市大脑”完成重磅升级完成了DeepSeek大模型本地化部署成为全省直管市中首个接入国产人工智能大模型DeepSeek的城...