当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

2个月前 (02-24)Deepseek最新资讯145

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

助力构建智能政务生态!梅州12345热线全市率先“牵手”DeepSeek

助力构建智能政务生态!梅州12345热线全市率先“牵手”DeepSeek

日前,梅州市政务服务和数据管理局联手中国电信梅州分公司部署接入DeepSeek,探索DeepSeek先进技术的政务化应用,构建智能政务生态。其中,梅州12345热线21日全市率先实现DeepSeek赋...

DeepSeek严选“春茶饮用指南”,是谁的DNA动了

DeepSeek严选“春茶饮用指南”,是谁的DNA动了

“明前茶,贵如金”眼下,正是品尝明前茶的好时候清明前茶树的芽叶最嫩且产量有限我们请DeepSeek当推荐官生成了一份“春茶饮用指南”来看看它的严选↓↓西湖龙井·浙江“明前茶标杆”龙井,当前最为应季。清...

AI手机迎来“DeepSeek时刻”?

AI手机迎来“DeepSeek时刻”?

2025年将是AI商业化落地元年,智能手机行业的争夺战尤其激烈。苹果CEO库克曾表示,在已开放使用Apple Intelligence技术的国家内,iPhone 16系列销量更高。而iPhone 16...

DeepSeek接入政务系统,公务员要下岗了?

DeepSeek接入政务系统,公务员要下岗了?

最近,全国多地将DeepSeek等人工智能系统应用于政务和公共服务。基于DeepSeek系统的“AI公务员”在深圳福田区上岗,在多类场景“办公”。广州市政务服务和数据管理局在政务外网正式部署上线Dee...

攀升新品亮相,首款搭载本地DeepSeek的定制AIPC开箱即用

攀升新品亮相,首款搭载本地DeepSeek的定制AIPC开箱即用

近日,国产开源大模型DeepSeek引发全球AI领域高度关注。PC作为应用场景最广泛的生产力工具,是承载大规模本地模型的首选终端。相较于手机、可穿戴等设备,PC能够支持远程会议、图形设计、编程开发、多...

30余个高频场景的职场应用 看这本书活用DeepSeek

30余个高频场景的职场应用 看这本书活用DeepSeek

湖南日报·新湖南客户端3月14日讯(记者 黄煌 通讯员 徐新力)随着DeepSeek的火爆出圈,越来越多的人意识到,在AI技术重构工作方式的今天,掌握DeepSeek已成为职场核心竞争力之一。如何最大...