当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

3周前 (02-24)Deepseek最新资讯50

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

联想杨元庆:DeepSeek推动端侧智能部署,AI加速平民化

联想杨元庆:DeepSeek推动端侧智能部署,AI加速平民化

2月20日下午,在联想发布2024/25财年第三财季业绩后的媒体采访上,DeepSeek成为大家口中的高频词。“DeepSeek深远的影响力证明了一个大方向:人工智能不是只在云上,也以更高效的模式、跟...

专访清华大学教授沈阳:DeepSeek的经济价值可能突破十万亿元

专访清华大学教授沈阳:DeepSeek的经济价值可能突破十万亿元

清华大学新闻与传播学院/清华大学人工智能学院双聘教授沈阳。封面新闻记者 边雪2025年伊始,中国人工智能实验室深度求索(DeepSeek)推出的开源语言模型DeepSeek-R1,以一场技术“地震”撼...

DeepSeek接入完毕,武汉硚口的这些业务可一键办理

DeepSeek接入完毕,武汉硚口的这些业务可一键办理

极目新闻通讯员 李刚近日,武汉市硚口区行政审批局“公司宝典”微信公众号接入深度求索(DeepSeek)人工智能模型,开创了湖北省省市场主体登记领域使用生成式AI服务群众的先河。公司宝典微信公众号据悉,...

创力集团:正在积极探索设备接入DeepSeek相关技术或平台

创力集团:正在积极探索设备接入DeepSeek相关技术或平台

e公司讯,创力集团(603012)2月18日在互动平台表示,公司正在积极探索设备接入DeepSeek相关技术或平台。公司研发团队在AI算法优化、数据处理及自动化控制等领域有丰富经验,利用DeepSee...

宇通率先接入DeepSeek 多维升级智能出行新体验

宇通率先接入DeepSeek 多维升级智能出行新体验

2月15日,宇通“一云两舱”,包含“云管家安睿通”、“智慧驾舱”和“智享客舱”接入DeepSeek推理大模型,依托DeepSeek强大的泛化、推理等能力,升级车辆类人交互智能体验,全面提升整车智能化水...

山东多地政务系统接入DeepSeek,“AI公务员”靠谱吗?

山东多地政务系统接入DeepSeek,“AI公务员”靠谱吗?

DeepSeek朋友圈正持续“扩容”。最近,越来越多政府部门官宣接入DeepSeek。拿山东来说,临沂、烟台、滨州以及济南市中区等地相继宣布政务系统接入DeepSeek。政务服务作为与民众生活息息相关...