当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

1年前 (2025-02-24)Deepseek最新资讯621

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

娄勤俭:通过DeepSeek兴起可看到中国的创新性和包容性

娄勤俭:通过DeepSeek兴起可看到中国的创新性和包容性

据央视新闻消息,十四届全国人大三次会议今天(3月4日)在人民大会堂举行新闻发布会,大会发言人娄勤俭就大会议程和人大工作相关问题回答中外记者提问。在回答人工智能发展相关问题时,娄勤俭表示,DeepSee...

DeepSeek最高日赚346万元?官方称理论收益并非实际

DeepSeek最高日赚346万元?官方称理论收益并非实际

3月1日,DeepSeek在开源周最后一天抛出的"暴利"数据引发热议——V3/R1推理系统理论日利润高达346万元人民币(47.5万美元)。在这组看似惊人的数字背后,是一场关于AI...

市延安医院成功接入DeepSeek

市延安医院成功接入DeepSeek

本报讯 记者徐婕报道 近日,昆明市延安医院正式上线本地化部署的DeepSeek大模型,标志着医院正式开启“AI+医疗”深度融合的智能医疗新篇章。  DeepSeek大模型依托前沿自然语言处理技术,可高...

刘慈欣称DeepSeek完全可能替代人类作家

刘慈欣称DeepSeek完全可能替代人类作家

本文转自【九派新闻】;3月29日,据央视财经,科幻作家、《三体》作者刘慈欣在接受采访时被问到DeepSeek未来有可能替代科幻作家吗?刘慈欣表示,暂时不太会,但是再过10年、20年,从理论上说完全可能...

华阳集团:DeepSeek部署有效提升研发效率和生产力

华阳集团:DeepSeek部署有效提升研发效率和生产力

中证报中证网讯(王珞)2月18日,华阳集团微信公众号发文表示,公司自研的软件开放平台已接入DeepSeek的API接口,公司的研发系统已初步完成了对DeepSeek的部署,有效提升了研发效率和生产力。...

接入DeepSeek!西安“智”创升级

接入DeepSeek!西安“智”创升级

2025年,DeepSeek可以称得上是最火的热词之一。接入!不到两个月时间,陕西已有不少企业、平台宣布全面接入DeepSeek,人工智能(AI)技术正在加速走进实验室、生产车间、远程诊疗、文旅融合等...