当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

8个月前 (02-24)Deepseek最新资讯482

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

DeepSeek开源第二弹:EP通信库来了,有望再次降低计算消耗

DeepSeek开源第二弹:EP通信库来了,有望再次降低计算消耗

2月25日,DeepSeek在“开源周”的第二日开源了DeepEP通信库。DeepSeek表示,这是第一个用于MoE(专家)模型训练和推理的开源EP通信库。“高效、优化的全员沟通;节点内和节点间均支持...

DeepSeek,激荡AI行业的“一股清流”

DeepSeek,激荡AI行业的“一股清流”

近期,外媒纷纷将聚光灯投向中国初创企业深度求索公司,其自主研发的人工智能(AI)大语言模型“深度求索”(DeepSeek)凭借“好用、开源、免费”三大特点,在全球范围内引发热烈反响。这一创新成果不仅在...

PPIO 上线 DeepSeek-Prover-V2-671B

PPIO 上线 DeepSeek-Prover-V2-671B

4月30日,DeepSeek 在 Hugging Face 开源了 DeepSeek-Prover-V2-671B 新模型。作为一站式 AIGC 云服务平台,PPIO派欧云在第一时间上线了 DeepS...

AI赋能,绿动未来:挚达科技接入DeepSeek全球化布局的新篇章

AI赋能,绿动未来:挚达科技接入DeepSeek全球化布局的新篇章

随着全球对可持续发展的重视,新能源汽车产业正以前所未有的速度蓬勃发展。然而,在全球化进程中,新能源汽车服务企业面临着多语言支持、跨文化服务以及本地合规审核等多重挑战。海外市场对于能够提供无缝对接、符合...

全面接入DeepSeek!中国电信股价创新高 运营商力推AI普惠应用收入有望迎增长

全面接入DeepSeek!中国电信股价创新高 运营商力推AI普惠应用收入有望迎增长

财联社2月10日讯(记者 付静)DeepSeek部署适配潮持续,国内三家通信运营商亦相继接入了DeepSeek。8日,工业和信息化部运行监测协调局在2025年春节通信业务相关情况中提到,三家基础电信企...

四川自贡举行小学科学教学研讨会 教师将AI数字人、DeepSeek融入课堂

四川自贡举行小学科学教学研讨会 教师将AI数字人、DeepSeek融入课堂

5月16日,自贡市2024-2025学年下学期小学科学教学研讨会,在自贡市汇东实验学校成功举办。本次活动以“深耕科学课堂,点燃创新梦想”为主题,通过教学研讨与校园科技节双线并行,展现科学教育实践成果,...