当前位置:首页 > Deepseek应用场景 > 正文内容

OpenAI罕见宣布将开源推理模型,DeepSeek给逼的

7个月前 (04-01)Deepseek应用场景441

就在刚刚,OpenAI CEO Sam Altman正式宣布,将在未来几个月内推出一款具备推理能力的强大开放权重语言模型,并期待与开发者共同探索如何最大化其潜力。


据Altman透露,这是自GPT-2以来OpenAI首次计划发布开放权重语言模型。


他坦言,虽然这一想法已酝酿许久,但此前其他优先事项占据了主导地位。如今,发布这款模型的时机变得尤为重要。



作为参考,开放权重(open weight)是指将AI模型(尤其是神经网络)的训练参数(即权重)公开,供公众使用、检查或进一步开发。


用户可以在这些权重的基础上进行修改,并将修改后的权重重新分发。


虽然开放权重不能完全等同于开源,是一种介于完全闭源和完全开源之间的折中方案,但它是开源理念在AI领域的一种延伸和部分实现,包括此前宣称开源的DeepSeek V3/R1同样只开放了权重。


在正式发布前,OpenAI将依据其“准备框架”对模型进行评估,确保其安全性与可靠性。


考虑到模型发布后可能被修改,团队还将开展额外测试与优化工作。


为进一步完善开发流程,OpenAI计划举办一系列开发者活动,以收集反馈并展示早期原型。首场活动将于数周后在旧金山启动,随后在欧洲和亚太地区陆续展开。


有兴趣参与的开发者可通过链接报名:
https://openai.com/open-model-feedback



OpenAI研究员约翰内斯·海德克(Johannes Heidecke)对此补充道:


“安全性是我们开发开放权重模型的核心。从预训练到发布,我们都会遵循严格的准备框架,确保不会推出可能引发灾难性风险的模型。尽管开放模型面临独特挑战,我们对此充满信心。”


目前,Altman的评论区已经乱成一锅粥了。


网友呼声最高的模型是OpenAI o1 mini,全球最大AI开源社区Hugging Face CEO Clément Delangue也现身评论区。



谈到开源,自然绕不开DeepSeek。R1和R2的身影也充斥着整个评论区。




网友是懂Sam Altman的。毕竟GPT-5也说是“未来几个月”发布,但至今未见踪影。



Altman此前发文透露,得益于GPT-4o的多模态图像生成功能,OpenAI在过去五天内新增了100万用户。



并且由于大量用户的涌入,导致OpenAI的GPU被“融化了”,等模型开放后只能说形势易转。



值得一提的是,Altman上个月曾与硅谷知名分析师Ben Thompson进行了一场深度对谈,其中也有谈到包括开源模型以及和DeepSeek的竞争。


他当时表示:


我认为DeepSeek确实是个很棒的团队,也做出了很优秀的模型,但他们真正走红的原因,并不完全是模型本身的能力。


这对我们来说是一个教训,那就是当我们隐藏一个功能时(思维链),我们给其他人留下了获得病毒式传播的机会。这是一个很好的警醒。它也让我重新思考我们在免费层中提供的内容,GPT-5将可以免费使用。


在今天的发文中,他表示“我们已经考虑这个问题很长时间了,但其他优先事项曾经占据了更高的优先级,现在感觉发布它变得非常重要。”


显然,这位曾罕见承认OpenAI封闭策略站在“历史的错误一方”的CEO已经深刻认识到开源的战略意义。


在接下来的几个月内,无论是Llama 4,还是DeepSeek R2都将成为击垮OpenAI声誉的重要一击,而此次宣布开源,或许正是OpenAI精心准备的一招反击。


“OpenAI罕见宣布将开源推理模型,DeepSeek给逼的” 的相关文章

湘潭政务服务开启DeepSeek新节奏

湘潭政务服务开启DeepSeek新节奏

AI赋能数字湘潭建设湘潭政务服务开启DeepSeek新节奏(记者 陈颖 通讯员 葛亚芬 朱欣)3月10日,基于DeepSeek-R1满血版大模型建设的“湘潭政务推理大模型”正式上线,这是湘潭市探索以A...

DeepSeek-V3模型悄然更新,编程数学能力更强了

DeepSeek-V3模型悄然更新,编程数学能力更强了

交汇点讯 3月24日晚间,deepseek 悄然发布一款新的大语言模型——deepseek-v3-0324。这款 641gb 大小的模型在开源平台hugging face上亮相,几乎未作任何宣传。本次...

“联通元景+DeepSeek” 赋能重庆12345热线智慧升级

“联通元景+DeepSeek” 赋能重庆12345热线智慧升级

在人工智能技术快速发展的背景下,中国联通积极推进数字化建设,助力重庆12345政务服务便民热线接入DeepSeek R1国产大模型,并融合中国联通元景大模型技术,实现民生诉求场景下热点问题的全维度态势...

Deepseek引发AI+变革浪潮 2025年AI行情可期

Deepseek引发AI+变革浪潮 2025年AI行情可期

本报记者 顾梦轩 夏欣 广州、北京报道2025年新年伊始,中国AI企业深度求索(DeepSeek)的开源大模型DeepSeek-R1在资本市场掀起巨浪。Wind数据显示,截至2月12日,万得Deeps...

《殷墟甲骨精粹注译》:一场关于甲骨的“Deepseek”

《殷墟甲骨精粹注译》:一场关于甲骨的“Deepseek”

殷墟甲骨刻辞自一八九九年被发现以来就一直受到学界和社会的关注,其所包含的对中国汉字源流演变、先秦语言文字、殷商历史文化、中国考古发掘等各方面的研究价值颇高。经过前辈学者们一百多年来的努力,我们对殷墟甲...

DeepSeek:为调查女神写的诗歌

DeepSeek:为调查女神写的诗歌

女神节她力量放光芒2025/03/08HAPPY WOMEN'S DAY蛇年伊始国产人工智能大模型DeepSeek迅速火爆出圈、霸屏网络科技前沿跃动智慧之光统计调查人亦是追光者今年正值第四次全...