当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

DeepSeek大模型赋能“有诉必应马上办”

DeepSeek大模型赋能“有诉必应马上办”

本报讯(记者 张弘靓)记者从西宁市数据局(市政务服务监管局)获悉,为进一步贯彻习近平总书记考察青海时提出的“切实保障和改善民生,尽力而为、量力而行,多办顺民意、惠民生、暖民心的实事,扎实解决群众急难愁...

田间赋诗的沂蒙农民大姐吕玉霞也用过DeepSeek “有人质疑诗是DeepSeek写的 它写的话肯定会更华丽一些”

田间赋诗的沂蒙农民大姐吕玉霞也用过DeepSeek “有人质疑诗是DeepSeek写的 它写的话肯定会更华丽一些”

齐鲁网·闪电新闻3月14日讯 3月14日(采访时间),山东临沂。近日,“70后”农民大姐沂蒙二姐”吕玉霞在田间创作诗歌的视频火了。吕玉霞提到,自己有不懂的字词也会通过DeepSeek学习,但在创作上,...

卓创资讯:完成DeepSeek系列大模型的本地化部署

卓创资讯:完成DeepSeek系列大模型的本地化部署

每经快讯,卓创资讯官微2月18日消息,近日,卓创资讯完成DeepSeek系列大模型的本地化部署,成功实现从技术引入到落地应用。卓创资讯通过DeepSeek系列大模型与公司已应用大模型的深度融合,形成协...

上海数据交易所接入DeepSeek大模型

上海数据交易所接入DeepSeek大模型

观点网讯:2月27日,上海数据交易所正式接入DeepSeek大模型,标志着国内首个大型语言模型在数据交易领域的应用落地。此次合作旨在构建多维数据交易知识体系的领域模型,提升数据交易服务智能化水平。据了...

北京大学联合华为发布全栈开源DeepSeek推理方案

北京大学联合华为发布全栈开源DeepSeek推理方案

据北京大学网站消息,近日,北京大学联合华为发布DeepSeek全栈开源推理方案。该方案基于北京大学自主研发的SCOW算力平台系统与鹤思调度系统,整合了DeepSeek、openEuler、MindSp...

钢铁大模型“拥抱”DeepSeek擦出新火花

钢铁大模型“拥抱”DeepSeek擦出新火花

本报讯(记者贡宪云)前不久,河钢数字WeShyper(威赛博)钢铁大模型正式接入DeepSeek(深度求索)。这款河北钢铁大模型“拥抱”DeepSeek,将擦出什么样的火花?“DeepSeek具有长文...