当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

8个月前 (03-25)DeepSeek技术交流497

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

中原证券:DeepSeek有望推动国产AI算力芯片加速发展

中原证券:DeepSeek有望推动国产AI算力芯片加速发展

AI算力芯片是“AI时代的引擎”。ChatGPT热潮引发全球科技企业加速布局AI大模型,谷歌、Meta、百度、阿里巴巴、华为、DeepSeek等随后相继推出大模型产品,并持续迭代升级;北美四大云厂商受...

在DeepSeek老家发新模型,豆包怎么想的?

在DeepSeek老家发新模型,豆包怎么想的?

摘要:尽管研发模型是当前最紧要的任务,但凤凰网科技从豆包内部人士处了解到,内部对应用层的投入同样巨大,“拿的资源不比模型层少”。凤凰网科技 出品作者|徐珍编辑|董雨晴豆包的思考模型终于正式揭开面纱。4...

深度分析DeepSeek爆火背后,对整个AI产业带来的颠覆与冲击

深度分析DeepSeek爆火背后,对整个AI产业带来的颠覆与冲击

本文参考报告:《2025中国DeepSeek对AI产业的影响》,首发于头豹科创网。DeepSeek在春节期间刷屏朋友圈,引发了AI产业关于低训练成本、开源与闭源模型选择、模型蒸馏及知识产权等话题的热烈...

DeepSeek说:520到了,不同mbti的理想爱情是什么样的?

DeepSeek说:520到了,不同mbti的理想爱情是什么样的?

MBTI作为人格分类工具,常被用来探讨爱情中的互动模式。不同人格类型对理想关系的期待确实存在差异,但需注意:个体差异远大于类型标签,以下仅为基于认知功能(如主导/辅助功能)的常见倾向总结:理性分析组(...

阿里千问与DeepSeek入选全球AI开源贡献榜前十

阿里千问与DeepSeek入选全球AI开源贡献榜前十

【阿里千问与DeepSeek入选全球AI开源贡献榜前十】财联社6月12日电,全球最大的AI开源社区Hugging Face发布了最新的AI开源贡献榜,中国团队表现亮眼,阿里通义千问跻身全球第五、中国第...

DeepSeek 爆火,为工业转型带来启示

DeepSeek 爆火,为工业转型带来启示

在当今竞争激烈的制造业市场中,数字化转型已成为企业生存与发展的关键。而最近爆火的 DeepSeek,为制造业企业的数字化转型带来了新的契机。作为制造业企业的 CIO,今天就来和大家聊聊如何利...