当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

8个月前 (03-25)DeepSeek技术交流498

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

华为+DeepSeek,推理性能创新高!技术报告也公布出来了

华为+DeepSeek,推理性能创新高!技术报告也公布出来了

金磊 发自 凹非寺量子位 | 公众号 QbitAI部署超大规模MoE这件事,国产芯片的推理性能,已经再创新高了——不仅是“英伟达含量为0”这么简单,更是性能全面超越英伟达Hopper架构!而做到这一点...

百度、微信接入DeepSeek

百度、微信接入DeepSeek

中国互联网行业再迎标志性技术事件。2月16日晚,百度搜索和文心智能体平台宣布将全面接入DeepSeek。搜索用户可免费使用DeepSeek和文心大模型深度搜索功能,文心智能体平台的开发者也将随时调用D...

外界热议:DeepSeek又变强了!

外界热议:DeepSeek又变强了!

中国人工智能初创公司深度求索(DeepSeek)24日深夜低调上线了DeepSeek-V3的新版本DeepSeek-V3-0324,参数量为6850亿,在代码、数学、推理等多个方面的能力再次显著提升,...

辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办

辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办

近日,辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办。本次会议以“AI赋能教育教学”为主题,探讨“昇腾AI重构高校教育科技生态”,探索新时代高校数智化发展新模式,推...

红塔证券:红塔证券已经成功上线DeepSeek-R1大模型

红塔证券:红塔证券已经成功上线DeepSeek-R1大模型

每经AI快讯,有投资者在投资者互动平台提问:长城证券002939智源AI中心已上线了大模型DeepSeek-R1与阿里Qwen2.5,公司员工可通过系统中的AI工具中心进行使用体验。请问贵公司未来也考...

体制内、党政机关写材料,DeepSeek写公文提示词大全

体制内、党政机关写材料,DeepSeek写公文提示词大全

一、通知类文书作为[机构全称]的[职位信息],拟制[特定事项]工作通知。必备模块:[职责划分]、[关键环节]、[执行标准],行文参照《党政机关公文格式》,禁用修饰语,采用"一、二、三&quo...