当前位置：首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

8个月前 (03-26)DeepSeek技术交流440

明敏发自凹非寺

量子位 | 公众号 QbitAI

刚刚，DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5！

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B，与此前网传的685B有所出入。

开源版本上下文长度为128K（网页端、App和API提供 64K 上下文）。

私有化部署时只需要更新checkpoint和tokenizer_config.json（tool calls相关变动）。

目前，想要体验这一版本模型，只需用户登录官方网页、APP、小程序进入对话界面后，关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议，此后非复杂推理任务使用V3新版本更好。

此外，官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高，视觉效果也更好。

中文写作

相较于R1版有进一步优化，特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文：

中文搜索

联网情况下，V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy（上下滑动查看完整内容）：

此外，V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力，比如做个小游戏：

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说，趁着深夜，还没睡的赶紧去体验最新版吧~

原标题：《新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练》

标签: DeepSeek 人工智能数据分析应用场景

返回列表

上一篇：DeepSeek V3再次震撼硅谷，中美AI差距突然缩至3个月！

下一篇：DeepSeek-V3升级：评测达75.9%正确率，代码生成提速40%

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

文心大模型X1对上最新版DeepSeek V3，表现谁更好？

3月26日，在多个公开数据集测评中，百度最新发布的文心大模型X1，在数学、代码、推理等能力上表现优异，超越升级后的DeepSeek-V3-0324。在数学场景中，GSM8K数据集测试后结果显示，文心X...

deepseek能用来干啥-deepseek有什么用途

DeepSeek是一款基于人工智能技术的工具，旨在帮助用户高效处理和分析数据、生成内容、优化工作流程等。其应用场景非常广泛，具体功能和使用场景包括但不限于以下几个方面：一、数据分析与可视化数据导入：支...

李国杰院士“七问”DeepSeek都说了些什么？

近日，DeepSeek的横空出世，在全球科技领域激起千层浪，引发了从学界到业界的广泛热议与深度思考。《科技导报》2025年第3期刊发李国杰院士的《DeepSeek引发的AI发展路径思考》一文，深入剖析...

警惕不法分子借DeepSeek热度研发出的新型骗局

紧急预警广大市民朋友：近期，DeepSeek的热度持续居高不下，这款全能型工具各领域分析处理能力都令人大开眼界。然而，DeepSeek的火爆也让不法分子利用用户渴望尝试DeepSeek却认知不足...

山东移动DeepSeek政务场景共创沙龙成功举办

齐鲁网·闪电新闻3月7日讯 3月7日，山东移动与华为联合举办DeepSeek政务场景共创沙龙。本次交流会以“政通智合数聚泉城共创政务AI新场景”为主题，邀请16地市大数据局相关专家、数百名政务领域资...

外界热议：DeepSeek又变强了！

中国人工智能初创公司深度求索（DeepSeek）24日深夜低调上线了DeepSeek-V3的新版本DeepSeek-V3-0324，参数量为6850亿，在代码、数学、推理等多个方面的能力再次显著提升，...