当前位置：首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

7个月前 (03-26)DeepSeek技术交流427

明敏发自凹非寺

量子位 | 公众号 QbitAI

刚刚，DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5！

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B，与此前网传的685B有所出入。

开源版本上下文长度为128K（网页端、App和API提供 64K 上下文）。

私有化部署时只需要更新checkpoint和tokenizer_config.json（tool calls相关变动）。

目前，想要体验这一版本模型，只需用户登录官方网页、APP、小程序进入对话界面后，关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议，此后非复杂推理任务使用V3新版本更好。

此外，官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高，视觉效果也更好。

中文写作

相较于R1版有进一步优化，特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文：

中文搜索

联网情况下，V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy（上下滑动查看完整内容）：

此外，V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力，比如做个小游戏：

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说，趁着深夜，还没睡的赶紧去体验最新版吧~

原标题：《新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练》

标签: DeepSeek 人工智能数据分析应用场景

返回列表

上一篇：DeepSeek V3再次震撼硅谷，中美AI差距突然缩至3个月！

下一篇：DeepSeek-V3升级：评测达75.9%正确率，代码生成提速40%

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

李彦宏：DeepSeek不是万能，最大问题是慢和贵，大多数大模型速度比DeepSeek满血版更快，价格更低「附多模态大模型行业市场分析」

（图片来源：摄图网）4月25日，百度创始人李彦宏在reate2025百度AI开发者大会上发表了题为《模型的世界应用的天下》的演讲。他在演讲中称 “DeepSeek不是万能的”，并指出了DeepSee...

DeepSeek赋能，美的空调开启 AI 智能新篇

2025年初，中国人工智能大模型 DeepSeek火遍全球，让全世界看到了中国AI技术的巨大潜力。国内家电行业也迅速乘上了这股东风，持续探索人工智能大模型与智能家居结合的无限可能性。据悉，家电巨头美的...

智汇政务创享未来——白银市广大干部集中专题学习DeepSeek人工智能大模型应用探索

在数字化浪潮中，人工智能、大数据等技术的应用场景不断拓展，作为一款先进的人工智能辅助决策系统，DeepSeek在政务服务、公共管理等多个领域展现出巨大的应用潜力。为学习探讨如何运用DeepSeek提升...

DeepSeek预测2025年高考十大热门填报专业，结果让人意外

今天，我们一同探讨DeepSeek对2025年高考热门专业的预测，剖析这些专业是否真的具备吸引力，值得广大学子的关注。一、智能科技与大数据——数字经济的支柱智能科技与大数据，作为数字经济的核心领域，正...

DeepSeek-V3模型悄然更新，编程数学能力更强了

交汇点讯 3月24日晚间，deepseek 悄然发布一款新的大语言模型——deepseek－v3－0324。这款 641gb 大小的模型在开源平台hugging face上亮相，几乎未作任何宣传。本次...

清华北大、浙大DeepSeek报告汇总（附下载）

DeepSeek作为一项前沿的人工智能技术，近年来在各大高校中得到了广泛应用和研究。本文整理了四校发布的DeepSeek报告，汇聚了各自在DeepSeek技术领域的最新研究成果，旨在为推动中国高等教育...

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

李彦宏：DeepSeek不是万能，最大问题是慢和贵，大多数大模型速度比DeepSeek满血版更快，价格更低「附多模态大模型行业市场分析」

DeepSeek赋能，美的空调开启 AI 智能新篇

智汇政务创享未来——白银市广大干部集中专题学习DeepSeek人工智能大模型应用探索

DeepSeek预测2025年高考十大热门填报专业，结果让人意外

DeepSeek-V3模型悄然更新，编程数学能力更强了

清华北大、浙大DeepSeek报告汇总（附下载）

温馨提示：
DeepSeek爱好者为非盈利站点，所有内容均来自网络整理，不保证内容的真实性。

Powered By Z-BlogPHP. Theme by TOYEAN.

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

李彦宏：DeepSeek不是万能，最大问题是慢和贵，大多数大模型速度比DeepSeek满血版更快，价格更低「附多模态大模型行业市场分析」

DeepSeek赋能，美的空调开启 AI 智能新篇

智汇政务 创享未来——白银市广大干部集中专题学习DeepSeek人工智能大模型应用探索

DeepSeek预测2025年高考十大热门填报专业，结果让人意外

DeepSeek-V3模型悄然更新，编程数学能力更强了

清华北大、浙大DeepSeek报告汇总（附下载）

Powered By Z-BlogPHP. Theme by TOYEAN.

智汇政务创享未来——白银市广大干部集中专题学习DeepSeek人工智能大模型应用探索