当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

3个月前 (03-26)DeepSeek技术交流205

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

DeepSeek R1模型已完成小版本试升级

DeepSeek R1模型已完成小版本试升级

每经快讯,5月28日,DeepSeek官方宣布DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变。每日经济新闻...

【Windows】全网最简单DeepSeek R1本地部署教程 小白也可操作完成 AI人工智能【免费分享】只需3分钟就可完成部署

【Windows】全网最简单DeepSeek R1本地部署教程 小白也可操作完成 AI人工智能【免费分享】只需3分钟就可完成部署

本文主要介绍是7b模型部署教程,7b模型适合电脑独显的显存4G及以上电脑【模型选择】 电脑没有独立显卡:选择1.5b模型 有独显,显存4G或8G:选择7b或8b模型 更高...

30余个高频场景的职场应用 看这本书活用DeepSeek

30余个高频场景的职场应用 看这本书活用DeepSeek

湖南日报·新湖南客户端3月14日讯(记者 黄煌 通讯员 徐新力)随着DeepSeek的火爆出圈,越来越多的人意识到,在AI技术重构工作方式的今天,掌握DeepSeek已成为职场核心竞争力之一。如何最大...

第一批用DeepSeek赶作业的孩子出现了

第一批用DeepSeek赶作业的孩子出现了

寒假接近尾声你家孩子寒假作业写完了吗?往年的这个时候许多“耍小聪明”的孩子会在网上找人“代写”而今年画风突然就不一样了不少中小学生开始用DeepSeek等人工智能应用赶作业一时间“DeepSeek成赶...

河南省公共资源交易中心接入部署DeepSeek “人工智能+”让公共资源交易“加数跑”

河南省公共资源交易中心接入部署DeepSeek “人工智能+”让公共资源交易“加数跑”

近日,经营主体登录河南省公共资源交易中心(以下简称“省交易中心”)官网进行网上咨询,不用提出问题后焦急等待人工回复,只需在“智能咨询”栏目中输入问题,即可获得“秒级响应、全网检索、深度解析、即时解答”...

江西联通深化人工智能赋能 推动DeepSeek多领域融合创新

江西联通深化人工智能赋能 推动DeepSeek多领域融合创新

当下最热的DeepSeek与江西联通携手,将擦出怎样的精彩火花?从政务服务到高校课堂,从纺织车间到产业决策,一场由人工智能驱动的变革正加速重构传统业态。近日,江西联通以DeepSeek大模型为核心,在...