当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源新基础模型,但不是V4,而是V3.1-Base

6小时前Deepseek最新资讯31

  昨晚,深度求索在用户群里宣布「DeepSeek 线上模型版本已升级至 V3.1,上下文长度拓展至 128k」并更新了 UI (去掉了 DeepThink 旁的 R1 标示)之后deepseek,在 Hugging Face 发布了一款新模型

  从名字也能看出来,该模型是 DeepSeek-V3 系列最新的基础模型。至于为什么命名为 V3.1,而不是像之前以前命名为 V3 带四位日期数字的形式(如 V3-0324),尽管社区有诸多猜测,但深度求索官方尚未给出明确说明 —— 和该公司之前的操作一样,这一次同样是模型先行,说明和宣传还在后面。

  该模型一发布就吸引了 AI 社区的广泛关注,短短几个小时就已经冲上了 Hugging Face 热门模型榜第 4 位!

  整体来看,社交网络上对深度求索的这次更新看法不一。有人表示非常振奋,认为这是深度求索在为接下来的 DeepSeek-V4 和 DeepSeek-R2 做铺垫,但也有人认为这次更新不够亮眼,没有达到该公司之前的一贯水准。原文出处:DeepSeek开源新基础模型,但不是V4,而是V3.1-Base,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek开源新基础模型,但不是V4,而是V3.1-Base” 的相关文章

DeepSeek破解GPT5推理机密 奥特曼破大防

DeepSeek破解GPT5推理机密 奥特曼破大防

  【#DeepSeek破解GPT5推理机密# 奥特曼破大防】#AI Deep Talk#当地时间8月7日,OpenAI官方正式推出了备受外界期待的、性能更强的新一代人工智能模型GPT-5...

浪潮企业云“民航大模型”基础能力通过中国信通院民航领域大模型能力验证!

浪潮企业云“民航大模型”基础能力通过中国信通院民航领域大模型能力验证!

  近日,首批民航云大模型场景应用能力评估结果于中国通信标准化协会主论坛正式发布,浪潮企业云“民航大模型”基础能力支撑的“民航智慧空管AI时空大模型”成功通过中国信通院民航领域大模型能力验...

78键轻巧办公助手,雷柏E9050LAI多模无线刀锋键盘一键直达DeepSeek

78键轻巧办公助手,雷柏E9050LAI多模无线刀锋键盘一键直达DeepSeek

  技术成就更强大的产品力,雷柏外设核心技术--“+计划”,发挥长期积累的技术优势,布局升级,优化迭代,推动无线技术的普及应用,驾驭科技服务于用户。加入星闪联盟、国产芯片操作系统(桌面类/...

刚刚,北大DeepSeek斩获ACL 2025最佳论文!全网首发一作演讲,稀疏注

刚刚,北大DeepSeek斩获ACL 2025最佳论文!全网首发一作演讲,稀疏注

  2025年ACL盛会于维也纳落下帷幕!今年会议规模空前,投稿量超过8000篇,其中超半数作者来自中国。4篇最佳论文中,出自中国团队之手的同样占到50%——分别是北大与DeepSeek合...

deepseek公布大语言模型部署方法专利

deepseek公布大语言模型部署方法专利

  天眼查App显示,近日,deepseek关联公司杭州深度求索人工智能基础技术研究有限公司申请的“一种大语言模型的部署方法及系统”专利公布。   摘要显示,该发明涉及人...

梁文锋论文获奖,DeepSeek V4真要来了?

梁文锋论文获奖,DeepSeek V4真要来了?

  【梁文锋论文获奖,DeepSeek V4真要来了?】 #梁文锋##deepseek##超级AI工厂##大模型# DeepSeek下一代技术提前曝光,梁文锋署名论文获ACL2025最佳论...