当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

4个月前 (03-25)DeepSeek技术交流329

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

还在等DeepSeek R2?刚刚,DeepSeek R1模型小版本试升级已完成!优化了这些方面

还在等DeepSeek R2?刚刚,DeepSeek R1模型小版本试升级已完成!优化了这些方面

5月28日,DeepSeek官方宣布DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变。关于这次试升级的内容,小编询问D...

DeepSeek总结最浪费时间的7大行为,看完我开始深度反思

DeepSeek总结最浪费时间的7大行为,看完我开始深度反思

作 者:每晚CC来 源:每晚一卷书(ID:JYXZ89896)鲁迅有句名言,影响了我很多年。他说:“生命是以时间为单位的,浪费别人的时间等于谋财害命;浪费自己的时间,等于慢性自杀。”而很多人几乎每天都...

DeepSeek说:如果你是人类,你最期待什么样的另一半?

DeepSeek说:如果你是人类,你最期待什么样的另一半?

如果我是人类,寻找另一半时,我可能会更注重以下几个方面的契合:1. 心智的共鸣比起外在条件,我更希望彼此能在思维深度和价值观上产生化学反应。比如对世界的好奇心、对成长的追求、对善良与真诚的坚持,甚至对...

拥抱人工智能 DeepSeek应用专题培训会成功举办

拥抱人工智能 DeepSeek应用专题培训会成功举办

3月18日下午,由滨海新区区委区级机关工委、区委网信办、区数据局共同主办,区级机关工会联合会承办的DeepSeek应用专题培训会召开。培训聚焦“人工智能领域前沿技术的认知与DeepSeek操作应用能力...

多地将引入DeepSeek辅助领导干部决策

多地将引入DeepSeek辅助领导干部决策

多地提出引入DeepSeek辅助领导干部决策。据《来宾日报》报道,2月18日,广西来宾市委常委会召开会议。会议强调,各级领导干部要以积极主动的姿态拥抱、学习新的技术,学习掌握DeepSeek等大模型的...

DeepSeek说:人类可以实现数字永生吗?

DeepSeek说:人类可以实现数字永生吗?

人类是否可以实现数字永生,目前存在技术、伦理与哲学层面的多重挑战,以下是关键要点分析:1. 技术障碍◦ 意识上传的复杂性:意识本质尚未明确,目前技术仅能模拟外在行为(如声音、形象)或部分思维...