当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

4个月前 (03-25)Deepseek最新资讯355

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

边城一场“孟”,世间山海“连”!与DeepSeek共游云南宝藏小城

边城一场“孟”,世间山海“连”!与DeepSeek共游云南宝藏小城

边陲风情,民族特色……当小编询问当下热门的大语言模型DeepSeek:“云南省普洱市的宝藏小城是哪一座?”DeepSeek推荐了被誉为“边地绿宝石”的孟连。今天,让我们和DeepSeek一同踏入孟连这...

持续看好!华尔街预测DeepSeek将推动A股“牛市”

持续看好!华尔街预测DeepSeek将推动A股“牛市”

中新网2月12日电(宫宏宇)DeepSeek对中国市场的利好还在持续。华尔街最新分析看好DeepSeek推动的发展势头,全球投资者正在重新评估中国的可投资性。据彭博社12日消息,摩根士丹利、摩根大通和...

优刻得与百事通战略合作 合力推进DeepSeek一体机司法领域应用

优刻得与百事通战略合作 合力推进DeepSeek一体机司法领域应用

人民财讯4月9日电,记者从优刻得获悉,优刻得与上海百事通信息技术股份有限公司达成战略合作。双方将携手推出DeepSeek一体机司法解决方案,实现“高安全国产算力+垂直领域数据资源”的技术融合,为司法行...

医生自嘲“天塌了”!病人查DeepSeek后质疑治疗方案,关键还说对了!AI看病靠谱吗?

医生自嘲“天塌了”!病人查DeepSeek后质疑治疗方案,关键还说对了!AI看病靠谱吗?

本文转自【新民晚报】;“天都塌了!病人DeepSeek后质疑我的治疗方案,气得我自己又查了一遍指南,才发现指南更新了……”2月22日,广东一位医学博主“孤芳自赏”的网帖引起网友热议。截至23日14时,...

广东多地政府部门接入DeepSeek

广东多地政府部门接入DeepSeek

【广东多地政府部门接入DeepSeek】财联社2月15日电,广东多地政府部门开始在政务系统部署接入DeepSeek。据了解,2月8日,深圳市龙岗区政务服务和数据管理局已经在政务外网部署上线了DeepS...

双良节能全面启动DeepSeek全场景应用 以AI驱动产业升级

双良节能全面启动DeepSeek全场景应用 以AI驱动产业升级

2月17日,双良节能全面启动DeepSeek全产业全场景应用计划。基于DeepSeek-R1大模型的高效推理能力与成本优势,通过本地化部署实现AI与业务的深度耦合,双良将在智能制造、清洁能源等核心产业...