当前位置:首页 > DeepSeek技术交流 > 正文内容

文心大模型X1对上最新版DeepSeek V3,表现谁更好?

1个月前 (03-27)DeepSeek技术交流113

3月26日,在多个公开数据集测评中,百度最新发布的文心大模型X1,在数学、代码、推理等能力上表现优异,超越升级后的DeepSeek-V3-0324。

在数学场景中,GSM8K数据集测试后结果显示,文心X1得分95.6,DeepSeek-V3-0324得分93.6;代码生成层面,HumanEval数据集测试后结果显示,文心X1得分90.9,DeepSeek-V3-0324得分86.6;在知识推理层面,C-Eval数据集测试后结果显示,文心大模型X1得分88.6,DeepSeek-V3-0324得分85.1。

近日,DeepSeek官方宣布V3模型完成小版本升级的消息,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。

而在不久前,百度正式发布文心大模型X1,具备更强的理解、规划、反思、进化能力。文心X1由百度的慢思考技术发展而来。作为能力更全面的深度思考模型,兼备准确、创意和文采,在中文知识问答、文学创作、文稿写作、日常对话、逻辑推理、复杂计算及工具调用等方面表现尤为出色。

据悉,文心大模型X1即将上线千帆大模型平台,API调用价格为DeepSeek-R1调用价格的50%。


“文心大模型X1对上最新版DeepSeek V3,表现谁更好?” 的相关文章

开源才是未来!李开复:DeepSeek证明闭源是一条死路

开源才是未来!李开复:DeepSeek证明闭源是一条死路

快科技3月30日消息,日前,在2025中关村论坛年会人工智能主题日上,零一万物CEO李开复在演讲中谈到了DeepSeek。李开复表示,DeepSeek是一个非常快速能达到推理引擎思考的,而且不是靠蒸馏...

腾讯搭上DeepSeek快车发力C端,字节、阿里、百度还坐得住?

腾讯搭上DeepSeek快车发力C端,字节、阿里、百度还坐得住?

文|萧俊然 编|张弘一出品|商业秀2月15日晚,科技圈又抛出一颗重磅炸弹:微信正在灰度测试接入DeepSeek-R1模型 。不少已经获得测试资格的用户,纷纷晒出体验。16日上午,腾讯方面回应称,确认正...

接入DeepSeek,松江政务服务提质升级

接入DeepSeek,松江政务服务提质升级

今年以来,松江区数据局积极探索“人工智能+政务服务”模式,全力推动政务数据与前沿技术融合创新。依托华为昇腾Atlas 800I训推一体机提供的强大算力,成功实现DeepSeek 671B满血版大模型的...

放大 AI 商业价值,企业快成长 DeepSeek 行业深度应用创新论坛华北站圆满落幕

放大 AI 商业价值,企业快成长 DeepSeek 行业深度应用创新论坛华北站圆满落幕

DeepSeek 一经问世便迅速赢得了众多用户的青睐,彼时,公众对 AI 的强烈需求直接体现在了注册数量上。经过多次迭代,DeepSeek-R1 和 DeepSeek-V3 现已发展成为能够进行深度思...

云米烟灶套装:DeepSeek赋能下的智慧厨房革命

云米烟灶套装:DeepSeek赋能下的智慧厨房革命

在智能家居浪潮中,厨房正成为AI技术落地的重要场景。云米科技凭借DeepSeek大模型的深度赋能,将其AI烟灶套装升级为"会思考的厨房指挥官",通过智能交互、主动安全和场景联动三大...

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

随着人工智能发展火热,deepseek问世后掀起了一股全民学习的热潮。近日,四平路街道阜新路社区睦邻中心组织开展了专门的教学活动,教老年人如何使用deepseek并普及人工智能知识,助力老年人跨越“数...