当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek宣布开源优化并行策略

8个月前 (02-27)Deepseek最新资讯497

Deepseek于开源周第四天宣布开源优化并行策略,其中DualPipe——包括一种用于V3/R1训练中计算-通信重叠的双向管道并行算法;EPLB——一种用于V3/R1的专家并行负载平衡器;以及分析V3/R1中的计算-通信重叠。


“DeepSeek宣布开源优化并行策略” 的相关文章

“小彩云”+DeepSeek 昆明市推进“智慧环保”再升级

“小彩云”+DeepSeek 昆明市推进“智慧环保”再升级

近年来,昆明市生态环境局通过引入人工智能技术,打造生态环境智慧助手“小彩云”。目前,接入DeepSeek和通义千问等主流开源模型,成功打造一系列智能化应用,涵盖生态环境保护督察投诉件分析、污染源自动监...

方大集团:已部署应用DeepSeek公司大模型,并已在公司的企业管理等方面应用

方大集团:已部署应用DeepSeek公司大模型,并已在公司的企业管理等方面应用

 证券日报网讯 方大集团3月14日在互动平台回答投资者提问时表示,公司高度重视智能化转型与创新技术应用,已部署应用DeepSeek公司大模型,并已在公司的企业管理等方面应用。公司目前正在推进DeepS...

企业微信接入 DeepSeek 模型,支持智能机器人、智能表格

企业微信接入 DeepSeek 模型,支持智能机器人、智能表格

IT之家 2 月 21 日消息,企业微信今日宣布接入 DeepSeek 模型,带来了「智能机器人」、「智能表格-客户跟进总结」等 AI 功能。IT之家从官方介绍获悉,接入 DeepSeek、混元等大模...

专访清华大学教授沈阳:DeepSeek的经济价值可能突破十万亿元

专访清华大学教授沈阳:DeepSeek的经济价值可能突破十万亿元

清华大学新闻与传播学院/清华大学人工智能学院双聘教授沈阳。封面新闻记者 边雪2025年伊始,中国人工智能实验室深度求索(DeepSeek)推出的开源语言模型DeepSeek-R1,以一场技术“地震”撼...

从DeepSeek-R1看AI国产化的全球突围

从DeepSeek-R1看AI国产化的全球突围

近期,中国初创公司深度求索(DeepSeek)推出的大模型DeepSeek-R1引发全球关注。这款完全基于国产技术研发的AI产品,不仅在自然语言处理、多模态交互等领域展现出不逊于国际顶尖模型的性能,更...

机器人基座大模型——下一个“DeepSeek”从这里来?

机器人基座大模型——下一个“DeepSeek”从这里来?

随着人工智能与机器人技术快速交汇,按照Anthropic联合创始人兼政策主管Jack Clark本周一的表态,机器人行业即将迎来类似生成式AI模型的早期发展时期——GPT-2时代!各家机器人基座大模型...