专栏名称: 中国基金报
关注中国基金报,即时获取深度理财资讯
目录
相关文章推荐
中国基金报  ·  海通资管总经理变更! ·  12 小时前  
鸡司令  ·  今天定投一笔,资产配置更合理 ·  2 天前  
中国基金报  ·  360亿龙头,冲刺港股IPO ·  2 天前  
中国基金报  ·  新央企,总经理亮相 ·  2 天前  
中国基金报  ·  华为重回前十! ·  2 天前  
51好读  ›  专栏  ›  中国基金报

DeepSeek,最新发布!

中国基金报  · 公众号  · 基金  · 2025-02-27 12:03

正文

【导读】 DeepSeek宣布开源Optimized Parallelism Strategies

中国基金报记者 忆山

2月27日,在“开源周”第四日,DeepSeek宣布开源Optimized Parallelism Strategies。

Optimized Parallelism Strategies主要针对大规模模型训练中的效率问题。其特点包括:混合并行策略,在减少通信开销的同时最大化GPU利用率;通过梯度压缩、异步通信、通信-计算重叠等技术降低节点间通信延迟;根据硬件拓扑和模型结构自动推荐并行策略,减少手动调参成本等。

2月21日,DeepSeek宣布,从2月24日起将开源5个代码库,以完全透明的方式与全球开发者社区分享他们的研究进展。并将这一计划命名为“开源周”。

DeepSeek称,即将开源的代码库是其在线服务中的基础组件,且都经过了详细记录、部署和实战测试。

2月24日,DeepSeek首个开源的项目是FlashMLA 。FlashMLA是DeepSeek用于Hopper GPU的高效MLA解码内核,并针对可变长度序列进行了优化,现已投入生产。

2月25日,DeepSeek宣布开源DeepEP ,即首个用于MoE模型训练和推理的开源EP通信库。其特点包括:高效且优化的全对全通信,通过NVLink和RDMA支持节点内和节点间的通信,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,用于计算通信重叠。

2月26日,DeepSeek宣布开源DeepGEMM 。其特点包括:同时支持密集布局和两种MoE布局,完全即时编译,可为V3/R1模型的训练和推理提供强大支持等。

此外,在2月6日宣布暂停API服务充值后,2月25日,DeepSeek宣布重新开放API充值。2月26日晚间,DeepSeek又宣布推出错峰优惠活动,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek-V3降至原价的50%,DeepSeek-R1降至原价的25%。

DeepSeek称,鼓励用户充分利用这一时段,享受更经济、更流畅的服务体验。

QuestMobile数据显示,上线以来至2月9日,DeepSeek App的累计下载量已超1.1亿次,周活跃用户规模最高近9700万个。

编辑:赵新亮
校对: 王玥
制作: 黄梅
审核:许闻







请到「今天看啥」查看全文


推荐文章
中国基金报  ·  海通资管总经理变更!
12 小时前
鸡司令  ·  今天定投一笔,资产配置更合理
2 天前
中国基金报  ·  360亿龙头,冲刺港股IPO
2 天前
中国基金报  ·  新央企,总经理亮相
2 天前
中国基金报  ·  华为重回前十!
2 天前
水库论坛shuiku  ·  说说买房认怂~#X001
7 年前