专栏名称: 中国证券报
《中国证券报》是新华通讯社主办的全国性证券专业日报,是证监会、保监会、银监会指定的信息披露报纸。
目录
相关文章推荐
中国证券报  ·  资金转向!什么信号? ·  昨天  
证券时报  ·  利好!深圳发布“创业大礼包” ·  昨天  
上海证券报  ·  全国政协会议议程来了! ·  3 天前  
上海证券报  ·  17.5亿元!加码核聚变 ·  3 天前  
51好读  ›  专栏  ›  中国证券报

DeepSeek最新发声

中国证券报  · 公众号  · 证券  · 2025-03-01 22:59

正文

图片

3月1日,DeepSeek在知乎官方账号发布题为《DeepSeek-V3/R1推理系统概览》的文章。

文章披露了DeepSeek-V3/R1推理系统采用大规模跨节点专家并行(EP)技术来实现更大的吞吐和更低的延迟。为提升整个系统效率和GPU利用率,DeepSeek尽可能地为每个GPU分配均衡的计算负载、通信负载。

文章还披露了DeepSeek的成本、利润等关键信息。

DeepSeek-V3和R1的所有服务均使用H800 GPU。由于服务负荷白天高、晚上低,DeepSeek实现一套机制,在白天负荷高的时候用所有节点部署推理服务,晚上负荷低的时候减少推理节点。

2月27日至2月28日的24个小时内,DeepSeek-V3和R1推理服务占用节点总和,峰值占用为278个节点,平均占用226.75个节点(每个节点为8个H800 GPU)。假定GPU租赁成本为2美元/小时,总成本为87072美元/天。

若所有tokens的输入和输出全部按照DeepSeek R1的定价计算,理论上DeepSeek一天的总收入为562027美元,成本利润率高达545%。不过,由于DeepSeek-V3定价低于R1,且网页端和应用程序免费,仅部分服务产生收入,再加上非高峰时段设有夜间折扣,其实际收入不及理论数值。

2月26日,DeepSeek在官网宣布,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek开放平台推出错峰优惠活动。在此期间,API调用价格大幅下调:DeepSeek-V3降至原价的50%,DeepSeek-R1更是低至25%。DeepSeek称,鼓励用户充分利用这一时段享受更经济更流畅的服务体验。

“DeepSeek开源周”自2月24日启动,期间DeepSeek陆续开源了众多最新技术进展,包括FlashMLA、DeepEP、DeepGEMM和3FS四个开源项目以及DualPipe、EPLB等代码库。这些开源成果在业内引发了热烈讨论。




图片

推荐阅读







请到「今天看啥」查看全文


推荐文章
中国证券报  ·  资金转向!什么信号?
昨天
证券时报  ·  利好!深圳发布“创业大礼包”
昨天
上海证券报  ·  全国政协会议议程来了!
3 天前
上海证券报  ·  17.5亿元!加码核聚变
3 天前
知心  ·  转身还有你在,就够了
7 年前
互联网分析沙龙  ·  后厂村,没有姑娘
7 年前