您的当前位置:首页>科技咨询>资讯详情

DeepSeek,最新发布!

发表于:2025-02-27 14:00:03 浏览:19次 发布者: 网易互联网


【导读】DeepSeek宣布开源Optimized Parallelism Strategies

中国基金报记者 忆山

2月27日,在“开源周”第四日,DeepSeek宣布开源Optimized Parallelism Strategies。

Optimized Parallelism Strategies主要针对大规模模型训练中的效率问题。其特点包括:混合并行策略,在减少通信开销的同时最大化GPU利用率;通过梯度压缩、异步通信、通信-计算重叠等技术降低节点间通信延迟;根据硬件拓扑和模型结构自动推荐并行策略,减少手动调参成本等。


2月21日,DeepSeek宣布,从2月24日起将开源5个代码库,以完全透明的方式与全球开发者社区分享他们的研究进展。并将这一计划命名为“开源周”。

DeepSeek称,即将开源的代码库是其在线服务中的基础组件,且都经过了详细记录、部署和实战测试。

2月24日,DeepSeek首个开源的项目是FlashMLA。FlashMLA是DeepSeek用于Hopper GPU的高效MLA解码内核,并针对可变长度序列进行了优化,现已投入生产。

2月25日,DeepSeek宣布开源DeepEP,即首个用于MoE模型训练和推理的开源EP通信库。其特点包括:高效且优化的全对全通信,通过NVLink和RDMA支持节点内和节点间的通信,用于训练和推理预填充的高吞吐量内核,用于推理解码的低延迟内核,原生FP8调度支持,灵活的GPU资源控制,用于计算通信重叠。

2月26日,DeepSeek宣布开源DeepGEMM。其特点包括:同时支持密集布局和两种MoE布局,完全即时编译,可为V3/R1模型的训练和推理提供强大支持等。

此外,在2月6日宣布暂停API服务充值后,2月25日,DeepSeek宣布重新开放API充值。2月26日晚间,DeepSeek又宣布推出错峰优惠活动,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek-V3降至原价的50%,DeepSeek-R1降至原价的25%。

DeepSeek称,鼓励用户充分利用这一时段,享受更经济、更流畅的服务体验。

QuestMobile数据显示,上线以来至2月9日,DeepSeek App的累计下载量已超1.1亿次,周活跃用户规模最高近9700万个。

编辑:赵新亮

校对: 王玥

制作: 黄梅

审核:许闻

版权声明

《中国基金报》对本平台所刊载的原创内容享有著作权,未经授权禁止转载,否则将追究法律责任。

授权转载合作联系人:于先生(电话:0755-82468670)

猜你喜欢

无需Attention的未来,RWKV-7能成为替代Transfo
无需Attention的未来,RWKV-7能成为替代Transfo
发表于:2025-03-26 浏览:15 发布者: 网易互联网
OpenAI:向免费用户推出GPT-4o mini驱动的高级
OpenAI:向免费用户推出GPT-4o mini驱动的高级
发表于:2025-02-27 浏览:21 发布者: 网易互联网
Meta(META.US)收购语音初创公司PlayAI 加码布局
Meta(META.US)收购语音初创公司PlayAI 加码布局
发表于:2025-07-14 浏览:8 发布者: 网易科技
深蓝S09正式上市交付:售价23.99万元起
深蓝S09正式上市交付:售价23.99万元起
发表于:2025-05-23 浏览:16 发布者: 网易IT
大厂混战“AI智能体”,生态之争暗流涌动
大厂混战“AI智能体”,生态之争暗流涌动
发表于:2025-03-20 浏览:21 发布者: 网易科技
独家丨阿里云新财年渠道政策:季度续费率被取消
独家丨阿里云新财年渠道政策:季度续费率被取消
发表于:2025-04-24 浏览:13 发布者: 网易互联网
微软和OpenAI,是如何渐行渐远的?
微软和OpenAI,是如何渐行渐远的?
发表于:2025-03-08 浏览:17 发布者: 网易互联网
DeepSeek抢镜巨头财报会!微软:有真创新且R1上
DeepSeek抢镜巨头财报会!微软:有真创新且R1上
发表于:2025-01-30 浏览:32 发布者: 网易科技
“推特蓝鸟”拍卖价约为3.5万美元
“推特蓝鸟”拍卖价约为3.5万美元
发表于:2025-03-22 浏览:21 发布者: 网易互联网
京东618利商服务再升级:商家保费降幅最高超90%
京东618利商服务再升级:商家保费降幅最高超90%
发表于:2025-05-20 浏览:13 发布者: 网易互联网