当前位置:首页 > 每日看点 > 正文内容

什么配置能本地部署并运行满血671B的DeepSeek-R1?

卡卷网1年前 (2025-02-18)每日看点282

请理解“满血”的含义:在8位精度下运行6710亿参数量的大模型。

有一个最保守的公式来计算内存用量:

M = (P x 4) / (32 / Q) x 1.2

M是所需内存(GiB),P是模型参数量(1B计量),Q是精度位数。算上模型副本、上下文等额外开销,再粗略地乘1.2考虑进去。

则,在Q8下需要805.2 GiB内存;

在Q4下需要402.6 GiB内存

若你使用GPU推理:

80G显存单卡(A100/A800/H100/H800/…)对应服务器台数48G显存单卡(L40/6000 Ada/A6000/…)对应服务器台数24G显存单卡(4090/5090/…)对应服务器台数
Q8精度(冗余考虑)2台8卡服务器3台8卡服务器5台8卡服务器
Q8精度1台8卡服务器+1台4卡服务器2台8卡服务器+1台4卡服务器4台8卡服务器+1台4卡服务器
Q4精度1台6卡服务器1台8卡服务器+1台2卡服务器3台8卡服务器

若你使用CPU推理:

跑Q8至少需要双路EPYC 9004/9005+1T内存的服务器1台。

Q4同理,改变内存即可。

由于内存带宽瓶颈或CPU并行算力弱,跑这个量级的LLM不会有任何冗余算力空间,推理速度也慢,而且你如果敢用CPU搞微调和训练……基本无法使用。

你要认真的话,我稍微查了下价格,最划算的当属8卡L40服务器,在某东一台仅需35万~40万,单卡算力比肩4090,性价比远高于8卡A100/A800(150万+)。当然,你如果需要全流程的预训练+迭代+调优+……,这种L40/A6000大规模训练会受通信带宽影响,你要来真的,还得是A100/H100。

至于微调需求(我理解的题干所描述“专项训练”),使用LoRA微调方法的显存需求量和推理差不多,全参数微调则需6~10倍的推理显存需量。


紧急补充:

评论区又有老哥指出:

刚刚诞生的开源项目Ktransformer可以提供非常低的推理成本,链接:github.com/kvcache-ai/k

我在b站找到了一个教程视频:b23.tv/Eq30UrG

简单来讲,利用deepseek的多专家机制,把回答问题刚需的专家拽到GPU里,别的专家缓存在内存里代替巨量显存占用。如此就能用一块GPU+大容量RAM+CPU混动实现超低成本推理。

如果题主只有推理部署需求,不搞微调,强烈建议此全新方案。届时可以用双路9005/5代铂金+1T内存+一块专业显卡来完成推理任务。


我的最新文章整合了各种预算方案,各位可以看看,字数虽少但看点丰富:

YangWannaSleep:盘点本地部署满血deepseek-r1的各种硬件配置方案 #1

扫描二维码推送至手机访问。

版权声明:本文由卡卷网发布,如需转载请注明出处。

本文链接:https://www.kajuan.net/ttnews/2025/02/10754.html

分享给朋友:

相关文章

有了Istio,开发还需要微服务架构吗?

有了Istio,开发还需要微服务架构吗?

Istio 是一个开源的服务网格(Service Mesh),通过它可以实现对服务间通信的管理和监控。对于那些本身没有设计为具备安全功能的传统应用程序,Istio 可以提供一个“透明”的安全保护层,而不需要对应用本身进行任何代码修改。 I...

PS有哪些实用小技巧,小白也能一学就会?

PS有哪些实用小技巧,小白也能一学就会?

不看后悔系列!本篇分享25个PS实用的技巧!不能保证每个都能让你惊艳,但是却是我用心写出来的,希望对你有帮助。另外我的知乎也写了接近200篇PS的技巧,超级合集分享!我目前正在带一个PS/Ai的软件训练营,两个多月搞定两大软件的学习详细的内...

手机用久了,垃圾都在哪里,总是内存显示不够,还很卡,这可怎么解决?

手机用久了,垃圾都在哪里,总是内存显示不够,还很卡,这可怎么解决?

大家的手机在使用一段时间之后啊,是不是都会出现又卡又慢的情况,尤其是安卓手机,这种现象更是非常明显,而且很多朋友啊,也都知道手机之所以会出现这些问题,一般都是手机安装了大量软件,而这些软件在使用过程中会产生大量的缓存垃圾,因此啊时间久了就会...

网易云音乐里有哪些打动你的评论?

1.“如果我被强奸了,有人说我会失去贞操。”“我怎么失去贞操了呢?” “我的贞操不在我的阴道里。”“失去贞操的是强奸犯,而不是被强奸的人。”2.但要记得那年海边的烟火,我们不拘一格 ,嘲笑过生活。………网易云热评《这样就很好》3.“ 我们在...

开发了个小程序,咋推广呢?

要是开发了个小程序,想推广的话,可以先从自己的朋友圈子下手,让亲戚朋友都帮忙转发宣传,这样能先有点人气。然后去一些跟你的小程序相关的论坛、社区啥的,发帖子介绍介绍,吸引有兴趣的人。还能找些网红、博主合作,要是他们觉得你的小程序不错,帮忙推荐...

为什么有人觉得华为mate60只值2000?

为什么有人觉得华为mate60只值2000?

你以为买Mate60的人真的傻?真的那么爱国?国庆前,我家那傻子加价800多买了一台Mate60,当时还被我骂他是傻子。可是他说一回到公司就被老板同事朋友看到,拿去反复查看,都在惊叹他这么快就买到新机。跟亲戚朋友聚会,别人一看就知道他买的是...

发表评论

访客

看不清,换一张

◎欢迎参与讨论,请在这里发表您的看法和观点。