当前位置:首页 > 每日看点

因为DeepSeek事件, 美国可能会让英伟达将H20禁售 如何看待?

卡卷网2年前 (2025-02-02)每日看点427

果然懂这其中门道的人不多,但英伟达还是懂的

禁售H20不是针对训练的,是针对推理的

DeepSeek本来也不用H20做训练,他用的是H800做训练,H20就不是训练卡而是推理卡

现在的大模型因为参数量太大,还要支持长上下文和大Batch,对推理算力的需求是远远大过训练的。

DeepSeek具体怎么部署推理集群的方法也是在技术报告里提及了的,但是它只说了用了H800没说用了 H20。他也是采用了PD分离的技术方案,把推理里计算最集中的Prefilling和Decoding两个阶段分别部署到不同的设备上。一般来说,Prefilling阶段需要高算力,Decoding阶段需要大内存。所以Decoding阶段需要大显存低成本的卡。

这其中的大显存低成本的卡很可能就是H20,H20相比H100只有大约一半的价格。

DeepSeek反正训练需要的卡已经买到了,估计还有一些储备,以后扩大训练规模也是够用的,但是DeepSeek开源后必然会有很多人产生私有化部署DeepSeek模型的需求,那么就需要大量的推理算力,H100 H20都禁售可以大幅提高国内大模型的部署成本,推理成本拉高后,就可以抑制了DeepSeek的推广和普及,也变相拖慢了国内大模型应用落地的速度。

不过有个变数,就是910C,很可能华为的910C能填补这个生态位,这回真的要且听龙吟了。

扫描二维码推送至手机访问。

版权声明:本文由卡卷网发布,如需转载请注明出处。

本文链接:https://www.kajuan.net/ttnews/2025/02/10524.html

分享给朋友:

相关文章

请问什么软件支持看电视直播?

请问什么软件支持看电视直播?

2024年9月6日最新更新:本文列举的 所有看电视直播、或流媒体影视资源点播的软件,我这两天又重新梳理成最新版本,最大程度保证可用性。获取方式见文末图片,或见评论。后续我也将持续更新,文章是旧的软件也会是新的,保证你拿到的都是最新可用版本。…

PHP承载百万/天 访问量需要用到什么技术?

当年做一个百万PV的商城,也不过是两台2c4g的阿里云虚机罢了(其实一台就够,另外一台主要的逼着大家一定开发的时候一定要有负载均衡和横向扩容的意识)。当时框架还是Thinkphp3.2,框架提高运行效率的开关全打开,标准的lnmp模式,单机…

在 Kubernetes 中,Service 的实现原理是什么,它是如何实现服务发现的?

行,问的这个问题挺有意思,Kubernetes 里 Service 是怎么实现的,服务发现是怎么回事,咱就直说了。这事儿看起来挺玄乎,但掰开揉碎了讲,也就那么回事。你得把这事儿想得简单点,别一上来就被啥术语吓住了——其实全是些搬砖的套路。…

中国的科技为什么在最近2-3年时间像突然大爆发一样?

这个真的得感谢1998年美国在南联盟使馆投的两颗大炸弹。 在80年代中国下马了一千多个项目,用资金进口了近一百万辆小汽车。我记得小时候有一段时间从海南岛开往北方的漂亮日本小面包车,密集从村前公路上驶过,连过路的间隙都没有,就这样接连开了一个…

你怎么看待软件测试这个工作的?

你怎么看待软件测试这个工作的?

先说一个插曲:上个月我有同学在深圳被裁员了,和我一样都是 软件测试,不过他是平安外包,所以整个组都撤了,他工资和我差不多都是14K。现在IT互联网已经比较寒冬,特别是软件测试,裁员先裁测试,这几乎都是定律。我最近看了某音很多应届生以及去年毕…

为什么现在 AI 已经没啥热度了?

从改名叫大模型那一刻,懂行的就已经放弃了,剩下资本和无知网友还有点后劲 所谓大模型,本质就是一个更大、更快数据库的传声筒。更大更快本身确实很厉害,但依然只是传声筒,和AI根本不沾边 数据库之外仍然一无所知,甚至数据库之内的输出逻辑还要依赖大…

发表评论

访客

看不清,换一张

◎欢迎参与讨论,请在这里发表您的看法和观点。