0
0

deepseek:HW的384超节点性价比只有英伟达VR72超节点的1/3(合集转寄)

2026-08-10
2026-08-13
deepseek:HW的384超节点性价比只有英伟达VR72超节点的1/3(合集转寄)
转寄人: ZabraZoe (ZabraZoe)
标 题: deepseek:HW的384超节点性价比只有英伟达VR72超节点的1/3
发信站: 水木社区 (Wed Aug 12 10:40:26 2026)
来 源: 36.112.8.34
【以下内容由 ZabraZoe 转寄于 NewExpress 版】
Engelbergermissing
Mon Aug 10 13:39:09 2026 · #1
以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。[upload=1][/upload][upload=1][/upload]
dangdangll浑沌
Mon Aug 10 13:40:37 2026 · #2
产能不够吧,产能上去了就便宜了
Engelbergermissing
Mon Aug 10 13:45:53 2026 · #3
[upload=1][/upload][upload=2][/upload]
【 在 dangdangll 的大作中提到: 】 : 产能不够吧,产能上去了就便宜了
holy834IDA
Mon Aug 10 13:49:38 2026 · #4
菊花看到你拿它和vr72比 笑都要笑醒了
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
Engelbergermissing
Mon Aug 10 13:49:49 2026 · #5
还有一个运营成本的问题,5年电费?1.91 亿 vs ?7,510 万 原因还是先进制程不行。
【 在 dangdangll 的大作中提到: 】 : 产能不够吧,产能上去了就便宜了 [upload=1][/upload]
bbsaskbbsask
Mon Aug 10 13:52:27 2026 · #6
opencode 加收费的deepseek好用吗? 我现在用的免费的。
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
dangdangll浑沌
Mon Aug 10 13:54:27 2026 · #7
这个影响也挺大的
【 在 Engelberger 的大作中提到: 】 : 还有一个运营成本的问题,5年电费?1.91 亿 vs ?7,510 万 : 原因还是先进制程不行。 : [upload=1][/upload]
Engelbergermissing
Mon Aug 10 13:54:31 2026 · #8
免费的要拿你的数据训练。 go套餐的deepseek如果只问答的话,基本上用不完,没必要用免费的。 虽然收费的也不一定不训练,重要数据最好不要上网。
【 在 bbsask 的大作中提到: 】 : opencode 加收费的deepseek好用吗? 我现在用的免费的。
Engelbergermissing
Mon Aug 10 13:55:52 2026 · #9
两边的5年电费居然都要超过硬件成本。 所以提高芯片的能效比还挺重要的。 1GW的算力中心,5年电费是几千亿。
【 在 dangdangll 的大作中提到: 】 : 这个影响也挺大的
hijackjack
Mon Aug 10 13:57:47 2026 · #10
懂王团队非要给hw送钱 有什么办法 老黄拦都拦不住
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
bbsaskbbsask
Mon Aug 10 13:58:28 2026 · #11
这样啊,我还不知道免费的要拿我数据呢,deepseek 和GLM,哪个好用些?
【 在 Engelberger 的大作中提到: 】 : 免费的要拿你的数据训练。 : go套餐的deepseek如果只问答的话,基本上用不完,没必要用免费的。 : 虽然收费的也不一定不训练,重要数据最好不要上网。
timeleapタイムリープぱらだいす
Mon Aug 10 13:58:43 2026 · #12
这很正常,皮衣这么多年又不是白发展的
Engelbergermissing
Mon Aug 10 13:59:29 2026 · #13
主要的技术指标差距还是单卡算力和带宽(访存+卡间), 华为堆了更多的卡,售价是英伟达超节点的2倍+,可能成本也是2倍+,性能大概在75%。
【 在 holy834 的大作中提到: 】 : 菊花看到你拿它和vr72比 : 笑都要笑醒了
matrassmatrass
Mon Aug 10 14:00:28 2026 · #14
没有数量级的差异已经很牛了,这玩意只要生态有了,赶起来来快的很,英伟达生生给自己培养了一个强大的对手
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
Engelbergermissing
Mon Aug 10 14:02:53 2026 · #15
AI硬件其实越先进,性价比越高。国产模型的推理硬件成本是海外模型的3倍,意味着AI公司要赚钱更难。所以智谱、kimi的套餐很难买,而且套餐内价格很贵(比openai的gpt5.6套内价格贵很多)。 KIMI和qwen的最新打法是模型开源,但是云服务商年营收2000万以上分账。海外云服务商的硬件成本只有国内的三分之一,说白了就是和海外的云服务商分账。
【 在 hijack 的大作中提到: 】 : 懂王团队非要给hw送钱 : 有什么办法 : 老黄拦都拦不住
riozBrasil 2010 & 2014
Mon Aug 10 14:03:02 2026 · #16
说的不都是废话?如果华为超节点的训练成本比英伟达的低,那AI算力领域还有英伟达什么事嘛。。。
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
Engelbergermissing
Mon Aug 10 14:04:40 2026 · #17
deepseek v4 flash 0731比glm5.2好。 glm5.2是特化的编程模型,v4 0731水桶一些。 v4的有个致命伤是长上下文精确数字记不住,金融、工程、科学计算领域要谨慎使用。技术架构决定的,pro也改不了。等V5吧
【 在 bbsask 的大作中提到: 】 : 这样啊,我还不知道免费的要拿我数据呢,deepseek 和GLM,哪个好用些?
Engelbergermissing
Mon Aug 10 14:09:38 2026 · #18
差距其实在半导体领域,半导体的生态起来还任重道远
【 在 matrass 的大作中提到: 】 : 没有数量级的差异已经很牛了,这玩意只要生态有了,赶起来来快的很,英伟达生生给自己培养了一个强大的对手
Engelbergermissing
Mon Aug 10 14:10:30 2026 · #19
AMD的账面训推成本就比英伟达的低啊
【 在 rioz 的大作中提到: 】 : 说的不都是废话?如果华为超节点的训练成本比英伟达的低,那AI算力领域还有英伟达什么事嘛。。。
bbsaskbbsask
Mon Aug 10 14:12:46 2026 · #20
多谢指点,我是菜鸟,deepseek您买的什么套餐?
【 在 Engelberger 的大作中提到: 】 : deepseek v4 flash 0731比glm5.2好。 : glm5.2是特化的编程模型,v4 0731水桶一些。 : v4的有个致命伤是长上下文精确数字记不住,金融、工程、科学计算领域要谨慎使用。技术架构决定的,pro也改不了。等V5吧
NodeBjj
Mon Aug 10 14:14:46 2026 · #21
上下文压缩太狠了
【 在 Engelberger 的大作中提到: 】 :deepseek v4 flash 0731比glm5.2好。:glm5.2是特化的编程模型,v4 0731水桶一些。
riozBrasil 2010 & 2014
Mon Aug 10 14:15:08 2026 · #22
你懂不懂啊就在这瞎说,哪家大模型公司用amd的机架然后说成本比英伟达的低的?
【 在 Engelberger 的大作中提到: 】 : AMD的账面训推成本就比英伟达的低啊
rockeyes*^*-*~*
Mon Aug 10 14:17:02 2026 · #23
根据Deepseek的搜索和计算 啥意思?
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。 : 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。 : 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。
Engelbergermissing
Mon Aug 10 14:17:11 2026 · #24
[upload=1][/upload]
【 在 bbsask 的大作中提到: 】 : 多谢指点,我是菜鸟,deepseek您买的什么套餐?
zhangcxvbv
Mon Aug 10 14:18:13 2026 · #25
1/3 是很好的结果了 去年这时候 还远不是三分之一
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。 : 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。 : 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。
Engelbergermissing
Mon Aug 10 14:18:39 2026 · #26
抬手就是一个KV缓存4合1压缩, 其他环节还好,这个环节是个不可逆的信息损失。比如连续8个数字,压缩成2个数字,无论如何是要损失信息的。
【 在 NodeB 的大作中提到: 】 : 上下文压缩太狠了 : :deepseek v4 flash 0731比glm5.2好。:glm5.2是特化的编程模型,v4 0731水桶一些。
bbsaskbbsask
Mon Aug 10 14:22:50 2026 · #27
多谢! 我马上去看看
【 在 Engelberger 的大作中提到: 】 : [upload=1][/upload]
qyli泾渭漳淮
Mon Aug 10 14:40:37 2026 · #28
我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。 : 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。 : 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。
hijackjack
Mon Aug 10 14:52:39 2026 · #29
等hw芯片能力上去了 改个模型不是分分钟的事情
【 在 Engelberger 的大作中提到: 】 : 抬手就是一个KV缓存4合1压缩, : 其他环节还好,这个环节是个不可逆的信息损失。比如连续8个数字,压缩成2个数字,无论如何是要损失信息的。
Engelbergermissing
Mon Aug 10 14:55:31 2026 · #30
你复制粘贴给deepseek问一下
【 在 qyli 的大作中提到: 】 : 我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
stanley668路路酒吧
Mon Aug 10 15:11:59 2026 · #31
学习了
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力
lomozm劳模宅男
Mon Aug 10 18:11:02 2026 · #32
│ j ┊ 卖 ┊ 噗 ┊ 我 │ │ 3 ┊ 东 ┊ 傻 ┊ 怀 │ │ 5 ┊ 大 ┊ 吗 ┊ 疑 │ │ , ┊ , ┊ ? ┊ 你 │ │ 有 ┊ 性 ┊ f ┊ 是 │ │ 钱 ┊ 能 ┊ 3 ┊ 喷 │ │ 不 ┊ 也 ┊ 5 ┊ 子 │ │ 赚 ┊ 比 ┊ 战 ┊ , │ │   ┊ 不 ┊ 鸡 ┊ 特 │ │   ┊ 过 ┊ 不 ┊ 狼 │
【 在 qyli 的大作中提到: 】 : 我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势! : 【 在 Engelberger 的大作中提到: 】 : : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
LordTodLordTod
Mon Aug 10 18:16:07 2026 · #33
别反装忠,你只能自恨,为什么西大不卖给你,为什么被迫独立自主
【 在 qyli 的大作中提到: 】 : 我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
UCIUC Irvine
Mon Aug 10 18:16:50 2026 · #34
居然已经有1/3了 可喜可贺
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
zszqzzz早睡早起
Mon Aug 10 18:56:37 2026 · #35
某司的硬件就是贵,不过也正常,人家赚的就是垄断钱,不然前期投入收不回来。
【 在 Engelberger 的大作中提到: 】 : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。 : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
HANNINGWINDOWADD
Mon Aug 10 19:26:42 2026 · #36
国外收费的AI也拿用户数据做训练。
【 在 Engelberger 的大作中提到: 】 : 免费的要拿你的数据训练。 : go套餐的deepseek如果只问答的话,基本上用不完,没必要用免费的。 : 虽然收费的也不一定不训练,重要数据最好不要上网。
HANNINGWINDOWADD
Mon Aug 10 19:38:49 2026 · #37
[upload=1][/upload]
【 在 rioz 的大作中提到: 】 : 说的不都是废话?如果华为超节点的训练成本比英伟达的低,那AI算力领域还有英伟达什么事嘛。。。
flaredll玄黄
Mon Aug 10 21:00:23 2026 · #38
拿昇腾910对比英伟达最新的Rubin,还只是1/3?英伟达吃屎的吧 华为是真牛逼,中已赢麻
【 在 holy834 的大作中提到: 】 : 菊花看到你拿它和vr72比 : 笑都要笑醒了 : 【 在 Engelberger 的大作中提到: 】 : : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。 : : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
oldmonk沙洲地青
Mon Aug 10 21:37:19 2026 · #39
你这电费是金子做的? 1GW即使满负荷运行,5年*8760小时也不过438亿度电 几千亿怎么花出去的
【 在 Engelberger 的大作中提到: 】 : 两边的5年电费居然都要超过硬件成本。 : 所以提高芯片的能效比还挺重要的。 : 1GW的算力中心,5年电费是几千亿。 flaredll