转寄人: ZabraZoe (ZabraZoe)
标 题: deepseek:HW的384超节点性价比只有英伟达VR72超节点的1/3
发信站: 水木社区 (Wed Aug 12 10:40:26 2026)
来 源: 36.112.8.34
【以下内容由 ZabraZoe 转寄于 NewExpress 版】
标 题: deepseek:HW的384超节点性价比只有英伟达VR72超节点的1/3
发信站: 水木社区 (Wed Aug 12 10:40:26 2026)
来 源: 36.112.8.34
【以下内容由 ZabraZoe 转寄于 NewExpress 版】
以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。
所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。[upload=1][/upload][upload=1][/upload]
产能不够吧,产能上去了就便宜了
[upload=1][/upload][upload=2][/upload]
【 在 dangdangll 的大作中提到: 】
: 产能不够吧,产能上去了就便宜了
菊花看到你拿它和vr72比
笑都要笑醒了
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
还有一个运营成本的问题,5年电费?1.91 亿 vs ?7,510 万
原因还是先进制程不行。
【 在 dangdangll 的大作中提到: 】
: 产能不够吧,产能上去了就便宜了
[upload=1][/upload]
opencode 加收费的deepseek好用吗? 我现在用的免费的。
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
这个影响也挺大的
【 在 Engelberger 的大作中提到: 】
: 还有一个运营成本的问题,5年电费?1.91 亿 vs ?7,510 万
: 原因还是先进制程不行。
: [upload=1][/upload]
免费的要拿你的数据训练。
go套餐的deepseek如果只问答的话,基本上用不完,没必要用免费的。
虽然收费的也不一定不训练,重要数据最好不要上网。
【 在 bbsask 的大作中提到: 】
: opencode 加收费的deepseek好用吗? 我现在用的免费的。
两边的5年电费居然都要超过硬件成本。
所以提高芯片的能效比还挺重要的。
1GW的算力中心,5年电费是几千亿。
【 在 dangdangll 的大作中提到: 】
: 这个影响也挺大的
懂王团队非要给hw送钱
有什么办法
老黄拦都拦不住
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
这样啊,我还不知道免费的要拿我数据呢,deepseek 和GLM,哪个好用些?
【 在 Engelberger 的大作中提到: 】
: 免费的要拿你的数据训练。
: go套餐的deepseek如果只问答的话,基本上用不完,没必要用免费的。
: 虽然收费的也不一定不训练,重要数据最好不要上网。
这很正常,皮衣这么多年又不是白发展的
主要的技术指标差距还是单卡算力和带宽(访存+卡间),
华为堆了更多的卡,售价是英伟达超节点的2倍+,可能成本也是2倍+,性能大概在75%。
【 在 holy834 的大作中提到: 】
: 菊花看到你拿它和vr72比
: 笑都要笑醒了
没有数量级的差异已经很牛了,这玩意只要生态有了,赶起来来快的很,英伟达生生给自己培养了一个强大的对手
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
AI硬件其实越先进,性价比越高。国产模型的推理硬件成本是海外模型的3倍,意味着AI公司要赚钱更难。所以智谱、kimi的套餐很难买,而且套餐内价格很贵(比openai的gpt5.6套内价格贵很多)。
KIMI和qwen的最新打法是模型开源,但是云服务商年营收2000万以上分账。海外云服务商的硬件成本只有国内的三分之一,说白了就是和海外的云服务商分账。
【 在 hijack 的大作中提到: 】
: 懂王团队非要给hw送钱
: 有什么办法
: 老黄拦都拦不住
说的不都是废话?如果华为超节点的训练成本比英伟达的低,那AI算力领域还有英伟达什么事嘛。。。
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
deepseek v4 flash 0731比glm5.2好。
glm5.2是特化的编程模型,v4 0731水桶一些。
v4的有个致命伤是长上下文精确数字记不住,金融、工程、科学计算领域要谨慎使用。技术架构决定的,pro也改不了。等V5吧
【 在 bbsask 的大作中提到: 】
: 这样啊,我还不知道免费的要拿我数据呢,deepseek 和GLM,哪个好用些?
差距其实在半导体领域,半导体的生态起来还任重道远
【 在 matrass 的大作中提到: 】
: 没有数量级的差异已经很牛了,这玩意只要生态有了,赶起来来快的很,英伟达生生给自己培养了一个强大的对手
AMD的账面训推成本就比英伟达的低啊
【 在 rioz 的大作中提到: 】
: 说的不都是废话?如果华为超节点的训练成本比英伟达的低,那AI算力领域还有英伟达什么事嘛。。。
多谢指点,我是菜鸟,deepseek您买的什么套餐?
【 在 Engelberger 的大作中提到: 】
: deepseek v4 flash 0731比glm5.2好。
: glm5.2是特化的编程模型,v4 0731水桶一些。
: v4的有个致命伤是长上下文精确数字记不住,金融、工程、科学计算领域要谨慎使用。技术架构决定的,pro也改不了。等V5吧
上下文压缩太狠了
【 在 Engelberger 的大作中提到: 】
:deepseek v4 flash 0731比glm5.2好。:glm5.2是特化的编程模型,v4 0731水桶一些。
你懂不懂啊就在这瞎说,哪家大模型公司用amd的机架然后说成本比英伟达的低的?
【 在 Engelberger 的大作中提到: 】
: AMD的账面训推成本就比英伟达的低啊
根据Deepseek的搜索和计算
啥意思?
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
: 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。
: 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。
[upload=1][/upload]
【 在 bbsask 的大作中提到: 】
: 多谢指点,我是菜鸟,deepseek您买的什么套餐?
1/3 是很好的结果了
去年这时候 还远不是三分之一
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
: 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。
: 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。
抬手就是一个KV缓存4合1压缩,
其他环节还好,这个环节是个不可逆的信息损失。比如连续8个数字,压缩成2个数字,无论如何是要损失信息的。
【 在 NodeB 的大作中提到: 】
: 上下文压缩太狠了
: :deepseek v4 flash 0731比glm5.2好。:glm5.2是特化的编程模型,v4 0731水桶一些。
多谢!
我马上去看看
【 在 Engelberger 的大作中提到: 】
: [upload=1][/upload]
我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
: 以deepseek v4 flash为例,HW超节点生成速度约8,480token/s,英伟达超节点为10,924token/s,HW的prefill峰值为2.77M token/s,英伟达的是5.47M token/s。英伟达超节点的能效比也要强2~3倍。
: 所以开源模型要设置2000万以上分账的线,因为海外部署开源模型比国内部署更有利可图,KIMI,QWEN与其在国内采购超节点自己做推理,不如模型开源,让海外的算力商用英伟达的超节点部署,再去分账。
等hw芯片能力上去了
改个模型不是分分钟的事情
【 在 Engelberger 的大作中提到: 】
: 抬手就是一个KV缓存4合1压缩,
: 其他环节还好,这个环节是个不可逆的信息损失。比如连续8个数字,压缩成2个数字,无论如何是要损失信息的。
你复制粘贴给deepseek问一下
【 在 qyli 的大作中提到: 】
: 我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
学习了
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力
│ j ┊ 卖 ┊ 噗 ┊ 我 │
│ 3 ┊ 东 ┊ 傻 ┊ 怀 │
│ 5 ┊ 大 ┊ 吗 ┊ 疑 │
│ , ┊ , ┊ ? ┊ 你 │
│ 有 ┊ 性 ┊ f ┊ 是 │
│ 钱 ┊ 能 ┊ 3 ┊ 喷 │
│ 不 ┊ 也 ┊ 5 ┊ 子 │
│ 赚 ┊ 比 ┊ 战 ┊ , │
│ ┊ 不 ┊ 鸡 ┊ 特 │
│ ┊ 过 ┊ 不 ┊ 狼 │
【 在 qyli 的大作中提到: 】
: 我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
: 【 在 Engelberger 的大作中提到: 】
: : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: : 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
别反装忠,你只能自恨,为什么西大不卖给你,为什么被迫独立自主
【 在 qyli 的大作中提到: 】
: 我怀疑你在造谣,DeepSeek傻吗?又贵又差,还买?肯定是华为有不可替代的优势!
居然已经有1/3了
可喜可贺
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
某司的硬件就是贵,不过也正常,人家赚的就是垄断钱,不然前期投入收不回来。
【 在 Engelberger 的大作中提到: 】
: 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
: 根据Deepseek的搜索和计算,HW最新的超节点涨价到了1.2亿~1.5亿元,英伟达的超节点最新售价约5000~6000万元。
国外收费的AI也拿用户数据做训练。
【 在 Engelberger 的大作中提到: 】
: 免费的要拿你的数据训练。
: go套餐的deepseek如果只问答的话,基本上用不完,没必要用免费的。
: 虽然收费的也不一定不训练,重要数据最好不要上网。
[upload=1][/upload]
【 在 rioz 的大作中提到: 】
: 说的不都是废话?如果华为超节点的训练成本比英伟达的低,那AI算力领域还有英伟达什么事嘛。。。
拿昇腾910对比英伟达最新的Rubin,还只是1/3?英伟达吃屎的吧
华为是真牛逼,中已赢麻
【 在 holy834 的大作中提到: 】
: 菊花看到你拿它和vr72比
: 笑都要笑醒了
: 【 在 Engelberger 的大作中提到: 】
: : 以英伟达为例,算力设备经历了2020年A100,2022年H100,2024年B200/GB200,2025年B300/GB300,2026年VR72超节点几代演化,计算效率不断提升。2026年英伟达最新的是GPU+CPU+卡间通信混合的超节点VR72。
: : 国内厂商只有HW在推超节点,其他算力厂商还是英伟达2022年的思路,组8卡服务器。
你这电费是金子做的?
1GW即使满负荷运行,5年*8760小时也不过438亿度电
几千亿怎么花出去的
【 在 Engelberger 的大作中提到: 】
: 两边的5年电费居然都要超过硬件成本。
: 所以提高芯片的能效比还挺重要的。
: 1GW的算力中心,5年电费是几千亿。
flaredll