0
0

估计美国那两大ai巨头上不了市了(合集转寄)

2026-08-05
2026-08-07
估计美国那两大ai巨头上不了市了(合集转寄)
转寄人: ZabraZoe (ZabraZoe)
标 题: 估计美国那两大ai巨头上不了市了
发信站: 水木社区 (Fri Aug 7 00:48:55 2026)
来 源: 120.245.107.123
【以下内容由 ZabraZoe 转寄于 NewExpress 版】
wjhtingerxca6140
Tue Aug 4 03:36:08 2026 · #1
shuimu0691shuimu0691
Tue Aug 4 06:45:22 2026 · #2
砸谁手里了?
superisaac宅男总动员
Tue Aug 4 06:47:24 2026 · #3
自从空叉上市美股就萎靡不振了,空叉有点像中石油
【 在 wjhtingerx 的大作中提到: 】
VNIπ= 3.14
Tue Aug 4 07:32:40 2026 · #4
看看这个
TexasPotato德州小土豆
Tue Aug 4 07:37:01 2026 · #5
Anthropic?还有谁?
【 在 wjhtingerx 的大作中提到: 】
antfinantfin
Tue Aug 4 07:39:39 2026 · #6
open AI?
【 在 TexasPotato 的大作中提到: 】 : Anthropic?还有谁? : 【 在 wjhtingerx 的大作中提到: 】 : FROM 116.128.189.* [上海 联通/IDC机房]
thinboyMeditation&Peace
Tue Aug 4 07:56:44 2026 · #7
现在这行情才是好时机吧 美国股市这么过热
【 在 wjhtingerx 的大作中提到: 】 : [upload][/upload]
texwoodapple小小凯
Tue Aug 4 08:00:36 2026 · #8
刚创新高怎么不行了,还是a股行?
【 在 superisaac 的大作中提到: 】 : 自从空叉上市美股就萎靡不振了,空叉有点像中石油
strongcat大馋猫
Tue Aug 4 09:15:19 2026 · #9
不要替资本家担心 美最终大概率留下三家 A, O, Google 美 1000万广义 IT人员 会被替代 500万; 前几天, OpenAI 新模型已经搞定了 多个 菲尔茨/图灵奖级别的 数学/算法难题 替代大学老师的进程马上启动,然后是医生,各种白领 保守替代 3000万人;资本家预期 年 5万亿刀级别的收益 所以这些AI 公司肯定会上市 最终 美很多人也都会被赶到 工厂 打螺丝
【 在 wjhtingerx 的大作中提到: 】
Engelbergermissing
Tue Aug 4 09:44:28 2026 · #10
但是大模型行业验证了一件事,其实去年初就验证了,deepseek r1用自己的大模型蒸馏出了几个小一两个数量级的小模型,发现小模型有大模型6—8成功力。很多人当时本地部署的就是蒸馏出的小模型。 此后,大模型后训练环节,就是SFT(探索方向和路径)+蒸馏(集成探索出来的能力)+RL(刷题让模型稳定输出,举一反三)。 大模型公司之间的基模底层架构差别很大,但是只要后训练是学了类似的东西,最后的结果就差不太多。就好比,不同的人,底层的思维习惯,方法论差别很大,但是只要刷足够的leetcode,都能编程。所以,后训练中,最贵,最难的事,变成了SFT,它需要探索新的路径。原创比模仿难多了。 有的公司进而想到,可以极致地降低基模的计算量,打造极致性价比模型,在后训练环节借助真实用例路由蒸馏编程数据。如deepseek v4,kv缓存先是只算四分之一,然后把k和v也合一,然后128个q头只有一个kv头,再然后这里面还只选然后一半的注意力层做这种极致简化的注意力计算,另一半要直接把kv除了128倍做计算。这种注意力机制,原理上在第一步,稍微超过128token滑动窗口后就该极其严重地损失精度,但是实践发现,后训练后编程还不错。 这就有点像,美国巨头可以研发新产品,义乌华强北山寨一个只要十分之一的成本。 只是deepseek发论文公开了架构和路线。其他家其实也可以这么干。 那么谁最傻呢?探索前沿的要花十倍代价,跟随的只用十分之一成本实现90%效果。而且这种蒸馏理论上就无法阻隔,fable5的反蒸馏机制扛不住灰测阶段的分散的真实用户用例,除非它自己因噎废食不对真实用户提供服务了。 openAI和Anthropic的商业模式,本质上就是花大钱,领先一小段时间,市值保不住了。
【 在 strongcat 的大作中提到: 】 : 不要替资本家担心 : 美最终大概率留下三家 A, O, Google : 美 1000万广义 IT人员 会被替代 500万;
epic大山子
Tue Aug 4 09:45:56 2026 · #11
国内那家也不咋的,收入二十来个亿,亏损五六个亿,估值四千多亿了,再投进去得人估计疯了
【 在 wjhtingerx 的大作中提到: 】
noocoo云淡风轻~
Tue Aug 4 09:51:06 2026 · #12
这俩不上市,这轮泡沫就崩的不彻底
【 在 wjhtingerx 的大作中提到: 】 : FROM 60.26.62.* [天津–红桥区 联通]
fulianzhuxi福利安诸喜
Tue Aug 4 09:53:59 2026 · #13
不可能
【 在 wjhtingerx 的大作中提到: 】 : [upload][/upload]
strongcat大馋猫
Tue Aug 4 09:57:44 2026 · #14
开源模型 ,跑跑分,评测还可以,创业公司,社区人员比较喜欢。 但训练的不充分 知识工程能力弱 幻觉都比较严重,企业级的应用还是不会用
【 在 Engelberger 的大作中提到: 】 : 但是大模型行业验证了一件事,其实去年初就验证了,deepseek r1用自己的大模型蒸馏出了几个小一两个数量级的小模型,发现小模型有大模型6—8成功力。很多人当时本地部署的就是蒸馏出的小模型。 : 此后,大模型后训练环节,就是SFT(探索方向和路径)+蒸馏(集成探索出来的能力)+RL(刷题让模型稳定输出,举一反三)。 : 大模型公司之间的基模底层架构差别很大,但是只要后训练是学了类似的东西,最后的结果就差不太多。就好比,不同的人,底层的思维习惯,方法论差别很大,但是只要刷足够的leetcode,都能编程。所以,后训练中,最贵,最难的事,变成了SFT,它需要探索新的路径。原创比模仿难多了。
Engelbergermissing
Tue Aug 4 10:13:43 2026 · #15
deepseek v4系列最过分的是,只有128token的滑动窗口做了完整计算,超出窗口就极致简化计算,排头就来个四合一。 精确数字四合一后直接永久丢失精度了,怎么也找不回来了。比如我需要129token之前的精确数字,v4系列怎么搞定? 我之前觉得这套不求精确,以最小成本把握大致逻辑的方式不适合工程和财务金融。结果3个月后训练,把编程能力拉起来了,这真挺让我吃惊的,蒸馏的作用居然这么大。 我现在觉得,预训练就像基础教育,蒸馏就像专业职业教育。二本生进北大学编程,照样能毕业。
【 在 strongcat 的大作中提到: 】 : 开源模型 ,跑跑分,评测还可以,创业公司,社区人员比较喜欢。 : 但训练的不充分 知识工程能力弱 幻觉都比较严重,企业级的应用还是不会用
hotfixhotfix
Tue Aug 4 10:23:32 2026 · #16
赞 专业
【 在 Engelberger 的大作中提到: 】 : deepseek v4系列最过分的是,只有128token的滑动窗口做了完整计算,超出窗口就极致简化计算,排头就来个四合一。 : 精确数字四合一后直接永久丢失精度了,怎么也找不回来了。比如我需要129token之前的精确数字,v4系列怎么搞定? : 我之前觉得这套不求精确,以最小成本把握大致逻辑的方式不适合工程和财务金融。结果3个月后训练,把编程能力拉起来了,这真挺让我吃惊的,蒸馏的作用居然这么大。 : 我现在觉得,预训练就像基础教育,蒸馏就像专业职业教育。二本生进北大学编程,照样能毕业。 : 【 在 strongcat 的大作中提到: 】
Engelbergermissing
Tue Aug 4 10:35:13 2026 · #17
相当于ai版的义乌和华强北,你只管创新,我只管压成本。 对用户来说,谁便宜用谁呗
【 在 hotfix 的大作中提到: 】 : 赞 专业
DLong德隆
Tue Aug 4 16:11:19 2026 · #18
我们呢 也逃不过资本家的镰刀吧
【 在 strongcat 的大作中提到: 】 : 不要替资本家担心 : 美最终大概率留下三家 A, O, Google : 美 1000万广义 IT人员 会被替代 500万;
rockeyes*^*-*~*
Tue Aug 4 16:15:51 2026 · #19
马斯克兵贵神速
【 在 superisaac 的大作中提到: 】 : 自从空叉上市美股就萎靡不振了,空叉有点像中石油 : 【 在 wjhtingerx 的大作中提到: 】 : FROM 120.244.162.* [北京 移动]
giggswyRyan
Tue Aug 4 16:44:58 2026 · #20
投资人已经投进去了
【 在 wjhtingerx 的大作中提到: 】
happysuccess春天里会跑会飞的一棵树
Tue Aug 4 16:53:38 2026 · #21
这么长能发出来,厉害了
【 在 Engelberger 的大作中提到: 】 : 但是大模型行业验证了一件事,其实去年初就验证了,deepseek r1用自己的大模型蒸馏出了几个小一两个数量级的小模型,发现小模型有大模型6—8成功力。很多人当时本地部署的就是蒸馏出的小模型。 : 此后,大模型后训练环节,就是SFT(探索方向和路径)+蒸馏(集成探索出来的能力)+RL(刷题让模型稳定输出,举一反三)。 : 大模型公司之间的基模底层架构差别很大,但是只要后训练是学了类似的东西,最后的结果就差不太多。就好比,不同的人,底层的思维习惯,方法论差别很大,但是只要刷足够的leetcode,都能编程。所以,后训练中,最贵,最难的事,变成了SFT,它需要探索新的路径。原创比模仿难多了。
qgg天天~天天天蓝
Wed Aug 5 02:20:56 2026 · #22
这一两月中国AI把老美闹麻了吧,GLM,KIMI,Deepseek,Seedance,千问,Minimax一个接一个,刚缓口气,GLM新版又要来了
【 在 wjhtingerx 的大作中提到: 】
zyf674逼夯宝
Wed Aug 5 02:26:35 2026 · #23
惨惨惨,丑国日薄西山命不久矣
【 在 qgg 的大作中提到: 】 : 标 题: Re: 估计美国那两大ai巨头上不了市了 : 发信站: 水木社区 (Wed Aug 5 02:20:56 2026), 站内 : 这一两月中国AI把老美闹麻了吧,GLM,KIMI,Deepseek,Seedance,千问,Minimax一个接一个,刚缓口气,GLM新版又要来了 : 【 在 wjhtingerx 的大作中提到: 】 : 宁静的祈祷 : --尼布尔 (1892-1971) : 我的上帝,请赐我平静,去接受我不能改变的一切 : 赐我勇气,去改变我所能改变的一切 : 赐我智慧,去分辨两者的不同 : ※ 修改:·qgg 于 Aug 5 02:22:13 2026 修改本文·[FROM: 61.48.148.*] : ※ 来源:·水木社区 mysmth.net·[FROM: 61.48.148.*]
qgg天天~天天天蓝
Wed Aug 5 02:31:34 2026 · #24
哪里哪里,只是些没有原创性的不入流的随机鹦鹉形蒸点,新罗马必定千Q万代一统江湖
【 在 zyf674 的大作中提到: 】 : 惨惨惨,丑国日薄西山命不久矣