本字幕由TME AI技术生成
用声音碰撞世界
生动活泼
与全球创新第一时间同步
这里是科技早知道
Deep tag 深科技系列
我是雅贤
欢迎跟我一起探索最新最前沿的硬核科技
Hello
大家好
欢迎来到我们今天的节目
我是雅贤
那不知道我们to 里头最近有没有想要换手机的
不知道大家有没有发现啊
同等配置的手机现在卖的是更贵了
或者呢
是想要的机型现在根本没货
那根据统计
二零二五年全球智能手机的出货量是减降了百分之十三
产产电脑出货量量也减少了了分之十
那产产品的价格也有不同程度的上调
那核心的原因呢
就是因为内存芯片不够用了
那内存去哪了呢
答案就是被ai 之度了
没错
存储芯片领域正在经历着一场前所未有的大迁徙
生产线呢
是从消费电子转向了ai 服务器
Theis a world by 报
那韩国存储厂商shortas k 海力士前不久是交出了一份s 国震撼的第一季度报啊
他们的利润率高达百分之七十二
超过了很多奢侈品业的利润率
那他们前三个月赚的钱已经是超过了过去一整年
同样的
另一家存储厂商三星第一季度利润也同比暴增了八倍
那尽管内存价格在过去的一年里头已经翻了不止一倍
但是有限的内存供给依然无法满足疯狂扩张的ai 算力需求
那毫不夸张的说
最近一个月存储板块股价的飙升
成为了引领美股科技股创下历史新高的核心力量
Scientic of more than twenty three percent western dicdidicten ty ten hhf perpercent day ten and seven percent
在热闹背后呢
也隐藏着质疑与恐慌
那存储这个行业是出了名的有非常强的周期性
那涨得有多猛呢
跌起强的周期惨
过去的四十年
存储芯片价格在一个周期内暴涨十倍又暴跌百分之九十的情况是屡见不鲜
存储厂商在行业低谷时疯狂扩局的案例呢
也是比比皆是
所以我们今天想要问的问题是
存储行业为什么现在这个时刻如此火爆
那上行的周期究竟能持续多久
还有
这次的繁荣真的不一样了吗
我们今天的嘉宾呢
就是前半导体行业的从业者
也是半导体公众号富利业的猫的主理人张海军
Hello
海军老师
先给大家打个招呼吧
哎 大家好
我是张海军
之前是在新思做资深工程师
然后去年呢
跟朋友也是在从事ma 服务器的分销工作
嗯嗯
我不知道从你的个人感受来讲
你是从什么时候感觉到这个存储周期的爆发的
到去年q 二末尾q 三开始的时候可能大家才注意到
因为当时很多卖方分析师才开始讲存储交易周期
但是当大家如果去看现货价格的话
就会发现
其实在去年q 一的时候就已经看出来
在去年四月份的时候呢
三星海力士就宣布布停产ddds
然后把它转向利润更高的ddr 五和其他品品
这个之间呢
是比市场的预期要早很多的
但是呢
由于当时很多设备它还是需要使用dds 的
所以呢
整个市场就感到恐慌
然后开始囤货
然后就直接导致dds 的现货价格就翻倍了
甚至赶上或者超过了ddr
到到后面面比如qq 三之后呢
然后整个ai 对存储的需求就上来
然后在去年同期的时候呢
还有一个原因就是关税
就是很多商家他怕政策的变动
所以呢
他们也倾向于去提前囤一些存储的这个产品
呃
应该是供给的紧张
加上ai 需求的拉动
还有整个这个地缘政治的影响
就让这这轮这个存储芯片的周期就到来了
对是对
然后我想这个请海军给我们介绍一下
就是说在一个数据中心里头
呃
存储是起到一个什么样的作用
它扮演一些什么样的角色啊
可以的
就是就当前的话
存储是有五层架构的
就是这个架构呢
可能以后会增或减
但是目前最主流的就是这五层
然后总的规律就是说离处理器
这个处理器呢
就是指gpu 或者cpu
离处理器越近
那它的带宽就越大
速率越高
但是价格越贵
那离处理器越近
它的单位存储储价格就越便宜越
但是它的带宽就越低
就是从处理器访问这个存储的延时越大
然后这五层呢
就是可以这样分
第一层呢
就是片上的rn
其实这一层就是相当于我们电脑就是我们pc 的缓存
是属于处理器的一部分
然后它的容量当然当然都不大
然后第二部分就是最近两年年特别火的啥高带宽内存hbm
呃 对
然后这个呢
就是 呃
这个显存嘛
但是需要注意的就是我们所使用的桌面级的这个呃
Gpu
它所使用的显存并不是hbm
而是使用的gd 点
对
然后第三层就是d ram
就是我们平时比如电脑里面你使用八g 十六g 内存
就是就这一块啊
然后第四级跟第五级就属于硬盘了
对
然后第四级呢
就是由nand 闪存组成的固态硬盘
然后这一块呢
我们后面也会做一个详细的这个讲解
就是因为我觉得nand 的身份现在在ai agent 到来之后
它的身份发生了变化
对
然后第五级就是传传统的机械硬盘
对
然后这里呢
我们要再多解释一下就关内存强的这个概念
对
这个概念是因为啥呢
是因为现在整个ai 芯片的速率跑太快
就是算力跑的非常快很很快啊
但是呢
这个ai 芯片它需要等数据送过来再处理啊
呃
送数据的这个速率太慢
那导致处理器在等待数据
然后就会影响到整个系统的处理效率
就大家如果去看海外
比如像像nv 和谷歌他们的最新的嗯
方案的话
可以看到就是他们其实在
嗯
处理器的算力提升方面
其实它的升级并不是很大
就是比如说谷歌它前两周出的那个tpuv 八嘛
Tpuv 八是分为八t 和八i
那它的v 八相对v 七来说
它的算力提升其实并不大
它的主要提升能力是在哪呢
是在它整个系统的互联
就它的网络互联这一块提升非常大的
其实这也是目前这些大厂都在解决的问题
就是它觉得它的芯片的处理速度已经够了
但是呢
是就是处理器之间的互联
以及处理器跟存储之间的这个延时或带宽
那是这一部分反而是成了整个系统的瓶颈
对
所以他们都在想办法去提升这一块
所以不管你的处理器再强
如果你的存储跟不上
以及这个存储和处理器这些传输的带宽跟不上的话
你再强也没有用
对 是的啊
因为我觉得我们从
呃
感受这个ai 的崛起
可能从二三年就已经有体感了
为什么到去年秋天的时候感受到这个存储的大爆发呢
是的
其实这也是很多人一个错觉
就是其实ai 这一轮他是从二三年就开始了
但是二三年到二四年
其实全球大厂都在做一件事
就是去训练
就是怎么去训练更好的模型是他们当时的主要任务
所以当时也是nmv 发展最快的时候
但是从二五年之后就是
就是推理的需求突然变得非常多了
然后推理呢
它是需要很多的kkk 式的
所以他对memory 的需求是要强于训练的
其实我下面想先着重聊一聊hbm
那所谓hbm 就是能跟数据中心的gpu 直接通信的高带宽内存
这个现在是最火的一个领域
然后包括你像这个sk
海力士
包括还三星
他们问二零二六年的产能
甚至到二七年的货都基本上是已经处于一个售罄的状态了
呃
我不知道海星老师能不能跟我说一下
为什么现在这个hbm 这个缺货缺的这么厉害
这主要是因为ai 需求太旺盛了
比如说像英伟达吧
他们二零二五年就出了接近七百万颗gpo
而且他们整个hbm 的出货量也是非常大的
比如说它的h 二零是每一课上有九十六gb 的hbm
然后h 两百的话
需要一百四十一gb 的显存了
然后到了b 系列又加倍了
B 两百的话是是需要一百九十二gb
然后b 三百的话
是需要两百八十八gb 了
对
所以就是首先它整个产品的更新迭代对显存的需求量是上升的
第二就是啊
Nv 它整个出货量也是非常大的啊
但是供给端是非常紧缺的
因为大家都知道台积电去年客户的产能是非常紧张的
然后想使用hbm 的话
就必须要使用台积电的科沃斯把处理器和现在发展到一起
呃
然后它的扩产周期呢
也是比较慢的
像前年的话
它整个扩产大概是需要十二到十五个月
然后今年的话
他们是有改善了
可能只需要六到九个月就可以完成从设备下单到可用的这个这个状态了
唉
我们说的这个科沃se
也就是先进封装啊
它是只有台积电有这个产能嘛
啊 不是
台积电也会把它的一些产能让其他的厂商去帮他生产
因为他那边已经生产不过来了
其实基本上现在内存厂商最大的也就是三家嘛
一个是刚才我们一直说的这个sk 海力士
然后还有就是三星
然后还有就是美光嘛
啊
海军可不给我们介绍一下
就是这三家厂商现在在存储市场上是一个什么样的格局
首先去年的话
每年预测就是全球的hbm 市场是有这三百五十亿美元这样一个空间
然后他们预计今年会增长到接近六百亿美元
然后明年呢
还会再扩大到接近八百亿美元是这样一个空间
然后去年呢
全球出货的大头还是第三代的hbm
也就是hbm 三亿为主
然后在这一块呢
海力士占了差不多百分之六十的市场空间
然后美光呢话
超过百分之二十的市场空间
对
然后三星是相对他来说比较低一些的
对
所以其实去年三星他卖很很多产品给我们这边了
对
然后今年的话
到了第四代hbm
就是整个市场格局就变了
然后老大还是海力士
老二呢就变成了三星
然后美光那边呢
他现在在英伟达的rubin 那边的份额还是零
但是就随着他们的研发进度
就是我相信他们后面在nv 那边还是有一些份额的
对
现在nn vidia 他们用的存储要
要是哪一代芯
芯片 呃
Ruby in 话
就是第第代代bm 了
然后后面面话话就是以翻亿为主
对
其实你说的海力士是大
因为为我这段时间也看到
呃 网上报
报道的比较多的是那个三星他们的员工啊
要罢工了 对
因为
依旧是因为他们隔壁的这个海力士发奖金发的太多了
这个三星的员工就产生了不满
因为三星他们除了存储芯片部门
其实还有很多其他的硬件部门
手机部门
家电部门
其实他们是亏钱的
所以他们为了保证员工的这个公平性呢
就是说我们大家都发点
但是都不发那么多
但是海力士的员工发的就特别多
对 是的
嗯
不知道大家有没有注意到
人工智能进入agent 时代以后
模型竞争的维度已经在悄悄改变了
过去大家评价一个模型无非两个维度
够不够聪明
够不够快
但当agent 真正开始跑生产及任务的时候
这两个维度好像都不够用了
那一个真实的agent 工作流是什么样的
多轮对话
工具调用
联网搜索
处理图片和文档
任务越来越重
上下文越来越长
光说聪明和快解释不了一个agent 到底能不能把活干完干好
所以现在真正值得问的问题变成了他能不能高效完成一个生产级任务
今月星辰今天上午发布的step 三点七flash 就是围绕着这个问题设计的
它不是旗舰模型的轻量级平替
核心定位就是面向生产级agent 的高效率flash 模型一开始就为agent coding search 和多模态工作流设计
Search 不是外挂功能
而是直接内置进agent 推理链路的
多模态也是原生的
不需要你单独再配一个视觉模块
另外它开源
可本地部署
如果你在生产环境里对可控性和数据安全有要求
这一点挺重要的
感兴趣的听友可以去在show note 中查看详情
新注册用户有代金券
可以直接上手跑一跑
看看它能不能让你的agent 的工作流跑得更快更稳
刚才我从开头的时候也说了嘛
就是说存储行业它是一个这个周期性非常强的行业
我也是这次做功课
我看了一下
就是过去四十年这个存储芯片的这个出货量随着时间变化
它那个曲线那就是跟一个心电图一样
就是那种高峰和低谷就差十万八千里
呃
就是为什么存储行业它这个周期性这么强呀
啊 没有
它是有几个原因导致的
就是首先啊
存储制造它是一个资本高度集中的行业
所以它的产能一旦建成之后
那这些厂商呢
它就有强烈的动机想去满负荷的运转来摊薄它的成本
所以呢
即使价格下跌
他们也不会轻易的去减产
只会加剧产能过剩
然后第二个就是说啊
存储芯片呢
它是一个非常标准化的商品
像美光还是他们两个厂家提供了d ram 芯片其实是很像的
所以呢
当整个需求上升的时候
那所有厂商都会同步去扩产
但是呢
由于产能建设周期是有很长的前之间的
所以它的供给总是滞后于需求变化的
那所以就会导致现实需求旺盛
然后导致价格暴涨
然后导致去扩产
然后就导致过剩
然后导致价格暴跌
对
就是它是一个这样的一个循环
当整个市场的需求变得非常强了之后
然后就会导致价格暴涨嘛
然后这个时候呃
原厂呢
它就会非常激进的扩产
那它一扩产就会导致供给过剩
而且因为整个memory 就是它的产品是高度标准化的
所以就是呃
几个公司生产出来产品其实都是可以通用的嘛
所个市场都在扩产
然后就会导致产能非常的过剩
然后就导致价格暴跌
对
所以其实这个存储的周期图啊
所以会发现就是它每一次暴跌都来的非常的猛烈
就是因为整个行业都在扩产
它那一下出来的产品太多了
然后第三个呢
就是呃
存储还有一个非常大的这个特征就是
就关于囤货哎
比如说当价格开始鉴顶的时候呢
那客户会集中的去减库存
然后当供应开始变得紧张的时候呢
客户就会因恐恐慌存存货
然样的就就会导致整个需求会被放大
对
我不知道历史上这么几个就是存储的周期啊
有没有几个
你感觉直到拿出来分析一下
然后能够借鉴的呢
啊
其实我导致上一轮分值周期就非常典型
然后上面分润周期是因为疫情嘛
就是都都这个居家办公
然后就导致整个pc 和服务器采购量都上来了啊
从而就导致整个存储市场的需求就暴增
然后在这个背景下
原厂呢就开始大规模的去扩产呢啊
从而引发了后续的这个反应啊
然后这一次呢
就是跟前面有啥区别呢
就是这一次首先被很多卖方都称之为超越周期啊
是因为这一次跟前面的基准周期有一些本质区别啊
首先第一个就是它的需求驱动从过去的周期性补库存
嗯
已经转向了结构性的ai 爆发
因为传统的周期大部分都是因为比如说pc 啊或手机啊或者是服务器的更新换代驱动的
但是这一轮都是由ai 驱动的
就是整个ai 的推理和训练对存储的需求是远超过去的手机和pc 的
对
然后第二个就是这一次它的三重需求都叠加了d ram
Hbm 和难的同时爆发
嗯 对
然后第三呢
就是说从供给侧来看的话
这几个原厂都从份额扩张的竞赛转向了资本几率优先
就是他们在前面周期里面呢
他们都是通过增加供给然后想去占更多的市场份额啊
但是这一轮
这几个原厂都更倾向于通过技术的升级来提升产能
而不是像以前那种纯单纯的去增加供给
对
以这个低ram 为例啊
呃
九八年的时候其实全球有接近十五家
但是到现在情况下还海外的话
就只有三家了
所以呢
这个也大幅降低了整个市场竞争的风险
呃
然后第四点就是原厂的议价能力是在提升了
因为在传统的周期中
那客户在谈判中他是占主导地位的
那原厂呢
他往往都是被迫降价来维持他的市场份额
但是这一次原厂的议价能力一直在提升
然后这也是就是我们后面要着重讲到长协跟前面长鞋的不一样的地方
长协就是长期供货协议的意思
然后第五点就是啊
本轮的这个ai 服务器
他是挤占了消费电子的这个份额的
对
就是现在手机电脑都要涨价了
呃 对 是的
因为在传统的
呃
手机厂商绝对是原厂的第一大客户
就是他们怎么着也要保证手机客户他优先拿到产能
但是这一轮就不一样
大家可以看到啊
很多手机厂他们都在降低他们的出货预期
就是因为他们其实是缺货的
呃 对
然后这里呢
代替一下苹果
就前段时间苹果在市场上疯狂的去扫货难的
那它的目的呢
就是想利用自自身的价格优势
因为本身它成品比较贵嘛
然后它的毛利比较高
即使nand 的拿货价比之前要高出两倍
那苹果依然是有赚头
它的毛利依然也还可以
但是相对之下
国内的这些手机厂家
那它虽然有高端机
但是它同时还有大量低毛利的低端机
那如果苹果把这个nand 就要打上去之后
那中国厂商在采购的时候
光难的这一项零件的涨价就可能会吃掉之前低端机所有的毛利
而且我问下来
国内目前确实是有一家就一个大厂
他们为了推广自己的品牌
确实是整个低端机都是亏损的
其实是为了提高他们品牌以及他们系统的市场占有率
对
你一开始提到你说这一轮是这个结构性的上涨嘛
就是这一轮的需求是由ai 拉动的
那ai 拉动的这一轮的需求和我们平常消费品的这个需求有什么不一样呢
那个首先就是我刚刚提到一点
就是这一轮呢
它是三重需求叠加
就是d ram
Hbm 和nand 需求都非常往上
然后传统的比如说像上一轮它没有导致hbm 的这个需求
呃 第二就是
呃
整个ai 就大家可以去算一下
比如说像英伟达它的
嗯
就是它的ai 芯片的出货量
它所使用的d ram m 的的整个的这量量量实就光nnn v 这一前就可以抵得上之前比如说很多什么pcl 或者手机的这个使用量
对
所以整个ai 去的训练和推理
它对就是存储的需求量是远超往期的什么手机和pc 的
对
而且这些大厂他们对内存的涨价其实是没有消费电子那么敏感的对不对
对 是的是的
那比如说nand 这一项吧
Nand 其实就是苹果他这个前段时间的扫货价是比之前要多了一倍还多
但是你多了这一倍
就导致比如说你一个五一二gb 的这个手机的价格就会上涨大几百块钱
那这个钱对手机来说就是非常敏感的啊
对
就是那些服务器厂商其实还好
就是因为这个整个服务器都是非常贵的
那所以就是你整个比如说d ram 或者的涨了几万块钱其实都还好啊
其实我后来还做了一下研究
其实过去四十年
基本上我感觉是每五到十年就会有一个大的这个存储周期
包括一开始这个个人电脑的发展
就是催生了一波这个存储芯片的这个周期的大涨啊
两千年左右这个互联网的这个爆发
包括我们其实我们上轮也讨
我们上期节目里头也讨论过这个互联网泡沫破破灭
是造成了一个非常大的存储的上升已经是下滑
然后当时就是像海军老师说的
以前可能有大概有二十家存储厂商
两千年泡沫破灭以后
存储厂马上就洗牌了
只剩三家了
就是现在我们现在说的这三家
对
然后包括我们在一零年左右有这个手机
然后平板的这个这么需求的增量
都是让这个存储在一个很长的上行之周期以后
突然就有一个断崖式的下跌
对 是的 是的 对
刚才咱们聊到嘛
就是说这个vi 的需求是非常的旺盛
不管是对存储类型的这个存储的芯片啊
那是不是现在这原厂
就是包括这个存储原厂有非常大的动力去扩产能呢
啊
其实并没有
其实还是我们上面所讲的
就是现在呢啊
整个存储已经在发生结构性转变了
就是从上一轮的他们抢份额
然后变到现在就是几个大厂都在想着怎么去保证自己的利润优限
对
所以就是在经历了上一轮的亏损之后
因为它上一轮真的是巨亏
所以整个存储行业的公司的经济哲学都发生了改变
就是厂商其实现在更看重他们整个盈利能力
然后还有就是效率
而不是说仅考虑市场占用
所以现在这几个大厂对于就是供应过剩而去扩产是非常谨慎的
那它一扩产就会导致供给过剩
对
其实我们刚才也提到这个长协嘛
就是长期供货协议啊
我看到有一些分析啊
就是说这个因为这个存储的周期波动特别大嘛
然后因么时候见顶就要往下坠了呢
就是在这个原厂跟客户之间签订这个长期协议的时候
它的股价基本上就是见顶了
呃
这个是有的
在前一轮的时候其实大家可以看到呃
当原厂签了长协之后
那它的股价基本上就见顶了
这个主要因为它签上来之后呢
它未来几年的收入基本上就比较确定了
那所以就是它整个资本市场想象空间就不太大了
本轮的周期其实跟上一轮是不一样的
就是哪怕长协其实我个人认为也是不一样
因为前面的长协呢
它基本上都是去把什么量价锁定
然后呢
这样的话对原厂来说它几年的收入是比较确定的
但是这一轮呢
就是首先国内来说
我跟国那几个大厂采购都聊过
那他们的厂鞋目前是锁量不锁价的
就是说原厂那我只能是尽量去给你保证你的供给
但是呢
价格要按照当时的市场价取钱啊
海外的话呢
目前长鞋主要是有两种
第一个呢
就是说客户他前期要支付很高的定金
然后第二个呢
就是去绑定原厂资本开支
比如说原厂他想扩展去买设备
那这个时候客户他愿意去出钱参与这个环节
那就等于说客户跟原厂是利益绑定的
然后通过利益绑定来获取啊存储原厂他未来的一些产能
并且利益绑定是不是就类似于比如说我sk 海力是要扩产能
然后英伟达就会来投资
对 是的
就是本质还是因为现在太缺了
就是这些客户他如果想去锁定未来几年的产能
那
那他就是要锁定自己己产产能
然后后就是本轮的长鞋其实跟过去也是不一样的
因为长鞋本质来说他其实是一个均的协议
就是它整体的约束力其实不强的
就是 呃
客户的违约成本是很低的
在传统商线里面
对 然后
所以这也是投资者
对
就是现在这几个新闻原厂它签行欠长期之后去看空的一个观点啊
但是签长协其实本质还是工需关系决定的
就是因为现在这个太缺了嘛
呃 对
然后上一轮呢
即便是缺货的情况下
原厂的话语权也没有这么高
但是现在本轮的存储期原厂话语权的提高
所以客户才有以前当前的这个模式
对
所以这也证明了就是我们这一轮的ai 对存储的需求真的是非常往上
现在这个周期上升的非常有
有很多人看多啊
但是也有很多人看看空
你觉得他们这个分歧的点在哪里啊
呃 首先
其实在两个多月前吧
当时市场上就有一些人在看空
比如说闪叠啊等这种公司
就我觉得从这个当前来看
因为短期这几个存储场都涨幅过大了
对他短期确实有些长买现象
所以我觉得回归调的话
其实实正常
呃
但是我觉得整个ai 对这个存储的需求是没变的
就是产能还是非常紧张
然后第二就是
就是这些原厂它其实现在扩产的意愿不是很强
对
就是它的扩产扩出来产能能对对整需需求来说
嗯
差的太大了
嗯对
所以就是我个人其实还是经场看多的
但是然后还有一点就是海力士他这一周在某个券商举办大会上
他们认为存储的供需关系到二零二八年也不会改善
但实际上就算这几家原厂就是开足马力扩产能
现在的它这个供给也相对于需求来说太短缺了
对对对 是的
其实这也是啊
比如前段时间谷歌他有个论文嘛
然后实场上让很多人拿谷歌那个论文去看空存储嘛
然后它论文其实就是
就是说他怎么去提高存储的利用率
然后就是可以把比如说ai 推理他所需要的存储量降低很多
这个逻辑我觉得
嗯 首先啊
就是整个存储的这个就是缺口还是非常大的
所以这几个大厂就是包括海外包括国内
他们其实每天都在研究怎么去提高存储的利表的
就是怎么能够就是降低存储的这个使用量
就是这个算法是每天都在发生的
所以那比如说明天或后天又出来一个新的算法说就是我可以把存储的利用率又降到原先十分之一
就我觉得这些都是正常的
就是也没必要拿这些技术去看控存储
因为现在整个存储的缺口确实太大
嗯
而且我知道你说的那个谷歌那个论文其实他大概是一年多前发表的
然后当时发表的是在去年四月份发表的
他其实发表的时候就有挺大的争议会
它其实是一个算法上的创新
对 是的是的 嗯
那个dsv 四它也能够去很大比例的去压缩存储空间
对
但是这其实一样的就是它也是在算法层面去做嘛
然后但是它并不会导致整个存储的需求会降低
嗯
对
因为不管你再压缩
你还是可以有无限多的这个上下文
对这个上下文的这个需求就是越来越大了
对对对 是的
这个其实就跟去年呃
**的时候当
当时很多人就是拿ds 去看空nv 嘛
就是觉得ds 它能够就是使用很少的算力
然后就会可以做出来一个就是很强的一个大模型
对
大家觉得可能对n 的需求没有那么大
但其实这个
这个也是悖论
当你的效率越高
其实你对整个算力或者对整个存储的需求量是上升的
而不是下降的
对
然后其实你也说到嘛
就是说这个虽然现在hbm 的这个产能非常受限啊
但是其实不管是大厂也好
或者说是原厂也好
其实都在想方设法的怎么样能够提升这个存储的效率
然后不管是从硬件上呀
或者是从算法上
这个方面海军老师可不可以给我们介绍一下
就是大家有什么一些什么样的方法能够绕过这个现在存储的这个bottle 内
呃 对
其实在当下hbm 这么缺的情况下
就是这些大厂都在想办法
就是怎么去方方设法的去提高其他memory 的利用率
呃 像nv 吧
Nv 他们去年出了一个方案叫icms
然后他们今年把方案改名了cmx 这个方案
那它会使用tb 级的这个nand 去存数据
呃 对
然后中间再搭配应达自己做的那个
那个什么bf 四
就是它使用dpu 去连接nand
然后先去做一些预取
因为如果直接从gpu 直接去访问nand
那它整个延时是非常大的
但是因为整个ai 不管是训练还推推理
那它其实对延时是非常敏感
对 所
所以他为了去消除这个延时怎么办呢
他就会先用这个这个处理器先用dpu 先去nad 里面做一些预取
然后后再从dpu 传给gpu
那这个延时就小了很多
呃 是
那这样的话是他们是不是不需要hbm
只用用样的就可以了啊
不是
不是这个需要的
需要就是 呃
Nv 和谷歌他们现在其实都是想办法去提高其他memory 利用率
但是不是说要取代hbm
看nv 或谷歌
其实他们下一代芯片
他们整个hbm 的规格依然是非常大
像这个b 系列
B 两百 呃
就是它那个片上是有幺九二gb 的hbm
但是到了rubin 里面是有这个二八八g
然后到了ruby ultra 是有一t
所以就是他虽然在想办法去提高其memmory 用率
但是他还是会使用hbm
嗯
Google 要来讲讲google 嘛
然后谷歌呢
它其实在是今年年初的时候吧
就是这个网上就在传了
谷歌它
它有一个cxl 内存池的方案
就是它使用cxl 这个协议
把d rum 这个做了一个池
从而呢
它不再使用hbm 了
然后这个好处是啥呢
第一个是它可以显著的提高dm 的容量
对对
然后内存池的容量是可以达到tb 级
对
然然歌n 一的那个方案
它使用那样的嘛
它是pb 级
是差了三个数量级
呃 对
然后第二个好处就
就是说它可以提高d ram 的容量了
对为谷在整个ram 价格非常贵的
那提高利用率就相当于是省的成本也可以这么理解吧
就是谷歌的下一代这个方案只是谷歌其中一个方案而已
对
不是说谷歌以后就再也不用hbm 了
对
然后谷v 那个方案呢
是因为现在ai 推理的需求是强于训练的嘛
对吧
这个这讲过杠刚
对
然后nv 的这个存储架构就非常适合现现在的推理
对
所以从这个架构其实也可以看出来
就是
就是这个当前现在很多人nv 它在推理方面的优势没有他之前的训练的那么大
对
所以就是大家觉得就是推理时代
其实就是可能自家使使用自己的ack 的性价比更高
对
所以这个啥很多人拿这个观点来看空nv 啊
但是如果大家去看nv 的方案的话
就可以看出来
Nv 他现在做的很多的方案其实都是针对推理的
对
所以就说明nv 就是也意识到存这个推理时代到来了
那他自己的产品就要更贴合现在时代的需求啊
对 然后nv 呢
它本身含一个那个封装
就是他下一代可能可能要到飞曼
他会采用他一定的三d 封装
就是把gpu 跟s ram 放在一起
这样的话呢
就可以提高s ram 的容量啊
这个容量提高也不会到很大
就顶多就是几百兆或者是一gb
这个量级也不会太高啊
所以呢 呃
三d 封装其实也算是nv 的一个后手啊
因为现就就是
就是这个技术像现在md 和苹果都已经在使用了
但是nv 还没有在使用
嗯对
所以你的意思是说
Nv 其其实也是在顺应这个推理的时代
推出他们一些新的解决方案
对对对 是的 嗯
哎 对
其实你刚才就是说到这个
大家现在看空nv 啊
最近刚刚ipu 的这个美国的一个芯片初创公司叫serreabs 哦
他们上他们ipu 以后
这个nv 的股价也是大跌啊
所以我不知道你怎么看待这家公司的技术路线
你觉得他们会取代这个nv 的gpu
呃呃
首先就是它的出现不是取代nv 的啊
对
然后第二点就是
嗯
从美国这创业公司路路可以发发现是美国跟中国的这个这个路线还是不一样的
因为比如说像这个公司
然后像前段时间很有火者tlace 的公司
他们跟nv 和谷歌的方案都是不一样
但是其实你看中国的这些创业公司司
就是中国的ai 芯片创业公司
他们的产品其实差异性都不大的
其实都差不太多
对
再说回siri brass 这家公司
就是他们的这个核心产品其实是晶圆级的这个引擎
就是说他把一个十二寸的这个
呃
晶圆做成一个大型的芯片
然后呢
它片上是使用四十四gb 的sm 来替代传统的hbm 线存
呃
所以这样呢
它就可以把实现就是它片上的这个内存的访问
它的带宽非常大
然后延时非常低
然后专门一向大模型的推理的啊
但是它的问题就就在于
第一个这个是它的s ram 的容量只有四十四gb
对
然后刚刚nv 的u
它的片上空间是有两百多gb 的hbm
对
所以是比较大的差距
然后第二就是它的io 的速率只有一百五十gb 每秒
这个扩展是是是
是受限的
然后第三就是它扩容是非常麻烦
然后第四点就是它的硬件的成本是非常高的
然后再加上就是它整个归员都当成一个大芯片
那它这个散热是很大问题的
因为现在我们整个ai 芯片的散热是非常大的
就要看它后续怎么去解决发热这个这个问题
嗯
所以在你看就是所有的这些其他的方案都不是一个相互替代的关系
可能是case by case
你在一些什么样的呃情况下可能选择这样的处理理器可能更好在其他的一些情况下取得
那选择那样的解决方案会更好
对是的是的
这说到五层存储的时候
有一层就是呃
Nand 嘛
就是我们之之前讲的是呃
Srm
然后呃
如果随着这个个传输速度的这个减慢的话
接下来就是来到难and
对对是的
就是我个人为为and 它现在的角色是发生变化
因为你看今年整个ai agent 变得非常火了嘛
可以预验的是agent 在以后的应用场景会这个变多的
呃 对
然后a ent 呢
它有核心特点是啥呢
是它整个推理链路是非常长的
那他就要求它的很多环节是可以被复原的
那复原的话
就要要求它的中间结果是要落盘
那所谓落盘就是要把这个结果存起来
那它存在位置的只能是nand
所以就是
就是我个人认为nand 的这个角色发生了变化
因为它从前呢
它是存结温数据啊
然后到现在它是
呃
就是可以认为是它参与到整个ai 推理过程中了
这个角色的转变可能会导致nand 的整体需求和性能的要求都提高
对 唉
那但是nand 的这个传输速度会是一个瓶颈
呃 对
会这个瓶颈
所以就是这个现在整个业界都非常期待闪叠的hbf 嘛
就是叫高带宽闪存
然后就是我觉得目前闪闪迪它的估值能比这么高
有很大一部分原因都是在于这个产品
就这个产品
它优势是几个呢
第一个是它的大容量
就是它的容量可以比hbm 要高出八到十六倍
而且呢
它还支持更大数据集和更复杂的模型处理
然后第二就是它成本是比较低的
其实这个land 它的单位存储的成本肯定是要比ddm 级要低很多的
对
然后第三就是它的高态宽宽和低延时
就是它其实也是类似hbm
它是跟处理器放在一起的
那所是呢
它这个延时就会低一些啊
但是呢
它仍然是没法取代hbm 的啊
主要原因是有只有两个
第一个是nand 它天生的差写寿命
就是它是没法像d ram 一样
就是可以接近无限次的写入数据的
那为第二就是and
它是有寿命限制的那个第二就是这个温度也是个问题
因为d ram 的温度是能够达到一百二十五摄氏度的
但是闪存一般来说工作温度是在八十到八十五之间
而且我们ai 处理器的板卡的这个热度是非常高的
所以这个散热也是一个挑战
呃 对的
还有就是
呃
它本身就是这个产品
它也不是取取代hbm 的
是因为这个主要优势其实是在读那边
就是大家知道它的写的这个延时比较大
但是它的读的性能理论上是可以跟d ram 是变身超越的
所以呢
未来的可能方案就是说把模型的参数放入到hbf 里面去
但是ktv 开始还是留在hbm 里面
呃
是不是闪迪他们主要的这个业务方向就是做难
唉 对 是 呃
闪迪它从去年这个系数出来之后
然后股价就到现在一直在涨
这个整个市场其实现在对难的这个我个人觉得可能比前段时间还要更乐观一些
因为前段时间就是看这个分析师这个报告
其实发现很多分析师已经在看空也反而涨到现在了
然后这些分析师就是前面看空的这些分析师可能现在又开始看多了
看空的原因是什么
是股价太高了
对 股价太高 对
然后还有就是
嗯
可能之前他们没有意识到难and 在整个ai agent 里面的这个这个之实是在发生变化了
你一直在都在说啊
说这一轮的这个存储的周期是结构性的
然后其实你从这几家原厂的出货来看
基本上他们到二六二七年也都是卖完的嘛
那你觉得这一轮周期能持续多久
我不说我的观点
唉 对 就是我
我说一下原厂观点
就是这个海力士的人
他本周在香港一个策略会上
他们就明确的说
嗯
到二八年供应关系也不会得到改善
对
然后就是我本身的看法是说
就是假如说我们去算ai 推理他对存储的需求
就会发现这个需求比现在要多非常多倍
但是几个原厂的扩展
就是哪怕到了八年
它的扩产它顶多比现在能多出个一倍或两倍
所以中间这gap 还是非常大的
所以我还是比较看好整个存储行业的
我就看到有一种说法
一种就是说这轮只不过是一个超级周期
只不过是一个比较长的周期
还有一种说法呢
就是说啊
有可能以后存储变成一个价值型的行业
也就比如说像苹果这样的厂商一样的可以长久持有它的这么一个行业
然后我不知道你是怎么想的
比如说像咱刚提的那个难的
反正我也看到很多人都在讲
他说难的已经发生了变化
就是从之前就是这个周期行业
然后变成了因为跟ai 强绑定的嘛
呃
但是我个人看来就是
哪怕这一轮是ai 驱动的
它只是弱化了周期性
但是还是没有改变整个存储行业是一个周期行业
它的本质并没有变
只不过是它的驱动轮子包括定价权
产能分配的逻辑被重写了而已
也是因为啥呢
第一个原因就是整个资本开支的滞后反噬
就是啊
像我们上面所讲到的
就是因为它是一个资本高度密集型的行业
然后它要扩建的话
第一个是有滞后
第二个是它要花很多的钱
对
就是这个滞后就会导致这个周期本身
第二就是
呃
下游算力建设的阶段性放缓
就是 呃
现在我们ai 的这个啥基建都还是非常的
嗯 火热 对
火热的对
这个这一天肯定会倒来
我觉得那他一放缓肯定会
嗯
就是导致比如说原先这些大厂他已经是去扩了很多产品了
然后肯定会导致产能可能会过剩
然后这些大厂为了摊薄这个折旧
它会就是把产能比如说在调回其他产品啊
然后就导致整个存储可能再次过剩的情况
对
保守估计这一轮至少得维持到二七到二八年
呃
我觉得二八年应该也不太会结束
那大家现在还来得及上车吗
这个不好说
刚才我们一直在说国外啊
是我们国内其实也有一些厂商现在在跟进啊
包括这个现在有一家马上就要上市的公司
大家讨论的也比较多
然后我不知道这个各位跟我们说说现在国内的存储发展到一个什么样的阶段
因为我前两天还看到一篇文章
它的标题特别吸引眼球
叫做长兴存储
是中国的sk 海力士吗
呃
其实国内的话
都是是比较名牌的
就是有两家比较知名啊
一个是长兴
一个是这个长江存储
然后他俩呢
就是
就是长兴是主要是制作d ram 嘛
对
然后这个长江存储主要是做难的
他俩马上都要上市
嗯 但是呢
他们的信息基本都是保密的
就包括技术的东西
包括他们的比如产能情况
其实都是保密的
就是说
就是整个市场其实对这这些东西了解的不是特别别多
呃 先 先
长江存储的的其实在国内内卖非非常多了
但新新的bmm 其
其实在国内还没有被规模的使用起来
对
就是华华的那个啊
飞行的九五零
就是这个是
呃
是那个徐志军徐总他自己己说的嘛
就是九五零是使用的自研cbm
对
然后华为是比较确定是使用自研的
然后国内其他厂家像去年的话
其实他们都还使用三星比较多
然后就是我了解的咱国内几个ai 芯片厂商
他目前也在跟长兴一块合作
但是目前应该还没有量产
但是长兴是不是可以给一些比如说像手机和笔记本电脑厂商供货
哎 对 是的 这个
这个可以说的
长兴就当然他的收购说明书里面就是可以看到他的股东啊
就是他的股东其实跟客户有很多是重叠的
比如说像什么小米啊这些手机厂商
对
他们去参与长兴的这个投资
其实他们也是想为了获取长兴的这个产能
总结一下
你怎么看存储这个赛赛道长期的一个发展
呃
就是我还是觉得这一轮ai 所带来的这个存周期跟上云是不一样的
嗯 但是呢
他还是没有去改变存储是一个周期行业的这个本质
那个
再有就是这个大家最要关心的是大厂的技术呃更新
比如像nv
像谷歌他们下代产品是什么样的
因后像nv 的话
他们使用蛋的是使用非常多的
然后像谷歌的话
他起码他下一代有一个方案是纯使用d ram 的
对
就是他们两家的方案都不一样
对
就是大家要去关注
嗯 国内外
比如像国内像华为啊
包括阿里
他们的就是新的技术的发展这个路线
然后来看一下这几个大厂对存储的态度
然后以及这这几个大厂就是他们对原厂的态度
就比如说像那个老黄吧
他其实这两年来亚洲来了非常多
那他他的要原因是啥呢
就是去索产能
就去找台积店
找分种厂商去锁产能
对
然后海外的话
比如说像
像奥特曼
他们现在一个非常大的优势是什么
就是他的估值已经被athroropic 超越
但是他们现在一个非常大的优势就是他们手里的这个算力
他们的产能
因为他去年也在疯狂的他的供应链的一些厂商去划饼
去去产产能
所以我
我觉得果说他们后面面面面把自己的
嗯
产品的能力在提升的话
那我觉得反正atropc 的机会也是比较大的
哦 真的吗 对
就是因为他们的手里现在有非常珍贵的产能
对
我之前前看到报道说opopen i 他
他们其在很早的时候就锁定了很多算力
但是anthroppic 没有预料料他们的这个个对算力的需求会这么大
然后包括你看他们现在是刚刚跟xai 签订的协议
要买xai 的产嘛
所以他们其实他们的算力是比较紧缺的
对对对 是的
那个可能这也是奥特曼很有先见之明的地方吧
就是他去年虽然他并没有看到open ai 怎么去盈利
但是他知道提前去把就该锁的产能先锁定好呀
那我们今天聊了很多关于存储的这个话题啊
也非常感谢海军跟我们分享啊
那我们今天就这样
拜拜
谢谢大家
拜拜
今天的科技早知道了
如果你有任何的想法
欢迎评评论区我们交流
如果有任何想听的话题
也请告诉我们
如果你喜欢我们的节目
请记得分享给更多的朋友
那我们下期再见
下期再见
哦哦哦