帅帅的爸爸
10-06 01:32
都是信口开河了
大摩:AI内存短缺将持续数年,三大路径破局,存储与异构算力迎结构性机会
免责声明:上述内容仅代表发帖人个人观点,不构成本平台的任何投资建议。
分享至
微信
复制链接
精彩评论
我们需要你的真知灼见来填补这片空白
打开APP,发表看法
APP内打开
发表看法
{"i18n":{"language":"zh_CN"},"detailType":1,"isChannel":false,"data":{"magic":2,"id":615228896285592,"tweetId":"615228896285592","gmtCreate":1791221573059,"gmtModify":1791221575002,"author":{"id":3561899791972822,"idStr":"3561899791972822","authorId":3561899791972822,"authorIdStr":"3561899791972822","name":"帅帅的爸爸","avatar":"https://static.tigerbbs.com/0501a1700aaa7542563567264289ab1f","vip":1,"userType":1,"introduction":"","boolIsFan":false,"boolIsHead":false,"crmLevel":1,"crmLevelSwitch":0,"individualDisplayBadges":[],"wearingBadges":[],"fanSize":1,"starInvestorFlag":false},"themes":[],"images":[],"coverImages":[],"title":"","html":"<html><head></head><body><p>都是信口开河了</p></body></html>","htmlText":"<html><head></head><body><p>都是信口开河了</p></body></html>","text":"都是信口开河了","highlighted":1,"essential":1,"paper":1,"likeSize":0,"commentSize":0,"repostSize":0,"favoriteSize":0,"link":"https://laohu8.com/post/615228896285592","repostId":2673889110,"repostType":2,"repost":{"id":"2673889110","kind":"news","pubTimestamp":1791211828,"share":"https://www.laohunote.com/m/news/2673889110?lang=zh_CN&edition=full","pubTime":"2026-10-05 22:50","market":"us","language":"zh","title":"大摩:AI内存短缺将持续数年,三大路径破局,存储与异构算力迎结构性机会","url":"https://stock-news.laohu8.com/highlight/detail?id=2673889110","media":"智通财经","summary":"大摩强调,当前 AI 内存短缺并非短期扰动,而是算力性能增长远超内存供给速度的结构性矛盾。而 DRAM 晶圆厂建设周期长达数年,供给弹性极低,短缺格局将持续数年。大摩测算,AI需求将推动 CXL 及相关内存附加芯片市场规模在 2030 年达到约 60 亿美元,远超传统 CPU 内存扩展市场体量。","content":"<html><head></head><body><p style=\"text-align: left;\">10月5日,摩根士丹利发布半导体行业研报指出,DRAM内存短缺将贯穿本轮AI产业周期,而AI算力扩张不会等待新晶圆厂建成投产。行业正通过硬件降配、推理架构解耦、CXL内存池化三大技术路径绕过内存瓶颈,在供给约束下持续推进算力建设。该行继续看好美光(MU.US)、闪迪(SNDK.US)等存储龙头,同时看好CXL互联、异构推理赛道的增量机遇,推荐Astera Labs(ALAB.US)、Marvell(MRVL.US)、Cerebras(CBRS.US)及英伟达(NVDA.US)。</p><p style=\"text-align: left;\">大摩强调,当前 AI 内存短缺并非短期扰动,而是算力性能增长远超内存供给速度的结构性矛盾。前沿大模型规模每 6 个月翻一番,头部模型上下文窗口年增速达 5-6 倍,叠加推理并发需求持续提升,内存容量与带宽需求持续爆发。而 DRAM 晶圆厂建设周期长达数年,供给弹性极低,短缺格局将持续数年。英伟达CEO黄仁勋也公开表示,行业需要转变思路,通过架构创新应对内存约束,而非单纯等待产能扩张。</p><p style=\"text-align: left;\">面对 HBM 与主存供给紧张,行业最直接的应对方式是选择性降低单设备内存规格(De-speccing)。以英伟达 Rubin 架构为例,单机架 LPDDR5 容量从原计划 54TB 降至 28TB,单 GPU HBM 容量从 288GB 下调至 192GB,通过降低内存堆叠高度保障整机出货量。大摩指出,降配并非消除内存瓶颈,而是将压力在内存层级间转移:削减高速本地内存后,KV 缓存等非高频数据向 NAND 存储下沉,同时跨 GPU 数据交互增加,带动对网络互联带宽的需求,本质上是以更高速的网络互联、更低成本的存储资源,补充稀缺的高带宽内存。</p><p style=\"text-align: left;\">第二条破局路径是推理架构解耦(Disaggregation)。AI推理包含预填充(Prefill)与解码(Decode)两个差异显著的阶段:Prefill 以算力消耗为主,Decode则高度依赖内存带宽。传统架构用同一加速器兼顾两类任务,资源利用率偏低。当前行业正加速走向异构推理,将两个阶段拆分至不同硬件:算力密集型Prefill由通用GPU承担,内存带宽密集型 Decode 则由搭载大容量片上 SRAM 的专用加速芯片处理。</p><p style=\"text-align: left;\">典型代表包括Cerebras的晶圆级引擎、英伟达收购的 Groq LPU 架构,均能在解码阶段提供远超传统 GPU 的内存带宽效率。大摩认为,异构推理将成为 AI 基础设施的重要演进方向,专精解码环节的算力厂商将获得明确的增量市场。</p><p style=\"text-align: left;\">第三条路径是 CXL 技术重构内存体系。CXL(计算高速互联)通过高速互联实现内存的扩展、共享与池化,让内存不再绑定单一处理器,成为突破内存容量约束的核心技术路径。大摩测算,AI需求将推动 CXL 及相关内存附加芯片市场规模在 2030 年达到约 60 亿美元,远超传统 CPU 内存扩展市场体量。其核心价值在于构建分层内存架构:最高频数据保留在HBM,次高频数据放入 CXL 内存池,低频冷数据下沉至 NAND,用成本梯度匹配数据访问频率。</p><p style=\"text-align: left;\"><strong>投资主线方面</strong>,大摩重申三大方向:一是继续超配美光、闪迪,降配源于供给短缺而非需求走弱,AI内存需求长期向上,供给缺口将持续消化产能;二是布局 CXL 与 scale-up 互联龙头 Astera Labs、Marvell;三是关注异构推理受益者Cerebras,以及通过收购Groq完善异构布局的英伟达。</p><p style=\"text-align: left;\"><strong>风险提示:</strong>AI 算力需求增速不及预期;CXL 技术落地进度慢于预期;内存产能扩张超预期。</p></body></html>","source":"stock_zhitongcaijing","collect":0,"html":"<!DOCTYPE html>\n<html>\n<head>\n<meta http-equiv=\"Content-Type\" content=\"text/html; charset=utf-8\" />\n<meta name=\"viewport\" content=\"width=device-width,initial-scale=1.0,minimum-scale=1.0,maximum-scale=1.0,user-scalable=no\"/>\n<meta name=\"format-detection\" content=\"telephone=no,email=no,address=no\" />\n<title>大摩:AI内存短缺将持续数年,三大路径破局,存储与异构算力迎结构性机会</title>\n<style type=\"text/css\">\na,abbr,acronym,address,applet,article,aside,audio,b,big,blockquote,body,canvas,caption,center,cite,code,dd,del,details,dfn,div,dl,dt,\nem,embed,fieldset,figcaption,figure,footer,form,h1,h2,h3,h4,h5,h6,header,hgroup,html,i,iframe,img,ins,kbd,label,legend,li,mark,menu,nav,\nobject,ol,output,p,pre,q,ruby,s,samp,section,small,span,strike,strong,sub,summary,sup,table,tbody,td,tfoot,th,thead,time,tr,tt,u,ul,var,video{ font:inherit;margin:0;padding:0;vertical-align:baseline;border:0 }\nbody{ font-size:16px; line-height:1.5; color:#999; background:transparent; }\n.wrapper{ overflow:hidden;word-break:break-all;padding:10px; }\nh1,h2{ font-weight:normal; line-height:1.35; margin-bottom:.6em; }\nh3,h4,h5,h6{ line-height:1.35; margin-bottom:1em; }\nh1{ font-size:24px; }\nh2{ font-size:20px; }\nh3{ font-size:18px; }\nh4{ font-size:16px; }\nh5{ font-size:14px; }\nh6{ font-size:12px; }\np,ul,ol,blockquote,dl,table{ margin:1.2em 0; }\nul,ol{ margin-left:2em; }\nul{ list-style:disc; }\nol{ list-style:decimal; }\nli,li p{ margin:10px 0;}\nimg{ max-width:100%;display:block;margin:0 auto 1em; }\nblockquote{ color:#B5B2B1; border-left:3px solid #aaa; padding:1em; }\nstrong,b{font-weight:bold;}\nem,i{font-style:italic;}\ntable{ width:100%;border-collapse:collapse;border-spacing:1px;margin:1em 0;font-size:.9em; }\nth,td{ padding:5px;text-align:left;border:1px solid #aaa; }\nth{ font-weight:bold;background:#5d5d5d; }\n.symbol-link{font-weight:bold;}\n/* header{ border-bottom:1px solid #494756; } */\n.title{ margin:0 0 8px;line-height:1.3;color:#ddd; }\n.meta {color:#5e5c6d;font-size:13px;margin:0 0 .5em; }\na{text-decoration:none; color:#2a4b87;}\n.meta .head { display: inline-block; overflow: hidden}\n.head .h-thumb { width: 30px; height: 30px; margin: 0; padding: 0; border-radius: 50%; float: left;}\n.head .h-content { margin: 0; padding: 0 0 0 9px; float: left;}\n.head .h-name {font-size: 13px; color: #eee; margin: 0;}\n.head .h-time {font-size: 11px; color: #7E829C; margin: 0;line-height: 11px;}\n.small {font-size: 12.5px; display: inline-block; transform: scale(0.9); -webkit-transform: scale(0.9); transform-origin: left; -webkit-transform-origin: left;}\n.smaller {font-size: 12.5px; display: inline-block; transform: scale(0.8); -webkit-transform: scale(0.8); transform-origin: left; -webkit-transform-origin: left;}\n.bt-text {font-size: 12px;margin: 1.5em 0 0 0}\n.bt-text p {margin: 0}\n</style>\n</head>\n<body>\n<div class=\"wrapper\">\n<header>\n<h2 class=\"title\">\n大摩:AI内存短缺将持续数年,三大路径破局,存储与异构算力迎结构性机会\n</h2>\n\n<h4 class=\"meta\">\n\n\n2026-10-05 22:50 北京时间 <a href=http://www.zhitongcaijing.com/content/detail/1503764.html><strong>智通财经</strong></a>\n\n\n</h4>\n\n</header>\n<article>\n<div>\n<p>10月5日,摩根士丹利发布半导体行业研报指出,DRAM内存短缺将贯穿本轮AI产业周期,而AI算力扩张不会等待新晶圆厂建成投产。行业正通过硬件降配、推理架构解耦、CXL内存池化三大技术路径绕过内存瓶颈,在供给约束下持续推进算力建设。该行继续看好美光(MU.US)、闪迪(SNDK.US)等存储龙头,同时看好CXL互联、异构推理赛道的增量机遇,推荐Astera Labs(ALAB.US)、Marvell...</p>\n\n<a href=\"http://www.zhitongcaijing.com/content/detail/1503764.html\">网页链接</a>\n\n</div>\n\n\n</article>\n</div>\n</body>\n</html>\n","type":0,"thumbnail":"https://static.tigerbbs.com/cde2e4fc86b629e1a7a7708ea53eb694","relate_stocks":{"SNDC":"2倍做多SNDK ETF-Corgi","MULL":"2倍做多MU ETF-GraniteShares","LABX":"Tradr 2X Long ALAB Daily ETF","MU":"美光科技","SNDU":"2倍做多SNDK ETF-T-REX","MUYY":"GraniteShares YieldBOOSTMU ETF","ALA":"Corgi ALAB 2x Daily ETF","SNXX":"2倍做多SNDK ETF-Tradr","SNDG":"2倍做多SNDK ETF-Leverage Shares","MUD":"1倍做空MU ETF-Direxion","ALAB":"Astera Labs, Inc.","MUG":"Leverage Shares 2X Long MU Daily ETF","MUU":"2倍做多MU ETF-Direxion","SNDK":"闪迪","MUZ":"2倍做空MU ETF-Defiance","SNDQ":"2倍做空SNDK ETF-Tradr","MIC":"2倍做多MU ETF-Corgi"},"source_url":"http://www.zhitongcaijing.com/content/detail/1503764.html","is_english":false,"share_image_url":"https://static.laohu8.com/e9f99090a1c2ed51c021029395664489","article_id":"2673889110","content_text":"10月5日,摩根士丹利发布半导体行业研报指出,DRAM内存短缺将贯穿本轮AI产业周期,而AI算力扩张不会等待新晶圆厂建成投产。行业正通过硬件降配、推理架构解耦、CXL内存池化三大技术路径绕过内存瓶颈,在供给约束下持续推进算力建设。该行继续看好美光(MU.US)、闪迪(SNDK.US)等存储龙头,同时看好CXL互联、异构推理赛道的增量机遇,推荐Astera Labs(ALAB.US)、Marvell(MRVL.US)、Cerebras(CBRS.US)及英伟达(NVDA.US)。大摩强调,当前 AI 内存短缺并非短期扰动,而是算力性能增长远超内存供给速度的结构性矛盾。前沿大模型规模每 6 个月翻一番,头部模型上下文窗口年增速达 5-6 倍,叠加推理并发需求持续提升,内存容量与带宽需求持续爆发。而 DRAM 晶圆厂建设周期长达数年,供给弹性极低,短缺格局将持续数年。英伟达CEO黄仁勋也公开表示,行业需要转变思路,通过架构创新应对内存约束,而非单纯等待产能扩张。面对 HBM 与主存供给紧张,行业最直接的应对方式是选择性降低单设备内存规格(De-speccing)。以英伟达 Rubin 架构为例,单机架 LPDDR5 容量从原计划 54TB 降至 28TB,单 GPU HBM 容量从 288GB 下调至 192GB,通过降低内存堆叠高度保障整机出货量。大摩指出,降配并非消除内存瓶颈,而是将压力在内存层级间转移:削减高速本地内存后,KV 缓存等非高频数据向 NAND 存储下沉,同时跨 GPU 数据交互增加,带动对网络互联带宽的需求,本质上是以更高速的网络互联、更低成本的存储资源,补充稀缺的高带宽内存。第二条破局路径是推理架构解耦(Disaggregation)。AI推理包含预填充(Prefill)与解码(Decode)两个差异显著的阶段:Prefill 以算力消耗为主,Decode则高度依赖内存带宽。传统架构用同一加速器兼顾两类任务,资源利用率偏低。当前行业正加速走向异构推理,将两个阶段拆分至不同硬件:算力密集型Prefill由通用GPU承担,内存带宽密集型 Decode 则由搭载大容量片上 SRAM 的专用加速芯片处理。典型代表包括Cerebras的晶圆级引擎、英伟达收购的 Groq LPU 架构,均能在解码阶段提供远超传统 GPU 的内存带宽效率。大摩认为,异构推理将成为 AI 基础设施的重要演进方向,专精解码环节的算力厂商将获得明确的增量市场。第三条路径是 CXL 技术重构内存体系。CXL(计算高速互联)通过高速互联实现内存的扩展、共享与池化,让内存不再绑定单一处理器,成为突破内存容量约束的核心技术路径。大摩测算,AI需求将推动 CXL 及相关内存附加芯片市场规模在 2030 年达到约 60 亿美元,远超传统 CPU 内存扩展市场体量。其核心价值在于构建分层内存架构:最高频数据保留在HBM,次高频数据放入 CXL 内存池,低频冷数据下沉至 NAND,用成本梯度匹配数据访问频率。投资主线方面,大摩重申三大方向:一是继续超配美光、闪迪,降配源于供给短缺而非需求走弱,AI内存需求长期向上,供给缺口将持续消化产能;二是布局 CXL 与 scale-up 互联龙头 Astera Labs、Marvell;三是关注异构推理受益者Cerebras,以及通过收购Groq完善异构布局的英伟达。风险提示:AI 算力需求增速不及预期;CXL 技术落地进度慢于预期;内存产能扩张超预期。","news_type":1,"symbols_score_info":{"MUYY":0.6,"SNDC":0.6,"LABX":0.6,"SNDK":2,"ALA":0.6,"MUZ":0.6,"MU":2,"SNDG":0.6,"SNXX":0.6,"SNDU":0.6,"MUD":0.6,"ALAB":2,"MIC":0.6,"MUG":0.6,"MUU":0.6,"SNDQ":0.6,"MULL":0.6}},"isVote":1,"tweetType":1,"viewCount":82,"commentLimit":10,"likeStatus":false,"favoriteStatus":false,"reportStatus":false,"symbols":[],"verified":2,"subType":0,"readableState":1,"langContent":"CN","currentLanguage":"CN","warmUpFlag":false,"orderFlag":false,"shareable":true,"causeOfNotShareable":"","featuresForAnalytics":[],"commentAndTweetFlag":false,"andRepostAutoSelectedFlag":false,"upFlag":false,"length":14,"optionInvolvedFlag":false,"subscribersOnly":false,"subscribersOnlyAccessible":false,"xxTargetLangEnum":"ZH_CN"},"commentList":[],"isCommentEnd":true,"isTiger":false,"isWeiXinMini":false,"url":"/m/post/615228896285592"}
精彩评论