Morgan Stanley: Ang kakulangan sa AI memory ay magtatagal ng ilang taon, tatlong pangunahing direksyon para solusyunan ito, at may estruktural na oportunidad sa storage at heterogenous computing power
Ang ulat ng industriya ng semiconductor na inilabas ng Morgan Stanley ay nagsasaad na ang kakulangan sa DRAM memory ay magpapatuloy sa kasalukuyang AI industry cycle, at ang pagpapalawak ng AI computing power ay hindi maghihintay sa pagpapatayo at operasyon ng bagong wafer factories.
Nalalaman mula sa APP ng Pananalaping Matalino na naglabas ang Morgan Stanley ng ulat ukol sa industriya ng semiconductor na nagsasaad na ang kakulangan ng DRAM memory ay magpapatuloy sa kasalukuyang cycle ng AI industry, at ang pagpapalawak ng AI computing power ay hindi maghihintay para maitayo at magsimulang mag-operate ang mga bagong wafer fab. Ang industriya ay kasalukuyang gumagamit ng tatlong pangunahing teknolohikal na ruta—hardware na may pinababang specs, disaggregation ng inference architecture, at CXL memory pooling—upang lampasan ang memory bottleneck at patuloy na itulak ang pagbuo ng computing power sa kabila ng limitasyon ng suplay. Patuloy na positibo ang pananaw ng Morgan Stanley sa mga nangungunang storage gaya ng Micron (MU.US) at SanDisk (SNDK.US), at nakikita rin ang karagdagang oportunidad sa track ng CXL interconnect at heterogeneous inference, kaya inirerekomenda ang Astera Labs (ALAB.US), Marvell (MRVL.US), Cerebras (CBRS.US), at Nvidia (NVDA.US).
Binigyang-diin ng Morgan Stanley na ang kasalukuyang kakulangan ng AI memory ay hindi pansamantalang abala, kundi isang structural na kontradiksyon kung saan ang pagtaas ng performance ng computing power ay malayo ang inangat kaysa sa bilis ng pagtaas ng memory supply. Ang laki ng mga advanced na modelo ay dumodoble bawat anim na buwan, at ang growth rate ng context window ng nangungunang mga modelo ay umaabot ng 5-6 beses kada taon. Kasabay ng tuloy-tuloy na pagtaas ng demand sa inference concurrency, patuloy na sumasabog ang pangangailangan sa kapasidad at bandwidth ng memory. Gayunpaman, ang cycle ng pagtatayo ng DRAM wafer fab ay umaabot ng maraming taon at napakababa ng supply elasticity, kaya’t ang kakulangan ay magpapatuloy sa maraming taon. Hayagang sinabi ni Nvidia CEO Jensen Huang na kinakailangan ng industriya ng pagbabago ng mindset, na dapat labanan ang memory constraint sa pamamagitan ng architectural innovation at hindi basta maghintay lamang sa pagpapalawak ng kapasidad.
Sa harap ng mahigpit na supply ng HBM at pangunahing memory, ang pinaka-direktang paraan ng industriya ay ang pagpili ng selective na pagbaba ng memory specs ng kada device (De-speccing). Halimbawa, sa Nvidia Rubin architecture, ang kapasidad ng on-board LPDDR5 ng isang device ay mula sa dating plano na 54TB naibaba sa 28TB, ang kapasidad ng HBM ng bawat GPU mula 288GB ay binaba sa 192GB, upang mapanatili ang kabuuang bilang ng shipment sa pamamagitan ng pagpapababa ng memory stack height. Pinunto ni Morgan Stanley na ang pagbaba ng specs ay hindi nag-aalis ng memory bottleneck kundi inililipat ang pressure sa pagitan ng memory layers: pagkatapos bawasan ang high-speed local memory, ang mga hindi high-frequency data gaya ng KV cache ay inililipat sa NAND storage, habang lumalakas ang inter-GPU data interaction na nagpapataas ng demand sa network interconnect bandwidth. Sa esensiya, ito ay pagpapalawak ng high-bandwidth memory gamit ang mas mabilis na network interconnect at mas murang storage resources.
Ang ikalawang paraan ng paglabas sa bottleneck ay ang inference architecture decoupling (Disaggregation). Binubuo ang AI inference ng dalawang magkaibang yugto: Prefill (malakas ang computing power consumption) at Decode (malubha ang pagdepende sa memory bandwidth). Noon, ginagamit ng tradisyunal na arkitektura ang iisang accelerator para sa parehong tasks, kaya mababa ang resource utilization. Sa kasalukuyan, mabilis na tinatahak ng industriya ang heterogeneous inference, pinaghihiwalay ang dalawang yugto sa magkaibang hardware: ang computation-intensive na Prefill ay handled ng general-purpose GPU, samantalang ang memory bandwidth-intensive na Decode ay sinasagawa ng specialized na acceleration chips na may malalaking on-chip SRAM.
Kasama sa mga tipikal na halimbawa ang wafer-scale engine ng Cerebras at ang Groq LPU architecture na binili ng Nvidia, na parehong kayang magbigay ng memory bandwidth efficiency na labis pa sa tradisyunal na GPU tuwing decode phase. Naniniwala ang Morgan Stanley na ang heterogeneous inference ay magiging mahalagang direksyon ng ebolusyon ng AI infrastructure, at ang mga computation power manufacturers na nakatutok sa decode phase ay makakakuha ng malinaw na karagdagang bahagi sa merkado.
Ang ikatlong ruta ay ang CXL technology na muling nag-oorganisa ng memory system. Ang CXL (Compute Express Link) ay nagbibigay-daan sa memory expansion, sharing, at pooling sa pamamagitan ng high-speed interconnection, kaya hindi na nakatali ang memory sa isang processor lamang, na nagiging pangunahing teknolohikal na paraan upang lampasan ang memory capacity constraints. Tinaya ng Morgan Stanley na sa taong 2030, dahil sa AI demand, aabot ang CXL at kaugnay na merkado ng memory attachment chips sa humigit-kumulang $6 bilyon, mas malaki kaysa sa tradisyunal na CPU memory expansion market. Ang pangunahing halaga rito ay ang pagtatayo ng tiered memory architecture: ang pinakamataas na frequency na data ay nilalagay sa HBM, kasunod ang data sa CXL memory pool, at ang mababang frequency/cold data naman sa NAND—ginagawan ng cost gradient na katapat ng data access frequency.
Para sa pangunahing linya ng pamumuhunan, muling pinagtibay ng Morgan Stanley ang tatlong direksyon: Una, patuloy na over-weight ang Micron at SanDisk, dahil ang pagbawas ng specs ay dulot ng kakulangan ng suplay hindi ng paghina ng demand; pangmatagalan ang pag-angat ng AI memory demand at ang kakulangan sa suplay ay patuloy na sisipsipin ang kapasidad. Ikalawa, mag-invest sa CXL at mga scale-up interconnect leaders gaya ng Astera Labs at Marvell. Ikatlo, bigyang pansin ang mga makikinabang sa heterogeneous inference gaya ng Cerebras, pati na ang Nvidia na pinahusay ang heterogeneous layout sa pamamagitan ng pag-acquire sa Groq.
Babala sa panganib: Ang pagtaas ng demand para sa AI computing power ay maaaring bumagal kaysa sa inaasahan; ang implementation ng CXL technology ay mas mabagal kaysa sa inaasahan; ang pagpapalawak ng kapasidad ng memory ay lumagpas sa inaasahan.
Disclaimer: Ang nilalaman ng artikulong ito ay sumasalamin lamang sa opinyon ng author at hindi kumakatawan sa platform sa anumang kapasidad. Ang artikulong ito ay hindi nilayon na magsilbi bilang isang sanggunian para sa paggawa ng mga desisyon sa investment.
Baka magustuhan mo rin
Ngayong taon, mga tech na bilyonaryo lang ang kumikita: Lumobo ang kanilang yaman ng $845 bilyon dahil sa AI craze, halos 40% dito ay napunta kay Musk
Ayon sa Bloomberg Billionaires Index, sa 500 pinakamayayamang tao sa mundo, humigit-kumulang 100 na bilyonaryo mula sa industriya ng teknolohiya ang tumaas ang pinagsamang yaman ng $845 bilyon sa unang siyam na buwan ng taon, na siyang pinakamataas na rekord sa kasaysayan para sa parehong panahon. Samantala, ang pinagsamang kayamanan ng mga bilyonaryo sa larangan ng hindi teknolohiya ay nabawasan ng $62 bilyon sa parehong panahon. Si Musk lamang ay nadagdagan ang kanyang yaman ng $310 bilyon sa unang siyam na buwan, na humigit-kumulang 40% ng kabuuang pagtaas sa index.
Pagkatapos ng paglabas ng reserba ng G7, si Trump ay muling kumilos upang pababain ang presyo ng langis bago ang pagpili: Iniuulat na balak niyang luwagan ang limitasyon sa paggamit ng "red diesel" na walang buwis.
Ayon sa ulat, inaasahan ng administrasyong Trump na ilalabas ang kaugnay na plano sa lalong madaling panahon ngayong Lunes, at maaaring palawakin ang paggamit ng pulang diesel sa mga sasakyang pampubliko sa kalsada. Noong nakaraang Biyernes, inihayag ng G7 na maglalabas sila ng 100 milyong bariles ng emergency oil reserves at maglalabas ng malaking dami ng diesel sa loob ng unang 20 araw. Sinabi pa ni Trump na hindi na ipatutupad ng Amerika ang diesel export ban, at may malalaking reserba ng diesel ang Europa habang magdadagdag din ng suplay ang Amerika.
Ang pagbebenta ng US Treasury ay nagtulak sa mga yield sa pinakamataas na antas sa loob ng mga dekada Citadel: Ang paglago ng ekonomiya at AI na mga pamumuhunan ay nagpapalala sa kompetisyon ng kapital
Naniniwala ang Citadel Securities na ang kamakailang pagbebenta ng US Treasury, kung saan tumaas ang yield sa pinakamataas sa loob ng dekada, ay hindi pangunahing dulot ng pangamba ng merkado sa paglala ng inflation, kundi dahil sa patuloy na malakas na paglago ng ekonomiya ng Amerika, pati na rin sa investment sa artificial intelligence (AI) at lalong tumataas na deficit ng gobyerno na nagpapalakas ng kompetisyon para sa kapital.
Ang kawalang-katiyakan sa pananalapi at politika sa Pransya ay nakaapekto sa sektor ng pananalapi! Tumaas ang tatlong pangunahing sukat ng panganib sa kredito ng mga bangko at kapansin-pansing tumaas ang gastos ng insurance laban sa default ng bond.
Habang lumalawak ang pag-aalala ng merkado sa kalagayang pinansyal at pampulitika ng Pransya sa credit market, kapansin-pansing tumaas ang mga indikasyon ng panganib sa kredito ng mga bond ng malalaking bangko sa Pransya.
