三星高層揭AI瓶頸:轉向記憶體運算與先進
在老黃定律沒出現前 運算效能大體就是照摩爾定律走
直到老黃提了個老黃定律 就是GPU計算效能每兩年翻倍
(或者有人認為老黃曾說過 智慧(AI)晶片的效能每十年會提升 1,000 倍 )
從早期顯卡TNT那款開始 老黃的算力就是系統上 軟體硬體多核 去達到這效果
現在的GenAI的核心就是Autoregressive 簡單說就是token資訊是一顆顆產
因此算力和記憶體坪寬速度 可以互換
白算盤說過 你資訊產量 可以用很少記憶體 但是每次需要資訊重新計算就好
這就是透過大量算力換取記憶體小
反之 你也可以透過記憶體把事先資訊記憶好 不用重複計算 這就是用大量記憶換算力
現在的趨勢很明顯 你的算力在製程和架構上(比方GB200 拿兩個晶片 先進封裝合體)這是個有極限 那按照老黃定律 算力就是系統整合的優化表現
那最簡單提高算力就是 把記憶體坪寬速度再追加 所以有了HBM 透過記憶體加速
然後記憶體要再加大加快 就是把HBM的層數往上疊 又或者最近的NVHBM
那就是把控制放到記憶體那邊 直接硬生生提高記憶體傳輸速度
這種系統層面就老黃強項啊 以前單顆晶片算力快 很多人當初吹得比老黃單晶片快但拉到Data Center 老黃就是比人家強 靠者NVLink 一堆串連
就能提供整體算力比別家快 老黃就喜歡拉者一堆供應鏈整合
去痛揍競爭對手 從用台積電產能卡蘇媽 當年就玩過一次
現在老黃想要靠算力去揍人 就是走記憶體坪寬速度 這條路好處是 現在供應鏈都老黃人日本韓國台灣 先進製程 ABF HBM 很早就有人說過算力大戰就是當年顯示卡算力大戰當年老黃拉者技嘉 微星 一票OEM 去胖揍3DFX這個自己想搞自己品牌顯卡
老黃定律 這條路只是重新再走過一次 AI晶片大戰 這就是意味者 算力(超級電腦)是一個軟體硬體全面整合的結果 這條路的終點 就是資料中心的建成
你其他算力小隊 只能靠架構去打 如果也要靠系統整合去提高算力 就會被HBM/ABF先進製程 台積產能 這些廠商供應鏈卡死 我現在不買老黃是因為我已經有夠多老黃加上他市值太大 沒有敷糗了
所以我寧願賭蘇媽 蘇媽不可能會輸的 喊出我立志餘生不再為哈佛MBA工作
這個公司一定能上2T 是不可能會輸的QQ 狗家就純生態圈 TPU就算是老二老三也不影響他就是那個狗家聖殿
算力以後主流現在一定是朝坪寬速度這個來 存<->算 互換 就是記憶卡哇算力卡哇未來坪寬速度你可以靠疊加HBM 老黃只是走了另一條捷徑 把控制器放到HBM 加快速度
這另一個好處就是 你家的HBM客製化給老黃用後 其他算力小隊是不能直接用
我看不懂這zHBM
現意思是出現NVHBM可跟邏輯閘GPU搭讓三星嚇到要自創新規格意思?
畢竟記憶體離GPU太遠會拖慢運算效率?
強者解釋一下
--