Re: [請益] 算力需求到底是缺還是快飽和了?

看板Stock作者 (嘴砲無雙)時間1月前 (2026/07/03 05:00), 1月前編輯推噓92(986197)
留言301則, 116人參與, 4周前最新討論串7/18 (看更多)
※ 引述《maplefff (降息の恐怖嘎鱷)》之銘言: : ※ 引述《soga0806 (巴歐薩給路嘎)》之銘言: : : 如題 : : 七巨頭不是狂支出砸基建嗎 : : 怎麼不到一個月 : : Meta跳出來說算力過剩 : : 還可以租給別人了 : : 真的假的啊? : : 鏟子股天花板快到極限了嗎 : : ---- : : Sent from BePTT on my iPhone 11 : 這要從兩個層面去分析當前現況: 模型層 和 雲基礎設施層 : 如果只評估最能盈利的toB coding方向, 目前主要LLM提供商能力大致如下 : Anthropic > OpenAI >>>> Gemini >= 中國模型 > grok, meta, others : 模型層營收開始出現顯著分化, 開始往兩超集中, 並且愈來愈集中的態勢 : 模型商品化, 白菜化的敘事落空, 市場看法逐漸轉向並不是花大錢, 疊加算力 : 就能得到前沿模型能力. 前沿LLM供應商保有足夠多的隱秘知識, 並逐漸壟斷市場 : 這表示Anthropic, Open AI 營收增速高100%, 毛利率60%~高70%可能是可持續的 : 能見度至少有半年, 並可能延長到1~2年以上 : 模型層的高毛利使得模型供應商有能力支付高溢價購買算力 : 所以高毛利會逐漸傳導到雲基礎設施供應商, 大幅改善4大CSP業者的現金流 : 並繼續推動AI基礎設施的擴充 : 這裡有幾個消息或資訊可以應證該推論 : 1. AWS 7/1開始對EC2 ML服務直接漲價20%: : 這是既26年1月調漲15%, 最新一輪的漲價; 並且漲幅比之前更大, 年內累積漲幅達38%. : H100(P5)報價: : 1月前: ~$3.8/hr 1~6月:~$4.3/hr 7月: ~$5.2/hr : H200(P5e)報價: : 1月前: ~$4.3/hr 1~6月:~$5.0/hr 7月: ~$6.0/hr : B200(P6-B200)報價: : 1月前: NA 1~6月:~$10.3/hr 7月: ~$12.4/hr : 2. Vast.ai上的價格: : Vast.ai是目前市場上最大的P2P GPU租賃平台, 其代表的意義是GPU租賃地板價 : 因為市場肯定是從: 四大CSP -> NeoCloud -> Vast.ai等另類平台 : 這樣的順序去依序尋找算力,上一層價格太貴才會往下找, 所以價格對需求外溢 : 的敏感度會非常高. : Vast.ai另外一個好處是價格是即時撮合出來並留有歷史季度 : https://vast.ai/pricing/gpu/B200 : 可以看到價格從1月開始逐步緩漲, 到5月矽谷開始Tokenmaxing狂潮, : 價格中價暴漲將近100%, 然後逐漸回歸理性, 但年內依然累積60%左右漲幅 : 最後結論一下:總得來講LLM市場競爭正在逐漸去泡沫, 淘汰實力較弱的參與者 : 並轉向合理的寡頭壟斷, 這使得LLM行業能保持合理毛利率, 並逐漸擴散到整體相關行業 : 在模型層失利的廠商, 透過轉化現有GPU去基礎設施層改善現金流和資產價值 : 是理性的雙贏選擇, 推論其為泡沫破裂的早期徵兆是嚴重滑坡 : CSP, NV股價有被低估, 記憶體股價低得誇張, 可以攤平購買 先說結論, 算力還是很缺, 記憶體, 尤其是DRAM, 還是很缺 詳細原因, 我在幾個星期前有解釋過 https://www.ptt.cc/bbs/Stock/M.1782458086.A.529.html 撇開不能說, 以及家醜不能外揚的部分, 可惜這部分才是最精彩的地方, 我說的都是我在業界現在正在看到的情況 從去年下半年開始, 尤其Gemini 追上 OpenAI Claude 之後, LLM 訓練部分已經不是瓶頸, 因為各家大模型現在訓練出來都差不多聰明, 沒有到差距很大, 如果你有感覺差距很大, 那是信仰的問題, 當然Claude 在 coding 這塊是真的強也真的好用, 這些就不多說, 會引戰 反正去年下半年之後, 主戰場就轉移到推理inference 上面, 也就是AI API token 等應用層面上, 而inference 推理市場是訓練市場的百倍千倍以上, 所以怎麼可能會算力過剩, 推理應用市場所需要的算力遠遠不足, 你看Gemini 現在的表現就知道推理的算力還是不足 Meta 跟 xai 算力出租代表的是他們退出AI訓練競爭, 也就是退出AI 模型競爭, 轉型成為資料中心的包租公, 你就想成像是類似ORCL Corewave等公司的形式, 不開發模型, 單純出租算力 這不表示算力過剩, 只是表示他們退出AI模型競爭, 現在算力都用在推理inference, 用在每一筆AI API token, 也就是真正能生出錢的地方, 只要token 還有需求, 算力就會有需求 除了谷歌之外, 模型商跟CSP廠是各自有自己的算盤, 以CSP廠的角度, 包含Meta xai+cursor等, 他們的商業想法是, 如果以後每一個模型都差不多一樣聰明, 那麼真正有議價權跟控制權的是掌握算力的一方, 也就是CSP廠, cursor 套皮可以隨意轉換任何模型, CSP廠跟meta 等算力出租公司, 可以壓低模型價格可以用自己的算力去議價 在模型商的想法是相反, 如果模型商能出一個遙遙領先最聰明的模型, 甚至是AGI, 那麼有議價權跟控制權的是這個唯一的AGI 模型, 他們可以隨意轉換CSP廠壓低算力價格, 最好的例子就是OpenAI 怎麼去凹 微軟跟ORCL的算力 所以這很難說 誰會勝出, 你覺得以後會有唯一的AGI真神模型, 還是以後所有的模型都差不多一樣聰明的爛大街模型, 我沒有答案就是了 Anyway, 扯遠了, 反正訓練模型只剩三家在玩, 但是inference 推理市場是百家爭鳴, 賣token 的是算力遠遠不足, 而其中, DRAM 對inference 的需求會遠高於HBM, ASIC 對inference 的需求會遠高於GPU, 這道理就是量大管飽, API token 要的就是量大管飽, 速度差一點沒關係 或者我們用生活上的例子來說明, 台北到高雄, 你可以選擇坐飛機, 坐高鐵, 坐台鐵, 開法拉利, 開Toyota, 甚至可以選擇坐統聯, 或是騎腳踏車一日雙城, 這跟你的乘客量還有票價有很大的相關性, inference 推理的API token 要的就是量大管飽, 每個token 的單價要壓到最低, 吞吐量要最大, 所以訓練是開法拉利, 推理是坐公車, 訓練是坐飛機, 推理是搭公車 -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 76.103.225.6 (美國) ※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1783026002.A.B3B.html

07/03 05:04, 1月前 , 1F
謝謝分享 99記憶卡蛙QQ
07/03 05:04, 1F

07/03 05:15, 1月前 , 2F
Mete明明是說如果過有富裕會出租目前還沒有自己用
07/03 05:15, 2F

07/03 05:15, 1月前 , 3F
不完的算力直接被標題找理由長多殺爛散戶被騙出來多
07/03 05:15, 3F

07/03 05:15, 1月前 , 4F
殺多
07/03 05:15, 4F

07/03 05:18, 1月前 , 5F
推淺顯易懂的解釋
07/03 05:18, 5F

07/03 05:19, 1月前 , 6F
華爾街一定知道算力不夠 吵算力過剩的都是假議題
07/03 05:19, 6F

07/03 05:24, 1月前 , 7F
重點還是在押注巨頭會不會減少資本支出 整體Ai軟體
07/03 05:24, 7F

07/03 05:24, 1月前 , 8F
部分賺的錢夠不夠支撐硬體的支出 不然借錢蓋資料中
07/03 05:24, 8F

07/03 05:24, 1月前 , 9F
心稀釋股權 股東早晚會抗議
07/03 05:24, 9F

07/03 05:45, 1月前 , 10F
感謝W大解釋 不過目前記憶體三星海力士美光都是偏向
07/03 05:45, 10F

07/03 05:46, 1月前 , 11F
HBM 那也就是之後他們會看情況再回頭做DRAM了
07/03 05:46, 11F
最近業界給美光的訂單大部分都是DRAM, 尤其inference大部分都是Dram

07/03 05:47, 1月前 , 12F
記憶卡蛙已經滿手血 每天只有更低
07/03 05:47, 12F

07/03 05:49, 1月前 , 13F
07/03 05:49, 13F

07/03 05:51, 1月前 , 14F
記憶體很缺 但中環賣軟鋼還賠錢?
07/03 05:51, 14F
※ 編輯: waitrop (76.103.225.6 美國), 07/03/2026 05:59:50

07/03 05:59, 1月前 , 15F
LLM絕對生不出AGI
07/03 05:59, 15F

07/03 05:59, 1月前 , 16F
過度投資而產出的低差異化在27 28 29年會讓半導體
07/03 05:59, 16F

07/03 06:00, 1月前 , 17F
跌掉接近90%
07/03 06:00, 17F

07/03 06:02, 1月前 , 18F
記憶體真的很缺啊,而且記憶體很容易就變成軟體效
07/03 06:02, 18F

07/03 06:02, 1月前 , 19F
能的最大瓶頸 -- PTT 當年能成為全台灣甚至全世界
07/03 06:02, 19F

07/03 06:02, 1月前 , 20F
承載同時上線人數最多的 BBS, 很大部份原因就是狠
07/03 06:02, 20F

07/03 06:02, 1月前 , 21F
狠地把記憶體加好加滿...
07/03 06:02, 21F

07/03 06:04, 1月前 , 22F
算力很缺,所以出租不是更划算嗎
07/03 06:04, 22F
是呀! 我沒有說META的決定不對, 如果模型拼不過別人, 本來就是早點認輸改出租更划算 我也都分析了模型商跟CSP+META+xai 他們各自盤算, 這其中, 只有谷歌是被逼著必須去比拼模型, 其他人沒有這壓力, 認輸出租算力對他們完全沒影響 ※ 編輯: waitrop (76.103.225.6 美國), 07/03/2026 06:12:05

07/03 06:09, 1月前 , 23F
因為阿祖軟體不行 她25年前交友軟體可能世界第一
07/03 06:09, 23F

07/03 06:16, 1月前 , 24F
但能用HBM誰會用DRAM 除非說KV Cache用的HBM真的貴
07/03 06:16, 24F

07/03 06:16, 1月前 , 25F
用不了了?
07/03 06:16, 25F

07/03 06:18, 1月前 , 26F
阿祖就是姑姑說的 七巨頭 聖杯戰爭中的魔術師~~
07/03 06:18, 26F

07/03 06:19, 1月前 , 27F
一開始最華麗 但也是第一個被幹掉的~~
07/03 06:19, 27F

07/03 06:25, 1月前 , 28F
有沒有可能去高雄根本就是個錯誤的選項?
07/03 06:25, 28F

07/03 06:27, 1月前 , 29F
相當於阿祖買了10萬台電腦 現在變成一萬間網咖出租
07/03 06:27, 29F

07/03 06:27, 1月前 , 30F
韓國男人 25歲~~35歲歐巴正五買太多 跌5%就熔斷惹
07/03 06:27, 30F

07/03 06:27, 1月前 , 31F
對啊 怎麼不去台中要去高雄
07/03 06:27, 31F

07/03 06:30, 1月前 , 32F
台中 高雄 不好玩,為何還要去
07/03 06:30, 32F

07/03 06:31, 1月前 , 33F
目標 的使用者是誰 去到哪 是他們在決定的
07/03 06:31, 33F

07/03 06:32, 1月前 , 34F
07/03 06:32, 34F

07/03 06:32, 1月前 , 35F
當阿祖用租就好,幹啥投資?
07/03 06:32, 35F

07/03 06:32, 1月前 , 36F
我們覺得高雄不好玩,去幹嘛,現在弄一堆垃圾,有
07/03 06:32, 36F
還有 226 則推文
07/03 09:41, 1月前 , 263F
因為meta沒人要用,賣了止損
07/03 09:41, 263F

07/03 09:48, 1月前 , 264F
合理
07/03 09:48, 264F

07/03 09:55, 1月前 , 265F
G可以日常生活用就好 A寫Code O 蛋掉
07/03 09:55, 265F

07/03 09:58, 1月前 , 266F
一堆錯誤
07/03 09:58, 266F

07/03 09:59, 1月前 , 267F
缺電缺錢
07/03 09:59, 267F

07/03 10:02, 1月前 , 268F
樓上寫一篇啊
07/03 10:02, 268F

07/03 10:09, 1月前 , 269F
專業推
07/03 10:09, 269F
※ 編輯: waitrop (76.103.225.6 美國), 07/03/2026 10:10:52

07/03 10:11, 1月前 , 270F
業界很缺便宜的蒜力 但生活上的應用在減緩中
07/03 10:11, 270F

07/03 10:23, 1月前 , 271F
救命啊 QQ
07/03 10:23, 271F

07/03 10:27, 1月前 , 272F
我只想說,算力不夠是一回事,市場還有沒有錢買算力
07/03 10:27, 272F

07/03 10:27, 1月前 , 273F
是一回事
07/03 10:27, 273F

07/03 10:29, 1月前 , 274F
如果使用方的錢無限,我想信算力的需求也無限。所以
07/03 10:29, 274F

07/03 10:29, 1月前 , 275F
算力夠不夠取決於使用方的錢夠不夠
07/03 10:29, 275F

07/03 10:32, 1月前 , 276F
不用寫一篇叫AI幫你查證就知道了
07/03 10:32, 276F

07/03 10:39, 1月前 , 277F
廢文
07/03 10:39, 277F

07/03 11:01, 1月前 , 278F
問了一堆,訂閱了沒?
07/03 11:01, 278F

07/03 11:09, 1月前 , 279F
我知道的meta 不是這樣反而是他們有巨大突破不需要
07/03 11:09, 279F

07/03 11:09, 1月前 , 280F
那麼多算力
07/03 11:09, 280F

07/03 11:11, 1月前 , 281F
花幾億美元挖來一堆華人大神這一年真的搞出很多成
07/03 11:11, 281F

07/03 11:11, 1月前 , 282F
績所以才裁員八千人因為它們做的AI 真的能取代很多
07/03 11:11, 282F

07/03 11:11, 1月前 , 283F
職位
07/03 11:11, 283F

07/03 11:12, 1月前 , 284F
業界推
07/03 11:12, 284F

07/03 11:39, 1月前 , 285F
謝謝分享
07/03 11:39, 285F

07/03 11:50, 1月前 , 286F
07/03 11:50, 286F

07/03 11:58, 1月前 , 287F
推 謝謝分享
07/03 11:58, 287F

07/03 12:15, 1月前 , 288F
阿祖就運氣好搞出FB 不然做啥都失敗
07/03 12:15, 288F

07/03 12:19, 1月前 , 289F
想問 AGI真神模型 會先出現 還是股票的聖杯會先出
07/03 12:19, 289F

07/03 12:19, 1月前 , 290F
07/03 12:19, 290F

07/03 13:19, 1月前 , 291F
你看gemini訂閱制搞那麼嚴格就知道缺不缺了,我常常
07/03 13:19, 291F

07/03 13:19, 1月前 , 292F
五小時未到就滿了= =
07/03 13:19, 292F

07/03 14:02, 1月前 , 293F
算力很充足就不會有什麼5小時跟周限制了token is mo
07/03 14:02, 293F

07/03 14:02, 1月前 , 294F
ney
07/03 14:02, 294F

07/03 14:12, 1月前 , 295F
诶乾 斷點斷得很不順 看得正過癮結果就沒了
07/03 14:12, 295F

07/03 15:42, 1月前 , 296F
想看家醜和不能說的
07/03 15:42, 296F

07/03 19:29, 1月前 , 297F
算力用量大戶未來一定有電影業,而這件事情還沒發生
07/03 19:29, 297F

07/03 19:29, 1月前 , 298F
,算力根本還遠遠不足
07/03 19:29, 298F

07/03 21:07, 1月前 , 299F
現在的大語言模型最後都會差不多拉
07/03 21:07, 299F

07/03 21:20, 1月前 , 300F
07/03 21:20, 300F

07/04 13:07, 4周前 , 301F
07/04 13:07, 301F
文章代碼(AID): #1gHj5Iix (Stock)
討論串 (同標題文章)
完整討論串 (本文為第 7 之 18 篇):
文章代碼(AID): #1gHj5Iix (Stock)