作者查詢 / pxhome
作者 pxhome 在 PTT 全部看板的留言(推文), 共25881則
限定看板:全部
看板排序:
全部PC_Shopping12745HatePolitics5946Gossiping4314Railway1025iOS926Examination255Coffee139MobileComm109LCD70Storage_Zone68transgender44TY_Research44LoL21hardware15MRT14PublicIssue14C_Chat11ArenaOfValor8Sub_DigiLife8RealmOfValor7VideoCard6AI_Art5Baseball5Stock5TW-language5HardwareSale4SET4Windows4Boy-Girl3Comic3marvel3Road3Tech_Job3WomenTalk3Audiophile2Aviation2CrossStrait2Gov_owned2IA2L_TalkandCha2MAC2PingTung2PublicServan2sex2SuperJunior2Tainan2Test2Beauty1ChainChron1Chiayi1cksh79th3101consumer1e-shopping1EarthQuake261EarthQuake431Eng-Class1GossipPicket1License1Notebook1PlayStation1Taoyuan1Teacher1Wallpaper1<< 收起看板(63)
100F推: 2400性能還夠用,單純是Zen1太廢了,只要36.230.189.233 07/27 07:39
101F→: 更換5600X3D即可36.230.189.233 07/27 07:39
102F→: 5500時脈太低,掛上X3D還是不夠力36.230.189.233 07/27 07:39
103F→: 有錢當然上5836.230.189.233 07/27 07:40
104F→: 顯示卡上9700會比較好,9600的算力跑4X生36.230.189.233 07/27 07:43
105F→: 成式補幀不太夠36.230.189.233 07/27 07:43
106F→: 不用到XT,GRE即可36.230.189.233 07/27 07:44
22F推: 現在還買的到沒漲價的5090?36.230.155.154 07/25 16:51
23F→: 御三家5060Ti 8GB帝版都開價破兩萬了,這36.230.155.154 07/25 16:51
24F→: 波5060以上全漲…36.230.155.154 07/25 16:51
25F→: 漲幅可能不只20%36.230.155.154 07/25 16:51
26F→: 直接買RTX Pro反而可能會比較便宜36.230.155.154 07/25 16:52
38F→: 真的已經破兩萬了! 廠家偷跑漲價後的價36.230.155.154 07/25 17:20
39F→: 錢36.230.155.154 07/25 17:20
40F→: 5060Ti 16GB上看2萬4, 首波還有送贈品,36.230.155.154 07/25 17:23
41F→: 之後就… 等等黨必敗36.230.155.154 07/25 17:23
122F推: AMD全線使用GDDR6漲個屁!GDDR6 256B= GDD36.230.155.154 07/25 17:06
123F→: R7 128B36.230.155.154 07/25 17:06
124F→: GDDR7的延遲又比同時脈的GDDR6低了20%,36.230.155.154 07/25 17:06
125F→: 更適合跑AI36.230.155.154 07/25 17:06
60F推: 5060Ti 16GB標準雙槽的已經下架, 剩下不36.230.155.154 07/25 16:54
61F→: 是2.5槽的垃圾,就是已經比5070還要貴36.230.155.154 07/25 16:54
62F→: 振華那款金牌1300W性價比比較高,反正會燒36.230.155.154 07/25 16:55
63F→: 的就是會燒36.230.155.154 07/25 16:55
26F→: 2033晚57分….天啊07/24 18:44
27F→: 2033晚57分….天啊!07/24 18:45
28F→: https://i.mopix.cc/ASp7t3.jpg07/24 18:46
67F推: 再買兩張回來壓壓驚101.10.158.84 07/24 12:46
63F→: 8月1日大限…101.10.158.84 07/24 12:44
21F推: 這顆CPU很熱, 4導熱管會壓不住, 5導熱36.230.139.227 07/20 13:49
22F→: 管又會卡記憶體36.230.139.227 07/20 13:49
23F→: ,很難辦! 不想卡構件只有水冷36.230.139.227 07/20 13:49
24F→: 我之前用36.230.139.227 07/20 13:51
25F→: Royal Knight 120 (RK120)36.230.139.227 07/20 13:51
26F→: 不會卡記憶體很不錯,但是壓不住熱情36.230.139.227 07/20 13:51
27F→: 改用PA120 Miniㄧ樣不會卡記憶體, 變成36.230.139.227 07/20 13:54
28F→: 單風扇 一樣壓不住,36.230.139.227 07/20 13:54
29F→: 只要100%輕輕鬆鬆超過70度。36.230.139.227 07/20 13:54
30F→: 不上水冷就只能盡量不要重運算36.230.139.227 07/20 13:54
31F→: https://i.mopix.cc/lWqJnQ.jpg36.230.139.227 07/20 14:00
32F→: 有圖有真相,A粉別嘴我沒有用過瞎猜!36.230.139.227 07/20 14:00
33F→: 其實AMD很涼快,會爆熱是自己散熱沒裝好36.230.139.227 07/20 14:01
13F推: 跳槽AMD AM4 583D或者59XT49.216.53.137 07/16 18:32
14F→: 12700那個小核是廢物49.216.53.137 07/16 18:33
15F→: ROG B550或X57049.216.53.137 07/16 18:34
81F推: 你聽好了,你的目標是跑AI,36.230.161.245 07/06 19:58
82F→: 要以GPU優先,其他的CPU & DDR是第幾代的36.230.161.245 07/06 19:58
83F→: 通通都不是重點。36.230.161.245 07/06 19:58
84F→: 第一主機板一定要找有兩條PCIe X16插槽的36.230.161.245 07/06 19:58
85F→: ,VRAM是你的一切這很重要!36.230.161.245 07/06 19:58
86F→: GPU請直接拿買N卡, 至少遇到問題用GPT還36.230.161.245 07/06 19:58
87F→: 能快速幫你解決。36.230.161.245 07/06 19:58
88F→: N卡在雲端上的分支計畫資源最豐富,實裝36.230.161.245 07/06 19:58
89F→: 難度也最小,還有NVIDIA 提供的集裝箱,下36.230.161.245 07/06 19:58
90F→: 載及用,省下為了最佳化重新編譯的時間也36.230.161.245 07/06 19:58
91F→: 不用擔心安裝後搞亂系統,讓你把精力放在36.230.161.245 07/06 19:58
92F→: 產出的品質上。36.230.161.245 07/06 19:58
93F→: 驅動還是工具鏈穩定是必須的,在這個基礎36.230.161.245 07/06 19:58
94F→: 上你才能針對需求去切換效果更好的模型。36.230.161.245 07/06 19:58
95F→: 比如說無道德審查模型,量化版的A卡沒有幾36.230.161.245 07/06 19:58
96F→: 個能用。36.230.161.245 07/06 19:58
97F→: 最後別被I卡的VRAM給騙了,B70 32GB漲價36.230.161.245 07/06 19:58
98F→: 後的價錢都可以買兩張5060 Ti 16GB,實際36.230.161.245 07/06 19:58
99F→: 上就只是一張吃電290W的3060Ti,算力還不36.230.161.245 07/06 19:58
100F→: 如5050。36.230.161.245 07/06 19:58
101F→: 更別提5060Ti X2這個高CP值的組合,NVFP436.230.161.245 07/06 19:58
102F→: 用對量化模型產出可以妣美4090,遇到只有F36.230.161.245 07/06 19:58
103F→: P8的老模型打開FlashAttention 3也可以追36.230.161.245 07/06 19:58
104F→: 平3090。36.230.161.245 07/06 19:58
105F→: DDR4 2133 ECC 16GBX4 (6千NTD有找)36.230.161.245 07/06 19:58
106F→: 5900XT & X570 WS ACE看看還能不能搞到手36.230.161.245 07/06 19:58
107F→: 。36.230.161.245 07/06 19:58
108F→: DDR3 1866四通道(頻寬接近D5 6K雙通道)36.230.161.245 07/06 19:58
109F→: 但是有些人無法接受洋垃圾,對於DRAM組建236.230.161.245 07/06 19:58
110F→: 56GB的成本最低是事實啊!36.230.161.245 07/06 19:58
111F→: MoE模型相對於稠密模型來說,每次獲得到36.230.161.245 07/06 20:03
112F→: 的結果差異性很大36.230.161.245 07/06 20:03
113F→: 你將來一定會被B70單卡的推理速度慢到受36.230.161.245 07/06 20:09
114F→: 不了,再加一張B70讓算力達到9070XT單卡36.230.161.245 07/06 20:09
115F→: 的水平。36.230.161.245 07/06 20:09
116F→: 32GB通常都是跑30-35B36.230.161.245 07/06 20:22
120F→: 這不是笑話,自己找圖比較36.230.138.251 07/07 03:43
121F→: 一樣的GDDR7 128Bit =896 bit GDDR6 256Bi36.230.138.251 07/07 03:43
122F→: t36.230.138.251 07/07 03:43
123F→: 那個896是AI亂加的XD36.230.138.251 07/07 03:45
124F→: 1866四通道60GB/s(X79)36.230.138.251 07/07 03:54
125F→: ,6000雙通道只有47GB/s因為你用的是AMD36.230.138.251 07/07 03:54
126F→: 9600X & DDR5 6000已經測到爛了36.230.138.251 07/07 03:56
127F→: AMD因為IO Die和IF總線,雙通道沒有吃滿,36.230.138.251 07/07 03:58
128F→: 記憶體性能下降25%左右。 算AI還是挑Intel36.230.138.251 07/07 03:58
129F→: 比較適合36.230.138.251 07/07 03:58
130F→: 挑便宜的買即可36.230.138.251 07/07 04:11
146F→: 張量平行是假議題,Ollama用對模型也可以49.216.181.198 07/07 12:49
147F→: 破百Tokens /s, 5060Ti 16GB X2根本不用49.216.181.198 07/07 12:49
148F→: 去考慮.cpp還是vLLM49.216.181.198 07/07 12:49
149F→: RTX50初始算力高有本錢折騰,不用搞那些49.216.181.198 07/07 12:53
150F→: 花里胡俏的,把FlashAttention打開性能自49.216.181.198 07/07 12:53
151F→: 然就出來49.216.181.198 07/07 12:53
152F推: PCIe減損也不用擔心,只要PCI error值為零49.216.181.198 07/07 12:56
153F→: , 就算用老舊的PCIe2.0X8對性能影響也不49.216.181.198 07/07 12:56
154F→: 到5%。49.216.181.198 07/07 12:56
155F推: 以5060Ti來說,用Ollama跑NV官網公告的Gem49.216.181.198 07/07 13:13
156F→: ma4 26B如果是線性成長,單卡40T雙卡80T四49.216.181.198 07/07 13:14
157F→: 卡160T但實際上是單卡20T雙卡80四卡200。49.216.181.198 07/07 13:14
158F→: vllm張量平行的增加幅度還沒有這麼誇張,49.216.181.198 07/07 13:14
159F→: 我認為問題要放在第一字的回應延時,四通49.216.181.198 07/07 13:14
160F→: 道D4 2400 76.8GB/s 最快還要歷時0.9秒,49.216.181.198 07/07 13:14
161F→: 沒辦法像雲端AI那樣控制在毫秒等級,目前D49.216.181.198 07/07 13:14
162F→: 5 8800雙通道140GB/s也沒有辦法做到。49.216.181.198 07/07 13:14
168F推: 考慮高併發的話,例如3人同時上線,KV Cac36.230.138.251 07/07 15:49
169F→: he就只能限制在16K以下, VRAM佔用量增加536.230.138.251 07/07 15:49
170F→: 0%,36.230.138.251 07/07 15:49
171F→: 超長上下文比如說100K在部署上的難度顯著36.230.138.251 07/07 15:49
172F→: 增加。36.230.138.251 07/07 15:49
173F→: 因為VRAM對於本地AI是寸土寸金36.230.138.251 07/07 15:49
174F→: 所以目前我把它當單機操作,最多就是同時36.230.138.251 07/07 15:49
175F→: 執行Qwen 3.6 35B和Gemma3 27B無道德審查36.230.138.251 07/07 15:49
176F→: 模型,36.230.138.251 07/07 15:49
177F→: 框架之間的差異對我來說無感。36.230.138.251 07/07 15:49
178F→: 除非將來PEX89096 PCIe5.0 Swtich擴充板量36.230.138.251 07/07 15:49
179F→: 產,讓我可以同時使用6張5060Ti 16GB一共936.230.138.251 07/07 15:49
180F→: 6GB,這樣vLLM建立家用AI工作站才有意義,36.230.138.251 07/07 15:49
181F→: 但說不定RTX50會是末代8Pin的60Ti。36.230.138.251 07/07 15:49
182F→: 商用本地AI的話,首字回應延時必須控制在36.230.138.251 07/07 15:51
183F→: 毫秒等級, 目前的消費級的平台都不可行。36.230.138.251 07/07 15:51
184F→: 理想值是0.2-0.3秒36.230.138.251 07/07 16:47
211F→: 雙PCIe的主機板越來越少,還要跟M2共享頻36.230.138.251 07/08 06:47
212F→: 寬, 難道要拿SATA硬幹?36.230.138.251 07/08 06:47
213F推: D5 6000 雙通最多就是90GB/s 聽你在吹? A36.230.138.251 07/08 06:49
214F→: MD記憶體弱本來就是事實,有多卡需求一定36.230.138.251 07/08 06:49
215F→: 是上EPYC了, 我只是模擬PCIe2.0對產出的36.230.138.251 07/08 06:49
216F→: 影響36.230.138.251 07/08 06:49
217F推: 還說9800X3D? 我從頭到尾說的是GPU推理,36.230.138.251 07/08 06:55
218F→: CPU只是配角36.230.138.251 07/08 06:55
219F→: 首字延時不是提示詞決定,而是你一次最大36.230.138.251 07/08 06:55
220F→: 生成字數決定的,Gemma4它的上限是819236.230.138.251 07/08 06:55
221F→: 是怎樣? 講AMD不好就影響你的股價?36.230.138.251 07/08 06:57