推 kuroshizu21: 感謝分享, 推 61.227.35.125 08/27 12:41
推 hangtenboy: 我一直在糾結要不要換N卡,還是要906 101.10.5.192 08/27 12:43
→ hangtenboy: 0XT升級9070XT,原Po可以幫幫我嗎? 101.10.5.192 08/27 12:43
如果要問我一律5090
推 ack0011: 買的到買的起拿來當賺錢工具用直接買N卡 49.215.59.195 08/27 12:46
→ ack0011: ,反正還會漲 49.215.59.195 08/27 12:46
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 12:49:22
推 sheng76314: 請問能跑qwen 3.8 27b 嗎 速度大概如 101.9.35.91 08/27 12:55
→ sheng76314: 何 謝謝 101.9.35.91 08/27 12:55
本地想跑LLM
想想硬體跟電費的錢
智力也不如線上的
還是直接買API吧
推 htps0763: 千問27b要玩重點是vram,至少24-32G 101.8.78.194 08/27 13:00
→ htps0763: 才能用q4配個128k 101.8.78.194 08/27 13:00
→ spfy: LLM和繪圖不太一樣 202.173.43.207 08/27 13:06
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 13:07:03
推 hangtenboy: 謝謝原Po... 101.10.5.192 08/27 13:12
→ hangtenboy: 謝謝四樓 101.10.5.192 08/27 13:12
推 iammatrix: Failed to initialize: Bad git execu 118.171.26.180 08/27 13:16
→ iammatrix: 執行START出現ERROR 無法啟動 118.171.26.180 08/27 13:16
→ iammatrix: 'stdlib.h' file not found 118.171.26.180 08/27 13:17

推 kaj1983: 真人抓胸那片有一瞬間看到六指 36.238.159.13 08/27 13:26
→ kaj1983: 不過應該沒人在乎就是XD 36.238.159.13 08/27 13:27
推 grtfor: 感謝分享,幫助A卡用戶踏入門檻 114.46.191.150 08/27 13:35
→ vsbrm: 玩A卡通常要配合GPT,有問題就丟GPT 42.77.22.73 08/27 13:36
推 gbcg9725: 6樓 9060xt跑qwen 3.8 27b Q4KM 大約9t 39.9.43.10 08/27 13:36
→ gbcg9725: ok/s供參考 39.9.43.10 08/27 13:36
→ gbcg9725: 要用rocm 版本,vulkan 只有6 tok/s 39.9.43.10 08/27 13:37
→ gbcg9725: 9060xt 16g 39.9.43.10 08/27 13:37
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 13:40:10
→ gbcg9725: 16g 經常卡上下文,要拿來寫code 還是 39.9.43.10 08/27 13:50
→ gbcg9725: 不太夠 39.9.43.10 08/27 13:50
→ gbcg9725: 2樓我覺得如果你是要玩影片還是拿n卡 39.9.43.10 08/27 13:54
→ gbcg9725: ,純llm可以拿A 39.9.43.10 08/27 13:54
→ gbcg9725: A卡生影片真的好慢 39.9.43.10 08/27 13:56
推 kanding255: 所以這個便攜包是什麼 。。 1.172.175.182 08/27 14:58
推 hangtenboy: 謝謝樓樓上 101.10.5.192 08/27 15:06
推 ganei: 推!H3要爽跑不知道是否真的要上R9700才行 114.136.135.71 08/27 15:15
→ ganei: ,明(後?)年RDNA5遊戲旗艦卡似乎只有24G... 114.136.135.71 08/27 15:15
→ ganei: 等等,評價反了吧?LLM真的不算A卡強項,反 114.136.135.71 08/27 15:18
→ ganei: 而是有開版這包之後A卡跑圖跑影片不輸N卡了 114.136.135.71 08/27 15:18
→ ganei: ,要煉丹的話另外再說 114.136.135.71 08/27 15:18
海螺H3社群一直在優化
16g顯存的卡跑起來本來就很吃力
9070XT也不是不能跑
至少跑1.0 5秒10秒是算穩定了
環境都弄好
該有的集中力算法都包在裡面了
網路上一堆什麼加速工作流
亂七八糟瞎搞一堆
都是有畫質變差的問題
為了快甚至用上稀疏集中力
我提供這便攜包也是掙扎很久
量化廚房跟動態顯存一直在更新
社群不少人也跳下來優化ROCm HIP後端
每天都有新的東西加入
→ gbcg9725: 還沒試過原po 這版,原生的很慢 27.53.121.203 08/27 15:24
→ gbcg9725: n卡1分鐘的工作流,A卡要6分鐘 27.53.121.203 08/27 15:25
→ gbcg9725: 我是對比4070 27.53.121.203 08/27 15:26
我是不懂你拿5070比9060
然後說A卡跑AI慢是什麼邏輯啦
推 proton63: 推 111.255.28.102 08/27 15:27
推 Tosca: 感覺用A卡和我用mac mini M4差不多爛?! 203.75.79.40 08/27 15:27
推 ack0011: 真的要便宜而且有精力研究在linux上部署 49.215.59.195 08/27 15:29
→ ack0011: ,趕快去找還沒有漲價的AI PRO R9700買 49.215.59.195 08/27 15:29
→ ack0011: 個兩張,不然現在要便宜買新的也沒什麼 49.215.59.195 08/27 15:29
→ ack0011: 能選了 49.215.59.195 08/27 15:29
推 speed7022: 推,雖然我學不會這個使用方法 61.230.78.184 08/27 15:30
推 kanding255: 認真看了一下 謝謝分享 1.172.175.182 08/27 15:42
推 nrsair: AI 125.224.89.222 08/27 15:44
→ lolicat: 好耶 又更新了 每次更新我都能玩上幾天 61.216.36.146 08/27 15:56
→ lolicat: 感謝分享 61.216.36.146 08/27 15:57
推 a2492409g: 推122.121.131.120 08/27 15:57
推 lolicat: 補推 61.216.36.146 08/27 15:58
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 16:00:34
→ gbcg9725: 我是拿4070比9060xt 27.53.121.203 08/27 16:07
→ gbcg9725: 然後我沒有說amd跑ai慢哦,llm兩個差不 27.53.121.203 08/27 16:08
→ gbcg9725: 多,但原生的就是我剛講這個速度 27.53.121.203 08/27 16:08
→ gbcg9725: 請不要斷章取義.. 27.53.121.203 08/27 16:08
這不是斷章取義
9060跟5070本身硬體就不同級
拿來比較本身就沒意義
→ gbcg9725: 原生跑h3 27.53.121.203 08/27 16:09
推 makeitcount: 請問速度如何 我用5070 5秒0.7MP串成 118.165.223.37 08/27 16:09
→ gbcg9725: 生圖的話amd沒有比較差,只針對h3 27.53.121.203 08/27 16:09
→ makeitcount: 15秒MOTIOIN CONTEXT大概430秒 118.165.223.37 08/27 16:10
→ makeitcount: 現在問題是LATENT放大最多1.3MP 118.165.223.37 08/27 16:10
→ makeitcount: 在上去爆VRAM 118.165.223.37 08/27 16:11
→ gbcg9725: 兩個都是用ck-attention 跟官方攜帶版c 27.53.121.203 08/27 16:11
→ gbcg9725: omfy 27.53.121.203 08/27 16:11
→ makeitcount: 早知道AI這麼好玩就買16G了 118.165.223.37 08/27 16:11
→ gbcg9725: 我想可能哪裡設定不對只是提供我自己的 27.53.121.203 08/27 16:12
→ gbcg9725: 結果 27.53.121.203 08/27 16:12
→ makeitcount: 使用TURBO4STEPS跑6步 118.165.223.37 08/27 16:13
→ gbcg9725: h3用a卡跑的資訊真的不多 27.53.121.203 08/27 16:14
→ makeitcount: 430秒指0.7MP跑3次五秒串接 118.165.223.37 08/27 16:14
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 16:16:35
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 16:28:17
→ gbcg9725: 我說4070 12g...為什麼會看成5070 27.53.121.203 08/27 16:29
→ gbcg9725: 4070應該跟9060xt同級? 27.53.121.203 08/27 16:30
→ gbcg9725: 手上還有5070ti就不敢拿來比了 27.53.121.203 08/27 16:35
哈..抱歉我看錯了
正常A卡會慢
是因為加速的集中力算法
大多必須自行編譯
像Sage2自行編譯HIP內核後
才能達到真正的速度
還有一些調優的手段跟N卡不一樣
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 16:41:27
→ gbcg9725: 了解,感謝分享 27.53.121.203 08/27 16:44
推 gohst1234: 新的N卡驅動也能直接調用記憶體了,在系122.117.236.216 08/27 16:48
→ gohst1234: 統遞補政策設定,剛在跑24g模型顯示跟系122.117.236.216 08/27 16:48
→ gohst1234: 統借了8.8g,或許能把分層載入拿掉了122.117.236.216 08/27 16:48
推 hangtenboy: 謝謝分享,等等去光華看哪家有9070XT 101.10.5.192 08/27 16:52
推 sotali306: 推 感謝持續更新 114.36.237.20 08/27 17:26
→ commandoEX: AMD:ROCm 10是最後一版ROCm(X 59.125.204.130 08/27 18:05
→ commandoEX: 剛剛查了Release note,RX9050竟然有 59.125.204.130 08/27 18:09
→ commandoEX: 4GB的版本,這個能跑啥模型??? 59.125.204.130 08/27 18:10
4G跑Anime int8cr模型也行吧
模型大小才2.2~2.3g
推 iwillbehere: 推188.214.106.184 08/27 19:31
推 Shigeru777: 感謝大絲襪模型 之前沒下載到y 61.230.230.98 08/27 19:39
推 d0178411: 同為9070xt用戶推223.143.242.113 08/27 20:37
→ spfy: 那個就傳聞OEM卡 106.64.121.43 08/27 22:29
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 22:37:16
推 xzero0911: N卡推 感謝所有為開源AI貢獻的人 114.34.51.252 08/28 02:32