作者trfmk1 (TRF小兵)
看板PC_Shopping
標題[心得] ComfyUI 9070XT(ROCm10)專用便攜包分享
時間Thu Aug 27 12:36:48 2026
ComfyUI_Win_portable_RX9070 TRFv0.6.1
https://drive.google.com/file/d/1huOM7MPm5fAlVJeMJbciRxc1nR197nJC/view?usp=drive_link
更新的軌跡
https://forum.gamer.com.tw/C.php?bsn=60030&snA=679332&subbsn=0&threadSubbsn=7&page=1&s_author=&gothis=2543422#2543422
這次更新拖了很久
這是我自己針對9070XT調整的版本
自行更新ComfyUI或者使用第三方啟動器有可能會破壞環境
包內環境是ComfyUI version: 0.34.0
檔案可以任意轉傳出去或者改成其他版本
我不是很在乎這個
ComfyUI本來就是免費的東西
1.Update ROCm.bat更新
可以選擇安裝ROCm10穩定版本
https://i.imgur.com/ykgry79.png
對...ROCm從7直接跳10...
建議使用PyTorch 2.13.0+rocm10.0.0
也可以選擇每夜更新版本
https://i.imgur.com/MiH6cS8.png
新增輸入日期選擇功能
目前還是建議使用PyTorch 2.13.0
2.Start.bat新增變數
微調舒適廚房
主要是Comfy Kitchen Triton 後端
對於int8的模型處理速度目前還是比AMD HIP後端快
https://i.imgur.com/uRe7w3w.png
所以我弄了個節點攔截其中的處理模式
用記事本編輯Start.bat
https://i.imgur.com/HaExCSR.png
set COMFY_KITCHEN_DISABLE_HIP_INT8=0
完全使用HIP後端
set COMFY_KITCHEN_DISABLE_HIP_INT8=1
int8_linear (ConvRot)強制走Triton後端
其餘走HIP後端
3.此版本sage集中力同時有2.2與sage Triton調優版本
需要透過SAGE注意力補丁KJ節點切換
選擇AUTO 使用RDNA4原生內核
選擇sageattn_qk_int8_pv_fp16_triton則切換舊版本
相關參數Start.bat裡面可以微調
新的舒適廚房集中力目前跑跑圖還行
要跑海螺H3 RDNA4內核特化的SAGE注意力還是比較快
壓力很大的環境sage Triton調優版本GPU使用率可能會比較高
請依照自己的硬體環境去調整
4.跑海螺H3如果覺得很吃力
可以將Win系統上的硬件加速 GPU 關閉
https://i.imgur.com/5XJgi4L.png
或者追加comfyui一些自定義參數
https://i.imgur.com/W0et4Jf.png
系統記憶體比較少的環境
可以使用--fast-disk跟--disable-pinned-memory
例如這樣追加參數
set "COMFY_ARGS=%ATTENTION_ARGS% %VRAM_ARGS% %SMART_MEM_ARGS%
--preview-method taesd --vram-headroom 2 --fast-disk"
5.我裝上了機智羅的XB-BOX 小白工具箱
https://github.com/WJLUOXIAO/XB_ToolBox
可以直接銜接機智羅的工作流
https://space.bilibili.com/302329373
如果機智羅的新工作流不能用
記得手動更新他的B-BOX 小白工具箱
ˊ
MiniMax-H3 模型相關位置
https://huggingface.co/Comfy-Org/MiniMax-H3/tree/main
lightx2v加速LORA
https://huggingface.co/lightx2v/Minimax-h3-Turbo/tree/main
Kijai基於lightx2v的修剪版LORA
https://huggingface.co/Kijai/MiniMax-H3_comfy/tree/main/loras
Kijai實驗模型
https://huggingface.co/Kijai/MiniMax-H3-experimental/tree/main
主要是抓取video_vae_int8 convrot版本
minimax_h3_video_vae_int8_convrot.safetensors
裡面W4A8權重的模型雖然比較小
但解包過程帶來的運算
比直接用int8 convrot吃力
反而速度不如用int8
https://huggingface.co/Merserk/MiniMax-H3-INT4-ConvRot/tree/main
主要是抓取 qwen3vl_32b_minimax_h3_int4_convrot.safetensors
空間放大節點
https://huggingface.co/LBH-123-AI/Minimax_h3_latent_Upscaler/tree/main
主要是抓取 minimax_h3_latent_upscaler_3d_bf16.safetensors
Minimax_h3_latent_Upscaler這個主要是在淺空間作放大後
在透過2次採樣補上細節
我在Minimax H3 Latent Upscaler (3D)節點上
做了試配A卡跟一些改造
https://i.imgur.com/eues35G.png
海螺H3內建角色表
https://huggingface.co/datasets/malcolmrey/various/blob/main/h3-center/known-characters/INDEX.md
慎用...裡面很多名人
不要亂搞瑟瑟發佈到網路上
包裡有內建一些工作流
可以去看看B站機智羅的影片拿他的工作流
會學到不少東西
我也有弄個圖生影片的2次採樣放大工作流
https://i.imgur.com/r0Bb75U.png
主要邏輯1采是先跑0.2 20步
2采空間超分 跑1.0 3步
基本上先生成一張圖片
將圖片放到提示詞生成工作流
https://i.imgur.com/pcEe8F2.png
然後很輕鬆就能得到會動的影片了
https://youtube.com/shorts/_lv47plZDeQ
https://youtube.com/shorts/cnvMDMeCuhM?feature=share
也可以直接透過文字生成
https://youtube.com/shorts/g4ZdZ0P91tE?feature=share
https://youtu.be/Q7NfGsyi7A0
https://youtube.com/shorts/iJLH8FhmSpI?feature=share
https://youtube.com/shorts/GhcFHDhKnrA?feature=share
海螺H3本地跑目前還是比較吃重的
模型抓下來也是要不少空間
記憶體建議有64G
32G也不是不能跑
但ComfyUI會使用SSD做緩存
可以先從跑720P 5秒的影片玩起
打打提示詞
就可以生成想要的影片
https://i.imgur.com/s1bnQdn.png
最後提供大絲襪的海螺H3模型
https://drive.google.com/file/d/1k1SMr1-mvn3kPgwB5VswqiA1npcWGD69/view?usp=drive_link
不知道為甚麼前幾天被下架了= =
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 125.229.59.186 (臺灣)
※ 文章網址: https://www.ptt.cc/bbs/PC_Shopping/M.1787805417.A.459.html
推 kuroshizu21: 感謝分享, 推 61.227.35.125 08/27 12:41
推 hangtenboy: 我一直在糾結要不要換N卡,還是要906 101.10.5.192 08/27 12:43
→ hangtenboy: 0XT升級9070XT,原Po可以幫幫我嗎? 101.10.5.192 08/27 12:43
如果要問我一律5090
推 ack0011: 買的到買的起拿來當賺錢工具用直接買N卡 49.215.59.195 08/27 12:46
→ ack0011: ,反正還會漲 49.215.59.195 08/27 12:46
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 12:49:22
推 sheng76314: 請問能跑qwen 3.8 27b 嗎 速度大概如 101.9.35.91 08/27 12:55
→ sheng76314: 何 謝謝 101.9.35.91 08/27 12:55
本地想跑LLM
想想硬體跟電費的錢
智力也不如線上的
還是直接買API吧
推 htps0763: 千問27b要玩重點是vram,至少24-32G 101.8.78.194 08/27 13:00
→ htps0763: 才能用q4配個128k 101.8.78.194 08/27 13:00
→ spfy: LLM和繪圖不太一樣 202.173.43.207 08/27 13:06
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 13:07:03
推 hangtenboy: 謝謝原Po... 101.10.5.192 08/27 13:12
→ hangtenboy: 謝謝四樓 101.10.5.192 08/27 13:12
推 iammatrix: Failed to initialize: Bad git execu 118.171.26.180 08/27 13:16
→ iammatrix: 執行START出現ERROR 無法啟動 118.171.26.180 08/27 13:16
→ iammatrix: 'stdlib.h' file not found 118.171.26.180 08/27 13:17
麻煩安裝Microsoft Visual C++ (MSVC)
推 kaj1983: 真人抓胸那片有一瞬間看到六指 36.238.159.13 08/27 13:26
→ kaj1983: 不過應該沒人在乎就是XD 36.238.159.13 08/27 13:27
推 grtfor: 感謝分享,幫助A卡用戶踏入門檻 114.46.191.150 08/27 13:35
→ vsbrm: 玩A卡通常要配合GPT,有問題就丟GPT 42.77.22.73 08/27 13:36
推 gbcg9725: 6樓 9060xt跑qwen 3.8 27b Q4KM 大約9t 39.9.43.10 08/27 13:36
→ gbcg9725: ok/s供參考 39.9.43.10 08/27 13:36
→ gbcg9725: 要用rocm 版本,vulkan 只有6 tok/s 39.9.43.10 08/27 13:37
→ gbcg9725: 9060xt 16g 39.9.43.10 08/27 13:37
※ 編輯: trfmk1 (125.229.59.186 臺灣), 08/27/2026 13:40:10
→ gbcg9725: 16g 經常卡上下文,要拿來寫code 還是 39.9.43.10 08/27 13:50
→ gbcg9725: 不太夠 39.9.43.10 08/27 13:50
→ gbcg9725: 2樓我覺得如果你是要玩影片還是拿n卡 39.9.43.10 08/27 13:54
→ gbcg9725: ,純llm可以拿A 39.9.43.10 08/27 13:54
→ gbcg9725: A卡生影片真的好慢 39.9.43.10 08/27 13:56