推 xzcb2008 : 你是拿來做什麼 08/26 15:50
小說, 小黃書, 漫畫, AI 短劇, AI 小黃圖片,
目前卡在GB10 算力不夠短劇生成,
太慢導致 timeout,
然後Kling 以及各個商用API 都不能碰瑟瑟,
所以我的AI onlyfans 就卡住了
推 strlen : 別想太多 mac市佔不到10% 中小企業又更少了 08/26 15:53
→ strlen : 會想玩本地LLM的中小大概不到0.01% 大多都是買個 08/26 15:54
→ strlen : Claude或GPT方案了事 08/26 15:54
推 wudishidove : 96g怎麼會不夠,新的qwen3.8 27b就超強了 08/26 15:57
推 xzcb2008 : 帥哥是拿來跑圖片的 08/26 15:58
→ xzcb2008 : 我都是拿來看發票入發票之類的401爆表的 你的難度 08/26 15:58
→ xzcb2008 : 比較高 08/26 15:58
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:05:39
推 sdbb : 謝謝 08/26 16:02
推 Terraria : qwen3.8 27b 建議多少 ram? 精度是 FP16 最高? 08/26 16:03
→ Terraria : *vram 08/26 16:03
72GB, Qwen2.5-72B-Instruct-abliterated-Q8_0.gguf
41GB, Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q8_K_P.gguf
31GB, gemma-4-31b-abliterated-Q8_0.gguf
HunyuanVideo, CogVideoX, Wan 也是幾十GB
這是今年本地LLM 排行榜,
排在前面S等級的,
都是數百GB 到 1TB 起跳,
https://onyx.app/self-hosted-llm-leaderboard
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:11:45
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:13:54
推 Terraria : 感恩,跟 AI 討論後,AI 說 Q5_K_M 精度跟 FP16 08/26 16:15
→ Terraria : 差距不大 08/26 16:15
→ Terraria : 上個月改組了 PC RTX 5080, 在想要不要再買一台 08/26 16:15
→ Terraria : mac studio or 再多買張顯卡玩看看 qwen 3.8 27b 08/26 16:16
我是不會自己多裝顯卡,
考量到電源供應器, PCIe 插槽, 機器空間,
我沒自信能多加一張顯卡
不然以成本跟運算效能來說,
兩張顯卡絕對完勝mac studio
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:18:27
→ Terraria : 明天就要預購了有點猶豫 XD 08/26 16:17
→ latw : 我可以說魔改4090真香嗎~~ 08/26 16:25
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:31:53
推 mqhung : 有人建議AI初心者適合用MAC,這是真的嗎? 08/26 16:34
真的,
你去電蝦版看我分享gb10 的兩篇文章,
光是安裝LLM 模型跟各種工具, 就會搞死你,
還常常自動更新後死機,
mac 相對簡單很多,
真的不行就call gemini api
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:37:35
→ vixyao : 我是好奇Comfyui在Mac上的表現,之前怎麼用,譬如30 08/26 16:43
→ vixyao : 秒生成一首歌曲,M1 Max大概跑了半小時才生成 08/26 16:43
我不知道,
但是我在gb10 跟 mac mini call kling 的經驗,
gb10 生成一個六秒的影片i2v,
花了半小時到一小時還生不出來,
kling api 大概花 5-10秒
同樣的,
comfyui 在 gb10 上面生一張圖需要兩到三分鐘,
gemini vertex api 只要一秒不到
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:46:10
→ vixyao : pse.is/9jd8xx 08/26 16:47
→ vixyao : 你拿的是桌機跟雲端服務比,現在說的是Mac 08/26 16:48
→ vixyao : 本地跑模型的表現 08/26 16:49
→ vixyao : M系列的規格很漂亮啊,token數跑超高,問題是你不是 08/26 16:50
→ vixyao : 只跟AI聊天而已,你要生圖做影片配音樂 08/26 16:50
所以我說 我不知道,
沒錢買頂規的mac studio,
我的零用錢只買得起漲價前的gb10,
我也跟你說了gb10 的效能慘況
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:57:59
推 NexusPrime : Ubuntu 很早以前還不錯,現在變得越來越臃腫耗記憶 08/26 16:58
→ NexusPrime : 體,不如用Arch Linux類的distro 08/26 16:58
gb10 搭配的是ubuntu,
可能ubuntu 對cuda 以及LLM 工具的支援度最高, 我說可能
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 17:01:19
推 TameFoxx : GB10光那個頻寬就躺在地板上了 08/26 17:01
推 fx4ti42 : XperStation WS300 這台就可以跑了 08/26 17:01
推 seemoon2000 : M5 ultra記憶體頻寬是GB10 4倍 08/26 17:15
→ seemoon2000 : 目前M5 max記憶體頻寬約等於GB10 2倍 decode就2倍 08/26 17:18
→ seemoon2000 : 記憶體頻寬目前推論市場就是線性的 GPU算力是其次 08/26 17:18
→ seemoon2000 : 等到記憶體頻寬產出效率高過GPU算力時才需要看GPU 08/26 17:19
推 hpk89 : 今年買股票可以搞到不賺錢也是蠻厲害的 08/26 17:19
推 DreamMakers : GB10可以串聯 一台不夠可以買5台 08/26 17:20
推 saito2190 : GB10的機器根本不用自己裝各種工具,買來什麼都裝 08/26 17:20
→ saito2190 : 好了,去網路上抄一段docker vllm recipe就可以跑 08/26 17:20
→ saito2190 : 了 08/26 17:20
→ saito2190 : 本地模型還是推薦4bit,Q4或NVFP4,3bit或5bit這種 08/26 17:21
→ saito2190 : 不能被2整除的有時候可能會更慢 08/26 17:21
推 seemoon2000 : Mac安裝才單純吧 他有那麼好的前端作業系統欸... 08/26 17:22
推 silverair : 你用什麼模型算圖要3分鐘@@ 影片現在用 minimax h3 08/26 17:23
→ seemoon2000 : GB10現在唯一優點是有cuda而已 08/26 17:23
推 silverair : 速度快品質好4070ti s都能玩,小黃片自給自足 08/26 17:26
推 Zending : 創作者的電腦市場有點門檻,至少12萬以上,較難普及 08/26 17:57
→ Zending : 偏偏12萬以下的家用電競電腦市場,就有好貨 08/26 17:58
→ Zending : AIPC要闖創作市場,希望未來還有其他市場,不然辛苦 08/26 18:00
推 Zending : 還未形成金礦的市場會賣不動鏟子,誘因不夠 08/26 18:04
→ Zending : GB10的DDR5 128G還全部焊死.....不能拆下來 08/26 18:08
推 create8 : 謝謝分享 08/26 18:10