看板 Stock 關於我們 聯絡資訊
先說結論, 絕對會影響NVDA 在中小企業的市場 我今年最成功的投資不是買股票, 我今年最成功的投資是在GB10 漲價之前買了一台GB10, 今年投資股票沒賺, 結果GB10 已經漲了50%, 這是我在電蝦版的開箱文跟開箱示意圖: https://www.ptt.cc/bbs/PC_Shopping/M.1780771439.A.18C.html 我同時有舊版的最便宜Mac Mini, 跟這台GB10, mac mini 主要是做AI agent, call API, API 又分成兩種, 一種是GB10 本地LLM 提供的API, 算是免費token, 另一種是GB10 處理不來的AI任務, 就只能呼叫貴鬆鬆的Gemini Kling API 這是我的看法, GB10 不穩, 所有NV GPU搭配 Ubuntu都不穩, 每隔一兩星期會當機, 需要手動重開機, 還有 Ubuntu 的系統自動更新也會殺死 各種本地LLM工具, 每次 ubuntu 系統更新就要開始重新編譯安裝被殺死的LLM 工具, 這個距離企業本地端使用LLM, 穩定度可能還有差距, 當然如果請專業IT 來每天重開機每天盯著機器, 穩定度或許會好很多 至於mac mini, macos, 穩定度絕對是企業等級的, 我已經半年沒有重開機, 也沒有當機問題, 原因在於蘋果對mac 的系統更新非常小心, 而且是要使用者自己選擇更新, 所以只要你堅持不更新, 基本上就不太會遇到不穩定或是更新死機的問題, 對照組就是Windows 強制系統更新, 所以你說Windows 要來跑企業本地LLM, 我就跟你分享這個經典笑話, https://www.youtube.com/watch?v=xDLvUqhwHZc
再來說說效能, 無庸置疑, 所有的NV GPU >> Mac Studio Ultra >= GB10 >= Mac Mini 其實我沒用過 Mac Studio Ultra, 所以我不確定 Mac Studio Ultra 會贏 GB10, 但是我敢保證, CPU + 小NPU/GPU 的組合絕對打不過 NV GPU 的大炮, 尤其你都買得起57萬的 RTX PRO 6000, 一定會跟著安裝最頂級的AMD 最強CPU, 所以所有的NV GPU 都一定大勝 Mac Studio/Mini, 我自己用GB10, 感覺慢到讓我懷疑人生, GB10 只有一個優點: 他會動, 他能動 這很重要, 下面接著說 然後我看所有人的分析重點都放在效能快慢上面, 我不知道是故意忽略, 還是真的不知道vram大小的重要性, vram 大小只影響一件事: 能不能動 就算你買了全世界最快的車子, 你沒加汽油就是不會動, 法拉利沒油也跑輸一隻烏龜 不論是Mac Studio, 或是GB10, 都只有一個優點: 他能動, 你跑真正夠強的本地模型, 真正能夠在企業本地端實用的模型, 都要幾百GB vram, 你就算買RTX PRO 6000, 也是跑不動呀! 這也就是我認為NVDA 會在中小企業的本地LLM受到影響, 因為你最強的RTX PRO 6000 只有96GB, 跑不了真正夠強大的本地模型 ※ 引述《seemoon2000 (no cash)》之銘言: : 標的:(AAPL) : 分類:多 (請選擇並刪除無關分類) : 分析/正文: : 蘋果今天公布了M5 Ultra和M6 : M5 Ultra試點了一下 : M5 Ultra+256gb ram+8TB硬碟 50.8萬台幣 : 乍看之下這價格好像不便宜 : 有在玩本地LLM的都會知道 : 現在瓶頸是記憶體頻寬,顯卡算力在本地端很多是過剩的 : 我比較一下現在主流的產品 : 記憶體頻寬: : Apple M5 Ultra(完整的一台Mac電腦) : 售價50萬 統一記憶體256GB:1200GB/s : RTX 5090 : 市價17萬 Vram32GB:1792GB/s : RTX PRO 6000:(純顯卡) : 市價57萬 Vram96GB:1792GB/s : RTX5080:純顯卡) : 市價5.2萬 Vram16GB:960GB/s : RTX5070ti:純顯卡) : 市價4.9萬 Vram16GB:896GB/s : NVIDIA DGX:(完整的一台Linux電腦) : 市價15~20萬 統一記憶體128GB:273GB/s : AMD Ryzen AI Max+ 395:(完整的一台Win/Linux電腦) : 市價9萬 統一記憶體128GB:256GB/s : 這陣子顯卡和DGX漲價,除了記憶體價格上漲,我個人觀點 : 主要也有一部分小型企業有開始買多卡佈署較低成本的方案 : 但這波上面所有價位段的競品,"沒有一個"能跟M5 Ultra比較,唯一稍微能比的只有RTX : PRO 6000,記憶體頻寬更高,但96GBVram也輸M5 Ultra的256/512GB,而且M5是整台電腦 : ,賣得還比純顯卡PRO 6000便宜 : 至於這陣子買到溢價DGX,基本上現在可以安慰自己說 : 生圖生影片用Cuda跑很快,很開心 : M5 Ultra這個方案,應該會有不少中型企業開始採用 : 因為可以直接安裝Deepseek v4 flash或Qwen 3.8 27b,複雜高級任務在調再API模型 : 這些T2等級的本地模型,對要自己部屬的企業,實用性遠比Kimi K3高多了 : M5 Ultra加上Deepseek v4 flash和Qwen 3.8 27b就是現在完全破壞中型2B市場的組合。 : NV老黃現在不可能貿然放生DGX和RTX Pro用戶 : 等於在中型企業端的市場會變成無法競爭 : NV應該會開始努力把產品賣給模型公司。 : 進退場機制: : 進場時機 最低305左右 退場時機 NV想出解方後 -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 76.103.225.6 (美國) ※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1787729923.A.4B1.html ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 15:42:13
xzcb2008 : 你是拿來做什麼 08/26 15:50
小說, 小黃書, 漫畫, AI 短劇, AI 小黃圖片, 目前卡在GB10 算力不夠短劇生成, 太慢導致 timeout, 然後Kling 以及各個商用API 都不能碰瑟瑟, 所以我的AI onlyfans 就卡住了
strlen : 別想太多 mac市佔不到10% 中小企業又更少了 08/26 15:53
strlen : 會想玩本地LLM的中小大概不到0.01% 大多都是買個 08/26 15:54
strlen : Claude或GPT方案了事 08/26 15:54
wudishidove : 96g怎麼會不夠,新的qwen3.8 27b就超強了 08/26 15:57
xzcb2008 : 帥哥是拿來跑圖片的 08/26 15:58
xzcb2008 : 我都是拿來看發票入發票之類的401爆表的 你的難度 08/26 15:58
xzcb2008 : 比較高 08/26 15:58
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:05:39
sdbb : 謝謝 08/26 16:02
Terraria : qwen3.8 27b 建議多少 ram? 精度是 FP16 最高? 08/26 16:03
Terraria : *vram 08/26 16:03
72GB, Qwen2.5-72B-Instruct-abliterated-Q8_0.gguf 41GB, Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-Q8_K_P.gguf 31GB, gemma-4-31b-abliterated-Q8_0.gguf HunyuanVideo, CogVideoX, Wan 也是幾十GB 這是今年本地LLM 排行榜, 排在前面S等級的, 都是數百GB 到 1TB 起跳, https://onyx.app/self-hosted-llm-leaderboard ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:11:45 ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:13:54
Terraria : 感恩,跟 AI 討論後,AI 說 Q5_K_M 精度跟 FP16 08/26 16:15
Terraria : 差距不大 08/26 16:15
Terraria : 上個月改組了 PC RTX 5080, 在想要不要再買一台 08/26 16:15
Terraria : mac studio or 再多買張顯卡玩看看 qwen 3.8 27b 08/26 16:16
我是不會自己多裝顯卡, 考量到電源供應器, PCIe 插槽, 機器空間, 我沒自信能多加一張顯卡 不然以成本跟運算效能來說, 兩張顯卡絕對完勝mac studio ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:18:27
Terraria : 明天就要預購了有點猶豫 XD 08/26 16:17
latw : 我可以說魔改4090真香嗎~~ 08/26 16:25
※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:31:53
mqhung : 有人建議AI初心者適合用MAC,這是真的嗎? 08/26 16:34
真的, 你去電蝦版看我分享gb10 的兩篇文章, 光是安裝LLM 模型跟各種工具, 就會搞死你, 還常常自動更新後死機, mac 相對簡單很多, 真的不行就call gemini api ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:37:35
vixyao : 我是好奇Comfyui在Mac上的表現,之前怎麼用,譬如30 08/26 16:43
vixyao : 秒生成一首歌曲,M1 Max大概跑了半小時才生成 08/26 16:43
我不知道, 但是我在gb10 跟 mac mini call kling 的經驗, gb10 生成一個六秒的影片i2v, 花了半小時到一小時還生不出來, kling api 大概花 5-10秒 同樣的, comfyui 在 gb10 上面生一張圖需要兩到三分鐘, gemini vertex api 只要一秒不到 ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:46:10
vixyao : pse.is/9jd8xx 08/26 16:47
vixyao : 你拿的是桌機跟雲端服務比,現在說的是Mac 08/26 16:48
vixyao : 本地跑模型的表現 08/26 16:49
vixyao : M系列的規格很漂亮啊,token數跑超高,問題是你不是 08/26 16:50
vixyao : 只跟AI聊天而已,你要生圖做影片配音樂 08/26 16:50
所以我說 我不知道, 沒錢買頂規的mac studio, 我的零用錢只買得起漲價前的gb10, 我也跟你說了gb10 的效能慘況 ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 16:57:59
NexusPrime : Ubuntu 很早以前還不錯,現在變得越來越臃腫耗記憶 08/26 16:58
NexusPrime : 體,不如用Arch Linux類的distro 08/26 16:58
gb10 搭配的是ubuntu, 可能ubuntu 對cuda 以及LLM 工具的支援度最高, 我說可能 ※ 編輯: waitrop (76.103.225.6 美國), 08/26/2026 17:01:19
TameFoxx : GB10光那個頻寬就躺在地板上了 08/26 17:01
fx4ti42 : XperStation WS300 這台就可以跑了 08/26 17:01
seemoon2000 : M5 ultra記憶體頻寬是GB10 4倍 08/26 17:15
seemoon2000 : 目前M5 max記憶體頻寬約等於GB10 2倍 decode就2倍 08/26 17:18
seemoon2000 : 記憶體頻寬目前推論市場就是線性的 GPU算力是其次 08/26 17:18
seemoon2000 : 等到記憶體頻寬產出效率高過GPU算力時才需要看GPU 08/26 17:19
hpk89 : 今年買股票可以搞到不賺錢也是蠻厲害的 08/26 17:19
DreamMakers : GB10可以串聯 一台不夠可以買5台 08/26 17:20
saito2190 : GB10的機器根本不用自己裝各種工具,買來什麼都裝 08/26 17:20
saito2190 : 好了,去網路上抄一段docker vllm recipe就可以跑 08/26 17:20
saito2190 : 了 08/26 17:20
saito2190 : 本地模型還是推薦4bit,Q4或NVFP4,3bit或5bit這種 08/26 17:21
saito2190 : 不能被2整除的有時候可能會更慢 08/26 17:21
seemoon2000 : Mac安裝才單純吧 他有那麼好的前端作業系統欸... 08/26 17:22
silverair : 你用什麼模型算圖要3分鐘@@ 影片現在用 minimax h3 08/26 17:23
seemoon2000 : GB10現在唯一優點是有cuda而已 08/26 17:23
silverair : 速度快品質好4070ti s都能玩,小黃片自給自足 08/26 17:26
Zending : 創作者的電腦市場有點門檻,至少12萬以上,較難普及 08/26 17:57
Zending : 偏偏12萬以下的家用電競電腦市場,就有好貨 08/26 17:58
Zending : AIPC要闖創作市場,希望未來還有其他市場,不然辛苦 08/26 18:00
Zending : 還未形成金礦的市場會賣不動鏟子,誘因不夠 08/26 18:04
Zending : GB10的DDR5 128G還全部焊死.....不能拆下來 08/26 18:08
create8 : 謝謝分享 08/26 18:10