VRAM大就是正義?Intel B70 minimax h3
YT Lon.TV 測了B70用ComfyUI跑 minimax
看起來VRAM大的優勢在這邊體現出來,無速度法跟NVIDA比,
不過NVIDIA要32G的價格就很不舒服了
B70生480p 5秒大概 2分半
生圖 1024x1024 大概 34秒
他還測了許多其他用途與模型,影片搭聲音,coding,等等
另外大vram的好處是跑LLM
Lon.TV 跑Qwen3.8可以全部放在vram 大概 25 token/s
亞馬遜的價錢
https://i.imgur.com/lErsamq.png
退一步B60 24G VRAM可以放絕大部分的模型只有B70一半的價錢
不過I卡的問題是待機功耗,待機要吃到50W有點高啊
單跑AI或許'目前'i卡是一種選擇?N卡的性價比實在太差了
在下做了 Qwen3.8 27B 的測試, 簡單的結論如下
1. 推薦模型: unsloth/Qwen3.8-27B-GGUF:UD-Q5_K_XL
2. 編譯 llama.cpp 建議用 F16 with oneDNN 那組編譯選項
3. 啟動 llama.cpp 建議不要改 -ctk -ctv, 預設 f16 的 kv cache 速度較快
測試報告可以參考 llama.cpp 討論區, 我寫了幾篇 B70 的測試結果
https://github.com/ggml-org/llama.cpp/discussi…
目前搭配 ZooCode, axe, AnythingLLM 等 Agent 使用
邏輯複雜的任務, 需要搭配 MCP 使用, 邏輯簡單手續複雜的任務可以直接做
以目前測試結果, 應該已經接近榨乾 B70 SYCL 性能
接下來會再研究 OVMS 與 OpenVINO IR 量化, 看能不能進一步提升效能
--
世界越快 心則慢
網路越慢 心則快
--