Tags
第 5 頁
量化
Qwen3.6 本地部署顯存:27B 與 35B-A3B 量化估算和實測方法
DeepSeek V4 本地部署可行性:Pro 與 Flash 參數、記憶體估算和 API 選擇
Gemma 4 本地部署顯存:E2B、E4B、12B、26B 與 31B 怎麼選
16G 顯卡也能跑 35B 模型:LM Studio 下 MoE 模型的顯存壓縮思路
大型模型量化詳解:FP16、Q8、Q5、Q4 到 Q2 怎麼選?