Tags
5 个页面
量化
Qwen3.6 本地部署显存:27B 与 35B-A3B 量化估算和实测方法
DeepSeek V4 本地部署可行性:Pro 与 Flash 参数、内存估算和 API 选择
Gemma 4 本地部署显存:E2B、E4B、12B、26B 与 31B 怎么选
16G 显卡也能跑 35B 模型:LM Studio 下 MoE 模型的显存压缩思路
大模型量化详解:FP16、Q8、Q5、Q4 到 Q2 怎么选?