Tags
7 个页面
GGUF
RTX 3060 也能跑 35B?llama.cpp 的 --n-cpu-moe 让老电脑继续本地大模型
Qwen3.6-35B-A3B 本地部署:GGUF、llama.cpp、显存与 API 验证
RTX 3070 8GB 本地运行 Qwen3.6-35B:llama.cpp 部署要点与优化参数
RTX 3060 12GB 本地大模型推荐:量化、上下文与实测选型
Qwen3.6 本地部署显存:27B 与 35B-A3B 量化估算和实测方法
Gemma 4 本地部署显存:E2B、E4B、12B、26B 与 31B 怎么选
从 Hugging Face 下载 GGUF 模型并导入 Ollama