Tags
5 páginas
GGUF
Despliegue local de Qwen3.6-35B-A3B: GGUF, llama.cpp, VRAM y verificación de la API
Mejores LLM locales para RTX 3060 12 GB: cuantización, contexto y pruebas
VRAM para Qwen3.6 local: medir cuantizaciones 27B y 35B-A3B
VRAM para Gemma 4 local: cómo elegir E2B, E4B, 12B, 26B o 31B
Descargar modelos GGUF desde Hugging Face e importarlos en Ollama