Tags
3 páginas
Qwen
Cómo usar Qwythos-9B: guía de despliegue con vLLM, SGLang y Transformers
NVIDIA publica Qwen3.6-35B-A3B-NVFP4: una versión cuantizada en FP4 para despliegues con vLLM
Despliegue local de Qwen3.6-35B-A3B: GGUF, llama.cpp, VRAM y verificación de la API