Tags
4 páginas
LLM
Qué modelos locales de IA puede ejecutar un portátil RTX 4060 8GB
Mejores LLM locales para RTX 3060 12 GB: cuantización, contexto y pruebas
Guía práctica de formatos tensoriales comunes en LLMs: FP32, FP16, BF16, TF32 y FP8
Explicación de la cuantificación de LLM: cómo elegir FP16, Q8, Q5, Q4 o Q2