GGUF, MLX, Q4, Q5 y Q8 determinan cuánto ocupa un modelo y cómo funciona. Explicamos qué archivo elegir para ejecutar IA local.
LLM
¿Cuánto contexto necesita una IA local y por qué consume tanta memoria?
Una ventana de contexto mayor permite manejar más información, pero también consume memoria y puede ralentizar el modelo. Explicamos cuánto necesitas.
Ollama vs LM Studio: ¿cuál elegir para usar IA local?
Ollama y LM Studio ejecutan modelos locales, pero no están pensados para lo mismo. Comparamos facilidad, control, modelos, privacidad e integraciones.
Cuánta RAM y VRAM necesitas para ejecutar un modelo de lenguaje en local
La memoria determina qué LLM puedes cargar y con cuánto contexto. Estas son las cifras útiles para modelos de lenguaje locales con 8, 16, 32 y 64 GB.