Todas las guías
LM Studio · Principiante
LM Studio en Windows - interfaz gráfica para ejecutar LLMs locales
Si prefieres hacer clic en lugar de usar terminal, LM Studio es el camino más rápido en Windows.
7 min de lecturaWindows 10/11 x64GPU NVIDIA opcionalActualizado jun 2026
1. Descargar
Ve a lmstudio.ai, descarga el instalador de Windows, ejecútalo y sigue el asistente.
2. Descubrir modelos
En la pestaña "Discover", busca `qwen2.5-7b-instruct` (buen estándar) o `llama-3.1-8b-instruct`. Elige una cuantización GGUF Q4_K_M para equilibrar velocidad y calidad.
3. Chat
En la pestaña "Chat", carga el modelo descargado y conversa. Ajusta `Context Length` según tu VRAM.
4. Servir una API local
En "Developer" -> Start Server. El endpoint queda en http://localhost:1234/v1 y es compatible con OpenAI.
curl http://localhost:1234/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"local-model","messages":[{"role":"user","content":"Hola"}]}'Elegir cuantización
- •Q4_K_M - mejor equilibrio (recomendado)
- •Q5_K_M - más calidad, cerca de 15% más lento
- •Q8_0 - casi precisión completa, solo si te sobra VRAM
- •Q2/Q3 - solo para probar; la calidad cae bastante
Próximos pasos