Todas las guías
LM Studio · Principiante

LM Studio en Windows - interfaz gráfica para ejecutar LLMs locales

Si prefieres hacer clic en lugar de usar terminal, LM Studio es el camino más rápido en Windows.

7 min de lecturaWindows 10/11 x64GPU NVIDIA opcionalActualizado jun 2026

1. Descargar

Ve a lmstudio.ai, descarga el instalador de Windows, ejecútalo y sigue el asistente.

2. Descubrir modelos

En la pestaña "Discover", busca `qwen2.5-7b-instruct` (buen estándar) o `llama-3.1-8b-instruct`. Elige una cuantización GGUF Q4_K_M para equilibrar velocidad y calidad.

3. Chat

En la pestaña "Chat", carga el modelo descargado y conversa. Ajusta `Context Length` según tu VRAM.

4. Servir una API local

En "Developer" -> Start Server. El endpoint queda en http://localhost:1234/v1 y es compatible con OpenAI.

curl http://localhost:1234/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"local-model","messages":[{"role":"user","content":"Hola"}]}'

Elegir cuantización

  • Q4_K_M - mejor equilibrio (recomendado)
  • Q5_K_M - más calidad, cerca de 15% más lento
  • Q8_0 - casi precisión completa, solo si te sobra VRAM
  • Q2/Q3 - solo para probar; la calidad cae bastante