Paso a paso: local o API
Elige entre correr modelos en tu propia máquina (privado, offline, gratis) o consumir vía API de los grandes proveedores.
Corre en tu hardware. Cero costo por token, los datos no salen.
Instala Ollama, descarga un modelo y haz la primera llamada local en menos de 10 minutos sin enviar datos a nadie.
Si prefieres hacer clic en lugar de usar terminal, LM Studio es el camino más rápido en Windows.
Compilar desde el código fuente da más rendimiento y control fino de opciones de GPU.
Configura OpenAI, Anthropic, Groq y otros en minutos.
De cero a una funcionalidad en producción con GPT-5 sin disparar la factura.
Claude 4.5 Sonnet es una opción fuerte para código y agentes. Así se conecta.
Llama, Qwen y Mixtral a 500+ tokens por segundo. Perfecto para chatbots con UX instantánea.