Todos os guias
LM Studio · Iniciante
LM Studio no Windows — interface gráfica pra rodar LLMs local
Se você prefere clicar em vez de terminal, LM Studio é o caminho mais rápido no Windows.
7 min de leituraWindows 10/11 x64GPU NVIDIA opcionalAtualizado jun. de 2026
1. Baixar
Vá em lmstudio.ai e baixe o instalador Windows. Rode e siga o wizard.
2. Descobrir modelos
Aba "Discover": busque por `qwen2.5-7b-instruct` (bom padrão) ou `llama-3.1-8b-instruct`. Escolha uma quantização GGUF Q4_K_M pra equilibrar velocidade e qualidade.
3. Chat
Aba "Chat", carregue o modelo baixado e converse. Ajuste `Context Length` conforme sua VRAM.
4. Servir API local
Aba "Developer" → Start Server. Endpoint fica em http://localhost:1234/v1 (compatível OpenAI).
curl http://localhost:1234/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"local-model","messages":[{"role":"user","content":"Oi"}]}'Escolhendo quantização
- •Q4_K_M — melhor equilíbrio (recomendado)
- •Q5_K_M — +qualidade, ~15% mais lento
- •Q8_0 — quase full precision, só se tiver VRAM sobrando
- •Q2/Q3 — só pra testar, qualidade cai bastante
Próximos passos