Todos os guias
LM Studio · Iniciante

LM Studio no Windows — interface gráfica pra rodar LLMs local

Se você prefere clicar em vez de terminal, LM Studio é o caminho mais rápido no Windows.

7 min de leituraWindows 10/11 x64GPU NVIDIA opcionalAtualizado jun. de 2026

1. Baixar

Vá em lmstudio.ai e baixe o instalador Windows. Rode e siga o wizard.

2. Descobrir modelos

Aba "Discover": busque por `qwen2.5-7b-instruct` (bom padrão) ou `llama-3.1-8b-instruct`. Escolha uma quantização GGUF Q4_K_M pra equilibrar velocidade e qualidade.

3. Chat

Aba "Chat", carregue o modelo baixado e converse. Ajuste `Context Length` conforme sua VRAM.

4. Servir API local

Aba "Developer" → Start Server. Endpoint fica em http://localhost:1234/v1 (compatível OpenAI).

curl http://localhost:1234/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"local-model","messages":[{"role":"user","content":"Oi"}]}'

Escolhendo quantização

  • Q4_K_M — melhor equilíbrio (recomendado)
  • Q5_K_M — +qualidade, ~15% mais lento
  • Q8_0 — quase full precision, só se tiver VRAM sobrando
  • Q2/Q3 — só pra testar, qualidade cai bastante
Próximos passos