Guias
Passo a passo: local ou API
Escolha entre rodar modelos no seu próprio computador (privado, offline, grátis) ou consumir via API dos grandes provedores.
LLM Local
Roda no seu hardware. Zero custo por token, dados nunca saem.
Ollama · Iniciante
Rodar LLMs localmente no macOS com Ollama
Instale, baixe um modelo e faça a primeira chamada em menos de 10 minutos — sem enviar dados pra ninguém.
8 min· macOS Apple Silicon (M1/M2/M3/M4)
LM Studio · Iniciante
LM Studio no Windows — interface gráfica pra rodar LLMs local
Se você prefere clicar em vez de terminal, LM Studio é o caminho mais rápido no Windows.
7 min· Windows 10/11 x64
llama.cpp · Avançado
llama.cpp no Linux — máximo desempenho sem sobrecarga
Compilar a partir do código-fonte entrega a maior vazão e controle fino das opções de GPU.
10 min· Ubuntu 22.04+
APIs de provedores
Configure OpenAI, Anthropic, Groq e outros em minutos.
OpenAI · Iniciante
OpenAI API — primeira chamada, streaming e controle de custo
Do zero até uma feature em produção com GPT-5 sem estourar a fatura.
9 min
Anthropic · Iniciante
Anthropic Claude API — do primeiro token até tool use
Claude 4.5 Sonnet é o padrão pra código e agentes. Veja como conectar.
8 min
Groq · Iniciante
Groq API — inferência mais rápida do mercado, com plano gratuito
Llama, Qwen e Mixtral a 500+ tokens/segundo. Perfeito pra chatbots com UX instantânea.
6 min