OpenRouter: Como Usar 150+ Modelos de IA
O OpenRouter e um hub de APIs que da acesso a mais de 150 modelos de IA, incluindo dezenas completamente gratuitos. Nesse tutorial voce aprende a configurar, escolher
Quantas contas de IA voce ja criou esse ano? Anthropic, OpenAI, Google, Mistral, Cohere... cada uma com seu preco, seu limite, sua API key diferente. E se tivesse um lugar so que te desse acesso a todos eles de uma vez, com varios modelos de graca?
E exatamente isso que o OpenRouter faz. Um hub de APIs com mais de 150 modelos de IA, uma unica chave, uma unica URL base. Da pra usar Llama 3, Gemma, Mistral, Phi e varios outros sem gastar um centavo. E ainda integra direto com ferramentas como Continue.dev, OpenCode e o proprio setup do Antigravity que liberou 150 modelos gratis no terminal.
Nesse tutorial vou te mostrar como criar conta, quais modelos gratuitos valem a pena, como conectar com suas ferramentas de dev e como monitorar seus gastos.
O Que e o OpenRouter
O OpenRouter e um agregador de modelos de IA que funciona como uma camada intermediaria entre voce e os provedores. Voce cria uma conta, deposita creditos (ou usa os gratuitos), e acessa qualquer modelo via API padrao no formato OpenAI.
A proposta e simples: em vez de ter 10 contas diferentes, voce tem uma. E paga pelo uso real, sem assinaturas mensais fixas. Se voce usa muito Claude Sonnet, paga por token. Se voce usa so modelos gratuitos, paga zero.
O modelo de negocio deles e pegar uma margem pequena sobre os modelos pagos e manter os gratuitos como isca para atrair usuarios. Funciona bem pra quem quer experimentar sem comprometer budget.
Como o OpenRouter cobra
O OpenRouter e um hub de APIs que da acesso a mais de 150 modelos de IA, incluindo dezenas completamente gratuitos. Nesse tutorial voce aprende a configurar, escolher os melhores modelos free e integrar com suas ferramentas de desenvolvimento.
Criando Conta e Configurando
- Crie a contaAcesse openrouter.ai e clique em 'Sign Up'. Aceita login com Google ou GitHub. Ao criar conta voce ja ganha $1 de credito gratuito para testar modelos pagos.
- Gere sua API KeyVa em Settings > API Keys > Create Key. Copie a chave gerada. Ela comeca com 'sk-or-v1-...' e e esse valor que voce vai usar em todas as ferramentas.
- Teste a conexaoAbra o terminal e rode: curl https://openrouter.ai/api/v1/models -H 'Authorization: Bearer SUA_CHAVE' | head -50. Vai aparecer a lista de modelos disponíveis.
- Configure sua ferramentaColoque a base URL como https://openrouter.ai/api/v1 e use sua chave. Funciona em qualquer ferramenta que aceita API compativel com OpenAI: Continue.dev, OpenCode, Cursor, LM Studio no modo servidor remoto.
- Monitore o usoNo dashboard do OpenRouter tem um painel de usage em tempo real. Da pra ver quantos tokens cada modelo consumiu e quanto custou.
Melhores Modelos Gratuitos para Codigo
O OpenRouter mantem uma lista de modelos com o sufixo ':free' que nao cobram tokens. A qualidade varia bastante, mas alguns sao surpreendentemente bons para tarefas de codigo.
Meta Llama 3.3 70B :freeTop Pick
O melhor modelo gratuito para codigo no momento. 70 bilhoes de parametros, contexto de 128k tokens. Resolve problemas medios de programacao sem dificuldade. Modelo: meta-llama/llama-3.3-70b-instruct:free
Google Gemma 3 27B :freeMelhor Explicacoes
Modelo do Google treinado com dados de qualidade. Muito bom para explicacoes tecnicas e revisao de codigo. Suporta visao, entao da pra mandar screenshot de erro. Modelo: google/gemma-3-27b-it:free
Mistral 7B Instruct :freeMais Rapido
Pequeno mas rapido. Resposta quase instantanea. Bom para completions simples e perguntas rapidas de sintaxe. Nao vai resolver problemas complexos mas e agil pra uso cotidiano. Modelo: mistralai/mistral-7b-instruct:free
DeepSeek R1 :freeMelhor Raciocinio
Modelo de raciocinio chain-of-thought gratuito. Excelente para bugs complexos que precisam de analise passo a passo. Mais lento que os outros mas com respostas mais elaboradas. Modelo: deepseek/deepseek-r1:free
Qwen 2.5 Coder 32B :freeFocado em Codigo
Focado especificamente em codigo pelo time da Alibaba. Context window de 32k. Muito bom para completions de codigo e para entender projetos grandes. Modelo: qwen/qwen-2.5-coder-32b-instruct:free
Os limites de rate dos modelos gratuitos ficam em torno de 10 a 20 requisicoes por minuto e 200 por dia. Pra uso pessoal de desenvolvimento isso costuma ser suficiente. Se voce usa muito, considera depositar $5 e alternando entre modelos pagos baratos.
Integrando com Continue.dev
O Continue.dev e a extensao de IA mais popular no VSCode fora do Cursor. Ele aceita qualquer provedor OpenAI-compativel, entao integrar com OpenRouter e trivial.
{
"models": [
{
"title": "Llama 3.3 70B (Free)",
"provider": "openai",
"model": "meta-llama/llama-3.3-70b-instruct:free",
"apiKey": "sk-or-v1-SUA_CHAVE",
"apiBase": "https://openrouter.ai/api/v1"
},
{
"title": "Qwen Coder 32B (Free)",
"provider": "openai",
"model": "qwen/qwen-2.5-coder-32b-instruct:free",
"apiKey": "sk-or-v1-SUA_CHAVE",
"apiBase": "https://openrouter.ai/api/v1"
}
],
"tabAutocompleteModel": {
"title": "Mistral 7B (Free)",
"provider": "openai",
"model": "mistralai/mistral-7b-instruct:free",
"apiKey": "sk-or-v1-SUA_CHAVE",
"apiBase": "https://openrouter.ai/api/v1"
}
}Com essa config voce tem dois modelos de chat gratuitos e autocomplete tambem de graca. Da pra trabalhar um dia inteiro sem gastar nada.
Integrando com OpenCode
O OpenCode ja vem com suporte nativo a OpenRouter. E provavelmente a integracao mais limpa disponivel. Voce ja conhece o combo OpenCode + Antigravity que libera modelos gratis direto no terminal, certo? O OpenRouter e outra opcao para quando voce quer escolher o modelo manualmente.
{
"provider": {
"openrouter": {
"apiKey": "sk-or-v1-SUA_CHAVE"
}
},
"model": "openrouter/meta-llama/llama-3.3-70b-instruct:free"
}Depois de configurar, voce pode alternar modelos direto na interface do OpenCode com o comando /model. Pratico para testar qual modelo resolve melhor um problema especifico.
Integrando com LM Studio (Modo API)
O LM Studio normalmente roda modelos locais, mas ele tem um modo de servidor que aceita configurar provedores externos. Assim voce usa a interface bonita do LM Studio mas com modelos do OpenRouter.
- Abra o LM StudioVa na aba Developer e ative o servidor local.
- Configure proxy externoNas configuracoes avancadas do servidor, coloque a URL do OpenRouter como proxy upstream e sua API key.
- Selecione o modelo remotoNa lista de modelos aparece a opcao de conectar a provedores externos. Escolha OpenRouter e selecione o modelo desejado.
Modelos Pagos que Valem o Custo
Se voce quer mais potencia que os modelos gratuitos oferecem, o OpenRouter tem precos competitivos nos modelos pagos. A vantagem e pagar so pelo que usar, sem mensalidade.
Custo dos principais modelos pagos no OpenRouter
Claude Sonnet 3.7
+ Prós
- • Melhor para codigo complexo
- • Raciocinio extended
- • Alta qualidade consistente
− Contras
- • $3/M tokens input, $15/M output
- • Pode ficar caro em uso intenso
GPT-4o
+ Prós
- • Muito bom para tarefas mistas
- • Visao nativa
- • Contexto de 128k
− Contras
- • $2.5/M tokens input, $10/M output
- • Nao e o melhor especificamente para codigo
Gemini 2.5 Pro
+ Prós
- • Contexto de 1M tokens
- • Otimo custo-beneficio
- • Rapido
− Contras
- • $1.25/M tokens input (ate 200k)
- • Menos preciso em tarefas muito especializadas
DeepSeek V3
+ Prós
- • Muito barato: $0.27/M input
- • Qualidade surpreendente para o preco
- • Bom para codigo
− Contras
- • Latencia maior que os outros
- • Contexto maximo de 64k tokens
Uma estrategia eficiente e usar modelos gratuitos para tarefas simples como leitura de codigo e explicacoes, e modelos pagos mais poderosos so para as tarefas realmente complexas como refatoracao de sistemas grandes ou debugging dificil.
Dicas para Economizar no OpenRouter
Praticas que reduzem seu custo
- Use modelos :free para chat exploratorio e so mude para pago quando o resultado for ruim
- Encurte seus prompts: tokens de input custam dinheiro tambem
- Configure context window maxima na sua ferramenta para evitar enviar historico desnecessario
- Use o Llama 3.3 70B Free antes de tentar Claude — ele resolve 70% dos casos
- Monitore seu uso no dashboard semanalmente para identificar padroes de gasto
- Ative alertas de custo no OpenRouter para nao ser surpreendido
- Para autocomplete, use sempre modelos menores e mais rapidos (Mistral 7B ou Phi-3)
Limitacoes dos Modelos Gratuitos
Antes de apostar tudo nos modelos gratuitos, e bom saber onde eles falham. Nao e nenhum drama, mas ajuda a ter expectativas realistas.
Rate limits sao o maior problema no dia a dia. 20 requisicoes por minuto parece bastante, mas se voce usar autocomplete com muita frequencia vai estourar rapido. A solucao e configurar um rate limiter na sua ferramenta ou alternar entre dois modelos gratuitos diferentes.
Contexto grande tambem e limitado nos modelos gratuitos. Para revisar arquivos enormes ou manter historico longo de conversa, voce vai precisar de um modelo pago com contexto maior. O Gemini 2.5 Pro com 1M de contexto e a melhor opcao custo-beneficio nesses casos.
Rate limits dos modelos gratuitos
A maioria dos modelos :free tem limite de 200 requisicoes por dia e 10 por minuto. Se voce trabalha o dia todo programando, isso pode acabar antes das 18h. Depositar $5 e usar modelos baratos como o DeepSeek V3 e mais pratico para uso profissional.
OpenRouter vs Usar API Diretamente
A duvida que aparece: por que usar OpenRouter se da pra ir direto no provedor? Alguns casos onde o OpenRouter ganha:
Variedade sem burocracia. Criar conta na Anthropic, pedir acesso a API, adicionar cartao, configurar billing... isso pra cada provedor. Com OpenRouter voce faz isso uma vez.
Fallback automatico. Voce pode configurar o OpenRouter para automaticamente usar outro modelo se o principal estiver fora ou com latencia alta. Util em producao.
Acesso a modelos sem conta propria. Alguns modelos menores nao tem API publica direta — so ficam disponiveis via OpenRouter ou plataformas parecidas.
Onde usar a API direta faz mais sentido: uso intenso de um unico modelo (Claude ou GPT-4o), quando voce precisa de SLA garantido, ou quando os creditos do OpenRouter ficarem mais caros que o provedor original para seu volume de uso.
Proximo Passo
Com o OpenRouter configurado, voce tem acesso a um cardapio completo de IAs. O proximo nivel e saber qual modelo usar pra cada tipo de tarefa. Confere o ranking dos melhores modelos de IA para codigo em 2026 com benchmarks reais para tomar essa decisao com dados.
E se voce quer o melhor setup de IA gratis no terminal sem configurar nada manualmente, da uma olhada no combo OpenCode + Antigravity que libera 150 modelos de graca. Simples assim.
Perguntas frequentes
OpenRouter e gratuito?
Sim, o OpenRouter tem plano gratuito com acesso a varios modelos. Voce ganha $1 de credito ao criar conta e modelos marcados com ':free' nao cobram nada, porem tem limites de rate (geralmente 10-20 requisicoes por minuto).
Qual a diferenca entre OpenRouter e usar a API diretamente?
Com OpenRouter voce usa uma unica API key e uma unica URL base para acessar modelos de OpenAI, Anthropic, Google, Meta e dezenas de outros provedores. Sem OpenRouter, precisaria de uma conta e API key separada em cada provedor.
OpenRouter funciona com OpenCode e Continue.dev?
Sim. Ambas as ferramentas aceitam qualquer provedor compativel com a API da OpenAI. Voce configura a base URL como https://openrouter.ai/api/v1 e usa sua chave do OpenRouter.
O Que e o OpenRouter
O OpenRouter e um agregador de modelos de IA que funciona como uma camada intermediaria entre voce e os provedores. Voce cria uma conta, deposita creditos (ou usa os gratuitos), e acessa qualquer modelo via API padrao no formato OpenAI. A proposta e simples: em vez de ter 10 contas diferentes, voce tem uma. E paga pelo uso real, sem assinaturas mensais fixas. Se voce usa muito Claude Sonnet, paga por token. Se voce usa so modelos gratuitos, paga zero. O modelo de negocio deles e pegar uma margem pequena sobre os modelos pagos e manter os gratuitos como isca para atrair usuarios. Funciona bem pra quem quer experimentar sem comprometer budget.