Pular para o conteúdo
Ferramentas

OpenRouter: Como Usar 150+ Modelos de IA

O OpenRouter e um hub de APIs que da acesso a mais de 150 modelos de IA, incluindo dezenas completamente gratuitos. Nesse tutorial voce aprende a configurar, escolher

Quantas contas de IA voce ja criou esse ano? Anthropic, OpenAI, Google, Mistral, Cohere... cada uma com seu preco, seu limite, sua API key diferente. E se tivesse um lugar so que te desse acesso a todos eles de uma vez, com varios modelos de graca?

E exatamente isso que o OpenRouter faz. Um hub de APIs com mais de 150 modelos de IA, uma unica chave, uma unica URL base. Da pra usar Llama 3, Gemma, Mistral, Phi e varios outros sem gastar um centavo. E ainda integra direto com ferramentas como Continue.dev, OpenCode e o proprio setup do Antigravity que liberou 150 modelos gratis no terminal.

Nesse tutorial vou te mostrar como criar conta, quais modelos gratuitos valem a pena, como conectar com suas ferramentas de dev e como monitorar seus gastos.

O Que e o OpenRouter

O OpenRouter e um agregador de modelos de IA que funciona como uma camada intermediaria entre voce e os provedores. Voce cria uma conta, deposita creditos (ou usa os gratuitos), e acessa qualquer modelo via API padrao no formato OpenAI.

A proposta e simples: em vez de ter 10 contas diferentes, voce tem uma. E paga pelo uso real, sem assinaturas mensais fixas. Se voce usa muito Claude Sonnet, paga por token. Se voce usa so modelos gratuitos, paga zero.

O modelo de negocio deles e pegar uma margem pequena sobre os modelos pagos e manter os gratuitos como isca para atrair usuarios. Funciona bem pra quem quer experimentar sem comprometer budget.

Como o OpenRouter cobra

O OpenRouter e um hub de APIs que da acesso a mais de 150 modelos de IA, incluindo dezenas completamente gratuitos. Nesse tutorial voce aprende a configurar, escolher os melhores modelos free e integrar com suas ferramentas de desenvolvimento.

Criando Conta e Configurando

  1. Crie a conta
    Acesse openrouter.ai e clique em 'Sign Up'. Aceita login com Google ou GitHub. Ao criar conta voce ja ganha $1 de credito gratuito para testar modelos pagos.
  2. Gere sua API Key
    Va em Settings > API Keys > Create Key. Copie a chave gerada. Ela comeca com 'sk-or-v1-...' e e esse valor que voce vai usar em todas as ferramentas.
  3. Teste a conexao
    Abra o terminal e rode: curl https://openrouter.ai/api/v1/models -H 'Authorization: Bearer SUA_CHAVE' | head -50. Vai aparecer a lista de modelos disponíveis.
  4. Configure sua ferramenta
    Coloque a base URL como https://openrouter.ai/api/v1 e use sua chave. Funciona em qualquer ferramenta que aceita API compativel com OpenAI: Continue.dev, OpenCode, Cursor, LM Studio no modo servidor remoto.
  5. Monitore o uso
    No dashboard do OpenRouter tem um painel de usage em tempo real. Da pra ver quantos tokens cada modelo consumiu e quanto custou.

Melhores Modelos Gratuitos para Codigo

O OpenRouter mantem uma lista de modelos com o sufixo ':free' que nao cobram tokens. A qualidade varia bastante, mas alguns sao surpreendentemente bons para tarefas de codigo.

Meta Llama 3.3 70B :freeTop Pick

O melhor modelo gratuito para codigo no momento. 70 bilhoes de parametros, contexto de 128k tokens. Resolve problemas medios de programacao sem dificuldade. Modelo: meta-llama/llama-3.3-70b-instruct:free

Google Gemma 3 27B :freeMelhor Explicacoes

Modelo do Google treinado com dados de qualidade. Muito bom para explicacoes tecnicas e revisao de codigo. Suporta visao, entao da pra mandar screenshot de erro. Modelo: google/gemma-3-27b-it:free

Mistral 7B Instruct :freeMais Rapido

Pequeno mas rapido. Resposta quase instantanea. Bom para completions simples e perguntas rapidas de sintaxe. Nao vai resolver problemas complexos mas e agil pra uso cotidiano. Modelo: mistralai/mistral-7b-instruct:free

DeepSeek R1 :freeMelhor Raciocinio

Modelo de raciocinio chain-of-thought gratuito. Excelente para bugs complexos que precisam de analise passo a passo. Mais lento que os outros mas com respostas mais elaboradas. Modelo: deepseek/deepseek-r1:free

Qwen 2.5 Coder 32B :freeFocado em Codigo

Focado especificamente em codigo pelo time da Alibaba. Context window de 32k. Muito bom para completions de codigo e para entender projetos grandes. Modelo: qwen/qwen-2.5-coder-32b-instruct:free

Os limites de rate dos modelos gratuitos ficam em torno de 10 a 20 requisicoes por minuto e 200 por dia. Pra uso pessoal de desenvolvimento isso costuma ser suficiente. Se voce usa muito, considera depositar $5 e alternando entre modelos pagos baratos.

Integrando com Continue.dev

O Continue.dev e a extensao de IA mais popular no VSCode fora do Cursor. Ele aceita qualquer provedor OpenAI-compativel, entao integrar com OpenRouter e trivial.

~/.continue/config.json
{
  "models": [
    {
      "title": "Llama 3.3 70B (Free)",
      "provider": "openai",
      "model": "meta-llama/llama-3.3-70b-instruct:free",
      "apiKey": "sk-or-v1-SUA_CHAVE",
      "apiBase": "https://openrouter.ai/api/v1"
    },
    {
      "title": "Qwen Coder 32B (Free)",
      "provider": "openai",
      "model": "qwen/qwen-2.5-coder-32b-instruct:free",
      "apiKey": "sk-or-v1-SUA_CHAVE",
      "apiBase": "https://openrouter.ai/api/v1"
    }
  ],
  "tabAutocompleteModel": {
    "title": "Mistral 7B (Free)",
    "provider": "openai",
    "model": "mistralai/mistral-7b-instruct:free",
    "apiKey": "sk-or-v1-SUA_CHAVE",
    "apiBase": "https://openrouter.ai/api/v1"
  }
}

Com essa config voce tem dois modelos de chat gratuitos e autocomplete tambem de graca. Da pra trabalhar um dia inteiro sem gastar nada.

Integrando com OpenCode

O OpenCode ja vem com suporte nativo a OpenRouter. E provavelmente a integracao mais limpa disponivel. Voce ja conhece o combo OpenCode + Antigravity que libera modelos gratis direto no terminal, certo? O OpenRouter e outra opcao para quando voce quer escolher o modelo manualmente.

~/.config/opencode/config.json
{
  "provider": {
    "openrouter": {
      "apiKey": "sk-or-v1-SUA_CHAVE"
    }
  },
  "model": "openrouter/meta-llama/llama-3.3-70b-instruct:free"
}

Depois de configurar, voce pode alternar modelos direto na interface do OpenCode com o comando /model. Pratico para testar qual modelo resolve melhor um problema especifico.

Integrando com LM Studio (Modo API)

O LM Studio normalmente roda modelos locais, mas ele tem um modo de servidor que aceita configurar provedores externos. Assim voce usa a interface bonita do LM Studio mas com modelos do OpenRouter.

  1. Abra o LM Studio
    Va na aba Developer e ative o servidor local.
  2. Configure proxy externo
    Nas configuracoes avancadas do servidor, coloque a URL do OpenRouter como proxy upstream e sua API key.
  3. Selecione o modelo remoto
    Na lista de modelos aparece a opcao de conectar a provedores externos. Escolha OpenRouter e selecione o modelo desejado.

Modelos Pagos que Valem o Custo

Se voce quer mais potencia que os modelos gratuitos oferecem, o OpenRouter tem precos competitivos nos modelos pagos. A vantagem e pagar so pelo que usar, sem mensalidade.

Custo dos principais modelos pagos no OpenRouter

Claude Sonnet 3.7

+ Prós

  • • Melhor para codigo complexo
  • • Raciocinio extended
  • • Alta qualidade consistente

− Contras

  • • $3/M tokens input, $15/M output
  • • Pode ficar caro em uso intenso

GPT-4o

+ Prós

  • • Muito bom para tarefas mistas
  • • Visao nativa
  • • Contexto de 128k

− Contras

  • • $2.5/M tokens input, $10/M output
  • • Nao e o melhor especificamente para codigo

Gemini 2.5 Pro

+ Prós

  • • Contexto de 1M tokens
  • • Otimo custo-beneficio
  • • Rapido

− Contras

  • • $1.25/M tokens input (ate 200k)
  • • Menos preciso em tarefas muito especializadas

DeepSeek V3

+ Prós

  • • Muito barato: $0.27/M input
  • • Qualidade surpreendente para o preco
  • • Bom para codigo

− Contras

  • • Latencia maior que os outros
  • • Contexto maximo de 64k tokens

Uma estrategia eficiente e usar modelos gratuitos para tarefas simples como leitura de codigo e explicacoes, e modelos pagos mais poderosos so para as tarefas realmente complexas como refatoracao de sistemas grandes ou debugging dificil.

Dicas para Economizar no OpenRouter

Praticas que reduzem seu custo

  • Use modelos :free para chat exploratorio e so mude para pago quando o resultado for ruim
  • Encurte seus prompts: tokens de input custam dinheiro tambem
  • Configure context window maxima na sua ferramenta para evitar enviar historico desnecessario
  • Use o Llama 3.3 70B Free antes de tentar Claude — ele resolve 70% dos casos
  • Monitore seu uso no dashboard semanalmente para identificar padroes de gasto
  • Ative alertas de custo no OpenRouter para nao ser surpreendido
  • Para autocomplete, use sempre modelos menores e mais rapidos (Mistral 7B ou Phi-3)

Limitacoes dos Modelos Gratuitos

Antes de apostar tudo nos modelos gratuitos, e bom saber onde eles falham. Nao e nenhum drama, mas ajuda a ter expectativas realistas.

Rate limits sao o maior problema no dia a dia. 20 requisicoes por minuto parece bastante, mas se voce usar autocomplete com muita frequencia vai estourar rapido. A solucao e configurar um rate limiter na sua ferramenta ou alternar entre dois modelos gratuitos diferentes.

Contexto grande tambem e limitado nos modelos gratuitos. Para revisar arquivos enormes ou manter historico longo de conversa, voce vai precisar de um modelo pago com contexto maior. O Gemini 2.5 Pro com 1M de contexto e a melhor opcao custo-beneficio nesses casos.

Rate limits dos modelos gratuitos

A maioria dos modelos :free tem limite de 200 requisicoes por dia e 10 por minuto. Se voce trabalha o dia todo programando, isso pode acabar antes das 18h. Depositar $5 e usar modelos baratos como o DeepSeek V3 e mais pratico para uso profissional.

OpenRouter vs Usar API Diretamente

A duvida que aparece: por que usar OpenRouter se da pra ir direto no provedor? Alguns casos onde o OpenRouter ganha:

Variedade sem burocracia. Criar conta na Anthropic, pedir acesso a API, adicionar cartao, configurar billing... isso pra cada provedor. Com OpenRouter voce faz isso uma vez.

Fallback automatico. Voce pode configurar o OpenRouter para automaticamente usar outro modelo se o principal estiver fora ou com latencia alta. Util em producao.

Acesso a modelos sem conta propria. Alguns modelos menores nao tem API publica direta — so ficam disponiveis via OpenRouter ou plataformas parecidas.

Onde usar a API direta faz mais sentido: uso intenso de um unico modelo (Claude ou GPT-4o), quando voce precisa de SLA garantido, ou quando os creditos do OpenRouter ficarem mais caros que o provedor original para seu volume de uso.

Proximo Passo

Com o OpenRouter configurado, voce tem acesso a um cardapio completo de IAs. O proximo nivel e saber qual modelo usar pra cada tipo de tarefa. Confere o ranking dos melhores modelos de IA para codigo em 2026 com benchmarks reais para tomar essa decisao com dados.

E se voce quer o melhor setup de IA gratis no terminal sem configurar nada manualmente, da uma olhada no combo OpenCode + Antigravity que libera 150 modelos de graca. Simples assim.

Perguntas frequentes

OpenRouter e gratuito?

Sim, o OpenRouter tem plano gratuito com acesso a varios modelos. Voce ganha $1 de credito ao criar conta e modelos marcados com ':free' nao cobram nada, porem tem limites de rate (geralmente 10-20 requisicoes por minuto).

Qual a diferenca entre OpenRouter e usar a API diretamente?

Com OpenRouter voce usa uma unica API key e uma unica URL base para acessar modelos de OpenAI, Anthropic, Google, Meta e dezenas de outros provedores. Sem OpenRouter, precisaria de uma conta e API key separada em cada provedor.

OpenRouter funciona com OpenCode e Continue.dev?

Sim. Ambas as ferramentas aceitam qualquer provedor compativel com a API da OpenAI. Voce configura a base URL como https://openrouter.ai/api/v1 e usa sua chave do OpenRouter.

O Que e o OpenRouter

O OpenRouter e um agregador de modelos de IA que funciona como uma camada intermediaria entre voce e os provedores. Voce cria uma conta, deposita creditos (ou usa os gratuitos), e acessa qualquer modelo via API padrao no formato OpenAI. A proposta e simples: em vez de ter 10 contas diferentes, voce tem uma. E paga pelo uso real, sem assinaturas mensais fixas. Se voce usa muito Claude Sonnet, paga por token. Se voce usa so modelos gratuitos, paga zero. O modelo de negocio deles e pegar uma margem pequena sobre os modelos pagos e manter os gratuitos como isca para atrair usuarios. Funciona bem pra quem quer experimentar sem comprometer budget.