Pular para o conteúdo
Ferramentas

OpenRouter: Como Usar 150+ Modelos de IA

O OpenRouter é tipo um agregador de modelos de IA que te dá acesso a mais de 150 modelos — vários deles grátis. Nesse guia eu mostro como

TL;DR

O OpenRouter é tipo um agregador de modelos de IA que te dá acesso a mais de 150 modelos — vários deles grátis. Nesse guia eu mostro como configurar tudo do zero, quais modelos valem a pena pra código e como plugar no seu IDE favorito.

Se você programa com IA, já deve ter passado por essa situação: cria conta na OpenAI, gasta o crédito grátis em 3 dias, olha pro preço do GPT-4 e pensa 'preciso de alternativa'. Bem-vindo ao clube. E é exatamente aí que o OpenRouter entra.

Eu uso OpenRouter há meses e posso dizer que mudou completamente como eu consumo modelos de IA. Em vez de ficar preso a um provider, tenho acesso a mais de 150 modelos — e os grátis dão conta de 90% do que eu preciso no dia a dia pra programar.

O que é o OpenRouter

OpenRouter é um agregador de modelos de IA. Funciona como um proxy: você faz uma requisição pra API deles e eles roteiam pro modelo que você escolheu. A API é compatível com o formato da OpenAI, então qualquer ferramenta que funciona com a OpenAI funciona com o OpenRouter — só trocar a base URL.

A sacada é que eles juntam modelos de vários providers num lugar só. Google (Gemini), Meta (Llama), DeepSeek, Mistral, Anthropic, Qwen — tudo acessível com uma única API key. E o melhor: vários desses modelos têm tier grátis.

Criando conta e pegando sua API key

  1. Acesse openrouter.ai e clique em 'Sign Up'. Dá pra criar conta com Google ou GitHub — recomendo GitHub pra devs
  2. Depois de logar, vá em Keys no menu lateral e clique em 'Create Key'
  3. Dê um nome pra key (tipo 'cursor-dev' ou 'meu-ide') e copie o valor gerado. Guarde isso num lugar seguro — a key não aparece de novo
  4. Pronto. Essa key funciona pra todos os modelos da plataforma. Não precisa criar key separada pra cada modelo

Dica de segurança

Nunca commite sua API key no repositório. Use variáveis de ambiente (.env) e adicione o .env no .gitignore. Parece óbvio, mas a quantidade de keys vazadas no GitHub é assustadora.

Melhores modelos grátis pra código

Galera, aqui é onde o OpenRouter brilha de verdade. Vou listar os modelos grátis que eu mais uso pra programar, com a pegada de cada um.

Geração de código

DeepSeek V3 (Free)

O rei da geração de código grátis. 685B de parâmetros MoE, scores acima de 82% no HumanEval. Gera funções completas, testes e até arquiteturas inteiras. Latência um pouco maior que modelos menores, mas a qualidade compensa.

Qwen 2.5 Coder 32B (Free)

Especialista em código com 32B de parâmetros. Score de 92.7% no HumanEval. Excelente pra completar código, gerar testes e refatorar. Mais rápido que o DeepSeek e muito consistente.

Llama 3.3 70B (Free)

Modelo generalista da Meta com ótima capacidade de código. 70B de parâmetros, bom pra explicar conceitos enquanto gera código. Score de 88.7% no HumanEval.

Code review e debugging

Gemini 2.0 Flash (Free)

Modelo do Google com janela de contexto gigante (1M tokens). Perfeito pra analisar arquivos grandes e fazer review de PRs inteiros. Rápido e preciso pra encontrar bugs.

Mistral Large (Free tier)

Modelo francês com foco em raciocínio. Ótimo pra debugging de lógica complexa e sugerir refatorações arquiteturais. O tier grátis tem limite de requests por dia.

DeepSeek R1 (Free)

Modelo de raciocínio do DeepSeek. Pensa passo a passo antes de responder, ideal pra bugs difíceis onde você precisa de análise profunda. Mais lento, mas mais preciso em problemas complexos.

Integrando com IDEs

Cursor

O Cursor aceita qualquer API compatível com OpenAI. A configuração é direta:

json
// Settings do Cursor → Models → OpenAI API Key
{
  "openai.apiKey": "sk-or-v1-SUA_KEY_AQUI",
  "openai.baseUrl": "https://openrouter.ai/api/v1"
}
// Depois vá em Model e digite o ID do modelo:
// deepseek/deepseek-chat-v3-0324:free
// qwen/qwen-2.5-coder-32b-instruct:free

Com isso, todos os modelos grátis do OpenRouter ficam disponíveis no Cursor. Você pode trocar de modelo sem reconfigurar nada — só muda o ID na hora de usar.

Continue (VS Code)

O Continue tem suporte nativo ao OpenRouter. Edite o arquivo config.json:

json
{
  "models": [
    {
      "title": "DeepSeek V3 (Free)",
      "provider": "openrouter",
      "model": "deepseek/deepseek-chat-v3-0324:free",
      "apiKey": "sk-or-v1-SUA_KEY_AQUI"
    },
    {
      "title": "Qwen Coder (Free)",
      "provider": "openrouter",
      "model": "qwen/qwen-2.5-coder-32b-instruct:free",
      "apiKey": "sk-or-v1-SUA_KEY_AQUI"
    }
  ]
}

OpenCode (Terminal)

O OpenCode funciona direto no terminal e aceita OpenRouter via variável de ambiente:

bash
# Instalar OpenCode
npm install -g @anthropics/opencode

# Configurar com OpenRouter
export OPENROUTER_API_KEY="sk-or-v1-SUA_KEY_AQUI"

# Rodar com modelo específico
opencode --provider openrouter --model deepseek/deepseek-chat-v3-0324:free

Maximizando o uso grátis

Os modelos grátis do OpenRouter têm rate limits. Não é ilimitado — mas com algumas estratégias dá pra esticar bastante o uso diário.

  1. Use modelos menores pra tarefas simples (autocomplete, formatação) e reserve os pesados pra geração complexa e debugging
  2. Aproveite o cache do OpenRouter — requisições idênticas não contam no rate limit
  3. Distribua o uso entre modelos grátis diferentes. Se um modelo atingir o limite, troque pra outro
  4. Escreva prompts mais específicos e curtos. Quanto menos tokens na entrada, mais requests cabem no seu limite diário
  5. Combine OpenRouter grátis com Ollama local pra tarefas offline — o rate limit não importa se o modelo roda na sua máquina

OpenRouter vs API direta — quando usar cada um

OpenRouter

Gateway com 150+ modelos e uma única API key. Ideal pra quem quer flexibilidade.

+ Prós

  • • Uma API key pra todos os modelos — zero fricção pra trocar
  • • Vários modelos com tier grátis que não existem na API direta
  • • Fallback automático: se um modelo cai, redireciona pra outro
  • • API compatível com OpenAI — funciona em qualquer ferramenta

− Contras

  • • Latência levemente maior por conta do proxy (20-50ms extra)
  • • Rate limits nos modelos grátis podem limitar uso pesado
  • • Você depende de um intermediário — se o OpenRouter cair, tudo para

API Direta

Conexão direta com o provider do modelo. Ideal pra produção e uso intenso.

+ Prós

  • • Latência mínima — sem intermediário
  • • Limites de rate mais altos no geral
  • • Mais controle sobre configurações específicas do provider
  • • SLAs e suporte direto do provider

− Contras

  • • API key separada pra cada provider
  • • Preços variam muito e precisam de gestão individual
  • • Trocar de modelo exige reconfigurar tudo
  • • Sem tier grátis na maioria dos providers

Na prática, o setup ideal é OpenRouter pra desenvolvimento e experimentação (onde você troca de modelo toda hora) e API direta pra produção (onde precisa de latência mínima e SLA). Dá pra usar os dois ao mesmo tempo sem problema.

Exemplo prático: chamada via código

Se você quer integrar o OpenRouter direto no seu app (não só via IDE), a API é compatível com a da OpenAI. Olha como fica em TypeScript:

typescript
import OpenAI from 'openai';

const openrouter = new OpenAI({
  apiKey: process.env.OPENROUTER_API_KEY,
  baseURL: 'https://openrouter.ai/api/v1',
  defaultHeaders: {
    'HTTP-Referer': 'https://seusite.com',
    'X-Title': 'Meu App'
  }
});

async function gerarCodigo(prompt: string) {
  const response = await openrouter.chat.completions.create({
    model: 'deepseek/deepseek-chat-v3-0324:free',
    messages: [
      { role: 'system', content: 'Você é um dev senior. Gere código limpo e bem comentado.' },
      { role: 'user', content: prompt }
    ],
    temperature: 0.3 // mais baixo = código mais consistente
  });
  return response.choices[0].message.content;
}

Percebeu? É a mesma SDK da OpenAI. Só muda a baseURL e a apiKey. Se você já tem código que usa OpenAI, migrar pra OpenRouter é trocar duas linhas. Simples assim.

FAQ — Perguntas frequentes

O OpenRouter é realmente grátis?

Sim, vários modelos têm tier grátis com rate limits. Pra uso pessoal e desenvolvimento, os limites são suficientes na maioria dos casos. Modelos premium cobram por token, mas você escolhe quais usar.

Quais são os melhores modelos grátis pra código?

DeepSeek V3 pra geração, Qwen 2.5 Coder pra completar e refatorar, Gemini Flash pra review de código grande e DeepSeek R1 pra debugging de lógica complexa. Essa combinação cobre praticamente tudo.

Dá pra usar OpenRouter no Cursor?

Dá sim. Configure a base URL como https://openrouter.ai/api/v1 e coloque sua API key nas settings. Todos os modelos grátis ficam disponíveis direto na interface.

OpenRouter vs usar a API direta — qual é melhor?

Depende do uso. OpenRouter é melhor pra flexibilidade e experimentação com vários modelos. API direta é melhor pra produção onde latência e SLA importam. O ideal é combinar os dois.

Perguntas frequentes

O OpenRouter é realmente grátis?

Sim, o OpenRouter oferece dezenas de modelos com tier gratuito. Você paga zero pelos modelos marcados como 'free' na plataforma. Modelos premium têm custo por token, mas dá pra programar tranquilo usando só os grátis.

Quais são os melhores modelos grátis do OpenRouter para código?

Os destaques grátis são DeepSeek V3, Llama 3.3 70B, Qwen 2.5 Coder 32B e Gemini Flash. DeepSeek V3 é imbatível pra geração de código, e Qwen 2.5 Coder é excelente pra debugging e refactoring.

Dá pra usar OpenRouter no Cursor?

Sim. Cursor aceita API compatível com OpenAI. Basta configurar a base URL como https://openrouter.ai/api/v1 e colocar sua API key. Todos os modelos grátis ficam disponíveis direto no Cursor.

OpenRouter vs usar a API direta do modelo — qual é melhor?

OpenRouter é melhor pra quem quer flexibilidade e acesso a vários modelos com uma só API key. A API direta pode ser mais barata por token em modelos específicos, mas você perde a conveniência de trocar de modelo sem reconfigurar nada.