Pular para o conteúdo
AI Coding

OpenRouter: Como Usar 150+ Modelos de IA

Para de gerenciar 10 API keys diferentes. O OpenRouter unifica Claude, GPT-4, Gemini, DeepSeek e mais de 150 modelos em uma so endpoint, com modelos gratis pra comecar

Por que isso é importante

Para de gerenciar 10 API keys diferentes. O OpenRouter unifica Claude, GPT-4, Gemini, DeepSeek e mais de 150 modelos em uma so endpoint, com modelos gratis pra comecar agora.

TL;DR

O que voce precisa saber

OpenRouter e um gateway unificado para 150+ modelos de IA com uma so API key.

Varios modelos sao 100% gratuitos: Gemini Flash, DeepSeek V3, Llama 4 e outros.

Compativel com SDK da OpenAI - so mudar a base URL no seu codigo.

Ideal pra testar varios modelos sem criar conta em 10 servicos diferentes.

Setup leva menos de 5 minutos. Tem free tier sem cartao de credito.

O Que E o OpenRouter e Como Funciona

Se voce ja trabalha com IA, conhece a dor de cabeca de gerenciar multiplas API keys. Uma pra Claude, outra pra GPT-4, mais uma pra Gemini, outra pra Mistral. E cada uma com seu proprio formato de requisicao, suas proprias limites, seu proprio billing. O OpenRouter resolve isso de forma elegante: uma so API key pra acessar mais de 150 modelos diferentes.

Lancado em 2023 e consolidado como ferramenta essencial do ecossistema em 2025, o OpenRouter funciona como um proxy inteligente. Voce manda a requisicao pra eles, eles encaminham pro modelo certo e te devolvem a resposta. Do ponto de vista do seu codigo, e como se voce estivesse falando com uma API da OpenAI, mas por baixo dos panos pode estar rodando Claude, Gemini ou qualquer outro modelo disponivel.

Um Gateway para Todos os Modelos

O conceito e simples mas poderoso. O OpenRouter mantem integracao com dezenas de provedores: Anthropic, OpenAI, Google, Meta, Mistral, Cohere, xAI e muitos outros. Quando um novo modelo sai, eles adicionam ao catalogo rapidamente. Em vez de voce precisar acompanhar cada lancamento e atualizar seu codigo pra cada API diferente, so muda o nome do modelo na requisicao.

A compatibilidade com o formato da OpenAI e o grande diferencial. Qualquer biblioteca que usa a API da OpenAI funciona com OpenRouter sem modificacao significativa. Da pra usar o proprio SDK openai do Python ou JavaScript, so mudando a base URL e a API key. Isso torna a migracao praticamente transparente pra quem ja tem codigo escrito.

Precos vs APIs Diretas

Aqui vem a pergunta que todo dev faz: tem custo adicional por usar o intermediario? A resposta e: quase nenhum. Para a maioria dos modelos pagos, o OpenRouter cobra o mesmo preco que o provedor original, sem markup. Eles ganham dinheiro com volume e com alguns modelos especificos. Pra modelos gratuitos, e literalmente zero.

Comparando com contratar direto, a vantagem real do OpenRouter e a simplicidade operacional. Um so billing, um so dashboard, uma so API key pra rotacionar caso comprometa. Se voce usa 3 ou mais modelos diferentes no seu projeto, a economia de tempo na gestao ja paga o possivel centavo a mais por token.

Como o billing funciona

Voce deposita creditos no OpenRouter (minimo $5).

Cada chamada debita o custo do modelo escolhido.

Modelos gratis nao debitam nada.

Da pra ver o gasto por modelo no dashboard.

Nao tem assinatura mensal - so paga o que usa.

Setup em 5 Minutos

Vamos direto ao ponto. O setup do OpenRouter e rapido e nao requer cartao de credito pra comecar com os modelos gratuitos. Voce vai criar uma conta, gerar uma API key e ja estar mandando requisicoes em menos de 5 minutos. Sem drama, sem configuracao complicada.

Criando Conta e API Key

  1. Acesse openrouter.ai e clique em Sign In (funciona com Google ou GitHub)
  2. No dashboard, va em Keys no menu lateral
  3. Clique em Create Key e de um nome descritivo (ex: 'dev-local')
  4. Copie a chave gerada - comeca com 'sk-or-v1-'
  5. Guarde em variavel de ambiente: export OPENROUTER_API_KEY='sk-or-v1-...'
  6. Opcional: adicione creditos em Credits se quiser usar modelos pagos

Primeiro Request via cURL

Com a API key em maos, da pra testar direto do terminal. O formato e identico ao da OpenAI, mudando so a URL base. Aqui vai um exemplo usando Gemini Flash, que e gratuito.

bash
# Testando com cURL - modelo gratuito
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "HTTP-Referer: http://localhost:3000" \
  -H "X-Title: Meu Projeto Dev" \
  -d '{
    "model": "google/gemini-flash-1.5",
    "messages": [
      {
        "role": "user",
        "content": "Explica o que e um closure em JavaScript em 2 frases"
      }
    ]
  }'

Os headers HTTP-Referer e X-Title sao recomendados pelo OpenRouter pra identificar sua aplicacao no dashboard deles. Nao sao obrigatorios, mas ajudam na hora de debugar uso por aplicacao. Para producao, coloca a URL real do seu site.

Integrando com Python

python
# pip install openai
from openai import OpenAI
import os

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key=os.environ["OPENROUTER_API_KEY"],
    default_headers={
        "HTTP-Referer": "http://localhost:3000",
        "X-Title": "Meu Projeto Dev",
    }
)

# Usando modelo gratuito
response = client.chat.completions.create(
    model="google/gemini-flash-1.5",
    messages=[
        {
            "role": "user",
            "content": "Revisa esse codigo Python e aponta problemas:\n\ndef soma(a, b):\n    return a + b\n"
        }
    ]
)

print(response.choices[0].message.content)

# Mudando pra Claude sem alterar mais nada
response2 = client.chat.completions.create(
    model="anthropic/claude-3.5-sonnet",
    messages=[
        {"role": "user", "content": "Mesmo codigo, analise mais profunda"}
    ]
)

print(response2.choices[0].message.content)
typescript
// npm install openai
import OpenAI from 'openai';

const client = new OpenAI({
  baseURL: 'https://openrouter.ai/api/v1',
  apiKey: process.env.OPENROUTER_API_KEY,
  defaultHeaders: {
    'HTTP-Referer': 'http://localhost:3000',
    'X-Title': 'Meu Projeto Dev',
  },
});

async function askModel(model: string, prompt: string) {
  const response = await client.chat.completions.create({
    model,
    messages: [{ role: 'user', content: prompt }],
  });
  return response.choices[0].message.content;
}

// Testando diferentes modelos no mesmo codigo
const models = [
  'google/gemini-flash-1.5',        // gratis
  'deepseek/deepseek-chat',          // gratis
  'meta-llama/llama-4-scout:free',   // gratis
];

const prompt = 'Qual a diferenca entre map e flatMap em JavaScript?';

for (const model of models) {
  console.log(`\n--- ${model} ---`);
  const answer = await askModel(model, prompt);
  console.log(answer);
}

Top 10 Modelos Gratuitos no OpenRouter

O OpenRouter tem uma categoria de modelos marcados como ':free' que nao custam nada. Nao e trial limitado, sao modelos que os proprios provedores disponibilizam gratuitamente via OpenRouter. A lista muda conforme novos modelos chegam, mas esses sao os mais confiaveis e uteis pra desenvolvimento em 2026.

Uma ressalva importante: modelos gratuitos podem ter rate limits mais baixos e latencia maior em horarios de pico. Pra uso pessoal e prototipos, e mais que suficiente. Pra producao com alto volume, vale considerar os pagos ou configurar fallback automatico.

Google Gemini Flash 1.5 (gratis)

O modelo gratuito mais util do catalogo. Contexto de 1M tokens, velocidade excelente e qualidade surpreendente pra coding e analise. Identificador: google/gemini-flash-1.5

DeepSeek V3 (gratis)

Modelo chines de alto desempenho que compete com GPT-4. Otimo pra raciocinio e codigo. Gratis no OpenRouter com bom rate limit. Identificador: deepseek/deepseek-chat

Meta Llama 4 Scout (gratis)

Ultima geracao do Llama com multimodalidade. Excelente pra tarefas gerais de desenvolvimento. Identificador: meta-llama/llama-4-scout:free

Mistral 7B Instruct (gratis)

Modelo compacto e rapido. Ideal pra completacoes simples, explicacoes de codigo e tarefas onde velocidade importa mais que profundidade. Identificador: mistralai/mistral-7b-instruct:free

Qwen 2.5 Coder (gratis)

Especializado em codigo pela Alibaba. Surpreendentemente bom pra debugging e geracao de codigo em varias linguagens. Identificador: qwen/qwen-2.5-coder-32b-instruct:free

Google Gemma 3 (gratis)

Versao open-source do Google, disponivel em varios tamanhos. Bom pra tarefas rapidas e integracao em aplicacoes com latencia baixa. Identificador: google/gemma-3-27b-it:free

Microsoft Phi-4 (gratis)

Modelo compacto da Microsoft com qualidade acima do esperado pro tamanho. Bom pra tarefas de raciocinio e codigo simples. Identificador: microsoft/phi-4:free

Nvidia Llama 3.1 Nemotron (gratis)

Fine-tune da Nvidia do Llama 3.1 com foco em seguir instrucoes. Excelente pra tarefas estruturadas e geracao de JSON. Identificador: nvidia/llama-3.1-nemotron-70b-instruct:free

Moonshot Kimi (gratis)

Modelo chines com contexto longo e bom desempenho em analise de codigo. Alternativa interessante ao Gemini Flash pra contextos grandes. Identificador: moonshotai/moonshot-v1-8k:free

Cohere Command R (gratis)

Especializado em RAG e busca. Se voce esta construindo sistemas de recuperacao de informacao, esse e o modelo certo. Identificador: cohere/command-r:free

Como ver a lista atualizada de modelos gratuitos

Acesse openrouter.ai/models e filtre por 'Free' no menu lateral.

Ou via API: GET https://openrouter.ai/api/v1/models e filtre por pricing.prompt === '0'.

A lista e atualizada constantemente conforme provedores adicionam modelos gratuitos.

Integrando com Ferramentas de Dev

O OpenRouter nao e so pra chamar via API no seu codigo. Ele integra com as principais ferramentas de desenvolvimento assistido por IA que voce provavelmente ja usa ou quer usar. A grande sacada e que qualquer ferramenta que aceita uma API key no formato OpenAI funciona automaticamente.

OpenCode (Terminal)

O OpenCode e uma ferramenta de coding via terminal que suporta OpenRouter nativamente. Configure uma vez e troca de modelo na hora sem reinstalar nada. Perfeito pra quem gosta de trabalhar no terminal e quer experimentar diferentes modelos pra diferentes tipos de tarefa.

bash
# Configurando OpenCode com OpenRouter
export OPENROUTER_API_KEY='sk-or-v1-sua-chave-aqui'

# No config do OpenCode (~/.config/opencode/config.json)
{
  "provider": "openrouter",
  "model": "google/gemini-flash-1.5",
  "apiKey": "${OPENROUTER_API_KEY}"
}

Continue (VS Code)

O Continue e uma extensao open-source pro VS Code que funciona como alternativa ao Copilot. Com OpenRouter, voce tem acesso a qualquer modelo disponivel direto no seu editor. Da pra configurar modelos diferentes pra chat, autocomplete e embeddings separadamente.

javascript
// ~/.continue/config.json
{
  "models": [
    {
      "title": "DeepSeek V3 (gratis)",
      "provider": "openai",
      "model": "deepseek/deepseek-chat",
      "apiBase": "https://openrouter.ai/api/v1",
      "apiKey": "sk-or-v1-sua-chave-aqui"
    },
    {
      "title": "Claude 3.5 Sonnet",
      "provider": "openai",
      "model": "anthropic/claude-3.5-sonnet",
      "apiBase": "https://openrouter.ai/api/v1",
      "apiKey": "sk-or-v1-sua-chave-aqui"
    },
    {
      "title": "Gemini Flash (gratis)",
      "provider": "openai",
      "model": "google/gemini-flash-1.5",
      "apiBase": "https://openrouter.ai/api/v1",
      "apiKey": "sk-or-v1-sua-chave-aqui"
    }
  ],
  "tabAutocompleteModel": {
    "title": "Qwen Coder (gratis)",
    "provider": "openai",
    "model": "qwen/qwen-2.5-coder-32b-instruct:free",
    "apiBase": "https://openrouter.ai/api/v1",
    "apiKey": "sk-or-v1-sua-chave-aqui"
  }
}

LibreChat e Outros Clientes

LibreChat e uma interface web self-hosted que suporta OpenRouter out-of-the-box. Da pra rodar localmente via Docker e ter uma interface tipo ChatGPT acessando todos os modelos com sua chave do OpenRouter. Util pra times que querem uma interface compartilhada sem pagar pelo ChatGPT Team.

bash
# LibreChat com Docker + OpenRouter
# No arquivo .env do LibreChat
OPENROUTER_KEY=sk-or-v1-sua-chave-aqui

# No librechat.yaml
endpoints:
  openRouter:
    apiKey: "${OPENROUTER_KEY}"
    baseURL: "https://openrouter.ai/api/v1"
    models:
      default: ["google/gemini-flash-1.5", "deepseek/deepseek-chat", "anthropic/claude-3.5-sonnet"]
      fetch: true  # busca lista atualizada automaticamente

Dicas para Economizar com Model Routing

Uma das features menos conhecidas do OpenRouter e o model routing automatico. Em vez de fixar um modelo especifico, voce pode pedir pro OpenRouter escolher o mais barato ou mais rapido que atenda seus criterios. Isso e util em producao quando voce quer controlar custos sem sacrificar qualidade.

O conceito e simples: em vez de passar um modelo especifico, voce passa uma lista de modelos em ordem de preferencia. O OpenRouter tenta o primeiro, se falhar (rate limit, erro) vai pro segundo, e assim por diante. Isso se chama model fallback e e gratuito pra usar.

python
# Model routing com fallback automatico
response = client.chat.completions.create(
    # Lista de modelos em ordem de preferencia
    # OpenRouter tenta o primeiro, faz fallback pros seguintes
    model="google/gemini-flash-1.5",
    extra_body={
        "models": [
            "google/gemini-flash-1.5",      # gratis, tenta primeiro
            "deepseek/deepseek-chat",         # gratis, fallback 1
            "meta-llama/llama-4-scout:free",  # gratis, fallback 2
            "anthropic/claude-3-haiku"        # pago, ultimo recurso
        ],
        "route": "fallback"  # ou "cheapest" para menor preco
    },
    messages=[{"role": "user", "content": prompt}]
)

# Verificar qual modelo foi realmente usado
print(f"Modelo usado: {response.model}")
print(f"Custo: {response.usage}")

Estrategias pra reduzir custo no OpenRouter

  • Use modelos ':free' pra desenvolvimento e testes
  • Configure fallback: gratis primeiro, pago so se necessario
  • Use Gemini Flash pra tarefas simples (rapido e gratis)
  • Reserve Claude/GPT-4 so pra tarefas complexas
  • Monitore custo por modelo no dashboard do OpenRouter
  • Configure limite de gasto mensal no dashboard
  • Use streaming pra nao bloquear e detectar respostas ruins cedo

Dica de ouro

Para tarefas de codigo: Qwen 2.5 Coder (gratis) e surpreendentemente bom e muito mais rapido que Claude pro autocomplete basico.

Para analise e reasoning: DeepSeek V3 (gratis) chega perto do Claude 3.5 em muitos benchmarks.

So use o modelo caro quando voce ja testou com os gratuitos e eles nao foram suficientes.

Quando Usar OpenRouter vs API Direta

O OpenRouter nao e a resposta pra tudo. Ha casos onde contratar direto com o provedor faz mais sentido. Entender essa diferenca te ajuda a usar cada opcao no contexto certo, sem pagar mais do que precisa ou complicar desnecessariamente.

OpenRouter

+ Prós

  • • Uma so API key pra tudo
  • • Facil trocar de modelo sem mudar codigo
  • • Modelos gratuitos disponiveis
  • • Fallback automatico entre modelos
  • • Dashboard unificado de custo
  • • Sem compromisso de volume

− Contras

  • • Latencia levemente maior (intermediario)
  • • Dependencia de terceiro
  • • Alguns modelos enterprise nao disponiveis
  • • Features especificas do provedor podem nao funcionar

API Direta (Anthropic, OpenAI, etc)

+ Prós

  • • Latencia minima sem intermediario
  • • Acesso a todas as features do provedor
  • • SLA direto com o provedor
  • • Melhor pra volume alto com contrato

− Contras

  • • Multiplas API keys pra gerenciar
  • • Billing separado em cada provedor
  • • Trocar de modelo requer refatoracao
  • • Sem fallback automatico

A regra pratica e simples: se voce esta prototipando, experimentando modelos ou construindo algo pessoal, use OpenRouter sem pensar duas vezes. Se voce tem um produto em producao, usa um modelo especifico com volume alto e precisa de SLA garantido, ai vale contratar direto.

Muita gente usa os dois em paralelo: OpenRouter pra desenvolvimento e testes rapidos, API direta em producao com o modelo que ja escolheu. Essa e uma abordagem saudavel que combina o melhor dos dois mundos. O codigo ja esta pronto pra ambos porque o formato e o mesmo.

Quando definitivamente usar OpenRouter

Voce quer testar 5 modelos diferentes no mesmo projeto sem criar 5 contas.

Voce quer modelos gratuitos sem configurar Ollama local.

Voce precisa de fallback automatico pra alta disponibilidade.

Voce esta construindo uma ferramenta que o usuario traz a propria API key.

Voce quer um unico lugar pra ver quanto esta gastando com IA.

Casos de Uso Reais: O Que Devs Fazem com OpenRouter

Pra fechar, vamos ver como devs reais usam o OpenRouter no dia a dia. Nao e so pra chamar no codigo - da pra usar como base de toda uma infraestrutura de IA no seu projeto sem complicar.

Um caso comum: pipeline de CI/CD que usa IA pra revisar codigo. Com OpenRouter, o pipeline usa Gemini Flash (gratis) pra reviews simples de PR e aciona Claude so quando a diff e grande ou complexa. Economiza 80% do custo com IA sem sacrificar qualidade nas reviews que importam.

Outro caso: chatbot de suporte que usa modelos diferentes por idioma. Llama 4 pra ingles, um modelo especializado pra chines, outro pra portugues. Com OpenRouter, e uma so integracao que direciona pro modelo certo baseado no idioma detectado na mensagem do usuario.

typescript
// Exemplo real: seletor de modelo por complexidade da tarefa
type TaskType = 'simple' | 'medium' | 'complex';

function selectModel(taskType: TaskType): string {
  const models: Record<TaskType, string> = {
    simple: 'google/gemini-flash-1.5',       // gratis, rapido
    medium: 'deepseek/deepseek-chat',          // gratis, boa qualidade
    complex: 'anthropic/claude-3.5-sonnet',   // pago, melhor qualidade
  };
  return models[taskType];
}

async function processTask(task: string, complexity: TaskType) {
  const model = selectModel(complexity);
  console.log(`Usando modelo: ${model} para tarefa ${complexity}`);
  
  const response = await client.chat.completions.create({
    model,
    messages: [{ role: 'user', content: task }],
  });
  
  return {
    result: response.choices[0].message.content,
    model: response.model,
    tokens: response.usage?.total_tokens,
  };
}

// Uso
const result = await processTask(
  'Corrige o typo nessa funcao',
  'simple'  // vai usar gemini flash gratis
);

const result2 = await processTask(
  'Refatora esse modulo inteiro pra usar Clean Architecture',
  'complex'  // vai usar Claude
);

O OpenRouter virou infraestrutura basica de IA pra muitos devs independentes e pequenas equipes. A barreira de entrada e zero, o upside e enorme. Se voce ainda nao tem uma conta, cria agora - e de graca e leva literalmente 2 minutos.

Perguntas frequentes

O OpenRouter e gratuito?

Tem um free tier com creditos iniciais e varios modelos com custo zero, como Gemini Flash e DeepSeek V3. Voce so paga quando usar modelos pagos acima do limite gratuito.

OpenRouter e mais barato que contratar direto?

Depende do modelo. Para Claude e GPT, os precos sao equivalentes ou levemente maiores pela conveniencia. Para modelos menores e gratuitos, o OpenRouter e muito mais vantajoso.

Da pra usar OpenRouter com qualquer SDK de OpenAI?

Sim. O OpenRouter e compativel com a API da OpenAI, entao qualquer SDK que suporte a interface OpenAI funciona so mudando a base URL para openrouter.ai/api/v1.

O Que E o OpenRouter e Como Funciona

Se voce ja trabalha com IA, conhece a dor de cabeca de gerenciar multiplas API keys. Uma pra Claude, outra pra GPT-4, mais uma pra Gemini, outra pra Mistral. E cada uma com seu proprio formato de requisicao, suas proprias limites, seu proprio billing. O OpenRouter resolve isso de forma elegante: uma so API key pra acessar mais de 150 modelos diferentes. Lancado em 2023 e consolidado como ferramenta essencial do ecossistema em 2025, o OpenRouter funciona como um proxy inteligente. Voce manda a requisicao pra eles, eles encaminham pro modelo certo e te devolvem a resposta. Do ponto de vista do seu codigo, e como se voce estivesse falando com uma API da OpenAI, mas por baixo dos panos pode estar rodando Claude, Gemini ou qualquer outro modelo disponivel. O conceito e simples mas poderoso. O OpenRouter mantem integracao com dezenas de provedores: Anthropic, OpenAI, Google, Meta, Mistral, Cohere, xAI e muitos outros. Quando um novo modelo sai, eles adicionam ao catalogo rapidamente. Em vez de voce precisar acompanhar cada lancamento e atualizar seu codigo pra cada API diferente, so muda o nome do modelo na requisicao.

Quando Usar OpenRouter vs API Direta

O OpenRouter nao e a resposta pra tudo. Ha casos onde contratar direto com o provedor faz mais sentido. Entender essa diferenca te ajuda a usar cada opcao no contexto certo, sem pagar mais do que precisa ou complicar desnecessariamente. A regra pratica e simples: se voce esta prototipando, experimentando modelos ou construindo algo pessoal, use OpenRouter sem pensar duas vezes. Se voce tem um produto em producao, usa um modelo especifico com volume alto e precisa de SLA garantido, ai vale contratar direto. Muita gente usa os dois em paralelo: OpenRouter pra desenvolvimento e testes rapidos, API direta em producao com o modelo que ja escolheu. Essa e uma abordagem saudavel que combina o melhor dos dois mundos. O codigo ja esta pronto pra ambos porque o formato e o mesmo.