Uma API para 200+ modelos de IA

Pare de fazer malabarismo com chaves de API e consoles de provedores. Roteie suas requisições para OpenAI, Anthropic, Google Gemini, Mistral e DeepSeek, acompanhe seus custos em tempo real e troque de modelo sem mexer no seu código.

Integração

Compatível drop-in.
Zero curva de aprendizado.

Já usa um SDK da OpenAI? Aponte-o para api.openvertexrouter.com e pronto. Funciona com qualquer linguagem ou framework.

  • Funciona com o SDK da OpenAI em qualquer linguagem, sem novas dependências
  • Mude uma linha: a URL base
  • Cada requisição medida: custo, latência e tokens consumidos
terminalbash
curl https://api.openvertexrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $OVR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "anthropic/claude-sonnet-5",
    "messages": [{ "role": "user", "content": "Hello" }]
  }'
client.tstypescript
import OpenAI from "openai";

const client = new OpenAI({
  // the only change
  baseURL: "https://api.openvertexrouter.com/v1",
  apiKey: process.env.OVR_API_KEY,
});

const completion = await client.chat.completions.create({
  model: "anthropic/claude-sonnet-5",
  messages: [{ role: "user", content: "Hello" }],
});
route.tstypescript
// app/api/chat/route.ts
import OpenAI from "openai";

const client = new OpenAI({
  // the only change
  baseURL: "https://api.openvertexrouter.com/v1",
  apiKey: process.env.OVR_API_KEY,
});

export async function POST(req: Request) {
  const { messages } = await req.json();
  const completion = await client.chat.completions.create({
    model: "anthropic/claude-sonnet-5",
    messages,
  });
  return Response.json(completion.choices[0].message);
}
client.pypython
import os
from openai import OpenAI

client = OpenAI(
    # the only change
    base_url="https://api.openvertexrouter.com/v1",
    api_key=os.environ["OVR_API_KEY"],
)

completion = client.chat.completions.create(
    model="anthropic/claude-sonnet-5",
    messages=[{"role": "user", "content": "Hello"}],
)
Client.javajava
OpenAIClient client = OpenAIOkHttpClient.builder()
    // the only change
    .baseUrl("https://api.openvertexrouter.com/v1")
    .apiKey(System.getenv("OVR_API_KEY"))
    .build();

ChatCompletion completion = client.chat().completions().create(
    ChatCompletionCreateParams.builder()
        .model("anthropic/claude-sonnet-5")
        .addUserMessage("Hello")
        .build());
client.gogo
client := openai.NewClient(
    // the only change
    option.WithBaseURL("https://api.openvertexrouter.com/v1"),
    option.WithAPIKey(os.Getenv("OVR_API_KEY")),
)

completion, err := client.Chat.Completions.New(ctx,
    openai.ChatCompletionNewParams{
        Model: "anthropic/claude-sonnet-5",
        Messages: []openai.ChatCompletionMessageParamUnion{
            openai.UserMessage("Hello"),
        },
    })
client.phpphp
$client = OpenAI::factory()
    // the only change
    ->withBaseUri('https://api.openvertexrouter.com/v1')
    ->withApiKey(getenv('OVR_API_KEY'))
    ->make();

$completion = $client->chat()->create([
    'model' => 'anthropic/claude-sonnet-5',
    'messages' => [['role' => 'user', 'content' => 'Hello']],
]);
client.rbruby
client = OpenAI::Client.new(
  # the only change
  uri_base: "https://api.openvertexrouter.com/v1",
  access_token: ENV["OVR_API_KEY"]
)

completion = client.chat(parameters: {
  model: "anthropic/claude-sonnet-5",
  messages: [{ role: "user", content: "Hello" }]
})

Como funciona

Cada requisição passa pela sua própria instância

Cada chamada roda em infraestrutura alocada só para a sua conta, com chaves de provedor isoladas. Sem gateway compartilhado, sem vizinhos barulhentos. Escolha entre uma instância única dimensionada para sua carga (Business) e várias instâncias em paralelo atrás de um load balancer (Enterprise).

Os apps do seu timeAPI unificadaRoteamento de provedorControle de orçamentoFailover de chavesRoteamento de modeloObservabilidadeOVRAI GATEWAY

Por que os times migram

10

provedores, um endpoint

OpenAI, Anthropic, Google, Mistral, DeepSeek e mais — atrás de uma única chave.

200+

modelos

De dez provedores. Troque de modelo mudando uma string.

30 %

de eficiência em custos

Cache inteligente, estratégias de roteamento.

99,999 %

de disponibilidade

Infraestrutura testada em batalha, confiável mesmo em grande escala.

Capacidades da plataforma

Tudo o que você precisa para rodar LLMs em produção

Oito capacidades que transformam uma pilha de contas de provedores em um único gateway que você realmente governa.

API unificada

Mantenha seu código do SDK da OpenAI. Troque a URL base e pronto, está no ar.

Acesso multiprovedor

OpenAI, Anthropic, Google, Mistral e DeepSeek em uma única integração. Troque de modelo mudando uma string.

Instâncias dedicadas

Sua própria instância de gateway, dimensionada para sua carga, com chaves de provedor isoladas.

Controle de orçamento

Saldos pré-pagos com tetos rígidos. Cada requisição é pré-autorizada antes de sair.

Limites e alertas

Limites de gasto por chave, com alertas em 80, 90 e 100 % do orçamento.

Roteamento inteligente

Roteamento por provedor e por modelo com failover de chaves embutido, seguindo as suas regras.

Análise de uso

Gastos e métricas de tokens em tempo real para cada requisição do seu time.

Detalhamento por modelo e provedor

Detalhe uso e gastos por provedor e por modelo para achar rápido os estouros de custo.

Preços

Dois planos, um mesmo modelo de preços

A mesma estrutura nos dois: uma assinatura mensal mais o consumo de provedores. Só os números mudam com o seu volume.

Enterprise

Preço sob medida

Implantação em escala, condições negociadas, prazos de pagamento. Para times acima de US$ 15.000/mês.

  • Várias instâncias atrás de um load balancer
  • Redundância e fixação de versão
  • Pagamento Net 15 / 30, transferência aceita
  • Account manager dedicado
  • SLA contratual disponível
Falar com vendas

*A assinatura mensal varia com o tamanho da instância.

Ver os preços completos e a comparação de planos →

Newsletter

Acompanhe o que lançamos

Um e-mail quando algo que vale a pena muda: um novo modelo, uma mudança de preços, um novo guia de roteamento.

  • Novos modelos e provedores assim que chegam
  • Mudanças de preços e de plataforma
  • Guias de roteamento e custos do blog

Sem spam. Cancele quando quiser. Política de privacidade