Key Takeaways
- O proxy open source do LiteLLM é gratuito em qualquer volume — mais de 100 APIs de provedores atrás de um único endpoint compatível com OpenAI, com controle de gastos, orçamentos e rate limiting já no plano gratuito.
- O OpenRouter não cobra assinatura, mas fica com ~5,5% sobre compras de saldo via Stripe (mínimo US$ 0,80), 5% em cripto, mais taxa BYOK de 5% acima de US$ 25.000/mês (pagamento por uso) ou US$ 200.000/mês (corporativo).
- O Portkey foi adquirido pela Palo Alto Networks (concluída em 29 de maio de 2026) e está sendo integrado ao Prisma AIRS — trate-o agora como compra de segurança corporativa.
- O repositório do LiteLLM no GitHub tem ~53,8 mil estrelas e ~9,8 mil forks em agosto de 2026 — o sinal público de adoção mais claro entre os três.
- O OpenRouter lista mais de 380 modelos e é o caminho mais rápido entre o cadastro e uma chamada multimodelo funcionando.
- O ponto de virada honesto: auto-hospedar fica mais barato assim que 5,5% do seu gasto mensal com modelos superar o custo de operar o proxy.
- Dispense o gateway por completo se você chama um único provedor com volume baixo e previsível e não planeja adicionar um segundo.
🏆 Melhor escolha: auto-hospedar ou alugar o gateway?
Rode o LiteLLM você mesmo se tiver onde rodá-lo; use o OpenRouter se não tiver. Essa única pergunta resolve a decisão com mais segurança do que qualquer lista de recursos, porque as três ferramentas já cobrem o trabalho central de um gateway: uma API, failover e controle de custos.
Auto-hospedar ou gateway hospedado?
Use um LLM local se:
- •Você já opera serviços e consegue manter um proxy — o LiteLLM não acrescenta nenhum percentual, em nenhum volume
- •Seu gasto mensal com modelos é alto o bastante para que 5% seja dinheiro de verdade (acima de cerca de US$ 500/mês isso supera a maioria das contas de hospedagem pequenas)
- •Você precisa controlar exatamente qual provedor atende uma requisição que falhou — por exemplo, para permanecer dentro de um limite de residência de dados da UE
- •Você precisa de implantação isolada de rede (o LiteLLM Enterprise suporta isso explicitamente)
Use um modelo em nuvem se:
- •Você não tem capacidade de DevOps e não quer assumir um serviço em operação
- •Você quer estar chamando mais de 380 modelos dentro de uma hora — o OpenRouter só exige uma API key
- •Seu gasto é modesto o bastante para que ~5,5% seja irrelevante diante do tempo economizado
- •Você já compra ferramentas de segurança da Palo Alto Networks e quer governar o gateway dentro do Prisma AIRS
Decisão rápida:
- →Gratuito e auto-hospedado → LiteLLM (núcleo OSS sob licença Apache, ~53,8 mil estrelas)
- →Zero infraestrutura, modelos hoje → OpenRouter (mais de 380 modelos, taxa de ~5,5% sobre o saldo)
- →Governança de segurança corporativa → Portkey / Prisma AIRS (US$ 49/mês Production, Enterprise sob consulta)
- →Um provedor, volume baixo → nenhum gateway — chame o SDK diretamente
O que é um gateway de API LLM?
Um gateway de API LLM é uma camada de roteamento entre sua aplicação e vários provedores de modelos que expõe uma única API consistente. Em vez de escrever código de integração separado para OpenAI, Anthropic, Google e todos os demais, você chama o gateway uma vez e ele cuida do formato específico de cada provedor, da autenticação, do failover e — na maioria das implementações — do controle de custos e do rate limiting.
O ganho só existe a partir do momento em que há mais de um provedor em produção. Numa aplicação com um único provedor, o gateway é uma camada de abstração sem contrapartida. Use um gateway se a dispersão de provedores já estiver custando código de cola e plantão; caso contrário, dispense.
Um gateway de API LLM roteia as chamadas da sua aplicação para vários provedores de modelos por uma única interface compatível com OpenAI, acrescentando failover, controle de custos e rate limiting sobre as APIs originais.
Pense num adaptador de tomada para modelos de IA. Seu código encaixa numa única tomada; o adaptador lida com o fato de cada provedor ter um plugue diferente. Se você só usa um plugue, não precisa do adaptador.
LiteLLM vs OpenRouter vs Portkey: o comparativo completo
Nenhum gateway vence em todas as categorias: o LiteLLM lidera em custo e controle, o OpenRouter na rapidez de configuração e o Prisma AIRS em governança corporativa. Preços e detalhes verificados nas páginas dos próprios fornecedores em 27 de agosto de 2026 — confira de novo se esta página estiver no ar há mais de 90 dias, já que os preços de gateways se moveram várias vezes neste ano.
| Critério | LiteLLM | OpenRouter | Portkey (Prisma AIRS) |
|---|---|---|---|
| Melhor para | Times que auto-hospedam, controle total, sem taxas | Trabalho multimodelo rápido sem infraestrutura | Empresas que já compram segurança da Palo Alto |
| Preço | Gratuito (OSS); Enterprise anual sob consulta | Sem assinatura; ~5,5% via Stripe, 5% em cripto | Grátis 10 mil logs/mês; US$ 49/mês Production; Enterprise sob consulta |
| Auto-hospedagem | Sim — é o desenho base, mais um proxy gerenciado opcional | Não — apenas acesso por API hospedada | Implantação em nuvem privada no Enterprise |
| Provedores / modelos | Mais de 100 APIs de provedores | Mais de 380 modelos listados | O repositório já anunciou mais de 1.600 LLMs |
| Failover | Sim — cadeias configuráveis no plano OSS | Sim — automático, no nível da plataforma | Sim — fallbacks e balanceamento em todos os planos |
| Controle de custos | Sim — gastos e orçamentos no plano OSS | Sim — painel de saldo por requisição | Sim — atribuição de custo e orçamento por chave virtual |
| Rate limiting | Sim — plano OSS | Global, no nível da conta (não configurável) | Controle granular no Enterprise |
| Programa de afiliados | Nenhum encontrado | Nenhum encontrado | Nenhum encontrado (o da Palo Alto é B2B) |
⚠️Warning: Preços capturados antes de maio de 2026 já não descrevem o Portkey. Confirme as condições atuais do Prisma AIRS com a Palo Alto Networks antes de citar um número de artigo ou captura antigos.
A via auto-hospedada: por que o LiteLLM é o padrão
O LiteLLM é o padrão da comunidade porque o plano gratuito é o produto inteiro, não uma versão de teste. Controle de gastos, orçamentos, rate limiting e cadeias de failover estão no núcleo open source — o plano Enterprise acrescenta SSO, SCIM, suporte dedicado e implantação isolada de rede, não o roteamento em si.
O proxy open source do LiteLLM chama mais de 100 APIs de provedores de LLM por uma interface compatível com OpenAI, sem custo de licença e sem acréscimo por requisição, em qualquer volume.
LiteLLM — melhor gateway no geral
Gratuito, auto-hospedado, ~53,8 mil estrelas no GitHub — o mais próximo de um padrão
O proxy central do LiteLLM é gratuito e open source e roteia mais de 100 APIs de provedores por um endpoint compatível com OpenAI. É a única opção aqui sem acréscimo percentual sobre o gasto com modelos, e é isso que a torna a mais barata em valores absolutos quando o volume importa. Suas ~53,8 mil estrelas e ~9,8 mil forks (agosto de 2026) são o sinal público de manutenção mais forte entre as três ferramentas — relevante quando você aposta uma camada de roteamento em produção em um projeto que precisa continuar mantido daqui a dois anos. O custo que você paga é operacional: você opera, monitora e atualiza um serviço.
Vantagens
- +Sem taxa por requisição nem percentual — gratuito em qualquer volume
- +Cadeias de failover, orçamentos e limites de taxa, tudo no plano OSS gratuito
- +Controle total sobre a lógica de roteamento e a residência dos dados
- +O plano Enterprise suporta implantação isolada de rede de forma explícita
Desvantagens
- –Disponibilidade, correções e monitoramento do serviço ficam por sua conta
- –O preço Enterprise é sob consulta — não há número publicado para orçar
- –Escolha errada para um time sem nenhuma capacidade de DevOps
A via hospedada: OpenRouter e Prisma AIRS
Há razões honestas, não publicitárias, para alugar o gateway em vez de operá-lo. Você economiza trabalho real de infraestrutura: disponibilidade, atualizações, gestão de segredos e o plantão que acompanha qualquer serviço no caminho das requisições. Um gateway hospedado também entrega uma cobertura de provedores que você integraria um a um.
A contrapartida é uma taxa percentual que cresce com o gasto e menos controle fino sobre o failover. É uma boa troca em volume moderado e uma troca ruim em volume alto — a seção de custos abaixo traz a aritmética exata do ponto de virada.
OpenRouter — melhor gateway sem configuração
Mais de 380 modelos com uma API key, nenhum servidor para operar
O OpenRouter é o caminho mais rápido entre o zero e uma aplicação multimodelo funcionando: cadastre-se, pegue uma API key e chame no mesmo dia mais de 380 modelos listados. Não há assinatura — a taxa incide sobre a recarga da conta, em torno de 5,5% sobre compras de saldo via Stripe (mínimo US$ 0,80) ou 5% em cripto. A taxa BYOK de 5% só vale acima de US$ 25.000 de gasto mensal roteado por BYOK (pagamento por uso) ou US$ 200.000 (plano corporativo), então uso leve não paga nada a mais ali. O failover é automático, mas no nível da plataforma: se um provedor falha, o OpenRouter pode rotear para um modelo equivalente sem que você configure a cadeia.
Vantagens
- +Nenhuma infraestrutura — uma API key é toda a configuração
- +Mais de 380 modelos listados, muito além do que você integraria manualmente
- +Sem assinatura; uso leve de BYOK fica dentro da franquia gratuita
- +Failover automático entre provedores, sem configuração
Desvantagens
- –A taxa de ~5,5% se acumula e fica cara em volume alto
- –O rate limiting é global, no nível da conta, e não configurável por você
- –Menos controle sobre qual provedor atende uma requisição que falhou — um problema sob regras estritas de residência de dados
Portkey / Prisma AIRS — a compra de segurança corporativa
Agora o gateway de IA dentro da plataforma de segurança da Palo Alto Networks
O Portkey continua fazendo o trabalho de gateway: fallbacks automáticos, balanceamento de carga, atribuição de custos e orçamento por chave virtual em todos os planos, com um plano Developer gratuito de 10.000 logs/mês e um plano Production de US$ 49/mês com 100.000 logs/mês. O que mudou foi a categoria: desde que a Palo Alto Networks concluiu a aquisição em 29 de maio de 2026, ele é posicionado como o gateway de IA dentro da plataforma de segurança Prisma AIRS, e não como um roteador independente. Isso serve bem se você já está comprando governança de IA corporativa e serve mal se você queria uma ferramenta ágil e independente.
Vantagens
- +Fallbacks e balanceamento de carga em todos os planos, inclusive no gratuito
- +Atribuição de custos e orçamento por chave virtual embutidos
- +Implantação em nuvem privada disponível no Enterprise
- +Combina o roteamento do gateway com governança de segurança de IA mais ampla
Desvantagens
- –Não é mais independente — roadmap e preços agora seguem um grande fornecedor de segurança
- –Preços e estrutura de planos anteriores a maio de 2026 podem já estar defasados
- –Escolha errada se a neutralidade de fornecedor era parte do motivo para ter um gateway
Quanto custa cada gateway em escala?
O núcleo open source do LiteLLM segue gratuito independentemente do volume; o custo do OpenRouter é um percentual de cada dólar creditado; o do Portkey cresce com o volume de logs e as condições contratuais. A tabela abaixo é aritmética direta sobre a taxa Stripe publicada de ~5,5% — não é estimativa, e é o número que decide esta compra.
Deliberadamente não damos um valor em dólares para operar o LiteLLM: o proxy é um serviço pequeno e permanente, e o custo depende inteiramente de onde você o executa. Coloque sua própria conta de hospedagem na última coluna e a decisão se resolve sozinha.
Observação para leitores no Brasil: os três fornecedores cobram em dólares americanos. Não existe tabela em reais, então sua fatura soma câmbio e, conforme o cartão, IOF e spread.
| Gasto mensal com modelos | Taxa OpenRouter (~5,5%) | Custo de licença LiteLLM | Auto-hospedar vence abaixo de |
|---|---|---|---|
| US$ 200 | ~US$ 11/mês (~US$ 132/ano) | US$ 0 | US$ 11/mês |
| US$ 500 | ~US$ 27,50/mês (~US$ 330/ano) | US$ 0 | US$ 27,50/mês |
| US$ 2.000 | ~US$ 110/mês (~US$ 1.320/ano) | US$ 0 | US$ 110/mês |
| US$ 10.000 | ~US$ 550/mês (~US$ 6.600/ano) | US$ 0 | US$ 550/mês |
Use o LiteLLM se o gasto mensal com modelos for alto o bastante para que um acréscimo de 5% pese em termos absolutos. Use o OpenRouter se a taxa custar menos que as horas de engenharia para operar um proxy. Para a mesma aritmética aplicada a hardware, veja a calculadora de custos de LLMs locais.
•Info: A taxa incide sobre o saldo que você compra, não sobre cada requisição — e a taxa BYOK separada de 5% só começa acima de US$ 25.000/mês de gasto roteado por BYOK (pagamento por uso) ou US$ 200.000/mês (corporativo). Abaixo dessa franquia, BYOK não custa nada a mais.
Por que a mudança de dono do Portkey importa para esta decisão
O Portkey não é mais um produto independente: a Palo Alto Networks concluiu a aquisição em 29 de maio de 2026 e está integrando-o à plataforma de segurança Prisma AIRS. Isso não é uma troca de marca. Um gateway adotado hoje como ferramenta leve pode, em um ciclo de produto, ser reprecificado, ter o escopo alterado ou passar a ser vendido apenas dentro de uma suíte de segurança maior.
Se você estava avaliando o Portkey justamente por ser um produto ágil de startup, essa premissa não vale mais. Confirme as condições atuais diretamente com a Palo Alto Networks antes de se comprometer — produtos adquiridos mudam preços, estrutura de planos e modelos de suporte com frequência nos primeiros 6 a 12 meses de integração.
A Palo Alto Networks concluiu a aquisição do Portkey em 29 de maio de 2026 e o está integrando como o gateway de IA dentro da plataforma de segurança Prisma AIRS.
Como cada gateway lida com o failover?
Os três suportam failover automático quando um provedor falha — a diferença está em quem escreve a política de failover. LiteLLM e Portkey permitem definir cadeias de failover e regras de balanceamento em uma configuração que você controla. O OpenRouter resolve isso no nível da plataforma: se um provedor dá erro, ele pode rotear automaticamente para um modelo equivalente, com menos controle fino sobre qual.
- LiteLLM — cadeias de failover definidas na sua própria configuração; o maior controle sobre qual modelo reserva atende uma requisição que falhou
- Portkey / Prisma AIRS — fallbacks automáticos e balanceamento de carga disponíveis em todos os planos, configurados na plataforma
- OpenRouter — failover automático entre provedores no nível da plataforma; nenhuma cadeia para configurar e nenhuma garantia sobre qual provedor assume
Quem deve usar cada gateway?
Desenvolvedores com infraestrutura devem escolher o LiteLLM por padrão; times que querem acesso multimodelo sem operação, o OpenRouter; empresas dentro de um stack da Palo Alto devem avaliar o Prisma AIRS. Além dessa divisão, o tamanho do time, os requisitos de conformidade e a tolerância à carga operacional decidem o resto.
- Desenvolvedores solo e startups pequenas prototipando com vários modelos → OpenRouter. Uma API key, mais de 380 modelos, nenhum servidor para cuidar. Dispense se for muito sensível a custo em volume alto: a taxa se acumula.
- Times de plataforma com aplicações multimodelo em produção → LiteLLM auto-hospedado. Gratuito, é o padrão da comunidade, e você mantém o controle do roteamento e da residência dos dados. Evite sem capacidade de operar um serviço.
- Empresas que já adquirem produtos da Palo Alto Networks → Portkey dentro do Prisma AIRS. Agora ele é entregue como camada de governança e segurança, então a proposta é outra em relação a um ano atrás.
- Setores regulados que precisam de implantação isolada de rede → o LiteLLM Enterprise suporta isso explicitamente; confirme as opções atuais de implantação do Prisma AIRS diretamente com a Palo Alto Networks, já que integrações pós-aquisição mudam a oferta no curto prazo. Veja também conformidade corporativa com LLMs locais.
- Times que chamam um provedor com volume baixo → nenhum gateway. Chame o SDK diretamente e reavalie quando adicionar um segundo provedor.
Gateways LLM na UE, no Japão e na China
Onde o gateway roda determina para onde vão seus prompts. Isso torna a escolha do gateway uma decisão de conformidade em três grandes mercados, não apenas uma questão de custo.
Erros comuns ao escolher um gateway LLM
- 1Supor que "gateway" significa a mesma coisa nas três ferramentas
Why it matters: O LiteLLM é um proxy auto-hospedado, o OpenRouter é uma API hospedada e o Portkey agora faz parte de uma plataforma de segurança. Leia a página de produto atual de cada fornecedor antes de comparar listas de recursos — não presuma paridade. - 2Escolher o OpenRouter para produção de alto volume sem modelar a taxa
Why it matters: Com US$ 10.000/mês de gasto em modelos, a taxa de ~5,5% dá cerca de US$ 550 por mês, ou US$ 6.600 por ano. Faça essa conta com o seu gasto real, não apenas com o ganho de conveniência. - 3Adotar um gateway antes de ter um segundo provedor em produção
Why it matters: O valor central de um gateway é o roteamento multiprovedor com failover. Com um modelo de um provedor, você está acrescentando uma camada de abstração, um novo modo de falha e uma curva de aprendizado sem retorno ainda. - 4Citar preços do Portkey capturados antes de maio de 2026
Why it matters: Páginas de preços e artigos anteriores à aquisição pela Palo Alto podem não refletir as condições atuais do Prisma AIRS. Confirme com o fornecedor antes de basear uma decisão de compra em uma captura antiga. - 5Tratar estrelas do GitHub como comparativo de recursos
Why it matters: As ~53,8 mil estrelas do LiteLLM indicam confiança da comunidade e a probabilidade de o projeto seguir mantido daqui a dois anos — não que ele tenha mais recursos que Portkey ou OpenRouter. Use a tabela comparativa, não o sinal de adoção.
Dispense o gateway por completo se…
Se você chama um único provedor de LLM com volume baixo e previsível e não planeja adicionar um segundo em breve, deixe os três de lado. Um gateway acrescenta complexidade operacional (auto-hospedado) ou uma taxa percentual (hospedado) em troca de um benefício multiprovedor que você ainda não usa.
Chame o SDK do provedor diretamente e reavalie no dia em que realmente adicionar um segundo modelo ou provedor. A mesma lógica vale um nível abaixo: se você ainda está decidindo se vai chamar APIs hospedadas, leia primeiro LLMs locais vs APIs em nuvem — o gateway mais barato é aquele de que você nunca precisou.
💡Tip: Um gatilho útil: adicione um gateway na primeira vez que escrever no seu próprio código uma ramificação específica de provedor. Esse condicional é o código de cola que um gateway existe para eliminar.
Perguntas frequentes
O que é um gateway de API LLM?
É uma camada de roteamento que dá à sua aplicação uma única API consistente para chamar vários provedores de LLM, normalmente acrescentando failover, controle de custos e rate limiting sobre as APIs originais. Você chama o gateway; ele cuida do formato específico de cada provedor e da autenticação. O benefício só se materializa quando há mais de um provedor em produção.
O LiteLLM é realmente gratuito?
O núcleo open source é gratuito e auto-hospedado, sem custo de licença, conforme a própria página de preços do LiteLLM em agosto de 2026. Não há acréscimo por requisição em nenhum volume. O plano Enterprise — SSO, SCIM, suporte dedicado e implantação isolada de rede — tem preço anual sob consulta conforme o volume de requisições e inclui teste de 30 dias.
O OpenRouter cobra por requisição?
Não diretamente. A taxa do OpenRouter incide sobre a recarga da conta: cerca de 5,5% sobre compras de saldo via Stripe, com mínimo de US$ 0,80, ou 5% em cripto. Uma taxa BYOK separada de 5% se aplica apenas quando o gasto mensal roteado por BYOK ultrapassa US$ 25.000 no pagamento por uso, ou US$ 200.000 no plano corporativo.
O Portkey ainda é uma empresa independente?
Não. A Palo Alto Networks concluiu a aquisição do Portkey em 29 de maio de 2026 e o está integrando como gateway de IA central da sua plataforma de segurança Prisma AIRS, conforme o comunicado da própria Palo Alto Networks. Trate qualquer informação de preço ou roadmap anterior a maio de 2026 como potencialmente defasada.
Qual gateway suporta mais provedores?
O OpenRouter lista mais de 380 modelos no próprio site em agosto de 2026. A documentação do LiteLLM descreve mais de 100 integrações de provedores — uma unidade diferente, já que um provedor expõe muitos modelos. O repositório do Portkey já anunciou mais de 1.600 LLMs, número que deveria ser reverificado após a aquisição.
Posso auto-hospedar o Portkey?
O Portkey/Prisma AIRS oferecia implantação em nuvem privada no plano Enterprise conforme as páginas de preços anteriores à aquisição. Confirme as condições atuais de auto-hospedagem diretamente com a Palo Alto Networks, já que integrações pós-aquisição costumam mudar as opções de implantação no primeiro ano.
Algum dos três tem programa de afiliados?
Nenhum programa público e verificável de afiliados ou indicação foi encontrado para LiteLLM, Portkey ou OpenRouter em agosto de 2026. Todos os links de produto desta página são links simples e declarados que não rendem nada à PromptQuorum. Se isso mudar, a página será atualizada com uma divulgação compatível com os termos reais do programa.
Como decidir entre auto-hospedar e um gateway hospedado?
Compare 5,5% do seu gasto mensal com modelos ao custo de operar um serviço pequeno e permanente. Abaixo desse ponto de virada, o OpenRouter sai mais barato depois de contar o seu tempo; acima dele, o LiteLLM auto-hospedado vence em valores absolutos. Acrescente um segundo teste de conformidade: se você precisa declarar qual provedor atendeu uma requisição, auto-hospede independentemente da aritmética.
Veredito final
- Use o LiteLLM se você puder auto-hospedar e quiser zero taxa recorrente com controle total do roteamento — próximo passo: implante o proxy open source e aponte a URL base da sua aplicação para ele.
- Use o OpenRouter se quiser acesso multimodelo hoje sem infraestrutura — próximo passo: crie uma API key e credite a conta, prevendo a taxa de ~5,5%.
- Use o Portkey / Prisma AIRS se já estiver comprando segurança da Palo Alto Networks e quiser roteamento de gateway incluído — próximo passo: fale com a Palo Alto Networks para reverificar as condições atuais após a aquisição.
- Dispense os três se chamar um único provedor com volume baixo e sem planos multiprovedor no curto prazo — próximo passo: reavalie quando adicionar um segundo provedor.