Skip to main content
PromptQuorum
Início/LLMs locais/Melhor ferramenta de observabilidade de LLM 2026: Langfuse, LangSmith ou Helicone
Tools & Interfaces

Melhor ferramenta de observabilidade de LLM 2026: Langfuse, LangSmith ou Helicone

·14 min de leitura·By Hans Kuepper · Founder of PromptQuorum, multi-model AI dispatch tool · PromptQuorum

Esta página contém links de referência para produtos de terceiros. O PromptQuorum não está inscrito em nenhum programa de afiliados — são links simples que não geram comissão. Clicar nos links e os próximos passos são de sua inteira responsabilidade. Estes links não representam qualquer endosso ou verificação por parte do PromptQuorum.

O Langfuse é a melhor escolha geral para a maioria das equipes em produção: 33,9 mil estrelas no GitHub, gratuito para auto-hospedar e com a maior cobertura de frameworks entre os quatro. O LangSmith é a escolha certa se sua stack roda em LangChain ou LangGraph, a US$ 39 por assento ao mês mais unidades de computação e armazenamento medidas. O Helicone é o mais rápido de adotar porque é um proxy e não um SDK, a US$ 79 ao mês. Dois pontos escapam à maioria das comparações: o Langfuse foi adquirido pela ClickHouse em 16 de janeiro de 2026, e seu nível auto-hospedado gratuito não é completo — nove recursos, incluindo RBAC e registros de auditoria, são exclusivos do Enterprise.

Key Takeaways

  • Langfuse — 33,9 mil estrelas no GitHub, a maior presença de código aberto aqui. O Hobby na nuvem é gratuito com 50 mil unidades por mês, 30 dias de acesso aos dados e 2 usuários; o Core custa US$ 29/mês com 100 mil unidades e usuários ilimitados; o Pro US$ 199/mês com três anos de retenção; o Enterprise US$ 2.499/mês. Auto-hospedar o núcleo de código aberto é gratuito e ilimitado.
  • Uma correção que vale a pena: o Langfuse é amplamente descrito como licenciado sob MIT sem muro de recursos. O próprio README diz que o repositório é "MIT licensed, except for the `ee` folders", e a página de auto-hospedagem lista nove recursos exclusivos do Enterprise: mascaramento de dados no servidor, RBAC por projeto, gestão de retenção, SCIM, registros de auditoria e outros. Observabilidade e avaliações básicas são realmente gratuitas; os recursos de governança não são.
  • O Langfuse foi adquirido pela ClickHouse, Inc. em 16 de janeiro de 2026, anunciado junto à Série D de US$ 400 milhões da ClickHouse. O arquivo LICENSE do repositório agora começa com "Copyright (c) 2023-2026 ClickHouse, Inc." Isso não é motivo para descartar o Langfuse, mas é uma consideração de roadmap que merece cinco minutos antes de padronizar em cima dele.
  • LangSmith — o Developer é gratuito com até 5.000 traces base por mês e um assento. O Plus custa US$ 39 por assento ao mês com até 10 mil traces base e, acima disso, cobrança por consumo a US$ 1,50 por unidade de computação e US$ 1,00 por unidade de armazenamento. O Enterprise é sob consulta, com opções auto-hospedada e híbrida.
  • Helicone — um proxy em vez de um SDK, então a integração é uma linha e captura cada chamada sem instrumentação. O Hobby é gratuito com 10 mil requisições, 1 GB e 7 dias de retenção; o Pro custa US$ 79/mês com assentos ilimitados e um mês de retenção; o Team US$ 799/mês com SOC-2 e HIPAA e três meses de retenção.
  • O Helicone também é de código aberto, sob Apache-2.0 com 6,1 mil estrelas, o que a maioria das comparações omite. A nuance é que sua página de preços vende on-premise apenas no Enterprise e não documenta nenhum caminho gratuito de auto-hospedagem com suporte. Código aberto aqui não significa que o fornecedor apoia você operando por conta própria.
  • PromptLayer — o mais estreito dos quatro. O nível gratuito oferece 2.500 requisições por mês, 5 usuários e 10 prompts; o Pro custa US$ 49/mês com US$ 0,003 por transação excedente; o Team US$ 500/mês com mais de 100 mil requisições e 25 usuários. A auto-hospedagem em GCP, AWS ou Azure é exclusiva do Enterprise.
  • Nenhum dos quatro publica programa de afiliados ou indicação. A LangChain mantém uma Partner Network, mas é um programa de integração técnica, não um esquema de comissões. Todos os links desta página são não remunerados.

🏆 A melhor escolha para o seu caso

A questão estrutural é se você instrumenta seu código ou coloca um proxy à frente, e isso decide o que você consegue enxergar. Leia de cima para baixo e pare na primeira linha que descreva você.

  • Você quer flexibilidade e a opção de auto-hospedar depois → Langfuse. As integrações mais amplas, núcleo auto-hospedado gratuito e o menor custo de troca — mas leia a lista do Enterprise antes de contar com os recursos de governança.
  • Sua stack é LangChain ou LangGraph → LangSmith. Ali o rastreamento é nativo e sem configuração, algo que nenhuma outra ferramenta iguala nesse ecossistema.
  • Você quer observabilidade hoje sem reescrever com SDK → Helicone. Um proxy significa uma linha de código e dados de custo em cada requisição por padrão.
  • Descontrole de custos entre muitas chaves e modelos é o seu problema real → Helicone. O detalhamento de custo por requisição é o produto central, não uma aba de relatórios acoplada ao rastreamento.
  • Você só precisa de versionamento de prompts e registros de requisições → PromptLayer. Gratuito até 2.500 requisições por mês e honesto ao ser mais estreito que os outros três.
  • Você está antes da produção, algumas dezenas de chamadas por dia → nenhum deles. Os painéis e registros dos fornecedores cobrem isso, e você vai reconfigurar de qualquer forma quando chegar tráfego real.
Langfuse — ver preçoslink de produto · divulgadoHelicone — ver preçoslink de produto · divulgado

O que é de fato observabilidade de LLM

Observabilidade de LLM captura e armazena traces das suas chamadas ao modelo — prompts, respostas, latência, uso de tokens e custo — para que você possa depurar falhas, detectar regressões de qualidade e acompanhar o gasto em produção. É a observabilidade de aplicações de sempre, estendida a um comportamento não determinístico em que a mesma entrada pode produzir saídas diferentes e "quebrou" costuma significar "a saída piorou", não "lançou uma exceção".

Essa é uma tarefa distinta de avaliação. A observabilidade acompanha o que seu sistema faz depois do lançamento; a avaliação diz se uma mudança pode ir ao ar. Muitas equipes fazem as duas, e várias dessas ferramentas cobrem ambas, mas as perguntas são diferentes. Para a metade anterior ao lançamento, veja as melhores ferramentas de avaliação de LLM.

Observabilidade de LLM é a prática de capturar traces de chamadas ao modelo — prompts, respostas, latência, uso de tokens e custo — para que equipes possam depurar falhas, detectar regressões de qualidade e monitorar o gasto em produção.

É registro para algo que responde diferente a cada vez. Você não anota só que houve uma chamada, mas o que entrou, o que saiu, quanto custou e quanto demorou, para conseguir entender por que a qualidade se moveu.

Langfuse, LangSmith, Helicone e PromptLayer comparados

Cada ferramenta otimiza um ponto diferente da stack em vez de competir recurso a recurso. Os preços foram lidos nas páginas dos fornecedores em 28 de agosto de 2026, e os números dos repositórios vieram da API do GitHub no mesmo dia.

CritérioLangfuseLangSmithHeliconePromptLayer
AbordagemRastreador SDKRastreador SDKProxyRegistro via SDK e REST
Estrelas no GitHub33,9 milNão é código aberto6,1 mil0,8 mil (biblioteca cliente)
LicençaMIT exceto pastas ee/ComercialApache-2.0Comercial
Nível gratuito50 mil unidades/mês, 30 dias5 mil traces/mês, 1 assento10 mil requisições, 7 dias2.500 requisições, 10 prompts
Entrada pagaCore US$ 29/mêsPlus US$ 39/assento/mês + consumoPro US$ 79/mêsPro US$ 49/mês
Auto-hospedagem gratuitaSim, recursos centraisNão, só EnterpriseCódigo aberto, não vendidoNão, só Enterprise
Nível de conformidadePro: SOC2, ISO27001, BAAEnterpriseTeam US$ 799: SOC-2, HIPAAEnterprise
Programa de afiliadosNenhum encontradoNenhum encontradoNenhum encontradoNenhum encontrado

⚠️Warning: Comparações costumam chamar o Langfuse de "a única opção de código aberto aqui". O Helicone é Apache-2.0 com 6,1 mil estrelas, então isso não procede. O que procede é que o Langfuse documenta e apoia uma implantação auto-hospedada gratuita, enquanto o Helicone vende on-premise apenas no Enterprise e não descreve nenhum caminho gratuito de auto-hospedagem com suporte em sua página de preços.

Langfuse: a escolha flexível

O Langfuse é a recomendação padrão porque tem a maior lista de integrações, um núcleo auto-hospedado genuinamente gratuito e o menor custo de troca se você mudar de ideia. Também é o que tem mais ressalvas, e vale conhecê-las antes de se comprometer.

1

Langfuse — melhor no geral

33,9 mil estrelas, núcleo auto-hospedado gratuito, maior cobertura de frameworks

O Langfuse cobre observabilidade, avaliações, gestão de prompts e conjuntos de dados em um único produto, e sua lista de integrações é a mais longa dos quatro: SDK da OpenAI, LangChain, LlamaIndex, Haystack, LiteLLM, Vercel AI SDK, Ollama e Amazon Bedrock nativamente, além de integrações da comunidade. Para uma stack mista — um pouco de LangChain, algumas chamadas de SDK diretas, LlamaIndex para recuperação — essa amplitude significa instrumentar uma vez em vez de por framework. Preços na nuvem: Hobby gratuito com 50 mil unidades por mês e 30 dias de acesso aos dados, Core a US$ 29/mês com 100 mil unidades e usuários ilimitados, Pro a US$ 199/mês com três anos de retenção mais SOC2, ISO27001 e um BAA para HIPAA, e Enterprise a US$ 2.499/mês. O excedente é escalonado, de US$ 8 por 100 mil unidades até US$ 6 em volume. Auto-hospedar o núcleo de código aberto é gratuito e de fato ilimitado no uso.

Vantagens

  • +A maior cobertura nativa de frameworks dos quatro: uma stack mista é instrumentada uma só vez
  • +Núcleo auto-hospedado gratuito com uso ilimitado, implantável via Docker Compose, Kubernetes ou modelos de nuvem
  • +Avaliações, conjuntos de dados e gestão de prompts inclusos em vez de vendidos à parte
  • +O menor custo de troca aqui, já que o núcleo é aberto e você pode levar sua própria instalação

Desvantagens

  • Nove recursos são exclusivos do Enterprise, incluindo RBAC, registros de auditoria e mascaramento de dados — veja a seção de auto-hospedagem
  • Auto-hospedar significa manter uma instalação de Postgres mais um ClickHouse autogerenciado, o que é tempo real de engenharia
  • Agora pertence à ClickHouse, o que segue sendo uma consideração de roadmap apesar do compromisso público com código aberto
Langfuse — ver preçoslink de produto · divulgado

LangSmith: a escolha LangChain

Se sua aplicação é construída sobre LangChain ou LangGraph, o LangSmith a rastreia sem configuração alguma, e nada mais chega perto disso. Fora desse ecossistema, o argumento enfraquece bastante.

1

LangSmith — melhor para times de LangChain e LangGraph

Rastreamento nativo sem configuração, US$ 39/assento/mês mais unidades por consumo

O LangSmith vem do time do LangChain, e dentro de LangChain ou LangGraph o rastreamento é automático: você obtém visibilidade em nível de passo de uma execução de agente sem escrever instrumentação. Fora disso, usa-se um wrapper `traceable()` em torno das chamadas aos SDKs da OpenAI ou Anthropic, o que funciona mas elimina a vantagem principal. Os preços: um nível Developer a US$ 0 por assento com até 5.000 traces base por mês e um único assento, Plus a US$ 39 por assento ao mês com até 10 mil traces base e uma implantação serverless pequena gratuita, e Enterprise sob consulta com opções auto-hospedada e híbrida. Acima da cota, a cobrança passa a ser por consumo: US$ 1,50 por unidade de computação do LangChain e US$ 1,00 por unidade de armazenamento. Essa é a parte a modelar antes de se comprometer, porque a fatura escala com a complexidade dos agentes e o volume de traces, não com o número de pessoas.

Vantagens

  • +Rastreamento sem configuração dentro de LangChain e LangGraph, imbatível para essa stack
  • +Ferramentas maduras de avaliação e experimentação orientadas por conjuntos de dados
  • +O nível Developer gratuito basta para uma pessoa sozinha prototipando
  • +O Enterprise oferece implantação auto-hospedada e híbrida

Desvantagens

  • A cobrança por unidades de computação e armazenamento torna a fatura difícil de prever conforme a complexidade dos agentes cresce
  • A auto-hospedagem é exclusiva do Enterprise, com preço sob consulta
  • Proposta de valor bem mais fraca se você não está no LangChain
LangSmith — ver preçoslink de produto · divulgado

Helicone: a escolha proxy

O Helicone é estruturalmente diferente dos outros três: fica à frente da sua chamada de API como proxy em vez de dentro do seu código como SDK. Essa única decisão explica tanto a maior vantagem quanto a limitação principal.

1

Helicone — mais rápido de adotar e melhor para custos

Integração proxy de uma linha, Apache-2.0, gratuito até 10 mil requisições e depois US$ 79/mês

Como o Helicone é um proxy, adotá-lo é trocar a URL base em vez de tocar um projeto de instrumentação, e ele captura dados de custo e requisição em cada chamada por padrão, sem que ninguém precise decidir o que rastrear. Isso o torna o mais rápido dos quatro a entregar valor e explica por que o acompanhamento de custos é seu ponto mais forte: o detalhamento de custo por requisição e a visibilidade do gasto entre muitas chaves e modelos são o produto central, não uma visão de relatórios montada sobre o rastreamento. O Hobby é gratuito com 10 mil requisições, 1 GB de armazenamento e 7 dias de retenção; o Pro custa US$ 79 ao mês com assentos ilimitados e um mês de retenção; o Team US$ 799 ao mês acrescentando conformidade SOC-2 e HIPAA e três meses de retenção; o Enterprise adiciona implantação on-premise, SSO SAML e retenção ilimitada. O código é Apache-2.0 com 6,1 mil estrelas, ainda que a página de preços comercialize on-premise apenas no Enterprise.

Vantagens

  • +Uma linha para integrar: sem reescrita de SDK, funciona com qualquer endpoint compatível com OpenAI
  • +O acompanhamento de custos é o produto central, não uma aba de relatórios secundária
  • +Licença Apache-2.0, algo que a maioria das comparações dessa categoria omite
  • +Assentos ilimitados a partir do nível Pro de US$ 79

Desvantagens

  • Um proxy vê requisições e respostas, não os passos internos de uma execução multiagente
  • O nível gratuito retém dados por apenas 7 dias, a janela mais curta aqui
  • On-premise é vendido no Enterprise apesar do código aberto
Helicone — ver preçoslink de produto · divulgado

PromptLayer: a escolha enxuta

O PromptLayer é mais estreito que os outros três, e isso é intencional, não um defeito. Ele faz versionamento de prompts e registro de requisições, e não finge ser uma plataforma completa de observabilidade.

1

PromptLayer — melhor quando você só precisa versionar prompts

Gratuito até 2.500 requisições por mês, Pro a US$ 49/mês

O PromptLayer concentra-se em manter um histórico versionado dos seus prompts junto a um registro das requisições que os usaram, uma necessidade real que aparece antes da observabilidade completa. O nível gratuito oferece 2.500 requisições por mês, 5 usuários e 10 prompts. O Pro custa US$ 49 ao mês com 5 usuários e excedente a US$ 0,003 por transação. O Team custa US$ 500 ao mês com mais de 100 mil requisições, 25 usuários e excedente mais barato a US$ 0,002. A auto-hospedagem em GCP, AWS ou Azure existe apenas no Enterprise sob consulta. É o único dos quatro sem presença relevante de código aberto: o repositório público é uma biblioteca cliente com 0,8 mil estrelas, não a plataforma. Trate-o como uma ferramenta de gestão de prompts que registra, não como uma plataforma de observabilidade que também gerencia prompts.

Vantagens

  • +O mais simples de entender e adotar entre os quatro
  • +O versionamento de prompts é de primeira classe, não um recurso lateral de um produto maior
  • +O nível gratuito serve para cargas realmente pequenas
  • +Excedente mais barato no Team, a US$ 0,002 por transação

Desvantagens

  • Sem plataforma de código aberto: o repositório público é só uma biblioteca cliente
  • A auto-hospedagem é exclusiva do Enterprise
  • A menor lista de integrações; avaliações e conjuntos de dados mais enxutos que Langfuse ou LangSmith
PromptLayer — ver preçoslink de produto · divulgado

O que a aquisição pela ClickHouse significa para o Langfuse

A ClickHouse, Inc. adquiriu o Langfuse em 16 de janeiro de 2026, anunciado junto à rodada Série D de 400 milhões de dólares da ClickHouse liderada pela Dragoneer. A aquisição foi noticiada à época pelo SiliconANGLE e está confirmada no blog da ClickHouse, em uma discussão no GitHub do Langfuse e pelo escritório que assessorou a operação.

A evidência mais clara está no próprio repositório: o arquivo LICENSE agora começa com "Copyright (c) 2023-2026 ClickHouse, Inc." O projeto segue em desenvolvimento ativo e recebeu alterações no dia em que esta página foi verificada.

Há uma lógica coerente por trás. O Langfuse já armazenava seus traces no ClickHouse, então a compradora é dona do banco de dados sob o produto e não uma adquirente alheia ao tema. Esse é um ponto de partida melhor que o da maioria das aquisições nessa categoria. A consideração ainda merece registro: depois de uma aquisição, as prioridades de roadmap seguem o interesse comercial da compradora, e o Langfuse auto-hospedado agora depende de uma empresa que também vende ClickHouse Cloud. O nível Enterprise auto-hospedado está explicitamente atrelado a ClickHouse Cloud ou BYOC, cujos custos se somam.

📌Note: Não é motivo para evitar o Langfuse: o núcleo de código aberto é MIT, é mantido ativamente e você pode operá-lo por conta própria. É motivo para ler o anúncio da aquisição antes de padronizar uma stack de produção nele, e para saber que o caminho auto-hospedado pago passa por planos comerciais da ClickHouse.

Auto-hospedagem e o muro do Enterprise

O Langfuse é o único dos quatro que documenta e apoia uma implantação auto-hospedada gratuita, mas a afirmação tão repetida de que não há muro de recursos entre o gratuito e o pago é falsa. A própria página de auto-hospedagem lista nove capacidades como exclusivas do Enterprise: mascaramento de dados no servidor, RBAC por projeto, gestão de retenção de dados, provisionamento de usuários por SCIM, criadores de organizações, personalização da interface, registros de auditoria, APIs de administração e de gestão da instância, e rótulos de implantação protegidos.

Leia essa lista pensando em para quem a auto-hospedagem costuma existir. Equipes auto-hospedam por residência de dados ou pressão regulatória, e RBAC, registros de auditoria e mascaramento de dados são exatamente do que uma equipe regulada precisa. O nível gratuito de fato cobre observabilidade, avaliações, gestão de prompts, conjuntos de dados, rastreamento e acompanhamento de custos com uso ilimitado. O que ele não cobre é governança.

Os outros três são mais diretos. O LangSmith restringe a auto-hospedagem ao Enterprise sob consulta. O PromptLayer oferece auto-hospedagem de locatário único em GCP, AWS ou Azure apenas no Enterprise. O Helicone é o caso interessante: o código é Apache-2.0 e público, mas a página de preços vende on-premise apenas no Enterprise e não documenta nenhum caminho gratuito de auto-hospedagem com suporte — aqui, código aberto e auto-hospedagem apoiada não são a mesma coisa.

⚠️Warning: Se você vai auto-hospedar o Langfuse justamente para atender a um requisito de conformidade, confira a lista do Enterprise antes de construir. Registros de auditoria e RBAC por projeto costumam ser inegociáveis para as equipes reguladas que mais se interessam por auto-hospedagem, e ambos estão atrás do muro.

Como os preços se comparam

Os quatro cobram em modelo híbrido — uma taxa por assento ou plataforma mais consumo medido acima de uma cota inclusa — de modo que duas equipes no mesmo nível podem receber faturas bem diferentes. O volume pesa mais que o número de pessoas, e o LangSmith é o exemplo mais claro.

NívelLangfuseLangSmithHeliconePromptLayer
GratuitoHobby: 50 mil unidades, 2 usuáriosDeveloper: 5 mil traces, 1 assentoHobby: 10 mil requisiçõesFree: 2.500 requisições, 5 usuários
Retenção gratuita30 dias de acesso aos dadosNão informado na página de preços7 diasNão informado na página de preços
Entrada pagaCore US$ 29/mêsPlus US$ 39/assento/mêsPro US$ 79/mêsPro US$ 49/mês
Cobrança por usoUS$ 8 por 100 mil unidades, escalonadoUS$ 1,50/computação, US$ 1,00/armazenamentoPor consumo acima da cota gratuitaUS$ 0,003 por transação
Nível intermediárioPro US$ 199/mês, 3 anos de retençãoEnterprise sob consultaTeam US$ 799/mêsTeam US$ 500/mês
ConformidadePro: SOC2, ISO27001, BAAEnterpriseTeam: SOC-2, HIPAAEnterprise
Custo de auto-hospedarGratuito para recursos centraisSó EnterpriseSó EnterpriseSó Enterprise

Para uma equipe pequena abaixo de cerca de 50 mil a 100 mil eventos por mês, espere US$ 0 com Langfuse auto-hospedado ou Hobby, ou entre US$ 29 e US$ 79 com Langfuse Core ou Helicone Pro. Separe isso do gasto com tokens do modelo, em geral maior.

💡Tip: Compare janelas de retenção, não só o tamanho do nível gratuito. O Helicone guarda os dados gratuitos por 7 dias e o Langfuse Hobby dá 30 dias de acesso. Uma ferramenta que parece generosa em volume de requisições ainda assim força um upgrade na primeira vez que você precisar investigar algo do mês passado.

Qual ferramenta serve para controle de custos?

O Helicone é construído em torno da visibilidade de custos, e a arquitetura de proxy é a razão. Como cada chamada passa por ele, os dados de custo e tokens são capturados por padrão em cada requisição sem que ninguém decida o que instrumentar, então não há pontos cegos por causa de um serviço que alguém esqueceu de encapsular.

Langfuse e LangSmith registram uso de tokens e custo por trace como parte de seus dados mais amplos de observabilidade, o que basta para a maioria das equipes. Nenhum dos dois apresenta gestão de custos como uma superfície de produto independente do jeito que o Helicone faz. O PromptLayer registra custo por requisição, mas reporta pelas suas visões de log em vez de um painel de custos dedicado.

Sendo direto, essa é uma diferença de ênfase, não de capacidade. Se você quer responder "qual modelo e qual chave estão queimando o orçamento em doze serviços", o Helicone responde mais rápido. Se quer responder "por que esta execução de agente custou onze dólares", um rastreador de SDK que enxerga os passos individuais serve melhor.

Quem deve usar o quê

A stack, os requisitos de residência de dados e o tamanho da equipe decidem isso. Seis perfis cobrem a maioria dos leitores.

  • Desenvolvedora sozinha prototipando em LangChain → LangSmith Developer. Os 5.000 traces gratuitos por mês bastam e o rastreamento não exige configuração.
  • Equipe pequena querendo controlar a residência dos dados → Langfuse auto-hospedado, conferindo antes a lista do Enterprise se precisar de RBAC ou registros de auditoria.
  • Equipe com mais de 10 mil chamadas por dia, fora do LangChain → Langfuse Cloud ou Helicone. A vantagem do LangSmith não se aplica a você, mas a cobrança por consumo sim.
  • Equipe cuja dor é descontrole de custos de API → Helicone Pro a US$ 79/mês, onde acompanhamento de custos é o produto.
  • Setor regulado que precisa de SOC-2 ou HIPAA → Helicone Team a US$ 799/mês ou Langfuse Pro a US$ 199/mês, que inclui SOC2, ISO27001 e um BAA.
  • Equipe que só precisa de controle de versão de prompts → PromptLayer gratuito ou Pro, reavaliando quando testes de regressão se tornarem necessários.

Observabilidade na UE, no Japão e na China

Traces de observabilidade contêm o prompt e a resposta completos, ou seja, contêm o que seus usuários digitaram. Isso transforma a escolha entre hospedado e auto-hospedado em uma questão de proteção de dados em três mercados importantes.

Erros comuns ao escolher uma ferramenta de observabilidade

  1. 1
    Acreditar que o Langfuse auto-hospedado não tem muro de recursos
    Why it matters: A própria página de auto-hospedagem lista nove recursos exclusivos do Enterprise, incluindo RBAC por projeto, registros de auditoria e mascaramento de dados no servidor. Equipes que auto-hospedam justamente por conformidade costumam precisar exatamente desses e descobrem a lacuna depois de a instalação pronta.
  2. 2
    Chamar o Langfuse de única opção de código aberto
    Why it matters: O Helicone é Apache-2.0 com 6,1 mil estrelas. A distinção correta é que o Langfuse documenta uma implantação auto-hospedada gratuita e apoiada enquanto o Helicone vende on-premise no Enterprise, não que um seja aberto e o outro fechado.
  3. 3
    Ler o preço de US$ 39 por assento do LangSmith como a fatura inteira
    Why it matters: O Plus acrescenta cobrança por consumo de US$ 1,50 por unidade de computação e US$ 1,00 por unidade de armazenamento sobre o assento. A fatura escala com a complexidade dos agentes e o volume de traces mais do que com o número de pessoas, então equipes com muito LangGraph podem ver o custo disparar sem contratar ninguém.
  4. 4
    Tratar o proxy do Helicone como equivalente ao rastreamento por SDK
    Why it matters: Um proxy captura requisição e resposta, mas não os passos internos de uma execução multiagente. Se você precisa ver por que um agente seguiu determinado caminho, combine o Helicone com um rastreador nativo do framework em vez de esperar que ele cubra as duas coisas.
  5. 5
    Comparar níveis gratuitos sem comparar a retenção
    Why it matters: O nível gratuito do Helicone guarda dados por 7 dias e o Langfuse Hobby dá 30 dias de acesso. Uma cota generosa de requisições com janela curta ainda força um upgrade na primeira vez que você investigar uma regressão do mês passado.

Pule isto se…

Se você ainda está prototipando — algumas dezenas de chamadas manuais por dia, sem tráfego de produção, ninguém mais precisando ver os traces — pule os quatro e use os painéis dos fornecedores. A página de uso da OpenAI e o console da Anthropic já mostram gasto e volume de requisições, e saídas de depuração cobrem o resto nessa escala.

O limiar que vale a pena esperar é concreto: usuários reais gerando tráfego que você não disparou, ou uma segunda pessoa precisando responder "o que ele fez" sem perguntar a você. Ambos são problemas de visibilidade, e é isso que essas ferramentas vendem. Adotar antes significa configurar uma plataforma contra padrões de uso que você ainda não descobriu, e a maioria das equipes reconfigura de qualquer forma quando o tráfego real chega.

💡Tip: Um gatilho útil: adote observabilidade na primeira vez que não conseguir responder "por que aquela resposta saiu errada" de memória ou pelos registros. Essa pergunta é o produto, e ela só começa a ser feita quando o tráfego é real.

Perguntas frequentes

O que é observabilidade de LLM?

É a prática de capturar e analisar traces de chamadas a modelos — prompts, respostas, latência, uso de tokens e custo — para que equipes possam depurar falhas, detectar regressões de qualidade e monitorar o gasto em produção. Ela estende a observabilidade de aplicações habitual a um comportamento não determinístico, em que a mesma entrada pode produzir saídas diferentes e a falha costuma significar qualidade degradada em vez de um erro.

O Langfuse é realmente gratuito para auto-hospedar?

Sim para o produto central, com uma ressalva importante. O núcleo auto-hospedado é licenciado sob MIT, tem uso ilimitado e cobre observabilidade, avaliações, gestão de prompts, conjuntos de dados e acompanhamento de custos. Mas a própria página de auto-hospedagem lista nove recursos exclusivos do Enterprise, entre eles RBAC por projeto, registros de auditoria, mascaramento de dados no servidor, gestão de retenção e SCIM. A funcionalidade central é gratuita; os recursos de governança não são.

O Langfuse foi adquirido pela ClickHouse?

Sim, em 16 de janeiro de 2026, anunciado junto à rodada Série D de 400 milhões de dólares da ClickHouse liderada pela Dragoneer. O arquivo LICENSE do repositório agora traz uma linha de copyright da ClickHouse, Inc. O projeto segue em desenvolvimento ativo e licenciado sob MIT em seu núcleo. A combinação tem certa lógica, já que o Langfuse armazenava seus traces no ClickHouse.

Quanto custa o LangSmith?

O nível Developer é gratuito com até 5.000 traces base por mês e um assento. O Plus custa US$ 39 por assento ao mês com até 10 mil traces base e uma implantação serverless pequena gratuita. Acima disso é por consumo, a US$ 1,50 por unidade de computação do LangChain e US$ 1,00 por unidade de armazenamento. O Enterprise é sob consulta, com opções auto-hospedada e híbrida.

LangSmith ou Langfuse se eu já uso LangChain?

LangSmith se você quer a experiência mais fluida e sem configuração especificamente dentro de LangChain e LangGraph e a hospedagem gerenciada serve. Langfuse se você está no LangChain hoje mas quer a opção de auto-hospedar depois, ou se também usa LlamaIndex, Haystack ou chamadas de SDK diretas: sua integração com LangChain é um SDK de primeira classe, não um paliativo.

O Helicone é de código aberto?

Sim, sob Apache-2.0 com cerca de 6.100 estrelas no GitHub, algo que muitas comparações dessa categoria omitem. A nuance é que a página de preços do Helicone vende a implantação on-premise apenas no nível Enterprise e não documenta nenhum caminho gratuito de auto-hospedagem com suporte, então código aberto não significa que o fornecedor apoia você operando por conta própria.

Algum deles tem programa de afiliados?

Não encontramos nenhum programa público de afiliados ou indicação nos sites dos quatro fornecedores. A LangChain mantém uma Partner Network, mas é um programa de parceiros de tecnologia e integração em vez de um esquema de comissões, e existe ainda um programa separado de créditos "LangSmith for Startups". A PromptQuorum não ganha nada com nenhum link desta página.

Qual a diferença entre observabilidade e avaliação?

A observabilidade acompanha o tráfego real depois do lançamento e diz o que o sistema está fazendo agora. A avaliação executa um conjunto de dados fixo antes de publicar e diz se uma mudança melhorou ou piorou a qualidade. Várias dessas ferramentas fazem as duas coisas, mas as perguntas diferem — veja as melhores ferramentas de avaliação de LLM para a metade anterior ao lançamento.

Veredito final

  • Use o Langfuse se quer as integrações mais amplas e a opção de auto-hospedar — próximo passo: comece no nível Hobby gratuito ou em uma instalação com Docker Compose, e confira a lista do Enterprise se precisar de RBAC ou registros de auditoria.
  • Use o LangSmith se sua stack é LangChain ou LangGraph — próximo passo: comece no nível Developer gratuito e modele seu uso de unidades de computação e armazenamento antes de migrar para o Plus, já que o preço por assento não é a fatura inteira.
  • Use o Helicone se visibilidade de custos é a dor e você quer isso funcionando hoje — próximo passo: aponte um serviço para o proxy no nível gratuito e confirme que os dados de custo batem com a fatura do seu fornecedor.
  • Use o PromptLayer se versionamento de prompts é o requisito real — próximo passo: use o nível gratuito e migre para Langfuse ou LangSmith quando precisar de testes de regressão orientados por conjuntos de dados.
  • Pule os quatro se você está antes da produção — próximo passo: use os painéis dos fornecedores e reavalie quando alguém além de você precisar ver o que o sistema fez.

Fontes

Nota sobre informações de terceiros

Este artigo faz referência a modelos de IA, benchmarks, preços e licenças de terceiros. O cenário da IA muda rapidamente. Pontuações de benchmark, termos de licença, nomes de modelos e preços de API podem mudar entre o momento em que foi escrito e quando você está lendo. Antes de tomar decisões de implantação ou conformidade com base neste artigo, verifique os dados atuais na fonte oficial de cada fornecedor: fichas de modelos do Hugging Face para licenças e benchmarks, sites dos fornecedores para preços de API e EUR-Lex para o texto atual do GDPR e da Lei de IA da UE.

Run PromptQuorum with a local LLM, your own API keys, or both — you pick the backend.

Download the PromptQuorum Beta →

← Back to Local LLMs