Skip to main content
PromptQuorum
Accueil/LLM locaux avancés/Plano : le proxy IA basé sur Envoy pour les applications agentiques
Overview & Reference

Plano : le proxy IA basé sur Envoy pour les applications agentiques

·11 min de lecture·Par Hans Kuepper · Fondateur de PromptQuorum, outil de dispatch multi-modèle · PromptQuorum

Plano est un serveur proxy et plan de données IA-natif, gratuit, open source, basé sur Envoy, pour les applications agentiques, construit par Katanemo, qui gère le routage LLM, l'orchestration d'agents, l'observabilité et les garde-fous en dehors de votre code applicatif. Il est sous licence Apache 2.0, s'exécute en tant que proxy auto-hébergé hors processus (pas un SaaS hébergé), et fonctionne en bring-your-own-model — vous le configurez avec OpenAI, Anthropic ou d'autres fournisseurs, ou le pointez vers des modèles locaux, tandis que le propre petit modèle orchestrateur de Plano gère les décisions de routage.

Plano (github.com/katanemo/plano) est un serveur proxy et plan de données IA-natif, gratuit, open source et sous licence Apache 2.0, construit sur Envoy par les contributeurs principaux d'Envoy eux-mêmes, et développé par Katanemo. Il centralise le « middleware caché » que les applications agentiques réimplémentent autrement dans chaque base de code — routage et orchestration d'agents, routage de modèles LLM, signaux et traces d'observabilité, et filtres de garde-fou pour la sécurité et la modération — avec plus de 7 050 étoiles sur GitHub. Cette revue présente ce que fait réellement Plano, comment l'installer et l'exécuter, son coût, et à qui il convient.

Points clés

  • Plano (github.com/katanemo/plano) est un proxy et plan de données IA gratuit, open source et auto-hébergé — pas un produit SaaS hébergé
  • Développé par Katanemo, et construit sur Envoy par les contributeurs principaux d'Envoy eux-mêmes
  • Sous licence Apache 2.0, confirmée via le fichier de licence du dépôt GitHub
  • Quatre capacités clés selon son propre README : orchestration d'agents, routage de modèles (« Model Agility »), observabilité sans code (« Agentic Signals » plus OpenTelemetry), et Filter Chains de garde-fou/modération
  • Le routage passe par un modèle orchestrateur dédié d'environ 4 milliards de paramètres (« Plano-Orchestrator ») plutôt que par un LLM généraliste ou un framework purement basé sur des règles
  • Plus de 7 050 étoiles GitHub et 480+ forks au moment de cette revue

📍 En une phrase

Plano est un serveur proxy et plan de données IA-natif, gratuit, open source (Apache 2.0), basé sur Envoy, développé par Katanemo, avec plus de 7 050 étoiles GitHub, qui ajoute le routage LLM, l'orchestration d'agents, l'observabilité et des garde-fous aux applications agentiques en dehors de votre code applicatif.

💬 En termes simples

Plano est un proxy auto-hébergé que vous exécutez devant vos agents IA. Plutôt que d'écrire votre propre logique de routage, votre télémétrie et vos filtres de sécurité dans chaque agent, vous déclarez vos agents et fournisseurs de modèles dans un fichier de configuration YAML, et Plano se charge de choisir le bon modèle, de tracer ce qui s'est passé et d'appliquer les garde-fous — gratuitement, puisque Plano lui-même n'a pas de frais de licence.

📌Remarque: Cette revue est le complément approfondi de l'entrée de Plano dans le Local LLM Software Directory — consultez cette page pour voir comment Plano se compare en un coup d'œil à des dizaines d'autres outils IA locaux et auto-hébergés.

Qu'est-ce que Plano ?

Plano est un proxy et plan de données auto-hébergé, hors processus, qui se place entre vos applications agentiques et les fournisseurs LLM ou sous-agents qu'elles appellent, gérant routage, orchestration, observabilité et garde-fous en une seule couche. Sa propre description GitHub le décrit comme « un serveur proxy et plan de données IA-natif pour applications agentiques », visant à extraire des préoccupations d'infrastructure comme le routage et la modération du code applicatif pour les placer dans une couche partagée et configurable.

  • Type de produit : un proxy/plan de données auto-hébergé que vous déployez vous-même (conteneur Docker ou binaire compilé), pas une API ou une passerelle SaaS hébergée
  • Développeur : Katanemo, selon l'organisation GitHub hébergeant le dépôt
  • Dépôt : github.com/katanemo/plano, créé le 9 juillet 2024
  • Licence : Apache 2.0, selon le fichier de licence du dépôt GitHub
  • Fondation : construit sur Envoy, le proxy edge/service open source largement utilisé, par des contributeurs ayant travaillé sur Envoy lui-même, selon le propre README de Plano
  • Ampleur : plus de 7 050 étoiles GitHub, 480+ forks et 140 issues ouvertes au moment de cette revue

Historique du projet Plano et jalons de versions

Le dépôt GitHub de Plano a été créé en juillet 2024, et le projet livre en continu depuis, en ajoutant des fonctionnalités de routage LLM, d'orchestration d'agents et d'observabilité en développement actif. Plano se positionne comme soutenu par la propre recherche LLM de Katanemo, y compris le modèle orchestrateur dédié utilisé pour ses décisions de routage.

  1. 1
    Dépôt créé — 9 juillet 2024
    Why it matters: Le dépôt GitHub canonique de Plano (katanemo/plano) a été créé, selon les métadonnées du dépôt GitHub.
  2. 2
    v0.4.36 — 19 août 2026 : version taguée la plus récente au moment de cette revue
    Why it matters: La dernière version publiée sur GitHub au moment de cette revue ; consultez directement la [page des releases](https://github.com/katanemo/plano/releases) pour tout ce qui a été publié après la date de publication de cette revue.
  3. 3
    Développement continu sur la branche principale
    Why it matters: Les métadonnées du dépôt GitHub montrent des commits poussés sur la branche principale après la dernière version taguée, indiquant un développement continu au-delà du dernier tag de version — vérifiez le statut actuel des releases avant de supposer une parité de fonctionnalités avec les derniers commits.

Que fait réellement Plano ?

L'ensemble de fonctionnalités de Plano vise à extraire les préoccupations d'infrastructure des applications agentiques du code applicatif pour les placer dans une couche proxy partagée et auto-hébergée. Voici ce que chaque partie fait réellement, selon le README GitHub et la documentation de Plano.

  • Orchestration d'agents — routage à faible latence entre les agents déclarés dans une configuration YAML, sans modifier le code applicatif ; de nouveaux agents peuvent être ajoutés en modifiant la configuration plutôt qu'en réécrivant la logique de routage
  • Routage de modèles (« Model Agility ») — route les requêtes par nom de modèle explicite, alias sémantique, ou automatiquement via des préférences configurées, afin que le code applicatif puisse appeler un nom de modèle logique plutôt qu'un fournisseur codé en dur
  • Agentic Signals — le terme propre à Plano pour la capture sans code de signaux d'usage/comportement, plus des traces et métriques compatibles OpenTelemetry émises sur chaque agent qu'il proxifie
  • Filter Chains de garde-fou et modération — un mécanisme configurable pour intégrer protection contre le jailbreak, politiques de modération et comportement de cohérence de mémoire dans la couche proxy plutôt que dans chaque agent individuel
  • Modèle de routage dédié — les décisions de routage passent par le propre modèle « Plano-Orchestrator » d'environ 4 milliards de paramètres plutôt que par un appel LLM généraliste ou un routeur purement basé sur des règles, selon le README de Plano
  • Agnostique au framework et au langage — les agents sont simplement des serveurs HTTP implémentant un point de terminaison de chat completions compatible OpenAI, donc Plano fonctionne avec des agents écrits dans n'importe quel langage ou framework IA
  • Mode passerelle LLM — Plano peut aussi être utilisé purement comme passerelle de routage LLM depuis des services applicatifs, indépendamment de ses fonctionnalités d'orchestration d'agents, selon sa propre documentation

Exemples d'utilisation : deux façons d'utiliser Plano

Ce sont des workflows concrets issus de l'exemple documenté du propre README de Plano — pas des cas d'usage hypothétiques.

Tarifs de Plano : est-il vraiment gratuit ?

Plano lui-même est gratuit et open source (Apache 2.0), sans frais de licence pour l'auto-hébergement. La nuance réside dans ce qui alimente son routage : Plano et la famille de LLM Plano (comme Plano-Orchestrator) sont hébergés gratuitement dans la région US-Central par Katanemo, explicitement pour offrir aux développeurs une première expérience sans configuration — selon le propre README du projet, ce niveau hébergé gratuit est destiné au développement, pas à l'échelle de production.

  • Le logiciel Plano lui-même : gratuit, open source, sous licence Apache 2.0, pas de niveau payant pour le proxy lui-même
  • Modèles de routage/orchestrateur de la famille Plano : hébergés gratuitement en US-Central pour une première expérience développeur, selon le propre README de Plano
  • Pour fonctionner à l'échelle de production, le README de Katanemo indique qu'il faut soit exécuter ces modèles de routage localement vous-même, soit contacter Katanemo via Discord pour des clés API hébergées — aucune page de tarification en libre-service publique n'a été trouvée pour cette option de clés hébergées lors de cette revue
  • Les coûts des fournisseurs LLM sont séparés : router des requêtes vers OpenAI, Anthropic ou d'autres fournisseurs via Plano coûte toujours ce que ce fournisseur facture — Plano lui-même n'ajoute pas de majoration, conformément à son rôle de couche de routage plutôt que de fournisseur de modèle

Plano vs. LiteLLM

Plano et LiteLLM sont tous deux des couches auto-hébergées pour gérer le trafic LLM, mais ils partent de postulats différents : LiteLLM est avant tout une API/SDK unifiée et un proxy pour appeler plus de 100 fournisseurs LLM via une interface compatible OpenAI, tandis que Plano est construit comme un plan de données basé sur Envoy avec l'orchestration d'agents comme fonctionnalité de premier plan, pas seulement le routage de modèles.

Fondation principale

Plano vs. LiteLLM:
Plano est construit sur le proxy Envoy ; LiteLLM est un SDK et serveur proxy Python natif, non basé sur Envoy.

Orchestration d'agents

Plano vs. LiteLLM:
Plano traite le routage multi-agents comme une fonctionnalité de premier plan via des agents déclarés en YAML ; LiteLLM se concentre principalement sur le routage LLM/fournisseur plutôt que sur l'orchestration agent-à-agent.

Mécanisme de routage

Plano vs. LiteLLM:
Plano utilise un modèle orchestrateur dédié d'environ 4 milliards de paramètres pour un routage basé sur l'intention ; LiteLLM route principalement via des règles de configuration explicites, l'équilibrage de charge et des listes de repli.

Observabilité

Plano vs. LiteLLM:
Plano appelle sa télémétrie « Agentic Signals » plus OpenTelemetry ; LiteLLM offre un suivi d'usage, des journaux de dépenses et des intégrations avec des outils d'observabilité comme Langfuse.

Licence

Plano vs. LiteLLM:
Les deux sont sous licence Apache 2.0 pour leur offre open source principale, selon le dépôt de chaque projet.

Les deux outils sont auto-hébergés et gratuits dans leur cœur ; le choix pratique dépend de si vous avez besoin d'une infrastructure proxy de niveau Envoy et d'une orchestration native d'agents (Plano) ou d'une passerelle plus simple axée sur le routage de fournisseurs avec une grande liste de compatibilité (LiteLLM). Vérifiez la parité actuelle des fonctionnalités sur la documentation de chaque projet avant de choisir, car les deux publient des mises à jour fréquentes.

Pour qui Plano est-il fait ?

Le choix de Plano dépend de si vous construisez des applications agentiques nécessitant une infrastructure partagée pour le routage, l'observabilité et les garde-fous, plutôt qu'un simple appel LLM unique.

Concurrents et alternatives

Plano est le plus souvent comparé à LiteLLM, AIClient2API et Langfuse — son principal élément différenciateur est d'être un plan de données basé sur Envoy avec orchestration multi-agents native, plutôt qu'une bibliothèque de routage purement applicative ou un outil dédié uniquement à l'observabilité.

Tool
Best known for
Link
LiteLLMProxy/SDK unifié pour appeler plus de 100 fournisseurs LLM via une API compatible OpenAIAvis LiteLLM
AIClient2APIProxy local léger qui convertit divers protocoles de clients IA en points de terminaison API unifiésAvis AIClient2API
LangfusePlateforme open source d'observabilité, de traçage et d'évaluation LLMAvis Langfuse

Cette liste reflète les outils couramment comparés à Plano dans l'espace routage/passerelle/observabilité, pas un classement indépendant de PromptQuorum — voir le Local LLM Software Directory pour le catalogue complet et régulièrement mis à jour, y compris l'entrée propre de Plano. Vérifiez les tarifs et fonctionnalités actuels de chaque outil avant de choisir.

Erreurs courantes lors de l'évaluation de Plano

La plupart des confusions autour de Plano viennent de son nom générique, d'hypothèses selon lesquelles il s'agirait d'un SaaS hébergé, ou d'attentes floues sur ce que couvre « gratuit ».

Questions fréquemment posées

Qu'est-ce que Plano ?

Plano (github.com/katanemo/plano) est un serveur proxy et plan de données IA-natif, gratuit, open source (Apache 2.0), basé sur Envoy, pour applications agentiques, développé par Katanemo, qui gère le routage LLM, l'orchestration d'agents, l'observabilité et les garde-fous.

Plano est-il gratuit ?

Oui, Plano lui-même est gratuit et open source, sans frais de licence pour l'auto-hébergement. Katanemo héberge aussi gratuitement les propres modèles de routage/orchestrateur de Plano dans la région US-Central pour une première expérience développeur ; un usage à l'échelle de production de ces modèles nécessite de les auto-héberger ou d'obtenir des clés API hébergées via Discord.

Comment installer Plano ?

Suivez le propre guide de démarrage rapide de Plano pour installer les prérequis, puis exécutez planoai up config.yaml face à une configuration YAML déclarant vos agents et fournisseurs de modèles.

Plano est-il un service hébergé ou un logiciel auto-hébergé ?

Plano est auto-hébergé : vous le déployez vous-même en tant que conteneur Docker ou binaire compilé, aux côtés de vos propres agents et services. Katanemo héberge séparément les propres petits modèles orchestrateurs de Plano gratuitement au niveau d'usage développement.

Que route réellement Plano ?

Plano route le trafic LLM et agent : il peut router entre plusieurs agents selon l'intention, et router les appels API LLM vers un modèle spécifique par nom explicite, alias sémantique, ou sélection automatique basée sur des préférences.

Plano est-il construit sur Envoy ?

Oui, selon son propre README, Plano est construit sur Envoy par des contributeurs ayant travaillé sur Envoy lui-même, fonctionnant comme un plan de données hors processus plutôt qu'une bibliothèque intégrée.

Qui développe Plano ?

Katanemo développe Plano, selon l'organisation GitHub hébergeant le dépôt katanemo/plano.

Plano fonctionne-t-il avec n'importe quel langage de programmation ou framework ?

Oui — les agents n'ont besoin d'implémenter qu'un point de terminaison HTTP de chat completions compatible OpenAI, donc Plano fonctionne avec des agents écrits dans n'importe quel langage ou framework IA, selon sa propre documentation.

Plano nécessite-t-il son propre modèle pour fonctionner ?

Les décisions de routage de Plano passent par son propre modèle orchestrateur dédié d'environ 4 milliards de paramètres, mais les réponses LLM réelles que vos agents utilisent peuvent provenir de n'importe quel fournisseur configuré (OpenAI, Anthropic, modèles locaux et autres) vers lequel Plano route le trafic.

En quoi Plano diffère-t-il de LiteLLM ?

Plano est un plan de données basé sur Envoy avec orchestration multi-agents native comme fonctionnalité centrale ; LiteLLM est un SDK/proxy natif Python centré principalement sur l'unification des appels vers plus de 100 fournisseurs LLM. Voir la comparaison Plano vs. LiteLLM ci-dessus pour les détails.

PromptQuorum a-t-il testé indépendamment les affirmations de Plano ?

Cette revue s'appuie sur le propre dépôt GitHub, README et documentation de Plano, plutôt que sur des tests pratiques réalisés par PromptQuorum.

Sources

← Retour aux LLM locaux avancés