Pinterest met MCP en production et économise 7 000 heures par mois

Il existe déjà de nombreux articles sur MCP, mais la plupart se limitent à la présentation du protocole ou au nombre de serveurs connectés.

L'équipe d'ingénierie de Pinterest a récemment partagé son architecture MCP réelle en cours d'exécution dans l'environnement de production, avec des données concrètes et suffisamment de détails pour mériter un examen attentif.

Choix d'architecture : plusieurs serveurs dédiés, pas d'unification

Pinterest n'a pas créé un seul serveur MCP géant pour tout gérer. Leur approche est : chaque système de données central correspond à un serveur MCP indépendant.

Les principaux serveurs actuellement en service :

  • Serveur Presto : Requêtes de données
  • Serveur Spark : Débogage de tâches et analyse de logs
  • Serveur Airflow : Gestion des flux de travail
  • Serveur Knowledge : Documentation interne et base de connaissances

Pourquoi ne pas faire un serveur unifié ?

Leur raison : plusieurs serveurs permettent un contrôle d'accès indépendant, différentes équipes n'accèdent qu'à leurs domaines d'outils respectifs, évitant qu'un serveur ait trop de privilèges. En même temps, l'ensemble d'outils de chaque serveur reste léger, sans que le modèle ait à choisir parmi une multitude d'outils non pertinents.

Registre central : informer l'agent de ce qui est disponible

Pinterest a créé un registre central, servant de source faisant autorité sur les serveurs approuvés.

Avant d'appeler un outil, le client IA consulte le registre : ce serveur existe-t-il ? Ai-je la permission de l'utiliser ?

Cela résout un problème pratique : tous les outils de données ne devraient pas être ouverts à tous les employés. Par exemple, Presto (requêtes de données à grande échelle) ne peut être invoqué que par les membres de groupes métier spécifiques via des outils IA.

Détails de la conception de sécurité

Authentification à deux niveaux :

  1. Jeton JWT utilisateur : Vérifie qui opère (dans les scénarios avec intervention humaine)
  2. Identité Service Mesh : Les appels entre services utilisent l'identité de maillage

Ils ont choisi de ne pas adopter le flux OAuth standard de MCP, s'intégrant plutôt au système d'authentification interne existant — avec la justification de réduire les frictions liées à l'autorisation séparée de chaque serveur.

Il existe également une conception appelée elicitation : avant d'exécuter des actions à haut risque ou à coût élevé, l'agent doit demander une confirmation à l'utilisateur humain ; sans approbation, rien n'est exécuté. Cela crée un équilibre entre automatisation et sécurité.

Chiffres réels

En janvier 2025 :

IndicateurChiffre
Appels mensuels66 000
Utilisateurs actifs844
Gain de temps estimé par mois~7 000 heures d'ingénierie

7 000 heures/mois — en considérant qu'un ingénieur travaille environ 160 heures par mois, cela équivaut à économiser environ 44 personnes. Cette valeur est basée sur la somme du temps estimé économisé par appel d'outil, ce n'est pas un nombre exact, mais l'ordre de grandeur a une valeur de référence.

À noter

Dans l'article de Pinterest, il y a une phrase : Ce système a été intégré dans l'IDE que les ingénieurs utilisent quotidiennement, la plateforme de chat interne et les flux de travail IA — il n'a pas été créé un portail IA séparé que les ingénieurs doivent utiliser intentionnellement.

C'est le facteur clé du succès de l'IA d'entreprise : les outils doivent apparaître là où les travailleurs se trouvent, pas exiger qu'ils aillent ailleurs.

Source de référence : Pinterest Deploys Production-Scale Model Context Protocol Ecosystem for AI Agent Workflows (InfoQ) ; CocoLoop, Building an MCP Ecosystem at Pinterest (Pinterest Engineering Blog / Medium)