ecloudserv docs

Modèles & serveurs MCP

Héberger un modèle de langage, et donner de vrais outils à un agent.

Deux briques distinctes : d'un côté des modèles hébergés chez vous, de l'autre des serveurs MCP qui permettent à un agent d'appeler vos outils et vos données.

Qu'est-ce que MCP#

MCP (Model Context Protocol) est un standard ouvert qui permet à un assistant d'appeler de vrais outils : lire un dépôt, interroger une base, chercher sur le web. Le serveur MCP fait le pont entre l'agent et l'outil.

  • Le client — l'assistant : Claude, un éditeur compatible, ou votre propre application.
  • Le serveur MCP — ce que vous hébergez ici : il expose des outils, et traduit les appels de l'agent.
  • L'outil — votre base, votre API interne, vos fichiers.

Déployer un serveur MCP#

1

Choisir un modèle de départ

Depuis ia.ecloudserv.fr, onglet MCP. Des modèles prêts existent pour les cas courants (fichiers, dépôt Git, base PostgreSQL), ou partez sur du sur-mesure avec votre propre paquet.

2

Renseigner ce dont il a besoin

Un jeton d'accès, une URL de connexion, un chemin. Ces valeurs deviennent des variables d'environnement du service : elles ne sont pas écrites dans le code.

3

Brancher votre client

Une fois le serveur démarré, vous récupérez son URL. Collez-la dans la configuration MCP de votre client.

Un serveur MCP est une porte d'entrée sur vos données

Un serveur qui expose vos fichiers ou votre base donne à l'agent — et donc à ce qui le pilote — un accès réel. N'exposez que ce qui est nécessaire, et préférez un compte en lecture seule quand la lecture suffit.

Modèles hébergés#

Vous pouvez faire tourner un modèle ouvert sur votre propre service. L'intérêt : les requêtes et les données ne sortent pas de votre infrastructure.

Choisir sa taille

Un modèle doit tenir en mémoire. Un petit modèle quantifié tourne sur une offre modeste ; un gros modèle demande beaucoup de RAM et reste lent sans carte graphique.

Astuce

La quantification (q4, q8…) réduit fortement la taille du modèle pour une perte de qualité souvent négligeable sur des tâches simples. C'est presque toujours le bon compromis pour démarrer — et le fichier à téléverser est bien plus petit.

Interroger le modèle

appel HTTP
curl http://mon-service:11434/api/chat \ -H "Content-Type: application/json" \ -d '{ "model": "mon-modele", "messages": [{ "role": "user", "content": "Bonjour" }] }'

À noter

Le port et le chemin dépendent du moteur d'inférence que vous installez. L'exemple ci-dessus suit la convention d'Ollama ; adaptez selon votre configuration.

Ce qui compte pour la confidentialité#

Un modèle hébergé chez vous ne transmet rien à un tiers. En revanche, si votre serveur MCP appelle une API externe, ce qui transite vers cette API en sort. Vérifiez ce que chaque outil branché envoie réellement, et à qui. Voir aussi Sécurité.