
Intégration API Anthropic (Claude)
Un modèle qui appelle vos outils, pas un chat de plus
Nous exposons vos outils métier au modèle via MCP, puis nous câblons Claude sur les documents longs et les décisions à tracer. La résidence UE passe par un hébergeur, pas par l'API directe.
- Équipe produit senior
- serveurs MCP en production
- résidence et budget cadrés
Pourquoi intégrer l'API Anthropic Claude dans une application métier ?
Les modèles Claude d'Anthropic se distinguent par leur capacité à appeler vos propres outils : le modèle analyse une demande, propose d'exécuter une action dans votre logiciel, et attend votre accord avant d'agir. Cela donne une frontière nette entre ce que décide le modèle et ce que fait votre système. On intègre l'API Anthropic quand on veut un assistant capable de lire un document, qualifier un dossier ou mettre à jour une fiche sans qu'un humain retranscrive le résultat. Le protocole MCP créé par Anthropic permet en plus de connecter le même outil à plusieurs agents sans redévelopper un connecteur par usage.
Quatre flux que nous câblons autour du modèle
Dossier long, réponse sourcée
Contrats, appels d'offres, documentation technique : le modèle répond en citant les passages, et le préfixe stable est mis en cache pour que relire le même dossier ne coûte pas le même prix à chaque question.
Vos outils exposés une seule fois
Un serveur MCP au-dessus de votre ERP, de votre CRM ou de votre base : déclaré une fois, réutilisé par l'agent, par l'éditeur des développeurs et par les automatisations.
Agent qui rédige et prépare
Compte rendu, devis, réponse type : le modèle produit le brouillon, l'écrit dans l'outil concerné sous forme de proposition, et laisse la validation à l'humain.
Reprise d'historique en masse
Classer ou enrichir des années d'archives en traitement de masse, à coût réduit, sans saturer le flux temps réel de vos utilisateurs.
Ce que ça change dans votre produit
Nous ne livrons pas un chat greffé sur le produit. Nous exposons vos outils proprement, puis nous laissons le modèle s'en servir sous contrôle.
Les documents longs deviennent exploitables
Ce que personne ne lisait devient interrogeable, avec les sources citées. Nous mesurons la proportion de réponses acceptées, pas le volume traité.
Un seul connecteur pour plusieurs usages
MCP évite de recâbler vos outils pour chaque nouveau besoin. L'investissement se fait une fois, il sert ensuite les suivants.
Le juridique a une réponse claire
Région d'inférence, sous-traitant, rétention : nous écrivons le schéma de flux, y compris le fait que l'API directe ne suffit pas pour la résidence.
La facture reste tenue
Cache sur les dossiers déjà lus, traitement de masse pour l'historique, plafond par parcours. Les gros dossiers cessent d'être la surprise de fin de mois.
Ce qu'un connecteur Claude impose comme méthode
Surface d'outils
Quels outils le modèle peut appeler, avec quels droits, et lesquels restent hors de portée. Un serveur MCP se conçoit comme une API publique interne.
Choix d'hébergement
API directe, Bedrock ou Vertex : la contrainte de résidence tranche avant la préférence technique. La région se fixe au départ.
Cache et budget
Partie fixe du prompt en tête pour être mise en cache, traitement de masse basculé en Batch, plafond par parcours et alerte.
Écritures sous contrôle
Chaque outil qui écrit est idempotent et journalisé, avec un refus explicite quand le modèle n'a pas de quoi conclure.
Ce que permet Claude
- Tool use explicite
- Le modèle renvoie un bloc d'appel d'outil que votre serveur exécute ou rejette. La responsabilité reste chez vous, ce qui est exactement ce qu'un audit veut voir.
- MCP en standard
- Le protocole créé par Anthropic pour exposer outils et données. Un serveur MCP écrit une fois sert plusieurs clients, dont l'éditeur de vos développeurs.
- Cache de prompt
- Réutiliser un préfixe stable réduit fortement le coût des appels suivants, ce qui change l'économie des dossiers volumineux relus souvent.
- Traitement par lots
- L'API Batch traite les volumes non urgents à tarif réduit, utile pour les reprises d'historique et les enrichissements nocturnes.
Le vocabulaire Anthropic
- Messages API
- L'interface unique : une liste de messages, éventuellement des outils déclarés, et en retour soit du texte, soit une demande d'appel d'outil.
- tool_use
- Le bloc par lequel le modèle demande l'exécution d'un outil. Il ne l'exécute pas : c'est votre serveur qui décide, et c'est là que se pose le contrôle.
- MCP
- Model Context Protocol, standard ouvert pour exposer un outil ou une source de données à un modèle. Écrire un serveur MCP, c'est investir une fois pour plusieurs usages.
- Cache de prompt
- Marquer la partie stable d'un prompt pour qu'elle ne soit pas refacturée au plein tarif aux appels suivants. Suppose de placer le fixe en tête.
- Bedrock et Vertex
- Les deux voies d'accès aux modèles Claude depuis une région européenne. C'est par là que passe une exigence de résidence, pas par l'API directe.
- API Batch
- File de traitement asynchrone à tarif réduit, adaptée aux volumes qui peuvent attendre plusieurs heures.
Ce que personne ne vous dit avant de signer
L'API directe ne règle pas la résidence européenne
Beaucoup d'intégrations démarrent sur api.anthropic.com puis découvrent, au moment de la revue juridique ou d'un appel d'offres public, que la région d'inférence n'est pas européenne. Le passage par Bedrock ou Vertex change l'authentification, les quotas et parfois les modèles disponibles : ce n'est pas une bascule de dernière minute.
Revendre un modèle n'est pas l'héberger
Une place de marché peut proposer Claude sans que l'inférence tourne sur son infrastructure dans la région annoncée. Si la résidence est contractuelle, la question à poser n'est pas quelle plateforme le propose, mais où le calcul a lieu.
Un serveur MCP est une surface d'attaque
Exposer vos outils à un modèle, c'est ouvrir une API. Droits par outil, secrets hors du serveur, journalisation des appels, et surtout aucun outil destructif exposé sans double validation.
Le cache se conçoit, il ne se constate pas
Le gain n'existe que si la partie stable du prompt est réellement stable et placée en tête. Un prompt assemblé dans un ordre variable annule le bénéfice sans que rien ne le signale.
API directe ou hébergeur européen
Le même modèle, deux chemins d'accès. Le choix se fait sur la contrainte contractuelle de résidence, puis sur l'outillage dont vous disposez déjà.
| Critère | API Anthropic directeLe plus simple | Bedrock ou Vertex en UESous contrainte |
|---|---|---|
| Mise en route | Une clé, quelques heures | Compte cloud et IAM à cadrer |
| Résidence européenne | Non garantie | Région européenne choisie |
| Authentification | x-api-key | IAM ou compte de service |
| Nouveaux modèles | Disponibles au plus tôt | Souvent décalés |
| Facturation | Directe chez l'éditeur | Consolidée avec votre cloud |
| Quotas | Propres à l'éditeur | Propres à l'hébergeur |
| Convient à | Produit sans contrainte forte | Secteur régulé, marché public |
Nous isolons l'appel derrière votre propre interface, ce qui permet de démarrer en direct puis de basculer sur un hébergeur européen quand un client grand compte l'exige, sans réécrire la logique métier.
Ce que nous tenons sur un projet Claude
Les autres modèles
Le bon choix dépend de la résidence des données et du geste métier, pas d'un classement.
Anthropic (Claude)Un modèle qui appelle vos outils, pas un chat de plusCette page
GeminiLa résidence UE par Vertex, et l'écosystème Google si vous y êtes déjà.
MistralL'option européenne, avec l'inférence sur api.eu.mistral.ai.
HeyGenNous développons votre connecteur HeyGen
ElevenLabsNous développons votre connecteur ElevenLabsTranscriptionNous développons votre connecteur de transcription
OpenAILa Responses API et le temps réel intégré, projet Europe dès la création.
CursorL'agent atteint vos outils internes, pas juste votre codeOn combine Claude avec
Les briques qui rendent le flux exploitable
Intégration Claude : vos questions
En commençant par la surface d'outils, pas par le prompt. On décide quels outils le modèle peut appeler, avec quels droits, et lesquels restent hors de portée. Cette surface se matérialise le plus souvent par un serveur MCP au-dessus de votre ERP, de votre CRM ou de votre base, conçu comme une API interne avec ses droits et sa journalisation. Ensuite on branche la Messages API : le modèle propose un appel d'outil, votre serveur exécute ou refuse. Enfin on traite l'exploitation, c'est-à-dire la région d'inférence, le cache sur les préfixes stables, le plafond de dépense et le chemin dégradé.
Oui, mais pas par l'API directe, qui ne propose pas de région européenne dédiée. La voie utilisée est Amazon Bedrock ou Google Vertex dans une région européenne, Paris et Francfort étant les plus demandées en France. Ce n'est pas un simple changement d'URL : l'authentification passe par IAM ou un compte de service, les quotas sont ceux de l'hébergeur, et les nouveaux modèles y arrivent parfois plus tard. Attention aussi aux plateformes qui revendent Claude sans que le calcul ait lieu sur leur infrastructure dans la région annoncée : si la résidence est contractuelle, la question est où l'inférence tourne.
MCP standardise la façon d'exposer un outil ou une source de données à un modèle. Concrètement, au lieu d'écrire un connecteur par usage, vous écrivez un serveur MCP au-dessus de votre système, une fois, et il sert ensuite l'agent de votre produit, l'éditeur de vos développeurs et vos automatisations. Le bénéfice est un investissement mutualisé et un point unique où poser les droits et la journalisation. La contrepartie est qu'un serveur MCP est une API exposée : il se sécurise comme telle, avec des droits par outil et aucun geste destructif accessible sans double validation.
Le développement dépend surtout de la surface d'outils à exposer et du niveau de contrôle exigé sur les écritures : un assistant de lecture documentaire se chiffre bien plus bas qu'un agent autorisé à créer des pièces dans un ERP. La consommation dépend de la taille des contextes, et c'est là que les dossiers volumineux pèsent : le cache sur la partie stable du prompt et le basculement des traitements de masse en Batch changent significativement la facture. Nous cadrons un plafond par parcours et sa mesure dès la première mise en ligne.
Cette page traite du connecteur Claude : la Messages API, le tool use, le serveur MCP, la région d'inférence, le budget. Notre page d'expertise sur les agents traite du cadrage en amont, c'est-à-dire quel processus mérite un agent, quel niveau d'autonomie lui accorder et comment mesurer le résultat. Si vous savez déjà quel geste métier automatiser, cette page est la bonne. Si la question porte encore sur le périmètre, commencez par l'expertise.
Quels outils voulez-vous exposer au modèle ?
Dites-nous ce que Claude doit pouvoir lire et écrire. 30 minutes pour poser la surface d'outils, la région et le budget.
Parler de mon projet Claude