CIIFragments Studio est agréée CII : récupérez jusqu'à 20 % de vos dépenses en développement logicielEn savoir plus

Intégration API Anthropic (Claude)

Un modèle qui appelle vos outils, pas un chat de plus

Nous exposons vos outils métier au modèle via MCP, puis nous câblons Claude sur les documents longs et les décisions à tracer. La résidence UE passe par un hébergeur, pas par l'API directe.

  • Équipe produit senior
  • serveurs MCP en production
  • résidence et budget cadrés
En bref

Pourquoi intégrer l'API Anthropic Claude dans une application métier ?

Les modèles Claude d'Anthropic se distinguent par leur capacité à appeler vos propres outils : le modèle analyse une demande, propose d'exécuter une action dans votre logiciel, et attend votre accord avant d'agir. Cela donne une frontière nette entre ce que décide le modèle et ce que fait votre système. On intègre l'API Anthropic quand on veut un assistant capable de lire un document, qualifier un dossier ou mettre à jour une fiche sans qu'un humain retranscrive le résultat. Le protocole MCP créé par Anthropic permet en plus de connecter le même outil à plusieurs agents sans redévelopper un connecteur par usage.

Cas d'usage

Quatre flux que nous câblons autour du modèle

01

Dossier long, réponse sourcée

Contrats, appels d'offres, documentation technique : le modèle répond en citant les passages, et le préfixe stable est mis en cache pour que relire le même dossier ne coûte pas le même prix à chaque question.

02

Vos outils exposés une seule fois

Un serveur MCP au-dessus de votre ERP, de votre CRM ou de votre base : déclaré une fois, réutilisé par l'agent, par l'éditeur des développeurs et par les automatisations.

03

Agent qui rédige et prépare

Compte rendu, devis, réponse type : le modèle produit le brouillon, l'écrit dans l'outil concerné sous forme de proposition, et laisse la validation à l'humain.

04

Reprise d'historique en masse

Classer ou enrichir des années d'archives en traitement de masse, à coût réduit, sans saturer le flux temps réel de vos utilisateurs.

Pour vous

Ce que ça change dans votre produit

Nous ne livrons pas un chat greffé sur le produit. Nous exposons vos outils proprement, puis nous laissons le modèle s'en servir sous contrôle.

Les documents longs deviennent exploitables

Ce que personne ne lisait devient interrogeable, avec les sources citées. Nous mesurons la proportion de réponses acceptées, pas le volume traité.

Un seul connecteur pour plusieurs usages

MCP évite de recâbler vos outils pour chaque nouveau besoin. L'investissement se fait une fois, il sert ensuite les suivants.

Le juridique a une réponse claire

Région d'inférence, sous-traitant, rétention : nous écrivons le schéma de flux, y compris le fait que l'API directe ne suffit pas pour la résidence.

La facture reste tenue

Cache sur les dossiers déjà lus, traitement de masse pour l'historique, plafond par parcours. Les gros dossiers cessent d'être la surprise de fin de mois.

Méthode

Ce qu'un connecteur Claude impose comme méthode

01

Surface d'outils

Quels outils le modèle peut appeler, avec quels droits, et lesquels restent hors de portée. Un serveur MCP se conçoit comme une API publique interne.

02

Choix d'hébergement

API directe, Bedrock ou Vertex : la contrainte de résidence tranche avant la préférence technique. La région se fixe au départ.

03

Cache et budget

Partie fixe du prompt en tête pour être mise en cache, traitement de masse basculé en Batch, plafond par parcours et alerte.

04

Écritures sous contrôle

Chaque outil qui écrit est idempotent et journalisé, avec un refus explicite quand le modèle n'a pas de quoi conclure.

L'API

Ce que permet Claude

Tool use explicite
Le modèle renvoie un bloc d'appel d'outil que votre serveur exécute ou rejette. La responsabilité reste chez vous, ce qui est exactement ce qu'un audit veut voir.
MCP en standard
Le protocole créé par Anthropic pour exposer outils et données. Un serveur MCP écrit une fois sert plusieurs clients, dont l'éditeur de vos développeurs.
Cache de prompt
Réutiliser un préfixe stable réduit fortement le coût des appels suivants, ce qui change l'économie des dossiers volumineux relus souvent.
Traitement par lots
L'API Batch traite les volumes non urgents à tarif réduit, utile pour les reprises d'historique et les enrichissements nocturnes.
Vocabulaire

Le vocabulaire Anthropic

Messages API
L'interface unique : une liste de messages, éventuellement des outils déclarés, et en retour soit du texte, soit une demande d'appel d'outil.
tool_use
Le bloc par lequel le modèle demande l'exécution d'un outil. Il ne l'exécute pas : c'est votre serveur qui décide, et c'est là que se pose le contrôle.
MCP
Model Context Protocol, standard ouvert pour exposer un outil ou une source de données à un modèle. Écrire un serveur MCP, c'est investir une fois pour plusieurs usages.
Cache de prompt
Marquer la partie stable d'un prompt pour qu'elle ne soit pas refacturée au plein tarif aux appels suivants. Suppose de placer le fixe en tête.
Bedrock et Vertex
Les deux voies d'accès aux modèles Claude depuis une région européenne. C'est par là que passe une exigence de résidence, pas par l'API directe.
API Batch
File de traitement asynchrone à tarif réduit, adaptée aux volumes qui peuvent attendre plusieurs heures.
À savoir

Ce que personne ne vous dit avant de signer

01

L'API directe ne règle pas la résidence européenne

Beaucoup d'intégrations démarrent sur api.anthropic.com puis découvrent, au moment de la revue juridique ou d'un appel d'offres public, que la région d'inférence n'est pas européenne. Le passage par Bedrock ou Vertex change l'authentification, les quotas et parfois les modèles disponibles : ce n'est pas une bascule de dernière minute.

02

Revendre un modèle n'est pas l'héberger

Une place de marché peut proposer Claude sans que l'inférence tourne sur son infrastructure dans la région annoncée. Si la résidence est contractuelle, la question à poser n'est pas quelle plateforme le propose, mais où le calcul a lieu.

03

Un serveur MCP est une surface d'attaque

Exposer vos outils à un modèle, c'est ouvrir une API. Droits par outil, secrets hors du serveur, journalisation des appels, et surtout aucun outil destructif exposé sans double validation.

04

Le cache se conçoit, il ne se constate pas

Le gain n'existe que si la partie stable du prompt est réellement stable et placée en tête. Un prompt assemblé dans un ordre variable annule le bénéfice sans que rien ne le signale.

Comparer

API directe ou hébergeur européen

Le même modèle, deux chemins d'accès. Le choix se fait sur la contrainte contractuelle de résidence, puis sur l'outillage dont vous disposez déjà.

CritèreAPI Anthropic directeLe plus simpleBedrock ou Vertex en UESous contrainte
Mise en routeUne clé, quelques heuresCompte cloud et IAM à cadrer
Résidence européenneNon garantieRégion européenne choisie
Authentificationx-api-keyIAM ou compte de service
Nouveaux modèlesDisponibles au plus tôtSouvent décalés
FacturationDirecte chez l'éditeurConsolidée avec votre cloud
QuotasPropres à l'éditeurPropres à l'hébergeur
Convient àProduit sans contrainte forteSecteur régulé, marché public

Nous isolons l'appel derrière votre propre interface, ce qui permet de démarrer en direct puis de basculer sur un hébergeur européen quand un client grand compte l'exige, sans réécrire la logique métier.

Notre expertise

Ce que nous tenons sur un projet Claude

MCP
outils exposés une fois, réutilisés partout
UE
région d'inférence tranchée avant le premier appel
cache
préfixe stable conçu pour être mis en cache
0
outil destructif exposé sans double validation

On combine Claude avec

Les briques qui rendent le flux exploitable

  • MCP
  • PostgreSQL
  • NestJS
  • AWS
  • n8n
FAQ

Intégration Claude : vos questions

En commençant par la surface d'outils, pas par le prompt. On décide quels outils le modèle peut appeler, avec quels droits, et lesquels restent hors de portée. Cette surface se matérialise le plus souvent par un serveur MCP au-dessus de votre ERP, de votre CRM ou de votre base, conçu comme une API interne avec ses droits et sa journalisation. Ensuite on branche la Messages API : le modèle propose un appel d'outil, votre serveur exécute ou refuse. Enfin on traite l'exploitation, c'est-à-dire la région d'inférence, le cache sur les préfixes stables, le plafond de dépense et le chemin dégradé.

Oui, mais pas par l'API directe, qui ne propose pas de région européenne dédiée. La voie utilisée est Amazon Bedrock ou Google Vertex dans une région européenne, Paris et Francfort étant les plus demandées en France. Ce n'est pas un simple changement d'URL : l'authentification passe par IAM ou un compte de service, les quotas sont ceux de l'hébergeur, et les nouveaux modèles y arrivent parfois plus tard. Attention aussi aux plateformes qui revendent Claude sans que le calcul ait lieu sur leur infrastructure dans la région annoncée : si la résidence est contractuelle, la question est où l'inférence tourne.

MCP standardise la façon d'exposer un outil ou une source de données à un modèle. Concrètement, au lieu d'écrire un connecteur par usage, vous écrivez un serveur MCP au-dessus de votre système, une fois, et il sert ensuite l'agent de votre produit, l'éditeur de vos développeurs et vos automatisations. Le bénéfice est un investissement mutualisé et un point unique où poser les droits et la journalisation. La contrepartie est qu'un serveur MCP est une API exposée : il se sécurise comme telle, avec des droits par outil et aucun geste destructif accessible sans double validation.

Le développement dépend surtout de la surface d'outils à exposer et du niveau de contrôle exigé sur les écritures : un assistant de lecture documentaire se chiffre bien plus bas qu'un agent autorisé à créer des pièces dans un ERP. La consommation dépend de la taille des contextes, et c'est là que les dossiers volumineux pèsent : le cache sur la partie stable du prompt et le basculement des traitements de masse en Batch changent significativement la facture. Nous cadrons un plafond par parcours et sa mesure dès la première mise en ligne.

Cette page traite du connecteur Claude : la Messages API, le tool use, le serveur MCP, la région d'inférence, le budget. Notre page d'expertise sur les agents traite du cadrage en amont, c'est-à-dire quel processus mérite un agent, quel niveau d'autonomie lui accorder et comment mesurer le résultat. Si vous savez déjà quel geste métier automatiser, cette page est la bonne. Si la question porte encore sur le périmètre, commencez par l'expertise.

Quels outils voulez-vous exposer au modèle ?

Dites-nous ce que Claude doit pouvoir lire et écrire. 30 minutes pour poser la surface d'outils, la région et le budget.

Parler de mon projet Claude
Parler de mon projet Claude